编程能力评估」共找到 4430 篇相关文章

推荐文章8

Vibe Coding 方法论:不会编程的人如何用 AI 写出能跑的代码

文章介绍 Vibe Coding 方法论,即便不会编程,也能用 AI 写出能跑的代码。核心是把需求说清楚,还可小步迭代开发,Claude 这类会主动询问的工具更适用,同时要明确其适用场景。

宝玉AI
推荐文章8

AI 开发时代的“能力暴露与禁止空间”方法论:TPDD 与高层测试闭环

文章指出大模型加速软件开发范式演进,AI 深度介入开发带来新生产路径,但也放大风险。作者提出 TPDD 方法论,通过提前定义测试点与边界条件,平衡能力利用与风险控制,确保系统可控、安全、可持续。

InfoQ
产品应用7

姚顺雨Agent能力交卷!腾讯混元Hy3把元宝练成了打工人

腾讯混元Hy3正式版发布,总参数295B、激活参数21B,最大支持256K上下文。它是快慢思考融合的MoE模型,重点提升Coding和Agent能力。其加持下,元宝大升级,能完成办公、生活等多场景任务。

量子位
新闻资讯7

程序员不再写代码,而是靠「感觉」!年度热词Vibe Coding背后的编程革命

‘vibe coding’被《柯林斯词典》评为2025年度词汇,它指用自然语言提示让AI协助编写代码。从键盘到语气,从逻辑到氛围,AI改写编程,也改变人类语言与思维,理性与感性开始融合。

新智元
7

DeepSeek V4永久降价!缓存命中再打1折,实测编程成本骤降83%

DeepSeek两天连续两次降价,输入输出2.5折,命中缓存输入折上再1折且无时限。实测编程成本骤降83%,此前31.73元,打折后只需5.34元。其曾引发价格战,此次对海外用户冲击更大。

量子位
新闻资讯8

澳洲放羊大叔引爆AI编程革命!Claude Code急推goal模式,不干完不许停

澳洲牧羊大叔用三行bash解决AI编程‘把事做完’难题,11天内被OpenAI、Anthropic和Hermes收编。Claude Code推出/goal功能,各公司实现路径不同,争的是工作流入口。

新智元
新闻资讯8

Gemini 3 Flash 发布,多、快、好、省,Coding 能力不输大哥Gemini 3 Pro

Google DeepMind 发布 Gemini 3 Flash,成本极低。它在多项测试表现出色,速度快、效率高,代码能力超 Gemini 3 Pro,获企业客户好评,今日起向全球开发者和普通用户推送。

AGI Hunt
推荐文章7

从 AI 创业角度看 GEO:如何引流、效果评估,以及创业机会在哪里?

文章从AI创业角度剖析GEO,介绍其原理、内容优化策略、实操建议、效果评估搭建、代表产品等,指出GEO与SEO不同,虽有争议但值得做,还探讨了相比SEO的更多想象空间。

Founder Park
新闻资讯7

谢赛宁回忆七年前OpenAI面试:白板编程、五小时会议,面完天都黑了

Meta研究者Lucas Beyer在𝕏发起AI大厂面试体验投票引关注。谢赛宁回忆在多家大厂面试经历,如DeepMind考百余问题,Meta FAIR重学术交流,OpenAI五小时白板编程等,还分享了其他人的面试趣事。

机器之心
算法论文8

RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能

普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。

机器之心