「工程师能力」共找到 3505 篇相关文章
Karpathy力荐必读博客:代码功底,决定AI「开挂」倍数!
Karpathy推荐Atharva博客,指出AI是工程师能力放大器,扎实编程基础搭配精准提示,能借AI打造极致产品。文章还给出用AI开发的策略、战术,以及数据库优化实例。
o3 Gemini 都翻车?首个可验证长链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界
GUI 智能体发展遇瓶颈,现有数据集难评估其长时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有长链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有模型瓶颈。
Coding Agent 自主解题很强,但用户改一行代码就"翻车"?自所团队提出 SWE-Touch 揭示共享工作空间下的能力缺口
当前基于大模型的Coding Agent是热门研究方向,现有评测多假设其独占代码仓库。中科院自动化所团队构建SWE - Touch框架,对9个前沿模型测试,发现用户干预下模型性能下降、排名洗牌。
顶级工程师Karpathy的“AI革命”:一个月前还在焦虑“落后”,如今“20年古法编程习惯”被彻底颠覆,80%代码已交给AI!
顶级工程师Andrej Karpathy分享用Claude编程心得,称过去20年编程方式在几周内改变,12月约80%代码交agent,自己做20%修改。Claude和Codex在2025年12月跨过‘一致性/连贯性门槛’,让agent编程可行。
π0.7的泛化能力有多强?零样本纯靠口述就能用空气炸锅,演示完换个机械臂也能叠衣服
2026年4月16日,美国明星机器人AI公司Physical Intelligence发布模型π0.7。它具组合泛化能力,借助多模态提示框架,能零样本完成新任务。在空气炸锅、叠衣服等实验中表现出色,有望推动具身智能发展。
谢尔盖·布林重启「创始人模式」?谷歌组建「突击队」,重押「AI编程」
近日媒体报道,谷歌组建由研究人员和工程师构成的“突击队”,提升AI编程模型能力,推动编码工作自动化。谷歌创始人谢尔盖・布林等参与其中,因Anthropic发布模型刺激,谷歌急起直追。
Agent失忆怎么办,Anthropic教你做好工作交接
文章指出AI Agent跨上下文窗口执行长任务时易失败,Anthropic用Opus 4.5实验发现,问题根源是交接差。解决办法是让Agent像人类工程师一样留文档、进度和测试,拆分流程,严格规范,提升测试覆盖率。
Anthropic:现在学习FDE,年薪百万!
Anthropic大佬分享FDE岗位价值,指出其非外包,是面向客户的软件工程师。还阐述适合的人才、团队,纠正三大误区,强调客户买的是解决问题的过程,现场沟通能力正升值。
Anthropic用GAN思路解决AI产出质量问题
Anthropic工程师发现AI会自我欺骗,无法准确评价自己工作。他们借鉴GAN思路,让Generator生成、Evaluator验收。校准Evaluator使其严格,还为前端设计定审美标准,实验证明挑刺搭档能提升AI产出质量。
10 万 Star 的反常识:AI 写代码的瓶颈从来不是代码本身
GitHub上的Superpowers开源项目,半年攒10.9万Star。它是AI编程工具的工作流操作系统,让AI像工程师工作,有面试需求、细化计划等流程,内置14个技能,安装简单,理念超前但也有局限。