自我改进编程智能体」共找到 1680 篇相关文章

开源动态8

中科院开源PPT Agent,一键自动生成PPT智能体

中科院软件所等联合开源PPT Agent,它能分析参考幻灯片,按人类流程分两阶段生成PPT,有自我修正功能,测试显示在多维度优于现有方法,极大节省用户时间精力。

AIGC开放社区
开源动态7

MiniMax开源技能包:让AI写代码从大学生变资深工程师

MiniMax 官方开源 skills 仓库,能提升 AI 写代码质量,从‘大学生水平’升为‘5年+资深工程师’。其覆盖多种开发场景,支持四种主流 AI 编程工具,配置后重启可用,具体效果因场景而异。

AI工程化
8

吴恩达来信:认识新一代生成式AI应用工程师

吴恩达介绍新一代生成式AI应用工程师,指出其需具备利用AI构建模块开发应用、借助AI辅助编程能力,有产品能力是加分项,还分享面试考察内容与问题。

DeeplearningAI
开源动态7

HarnessEval 来了!开启 RSI 时代的新评测范式!

过去一年AI进入RSI时代,但评测方式仍停留在过去。MirroS联合多方发布HarnessEval,将Harness引入评测领域,使评测成为具备自我进化能力的智能系统,还率先应用于交互式世界模型评测。

特工宇宙
推荐文章8

“每给 Claude Code 提一个请求,我就点上一根烟,放松下”

OpenFGA 核心维护者 Siddhant Khare 写博客吐槽使用 AI 编程的‘疲惫感’,指出 AI 带来职业疲惫却被行业回避,还分析了原因,如任务量膨胀、角色转变等,并给出应对建议,引发工程师共鸣。

InfoQ
产品应用8

Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro

Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。

AI工程化
新闻资讯7

OpenRouter模型7月排名:谷歌遥遥领先,DeepSeek 令牌份额占比超越Anthtropic

OpenRouter公布7月模型排名,按模型令牌份额占比,谷歌以43.2%遥遥领先,DeepSeek 19.4%超Anthropic,OpenAI仅5.9%。编程领域Claude sonnet 4占比第一,谷歌Gemini 2.5pro进步大。

AI寒武纪
算法论文8

北大团队改造DeepSeek注意力,速度快四倍还不丢精度

北大张牧涵团队提出新稀疏注意力机制HISA,突破64K上下文索引瓶颈,相比DSA提速2 - 4倍,且不丢精度、即插即用。该机制分块级粗过滤和块内精挑字符两步,实测表现亮眼,也指出后续改进方向。

量子位
产品应用8

整整21个月,豆包大模型正式进入2.0时代!

时隔21个月,豆包大模型2.0正式推出。它在多模态理解、企业级Agent、推理和代码能力上有提升,在多个基准测评中达业界最优。实测显示其在编程、数学问题处理上性能出色,性价比也具优势。

量子位
产品应用8

Cursor 1.0 正式发布:AI 代码编辑器进入“自动审查 + 记忆”时代!

智能代码编辑器 Cursor 正式发布 1.0 版本,带来多项重磅功能,如自动代码审查助手 BugBot、Jupyter Notebook 原生支持、项目级 AI 记忆等,还提升了用户体验,是向“AI 编程操作系统”迈进的重要一步。

AI科技大本营