「AI coding agent」共找到 10842 篇相关文章

新闻资讯8

MMLab@HKU 闪耀 CVPR 2025!与全球顶尖学者共话 AI 前沿

CVPR 2025 于 6 月 11 日至 15 日在美国纳什维尔举行,MMLab@HKU 携 24 篇高质量论文亮相。其还是三项国际竞赛的发起与主办方,主办六项前沿活动,研究成果展示了多领域进步。

AI科技评论
新闻资讯8

斯坦福临床医疗AI横评,DeepSeek把谷歌OpenAI都秒了

斯坦福最新大模型医疗任务评测,构建含35个基准测试的MedHELM综合评估框架。结果显示,DeepSeek R1以66%胜率领先,o3 - mini等模型也各有表现,还分析了成本效益。

量子位
产品应用7

Cursor 内置三大文档工具,为AI 编程注入精准上下文

大模型编程易因知识陈旧致代码出错,为其提供实时上下文是关键。Cursor 有 @Docs、@Web、MCP 三大文档工具,能处理不同文档,还可协助创建和更新文档,弥合模型知识与项目需求的鸿沟。

AI工程化
算法论文8

何恺明等降维打击!彻底颠覆AI生图,无需预训练一步到位

何恺明团队推出生成模型MeanFlow,它跳脱传统训练范式,无需预训练等,仅一次函数评估就能完成生成。在ImageNet 256×256上表现优越,缩小了一步与多步模型性能差距。

新智元
算法论文8

「边思考、边搜索、边写作」WebThinker开启AI搜索&研究新纪元!

大型推理模型有推理能力,但静态知识限制其在复杂任务表现。WebThinker 让 LRM 推理中自主搜索、导航及写报告,集成探索器,有自主策略和训练工具,实验显示性能强,还指明未来探索方向。

机器之心
新闻资讯7

OpenAI发力AI应用!前Meta产品总裁将任应用部门CEO

Sam Altman宣布生鲜电商平台Instacart首席执行官Fidgi Simo加入OpenAI,担任新设立的应用部门CEO。该部门将整合业务和运营团队,推动研究成果惠及全球用户,实现规模化扩张。

AI工程化
推荐文章8

一篇讲透Agent自进化飞轮怎么搭:评测→记忆→落地→控制

文章指出多数团队评测、记忆、Self - Improve 拆分做,飞轮难转,原因是环节衔接断链。基于行业研究及实践,提炼评测→记忆→落地→控制四齿飞轮方法论,阐述各环节核心矛盾、建设要点、避坑指南及咬合形成飞轮的方法。

腾讯技术工程
推荐文章8

刚刚,翁荔博客又上新:通过Harness工程实现AI自我提升

翁荔新博客聚焦Harness Engineering,梳理围绕‘Harness自我优化’的研究,探讨递归式自我提升发生层面,还指出自动化研究和自我提升系统面临的瓶颈,如评估标准模糊、奖励作弊等。

机器之心
产品应用7

Anthropic发布Claude Science,AI开始像研二学生一样做科研

当地时间6月30日,Anthropic发布科研产品Claude Science。它运行Claude Opus 4.8,亮点在使用方式,将科研所需整合,还能拆分任务。早期用户反馈良好,与OpenAI、谷歌竞争,已开放测试版。

DeepTech深科技
产品应用7

80%代码由Claude合并,Anthropic内部人员点破Agent真相:「Close the Loop」

Anthropic团队研究产品经理Theo演讲指出,Claude已深入其工程流程,超80%代码由它合并。模型角色转变,能力提升,失败率下降。开发者应升级研发战术,如刷新评估基准、精简“脚手架”、闭环设计。

机器之心