「编程代理」共找到 1260 篇相关文章
长生不老成真?哈佛AI数周破解「衰老密码」,人类寿命或迎重写
哈佛团队借助AI系统K-Dense揭示衰老分阶段运行的秘密。K-Dense采用层级多代理架构,能完整跑通研究流程,在BixBench测试中超越GPT - 5。它还让哈佛团队几周完成原本数年的研究,成果待同行评审。
OpenAI商业帝国野心初现,ChatGPT上线“即时结账”功能:聊天就能直接下单
OpenAI为ChatGPT推出“即时结账”功能,由代理商业协议(ACP)支持,可将用户产品发现对话转化为购买行为。商家能在需求源头捕获消费意向,用户可在对话内完成购买。目前仅在美国向美商开放。
CEO 上阵写代码,公司从被传濒临倒闭到千亿估值,最大功臣是Claude?
Airtable创始人兼CEO Howie Liu分享公司发展。Airtable曾被传濒临倒闭,后年收入达数亿美元。他亲自参与编程,围绕AI重组公司,还介绍推动团队用AI、岗位转型及公司转型AI的策略,强调打破角色壁垒。
吴恩达:一边是CS毕业生“过剩”,一边是AI人才抢破头,问题出在哪?「cs专业依然是王牌」
吴恩达分享对CS专业人才市场的观察,指出市场对AI开发者需求未满足,而新毕业CS学生失业率上升。根源是高校课程未跟上AI提升编程生产力的步伐,还阐述了AI工程师核心能力及人才短缺趋势等。
首个为手机而生的通用Agent?!苹果做不到的事,“野路子”智谱抢先实现了
苹果预计2026年升级Siri实现自主行动,但完整落地的执行型Agent仍未推出。8月20日,智谱发布AutoGLM 2.0,宣称是全球首个可在手机用的Agent,开创‘Agent + 云手机 / 云电脑’范式,能代理操作高频应用。
扩散模型+自进化:这篇论文让Deep Researcher错误率直降70%
论文提出测试时扩散深度研究代理(TTD-DR),将报告生成建模为扩散过程,有组件自进化机制和动态闭环设计。实验显示其在多领域研究任务超现有方案,为AI研究助手落地提供新范式。
全网实测开玩Fable 5.1,听说写作说话和真人没区别?
Anthropic发布Fable 5.1后,第三方跑分和个人实测出炉。ARC Prize测试成绩佳且成本降32%,网友用它做出多款游戏。科技媒体Every全面测评,指出其多方面优势与设计等短板,并给出使用边界。
Claude Sonnet 5 上线一日差评刷屏:打不过千问和 Minimax,性价比全面翻车
Claude Sonnet 5发布一天差评多。虽官方定位高,有能力亮点,但在中文测评中性价比低,测试成本高,且Max推理模式易过度思考。还因过度保守失去实用价值,其表现取决于使用场景和预算。
Claude Fable 5解禁,Sonnet 5发布,但各种骚操作封禁中国用户
6月30日深夜到7月1日凌晨,Anthropic宣布Claude Fable 5出口管制解除,7月2日恢复访问,还发布Sonnet 5。但此前安全研究者发现Claude Code在系统提示词里给中国时区和代理域名请求打暗号,Anthropic还收紧对中国账号封锁。
米哈游一夜烧掉200万元Token,大厂高管也开始质疑:Token烧不出价值,但养肥了谁?
Uber运营负责人质疑AI tokenmaxxing成本合理性,米哈游员工一晚烧200万Token。部分公司开始调整,如多邻国取消AI使用绩效评估,Shopify阻止失控消耗。Tokenmaxxing让模型厂商、编程工具和算力相关方受益,盲目跟风企业或成输家。