「自适应推理框架」共找到 3396 篇相关文章
Anthropic创始人盛赞Meta:开启广告基础设施「智能体进化」时代
Meta最新论文揭示基于树状思维链搜索的智能体框架,以“无人驾驶”方式重写广告系统底层内核,将内核开发时间从数周缩至数小时,生产环境性能最高提升17倍,Anthropic创始人高度评价。
1400亿,他带走AI芯片独角兽的核心班底
平安夜英伟达官宣200亿美元与AI芯片初创公司Groq交易,后澄清是技术许可协议。英伟达获技术授权并整合产品,Groq核心团队加入,其继续独立运营,这或为“人才收购”,剑指AI推理市场。
开源白嫖!微软这个开源 Agent,让 AI 帮你点按钮、填表格、跑多步流程(还可跨设备)
微软开源智能自动化框架 UFO,主线是 UFO³(Galaxy 多设备编排)+ UFO²(Windows 桌面 AgentOS)。能将多步任务拆分执行,解决跨应用、多步骤甚至跨设备任务难题,有多种功能亮点。
阿里发了个简历AI神器,大小仅0.6B
阿里巴巴集团研究团队开发出基于布局感知的简历解析框架,在简历解析任务准确率逼近Claude - 4等顶尖大模型,处理仅需1 - 2秒,直击自动化简历解析痛点,已在阿里HR系统全面部署。
一篇最新自演化AI Agents全新范式系统性综述
传统LLM Agent工作流固化,面对动态环境只能人工硬编码,成本高、迭代慢。此55页综述提出“Self - Evolving AI Agents”新范式,让Agent自主优化自身结构,还给出三定律、统一框架及各类优化方法。
Claude Opus 4.1 上线,SWE-bench 验证率 74.5%,重构可靠性与安全性全面升级
Anthropic推出Claude Opus 4.1,是Opus 4重要升级版。SWE - bench验证率从72.5%提至74.5%,多文件代码重构可靠性及长链交互推理能力增强,无害响应率提升,合作率下降,定价不变。
GPT-5真的拉胯吗?机器之心一手实测,网友:还我4o、还我4.5
OpenAI发布GPT - 5后评价褒贬不一。有人认为它进步大,也有人差评,如制作游戏、重构代码失败。机器之心实测发现其表现不稳定,写作、推理、编码能力有好有坏,复杂任务表现欠佳。
北大-灵初重磅发布具身VLA全面综述!一文看清VLA技术路线与未来趋势
GPT-4o等多模态基础模型发展,让研究者探索将智能延伸到物理空间,VLA模型受关注。北大 - 灵初联合实验室从动作词元化视角提出新框架,分析主流action token,还介绍了VLA发展趋势及面临挑战。
AI操作网页:browser-use和AI大模型互动解析
文章深入解析开源框架browser - use与AI大模型互动方式。它能自动化在线任务,靠精巧prompt设计和不同类型Message输入实现高效交互,还总结出可用于其他大模型交互场景的技巧。
ICML 2026 | 大模型为什么算不对加法?南大团队提出等本位和轨迹,揭示LLM算术错误的几何机制
南大团队研究LLM在多操作数加法中的内部表征结构,发现算术状态呈高度结构化几何流形。提出等本位和轨迹与噪声量化模型,解释模型算错加法原因,还设计推理时纠错方法。