「大型混合推理模型」共找到 2313 篇相关文章
挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因
随着大语言模型发展,多智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。
长视频生成可以回头看了!牛津提出「记忆增稳」,速度提升12倍
牛津大学团队提出VMem,把「看过什么」写进几何小片,用基于3D几何的记忆索引替代短窗上下文,实现「一致性更强、资源更省、速度更快」,实测速度比常规管线快约12倍。
EMNLP2025 | 揭开LLM训练数据中的中文污染真相,有比“您好”高2.6倍的token?
近年来,大型语言模型虽成功,但训练数据易混入不良内容。论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》探索此问题,定义PoC Token,开发PoCDetect和PoCTrace工具,揭示LLMs训练数据污染情况。
首个为具身智能而生的大规模强化学习框架RLinf!清华、北京中关村学院、无问芯穹等重磅开源
人工智能从‘感知’迈向‘行动’,具身智能成焦点。当前强化学习框架对具身智能支持受限,清华等机构联合开源面向具身智能的框架RLinf,提出混合式执行模式,设计灵活可扩展,在多方面表现出色。
Skywork技术论坛一手分享:Agent与多模态的落地真相|甲子光年
8月19日,昆仑万维发起第一期Skywork全球技术论坛讨论会,众多高校和企业嘉宾围绕Agent与多模态展开交流。探讨了Agent商业化、多模态应用等核心问题,提出诸多判断,指出行业热度高但落地是关键。
突破Claude-4编程上限!自进化Agent框架拿下新SOTA,底模越好性能越高,已开源
中科院、清华等提出SE - Agent自进化框架,突破Claude - 4编程上限。它让智能体系统性修订、重组与精炼思考过程,在SWE - Bench Verified上刷新开源框架SOTA,已开源。
首个企业级智能体全开源!京东云将Agent门槛直接给打没了
京东云JoyAgent成为首个100%开源企业级智能体,完整能力全部开源,企业开发者可本地独立部署。它多智能体协同能力强、性能一流,还具多项技术创新,解决了企业AI落地难题。
李开复入场Agent!零一万物推出“万仔”,直接对话CEO走独特“一把手工程打法”
今早,李开复宣布零一万物升级万智平台2.0并推出企业级Agent智能体。他指出AI Agent正重构企业架构,零一万物采用“一把手工程打法”,万智2.0有五大功能,还预计了AI Agent三个演进层级。
全球首个IMO金牌AI诞生!谷歌Gemini碾碎奥数神话,拿下35分震惊裁判
谷歌DeepMind官宣Gemini Deep Think在IMO获官方认证金牌,4.5小时解5题得35分。它用纯英语解题,结合并行思考与强化学习训练。谷歌后续将向部分测试者及订阅者推出模型,还公开了解题过程。
Gemini 2.5 Pro 负责人:最强百万上下文,做好了能解锁很多应用场景
谷歌DeepMind长上下文预训练联合负责人Nikolay Savinov在播客中分享Gemini 2.5长上下文技术。他认为长上下文能革新产品交互,与RAG协同,未来千万级token上下文将成标配,但当前百万级未达完美时扩规模意义不大。