「智能体推理」共找到 5118 篇相关文章
MASFactory: 多智能体系统开发进入Vibe Graphing时代
AI能力迭代,多智能体编排却停留在旧阶段。北京邮电大学GAMMA Lab团队发布MASFactory,用Vibe Graphing编排多智能体系统,融合多种开发方式,有全栈可视化等优势,还给出实用案例和开源代码。
从豆包手机谈起:端侧智能的愿景与路线图
近日,字节跳动发布豆包手机助手,标志大模型应用从‘Chat’迈向‘Action’。文章解析其关键技术,指出虽具实用价值,但端侧智能体面临安全、自主任务、个性化服务等挑战,还展望了手机助手与端侧智能体的未来发展。
面壁智能开源 EdgeClaw,一款安全高效端云协同的龙虾 Agent。
当下AI Agent端侧常被忽视,数据任务都涌向云端致隐私泄露和算力浪费。近期面壁智能等联合开源EdgeClaw,以三级安全和性价比感知协同机制,解决OpenClaw数据泄露、token成本高等问题。
Graph工程的尽头是,Ontology工程
15家机构联合发布图工程系统性综述,指出此前“XX工程”范式多优化单个智能体,而图工程能将智能提升到系统层面。论文还指出图工程语义局限,认为本体工程可作下一代系统智能语义地基。
AI开始学会合作?!实测4大多Agent体=10个打工人
Agent热潮进入多智能体时代,多款产品涌现。鲸哥测评了它们在商业计划、运营设计等四大场景表现,总结各产品亮点与不足,指出多Agent正推动大模型向“协作式智能群体”演进。
Multi-Agent记忆系统MIRIX:比RAG性能飙升35%,存储减少99.9%
现有AI Agent记忆方案有局限,MIRIX作为模块化多智能体记忆系统应运而生。它由六种记忆类型和多智能体框架组成,支持多种检索功能。在多模态和单模态测试中表现优异,为记忆增强型LLM智能体设新标准。
跳出超级 App 之争,鸿蒙系统级智能如何改写 AI 赛道规则?
2025年AI热潮转向落地场景深耕,华为鸿蒙在终端操作系统层面开辟新赛道。其通过鸿蒙智能体框架打破‘APP孤岛’,走‘C+B’差异化路线,还推出开放平台等繁荣生态,推动终端智能化迈进。
TRM思考奖励模型上线,大模型推理质量终于能量化了 | ICML‘26 Oral
大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。
腾讯提出“我思故我玩”Agent:LLM构建推理与规划世界模型
腾讯与武大联合发表论文提出 CEL 新型 Agent 架构,通过 LLM 驱动两阶段循环实现“思考式学习”。它能填补传统方法短板,在小游戏实验中表现出色,有可解释性等优势,但也有实验环境局限等问题。
Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升
当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。