「多智能体架构」共找到 7478 篇相关文章
GAIR Live 预告|世界模型——通向通用智能的关键拼图
随着AGI议题升温,‘世界模型’成前沿焦点。GAIR Live将邀顶尖学者与专家,探讨其定义、趋势等问题,还有直播议题如Lecun观点看法、不同领域世界模型差异等。
一站式智能分析引擎,快速构建企业级数据分析 Agent
在数据驱动的商业环境中,传统数据分析流程有诸多局限。本文介绍基于阿里云实时数仓 Hologres 和阿里云百炼的联合方案,结合 Function AI 平台,可构建企业级数据分析 Agent,实现端到端加速。
OpenAI自曝:AI推理砸钱越多,碾压人类越狠!
OpenAI研究员探讨推理模型时代。Noam Brown强调预训练和推理范式,指出当前AI胜在通用性。推理范式成本低、效果好,如o系列模型表现出色。首席经济学家谈AI经济影响,称其重塑企业格局。
对话刘靖康:镜头之外的「智能」和「审美」,才是 Camera Agent 的主战场
影石 Insta360 创始人刘靖康在 AGI Playground 2026 上提出未来影像设备“前轻后重”趋势。他介绍了 Cameraman 愿景,涵盖 Imaging、AI、Robotics 三技术方向,还提到云端 AI 剪辑服务情况及对行业多方面的见解。
具身智能“高考”难疯了!人类100分,最强模型12.8
原推出RoboTwin系列基准的团队带来RoboDojo,这是统一的仿真+真实世界机器人操作评测基准。它设42个仿真任务、18个真实任务,让30个主流策略竞技,结果显示机器人距通用操作差距大。
具身智能空间视觉死穴,终于被最新顶会彻底解决!
招商局先进技术研究院下属实验室提出新的移动数据范式,以极低成本破解 VLA 的空间泛化瓶颈。研究团队识别出 VLA 模型三种捷径学习模式,提出层次化数据解耦策略,该方案在主流 VLA 模型上验证有效。
《动手写AI Agent》多模型适配:一套代码跑通三家 LLM
上一章用火山引擎豆包 API 写了能跑的 Agent,但换模型重写代码会混乱。本章用 Adapter 模式解决问题,介绍火山引擎、Claude、OpenAI 三家 API 关键差异,还分析了 Claude 工具调用格式特殊之处。
龙虾之后,为什么说「主动式智能」才是Agent的终极形态?
OpenClaw爆火展现AI Agent主动性,但止步屏幕。Looki最新上线Proactive Intelligence Engine,将自动驾驶工程范式迁移到可穿戴设备,实现从被动到主动的跨越,面临技术和隐私挑战。
Kimi新架构让马斯克叹服!17岁高中生作者一战成名
17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。
刚开源的口袋级TTS,CPU 即可多语言本地畅用,爽!
传统TTS模型对个人开发者和边缘设备不友好,最近Github上开源的Pocket - TTS仅100M参数,能在普通CPU上超实时语音合成,支持语音克隆,安装简单,适合多种本地语音开发场景。