多模态智能体」共找到 4136 篇相关文章

算法论文8

GPT-4V仅达Level-2?全球首个多模态通才段位排行榜发布,General-Level打造多模态通用AI评测新范式

General-Level团队提出全新评测框架General-Level和数据集General-Bench,构建超大规模评测基准和多模态通才模型排行榜。其用五级段位系衡量模型通才能力,General-Bench覆盖多模态任务,排行榜分多层次榜单,目前各模型段位差异大,Level-5空缺。

量子位
推荐文章8

Efficiency Law, 物理精确世界模型,及世界模型引擎驱动的具身智能学习新范式

2025年秋具身智能赛道火热,特斯拉、英伟达动作不断,数据问题成落地症结。跨维智能贾奎、港中大(深圳)刘桂良探讨突破具身智能学习枷锁的方法,提出Efficiency Law和GS - World世界模型引擎及新学习范式。

机器之心
开源动态7

MASFactory: 多智能系统开发进入Vibe Graphing时代

AI能力迭代,多智能编排却停留在旧阶段。北京邮电大学GAMMA Lab团队发布MASFactory,用Vibe Graphing编排多智能系统,融合多种开发方式,有全栈可视化等优势,还给出实用案例和开源代码。

深度学习自然语言处理
推荐文章8

为什么说多模态是推荐系统破局的关键?来自饿了么一线的实战复盘

文章围绕多模态推荐展开,从传统推荐算法演进到多模态表征技术,结合饿了么场景实践,还探索生成式推荐。介绍多模态推荐挑战与代表性工作,梳理表征技术发展,详述饿了么系统设计与训练,分析生成式推荐方案及业界路线。

阿里云开发者
新闻资讯8

从豆包手机谈起:端侧智能的愿景与路线图

近日,字节跳动发布豆包手机助手,标志大模型应用从‘Chat’迈向‘Action’。文章解析其关键技术,指出虽具实用价值,但端侧智能面临安全、自主任务、个性化服务等挑战,还展望了手机助手与端侧智能的未来发展。

AI前线
开源动态7

面壁智能开源 EdgeClaw,一款安全高效端云协同的龙虾 Agent。

当下AI Agent端侧常被忽视,数据任务都涌向云端致隐私泄露和算力浪费。近期面壁智能等联合开源EdgeClaw,以三级安全和性价比感知协同机制,解决OpenClaw数据泄露、token成本高等问题。

开源星探
算法论文8

Graph工程的尽头是,Ontology工程

15家机构联合发布图工程系统性综述,指出此前“XX工程”范式多优化单个智能,而图工程能将智能提升到系统层面。论文还指出图工程语义局限,认为本工程可作下一代系统智能语义地基。

PaperAgent
产品应用7

AI开始学会合作?!实测4大多Agent=10个打工人

Agent热潮进入多智能时代,多款产品涌现。鲸哥测评了它们在商业计划、运营设计等四大场景表现,总结各产品亮点与不足,指出多Agent正推动大模型向“协作式智能”演进。

鲸选AI
8

跳出超级 App 之争,鸿蒙系统级智能如何改写 AI 赛道规则?

2025年AI热潮转向落地场景深耕,华为鸿蒙在终端操作系统层面开辟新赛道。其通过鸿蒙智能框架打破‘APP孤岛’,走‘C+B’差异化路线,还推出开放平台等繁荣生态,推动终端智能化迈进。

AI科技大本营
7

AI修真的一年:学者们怎么看“真智能”?|甲子光年

甲子光年在年终盛典对话三位学者,探讨AI“真假智能”。学者们提及强化学习、推理、多模态等技术突破,分析研究路径,还谈选择标准与未来期待,指出AI是工程实践命题,真与假关乎信念选择。

甲子光年