「多模态系统」共找到 2532 篇相关文章
分化、新范式、Agent 与全球 AI 竞赛,中国模型主力选手们的 2026 预测
AGI-Next 2026活动聚集众多国内大模型核心人物,「海外独角兽」总结出40条重要判断。涉及模型分化、新范式(自主学习、原生多模态)、Agent、全球AI竞赛等方面内容,对AI未来发展趋势做出探讨。
经验记忆黑科技:LightSearcher让AI工具调用减39.6%、推理快48.6%
现有的 RL 驱动的深度思考大模型系统面临准确率与效率的「跷跷板」困境,北邮百家 AI 团队提出 LightSearcher 框架,解决了这一痛点,在保持准确率的同时,显著提升了工具调用效率。
透视Chiplet生态版图
随着摩尔定律逼近极限与AI算力需求爆发,集成电路产业从“单芯演进”迈向“系统集成”,Chiplet技术成关键。此报告剖析欧美政府项目战略及国际巨头的竞争态势,还探讨中国企业突围之路。
AgentScope x RocketMQ:打造企业级高可靠 A2A 智能体通信基座
文章介绍 Apache RocketMQ 新推的 LiteTopic 通信模型,能简化 AI 系统架构、提升稳定性。结合 A2A 协议与 AgentScope 框架案例,剖析智能体通信实践与技术实现,还给出构建多智能体应用的实战方案。
自写驱动越狱!Gemini 3 Pro零败绩通关宝可梦:效率碾压前代8倍「Agent进化太快了」
在全自动《宝可梦 水晶版》对决中,Gemini 3 Pro击败Gemini 2.5 Pro,通关速度至少快2倍,前代或慢8倍。它还展现出诸多能力,如自写驱动绕过限制等,但也存在不验证假设等局限。
告别「手搓Prompt」,前美团高管创业,要让物理世界直接成为AI提示词
在2025年AI硬件赛道火热背景下,Looki创始人孙洋团队打造Looki L1可穿戴设备,将自动驾驶逻辑用于生活场景,转化视听信号为模型上下文,构建用户专属数据飞轮,让AI实现主动共鸣。
「Memory as a Context」是否将重新定义 Transformer 的 「记忆模式」?
本期机器之心PRO会员通讯解读3个AI业内要事,包括「Memory as a Context」能否重新定义Transformer记忆模式、世界模型发展情况,以及OpenRouter联合a16z发布的《State of AI》报告。详细探讨了谷歌Titans架构及其理论框架MIRAS,还提及业界对LLM记忆力的改进方案。
OpenAI:人&AI对齐技术应该是一个动态、双向的循环
在NeurIPS 2025上,NYU&OpenAI就Human - AI Alignment发布Tutorial。指出当前对齐像打地鼠,根源是将其当成静态、单向的,提出HAA框架,强调多元目标、人类全链路话语权及社会 - 技术系统量化监督。
告别“试验田”:当大模型真正嵌入 ERP、供应链与核心决策流 | AICon
文章围绕大模型嵌入企业核心系统展开,邀用友罗小江等担纲。介绍鞍钢赵伟升级 RAG 技术、用友罗小江构建决策架构、京东耿东阳用大模型优化供应链的案例,为企业数智化转型提供参考。
从 LLM 到 World Model:为什么我们需要能理解并操作世界的空间智能?
文章指出 LLM 仅靠语言不足以支撑真正智能,构建空间智能与世界模型成关键方向。2024 年李飞飞等创立 World Labs,11 月推出 3D 世界生成模型 Marble,本文探讨空间智能重要性及世界模型如何成转变基础设施。