「多智能体推理能力」共找到 7095 篇相关文章
ACL 2026|Doc-V*:读100页文档不如只翻对5页,80页场景「暴打」RAG 10个点
Doc-V*由小米和华中科技大学团队提出,是多页文档理解新范式,通过交互式视觉推理让模型有策略地读长文档。它在多页文档问答基准上比RAG变体提升49.7%,不依赖大模型或长上下文窗口。
Agent 的第一性问题:Proactive 与 Context 经济学
过去一年AI Agent能力提升,但用户体感未同步变好,原因在于人类注意力窗口有限。赛道分化,主动式桌面Agent是新方向,AirJelly是代表产品,五源资本对其创始人黄柏特进行访谈,探讨产品设计、应用场景等问题。
超越VLA与世界模型,银河通用发布LDA,全谱系数据跑通Scaling Law
近期具身智能领域竞争激烈,银河通用联合多机构发布 LDA-1B 模型,能统一利用各类具身数据。它在基准测试中表现出色,代码已开源,还解决了数据格式、质量等问题,实战效果也很突出。
从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
90后华裔女高管Cat Wu推动Anthropic产品“按天迭代”,她认为token成本低于工程师工资。她分享了产品发布、团队协作等经验,还谈到AI时代PM应具备的能力,以及Claude系列产品的使用和发展方向。
GPT-image-2十大最强玩法实操:夯到爆炸
OpenAI全量上线GPT Image 2,其表现远超其他模型。它优势明显,如真实感与细节强、文本渲染准确、自带“思考”能力。文章还给出其十大玩法实操及提示词,涵盖图文组合、海报生成等。
突发:SpaceX 或 600 亿美元收购 Cursor
SpaceX官宣与Cursor合作,打造编程和知识工作AI。Cursor授予SpaceX今年晚些时候以600亿美元收购的权利,或支付100亿合作费。Cursor增长快但无自研模型,合作可助其训练模型。此外还介绍了编程AI市场竞争情况。
Turso:用 Rust 重写 SQLite,让数据库跑在每一个边缘节点
Turso用Rust重写SQLite内核,解决其单写者限制和缺乏网络同步能力的短板。它有嵌入式副本、边缘同步和向量搜索等特性,适用于AI Agent、多租户SaaS等场景,与竞品相比优势独特。
全球第一,13个SOTA!我们找到了龙虾界掌管GUI的神
明略科技推出自研 GUI-VLA 智能体模型 Mano-P 1.0,不依赖 API 对接与浏览器场景,可操作桌面软件与网页界面。它在 13 个多模态基准榜单达 SOTA,支持本地运行,数据零上云,采用分阶段开源策略。
对话朱广翔 - 人人都能coding了,软件会消失吗?
本文是对百度秒哒产品总经理朱广翔的访谈。朱广翔认为写代码或成古法,建议别学。秒哒用户有人已赚1000万。他还提出人与AI保持15度夹角,垂直AI产品有生命力,未来APP和Skill将共存。
Google悄悄下了一盘大棋:一天三个端侧AI项目同时爆发
Google 一天内三个端侧 AI 项目爆发,包括离线听写 App Eloquent、端侧 AI 示例集 AI Edge Gallery 和端侧大模型推理运行时 LiteRT-LM。云端大模型竞争趋同,端侧 AI 是差异化战场,Google 全栈布局有优势。