「多模型 Agent」共找到 10908 篇相关文章
OpenAI新模型GPT-5.1发布,不跑分不刷榜,主打一个说人话
OpenAI发布GPT-5.1,主打更智能、更具对话性,无跑分打榜,有人设说人话。包括Instant和Thinking两个子模型,简单问题快,复杂问题智能。本周逐步向用户免费开放,还更新了语气风格等功能。
网页智能体新突破!引入协同进化世界模型,腾讯AI Lab提出新框架
腾讯AI Lab提出WebEvolver框架,引入协同进化的世界模型,让智能体在真实网页环境中性能提升10%,突破现有基于LLM的网页智能体瓶颈,还通过实验验证了其有效性和对网页状态变化的预测能力。
小米MiMo-V2-Flash开源:3090亿参数大模型能否改写AI行业规则!
2025年12月16日小米开源旗舰大模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。
乐鑫开源首个「物联网设备Agent框架」,Claw的风终于吹到硬件上
乐鑫开源首个物联网设备Agent框架ESP - Claw,用C语言重写。它核心理念是对话即创作,可让用户通过聊天定义硬件行为。具备运行效率高、内存占用低等特点,还有多种功能及良好的生态适配性。
写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾?
libGDX 创始人、17 年开源老兵 Mario Zechner 吐槽 Claude Code、OpenCode 等工具功能堆叠,带来掌控感丧失等问题。他推出极简主义编程 agent pi,仅含四种工具,有最短系统提示词,扩展性强,能让开发者重拾掌控权。
让记忆学会“进化”:探索 LLM Agent 的运行时价值感知与自适应检索 | 直播预约
本次直播将介绍最新研究成果 MemRL,提出作用于情景记忆的运行时强化学习方法,使 LLM Agent 能判断记忆价值,检索高价值经验,提升复杂未知环境下泛化性能与任务成功率。
全球首个AI Agent操作系统FlowithOS跑分超Atlas,网友:它「杀死」了比赛
AI应用初创企业Flowith推出全球首款专为AI Agent打造的操作系统FlowithOS。它能改写交互方式,功能超AI浏览器,跑分超竞品,还具记忆能力,适配多系统,已公测,或引发“AI操作系统”竞争。
阶跃星辰豪揽超50亿融资,“天才创始人”印奇重掌帅印
通用人工智能公司阶跃星辰完成超50亿元B+轮融资,刷新中国大模型领域单笔融资纪录。同时,印奇出任董事长。该公司坚持“基础大模型”与“AI+终端”战略,商业化探索也在多方向推进。
Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro
Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。
Cursor 1.0 正式版来了!BugBot 代码审查、后台 Agent 全面开放、MCP 一键安装。
Cursor 1.0正式版更新,新增功能不少,如BugBot代码审查、记忆功能、MCP一键配置等。后台Agent全面开放,还支持Jupyter Notebook。不过新设置界面使用体验一般,远程开发时mcp配置有问题。