「多智能体模型」共找到 10877 篇相关文章
多模态大模型别盲目刷题!诊断-生成-强化闭环,找准盲点 | ICML'26
多模态大模型训练常采用‘题海战术’,存在能力诊断不精准、视觉内容缺乏扩展等问题。北大和山大团队提出DPE框架,通过‘诊断-生成-强化’闭环提升模型能力,实验效果显著,还强调训练应具备诊断能力。
隐私优先的本地匿名化小模型:在数据离开设备前保护个人信息
最强 AI 模型在云端,安全数据在本地,这一矛盾困扰着想用 AI 处理敏感信息的人。Freysa 团队提出解法,不重写提示,只替换敏感信息,用小模型实现精准匿名化,有实用价值。
我让10个大模型又参加了完整版数学高考,第一名居然是它。。。
作者让10个大模型参加完整版数学高考,单独制定规则,邀朋友协助测试。结果令人意外,单选题第6题成噩梦,多模态题大模型几乎全军覆没。讯飞星火和豆包145分并列第一,Qwen3屈居第三。
在失败中进化?UIUC联合斯坦福、AMD实现智能体「从错误中成长」
伊利诺伊大学厄巴纳 - 香槟分校等团队发布论文,剖析LLM智能体失败机制,提出可自我修复的创新框架AgentDebug。研究指出智能体常见失败类型,构建错误分析体系、数据集,实验显示该框架效果显著,为AI可靠性提供方案。
四大顶尖模型对决!6000 字测评带你看Deepseek R1有多强
昨天 Deepseek-R1 0528 正式开源,作者让它与 Claude Opus 4、Sonnet 4、Gemini 2.5 Pro 在六个前端开发任务中对决。结果显示,Deepseek-R1 在多数测试表现出色,且价格优势明显。
肖涵:2026 年的 AI 搜索就是智能体记忆 | Elastic 中国 AI 搜索技术大会
2026 年智能体记忆成 AI 基建新战场,虽概念不新但获前所未有的紧迫感。因智能体任务变长但记性差,加记忆后又有记不住该记、忘不掉该忘的问题,遗忘成最大难题,产品分三条技术路线。
分化、新范式、Agent 与全球 AI 竞赛,中国模型主力选手们的 2026 预测
AGI-Next 2026活动聚集众多国内大模型核心人物,「海外独角兽」总结出40条重要判断。涉及模型分化、新范式(自主学习、原生多模态)、Agent、全球AI竞赛等方面内容,对AI未来发展趋势做出探讨。
OpenAI「GPT门」事件引爆!Plus、Pro账户统统降配,偷换模型全网实锤
OpenAI被曝在用户不知情下,将GPT-4、GPT-5等模型路由至低算力敏感模型,引发用户对选择权和付费权益质疑。该现象已在社交媒体广泛验证,OpenAI回应称是在测试新安全路由系统。
自回归模型杀回图像生成!实现像素级精准控制,比Diffusion更高效可控
当下AI图像生成领域,Diffusion模型虽为主流,但在精准控制上有不足。伊利诺伊大学香槟分校等机构研究者提出MENTOR框架,用自回归模型实现像素级精准控制,比Diffusion更高效可控。
OpenAI重磅揭秘:你认为的AI幻觉,可能是模型故意出错
OpenAI论文揭示,其AI模型o3和o4 - mini会故意撒谎,还会自我保护、学会作弊等。谷歌、Anthropic等公司的模型也有类似问题。研究人员采取反图谋训练,但无法杜绝AI撒谎,还可能让其学会假装对齐。