大模型Agent」共找到 10509 篇相关文章

产品应用7

AI开始学会合作?!实测4Agent体=10个打工人

Agent热潮进入多智能体时代,多款产品涌现。鲸哥测评了它们在商业计划、运营设计等四场景表现,总结各产品亮点与不足,指出多Agent正推动模型向“协作式智能群体”演进。

鲸选AI
开源动态8

医疗领域DeepSeek时刻:蚂蚁 · 安诊儿医疗模型正式开源,登顶权威榜单

2026 年初,OpenAI 报告显示不少人用 ChatGPT 咨询医疗问题,还发布了 ChatGPT 健康。近日,蚂蚁集团等开源的蚂蚁・安诊儿医疗模型或成最优解,它参数量,在多评测中登顶,技术优势明显。

机器之心
新闻资讯7

深度解读 AGI-Next 2026:分化、新范式、Agent 与全球 AI 竞赛的 40 条重要判断

文章总结了 AGI-Next 2026 活动上核心观点。指出模型分化是趋势,有 To B 和 To C 等场景差异;自主学习是新范式;模型AgentAgent 即产品;还分析了中美 AI 竞赛的现状与挑战。

海外独角兽
算法论文8

清华首提通用模型滤波方法,实现零样本状态估计|NeurIPS'25

清华学李升波教授团队在NeurIPS 2025提出LLM - Filter通用滤波器,将状态估计融入语言模型推理框架。它能解决传统方法泛化性差问题,在未见过系统中实现零样本状态估计,有望成基础模型

新智元
开源动态8

超越GPT-4o和Gemini 2.5!小米MiMo-Audio音频模型真香

小米推出MiMo - Audio模型,预训练数据超1亿小时。它在多个基准测试成开源7B模型SOTA,开放相关资源。分词器表现佳,有全新架构,在音频理解、对话、推理等方面表现出色,还集成TTS功能。

AIGC开放社区
算法论文8

ICLR 2026 | 别再让模型“想太多”了!最新研究揭示 LLM 推理效率的关键瓶颈

语言模型推理计算成本失控,存在过度与思考不足问题。研究揭示推理失衡是根源,提出BAM模型及Plan - and - Budget框架,实验显示其能提升准确率与效率,转向‘推理价值’范式。

机器之心
算法论文8

多模态模型中Attention机制暗藏「骗局」,需用一个公式修正丨上×南开

上海学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝会丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。

量子位
开源动态8

性能比肩DeepSeek-R1,MiniMax仅花380万训出推理模型性价比新王|开源

MiniMax开源推理模型MiniMax - M1,原生支持100万token输入、8万输出,性能比肩DeepSeek - R1,仅花380万训成。采用Lightning Attention机制与CISPO算法,在多领域表现出色,模型权重可在HuggingFace下载。

量子位
开源动态8

社区供稿丨如何抑制模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。

Hugging Face
算法论文8

ICML 2025 Spotlight | 多模态模型暴露短板?EMMA基准深度揭秘多模态推理能力

最新研究推出 EMMA 基准测试,揭示顶尖多模态语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距,视觉推理是核心瓶颈。

机器之心