大模型智能体」共找到 10587 篇相关文章

新闻资讯8

清华2年前预言,正成为全球共识!Meta等三AI机构已得出同一结论

全球三家AI研究机构结论曲线斜率几乎重合,而中国面壁智能和清华联合团队两年前提出的“密度定律”与它们一致。该定律改写行业假设,如推理成本下降、端侧智能爆发临近、模型策略反转等。

新智元
开源动态7

OpenAI解密模型失控:它不是变坏,而是「太听话」

OpenAI公开IH - Challenge,解决模型指令冲突难题。指出模型问题多因听信错误指令,给出系统>开发者>用户>工具的指令层级结构,设计数据集训练模型遵循高信任等级指令,提升安全可控性与抵御提示词注入能力。

新智元
开源动态8

突破具身智能任务规划边界,刷新具身脑多榜单SOTA,中兴EmbodiedBrain模型让具身脑学会「复杂规划」

当前主流语言模型在具身任务场景面临瓶颈,中兴星云脑团队推出具身视觉 - 语言基础模型 EmbodiedBrain,构建全流程创新框架,在架构、数据训练、评估体系等方面有突破,还将开源成果推动生态发展。

机器之心
算法论文7

正确答案 ≠ 正确推理,CoT 或成模型推理能力停滞的「罪魁祸首」?

研究指出当前模型推理能力评估多关注答案准确性,忽视推理步骤。通过对前沿模型测试发现,2023 - 2024 年模型推理能力提升停滞,进步靠提示工程,自底向上策略最有效。

AI科技评论
产品应用8

医疗幻觉率比DeepSeek低3倍,百川循证增强模型横扫全球医学考试!

百川智能发布首个循证增强医疗模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在多场景评测中幻觉率低,多国医考成绩优异,已上线百小应APP并开放API。

新智元
算法论文8

模型化身苏格拉底:通过主动提问挖掘人机协作的深度

微软与南加州学联合团队研究揭示激发模型主动提问能力新范式。通过定义主动信息收集任务、提出强化微调策略,经实验验证该方法有效,使模型在多领域表现出色,重新定义模型角色。

AIGC开放社区
算法论文7

模型刷数学题竟有害?CMU评估20+模型指出训练陷阱

CMU团队评估20多个模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。

量子位
新闻资讯8

百川开源医疗模型 M3,王小川:今年会发布两款 ToC 产品,正在做硬件

1月初OpenAI、Anthropic推出医疗产品,百川智能也开源医疗模型Baichuan - M3,评测成绩突出。王小川表示今年会发布两款ToC产品,还在做硬件,阐述了百川在医疗领域的目标与策略。

Founder Park
算法论文8

句子级溯源+生成式归因,C²-Cite重塑模型可信度

在人工智能发展背景下,模型内容可信度成焦点。北邮百家AI与小米团队提出溯源模型C² - Cite,首创上下文感知归因生成技术,解决现有归因模型缺陷,已被WSDM 2026收录。

机器之心
新闻资讯7

Generalist爆火背后:具身智能真正的竞争,已不在模型

Generalist AI发布的GEN - 1模型引爆具身智能领域,其多项指标出色,预示具身智能竞争从模型层转向基础设施层。行业关注焦点转移,数据正从‘静态数据集’演进为‘动态教育系统’,评测与仿真基础设施成关键。

机器之心