「多智能体工作流」共找到 6752 篇相关文章

算法论文8

EMNLP 2025 | T2R-bench: 业内「首个」工业级表格生成报告评测基准

中国电信人工智能研究院推出业内首个面向真实工业场景的“表格到报告”基准T2R-bench,涵盖多领域真实表格、问题与人工标注关键点,配套创新性三维度评测体系。实验显示主流大模型在该任务上表现欠佳,提升空间大。

AINLPer
开源动态8

高阶程序,让AI从技术可行到商业可信的最后一公里

文章指出进入AI下半场,可靠性成关键。当前多种探索路径有局限,企业常用RAG、智能体框架等方案也各有问题。而高阶程序(HOP)是神经 - 符号思想的工程实践,能为AI构建可靠控制系统,已在金融等行业展现价值。

机器之心
产品应用8

文心新出的推理大模型,给了我们信心

在 WAVE SUMMIT 2025 大会上,百度发布文心大模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。

机器之心
产品应用8

英伟达祭出NVFP4核弹:大模型训练根本性转变,GB300效率狂飙7倍

英伟达推出新格式NVFP4,能以4 - Bit速度与效率实现16 - Bit生产件级训练精度,是LLM开发重大飞跃。虽处于研究阶段,但正与多组织合作。还介绍其方法、优势,实验也证明它在大规模训练的有效性。

AI寒武纪
产品应用8

有生之年吃到了钉钉的细糠

作者参加“2025 钉钉十周年暨新品发布会”,体验了钉钉 8.0 版本。该版本开启 AI 1.0 新篇章,界面焕然一新,以钉钉 One、AI 搜问等重塑工作流程,还升级语音智能硬件,实现信息处理闭环,提升企业与员工效率。

MacTalk
算法论文8

击败Meta登榜首:推理增强的文档排序模型ReasonRank来了

本文第一作者刘文涵聚焦AI搜索研究。提出推理增强的文档排序模型ReasonRank,在多个榜单击败多校和机构登榜首,其7B版本超越32B模型,论文获Huggingface paper日榜第一。还介绍研究动机、方法及实验结果等。

机器之心
算法论文7

大模型刷数学题竟有害?CMU评估20+模型指出训练陷阱

CMU团队评估20多个大模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。

量子位
产品应用8

百度网盘的阵势真不小

作者参加百度AI开放日,看到百度文库和网盘发布一系列AI新功能,已发展成一站式AI内容生产力平台。如全新AI相机功能多,GenFlow 2.0体验流畅,背后依托沧舟OS打通全链路。这反映泛内容创作降门槛趋势。

MacTalk
新闻资讯7

AI裁员这一刀,终于砍到他们身上!外媒高层一锅端,9年老记者血泪控诉

宣扬「AI变革」的外媒Business Insider宣布裁员21%,全面拥抱AI。此前多名记者被裁,引发读者不满。今年谷歌、微软等大厂也有因AI而裁员情况,有预言称其将致入门级白领岗位消失,企业也想借其淘汰员工。

新智元
推荐文章8

在三张圆明园鼠首照片里,我们看到了3D AI的Harness时刻

作者通过三张圆明园鼠首照片开展实测,验证了全新3D AI Harness工作流:通用Agent调度任务、专业3D模型生成、专业软件后处理,仅1.47元即可生成可编辑可交付的3D资产,探讨了3D AI行业的新发展路径。

AI科技评论