大模型智能体」共找到 10577 篇相关文章

开源动态8

国产开源LLM迎来爆发的一周:Kimi、腾讯、快手、美团、面壁智能

国产开源模型迎来爆发,快手、月之暗面、美团、面壁智能、腾讯等接连发布新模型,如快手Keye-VL - 1.5 - 8B刷新视频理解SOTA,美团LongCat - Flash - Chat推理快成本低等。

PaperAgent
产品应用8

融合风控知识的模型体系建设与应用实践

腾讯算法专家欧阳天雄在AICon会分享《模型驱动下的智能风控落地实践》,介绍腾讯天御融合海量风控知识构建金融风控模型,解决传统风控模型难题,还展示构建技术、工程实践及落地案例,为金融风控提供新思路。

InfoQ
产品应用8

文心新出的推理模型,给了我们信心

在 WAVE SUMMIT 2025 会上,百度发布文心模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。

机器之心
开源动态8

别问树模型了!死磕结构化数据,清华团队把模型表格理解推到极限

AI 时代处理结构化数据成痛点,LLM 模型难以满足生产要求。清华学与稳准智能联合发布的 LimiX 系列模型,做到真正通用,在跑分和实际落地表现出色,其轻量级版本 LimiX - 2M 适合边缘设备和科研场景。

机器之心
算法论文8

只需一次指令微调,模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral

预训练模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙与Thomson Reuters团队提出SIMoE,单阶段微调就能升级模型,还解决传统方法两局限,在性能和效率上双突破。

量子位
算法论文8

清华孙茂松团队 × 深言科技:以解释作为训练信号,让 8B 模型在幻觉检测上反超闭源模型

语言模型幻觉问题待解,成本与算力需求攀升。清华孙茂松团队联合深言科技提出FaithLens模型,把幻觉检测提升为整体评估,以解释作为训练信号,8B模型在多任务上超闭源模型

AI科技评论
算法论文8

230个模型在婴幼儿认知题上集体翻车!揭秘多模态模型的核心知识缺陷

ICML 2025研究揭示多模态模型在基础认知能力上表现不佳。研究者建测评题库CoreCognition测试230个主流模型,发现其存在核心知识缺陷,扩规模难补短板,还需补齐核心知识。

量子位
产品应用8

抢先OpenAI?AIUI全新升级燃爆22亿终端,国内厂定义智能交互

讯飞围绕智能交互场景,对AIUI、机器人超脑等4平台全面升级。其AIUI以模型为引擎,有儿童专属交互方案,还推出智能眼镜“三麦阵列”等,各平台在多领域应用成果显著。

新智元
算法论文8

ACL 2025 | 指令遵循不能仅靠常识?GuideBench 揭示模型如何“踩雷”领域指南规则

这篇ACL 2025主会论文聚焦提升智能体指南规则遵循能力。提出评估基准GuideBench,涵盖7类1272个任务。实验显示多数主流模型指令遵循能力不佳,尤其数学推理挑战,为模型迭代提供评估基准。

深度学习自然语言处理
算法论文7

模型的第一性原理:(三)信息论篇

本文从信息论角度解读模型第一性原理。介绍Shannon信息论,提出将其从以BIT为中心转换为以TOKEN为中心解释模型底层原理,还阐述模型各阶段信息论原理、定向信息计算方法,对比Granger与Pearl因果。

机器之心