大模型榜单」共找到 9258 篇相关文章

推荐文章8

深度解析模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景

模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。

腾讯技术工程
产品应用8

Speech-02语音模型登顶国际单:完美复刻声音,同事听后难辨真伪

MiniMax的Speech-02语音模型登顶国际单,超越OpenAI等海外模型。它引入可学习说话人编码器,有高扩展性,还能结合文本描述生成音色。测试显示其音色丰富、读音准、支持多语种,声音复刻逼真。

歸藏的AI工具箱
算法论文8

名师一定出高徒?清华团队最新揭秘:别再迷信模型蒸馏的「免费午餐」

当下模型后训练中,On-Policy Distillation(OPD)成明星技术,业界采用后报告性能提升。但清华团队研究发现,换更强Teacher,Student性能可能无提升甚至倒退。研究揭示蒸馏成败条件,深挖对齐机制,还给出拯救失败蒸馏的方法。

机器之心
算法论文8

腾讯与中科院联合提出R-4B,一个能自动决定是否思考的多模态模型

多模态语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在多评测中达SoTA,省资源且效果好。

深度学习自然语言处理
新闻资讯8

直面LeCun愿景,智在无界发布最强具身世界模型,20万小时人类视频屠6

智在无界作为人类视频学习路线开创者,4月14日发布第三代旗舰模型Being - H0.7,用20万小时人类视频训练,提出新范式,在6项权威评测中综合排名全球第一,拓展了世界模型能力边界。

机器之心
算法论文8

68页论文再锤模型竞技场!Llama4发布前私下测试27个版本,只取最佳成绩

《排行幻觉》论文指出Chatbot Arena存在问题,如少数厂私下多版本测试选最优、数据访问不平等、用Arena数据训练可提性能、模型量静默弃用等,研究团队给出改进建议,官方也进行了回应。

量子位
开源动态8

蚂蚁专用模型超越o3!仅用2K训练样本刷新医疗AI单纪录

蚂蚁集团联合团队发布《MedResearcher-R1: Expert-Level Medical Deep Researcher》报告,其医学AI智能体MedResearcher-R1用2100条训练样本在医疗基准测试反超通用模型,靠数据、工具、训练方法三创新实现突破。

量子位
算法论文8

一个省略号提示+强化学习搞定模型“过度思考”,中科院自动化所新方法:从强制推理到自主选择

中国科学院自动化研究所联合鹏城实验室提出AutoThink方法,用省略号提示和多阶段强化学习,让推理模型依题目难度自主切换思考模式,解决过度思考问题,在多数据集验证有效。

量子位
算法论文7

OpenAI谈:模型为什么会有幻觉?如何避免?

OpenAI论文探讨模型幻觉问题,指出评测缺陷,像多数AI模型评测非对即错,模型为得分会瞎猜。还从预训练和后训练阶段剖析根源,提议改造评测,引入置信度阈值和错误惩罚机制。

探索AGI
算法论文8

AI玩拼图游戏暴涨视觉理解力,告别文本中心训练,无需标注的多模态模型后训练范式

在多模态模型后训练浪潮中,现有方法多以文本为中心。MMLab@南洋理工学提出Visual Jigsaw,将拼图任务用于后训练,让模型不依赖标注强化视觉感知与理解,在图片、视频和3D模态验证有效。

量子位