「AI模型训练」共找到 13906 篇相关文章

产品应用8

医疗幻觉率比DeepSeek低3倍,百川循证增强大模型横扫全球医学考试!

百川智能发布首个循证增强医疗大模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在多场景评测中幻觉率低,多国医考成绩优异,已上线百小应APP并开放API。

新智元
产品应用7

全民养虾,百虾大战,但2026年了,99%的企业用AI还是没赚到钱。

2026年,99%企业用AI未盈利。如今模型性能差距小,壁垒在context。Data不等于Context,企业需挂钩业务结果、构建反馈闭环与专属上下文系统。特赞GEA是这样的企业级智能体系统。

探索AGI
算法论文8

建模世界偏好:偏好建模中的Scaling Laws

研究首次揭示人类偏好建模遵循Scaling Law,从论坛收集数据在Qwen 2.5模型训练,发现测试损失随训练规模指数增长线性下降。提出建模世界偏好,论文和模型已开源,还探讨了偏好建模可扩展性等问题。

通义千问Qwen
新闻资讯7

AI七个月突破数学家“围剿”反超人类!14位数学家深挖原始推理token:不靠死记硬背靠直觉

大模型o3 - mini - high在7个月内,于FrontierMath基准测试中,答题得分从2%提升到22%,超人类团队平均水平。数学家分析其推理记录,发现它靠直觉而非死记硬背解题,但也存在缺乏创造力等局限。

量子位
开源动态8

具身智能从此「边听边说」,智源研究院开源原生全双工语音大模型RoboBrain-Audio

北京智源研究院联合多方发布原生全双工语音对话大模型 RoboBrain - Audio,采用新架构和创新训练范式,在性能上全面领先,革新音频 - 文本对齐方式,丰富了 RoboBrain 全栈体系,推动具身智能发展。

机器之心
新闻资讯7

李飞飞一年前究竟说了啥?怎么又火了

AI教母李飞飞一年前访谈再引关注,她指出大语言模型或许并非真正智能,其基于一维语言信号训练,在理解三维物理世界存在局限。相关实验也证实大模型在物理任务表现差,不过也有人提出不同观点。

量子位
新闻资讯7

一盘大棋!OpenAI「截胡」IMO金牌,奥特曼为GPT-5献上「核弹级」预热

OpenAI用全新通用推理模型拿下IMO金牌,抢了谷歌DeepMind的风头。此模型是融合新通用技术的推理LLM,在推理时间跨度和效率上有进步。奥特曼借此为GPT - 5预热,陶哲轩指出缺乏统一标准时对比AI表现无意义。

新智元
算法论文8

北航领衔发布300页代码智能综述:从基础模型到智能体,一次读懂Code LLM全景图

北航领衔联合近30家机构撰写《From Code Foundation Models to Agents and Applications》,系统梳理代码智能领域,串联模型、任务等成完整技术链路,还通过实验等给出实践指南。

量子位
新闻资讯8

深度|开源大战全面开打:老黄+小扎 vs 奥特曼+达里奥

黄仁勋注册X账号分享公开信《Open Weights and American AI Leadership》,25家联署方支持开放权重模型,OpenAI、Anthropic、谷歌三家闭源前沿实验室未签署。信中核心论点是开放权重模型让AI成行业基础设施,还涉及蒸馏等敏感政策争论。

新智元
算法论文8

ICLR 2026 Oral | 让大模型学会“像法医般思考”,实现可解释、可泛化的深度伪造检测

生成式AI发展使深度伪造技术安全隐患受关注,现有检测器表现不佳。中科院自动化所联合蚂蚁集团提出Veritas框架,构建HydraFake数据集,赋予大模型“模式感知推理”能力,实验效果超现有检测器,还给出未来研究方向。

深度学习自然语言处理