「数学推理能力」共找到 4772 篇相关文章
国产大模型新SOTA:蚂蚁万亿级旗舰模型赶超GPT-5
蚂蚁集团开源万亿参数旗舰大模型Ling-1T,属Ling 2.0家族。它激活比例低降低运算成本,训练有“Ling缩放定律”等方法,多项测试超主流模型,不过处理超长上下文成本较高。
RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异
清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。
Qwen3-LiveTranslate:视、听、说全模态同传大模型!
Qwen3-LiveTranslate-Flash 是基于大语言模型的多语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有多语言和方言支持、视觉增强等亮点,性能超主流大模型。
超10万亿Tokens的高质量数据集是怎么炼成的?专访中国电信天翼AI阮宜龙
中国电信天翼AI打造超10万亿Tokens高质量数据集,依托星辰MaaS平台构建“数据—模型—服务”闭环。其与研究院推进技术研发并落地产品,建“三全”星辰大模型体系,还在多行业展现应用价值。
高通祭出全球最快移动SoC!卢伟冰携全球首发小米17Pro现身
2025骁龙峰会·中国会场,高通推出第五代骁龙8至尊版移动平台,采用台积电3nm制程。小米17系列将全球首发,多家厂商也会搭载。该芯片在CPU、GPU、NPU等多维度性能提升,还在影像、音频和通信方面有飞跃。
突发!Meta刚从OpenAI挖走了清华校友宋飏
刚刚,OpenAI前高层研究员宋飏加盟Meta Superintelligence Labs任研究负责人,向赵晟佳汇报。此次人事流动或透露出Meta在AI竞赛中释放的三重信号,如MSL人才拼图更完整等。
对抗协作+原型学习!深北莫FedPall开源,联邦学习破局特征漂移,准确率登顶SOTA
深圳北理莫斯科大学人工智能研究院在ICCV发表FedPall算法,结合原型对比与对抗协作学习,在多种特征偏移数据集获SOTA性能。该算法通过多步骤训练缓解特征漂移,在多个公开数据集表现出色。
AIME'25满分炸场!Qwen一波七连发,全家桶大更新
云栖大会上,通义团队成果丰硕。Qwen3-Max性能提升,数学评测满分,多测试成绩优异;Qwen3-VL、Qwen3-Omni等开源,各有亮点;Qwen3-Coder升级。吴泳铭称要发展超级人工智能。
无需训练,即插即用:西湖大学发布世界模型WorldForge,让普通视频模型秒变「世界引擎」
自Sora亮相,AI视频可控性成瓶颈。西湖大学AGI实验室团队提出WorldForge框架,在推理时为视频模型注入「时空几何」,无需训练,实现单图360°环绕视频生成和视频重运镜等,降低创作门槛。
谁在重新定义 AI 云?
过去几年,AI成云计算行业统一叙事,但厂商口号趋同,差异化消解。当下AI从“炫技”走向“应用”,华为云在全联接大会2025上提出新组合,回应行业成本、基建和应用难题,不过路径也面临挑战。