AI模型训练」共找到 13627 篇相关文章

算法论文8

从最优传输角度训练奖励模型:让 RLHF 学会「忽略错误偏好」丨ICML 2026

浙江大学、小红书、北京大学等团队提出SelectiveRM,基于最优传输训练奖励模型。它重构训练目标,通过选择性分布对齐排除噪声偏好,解决了奖励模型训练中监督信号不可靠的问题,实验验证其有效且泛化能力好。

AI科技评论
新闻资讯8

00后的他们,正在定义AI时代的新坐标丨红杉中国联合《麻省理工科技评论》中国发布“25岁以下AI创新青年先锋”

AI领域创新正由年轻一代推动。红杉中国与《麻省理工科技评论》中国发起“AI25”计划,揭晓2025年“25岁以下AI创新青年先锋”入选者名单,他们在各领域成果突出,未来还将打造AI原生社区。

DeepTech深科技
新闻资讯7

章鱼动力再获5000万美元融资,以世界模型驱动「手脑一体」的物理 AI 基础设施

AI科技评论获悉,物理AI基础设施公司章鱼动力近日完成5000万美元融资,过去3个月累计融资近10亿。本轮由锦秋基金等领投,下轮5亿融资也接近完成。公司以SYNTH架构构建闭环,目标推动物理AI进阶。

AI科技评论
产品应用8

Agnes AI 实测:AI 编程真正的瓶颈,99%的人想错了

本文实测Agnes AI,指出AI编程瓶颈在于缓存命中率,而非模型智商。介绍其产品线、评测成绩与价格优势,还分享客户端体验,包括亮点、回滚事故及日志结论,最后点明智能免费后验证更稀缺。

AI科技评论
算法论文8

12个Ai编程Agent同台PK,最贵的不一定是最强的

上海交大和美团联合发布PRDBench论文,将12个主流AI编程Agent放入50个真实Python项目测试。结果显示,基础模型写代码强,商业版调试优势明显;专门训练的裁判模型比通用大模型靠谱。

CourseAI
开源动态8

国产大模型新SOTA:蚂蚁万亿级旗舰模型赶超GPT-5

蚂蚁集团开源万亿参数旗舰大模型Ling-1T,属Ling 2.0家族。它激活比例低降低运算成本,训练有“Ling缩放定律”等方法,多项测试超主流模型,不过处理超长上下文成本较高。

AIGC开放社区
新闻资讯7

The Batch: 868 | AI 视频走向主流

生成式视频席卷网络爆款、广告宣传,甚至登陆 Netflix 剧集。如 Dor Brothers 用 AI 打造爆款视频,Genre.ai 低成本制作广告。各主体制作方式有别,顶尖模型开发商也积极与影视方合作,AI 正改变影视业。

DeeplearningAI
开源动态8

探针伸进大模型黑箱,南加州大学华人团队打造AI记忆研究的深空望远镜

南加州大学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控大模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示大模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。

DeepTech深科技
新闻资讯8

独家解读|2025年AI五大趋势与底层数据革命

2025 年 AI 发展重心转移,高质量数据成新基石。本文解读五大技术趋势,如多语种 TTS 与全双工交互、多模态大模型等,还介绍了各趋势的数据需求及数据堂提供的相应数据服务方案。

机器之心
算法论文7

MOE RL实战:统一FP8全流程训练

SGLang RL团队等联合完成工作,实现RL中全流程FP8训练与采样。介绍FP8训练硬件基础、格式、scale选择等,指出训练难点,分析KL Loss异常归因,验证其在MoE模型RL应用效果,还探究模型规模对训推不一致性的影响。

GiantPandaLLM