不对称训练」共找到 3303 篇相关文章

新闻资讯7

ChatGPT确认卖广告!奥特曼:挣钱嘛寒碜

2026年1月16日,OpenAI官宣ChatGPT免费版和Go版引入广告。奥特曼称因多数人想用AI又付费,只能以此盈利。这背后是大模型行业受开源模型冲击,陷入定价困境,开源模型改变了行业预期和估值逻辑。

新智元
开源动态8

SFT+RL双管齐下:ReasonGen-R1如何破解文生图「指令遵」难题?

上海科技大学等机构提出 ReasonGen-R1 框架,结合链式推理监督微调与强化学习,提升自回归图像生成模型推理和创作能力,已全面开源。介绍了其训练阶段、实验结果及推理链模式。

机器之心
算法论文8

无需训练,直接「算出」最强AI!理想汽车发现端侧Scaling Law

理想汽车基座模型MindVLA团队与国创决策智能技术研究所联合发布论文,提出面向端侧大语言模型的「硬件协同设计扩展定律」,解决大模型部署在端侧设备的难题,实现软硬协同设计,提升模型性能和研发效率。

新智元
新闻资讯8

Ilya 最新访谈,预训练时代终结后,AI行业来到了哪里?

Ilya接受90多分钟深度访谈,指出当前大模型泛化能力远如人,Scaling时代终结,研究时代回归。还谈到AI经济影响与跑分匹配、泛化能力鸿沟、情感价值等问题,预测超级智能5 - 20年到来。

探索AGI
产品应用8

合合信息:基于 JuiceFS 构建统一存储,支撑 PB 级 AI 训练

合合信息为应对AI训练存储挑战,引入JuiceFS构建统一存储架构,结合BeeGFS作缓存。该架构提升I/O性能与资源调度效率,还通过缓存优化、数据治理等措施,支撑多业务并发,为AI基建奠基。

InfoQ
开源动态8

个人电脑也能进行智能体RL训练?尤佳轩团队开源OpenTinker

伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全新‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在同算力设备启动智能体训练,解决传统RL框架难题,指明下一代智能体基建方向。

机器之心
算法论文7

Megatron 1F1B流水线并行中的负载均衡问题研究

文章分析Megatron 1F1B流水线并行中负载均衡问题。通过实验发现通信时间‘一短一长’,原因是最后一个Stage计算慢致同步,额外计算引发通信延迟,还梳理了流水线各阶段执行过程。

GiantPandaLLM
算法论文7

DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO

文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。

机器之心
产品应用7

蚂蚁多模态统一框架Ming-Omni:能看懂世界、会说话、还能画画

文章介绍蚂蚁多模态统一框架Ming - Omni,它可统一处理图像、文本等多模态数据。该框架解决了多模态训练中模态表示差异、收敛速度一致等问题,采用分阶段预训练,能用于图像、音频生成及多模态交互。

CourseAI
开源动态8

增加人手,项目效率飙升45%,OpenAI公开了一套AI实战经验

OpenAI公开基于大语言模型和专属Skill包的开源仓库维护方法论,将重复工作自动化,使项目代码合并吞吐量飙升45%。该方法由AGENTS.md、Skill包和GitHub Actions构成,还涉及任务分配、验证策略等。

AIGC开放社区