「规模化RL」共找到 409 篇相关文章
DeepSeek点燃大模型效率之争,阶跃火速接棒:JetSpec让大模型解码速度最高提升近10倍
近期,DeepSeek发布DSpark,阶跃星辰发表JetSpec论文,二者聚焦大模型推理效率。DSpark关注验证效率,JetSpec从Draft生成本身入手。结果显示,二者都有加速效果,共同表明推理效率正成Agent落地关键变量。
蚂蚁集团领投,光轮智能20亿美元估值引领全球具身数据基础设施|甲子光年
具身智能市场逻辑生变,从关注模型和本体转向数据与评测基础设施。光轮智能获蚂蚁集团领投,估值超20亿美元。其构建完整闭环,参与国际标准制定,打造物理AI教育系统,引领产业发展。
QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5
通义文档智能团队推出QwenLong - L1.5长文本推理专家,提供端到端长文本推理后训练“配方”,含数据合成管线、强化学习方法、智能体架构,在多基准测试成绩佳,代码已开源。
商业航天开始交卷
今年工信部批复卫星物联网商用试验许可,商业航天迈进商业化。时空道宇作为获批民企成观察样本,它解决卫星量产等难题,实现车载前装量产,构建全栈闭环能力,为行业提供思路。
Sand.ai开源发布MagiCompiler:突破局部编译界限,定义训推性能上限
大模型开发者面临速度与显存的两难选择,原生torch.compile有局限。Sand.ai开源MagiCompiler,突破传统编译界限,提出Compiler as Manager理念,解决算力与显存墙难题,性能实测亮眼,且接入简单。
2篇最新论文,把Deep Research讲透了~
阿里开源Tongyi DeepResearch热度高,文章分享两篇相关技术综述。介绍Deep Research是代理研究新范式,阐述其四大核心模块、优化方法、数据处理、奖励机制,还提及开源系统亮点及相关论文。
windsurf分享了他们对构建Agent应用的认知。
windsurf发表博客讨论Agent,指出构建Agent应用存在认知误区,分享灵魂四问分析框架评估其‘含金量’,还提到苦涩教训,提醒警惕过度设计,拥抱规模化、通用化方法。
矩阵起源(MatrixOrigin)完成超千万美元A轮融资 | 5Y News
2026年8月6日,企业级AI基础设施厂商矩阵起源完成超千万美元A轮融资,由汉得信息参与投资的基金、亚康股份与Artesian Venture Partners注资。资金用于平台研发、市场拓展等。其产品具优势,获多方认可。
专访|两位华人主导创办,Jeff Dean参投,伯克利开源项目SkyPilot转型初创
前沿模型团队算力瓶颈从不足变为分散,开源AI算力调度项目SkyPilot应运而生。7月末,它从高校走出成为初创公司,完成2000万美元种子轮融资。其免费版与商业版各有侧重,切入AI编排赛道潜力大。
千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师
以往空间音频模型受限于采集条件和标注成本,清华和密西根大学团队在CVPR 2025给出新路径,利用相机自运动作监督信号,让模型从互联网视频学三维空间音频感知,成果入选会议Highlight。