开源动态8
英伟达等推出Long - RL,长视频训练速度翻倍
机器之心
AI 摘要
英伟达联合多机构推出Long - RL,解决大模型处理长视频和复杂推理难题。它提升训练数据长度上限、让速度翻倍,LongVILA - R1是其应用,团队称结合RL和长序列推理是AGI必经之路。
阅读原文 · 机器之心
英伟达&MIT等推出Long-RL,长视频训练速度翻倍
英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
95后庞天宇入职腾讯任混元首席科学家
继OpenAI大神姚顺雨之后,95后清华博士庞天宇入职腾讯,任混元首席研究科学家,负责多模态强化学习。腾讯AI战略从跟随转向进攻,人才、技术、架构都有新动作。
新智元
开源动态8
国产SpikingBrain适配GPU,长序列推理提速百倍
中国科学院自动化所李国齐、徐波团队发布类脑脉冲大模型SpikingBrain (瞬悉)-1.0,借鉴大脑信息处理机制,适配国产沐曦GPU,长序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑大模型生态。
量子位
开源动态7
27.2k Star FastMCP:让MCP工程化
文章介绍了27.2k Star的FastMCP,它是Python MCP应用框架,能让普通Python函数成为MCP工具。讲了其适合场景、省事原因及上线安全边界,还给出了适用人群和注意点。
小华同学ai
开源动态8
腾讯开源框架,一句话造3D世界
香港科技大学(广州)和腾讯团队开源VibeWorlding框架,实现说句话造3D世界。它由VWE - Bench和VibeWorlding - Gym组成,开源模型经强化学习训练后成绩逆袭,证明强化学习解锁3D推理潜力巨大。
AIGC开放社区