「F2LLM」共找到 2796 篇相关文章
GenEnv:智能体与环境模拟器之间的难度对齐协同进化 | 直播预约
训练高性能 LLM 智能体受限于真实世界交互数据的成本和特性,为此推出 GenEnv 框架,它建立难度对齐协同进化博弈,能让智能体表现提升,减少数据使用量,为扩展能力提供数据高效路径。
如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性
文章通过分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在大规模 AI 训练中的表现。介绍三类训练负载及新的 Checkpointing 负载,分析共享文件系统类别,给出比较视角,解读各负载测试结果并总结选型要点。
用Claude Code剪视频,自动去口癖、加字幕、调色,完全免费开源
browser - use团队开源Claude Code技能video - use,可自动去口癖、加字幕、调色等。它通过转录文本和按需视觉合成图让LLM理解视频,有完整流水线和设计原则,还给出使用方法。
灭霸带着复联放烟花!16秒,让手搓 AI 视频拥有大片即视感
生数科技的Vidu Q3超越Sora 2,位居全球第二、中国第一。它能16秒声画同出、叙事能力强、镜头和文字渲染出色,还降低了视频制作门槛,可用于漫剧、短剧、影视剧制作。
2026 将近,世界模型到底更「世界」了吗?
近期 Runway 发布相关产品,让「世界模型」讨论再聚焦。其定义从强化学习语境延伸,业内理解不断变化,概念边界变模糊。如今被推到和 LLM 同级,出现概念同名但内核分裂现象。
硅谷热议:最快语音转文字模型
AI语音独角兽ElevenLabs发布Scribe v2 Realtime实时语音转文本模型,实现150毫秒超低延迟、93.5%高准确率,覆盖90多种语言,打破速度与精度不可兼得困境,此前该领域痛点多。
Agent+Code,打开AI开发新范式
当下企业级AI叙事逻辑转变,传统AI应用有瓶颈。京东云在JDD 2025大会提出“深度应用”理念,推出“Agent+Code”新范式,其包含JoyAgent 3.0和JoyCode 2.0,还通过开源引领行业创新。
浙大校友打造AI代码测试神器,零代码零bug,30分钟创建网站
浙大校友打造的智能测试平台TestSprite 2.0,零代码零bug,30分钟创建网站,能让AI写代码准确率从42%跃升至93%,还可自动生成测试报告、调试修复错误,全程无需人工干预。
GoPro卖身了,准备搞光模块
当地时间9月1日,GoPro与Starman Optical达成合并协议,后者2.85亿美元收购约90%股权。GoPro曾辉煌,后因产品、对手、内存等问题衰败。Starman看中专利等,GoPro或涉足新领域。
阿里开源 Vivid-VR!带来逼真连贯的视频修复
阿里开源 Vivid - VR 用于视频修复,基于 T2V 模型结合 ControlNet 保证画面一致性。它引入概念蒸馏训练策略,设计控制特征投影器和双分支 ControlNet 连接器,实验展现出优异表现。