「强化学习训练框架」共找到 3143 篇相关文章
BesiegeField:LLM能否学会设计机器?
香港中文大学推出基于游戏《Besiege》的测试平台BesiegeField,探讨LLM能否学会设计机器。研究通过组合式机器设计视角,测试LLM,提出多智能体迭代设计流程等,发现LLM有挑战但并非不可实现,如Gemini 2.5 Pro表现不错。
Self-Forcing++:让自回归视频生成模型突破 4 分钟时长极限
加州大学洛杉矶分校与字节Seed等团队联合完成Self-Forcing++,让自回归视频生成模型突破4分钟时长极限。它解决传统模型架构缺陷,经三步技术实现稳定超长视频生成,实验超基线,但仍有长时记忆缺失等问题。
万字长文 | 异构算力技术架构与核心组件解析
文章聚焦异构算力技术架构与核心组件,解析主流AI芯片特点、国产芯片技术路线;介绍高速互联技术、网络拓扑结构及优化方法;阐述大模型存储需求、分布式存储技术及数据预处理与加载技术,为AI计算提供全面方案。
AI「学不会」竟成相变探针!UCSD华人联手谷歌等,曝光量子纠缠秘密
加州大学圣地亚哥分校华人学者Wanda Hou等与Google Quantum AI合作,在谷歌超导量子处理器实验,发现机器学习模型‘学不会’对应量子体系测量诱发相变,AI失效成物理探针,还展望了量子AI前景。
LeCun团队开源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典
Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在多个代码与推理任务表现出色,开源代码、训练细节等,不过目前仅支持Python。
这一次,天玑9500的端侧AI能力,友商赶不上了
9月22日,联发科推出天玑9500芯片,展示新形态端侧AI应用,推动端侧AI实用化。其性能强、功耗低,还支持端侧模型训练。多家手机厂商将发布搭载该芯片的手机,展现新AI趋势。
GPT-5爆改时尚圈,让Excel原地复活!OpenAI黑客松大奖出炉
OpenAI举办GPT - 5黑客马拉松挑战赛,95支队伍角逐5万美元奖金。韩国Gentoo团队夺冠,其用GPT - 5开发系统助力商家营销。此外,还有团队将GPT - 5用于时尚、电子表格、知识学习、电脑使用、电网决策等场景。
震撼实锤!清华姚班校友揭「1.4×加速」陷阱:AI优化器为何名不符实?
为降低大模型预训练成本,近年新优化器频出,宣称加速1.4×到2×却难落地。斯坦福研究指出方法学缺陷,对比不同缩放范式加速差异,给出优化器设计见解,证实严格基准评测必要。
通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性能,硬件无缝支持
LLM.265研究发现,视频编码器是高效的大模型张量编码器,现成视频编解码硬件压缩AI模型数据效率高。它灵活控制码率、可压缩多种张量,还能利用GPU硬件加速。实验显示其压缩效果显著。
如何破解海量内容审核难题?快手安全大模型技术探索与应用实践
在数字内容爆炸式增长下,传统内容审核模式难应对挑战。快手安全算法中心负责人刘梦怡分享自研多模态大模型技术方案与应用实践,涵盖架构、数据、训练等,还介绍审核智能化应用及未来展望。