「两阶段训练策略」共找到 3206 篇相关文章
世界模型原生新一代范式!极佳视界斩获全球第一后,GigaBrain-0.5M*再进化
具身世界模型新一代原生范式登场,GigaBrain-0.5M*在多真实机器人任务中数小时零失误。它依托世界模型,创新引入人在回路机制,研发采用四阶段闭环训练流程,优势显著。
Cloudflare 增强robots协议:对“AI白嫖”说不
互联网面临开放内容被利用或封闭内容失读者的困境,AI加剧此局面。Cloudflare持近20%网站流量,先推抓取付费策略,又推“内容信号政策”,升级robots.txt,限制AI训练使用内容。
Lumina-mGPT 2.0:自回归模型华丽复兴,媲美顶尖扩散模型
上海人工智能实验室等团队提出Lumina - mGPT 2.0自回归模型,统一多种图像任务。它采用独立训练架构、统一多任务处理框架和高效推理策略,实验表现优异,后续将优化采样时间并扩展至多模态理解。
流式数据集:效率提升 100 倍!
现在只需一行代码,就能通过 `load_dataset('dataset', streaming=True)` 以流式方式加载数据集,无需下载。Hugging Face 优化后端,提升流式数据集速度与效率,减少请求、提升解析速度,还优化启动和流式加载阶段。
跳出「黑盒」,人大刘勇团队最新大语言模型理论与机理综述
大语言模型工程成功但理论研究滞后,被视为「黑盒」。人大刘勇团队用生命周期分类法,将LLM理论研究整合为六阶段,系统综述底层理论与机制,指出前沿挑战,为其向严谨科学转型提供路线图。
Being-VL的视觉BPE路线:把「看」和「说」真正统一起来
北大、UC San Diego 和 BeingBeyond 联合提出 Being-VL 的视觉 BPE 路线,先将图像离散化并「分词」,再与文本统一建模,能缩短跨模态链路、保留视觉结构先验,还介绍了实现步骤、训练方式等。
字节开源版Seedance发布,超越Sora 2!
字节Alive团队发布开源版Seedance 2.0,在人类评估中超越Sora 2等。它通过统一架构、时空对齐技术和非对称训练策略,解决声画不同步和画质音质难两全问题,还建立数据流水线和测试基准。
刷新SOTA高出19.05分!英伟达开源OmniVinci全模态理解模型,只用1/6的数据,实现全方位超越
英伟达研究团队发布OmniVinci研究,该全模态理解大语言模型用六分之一训练数据,在全模态理解基准测试成绩超现有顶尖模型19.05分。它靠创新架构和数据策略实现效率与性能双突破。
腾讯提出SPO,告别Group
腾讯团队提出Single - stream Policy Optimization(SPO),回归单流策略梯度范式,解决组基方法瓶颈。它有多项亮点,如告别组同步、采用自适应价值跟踪等,在实验中提升了模型性能和训练吞吐。
一句话生成无限逼真3D场景!匹兹堡大学新作直击VLM空间推理软肋丨CVPR'26
VLM在3D空间推理上表现不佳,且缺乏合适测试基准。匹兹堡大学团队提出InfiniBench框架,用LLM Agent迭代优化和聚类策略,可按需生成3D场景,还能精准定位大模型空间推理缺陷。