「开放世界数据集」共找到 3663 篇相关文章
从数据分布视角,重新认识下CoT
本文从数据分布视角重新审视大语言模型的思维链(CoT)推理。指出CoT并非真正推理,而是模仿,其效果受训练与测试分布差异影响。通过实验揭示CoT在分布偏移时性能退化,提醒勿过度依赖。
美国视频生成老炮儿,入局世界模型
Runway发布首个通用世界模型GWM - 1及一系列变体,包括GWM Worlds、GWM Avatars、GWM Robotics,均基于Gen - 4.5构建。还对Gen - 4.5升级,新增原生音频生成、编辑和多镜头编辑功能。
The Batch: 879 | 谷歌必须与 AI 竞争对手共享数据
一家联邦法院裁定,谷歌须将当前搜索索引交给美国本土AI及搜索引擎对手,以打破其在网页搜索的垄断,但未采纳拆分公司请求。谷歌按条件共享数据,在其他业务仍可竞争。
阿里新研究:统一了VLA和世界模型
阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。
效率狂飙数倍后:Coding Agent已然成熟,但开放世界仍是“无人区”
2025 年被定义为 Agent 的‘工程落地元年’。MCP、A2A 协议及多智能体协同框架推动 Agent 应用爆发,但企业级落地仍面临多 Agent 协作低效等挑战。AI Coding 和自动化运维是落地较成熟领域,其终极形态观点不一。
中科院类脑大模型SpikingBrain,2%数据,百倍速度
中国科学院自动化研究所李国齐、徐波团队发布全球首款大规模类脑脉冲大模型SpikingBrain 1.0。它处理长文本比主流Transformer模型快超百倍,训练数据仅为2%。该模型采用新架构,降低计算复杂度,还可转换现有模型,且在国产GPU完成训练。
腾讯发布Hunyuan-GameCraft!从静图进入动态游戏世界
近年来,现有方法难满足游戏视频生成需求。腾讯推出Hunyuan - GameCraft,可基于一张图像和提示词生成游戏交互视频,能精准响应交互信号,保留历史场景信息,不过动作空间待丰富。
字节奖学金首次全球开放,五年67位得主去向追踪
2026 字节跳动奖学金启动,首次开放全球申请,扩大获奖名额、提高奖金。此前五届共支持 67 位青年研究者,研究覆盖 AI 全谱系。获奖者去向多元,研究方向常领先风口,体现字节对源头创新的支持。
Qwen-AgentWorld:一个语言世界模型,模拟七大Agentic领域
今天正式发布 Qwen-AgentWorld,它是首个原生语言世界模型,能在七大领域模拟智能体交互环境。同步发布 AgentWorldBench 评测基准。Qwen-AgentWorld 经三阶段训练,在评测中表现出色,还探索两种范式增强通用智能体能力。
一分钟的奇迹与幻觉:实测世界模型Happy Oyster
4月16日阿里发布世界模型Happy Oyster,支持多模态输入与音视频联合生成。实测显示,它在场景构建、渲染上有优势,可替代部分传统引擎工作,但存在一致性不足问题,现阶段更适合改造游戏开发流程。