3D世界模型2.0」共找到 8998 篇相关文章

算法论文8

首个3D动作游戏专用VLA模型,打黑神话&只狼超越人类玩家 | ICCV 2025

淘天集团未来生活实验室团队提出首个3D动作游戏专用VLA模型CombatVLA,已被ICCV 2025接收。它能处理视觉输入输出动作指令,在战斗理解准确率和执行速度上表现优异,还构建了评测基准等。

量子位
新闻资讯7

猝不及防,Adobe关停2D动画软件Animate拥抱AI!最惨学生:一学期的课白上了

Adobe宣布将于2026年3月1日停止销售2D动画软件Animate,企业客户可获三年服务,其他用户仅一年。该软件历史超25年,虽有衰落但仍被不少人使用,Adobe此举或因重心转向AI。

量子位
算法论文8

无预训练模型拿下ARC-AGI榜三!Mamba作者用压缩原理挑战Scaling Law

CompressARC研究中,Mamba作者Albert Gu团队给出不同于大规模预训练的智能配方——最小描述长度(MDL)。一个76K参数、无预训练模型,在ARC - AGI - 1基准解决20%问题,获ARC Prize 2025第三名。

量子位
算法论文8

SCPMA|清华大学 张宇飞团队:基于改进傅里叶神经算子的翼型流场快速预测模型

传统计算流体力学在工程场景计算成本高,深度学习方法预测精度与泛化性不佳。本研究基于傅里叶神经算子构建流场预测模型,经改进能精确预测超临界翼型流场与气动力系数,误差低且泛化能力优。

力学与人工智能
开源动态7

2万开源项目已用上,OpenAI下了盘大棋,Cursor,Codex智能体纷纷支持

据彭博社消息,DeepSeek计划年底发布可自主执行多步任务、自我学习进化的AI Agent。OpenAI开源的AGENTS.md已获5k星,为编码智能体提供使用说明,还给出示例和使用指南,相关智能体已用于2万开源项目。

PaperAgent
算法论文8

如何将LLM的"思考习惯"迁移到视觉领域?

传统多模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。

深度学习自然语言处理
新闻资讯8

Anthropic首次揭秘下一代Claude怎么造!用户吐槽直接喂模型,连AI“做梦”都被训练

Anthropic研究团队产品经理Alex在访谈中透露Claude演进方向,如将模型开发产品化、向“持续运行Agent”演化,还解释“dreaming”机制等,也提及训练“人格”、研究意识等,展现了长远思考。

InfoQ
开源动态8

把RoPE扔掉,AI更能看懂长上下文!Transformer作者团队开源大模型预训练新方法

Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。

量子位
开源动态8

不吹不黑,在Agent任务上,kimi 2.6确实让我忘了Claude。

Kimi K2.6发布并开源,代码和Agent能力提升。作者测试发现,它在部署Claude Code源码、网站生成、多智能体任务等方面表现出色,审美提升,思维活跃,还能复刻文档风格,开源释放了前沿编程能力。

探索AGI
算法论文8

模型赋能的具身智能:自主决策和具身学习技术最新综述

具身智能是通往通用人工智能的关键路径,但传统方法有泛化瓶颈。电子科大最新综述梳理大模型赋能具身智能的自主决策与具身学习,还将‘World Model’纳入统一框架,为研究者提供路线图。

PaperAgent