视角 - 动作对齐」共找到 681 篇相关文章

新闻资讯7

4万多名作者挤破头,CVPR 2025官方揭秘三大爆款主题, 你卷对方向了吗?

CVPR 2025 官方根据 4 万多名作者 13008 份投稿,总结出计算机视觉热门的三大方向,即基于多视角与传感器的 3D 技术、图像与视频合成、多模态学习(视觉、语言和推理),并介绍了各方向热门原因。

机器之心
新闻资讯7

奥特曼马斯克豪言:我们已进入奇点!AGI加速窗口已至

新智元报道,奥特曼和马斯克都认为奇点已至,当下处于AGI加速窗口。OpenAI曾靠资源猛追让Codex逆袭。但AI发展也引发担忧,如人类能否保持理智、安全对齐进展不明等。

新智元
算法论文8

机器人终于能用明白洗碗机了|UC伯克利新研究

UC Berkeley团队发表研究论文,通过‘模块化教学+智能选动作’方案破解人形机器人全身协同难题。该方案结合星动纪元STAR1硬件优势,经实验验证效果远超传统方案,为机器人产业化带来落地价值。

量子位
算法论文8

腾讯混元数字人团队发布Moral RolePlay基准,揭秘大模型的「道德困境」

腾讯混元数字人团队和中山大学推出「Moral RolePlay」测评基准,评估大模型扮演多元道德角色能力,揭示顶尖AI模型演不好反派,暴露模型理解社会心理复杂性的局限,还给出未来对齐技术方向。

机器之心
开源动态8

大事不好!机器人学会预测未来了

蚂蚁灵波连续四天开源,此次推出全球首个用于通用机器人控制的因果视频 - 动作世界模型LingBot - VA。它能脑补未来,有记忆不丢失、高效泛化等亮点,架构设计独特,实验效果出色,推动通用机器人走向视频时代。

量子位
新闻资讯8

刚刚,Opus 5来了:性能不输 Fable 5、价格砍半

Anthropic 发布新一代模型 Claude Opus 5,其智能接近 Claude Fable 5 但价格减半。它在编程、知识工作等评测中表现出色,科研能力进步大,自主性与严谨性更强,安全对齐度高,防护兼顾安全与可用。

机器之心
新闻资讯7

具身智能稀缺的数据,可能藏在这个游戏手柄里?

游戏录屏平台Medal掌握的玩家操作记录成机器人模型训练核心数据。其创始人皮姆创办General Intuition获高额融资,该公司用游戏录像预训练动作模型,但也面临数据多元性、任务表现及合作模式等问题。

DeepTech深科技
新闻资讯8

Claude Design连夜突袭,Figma市值瞬间蒸发!或抢走全球UI设计师饭碗

Claude实验室推出Claude Design功能,只需输入一句话就能生成可交互完整原型,让Figma等设计公司股价跳水。它或让画图动作消失,引发对设计师职业是否会被取代的思考,Anthropic还在下更大的棋。

新智元
开源动态8

音画同步视频生成重磅开源!Character AI和耶鲁大学推出Ovi,让音、画在一个大脑里思考

Character AI和耶鲁大学团队推出开源模型OVI,它采用双骨干交叉模态融合架构,让音视频同步生成。其架构对称,用旋转位置嵌入技术对齐时间,训练策略分步进行,生成效果佳,为开源音视频生成提供新路径。

AIGC开放社区
开源动态8

开源模型首超Opus4.6!智谱GLM-5.1登场,14小时后CUDA专家被冲了

智谱开源模型GLM - 5.1带来重大突破,14小时完成CUDA Kernel优化,加速比大幅提升。它解锁与顶尖闭源模型Claude Opus 4.6全面对齐,在多测试中表现优异,展现长程任务能力,改写行业叙事逻辑。

量子位