多视角评估」共找到 4742 篇相关文章

新闻资讯8

第一视角效率超过真机,深度机智发布全球首个以人类学习范式构建的具身基座模型

2026年具身智能行业火热,但技术路线不明。深度机智创始人陈凯在中关村论坛发布具身智能基座模型PhysBrain 1.0,用千余小时人类第一视角数据超越真机数万小时数据成果,开启具身领域‘物理常识’革命。

AI科技评论
算法论文8

解码提速15.1倍、任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,任务性能不降。

机器之心
开源动态8

GitHub Trending 榜一的开源 Cowork 来了!4天4.5K星,首个智能体工作流应用!

开源项目Eigent冲上GitHub Trending榜首,4天获4.5K+ Star。它是全球首个智能体工作流桌面应用,完全开源、支持本地模型,有种智能体工作流,具备本地优先、并行工作流等特性,提供三种使用模式。

开源星探
算法论文8

深度视角 | 物理法则如何“纠偏”AI黑盒?首篇社会物理学引导的深度学习(SGDL)综述深度解析

近日,清华等机构发布全球首篇SGDL系统性综述。文章介绍SGDL诞生背景、核心架构、应用场景,探讨其与大模型结合潜力,也指出面临的挑战,认为其是思维范式跃迁,正构建智能社会蓝图。

AI科技评论
算法论文8

视频世界模型跑长序列不「崩」了!用光流约束+历史记忆+步训练,让动态场景稳如磐石

现有视频世界模型在长时间交互中易出现运动不合理与场景崩坏问题,核心原因是误差累积。MagicWorld提出面向长时稳定性的交互式建模框架,通过光流约束、历史缓存检索和步聚合训练,有效缓解误差累积。

量子位
算法论文7

模态大模型不会画辅助线?最新评估得分:o3仅25.8%,远低于人类82.3% | 清华腾讯斯坦福联合

清华、腾讯、斯坦福等团队发布RBench - V基准测试,评估大模型视觉推理能力。结果显示,主流大模型如o3、Gemini2.5等准确率远低于人类,开源模型表现更差,暴露出大模型在复杂模态推理任务中能力不足。

量子位
开源动态8

银河通用X清华大学发布业内首款开源人形机器人全身遥操系统OpenWBT,支持机型、跨虚实,小时内可轻松部署

银河通用与清华大学合作发布全开源人形机器人全身遥操作系统OpenWBT,新手小时内可部署。该系统有极简部署、机型跨平台、兼顾虚实遥操三大亮点,背后技术解决了sim2real迁移难题。

机器之心
算法论文8

3D重建的惊人进展:所世界名校联合发布论文,告诉你AI在3D世界的研究现状

所世界名校联合发布调查研究论文,回顾用于3D重建和视图合成的前馈技术并分类,研究关键任务及应用。前馈模型打破每场景优化魔咒,带来速度和泛化能力的提升,解锁新应用,但也面临挑战。

AIGC开放社区
开源动态8

【GitHub 10.9k star】DeepCode:把论文和需求文档“一键变代码”的智能体开发神器,真能干掉手写样板?

DeepCode 是香港大学开源的智能体开发平台,支持将论文、需求文档等转化为生产级代码。它能解决论文复现、原型开发等痛点,有项特色功能,在性能对比中领先,适用于类场景。

小华同学ai
新闻资讯8

振臂一挥,大半个具身机器人圈都来了!智源研究院:别藏了,谁贡献数据,谁的大脑就更好用

2025智源具身智能Open Day上,智源研究院院长邀厂商共享数据,称谁家贡献,具身大脑在其机器人上更好用。智源无商业包袱,开源数据、统一评测,布局具身大小脑体系,欲做具身智能“安卓”。

量子位