「机器人具身推理」共找到 3405 篇相关文章
预测误差仅0.26mm,中科院自动化所×灵宝CASBOT团队让机器人提前“知道你要干嘛”
中科院自动化所与灵宝CASBOT提出DTRT方法获ICRA 2025录用。该方法利用Transformer和博弈论,将人类动态纳入长期预测,实验显示其预测精度和协作表现显著优于现有技术,有巨大应用潜力。
独家专访来福谐波创始人及投资人:一家县级市机器人零部件公司,如何走到港股上市?|甲子光年
2026年6月30日,浙江来福谐波传动股份有限公司在港股上市。「甲子光年」专访其创始人张杰和北极光创投合伙人黄河,探讨这家县级市企业如何在竞争激烈的市场中站稳脚跟、发展上市,还分享了发展历程、产品迭代等情况。
万帧照片级仿真,打通视觉机器人学习的感知与物理鸿沟:国产仿真器GS-Playground入选RSS 2026
清华大学等联合提出高通量视觉高保真仿真器GS - Playground,被RSS 2026录用。它解决现有仿真器渲染开销高、资产制作依赖人工、Sim2Real迁移鸿沟大等问题,是全栈重新设计的仿真基础设施。
大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练
字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。
告别高昂重制成本!港科大广州、快手可灵发布立体视频转换单步推理新方案
随着 3D 设备发展,人们对 3D 立体视频需求增加,但高昂制作成本成阻碍。快手可灵与港科大广州团队联合提出 StereoPilot 模型,能快速将 2D 视频转为高质量 3D 视频,还构建了 UniStereo 数据集。
一个现代化AI 内容聚合平台,集成了 AI 报告生成、飞书机器人推送、多源内容聚合等高级功能
RSS - AIGC 是现代化 RSS 订阅与 AI 内容聚合平台,有智能内容聚合、AI 内容加工等核心能力。具备 RSS 订阅管理、内容聚合等功能,还介绍了环境要求、配置说明及部署指南。
在西部见证了一场极致真诚、极具影响力的科技领袖盛会|GTLC成都站圆满落幕
10月25日,GTLC全球科技领导力大会·成都站圆满举办,以“AI新‘蜀’光”为主题,邀请十余位嘉宾从多角度分享。大会含主题演讲、闭门会和特色活动。多位嘉宾围绕AI应用、企业转型等分享经验,为各行业提供参考。
模拟大脑功能分化!北大与港中文发布Fast-in-Slow VLA,让“快行动”和“慢推理”统一协作
北大与港中文研究团队发布 Fast-in-Slow(FiS-VLA)全新双系统视觉 - 语言 - 动作模型,将快速执行模块嵌入预训练视觉 - 语言模型,实现快慢系统一体化。该模型在多平台表现优异,控制频率大幅领先。
为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通大学
上海交通大学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态大模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。
ICCV 2025 | 打造通用工具智能体的基石:北大提出ToolVQA数据集,引领多模态多步推理VQA新范式
北大团队提出ToolVQA数据集,用于提升基础模型工具使用能力。它含2.3万条样本,贴近真实需求。通过ToolEngine构建,涵盖多工具与任务领域。微调后模型表现佳,代码与模型已开源。