机器人控制框架」共找到 2807 篇相关文章

开源动态8

腾讯开源Stand-In!轻量级身份保留视频生成新突破

生成符合指定身份的高保真视频挑战大,现有方法依赖大参数且兼容性不足。腾讯开源轻量级、即插即用的Stand - In框架,在身份保留文本生成视频任务中性能先进,兼容性强,有广阔应用潜力。

带你学AI
算法论文8

CHI 2026 Best Paper|社会模拟迈入可控、可量化时代:为AI Agent加上「认知滑条」

UCSD团队在CHI 2026 Best Paper论文CoBRA中提出可量化、可验证、可复现的Agent控制框架。它将经典社会科学实验转化为校准环境,使Agent行为可控,标志着AI社会模拟走向实验科学范式。

机器之心
算法论文8

UNC | 发布Bifrost-1,构建“最强大脑”与“顶级画师”的桥梁,低成本实现“文生图”自由

随着AI发展,打造能推理又能创作的系统成为焦点。但让LLM学习视觉创作面临训练成本高和能力受损问题。BIFROST - 1框架在MLLM和扩散模型间建通信信道,解决核心痛点,实验表现出色。

AINLPer
算法论文7

机器狗能当羽毛球搭子了!仅靠强化学习从0自学,还涌现出类人回位行为 | Science子刊

苏黎世联邦理工学院团队让机器狗靠强化学习学会打羽毛球,开发全身视觉运动控制策略,使其最高挥拍速达12米/秒,还涌现类人回位行为,研究证明足式机器人在体育场景应用可行。

量子位
算法论文8

北大-灵初重磅发布具身VLA全面综述!一文看清VLA技术路线与未来趋势

GPT-4o等多模态基础模型发展,让研究者探索将智能延伸到物理空间,VLA模型受关注。北大 - 灵初联合实验室从动作词元化视角提出新框架,分析主流action token,还介绍了VLA发展趋势及面临挑战。

机器之心
算法论文8

单张4090跑到30fps,范浩强团队让VLA实时跑起来了

Dexmal原力灵机团队在RT - VLA论文中公布,常用Pi0级30亿参数VLA模型在单张RTX 4090上最快能跑30fps。他们深入分析优化模型,成果已开源,还设计了未来控制框架

机器之心
开源动态8

视频生成Prompt何须仅是文字!字节&港中文发布Video-As-Prompt

AI视频生成中,依赖抽象语义控制的创作因缺乏统一条件表征而困难。字节与港中文团队提出Video - As - Prompt框架,引入‘视频参考’范式,实现抽象语义下可控视频生成范式统一,代码和数据集已开源。

机器之心
推荐文章8

在参与OpenAI、Google、Amazon的50个AI项目后,他们总结出了大多数AI产品失败的原因

Aishwarya Naresh Reganti和Kiriti Badam参与超50个AI项目后,指出多数AI产品失败。他们认为构建成本降低,但设计和明确痛点才是关键,还分享开发陷阱、成功路径,介绍CC/CD框架及AI未来走向。

AI前线
新闻资讯8

黄仁勋CES最新演讲:Rubin 今年上市,计算能力是 Blackwell 5 倍、Cursor 彻底改变英伟达软件开发方式、开源模型落后于先进模型约6个月

英伟达CEO黄仁勋在CES 2026演讲宣告AI从理解语言走向改造物理世界。他提及开源模型发展,还发布多款新品,如AlpaSim仿真框架、GROOT 1.6机器人模型、AI超算Vera Rubin等,凸显英伟达在AI领域的布局与野心。

InfoQ
8

AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星

香港大学黄超团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首超人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。

新智元