「动作控制」共找到 713 篇相关文章
陪5岁小朋友玩到黔驴技穷,我用一张照片给他做了个汪汪队手办。
作者陪5岁小朋友玩时,用一张照片结合Hi3D网页和3D打印技术做汪汪队手办。介绍了3D建模、格式选择、代加工等全流程,还分享了成本控制和上色等经验。
从 Rule、Spec 到 Harness:AI Coding 的渐进式建设路径
作者分享帮团队落地AI Coding经验,指出试点易但推广难,瓶颈在接收端。介绍从Rule、Spec、Loop到Harness的渐进式建设路径,各层前后相依,逐层收紧控制面,助AI在工程体系稳定交付。
不同灵巧手,终于可以共用「一套大脑」了
北卡罗来纳大学教堂山分校团队提出 One Hand to Rule Them All,构建统一描述空间,使不同灵巧手共享动作表达与策略结构。该方法解决跨手泛化难题,实验证明其在多方面有效,有望推动机器人操作研究发展。
英伟达世界模型再进化,一个模型驱动所有机器人!机器人的GPT时刻真正到来
英伟达GEAR实验室提出DreamZero,是基于预训练视频扩散骨干网络的世界动作模型,有140亿参数,能让机器人通过文本提示完成未见任务。它解决了传统模型问题,在多方面表现出色,代码已开源。
Github 7万星的Clawdbot实测:用国产模型做心脏,躺在床上指挥电脑干活。
本文实测了Github 7万星的Clawdbot(现叫Moltbot),介绍其能在本地运行,可多平台交互,有持久记忆、能控制浏览器等特点,还说明了安装配置过程,指出它虽有不足但想象空间大。
企业级Agent「登月」时刻!1人1周搞定高可用系统,只花5元
12月16日,无问芯穹智能体服务平台发布,为企业提供全链路陪伴式落地服务。它有能力模板和托管服务,能解决企业智能体落地困境,如提升效果、保障稳定、控制成本等,已在多行业验证价值。
视频生成Prompt何须仅是文字!字节&港中文发布Video-As-Prompt
AI视频生成中,依赖抽象语义控制的创作因缺乏统一条件表征而困难。字节与港中文团队提出Video - As - Prompt框架,引入‘视频参考’范式,实现抽象语义下可控视频生成范式统一,代码和数据集已开源。
用完这张无限可能的AI画布,第一次感觉人类导演要失业了!
2024年7月上线后迅速风靡海外的SkyReels发布最新版本,它重构AI创作生态,打通「图片—音频—视频」全栈,集成多种功能于一张画布,还推出专家智能体,让普通人轻松创作高质量内容。
AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星
香港大学黄超团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首超人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。
Dexmal原力灵机开源Dexbotic,基于PyTorch的一站式VLA代码库
Dexmal原力灵机推出基于PyTorch的开源视觉-语言-动作模型(VLA)代码库Dexbotic,面向具身智能研究者。其架构含三大核心组件,有五大特征,还推出开源硬件,未来将持续投入生态建设。