「具身全栈引擎」共找到 1333 篇相关文章
杭州再出黑马,中国千亿市场被炸穿!AI「杀死」会计,达摩院大佬出手了
杭州精算家的「深蓝财鲸」炸穿国内千亿财税市场,实现90%降本。它具多智能体协作框架与动态策略进化引擎,冲击传统代账公司和中小企业财务岗,其团队来自达摩院,对标美国巨头Intuit。
DreamArt!只需一张图,生成可动的可交互物体
生成可动物体是具身智能等领域关键挑战,现有方法有局限。北大团队提出DreamArt框架,从单张图像生成可交互可动物体,经三阶段流程,表现优于基线方法,不过也存在生成不符物理规律等问题。
蚂蚁开源世界模型LingBot-World:具有分钟级记忆的实时世界模拟器
蚂蚁集团旗下灵波科技开源具身智能模型及世界模型LingBot-World,它将视频生成模型进化成可交互世界模拟器,采用多阶段进化策略,有涌现记忆等能力,虽有不足,但为开源社区构建世界模型迈出坚实一步。
大厂离职后,白天是保安,夜里是 AI 创造者
本文讲述杨晨从大厂运营离职后成为保安,白天观察人间百态,夜里用AI搞创作。他用AI为家人、朋友做工具,还帮公司做定制化工作流,赚了点小钱。他也想记录普通人故事,认为大家可借AI改变生活。
国产「3D版Anthropic」再获数亿融资!60人初创,卡住全球3D脖子
影眸科技完成数亿元新一轮融资,发布全球首个具千万面级生成能力、引入‘先思考、再生成’逻辑的3D大模型Hyper3D Rodin Gen - 2.5。其有诸多优势,获多巨头认可,目标是定义空间智能底层规则。
怎么量化机器人数据价值?ATHENA将影响函数扩展到十亿参数VLA,313×加速筛选高价值数据
具身智能进入数据scaling时代,VLA模型训练中数据并非越多越好。上海交大同济等校团队提出ATHENA框架,将影响函数扩展到十亿参数VLA模型,解决计算和筛选难题,实现313倍加速,实验证明其用更少数据获更好效果。
刚刚,最佳VLA模型GigaBrain-0开源:世界模型驱动10倍数据,真机碾压SOTA
近日,极佳视界与湖北人形机器人创新中心联合发布端到端VLA具身基础模型GigaBrain - 0,这是国内首个用世界模型生成数据实现真机泛化的模型,后续将全面开源,能完成复杂操作,实验成功率超SOTA方法。
5秒出4张2K大图!阿里提出2步生成方案,拉爆AI生图进度条
阿里智能引擎团队针对Qwen最新开源模型,将SOTA压缩水平从80 - 100步前向计算骤降至2步,速度提升40倍,5秒可出4张2K高清大图。已发布Checkpoint,集成到呜哩AI平台。文章还分析传统蒸馏方案问题并介绍团队改进策略。
10岁孩子都能训机器人!对话松应科技创始人:做物理AI界的“安卓”挑战英伟达,正将其开源开放
松应科技创始人聂凯旋表示团队对标英伟达,四年达其主流能力,产品落地多家企业。松应发布 ORCA Lab 1.0 开发者版,降低具身智能研发门槛。其采用开放生态,构建数据策略,目标培养物理 AI 人才,推进自主创新。
T-PAMI|中国科大、合工大等提出CAPER++:让关节物体位姿感知真正迈向「又快又稳」
在具身智能发展下,关节物体位姿感知难题待解。中国科大、合工大等团队提出 CAPER++ 框架,从关节驱动视角建模,将位姿学习拓展至 SE (3) 流形切空间,实现端到端推理,兼顾精度、鲁棒性与实时性。