具身操作评测」共找到 2053 篇相关文章

8

10万字Claude系统提示词泄露!我用DeeSeek 将它翻译成了中文版

Claude完整系统提示在GitHub泄露,虽真假未确认,但值得分享供参考。作者用DeepSeek将其翻译成中文版,该提示涵盖模型行为、工使用等多方面,设计精妙全面,是AI交互设计“百科全书”,对提示词工程师极学习价值。

AGI Hunt
开源动态8

终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成

过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。

量子位
8

CUDA 20年护城河一个周末崩了 !Claude独自跑通AMD新GPU

一个周末,Claude直接把自家最前沿模型跑在全新AMD MI355X机架,人类工程师没改一行代码。AMD还给AI开发调GPU的工,ROCm.AI可让Agent自己部署操作。Agent补生态积累短板,对CUDA生态形成降维打击。

新智元
算法论文8

T-PAMI|中国科大、合工大等提出CAPER++:让关节物体位姿感知真正迈向「又快又稳」

身智能发展下,关节物体位姿感知难题待解。中国科大、合工大等团队提出 CAPER++ 框架,从关节驱动视角建模,将位姿学习拓展至 SE (3) 流形切空间,实现端到端推理,兼顾精度、鲁棒性与实时性。

机器之心
产品应用8

跨维智能DexWorldModel斩获榜首,世界模型真正的考场在机器人执行里

今年4月,Generalist AI发布GEN - 1,其CEO表示不再将模型归类为VLA。当下VLA和世界模型是身智能主流技术路线,多数世界模型在机器人任务上有瓶颈。跨维智能DexWorldModel在RoboTwin榜单表现出色,还开源EmbodiChain助力行业。

量子位
推荐文章8

GPU-MODE Leaderboards之nvfp4_gemv代码阅读

文章围绕GPU-MODE的nvfp4_gemv竞赛rank1代码展开,先介绍问题及官方baseline,后详细解读rank1代码,含数据加载、线程模型等,还剖析核心计算函数,最后总结代码在缓存控制、数据格式等方面的调优亮点。

GiantPandaLLM
推荐文章7

“Skill 不就是长一点的提示词吗?”

文章回应了对'skill是长提示词'的质疑,指出差异在于提示词配套的是ChatBot还是Agent。ChatBot只能对话,Agent能调用工干活。Skill可渐进加载,可复用、组合、迭代等优势,是提示词工程化封装。

宝玉AI
产品应用8

那个写出20万+阅读的写作Skill,我用扣子免费公开了

作者分享将写作工作流变成扣子技能的经验。扣子的Coze Skill功能让非编程人员也能沉淀专业经验为AI能力,创建简单。对比通用AI,技能产出更风格。职场人可将方法论做成技能共享,普通人也能搭建。

花叔
算法论文8

突破视觉-语言-动作模型的瓶颈:QDepth-VLA让机器人拥有更精准的3D空间感知

视觉 - 语言 - 动作模型(VLA)在机器人操控领域潜力大,但应对长时序或精细操作任务时性能下降,根源是缺乏三维空间感知与推理能力。中国科学院自动化研究所与灵宝 CASBOT 提出 QDepth - VLA 模型,提升了机器人空间推理与操控精度。

机器之心
新闻资讯7

第一批买机器人做家务的人崩溃了

第一批买机器人做家务的人崩溃了,自主机器人常闯祸,体验感差。传奇程序员卡马克建议卖远程家政服务,如1X Technologies的NEO机器人就是远程操控。但也有人认为机器人应自主性,部分企业还搞预售圈钱。

量子位