全模态具身」共找到 2725 篇相关文章

新闻资讯8

刚刚,首个能在机器人上本地运行的身Gemini来了

谷歌DeepMind推出Gemini Robotics On-Device,这是首个可部署在机器人上的VLA模型,无需联网,能让机器人适应新任务和环境。还将发布SDK助开发者评估。此外,谷歌下调Gemini免费额度,推出图像生成模型Imagen 4和Imagen 4 Ultra。

机器之心
产品应用8

智元首发SOP系统:打破离线训练瓶颈,让身智能在“干中学”

2025年VLA让机器人有通用性,但真实部署存问题。智元机器人身研究中心提出SOP在线后训练系统,融合在线学习等,使机器人在真实环境持续进化,实验显示其能提升性能、效率,突破VLA瓶颈。

量子位
开源动态7

致敬Kimi K2:基于slime的流程INT4量化感知RL训练

受Kimi K2团队启发,SGLang RL团队落地INT4量化感知训练流程方案,在强化学习多方面取得进展,还在slime框架复现流程方案,实现媲美BF16精度,提高Rollout效率,为社区提供开源参考。

机器之心
开源动态8

Qwen3技术报告首次公开!“混合推理模型”是这样炼成的

本文首次公开Qwen3技术报告,介绍其模型架构、预训练及后训练过程、性能表现等技术细节。Qwen3整合两种模式,引入思考预算机制,降低轻量级模型计算资源,在多基准测试领先,多语言支持扩展至119种,所有模型开源。

通义千问Qwen
产品应用7

Claude Code + Kimi K2栈开发教程,1小时上线「"丑咪"挑战赛」!

作者分享用Cursor + Claude code + Kimi K2开发「丑咪挑战赛」栈项目的体验,介绍组合优势、接入教程、前端测试案例和使用技巧,认为Kimi K2在agent和coding能力上表现不错,适合作为Coding模型。

花叔
新闻资讯7

对话地平线前高管牛建伟:万亿参数大模型如何重塑身智能

身智能赛道分“VLA派”“智驾降维派”和“大模型派”。地平线前高管牛建伟认为VLA是弯路,主张用分层架构,以万亿参数“空间智能大模型”做大脑,VA小模型执行操作,目标是做物理世界的OpenClaw。

AI科技评论
算法论文8

0%完成率!Claude、GPT、Gemini 灭,SWE-Bench作者新作把AI圈干沉默了

SWE - Bench创建者推出新benchmark ProgramBench,测试AI从零构建软件系统能力。结果一线模型完成率0%,暴露AI擅长局部代码生成,缺局系统规划能力,引发对其评估方式的讨论。

机器之心
产品应用7

长得这么“乖”的人形机器人,第一次见

北京朝阳,傅利叶发布尺寸人形机器人Care-bot GR-3,外观采用莫兰迪暖调配色等设计,有亲和力。它配备感交互系统,能实现多种拟人行走姿态,未来将拓展至辅助陪护场景。

量子位
新闻资讯7

「国产GPU第一股」首秀!新架构下周揭秘,栈底座不藏了

2025年12月19 - 20日,摩尔线程首届MUSA开发者大会将在北京举行。届时会揭晓新一代GPU架构与路线图,设20+技术专场,还有1000㎡科技嘉年华,展示栈能力与生态进展。

新智元
开源动态7

Glyph:文本转图片解决长上下文困境,智谱把“DeepSeek-OCR”像化了

传统 token 扩展方式遇算力成本天花板,DeepSeek 与智谱都想到让 AI“看”文字思路。智谱发布 Glyph 框架工程化实现此思路,将文本转图片处理,降低计算成本,有不错效果但也存在排版敏感等限制。

AI工程化