「机器人推理模型」共找到 8737 篇相关文章
MOE RL实战:统一FP8全流程训练
SGLang RL团队等联合完成工作,实现RL中全流程FP8训练与采样。介绍FP8训练硬件基础、格式、scale选择等,指出训练难点,分析KL Loss异常归因,验证其在MoE模型RL应用效果,还探究模型规模对训推不一致性的影响。
构建会“说话”和“行动”的 AI:生成式数字人技术与 EchoMimic 实践
在 QCon 全球软件开发大会上,支付宝李宇明围绕 EchoMimic 介绍生成式数字人进展、技术、应用及研究思路。对比传统数字人,生成式数字人成本低、易控制,但也有技术新、推理成本高的问题。EchoMimic 两版本已开源,经优化推理速度可提升。
LeCun炮轰Hinton:他认可LLM就是想摆烂退休了!
Yann LeCun在播客专访中火力全开,炮轰Hinton认可LLM是想摆烂退休,直言LLM不是通往智能的路,还吐槽Meta卷入LLM竞赛后无法专注研究。他介绍了新公司AMI和世界模型、JEPA等技术,认为JEPA类世界模型五年内将统治AI圈。
三个理想火枪手创业,打破具身最快百台交付纪录
至简动力由理想智驾团队三位核心负责人创立,7月6日宣布首款全场景机器人i7 Pro完成首批百台交付,创下具身智能行业最快纪录。其与绿的谐波子公司合作落地全球首个CNC智能化具身机器人产线,i7 Pro还进入多场景。公司计划进入多领域,将发布新品。
AI 的终极护城河不是模型
硅谷风投投资人Jaya Gupta指出,当AI领域趋同,产品易被复制时,公司组织形态才是难以复制的护城河。如OpenAI、Palantir围绕新型工作创造新型机构,吸引特定人才。公司应匹配叙事与组织形态,选人要注重结构认可。
The Batch: 895 | 发起群聊的聊天机器人
如今互联网受AI泛滥化影响,还面临阻止LLM进入的情况。但AI可被设计连接人们,如在聊天中作积极联合力量。研究者做些改变就可行,未来AI或能促人类共同提升。
模型不是企业的护城河,那什么才是?
文章指出企业AI进入深水区后,真正的竞争是将AI变成企业自己的智能引擎。衔远科技创始人周伯文提出泛化基础上的深度专业化是企业竞争力来源。衔远发布EnterpriseClawBench,揭示企业需私有化评估和可持续进化能力。
The Batch: 901 | 医疗健康聊天机器人争相登台
OpenAI和Anthropic在医疗健康市场布局,OpenAI发布面向消费者的ChatGPT Health,可调取医疗信息,有安全隐私措施;Anthropic推出面向医疗专业人士的Claude for Healthcare,可加快文书处理。此前谷歌健康摘要功能因错误信息被撤。
马斯克的最快AI模型来了
xAI发布Grok 4 Fast,生成速度每秒75个token,比标准版快10倍。网友实测其解题、问答速度惊人,但也有准确性问题。它为求速度做了妥协,适合追求即时结果的用户。
谷歌Gemini-0605发布,全球大模型第一!
昨晚谷歌发布Gemini 0605版本,官方称其回归0325版本效果。该版本在多项基准测试中领先,Elo评分提升。谷歌针对反馈改进,使Gemini 2.5 Pro回答更优,还取消日期后缀,输入输出Token价格有优势。