「任务执行能力」共找到 4818 篇相关文章
从VLA到RoboOmni,全模态具身新范式让机器人察言观色、听懂话外音
复旦大学等联合推出全模态端到端操作大模型RoboOmni,统一多模态,实现动作与语音协同控制。它重新定义机器人交互范式,让机器人具备“察言观色”能力,还构建了OmniAction数据集,实验表现全面领先。
中年人的认知坍塌
Andrej Karpathy在播客提到模型持续用合成数据训练会出现‘认知坍塌’,能力退化。他认为人类随年龄增长和经验固化,也会从无限可能收敛到固定思维模式,像极了中年人的认知坍塌。
1.58bit不输FP16!微软推出全新模型蒸馏框架,作者全是华人
微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在多下游任务表现近全精度模型,降内存开销、提推理速度,作者全是微软研究院华人。
代码生成要变天了?被质疑架空后,Yann LeCun携320亿参数开源世界模型“杀回来了”
美国当地时间9月24日,Yann LeCun团队发布320亿参数代码世界模型CWM。它创新训练方式,能模拟代码执行。性能测试表现出色,还开放检查点。Meta AI业务重组,CWM发布或表明未彻底放弃开源。
吴恩达来信:AI 技能正在重新定义优秀开发者的标准
吴恩达指出市场对懂 AI 的开发者需求大,应届生失业率上升。面试看重利用 AI 辅助开发等能力,具备这些技能的人效率远超传统开发者,AI 工程正掀起变革,基础与 AI 知识结合造就高效开发者。
美国政府变身英特尔最大股东,能帮它重新崛起吗?
路透社消息,美国政府与英特尔达成协议,将掏89亿美元买其4.333亿股普通股,占股9.9%,加上之前拨款,总投资达111亿美元。此交易引发各方争议,美国政府意在提升本土芯片制造能力。
Google官方发布nano banana使用指南
Google官方发布nano banana使用指南,介绍其核心能力,如角色一致性、精确局部编辑等,还给出写提示词的6要素、5种实用技巧,同时指出模型存在风格化不一致、文字渲染易出错等问题。
镜头被油污糊住,机器人还稳定操作?北大/清华等给VLA加一道信息筛选,不靠额外数据,效率提升14x,真机鲁棒性反而更高了 | ICML 2026
北大、清华等机构联合提出StableVLA,相关工作被ICML 2026接收。该工作提出轻量级IB - Adapter,不依赖额外数据对视觉特征筛选对齐,让机器人遇视觉干扰仍能稳定执行任务,实验展现出鲁棒性提升。
CVPR 2026 Highlight|让家电「在仿真中运转起来」,北大正式发布RealAppliance!
北京大学团队提出 RealAppliance 数据集与 RealAppliance - Bench 评测基准。前者收录 100 个精细家电资产,与真实产品系统多层面对齐;后者围绕五项任务评估模型家电操作规划能力,实验显示主流模型仍面临挑战。
Anthropic 兄妹 Dario Amodei 和 Daniela Amodei 最新对话:Claude 为什么一直限速?
在 5 月 6 日 Anthropic 开发者大会上,兄妹 Dario Amodei 和 Daniela Amodei 对话,谈到 Claude 限速因 2026 年 Q1 增速年化 80 倍远超规划,还涉及开发者生态、模型训练、能力释放等话题,强调平衡发展与安全。