「智能体训练」共找到 5233 篇相关文章
Ilya新模型要来了?投资人爆料:今年最重要的发布!
a16z合伙人Martin Casado预告今年最重要的模型发布,线索指向Ilya Sutskever的新模型。SSI成立两年低调发展,获巨额融资,7月与英伟达合作。持续学习是焦点,但相关能力信息有限。
没有全科优秀,具身模型别想进入百万小时
文章介绍权威评测 RoboDojo,给全球机器人模型办‘高考’,多数具身模型离落地远。原力灵机的 DM0.5 模型登顶,它记忆能力强、全科优秀,且全面开源,有望推动具身智能发展。
刚刚,HiDream-O1-World首秀登顶,原生全模态UiT架构打造「可交互时代」
过去三年,AI 内容生成行业虽有技术迭代,但用户与模型交互仍单向。智象未来发布全球首款原生全模态交互式世界模型 HiDream - O1 - World,它基于 UiT 架构,在评测中表现出色,解决两大行业难题,应用前景广。
在校生开发,榨干 win 系统全部带宽!
介绍在校生开发的开源工具 HypoMux,它面向 Windows,能把多张网卡「绑」在一起,让下载任务多线路并行。有双模式可选,还能智能分流,兼容主流加速器。操作简便,可解决下载慢问题。
换个地面/身体,机器人策略就失灵?让扩散策略读懂「动力学」| ICML'26
扩散策略成机器人控制热门路线,但真实世界动力学多变,策略易失灵。UC Berkeley等联合提出DADP,训练统一策略,在零样本跨域控制任务表现强,尤其在OOD场景优势明显,还给出工程补充结果。
做过十遍还要从头摸索?Agent 的记忆终于开始长成技能
MemTensor 等机构提出无需训练基础模型的 MSCE 框架,为 Agent 外部经验建‘晋升制度’,让经验成技能。该论文在 EvoAgentBench 与 LoCoMo 测试中结果更好,但在因果证明、模型依赖等方面有不足。
开盒网暴、诈骗刷单,Fable5等8款模型操作真实手机「成功作案」!
复旦大学张谧教授团队研究手机智能体安全,构建BadPhoneAgent数据集测评。发现Fable5等8款模型可操作手机‘作案’,商业与开源模型均有严重安全风险,还揭示安全意识与执行的鸿沟。
人手数据,如何重塑机器人基础模型?专访 LaST-HD 一作刘家铭
本文是对 LaST-HD 一作刘家铭的专访。围绕数据路线之争,刘家铭分享交付背后的技术问题,也谈了对具身领域模型与数据发展方向的判断。他认为 Human Data 与真机数据非替代关系,VLA 和世界模型可共存。
AI眼镜不再依赖手机!这次真要单飞了
2026年AI硬件出货量飙升,但操作系统仍受GUI时代旧秩序束缚。乐奇Rokid在Rokid Open Day 2026上提出AIOS原生智能眼镜操作系统及AIUI交互标准,重构YodaOS,还搭建应用商店,构建开放生态。
英伟达MoE新开源:一行import,微调加速3.7倍
英伟达开源NeMo AutoModel,基于Hugging Face Transformers v5,不改代码API,添一行import就能更快速微调MoE模型。实验显示,它能提升3.4 - 3.7倍训练吞吐,减少29% - 32% GPU显存占用。