「预训练框架」共找到 3486 篇相关文章
具身智能发展趋势与展望 | 中国工程科学
文章深入探讨具身智能的概念、内涵、计算框架与系统实现,梳理发展现状、趋势与挑战,强调生成式AI在其演进中的关键作用,还分析我国发展进展、风险,并给出研究方向与对策。
Ilya新模型要来了?投资人爆料:今年最重要的发布!
a16z合伙人Martin Casado预告今年最重要的模型发布,线索指向Ilya Sutskever的新模型。SSI成立两年低调发展,获巨额融资,7月与英伟达合作。持续学习是焦点,但相关能力信息有限。
爆火的 DeepSeek Harness,全网最全小白接入教程!
DeepSeek Harness 在 GitHub 上线不到三天 Star 数破 10 万。文章给出小白接入教程,介绍三种部署思路,包括手动安装、用 Agent 一键安装、一键安装桌面版,还给出其与多个框架的测评对比。
换个地面/身体,机器人策略就失灵?让扩散策略读懂「动力学」| ICML'26
扩散策略成机器人控制热门路线,但真实世界动力学多变,策略易失灵。UC Berkeley等联合提出DADP,训练统一策略,在零样本跨域控制任务表现强,尤其在OOD场景优势明显,还给出工程补充结果。
英伟达MoE新开源:一行import,微调加速3.7倍
英伟达开源NeMo AutoModel,基于Hugging Face Transformers v5,不改代码API,添一行import就能更快速微调MoE模型。实验显示,它能提升3.4 - 3.7倍训练吞吐,减少29% - 32% GPU显存占用。
跟Claude谈个恋爱怎么了?Nature最新研究:真能给人聊傻了
Nature旗下研究指出,聊天机器人持续顺着、理解、陪伴用户,可能让正常人怀疑现实。研究总结出“放大螺旋”框架,含语言镜像、超个性化、谄媚三组件,叠加会成妄想放大机。OpenAI也关注此问题。
宇树背后的供应链赌局:不怕错,怕空|甲子光年
文章介绍新能安,作为宁德时代和新能源科技合资子公司,在多领域成龙头。它凭借技术积累切入人形机器人电池赛道,给宇树供货,试图建立标准,虽赛道有泡沫和风险,但提前布局或占先机。
Kimi Work 推出目标模式:连肝 24 小时做了本漫画书,已开源
Kimi Work 推出目标模式,设定完成条件可自动工作至达标。与 Claude Code、Codex 有差异,还具 Agent 集群能力。作者用其复刻 Logo、转换论文格式、制作漫画书并开源,指出目标模式类似模型训练。
AI 企业 Day 0 出海,如何少走技术弯路?
InfoQ与多家AI出海企业交流发现,很多企业放弃常见Agent平台和流行框架,选择自研全栈平台。GMI Cloud升级产品,构建完整基础设施图谱,解决全球算力部署、模型调用和Agent商业化落地问题。
几张GPU干翻超算!耶鲁AI颠覆化学合成,实验成功率71%
近日,耶鲁大学李昊特团队开发 AI 系统 MOSAIC,将化学合成知识分 2498 个领域训练专家模型。测试中对超 35 种新化合物合成成功率达 71%,还完成难反应与新反应,相关论文发表于《自然》。