「全量微调」共找到 2591 篇相关文章
别高估车企“造人”
今年5月特斯拉停产后搭建Optimus量产线,虽强调FSD算法可复用,却未量产。车企造机器人,优势在供应链管理和生产制造,算法移植效果一般,且面临数据难题,竞赛中暂无通关密码。
从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓
4月16 - 18日QCon全球软件开发大会·北京站(2026)圆满举办,超2000人参与。多位技术领袖围绕AI与工程实践分享见解,大会还设25大专题。最后揭晓17位优秀出品人和29位明星讲师。
AI生成内容如何确权?全国首部区块链知识产权存证标准启动编制,欢迎参与起草!
区块链存证技术能解决知识产权确权、举证、维权难题,但实践中存证流程不规范等问题凸显。全国首部《基于区块链的知识产权存证管理规范》团体标准立项,正征集起草单位和起草人,可解决企业核心困境。
三家中国工博会参展商,在半导体两场革命中改写格局
2025中国工博会首设集成电路展区,超90%为专精特新企业。在CES 2026上,曾参展的中国展商再登场。瑞芯微、新思科技、移远通信携方案突围,参与半导体算力与场景创新两场变革。
一个模型装下整个物种树!伯克利GPN-Star斩获基因预测双料冠军
加州大学伯克利分校等机构推出基因组语言模型GPN - Star,可将全基因组比对和物种树信息装进大模型。它克服传统GLMs短板,实现三点升级,在多基准测试表现出色,是强大的全基因组变异解读框架。
DeepMind 颠覆机器人学习范式:让机器像人一样 “自由成长”
谷歌DeepMind受大模型微调中强化学习阶段启发,提出面向机器人学的两阶段后训练方法,含监督微调与自我提升。实验显示该方法让机器人自主习得新技能、广泛泛化,但研究也存在标注成本高等局限。
ACL'25最佳论文解读 | 大模型也会‘弹簧回弹’?揭秘 LLM 对齐的脆弱根源
本文分享 ACL 2025 最佳论文,指出预训练大模型存在‘抗对齐’的 Elasticity 现象,即对齐微调只是暂时拉伸,后续微调会让其迅速弹回预训练分布。研究量化该概念,用‘压缩理论’刻画对齐并实验验证。
他想让TPU成为AI界的X86!
2026世界人工智能大会期间,中昊芯英主办分论坛,新一代全自研TPU架构AI芯片“须臾®”亮相,华东地区首个国产TPU智算千卡集群落成。“须臾®”算力强、成本低,集群全链路国产化,中昊芯英探索TPU突围路径。
6 个关键维度:如何把 OpenClaw 工程化为企业可控生产力平台。
文章探讨如何将 OpenClaw 工程化为企业可控生产力平台,从多租户与共享、安全管控、企业应用集成等六个维度进行系统化设计,给出不同场景适用模式及管控思路,助力其在企业安全、高效运行。
机器人全程自主收拾客厅!390亿美元估值机器人端到端新技能,英伟达持续加注
估值390亿美元、英伟达持续看好的Figure机器人有新进展,能完全自主、端到端全流程整理客厅。背后是其自主研发的具身大脑Helix 02系统,仅补充新数据就能掌握全新任务。