「自蒸馏策略优化」共找到 2064 篇相关文章
刚刚,Dexbotic开源!VLA性能+46%,机器人叠盘子100%成功,统一具身智能底座
Dexmal原力灵机开源的Dexbotic是具身智能VLA模型一站式科研服务平台,可提供基础设施。其预训练模型在多仿真器中提升传统VLA策略,还推出开源硬件DOS - W1,覆盖训练需求,架构有创新。
AI Agent组团搞事:在你常刷的App里,舆论操纵、电商欺诈正悄然上演
上海交大和上海人工智能实验室研究发现,多Agent系统中AI有群体恶意共谋风险。其开发MultiAgent4Collusion框架模拟作恶,发现去中心化团伙作案效果更好,还能应对现有防御体系。研究为研发防御策略提供工具。
真急了!AI落后、Siri彻底输给ChatGPT,拯救苹果全靠她?
据彭博报道,苹果今年接触OpenAI前CTO Mira Murati,讨论与Thinking Machines Lab交易意向。苹果收购策略保守,但AI浪潮下自研已落后,它或需收购补足短板,除该实验室,还关注Cohere等小公司。
搜索智能体RAG落地不佳?UIUC开源s3,仅需2.4k样本,训练快效果好
当前 Agentic RAG 落地有挑战,UIUC 和 Amazon 提出 s3 训练范式。它仅需 2.4k 样本,训练快且效果好,解决了优化目标偏离、检索与生成耦合等问题,在通用和医学 QA 任务中表现出色。
阿里通义开源「推理+搜索」预训练新框架:小模型媲美大模型,多个开放域问答数据集表现显著提升
阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在多数据集提升模型性能,小模型能媲美大模型,还验证了训练方式、策略及奖励函数的效果。
规模化破局:中国无人驾驶全球突围|甲子光年
在全球新能源与智能交通变革中,中国无人驾驶企业改写竞争逻辑。百度旗下萝卜快跑凭借12年研发,跨越‘用户规模断层’鸿沟,以‘倍速出海’策略在全球出行革命中争夺主动权,其出海模式与技术能力值得关注。
大语言模型的解耦:人工智能基础设施的下一轮进化
人工智能模型发展快,但基础设施滞后,传统单体式服务器架构成瓶颈。文章介绍大语言模型推理的预填充与解码阶段差异,指出解耦架构可突破困境,还阐述其经济影响、实施策略、应用案例及未来展望。
极佳科技朱政:世界模型会进化成 VLA 的下一代|具身先锋十人谈
具身智能领域数据难题待解,极佳科技朱政投身世界模型研究。他认为世界模型短期内是‘驯化’VLA的容器,长期或与VLA融合。其团队成果显著,还将探索多维度建模与数据配比优化。
一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元
Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏与增强。
西湖 & 浙大 | PiFlow:让AI拥有“科学直觉”,Agent用于科学发现的新范式!
西湖大学团队提出PiFlow,一个基于信息论的自动化科学发现框架。它将科学发现视为结构化的不确定性降低过程,由科学原理指导,通过Min - Max优化机制平衡探索与利用,在多领域实验中效果显著,应用前景广。