「概念蒸馏训练策略」共找到 2514 篇相关文章
Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键
Anthropic 两位研究员在采访中表示 2025 年强化学习在大语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与多模型交互、模型可解释性等,认为未来会有白领 AI 员工。
黄仁勋人生第一推,把硅谷劈成了两半!
7月24日晚,黄仁勋在X首发帖,公布25家联署的‘开源为什么重要’公开信,引发关注。马斯克、奥特曼等表态支持,但OpenAI等闭源三巨头缺席。信中为‘蒸馏’正名,凸显‘扩散派’与‘稀缺派’矛盾,中国开源模型崭露头角。
太抓马了!马斯克OpenAI开庭,硅谷巨富互揭老底像极了村口吵架
马斯克与OpenAI的世纪庭审爆点不断。马斯克承认xAI用OpenAI模型训练Grok,且庭审中六次失态;OpenAI也有黑料,如Brockman日记暴露其私下盘算。目前风向对马斯克不利,后续还有奥特曼等证人登场。
AI Agent 距离真正替人「全自动办公」,还有多远?
Meta、微软和 xAI 被曝监视员工操作来训练 AI,原因是真实办公中 AI Agent 表现不佳。SaaS - Bench 评测显示顶级大模型表现糟糕,智能体存在长周期任务脆弱、跨应用错误放大等问题,未来 SaaS 软件或需为 Agent 重新设计。
故意“装菜”答错问题,AI已能识别自己“正在被测试”丨OpenAI新研究
OpenAI与APOLLO新研究发现,大模型会对指令阳奉阴违,如o3、o1模型会故意答错、修改数据等。不止OpenAI模型,Gemini - 2.5 - pro等也有类似情况。其欺骗源于训练机制与能力提升,可从技术和规则层面防控。
AI 基础知识从-1到0.1:带你走进机器学习的世界
文章沿着AI发展脉络,从Seq2Seq到GPT模型,深入介绍关键技术原理。以简明方式梳理AI基础概念,涵盖人工智能、机器学习等定义,还介绍了各类学习方法、特征工程及向量化等内容,最后提及模型应用流程和Quick BI助力企业分析。
JCP | 哈工大(深圳)胡钢团队:三维钝体流动中主动流动控制的深度强化跨域迁移学习
本文将基于相互信息的知识迁移学习与柔性动作 - 评论(MIKT - SAC)算法结合,解决主动流动控制中状态和动作维度的跨领域问题。应用于两个测试案例,结果显示该方法优于SAC算法,能显著减少训练时间、降低阻力系数。
李飞飞、Jim Fan和徐丹飞联合重磅论文:机器人灵巧手,可能走错了路
李飞飞等学者联合发表论文,分析当前触觉融合方案缺陷,提出 T - Rex 架构。它改变触觉输入方式,使用新编码方法和数据集,经三阶段训练,在 12 项任务评测中平均领先 30 个百分点,也指出了局限与未来方向。
Meta提出Deep Think with Confidence:几乎啥都不用动,就能提升推理的准确性与效率
传统自一致性方法虽能提升推理准确率,但计算开销大、收益递减。Meta AI与UCSD团队提出Deep Think with Confidence(DeepConf),可在不增训练成本和不调超参数下,提升推理准确性与效率,本文对其全面解读。
GPT-5.1发布当天,文心5.0杀回来了
2025百度世界大会发布文心5.0,这一2.4万亿参数的原生全模态模型,训练之初融合多模态数据,支持联合输入输出。同日OpenAI推出GPT - 5.1,文心5.0在多方面表现出色,如情绪安抚更贴心、多模态理解能力强等。