后训练策略」共找到 4329 篇相关文章

新闻资讯7

LeCun离职不止创一份业!押注与大模型不同的路线,加入硅谷初创董事会

离开Meta,Yann LeCun创立AMI,还加入Logical Intelligence任技术研究委员会主席。该公司推能量 - 推理模型,与主流大模型路线不同,其Kona模型在数独测试上表现远超大模型。

量子位
新闻资讯7

00挑大梁!近20国选手激战外滩大会,AI科创赛三赛道冠军诞生

9月10日,2025外滩大会AI科创赛在上海落幕,设三大核心赛事,80个项目获奖。00成主力,近20国选手参与。大赛提供资源支持,AI硬件赛受青睐,金融与安全赛道涌现创新方案,还开源数据集。

机器之心
算法论文8

EasyCache:无需训练的视频扩散模型推理加速——极简高效的视频生成提速方案

近年来,扩散模型在视频生成领域广泛应用,但推理慢、算力消耗高问题突出。EasyCache是无需训练的视频扩散模型推理加速方案,在多模型实验中实现大幅提速且视频质量几乎无损,为技术落地提供基础。

机器之心
算法论文8

ICCV 2025|降低扩散模型中的时空冗余,上交大EEdit实现免训练图像编辑加速

上海交通大学EPIC Lab团队提出EEdit框架,入选ICCV 2025。它是首个加速匹配流模型图像编辑框架,能兼容多种引导方案,免训练,速度较原始工作流快2.4倍,支持多类型编辑任务。

机器之心
开源动态8

杨植麟带 Kimi 团队深夜回应:关于 K2 Thinking 爆火的一切争议

上周,月之暗面发布并开源 Kimi K2 Thinking,主打“模型即 Agent”,引发广泛关注。今日凌晨,杨植麟等团队成员在 Reddit 开展 AMA 活动,回应 K2 Thinking 相关问题,如 KDA 机制应用、训练成本、速度与准确性平衡等。

AI前线
新闻资讯7

首页大翻新,Agent HQ 上线!回归微软,GitHub 不再是你认识的 GitHub 了?

2025 年 GitHub 回归微软再出发,新负责人 Jared Palmer 带来变革。发布 Agent HQ 整合第三方编码代理,重构首页成工作起点。GitHub 正从代码托管走向开发者与智能体协同中枢。

InfoQ
算法论文7

为何95%的AI项目注定失败?回到未来,策略型代理AI才是正确路径

《代理AI的进展:回到未来》指出,当前95%的AI项目失败因企业缺乏消费模型的架构。文章提出‘机器中的机器’理论,论证策略型代理AI是企业转型路径,还阐述构建算法化企业生态的方法。

AIGC开放社区
开源动态8

阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理大模型

LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。

PaperAgent
新闻资讯7

Meta详细阐述基于LLM级训练、混合并行计算与知识迁移的GEM广告模型

Meta发布生成式广告模型GEM详细信息,旨在改善平台广告推荐能力。它处理海量用户 - 广告交互数据,用三种方法构建系统,还实施GPU级优化,采用两种知识迁移策略,获业内人士认可。

AI前线
开源动态8

清库存!DeepSeek突然补全R1技术报告,训练路径首次详细公开

DeepSeek给近一年前登上《Nature》封面的R1论文补64页技术细节,正文大幅翻修。新论文展开R1完整训练路径,补充R1 - Zero分析,还披露安全评估细节。此外团队稳定,引发对其续动作猜测。

量子位