并行 - 蒸馏 - 精炼」共找到 363 篇相关文章

开源动态8

5.3 万人收藏的开源版 Claude Code 彻底起飞了,GLM-4.7直接免费用。

近期AI编程界,Claude Code虽好用但对小白不友好。而开源神作OpenCode爆火,Star数达53K。它把‘选模型’进化成‘选员工’,有图形化界面,还集成可靠模型,支持并行运行,社区有强大插件。

开源星探
开源动态8

真实评估!北理发布全球首个「全场景教育」基准,支持4000+情境

北京理工大学高扬老师团队推出EduBench,是全球首个「全场景教育」基准,涵盖9大教育场景、12个评估维度、超4000个情境。团队将数据、模型等全面开源,评估发现大模型在特殊教育场景有不足,还提出多源知识蒸馏等方法。

新智元
开源动态8

一夜之间,AI终获「永久记忆」!最难考试99%刷爆SOTA,全网直呼疯狂

新智元报道,Supermemory团队推出超级记忆系统ASMR,在AI记忆界最难考试LongMemEval中刷到99%准确率。它抛弃传统模式,采用多Agent并行推理,4月初将开源代码。此外,其背后的Supermemory引擎功能强大,能让AI真正拥有记忆。

新智元
算法论文8

AI生图免训练提速1000%,办法:最简洁的“三阶段流水线”

AI画图速度慢,过往主流加速方法有局限。MrFlow团队提出三阶段流水线,在Qwen - Image等模型上实现10倍以上端到端加速,生成效果好,优势显著,还能与时间步蒸馏叠加,且完整开源。

量子位
算法论文8

Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升

当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。

PaperAgent
算法论文8

上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
新闻资讯8

谷歌Gemini 3.2偷跑上线!2200行代码一镜到底,Claude/GPT坐不住了

发布会未开,谷歌Gemini 3.2 Flash网页端静默上线,编码实力强悍,代码量大幅提升。其核心技术是蒸馏与稀疏化,推理成本大降。Gemini App集成第三方应用,谷歌I/O大会多款产品将曝光,此次发布对谷歌至关重要。

新智元
产品应用7

电脑操作、技能、连接器、工作伙伴:豆包的牌来了

最近字节有两个豆包相关新闻,一是在训练超大模型,二是反对模型蒸馏。豆包上线大批 Agent 相关工作任务能力,覆盖办公场景,如电脑操作、技能商店等,过程流畅且可观察,还更新移动端,实现远程控制。

MacTalk
产品应用7

Agent效率X10,ClaudeCode/Codex 专属的文件管理Agent:Agentfile

Claude Code创始人用多Claude并行开发,作者受启发做了Agentfile。它能将项目文件夹变为标签页,便于切换,从Wave改进而来,轻量且适合承接HTML结果,是Skill驱动的Agent,定位为多Agent工作流收口台。

AI产品自由
算法论文8

Yann LeCun非生成世界模型前瞻:开年三篇论文展示JEPA工程化拐点

2026年Yann LeCun团队3篇论文展示基于JEPA框架的非生成世界模型工程化拐点。Rectified LpJEPA让表示更省力,GRASP将长时域规划并行求解,EB - JEPA把方法写成代码,为非生成式世界模型提供技术路线。

AIGC开放社区