「高性能」共找到 3405 篇相关文章
名师一定出高徒?清华团队最新揭秘:别再迷信大模型蒸馏的「免费午餐」
当下大模型后训练中,On-Policy Distillation(OPD)成明星技术,业界采用后报告性能提升。但清华团队研究发现,换更强Teacher,Student性能可能无提升甚至倒退。研究揭示蒸馏成败条件,深挖对齐机制,还给出拯救失败蒸馏的方法。
从“暴力烧Token”到“系统工程”:OpenAI与华为的两条 AI 编程路径
文章对比OpenAI与华为的AI编程路径,指出模型中心派靠推高上下文窗口但有成本高、延迟大等问题;工具驱动派如Cursor和华为云码道重构IDE工具。码道将任务解耦,通过多技术实现性价比,还介绍了底层基石及其实测表现。
谈一谈TP推理场景下MoE Group GEMM的优化思路
作者在使用H20测试SGLang CUTLASS MoE时,发现其在中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案在H20和Hx00上的实现细节及性能测试结果。
FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾
文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。
高盛大力培养“AI原住民”
Fortune消息,高盛2025年实习生计划竞争激烈,录取率仅0.7%。首席信息官Marco Argenti认为应赋予年轻专业人士AI技能。高盛推出GS AI Assistant,超95%员工用AI完成缺技能任务,公司强调赋能AI原住民好处。
阿里最新开源王炸Agent!性能全面SOTA!
阿里WebAgent更新频繁,基本一月一版。它是类似DeepResearch的通用智能体,历经WebWalker到WebWatcher多阶段演进,各阶段解决不同问题,如网页导航、自主信息搜集等,还不断优化训练数据生成与处理方式。
Subagents:构建高可靠 AI Coding 专家顾问团
文章探讨 Claude Code 的 Subagents 功能在复杂 AI 编程场景的价值与实践。指出复杂 AI Coding 面临上下文膨胀等问题,而 Subagents 可创建专属子代理,有 Context 保护等优点,还介绍使用方法、业务实践及相关思考。
中际旭创的高增长,还能持续多久?
今年夏季光模块龙头中际旭创市场表现强劲,市值逼近4600亿,但控股股东计划减持。此前也有股东减持,市场曾争论其估值合理性。要实现250亿利润目标,受北美大厂算力支出、竞争、CPO进展等因素影响。
HOIDiNi:一句话驱动虚拟人高精度操作物体
特拉维夫大学提出HOIDiNi,这是文本驱动的扩散框架,用于生成人体 - 物体交互动作。它引入扩散噪声优化,能兼顾真实感与物理正确性。不过它泛化能力待拓展、生成速度慢,未来需提升效率等。
Agent性能暴涨90%,刷榜GAIA可太容易了~
今年AI Agent层出不穷,当前研究缺乏统一标准、复现难。oppo Agent团队分享构建高效Agent的关键组件及刷榜GAIA的方法,从事实获取能力和逻辑推理保真度两维度分析,介绍了强化感知和提升思维的策略。