「优化原理」共找到 1416 篇相关文章
英伟达韩松团队新作:具有后神经架构搜索的高效语言模型
英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。
腾讯Kuikly框架进一步开源,新增支持Web,开启一码五端新体验!
腾讯Kuikly框架进一步开源,新增Web版支持H5和微信小程序。该框架基于Kotlin Multiplatform,已被20+业务深度使用。与主流框架对比,它在产物大小、加载速度等方面优势明显,还将持续优化和拓展。
半年研发、1周上线,1秒200行代码爆发?美团研发负责人:靠小团队奇袭,模型和工程能力突破是核心
6月10日美团推出首款AI Coding Agent产品NoCode。美团基础研发平台工程效率负责人程大同在访谈中解答诸多问题,如模型性能优化、产品竞争力、用户使用难点等,还提及产品未来规划和对行业发展的看法。
OpenAI久违发了篇「正经」论文:线性布局实现高效张量计算
OpenAI 近日发布研究论文,提出用于高效张量映射的统一代数框架 Linear Layouts,解决了 Triton 等深度学习编译器中长期存在的难题。该框架是使用二元线性代数的张量布局通用代数形式,评估显示其优化版 Triton 性能有提升。
6位前DeepMind老将打造「AI指挥官」,一半成本刷新SOTA
6名前Google DeepMind成员创立Poetiq,搭建元系统让前沿大模型自动生成解决特定任务的策略和模型组合,降低推理成本。其Gemini 3 Pro优化技术在ARC - AGI - 2上创SOTA,成本仅为之前最优方法一半。
中兴发了一篇论文,洞察AI更前沿的探索方向
当大模型参数量冲向万亿级,AI 行业面临瓶颈。中兴通讯发布论文剖析困境,勾勒前沿方向。文中分析了 LLM 现状、架构瓶颈、AGI 争议等,还阐述了改进优化措施及下一代计算范式发展趋势,介绍了中兴的探索实践。
32倍加速,58秒搞定720p视频!字节发布离散自回归框架,统一视觉生成和长视频生成
字节发布InfinityStar框架,将5秒720p视频生成时间从30多分钟缩至58秒,还支持多样任务。它基于对视频本质思考设计时空金字塔模型,将时空分离,通过多项技术优化,性能表现出色,不过也存在一些技术局限。
OpenAI没开源的gpt-oss基础模型,他去掉强化学习逆转出来了
OpenAI未发布gpt-oss基础模型,Cornell Tech博士生Jack Morris自行逆转gpt-oss模型强化学习,发布gpt-oss-20b-base。该模型可生成任意文本,但不再对齐,还测试了其记忆能力,介绍了诞生原理与技术细节。
DeepMind揭示Reasoning内在机制
近年来大型推理模型在复杂任务表现出色,但推理机制成谜。本文提出用推理图解码其‘思考轨迹’,分析环状结构、直径大小和小世界特性,发现蒸馏模型等特点,为理解AI推理及模型优化指明方向。
Karpathy用「harness」彻底终结了RAG。
假期时Karpathy提出llm.wiki想法引发关注。它是元框架,定义人类与AI协作管理知识的方式。与RAG不同,它将新材料关键信息编入已有wiki并持续维护。作者用多种数据测试,发现TextIn API解析效果好,还优化处理流程提升质量。