「模型优化器」共找到 8489 篇相关文章

开源动态7

NextStep-1:一次在图像生成上自回归范式的探索

阶跃星辰团队探索自回归图像生成新路径,推出 NextStep-1。它直接在连续视觉空间自回归生成,架构简洁,实现端到端训练。模型有高保真生成和编辑能力,Benchmark 表现佳,但也面临稳定性等挑战。

机器之心
算法论文8

IEEE TPAMI 2025 | 北京大学提出LSTKC++,长短期知识解耦与巩固驱动的终身行人重识别

北京大学周嘉欢团队在IEEE TPAMI发布LSTKC++研究成果。该框架引入长短期知识解耦等机制,保障模型学习新知识和记忆历史知识。代码已开源,研究在性能和效率上优势明显,有广泛应用价值和拓展空间。

机器之心
推荐文章7

上下文就是一切!行业热议话题:提示工程是否应该改名

AI圈热议提示工程是否应改名“上下文工程”。Shopify CEO等发表看法,指出其在LLM应用和AI Agent构建中很重要,还分析了重要性、优化方法,给出实践经验,强调要在性能、成本和准确性间平衡。

歸藏的AI工具箱
算法论文8

MIT & Google | 提出异步并行生成新范式,LLM推理效率大幅提升!

MIT与谷歌团队在研究PASTA中探索异步生成范式,开发标记语言PASTA - LANG,采用双阶段训练流程,设计推理系统。实验显示PASTA平衡性能与质量,有可扩展性,为LLM推理效率优化开创学习驱动新路径。

AINLPer
新闻资讯8

突发!OpenAI紧急暂停GPT-6训练

OpenAI奥特曼官宣暂停下一代旗舰模型强化学习训练两周,原因是确保安全等标准跟上能力水平。触发因素有Hugging Face事故和Astra达安全红线,后续将让AI监管AI,加固三道安全防线。

新智元
新闻资讯7

13人干翻Transformer!新架构SSA算力暴减千倍,成本仅Opus 5%

一款基于SSA架构的AI模型SubQ横空出世,其上下文高达1200万Token,计算量比Transformer暴减1000倍,成本不到Claude Opus的5%。打造它的Subquadratic公司仅13人,产品发布后引发AI社区不同反应。

新智元
新闻资讯7

Meta员工空转AI只为浪费token!烧的多挣的多,日均消耗2万亿

Meta内部在首席AI官亚历山大王推动下,员工为抢夺虚荣头衔展开“Token竞技”,日均消耗两万亿Token。这源于扎克伯格重写代码库要求,首席技术官支持资源投入。新模型将半开源,嵌入社交业务。

量子位
产品应用8

访谈|Codex 团队如何用自己的产品构建产品——整个 Spec 只有 10 个要点

OpenAI Codex 团队产品规格文档极简,仅 10 个要点。团队运作如‘海盗船’,规划只做近期和远期,不做中期。Codex App 诞生源于模型能力提升,团队以 power user 为导向设计产品,还谈到 PM 角色转变和招聘标准。

宝玉AI
算法论文7

The Batch:927|极速扩散学习

研究表明扩散图像生成器学习重建预训练编码器嵌入可加快训练,Apple团队提出的FAE,通过缩小嵌入再重建解决了因嵌入尺寸大导致的训练受阻问题,性能与先进模型相当且训练更快。

DeeplearningAI
新闻资讯7

GPT-5.4一周狂赚10亿美元ARR!一句嗨烧掉80刀,效率却飙升32倍

OpenAI总裁披露,GPT - 5.4上线一周,每天处理约5万亿token,带来10亿美元年化净新增收入。它成本和token消耗量高,但效率提升32倍。作为“大一统”模型,它智能水平出色,原生支持电脑操作。

量子位