「瞬时速度约束」共找到 762 篇相关文章
告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!
北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。
综述 | 从“说出来”到“脑中算”:Latent Reasoning的范式跃迁与无限可能
大型语言模型用显式思维链推理有局限,潜在思维链(Latent CoT)让推理在连续隐藏状态空间进行。论文梳理该领域,建立框架,介绍方法,探讨可解释性与无限深度推理,指出价值、挑战与未来方向。
YC AI 创业营 Day 2:纳德拉、吴恩达、Cursor CEO 都来了
YC AI创业营第二天,微软CEO纳德拉、吴恩达等七位重磅嘉宾围绕AI技术、创业等话题分享观点,如不要将AI拟人化,智能体将成新一代计算机等,还给出产品开发、创业等方面建议。
蚂蚁多模态统一框架Ming-Omni:能看懂世界、会说话、还能画画
文章介绍蚂蚁多模态统一框架Ming - Omni,它可统一处理图像、文本等多模态数据。该框架解决了多模态训练中模态表示差异、收敛速度不一致等问题,采用分阶段预训练,能用于图像、音频生成及多模态交互。
Web 开发 AI 就选它?V0复合架构无错误率 93.87% 远超 Claude 4 Opus 单体!
Vercel推出新AI模型v0系列,采用复合模型架构,将RAG专业知识、SOTA大模型推理能力和定制流式后处理模型结合,能提升代码生成质量,且基础模型升级时可快速替换,还训练了定制AutoFix模型。
具身智能开始“交卷”:宇树上市之后,产业和资本怎么走?|甲子引力X
2026年8月20日,「激流——2026甲子引力X·科技产业投资大会」举行,聚焦人工智能等硬科技方向。会前一天宇树科技上市,股价波动引发对具身智能估值的讨论。会上投资人探讨了具身智能从技术到产业化的变化、拐点、资本市场走向等问题。
13.3K Star!终于有人把文档转 Markdown 这件事做好了!
AI 应用普及,企业常将不同格式文档喂给大模型,但转换工具存在诸多问题。Firecrawl 团队的开源项目 anydoc 支持 14 种格式统一转 Markdown,速度快、输出一致,还有浏览器版本保障隐私,提供多种编程接口。
从“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026
WAIC 2026热度高涨,InfoQ直播间追问‘AI正在重写什么’。与会嘉宾讨论AI产业新阶段变化,如从‘看能力’到‘算总账’,认为模型重要性方式已变,还探讨了AI原生产品定义、AI Infra影响及未来关注方向。
CVPR 2026 Oral|告别模型合并冲突!南大等提出OrthoReg:极简正交正则化,揭开任务算术的底层机制
南京大学等团队为任务算术建立底层理论框架,提出「任务特征特化」属性,推导出几何约束方法OrthoReg。该方法引入极简正交正则化项,提升模型合并性能,论文被CVPR 2026接收并评为Oral,代码等已开源。
ACL 2026|答得更准还写得更短?华为泰勒实验室提出SHAPE,给LLM推理装了个「推理税」
华为泰勒实验室等团队提出 SHAPE,给推理链装「里程碑 + 推理税」机制。它分三步,能统一势能增益度量、阶段难度感知和 token 效率约束。实验显示,它提升准确率、降低 token 消耗,还解决了推理坍缩等问题。