推理算法优化」共找到 3340 篇相关文章

算法论文8

睡觉也在卷!伯克利Letta新作「睡眠时计算」让推理效率飙升

Letta和UC伯克利研究者提出「睡眠时计算」技术,能让LLM在空闲时间提前思考以提升推理效率,降低推理成本,在多数据集实验中展现优势,在软件工程任务中也有应用。

新智元
算法论文8

吴恩达新作:87%推理token用不着,丢掉反而快3倍

吴恩达新作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供新思路。

PaperAgent
开源动态8

多模态卷王阶跃星辰Step 3登场,推理效率可达DeepSeek-R1 300%

新一代多模态推理基模Step 3登场,它采用原创MFA架构,具“多开好省”亮点,推理效率高、性价比优。7月31日将开源,能适配各芯片,还发起“模芯生态创新联盟”推动应用落地。

新智元
新闻资讯8

快排算法之父Tony Hoare去世,从古典学文科生出身到图灵奖得主,他的人生比算法更传奇

快排算法之父、图灵奖得主托尼·霍尔(Tony Hoare)去世,享年92岁。他提出快速排序,创造霍尔逻辑、CSP并发模型,也引入“空引用”。他出身古典学,学术生涯成果丰硕,荣誉等身。

量子位
开源动态7

推理成本骤降75%!gpt-oss用新数据类型实现4倍推理速度,80GB显卡能跑1200亿参数大模型

OpenAI在gpt - oss开源模型采用MXFP4数据类型,使推理成本降75%,内存占用为BF16模型四分之一,生成token速度提4倍,还能降低硬件资源需求。不过MXFP4也有缺陷,英伟达推出NVFP4提升质量。

量子位
算法论文8

谷歌揭秘:Multi-Agent 推理时扩展才是未来。

谷歌DeepMind和MIT联合发表论文TUMIX,指出Multi - Agent是推理时扩展的最佳方式,以低成本大幅提升准确率。实验表明Agent多样性优于重复采样,还展示TUMIX机制、实战表现,且LLM能设计更强Agent。

探索AGI
算法论文8

o1之后下一个范式?隐式CoT大突破,让推理不再「碎碎念」

文章推荐 Implicit Chain-of-Thought 的最新进展 SIM-CoT,它直击隐式 CoT 核心痛点,用辅助解码器让隐式推理可解释。推理零额外开销,效果猛,研究已中稿 ICLR 2026,论文等均已开源。

机器之心
开源动态7

马斯克说到做到:开源X平台核心推荐算法

X(原Twitter)开源内容推荐Feed on X召回、精排推理、策略代码,模型参数配置较小,应是简化Demo版。召回用双塔模型,精排用双层Transformer,还介绍了系统架构、模型细节等。

腾讯技术工程
算法论文8

大模型如何准确读懂图表?微软亚研院教它“看、动手、推理

多模态大模型处理结构化图像有误差放大、推理难等问题。微软亚洲研究院等提出PixelCraft,以高保真图像处理与非线性多智能体推理为支柱,提升结构化图像理解性能,在多基准上有增益。

量子位
算法论文7

少说‘Wait’,多做题:NoWait重塑大模型推理路径

现代大模型在复杂推理时爱用自我反思词,触发冗余验证循环,拖慢速度、增加算力消耗。NoWait方法零训练成本,通过抓关键词、扩展变体、实时屏蔽,让模型跳过废话,在多任务中表现出色,且颠覆对推理的认知。

深度学习自然语言处理