「无限深度推理」共找到 2776 篇相关文章
FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾
文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。
AI证伪百年数学猜想被打假!Lean证明惊现漏洞,哥大教授破防了
OpenAI新推理模型取得十项数学进展,如证明非Sofic群存在性等。哥伦比亚大学副教授Henry Yuen对其量子并行重复定理证明既兴奋又失望,因证明有AI味且难理解。此外,Lean证伪科拉兹猜想被指利用内核漏洞,专家提醒Lean验证有局限。
GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率
OpenAI推出GPT-6 Astra,接连在埃尔德什单位距离猜想、纳维-斯托克斯方程等多个顶级数学难题上取得突破性进展,引发顶尖数学家对学术伦理与传统研究模式的争议,本文为OpenAI内部研究员的深度对谈编译,拆解AI数学推理的核心逻辑。
蚂蚁·安诊儿医疗大模型:正式开源并登顶权威医疗榜单
近日,蚂蚁集团联合浙江省卫生健康委开源自研的蚂蚁·安诊儿医疗大模型。它基于蚂蚁百灵大模型架构,经深度训练,是参数规模最大的开源医疗模型。该模型在多评测中表现出色,有三阶段训练流程,架构高效、推理快,已开源助力行业发展。
长程 Agent 越跑越乱?ContextPilot 用细粒度 RL 教会模型主动管理上下文
长程 Agent 推理时,传统方法使上下文臃肿、推理成本高。清华、腾讯等团队提出 ContextPilot 框架,扩展管理工具集、采用新采样和信用分配方法。实验显示其用短上下文获高分,降低推理开销。
读万卷书,大模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源
Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。
超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破
文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。
智谱 GLM-4.5 团队深夜爆料:上下文要扩、小模型在路上,还承诺尽快发新模型!
今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推小模型是重点,还承诺尽快发新模型,也探讨了大模型发展观点。
老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素
黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。
基于百万亿 Token 的 AI 使用模式分析:趋势、拐点与未来|PPT分享
近期OpenRouter报告《人工智能现状:基于OpenRouter的100万亿Token实证研究》,分析超100万亿个token的真实世界LLM交互数据,弥补LLM实际使用情况证据不足,揭示2024年转折及多方面发现。