「推理加速技术」共找到 4901 篇相关文章
从社区数据出发,再看大模型开源开发生态全景与趋势
蚂蚁开源先后在527蚂蚁技术日和外滩大会发布大模型开发生态开源项目全景图1.0和2.0版本。2.0版更新评估方法,呈现生态新变化,还分析技术趋势、开发者分布,提及项目进出情况及TensorFlow衰落等。
The Batch: 948 | GLM 5.1:面向长时任务的能力提升
Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。
Reasoning的最终答案可能不是模型想要的答案!
大型语言模型解决复杂问题有推理过程和答案,传统评估只看最终答案。论文提出最终答案可能不佳,中间步骤更值得研究。还介绍通过切割推理过程发现中间步骤藏玄机,提出‘分步检查法’提升模型表现,实验表明准确率最高提升13%等。
OpenAI Astra被曝引入「循环深度」能力飙升!安全专家坐不住了
OpenAI 最强新模型 Astra 或即将发布,它是首个达「关键级」网络安全能力门槛的模型,在测试中表现优异。《The Information》爆料其用「循环深度」技术,能力提升但引发安全专家担忧,该技术可使模型内部计算增多,思维链监控或失效。
第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力
新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B长文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。
破解AI对不同上下⽂位置的敏感度不⼀致,新框架使出“解铃还须系铃人”
语言模型存在位置偏见,影响复杂推理等任务。论文提出Pos2Distill框架,将模型优势位置能力迁移到劣势位置缓解偏差,设计了Pos2Distill - R1和Pos2Distill - R2,在检索和推理任务表现好且有跨任务泛化能力。
又是王冠:27M小模型超越o3-mini!拒绝马斯克的00后果然不同
27M小模型HRM由拒绝马斯克的00后王冠开发,超越o3 - mini - high和DeepSeek - R1,推理不靠思维链。它采用分层推理等五项核心技术,在多测试中表现出色,虽被指通用性不足,但有人看好其仿脑架构。
你的扫描全能王,作价217亿冲刺港股IPO
扫描全能王母公司合合信息拟作价217亿赴港IPO,冲刺“A+H”双重上市。其C端有扫描全能王等产品,B端有TextIn等产品。合合以文本智能技术为核心,打造三大技术平台,C端靠付费订阅、B端卖产品模块盈利。
人工智能无法加速软件交付
文章指出速度不是软件交付目标,提升效率是为获反馈。片面追求速度不可取,如微软 Word 因功能堆砌失市场。引入人工智能只为提速不可信,应重视反馈,优化交付流程,借助 AI 打造更有格局产品。
人工智能无法加速软件交付
文章以养狗比喻,指出有些机构用AI只看重速度,速度并非目标,为速度用AI缺乏可信度。强调应看重反馈,以反馈循环主导软件交付流程,还给出团队规模、产品开发等建议。