通用推理系统」共找到 4155 篇相关文章

开源动态7

梳理SGLang中DP Attention及其Padding问题

作者梳理SGLang中DP Attention及其Padding问题。介绍DP Attention背景、流程,指出padding分max和sum模式,旧版sum padding浪费计算、影响cuda graph使用,v0.4.10后有优化,max padding仍待完善。

GiantPandaLLM
新闻资讯7

商汤王晓刚:世界模型将加快AI从数字空间进入物理世界,「悟能」想做那个桥梁

具身智能“大脑”成AI竞争焦点,“世界模型”或是通往“类人智能”的解法。商汤科技王晓刚认为世界模型将加快AI从数字空间进入物理世界,其推出的“悟能”具身智能平台想做这个桥梁,还谈到具身智能发展面临的问题与挑战。

机器之心
产品应用8

让64张卡像一张卡!浪潮信息发布新一代AI超节点,支持四大国产开源模型同时运行

浪潮信息发布新一代AI超节点“元脑SD200”,可让64张卡像一张卡。它支持四大国产开源模型同时运行,实现算力聚合突破,通过软硬协同优化提升推理性能,采用开放架构推动“智能平权”。

量子位
新闻资讯7

实测GPT-5:写作坠入谷底,编程一骑绝尘。

GPT-5发布,它是统一系统,含多种模型。性能上减少事实幻觉、应对谄媚有进展,跑分强且节能,但无新功能特性。写作不如GPT 4.5,编程表现出色,发布后OpenAI与Google预测交叉跳水。

AI大模型应用实践
推荐文章8

长上下文不再难:KV Cache 全生命周期优化实战

长上下文大语言模型发展带来计算和内存挑战,现有基准测试多忽视 KV 缓存完整生命周期。微软姜慧强在 AICon2025 分享 SCBench 工具,梳理推理优化方法,介绍 MInference 等,还提出 Tri - shape 方法等成果。

AI前线
算法论文8

Discrete Tokenization:多模态大模型的关键基石,首个系统化综述发布

近年来,人们关注将LLM能力扩展至非文本模态,Discrete Tokenization成关键方案。但现有研究缺系统总结,香港科技大学等团队发布首个相关系统化综述,梳理技术脉络、方法及挑战,给出未来研究方向。

机器之心
算法论文8

科学家首次实现修正线粒体DNA突变,治愈不治之症打开新大门

荷兰科学家在《PLOS Biology》发文,称用DdCBE成功纠正线粒体DNA突变。研究在原代成人细胞中验证其能恢复线粒体功能,还探索了modRNA和LNPs递送系统,虽距临床尚有数年,但意义重大。

量子位
算法论文8

语言反思>强化学习:伯克利新架构碾压传统RL

大型语言模型下游任务优化依赖强化学习,但计算成本高。伯克利等机构论文提出GEPA新型优化器,将LLM执行轨迹转化为诊断信号,用语言反馈替代标量奖励,仅用传统方法1/35计算量,性能最高提升19%。

深度学习自然语言处理
新闻资讯7

OpenAI IMO金牌团队爆料:AI拒绝作答第六题

OpenAI IMO团队接受采访,透露让模型获IMO金牌的项目仅用两三个月、核心开发者仅三人。还谈及模型证明风格、第六题失分原因、解决千禧年大奖难题距离等,强调通用技术及面临的新挑战。

机器之心
算法论文8

LeCun出手,造出视频世界模型,挑战英伟达COSMOS

训练有效世界模型面临数据、任务难度、算力消耗和评估等难题。Meta研究者提出通用视频世界模型DINO - world,可预测未来帧,在多方面有优势,实验显示其性能显著,能降低对标注数据需求。

机器之心