「大规模计算」共找到 880 篇相关文章
破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%
来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,能降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。
字节豆包2.0重磅发布!成本暴降一个数量级,Seed团队揭秘视频Agent竞争关键
今天,字节正式发布豆包大模型 2.0 系列,围绕大规模生产环境需求优化,提供多款通用 Agent 与 Code 模型。其成本优势明显,多模态能力升级,未来将聚焦长链路智能系统构建。
比SOTA快9倍,谷歌DeepMind时空重建,把视频变成时空搜索引擎
谷歌DeepMind联合团队发布D4RT时空重建框架,颠覆传统视频转3D方法。它按需提问,像搜索引擎,处理动态视频高效。内部结构分编码、解码两步,速度快,还发明聪明收割机算法,在多项测试中表现优异。
让两个大模型「在线吵架」,他们跑通了全网95%科研代码|深势发布Deploy-Master
科学计算领域开源软件多,但多数无法直接运行,制约可用性。Deploy - Master 针对此开发,通过搜索筛选工具、双模型博弈构建,将部署成功率提至 95%以上,为 Agentic Science 提供行动基座。
AGI 新技术路线:下一代稀疏注意力机制 Monte Carlo Attention 开源
超对称技术公司在新版基座模型 BigBang - Proton 中使用的 Monte Carlo 注意力开源。它基于二进制块编码技术,用块间代表交流机制实现线性复杂度,兼具多种注意力机制优点,可满足宇宙尺度建模的上下文长度需求。
TileLang深入详解-第一章-GPU 体系结构复习
作者借长假学习 TileLang 并撰写此文,先复习 GPU 体系结构,包括计算与线程组织、存储层次、专用指令单元,接着介绍核心性能模型与优化原理,最后给出基于 TileLang 的基准测试实践。
信息量爆炸!OpenAI内部路线图首次全曝光,首席科学家亲口承认:超级智能10年内到来
OpenAI宣布重组完成后,Sam Altman和首席科学家Jakub Pachocki直播公开内部路线图,称深度学习或10年内实现超级智能,还公布了AI研究目标与时间线,涉及产品、基建等多方面规划。
用激光给芯片散热,摩尔定律天花板盖不住了
初创公司Maxwell Labs提出光子冷却法,可将芯片热量转化成光并去除。该方法基于反斯托克斯冷却原理,集成到薄膜芯片级光子冷板。相比传统散热,它效率更高,有望解决芯片散热难题,推动行业发展。
全球首个「长肌腱」AI机器人量产!Nature盛赞的中国方案惊艳IROS现场
当特斯拉等巨头还在展示蓝图,星尘智能已量产绳驱AI机器人并获多笔订单。在IROS 2025上,其首发半身机器人和超远程遥操作方案,以「Design for AI」理念获《Nature》认可,展现全栈技术实力。
网络基础设施如何支撑大模型应用?北京大学刘古月课题组5大方向研究,相关论文入选ACM SIGCOMM 2025
在智能计算和网络演进背景下,北大刘古月课题组聚焦网络研究。其 5 篇论文入选 ACM SIGCOMM 2025,从架构、数据、运维、安全四个维度形成技术闭环,推动新一代网络系统发展。