精度与效率」共找到 7280 篇相关文章

推荐文章7

如何为 GPU 提供充足存储:AI 训练中的存储性能扩展性

文章分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在 AI 训练中表现。在满足 GPU 利用率阈值下,能支撑更多 GPU 的存储系统扩展性稳定性更强,还需关注资源利用率。以太网存储方案灵活且成本效益高。

AI前线
新闻资讯7

一场机器人黑客松,让具身智能的差距机会同时显形

作者参加深圳机器人黑客松,这是全球最大规模线下具身智能开发者大赛之一。3天内参赛队伍可完成从数据采集到真机部署闭环。比赛让行业差距机会显形,凸显基模重要性,自变量也给出新方向。

InfoQ
推荐文章7

TileLang深入详解-第一章-GPU 体系结构复习

作者借长假学习 TileLang 并撰写此文,先复习 GPU 体系结构,包括计算线程组织、存储层次、专用指令单元,接着介绍核心性能模型优化原理,最后给出基于 TileLang 的基准测试实践。

GiantPandaLLM
新闻资讯7

中美AI竞争的四种未来:OpenAI情报调查团队指出决胜点

OpenAI情报调查团队对中美未来几年AI竞争进行推演,指出美国有资本、算力等优势,但面临电力等问题;中国靠国家意志推动,有工业协调等优势。未来博弈有四种结局,决胜看中国算力自救、全球‘朋友圈’和本土市场消化能力。

AIGC开放社区
推荐文章8

Python语言从2.7到3.14的能力变化演进逻辑

文章从编程风格、类库生态、性能优化等多维度,阐述Python从2.7到3.14版本的能力变化演进逻辑。如编程风格现现代化转型,类库生态战略性调整,性能优化有突破性进展等,还分析了演进背后的推动力及未来趋势。

阿里云开发者
算法论文8

SIGGRAPH 2026 | 无需训练,一段单目视频解锁任意运镜「子弹时间」

来自UIUC、宾大Netflix Eyeline Labs的研究团队提出FreeOrbit4D,无需训练模型,用单目视频就能实现任意运镜和“子弹时间”。它通过“前景补全的4D重建”提供几何支架,在大角度视角变化下表现出色,还带来诸多应用。

机器之心
算法论文8

「熟悉的陌生人」才是「好老师」?复旦提出简单指标,找出推理蒸馏中真正有教学价值的数据

复旦大学和上海人工智能实验室研究者提出 Rank - Surprisal Ratio (RSR) 度量方法,综合考虑样本信息量对齐程度,在蒸馏实验中学生模型后训练性能相关性高,可用于筛选推理轨迹和选择教师模型。

机器之心
推荐文章8

从“暴力烧Token”到“系统工程”:OpenAI华为的两条 AI 编程路径

文章对比OpenAI华为的AI编程路径,指出模型中心派靠推高上下文窗口但有成本高、延迟大等问题;工具驱动派如Cursor和华为云码道重构IDE工具。码道将任务解耦,通过多技术实现性价比,还介绍了底层基石及其实测表现。

InfoQ
开源动态8

多模态开发革命!Gabber开源:图形化构建实时AI应用,效率提升10倍!

AI应用迈向多模态交互,传统开发方式周期长。开源项目Gabber是实时AI应用引擎,通过模块化图形化简化开发,有诸多特性,还给出安装指南,适用于多种场景。

开源星探
算法论文8

破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%

来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,能降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。

机器之心