「GPU性能分析」共找到 3214 篇相关文章
93%的人在用AI,为什么生产力只提升了10%——两个被严重低估的杠杆
Stack Overflow 2024年调查显示93%开发者用AI辅助工具,但DX Research研究表明生产力仅提升约10%。文章指出多数人用AI是线性叠加,真正的乘数效应来自自闭环验证和长期记忆,还分析误区并给出实践路径。
MIT新研究:大模型加噪声就能替代GRPO/PPO调参
MIT新论文提出,预训练模型周围存在大量“专家模型”,只需添加高斯噪声并集成,性能就能比肩甚至超越GRPO/PPO等调参算法。由此启发了RandOpt算法,经测试准确率不错,但也有依赖预训练等缺点。
李飞飞World Labs最新判断:AI写完代码,下一步是「写世界」?
这篇来自 World Labs 的博客探讨了 AI 参与空间创作和现实世界任务时的通用接口,认为是 3D 。它像代码一样可结构化表达,还分析了神经图形学、模拟引擎的作用,并介绍了相关项目。
万亿思考模型夺下IMO金牌,无缝接入OpenClaw!一句话手搓丐版PS
2026年AI圈竞争激烈,闭源巨头巅峰对决时,开源社区迎来中国队的「技术核爆」。全球首个万亿级混合线性「思考模型」Ring - 2.5 - 1T开源,它能力强大,还能无缝接入Claude Code,实战表现亮眼。
SDD 如何在复杂业务系统中真正落地?
文章围绕SDD在复杂业务系统落地展开,介绍OpenSpec库使用,对比与系分差异,分析其优势与问题,如LLM与IDE执行能力鸿沟、无update命令等,还对比OpenSpec和GitHub Spec Kit,并给出流程及提示词。
SGLang Hierarchical Sparse Attention 技术深度解析
阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了长上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段。
万字长文|迈向电商大模型时代,从虚拟试穿聊到电商AIGC
本文是京东李岩博士在AICon2025的演讲整理。他从虚拟试穿切入,拆解其技术逻辑、行业实践与未来趋势,还介绍京东电商AIGC布局,如商品抠图、素材生成等能力,分享业务成果及对电商AIGC未来的看法。
Ilya重新定义AGI: 为什么ChatGPT离真正的AGI还很远
OpenAI前首席科学家Ilya在访谈中提出对AGI的新定义,还指出AI规模时代结束,未来拼想法和研究深度。他分析模型评测强但经济影响弱的原因,阐述人类价值函数作用,且SSI战略或调整。
56倍加速生成式策略:西交大提出EfficientFlow,迈向高效具身智能
生成式模型在机器人和具身智能领域面临训练依赖大量数据、推理慢的问题。西安交通大学团队提出EfficientFlow,融合等变建模与高效流匹配,提升数据效率,压缩推理迭代步数,在多基准实现SOTA,推理提效显著。
起底“豆包手机”:核心技术探索早已开源,GUI Agent布局近两年,“全球首款真正的AI手机”
当红的“豆包手机”技术详情被证实,其助手技术基于字节自研的UI-TARS模型,该模型初代开源后引发热议,“豆包手机”用的闭源版性能更优。UI-TARS历经迭代,成果成热门开源多模态智能体。