「高性能计算」共找到 3867 篇相关文章
前谷歌研究员发文:算力崇拜时代该结束了
前谷歌大脑研究员 Sara Hooker 发文指出,过去十年 AI 创新依赖算力,但如今持续扩展训练计算资源效率极低,收益递减。她探讨了影响算力回报率的因素,批判 Scaling Law,并提出未来创新方向。
Claude Code迎来大更新:Agent能力增强
Claude Code 2.1.0正式发布,围绕Agent能力、开发者体验和安全性全面升级。有大量功能新增,如技能与Agent的热重载、上下文分叉等;修复诸多问题,还进行了性能、可靠性等方面的优化。
170次搜索+50次反思:用GLM-4.7盘点2025 Agent行业趋势,结果太震撼!
作者给智谱新开源的GLM - 4.7布置调研2025年Agent赛道企业的任务,结果令人震撼。该模型进化显著,能整理详细企业信息,还能生成高审美PPT。国内有不少特色AI落地企业。
刚刚,OpenAI发长文:找到缓解LLM撒谎的方法!
Google发布Gemini 3 Deep Think,ARC - AGI - 2准确率高且采用并行推理技术。OpenAI发长文《通过忏悔训练大型语言模型诚实性》,介绍缓解LLM撒谎的忏悔训练法、实验结果等,也指出其局限。
OpenAI深夜双王炸!GPT-5.1 Pro紧急发布,降维打击Gemini 3
OpenAI同一天发布GPT-5.1 Pro和GPT-5.1-Codex-Max。前者向Pro订阅用户推出,主打「情商智商」双强;后者在Codex平台上线,专为「长时间、高强度」开发任务设计,采用「压缩」机制,表现出色。
Thinking Machines再发文:模块化流形让训练更稳定
Mira Murati团队分享神经网络训练推理新研究,提出“模块化流形”让训练更稳定。将权重约束在Stiefel流形,设计Manifold Muon优化器,实验显示效果好,但计算开销和理论问题待解决,代码已开源。
Grok 4意外提前曝光,xAI巨额融资700亿,马斯克宣布“重写人类知识库”
xAI的Grok 4提前泄露,团队跳过Grok 3.5直接推出。它被定位为旗舰模型,有强大性能。马斯克欲用其重写人类知识库,但引发争议。xAI融资100亿,建超算中心面临电力问题。
这个推理模型:HRM ,只用2700万参数,超越了DeepSeek和Claude
Sapient Intelligence研究者受大脑机制启发提出分层推理模型HRM,它是全新循环架构,仅2700万参数、1000个训练样本,就在复杂推理任务上表现卓越,还引入近似梯度等方法,有推动通用计算变革潜力。
这个扩散LLM太快了!没有「请稍后」,实测倍速于Gemini 2.5 Flash
AI初创公司Inception Labs推出首款专为聊天定制的商业级扩散LLM——Mercury。它速度超快、效率高,能实时响应对话。实测显示其速度优于Gemini 2.5 Flash等,不过生成质量有待提升。
字节跳动2步突破,复杂文档布局解析,为啥如此惊艳?
文章指出现有文档图像解析方案有局限,介绍字节跳动的Dolphin解决方案。它采用分析 - 解析范式分两阶段解析文档,避免传统方法弊端,运行效率高,还给出训练方案、实战代码和试用链接。