算力大考」共找到 5573 篇相关文章

新闻资讯7

马斯克最算力中心建成了:全球首个GW级超算集群,再创世界纪录

全球首个GW级超算集群Colossus 2正式投入运行,马斯克称其4月将升级至1.5GW。这为Grok 5训练提供强算力。但美国部分地区因数据中心电力需求激增,或在用电高峰对居民轮流停电。

量子位
产品应用8

从操作系统到Agent Team,字节Seed 2.0来了!

作者受字节内测邀请,对豆包模型Seed 2.0进行多方面测试。在APP开发、多模态理解、操作系统构建、Skills调用、真实项目开发等测试中表现出色,虽有小缺点,但整体提升,值得试用。

AI产品黄叔
推荐文章7

评论送书 | 一文读懂多Agent系统演进趋势

文章指出多Agent系统成模型应用重要方向。分析模型交互的上下文瓶颈,如语义膨胀、信息密度不均等;阐述Agent间协同结构演化,包括松耦合编排、语义协同等;还说明传统Prompt工程局限及通信与上下文协议的作用。

AIGC开放社区
算法论文8

合成数据>人工数据,绝对性能暴涨超10个点!仅需任务定义,高效微调模型

为解决基础模型在专业领域表现不佳、依赖人工标注数据的难题,北、MIT等机构提出「合成数据强化学习」框架。该框架仅需任务定义,能生成合成数据微调模型,在多领域基准上性能提升显著,代码已开源。

新智元
开源动态8

写Verilog、调CUDA,总翻车?工业代码模型开始学会「先想后写」了

工业代码模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思深度,且模型与代码已开源。

机器之心
推荐文章7

直播预约 | 如何缓解LLM-as-a-Judge的潜在偏好?UDA:一种无需人工标注的无监督去偏对齐框架

论文针对不同模型对同一组模型回答打分差异等问题,提出无需人工标注、模型无关、即插即用的UDA框架,以无监督方式动态调整Elo评分,实验表明该方法能降低打分标准差、提升与人类评分相关系数。

深度学习自然语言处理
产品应用8

京东AI「结果」:深度应用已成当下,万亿生态瞄准未来

9月25日,“2025京东全球科技探索者会”展示了京东AI的深度应用成果。京东发布全新JoyAI模型及三AI产品,展示其在多场景的应用,还升级多个平台,未来三年将投入带动万亿规模AI生态。

机器之心
新闻资讯7

刚刚,全球最难试惊天反转!黑马AI冲破36%,顶流模型集体翻车

ARC-AGI-3测试中,顶级模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。

新智元
产品应用8

英伟达祭出NVFP4核弹:模型训练根本性转变,GB300效率狂飙7倍

英伟达推出新格式NVFP4,能以4 - Bit速度与效率实现16 - Bit生产件级训练精度,是LLM开发重飞跃。虽处于研究阶段,但正与多组织合作。还介绍其方法、优势,实验也证明它在规模训练的有效性。

AI寒武纪
算法论文8

推荐模型来了?OneRec论文解读:端到端训练如何同时吃掉效果与成本

随着AI发展,推荐系统面临诸多问题,快手技术团队提出OneRec,以端到端生成式架构重构推荐系统全链路,在效果与成本上实现突破,已在快手双端服务用户,也有需完善之处。

机器之心