「集群性能优化」共找到 2917 篇相关文章
国产王炸!上海AI Lab开源Lumina-DiMOO,开创多模态理解与生成新范式
上海人工智能实验室等多机构推出多模态生成与理解统一模型Lumina - DiMOO,采用全离散扩散架构。它解决传统多模态架构问题,有全离散扩散建模等四大创新,性能在多基准测试中领先,应用前景广。
刚刚,OpenAI发布GPT-5-Codex:可独立工作超7小时,还能审查、重构大型项目
凌晨1点,OpenAI发布针对编程优化的GPT-5-Codex,它能独立工作超7小时,可审查、重构大型项目。还宣布Codex升级,包括新CLI和IDE插件等,同时介绍安全保护措施、价格及可用性。
谷歌Gemini | 一次提示能耗≈看9秒电视剧?
谷歌发布Gemini能源消耗研究报告,称处理中位数文本提示能耗低,2024 - 2025年能耗降33倍、碳足迹减44倍,归功于全栈式优化。但专家质疑方法论,指出未算间接用水、碳排放核算不全等问题。
全球第一!西湖大学成功登顶Science,卷赢同行背后黑科技揭秘
西湖大学一篇论文登顶Science,力压4篇同主题投稿。其成功除科研人员实力,还靠曙光存储支持。曙光为其AI集群升级,提供单节点带宽150GB/s的存储方案,且已大规模落地科研领域。
GPT-5 放弃追求智能上限了?
GPT-5发布,虽借OpenAI名气获流量,但AI科技评论认为其结果令人失望。它推销转向任务性能提升,非基础大模型能力突破。虽成果出色,但也引发对AGI发展的反思,还面临诸多难题。
阿里、南开大学发布免训练,视频大模型创新压缩方法
视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。
无损加速视觉语言模型推理!轻松剪掉视觉冗余Token|腾讯AI Lab
多图像、长视频让大型视觉语言模型推理成本暴涨,成算力瓶颈。腾讯AI Lab联合CMU提出VScan,通过两阶段视觉token筛选机制,在几乎不损性能的前提下实现推理加速,且已在GitHub开源。
Muon作者仅用一篇博客,就被OpenAI看中了
Keller Jordan 2024 年 12 月 8 日发布博客提出用于神经网络隐藏层的优化器 Muon,能提升训练速度。他未发论文,称只信速通。其案例显示 OpenAI 重能力。博客对前沿指标描述或过时,Muon 有诸多实证成果。
OpenAI首席研究员Mark Chen长访谈:小扎亲手端汤来公司挖人,气得我们端着汤去了Meta
OpenAI首席研究官Mark Chen在访谈中爆料Meta抢人大战升级成送汤大战,还谈到OpenAI核心研究团队规模、应对Gemini 3策略等。他认为OpenAI本质是研究公司,有信心在预训练和模型性能上超越对手,还提及OpenAI for Science等计划。
斯坦福423页AI报告出炉!中美差距仅2.7%,清华DeepSeek冲进全球前十
斯坦福发布「2026年AI指数报告」,长达423页,揭示全球AI产业版图。指出中美AI模型性能差距仅2.7%,AI发展迅速但人类管控能力未跟上,还呈现出就业、算力、应用等多方面趋势。