多GPU性能」共找到 5701 篇相关文章

开源动态8

他们让万亿参数RL学会了「省着跑」,顺便砍掉九成算力

2025年,强化学习成大模型进化主战场,但万亿参数模型跑RL成本高。Mind Lab团队实现1T参数模型LoRA高效RL训练,GPU消耗降90%,技术开源。此外还有Memory Diffusion记忆机制等成果。

量子位
算法论文8

与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读长文本

NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在任务表现优,还让模型‘用眼看文字’,优势明显。

机器之心
新闻资讯8

ICIG 2025:共话图像发展新坐标

2025年10月31日至11月2日,第十三届国际图象图形学学术会议(ICIG 2025)在徐州举行,700余人参会。大会展示前沿成果,设场论坛与赛事,专家认为其为领域发展注入新动力,巩固中国学术交流地位。

AI科技评论
产品应用8

刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」

Cursor 2.0发布重大更新,带来自研编码模型Composer和新协作界面。Composer速度领先,针对软件工程优化;新界面以智能体为中心,可并行运行智能体,还解决了代码评审和测试瓶颈。

机器之心
新闻资讯7

“iFold”,苹果AI新成果

苹果发布基于流匹配的蛋白质折叠模型SimpleFold,被戏称“iFold”。它用通用Transformer模块搭配流匹配生成范式,3B参数版本追平谷歌AlphaFold2性能,还解决了传统模型算力依赖问题,效率高。

量子位
开源动态8

LeCun团队开源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典

Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在个代码与推理任务表现出色,开源代码、训练细节等,不过目前仅支持Python。

量子位
新闻资讯7

刚刚,奥特曼发布GPT-5!人人免费用「博士级」智能,基准图错误遭全网吐槽

OpenAI 发布 GPT - 5,奥特曼连发推文介绍看点。它是集成模型,有免费版、Plus 和 Pro 计划,领域跑分亮眼。不过直播现小 bug,跑分图出错,马斯克拆台,表现未达部分人预期。

机器之心
新闻资讯7

突发!特朗普刚刚发布《美国AI计划》,OpenAI、微软、亚马逊成大赢家

今天凌晨,特朗普公布《美国AI行动计划》,含加速AI创新、构建基础设施、主导外交安全三大支柱及90项行政命令,旨在让美成全球AI霸主,还将中国列为对手,官员表态肯定该计划。

AIGC开放社区
新闻资讯7

大模型平台Mistral正洽谈10亿美元融资

彭博消息,法国大模型开源平台Mistral正与阿布扎比MGX基金及法国贷款机构洽谈10亿美元融资。MistralAI成立于2023年,模型性能佳,2023年末至2024年轮融资使估值飙升,还开发款模型。

AIGC开放社区
新闻资讯8

The Batch:835 | 图表中的 AI 市场趋势

知名投资分析师 Mary Meeker 时隔六年发布 340 页 AI 市场报告。报告指出 AI 变革快、性能攀升、有新兴能力,还会影响劳动力等,同时也带来经济不确定性,当下是开发软件应用的黄金时期。

DeeplearningAI