FP8训练」共找到 2612 篇相关文章

新闻资讯7

OpenAI财报泄露!3个月能烧37亿美元,年亏损涨8

OpenAI最新泄露财报显示,2025年经营数据糟糕,收入130.7亿美元,支出340亿,亏损385亿,是24年近8倍。2026年Q1烧钱37亿美元。不过账上现金充裕,IPO虽受影响但不绝对。

量子位
算法论文8

无需再训练即可增强性能!港大团队提出GPC框架,实现机器人「策略组合」

在机器人学习领域,提升策略性能常需巨额成本。香港大学团队提出GPC框架,通过“策略组合”创造超越单一父策略的“组合策略”,免训练且跨架构、模态融合,经仿真和真机实验验证性能提升。

机器之心
开源动态8

轻量级易开发,8B参数释放大实力!科学多模态模型Intern-S1-mini开源

上海人工智能实验室继7月26日开源后,推出轻量化版本Intern-S1-mini。它是8B参数“迷你模型”,兼具通用与专业科学能力,适合快速部署和二次开发,在多方面表现出色,还降低了对高端计算设备依赖。

OpenMMLab
开源动态8

阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理大模型

LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。

PaperAgent
开源动态8

清库存!DeepSeek突然补全R1技术报告,训练路径首次详细公开

DeepSeek给近一年前登上《Nature》封面的R1论文补64页技术细节,正文大幅翻修。新论文展开R1完整训练路径,补充R1 - Zero分析,还披露安全评估细节。此外团队稳定,引发对其后续动作猜测。

量子位
算法论文8

Adobe 新研究:不用再「喂」训练数据,VLM 靠和自己玩游戏变聪明

Adobe 等机构研究人员提出「Vision-Zero」,借鉴 AlphaGo 自迭代方式,设计让 VLM 自我学习框架。此框架以类似「谁是卧底」游戏训练,不依赖标注数据,在多任务超越有标注的 SOTA 方法。

Founder Park
新闻资讯7

3个月融资亿元,流形空间证明世界模型也需要预训练 | 甲子光年

2025年5月武伟创办流形空间,成立3个月获亿元融资。他认为VLA是过渡方案,世界模型是AGI新基建。当下技术分显式物理建模和隐空间交互两派,流形空间做具身世界模型,从预训练做起,还将领域模型产品化。

甲子光年
开源动态8

无需训练,即插即用:西湖大学发布世界模型WorldForge,让普通视频模型秒变「世界引擎」

自Sora亮相,AI视频可控性成瓶颈。西湖大学AGI实验室团队提出WorldForge框架,在推理时为视频模型注入「时空几何」,无需训练,实现单图360°环绕视频生成和视频重运镜等,降低创作门槛。

机器之心
新闻资讯7

刚刚,OpenAI全员放假一周!被Meta高薪连挖8人「偷家」,真麻了

生成式AI竞争激烈,OpenAI却宣布全员放假一周,原因是被Meta高薪连挖8人。OpenAI高管承诺正面交锋,Mark Chen称不会袖手旁观,还鼓励员工留下,公司更专注实现通用人工智能。

机器之心
新闻资讯8

内存减6倍、精度0损失,推理提速8倍!谷歌新技术震撼了AI圈

Google Research团队推出TurboQuant技术,能将KV缓存6倍压缩、无精度损失,推理速度提升8倍,解决内存瓶颈问题,为大语言模型应用扫清障碍,引发业界关注,还致存储芯片巨头股价大跌。

AIGC开放社区