低成本训练」共找到 3845 篇相关文章

新闻资讯8

预测太阳磁暴全球最强!首个空间天气链式AI预报模型亮相WAIC

在WAIC上,我国发布全球首个全链式空间天气AI预报模型“风宇”。它首创链式训练结构,整合孤立环节;基于天地一体化观测数据,在多区域短临预测表现卓越,误差,已申请多项专利,还可用于航天器设计管理。

量子位
开源动态8

DeepSeekV3.2技术报告还是老外看得细

ChatGPT三岁生日时,DeepSeek两款开源模型DeepSeek-V3.2和DeepSeek-V3.2-Speciale引发热议。它们在智能体评测中表现出色,缩小了开源与闭源模型差距,还降成本,给硅谷闭源AI公司带来压力。

量子位
开源动态8

让图像生成告别 AI 味!清华 + 港中大 + 腾讯混元联手推出SRPO

腾讯混元联合港中大、清华推出SRPO,解决文生图技术痛点。它结合Direct - Align和SRPO,提升图像审美等,训练时间缩至十分钟,在测试中碾压主流方法,不过对冷门风格控制和机制可解释性待提升。

AIGC开放社区
开源动态8

Nanbeige4.2-3B:探索通用Agent小模型

在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。

AIGC开放社区
算法论文8

斯坦福&英伟达提出新范式:推翻Scale Law,在“推理”阶段自我进化,超越人类专家

斯坦福和英伟达提出 TTT - Discover 新范式,允许模型在测试时继续训练,针对难题‘进化’。它设计了自适应熵目标函数和 PUCT 状态复用组件,实验在多领域碾压人类专家与同行,但在部分领域落地有局限且计算成本高。

深度学习自然语言处理
产品应用7

全网实测开玩Fable 5.1,听说写作说话和真人没区别?

Anthropic发布Fable 5.1后,第三方跑分和个人实测出炉。ARC Prize测试成绩佳且成本降32%,网友用它做出多款游戏。科技媒体Every全面测评,指出其多方面优势与设计等短板,并给出使用边界。

量子位
算法论文8

只需1/4预算,性能反超基线:阿里高德提出Tree-GRPO,高效破解智能体RL难题

阿里高德提出Tree - GRPO方法解决智能体RL难题。它以智能体步骤为节点树搜索,在11个数据集中更省预算、表现更好,能在1/4预算超GRPO基线,解决了Rollout成本高和监督稀疏问题。

机器之心
推荐文章7

TPU vs GPU 全面技术对比:谁拥有 AI 算力最优解?

SemiAnalysis对Google TPU v7/v8深度拆解,将TPU与Nvidia GPU多方面对比拆到可计算层面。不过其结论有局限性,本文重新分析,指出TCO因场景而异,互联体系分歧在流量假设,Google TPU v8成本优势被削弱。

海外独角兽
产品应用8

全球首个英伟达含量为0的万亿模型,成了海外开发者的抢手货

美团推出LongCat-2.0,是首个在国产算力上实现全链路训推闭环的万亿参数模型。它多项性能强,适配主流编程工具,架构设计原创,还证明了国产算力有支撑大模型迭代的能力,训推成本

量子位
算法论文8

CVPR 2026 | ReFTA:打破张量化PEFT的「权重重建」瓶颈

随着大模型发展,全参数微调成本高,参数高效微调(PEFT)成主流。常见基于矩阵秩分解的PEFT方法有局限,张量化PEFT虽有优势但存在权重重建问题。本文提出ReFTA方法解决该问题,有工程和理论优势。

机器之心