两阶段微调」共找到 1556 篇相关文章

算法论文8

对话清华商宇丨从生成视频到支撑行动,世界模型需要新的评测标准

文章围绕清华团队提出的 WorldArena 评测框架展开。它针对具身世界模型,对过去沿用视频生成的评测逻辑重新审视,从视觉质量和功能性任务维度评估,推动世界模型从‘生成世界’迈向‘使用世界’。

AI科技评论
算法论文8

大模型顿悟原理!Meta新论文说清楚了

Meta超级智能实验室(FAIR)最新论文把大模型顿悟(grokking)现象的数学机制说清楚了。提出Li2数学框架,将层神经网络的grokking动态分三阶段,还推导了泛化缩放定律等。

AI工程化
算法论文8

美团提出多模态推理新范式:RL+SFT非传统顺序组合突破传统训练瓶颈

美团研究者提出Metis - RISE框架,将RL激励和SFT增强以非传统顺序结合提升多模态大语言模型推理能力。先RL激发潜能,再SFT补齐短板,训练的模型在OpenCompass榜单成绩优异。

量子位
推荐文章7

【访谈】在黑箱中寻找自我显影——对话苏仲尧|三影堂厦门

苏仲尧个展《打开黑箱说亮话》聚焦摄影人机互动,引向对‘技术黑箱’思考。创作分三阶段,从文字照片到金属板,再结合AI。他将创作主导权回归自身,借作品探讨技术与人关系及当下处境。

三影堂摄影艺术中心
新闻资讯8

刚刚,Fable-5之下,智谱开源的GLM-5.2拿下AI编程第一!

智谱开源的GLM - 5.2在AI编程领域成绩斐然,在Arena获全球第二、Design Arena全球第一,八项基准测试表现亮眼。经多方面实测,它在长程任务中优势明显,标志国产开源模型进入开发者工作流和硬核工程阶段

量子位
开源动态8

YOLO12改进引入DINOv3少样本目标检测精度飙升,分享训练自定义数据集代码

Meta 人工智能研究院的 DINOv3 是基于自监督学习的视觉大模型,解决诸多问题且无需微调,在多任务表现出色。将其引入 YOLO12 后,在不同规模数据集上检测性能显著提升,还分享训练自定义数据集代码。

机器学习AI算法工程
开源动态8

500美元刷新SOTA!训练成本砍到1/200,华人团队重构视频生成范式

香港城市大学等团队发布图像 - 视频生成模型Pusa V1.0,在基础大模型上引入VTA机制,用3860对视频 - 文字数据、约500美元微调,在I2V超越Wan - I2V - 14B实现SOTA,还解锁零样本任务能力。

量子位
算法论文8

边画边想!多模态Reasoning迎来巨大提升!

论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)在空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,在五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。

深度学习自然语言处理
推荐文章8

API7.ai创始人温铭:烧了几百亿Token,我用AI重写了生产级网关,总结出6条经验

API7.ai创始人温铭分享用AI重写生产级网关经验。他认为AI编码能力超资深工程师,瓶颈在人。还介绍在公司‘禁手写代码’的情况,以及AI代码审查、使用阶段等内容,最后说明重写AI网关AISIX的原因。

InfoQ
新闻资讯7

阿里的未来,是通往超级人工智能

云栖大会上,阿里巴巴 CEO 吴泳铭演讲传达阿里对 AI 发展判断与战略规划。他认为 AGI 非终点,ASI 是目标,并提出实现三阶段。还指出阿里抓住大模型和 AI Cloud 支点,要把通义千问打造成 AI 时代 Android 系统。

特工宇宙