「SFT阶段」共找到 780 篇相关文章
看完Kimi K2.5技术报告,它的视觉Agentic真给我惊到了
Moonshot AI发布Kimi K2.5技术报告,该模型将文本和视觉打通,有并行执行的智能体集群系统。它采用Joint Training,提出“Zero-Vision SFT”,用MoonViT - 3D处理图像和视频,开源后受欢迎,展示通用智能体可能。
极简RL新范式:一半算力刷新1.5B模型推理SOTA
过去为提升中小参数量模型推理能力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定超参训练方案,在两主流1.5B模型上刷新SOTA,节省2倍算力,消融实验还揭示部分技巧会致性能退化。
从人工到AI驱动:天猫测试全流程自动化变革实践
AI时代,天猫技术质量同学探索AI在测试全流程提效的落地方案,将传统测试工作链拆解为五阶段,目标是实现全流程自动化等。介绍了测试体系变革、所需关键能力、技术架构及落地收获与未来趋势。
Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型
现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。
具身智能还需要一个「五年耐心」
作者与具身智能领域人士交流后认为,具身智能还需「五年耐心」。当下通用机器人进工业产线挑战大,一到两年或迎「GPT - 3.0 时刻」,但到「GPT - 4.0」阶段还需解决数据、硬件等诸多问题。
DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜
DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。
当AI接管70%代码审查工作,剩下的30%才是 “地狱模式”
2024年初“Vibe Coding”成热词,其虽能快速验证想法,但在大型企业项目中“不可控性”凸显。亚马逊云科技研发的Kiro,尝试解决“从提示词到生产”的断裂问题。目前代码审查多采用混合模式,AI仅处初级阶段。
Andrej Karpathy 爆火演讲刷屏技术圈:AI 开启软件 3.0,重写一切的时代来了!
Andrej Karpathy 在旧金山 AI 创业学校演讲,指出 AI 开启软件 3.0 时代,自然语言成编程接口。软件经历 1.0 代码、2.0 神经网络权重,现进入 3.0 用提示词编程大模型阶段,还探讨大模型特性、应用及相关问题。
Token需求狂飙千倍,22亿热钱涌向这家AGI Infra头号玩家
在AI基础设施成风口的背景下,国内AGI Infra头部玩家无问芯穹获超7亿融资,其Token调用量爆发式增长。随着AI产业进入Agent阶段,传统架构难适配新需求,无问芯穹以中立定位成Token经济枢纽。
刚刚,一口气连发3个王炸模型、亮出2026年AGI战略,昆仑万维夯爆了
27日下午,昆仑万维在2026中关村论坛发布全新AI游戏世界模型Matrix - Game 3.0、AI视频大模型SkyReels V4和AI音乐大模型Mureka V9,还公布2026 AGI战略,推动AI从全模态能力突破进入平台化构建阶段。