「两阶段训练法」共找到 3104 篇相关文章
刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA
普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。
Google 发了个压缩算法,内存砍 6 倍,速度快 8 倍,精度零损失
Google Research发布TurboQuant压缩算法,将在下月ICLR 2026正式发表。该算法把大模型的KV Cache压缩到3 bit,内存降6倍、速度快8倍且精度零损失,解决了传统算法的压缩开销问题。
智谱GLM-OCR,0.9B开源即巅峰,复杂文档精准解析
智谱发布并开源GLM - OCR,以0.9B轻量级参数在多项基准取得SOTA。它解决视觉感知难题,具备视觉编码与语言解码协作架构,还可端侧与高并发部署,成本低,推动文档智能化处理升级。
传Claude sonnet 5即将发布:能自动组建开发团队,一人即一公司,价格爆降50%
小道消息称Anthropic下一代AI模型Claude Sonnet 5或于北美时间2月3号发布,代号“耳廓狐”。它有全新功能,能化身虚拟开发团队,编程能力强,价格将降50%,还与谷歌深度合作。
CES 2026「最烂」产品大赏
CES 2026 展会中消费者权益倡导者颁出最烂产品奖。如三星冰箱语音开门易失灵;亚马逊 Ring 门铃侵犯隐私;Lollipop Star 棒棒糖产生电子垃圾,还介绍了博世等公司部分产品情况。
AI Coding 生死局:Spec 正在蚕食人类编码,Agent 造轮子拖垮效率,Token成本失控后上下文工程成胜负手
本文为《2025 年度盘点与趋势洞察》系列之一,聚焦 AI Coding 在程序员群体的演进与落地。探讨了 Spec 驱动开发、Agent 崛起、Token 成本等问题,指出上下文工程是 AI Coding 成败关键。
打破显存墙:谢赛宁团队提出CLM,单卡RTX 4090「撬动」1亿高斯点
3D Gaussian Splatting (3DGS) 是流行的新视角合成方法,但显存容量限制其应用于大型复杂场景。谢赛宁团队提出 CLM 系统,基于 3DGS 稀疏性和空间局部性,减少通信开销,可在单卡 RTX 4090 渲染大型场景。
零一万物高管新阵容亮相,李开复加码布局ToB 2.0
零一万物ToB战略加速落地,公布新一轮高管任命,沈鹏飞、赵斌强、宁宁三位核心管理者亮相。其“一把手工程”依托万智平台,已覆盖多行业,在国内外均有合作成果,目标是让AI成企业转型推动者。
DeepSeek开源的不仅仅是个新OCR模型。。。
DeepSeek开源3B参数的新OCR模型,重新思考AI处理长文本方式,用视觉token压缩文本信息。核心组件有DeepEncoder和DeepSeek3B - MoE解码器,实验效果好,成本降低,还解决了一些算法和工程问题。
Claude Code 快速入门,高频使用点 + 生态工具,一篇搞定!
本文是Claude Code快速入门教程,涵盖安装、常用命令、使用技巧等内容,还介绍成本控制、新功能及访问方案,最后给出不同阶段使用咒语,助用户发挥其最大效能。