「后训练方法」共找到 4805 篇相关文章
刚刚,Karpathy亲自辟谣:我没走!
Karpathy入职Anthropic 68天时,因简介里「Anthropic」不见引发离职猜测,后他亲自辟谣。此前他简介改动常与离职有关,此次事件还与开源闭源之争相关,他曾是开源信仰者,如今力挺闭源Claude。
商汤SenseNova U1深度拆解,原生统一架构终结缝合时代
文章深度拆解商汤科技开源的新一代模型「日日新 SenseNova U1」,介绍其基于 NEO - Unify 原生统一架构,在数据、训练与推理深度协同,多维度测试成绩亮眼,代表多模态从拼接走向原生建模新方向。
穿越100年前打造的AI,不知道二战和互联网,却从几个例子学会了Python
前OpenAI研究成员等打造出130亿参数的时代语言模型talkie,只用1930年前英文词元训练。它不知二战等现代信息,能从例子学Python,风格似20世纪绅士,研究团队将扩大其规模。
盛大AI研究院新作:流式生成超越非流式,一句话让虚拟人动作丝滑如真,推理延迟仅1帧
盛大AI研究院与东京大学联合提出FloodDiffusion,首个基于定制化扩散强制的流式人体动作生成框架。它能零延迟生成无限长动作序列,解决了现有方法的问题,在多数据集评估中表现优异。
10 年后,Kimi 团队重新发明残差连接。马斯克和 Karpathy 同时点赞
Kimi团队发布技术报告,提出用Attention Residuals替换残差连接。实验显示其在各尺度模型上表现优于基线,降低训练成本。马斯克和Karpathy点赞,这或标志深度学习基础范式进入重新讨论阶段。
Seedance 2.0之后,又一中国视频模型SkyReels-V4登上全球第二
昆仑天工发布SkyReels V4视频大模型,在Artificial Analysis Arena基准测试中排全球第二。它支持多模态输入、音视频同步生成等,采用独特架构与技术,经多阶段训练,有全新评估基准,表现出色。
谢赛宁新作:VAE退役,RAE当立
谢赛宁团队研究表明VAE时代结束,RAE将接力。RAE是用于扩散Transformer训练的新型自动编码器,能提供高质量重建结果,有语义丰富潜空间,支持可扩展架构,收敛快,在ImageNet图像生成效果强劲。
空间智能新高度:港科大谭平团队SAIL-Recon突破万帧级图像大规模3D场景重建Transformer
香港科技大学谭平教授团队与地平线团队发布3D场景表征与大规模重建新方法SAIL - Recon,突破现有模型处理能力瓶颈,可实现万帧级场景表征抽取与定位重建,在多数据集上表现优于现有方法。
Founder Mode主导,按结果付费带来300%增长,Intercom 的AI转型为什么能成?
本文讲述 Intercom 从 SaaS 老牌公司到 AI-first 的转型故事。创始人 Eoghan McCabe 回归后,裁员聚焦客服,推出 AI Agent 产品 Fin,按结果付费,增长率超 300%。还分享转型经验、AI 影响及对人才培养的见解。
下周聊:出海第一步,AI 科技公司需要关注的 5 个法律合规问题
AI创业应尽早出海,但不同地区法律法规等复杂。文章邀请专业人士,下周四线上分享科技公司、AI创企出海面临的合规风险、典型案例及应对方法,还提及需关注的软硬件法律风险等问题。