后训练策略」共找到 4334 篇相关文章

新闻资讯7

刚刚,OpenAI内部推理模型斩获IOI 2025金牌!所有AI选手中第一

OpenAI内部推理模型获IOI 2025金牌,总排名第6、AI组第1,沿用IMO金牌版本且未专门训练。商业模型在IOI表现不足,Grok 4相对领先。巨头热衷竞赛,源于竞争、技术迭代及多方利益考量。

新智元
新闻资讯7

独家丨数千万天使轮融资,中科院背景团队「熵旋芯智」押注存内概率计算

AI 科技评论独家消息,熵旋芯智获数千万元天使轮融资,由英诺天使基金领投。该公司是国内唯一基于 MRAM 构建存内概率计算平台的企业,采用全栈软硬协同策略,有望大幅提升能效比,计划 2027 年初交付芯片。

AI科技评论
产品应用8

千人千面的真人级AI名师,劈开教育「不可能三角」

与爱为舞推出的AI导师能个性化教学,服务百万用户。其用「模型+语音+工程」铸造技术巨剑。经训练,AI可驾驭课堂,再经自研语音模型实现交互,通过链路优化等实现规模化落地,践行「全员皆超级个体」理念。

量子位
开源动态8

Day0迁移、一键部署,华为开源的昇思MindSpore成为大模型开发的“万能钥匙”

在大模型无法一统天下的背景下,开发者面临在一个框架、生态体验众多主流大模型和AI技术的难题。华为开源的昇思MindSpore可实现训练Day0迁移、推理一键部署,还介绍了其相关技术和实测效果。

量子位
新闻资讯7

刚刚,Karpathy亲自辟谣:我没走!

Karpathy入职Anthropic 68天时,因简介里「Anthropic」不见引发离职猜测,他亲自辟谣。此前他简介改动常与离职有关,此次事件还与开源闭源之争相关,他曾是开源信仰者,如今力挺闭源Claude。

新智元
开源动态8

商汤SenseNova U1深度拆解,原生统一架构终结缝合时代

文章深度拆解商汤科技开源的新一代模型「日日新 SenseNova U1」,介绍其基于 NEO - Unify 原生统一架构,在数据、训练与推理深度协同,多维度测试成绩亮眼,代表多模态从拼接走向原生建模新方向。

机器之心
新闻资讯7

穿越100年前打造的AI,不知道二战和互联网,却从几个例子学会了Python

前OpenAI研究成员等打造出130亿参数的时代语言模型talkie,只用1930年前英文词元训练。它不知二战等现代信息,能从例子学Python,风格似20世纪绅士,研究团队将扩大其规模。

DeepTech深科技
算法论文8

10 年,Kimi 团队重新发明残差连接。马斯克和 Karpathy 同时点赞

Kimi团队发布技术报告,提出用Attention Residuals替换残差连接。实验显示其在各尺度模型上表现优于基线,降低训练成本。马斯克和Karpathy点赞,这或标志深度学习基础范式进入重新讨论阶段。

AGI Hunt
产品应用8

Seedance 2.0之,又一中国视频模型SkyReels-V4登上全球第二

昆仑天工发布SkyReels V4视频大模型,在Artificial Analysis Arena基准测试中排全球第二。它支持多模态输入、音视频同步生成等,采用独特架构与技术,经多阶段训练,有全新评估基准,表现出色。

AIGC开放社区
算法论文8

arXiv开始拒收综述论文了?「论文DDoS」这事,这篇NeurIPS论文早有讨论

近日,arXiv宣布拒收未通过同行评审的综述和立场性文章,危机源于生成式AI与大模型。上海交大团队中稿NeurIPS的论文,精准预见此危机,提出“综述论文DDoS攻击”概念,还给出应对策略

机器之心