预训练框架」共找到 3478 篇相关文章

算法论文8

10万token自然语言推理,让30B-A3B模型站上奥赛金牌线

上海人工智能实验室报告显示,30B - A3B规模的SU - 01模型不依赖外部工具,经训练在IMO、USAMO、IPhO等奥赛评测达金牌水平。研究还验证更高效科学推理系统路线,有望用于更多科学问题。

机器之心
新闻资讯8

陈天桥旗下盛大AI东京研究院于SIGGRAPH Asia正式亮相,揭晓数字人和世界模型成果

在SIGGRAPH Asia 2025期间,盛大AI东京研究院首次公开亮相。当前数字人交互缺乏“灵魂”,存在长期记忆与人格一致性、多模态情感表达缺失和缺乏自主进化能力等问题。为此,研究院推出Mio框架解决挑战。

机器之心
推荐文章7

中年人的认知坍塌

Andrej Karpathy在播客提到模型持续用合成数据训练会出现‘认知坍塌’,能力退化。他认为人类随年龄增长和经验固化,也会从无限可能收敛到固定思维模式,像极了中年人的认知坍塌。

newtype AI
算法论文8

NTU等联合提出A-MemGuard:为AI记忆上锁,投毒攻击成功率暴降95%

在AI智能体依赖记忆系统的当下,记忆投毒攻击兴起。A-MemGuard作为首个为LLM Agent记忆模块设计的防御框架,通过共识验证和双重记忆结构,解决防御难题,使投毒攻击成功率暴降超95%。

新智元
开源动态8

国产大模型新SOTA:蚂蚁万亿级旗舰模型赶超GPT-5

蚂蚁集团开源万亿参数旗舰大模型Ling-1T,属Ling 2.0家族。它激活比例低降低运算成本,训练有“Ling缩放定律”等方法,多项测试超主流模型,不过处理超长上下文成本较高。

AIGC开放社区
开源动态8

代码生成要变天了?被质疑架空后,Yann LeCun携320亿参数开源世界模型“杀回来了”

美国当地时间9月24日,Yann LeCun团队发布320亿参数代码世界模型CWM。它创新训练方式,能模拟代码执行。性能测试表现出色,还开放检查点。Meta AI业务重组,CWM发布或表明未彻底放弃开源。

InfoQ
算法论文8

重磅!DeepSeek R1论文经过同行评议登上Nature封面,梁文锋作为通讯作者再次创造历史

DeepSeek R1论文《DeepSeek - R1 incentivizes reasoning in LLMs through reinforcement learning》登上Nature封面,梁文锋为通讯作者。它是首个经同行评议的有全球影响力的LLM,训练成本低,创新使用‘纯粹强化学习’方法,启发众多研究。

AI寒武纪
开源动态8

字节跳动开源超强USO模型,AI绘图六边形战士来了

在AI图像生成领域,风格和主题驱动的图像生成一直脱节。字节跳动智能创作实验室推出USO模型,构建海量数据集,设计两阶段训练法,引入风格奖励学习范式,化解此难题,且已全面开源。

AIGC开放社区
新闻资讯8

77岁Hinton首度访华,周伯文高能交锋!17分钟尖峰对话震撼全场

7月26日,77岁的AI教父Hinton首度访华,与周伯文教授进行17分钟尖峰对话。Hinton称多模态大模型已有「意识」,建议分技术训练「聪明」与「善良」AI,两人还探讨AI发展路径并寄语青年科研者。

新智元
算法论文8

强化学习的两个「大坑」,终于被两篇ICLR论文给解决了

现有强化学习算法基于理想化交互模式,难应对真实环境。Mila 实验室两篇 ICLR 2025 论文提出实时强化学习框架,分别解决推理延迟和动作缺失问题,还可结合使用,对关键领域意义重大。

机器之心