预训练研究」共找到 3718 篇相关文章

算法论文8

为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通大学

上海交通大学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态大模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。

量子位
开源动态8

Nanbeige4.2-3B:探索通用Agent小模型

在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。

AIGC开放社区
算法论文8

让大模型学会「自己教自己」!京东&中科院信工所连发三篇论文定义Self-Taught RLVR

京东和中科院信工所开展Self - Taught RLVR系列研究,连发三篇论文。从RLSD、NPO、CoPD三个维度探索让大模型自我指导。如RLSD解决信息泄漏,NPO引入有效学习信号,CoPD整合多专家能力,各有创新与良好效果。

量子位
新闻资讯7

马斯克最大算力中心建成了:全球首个GW级超算集群,再创世界纪录

全球首个GW级超算集群Colossus 2正式投入运行,马斯克称其4月将升级至1.5GW。这为Grok 5训练提供强大算力。但美国部分地区因数据中心电力需求激增,或在用电高峰对居民轮流停电。

量子位
产品应用8

上帝视角!DeepMind提前5天锁定Melissa,强度报不再靠天

飓风Melissa来临前,DeepMind算法提前5天言其强度变化。该模型用两类数据训练,能生成多种未来场景,在路径和强度测上优于传统模型,已被NHC投入实战,但AI不能理解灾难,人类仍需做决策。

新智元
新闻资讯7

新世界首富:斥巨资求永生,TikTok收购案最可能买家,得OpenAI千亿订单

81岁的拉里·埃里森上周凭借OpenAI千亿订单成新世界首富。他创立甲骨文,怼大佬、爱极限运动、捐钱研究永生。甲骨文与OpenAI签五年3000亿美元合同,股价一度飙升,他还可能买TikTok,儿子想并购好莱坞巨头。

新智元
新闻资讯7

扎克伯格看OpenAI直播挖人,北大校友孙之清加入Meta

本周五,前OpenAI研究科学家Hyung Won Chung晒照,显示他、孙之清与Jason Wei已加入Meta新成立的超级智能实验室。孙之清曾是ChatGPT Agent核心开发者,还和山姆・奥特曼直播发布该产品,一个月后跳槽。

机器之心
开源动态8

32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理小模型 AM-Thinking-v1

2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索小体量实现大能力路径。

AI科技评论
新闻资讯8

为什么AI大厂的人,都跑去做生命科学了?

越来越多AI人才投身生命科学,创办数十亿美元估值公司。这是因训练通用模型门槛高,而生命科学技术可迁移、产业愿付费且有成功先例。新一代公司AI位置、融资、技术目标有变化,但仍面临数据和临床验证问题。

DeepTech深科技
产品应用7

【翻译】在 Codex 中使用 Goals:长时间工作的持久目标

文章介绍 Codex 中的 Goals,它是持久目标,能让线程跨多轮对话朝明确结果推进。阐述了 Goals 与普通 prompts 的区别、编写方法、活跃后的变化、设计方式及适用场景等,还通过案例展示其在研究任务中的应用。

GiantPandaLLM