后训练课程」共找到 3824 篇相关文章

开源动态8

103K「硬核」题,让大模型突破数学推理瓶颈

现有大语言模型在数学推理训练时面临数据瓶颈,腾讯AI Lab与上海交大团队推出DeepMath - 103K数据集。它规模大、难度高、数据新颖、严格去污染,让DeepMath系列模型达SOTA,还能实现推理泛化。

机器之心
新闻资讯7

冲击自回归,扩散模型正在改写下一代通用模型范式

Google I/O 2025 开发者大会上,Gemini Diffusion 引发关注,它是采用扩散模型的语言模型。此前已有团队探索扩散式 LLM,如斯坦福、上海 AI 实验室等。蚂蚁集团和人大推出 LLaDA,发展出多模态模型,国内团队跻身前列。

机器之心
新闻资讯8

一周两破18年数学纪录!陶哲轩惊叹:AlphaEvolve带来久违「加速度」

人类数学家与AlphaEvolve携手,一周内两次刷新18年未破的数学纪录。先是AlphaEvolve将和差集的θ下界提升,人类数学家Gerbicz在其基础上再进一步,展现AI与人类协作在数学研究中的惊人潜力。

新智元
新闻资讯7

刚刚,北大校友Lilian Weng自曝公司首个产品?一篇论文未发,估值却已90亿

OpenAI前安全副总裁Lilian Weng疑似曝光90亿估值新公司Thinking Machines首个产品——手动调参仪表盘,训练中可手动调超参数。OpenAI也有AI硬件野心,设想让ChatGPT成全能硬件助手。

新智元
推荐文章7

别学提示词,学逻辑

作者黄益贺认为别学提示词、别买相关课程,因其本质是通用沟通技巧,靠逻辑和方法论。还提到提示词上层是针对模型优化,但普通用户做好底层就行,靠提示词收割流量挺无聊。

newtype AI
算法论文8

「边思考、边搜索、边写作」WebThinker开启AI搜索&研究新纪元!

大型推理模型有推理能力,但静态知识限制其在复杂任务表现。WebThinker 让 LRM 推理中自主搜索、导航及写报告,集成探索器,有自主策略和训练工具,实验显示性能强,还指明未来探索方向。

机器之心
新闻资讯7

Axiom Math 对谈 SGLang:模型的下一步是可验证,结果层才是真正的护城河

在AGI Playground 2026圆桌论坛,Axiom Math联合创始人等探讨AI核心问题。提到AI进入生产环境,可验证或成瓶颈,还从长任务智能体、推理基建等多方面深入交流,如模型验证、基建优化等。

Founder Park
新闻资讯7

脑机接口迈入医疗器械时代:临床、支付与商业化的三道门|甲子引力X

今年脑机接口获首张侵入式三类医疗器械注册证,行业关注点转变。在「甲子引力X」圆桌对话中,六位投资人围绕临床、支付、商业化展开探讨,分享对不同场景的看法及对脑机接口走进生活的畅想。

甲子光年
产品应用7

全网实测开玩Fable 5.1,听说写作说话和真人没区别?

Anthropic发布Fable 5.1,第三方跑分和个人实测出炉。ARC Prize测试成绩佳且成本降32%,网友用它做出多款游戏。科技媒体Every全面测评,指出其多方面优势与设计等短板,并给出使用边界。

量子位
开源动态8

一款永远不睡觉的 AI Agent 微框架:它会自己琢磨事儿,干完主动来找你汇报!

Laude Institute的AI Agent Audel在无指令下自动修复bug,背是开源的AI Agent微框架Headlong。它与其他Agent不同,其Agent永远不睡觉,核心由9800行Bash脚本构成,安装简单,提出AI主体性问题。

开源星探