「数学竞赛」共找到 512 篇相关文章
Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃
大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。
仅用提示词工程摘下IMO金牌!清华校友强强联手新发现,学术界不靠砸钱也能比肩大厂
清华校友杨林和黄溢辰,仅用提示词设计和自我迭代验证流程,让基础模型Gemini 2.5 Pro达到IMO金牌水平。他们设计的流程分六个步骤,用差异化提示词,最终为5道题生成严谨解答。
MiniMax 技术闭门会分享:长上下文是 Agent 的 Game Changer
MiniMax 7月10日举办M1技术研讨会,探讨模型架构创新等领域。会议围绕RL能否赋予模型新能力、预训练价值等展开,指出长上下文是Agent的Game changer,混合架构将成主流,还分享了混合架构推理实践及M1相关问答。
刚刚,扎克伯格宣布成立Meta超级智能新实验室
Meta宣布进入超级智能赛道,扎克伯格成立Meta超级智能实验室,任命前Scale AI CEO为首席AI官。MSL整合多团队,Meta还投资Scale AI,为抢人才不惜重金,新团队成员来自顶尖实验室,Meta有独特优势。
实证:现在的LLM根本不会Reasoning!
论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。
刚刚,Bengio官宣创业!急筹3000万专治AI欺骗人类,图灵三巨头全下场
图灵奖得主Yoshua Bengio官宣创办非营利机构LawZero,致力于研发「设计即安全」的AI系统,以应对AI军备竞赛风险。其研发的「Scientist AI」不具行动性,目标是理解世界,防止人类陷入AI风险。
刚刚,OpenAI新Transformer火了!Astra架构首次曝光
OpenAI下一代Astra采用「循环深度」推理方法,思考Token减少但性能提升,不过其思考过程难监控。此前业界已对「循环Transformer」有研究,该架构适合数学编程任务,Astra实力获验证,GPT - 6或即将发布。
百年黎曼猜想被Claude破了新纪录!是个未公开新模型
A社官宣未公开的Claude研究模型在黎曼猜想取得重大进展,将满足猜想的黎曼ζ函数零点比例下界从41.6%提高到67.2%。它靠60个智能体、3100万输出Token完成研究,几乎走完科研流程。
字节Seedance,正在占领好莱坞
字节Seedance从被好莱坞排斥到被认可,进入创作者圈与工作流,用于拍电影长片。它成本低且有免费福利,吸引独立电影人。在AI视频模型竞赛中逼近美国对手,影视业对AI投入将上涨。
从“被 AI 取代”到“用 AI 重构组织”,奇点智能产品大会聚焦产品、组织与商业重塑这些真问题
7月17 - 18日,CSDN与奇点智能研究院联合举办「2026奇点智能产品大会」,围绕十二大专题展开。主会场跳出模型竞赛,多位行业大咖将分享见解、深度讨论,还准备了AI产品落地资料包。