「爱学」共找到 446 篇相关文章
少说‘Wait’,多做题:NoWait重塑大模型推理路径
现代大模型在复杂推理时爱用自我反思词,触发冗余验证循环,拖慢速度、增加算力消耗。NoWait方法零训练成本,通过抓关键词、扩展变体、实时屏蔽,让模型跳过废话,在多任务中表现出色,且颠覆对推理的认知。
沉迷贪吃蛇,7B小模型竟变身「数学天才」!几何推理碾压GPT-4o
NVIDIA等团队提出视觉游戏学习ViGaL范式,让7B多模态模型玩贪吃蛇等游戏,使其在数学、几何等任务击败GPT - 4o。游戏培养通用认知与推理能力,不同游戏提升不同推理能力,多游戏训练效果更佳。
PPO-Clip的「盲点」被补齐了?快手提出熵比裁剪方法,从局部约束到全局稳定的关键一跃
快手科技语言大模型团队提出熵比裁剪(ERC)方法,应对强化学习中信任域偏离问题。该方法从全局视角稳定策略分布,在多个数学推理基准实验中提升了模型性能,还与多种方法对比验证了泛化能力。
腾讯AI Lab首创RL框架Parallel-R1,教大模型学会「并行思维」
腾讯AI Lab等机构研究者首创Parallel - R1框架,通过强化学习让大模型掌握并行思维。它解决了RL训练的冷启动和奖励设计难题,在多数学基准上提升准确率,还揭示模型思维策略变化及并行思维的‘脚手架’作用。
AI上清北,普通人该怎么办?|甲子光年
2025年AI模拟高考成绩达清北线,引发对人类努力意义的思考。三位嘉宾围绕AI能力进步、与人类能力差异、对教育和创作的影响等展开对谈,探讨人类在AI时代的定位、专业选择、教育变革等问题。
618想换电脑跑AI?先听我一句劝。
文章围绕618换电脑跑AI展开,分析了本地跑AI的情况,包括不同模型对算力和显存的要求,指出本地跑的好处是隐私安全、无限免费,还推荐了不同预算的笔记本,为想换电脑学AI的人提供参考。
GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷
Epoch AI和曼彻斯特大学发布FME基准测试论文,让68道未解数学难题成5个顶级AI的考场。GPT - 6 Astra成唯一得分非0分模型,放宽预算共解开5道,其余4个AI全交白卷。该测试是对陶哲轩批评的回应。
AI首次拿下IMO官方满分金牌,背后藏着一套自我纠错机制
在第67届国际数学奥林匹克(IMO 2026)上,小红书的「dots-note-3.0」成为首个获官方满分金牌的AI模型。它解题时自我检查修正,有自主探索能力。之后模型要应对生活中长周期、多变任务的挑战。
Soul APP 开源首个 14B 实时数字人!0.87秒延迟+32fps,冲进 I2V 趋势榜 TOP5!
AI圈对数字人爱恨交加,因其存在太假、太慢、太僵硬等问题。Soul App旗下AI团队开源实时数字人生成模型SoulX - FlashTalk,参数量14B,有亚秒级延迟、高帧率等亮点,冲进HuggingFace I2V趋势榜TOP5。
突破125年世纪难题!北大校友联手科大少年班才子破解希尔伯特第六问题
1900年希尔伯特提出23个数学难题,其中第六个‘物理学的公理化’被称为数学物理的终极挑战。125年后,北大校友邓煜、中科大少年班马骁与陶哲轩高徒扎赫尔・哈尼在该问题上取得重大突破,填补了牛顿力学与玻尔兹曼方程间的逻辑鸿沟。