数学顶刊」共找到 821 篇相关文章

产品应用8

马斯克挖不动的清华霸,一年造出 “反内卷 AI”!0.027B 参硬刚思维链模型,推理完爆 o3-mini-high

新加坡 Sapient Intelligence 推出小型模型 HRM,参仅 2700 万却能解决复杂推理难题,其不依赖“思维链”,借鉴人类大脑工作方式。该模型准确率超先进思维链模型,推理能力强,具经济性,可提升任务效率。

InfoQ
产品应用8

马斯克挖不动的清华霸,一年造出 “反内卷 AI”!0.27B参硬刚思维链模型,推理完爆o3-mini-high

新加坡Sapient Intelligence推出小参AI模型HRM,能解决复杂推理难题。它受大脑启发,提出“隐性推理”路径,准确率碾压先进思维链模型,推理能力超越o3 - mini - high,经济性突出,任务效率可百倍提升。

AI前线
算法论文7

AI仅凭“自信”会推理,浙大校友复刻DeepSeek长思维链涌现,强化习无需外部奖励信号

UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能会复杂推理。该方法无需外部奖励信号或标注据,用模型自身置信程度作内在奖励信号,在多任务表现良好。

量子位
新闻资讯7

AI游戏创新大赛线下终极对决!世纪华通发起,ChinaJoy见证最终冠军诞生

7月23日,世纪华通发起的“龙杯”全球AI游戏及应用创新大赛在上海举办线下路演。20余款AI作品团队展示创新成果,覆盖多领域。评审严格考评,最终结果8月1日在ChinaJoy揭晓。

量子位
产品应用7

grok 4一图流

文章展示grok 4核心据,涵盖训练成本、模型定价,还列举其在通用、专业、、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。

AI寒武纪
新闻资讯7

拒稿警告,靠大模型「偷摸水论文」被堵死,ICLR最严新规来了

ICLR 2026出台大语言模型使用政策,规范作者与审稿人使用LLM做法,明确需如实披露使用情况并担责,违规将受处罚。其他会如NeurIPS、ICML等也有相关规定。

机器之心
开源动态8

开源AI真人级互动老师,多Agent+可视化画布,函/思维导图实时作图!

本文介绍开源项目ChatTutor,它是可视化互动式AI老师,能边说边画。有画布、思维导图等功能,未来将支持代码、物理等画布,可用于解题、备课等,已上线chattutor.app。

开源星探
推荐文章7

从局部最优到全局跃迁:关于企业“智慧运营中枢”模式的构建与实践思考

文章阐述企业智化转型历程,指出转型中战略脱节、业技融合难等问题,介绍以企业架构为核心构建的“智慧运营中枢”模式,主张用大模型重塑业务价值链,强调转型是长期变革。

InfoQ
开源动态7

走出 MMLU 的高分幻觉:AI Agent 的「斯坦利时刻」与职场生存法则

文章指出多模态大模型在基准测试分高,在实际业务流程却像‘职场巨婴’。研究团队构建Trainee - Bench测试尖模型,结果显示模型离‘独立上岗’远,凸显提升Agent自主习性的重要性。

AI科技评论
开源动态8

小模型推理极限在哪里?微博开源3B小模型,比肩级闭源

微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在竞赛、编程等可验证推理基准上表现优异,成绩直逼尖大模型。其训练流程层层叠加,还提出参压缩 - 覆盖假说。

AIGC开放社区