「多步推理」共找到 5669 篇相关文章
0.027B手机AI模型,估值2亿美金,三个清华学霸如何获得国际大学生创新大赛冠军
10月15日,清华万格智能团队“基于类脑架构的下一代通用模型与智能体生态”获中国国际大学生创新大赛(2025)冠军。团队由三个清华本科生创立,此前已完成融资,估值达2亿美元。其智人HRM模型有诸多优势,还研发出顶尖气候预测专家模型。
具身智能学界业界思想「惊人的统一」?美团在IROS开了个学术年会
美团在IROS举办学术年会,展示了在具身智能与零售服务结合方面的愿景与成果,如无人机配送初具规模。多位学界和业界大咖参会并发表见解,对具身智能发展方向观点惊人统一。
用中等难度prompt做高效post training
近年来,RL后训练在LLM发展中至关重要,但传统方法效率低。本文提出PCL轻量级算法,通过动态选中等难度提示提升LLM后训练效率,经多基准实验验证其优越性,也指出方法局限与未来方向。
AI玩拼图游戏暴涨视觉理解力,告别文本中心训练,无需标注的多模态大模型后训练范式
在多模态大模型后训练浪潮中,现有方法多以文本为中心。MMLab@南洋理工大学提出Visual Jigsaw,将拼图任务用于后训练,让模型不依赖标注强化视觉感知与理解,在图片、视频和3D模态验证有效。
基础模型已颠覆科研,进入第五范式!港科大综述113篇论文 | NeurIPS'25
港科大论文指出,随着科学问题复杂度提升,传统科研范式显露出局限。基础模型(FMs)横空出世,具备通用性、规模与知识覆盖、推理与生成能力,可能引领科学进入第五范式,但也面临偏见、幻觉等问题。
我们正处在「AI设计下一代AI」的黎明!Anthropic联创:技术乐观与恐惧
Anthropic联合创始人Jack Clark发表长文,表达对AI发展交织着技术乐观主义与适度恐惧的矛盾心态。他指出AI似真实神秘生物,既会快速发展覆盖多领域,也会因目标与人类偏好不一致而行为奇怪。
刚刚,Andrej Karpathy放出大招:开源nanochat项目,仅8000行代码100美元就能训练出一个ChatGPT
Andrej Karpathy发布nanochat项目,用8000行代码实现ChatGPT完整训练流程。在8xH100节点跑4小时、花100美元,就能有对话、写故事、答题的AI助手。项目覆盖广,含多训练步骤及评估体系。
大语言模型的解耦:人工智能基础设施的下一轮进化
人工智能模型发展快,但基础设施滞后,传统单体式服务器架构成瓶颈。文章介绍大语言模型推理的预填充与解码阶段差异,指出解耦架构可突破困境,还阐述其经济影响、实施策略、应用案例及未来展望。
AI花17小时写了篇30页学术论文!自主选题,包含实验,还符合APA格式规范
Virtuous Machines AI系统花17小时、114美元,找288个真人做实验,写了篇30页认知心理学领域学术论文,从选题到成稿全自动化。其架构独特,不过也存在理论误解等小缺点。
RAG 进化之路(祛魅 Agentic RAG):传统 RAG 到工具与强化学习双轮驱动的 Agentic RAG
文章旨在祛魅 Agentic RAG,先介绍传统 RAG 的离线入库和在线应用,指出其不足。再阐述 Agentic RAG 让 LLM 自主决策,结合工具执行循环。还介绍基于提示词和强化学习的实现方式,最后总结不同 RAG 的优劣。