「两阶段后训练方法」共找到 3664 篇相关文章
终于!Linux用户等来了官方ChatGPT桌面版
今日凌晨,OpenAI 宣布适用于 Linux 的 ChatGPT 桌面应用进入预览阶段。此前其原生 AI 能力在 Linux 长期缺位。用户可在特定 Linux 发行版中用三件套处理工作,虽兼容有限也是好开端。
谷歌「推理之王」也跑路Meta了,当年还是李飞飞挖来的
谷歌「离职潮」含金量提升,「推理之王」周登勇跳槽Meta。此前Noam Shazeer、John Jumper等也相继离开。谷歌全力「武装」AI Coding突击小队,重构Gemini训练方式,与原世界模型AGI路线冲突。
Claude code让程序员消失,Anthropic却说用AI编程会让你变傻
Anthropic科学家实验发现,新手过度依赖AI编程,概念理解、代码阅读和调试能力显著退化,效率未提升。研究识别六种AI使用模式,指出主动思考才是技能形成途径,应保留人脑训练的“摩擦力”。
DeepSeek又又又又发新论文了!这一次,他们重构了AI看图的方式
DeepSeek发布论文DeepSeek - OCR 2,指出传统AI看图方式有误,提出视觉因果流概念。其两阶段级联推理解法效果显著,还可能整合进即将发布的DeepSeek V4,有望实现原生多模态。
2篇最新论文,把Deep Research讲透了~
阿里开源Tongyi DeepResearch热度高,文章分享两篇相关技术综述。介绍Deep Research是代理研究新范式,阐述其四大核心模块、优化方法、数据处理、奖励机制,还提及开源系统亮点及相关论文。
不靠英伟达,中科院在国产 GPU 上跑通 76B 类脑大模型
过去大模型依赖Transformer和NVIDIA GPU体系,硬件自主化难。中科院团队提出类脑大模型SpikingBrain,在超长文本处理上百倍加速,在国产MetaX GPU平台稳定训练76B模型,开辟新道路。
智能流体力学青年学者论坛第二十六、二十七讲 | 国防科技大学陈新海、北京航空航天大学张天汉
智能流体力学青年学者论坛第二十六、二十七讲分别由国防科技大学陈新海、北京航空航天大学张天汉开讲。陈新海介绍智能网格生成研究进展,搭建科学计算智能体平台;张天汉提出ChatCFD方法,提升CFD可及性。
全球首个跨本体、跨视角、多模态物理世界模型,CurrentWorld-0 来了!
Current Robotics 发布跨本体、多模态物理世界模型 CurrentWorld-0,它从真实数据学规律,整合跨本体、多视角和力触预测,可评测机器人,解决动作可控性等问题,让评测成训练数据入口。
解读Qwen3文本嵌入与重排序技术版图
文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。
Claude团队大揭秘!如何调动多智能体搞深度搜索
Claude团队分享用多智能体构建深度搜索的心得,展示有效多智能体研究系统架构,涵盖系统架构、提示工程、评估方法等内容,还提及系统面临的问题、挑战及额外建议。