后训练阶段」共找到 4141 篇相关文章

算法论文8

14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~

有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不可控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经多步骤训练,实验显示其在检索能力和泛化性上表现出色。

PaperAgent
新闻资讯7

终于!Linux用户等来了官方ChatGPT桌面版

今日凌晨,OpenAI 宣布适用于 Linux 的 ChatGPT 桌面应用进入预览阶段。此前其原生 AI 能力在 Linux 长期缺位。用户可在特定 Linux 发行版中用三件套处理工作,虽兼容有限也是好开端。

机器之心
新闻资讯7

谷歌「推理之王」也跑路Meta了,当年还是李飞飞挖来的

谷歌「离职潮」含金量提升,「推理之王」周登勇跳槽Meta。此前Noam Shazeer、John Jumper等也相继离开。谷歌全力「武装」AI Coding突击小队,重构Gemini训练方式,与原世界模型AGI路线冲突。

量子位
产品应用7

有嘴就能用电脑的时代来了

作者分享语音输入体验,先自制工具,用微信输入法,现用豆包输入法。指出语音输入对内容创作者等很重要,介绍豆包输入法优点,还提到语音输入成AI核心场景及使用建议。

刘言飞语
推荐文章8

Claude code让程序员消失,Anthropic却说用AI编程会让你变傻

Anthropic科学家实验发现,新手过度依赖AI编程,概念理解、代码阅读和调试能力显著退化,效率未提升。研究识别六种AI使用模式,指出主动思考才是技能形成途径,应保留人脑训练的“摩擦力”。

AIGC开放社区
算法论文8

DeepSeek又又又又发新论文了!这一次,他们重构了AI看图的方式

DeepSeek发布论文DeepSeek - OCR 2,指出传统AI看图方式有误,提出视觉因果流概念。其两阶段级联推理解法效果显著,还可能整合进即将发布的DeepSeek V4,有望实现原生多模态。

花叔
算法论文8

不靠英伟达,中科院在国产 GPU 上跑通 76B 类脑大模型

过去大模型依赖Transformer和NVIDIA GPU体系,硬件自主化难。中科院团队提出类脑大模型SpikingBrain,在超长文本处理上百倍加速,在国产MetaX GPU平台稳定训练76B模型,开辟新道路。

AI科技评论
产品应用7

全球首个跨本体、跨视角、多模态物理世界模型,CurrentWorld-0 来了!

Current Robotics 发布跨本体、多模态物理世界模型 CurrentWorld-0,它从真实数据学规律,整合跨本体、多视角和力触预测,可评测机器人,解决动作可控性等问题,让评测成训练数据入口。

机器之心
推荐文章7

芯片初创公司的斩杀线

IC设计语境里,初创公司存在“斩杀线”,可分为生死线和温饱线。若公司在这些阶段出问题,创始人命运或受影响,对赌协议会形成个人“三条生死线”,创业团队需设防火墙。

芯师爷
算法论文8

扩展外部测试时Scaling Law,中关村学院新发现:轻量级验证器可解锁LLM推理最优选择

文章聚焦大语言模型‘测试时扩展’,指出内部方法接近瓶颈,外部方法的传统实现有缺陷。提出 TrajSelector 策略,用轻量级打分模型复用隐状态打分,训练无需手动标注,实验显示性能增长稳定。

机器之心