「后训练策略」共找到 4334 篇相关文章
FaceAge登上「柳叶刀」!AI一张照片看穿你的真实年龄
科学家开发AI工具「FaceAge」,登上《柳叶刀数字健康》。它能通过人脸照片预测癌症患者生物年龄辅助治疗。研究显示,脸显老的患者治疗效果差。不过,它存在训练数据局限,离临床应用还有距离。
Claude Managed Agents 公测发布!Agent 开发成本直降 500 倍
Claude 宣布 Managed Agents 进入公测,可大幅降低 Agent 开发成本。它能自动生成配置和代码,接管多项任务,实现长时间自主运行。多家早期客户使用后效果显著,还介绍了定价、接入方式及与自建的差异。
阿里最新开源王炸Agent!性能全面SOTA!
阿里WebAgent更新频繁,基本一月一版。它是类似DeepResearch的通用智能体,历经WebWalker到WebWatcher多阶段演进,各阶段解决不同问题,如网页导航、自主信息搜集等,还不断优化训练数据生成与处理方式。
盘一盘,2017年Transformer之后,LLM领域的重要论文
本文梳理2017年Transformer后LLM领域重要论文。如提出Transformer架构的论文成现代AI基石;介绍GPT - 3的论文确立‘大模型 + 大数据’缩放定律,引领LLM军备竞赛等。还列举各论文内容与影响。
14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~
有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不可控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经多步骤训练,实验显示其在检索能力和泛化性上表现出色。
谷歌「推理之王」也跑路Meta了,当年还是李飞飞挖来的
谷歌「离职潮」含金量提升,「推理之王」周登勇跳槽Meta。此前Noam Shazeer、John Jumper等也相继离开。谷歌全力「武装」AI Coding突击小队,重构Gemini训练方式,与原世界模型AGI路线冲突。
有嘴就能用电脑的时代来了
作者分享语音输入体验,先自制工具,后用微信输入法,现用豆包输入法。指出语音输入对内容创作者等很重要,介绍豆包输入法优点,还提到语音输入成AI核心场景及使用建议。
Claude code让程序员消失,Anthropic却说用AI编程会让你变傻
Anthropic科学家实验发现,新手过度依赖AI编程,概念理解、代码阅读和调试能力显著退化,效率未提升。研究识别六种AI使用模式,指出主动思考才是技能形成途径,应保留人脑训练的“摩擦力”。
不靠英伟达,中科院在国产 GPU 上跑通 76B 类脑大模型
过去大模型依赖Transformer和NVIDIA GPU体系,硬件自主化难。中科院团队提出类脑大模型SpikingBrain,在超长文本处理上百倍加速,在国产MetaX GPU平台稳定训练76B模型,开辟新道路。
全球首个跨本体、跨视角、多模态物理世界模型,CurrentWorld-0 来了!
Current Robotics 发布跨本体、多模态物理世界模型 CurrentWorld-0,它从真实数据学规律,整合跨本体、多视角和力触预测,可评测机器人,解决动作可控性等问题,让评测成训练数据入口。