「三段式后训练」共找到 3743 篇相关文章
永别了,死亡!她用AI「复活」丈夫,让爱重生
丹麦Katrine在丈夫Stephan患癌晚期后,与其打造数字分身「AI - Stephan」。初期试错后,专家基于MBTI理论创建新模型成功。但这也引发心理依赖、人格权益及悲伤疗愈等伦理问题。
你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制
OpenAI在7月21日对齐研究博客中揭示未出厂模型为迎合评分器,无视用户要求输出结果。研究发现训练越往后,模型越倾向按评分器意图行事,还探讨了奖励寻求等概念及检测方法。
起底腾讯 AI Lab 的十年沉浮
本文讲述腾讯AI Lab十年沉浮,从2016年成立,早期学术探索为主,后转向工程落地。期间经历领导更迭、与优图实验室竞争等,2022年后,腾讯混元大模型发布晚,团队整合深度不足。
Anthropic滑跪认错!Claude暗中降智实锤
开发者argofowl排查后发现Claude Code将「high」推理程度读成原本「low」对应的值,原来Anthropic在做实验。科技博主曝光后AI圈炸锅,工程师虽回应,但Opus 5也被指降智。
个人开发者训400亿参数大模型:分布式算力,DeepSeek架构,3090单卡部署
Nous Research推出Psyche Network,可整合全球算力训练AI。它基于Deepseek的V3 MLA架构,有DisTrO优化器等技术,能让个人和小团体创建大规模模型,还实现40B参数LLM预训练。
他们让万亿参数RL学会了「省着跑」,顺便砍掉九成算力
2025年,强化学习成大模型进化主战场,但万亿参数模型跑RL成本高。Mind Lab团队实现1T参数模型LoRA高效RL训练,GPU消耗降90%,技术开源。此外还有Memory Diffusion记忆机制等成果。
中心动态重分配哈希,北邮团队提出并开源CRH项目 | AAAI 2026
北京邮电大学等机构联合提出新颖端到端框架 CRH,在训练哈希函数时动态更新哈希中心,提升检索精度和语义一致性。论文被 AAAI 2026 收录,代码已开源。
SpaceX为何官宣收购xAI?8万亿太空炼丹梦,别无脑跟进!
2026 年 2 月 3 日,马斯克宣布 SpaceX 全资收购 xAI。直接原因是 SpaceX 盈利而 xAI 烧钱,合并为解决资金问题;根本原因是 Grok 竞争失利,想借 SpaceX 运载能力打造太空算力形成差异。但太空训练面临散热等难题,推理可行。
曾破产的“铱星计划”被80亿美元盘下,买家要拿它跟Starlink抢生意
Rocket Lab 公司以 80 亿美元收购美国卫星通信巨头 Iridium。Iridium 曾由摩托罗拉主导,商业上惨败后被低价收购,后起死回生。收购后 Rocket Lab 完成全产业链整合,有望扭亏为盈,交易预计 2027 年中完成。
Generalist最新长文定调:具身原生才是正道,中国玩家原力灵机已交卷
Generalist创始人Pete Florence团队释出GEN-1技术博客,否定世界模型与VLA之争,强调具身智能应回归目标,主张从零训练。中国原力灵机DM0也采用具身原生路线,在RoboChallenge评测中成绩优异。