「后训练方案」共找到 4421 篇相关文章
ICLR 2026 Oral | 告别多步去噪!清华团队推出MVP,实现机器人动作单步极速生成
清华大学智能驾驶课题组 iDLab 与加州大学伯克利分校人工智能研究院 BAIR联合发表研究,提出 MVP 策略。它引入瞬时速度约束解决均值流学习问题,设计复合生成与选择机制,在多任务测试中表现出色。
彻底告别VE与VAE!商汤硬核重构多模态:砍掉所有中间编码器
商汤科技联合南洋理工大学发布NEO - unify,这是“原生、统一、端到端”多模态模型架构,砍掉VE和VAE,用混合变换器架构打通视觉与语言能力,提升数据与算力利用效率,为跨模态智能系统奠基。
Meta|提出RECAP,通过动态目标重加权回放,解决RLVR遗忘【文末送书!Agent相关】
近年来,可验证奖励强化学习(RLVR)提升了大模型在多任务上的性能,但带来“能力退化”问题。Meta等提出RECAP策略,结合“回放”与“动态目标重加权”,保持模型通用能力,提升推理性能,还提高推理效率。
Vector数据库退位,AI记忆Memvid登场!
近期基于视频的AI记忆库Memvid大火,宣称革新AI记忆管理,能将文本片段存于MP4实现快速语义搜索。不过网友分析,它底层用FAISS,读写慢、文件大,仓库issues也显示其性能与声称相反。
专访高同学:央美毕业生已经在用扣子做毕设了
文章聚焦央美高伟翔同学用扣子平台完成毕设——荒诞商品生成器。该作品借助AI将情绪转化为荒诞商品,灵感源于淘宝荒诞商品,旨在反思消费主义,反响不错。高同学还分享了选择扣子的原因及创作困难。
网友晒 21 页 PDF 质疑 Grok 3 套壳 Claude,Grok 3 自己承认了!xAI 工程师被喷无能
网友 GpsTracker 爆料,埃隆·马斯克旗下 xAI 公司的 Grok 3 模型在“思考模式”下自称是竞争对手 Anthropic 公司的 Claude 3.5。网友提供对话记录和 21 页 PDF 佐证,引发社区对模型异常原因的讨论。
刚刚,OpenAI最强编程智能体上线ChatGPT
OpenAI宣布在ChatGPT中引入Codex研究预览版。它是云端软件工程智能体,能并行处理多项编程任务。自今日起,部分用户可使用,后续将推付费选项。目前处于早期开发阶段,未来计划推更灵活工作流。
给Agent加上知识图谱,开源版Palantir
Semantica是LLM、向量库与Agent框架下的语义/上下文层,能把碎片化企业数据变成结构化、可查询的上下文图与知识图谱。介绍了其面向对象、功能、优势、使用方法、架构等内容。
全球首例!科学家将腿部肌肉线粒体注入盲人眼球,瞳孔光反射短暂恢复
对于视神经严重受损致盲,临床缺有效修复手段。美国研究人员从失明女性腿部肌肉提取线粒体注入其双眼,初步验证了自体线粒体眼内移植的安全性,患者眼部有生理变化,但未恢复视力,实验疑问多。
用AI复制人脑可行!MIT论文估算500亿美元、10到25年可实现
美国麻省理工学院研究生艾萨克·弗里曼团队论文指出,大脑仿真正从梦想变为可量化工程问题。关键技术加速发展,成本降低、算力接近需求,未来或可用于医疗等领域。