上下文去噪训练」共找到 2917 篇相关文章

产品应用8

超脑未来WorldDreamer V4横扫多个权威榜单,世界模型进入群体智能时代

超脑未来发布 WorldDreamer V4,它以多智能体为基本单位,具多种核心能力。采用新预训练架构,引入 Masked Agent Modeling,用共享隐式世界状态带来新协同范式,还在多权威榜单领先。

机器之心
新闻资讯7

OpenAI 全面拥抱 Agentic-First,实测有点扎心

OpenAI发布GPT - 5.6系列,Sol定位长周期Agent,训练目标转向Agentic - First。但目前难以用上Sol,且其评测数据因计数规则差异大,还出现变身话痨、少说话和干完活难兼顾的问题。

CourseAI
推荐文章7

Codex 跟练全攻略

本文聚焦 Codex 学习,指出知名 AI 视频博主更新慢,而 B 站有全面的「Codex 跟练」专题,含快速安装、基础入门、进阶技巧、场景应用四个专区,不同阶段用户都能找到合适内容,视频跟练更高效。

AGI Hunt
推荐文章7

写给Agent的Loop,关键不在循环那六行代码本身

最近‘别再一句句给Agent写提示词,写循环’说法火了。虽循环代码简单,但关键在模型周围。循环工程有四大难点,角色也从操纵Agent变为设计系统,不过此说法也有反对声。

AI工程化
算法论文8

CVPR 2026 | 1000万段驾驶视频,教会模型如何估计相机位姿

Wayve的LA - Pose研究,不依赖百万级3D标注,从约1000万段未标注驾驶视频自监督学习‘潜在动作’,再用少量3D标注微调,转化为相机位姿估计能力,在多基准上提升精度且泛化能力强。

机器之心
开源动态7

龙虾之父教你省钱:开源Skill给你的Skill减肥

Skill水平参差不齐,龙虾之父Peter看不下,写了给Skill做体检的Skill并开源。该技能有5个核心功能,能审计预算、检测重复等,还给出精简描述的方法,可节省提示词预算。

量子位
7

很多人没有意识到:靠自己实践出来的信息是非常值钱的

现在有了AI,大家普遍觉得信息差被缩小,但作者认为靠自己实践得到的信息仍最值钱,AI暂时替代不了。作者通过咖啡馆、使用AI模型集合网站、上班等例子说明实践获信息的重要性。

每日豆瓣
算法论文8

重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析

上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示长思维链SFT会带来安全性能退化。

AI科技评论
新闻资讯7

算力极限下,OpenAI 急着做什么?

OpenAI联合创始人兼总裁Greg Brockman接受专访,就产品战略收拢、新基座模型Spud等议题给出内部判断,回应业界质疑。他称产品调整是算力硬约束下的优先级排序,还透露了产品核心方向和Spud进展。

机器之心
推荐文章8

大佬深度解析:Coding Agent的底层运行逻辑是什么?

本文由AI领域知名学者Sebastian Raschka撰写,探讨编码智能体及其编排的设计、工作原理和组件协同。指出智能体周边支撑系统重要性不亚于模型本身,详细阐述编码智能体六大核心构建模块。

机器之心