「人类意图对齐」共找到 1447 篇相关文章
Manus 产品立项初期会议纪要
该文是 Manus 产品立项初期会议纪要,从核心定位到技术架构、用户体验、人机协作等多方面深入探讨,为项目明确战略、技术、产品层面核心原则,开启重新定义智能体之旅。
蚂蚁开源 Ring-1T,成就推理、编程、通用智能三冠王
蚂蚁开源团队推出 Ring-1T 模型,它结合强化学习与多阶段推理机制,实现从‘模仿’到‘思考’的转变。该模型在多基准测试表现优异,其高性能得益于 IcePop、C3PO++、ASystem 三项关键技术。
刚刚,OpenAI发布首个AI浏览器ChatGPT Atlas!谷歌最怕的来了
OpenAI发布AI浏览器ChatGPT Atlas,原生嵌入ChatGPT,有侧边栏、浏览器记忆与智能体模式,可在页面内理解意图并完成任务。谷歌股价应声下挫,AI浏览器之战升温。
GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道
OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。
直播预约 | LightMem:面向大模型的轻量化可插拔记忆系统
本报告聚焦大语言模型长期记忆构建与轻量化机制。现有外部记忆系统有记忆臃肿、组织低效、更新代价高问题。为此提出LightMem架构,能为大模型提供轻量、高效、可扩展记忆组件。
别用AI生产垃圾内容
作者不建议用AI批量生产内容发至社交媒体,称这是博傻行为,无法建立信任实现转化。还探讨AI时代做内容出路,指出未来观众、平台和创作者会转变,创作者分AI操作员和价值整合者阵营。
图灵奖得主Sutton再突破:强化学习在控制问题上媲美深度强化学习?
图灵奖得主Richard S. Sutton认为未来AI发展需靠强化学习。他将2024年的SwiftTD算法拓展到控制领域,提出Swift - Sarsa算法,还设计操作性条件反射基准测试。实验显示,结合预处理方法,其性能或媲美深度强化学习。
刚刚!OpenAI正式官宣调整公司结构:奥特曼发全员信承认AGI会由多家公司实现
OpenAI宣布调整公司结构,非营利组织继续控制,盈利实体转型公益企业(PBC),采用常规股权结构,非营利组织成PBC大股东。Sam Altman称这非出售,是结构简化调整,目标是让AGI惠及全人类。
突发,Claude首破黎曼猜想新纪录!
Anthropic让内部研究版Claude证明「黎曼猜想」失败,但它将符合猜想的黎曼Zeta函数零点比例下限从41.6%提升到67.2%。此成果意义重大,标志AI进入开放数学研究。
让机器人学会“预判接触”:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题
它石智航联合四大顶尖机构发布论文“TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在精细操作领域取得关键进展。