自监督学习」共找到 2384 篇相关文章

新闻资讯8

图灵奖得主Bengio再创业:启动资金就筹集了3000万美元

图灵奖得主Yoshua Bengio官宣再创业,成立非营利组织LawZero构建下一代AI系统,不做Agent。已筹3000万美元启动资金,要做“设计即安全”的AI,以监督Agent,将安全性置于商业利益之上。

量子位
算法论文7

LSTM之父22年前构想将成真?一周内AI「我进化」论文集中发布,新趋势涌现?

本文介绍AI模型我进化方向的进展,涉及多机构的相关论文。如受“哥德尔机”启发的“达尔文哥德尔机”可我改进;还有“我奖励训练”“MM - UPT”“UI - Genie”等方法,展现AI我进化潜力。

机器之心
开源动态8

Agent 框架热潮褪去,大模型开发已经进入“生死局”?

蚂蚁开源发布《2025 ⼤模型开源开发⽣态全景与趋势》报告,涵盖 19 个技术领域 135 个项目,解读七大趋势。当下大模型开发生态如黑客松,项目兴衰快速,AI Search 式微、AI Coding 火热,三大技术领域也有变化。

AI前线
新闻资讯7

Claude 4如何思考?资深研究员回应:RLHF范式已过,RLVR已在编程/数学得到验证

Anthropic两位研究员在博客采访中透露Claude 4思考细节。提到可验证奖励强化学习RLVR在编程和数学领域获证明,探讨了RL扩展、模型我意识等,还为大学生给出AI领域建议。

量子位
算法论文8

纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究

剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。

量子位
算法论文8

ICML 2025 | 注意力机制中的极大值:破解大语言模型上下文理解的关键

ICML 2025新研究揭示,在使用RoPE的现代Transformer模型里,注意力机制Q和K表示有集中极大值,V表示无此模式。研究通过实验明确极大值与上下文知识理解的联系,对模型设计、优化和量化有重要启示。

深度学习自然语言处理
新闻资讯7

随着 AI 内存需求推高非 AI 基础设施价格,OVHcloud 将上调服务价格

OVHcloud 将于秋季上调多数服务价格,主因是 2025 年年中起内存与存储组件成本大幅攀升,创始人 Octave Klaba 认为是 AI 算力建设热潮挤占了普通服务器核心组件的晶圆制造产能。

InfoQ
推荐文章7

如果你的大学不提供 Token,应该立即退学

本文站在学生角度探讨 AI 时代大学生学习问题。认为高校在 AI 教育上滞后,不提供 Token 不合理。强调学生应善用 AI,具备问题意识、判断力和品味,还给出了使用 AI 的具体建议。

特工宇宙
产品应用8

RoboScience 机器科学发布轮式仿人形通用机器人 REX G1,让机器人真正成为新一代具身生产力伙伴

8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1,定位“新一代具身智能生产力伙伴”。它搭载研VLOA架构通用具身大模型Visics,适用于多场景,推动机器人承接完整任务。

AI科技评论
算法论文7

Transformer上限触顶,Mobius能否引发下一代模型架构的革命?

ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。

机器之心