「端到端学习」共找到 3454 篇相关文章
T-PAMI|中国科大、合工大等提出CAPER++:让关节物体位姿感知真正迈向「又快又稳」
在具身智能发展下,关节物体位姿感知难题待解。中国科大、合工大等团队提出 CAPER++ 框架,从关节驱动视角建模,将位姿学习拓展至 SE (3) 流形切空间,实现端到端推理,兼顾精度、鲁棒性与实时性。
新模型亦是新 Agent,Kimi-Researcher 超大量一手实测!
2025 年被称为“Agent 元年”,月之暗面发布了端到端强化学习训练的新一代 Agent 模型 Kimi - Researcher,其基座是自研新模型。文章对其进行大量实测,与 OpenAI 等对比,并探讨了 Deep Research 的重要性及 Kimi 的不足。
一个强化学习信仰者的十年|甲子光年
本文讲述朱哲清在强化学习领域的十年历程。他从斯坦福到Meta再创立Pokee AI,逆势押注强化学习。虽面临诸多质疑,但随着InstructGPT等出现,强化学习逐渐被认可,他致力于构建新一代AI Agent。
强化学习之父:LLM主导只是暂时,扩展计算才是正解
新晋图灵奖得主、强化学习之父Richard Sutton在新加坡国立大学演讲时预测,大模型主导是暂时的,未来五年甚至十年内不是技术前沿。他认为AI应从依赖人类数据转向体验学习,强化学习潜力需靠扩展计算支撑。
面壁小钢炮 VoxCPM-TTS:开源端到端 TTS,轻量高效低延迟
面壁提出基于扩散自回归建模的端到端语音生成模型 VoxCPM,构建于 MiniCPM - 4 之上。它克服传统离散 token 方法缺陷,实现语义与声学特征解耦,有上下文感知语音生成和零样本语音克隆能力,低延迟。
ChatGPT「学习模式」火爆上线,一大波教育AI连夜被端!24小时导师免费用
OpenAI为ChatGPT上线苏格拉底「学习模式」,针对大学生,以交互式提示、分步解答等功能引导学习,可应对复杂学科难题。一经推出便受网友热捧,有人预言将端掉一波教育类AI。
对话 Befreed 创始人:从「个人学习」切入的 AI Agent,把学习变成一种生活方式
文章对话 Befreed 创始人 Jisong Liu ,介绍其以「强个性化学习 Agent」为核心的音频学习产品,它能把零散学习累积成知识路径,采用订阅制,有付费转化,还分享了创业、社媒运营等经验。
生成式视角重塑监督学习!标签不只是答案,更是学习指南 | ICML 2025
上海交大等机构团队在ICML 2025提出预测一致性学习(PCL),通过扩散过程消减标签信息,引入噪声标签,将标签学习分解为渐进式任务,实现标签信息复用。在多模态任务实验中,PCL表现优于传统监督学习。
新型开源端到端 AI 语音模型!Voila:195ms 超低延迟引领全双工对话!
Maitrix团队发布开源AI端到端语音模型Voila,以195ms超低延迟及全双工对话受关注。它功能强大,支持多语言,有多种使用方式,适用于多个场景,架构采用模块化设计。
ICLR 2026 | 从「聚合」到「引导」:FedDRM开启客户端智能路由新范式
传统联邦学习中,统计异质性是障碍,本文提出 FedDRM,将联邦学习从「聚合范式」拓展到「路由范式」,让服务器能把问题交给最合适的客户端处理,在多数据集上提升系统准确率,为多场景提供新可能。