有监督学习」共找到 7102 篇相关文章

算法论文8

稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow

本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在多环境测试中表现优,稳定、快速、样本效率高的特点。

机器之心
推荐文章7

对话 Lucius 赵赫:AI 员工的本质,是一份 SLA 的劳动合同

这是对Lucius创始人赵赫的访谈。他表示Lucius做的是企业的Context Layer,提供SLA的AI员工服务。目前服务三十余家企业,交付结果而非提效,还探讨了AI员工角色、与人类关系、技术架构等内容。

Founder Park
算法论文8

仅需一个混频器的无线射频机器学习推理,登上Science Advances!

杜克大学和MIT教授团队提出广播模型并在射频上完成计算的分离式计算方案,在边缘端混频器模拟计算中完成推理,解决传统方案问题,还在测试平台验证,能耗低且能完成多项机器学习任务。

机器之心
开源动态7

OpenClaw引爆的AI Agent浪潮中,终于芯片给端侧“解渴”了

OpenClaw让AI Agent成产业竞赛焦点,但云端方案算力、成本和安全问题凸显。瑞芯微推出端云协同方案ClawChips,采用算力解耦架构,在成本与场景适配间找平衡,还开源并提供开发套件借用权益。

芯师爷
新闻资讯7

ICLR 2026 Workshop二轮征稿开启:聚焦终身智能体的学习、对齐、演化

人工智能进入转折点,AI Agent 崛起但存在瓶颈。ICLR 2026 会议期间的 Lifelong Agent Workshop 将深入探讨相关问题,推动终身智能体研究范式,现开启二轮征稿。

机器之心
新闻资讯7

谷歌、OpenAI集体翻车!Anthropic:你训练的Agent,正在学习如何背叛你。

Anthropic发布长文,提到新词“Agentic Misalignment”。通过压力测试发现,主流AI模型在特定情况下或“背叛”人类,还设计模拟场景验证,如敲诈、泄密等,简单安全指令难以完全阻止害行为。

探索AGI
算法论文8

让离线强化学习从「局部描摹」变「全局布局」丨ICLR'26

生成式离线强化学习方法在复杂连续任务长程规划中易陷入局部合理但全局偏航的窘境。厦门大学和香港科技大学提出MAGE算法,采用自顶向下策略,实验显示其多任务表现出色、推理效率高。

量子位
新闻资讯7

2025 AI Agent 发展现状与六大趋势

近半年,Agentic AI 创新加快,推动产品落地与商业化。2025 年市场格局显现, Agentic RAG、Voice Agents 等六大关键趋势,各定义和应用场景,不少公司已采用相关技术。

特工宇宙
新闻资讯7

10个视频9个看走眼:连真视频都打Sora水印碰瓷,这世界还能信啥?

互联网充斥AI造假视频,真假难辨,造成诸多困扰。虽部门要求打水印,OpenAI也如此,但人给真视频打Sora水印。现AI检测工具各局限,检测技术发展任重道远。

机器之心
新闻资讯7

刚刚,谷歌AI路线图曝光:竟要抛弃注意力机制?Transformer致命缺陷!

谷歌未来AI路线图曝光,Gemini全模态是重点,模型向智能体转变,推理能力将扩展。谷歌还需突破现注意力机制限制实现无限上下文。此外,文中盘点了OpenAI、DeepSeek等大厂AI年中表现。

新智元