有监督学习」共找到 7102 篇相关文章

新闻资讯7

聊天框之外,AI 交互正在被哪些「新界面」重写?

近期,「理想的 AI 交互形态」引发热议。目前流行的聊天对话框式 AI 交互局限,一些产品开始在特定场景引入不同交互设计。文章还分析了多数 AI 产品界面停留在聊天框的原因及业界探索新交互机会的情况。

机器之心
产品应用7

全网首个“活的AI社会”上线!Agent背着人类建工会、放贷款,图灵奖得主预言成真了?

强化学习奠基人Richard Sutton认为真正的智能来自能从经验和环境反馈中学习的智能体。iLands创始人唐垲鑫构建了让AI真实记忆、关系和代价的世界。内测中AI出现自发旅行、建信用体系等行为。

AI寒武纪
开源动态8

别让AI一上来就“进厂打螺丝”:智源悟界·Orca要先教模型理解世界如何变化

智源研究院悟界·RoboBrain Orca Team发布技术报告Orca,探索模型是否理解世界状态变化。Orca尝试在统一世界潜空间学习状态与规律,受海外关注。它先学世界表征,独特学习方式,经实验验证效果良好。

量子位
开源动态8

斩获7.4K标星!NotebookLM的终极开源平替,私化多模态播客一键生成!

Google的Notebook LM虽能上传资料一键生成播客总结,但数据隐私等问题。近期GitHub上的Open Notebook获7.4K标星,它复制并超越前者功能,强调数据主权,多项亮点且部署灵活。

开源星探
新闻资讯7

黄仁勋李飞飞林斌投了同一家机器人公司

Generalist是专注给机器人“造通用大脑”的AI公司,创立不久便多次融资,估值超20亿美元。其GEN - 1.5强大泛化能力,演示一次就能上手,但也很大进步空间,展示了未来通用机器人大脑学习方式。

量子位
算法论文8

让机器人「不仅会想,还能准确去做」,VLA-R1把「推理+行动」带进真实世界

VLA-R1是“先推理、后执行”的VLA基础模型,结合链式思维监督与强化学习,优化推理和执行。它两阶段训练、三类可验证奖励等创新点,经多层面测试效果好,在多领域应用前景。

机器之心
产品应用7

这一夜,中国AI彻底翻身了:DeepSeek R1让全世界刮目相看 | 深度评测

作者深度测试新DeepSeek R1,发现其代码生成能力超Claude 3.7,虽编程全面性不足,但已处Claude 3.7与Claude 4之间。前端设计审美达Claude 4水准,部分方面略胜,自主学习推理能力,或改变中国AI历史。

AI产品黄叔
算法论文8

无需验证器的RL:RLPR解锁LLM通用推理潜能

依赖强化学习与可验证奖励(RLVR)提升大语言模型(LLM)推理能力的方法,受限于领域特定验证器。本文提出RLPR框架,利用LLM生成正确答案的固概率作奖励信号,实现无需外部验证器的通用领域强化学习,效果显著。

深度学习自然语言处理
开源动态8

单卡可跑18万原子!分子模拟的“规模焦虑”该终结了

至知创新研究院UBio团队发布的UBio-MolFM v1.5,是可进行分子动力学模拟的机器学习原子间势函数。它在精度和规模上提升,实测中表现优于经典力场,架构、数据和训练都创新,误差降45%,速度提8倍,现已开源。

量子位
产品应用8

文心X1.1三大能力狂飙,海内外实测还挺惊艳!

9日WAVE SUMMIT深度学习开发者2025大会上,文心大模型X1.1发布,事实性、指令遵循、智能体能力显著提升,多项测试表现佳。它能做到知识一致,精准遵循指令,智能体解决问题出色,代码、数学、多模态能力也进化,得益于迭代式混合强化学习训练框架。

新智元