多智能体学习算法」共找到 4797 篇相关文章

推荐文章7

算法天才到机器人造梦者,原力灵机范浩强详解具身智能进化论:模型解锁场景,场景定义硬件

AI 前线深度访谈原力灵机范浩强,探讨其创业选择、具身智能技术演进与产业趋势。他认为机器人是 AI 绕不过的点,2025 年硬件与算法拼图开始对齐,原力灵机强调算法先行,还分享了保证算法演进的路线。

AI前线
算法论文8

南大周志华团队最新力作:一个算法通吃所有,在线学习迎来新范式?

世界是动态变化的,AI 模型需具备在线学习能力,领域提出适应性遗憾值指标。现有算法通用性不足,南京大学周志华团队研究具有双重自适应性的通用算法,提出元 - 专家框架等,还研究了在线复合优化问题。

机器之心
新闻资讯8

Andrej Karpathy 开炮:智能体都在装样子,强化学习很糟糕,AGI 十年也出不来

本周五,Andrej Karpathy 长达两小时多的采访视频引发关注。他直言行业步子迈得太大,嘲讽 AI 现状夸大、脱离实际。他认为智能体成熟需十年,强化学习糟糕,还探讨了 AGI、人类学习、教育未来等多方面问题。

机器之心
开源动态8

只训练数学,却在物理化学生物战胜o1!新强化学习算法带来显著性能提升,还缓解训练崩溃问题

上海创智学院、上海AI Lab的MM - Eureka系列工作提出新强化学习算法CPGD,缓解训练崩溃问题,提升性能。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。

量子位
新闻资讯8

Andrew Karpathy最新访谈:RL很糟糕、人类学习和教育、智能和文化的演变、AGI还要十年,将带来2%的GDP增长

Dwarkesh Patel 播客对 Andrej Karpathy 进行深度访谈。他认为 AGI 还需十年,目前算法有缺陷;强化学习虽有问题但必要;分析了 LLM 局限,探讨人类学习机制、AGI 经济影响等多方面内容。

AGI Hunt
开源动态8

具身智能算法哪家强?RoboChallenge见真章!全球首个大规模真机算法评测平台来了

Dexmal原力灵机联合Hugging Face推出RoboChallenge项目,它是全球首个大规模、多任务的真实物理机器人基准评测平台。该平台创新采用‘远程机器人’架构,有30项真实任务基准集等,已验证多种算法表现。

新智元
新闻资讯8

人脑细胞做成芯片打Doom!20万活体神经元自己探路杀敌,学习效率碾压深度强化学习

20万人类脑细胞组成“脑PU”学会玩《毁灭战士》,代码已开源。研究将活体神经元与三大强化学习算法对比,发现生物培养物学习效率全面超越算法。实验运行在Cortical Labs的CL1生物计算机上,团队邀开发者探索更多可能。

量子位
推荐文章8

出价算法新SOTA——快手首提生成式强化学习出价

文章介绍快手新提出的生成式强化学习出价模型GAVE,回顾出价算法发展历程。GAVE结合生成式与强化学习优势,有Score-based RTG等创新,经竞赛、实验验证效果佳,为出价技术带来新方向。

王喆的AI笔记
算法论文8

让思考更准更长!强化学习算法FIPO来了

阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。

千问大模型
开源动态8

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

端到端策略模型在物理世界失灵,现有在线学习路径未走通。清华 AIR 与域变换联合推出 Zetta ζ,通过三个闭环实现闭环物理智能体在线学习,实验显示其任务成功率高,还让机器人出现‘Aha Moment’。

机器之心