多智能体学习算法」共找到 4815 篇相关文章

新闻资讯7

特斯拉们,慌了?英伟达智能驾驶实测曝光:仅用一年追平马斯克八年心血

英伟达汽车业务虽仅占总收入1%,但十年积累已成气候。其与Uber合作、推广L2级城市功能,到2028年将实现L3高速公路驾驶,仅用1年几乎追上马斯克的FSD。实测中英伟达自动驾驶表现出色,新系统也有诸多亮点。

新智元
开源动态8

社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。

Hugging Face
新闻资讯7

中国设计智造大奖作品展来了!从具身智能到智慧空间,打开未来生活想象

第十届中国设计智造大展在国美良渚校区开启,展示200余件获奖作品。展览设5大主题、打造新场景,验证新技术产业化应用,还展示增强外骨骼等案例,助力未来产业集群培育。

MANA新媒体艺术站
算法论文8

极简主义的胜利:清华团队用最简单的强化学习配方刷新1.5B模型纪录

清华、伊利诺伊大学和上海AI实验室团队提出JustRL架构,仅用单阶段训练和固定超参数,在1.5B模型上刷新性能纪录,计算量仅为复杂方法50%,挑战了复杂技术堆叠现状。

AIGC开放社区
开源动态8

小红书提出DeepEyesV2,从“看图思考”到“工具协同”,探索多模态智能新维度

小红书推出多模态模型DeepEyesV2,它延续视觉推理优势,实现代码执行、网页搜索和图像操作的全工具协同。通过多工具协同推理解决复杂问题,采用两阶段训练策略,准确率远超开源模型。

量子位
算法论文8

陈丹琦新作:大模型强化学习的第三条路,8B小模型超越GPT-4o

陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越大模型,推理更像人类。

量子位
新闻资讯8

重磅!谷歌联合 Coinbase 推出智能体支付协议 AP2,AI Agent 们可以互相打钱了

Google和Coinbase联手推出Agentic Payments Protocol(AP2),配合x402稳定币支付轨道,让AI Agent能相互对话并完成支付交易,开启了Agent经济,还展示了全自动化购物流程,微支付场景将爆发。

AGI Hunt
产品应用8

AI智能体加持,爆款视频产出速度提升了10倍,全民导演时代已来

Video Ocean在影像创作领域带来革新,通过AI Agent实现一人完成多职能,将拍摄周期大幅缩短。它打造自动化创作生态,能快速批量生成爆款视频,覆盖多种创作场景,操作简单,打破创作壁垒。

机器之心
开源动态8

狂涨 17.7K star!!智能查询导入、数据可视化、AI 迁移,这款开源数据库图表工具火了!

日常开发中,数据库设计和管理工作繁琐易出错。本文介绍超实用开源项目 ChartDB,它能将数据库结构可视化,AI 帮导出 SQL,有一键导入、AI 驱动导出等特性,开源免费,多种方式安装。

开源先锋
产品应用8

AI × 老旧系统:Vibe Coding 构建 AI 迁移工具,实现 10x 端到端智能迁移

文章指出老旧系统现代化复杂且需大量人工,AI 编程工具和 Vibe Coding 带来新可能。介绍 6R 策略、绞杀模式等迁移方法,还阐述 AI 在系统分析评估、代码转换等方面的应用,最终目标是打造闭环 AI 迁移 Agent。

phodal