「多智能体强化学习」共找到 4568 篇相关文章
Meta视觉基座DINOv3王者归来:自监督首次全面超越弱监督,商用开源
Meta推出并开源视觉基础模型DINOv3,采用自监督学习,首次全面超越弱监督,可生成高质量高分辨率视觉特征。它在多任务表现出色,参数和数据量提升,还构建模型家族,已在多领域产生实际影响。
4万多名作者挤破头,CVPR 2025官方揭秘三大爆款主题, 你卷对方向了吗?
CVPR 2025 官方根据 4 万多名作者 13008 份投稿,总结出计算机视觉热门的三大方向,即基于多视角与传感器的 3D 技术、图像与视频合成、多模态学习(视觉、语言和推理),并介绍了各方向热门原因。
给AI发100美元去二手市场捡漏,结果它给自己买了19个乒乓球
2025 - 2026年,Anthropic进行“Project Deal”实验,让69个Claude智能体在真实双边市场自主交易,完成186笔超4000美元交易。实验发现模型能力影响交易结果,还揭示了AI代理交易存在的问题和隐忧。
菲尔兹奖成果首次被AI完整形式化,Gauss20万行代码改写数学史?
Math, Inc. 公司用 Gauss 智能体完成 8 维和 24 维空间最优球体堆积定理形式化证明,代码约 20 万行。该定理最初由 Maryna Viazovska 及其合作者证明,这是本世纪首个被完全形式化证明的菲尔兹奖成果。
13 vs 3,国产安全AI悄悄完成了对Claude的超越
Anthropic官方披露Claude Code Security定位3个典型0day漏洞,而安恒信息旗下恒脑安全智能体100%复现这3个漏洞,还额外挖出10个全新0day漏洞,展现出强大的AI自主发现能力。
训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD
清华大学THU-IDM团队与慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,预测难度,开销低、动态适应且平衡探索利用,在多任务表现佳,降本增效,有新范式。
姚顺雨入职腾讯50天后,发布了首篇署名论文:CL-Bench
2月3日姚顺雨加入腾讯50天后发布首篇署名论文《CL-bench: A Benchmark for Context Learning》。该论文做了新的benchmark,测试显示前沿模型平均分仅17.2%,指出模型在上下文学习尤其是归纳能力上的短板。
4K超分Agent修图师来了!一键救活所有模糊照片
传统图像放大模型应对复杂情况力不从心,4KAgent应运而生。它基于多智能体设计,有感知、复原等模块,能为图像定制4K超分方案,在多领域测试中表现出色,无需特定领域再训练。
大模型如何准确读懂图表?微软亚研院教它“看、动手、推理”
多模态大模型处理结构化图像有误差放大、推理难等问题。微软亚洲研究院等提出PixelCraft,以高保真图像处理与非线性多智能体推理为支柱,提升结构化图像理解性能,在多基准上有增益。
14000人原地被裁!亚马逊今日:打工人水深,AI机器人火热
10月28日,亚马逊约1.4万名员工收到裁员通知,占全职员工4%,超80%来自零售业务。公司业绩不错仍裁员,是为用AI增效、资源重组,还押注具身智能,或取代超50万蓝领岗位。