多目标强化学习」共找到 1489 篇相关文章

推荐文章7

AI 会取代人类思考吗?我们为什么仍要亲手写作和编程

文章探讨AI是否会取代人类思考,指出不能过度依赖AI,如写作和编程应亲力亲为。还给出使用AI的指南,引用多方观点说明人类在创作、决策等方面的价值,以及学习编程和掌控AI的重要性。

宝玉AI
推荐文章7

入局AI Infra:程序员必须了解的AI系统设计与挑战知识

文章分享传统后台工程师技术栈和方法论如何迁移到AI系统,系统性拆解AI Infra的硬件、软件、训练和推理挑战,如硬件从CPU到GPU、软件依赖深度学习框架,还分析训练和推理面临的问题及解决办法。

腾讯技术工程
产品应用8

阿里发布新一代千问旗舰模型Qwen3.7-Max,登顶最佳国产模型

5月20日,阿里发布新一代千问旗舰模型Qwen3.7 - Max。近三月千问迭代三次,Qwen3.7 - Max在多测评中表现优异,位列国产模型第一。它强化编程等能力,阿里还通过MaaS等连接各环节,布局AI基础设施。

InfoQ
算法论文8

ICDE 2026 | 从匹配困境到推理突破:阿里REG4Rec 激活生成式推荐的个性化潜力

阿里国际智能技术团队提出生成式推荐模型 REG4Rec,从表征学习、训练目标和推理策略层面设计,提升推理能力与稳定性。离线实验表现优,已在 Lazada 部署,带来显著商业收益,成果被 ICDE 2026 接收。

机器之心
产品应用8

捅破具身智能天花板!极佳视界新VLA大模型登场,复杂长时程任务近100%成功率

极佳视界推出GigaBrain-0.5M*VLA大模型,以世界模型条件驱动,引入人在回路持续学习机制。在与主流方法对比中,任务成功率提升30%,长时程任务近100%成功,还具备高效准确的价值预测能力。

量子位
算法论文8

数据蒸馏的双重突破:从几何保真到对抗鲁棒

深度学习中,数据集蒸馏可用精简合成样本替代庞大训练集且不牺牲模型性能,但面临精度和可靠性两大难题。两篇发表于 ICCV 2025 和 AAAI 2025 的论文分别给出解决方案,且代码已开源。

深度学习自然语言处理
算法论文8

最新视觉大模型 DINOv3论文精读(逐段解析)

DINOv3是突破性自监督视觉基础模型,其创新围绕数据与模型协同扩展、Gram锚定技术、多阶段训练策略。它解决传统自监督学习难题,在多任务上无需微调达最优,为计算机视觉树立新标杆。

机器学习AI算法工程
算法论文7

OpenClaw爆火背后,仅8.6%用户能察觉异常!多校联合实证

OpenClaw等AI智能体爆火,其安全隐患凸显。多校联合研究发现,仅8.6%的用户能感知智能体媒介欺骗,总结了6类认知失效模式,认为体验式学习或比静态提醒更能提升用户警觉性。

新智元
新闻资讯8

Bengio 15 年前论文再夺 AAAI 奖!AI 正告别单纯炫技,走向真实世界

全球人工智能顶会AAAI揭晓年度奖项,Yoshua Bengio 2011年论文获经典论文奖。今年5篇杰出论文研究方向指向AI从炫技走向应用,如ReconVLA改进VLA视觉感知,CADYT解决连续时间因果结构学习空白等。

InfoQ
新闻资讯7

安全噩梦:Docker 警告 MCP 工具链中存在的风险

Docker 博文警告,基于 MCP 构建的 AI 开发工具引入安全漏洞,如凭证泄露等。MCP 发展迅猛但部分实现有隐患,Docker 分析发现广泛漏洞,还提出强化方法应对风险,其他厂商也有类似担忧。

AI前线