3D强化学习」共找到 3343 篇相关文章

新闻资讯7

具身智能的「Z 世代」,来了

文章与三位具身智能领域的Z世代年轻人对话,他们有不同背景和经历。谭恒楷研究机器人,提出创新模型和算法;吴铭东专注真机强化学习;王乾旭研究蒸馏特征场。他们对AI有独特认知,展现出年轻人的冲劲和思考。

AI科技评论
推荐文章8

刚刚!北大校友Lilian Weng最新博客来了:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。

机器之心
产品应用8

新模型亦是新 Agent,Kimi-Researcher 超大量一手实测!

2025 年被称为“Agent 元年”,月之暗面发布了端到端强化学习训练的新一代 Agent 模型 Kimi - Researcher,其基座是自研新模型。文章对其进行大量实测,与 OpenAI 等对比,并探讨了 Deep Research 的重要性及 Kimi 的不足。

特工宇宙
产品应用8

阿里Qwen3一大波更新:代码生成、视频、图片、语音全都有

阿里Qwen3迎来一大波更新,涵盖多个模型。如Qwen3-Max在代码与智能体表现卓越;Qwen3-VL是强大视觉语言模型;Qwen3-Omni是全模态模型;还有图像编辑、同传、安全防护等模型及旅行规划师等应用。

AIGC开放社区
开源动态8

AIME'25满分炸场!Qwen一波七连发,全家桶大更新

云栖大会上,通义团队成果丰硕。Qwen3-Max性能提升,数学评测满分,多测试成绩优异;Qwen3-VL、Qwen3-Omni等开源,各有亮点;Qwen3-Coder升级。吴泳铭称要发展超级人工智能。

量子位
新闻资讯8

汪军对话 Rich Sutton:大模型在一定程度上分散了我们对智能理解的注意力

在RL China 2025开幕式上,汪军与图灵奖得主Richard Sutton对话。Richard认为大模型缺乏目标和奖励,分散对智能理解的注意力。他强调RL核心是从经验学习,智能原则含梯度下降等,建议将目标解读为“奖励”。

AI科技评论
新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,如Qwen3-Max对标顶尖模型,Wan2.5支持音画同出,Qwen3-VL开源且跑分出色,Qwen3-Omni是全模态模型等。发布会上阿里股票涨飞,其构建了全模态、全场景超级生态。

数字生命卡兹克
开源动态8

开源Qwen一周连刷三冠,暴击闭源模型!基础模型推理编程均SOTA

通义千问卷疯了,Qwen3-Coder刚登场,全新开源Qwen3系列最强推理模型Qwen3-235B-A22B-Thinking-2507又刷新SOTA。一周内,通义千问完成开源三连,在基础模型、编程模型、推理模型方面均达全球开源最强。

量子位
新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是全模态模型。此外还有多个新模型,构建全场景生态。

开源星探
开源动态7

无需租GPU,一台24GB内存的笔记本就够了!

阿里开源稀疏 MoE 模型 Qwen3.6-35B-A3B,总参数 35B,激活 3B。它在智能体编程上超越前代,可与稠密模型媲美,支持多模态,已在 Qwen Studio 上线,还能集成第三方编程助手。

GitHubStore