3D强化学习」共找到 3336 篇相关文章

产品应用7

AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神

用AI做视频常遇运镜、人物走位等问题,因文生视频系统缺空间锚定能力。updream在8月17日上线「预演台」功能,通过传参考图自动生成3D白模场景,实测显示其显著减少「抽卡」次数。

新智元
产品应用7

Deepseek 正式发布 V3.1:混合推理,Agent能力大幅提高,token消耗减半

Deepseek正式发布Deepseek V3.1,采用混合推理,支持双模式切换,上下文扩展到128k,API支持Claude Code调用。工具与Agent能力提升,思考效率更高,token消耗减半,官方渠道全面升级,9月6号起调整价格。

AI寒武纪
新闻资讯7

DeepSeek大招曝光?梁文峰督战超级智能体:能自主学习,或年底发布

据彭博社爆料,DeepSeek正开发AI智能体,打造无需复杂指令、可自主学习与执行的下一代AI系统,年底发布。此前DeepSeek R1表现出色,曾推动开源发展,此次新动作彰显竞争决心。

新智元
算法论文8

ICML 2026 |让大模型边想边说:这篇文章把「何时开口」变成可学习策略

论文《When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning》针对推理模型的‘沉默税’问题,提出Side - by - Side(SxS)Interleaved Reasoning,将‘何时披露内容’变为可学习决策,经实验验证效果良好。

机器之心
产品应用8

我在Seko 3.0里敲了个「/」,它把导演调了出来

商汤在WAIC发布Seko 3.0,这是一个AI短剧和漫剧创作平台。它把导演变成可调用的能力,将创作者方法封装成Skill。作者通过实验对比,证实Skill核心在工作纪律,该平台还支持成片制作,且有创作者产业基地。

花叔
算法论文7

DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO

文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。

机器之心
新闻资讯8

刚刚,阿里旗舰模型Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布旗舰模型Qwen3-Max-Thinking,总参数超1万亿,在多项权威基准测试中表现优异,可与顶级闭源模型竞争。千问团队为其引入两项核心创新,提升推理性能,该模型已可免费体验。

InfoQ
新闻资讯8

李飞飞押注的3D世界模型黑科技,被这篇论文一次性扒光!

李飞飞创业公司World Labs发布空间智能模型成果,推出Marble平台。本文分享3D、4D世界模型技术综述,系统梳理原生表示的世界模型,给出分层分类法、数据集与评测指标,并开源维护。

PaperAgent
算法论文8

信通院&清华提出FedRE:用「纠缠」搞定联邦学习三难困境 | CVPR 26

联邦学习中兼顾模型性能、数据隐私和通信开销是挑战,尤其在模型异构场景。信通院和清华联合团队提出FedRE框架,能适配异构与同构场景,保证性能同时保护隐私、降低开销。

量子位
新闻资讯7

扎克伯格3亿美元都挖不动的人:OpenAI十名员工拒绝天价挖角

据《华尔街日报》报道,Meta扎克伯格为组建AI实验室,砸3亿美元挖角OpenAI员工,还收购Scale AI股份。OpenAI高层不满,员工多数坚守。此外,Windsurf收购剧情反转。这场人才战重塑科技行业规则。

AGI Hunt