三维环境生成」共找到 2686 篇相关文章

算法论文8

今年看到最系统的AI Agents时代Memory综述~

分享由NUS、人大等联合出品的《Memory in the Age of AI Agents: A Survey》。用三维框架讲透200+篇论文,提出新三大记忆形态,展望7大前沿,还涵盖记忆各方面知识及资源。

PaperAgent
算法论文8

邱锡鹏老师团队发布VehicleWorld:让智能汽车真“智能”

邱锡鹏老师团队发布论文,构建高度仿真的智能座舱虚拟环境VehicleWorld,并提出基于状态的函数调用(SFC)方法。实验显示,SFC大幅提升任务执行准确率和效率,还构建了Vehicle Benchmark进行评估。

深度学习自然语言处理
新闻资讯7

清华辍学、斯坦福睡地板,华人小哥用AI社交挑战Meta,融资数千万美元

来自中国的小哥Brandon Chen打造AI原生即时通讯工具Intent,已获数千万美元融资。它结合微信聊天与大模型自动执行功能,如处理图片、规划旅行、生成购物清单等,带来全新聊天体验。

机器之心
推荐文章7

一文带你彻底理解AIGC、Agent、MCP的概念和关系

本文为非AI开发者科普AIGC、Agent、MCP概念和关系。AIGC用AI生成内容;Agent可自主决策调用工具;MCP是Anthropic开源协议,降低模型与工具集成成本,获大厂支持。

腾讯技术工程
开源动态8

ViT一作盛赞:这个中国开源“PS模型”强过Nano Banana

ViT核心作者Lucas Beyer连发三条帖子怒赞通义千问发布的开源模型Qwen—Image—Layered,认为这是图像生成的正确打开方式。该模型可实现PS级拆图自由,支持精细化修改图片元素,核心技术是端到端的扩散模型。

量子位
开源动态8

开源 AI 视频平台

开源 AI 视频平台集成剪辑生成器、AI 短视频、YouTube 工作室三大工具,能将长视频转短视频,为业务生成营销视频,还具备免费 YouTube 工具包。支持多平台发布,自托管永久免费。

GitHubStore
开源动态7

这张信息图,居然是8B开源模型做的??

商汤新开源的 8B 多模态模型 SenseNova U1,架构独特,图像评测表现好,信息图生成能力强、延迟低。它具备图文交错能力,适合自媒体、敏感行业等,有在线体验和开源代码入口。

花叔
开源动态7

干掉延迟!12G显存就能实现实时AI换脸直播,开源免费。

推荐开源项目PersonaLive,它是基于自回归流式扩散技术的实时人像动画生成框架。能平衡画质与低延迟,用一张照片在普通显卡实现数字分身实时驱动,有低显存、无限时长等特点。

开源AI项目落地
推荐文章7

5Y View|欢迎来到评测时代

强化学习推动AI突破,模型将刷爆既有评测,AI实验室面临评测饥荒。构建评测与RL环境是利用人类时间的高效方式,不同领域有不同验证方式,Mercor已率先拓展RL数据边界。

五源资本 5Y Capital
算法论文7

直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?

论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理