真实场景重建」共找到 2420 篇相关文章

新闻资讯8

具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据

AI机器人创业公司Generalist推出新型具身基础模型GEN-0,参数量10B+,专为多模态训练构建。该模型展现强大Scaling Law,能力可扩展,有和谐推理等特性,在多方面有突破,成果备受赞誉。

机器之心
开源动态7

首个开源「智能视频剪辑系统」,11个工作流覆盖所有视频制作场景,成本巨低!

今天分享开源智能视频制作系统OpenMontage,号称首个。它有11条完整生产流水线,覆盖几乎所有视频类型;有49个生产工具、400+个Agent技能。其成本低,功能丰富。

开源AI项目落地
开源动态8

救命! Canvas?3.1k Star Mind Elixir ,真丝滑!!!!

Mind Elixir是可嵌入的JavaScript脑图内核,零依赖、框架无关。它能将JSON数据变成可交互节点,有拖拽、编辑等功能。适合知识库等场景,不适合只需不可编辑宣传图等场景

小华同学ai
新闻资讯7

图灵也没想到,智能,必须在现实中「活」下来

第六届 ATEC 科技精英赛 ATEC2026 已开赛,由多单位共同组织。赛事聚焦人工智能、具身智能等方向,以真实世界挑战为命题,通过赛题设计检验系统在真实环境的运行能力,还设置丰厚奖励。

机器之心
算法论文8

AgentA/B:用AI模拟用户,真人AB测试或将成为历史

宾夕法尼亚州立大学和亚马逊合作研发AgentA/B测试框架,用大语言模型生成虚拟用户模拟真实行为,成本低、速度快,还能绕开真实流量测试。虽有人质疑,但它或改变传统AB测试。

AGI Hunt
产品应用8

阿里Qwen-Image-2.0图像生成与编辑巅峰汇合,超真实、超强图文结合

阿里Qwen - Image - 2.0将生图与编辑能力合二为一。它支持长指令,能精准渲染大量文字,引入物理逻辑让文字呈现真实质感,在生图和编辑上对语义理解和画面重构能力强。

AIGC开放社区
开源动态8

数字人视频革命!MultiTalk开源:15秒多人对话一键生成,歌唱/卡通全驾驭!

在AI驱动的视频生成领域,创建多人对话场景是难题。MultiTalk是开源音频驱动多人对话视频生成框架,由MeiGen - AI等联合研发,输入多路音频等就能生成嘴型同步的视频,适用于多种场景

开源星探
新闻资讯8

60秒极限挑战!中国GPU独角兽杀出重围,斩获图形顶会大奖

2025年12月,SIGGRAPH Asia 2025在香港开幕,摩尔线程在3DGS重建挑战赛中凭自研技术LiteGS斩获银奖。该团队还开源3DGS基础库LiteGS,实现全链路协同优化,提升训练效率与重建质量。

新智元
开源动态8

AI教母李飞飞空间智能开源大动作:上亿节点3D高斯场景塞进手机网页

AI教母李飞飞的空间智能公司World Labs开源3D高斯泼溅网络渲染器Spark 2.0,打破硬件与平台壁垒,将亿级渲染能力带到网页和移动端,解决Web端痛点,还采用三大核心技术系统及更多黑科技。

AI寒武纪
新闻资讯8

LangChain Agent 年度报告:输出质量仍是 Agent 最大障碍,客服、研究是最快落地场景

LangChain对1300名行业人士调查,揭示AI Agent应用情况。超半数受访者已将Agent投入生产,客户服务、研究与数据分析是热门方向,但输出质量仍是落地最大障碍,成本不再是难题。

Founder Park