3D场景理解」共找到 4231 篇相关文章

产品应用7

宇树新机器狗太猛了!1米高石阶轻松爬,越野快到出残影,网友:这不是AI生成的???

宇树新机器狗Unitree A2星际猎影实力惊人,全视频无加速展示跑酷、爬山等技能。它有超广角激光雷达3D感知系统,能自主避障,还很轻、强、快,承载能力佳,官方未公布售价和上市日期。

量子位
算法论文8

DeepMind揭示Reasoning内在机制

近年来大型推理模型在复杂任务表现出色,但推理机制成谜。本文提出用推理图解码其‘思考轨迹’,分析环状结构、直径大小和小世界特性,发现蒸馏模型等特点,为理解AI推理及模型优化指明方向。

深度学习自然语言处理
新闻资讯7

从实验室到工厂:具身智能如何跨越商业化的“死亡谷”?|甲子引力X

4月28日「AI共潮生——2025甲子引力X科技产业新风向」大会上,五位嘉宾围绕具身智能分享见解。当前行业处概念到商用过渡期,梅卡曼德邵天兰等四位机器人领军人物探讨商业化路径,指出需聚焦场景、降成本、强技术可靠性。

甲子光年
开源动态8

开源 AI 文档生成器!给代码库做个CT扫描,一键生成交互式Wiki文档!

介绍开源工具DeepWiki-Open,它由AsyncFuncAI开发,能将GitHub或GitLab仓库一键转为交互式Wiki,基于多种技术实现代码分析和自动化文档生成,解决开发者理解复杂代码库的痛点,还给出快速上手步骤和适用人群等。

开源星探
产品应用7

Codex正式开放1M上下文!解除GPT-5.6 Sol封印,三行配置搞定

现在3行配置就能让GPT - 5.6 Sol封印解除,在Codex里用上1M上下文。不过有网友警告轻易别用,因超出默认窗口,模型消耗token速度会翻倍,且模型上下文利用能力会下降。此外,Codex确定会上Astra。

量子位
新闻资讯8

AI 视频生成的未来在中国

当地时间3月24日,OpenAI宣布关闭视频生成应用Sora,这是其冲刺IPO前的战略调整。Sora曾是AI视频生成领域明星产品,性能卓越,但因内容生态缺失、商业变现难而关停。中国AI视频生成赛道崛起,应用场景丰富,形成生态壁垒。

AI科技评论
开源动态8

AgentScope 正式发布 Skills 支持 - 实现渐进式披露

文章指出大语言模型驱动的Agent系统存在核心矛盾,常见上下文加载方案有局限,缺乏灵活机制。介绍了AgentScope发布的Skill机制及渐进式披露策略,还讲了其在Java中的实现,最后分析了适用与不适用场景

阿里云开发者
算法论文8

停止迷信“超级Prompt”:要想AI不犯错,你得专门雇人“怼”它

这篇来自Isotopes AI的论文指出,在生成式AI落地中,迷信‘超级Prompt’不可取。对于高风险场景,单体LLM有局限,论文构建‘AI Office’架构,引入‘对手团队’概念,实验使准确率从60%提升到92.1%,但也有成本和局限。

深度学习自然语言处理
新闻资讯8

火了!刚刚,李飞飞2篇最新文章发布!

AI圈近期被李飞飞两篇重磅文章刷屏,一篇阐述空间智能愿景,指出当前AI缺乏空间智能,其创办的World Labs提出世界模型;另一篇论文揭示当前视频理解基准自欺欺人,还提出新基准VSI - SUPER及预测性感知新范式。

PaperAgent
产品应用8

马斯克AI女友直播「一秒变身」,Karpathy看完立刻投钱

世界首个支持直播推流的「实时」扩散AI视频模型MirageLSD诞生,大神Karpathy亲自站台。它能理解真实视频后同步生成AI视频,实现零延迟、无限时长、每秒24帧不卡顿,给视频娱乐和直播互动带来丰富想象。

新智元