3D场景理解」共找到 4202 篇相关文章

推荐文章7

一文探析多分类指标Accuracy/Precision/Recall/F1-score

文章探讨机器学习分类模型评价指标,指出Accuracy在不平衡数据集有缺陷,需引入Precision、Recall和F1 - score。分开解析二分类和多分类模型指标,还给出不同场景下指标侧重建议。

海边的拾遗者
新闻资讯7

对话阶跃星辰段楠:“我们可能正触及 Diffusion 能力上限”

阶跃星辰段楠指出当前视频生成技术或触天花板,真正有深度理解能力的模型尚待突破。他预测未来1 - 2年视觉领域基础模型有望出现,还分享视频生成及多模态AI未来核心洞察。

AI科技大本营
新闻资讯7

没有头,没有脚,还能三折叠,周衔团队发布首款「非人形」机器人

机器人创业公司Genesis AI发布首款通用机器人Eno,它是轮式且配机械臂,无腿无头部,外壳颜色可定制。其由自研模型GENE驱动,预计2026年Q4发货,落地从工业到生活场景

机器之心
开源动态7

GSD框架解析:解决AI编程工具Context Rot的工程化方案

文章介绍GSD框架,它旨在解决AI编程工具的Context Rot问题,通过Meta - prompting等方法将开发过程阶段化。提供常用命令稳定工作流,有实用新能力,适用于多种场景,以npm包部署,支持多平台。

小华同学ai
开源动态8

港大开源视频版RAG,像聊天一样看完百小时纪录片。

港大HKUDS团队开源超长视频理解框架VideoRAG,突破传统模型时长限制,支持对数百小时视频精准检索和问答。还有桌面应用Vimo,使用简单高效。介绍了其切片索引、混合检索、生成回答的实现逻辑。

开源AI项目落地
新闻资讯8

UC伯克利大牛预警:留给人类能干的活,只剩5年了!

UC伯克利教授Sergey Levine预言,2030年前机器人将进入真实世界,接手厨房、客厅等场景,甚至工厂、仓储和数据中心建设。其基于Robot Foundation Models等进展,认为‘自我进化飞轮’启动后不会停下,还会带来经济冲击。

新智元
开源动态8

GAIA 榜首,杀疯了!高并发、多任务京东开源的JoyAgent秒杀行业巨头

本公众号关注AI前沿技术,分享实战案例与课程。京东开源轻量化通用多智能体产品JoyAgent - JDGenie,可挂载新场景功能,在GAIA榜单准确率超行业知名产品,还介绍了其架构特点与创新点。

CourseAI
新闻资讯7

谷歌云推出面向毫秒级延迟工作负载的 Rapid Storag

在 Google Cloud Next 2025 大会上,谷歌云推出 Rapid Storage,为频繁访问数据和延迟敏感应用提供毫秒级数据访问,有低延迟、高吞吐量等特点,还与亚马逊 S3 Express 被比较,目前处于预览阶段。

InfoQ
开源动态8

老黄入局吃龙虾!英伟达发布最强开源Agent推理模型

英伟达发布并开源120B参数的MoE模型Nemotron 3 Super,在多项测试中表现出色。它原生支持100万token上下文,吞吐量大幅提升。英伟达还计划五年投260亿美元构建开源AI模型,开放全参数权重等。

量子位
开源动态7

让视频搜索像聊天一样简单!本地也能跑的视频语义搜索工具

SentrySearch是基于语义的视频搜索工具,输入文字描述就能从视频中找到对应片段并剪辑成短视频。它可借助Google Gemini Embedding API或本地Qwen3 - VL模型,还适配特斯拉行车记录仪,能叠加车速等信息。

GitHubStore