图像到三维」共找到 2534 篇相关文章

新闻资讯8

从 IROS 2025谈起,智能机器人何时迎来「GPT式爆发」? | GAIR Live 019

雷峰网邀请三位嘉宾解码IROS 2025背后具身智能前沿趋势。探讨了IROS现场变化、具身智能认知升级、Sim2Real实用边界、商业落地路径等,还预测具身智能“GPT时刻”或由“World Model+VLA”组合推动。

AI科技评论
产品应用7

打破 AI 辅助开发碎片化困境,阿里巴巴 R2C Agent 的 AI 编程实践

文章围绕阿里巴巴 R2C Agent 的 AI 编程实践展开。指出当前 AI 辅助开发存在与生产链路结合难、协作碎片化等问题,介绍了 R2C Agent 如何驱动研发链路,阐述其框架、实施情况及未来提升 AI 渗透率的目标。

InfoQ
产品应用7

理解规范驱动开发:Kiro、spec-kit和Tessl

作者尝试理解规范驱动开发(SDD),查看了 Kiro、spec - kit 和 Tessl 三个自称 SDD 的工具。介绍了 SDD 定义、规范含义,分析评估工具的挑战,还指出工具存在不适合多数编程问题、审查体验差等问题。

InfoQ
开源动态8

SGLang 优化Triton FusedMoE 的一个新技巧​

蚂蚁在SGLang中提交优化PR,针对Fused Triton MoE的Down Projection kernel加入TMA优化,在DeepSeek - R1模型的H200 TP8 prefill场景下性能提升显著,还详细分析了优化背景、思路、实现细节及测试结果。

GiantPandaLLM
开源动态8

百度0.9B参数模型登顶全球第一,聊聊PaddleOCR-VL背后的技术细节

百度PaddleOCR-VL模型仅0.9B参数,在OmniDocBench V1.5榜单获92.6分全球第一,在多能力维度达业界最佳,能处理109种语言。其采用两阶段架构,结合优质训练数据,实现高性能与低内存、快速度的平衡。

AIGC开放社区
算法论文7

BesiegeField:LLM能否学会设计机器?

香港中文大学推出基于游戏《Besiege》的测试平台BesiegeField,探讨LLM能否学会设计机器。研究通过组合式机器设计视角,测试LLM,提出多智能体迭代设计流程等,发现LLM有挑战但并非不可实现,如Gemini 2.5 Pro表现不错。

带你学AI
新闻资讯8

29个月增长100倍:一个AI 2.0公司应该怎么建?HeyGen的取胜的秘密

AI视频生成公司HeyGen在29个月内ARR从100万美元增长超1亿美元。创始人Joshua Xu公开取胜秘密,即独特运营模式‘The HeyGen Way’,包括拥抱变化、匹配节奏、最小化快速验证迭代等理念。

AI工程化
算法论文8

Meta「分割一切」3.0曝光!技能语义分割加入概念提示,好好玩,要爆了

Meta第三代“分割一切”模型SAM 3悄然投稿ICLR 2026。它支持基于概念提示的多实例分割,能听懂人话,处理图片快,还设计新架构、构建数据引擎、提出SA - Co基准,实验表现佳但也有局限。

量子位
开源动态8

超越AlphaFold 3!ProRNA3D搞定RNA蛋白互作,攻克癌症、病毒有了新武器

弗吉尼亚理工Debswapna Bhattacharya团队开源AI工具ProRNA3D - single,能仅靠单条蛋白质和RNA序列预测二者复合物三维结构,超越AlphaFold 3等工具,基于生物语言模型,有诸多应用价值,也有改进方向。

AIGC开放社区
开源动态8

京东AI一揽子开源!超多核心项目全开源,GitHub万star项目也有新进展了

京东系统性开源系列AI能力,从大模型Agent等。JoyAgent 3.0升级,开源DataAgent和DCP模块;OxyGent多智能体框架让开发者自由组合。还有京医千询2.0等,意在推动AI在各行业落地。

量子位