水下场景理解」共找到 2575 篇相关文章

开源动态8

清华深研院等开源GUAVA:单图0.1秒出3D形象,打破数字人天花板

清华深研院和国际数字经济研究院的中国团队开源GUAVA,单图0.1秒就能生成3D形象,在速度、效果和成本上远超传统数字人制作流程。它结合EHM模型和3D高斯泼溅技术,有诸多应用场景

AIGC开放社区
产品应用8

面向UE5的智能数字人系统

GMTalker是光明实验室媒体智能团队为虚幻引擎5.3打造的智能数字人系统,集成多种能力,适用于科研等场景。具备多功能特点,与其他开源方案对比优势明显,还介绍了环境要求、启动方式、配置、API等。

GitHubStore
开源动态8

腾讯开源WMT2025冠军大模型:拿下30个第一,同类最佳

昨晚腾讯开源WMT2025冠军翻译大模型Hunyuan - MT - 7B,它在31种语言测试中获30个第一,成同类最佳。文中介绍其架构、训练过程,还通过多场景翻译案例展现优势,有望推动高质量翻译普及。

AIGC开放社区
产品应用7

除了内卷和价格战,国产MCU还剩下什么?

国产MCU市场竞争激烈,中低端价格战严重,但仍有企业突围。本文介绍第七届“芯师爷 - 硬核芯年度评选活动”参评的MCU产品,如极海、芯驰等企业的芯片,各有特点与应用场景

芯师爷
推荐文章7

拆解、对比与优化:LLM工具智能体的五种任务规划与执行模式

文章探讨了大语言模型驱动的AI智能体的五种任务规划与执行模式,包括ReAct、Plan-and-Execute、静态Workflow、Workflow+局部智能、模块化的分层规划,分析其优缺点、适用场景,还给出优化方法。

AI大模型应用实践
开源动态7

1.5B参数!支持本地实时语音转录

Liquid AI发布首个端到端音频基础模型LFM2 - Audio - 1.5B,参数1.5B,能在本地设备处理高质量端到端音频任务。它是统一多模态模型,支持两种生成策略,多种应用场景,虽仅支持英文但性能出色。

AI工程化
8

GPT-5.5 Instant上线:幻觉减少52.5%,告别废话

OpenAI完成ChatGPT默认模型的静默升级,GPT-5.5 Instant全面替换GPT-5.3 Instant。它在数学推理、减少幻觉、精简回答、记忆功能等方面有显著改进,还采用灰度推送策略。开发者认为其定位是日常场景够用顺手。

AI工程化
新闻资讯7

5Y News | 地瓜机器人完成1.5亿美元B2轮融资

近日,地瓜机器人完成1.5亿美元B2轮融资,B轮累计2.7亿美元。2025年业务成果出色,出货量增180%、客户量翻倍、开发者破10万。它与地平线打造具身智能大脑基座,释放多场景应用潜力。

五源资本 5Y Capital
产品应用8

英伟达发布物理AI和机器人顶级开发平台Nvidia Jetson Thor

英伟达官网发布专为物理AI和类人机器人打造的顶级平台Nvidia Jetson Thor。其AI计算能力强劲,相比NVIDIA AGX Orin性能和能效大幅提升,硬件配置、存储、多媒体处理及相机支持等方面表现出色,能应对复杂场景

AIGC开放社区
新闻资讯8

卡车自动驾驶里程超10亿公里,嬴彻科技定义“货运物理AI”

2026年9月3日,嬴彻科技宣布卡车自动驾驶商业运营里程破10亿公里,以超90%市场份额领跑中国卡车智驾市场。其构建“货运物理AI”,有三大核心能力,还布局全场景货运网络,海外业务也有突破。

量子位