多模态智能硬件」共找到 4429 篇相关文章

产品应用8

字节最强多模态模型登陆火山引擎!Seed1.5-VL靠20B激活参数狂揽38项SOTA

5月13日,火山引擎在上海发布5款模型和产品,其中豆包1.5・视觉深度思考模型(Seed1.5-VL)最吸睛。它激活参数20B,性能与Gemini2.5 Pro相当,38个评测基准达SOTA,推理成本低,已开放API。

机器之心
开源动态8

用2D先验自动生成3D标注,自动驾驶、具身智能有福了丨IDEA团队开源

IDEA团队张磊团队提出OVSeg3R开集3D实例分割学习新范式。它无需人工后处理和3D掩码标注,降低训练成本,有望让3D实例分割商业落地,可用于自动驾驶、智能家居等领域。

量子位
推荐文章7

这波AI淘金热里,卖“铲子”的公司正闷声发财,“征服"了几十家国内外巨头!

光轮智能联合创始人杨海波表示,AI发展让合成数据需求增大。该公司为具身智能行业提供3D合成数据,服务众多头部企业。其优势在于技术视野与路径独特,强调物理交互、人类示范等。还谈及创业要点与AI赛道变化。

AI前线
产品应用7

季度AI视频生成产品:多模态输入成标配,角逐一站式生成能力 | 量子位智库AI 100

Sora2下载量破百万引发AI视频生成热潮,谷歌推出Veo3.1再掀高潮。国外大厂将其卷至电影制作级创意,国内企业追求高质量、秒级生成并落地垂直场景。量子位智库发布的产品呈现多维度技术演进。

量子位
新闻资讯8

Sam Altman自曝羡慕20岁辍学生,还直言美国难以复制微信这类“全能App”!

当地时间2025年开发者日,OpenAI推出系列开发者更新,向通用智能平台转型。会后,CEO Sam Altman接受专访,谈及新工具影响、AGI突破、智能体发展等,还表示羡慕20岁辍学生,认为美国难复制微信“全能App”模式。

AI前线
算法论文8

论文精选 | 以AI赋能力学:计算力学的智能化之路与未来图景

中国力学学会旗舰期刊AMS推出“力学前沿”专栏,首期解读“计算力学的智能化之路与未来图景”。文章介绍智能计算力学三大范式、面临挑战,还阐述重塑智能框架前沿方向,指出AI与计算力学融合是系统性重构。

力学与人工智能
推荐文章8

无问芯穹曾书霖谈 AI 2.0 时代的大模型推理:从模型到硬件的协同优化

本文整理自无问芯穹总经理曾书霖博士在 2025 年 QCon 全球软件开发大会演讲。他介绍软硬件协同优化提升智能系统能效成果,结合华为昇腾集群实践,探讨 AI 推理系统演进趋势,还从云、端维度分享大模型推理实践与挑战。

InfoQ
新闻资讯7

智能醒于物理世界,英伟达副总裁: 下一个十年属于物理AI!|新智元十周年峰会

在新智元十年峰会上,NVIDIA副总裁赖俊杰揭示公司下一个十年战略核心——物理AI,它是继生成式AI和智能体AI后的下一波浪潮。物理AI与现实物理世界交互,但面临诸多挑战,英伟达为此开源Cosmos世界基础模型。

新智元
推荐文章7

拥抱 AGI 时代的中间层⼒量:AI 中间件的机遇与挑战

文章指出大模型发展呈能力跃迁、生态开放趋势,推动AI应用从聊天机器人向组织级智能体演进。AI中间件可解决应用工程化挑战,但面临上下文管理、记忆更新等难题,短期助力应用规模化,长期或成组织智能“神经中枢”。

InfoQ
开源动态8

清华姚班团队,开源具身智能视觉语言动作(VLA)模型工具箱,打造行业通用技术底座

清华姚班团队所在的原力灵机公司,开源了基于PyTorch的视觉语言动作(VLA)模型工具箱Dexbotic。它能打造通用底座,解决行业研发困境,其预训练模型表现出色,还与Hugging Face合作推出评测平台。

AIGC开放社区