视频大模型」共找到 9464 篇相关文章

产品应用8

模型“跑”在手机里:vivo蓝心端侧部署创新揭秘,性能功耗双优!

在AICon2025上海站,vivo AI研究院工程师章苏迟分享蓝心模型端侧部署方案。介绍端侧模型优势及应用场景,阐述内存、性能、功耗等指标优化方法,还提及多业务场景应对策略与安全合规措施。

InfoQ
开源动态8

万帧?单卡!智源研究院开源轻量级超长视频理解模型Video-XL-2

视频理解是多模态模型关键能力,当前开源模型有短板。智源研究院联合发布 Video-XL-2,多维度优化长视频理解能力,还设计效率优化策略,在主流评测基准表现出色,有广泛应用潜力。

机器之心
开源动态8

央企牵头!这个AI开源社区要让模型跑遍「中国芯」

6月30日百度文心模型4.5系列开源并登陆魔乐社区,该社区发起‘模型推理适配协作计划’,想让模型跑遍中国芯。其升级工具中心和协作空间,联动产业力量,解决模型在国产芯适配难题,推动生态发展。

机器之心
算法论文8

模型多模态检索全面超越SOTA!ReCALL框架化解生成式与判别式的范式冲突|CVPR'26

紫东太初团队联合新加坡国立学攻克模型检索难题,其ReCALL框架以‘诊断 - 生成 - 校准’闭环体系解决范式冲突,让模型变身高效检索器,成果被CVPR 2026录用,刷新SOTA性能。

量子位
产品应用8

杭州跑出的AI独角兽,突围模型的“第二战场” | 甲子光年

2025年AI行业有转变,算力堆叠对语言模型性能提升放缓,空间智能成“第二战场”。谷歌、英伟达等巨头纷纷布局,群核科技作为杭州“变量”,发布业界首个3D室内空间模型,构建数据飞轮,技术有望落地多领域。

甲子光年
开源动态7

Qwen3小升级即SOTA,开源模型王座快变中国内部赛了

开源模型进入中国时间,Kimi K2风头正盛时,Qwen3迎来升级,235B总参数量仅为Kimi K2四分之一,基准测试性能却超它。Qwen官方不再用混合思维模式,新模型仅支持非思考模式,此次是小更新,招在后头。

量子位
新闻资讯8

刚刚,智源全新「悟界」系列模型炸场!AI第一次真正「看见」宏观-微观双宇宙

6月6日第七届智源会,智源研究院推出全新「悟界」系列模型,含原生多模态世界模型Emu3、脑科学多模态通用基础模型见微Brainμ等,反映其对模型发展的研判,推动AI向物理世界迈进。

机器之心
产品应用7

昇腾910B模型实测:开源框架能不能打?真相全放这了

文章对昇腾 910B 模型进行实测,对比 vLLM Ascend 与 MindIE 在实际推理场景中的性能差异。通过 GPUStack 平台测试多种模型,结果显示两者在不同部署场景各有优势,vLLM 适合单卡小模型,MindIE 适合模型多卡部署。

探索AGI
产品应用7

高考数学全卷重赛!一道题难倒所有模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态模型

机器之心
开源动态8

阿里AI 重磅第4发:电影级MOE 视频模型Wan2.2正式开源!

阿里通义团队开源电影级视频生成模型Wan2.2,将光影、色彩、镜头语言装进模型,支持60多参数自由组合。它是业界首个用MoE架构的视频生成模型,推理省计算资源,性能超主流模型,获国外网友盛赞。

AGI Hunt