多对象融合」共找到 4474 篇相关文章

开源动态8

为训推加速!全新FlashQLA注意力算子库开源

自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上场景加速,提升预训练和端侧推理效率。

千问大模型
算法论文8

打破确定性魔咒!北航团队提出VBF++:用“不确定性建模”刷新模态视频推荐 SOTA

北京航空航天大学和北京邮电大学联合提出VBF++框架,将模态融合从“点估计”升级为“分布建模”。它由上下文感知先验、推荐引导的对抗优化和元学习三大组件构成,在个数据集上刷新SOTA。

AI前线
开源动态7

OVI:统一的音视频生成模型,声音与画面同步诞生

音视频生成领域以往阶段架构易致音画不同步等问题。耶鲁大学团队提出 OVI 统一范式,采用双塔 DiT 架构与分块式跨模态融合机制,实现音画同步生成,不过目前有计算开销大、音频有局限等问题。

带你学AI
推荐文章8

传感器如何赋能精细化工行业?丨郭源生细说传感器

文章聚焦精细化工行业的智能传感器,阐述其应用前景、产业现状等。指出传统传感器短板,介绍前沿技术与传感器融合方案,预测市场规模与用量,分析智能化瓶颈并给出突破路径与建议,推动行业高端化升级。

芯师爷
开源动态7

困在产业落地的数据流通,开源会成为“破局点”吗?

AI时代数据成生产要素,但可信流通困于产业落地。8月14日隐语开源社区三周年升级,扩容为‘隐语·数据可信流通技术社区’,覆盖技术路线。其以开源降低应用门槛,或改写数据产业规则。

InfoQ
产品应用8

AI深度应用关键元年,快手重塑内容与商业价值

2025年是AI深度应用元年,AI走向产业级价值兑现。快手在1024程序员节展示AI与业务融合布局。程一笑称竞争关键是结合AI与场景,快手构建技术与应用栈,各业务成果显著,推动全链路AI重塑。

机器之心
新闻资讯7

首创郎园成功举办AIGC视听产业人才新生态大会

2025年首创郎园AIGC视听产业人才新生态大会在北京举办,由机构联合主办,众高校、企业及嘉宾参与。大会聚焦构建产业‘星探’平台,展示成果、成立矩阵、发布资源包、启动大赛等,推动人才与产业对接。

郎园Station
新闻资讯8

全国首部!AI 大模型私有化部署标准起草单位 / 个人征集启动!

国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》立项,正征集起草单位和起草人。该标准全流程覆盖、方面融合、三方协作,能解决企业部署痛点,构建安全可信生态。

AI大模型应用实践
开源动态8

清华团队开源发布首个结构化数据通用大模型

2025年8月29日,清华崔鹏教授团队联合稳准智能开源“极数”(Limi X)结构化数据通用大模型。它融合结构因果推断与预训练技术,适配任务,性能超最优专用模型,已落地个工业场景。

AI科技评论
算法论文8

首帧的真正秘密被揭开了:视频生成模型竟然把它当成「记忆体」

UMD、USC、MIT研究团队发现视频生成模型会把首帧当作‘概念记忆体’,将视觉实体存于首帧并在后续复用。基于此提出轻量方法FFGo,用少量例子让模型实现SOTA级视频定制。

机器之心