模态融合」共找到 666 篇相关文章

算法论文8

PRSA 2025 | RPI Nithin Somasekharan、Shaowu Pan(潘韶武):突破柯尔莫哥洛夫屏障——面向模型降阶的可学习加权混合自编码器

本文将线性POD与非线性Autoencoder通过可学习参数融合,提出可学习加权混合自编码器架构。在多数据集验证中,该方法克服了POD和纯AE的局限,在复杂PDE系统预测中表现出色,或可降低大规模计算成本。

力学与人工智能
新闻资讯7

4天100万下载,这个移动端Agent直接给谷歌偷家了。

蚂蚁的全模态助手灵光爆火,上线4天下载量达100万,三天冲上App Store总榜第六。它提前实现了谷歌AI Studio移动版的核心能力,以简洁报告输出和多智能体协作架构获市场认可,有望让创造力平权。

探索AGI
产品应用8

钉钉不说话,默默把 AI 表格干到了 1000 万热行

钉钉 AI 表格单表容量突破 1000 万热行,成业内首个实现该能力的智能表格。它基于阿里 AI 技术重构底层架构,实现性能与智能融合,在业务场景应用效果好,推动 AI 办公进入‘原生时代’。

MacTalk
新闻资讯7

老黄回应英伟达入股英特尔

英伟达50亿美元入股英特尔,将持有超4%股份成大股东之一。双方要联合开发用于PC和数据中心的AI芯片,未来芯片或成CPU与GPU融合的超级芯片。此合作或冲击AMD和台积电。

量子位
开源动态8

DeepSeek-V3.2正式版发布,将开源模型的能力推向极致

DeepSeek-V3.2正式版开源,包含标准版和Special版。它采用稀疏注意力机制,降低计算复杂度。后训练阶段有多项算法改进,支撑高难度推理。还融合思考与工具使用,合成训练数据,在智能体评测表现优异。

AIGC开放社区
新闻资讯8

瓦卡奖AI视觉创意大赛·从人工智能专家跨文化对话到全球AI厂商的竞技

10月17 - 19日,第二届瓦卡奖AI视觉创意大赛在深圳举行。期间AI全球视觉工作坊汇聚专家探讨AI与艺术融合,竞技日集结全球AI视频厂商民间团队参赛。大赛还发布国内首部《AI视觉创意应用蓝皮书》。

MANA新媒体艺术站
7

谷歌突砍Gemini免费版炸锅,数据养模遭背刺?GPT-5.2突袭Gemini 3,Demis Hassabis:谷歌须占最强位

近日谷歌收紧Gemini API免费层级限制,引发开发者不满。与此同时,OpenAI计划提前发布GPT - 5.2应战。Google DeepMind CEO Demis Hassabis表示谷歌要占最强位,对Gemini 3满意,还介绍了谷歌未来三个发力方向。

AI前线
开源动态7

野生DeepSeek火了,速度碾压官方版,权重开源

近日,德国AI咨询公司TNG推出的「DeepSeek R1T2」模型火了,速度比R1快20%,性能不弱于R1。它采用AoE技术,融合官方三大模型,开源且在Hugging Face开放权重,获不少人期待。

机器之心
算法论文8

大模型听懂语音却反而变笨?港中深与微软联合解决语音大模型降智问题

从GPT - 4o开启全能交互时代后,Speech LLM面临“模态推理鸿沟”问题,输入从文本变语音,推理能力显著衰退。港中深与微软联合提出TARS框架,通过三项创新解决此问题,实验显示推理能力100%复原。

机器之心
新闻资讯7

座舱芯片,谁能从高通手中抢市场?

座舱芯片领域,高通凭借技术和生态优势成为霸主,与全球主流车企合作稳定。但本土厂商如MTK、芯擎等通过成本、本土化服务等错位竞争提升份额。同时,舱驾融合虽为趋势,但推进难度大。

芯师爷