多模态技术」共找到 3527 篇相关文章

产品应用8

“图片秒生”,腾讯混元图像2.0模型正式发布,主打速度和真实感

5月16日,腾讯发布混元图像2.0模型,率先实现实时生图,生图速度快、质量高,能避免‘AI味’。在GenEval基准上准确率超95%,还发布实时绘画板功能,后续将推原生多模态模型。

AI科技大本营
新闻资讯8

库里被「采访」、杨紫被「演」短剧?别慌!蚂蚁AI鉴真拿下CVPR 2026冠军,专治黑产

深度伪造技术滥用,明星成换脸受害者,引发社会关注。蚂蚁集团AI安全实验室队伍MICV获CVPR 2026挑战赛冠军,还发布检测资源仓库。团队提出基于DINOv3的框架,解决AIGC检测难题,成果显著。

机器之心
推荐文章7

GAN之父Ian Goodfellow病后归来,剑指高效世界模型

GAN之父Ian Goodfellow等提出,利用符号化表示和游戏虚拟世界数据,或为构建动作条件多模态世界模型最佳路径,该模型可支持长时序任务预测与规划,还探讨构建原因、数据来源等。

机器之心
新闻资讯7

谷歌开始肢解DeepMind,数个团队被划归总部

DeepMind换帅一周后震荡持续,谷歌将拆分它,把部分非技术团队转入谷歌汇报体系。谷歌联合创始人谢尔盖·布林重新介入Gemini。此外,Gemini因算力、内讧、官僚等问题落后。

量子位
开源动态8

最强开源VLM“华山论剑”丨多模态专场直播

近期Intern - S1等多模态大模型开源,引发热烈讨论。本周四OpenMMLab等发起AI Insight多模态专场,邀请模型核心研发者分享,涵盖模型设计思路、实践经验等,还有圆桌对谈。

OpenMMLab
新闻资讯7

一等奖20万,大佬们出题,最硬核视频生成全球挑战赛开启!

首个AI视频生成全球挑战赛来袭,多位大佬发起,20万大奖待拿。大赛聚焦AI视频生成「一致性」挑战,设主赛道和创意赛道,分别面向技术派和创作者,旨在推动视频生成技术发展。

新智元
算法论文7

Transformer与RNN合体,谷歌打下显存门槛,解锁超长上下文

谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生长的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更长文本、降低推理资源门槛,实验显示有良好效果。

机器之心
新闻资讯8

5Y News|祝贺摩尔线程成功登陆科创板!

2025年12月5日,摩尔线程在科创板上市,成中国首家登陆资本市场的全功能GPU企业。它以自主创新为根基研发芯片,构建起技术体系,商业表现佳,上市募资将投入芯片研发,助力国家数字经济发展。

五源资本 5Y Capital
7

担心被曝“于谦门”,57岁的于谦到底用龙虾做了什么?

于谦视频播客《多新鲜呐》最新一期,本质是“AI产品用户体验公开测试”。于谦作为测试员,关注点在结果、省事、风险等,节目把技术叙事换成生活叙事,帮AI面向大众转译。

量子位
开源动态8

商汤SenseNova U1深度拆解,原生统一架构终结缝合时代

文章深度拆解商汤科技开源的新一代模型「日日新 SenseNova U1」,介绍其基于 NEO - Unify 原生统一架构,在数据、训练与推理深度协同,多维度测试成绩亮眼,代表多模态从拼接走向原生建模新方向。

机器之心