图像和视频换脸」共找到 7588 篇相关文章

新闻资讯8

英伟达新GPU,超长上下文/视频生成专用

在AI Infra Summit上,英伟达宣布推出NVIDIA Rubin CPX GPU,专为处理百万token级代码生成生成式视频应用。它是首款为超大上下文AI量身定制的CUDA GPU,性能强且能效高,预计2026年底推出。

量子位
产品应用7

Gemini AI /Nano Banana Pro图像无损去水印工具

这是基于Javascript的纯浏览器端Gemini AI图像无损去水印工具,用反向Alpha混合算法,有纯浏览器端处理、隐私保护等特性,介绍使用方法、算法原理等。

GitHubStore
算法论文8

演讲生成黑科技,PresentAgent从文本到演讲视频

联合团队提出 PresentAgent,能将长篇文档转化为带解说演示视频。采用模块化流程,还引入 PresentEval 评估框架。实验显示其接近人类表现,优于现有方案,展现了多模态智能体潜力。

机器之心
开源动态8

手机上同步用 Claude Code Codex,666啊~

开发者常遇AI编程任务运行时需离开电脑的困扰。开源项目`Happy`是Claude CodeCodex的移动端及Web客户端解决方案,有跨端控制、实时同步等功能,助开发者随时随地管理会话。

开源先锋
产品应用7

Grab 订阅平台从 SQS Redis 切换到 Temporal

Grab基于Temporal构建新的GrabUnlimited架构,增强用户体验,将订阅平台生产事件减少80%。原架构用SQSRedis,随订阅者增多问题频出,新架构利用Temporal特性解决诸多难题。

InfoQ
产品应用8

松下发布多模态大模型,文本、图像、音频随意切换

多模态数据处理成热点,但现有模型处理复杂任务有挑战。松下开发多模态大模型OmniFlow,采用模块化设计、多模态引导机制,实验显示其在多任务中有卓越表现。

AIGC开放社区
新闻资讯8

刚刚,OpenClawCursor杀入手机!Agent从此塞进口袋

OpenClawCursor同日发布原生App,OpenClaw上架全血原生App,可无缝交互,解锁设备底层能力;Cursor发布iOS应用公开测试版,可让开发者在手机上指挥代码开发,重塑人类工作方式。

新智元
新闻资讯7

ChatGPT群聊来了,Slack钉钉要哭了

ChatGPT上线群聊功能,目前处于试点阶段。它与Slack、钉钉不同,是在AI里长出协同。有潜水主动两种互动模式,还将加入多种功能,或改变协作赛道格局。

newtype AI
推荐文章7

中美 NeoLab 对话:模型 Agent 如何实现「持续学习」?

在新加坡 AGI Playground 2026 舞台上,AMI Labs 林敏 Mind Lab Andrew Chen 深度对谈,探讨 Agent 如何将经验转化为能力、持续学习。两人对持续学习给出不同答案,还讨论记忆、学习等基础问题及解决办法。

Founder Park
推荐文章7

Model Agent 越来越强,为什么 AI 仍然难用?

文章指出 AI 行业误判将‘Agent 完成任务’等同于‘用户完成工作’,存在‘Agent 能力—用户可用性鸿沟’。强调 Product 应承担复杂度,以记忆、流程界面为基础,让 AI 更好用于普通人的持续工作,还介绍了 Kition 实践。

InfoQ