图像和视频换脸」共找到 7588 篇相关文章

产品应用8

一手实测全新的Sora 2 - AI视频的ChatGPT时刻到来了。

OpenAI发布Sora 2Sora APP,Sora 2是视频音频生成模型,在运动质量、人物表演、音频生成等方面表现出色;Sora APP类似AI版抖音,有社交互动“cameos”功能,但产品未来尚不明朗。

数字生命卡兹克
开源动态8

万帧?单卡!智源研究院开源轻量级超长视频理解模型Video-XL-2

视频理解是多模态大模型关键能力,当前开源模型有短板。智源研究院联合发布 Video-XL-2,多维度优化长视频理解能力,还设计效率优化策略,在主流评测基准表现出色,有广泛应用潜力。

机器之心
新闻资讯7

叫板 OpenAI Sora?Manus 推出文生视频服务,计划向所有用户开放

近日,Manus AI 推出文本转视频生成服务,支持单条提示完成视频制作,目前供部分订阅用户抢先体验,计划向所有用户开放,对标 OpenAI Sora 等竞品。其母公司获投资,还与微软合作,系统有独特优势。

AI前线
开源动态8

人大微软开源Arbor,一棵假设树突破自主科研新高度

中国人民大学微软研究者推出Arbor,它将实验挂到假设树,让研究信息跨周期保留。在六道真实研究任务中表现优异,增益超CodexClaude Code,且成本相当,还能从失败中积累经验。

AIGC开放社区
产品应用8

ChatGPT Health重磅登场:可连接病历Apple Health,打造专属健康助手

OpenAI推出ChatGPT Health,可连接病历健康应用,基于用户健康信息回应。它有强化隐私保护,与医生合作设计,不取代医疗护理。先向部分早期用户开放,后续将面向网页iOS用户。

AI寒武纪
新闻资讯7

马斯克起诉OpenAI苹果垄断:App Store操纵排名,索赔数十亿美元

马斯克的xAI起诉OpenAI苹果反垄断,指控苹果操纵App Store排名偏袒ChatGPT、打压Grok,还称两家公司联手垄断AI市场。这不是他首次OpenAI对簿公堂,他与苹果也早有积怨。

量子位
开源动态8

ICML 2025 Spotlight | 用傅里叶分解探讨图像对抗扰动,代码已开源

文章聚焦图像对抗净化,现有基于扩散模型策略在时域难解耦干净像素与扰动,损害图像语义。作者从频域研究,用傅里叶分解,发现扰动倾向破坏高频谱,提出注入低频信息,效果显著,论文与代码已开源。

机器之心
算法论文8

极低成本,复现GPT-4o图像风格化一致性!NUS推出OmniConsistency

NUS ShowLab 推出 OmniConsistency,解决开源扩散模型在图像风格化一致性上与商业 API 的差距。它成本低,能在保持风格化效果时精准保留图像细节等,还解决了风格化与一致性的跷跷板问题,且兼容性强。

机器之心
新闻资讯7

男子老婆吵架,向AI求助推荐一条爬山线路散心被困悬崖

8月12日晚,杭州临安一小伙因老婆吵架,听AI推荐前往童公尖,被困在海拔1300多米处。救援持续到次日凌晨。救援队称这是首起靠AI推荐线路导致的救援,提醒AI无实际经验且不担责。

昆明走进自然户外
新闻资讯7

老外给中国 AI 开源厂商打分:第一梯队是 DeepSeek Qwen。

Nathan Lambert发布“中国开源模型开发商排名”,评估19家实验室贡献,第一梯队是DeepSeekQwen。还介绍字节跳动豆包、小米、百度文心一言发展情况,如豆包月活全球第二,小米模型效率突破,文心一言企业应用领先。

AI进修生