参考图像转视频」共找到 1473 篇相关文章

产品应用8

谷歌nano banana正式上线:单图成本不到3毛钱,比OpenAI便宜95%

昨晚谷歌图像生成与编辑模型nano banana上线,正式名gemini - 2.5 - flash - image - preview。它有强大能力,成本低,有多种玩法,上线后测试火爆,在多个榜单成绩优异。

机器之心
开源动态7

这几个开源项目火起来啦,抓紧收藏哟起来!!!

本文介绍三个热门开源项目。KnowNote 是本地优先的 AI 知识笔记工具,是 Google NotebookLM 开源替代方案;Remotion 让开发者用 React 技术栈制作视频;Superpowers 可让 AI 编程助手升级为智能开发伙伴。

小华同学ai
开源动态8

4 天 6.8K Star,这个 AI 漫剧项目火了:waoowaoo!

短剧/漫剧市场火爆,但普通人制作门槛高。waoowaoo是solo开发者作品,4天6.8K Star。它能从小说文本一键生成视频,涵盖AI剧本分析、角色场景生成等功能,部署简单,技术栈主流。

开源星探
开源动态7

AI 剪辑杀器 CutClaw 开源了!再也不用手动卡点了!

CutClaw是面向长视频与音乐的端到端自动剪辑系统,可自动解析素材,按文字指令生成踩点短片,部署简单,有短期和长期目标,也给出运行慢的原因与优化建议。

GitHubStore
产品应用8

机器人GPT时刻!英伟达WAM赋予全机器人零样本操作能力

英伟达发布世界动作模型 DreamZero,通过耦合视频生成与动作预测,让机器人有物理直觉,能在陌生环境完成复杂任务。它用异构数据学习,适配不同机体,还经优化实现高速推理。

AIGC开放社区
算法论文8

ICCV 25 Highlight | 扩散过程「早预警」实现6x加速,AIGC生图的高效后门防御

随着AIGC图像生成技术流行,后门攻击威胁开源社区,传统防御技术难适配。本文作者来自多所高校,提出输入级防御框架NaviT2I,基于神经元激活差异检测样本,加速检测,性能优。

机器之心
8

4倍无损压缩Diffusion,6倍加速!仅需时间特征维护 | TPAMI'25

扩散模型时间特征对量化敏感,现有量化方法会致其扰动,影响图像质量。港科大等多校团队提出TFMQ - DM框架,优化时间特征相关模块,提升低比特量化性能,实现硬件加速。

新智元
新闻资讯7

OpenAI o3-pro模型发布,但不能聊天

当地时间6月10日,OpenAI o3 - pro模型发布,ChatGPT Pro用户可通过API使用。它是o3子版本,在多领域表现出色,但响应慢,适用于对可靠性要求高的难题。目前临时聊天功能停用,不支持图像生成和Canvas。

AI前线
算法论文8

ICLR 2026 | 救命,手机Live Photo重选封面终于不糊了

vivo 蓝图实验室与南开大学联合发布研究,被 ICLR 2026 接收。该研究定义了 Live Photo 重选封面帧修复任务,提出 LiveMoments 方案,利用原始封面帧作参考提升画质,实验表现优,应用场景广。

机器之心
开源动态8

本周 5 个火火火的Github开源项目,每个都很有说法!

本周介绍5个Github开源项目。ai - berkshire将投资大师方法论系统化;stremio - web聚合视频资源;archify能将大白话描述变成架构图;Maple - font是优化的编程字体;Netcatty整合SSH客户端等功能。

开源先锋