参考生」共找到 280 篇相关文章

产品应用8

这是我花9毛钱拍的《Meta老板砸钱把我从苹果挖走》

国产AI开启新Level,数科技的Vidu Q1参考生视频功能,9毛钱+4张图就能成视频。它重新定义叙事,砍分镜、拍摄等流程;有业内最强一致性;价格低,让AI视频成“快、好、省”。

量子位
产品应用7

一致性对标Nano Banana,国产Vidu Q1同时支持7张参考 | 实测

AI图赛道竞争激烈,专注视频大模型的Vidu推出Q1参考生图模型,能同时支持7张参考图,主体一致性对标谷歌Nano Banana。实测玩法多样,有高可操作性,现已全球同步上线。

量子位
算法论文8

VLM会描述视频,却未必用对参考图:RefCaptioner让参考图与视频语义精准对应

多模态大模型处理多参考图与视频对应关系能力不足。为此提出 RefCaptioner,强化模型对参考图识别感应能力、优化输出格式与奖励函数;还构建 MRVBench 评测基准,实验显示其表现优异。

机器之心
产品应用8

数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务

数科技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。数科技双轨布局,Vidu与MotuBrain同根。

量子位
开源动态8

智谱联合清华开源多图参考视频成模型,带来主体一致性新高度

合肥工业大学、清华大学和智谱开源多主体参考视频成模型Kaleido。它用全新数据构建法和精巧架构,解决主角与背景混淆难题,实验显示其在多维度表现优异,超越现有开源模型。

AIGC开放社区
Product Application7

Wan 2.6 发布,可以参考视频进行角色扮演 & 终于有积分了:每天 150

Wan 2.6发布,积分从每天10个提升到150个。更新了主演、多镜头叙事、图像成等新功能,如可将参考视频角色放入新场景,简单提示自动成多镜头叙事视频等。

AI进修生
产品应用8

AI视频成走向「演技成」时代,数科技Vidu全球发布Vidu Q2

9月25日,数科技全球上线新一代图视频大模型Vidu Q2,打破AI成表情假、动作飘忽等问题,实现从“视频成”到“演技成”跨越,有AI演技动、镜头语言丰富等亮点,已多端上线。

机器之心
新闻资讯8

专访何佳坤 - 英语高考50分的00后体育,却用AI年销3000万。

本文讲述00后体育何佳坤的外贸创业故事。他高考英语50分,却借助AI做外贸,从大学创业起步,业务不断发展。他将AI用于翻译、售后、招聘等各环节,2023 - 2025年营收持续增长,体现AI在打破语言文化差异上的巨大作用。

数字生命卡兹克
7

三位哈佛辍学,如何将专用芯片变成估值百亿美元的 AI 算力公司

文章聚焦 Etched 公司,分析推理成 AI 算力主战场背景,介绍三位哈佛辍学创始人故事,阐述其从芯片到推理集群的产品打造,还提及团队、文化、资本情况,最后分析竞争格局与前景。

投资实习所
算法论文8

清华大学x数科技:从波形到隐空间,AudioLBM引领音频超分新范式

音频超分辨率是提升音频体验的关键技术,但高频细节损失是挑战。OpenAI的Sora 2树立高保真音频成标杆,现有学术模型有局限。清华与数科技团队发表两项成果,AudioLBM展现通用高分辨率音频成潜力。

量子位