多人物视频生成」共找到 2700 篇相关文章

产品应用8

文心快码正式发布 AI IDE,生成超 43% 百度新增代码

6月23日,百度副总裁陈洋发布文心快码独立AI原生开发环境工具Comate AI IDE,这是行业首个多模态、多智能体协同的AI IDE。目前文心快码生成代码占百度每天新增代码超43%,在多方面有显著优势。

InfoQ
开源动态8

蚂蚁发布全球首个视频-动作世界模型,开源即刷新世界纪录

从Sora惊艳亮相到谷歌开放Genie 3线上体验,世界模型从概念走向交互世界。蚂蚁旗下蚂蚁灵波开源全球首个视频 - 动作世界模型LingBot - VA,可驱动机器人完成复杂操作,解决长时漂移等问题,还提出工程化解法。

MacTalk
开源动态7

真是天才!有人把做软著做成了skill,自动生成全套软著申请材料

介绍了SoftwareCopyright - Skill,它能一键生成符合软著申报要求的源代码文档和用户操作手册,全链路自动化,功能特点多,如真实代码抽取、智能合规排版等,还给出项目链接。

开源AI项目落地
新闻资讯7

“无限可能”AI视频竞演第二阶段结果揭晓,11部作品入围深圳路演大会

3月8日,“无限可能”AI视频竞演完成二阶段评审,11部作品从50部入围作品中选出,晋级3月14日深圳路演大会。作品经“幻镜”AI视听测评季第三季测评,结果将现场公布。

郎园Station
产品应用8

一张图生成雕刻级 3D 模型,效率拉满,绝了!

Hi3D是商品级3D模型生成工具,在Hugging Face上连续三周霸榜下载第一。其2.0版本能自动补全不可见结构、消除环境光干扰、优化人像细节。操作简单,还有多种玩法场景,官方还提供兑换码福利。

开源先锋
产品应用7

Gemini CLI 重磅更新:现已支持音视频处理,并带来多项体验升级

Gemini CLI 迎来重磅更新,带来多项改进。新增音视频输入(暂未正式开启)、增强 Markdown 功能,集成 VSCodium 和 Neovim,技术栈升级至 Ink 6 和 React 19,还有主题更新、隐私管理等优化。

AI寒武纪
开源动态8

5B参数+4060Ti,10秒出图,全流程开源可复现!补齐统一多模态生成编辑的开源版图,让高质量图像生成真正变得更轻量、更普及

近日,多机构联合发布统一多模态生成编辑模型DeepGen 1.0,仅5B参数,集成五大能力,4060ti 16G上10秒出图,多项指标超大4倍工业级模型。团队开源全流程代码与数据,可从零复现。

量子位
产品应用7

国内首个!360发布“纳米漫剧流水线”,AI漫剧生成进入工业化时代

1月29日,360宣布国内首个工业级AI漫剧智能体生产平台“纳米漫剧流水线”公测。它整合多环节,素材生成成功率超90%,单集制作缩至1小时内,已和多家公司合作,推动构建行业标准。

量子位
算法论文8

何恺明组三位本科生领衔!持续聚焦Flow模型,突破归一化流生成效率瓶颈

何恺明团队新作聚焦Flow模型,提出双向归一化流(BiFlow)框架,解耦前向与逆向过程,打破传统归一化流生成模型效率低下问题。三位一作是本科生,实验显示其速度和质量表现出色。

量子位
产品应用8

Meta「轻量级」KernelLLM颠覆GPU内核生成,8B参数碾压GPT-4o

Meta推出基于Llama 3.1微调的8B参数KernelLLM,能将PyTorch代码转高效Triton GPU内核。实测单次推理性能超GPT - 4o和DeepSeek V3,多次生成得分更高,让内核开发更易上手。

新智元