电影生成系统」共找到 3706 篇相关文章

产品应用7

FairyGen:AI 把孩子的画“动”起来,个性化教育和动画创作

FairyGen 能将孩子画作变成卡通短片,通过多模态大语言模型构思分镜脚本,采用分层建模处理前景人物动作与背景动态。其生成流程分四阶段,但也存在前景角色重建不准、背景生成不稳定等问题。

带你学AI
开源动态8

国产AI视频炸了!SkyReels-V3三大功能重磅开源,1张图生成逼真视频

昆仑天工SkyworkAI团队开源多模态视频生成模型SkyReels-V3,它能在一个架构内搞定参考图像转视频、视频延长、音频驱动虚拟形象三大核心能力,超越主流商业模型,且真正开源。

新智元
算法论文8

不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化

随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。

机器之心
算法论文8

LLM记忆管理终于不用“手把手教”了,新框架让智能体自主管理记忆系统

加州大学圣地亚哥分校和斯坦福大学研究人员提出强化学习框架Mem-α,用于训练LLM智能体自主管理记忆系统。它将记忆构建转为序列决策问题,采用多维度奖励函数,实验显示其全面超越现有方法。

量子位
开源动态8

训练时间减半,性能不降反升!腾讯混元开源图像生成高效强化方案MixGRPO

混元基础模型团队提出全新框架MixGRPO,结合SDE和ODE,简化MDP优化流程,提升效率与性能。还推出更快变体MixGRPO - Flash。MixGRPO训练时间降近50%,MixGRPO - Flash再降71%,效果和效率优于DanceGRPO。

量子位
产品应用7

吉卜力风「手游」爆火,可灵+Midjourney生成的!教程已出,支持复刻

吉卜力风格“手游”在Reddit和推特爆火,它由AI制作,创作者用可灵AI、Midjourney结合文字提示实现效果,公开教程支持复刻。还介绍了制作方法及提示词示例,可灵AI发展势头也很猛。

量子位
新闻资讯8

中国中文信息学会大模型与生成专委会2025大模型战略研讨会成功举办

2025年6月27日,中国中文信息学会大模型与生成专委会2025大模型战略研讨会在哈尔滨举办。会议探讨技术革命、交流成果、发布基金,多位专家作报告、参与思辨讨论,聚焦大模型多方面话题。

深度学习自然语言处理
开源动态8

全球首个!国产AI开源系统一周狂改百款软件,全程0人干预

中国正从「制造大国」迈向「智造强国」,国产工业软件面临性能瓶颈。面壁智能联合OpenBMB开源全球首个Stencil优化AI系统ForgeStencil,1周自动优化100+软件,全程0人干预,提升研发效率,切中制造业升级诉求。

新智元
新闻资讯8

股价暴涨32%!GLM-5登顶全球开源第一,25分钟一镜到底搓出完整系统

2026年初,智谱GLM - 5上线,它是全球首个在系统级工程能力上与硅谷巨头正面竞争的开源模型,发布后智谱股价暴涨32%。它能力惊艳,能完成复杂项目,成本可控,还适配国产算力。

新智元
算法论文8

Apple发布新SOTA Manzano:混合Tokenizer破解多模态统一难题,理解与生成双翼齐飞

多模态AI前景广,但现有模型在理解和生成任务上存在性能冲突。苹果提出Manzano模型,用混合视觉标记器降低任务冲突,结构简单可扩展,在多基准测试达SoTA水平,还展示图像编辑潜力。

深度学习自然语言处理