变分自编码器」共找到 1169 篇相关文章

开源动态7

AI短剧生成神器

作者享开源的AI短剧生成工具,它能根据剧本完成智能镜、生成视频片段等一条龙服务,采用全局种子+风格继承改善人物和场景一致性,有镜编辑器可手动调控,适合多种人群。

GitHubStore
新闻资讯8

Anthropic 发布 AI-Native 软件开发流程:时代了,该换套模式了

Anthropic 8 月 21 日发布《The AI-Native SDLC Playbook》,指出传统软件开发生命周期(SDLC)流程重,已不适应 AI 时代。介绍了 AI 原生 SDLC,把旧管控目标和新执行方式结合,还六阶段阐述具体实践。

Founder Park
算法论文8

新SoTA方法RM-R1:让reward model对评说出原因!超越GPT4o

过去模型‘黑箱打’不透明、不灵活。论文提出ReasRM,经两阶段训练,让奖励模型像人类先思考再打。它能任务类型、动态奖励,实验中碾压GPT - 4,小模型逆袭,团队已开源6个模型。

深度学习自然语言处理
新闻资讯7

第一,实战拉胯!GPT Image 1.5被骂惨,奥特曼这波悬了

OpenAI推出新一代旗舰图像模型GPT Image 1.5,生图能力强,免费用户可上手,开发者能调用API。它在跑榜单成绩优异,但网友实测发现是‘高低能’,引发吐槽。此外,其API价格降20%,此次更新是回击谷歌。

新智元
新闻资讯7

ChatGPT转型计划曝光!不再只是回答问题,而是通过穿插使用工具身行动助手

OpenAI CPO Kevin Weil在访谈中透露,ChatGPT将从回答问题转为为用户做事,通过穿插使用工具解决复杂问题。当下模型成本已是GPT - 4的500倍,未来将不断降低API价格,还提及模型效率突破关键等内容。

量子位
产品应用7

FairyGen:AI 把孩子的画“动”起来,个性化教育和动画创作

FairyGen 能将孩子画作成卡通短片,通过多模态大语言模型构思镜脚本,采用层建模处理前景人物动作与背景动态。其生成流程四阶段,但也存在前景角色重建不准、背景生成不稳定等问题。

带你学AI
产品应用8

抽象小视频秒特效大片:原视频精髓不角色环境任意换,Luma出品

Luma AI推出Modify Video玩法,能将抽象小视频爆改为特效大片,可对角色、场景等任意换,还保留原视频动作运镜。能进行视频动捕、风格迁移、单个元素编辑,性能超越同行Runway。

量子位
开源动态7

NovaSR:一个52KB的音频超模型,把16kHz模糊音频成48kHz清晰版

最近,只有52KB的音频超辨率模型NovaSR开源,能把16kHz模糊音频成48kHz清晰版,处理速度极快,可实时处理音频流。它能提升TTS模型质量等,虽有不足,但平衡了速度与质量。

AI工程化
产品应用8

硬刚Sora2,万相2.6轻松定制角色、控制镜,普通人也能当导演

2025 年视频生成领域发展迅猛,OpenAI 的 Sora 2 带来新玩法,商业落地加速,但普通用户体验门槛高。12 月 16 日阿里发布万相 2.6 系列模型,功能全面升级,实测效果惊人,标志 AI 视频生成迈向精准可控新阶段。

机器之心
新闻资讯7

刚刚,OpenAI公司结构重大调整:继续由非营利实体控制,营利性部门要公益公司

OpenAI官方宣布公司结构重大调整,将继续由非营利组织控制,现有营利部门成公益公司(PBC),非营利组织控制PBC并成大股东,二者使命相同。这是与相关部门对话后决定。

量子位