多主体视频生成」共找到 2692 篇相关文章

开源动态8

谷歌最强AI,被港科大开源超了?让海外创作者喊出「King Bomb」的P图大杀器来了

图像编辑与生成模型爆发,冲击Photoshop地位。港科大贾佳亚团队开源DreamOmni2,优化升级多模态指令编辑与生成能力,效果获海外创作者认可,还在实测中表现出色,其采用创新技术方案构建多模态生成体系。

机器之心
算法论文8

比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗

英伟达新研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握新动作、泛化到新环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。

新智元
新闻资讯7

马斯克宣布:Grok学会看片了!无字幕看懂陶哲轩菲奖级难题

马斯克宣布Grok可分析任何视频。它能对伪造视频鉴假溯源,但也有处理画面靠字幕、有幻觉问题和效果不稳定的缺陷。实测中它能理解无字幕视频,还整理访谈内容。这功能虽便利,但引发人类能力退化担忧。

新智元
产品应用8

Harness Engineering: C 端 AIGC 内容生产自优化实践

文章介绍蚂蚁保保险快查深度解读页面生成系统(DIPG),它将Harness思想用于C端AIGC生产链路。DIPG采用‘离线生成+校验+刷入DB’模式,解决LLM实时生成时延和质量问题,还阐述多Agent协作、校验机制及回灌流程等。

阿里云开发者
新闻资讯7

Gartner:生成式AI不会取代软件工程师

全球著名咨询调查机构Gartner官网发布专访,分析师Haritha Khandabattu认为生成式AI不会取代软件工程师,其可提高生产力。还谈及在招聘人才方面的变化及领导者助团队成功的关键措施。

AIGC开放社区
开源动态8

视频存储文本的黑科技!

memvid-rs是memvid的Rust重实现,可将文本文档编码为视频二维码实现存储和检索。它有高性能、用TRUE机器学习等特点,兼容多格式、跨平台,无需安装,适合存档文本语料库等。

GitHubStore
新闻资讯7

糟糕,大佬45年前论文,被判AI生成

随着AIGC增多,AI内容检测需求迫切,但表现远不及预期。如作家Adam Kay、教授Devi Sridhar等多人的作品被误判,原因或是AI用人类内容训练,使判断边界模糊。

机器之心
新闻资讯7

余家辉交卷!Meta MSL连发图像/视频模型

Meta MSL由余家辉带队发布图像模型Muse Image,开启视频模型Muse Video预览。Muse Image表现出色,采用独特创作流程,能与Muse Spark联动,有多种实用功能;Muse Video待改进,将未来几月推出。

量子位
新闻资讯7

震撼!人类第一张在太空生成的图片曝光

人类首张太空生成图片曝光,共绩科技与星测未来两家清华系企业携手开启「天地同算」时代。前者解决算力调度难题,后者让太空有算力可用,未来太空或成分布式超级计算机。

新智元
推荐文章7

第十一章 Deep Agents 实战——数据分析与报告生成

本章介绍构建营销内容 Agent,能分析产品数据、生成营销文案等。核心技术有结构化输出、多 Skill 水平组合、模拟数据分析。还对比传统营销与 Agent 流程,展示结构化输出优势及数据驱动决策方法。

CourseAI