视频创作自动化」共找到 1647 篇相关文章

算法论文7

让AI创作不千篇一律,提示词随机插词汇就行

最新研究发现,在AI开写前由人类提供开头或随机插入词汇,写作效果会更多样,AI写作同质化或因“启动条件”问题。研究创建三类同质化评价指标,还发现向系统提示注入随机词汇可提升模型输出多样性。

量子位
产品应用7

Manus突发上新文生图!告别“抽卡”,Agent+深度思考联合创作

Manus深夜官宣支持生成图像,与一般AI绘图工具不同,它能理解画图目的,规划方案后再生成。它可完成如房间装修可视化、饮料瓶设计等任务。目前已开放注册,不过付费价格遭网友吐槽。

量子位
产品应用7

Codex自改进Prompt:让AI自己把重复工作变成自动化

开发者Vaibhav更新的Codex自改进Prompt引发AI开发者群体讨论,被OpenAI联合创始人转发。完整版核心逻辑可拆解为8步,加了严格跳过规则。实测有反馈,也有优化建议和现存问题。

AI工程化
新闻资讯7

神秘「欢乐马」霸榜视频模型!本以为Seedance2.0已封神…

神秘模型HappyHorse - 1.0悄然登顶Artificial Analysis的AI Video Arena排行榜,在多个赛道力压Seedance等模型,呈现断层式碾压。它或出自阿里淘天未来生活实验室,据说完全开源,10号将正式发布。

量子位
开源动态7

OpenMAIC:一键生成互动课堂,视频+PPT全都有,还可以编辑

清华开源项目OpenMAIC是多智能体互动课堂,上传文档或描述主题,几分钟就能生成虚拟课堂,AI教授讲课、同学讨论,还有白板功能。底层用LangGraph编排,支持主流模型,有OpenClaw集成,架构完整。

AI工程化
算法论文8

代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈

ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。

新智元
开源动态8

开源PDF表单自动化神器,一行命令,把静态 PDF 变成交互表单!

平时拿到的PDF表单大多无法直接填写,操作繁琐。GitHub上的开源工具CommonForms能自动识别PDF表单区域,一键生成可填写的交互式表单,基于深度学习模型FFDNet,功能强大且使用简单,还保障数据隐私。

开源星探
产品应用7

FairyGen:AI 把孩子的画“动”起来,个性化教育和动画创作

FairyGen 能将孩子画作变成卡通短片,通过多模态大语言模型构思分镜脚本,采用分层建模处理前景人物动作与背景动态。其生成流程分四阶段,但也存在前景角色重建不准、背景生成不稳定等问题。

带你学AI
算法论文8

李飞飞又被超越了?百万「普通视频」打造通用4D世界模型!

全行业为昂贵多视角数据发愁时,中科院和CreateAI推出NeoVerse,用百万单目视频打开4D世界模型大门。它抛弃多视角数据和离线预处理,解决扩展性瓶颈,在重建速度、生成质量等方面表现出色,有丰富下游应用。

新智元
算法论文8

视频刷多了AI也会变蠢!“年度最令人不安的论文”

最新研究显示,大模型灌多垃圾内容会‘脑损伤’,研究人员用不同维度定义垃圾数据并训练模型,测试其核心能力,发现垃圾数据致认知下降,且损伤不可逆,还给出行业启发。

量子位