多角色对话视频生成」共找到 1701 篇相关文章

产品应用7

提示词分享:帮助在 Hacker News 或者 Reddit 这样的讨论贴中提取精华内容

分享了在 Hacker News 或 Reddit 讨论贴提取精华内容的提示词,介绍最佳模型为 Gemini 2.5 Pro,还给出角色定位、工作流程、写作风格技巧及禁止出现的表达方式。

宝玉AI
产品应用7

AI漫画“拍立得”上线:1句话1张照片,生成剧情完整连载

AI漫画创作“拍立得”时刻到来,一句话、一张照片、两分钟就能变成可分享的AI连载漫画。在文心APP魔法漫画功能里,玩法简单,还能续写、改编,降低了创作门槛,见证AI普惠走向现实。

量子位
开源动态8

ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节

格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。

机器之心
产品应用7

零代码、100%本地!三步生成企业级MCP,Postman这个新功能绝了~

作者发现Postman新增MCP Generator功能,拖拖点点就能构建MCP Server。以公共的HackerNews为例,介绍了筛选API、生成代码、配置Client三步生成企业级MCP的过程,还指出此功能适合快速接入标准化REST API。

探索AGI
产品应用8

稚晖君新大招:机器人二次开发0门槛了!

在智元机器人首届合作伙伴大会上,联合创始人稚晖君发布机器人动作与表达创作平台灵创平台。它以AI加持,能将机器人二次开发抽象成模块化工具,降低难度,适配多款机器人,10月上线beta版。

量子位
新闻资讯7

谷歌实验室推出了 Opal,一个用于创建 AI 迷你应用程序的可视化平台

谷歌实验室推出实验性无代码工具 Opal,可让用户通过自然语言和可视化编辑器创建 AI 小应用。它支持两种交互模式,开发完成后能分享链接。开发者关注其与微软产品竞争前景。

InfoQ
产品应用8

万万没想到,这家央企竟让香农和图灵又“握了一次手”

中国电信人工智能研究院研发布局的智传网(AI Flow),让信息技术和通信技术融合。在WAIC中,李学龙提出智传网三律,即信容律、同源律和集成律,打破传递智能的‘壁’,为数字世界带来深远影响。

量子位
推荐文章8

Claude团队大揭秘!如何调动多智能体搞深度搜索

Claude团队分享用多智能体构建深度搜索的心得,展示有效多智能体研究系统架构,涵盖系统架构、提示工程、评估方法等内容,还提及系统面临的问题、挑战及额外建议。

量子位
算法论文8

UofT、UBC、MIT和复旦等联合发布:扩散模型驱动的异常检测与生成全面综述

多伦多大学、麻省理工学院等高校研究者合作完成长文综述,聚焦扩散模型在异常检测与生成领域的应用,梳理图像、视频等异常检测任务进展,提供分类体系,展望未来趋势。

机器之心
算法论文8

苹果新作:内化视觉思考,推理提速 5 倍

Apple研究团队提出Internalized Visual Thinking(IVT),一种将预测性世界建模能力内化到模型表征中的后训练框架。它在训练时预测未来,推理时直接回答,相比Visual CoT推理提速超5倍。

机器之心