演示文稿生成」共找到 2278 篇相关文章

算法论文8

AI「看不懂」、「做不好」视频的问题,混元用「MTSS」解决了

腾讯混元团队提出 Multi-Stream Scene Script(MTSS)新视频描述范式,将传统方式升级为‘多流结构化剧本’。它解决了传统方式语义冗余、扩展性差等问题,在视频理解和生成任务表现显著。

机器之心
算法论文8

任意图像+视频=无限创意!港科大BiCo:AI视频进入组合时代,随意换角

BiCo是创新AI视觉内容生成方法,能灵活组合图像和视频视觉概念实现可控编辑。它解决现有方法在概念提取和组合上的问题,在多方面表现优异,可用于视频制作、艺术创作等领域。

新智元
产品应用8

首钢园社群•邻里Station实战活动课:让AIGC掀起效率革命

7月16日晚,首钢园社群•邻里Station举办“AI视频生成与应用”实战活动课,聚焦AIGC前沿趋势。授课达人展示前沿AI平台案例,还进行多环节教学,剖析行业趋势,首钢园为学习实践提供好环境。

首钢园
产品应用7

今天起,Claude Design要把设计师和程序员变成同一种人了

Anthropic官宣Claude Design大版本更新,有四大亮点,如设计系统一键导入、代码双向同步等。设计师亲自演示新功能,还引出两条新命令。设计工具领域竞争激烈,背后是科技巨头抢占用户入口。

新智元
开源动态7

这个 AI 股票分析项目,居然快 2w star了?!

A股行情火热,盯盘分析耗时耗力。Github上的开源项目`daily_stock_analysis`基于AI大模型构建,能自动分析股票行情等,生成“AI决策仪表盘”,给出投资参考建议,目前已获18.1k+ Star。

开源先锋
产品应用7

把 Nano Banana/Gemini 3 Pro 榨干!这几点你必须知道

Gemini 3 放出 Pro 和 Nano Banana Pro 两条线,前者主打长上下文、多模态推理,后者专攻像素级生成。文章提炼精髓,给出“通用 + 像素”双模实战笔记,介绍两者使用要点及创意场景实测。

PaperAgent
开源动态7

Voices 能够让 Java 应用程序快速实现文本到语音转换

Voices 是开源文本转语音项目,为 Java 17 及以上应用设计,无需外部 API 或手动安装软件。可按字典或 OpenVoice 为不同语言生成音频,其使用 ONNX Runtime 加速,还介绍了使用方法和配置。

InfoQ
产品应用7

AI+直播的新玩法! StreamDiffusionV2让创意零延迟

生成模型改变直播行业,但此前模型难保证时间一致性、有延迟等问题。加利福尼亚大学推出StreamDiffusionV2,通过智能调度和缓存机制优化,支持多GPU并行,可灵活调画质和延迟,实现实时直播。

带你学AI
开源动态7

DevProxy 0.28 发布,增加 AI 支持

微软发布 DevProxy 0.29 命令行工具,新版本增加 AI 支持,便于配置使用。它能模拟 API 及网络行为,结合 dev tunnels CLI 可检查云服务通信,还利用大模型生成文件,有重大架构变更等。

InfoQ
新闻资讯7

刚刚,OpenAI全员放假一周!被Meta高薪连挖8人「偷家」,真麻了

生成式AI竞争激烈,OpenAI却宣布全员放假一周,原因是被Meta高薪连挖8人。OpenAI高管承诺正面交锋,Mark Chen称不会袖手旁观,还鼓励员工留下,公司更专注实现通用人工智能。

机器之心