「对话式创作」共找到 1460 篇相关文章
别再乱学AI了!我花7天实践了张Zara的方法,从此告别焦虑
作者实践张Zara的AI学习法后告别焦虑,分享学习-实践-链接-输出的心法。包括高质量输入,如看长视频、跟随创造者、深度用产品;内化输出,如公开学习、与创造者交流、实践;还提及启动和持续输出要点及优质信息源。
一张图片+ 一条音频,照片开口说话唱歌,多角色、情绪控制都拿捏了。
腾讯混元联合腾讯音乐推出 HunyuanVideo - Avatar 模型,上传照片配音频就能生成动态视频。支持多风格角色、情绪控制和多角色对话,单角色模式已开源,技术有创新,在多数据集表现优。
ICML25 | 让耳朵「看见」方向!仅依靠360°全景视频,就能生成3D空间音频
空间音频技术成提升沉浸式体验关键,但现有技术未充分利用360°全景视频空间信息。OmniAudio研究可直接从360°视频生成空间音频,相关代码和数据集已开源,虽有局限但前景好。
Claude:Profile and Preference
文章借与Claude对话,探讨Profile和Preference概念,分析其区别联系,指出AI时代借助大模型理解用户的变化,还谈及数据源、实时个性化、偶然性、广告变革等问题,最后Claude为作者生成简易画像。
AI辅助编码将如何改变软件工程:更需要经验丰富的工程师
文章指出生成式AI改变软件开发方式,LLM在编码领域成果显著。但AI辅助编码有局限,如‘70%问题’。还介绍有效模式,提及软件工程智能体兴起,最后认为未来对经验丰富工程师需求或增加。
从沙子到会“思考”的智能材料,张朝阳与物理学家刘若微揭秘世界的底层逻辑
8月12日,张朝阳与刘若微教授围绕“复杂的世界:从沙子到智能”主题,从沙堆、泡沫切入软物质与非平衡统计物理前沿,探讨阻塞相变、低功耗类脑智能材料研究路径及未来潜力,还分享科研感悟。
AI 是设计工具的顺风还是逆风?
在生成式AI影响下,Figma曾被视为「AI输家」,但2026年第一季度营收同比增长46%。其联合创始人兼CEO Dylan Field称,AI是业务扩张核心驱动力,强调设计价值在不可被AI标准化领域。
拆解 Anthropic:最好的 AI 公司,可能也都是一种组织发明
过去一年,Anthropic 是 AI 行业最值得研究的公司,创造了最快爆发性增长,估值反超 OpenAI。文章从战略判断和组织文化两方面拆解其成功原因,分析与 OpenAI 的差异,还指出 AI 竞争中组织文化的重要性。
AI PPT,这次是真不用返工了
过去AI做PPT虽快但有“幻觉数据”和“拼凑式模板”问题,被认为是高估需求。如今讯飞智文Vision Agent出现,能生成专业PPT,还解决了美观、内容等问题,将AI PPT带入2.0阶段。
MiniCPM-o 4.5 技术报告发布:全双工全模态 API 开放,RTX5070 即可实时运行
面壁智能等发布 MiniCPM-o 4.5 技术报告,开放全双工全模态 API。该模型 9B 参数,RTX5070 可实时运行,下载量超 25 万。报告披露 Omni - Flow 框架,模型性能强,还能催生新应用。