「有声故事绘本」共找到 133 篇相关文章
终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成
过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。
Kotoko AI 乔海鑫:C.Al 的故事已经结束,我们用 OC 链接 05后
本文是对Kotoko AI创始人乔海鑫的访谈。他认为OC市场潜力大,Gacha Life验证了其市场需求。Bside是融合UGC与游戏化玩法的OC社交互动平台,6月将在Steam新品节上线Demo,7月开启Early Access。乔海鑫还探讨了OC商业化、AI应用等问题。
AI短片节创作者招募:在崇礼,用AI讲一个未来故事|甲子光年
「Future Now/未来此刻」2026夏季崇礼论坛将启幕,设立「Chongli AI Film Lab」专场论坛,发起AI短片节。面向全球创作者征集作品,有两大创作方向,生数科技Vidu全程支持,对作品有要求,还有丰厚奖励。
这家初创要为AI重绘地球:可量身定制卫星星座,对接太空计算
西班牙初创公司 Xoople 完成 1.3 亿美元 B 轮融资,欲构建“地球记录系统”。它先铺管道、再造源头,与 L3Harris 合作开发天基测量系统,虽面临竞争与隐忧,但也顺应太空计算融合趋势。
RISC-V×AI生态大会暨ArchitStudio用户大会成功举办,共绘智能计算生态新图景!
12月26日,‘RISC-V×AI生态大会暨ArchitStudio用户大会’举办,DSA领域计算实验室揭牌。浦软与隼瞻科技将依托其开展研究、转化成果。会上各方共话RISC-V与AI融合机遇,还展示了ArchitStudio等产品应用。
AI 如何讲好一个多人故事?首个支持多角色互动的3D场景叙事系统
首尔国立大学提出全新框架,能生成虚拟动态场景并支持多角色上下文动作生成。引入LLM拆解复杂任务,系统用事件驱动方式规划动作,还构建基准评估相关能力,有良好扩展性和实用性。
当万相2.5刚开卷有声视频,7月已经发布音频一体化的百度蒸汽机又开卷长视频了
百度升级MuseSteamer蒸汽机视频生成模型,可生成任意长度视频,生成中能更新prompt交互创作。其技术规划前瞻体系化,成本低,在多行业有应用和商业化空间。
一次汇报,资源投入暴涨数十倍:快手大模型推荐以 1/12 成本突围,技术负责人亲历的革新故事
InfoQ 专访快手科技副总裁周国睿,他分享了快手大模型推荐技术投入挑战、决策过程等。如汇报后资源投入涨数十倍,以 1/12 成本突围。还阐述推荐系统变革、技术押注及未来推荐系统突破点等观点。
中国AI创业者重登GTC舞台:杨植麟用技术语言讲了一个智能上限突破的浪漫故事|甲子光年
美国当地时间3月17日,月之暗面(Kimi)创始人杨植麟在英伟达GTC演讲,介绍Kimi技术路线图。他提出开源模型要出色,给出Token效率、长上下文、智能体集群三个概念,还探索了未来架构,且将创新开源。
全新OCR将图片变代码无损重绘!华中科大&小红书发布3B模型,图形重建超越Gemini 3 Pro
华中科技大学与小红书联合推出MOCR,提出「解析一切」新范式,将文档图形升级为「一等解析目标」。它解决传统OCR短板,在文档解析和图形重建表现出色,还革新评估方法,代码和模型已开源。