实时视频对话」共找到 1751 篇相关文章

开源动态8

登顶全球权威榜单!浙大创业团队百卡打造开源实时世界模型,视频秒变可交互4D世界

全球科技界正豪赌「世界模型」,但主流模型多停留在「视觉生成」。中国影溯公司发布并开源世界模型 InSpatio - World,综合性能优异,以小博大登顶权威榜单,降低了物理世界数字化门槛,引发行业关注。

机器之心
产品应用8

AI短剧成了!LibTV-seedance2支持“真人模式”:一手实测,视频闪电直出,效果炸裂

LibTV首发支持Seedance 2.0真人生成视频功能,操作简单严谨。真人出镜可用于虚拟主播、数字分身、角色替换等场景。该工具工作流高效,接入主流模型,价格有优惠。

AI寒武纪
新闻资讯7

Meta CEO X 微软 CEO 对话解读:「蒸馏工厂」为何成为开源的魅力之源?

Meta CEO Mark Zuckerberg 和微软 CEO Satya Nadella 在 LlamaCon 2025 闭幕会议对话,探讨AI对技术平台等影响,如使文档、应用和网站界限模糊,还谈及开源与闭源模型战略价值及‘蒸馏工厂’概念。

机器之心
开源动态8

登上 GitHub 日榜 TOP5,收获 1.2 万标星的自动剪辑视频开源工具。

video-use是browser-use团队开源的自动剪视频项目,登上GitHub日榜TOP5、获1.2万标星。它改变剪辑交互方式,让用户描述意图,有智能剪辑、调色等功能。技术亮点是双层读取系统,成本和效率更优。

开源星探
新闻资讯7

2025AI红利爆发!新智元创始人与5位清华系大咖「探索对话

11月5日,「新浪新闻・2025探索大会」举办,新智元创始人杨静主持探索对话环节,多位嘉宾围绕「如何掌握科技创新的时代红利」展开交流,探讨释放红利路径,还提及协同创新和出海对放大红利的重要性。

新智元
算法论文8

ACL 2026|证据摊开看,场景图画清:让流式视频大模型拿捏「何时开口」

随着多模态和大语言模型发展,人类与 AI 交互走向共生。现有视频大模型难把握响应时机,西北工业大学等团队在 ACL 2026 提出 Response - G1 框架,实验显示其提升了模型性能。

机器之心
开源动态8

代码库的AI觉醒!GitMCP开源神器:实时文档中心秒级搭建,终结代码幻觉!

AI助手处理项目文档常“幻觉”频发,GitMCP这款开源工具通过MCP将GitHub仓库转变为实时文档中心,让AI直接访问最新文档和代码,消除“代码幻觉”。它功能强大,配置简单,应用场景广泛。

开源星探
产品应用8

可灵2.5Turbo实测|顶尖AI视频模型,真能打平CG吗?

可灵发布2.5 Turbo版本视频模型,进步显著,提示词理解、高速动态表现、风格稳定性都有提升,价格还更划算。经多场景测试,其在特定场景下内容质量能与CG媲美,开始理解动作背后逻辑。

歸藏的AI工具箱
开源动态8

数据减少超千倍,500 美金就可训练一流视频模型,港城、华为Pusa来了

香港城市大学与华为香港研究所合作推出 Pusa 项目,它基于 FVDM 理论,可极低成本微调大规模预训练视频模型,成本降超 200 倍、数据减少超 2500 倍,代码已开源。

机器之心
开源动态8

新型开源端到端 AI 语音模型!Voila:195ms 超低延迟引领全双工对话

Maitrix团队发布开源AI端到端语音模型Voila,以195ms超低延迟及全双工对话受关注。它功能强大,支持多语言,有多种使用方式,适用于多个场景,架构采用模块化设计。

开源星探