实时视频模型」共找到 8341 篇相关文章

新闻资讯7

马斯克版微信亮相:支持中文,加密聊天,还专门防截屏

马斯克版微信XChat将于4月17日上线,支持中文版。其核心主打加密聊天,功能有文字、图片等发送及视频通话,还内置Grok模型。不过网友质疑其难成功,因X已有聊天功能,且微信生态难撼动,市场竞争大。

量子位
开源动态8

告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent

现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。

量子位
产品应用7

加拿大丛林迷路五小时,ChatGPT救命神技,比地图还靠谱!

一群人在加拿大森林迷路5小时,手机电量低、Google Maps失灵,靠向ChatGPT发实时坐标获导航指引脱险。此外,上海交大团队推出PathGPT,用大模型让导航可自然对话,虽有不足但潜力大。

新智元
推荐文章7

LLM学习笔记:最好的学习方法是带着问题去寻找答案

文章总结拓展Andrej Karpathy教学视频,分析大模型聊天流程与原理,介绍LLM训练步骤,包括预训练、后训练和强化学习,还提及主流特性应用,如文件上传、网络搜索,强调带问题学习的重要性。

腾讯技术工程
新闻资讯8

29个月增长100倍:一个AI 2.0公司应该怎么建?HeyGen的取胜的秘密

AI视频生成公司HeyGen在29个月内ARR从100万美元增长到超1亿美元。创始人Joshua Xu公开取胜秘密,即独特运营模式‘The HeyGen Way’,包括拥抱变化、匹配节奏、最小化快速验证迭代等理念。

AI工程化
新闻资讯7

Google 亲手证明:GUI 已死,但尸体还在动

Google DeepMind发布Flash - Lite Browser,能用Gemini 3.1 Flash - Lite实时生成网站。它表明GUI连预先设计都不需要,界面正发生三层分化,虽有不足,但展现界面从预制到即时生成的趋势。

AGI Hunt
新闻资讯8

苹果OS全家桶12年最狠升级!AI入侵一切,唯独Siri没更

春季WWDC开幕,苹果OS全家桶迎十多年最大版本升级,统称OS 26。苹果AI进化,支持实时翻译、看屏搜物等。开发者工具升级,三行代码可调用苹果AI。各系统在设计、功能上均有革新。

新智元
开源动态8

你的电子老婆开源了!登顶GitHub热榜

GitHub热榜项目AIRI是超火虚拟主播Neuro - sama的开源版,可自托管,7×24小时在线。它能实时语音、陪玩游戏等,支持多种大模型API,还介绍了不同系统搭建该项目的方法。

量子位
新闻资讯7

Meta 系 95 后华人明星团队,创业一年就与高通达成合作,让手机拥有多模态记忆

由华人创业者沈俊潇创办的 Memories.ai 发布 LVMM 2.0 并宣布与高通合作,该模型 2026 年将在高通处理器上原生运行。它解决视频可搜索性问题,应用广泛,能降低延迟、确保数据安全等。

Founder Park
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向多模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向多模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在多模态基准测试中表现优异,尤其小规模模型性能突出。

新智元