声画同出」共找到 1124 篇相关文章

开源动态8

一夜颠覆Sora神话,H200单卡5秒片!全华人团队开源AI引爆视频圈

UCSD等机构发布FastWan系模型,用「稀疏蒸馏」训练方案,让视频去噪速度飙升70倍。FastWan在单张H200上5秒生成480p视频,模型权重等全开源,改写AI视频生成格局。

新智元
算法论文8

大模型再爆弱点!旧记忆忘不掉,新记忆分不,准确率暴降 | ICML'25

弗吉尼亚大学和纽约大学研究人员用「前摄干扰」概念设计测验PI - LLM,测试大语言模型(LLM)上下文检索能力。结果显示,随干扰增加,模型准确率对数下降至零,提示工程效果有限,需调整模型架构或训练范式。

新智元
开源动态8

中科院甩多模态“核弹”!类GPT-4o多模态模型开源!支持语言-视觉-语音任意组合交互!

中国科学院计算技术研究所(ICTNLP)开源类GPT - 4o多模态模型Stream - Omni,支持文本、视觉和语音任意组合交互,核心是高效模态对齐技术,少量多模态数据即可训练,有多种使用场景。

开源星探
产品应用7

谷歌AI试穿神器真神了!上传照片秒OOTD,视频效果和照镜子没区别

谷歌推应用Doppl,上传照片就能看到衣服“穿”在自己身上的效果,还能生成动态视频。它不仅能试穿,还会帮忙搭配。此外,Google Labs还有Portraits、文生视频产品Flow等小实验。

量子位
开源动态8

腾讯祭开源核弹!LeVo音乐生成模型,媲美Suno,支持零样本风格迁移,歌词完美匹配

音乐生成领域有重大突破,腾讯AI Lab开源高保真音乐生成模型LeVo。它由LeLM和音乐编解码器组成,能解决现有方法在音质、音乐性等方面的局限,实验显示其优于现有方法,功能强大且适用场景多。

开源星探
新闻资讯7

奥特曼宫斗要成好莱坞大片了!《哈利波特》款制片人,主角人选被曝“蜘蛛侠”

据The Hollywood Reporter消息,米高梅计划联手卢卡·瓜达尼诺将OpenAI高层争斗拍成电影《Artificial》,今年夏天开拍。演员阵容未敲定,网友对演员人选看法不一,而OpenAI宫斗本身就足够抓马。

量子位
算法论文8

能效翻5倍!他们复刻人脑双记忆通路,造能长效记住上下文的类脑AI芯片

帝国理工学院博士后孙鹏飞和苏黎世联邦理工博士后苏哲及合作者,受大脑皮层机制启发,打造“双重记忆路径”类脑网络及配套芯片,处理语音识别任务时能效比此前优方案高5倍。相关论文发表在《自然·机器智能》且代码、设计全开源。

DeepTech深科技
新闻资讯8

李开复陆奇重仓一家Harness智能体公司,李笛带队,4个月2轮融资3-5年粮草

成立仅四个多月的AI初创公司明日新程宣布连续完成两轮融资,资金储备够未来三到五年创新。其由李笛带队,获李开复、陆奇等投资,聚焦Harness群体多智能体,还将推新版“小冰岛”。

量子位
算法论文8

融资 1200亿后 Kimi 再扔王牌,新架构爆改 Transformer 老配件,比 DeepSeek 款还省钱

Kimi 发布新论文,提“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。

AI前线
新闻资讯7

Anthropic万名工程师都离不开!深夜随手撸的开源神器,被OpenAl高价收购,23人创业逆袭

昨日,OpenAI 宣布收购 AI 安全初创公司 Promptfoo,其技术将整合进 OpenAI Frontier 平台。该公司由 23 人创立,开发开源工具测试 AI 系统安全。收购后 Promptfoo 保持开源,OpenAI 将新增相关功能。

AI前线