可灵 2.1 首尾帧模型」共找到 8986 篇相关文章

产品应用8

马斯克视频生成模型首次交卷!电影级运镜+音效,免费可玩

xAI的“迄今为止最强大的视频音频生成模型”Grok Imagine 1.0正式全面上线。该模型支持文生视频、图生视频,音频效果出色,还擅长日常趣味创作。其在视频生成和剪辑性能领先,官网可免费玩。

量子位
开源动态7

开源模型叫板Nano Banana Pro!Stable Diffusion原班人马杀回来了

时隔一年,上一代AI生图顶流Flux带着新模型Flux.2杀回来了。该模型发布即开源,生图质量媲美谷歌Nano Banana,价格却便宜得多。它有多个版本可选,实测在指令遵循、精细控制方面有进步,但与Nano Banana Pro仍有差距。

量子位
产品应用7

怎么回事?刚被OpenAI收购,Windsurf就发了个自己的模型

5月初,刚被OpenAI收购的Windsurf发布AI编程模型SWE - 1,该模型针对软件工程全流程,核心是流动感知,实现人机自然交接。它有三个系列,已上线可免费使用,开发灵感源于编辑器,在评估和实测中表现良好。

Founder Park
新闻资讯7

xAI解散,但Grok还在上新,马斯克官宣新模型

xAI 解散、大批成员离职后,马斯克透露 Grok 最新模型进展,参数量 1.5T 的 Grok V9 - Medium 已完成训练,预计两到三周内发布。他还宣布现有 0.5T 模型年底前开源,此外首款编码智能体 Grok Build 也备受关注。

机器之心
产品应用7

Airbnb 的 Mussel V2:下一代的键值存储,以统一流和批处理

Airbnb工程团队推出Mussel v2,对内部键值引擎彻底重构,统一流和批处理,简化运维、扩展工作负载。它结合NewSQL后端与Kubernetes控制平面,解决了v1的局限,迁移虽有挑战但成功完成。

InfoQ
开源动态8

杨立昆亲自指导开源世界大模型,为AI Agent打造超级大脑

今天凌晨,Meta开源世界大模型V - JEPA 2,它用超大规模数据集训练,能让AI Agent理解物理世界。图灵奖得主杨立昆参与开发并推荐。模型经多方面改进,还拓展用于机器人规划和视频问答,效果良好。

AIGC开放社区
新闻资讯7

太炸了!小扎2亿美金挖走了庞若鸣,比库克年薪还高

外媒爆料小扎花2亿美金挖走苹果智能基础模型负责人庞若鸣,薪酬比库克高,且大部分与绩效挂钩。庞若鸣履历出色,领导苹果自研大模型核心团队,成果关乎苹果产品未来。

AI寒武纪
新闻资讯7

Sutton、OpenAI 联创押注的持续学习,有中国团队带着模型进场了

7 月,TML 发布 Inkling 模型,Mind Lab 发布 Macaron V1,二者均针对持续学习场景。持续学习走「参数空间的迭代」路线,让模型用得越多越好用。硅谷已有不少新尝试,产业链正在形成。

Founder Park
产品应用8

通用级PixVerse P1的技术突破,揣着进入平行世界的密码

PixVerse R1 突然上线,带来「即时响应、即看即创」新体验。它是全球首个支持最高 1080P 分辨率通用实时世界模型,实现从「静态输出」到「实时交互」跨越,本文将解析其技术突破。

机器之心
产品应用8

金山与华科发布多模态模型MonkeyOCR v1.5:文档解析能力超越PaddleOCR-VL,复杂表格解析首次突破90%

2025年6月以来多模态文档解析成前沿课题。MonkeyOCR v1.5是全新框架,在OmniDocBench v1.5等基准上全面突破,复杂表格等场景提升9.7%,采用两阶段解析管道和复杂表格处理方案。

量子位