「Artificial Analysis」共找到 42 篇相关文章
Runway重夺全球第一!1247分碾压谷歌Veo3,没有千亿算力也能干翻科技巨头
Runway Gen - 4.5击败谷歌Veo3,以1247的ELO分数在Artificial Analysis榜单中重夺AI视频王座。它在多方面树立新标杆,虽有局限,但创始人认为其是通用模拟引擎,应用场景广泛。
断层碾压Seedance 2.0:神秘「欢乐马」空降榜首,视频AI变天了
周二晚间,代号「HappyHorse - 1.0」的神秘视频生成模型在 Artificial Analysis 平台空降榜首,不论文字生视频还是图像生视频都排第一,拉开 Seedance 2.0 很大差距,不过在「视频 + 音频」综合排名上屈居第二,引发诸多猜测。
Runway Gen-4.5刷屏发布,把重量、尘土和光影都做对了,网友:颠覆
Runway Gen-4.5突袭发布,获“视频生成AGI时刻”评价,在Artificial Analysis测试中拿下SOTA。它能精准执行复杂指令,物理还原与视觉精准度强,官方将逐步开放使用权限,还直言其存在因果推理等局限。
拍我AI V5模型发布,AI视频的“不可能三角”被解开了?
拍我AI推出V5模型,一上架就到Artificial Analysis榜单前列。它在多维度升级,维持速度和性价比优势,试图解开AI视频生成“不可能三角”。文章实测其运动、二次元、商业等场景表现,还提及速度与价格优势。
Meta新模型逼平Fable 5,小扎:开源且便宜到你懒得算账
Meta推出新模型Muse Spark 1.3,在Artificial Analysis榜单中与Fable 5打平手。小扎称其在Coding和Agent工作有大幅提升,还便宜。网友实测它真能肝、真能省,Meta团队核心研究员也透露背后改动。
等等,MiniMax H3不是刚发布吗?怎么就卷到几分钱的价格了……
MiniMax新发布的视频模型H3在多模态能力出色,霸榜Artificial Analysis榜单。但开源模型有部署和成本难题,秘塔AI上线该模型,免部署,2K方案0.15元/秒,768P方案0.09元/秒,降低创作门槛。
GLM-5登顶开源模型No.1!智力指数首破50大关,打平Opus 4.5
在Artificial Analysis评测中,GLM - 5成开源权重模型智力排名第一,是首个智力指数破50的开源模型,除代码能力外各方面表现出色。它集成DeepSeek稀疏注意力,参数规模大,擅长“搞钱”任务,幻觉率低且输出精简。
单Agent时代结束,AI们开始组团上班
月之暗面发布并开源K2.6,重点升级代码能力与多Agent协作的“Agent集群”能力。K2.6在Artificial Analysis上取得全球开源第一,实测能并行交付多格式成果,还展现出强大的全栈应用开发能力。
昨天夸国产大模型争气,今天Vidu Q3就霸榜了
国产视频大模型Vidu Q3在国际权威AI基准测试机构Artificial Analysis的最新榜单里,于Video Arena冲到全球第二、国产第一。它是全球首个支持16秒音视频直出模型,声画同出、高清直出,还有镜头控制、多语言文字渲染等优势。
TPAMI 2026 | 仅用两个变量破解混杂因素:CIC实现动力学因果推断与混杂变量重构
上海交通大学陈洛南团队与西北工业大学张绍武团队合作,在《IEEE Transactions on Pattern Analysis and Machine Intelligence》发表成果,提出动力学因果判别框架CIC,能在有未观测混杂变量时,借观测数据识别因果、重构变量与网络。