新闻资讯7
神秘「欢乐马」碾压 Seedance 2.0 登顶
机器之心
AI 摘要
神秘模型「HappyHorse - 1.0」在 AI 评测平台空降榜首,纯视频生成能力断层碾压 Seedance 2.0,但「视频 + 音频」综合排名居第二,引发刷分质疑,大家猜测其背后团队,或近日揭晓答案。
阅读原文 · 机器之心
断层碾压Seedance 2.0:神秘「欢乐马」空降榜首,视频AI变天了
周二晚间,代号「HappyHorse - 1.0」的神秘视频生成模型在 Artificial Analysis 平台空降榜首,不论文字生视频还是图像生视频都排第一,拉开 Seedance 2.0 很大差距,不过在「视频 + 音频」综合排名上屈居第二,引发诸多猜测。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用7
成峰:低成本复刻《变形金刚》运镜
作者分享用 Seedance 2.5 加 updream 复刻《变形金刚》迈克尔·贝式运镜的经验。先预演再生成可省成本,介绍预演台操作,经四步完成复刻,最后检查三项指标判断是否成功。
AI产品自由
算法论文8
SWE - Touch揭示Coding Agent共享协作能力缺口
当前基于大模型的Coding Agent是热门研究方向,现有评测多假设其独占代码仓库。中科院自动化所团队构建SWE - Touch框架,对9个前沿模型测试,发现用户干预下模型性能下降、排名洗牌。
深度学习自然语言处理
算法论文7
MLS - Bench评测:AI科研创新能力待提升
新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。
新智元
开源动态8
腾讯 WorkBuddy 开源评测,曝光多模型底牌
腾讯 WorkBuddy 团队将内部模型选型评测等开源成 Benchmark,公开多模型 Agent 工作台选型底牌。Bench 优点是任务分布真实且开源可审计,论文介绍了核心方法论、四大赛道拆解、榜单结果,还对比了现有工作。
PaperAgent