算法论文8
高校联合腾讯:前沿模型游戏生成能力仍弱
AI科技评论
AI 摘要
高校联合腾讯发布 GameCraft-Bench 评测基准,解决现有基准不足。测试发现前沿模型总分难及格,核心机制外表现差。如 Kimi-K2.6 视觉反馈高效,MiMo-V2.5-Pro 执行低效。
阅读原文 · AI科技评论
GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到可玩水平
香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整可运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端可玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章8
前英伟达工程师:AI 终局是后台 Agent
前英伟达工程师、Sail Research 创始人 Neil Movva 认为当前 AI 行业陷“延迟陷阱”,AI 终局应是后台 Agent。他执行“算力拾荒者战略”,想降低智能成本,还指出 Transformer 架构有缺陷,互联网数据被吃光等问题。
AI科技大本营
新闻资讯8
比尔·盖茨:AI已跨过临界点引担忧
比尔·盖茨在与《麻省理工科技评论》的采访中表示,AI在多方面已跨过临界点,但行业外缺乏讨论。他警告生物恐怖主义风险,提出‘人类保留岗位’、征税等政策设想,也看好AI在部分领域价值。
DeepTech深科技
产品应用7
HarmonyOS腕上健康应用:机遇与鸿沟并存
文章聚焦HarmonyOS穿戴应用,如「小卡健康」将健康记录入口移到手表,还介绍「开练」「凯格尔运动」应用。阐述了从接口到产品需解决权限、断连等问题,强调要为用户提供合适体验。
AI前线
新闻资讯7
AI公司挑战训练物理通用模型
近日,AI初创公司Accelerated Understanding亮相,由Anima Anandkumar夫妇创立。它未随主流,目标是训练模拟物理现象的通用AI模型。该模型处理数据规模大,公司想解决AI验证瓶颈,产品面向科研工程机构。
DeepTech深科技