真实世界测试」共找到 2902 篇相关文章

产品应用8

腾讯发布Hunyuan-GameCraft!从静图进入动态游戏世界

近年来,现有方法难满足游戏视频生成需求。腾讯推出Hunyuan - GameCraft,可基于一张图像和提示词生成游戏交互视频,能精准响应交互信号,保留历史场景信息,不过动作空间待丰富。

带你学AI
新闻资讯8

谷歌前CEO深度专访:AI、智能体会重塑世界

谷歌前CEO Eric Schmidt在Ted专访中,从AI起点AlphaGo说起,阐述其从大模型到自主决策智能体的发展,还提及算力电力需求增长、监管、开源等问题,虽挑战多,但他对AI重塑世界充满信心。

AIGC开放社区
新闻资讯7

ICME专题征稿 | 具身多模态智能:从感知到世界建模

ICME是多媒体领域国际顶级会议,2026年将在泰国曼谷举行。此次专题征稿聚焦具身多模态智能,涵盖多模态感知、世界模型等主题,介绍了投稿详情及联系方式。

深度学习自然语言处理
新闻资讯7

谁是最强“打工AI”?OpenAI亲自测试,结果第一不是自己

OpenAI发布新研究,提出GDPval基准衡量AI模型在有经济价值任务上的表现。Claude Opus 4.1表现最佳,GPT - 5次之。OpenAI开源优质子集并提供自动评分服务,还指出了GDPval的局限。

量子位
新闻资讯8

2025乌镇峰会看点:人工智能,中国数字世界秩序之巅

2025年世界互联网大会乌镇峰会是战略转折点,议程、展览等聚焦AI,从宽泛论坛变为展示AI驱动发展模式平台。报告剖析议程架构、战略差异,评估其对全球AI格局等多方面的影响。

AI Reading Hub
开源动态8

红杉中国xbench全球首发,AI智能体真实战力揭榜!

红杉中国推出全新AI基准测试工具xbench及相关论文,采用双轨评估体系和长青评估机制,首期发布两个核心评估集并综合排名,还提出垂类评测方法论。它能追踪模型能力与实际场景价值,解决现有评估难题。

新智元
产品应用8

一手实测深夜发布的世界首个设计Agent - Lovart。

博主实测深夜发布的世界首个设计 Agent - Lovart。虽内测版细节粗糙,但大框架已现。它先匹配设计风格,再创建执行计划,还支持二次编辑等,集成多工具可生成视频等,未来或重写设计工作流。

数字生命卡兹克
算法论文7

Veo何止生成视频:DeepMind正在用它模拟整个机器人世界

通用型机器人策略发展带来挑战,传统评估方法有局限,前沿视频模型虽有潜力但面临困难。Google DeepMind团队提出基于Veo的机器人策略评估系统,经实验验证有效,展示了视频仿真评估的可行路径。

机器之心
产品应用7

狂肝一周,测评十余款 PPT AI 生成产品的真实反馈

评估 Agent 产品能力复杂,以 PPT 生成为例,有 Agent 和模板化两种流派。作者选前者投票测评、后者全方位测试。给出方案,还推荐不同需求适用产品,附总榜单和细致体验描述。

特工宇宙
产品应用8

π0引用的中国团队,又出手了:世界仿真器新作发布

Current Robotics团队发布交互式世界仿真器CurrentWorld - 0,创始人祝毅晨履历亮眼。该仿真器能跨本体、多视角、力 - 触觉预测,可用于评测机器人,还能让人类接管以探索不同动作结果。

量子位