「游戏交互视频」共找到 1721 篇相关文章
革命性突破!Windows-MCP 开源:AI 助手直接操控实体电脑,告别按键精灵!
在AI驱动的桌面自动化领域,传统工具部署复杂且性能受限。最近GitHub开源的Windows - MCP工具,能让AI助手与Windows UI原生交互,可进行点击、输入等操作,支持Windows 7 - 11,无需传统计算机视觉技术。
告别噪声初始化:NTU MARS Lab提出A2A新范式,实现机器人高性能单步动作生成
新加坡南洋理工大学 MARS Lab 提出 Action-to-Action (A2A) Flow Matching 新范式,以历史机器人轨迹为生成起点,打破生成速度与精度瓶颈,在训练效率、推理速度及泛化表现上佳,还可扩展至视频生成领域。
谷歌AI Studio大更新:推出全新“vibe编程体验”,一键生成AI应用,好用到爆
谷歌AI Studio发布全新vibe编程体验,可一键生成AI应用。基于Gemini API,启动界面有功能建议,还有“手气不错”按钮。构建问答游戏不到1分钟,免费且可编辑代码,还有AI建议功能,适合小白。
叫板英伟达RTX 5090!GPU初创公司做出13倍路径追踪性能的怪兽显卡
芯片初创公司Bolt Graphics首款GPU模组Zeus 4C,路径追踪性能达RTX 5090的13倍。但它不适合游戏场景,更擅长低功耗高精度图形渲染,不过测试、应用、价格目前都是未知数。
SIGGRAPH Asia 2025|电影级运镜一键克隆!港中文&快手可灵团队发布CamCloneMaster
香港中文大学与快手可灵团队联合提出运镜可控视频生成框架CamCloneMaster,引入‘参考即用’范式,告别对相机参数依赖。其训练、测试代码和数据集均已开源,在各项指标上优于SOTA方法。
亚马逊“盲眼”机器人30秒跑酷首秀惊艳!华人学者领衔
亚马逊机器人团队FAR发布人形机器人研究成果OmniRetarget,它能让强化学习策略在复杂环境学技能并零样本迁移。该成果通过交互网格建模关系,经实验验证优势明显,背后团队由华人学者领衔。
Meta详细阐述基于LLM级训练、混合并行计算与知识迁移的GEM广告模型
Meta发布生成式广告模型GEM详细信息,旨在改善平台广告推荐能力。它处理海量用户 - 广告交互数据,用三种方法构建系统,还实施GPU级优化,采用两种知识迁移策略,获业内人士认可。
登上热搜!Prompt不再是AI重点,新热点是Context Engineering
最近「上下文工程」很火,Andrej Karpathy 为其打 Call。它和「提示词工程」不同,是构建自动化系统给模型提供输入。文章介绍了其核心要素、实践方法论,还给出了参考的博客和视频。
Rokid火得太晚了
消费电子市场中AI眼镜迎曙光,乐奇Rokid成AI+AR品类全球销冠。它通过双目衍射光波导和双芯片架构解决轻量化与续航难题,还以开放生态脱颖而出,其判断未来眼镜将成交互主体。
1.4亿宝可梦玩家,都在给AI免费打工…
1.4亿《精灵宝可梦Go》玩家10年拍300亿张实景图,为Niantic免费收集数据。Niantic用此数据训练VPS视觉定位系统,提升机器人配送效率,还获巨额投资,剥离游戏业务专注空间AI。