「现场演示翻车」共找到 294 篇相关文章
宇树新机器狗太猛了!1米高石阶轻松爬,越野快到出残影,网友:这不是AI生成的???
宇树新机器狗Unitree A2星际猎影实力惊人,全视频无加速展示跑酷、爬山等技能。它有超广角激光雷达3D感知系统,能自主避障,还很轻、强、快,承载能力佳,官方未公布售价和上市日期。
精准复刻!字节推出X-UniMotion实现高精度动作模仿合成
字节推出的X-UniMotion代表角色动画技术突破,提供统一运动控制系统,融合先进算法与操作界面,构建强大技术架构,能生成自然流畅角色动作,还介绍了其技术原理、演示对比等内容。
疯狂……韩国开发出强大的核灾难处理人形机器人。丑,但实用
韩国原子能研究院正开发用于核灾难响应和废料处理的人形机器人,目标是能举200公斤重物。与其他机器人相比,其举重能力优势明显。不过在真实核灾难现场应用还需长期测试。
用DeepSeek徒手造一个能对话的AI简历,助你当场拿下Offer。
作者招人时收到很多AI生成简历,有份把自己变成含AI对话的可视化简历脱颖而出。作者分享用Dify+Gemini或DeepSeek+YouWare搭AI简历方法,还以马斯克求职为例演示操作步骤。
首个多人对话视频生成框架MultiTalk,角色有表情还能互动
现有音频驱动人体动画方法多聚焦单人,处理多音频流能力弱、指令跟随有局限。中山大学提出多人对话视频生成新框架MultiTalk,介绍了技术原理,演示效果显示其指令跟随能力强、伪影少。
所有AI工具共享持久私有记忆,OpenMemory MCP杀疯了~
本文介绍实用的MCP Server - OpenMemory MCP,它能为AI提供持久记忆、跨平台和跨会话功能,数据私有,隐私有保障。还演示了本地化部署步骤,且官方封装成MCP降低了使用门槛。
实战指南:从零构建 MCP 架构下的 Agentic RAG 系统,无第三方MCP Server
五一期间作者用MCP架构从零实现Agentic RAG系统,分享MCP与Agentic RAG融合思考、架构设计,介绍MCP服务端和客户端实现,还做了端到端效果演示,指出架构优势及待优化处。
汉字防AI作弊!甩英文、拉丁文十几条街
中科院等联合发布 Chronicles-OCR 基准测试,让 20 多个主流视觉大语言模型识别汉字演变史。结果显示,模型在古文字识别上表现糟糕,还存在靠认材质作弊情况,暴露了 AI 理解汉字的局限。
只看图片就能学会压缩Token!浙大&阿里新框架多轮VQA压缩率90%,精度不掉|CVPR 2026
多轮视觉问答成LVLM推理效率“照妖镜”,现有压缩方法在多轮场景翻车。浙大宋明黎教授团队与阿里联合提出MetaCompress框架,可根据图像生成最优压缩映射,实验验证其效果优,能平衡压缩率与精度。
Q:Lab · 龙虾季 | 直播预告
InfoQ 中国推出「Q:Lab」AI 产品测评直播栏目,第一季「龙虾季」聚焦 AI Agent 产品,共 3 期直播,覆盖 9 款核心产品,每期围绕真实职业场景测评,由一线从业者操作并现场出结果。