3D画面控制」共找到 2483 篇相关文章

新闻资讯7

宇树机器人“撞人逃逸”火到国外,王兴兴回应:下次不遥控了

宇树机器人“撞人逃逸”片段在国外疯传,引发对机器人安全性的担忧。分析发现,“元凶”可能是人类控制员交接遥控器时未及时避让。宇树创始人王兴兴表示下次让机器人自主奔跑,还透露未来有更多突破。

量子位
新闻资讯8

刚刚,智源全新「悟界」系列大模型炸场!AI第一次真正「看见」宏观-微观双宇宙

6月6日第七届智源大会,智源研究院推出全新「悟界」系列大模型,含原生多模态世界模型Emu3、脑科学多模态通用基础模型见微Brainμ等,反映其对大模型发展的研判,推动AI向物理世界迈进。

机器之心
产品应用7

企鹅终于跟进了:OpenClaw 接入企微,一个企微群,我管住了 Win、Mac、手机,还能@不同AI 专家

微信不开放,企业微信却允许 OpenClaw 接入。其接入简单,还具特色机制与主动性通知。文中介绍了 OpenClaw + 企微等玩法,如多 Bot 群聊、跨设备控制等,最后给出企微接入 OpenClaw 保姆教程。

AI进修生
开源动态8

阿里Qwen又悄悄放出8个开源权重,卷疯了~

阿里通义千问太卷,悄悄放出8个开源模型权重,包括体积更小的Qwen3-VL及FP8权重。这一代实现全方位升级,提供两种架构、两个版本,架构也有更新,还给出使用示例与模型权重链接。

PaperAgent
产品应用7

豆包大模型2.0+Claude Skills,3步装好,终于有AI能帮我"看视频做笔记"了!火山引擎全系列可用!

传统视频总结工具只基于音频总结,内容浅显。而豆包大模型2.0是多模态原生模型,能同时处理画面和声音。只需3步安装配置,就能让它真正“看”视频,输出详细笔记。

AI产品自由
产品应用7

阿里通义发布Z-Image非蒸馏版基础模型版本,支持完整CFG和负向提示

阿里通义发布Z-Image基础图像生成模型,采用单流扩散Transformer架构,具核心创新技术。它是非蒸馏模型,支持完整CFG和负向提示,注重输出多样性和创意控制,已在Hugging Face开放下载。

AI工程化
新闻资讯8

机器狗腿被锯了也能继续走!最新机器人大脑来自320亿估值独角兽

Skild AI推出Skild Brain机器人大脑,它在虚拟环境训练相当于一千年时间成型。此模型没在对应机器人训练,控制能力是涌现的,能应对肢体断裂、马达卡住等情况,还可完成精细动作。

量子位
产品应用7

Cursor自研模型反超Opus 4.6!价格脚踝斩,氛围编程沸腾了

Cursor新编程模型Composer 2性能超Claude Opus 4.6,价格“脚踝斩”。它靠引入新强化学习方法,让模型学会“做笔记”突破上下文瓶颈,在任务中表现出色,研究员还放出Composer 3消息。

量子位
开源动态7

又来一款 AI 编程远控项目,有点意思!

GitHub上出现开源项目`HAPI`,它是本地优先的AI编程远程控制工具,可让用户在手机或平板远程接管Claude Code等AI助手会话,有无缝切换等特性,安装简单,值得开发者体验。

开源先锋
算法论文8

警告:你的Agent可能无法"解决"真实世界的视觉问题

文章提出 AgentVista 评测基准,含 209 道任务,横跨 7 大领域 25 个子方向。评测 14 个主流模型,最强的 Gemini - 3 - Pro 准确率仅 27.27%,揭示多模态 Agent 在视觉理解、工具调用等方面挑战大。

深度学习自然语言处理