多角色精准控制」共找到 976 篇相关文章

开源动态8

让机器人「秒懂人话」!中国电信TeleAI发布首个实时文本驱动人形机器人控制框架TextOp

中国电信人工智能研究院(TeleAI)具身智能团队推出人形机器人TextOp通用小脑,首创流式文本驱动的实时小脑控制范式。用户发文本指令,机器人就能实时理解、无缝切换动作,在多场景有应用潜力。

机器之心
算法论文8

IEEE TVCG | 告别写代码!MoGraphGPT:基于模块化大模型与图形控制的2D交互场景创作

香港多所高校研究团队提出 MoGraphGPT 系统,结合上下文感知模块化大模型与图形化控制,能让用户零代码搭建 2D 交互场景。该成果被 IEEE TVCG 录用,还对比实验验证其优势。

机器之心
产品应用7

Gemini 3+Nano Banana Pro+3D 生成+手势控制=?藏师傅教你炫酷展示运动成果

作者作为户外运动爱好者,用Nano Banana Pro做户外运动成果展示的图片提示词和海报效果佳,还将图片转3D模型、加手势控制,文章分享制作方法、提示词及工具使用方式。

歸藏的AI工具箱
算法论文8

大模型人格可以被量化!Anthropic最新论文发现“辅助轴”,开辟人类控制AI全新道路

Anthropic等机构研究团队深入模型激活空间,发现大模型人格可量化,存在“辅助轴”。沿此轴干预能预测、解释“人格漂移”,用“激活上限”技术稳定模型行为,抵御越狱攻击,开辟人类控制AI新道路。

AI寒武纪
开源动态8

图像编辑太慢太粗糙?全新开源自回归模型实现精准秒级修改 | 智象未来

AI图像编辑中扩散模型有两大难题,智象未来团队提出全新自回归图像编辑框架VAREdit,引入视觉自回归架构,提升编辑精准度与速度。模型和代码已开源,还提出SAR模块优化,在基准测试表现出色。

量子位
算法论文8

灵宝 CASBOT 与 CASIA 共同提出“增强物理人机协作中的人类意图估计和人机角色分配”方法

近日,ICRA 2025 在美国亚特兰大开幕,中科院自动化所与灵宝 CASBOT 提出的“增强物理人机协作中的人类意图估计和人机角色分配”方法获录用。该方法解决现有问题,实验显示优势明显,有巨大应用潜力。

InfoQ
新闻资讯8

Figure抛弃10万行C++代码!用1000小时人类数据训练神经网络,实现全身控制基础模型

美国机器人公司Figure推出具身大脑Helix 02及家务demo。其搭载的Figure 03在厨房自主完成复杂任务,且实现端到端全身控制。新引入的System 0基于人类数据训练,替代大量手写代码,还展示多种灵巧操作。

量子位
开源动态8

让VLA真正跑上机器人:北大团队开源Jetson-PI,Jetson Orin控制频率提升8.66倍

文章聚焦让VLA模型在机器人上高效运行难题。北大等团队提出Jetson - PI方案,从异步推理算法等三层面优化,在Jetson Orin上控制频率提升8.66倍,推动具身智能向工业应用跃迁。

机器之心
算法论文8

训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD

清华大学THU-IDM团队与慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,预测难度,开销低、动态适应且平衡探索利用,在多任务表现佳,降本增效,有新范式。

量子位
开源动态8

错过它=落伍!只用一张照片+14秒,腾讯开源 HunyuanVideo-Avatar 带你玩转多角色数字人

HunyuanVideo-Avatar 是腾讯混元团队最新开放的多模态数字人生成模型。上传一张人物图片,再配上一段音频,模型即可在约 14 秒内输出分辨率最高 720p、情绪可控、动作丰富且支持多角色同屏的短视频。

小华同学ai