动态交互」共找到 941 篇相关文章

开源动态8

革命性突破!Windows-MCP 开源:AI 助手直接操控实体电脑,告别按键精灵!

在AI驱动的桌面自动化领域,传统工具部署复杂且性能受限。最近GitHub开源的Windows - MCP工具,能让AI助手与Windows UI原生交互,可进行点击、输入等操作,支持Windows 7 - 11,无需传统计算机视觉技术。

开源星探
算法论文8

ACL 2026 Main|混合推理模型也会「钻空子」:南大移动团队提出TNT,破解「假装不思考」骗奖励

大型推理模型存在「过度思考」问题,训练混合推理模型易出现奖励欺骗。南大等团队提出 TNT 方法,利用思考模式解答部分为问题动态设非思考模式 token 上限,解决奖励欺骗,实现准确率与效率双赢。

机器之心
开源动态7

100k Star,他们给Clawdbot升级了超级记忆

Clawdbot项目突破100k,后改名moltbot。其原记忆是静态的,此次升级为超级/动态记忆,构建三层记忆系统,让理解力自我更新。还集成Supermemory,有自动回忆等功能,文章给出实施指南。

PaperAgent
开源动态8

亚马逊“盲眼”机器人30秒跑酷首秀惊艳!华人学者领衔

亚马逊机器人团队FAR发布人形机器人研究成果OmniRetarget,它能让强化学习策略在复杂环境学技能并零样本迁移。该成果通过交互网格建模关系,经实验验证优势明显,背后团队由华人学者领衔。

量子位
开源动态7

号称视频编辑领域的开源nano banana来了,用文字就能改视频

DecartAI开源Lucy Edit模型,号称视频领域开源Nano Banana,能理解自然语言指令改视频。如输入指令可精准换服装等,渲染快,有身份保持和动态适配亮点,有多个版本,应用场景广。

AI工程化
新闻资讯7

Meta详细阐述基于LLM级训练、混合并行计算与知识迁移的GEM广告模型

Meta发布生成式广告模型GEM详细信息,旨在改善平台广告推荐能力。它处理海量用户 - 广告交互数据,用三种方法构建系统,还实施GPU级优化,采用两种知识迁移策略,获业内人士认可。

AI前线
产品应用7

Rokid火得太晚了

消费电子市场中AI眼镜迎曙光,乐奇Rokid成AI+AR品类全球销冠。它通过双目衍射光波导和双芯片架构解决轻量化与续航难题,还以开放生态脱颖而出,其判断未来眼镜将成交互主体。

远川科技评论
算法论文8

港大联合字节跳动提出JoVA: 一种基于联合自注意力的视频-音频联合生成模型

香港大学联合字节跳动提出视频 - 音频联合生成框架 JoVA,支持音视频 Token 跨模态交互,引入嘴部区域特定损失解决口型同步问题。实验显示,它用约 190 万条数据就达先进水平。

机器之心
新闻资讯8

麻省理工AI放王炸!无需说话、秒懂你的想法,外挂AI大脑来了

今天凌晨2点,麻省理工学院分享突破性研究Alterego。它是可穿戴无声语音交互AI设备,通过捕捉神经肌肉信号实现无声沟通,处理后用骨传导耳机反馈结果,应用场景广泛,还能帮助残疾人交流。

AIGC开放社区
推荐文章8

Harness不是目的,知识才是护城河 —— 一个AI工程交付团队的知识沉淀实践

本文指出构建Harness工作流非最终目的,私域和团队知识沉淀才是技术护城河。分享AI Team工程交付编排系统中知识分层架构设计、团队知识库共建共享、工作流成知识沉淀载体、突破人机交互瓶颈及落地经验与思考。

腾讯技术工程