「硬件指令」共找到 737 篇相关文章
“机器人一次性卖完太亏!”真机智能刘智勇:今年中国本体厂商将大淘汰,拼的是世界模型?
InfoQ采访真机智能刘智勇,探讨具身智能领域进展、技术瓶颈及商业方向。刘智勇指出,VLN技术有进展但导航成功率待提升,世界模型可提升机器人能力,2026年本体厂商将收缩,盈利是核心。
拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?
现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。
上市后的摩尔线程,重心从造芯变成建生态
上市刚满15天的摩尔线程在MDC 2025大会展示全栈技术成果,回应市场关注。其创始人强调生态是GPU行业核心,正构建MUSA生态体系,MUSA架构升级,还揭晓‘花港’架构及两款芯片技术路线。
更会聊天、主打情绪价值,OpenAI 发布 GPT-5.1
今天凌晨,ChatGPT 模型升级为 GPT-5.1,官方主打更智能、更具对话性。它有 GPT-5.1 Instant 和 GPT-5.1 Thinking 两个子模型,本周内逐步向所有用户免费开放。升级重点在模型能力和个性化设置。
Skywork技术论坛一手分享:Agent与多模态的落地真相|甲子光年
8月19日,昆仑万维发起第一期Skywork全球技术论坛讨论会,众多高校和企业嘉宾围绕Agent与多模态展开交流。探讨了Agent商业化、多模态应用等核心问题,提出诸多判断,指出行业热度高但落地是关键。
2.1K Star 本地实时数字人!阿里开源低延迟数字人系统,2.2秒实时响应!
阿里在GitHub开源轻量本地实时数字人对话系统OpenAvatarChat,摆脱高性能硬件依赖等问题。它平均回答延迟2.2秒,有100+预置形象,支持多模态交互,提供多种部署方式,适配多场景。
多突触神经元模型问世,国内团队打造类脑计算新引擎,登上《自然·通讯》
当前人工智能高能耗问题凸显,脉冲神经网络被认为更具生物合理性、能效更高,但缺乏平衡计算效率和生物合理性的脉冲神经元模型。国防科技大学与中科院团队合作提出 MSF 脉冲神经元模型,相关研究发表于《自然・通讯》。
腾讯混元开源游戏AI生成新工具!RTX 4090就能制作3A级动态内容
腾讯开源游戏视频生成框架Hunyuan - GameCraft,基于混元视频生成搭建,操作简单,输入单张场景图、文字描述和动作指令就能生成高清动态游戏视频,解决传统工具瓶颈,性能优于主流模型。
英伟达回应了!没有后门、没有终止开关、没有监控软件
8月5日英伟达官方博客回应「H20后门」事件,首席安全官称芯片没后门,过去、现在和未来都不会有。其指出嵌入后门危害大,还以Clipper芯片为例说明预设后门会留隐患、摧毁信任。
斑马智行,开启汽车主动智能时代|甲子光年
2025年WAIC上,斑马智行联合通义及高通,首发行业首个基于高通8397平台的端侧多模态大模型解决方案。该方案让智能座舱从“被动响应”到“主动感知”,还打通产业链,实现多方面适配。