「能碳产业大模型」共找到 10507 篇相关文章

算法论文7

首个多人对话视频生成框架MultiTalk,角色有表情还能互动

现有音频驱动人体动画方法多聚焦单人,处理多音频流能力弱、指令跟随有局限。中山大学提出多人对话视频生成新框架MultiTalk,介绍了技术原理,演示效果显示其指令跟随能力强、伪影少。

带你学AI
产品应用8

实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型

今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。

带你学AI
新闻资讯7

小华智慧成立发布仪式在首钢园举办,AI 赋能会展新升级

大新华会展旗下小华智慧科技在北京首钢园举办成立发布仪式,正式亮相会展行业首个自研AI4MICE平台,践行“ALL IN AI”战略,探索会展行业数智化升级与人机协同新模式。

首钢园
新闻资讯7

跟Claude谈个恋爱怎么了?Nature最新研究:真能给人聊傻了

Nature旗下研究指出,聊天机器人持续顺着、理解、陪伴用户,可能让正常人怀疑现实。研究总结出“放大螺旋”框架,含语言镜像、超个性化、谄媚三组件,叠加会成妄想放大机。OpenAI也关注此问题。

量子位
算法论文8

软体机器人控制难题获解,比传统方法节能75倍,还能闭眼干活

美国两校研究人员结合生物学与人工智能工程学,用‘神经储备池’技术控制生物混合软手臂,实现稳定追踪、自我感知和低能耗运行,还在多方面展现优势,目前研究处于仿真阶段。

DeepTech深科技
算法论文8

把VLM塞进隐式世界模型,小鹏机器人新框架让机器人长出物理直觉

机器人大脑架构中VLM和VAM路线各有短板,香港大学、小鹏机器人等团队提出DIAL框架,让VLM在原生特征空间做隐式世界建模,解耦认知决策与底层执行,在机器人部署中表现优异。

量子位
开源动态7

画个图就能管理知识?这个开源工具把笔记和画板合二为一了

作者发现开源工具Revezone,它将白板和笔记合二为一,解决图文割裂问题。有Excalidraw、Tldraw白板及类Notion笔记功能,还支持拖拽分屏。提供线上和桌面版,适合多类人群,优势明显且免费。

小华同学ai
开源动态8

具身智能体操作系统PhyAgentOS,赋能全球Physical AI 技术挑战赛冠军

2026年4月27日,中山大学HCP实验室研发的PhyAgentOS开源框架,助力11岁开发者Arjun获全球Physical AI技术挑战赛冠军。该框架降低开发门槛,打通执行闭环,加速具身智能落地。

AI科技评论
开源动态8

诺奖得主实验室走出的中国团队,正用世界模型重构生命分子设计

过去 AI 分子设计多困于‘模态孤岛’,难以跨模态理解和设计。诺奖得主实验室走出的中国团队推出 ODesign 开源项目,将多模态分子纳入统一框架,展现跨模态迁移能力,团队创立英灵殿科技欲重构药物研发流程。

机器之心
开源动态8

「被动感知」到「理解接触」!它石智航重磅发布OmniVTA视触觉世界模型

它石智航联合六大顶尖机构推出OmniVTA视触觉操作框架和OmniViTac大规模视触觉数据集。该框架核心是从被动感知到主动预测触觉,通过多模块协同让机器人有预测、理解和修正能力,实验表现优。

新智元