跨本体」共找到 343 篇相关文章

产品应用8

生数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务

生数科技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。生数科技双轨布局,Vidu与MotuBrain同根。

量子位
产品应用8

阿里发布Qwen3-TTS:语言混合无缝切换,方言音色全面覆盖!

TTS技术从单一合成进化到多模态表达,但传统模型在语言/方言混合场景有不足,商业工具费用高且不开源,开源方案训练数据少。阿里推出Qwen3 - TTS,实现人类级自然度和表现力,功能强大,应用场景多。

开源星探
产品应用8

突破遥操瓶颈!全新无本体数据世界动作模型Noe-0发布

穹彻智能发布世界动作模型 Noe - 0,全链路采用无本体采集数据。其数据来自真实环境,配合 World Action Model 架构和 AI - Native 数据基础设施,跑通从真实世界经验到机器人能力转化的完整链路,是具身智能的里程碑。

机器之心
新闻资讯8

刚刚,谷歌发布机器人最新「大脑」模型!思考能力SOTA,还能「物种」学习

谷歌旗下DeepMind发布Gemini Robotics 1.5系列模型,包括Gemini Robotics 1.5和Gemini Robotics - ER 1.5,能让机器人学会‘思考’,还可具身形态学习技能,有望开启通用机器人新时代。

新智元
开源动态8

阿里开源Mobile-Agent-v3:多模态GUI智能体,实现平台自动化突破!

全新自动化时代,GUI智能体融入日常。阿里巴巴通义实验室推出GUI - Owl与Mobile - Agent - v3,实现平台自动化突破。文章解析其发展历程、技术创新,且项目开源,商业化潜力引关注。

AIGC开放社区
算法论文8

AI打通第一/第三人称视觉,视角视觉理解新SOTA|ICCV 2025 Highlight

INSAIT、复旦大学等联合提出ObjectRelator框架,让AI精准匹配不同视角下同一物体,实现视角统一表征与理解。它在Ego转Exo和Exo转Ego任务上超基线模型,已被ICCV 2025接收,代码开源。

量子位
开源动态8

告别依赖地狱!新型Python打包神器,支持三种打包模式,平台,零配置!

分发Python应用时,环境配置和依赖管理让人头疼。刚开源的Python打包工具PyFuze功能全面,基于cosmopolitan和uv构建,有三种打包模式,兼容GUI应用,平台运行,还能一键将项目打包为单个可执行文件。

开源星探
产品应用8

mem0推出王炸mcp工具OpenMemory,打造用户私有、应用的共享记忆层

mem0项目推出OpenMemory MCP,这是专为兼容MCP的AI客户端设计的私有记忆层,能解决AI工具的Context共享问题。它强调隐私和本地控制,功能实用,获用户积极反馈。

AI工程化
算法论文8

视频生成不再「断片」:OneStory给模型装上「选择性记忆」,镜头讲故事人物场景始终如一丨CVPR'26

多镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为多镜头视频生成建立镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。

量子位
算法论文7

AIAAJ | 西工大张巧、张伟伟等:多专家特征融合网络架构预测声速抖振气动噪声

为解决气动噪声数据中流动状态与空间位置分布不平衡导致的MLP预测精度不足问题,本研究提出多专家特征融合网络架构,以声速抖振气动噪声为算例评估,可降低MLP算法MSE,泛化性更好。

力学与人工智能