「空间智能大模型」共找到 9750 篇相关文章

新闻资讯7

训练机器人方式对了吗?英伟达DreamZero双榜第一新反思

NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。

机器之心
新闻资讯7

谨慎用OpenClaw:上海科技大学发布其全面安全体检报告

上海科技大学联合上海人工智能实验室对爆火的智能体OpenClaw做安全审计,在34个测试场景中,整体安全通过率58.9%,暴露出多方面问题,研究据此给出纵深防御策略。

AIGC开放社区
开源动态8

微软重磅开源!22K星的 VibeVoice 再添新成员,60分钟音频 ASR 端到端统一输出!

现在的 ASR 模型处理长音频存在断章取义、说话人错乱等问题。微软开源 VibeVoice-ASR,可一次性处理 60 分钟音频,实现“三位一体”输出,补齐 VibeVoice 生态,还介绍了特点、架构、使用方法与应用场景。

开源星探
产品应用8

OpenAI 推出 GPT-5 驱动的安全卫士Aardvark:Codex 绝佳搭档

OpenAI推出由GPT - 5驱动的自主安全研究智能体Aardvark,用于软件安全保障。它能持续分析代码仓库,识别并修复漏洞,目前在内部及合作伙伴代码库效果良好,正处私有测试阶段。

AGI Hunt
开源动态8

开源AI教育视频生成神器,3Blue1Brown风教学动画一键搞定!

新加坡国立大学Show Lab团队开源Code2Video,能让代码变高质量教育视频,逻辑是用代码驱动视觉效果。它有智能解析等特性,可解决传统教学视频形式单一等问题,应用场景广泛。

开源星探
新闻资讯7

谷歌市值突破3万亿!重大利好力推股价大涨

谷歌母公司Alphabet股价周一大涨,市值首破3万亿美元,成全球第四家达此成就的公司。近期谷歌反垄断案落定避免拆分,且其模型表现优异,驱动多业务转型,投资者信心大增。

新智元
开源动态8

社区供稿 | VibeVoice实现90分钟、多角色播客生成,拓展语音合成新边界

微软亚洲研究院提出全新语音生成模型 VibeVoice,采用 next - token diffusion 机制,能将文字脚本转为最长 90 分钟、最多 4 人对话的高质量播客音频,在多方面有显著优势,未来潜力大。

Hugging Face
算法论文8

北大、蚂蚁三个维度解构高效隐私保护机器学习:前沿进展+发展方向

北大李萌课题组与蚂蚁集团研究者共同完成综述,从协议、模型和系统三个维度梳理隐私保护机器学习(PPML)领域,指出当前痛点,给出优化策略,还提出跨层级协同优化方向。

机器之心
算法论文8

创智突破:AI首次自主发现106个超越人类设计的神经网络架构

创智学院团队发布的AI超智能系统ASI - ARCH,自主发现106个超越人类设计的神经网络架构,建立“科学发现缩放定律”,实现从“自动化优化”到“自动化创新”转变,还将成果开源推动研究发展。

机器之心
开源动态8

震撼发布!最大人体动作数据集 MotionMillion 正式登场

上海交通大学研究团队构建高效标注流程,发布最大人体动作数据集MotionMillion,含超2000小时、200万条文本 - 动作配对数据。还推出评测体系MotionMillion - Eval,训练70亿参数动作生成大模型,刷新SOTA。

带你学AI