传感器融合」共找到 535 篇相关文章

产品应用7

实测可灵O1,AI视频界的Banana也来了。

可灵推出全新多模态视频大模型可灵O1,融合多种视频生成与修改能力。实测显示,它能实现视频内容增删、特定内容修改、扣绿幕、动作迁移、风格更改等功能,虽有局限,但开启用嘴改视频新时代。

数字生命卡兹克
新闻资讯7

暴走东京电玩展,Game Show也AI上了

东京电玩展上,网易、腾讯等中国游戏厂商摆大展台,AI厂商也秀出肌肉。阿里展出通义千问和通义万相,拿出大模型商用化方案;3D生成受关注,混元3D、VAST Tripo等受游戏厂商青睐;AI陪玩HakkoAI海外首秀成绩亮眼。

量子位
产品应用8

一家低调的工业AI公司,用TPT跨越生成式AI鸿沟|甲子光年

麻省理工学院报告指出约95%生成式AI企业试点无实质回报,存在生成式AI鸿沟。工业AI落地难,中控技术的TPT及TPT 2模型,在兰州石化榆林化工应用效果好,其优势源于数据和行业经验,也体现了破局决心。

甲子光年
新闻资讯7

动物间谍:一只披着羊皮的狗……

中国科学院派披着羚羊皮的深圳云深处X30四足机器人混入可可西里藏羚羊群,观察其行为。该机器人装备多类传感器和定位系统,能实时传输数据,还可远程控制,此前也有不少用机器人研究动物的案例。

AGI Hunt
新闻资讯8

刚刚,OpenAI 发布了GPT-5 前菜:ChatGPT Agent

OpenAI发布ChatGPT Agent,它是统一智能代理系统,融合多种功能与工具,能动态选处理路径。在多测试中表现佳,采用强化学习微调新架构。使用体验似与人协作,OpenAI采取安全措施,还探索商业、分批开放,业内看法不一。

AGI Hunt
算法论文8

ICML 2025 Spotlight | 多模态大模型暴露短板?EMMA基准深度揭秘多模态推理能力

最新研究推出 EMMA 基准测试,揭示顶尖多模态大语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。

机器之心
产品应用8

AI时代CRM的重生之路:阿里云上的Salesforce如何改写SaaS规则?

AI 浪潮下传统 CRM 面临效率、合规与智能融合等问题。阿里云上的 Salesforce 展出“中国定制化 AI CRM”方案,历经六年探索,从合规、生态到 AI 闭环构建能力,通过多行业实践重塑企业增长逻辑,为 SaaS 行业提供范本。

AI前线
算法论文8

ICLR 2026 Oral|多模态知识图谱对齐难:破解噪声关联至为关键

在数据多元化时代,多模态知识图谱能为下游应用提供数据支撑,实体对齐是构建知识图谱的核心技术。但大规模知识图谱关联与融合面临噪声和潜隐关联挑战。四川大学团队提出 RULE 方法,缓解了这些影响,论文被 ICLR 2026 接收为 Oral。

机器之心
产品应用8

vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼

vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、高效策略,还有高质量数据和高性能平台支撑。

量子位
产品应用8

腾讯混元AI Infra如何优化Hy3 Preview:一次大模型推理性能提升的技术拆解

文章聚焦腾讯混元AI Infra对Hy3 preview模型的推理性能优化。从算子优化与融合、并行策略等五大维度,剖析技术思路、算法及收益,如Attention算子单batch长文本最高加速2.95x,还提及后续显存优化等工作。

腾讯技术工程