传感器融合」共找到 535 篇相关文章

推荐文章8

面向多工具任务调度的两种路径:MCP vs Agent + Function call

本文围绕大语言模型智能应用中的工具与数据接入问题,介绍了基于 Agent + Function Call 的动态调度机制与基于 MCP 的标准化接入框架,分析了不同场景下的适用性,还探讨了二者未来的协同融合方向。

阿里云开发者
开源动态8

阿里通义的视觉RAG革命!VRAG-RL:基于强化学习的视觉感知RAG框架,性能飙升30%

阿里巴巴通义实验室推出VRAG - RL,融合视觉感知、多模态推理与强化学习,已在GitHub开源。它破解传统RAG处理视觉数据难题,通过创新机制提升性能,在多数据集表现出色,还将向更拟人化和低幻觉方向发展。

开源星探
开源动态7

n8n是开源工作流程自动化工具,提供直观界面创建自定义流程,支持超400应用集成。过去一年增长迅速,活跃用户超20万,ARR增长5倍,GitHub获77.5k star。介绍其创立背景、优势特点,用户评价褒贬不一,还提及与其他工具对比及“公平代码”理念。

冬梅
推荐文章8

复旦硬核青年:破解核材料百年难题,为人造太阳锻造不灭铠甲

张宏亮童年时便渴望稳定电力,考入复旦后历经行业寒冬。他深耕核材料研究,取得多项成果,能用新技术降低成本、能耗,揭示材料新机制,回国后又搭建研究系统、优化工艺等,还看重产学研结合和跨界融合

DeepTech深科技
产品应用7

姚顺雨Agent能力交卷!腾讯混元Hy3把元宝练成了打工人

腾讯混元Hy3正式版发布,总参数295B、激活参数21B,最大支持256K上下文。它是快慢思考融合的MoE模型,重点提升Coding和Agent能力。其加持下,元宝大升级,能完成办公、生活等多场景任务。

量子位
产品应用8

一个月的活一周干完!英伟达世界模型训练速度飙升400%

英伟达世界动作模型 DreamZero 训练成本高、耗时长,无问芯穹与清华等推出的 RLinf 框架,从算子融合到 I/O 全链路系统级重构,使训练吞吐拉高近 4 倍,还解决多类性能瓶颈,保证训练效果。

新智元
产品应用7

神隐许久的光年之外,造了款AI浏览器Tabbit,能打吗?

浏览器成AI落地重要战场,巨头纷纷布局。光年之外推出Tabbit AI浏览器,集多种功能于一体,深度融合AI能力,已开启公测。实测其功能实用,虽有不足但已改变使用习惯,AI浏览器或重塑人与信息关系。

机器之心
开源动态8

Ilya刚预言完,世界首个原生多模态架构NEO就来了:视觉和语言彻底被焊死

当Ilya断言大模型未来在于架构创新时,中国团队推出全球首个可大规模落地的开源原生多模态架构NEO。它颠覆传统拼接模式,从根上融合视觉与语言,以简洁架构证明架构聪明才是下一代AI竞争力。

量子位
产品应用8

Gemini 3.0还在预热,中国AI抢先!30秒造APP全网首测

谷歌Gemini 3.0预热时,国内新生AI神器蚂蚁灵光上线。它能30秒造APP,实现“生成涌现”落地,以闪应用开启范式革命,用信息美学融合全模态,探索“摄像头+AI”新形态,让普通人提前感受未来AI世界。

新智元
算法论文8

字节Seed提出M3-Agent:像我们一样"记住"与"思考"的长视频理解新范式

字节Seed提出M3 - Agent,这是首个融合实时视听输入、类人记忆构建与自主推理的多模态智能体。它模仿人类记忆机制,解决长视频理解痛点,已被CVPR 2025收录并开源代码,为通用人工智能奠定基础。

深度学习自然语言处理