感知融合」共找到 808 篇相关文章

开源动态8

NeurIPS 25 | 中大&UC Merced等开源RAPID Hand,重新定义多指灵巧手数据采集

来自多机构研究者联合提出全新开源高自由度灵巧手平台 RAPID Hand。它能解决硬件瓶颈问题,实现稳定、高质量数据采集。其软硬协同优化,在操作表现与稳定性上优于现有方法,还具备低成本等优势。

机器之心
算法论文8

Meta超级智能实验室首篇论文:重新定义RAG

Meta超级智能实验室首篇论文提出REFRAG框架,重新定义RAG。它通过“压缩、感知、扩展”流程优化LLM处理外部知识方式,最高将首字生成延迟加速30倍,且性能无损。

量子位
推荐文章7

2025年8月全球新媒体艺术盘点

MANA平台8月全球新媒体艺术盘点,涵盖20件来自多国的作品,有荷兰模拟雷暴的艺术晚宴、中国探讨具身智能的作品等,涉及多领域创新,展现新媒体艺术多元魅力。

MANA新媒体艺术站
推荐文章7

从私域知识到智能 Agent:构建智能运维知识库

抖音算法工程师王宁在 QCon 大会分享,介绍将私域知识与 LLM 融合构建运维系统的方法,详解 SOPAgent 架构解决传统 AIOps 难题,还提及多模态数据处理、知识管理体系等亮点。

InfoQ
产品应用7

八爪鱼微电子:打造感算一体的智能识别生态

八爪鱼微电子成立于2019年,是国内智能门锁芯片与模组领域领先企业。它构建‘感算一体’底层技术体系,还通过标准共建、创新平台构建等推进生态建设,欲以技术与生态驱动行业创新。

芯师爷
新闻资讯7

OpenAI 开源模型泄露:六大技术细节

OpenAI 可能发布的开源大模型细节泄露,包含两款模型,1200 亿参数 MoE 模型和 200 亿参数稠密模型,专注文本处理。还涉及训练技术、激活函数、上下文窗口、注意力机制及底层架构等方面的技术细节。

AI寒武纪
开源动态8

1.5B参数撬动“吉卜力级”全能体验,国产开源之光多模态统一模型,来了

GPT-4o引发“吉卜力”风暴,改变AIGC范式。昆仑万维开源多模态统一模型Skywork UniPic,1.5B参数就能接近甚至超越十几亿参数专用模型,可在消费级显卡运行,还公开全套资源。

量子位
算法论文7

清华-腾讯联手:音频 - 视觉多模态任务统一框架

Crab是人大、清华和腾讯合作论文提出的模型,目标是高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。

CourseAI
新闻资讯7

「CV 铁三角」落定Meta,视觉 AI 如何向多模态演进?

Meta 高薪挖来「CV 铁三角」引关注,其研究成果与视觉 AI 向多模态演进路径高度贴合。他们过往十年协作,研究涵盖 S4L、BiT、ViT 等,构建起现代多模态 AI 基础框架。

机器之心
算法论文8

细粒度视觉推理链引入数学领域,准确率暴涨32%,港中文MMLab打破多模态数学推理瓶颈

香港中文大学MMLab团队发布MINT - CoT视觉推理方案,解决多模态数学推理难题。它引入特殊Interleave Token,构建专属数据集,采用三阶段训练策略,实验效果全面超越现有方法。

量子位