「多模态数据融合」共找到 3534 篇相关文章
GPT-5.4发布:OpenAI首个大一统模型,简直是龙虾原生
OpenAI发布GPT - 5.4,这是其首个大一统模型,将推理、编程等能力融合,且单项性能领先。它在知识工作、计算机使用、编程调试等能力提升,定位AI数字员工,虽单价高但有省钱机制。
大模型Agent的核心还是prompt? 目前有什么挑战?
文章指出大模型Agent核心并非Prompt,而是工程化架构设计、工作流编排与数据闭环。介绍Flow Engineering等概念及工具,分析规划、记忆、工具使用要点,还谈及开发面临的延迟、稳定等挑战,并给出应对建议。
大模型中标TOP10里的黑马:中关村科金的应用攻坚之道
2025 年中国大模型产业招投标市场爆发,应用类项目占比近六成。中关村科金以 23 个中标项目入围应用类 TOP10,在多行业落地成果显著。2026 年行业将聚焦 ROI、数据壁垒等方面。
Sora APP 60天留存率:0
a16z合伙人Olivia Moore分享数据,Sora APP下载爆发快,但用户留存率从首日10%降至60天的0%。虽有功能更新、取消注册门槛等举措,用户仍不买账,或因算法、功能设计等问题。
GPU为什么能取代CPU,成为计算领域无可争议的核心?
文章介绍GPU取代CPU成计算领域核心的原因。对比二者架构差异,指出人工智能、大数据和HPC等领域需并行处理,GPU正擅长此。软件支持也推动其普及,未来还会在更多领域发挥作用。
95% 企业 AI 投资无回报?华为云 × 合力亿捷:客服 Agent 给出解题思路
麻省理工报告显示 95% 企业生成式 AI 投资无回报,但指出办公自动化等领域回报率高。客服 AI Agent 是热门方向,华为云与合力亿捷合作的方案解决行业痛点,打通数据闭环,有示范意义。
小扎又开源了:7B实现自监督学习SOTA
Meta发布全新开源视觉模型DINOv3,首次证明自监督学习模型能在广泛任务中超越弱监督学习模型。它用无标注方法,扩展数据和模型规模,支持标注稀缺场景,在多任务实现SOTA。
16K星 Zep凭一张“动态记忆图”吊打一众Graph RAG
现有的RAG框架多依赖静态文档检索,无法满足企业对动态知识整合的需求。本次分享的Zep提供新型智能体记忆层服务,通过核心组件Graphiti动态整合数据,在LongMemEval基准测试中表现出色。
港科大&北京人形提出LOVON:足式机器人开放世界全域目标追踪新范式!
港科大广州联合北京人形创新中心推出LOVON框架,融合大语言模型、开放词汇视觉检测和语言 - 运动映射模型,解决足式机器人开放世界全域目标追踪难题,有抗干扰视觉处理等优势,性能超传统方法。
2G 内存跑 Gemma 3n 完整版!全球首个 10B 内模型杀疯 LMArena:1300 分碾压记录
当地时间6月26日,谷歌正式发布Gemma 3n完整版,可在本地硬件运行。它是开源大模型,具多模态能力,最低2GB内存设备就能跑,E4B模型LMArena测评表现佳,还有MatFormer架构等多项创新。