「数据组织范式」共找到 3498 篇相关文章
RAG新SOTA,还在5亿条数据上跑进秒级,只有它了
本文围绕RAG技术展开,指出传统RAG在多跳推理等方面存在局限。介绍了GraphRAG、HippoRAG 2的优缺点,重点阐述Zleap AI的SAG方案,它用超边结构重构数据底座,在多跳问答测试中表现出色,还能在大规模数据下低延迟落地。
CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据
北京通用人工智能研究院团队在CVPR 2026接收论文中,提出自动化数据引擎,用互联网视频构建SceneVerse++数据集,规模超现有同类,在3D检测、VQA、VLN任务提升性能,还指明3D空间智能发展方向。
面向6G环境感知通信!西电开源3Dx3D无线电地图数据集与生成式基准框架
面向6G,西安电子科技大学等团队联合提出高分辨率多模态三维无线电图谱数据集UrbanRadio3D,构建三维无线电图生成框架RadioDiff-3D,弥补了当前主流RM构建方法与数据集的局限。
国内首套:港中文团队发布7模态人体动作数据集,揭开大模型理解能力短板
港中文邢国良教授团队博士生蒋思阳完成 CUHK-X 多模态人体动作数据集,成果被 ACM MobiSys 2026 接收。用其测试主流大模型,发现理解人类动作平均正确率仅四成。该数据集数据收集方法反常规,还开展了基准测试。
提出“AI虚拟细胞”的团队,现在要虚拟整块组织了
2024年12月,瑞士洛桑联邦理工学院夏洛特·邦纳团队提出“AI虚拟细胞”。一年多后,AIVC方向有进展,但虚拟组织层面工作少。近日团队推出VirTues基础模型,解决空间蛋白质组学数据分散问题,在多任务表现好,还用于三阴性乳腺癌预测。
Gemini 3预训练负责人警告:模型战已从算法转向工程化!合成数据成代际跃迁核心,谷歌碾压OpenAI、Meta的秘密武器曝光
2025年底大模型“年终决战”,Gemini 3强势突围。其预训练负责人Sebastian Borgeaud指出,谷歌转向“做系统”,AI进入“数据有限”阶段,合成数据等构成未来进化路径,还分享了预训练热点与挑战。
Palantir 创始工程师深度分享:FDE 模式是 Agent 时代的 PMF 范式
本文编译前 Palantir 高管 Bob McGrew 对 FDE 模式的思考。FDE 团队填补产品与客户需求差距,交付有价值成果。在 AI Agent 时代,因产品需大量探索且要从企业内实践出发,FDE 或成创业公司新范式。
2025 AI Agent全景报告:50+权威数据,85%企业已上车、发展趋势预测!
index.dev发布AI Agent调研报告,盘点50多个关键数据,涵盖应用趋势、场景、工作流等。截至2025年,85%组织集成AI Agent,市场价值73.8亿美元,预计2032年达1036亿美元。报告还分析技术栈各层应用及市场趋势。
麻省理工 NANDA 研究发现,只有 5% 的组织把 AI 工具大规模用于生产
麻省理工 NANDA 报告指出,95%企业组织的 AI 投入无回报,仅 5%将 AI 工具规模化用于生产。原因是 AI 系统存数据、适应变化及持续学习能力不足,领导层对 AI 项目信心下降。
72天,从0到千万小时产能,这个具身「新锐派」凭什么接管数据赛道?
觅蜂科技成立72天亮出破局方案,推出MEgo系列无本体数据采集硬件,同步发布数据服务平台、治理引擎,启动蜂巢数据共创行动,与多家头部企业合作,欲解决具身智能数据难题。