「结构化数据」共找到 3397 篇相关文章
CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据
北京通用人工智能研究院团队在CVPR 2026接收论文中,提出自动化数据引擎,用互联网视频构建SceneVerse++数据集,规模超现有同类,在3D检测、VQA、VLN任务提升性能,还指明3D空间智能发展方向。
国内首套:港中文团队发布7模态人体动作数据集,揭开大模型理解能力短板
港中文邢国良教授团队博士生蒋思阳完成 CUHK-X 多模态人体动作数据集,成果被 ACM MobiSys 2026 接收。用其测试主流大模型,发现理解人类动作平均正确率仅四成。该数据集数据收集方法反常规,还开展了基准测试。
给Agent加上知识图谱,开源版Palantir
Semantica是LLM、向量库与Agent框架下的语义/上下文层,能把碎片化企业数据变成结构化、可查询的上下文图与知识图谱。介绍了其面向对象、功能、优势、使用方法、架构等内容。
GPU 开始伸手进算法了:摩尔线程要加速 3D 高斯训练 | ECCV 2026
摩尔线程团队论文LiteGS被ECCV 2026接收,旨在加速3DGS训练。它从GPU底层光栅化、数据排列及致密化判断三层改进,进行系统与算法协同设计,开源后成果显著。
一文讲透程序编排的核心方式:从表达式语言到并行化实践
文章围绕程序编排展开,介绍单语句编排、类编排、流程编排、并行化编排等核心方式,分析多种编排框架特点及适用场景,还提及Lindorm泛时序数据解决方案,为开发者提供编排参考。
6.2k 谷歌开源LangExtract,主打精确溯源的长文档抽取
谷歌开源 Python 库 LangExtract,能让 LLM 依用户指令从非结构化文档提取结构化信息。它可处理临床记录等,具备精确源接地、可靠输出等特性,支持多模型,无需微调,适用于各领域。
谷歌开源高效文本提取 Python 库LangExtract
谷歌开源 Python 库 LangExtract,能用大语言模型从非结构化文本提取结构化信息。它定位精确、输出可靠,支持多模型,适应多领域,还能处理长文档,通过示例介绍了使用方法。
金融大模型升级决策平台!马上消费发布“天镜”3.0破解经验碎片化难题
6月6日“2025消费金融生态大会”在重庆举行,马上消费常务副总经理蒋宁推出全面迭代的“天镜”3.0。它开启从个体到群体智慧跃迁,挖掘隐性经验,能匹配最佳服务路径,还具备协同进化能力。
72天,从0到千万小时产能,这个具身「新锐派」凭什么接管数据赛道?
觅蜂科技成立72天亮出破局方案,推出MEgo系列无本体数据采集硬件,同步发布数据服务平台、治理引擎,启动蜂巢数据共创行动,与多家头部企业合作,欲解决具身智能数据难题。
三个方法让Cursor构建网站更加精美:Browser MCP 克隆 + 提示技巧 + 组件修改!(Bolt、Lovable)
文章介绍用Browser MCP克隆网站结构、结构化Prompt模板及UI组件修改三种方法,让Cursor构建网站更精美,还分享Lovable设计技巧、让AI网站变好看的方法及早期公司获客策略。