结构化知识」共找到 1558 篇相关文章

开源动态8

PDF解剖大师来了!LandingAI开源神器,这个Python库让百页文档秒变结构数据!

复杂文档处理是数据分析痛点,传统方法常因布局复杂失准。LandingAI团队在GitHub开源Python库Agentic - Doc,可从复杂文档提取结构数据,支持多格式,新增多项功能,提升处理效率和准确性。

开源星探
开源动态8

别问树模型了!死磕结构数据,清华团队把大模型表格理解推到极限

AI 时代处理结构数据成痛点,LLM 大模型难以满足生产要求。清华大学与稳准智能联合发布的 LimiX 系列模型,做到真正通用,在跑分和实际落地表现出色,其轻量级版本 LimiX - 2M 适合边缘设备和科研场景。

机器之心
开源动态8

攻克结构长文档检索难题!新框架让模型告别“结构性失明”

SEAL团队推出全新对比学习框架SEAL,通过带结构感知和元素对齐,将文档宏观层级结构和微观元素语义融入Embedding空间,提升模型对结构数据的理解。在BGE - M3模型上提升了MRR@10指标,还开源了万级字数长文档数据集。

量子位
开源动态8

结构预处理让DeepSeek准确率提升51%,现已开源丨清华&深言

零成本降低大模型幻觉新方法LingoEDU,让DeepSeek准确率提升51%。它对上下文精准切分,形成篇章结构树。能解决现有方案两难困境,在多方面实验表现出色,有根治幻觉等核心价值。

量子位
推荐文章8

Harness不是目的,知识才是护城河 —— 一个AI工程交付团队的知识沉淀实践

本文指出构建Harness工作流非最终目的,私域和团队知识沉淀才是技术护城河。分享AI Team工程交付编排系统中知识分层架构设计、团队知识库共建共享、工作流成知识沉淀载体、突破人机交互瓶颈及落地经验与思考。

腾讯技术工程
推荐文章7

大模型微调知识与实践分享

文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。

阿里云开发者
产品应用7

AutoDev 预上下文引擎:预生成代码语义信息,构建 AI 编程的知识基座

文章介绍 AutoDev 预上下文引擎,指出向量代码检索性价比低,提出用预生成上下文提升 RAG 效果。Context Worker 能深度解析代码,支持多语言,使用简单,还可结合 MCP 服务获取上下文知识

phodal
算法论文7

表格建模也能Scaling?树模型的时代要改变了

文章指出 AI 算力增长与结构数据建模以树模型为主形成反差。浙大 X 蚂蚁 AIforData 团队探索结构数据预训练,在表格数据和行为序列预训练上有成果,验证了 Scaling Law,预示结构数据建模范式将改变。

机器之心
推荐文章8

构建 AI 时代的知识底座:直播数据 LLM Wiki 实践

文章围绕直播数据 LLM Wiki 实践展开,指出领域知识沉淀面临挑战,引出 LLM Wiki。介绍其实际效果,如指标召回、代码生成等,阐述构建方法、架构设计、编译流水线、检索方式,还提及增量编译与持续 Lint,最后给出未来规划。

阿里云开发者
推荐文章7

深度解析LLM Wiki / Obsidian-Wiki / GBrain:Agent时代知识的“自组织”与“自进

文章深度解析LLM Wiki、Obsidian - Wiki和GBrain项目,探讨Agent时代知识的“自组织”与“自进”。指出传统知识管理有短板,而这些项目通过不同方式解决知识结构、沉淀和更新问题,各有优劣。

阿里云开发者