「结构化文档识别」共找到 997 篇相关文章
这款拿下 10k+ Star 的开源 LLM DevOps 平台,如何帮企业“批量孵化”AI 应用?——BISHENG 深度上手
BISHENG 是面向企业级场景的开源 LLM 应用 DevOps 平台,支持 GenAI 工作流等完整能力,已在众多头部组织落地。它围绕企业痛点搭建,有灵思 Agent、可视化工作流编排等亮点,适用于多场景。
Meta通过简单算术解锁LLM SoTA性能
大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供新思路。
海外GEO优化怎么做?15步可操作方法分享【干货】
白杨SEO分享海外英文GEO优化15步可操作方法。先阐述GEO与SEO、国内与海外GEO区别,后从高频词内容调研、发布原创数据等方面详细介绍优化步骤,还提及相关工具与平台。
传统训练效率很低?我们靠 “给模型降噪” 重新审视长上下文建模难题
文章指出长上下文模型处理长文本时易受噪声干扰,提出新评估指标IG分数和“上下文去噪训练(CDT)”方法。实验表明CDT优于现有策略,经其训练的开源模型在长上下文任务中性能媲美GPT - 4o。
AI是否足够的中立?宾夕法尼亚大学发现AI训练数据中的隐形偏见
宾夕法尼亚州立大学和俄勒冈州立大学研究发现,普通用户难察觉AI训练数据中种族与情绪绑定的偏见,直到AI性能表现出明显偏见才会警觉。不同族裔对偏见感知有差异,黑人更易识别。
首创“AI+真人”双保障模式!刚刚,百度健康推出7x24小时「能聊、有料、会管」AI管家
百度健康推出7x24小时AI管家,首创“AI+真人”双保障模式,提供全链路服务。它能精准咨询、推荐就医、管理健康档案,靠三层模型架构支撑,标志医疗AI向“智能健康伙伴”跃迁。
ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍
文章介绍HyperGraphRAG模型,它由知识超图构建、超图检索策略、超图引导的生成机制三部分组成。构建含知识超图构建、超图检索、生成机制等步骤,能提升检索效率与答案质量,或成ACL 2025爆款。
为什么我坚决投入GEO(生成式引擎优化)?
AI改变流量分配规则,站长竞争焦点从‘排名位置’变为‘被引用率’,GEO应运而生。作者总结了GEO打法,如优化全站、关键页面,做结构化数据增强,还应用于自身产品。
杜克大学、Zoom推出LiveMCP‑101:GPT‑5表现最佳但未破60%,闭源模型Token效率对数规律引关注
杜克大学与Zoom研究者推出LiveMCP - 101,这是针对真实动态环境的MCP - enabled Agent评测基准。含101个任务,实验显示先进模型成功率低于60%,研究为提升Agent能力提供改进方向。
EMNLP25 | "大模型在环"技术新突破:Dial-In LLM 推动中文客服意图聚类新范式
本文提出LLM-in-the-loop意图聚类框架,以传统聚类为骨架,微调后的中文LLM做语义裁判和命名批注。在10万+真实客服通话数据集上超越基线,解决现有方法依赖词向量、缺乏可解释性、调用大模型成本高的问题。