长文档抽取」共找到 942 篇相关文章

算法论文8

传统训练效率很低?我们靠 “给模型降噪” 重新审视上下文建模难题

文章指出上下文模型处理文本时易受噪声干扰,提出新评估指标IG分数和“上下文去噪训练(CDT)”方法。实验表明CDT优于现有策略,经其训练的开源模型在上下文任务中性能媲美GPT - 4o。

深度学习自然语言处理
产品应用8

解析天花板?TextIn xParse如何为RAG打造「零损耗」知识管道

在AI应用发展中,LLM与RAG系统成核心引擎,但项目落地时模型表现常难达预期,根源在于文档解析质量。TextIn xParse能为RAG打造‘零损耗’知识管道,本文从多方面对其解析能力进行了解读。

深度学习自然语言处理
算法论文8

Qwen团队发布上下文Reasoning模型QwenLong-L1,超越o3-mini

Qwen团队发布上下文Reasoning模型QwenLong - L1。当前大模型处理文本有训练效率低、过程不稳定难题。QwenLong - L1用分阶段强化学习等方法,实验中超越o3 - mini、比肩Claude,还在案例表现出色。

深度学习自然语言处理
新闻资讯7

传 GPT-5.6 明日发布:要打赢 Fable 5,光靠刷分可不行

近期GPT-5.6发布消息不断,上线或进入倒计时。它被拿来与Fable 5对比,Fable 5任务处理出色,而GPT-5.5有短板。GPT-5.6虽跑分亮眼,但被指‘benchmaxxed’,还存在脱离现实常识问题。

AI科技评论
新闻资讯7

红杉合伙人:2026,AGI已经来了

红杉资本合伙人 Pat Grady、Sonya Huang 联合发文称 AGI 已至,以 Claude Code 为代表的周期智能体是例证,举例其自主找候选人全程仅 31 分钟。他们给出指数曲线,认为 2026 年是周期智能体元年,但有人觉得预测太乐观。

机器之心
推荐文章7

分享2个模型省钱大法

文章分享两个大模型API省钱技巧。一是文本转截图,适用于输入输出短、费用花在输入token的任务;二是音频加速识别,OpenAI语音识别模型Whisper按音频时收费,加速音频可省钱,还可包装成API服务盈利。

AGI Hunt
开源动态8

第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力

新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。

新智元
产品应用7

企业微信给AI写了94份说明书,Claude Code现在能直接干活

北京时间8月17日,企业微信更新,将能力域从7个扩到12个,参考文档扩到94份。介绍了其能操作的业务品类,分析文档权重体现的产品意图,阐述三个设计细节,指出想象空间、机会及坑,强调此次更新比首次更重要。

AI Reading Hub
开源动态8

R-HORIZON:程推理时代来临,复旦NLP&美团LongCat重磅发布LRMs能力边界探测新范式

复旦大学与美团LongCat Team联合推出R - HORIZON,它是首个系统性评估与增强LRMs链推理能力的方法与基准。提出Query Composition方法构建评测基准和训练数据,评测发现主流模型链推理性能断崖式下降,还分析出三大瓶颈,训练后模型性能双重提升。

机器之心
推荐文章8

通用Agent啥样

视频探讨大厂做基于命令行编程工具的原因,介绍命令行Agent,剖析其等于庞大工具生态、经典Unix组合哲学与现代AI调度能力,指出通用Agent骨架由AI大脑、命令行身躯和MCP感官构成。

newtype AI