「长文档抽取」共找到 942 篇相关文章
Memvid:把你的文档库变成一个小巧的视频,还能瞬间搜出你想要的!
传统向量数据库因高成本和复杂运维让开发者却步。开源项目Memvid将文本数据存入视频文件,能高效检索,解决存储冗余、检索延迟和网络依赖问题,使用简单,虽处概念原型阶段但值得尝试。
TACL 综述 | 别只卷架构了——长文本模型的能力天花板,其实是数据决定的
该 TACL 综述首次从数据视角审视长上下文语言模型,指出长上下文能力本质是数据驱动。它建立分类体系,明确高质量长文数据条件,给出核心能力的数据配方与评估法,还整理数据集和基准,提出待解问题。
肝脏也能“按需定制”?科学家研发新型植入物,让肝组织在体内自己长
哈佛大学怀斯研究所团队研发“BOOST”策略,结合组织工程与合成生物学,创造可在体内远程接收成长指令的工程化肝脏构建体,在动物实验中实现植入后按需扩增,为解决肝脏移植供体短缺带来新希望。
GitHub 上 6.4 万标星的 Hermes Agent,比 OpenClaw 响应快太多!还会成长进化!
AI Agent领域热闹,OpenClaw有响应慢等问题。Nous Research今年2月开源的Hermes Agent爆火,获64.8K Star。它是自学习型AI智能体,有六大核心特性,支持换模型,更新快,还支持一键安装。
Claude Code 更长更快!Agent能自己管项目了!从 Todo 升级到 Task
上周Claude Code团队更新任务清单系统,从「记事本」升级为「项目管理系统」。因模型能力增强,需求变复杂,原TodoWrite无法满足,新Task系统解决了任务依赖协调问题,支持复杂项目。
超强开源OCR,手写体识别能力超dots.ocr,封存多年的老文档数字化有救了。
文章推荐新开源的OCR系统Chandra,它对手写体识别做了优化,官方测评数据显示比dots.ocr强。介绍其适用于多场景及功能特点,还展示了不同场景的识别效果,建议有需求者多对比测试。
惊天丑闻!OpenAI档案曝光,奥特曼捏造YC董事长身份,虚伪真面目被揭穿
OpenAI奥特曼亲自透露GPT - 5今夏发布,还谈模型版本等问题。但同时「The OpenAI Files」曝光,揭其劣行,如捏造身份、利益输送等,还指出OpenAI重组等四大问题。
阿里杀进Agent上下文战场:钉钉聊天、企业文档、工作数据终于要被Agent吃进去了
个人、企业用户苦工作场景「上下文」久矣,Agent常不懂真实业务。阿里千问办公开源的「MyContext」,将分散工作数据加工成Agent可消费的上下文,处理多种难题,还将能力向组织延伸,助力Agent融入工作流。
文档解析OCR全新升级,追平Gemini2.5pro,超越MinerU、碾压Qwen2.5VL-72B
CourseAI介绍PP - StructureV3实战、能力、性能与架构。它在通用版面解析等方面能力强,更新PP - OCRv5提升准确率,超主流OCR方案,轻且速度快,但遇特殊情况需重新训练。
Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认不达标为何不退钱?
8 - 9 月初Claude模型质量下降,Anthropic发文解释是因三项基础设施漏洞。介绍了三个bug及处理办法,也分析检测难的原因并给出改进方案,但很多用户已不再买账,Claude用户流失问题持续。