「长文本处理」共找到 1803 篇相关文章
从 Prompt 到 Context:基于 1400+ 论文的 Context Engineering 系统综述
本文围绕Context Engineering展开,介绍其定义、与Prompt Engineering区别,从LLM OS视角说明其重要性,指出context处理不当的问题,对其分类及处理管理过程进行探讨,还提及面向LLM Context开发的变化。
斩获20K星!再见PDF排版噩梦,这个开源神器让文档处理爽到飞起!
MinerU是上海人工智能实验室推出的开源数据提取工具,能将多模态文档解析为Markdown,支持精准提取图片、表格、公式,具有多语言支持、高性能等特点,应用场景广泛,还开源免费。
C罗刚头球破门,AI解说脱口而出!全模态实时流太狠了
2026世界杯正热,阿里云在Flink Forward Asia 2026大会宣布Apache Flink 3.0进入Agentic Streaming For AI时代,推出全模态数据流处理能力,可让AI实时解说比赛。Flink 3.0解决了流式Agent数据处理难题,已有智能运维等应用场景。
The Batch: 876 | Gemini 的环境影响测算
谷歌研究人员对驱动 Gemini AI 助手的模型进行一年研究,发现处理一个提示的环境影响小。其能耗、水耗和温室气体排放量远低于此前估算,2024 - 2025 年处理中位提示时能耗、排放大幅降低。
AI文本转语音进入“Next Level”!独角兽ElevenLabs发布Eleven v3:狠狠拿捏情感控制
独角兽ElevenLabs发布最新版TTS模型Eleven v3,支持70多种语言,能进行多人对话,生动展现情绪语气。官方称其为“迄今为止最具表现力的文本转语音模型”,网友实测好评居多,但中文效果不如英文。
ICML Desk Reject 引发热议,AI审稿究竟该如何科学检测
ICML 2026 部分论文被 desk reject,因 reviewer 用 LLM 写 review。ICML 用带诱导的隐式水印检测,引发支持与反对争议。有论文提出从文本检测转向判断检测,还开发 J - Detector,结合文本检测准确率达 99.3%。
刚刚,谷歌放出Nano Banana六大正宗Prompt玩法,手残党速来
谷歌 Nano Banana 被网友玩出花样,背后是巧妙提示词的功劳。刚刚谷歌官方公布了该模型六个文本转图像提示,可进行文本生成图像等操作,还给出对应提示模板,不过使用中也存在一些问题。
为什么Cline不对你的代码库进行索引(以及为什么这是好事)
用户常问Cline如何处理大型代码库,是否用RAG索引全部代码。Cline特意选择不对代码库进行索引,因为传统RAG方法用于代码库有逻辑切割、索引过时、安全风险等问题。Cline像开发者一样处理代码,有独特优势。
AI生图大洗牌!流匹配架构颠覆传统,一个模型同时接受文本和图像输入
AI生图有新突破,新模型FLUX.1 Kontext用流匹配架构,与此前技术不同,能接受文本和图像输入。其来自Black Forest Labs,有编辑和生成能力,还具备4个特性,第三方测试也给出提示词使用技巧。
AI视频进入蒸汽机时代
百度蒸汽机 2.0 迎来重磅升级,推出行业首个通用 AI 长视频生成功能,突破时长限制,引入交互式需求表达功能。它解决了传统视频生成痛点,在多个维度优化创新,还带来商业应用新可能。