长文档处理」共找到 1723 篇相关文章

开源动态8

南洋理工、北大、上海AI实验室开源记忆世界模型

目前世界模型模拟方法在维持期一致性上有挑战,南洋理工大学、北京大学王选计算机技术研究所、上海人工智能实验室联合开源记忆世界模型WORLDMEM,介绍了其记忆机制、基础架构、训练技术及检索策略等。

AIGC开放社区
推荐文章7

笑死,网友支招,破Agent对话"变蠢"

文章指出用AI编程时,上下文一模型就易“变蠢”,如违反约束、反复改文件等。分析原因是难从海量历史找重点,给出应对策略,还介绍Claude Code、Cursor、Codex等工具操作方法。

CourseAI
推荐文章7

AI 创业者的反思:那些被忽略的「快」与「

周喆吾分享在 3D AR 社交平台 Presence 的创业反思,强调 AI 创业中‘快’和‘ context’的重要性,还举例说明 AI 对白领工作的影响、Workflow Capture 做法等,指出产品经理和投资人应提升对模型的认知。

Founder Park
开源动态7

多模态需求井喷,智能视频云如何靠分布式处理破局?

国内多模态AI发展中,模型层火热但应用层落地慢。多模态应用落地面临体验升级、视频化扩展、大模型部署下沉挑战,催生智能视频云升级需求。火山引擎在FORCE大会展示分布式多媒体处理实践,推出MIPP平台,未来将开源并推商业化产品。

InfoQ
新闻资讯8

Mamba一作预告新架构!文论述Transformer≠最终解法

Mamba一作将演讲整合成科普文,探讨SSMs和Transformer模型权衡之术。认为Attention非万能,Transformer是阶段性最优。几天后将发布新架构,能与Transformers兼容,还回顾了两模型特点及结合优势。

量子位
新闻资讯7

250份文档就能给大模型植入后门:不分参数规模

Claude母公司Anthropic联合英国AISI和图灵研究所研究发现,仅250份恶意文档就能给不同规模大模型植入“后门”漏洞,打破了以往对大模型数据中毒的认知,给厂商提了个醒。

量子位
开源动态8

阿里搞了个全能解析器,文档、图片、音频、视频一锅端

阿里巴巴开源 Logics-Parsing-Omni,用一个模型统一处理文档、图片、音频、视频四种模态,输出结构化 JSON 数据。它采用三级渐进解析框架,两阶段训练策略,在自建基准上多项指标超越 Gemini - 3 - Pro。

CourseAI
新闻资讯7

MiniMax 技术闭门会分享:上下文是 Agent 的 Game Changer

MiniMax 7月10日举办M1技术研讨会,探讨模型架构创新等领域。会议围绕RL能否赋予模型新能力、预训练价值等展开,指出上下文是Agent的Game changer,混合架构将成主流,还分享了混合架构推理实践及M1相关问答。

Founder Park
推荐文章8

LlamaIndex 深度实战:用《安的荔枝》学会构建智能问答系统

文章兼顾 RAG 科普与 LlamaIndex 实战。介绍 RAG 原理,用《安的荔枝》讲解关键步骤和参数。实战部分展示用 LlamaIndex 搭建问答系统,代码量少。优化篇通过实验给出参数调优建议,架构篇剖析内部机制,最后提及 Agent 化拓展功能。

阿里云开发者
算法论文7

基于Memory Bank的Cursor会话记忆内存库理论研究与实践

文章围绕Memory Bank展开,介绍其为解决大模型会话记忆瓶颈而设计的机制,包括存储、检索、更新模块。阐述其在编程和知识库建设的应用,还评测了Codelf等工具,指出Memory Bank是AI迈向智能的重要一步。

阿里云开发者