「算法论文」共找到 1506 篇相关文章
模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相
近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。
用LoRA微调VLM做乳腺癌病理分类,实战对比CNN
哈萨克斯坦团队论文对比CNN和用LoRA微调的VLM在乳腺癌病理分类上的表现。指出VLM微调后接近CNN水平,但CNN仍是王者。还介绍LoRA原理、实验设计、结果,给出实战代码及对从业者和研究者的启示。
OpenDev:破解AI编程指令衰减难题
当下AI编程工具竞争激烈,大多存在闭源或绑定单一模型的问题。OpenDev是开源的终端AI编程Agent,用Rust编写,仅3.7MB。其论文详细解释设计决策,给出指令衰减问题的工程解法,还有多种实用设计。
破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%
来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,能降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。
估值840亿AI实验室再放大招,他们要给大模型戴上「紧箍咒」
新智元报道,OpenAI前CTO创办的Thinking Machines Lab发布研究「模块流形」,将传统数值修正转为「预防式」约束优化。它提出新范式,为训练大模型提供新思路,还介绍了流形优化器及相关算法。
RAG性能优化:基于RAGFlow自定义解析工具实现文本结构化(含源码教学)
文章围绕RAG性能优化展开,指出RAGFlow框架中DeepDoc解析算法不足,介绍开源与商业化解析工具优劣势及API调用和本地部署特点,推荐TextIn xParse,给出RAGFlow+TextIn知识库构建方法,还探讨了RAG优化方案。
刚刚!UCLA杨林团队证明:仅凭提示词,Gemini 2.5 Pro就可以拿到IMO2025金牌
加州大学洛杉矶分校杨林和黄溢辰撰写论文,阐述利用Gemini 2.5 Pro解决2025年IMO竞赛5道题达金牌水平。设计解题者和验证者构成的自我验证流水线,用双提示词系统迭代,还规避数据污染问题。
独家揭秘OpenAI核心文件:AGI五级突破实锤!微软130亿投资或打水漂
新智元揭秘OpenAI核心文件,Ilya Sutskever曾预言AI无所不能,也担忧其失控后果。OpenAI与微软的合同中AGI条款成谈判核爆点,未公开论文划分AGI五级,让微软130亿投资或打水漂。
DeepSeek刚解决了AI视觉最后一块拼图:极低成本+精准视觉定位,AI接管电脑已无死角
DeepSeek放出新论文《Thinking with Visual Primitives》,解决多模态大模型中长期被忽视的“说不清位置”问题。提出将空间标记作为“最小思维单元”插入推理链条的方案,在多个任务上达前沿水平,但也存在精度、触发机制和泛化能力等局限。
只要交钱,高中生也能发NeurIPS?港大教授怒批顶会变味
在AI浪潮下,学术研究被商业机构「量产化」,成明码标价的「入学筹码」。港大教授马毅揭露乱象,如Algoverse机构指导团队顶会录用率高,高中生也能发文。付费论文收割家长「焦虑税」,还带来诸多学术问题。