两小时学习法」共找到 2352 篇相关文章

算法论文8

BookRAG:专治各种「层次化复杂」文档

BookRAG专为处理层次化复杂文档而生。传统RAG有大盲区,而BookRAG在多模态长文档基准上刷新SOTA。它采用BookIndex×Agent - based Retrieval技术方案,效率高、可扩展性强,兼顾高精度、高召回、低成本。

PaperAgent
新闻资讯8

梁文锋执笔的R1论文登上Nature封面!首次回应外界三大质疑

9月17日,DeepSeek创始人梁文锋通讯作者名义发表的DeepSeek - R1论文登《自然》封面。该模型借助强化学习自主形成推理能力,在Hugging Face下载量破1090万次。新版论文回应质疑,披露训练细节,虽有不足但引发学界关注。

InfoQ
开源动态8

超越O4-mini,多模态大模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态大模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经阶段训练,性能超O4 - mini,论文等已开源。

机器之心
开源动态7

OCR又出宠OpenDoc,速度超MinerU6倍

复旦开源的OpenOCR是面向通用OCR任务的开源平台,其OpenDoc是超轻量文档解析系统。它采用Pipeline模式,阶段解析不易放大误差。UniRec - 0.1B有独特架构与分层监督训练等创新技术。

CourseAI
算法论文8

Sea AI Lab 揭秘:你费尽心力调的 LLM 一直在崩溃?罪魁祸首可能只是一个参数:BF16

Sea AI Lab 和新加坡国立大学研究指出,强化学习微调中训练不稳定和性能瓶颈,根源是数值精度 BF16。其低精度造成“训练 - 推理不匹配”,使训练易失败。将精度切换到 FP16 可解决问题,提升模型表现。

AI寒武纪
产品应用8

从「对口型」到「会表演」,刚进化的可灵AI数字人,技术公开了

快手可灵团队让数字人从「对口型」进化到「会表演」,全新数字人功能在可灵平台公测。技术报告Kling - Avatar解析背后技术路径,设计多模态阶段生成框架,实验显示其在多方面领先竞品。

机器之心
新闻资讯7

对话心资本吴炳见:我不问AI创业的“终局”|甲子光年

本文是对心资本合伙人吴炳见的访谈。他2022年底All in AI,分享投资理念,如共鸣时投资、关注当下问题;分析AI发展阶段、应用情况,认为Agent是核心应用形态;还谈及投资案例、学习方式及经验复用与摒弃等。

甲子光年
算法论文7

无需外部数据!AI自问自答实现推理能力进化

卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。

量子位
新闻资讯7

OpenAI新模型,被曝秘密训练中!万字硬核长文直指o4核心秘密

SemiAnalysis爆料,OpenAI正训练规模介于GPT - 4.1和GPT - 4.5间的新模型,下一代推理模型o4基于GPT - 4.1训练。强化学习成推理模型进步功臣,但面临基础设施瓶颈,奖励函数难定等问题。

新智元
产品应用7

从衣服到饰品:OmniTry 实现珠宝、包袋等多类可穿戴物品的虚拟试穿

Kunbyte提出OmniTry,将VTON从服装扩展到任意可穿戴物品,采用无掩码设定。它经阶段处理流程训练,在12种常见物品类别评估中表现优,有扩展潜力,但也存在训练数据类别限制等局限。

带你学AI