两阶段训练策略」共找到 3222 篇相关文章

推荐文章8

这大概是我见过最通俗易懂的AI发展历程科普详文了

文章从历史时间线出发,介绍AI诞生、发展历程,涉及细分技术模块。结合案例说明AI在不同阶段的应用,如早期机器翻译、垃圾邮件过滤。还探讨AI大模型、智能体等概念,分析调优方法和‘幻觉’问题,展望其未来前景。

腾讯技术工程
算法论文8

零Token部署GraphRAG,LinearRAG做到了~

现有GraphRAG模型在实际应用中常不如朴素RAG,原因是自动构建的知识图谱质量不佳。LinearRAG框架通过Tri - Graph架构、两阶段精准检索和零Token范式重构GraphRAG,在多数据集上超越现有方法,代码和数据已开源。

PaperAgent
新闻资讯7

高通新款云端芯片公开!借推理抢英伟达蛋糕,市值一夜暴涨197.4亿美元

高通宣布推出AI200和AI250两款全新AI芯片进军数据中心市场,消息使股价一度飙升超20%。新品聚焦推理阶段,主打低TCO、高能效与强内存处理能力,还推进端到端软件栈。高通早有布局,已获订单。

量子位
算法论文8

让大模型学会“像人一样”查证真伪

伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“在线查证”新范式。它借助在线强化学习、精细化奖励机制和高质量数据,让模型学会像人一样查证,在多数据集上表现出色。

深度学习自然语言处理
开源动态8

社区供稿丨MiniCPM-V 4.5 技术报告正式出炉

上个月开源的多模态模型 MiniCPM-V 4.5 广受好评,今日其技术报告出炉。报告从架构、数据和训练三方面探索高效路径,提出三大技术,使模型在多任务上突破,小参数规模下性能和推理速度佳。

Hugging Face
产品应用8

OneSearch,揭开快手电商搜索「一步到位」的秘技

本文介绍快手提出的电商搜索端到端生成式框架 OneSearch。它有三大创新,包括 KHQE 模块、用户行为序列注入策略、偏好感知奖励系统。实验显示它在多方面提升显著,已部署于快手电商搜索场景。

机器之心
新闻资讯7

Mira Murati 创业公司首发长文,尝试解决 LLM 推理的不确定性难题

OpenAI前CTO Mira Murati创立的Thinking Machines Lab首发文章《克服LLM推理中的不确定性》,指出大语言模型推理难获可复现结果,深入探究其不确定性根源,提出使核函数具备批次不变性的方法并给出实现与实验。

Founder Park
开源动态7

三重Reward驱动的运维智能体进化:多智能体、上下文工程与强化学习的融合实践

文章阐述了AI原生时代下,面向技术风险领域的智能体系统(DeRisk)的架构设计、核心理念等。介绍运维智能体发展现状,提出其技术演进需找三类Reward,还介绍相关概念、DeRisk架构,给出实践案例并将开源技术产品。

阿里云开发者
新闻资讯8

CEO 上阵写代码,公司从被传濒临倒闭到千亿估值,最大功臣是Claude?

Airtable是先进无代码应用平台,曾被传濒临倒闭,如今估值达千亿。CEO Howie Liu分享围绕AI重组公司、亲自编程让公司实现正现金流的心路,还探讨推动团队用AI、岗位受影响情况及公司转型策略等。

AI前线
新闻资讯8

刚刚,全球AI百强榜发布!ChatGPT稳坐第一,DeepSeek第三,前50有22个来自中国

a16z发布「全球Top100消费级GenAI应用榜单」,显示AI竞争格局渐稳,进入多极化阶段。中国多款产品跻身前十,谷歌携四款产品入榜,ChatGPT居首,Grok紧追,氛围编程崛起,还有14家‘全明星’公司从未缺席。

新智元