推理算法优化」共找到 3340 篇相关文章

推荐文章7

不得不说你的GEO优化的很好

白杨SEO结合自身经验,分享AI搜索优化GEO推广相关问题。包括第一步要确认业务、分析现状找真实需求;介绍确定精准意图词的方法;还阐述GEO与SEO关系及推广效果和转化挂钩的办法。

白杨SEO优化教程
推荐文章7

大概念模型:AI 推理的新范式

大概念模型(LCM)是自然语言处理新范式,侧重结构化推理和理解,与 LLM 不同。它依赖结构化知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。

InfoQ
产品应用7

DeepSeek-R1 更新,思考更深,推理更强

DeepSeek R1 模型完成小版本升级至 DeepSeek - R1 - 0528,用户可在官网、APP 等体验,API 同步更新。该版本强化深度思考能力,在多基准测评表现优异,还改善幻觉、提升创意写作等能力。

AI工程化
算法论文8

用子模优化法为DeepResearch生成多样性查询

开发DeepResearch时,生成多样化查询是关键。多数开源项目处理方法粗放,本文提出结合句向量与子模优化的方法,设计子模目标函数,给出代码实现,实验显示该方法生成的查询组合多样性更高。

Jina AI
开源动态7

蚂蚁开源MedResearcher-R1医学知识图谱+多跳推理

医学领域需处理复杂关系,现有医学AI系统缺乏对罕见实体和复杂关系的推理能力。MedResearcher - R1通过专门图谱和检索工具,结合两阶段训练范式解决问题,在医学基准测试取得新成果。

CourseAI
推荐文章8

迈向可信AI:LLM幻觉的分析与优化

随着LLM广泛应用,其幻觉现象成AI落地关键挑战。文章分析LLM幻觉成因、优缺点,结合RAG、SFT、强化学习等技术,提出多维度优化方案,为构建可信大模型应用提供理论与实践路径。

腾讯技术工程
算法论文8

阿里:RL强化LLM推理,是技巧还是陷阱?

近年来,强化学习(RL)成为解锁大型语言模型(LLM)复杂推理能力的关键工具,但该领域也面临技术选择困境。阿里联合多所高校的论文通过大规模可复现实验,揭示主流RL技巧的机制与适用场景,还发现极简组合(Lite PPO)性能超越复杂方案。

深度学习自然语言处理
新闻资讯7

OpenAI 发布了个 ChatGPT 优化计划,不是GPT-5

OpenAI未发布GPT - 5,而是推出ChatGPT「健康使用」优化计划,旨在助用户成长而非让人上瘾,措施包括休息提醒、改进生活建议功能等,还与专家合作改进响应方式。

AGI Hunt
新闻资讯7

Karpathy:强化学习「有点问题」,突破还需新算法

前特斯拉AI总监、OpenAI创始团队成员Karpathy发文称,强化学习虽能带来更多收益,但机制「可疑」,不像人类解决智能任务的方式。他提出新算法框架,还指出当前存在诸多待解决的问题。

AGI Hunt
新闻资讯8

性价比搏击:Grok 4 Fast 推理成本直降 98%

xAI上周五发布旗舰模型轻量化版Grok 4 Fast,推理成本直降98%。它通过强化学习在基准测试表现佳,有原生工具调用能力,采用统一架构,性价比高,或改写大模型竞争规则。

AI科技评论