推理技术」共找到 4569 篇相关文章

开源动态8

重磅!Thinking Machines开山之作:大模型输出随机的根本原因被揪出,并开源终结方案

由OpenAI前CTO创办的Thinking Machines宣布上线技术研究博客,开篇文章揪出LLM输出随机的根本原因是负载及批次大小的非确定性变化,并给出系统性解法,还开源方案。

AI寒武纪
推荐文章8

吴恩达来信:智能体并行运行以提升效率

吴恩达称并行智能体成扩展AI规模新方向。AI性能会随数据量、训练及推理计算量提升,但耗时久。随着LLM每个token价格下降,更多智能体工作流被并行化,且相关研究增多。

DeeplearningAI
推荐文章7

RAG效果不佳?先别急着微调模型,这几个关键节点才是优化重点

文章深入探讨RAG技术实现与优化,指出其在AI应用开发中常被当黑盒,从文档分块、索引增强、编码、混合检索到重排序等关键环节解析,强调结合场景调优以提升召回与精确率。

阿里云开发者
新闻资讯8

梅花创投吴世春:AI不再卖工具,而是卖收益|甲子引力X

在「渡口——甲子引力X2025科技产业投资大会」上,梅花创投吴世春剖析AI创业投资逻辑。他认为大模型格局已定,资本兴奋点转向应用,AI价值锚点从技术转向商业结果,AI将成基础设施。

甲子光年
新闻资讯7

GPT正面对决Claude!OpenAI竟没全赢,AI安全「极限大测」真相曝光

OpenAI和Anthropic罕见合作,测试双方模型在幻觉等四大安全方面的表现。这场合作是AI安全的里程碑,百万用户每天的互动推动安全边界扩展。文中详细对比了GPT和Claude模型在各安全测试中的表现。

新智元
新闻资讯7

AAAI-26投稿量爆炸:近3万篇论文,2万来自中国,评审系统都快崩了

AAAI - 26主技术轨道接收近29000篇投稿,近20000篇来自中国。投稿作者超75000人,虽会剔除未达标稿件,仍约23000篇进入评审,是AAAI - 25近两倍。AAAI采取措施保障评审质量。

机器之心
新闻资讯8

强化学习之父Richard Sutton最新演讲揭示OaK架构:通向超级智能的八步愿景

强化学习之父Richard Sutton在演讲中介绍OaK架构,认为它是通向超级智能的路径。他回顾对简单通用AI智能体架构的追求,强调从经验学习、拟合世界的重要性,还指出实现该架构需八个步骤,虽只是愿景但提供了发展路线图。

机器之心
产品应用7

滴滴出行MCP:全面解读滴滴MCP Server 的第一公里与最后一公里!

2025年8月1日,滴滴发布MCP Server v1.0.0,将运力能力抽象成JSON - RPC 2.0接口。开发人员四步即可嵌入完整闭环服务。MCP把运力‘云化’,还介绍了技术细节、安装使用、典型场景及开放限制。

MCP Server
算法论文7

从BERT到T5再到Qwen3:关于Embedding的八点总结

哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。

PaperAgent
算法论文8

Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃

大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。

深度学习自然语言处理