多轮对话」共找到 4133 篇相关文章

算法论文8

推理路径的动态调控:让大模型学会“恰到好处”的思考

当前大模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在个STEM基准测试中缩减推理步骤、提升准确率。

深度学习自然语言处理
新闻资讯7

在WAIC,比起看机器人打拳,人们更想知道怎么用AI赚钱

7月27日普通观众参观日,WAIC现场火爆。本届大会规模为历届之最,机器人与模型厂商纷纷展示落地应用。机器人从“能动”走向“会干”,模型厂商聚焦场景,投融资锚点转向商业指标。

芯师爷
新闻资讯7

全国首部AI大模型私有化部署标准,公开征集起草单位和个人!

近期AI领域政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但面临诸问题。由智合标准中心组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准立项,现征集起草单位和个人。

AI进修生
算法论文8

半量工具,双倍效能:ARPO革新大模型强化学习

大语言模型在轮工具调用场景有挑战,传统强化学习算法有探索效率低和资源消耗大问题。本文提出ARPO,通过量化token熵分布变化设计自适应探索机制,降低工具调用成本且提升轮推理性能。

深度学习自然语言处理
推荐文章7

一个“蠢问题”改写模型规则!Anthropic联创亲曝:瞄准Claude 5开发爆款应用,最强模型的价值会让人忽略成本负担

Anthropic联合创始人Jared Kaplan在YC分享Scaling Law对大模型发展的影响及Claude模型意义。他指出Scaling Law源于问“蠢问题”,是推动AI进步核心动力,还给出产品构建建议,介绍Claude 4优化。

AI前线
新闻资讯7

这家国内公司,在给具身智能技术栈做「通解」

具身智能是AI热门赛道,世界人工智能大会WAIC 2025让其概念渐明。国内梅卡曼德公司展位集合机器人技术种落地形式,展示自研通用机器人「眼脑手」全栈技术产品,推动机器人各行业落地。

机器之心
开源动态8

“AI大神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!

7月23日,“AI大神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在个测评中成绩领先,有种能力,李沐介绍其技术及训练方法。

AI前线
新闻资讯8

老黄自曝皮衣口袋藏“秘密期权池”!随时准备奖励员工,团队亿万富翁数量世界第一

黄仁勋在采访中透露随身带“秘密期权池”奖励员工,称团队亿万富翁数量世界第一。他还谈及人才市场、芯片分配、AI对就业和经济影响等,如认为收购公司不如付一人10亿,芯片分配先到先得等。

量子位
算法论文8

揭示隐藏联系:RLHF/DPO即对比学习!

大型语言模型输出符合人类价值观是挑战,主流技术RLHF复杂、昂贵且不稳定,DPO简化流程但有训练崩溃问题。论文揭示RLHF/DPO即对比学习,提出MIO算法解决DPO崩溃,实验验证其性能优势。

深度学习自然语言处理
算法论文7

研究表明:资深开发者在使用AI工具时,完成任务的时间比不使用时延长了19%。

研究通过随机对照试验,发现2025年初资深开源开发者使用AI工具完成任务时间比不使用时延长19%。当前衡量AI能力依赖标准化评测,可能高估或低估其真实能力,研究旨在更准确评估。

宝玉AI