推理与计算」共找到 7998 篇相关文章

算法论文8

BRIGHT榜单SOTA!人大&百度ReasonRank:用推理增强的段落重排序器

传统listwise在复杂查询表现差,近期工作泛化性不佳。人大百度等提出ReasonRank,通过全自动合成13K推理数据及两阶段训练,在BRIGHT等榜单表现优异,且ReasonRank-7B比Rank1-7B快2.5倍。

PaperAgent
算法论文8

LLM「拒绝回答」难题有救了!最新研究让AI学会人情世故 | COLM'25

最新研究发现模型规模和通用语言能力处理敏感内容判断能力无直接关联,开源模型表现不错。通过提出的训练方法,在非推理推理型模型上缓解过度拒绝问题,提升AI实用性和可靠性。

新智元
新闻资讯7

优步针对微服务和大规模计算工作负载完成了大规模的 Kubernetes 迁移

优步成功将计算平台从 Apache Mesos 迁至 Kubernetes,覆盖多数据中心和云环境。工程团队详述迁移挑战、方案教训。虽遇技术、文化难题,但迁移后运营效率等提升,为大公司提供借鉴。

InfoQ
产品应用8

英伟达拿出推理版VLA:Alpamayo-R1让自动驾驶AI更会动脑子

当今自动驾驶模型虽强大,但在‘长尾场景’易翻车。英伟达推出的Alpamayo - R1是带推理能力的视觉 - 语言 - 行动模型,有核心创新,实验中性能显著提升,训练分三阶段,让自动驾驶迈向可解释。

机器之心
算法论文8

IROS 2025 | 机器人衣物折叠新范式,NUS邵林团队用MetaFold解耦轨迹动作

新加坡国立大学邵林团队提出MetaFold框架用于机器人衣物折叠。它创新分层架构,解耦任务规划动作预测。构建开源数据集,经实验在多指标超现有方法,还验证了从仿真到现实的迁移能力。

机器之心
推荐文章8

阿里云CIO首次系统复盘:大模型落地的 RIDE 方法论 RaaS 实践突破

阿里云智能集团 CIO 蒋林泉分享大模型落地实践,指出企业中业务 IT 对 AI 认知矛盾突出。他展示阿里云数字人落地成果,提出 RIDE 方法论,还剖析翻译和 Agent 两种应用模式及落地要点。

AI前线
7

硬件只是入场券:AI可穿戴的百万销量背后,软件场景才是终极战场

InfoQ《极客有约》X AICon 直播探讨 AI 硬件进阶。Plaud、Rokid 等企业代表认为,AI 硬件成功关键在于早布局、结合需求设计。软硬件一体是核心,可在传统硬件难胜任场景脱颖而出,多模态交互有挑战也有应用。

AI前线
推荐文章8

从RLHF、PPO到GRPO再训练推理模型,这是你需要的强化学习入门指南

强化学习是当今LLM重要技术,Unsloth团队发布教程,从吃豆人谈起,介绍RLHF、PPO到GRPO,分享用GRPO训练推理模型技巧,涵盖相关概念、训练方法及奖励函数设计等内容。

机器之心
开源动态8

让OpenAI只领先5天,百川发布推理新模型,掀翻医疗垂域开源天花板

百川智能发布医疗推理大模型Baichuan - M2 - 32B,在OpenAI的Healthbench评测集上超越刚发布5天的gpt - oss - 120b,领先多数前沿模型,支持RTX4090单卡部署,还首创患者模拟器和Verifier系统。

量子位
新闻资讯7

突发!微软OpenAI同日开火:语音之战+通用大模型,AI霸权决战打响

OpenAI发布语音大模型时,微软同日推出自研语音模型MAI-Voice-1和通用模型MAI-1-preview。MAI-Voice-1效率高、表达丰富,MAI-1-preview采用MoE架构。微软此举在语音战场布局,也为OpenAI谈判增加筹码。

新智元