「新推理模型」共找到 9794 篇相关文章

算法论文8

推荐系统进入「双动力」时代!首篇LLM-RL协同推荐综述深度解析

强化学习是推荐系统主流建模范式,但传统 RL 推荐系统有诸多瓶颈。大语言模型崛起带来新机遇,LLM 与 RL 结合开启新范式。研究团队发布首篇相关综述,提出五大协同范式,总结评估体系,分析挑战与方向。

机器之心
产品应用8

前端同事看走眼了,这个“游戏网页”其实全是AI写的!

Kimi K2.5上新,集视觉理解、代码生成等能力于一体,提供四种使用模式,其中Agent集群模式提效显著。实测显示其网页生成、动效理解能力出色,下一代K3模型或用新架构KDA降低计算成本。

InfoQ
开源动态8

英伟达&MIT等推出Long-RL,长视频训练速度翻倍

英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。

机器之心
新闻资讯8

被员工怒怼“磕了”,追觅CEO:我有肚量;AI恋人陪聊涉黄被判刑,2.4万人付费;马斯克、奥特曼又开撕|AI周报

本周AI热点众多,有AI恋人陪聊涉黄案二审,追觅CEO回应员工怒怼,携程涉垄断被查等行业事件;还有文心大模型5.0登顶国内文本榜、字节跳动发布SeedFold等大模型进展;以及苹果、谷歌等企业的应用合作动态。

AI前线
推荐文章8

让AI自我进化,斯坦福新课免费教

斯坦福开设新课CS329A《自我进化AI智能体》,被奉为Agent学习新晋资源宝库。课程由实战派教授授课,介绍扩大模型规模、养成能听懂人话的AI、提升AI能力等内容,还探讨AI自我改进及智能体工作流等。

量子位
新闻资讯8

OpenAI曝出第一颗芯片叫「辣椒」!AI自己设计,9个月流片

OpenAI首颗自研芯片Jalapeño问世,9个月从白纸到流片,创行业最快纪录。该芯片专为大模型推理设计,由其AI参与设计优化,有望降低推理成本,提升用户体验。OpenAI欲做全栈AI公司。

新智元
产品应用8

Qwen3.8-Flash:全新架构,更强更稳更划算

本文介绍了 Qwen3.8-Flash 多模态 MoE 模型,它原生支持 262,144 token 上下文。该模型在 Attention、Residual、Embedding 与 Optimization 四个方面系统升级,降低训练与推理成本,即将上线千问 AI 平台。还发布了 Qwen3.8-Flash-Next 开源权重。

千问大模型
推荐文章7

刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次

Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。

机器之心
推荐文章8

甲小姐对话程路:做能源领域的“自动驾驶”|甲子光年

本文是甲小姐对话新奥能源程路,探讨能源领域“自动驾驶”。程路认为能源转型正当时,AI是关键。新奥泛能网构建数字能源运营系统,提出“能源领域的自动驾驶”分级概念,还介绍了数据处理、算法及落地应用等情况。

甲子光年
推荐文章7

万字实录:AI究竟是普通人的“印钞机”,还是更狠的「收割机」?| GAIR Live 021

雷峰网&AI科技评论邀三位老师探讨“AI大模型金融应用的机遇与挑战”。以Trading Arena大赛为例,分析大模型在金融投资应用,指出打造强逻辑推理“大脑”是金融应用关键,也提及Agent局限与“黑天鹅”预判路径等。

AI科技评论