推理学习」共找到 3139 篇相关文章

新闻资讯7

OpenAI博通联手发芯片,黄仁勋还能保持松弛吗?

OpenAI与博通联手发布自研推理芯片Jalapeño,英伟达虽业绩亮眼但正被围攻。博通的ASIC芯片及通信优势、中立身份受青睐,OpenAI和Anthropic也正脱离英伟达管控,博通靠“芯片自主权外包”模式上位。

芯师爷
算法论文8

让大模型学会「自己教自己」!京东&中科院信工所连发三篇论文定义Self-Taught RLVR

京东和中科院信工所开展Self - Taught RLVR系列研究,连发三篇论文。从RLSD、NPO、CoPD三个维度探索让大模型自我指导。如RLSD解决信息泄漏,NPO引入有效学习信号,CoPD整合多专家能力,各有创新与良好效果。

量子位
推荐文章7

没有AI也能活得很好的公司,才能用好AI

多数企业推进AI时,虽采纳率高但效果不佳,投入大回报低。问题核心不在AI,而在企业自身组织学习和集成准备度。能从AI获益的是原本就运营良好的公司,当下应审视自身是否适合用AI。

DeepTech深科技
开源动态7

AI Labs 都在用,ClickHouse 能成为 AI 日志的实时分析引擎吗?

过去18个月,ClickHouse发展迅猛,2025年末ARR达1.6亿美元,付费云客户超3000。它原是Yandex项目,适合LLM推理日志分析。通过收购拓展为数据平台,进入多市场竞争。文章探讨其增长原因、产品、市场及优劣势等。

海外独角兽
算法论文8

DeepSeek刚解决了AI视觉最后一块拼图:极低成本+精准视觉定位,AI接管电脑已无死角

DeepSeek放出新论文《Thinking with Visual Primitives》,解决多模态大模型中长期被忽视的“说不清位置”问题。提出将空间标记作为“最小思维单元”插入推理链条的方案,在多个任务上达前沿水平,但也存在精度、触发机制和泛化能力等局限。

AI寒武纪
推荐文章8

端到端语音模型:从语音表征到模型架构

本文整理自阶跃星辰语音模型负责人杨学锐在2025年QCon全球软件开发大会的分享。介绍大模型对语音技术的重塑,涵盖识别、合成等方面;阐述端到端语音模型构建,涉及表征、架构、训推和任务;还提及模型评估方法。

InfoQ
新闻资讯7

Meta 143亿挖角后首个作品来了:Alexandr Wang 推出闭源模型,杨立坤点赞

沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,Meta还披露技术实现细节。不过闭源引争议,且模型在长时程智能体等方面有短板。

AI前线
算法论文8

推荐系统进入「双动力」时代!首篇LLM-RL协同推荐综述深度解析

强化学习是推荐系统主流建模范式,但传统 RL 推荐系统有诸多瓶颈。大语言模型崛起带来新机遇,LLM 与 RL 结合开启新范式。研究团队发布首篇相关综述,提出五大协同范式,总结评估体系,分析挑战与方向。

机器之心
产品应用8

还在玩AI 3D手办?Gemini 3 Deep Think已能直出STL,可打印实物

推理模型赛道竞争激烈,谷歌 Gemini 3 Deep Think 迎来重大升级,能处理科研级、工程级、多条件约束问题,可将用户要求等建模成 3D 打印实体文件,还能用于多领域科研和工程,欲成科研工程‘第二大脑’。

机器之心
开源动态7

刚刚,马斯克开源基于 Grok 的 X 推荐算法!专家:ROI 过低,其它平台不一定跟

马斯克时隔近三年再次开源X推荐算法,该算法基于Grok,采用端到端学习预测用户兴趣。不过有争议认为这或是因现实压力。专家称其ROI低,其他平台不一定跟进,且此次开源对学术研究价值不大。

AI前线