推理与计算」共找到 8061 篇相关文章

算法论文8

清华上交满分论文证明:强化学习并不能让大模型更会思考!

清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让大模型更会思考,推理能力上限仍由基础模型决定。

AI工程化
产品应用8

小米AI语音新框架:人人都能当声音导演

小米大模型应用团队提出Midasheng - audio - generateXiaomi Any2Speech两大音频生成框架。前者可实现全场景声音重建,后者让AI学会理解声学空间叙事逻辑,改变了语音合成应用场景思路。

量子位
算法论文8

「边思考、边搜索、边写作」WebThinker开启AI搜索&研究新纪元!

大型推理模型有推理能力,但静态知识限制其在复杂任务表现。WebThinker 让 LRM 推理中自主搜索、导航及写报告,集成探索器,有自主策略和训练工具,实验显示性能强,还指明未来探索方向。

机器之心
算法论文7

CoT 之后,CoF 如何让帧间逻辑从「隐式对齐」变成「显式思考」?

CoT 虽提升语言模型推理能力,但在 C 端场景有局限,且被质疑并非真实推理。视觉领域提出 CoF 概念,Google DeepMind 团队引入理论,让视频模型通过帧链推理提升帧间一致性,还具强大泛化能力。

机器之心
产品应用7

Lyft 使用 AI 和人机协同扩展了全球范围内的本地化能力

Lyft 实现 AI 驱动的本地化系统,加速应用网页内容翻译。新系统结合大语言模型、自动评估人工审核,将翻译周期从数天缩至分钟级,兼顾质量适配性,还分批量和实时翻译架构处理不同场景。

InfoQ
新闻资讯7

产学研深度融合样本:高校教授携手昇腾,共筑AI算力生态基石|甲子光年

本文对话华南理工大学陆璐教授,他有丰富业界经验,回归学界后聚焦AI算力平台性能优化。其团队昇腾合作解决性能挑战,成果用于开源产品集成。陆璐还对算力生态未来给出战略实操建议。

甲子光年
算法论文8

超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破

文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。

机器之心
产品应用8

jina-reranker-v3刷新全球重排榜,效率狂飙4.79%

jina-reranker-v3作为LLM时代向量模型,提出“最后但不晚”交互机制,解决文档检索效率效果权衡、多语言文档重排性能效率平衡、模型泛化能力和适应性等问题,架构训练方案有创新。

CourseAI
推荐文章7

分享6个平时我最常用的Prompt心法。

作者作为常靠AI帮忙的普通用户,分享6个AI对话的心法技巧。包括让AI选角色回答、回答前追问、AI辩论、预演失败、反向推提示词和双层解释法,助大家AI有效协作。

数字生命卡兹克
算法论文8

KDD 2025 | UoMo来了,首个无线网络流量预测模型,一个框架搞定三类任务

在 ACM KDD 2025 大会上,清华中国移动联合发布 UoMo,全球首个面向移动网络的通用流量预测模型。它结合扩散模型 Transformer,能理解地理人流变化,一个框架搞定三类流量预测任务。

机器之心