推理可解释性」共找到 5609 篇相关文章

新闻资讯7

一键分享=全网公开?Claude 被曝聊天记录在谷歌直接搜到

2026 年 7 月 26 日,Reddit 用户称用谷歌站点检索语法能调出 Claude 用户共享对话记录。因 Claude 未补全防护配置,致用户加密资产、身份等信息泄露。此前 OpenAI、Grok 也有同类问题,社区呼吁平台完善防护体系。

AI科技评论
算法论文8

多模态幻觉的病因「高熵节点」找到了!全基准幻觉率下降

多模态大推理模型的幻觉常出现在生成转折词时,此时模型处于高熵关键节点,易脱离图像证据。研究者提出LEAD,高熵时保留候选推理方向,注入视觉锚点拉回证据,实验显示它能跨领域提升模型性能。

新智元
产品应用7

从衣服到饰品:OmniTry 实现珠宝、包袋等多类穿戴物品的虚拟试穿

Kunbyte提出OmniTry,将VTON从服装扩展到任意穿戴物品,采用无掩码设定。它经两阶段处理流程训练,在12种常见物品类别评估中表现优,有扩展潜力,但也存在训练数据类别限制等局限。

带你学AI
7

硬件只是入场券:AI穿戴的百万销量背后,软件与场景才是终极战场

InfoQ《极客有约》X AICon 直播探讨 AI 硬件进阶。Plaud、Rokid 等企业代表认为,AI 硬件成功关键在于早布局、结合需求与设计。软硬件一体是核心,在传统硬件难胜任场景脱颖而出,多模态交互有挑战也有应用。

AI前线
算法论文8

14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~

有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经多步骤训练,实验显示其在检索能力和泛化性上表现出色。

PaperAgent
开源动态8

让OpenAI只领先5天,百川发布推理新模型,掀翻医疗垂域开源天花板

百川智能发布医疗推理大模型Baichuan - M2 - 32B,在OpenAI的Healthbench评测集上超越刚发布5天的gpt - oss - 120b,领先多数前沿模型,支持RTX4090单卡部署,还首创患者模拟器和Verifier系统。

量子位
新闻资讯7

传 GPT-5.6 明日发布:要打赢 Fable 5,光靠刷分不行

近期GPT-5.6发布消息不断,上线或进入倒计时。它被拿来与Fable 5对比,Fable 5长任务处理出色,而GPT-5.5有短板。GPT-5.6虽跑分亮眼,但被指‘benchmaxxed’,还存在脱离现实常识问题。

AI科技评论
算法论文8

自适应Agent基础模型:从“会推理/会用工具”到“懂得取舍的执行者”

当前大型语言模型在智能体/工具调用场景有推理型和工具型两类,存在效率与功能、深度的矛盾。A²FM框架提出多模式自适应路由,实现模式自适应切换,在多基准测试中效果与效率双升。

深度学习自然语言处理
新闻资讯8

具身导航,感知推理到底是「上帝」,还是执行控制是「命门」?| GAIR Live 023

本文是GAIR Live 023圆桌对话实录,浙江大学彭思达与具身多模态算法专家郝孝帅探讨具身导航。涉及本质、范式、挑战、交互等方面,还对未来5 - 10年发展做了展望。

AI科技评论
算法论文8

腾讯提出Vision-SR1:让模型真正学会“看图思考”,而不是“蒙答案”

视觉语言模型(VLMs)存在视觉幻觉和语言捷径问题,限制其靠性和泛化能力。腾讯提出Vision - SR1训练方法,通过推理分解和自我奖励机制,不依赖外部监督,提升模型视觉感知和推理靠性。

深度学习自然语言处理