深度研究能力」共找到 5114 篇相关文章

算法论文8

谷歌提出破局Self-Consistency计算瓶颈!LLM推理效率革命,推理加速不牺牲精度

Google Research等团队提出CISC,通过给推理路径赋予置信度权重,少量样本即可超越传统自洽性效果,平均减少40%计算成本,还提出WQD指标揭示模型自评估能力本质。

深度学习自然语言处理
算法论文8

AI失忆术!只需3个注意力头,就能让大模型忘记「狗会叫」

Meta和纽约大学团队发布论文《From Concepts to Components》,提出SAMD和SAMI方法。前者定位模型概念注意力模块,后者微调强度。能让模型‘失忆’,还可增强推理、控制安全,为AI研究开新方向。

新智元
算法论文8

用雨伞「钓」无人机?首个针对自主目标跟踪闭环系统的物理攻击

加州大学尔湾分校研究人员用特制雨伞干扰无人机视觉系统,实现FlyTrap攻击,让无人机误判目标远去而失控俯冲。此攻击无需信号干扰,成功率超60%,有强泛化能力,揭示了AI感知系统安全隐患。

新智元
新闻资讯8

李飞飞最新长文火爆硅谷

AI教母李飞飞发表长文,首次系统性解释空间智能,提出真正具有空间智能的世界模型须具备生成、多模态、交互三个核心能力,还分享World Labs进展及世界模型在多领域的潜力。

量子位
开源动态8

最强大脑组合!全球SOTA的逻辑和记忆CodeBrain-1&MemBrain1.5同时开源

世界模型初创公司Feeling AI正式发布并开源MemBrain1.5和CodeBrain-1,终结AI“无状态”工具时代。CodeBrain提升模型操作成功率、降低成本,MemBrain重构记忆系统,二者助力Agent能力升级。

机器之心
产品应用7

金融版 Claude Code

Dexter 是自主运行的金融研究智能体,类似金融版 Claude Code。能处理复杂金融问题,有智能任务规划等核心能力。文章介绍其先决条件、安装、运行、评估、调试方法及项目地址。

GitHubStore
推荐文章7

The Batch: 894 | 面向生物医学的多模态模型

过去几年联合推理模型进展快,但生物医学领域能力碎片化、脆弱或难解释。2026 年,学术界应推进多模态模型建设,关注深度整合、可解释性、数据效率和适应性及模型在工作流中的整合。

DeeplearningAI
算法论文8

大语言模型逻辑评估

现有归因问答评估方法有‘归因短视’问题,研究团队提出 LOGICSCORE 框架,从三维度量化推理质量。在多数据集测试多款 LLM,发现专有、开源模型等存在不同逻辑问题,还分析典型逻辑错误。

深度学习自然语言处理
开源动态8

一个月狂揽2w+star,带你手搓自己的claude code!

Claude Code受广泛关注,但多数讨论抽象或为‘黑盒用法’。`learn-claude-code`项目对其深度拆解,通过12个课程教构建智能体载具系统,开源超一月揽34K star,还提供Web交互平台。

开源先锋
算法论文8

首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26

研究发现大模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为大模型逻辑评估提供新思路,可用于多领域。

新智元