认知鸿沟」共找到 394 篇相关文章

开源动态8

中国科大Science-Star(科星) : 一体化、可扩展的科学智能体搭建平台

中科大认知智能全国重点实验室开发了 Science - Star 科研智能体平台。它基于 ReAct 引擎,有一体化可视化支持、插拔式模块化架构和跨学科工具集成等特色,为科研智能体研发与实验提供高效基础设施。

PaperAgent
算法论文8

AI修Bug新SOTA:SWE-Bench Lite60.33%修复率,像人一样能积累经验,中科院软件所出品

ExpeRepair是中科院软件所团队推出的仓库级缺陷修复系统,模拟人类认知的情景和语义两种记忆模式,能积累经验。在SWE - Bench Lite评测中,其Claude - 4+o4 - mini组合修复率达60.3%居首。

量子位
算法论文8

ICML2025 | 揭示MLLM的图文联动推理能力

当前多模态大语言模型(MLLMs)在图文深度融合推理能力上面临挑战,现有评测基准无法真正检验该能力。EMMA基准应运而生,它从四大领域精选题目,采用双重过滤机制和细粒度标注体系,评测发现MLLMs存在多模态推理危机。

深度学习自然语言处理
算法论文8

大模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮

北邮研究团队通过思维链审计实验,揭示大模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。

量子位
推荐文章7

2025AI产品用户需求调研报告:AI产品的用户类型细分与画像分析 | 甲子光年智库

甲子光年智库基于调研数据开展AI产品用户研究,分析目标用户界定、类型细分与画像。指出新一代AI会重塑用户习惯,需探寻产品最终形态,还给出用户需求、类型分布等多方面结论。

甲子光年
产品应用7

从扭秧歌到跑半马:机器人离「iPhone时刻」还有多远?

过去半年,机器人表演把人们认知拉进现实。当下具身智能赛道玩家关注缩短探索周期、降低成本。地瓜机器人发布 RDK S100 套件,其有独特设计和适配场景,还围绕开发者诉求提供支持,跑通多种场景。

机器之心
产品应用7

Cursor 内置三大文档工具,为AI 编程注入精准上下文

大模型编程易因知识陈旧致代码出错,为其提供实时上下文是关键。Cursor 有 @Docs、@Web、MCP 三大文档工具,能处理不同文档,还可协助创建和更新文档,弥合模型知识与项目需求的鸿沟

AI工程化
新闻资讯7

“你以为买的是 DeepSeek Flash,到手可能是 1.5 bit 缩水版”:Pi 核心贡献者谈 AI Token 黑箱

Pi 核心贡献者 Armin Ronacher 与 Modem 联合创始人 Ben Vinegar 播客对谈指出,当前 AI token 市场不透明,模型公司或失控。如买 token 像买成分不明商品,模型训练目标不明,且 Agent 行为边界在扩展,问责制缺失。

InfoQ
推荐文章7

AI 3 秒给你一本书的摘要,我为什么还要花 10 小时读完

本文探讨AI时代读书投入产出比变化。指出很多书不必读完,印刷术与AI影响不同,AI降低加工成本,但认知成本省不掉。读书收益分信息和结构两部分,结构无法外包,选书能力也更重要。

AI Reading Hub
产品应用8

堆了一仓库GPU,却生产不出专业智能?九章云极用AI工厂给出解答

企业接入通用大模型到业务系统,却发现它难以执行任务。九章云极在发布会上推出‘AI工厂’战略,通过训练工厂和Token工厂填平执行鸿沟,前者用强化学习造专业模型,后者让专业智能规模化流通。

机器之心