认知推理能力」共找到 4745 篇相关文章

产品应用7

Claude Opus 4.7发布:更强能力,自我纠错,越来越不需要人类干预了

Anthropic发布Claude Opus 4.7版本,搭配Routines功能可自动化工作,人类干预减少。该版本能力大幅增强,还引入护栏机制保障安全,推出新运算级别和任务预算功能。

AIGC开放社区
开源动态8

港中文联手美团开源“视觉推理通才”!图像视频10类任务一网打尽

香港中文大学MMLab与美团研究团队开源OneThinker模型,它可覆盖图像与视频十类核心视觉任务,在31项测试中表现出色,还展现泛化能力。研究团队搭建数据集,并引入EMA - GRPO算法提升训练稳定性。

量子位
开源动态8

小模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源

微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。

AIGC开放社区
算法论文7

AI让全人类思维越来越雷同!南加大研究实锤:认知多样性正在被抹平

南加州大学论文指出,AI正让全人类想法和表达同质化,体现在语言、视角和推理三方面。原因包括训练数据有偏差、训练目标求稳、人们过度依赖。研究人员虽在想办法,但效果有限,呼吁勿无节制依赖。

量子位
算法论文8

为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通大学

上海交通大学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态大模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。

量子位
推荐文章7

统一框架下的具身多模态推理:自变量机器人让AI放下海德格尔的锤子

当前先进机器人无法像人类自如用工具,现有多模态系统有局限。自变量机器人提出端到端统一架构,以统一表示学习和多任务多模态生成解锁具身多模态推理能力,实现范式转换。

机器之心
开源动态8

KAG-Thinker:「结构化」思考新范式,支持逻辑严谨的大模型复杂推理

近日,蚂蚁集团知识引擎团队协同高校发布 KAG-Thinker 模型,是 KAG 框架重要迭代。它聚焦复杂推理,建立结构化思考范式,实验显示其性能在多数据集上有提升,还在医疗问答验证了专业领域有效性。

机器之心
新闻资讯8

Gemini 3 Flash 发布,多、快、好、省,Coding 能力不输大哥Gemini 3 Pro

Google DeepMind 发布 Gemini 3 Flash,成本极低。它在多项测试表现出色,速度快、效率高,代码能力超 Gemini 3 Pro,获企业客户好评,今日起向全球开发者和普通用户推送。

AGI Hunt
新闻资讯8

谷歌CEO劈柴震撼预言:2030年AI直逼超人智能,80亿人认知被颠覆

谷歌CEO劈柴在采访中称AI是人类历史上影响最深远的技术,进步极快且能力上限未知。他谈到AI会释放80亿人认知潜能,还从多方面阐述了AI对各领域的影响及未来发展。

新智元
推荐文章7

Chrome已死,AI浏览器当立!认知革命比技术成熟来得更快。

文章指出AI浏览器重新定义底层逻辑,从导航工具变为执行意图的引擎,有持续意图记忆等核心能力。即便成功率不高,用户也易完成认知转变,还总结了AI产品团队应知道的规律及失败类型。

探索AGI