再思考能力」共找到 3855 篇相关文章

8

纯CPU“踢开”GPU,中国超算九年后登顶!

6月23日,国家超级计算深圳中心“灵晟”超算以2.19EFlops性能登顶全球超算TOP500榜单,这是世界首台超2EFlops的超算系统。它基于“灵鲲”平台,采用纯CPU设计,展现我国超算全栈自主可控能力

芯师爷
开源动态8

ThinkChain:一个让Claude边调用工具边思考的开源框架

ThinkChain是展示Claude高级能力的Python项目,其核心创新是将工具执行结果注入Claude思维流,改变AI与工具交互方式。它支持零配置启动,有丰富工具集,还具备交互式命令等特性。

AGI Hunt
推荐文章8

AI 顶尖科学家、前 OpenAI 联创 Ilya Sutskever 的 18 个最新思考

这是前OpenAI首席科学家Ilya Sutskever离开OpenAI后的深度访谈。他分享了对LLM研究、实现ASI、研究品味等思考,指出Scaling时代结束,强调‘情感’价值函数等,还回应了创业公司SSI规划。

Founder Park
算法论文8

LLM规划能力飙升79%!Google:内在自我批评技术拿下多项SOTA

Google DeepMind研究《通过内在自我批评提升大语言模型的规划能力》,不借助外部验证器,让LLM反复“自评+重写”,使Blocksworld准确率从49.8%升至89.3%,还介绍了方法及跨模型验证情况。

PaperAgent
产品应用7

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%。它能完成输入视觉回答问题、做几何体等任务,重点解决多模态推理、视觉理解及与人类偏好对齐问题,介绍了模型结构、训练阶段等内容。

CourseAI
开源动态8

告别大模型“失忆”!人大开源MemSifter:轻量代理先思考回忆,搞定长时记忆

中国人民大学团队提出全新LLM记忆管理框架MemSifter,打破长时记忆管理‘精度不够’和‘成本太高’的困局。它将记忆检索‘外包’给轻量级代理模型,采用任务结果导向的RL训练范式,在8个基准测试中超越现有SOTA方案。

深度学习自然语言处理
开源动态8

告别大模型“失忆”!人大开源MemSifter:轻量代理先思考回忆,搞定长时记忆

当前大语言模型在长周期任务中,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。中国人民大学团队提出MemSifter框架,将记忆检索工作外包给轻量级代理模型,在8个权威测试中超越现有方案,且已开源。

PaperAgent
新闻资讯8

Anthropic发布Fable 5.1:科研、编程能力翻倍,成本最高降45%

当地时间9月1日,Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1科研、编程能力翻倍,成本最高降45%,还能解决实际问题,此次模型竞争转向多方面综合较量。

DeepTech深科技
开源动态7

The Batch: 948 | GLM 5.1:面向长时任务的能力提升

Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。

DeeplearningAI
产品应用8

WAIC现场最“聪明”展台!AI眼睛耳朵能力全打开了

WAIC现场,声网展台被观众挤爆,其新奇“AI玩具”都能与玩家流畅对话。声网对话式AI引擎全新升级,新增选择性注意力锁定、视觉理解能力,能与主流数字人方案集成,还可接入大模型,价格低。它已在多领域落地。

量子位