通用推理能力」共找到 5005 篇相关文章

算法论文8

警惕!大模型成本倒挂:你正在为模型的多余「思考」买单

一项来自多所高校和微软研究院的研究揭示AI模型价格倒挂现象,低定价模型可能产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据集,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心
算法论文8

Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?

LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。

深度学习自然语言处理
开源动态8

最详细的 DeepAgents 实战拆解:一次看懂LangChain全新深度智能体框架

本文深入解读了LangChain推出的全新开源项目DeepAgents。它定位为“深度Agent”框架,能提升复杂场景下Agent能力。文中通过股票分析实例展示其任务规划、文件系统、子智能体三大核心机制,还介绍原理与未来发展方向。

AI大模型应用实践
产品应用7

Git for Data: 像 Git 一样管理你的数据

传统数据恢复手段在AI时代耗时费力,Git for Data带来变革,具备版本控制、快速回滚等能力,是AI时代数据管理新范式。MatrixOne数据库已具备其核心能力,未来将持续增强相关特性。

InfoQ
产品应用8

Claude Opus 4.7 发布!留给人类的时间,不多了

Anthropic 发布 Claude Opus 4.7,核心升级是让 AI 跑长且复杂任务,还能自我验证结果。它视觉能力超强,编程能力提升,新增 /ultrareview 功能,API 多了调节档,不过 token 数量或增加,成本可能上浮。

AGI Hunt
新闻资讯8

11 年前的那张图,又火了

一张2015年关于AI的智能曲线图近日在X上刷屏,马斯克也进行了转发。该图作者Tim Urban将AI分为ANI、AGI、ASI三个层级,指出人类习惯线性思考,但AI进步是指数级的。如今AI发展加速,其能力边界不断扩张。

AGI Hunt
产品应用8

Claude有的,国产也有!紫东太初科研龙虾ScienceClaw,已经把Harness卷进实验室

Claude发布的Managed Agents让“Agent Harness”概念受关注,而国内紫东太初ScienceClaw早有相关思路并落地。它全链条覆盖科研,能7x24小时优化,具透明执行优势,还覆盖通用场景,架构有创新。

量子位
新闻资讯7

Meta 突然百亿收购Manus,小扎再收百人团队,肖弘任副总裁!季逸超感叹:两个辍学生的道路交汇了

今早,Manus 宣布加入 Meta,收购金额达数十亿美元。此前字节跳动曾试图收购被拒。加入后,肖弘任 Meta 副总裁,核心团队并入 Meta AI。业内看法不一,有人赞创业成功,也有人质疑通用 Agent 是大厂游戏。

AI前线
算法论文8

LLM的快速、慢速与工具增强思维模式综述

大型语言模型在不同任务中对推理策略需求差异大,策略选择不当会影响效率与可靠性。本文提出双重知识边界框架,梳理LLMs推理模式,将策略选择形式化,还分析了决策因素及策略选择机制。

深度学习自然语言处理
新闻资讯8

重磅!OpenAI深夜发布ChatGPT Agent:AI打工人正式上线「附发布会全程视频」

OpenAI推出ChatGPT Agent,它整合Operator远程浏览器和Deep Research能力,Pro、Plus和Team用户可激活。能完成复杂任务,有强大工具集,性能在多基准测试超人类,但OpenAI因能力增强启动最高安全保障。

AI寒武纪