「AI推理能力」共找到 11842 篇相关文章
AI 时代最大的“幻觉”:我们有了最强工具,却正在失去定义真问题的能力
BAT增长顾问、前快手产品总监杨一溪在全球产品经理大会指出,AI时代人们易迷失在‘可能性’中,失去定义‘真问题’的耐心。他结合案例,从多方面分享增长方法论,强调用户需求洞察的重要性。
Token成本下降,订阅费却飞涨,AI公司怎么了?
文章指出,虽模型训练成本下降,但 AI 公司运营成本尤其是推理费用猛增。以固定费率订阅和高 token 消耗的商业模式的公司面临困境,如 Windsurf、Claude Code 等,还给出避免亏损的三条出路。
真正的Jarvis要来了?涂鸦智能押注Physical AI
智能家居爆发期,诸多硬件品牌借涂鸦能力发展。如今涂鸦发布AI生活助手“Hey Tuya”,它依托自研架构补齐Agent进入物理世界的关键能力,让涂鸦从幕后走向台前,有望构建家庭生活新基础。
GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~
智谱继GLM4.5后又开源GLM - 4.5V,它是同级别开源SOTA视觉推理模型,在多模态理解榜单表现优异。文章实测其在科研全生命周期的应用,还介绍了模型架构设计和训练策略。
大模型Agent的下一阶段:可自我进化的AI-Agent
在人工智能飞速发展下,研究者探索让AI自我反思改进。本文作者构建自我进化AI智能体系统,设计四层渐进式架构,经《卡坦岛》实验,证明自我进化能力,不同模型表现有差异,代码级进化潜力惊人。
为什么我觉得AGI并不会马上到来
作者Dwarkesh Patel认为AGI不会马上到来。当前大语言模型缺乏持续学习能力,难以替代人类工作;计算机操作能力受训练周期、数据等限制;推理能力虽有突破,但仍需时间发展。作者给出了具体预测时间。
性能提升11.74%!腾讯优图提出激励推理,专攻复杂指令
现有大语言模型处理复杂指令能力不足,腾讯优图研究团队提出激励推理方法。该方法能提升LLM处理复杂指令表现,在1.5B参数LLM上性能提升11.74%,媲美8B参数模型。
AI驱动的开源攻击框架:HexStrike-AI
HexStrike-AI是安全研究员开发的开源攻击框架,2025年7月起在GitHub免费提供。它基于MCP协议,集成LLM与150多种工具,可自动化渗透测试和漏洞发现。曾被网络犯罪分子利用,能加速攻击流程,展现强适应和并行化能力。
国内AI应用半年报告:App和Web应用月活都在跌,AI搜索需求被验证,百度是DeepSeek流失用户最大接盘手
QuestMobile发布2025年国内AI应用上半年报告,指出国内与海外市场情况不同,国内移动端和PC端AI产品月活下滑,AI搜索需求被验证,百度成DeepSeek流失用户最大接盘手,还分析了各类型AI应用发展态势。
103K「硬核」题,让大模型突破数学推理瓶颈
现有大语言模型在数学推理训练时面临数据瓶颈,腾讯AI Lab与上海交大团队推出DeepMath - 103K数据集。它规模大、难度高、数据新颖、严格去污染,让DeepMath系列模型达SOTA,还能实现推理泛化。