渐进式发现」共找到 1657 篇相关文章

算法论文8

Anthropic最新论文:检测LLM内省意识的方法

Anthropic与MIT等研究表明,LLM能‘感知’被注入的steering vector,‘内省意识’在DPO等后训练阶段涌现。研究构建实验,发现内省能力行为稳健、检测非简单线性关联等,还揭示检测与识别机制不同及两阶段电路。

PaperAgent
新闻资讯7

人类秒懂,AI崩溃:一个简单测试,就让GPT-5、Gemini等顶级模型集体“翻车”

来自多机构研究团队发现,OpenAI的GPT-5等顶级AI模型,面对‘看得见但读不懂’文字时表现极差。VYU团队实验显示,人类能轻松读懂的切分拼接文字,AI却全军覆没,原因是其靠模匹配,不懂文字结构。

量子位
推荐文章8

OpenAI帝国的真相与幻象——496页「Empire of AI」中文版电子书分享!

资深科技记者Karen Hao新书《Empire of AI》出版,496页巨著撕开OpenAI真实面貌。书中把其比作殖民帝国,揭露生成AI繁荣背后隐形成本,还记录其从理想到现实转变、GPT - 3背后故事及2023年董事会政变等。

AGI Hunt
开源动态8

终端已死,Agent终端万岁:Warp一天暴涨1.2万星背后的开发者工具革命

4月29日,Warp在GitHub单日涨近12000星,总星数破4万。其定位从普通终端转变为Agent开发环境,这表明开发者对AI原生终端需求真实且被低估,Agent化已成产品核心竞争力。

AI Reading Hub
开源动态8

15个前沿大模型,100个职业场景:谁才是最强AI打工人?

通义千问与港中文联合发布OccuBench,用语言世界模型评测AI Agent职业能力。评测15个前沿模型,发现无全能选手,隐故障难处理,Scaling定律有效,做Agent和环境模拟器能力不同,还给出具体案例。

AI科技评论
算法论文7

The Batch: 919 | 本地 AI 能否替代云端?

大语言模型预测输出需求推动数据中心扩建,研究人员探讨本地小型模型能否分担算力负荷。斯坦福与Together AI团队研究发现,本地系统单瓦特智能量与云端有差距但在缩小,若准确率相近可节省能耗。

DeeplearningAI
产品应用8

美团悄悄上线的AI浏览器Tabbit,我觉得它更适合普通人。

美团光年之外团队发布AI浏览器Tabbit,作者认为它比Comet的Agent能力更强,产品完整细节好还免费。与类OpenClaw产品是互补关系,能处理场景任务,还有很多实用功能,值得一试。

数字生命卡兹克
开源动态7

我MiniMax,用实习生处理数据,照样屠榜开源大模型

MiniMax M2屠榜开源大模型,引发社区热议。它在注意力机制、数据处理、思考模上另辟蹊径,公开技术细节。M2团队选Full Attention,雇实习生处理数据,提出交错思维链策略,强调实用性和泛化能力。

量子位
算法论文8

DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配

现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。

PaperAgent
推荐文章7

老年代的“滞留对象”:一次由提前晋升引发的线上内存告警排查

文章以线上环境内存告警排查为例,介绍过程和思路。发现老年代因大量不可达对象占用且未触发FullGC致告警,排查出对象提前晋升是主因,还给出调整参数、减少对象产生等解决办法。

阿里云开发者