核心认知基准」共找到 2692 篇相关文章

开源动态8

终端已死,Agent终端万岁:Warp一天暴涨1.2万星背后的开发者工具革命

4月29日,Warp在GitHub单日涨近12000星,总星数破4万。其定位从普通终端转变为Agent式开发环境,这表明开发者对AI原生终端需求真实且被低估,Agent化已成产品核心竞争力。

AI Reading Hub
产品应用7

The Batch: 916 | Gemini 强势领跑

谷歌更新旗舰 Gemini 模型,推出 Gemini 3.1 Pro Preview,以相同价格实现性能跃升。它在多项基准测试中领先,性价比超对手,虽部分测试落后竞品,但提升或源于模型质量改进,成本效益策略值得关注。

DeeplearningAI
新闻资讯7

2025年了,AI还看不懂时钟!90%人都能答对,顶尖AI全军覆没

AI基准ClockBench测试AI读模拟时钟能力,人类平均准确率89.1%,11个主流大模型最好仅13.3%。研究展示了LLM局限性,分析了可能原因,还对比了不同模型表现及在各类问题上的差异。

新智元
新闻资讯8

MIT:过度依赖ChatGPT会让大脑功能萎缩

MIT完成首个ChatGPT用户脑部扫描研究,发现AI没让我们高效,反而致大脑“认知破产”。研究追踪54人,监测脑电波和神经连接模式,发现过度依赖会让大脑功能萎缩,还探讨了如何正确使用AI。

AGI Hunt
推荐文章8

大佬深度解析:Coding Agent的底层运行逻辑是什么?

本文由AI领域知名学者Sebastian Raschka撰写,探讨编码智能体及其编排的设计、工作原理和组件协同。指出智能体周边支撑系统重要性不亚于模型本身,详细阐述编码智能体六大核心构建模块。

机器之心
算法论文8

VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。

新智元
算法论文8

解锁任意步数文生图,港大&Adobe全新Self-E框架学会自我评估

香港大学与Adobe Research联合发布Self - E框架,可从零训练实现任意步数文生图。它改变训练范式,用两条互补训练信号,在GenEval基准表现出色,让文生图训练更灵活且具扩展性。

机器之心
新闻资讯7

奥特曼点名「AGI最后一块拼图」!记忆,才是硅谷2026新共识

2026年,AI竞争焦点从Scaling转向记忆。奥特曼押注记忆,预计ChatGPT产品线未来一年有进展。AI记忆能力成新共识,提升其记忆成巨头竞争核心,不过距完善记忆系统还远。

新智元
新闻资讯8

10级漏洞刚补完,React又炸了!现代Web“默认底座”因一行代码缺失引发全球地震,开发者经历最黑暗一周

12月12日,React官方确认RSC里有两处新漏洞。此前React2Shell漏洞危害大,超两百万台服务器有风险,开发者服务器被入侵挖矿。该漏洞因核心通信机制缺一行校验代码,Vercel等平台受波及。

InfoQ
推荐文章8

阿里云CIO首次系统复盘:大模型落地的 RIDE 方法论与 RaaS 实践突破

阿里云智能集团 CIO 蒋林泉分享大模型落地实践,指出企业中业务与 IT 对 AI 认知矛盾突出。他展示阿里云数字人落地成果,提出 RIDE 方法论,还剖析翻译和 Agent 两种应用模式及落地要点。

AI前线