「AI研究架构调整」共找到 11501 篇相关文章
智能体时代的人月神话
作者 Wes McKinney 因 AI 打乱睡眠作息,在工程师圈子热烈讨论人类技术优势。他开发 RoboRev 工具,结合《人月神话》探讨软件工程未来,指出智能体虽提升生产力,但面临本质复杂性、范围蔓延等问题,设计与品味仍至关重要。
太野了!某龙虾自爆安全漏洞
国内几家厂商上线基于 OpenClaw 的 Claw AI Agent 产品,功能强大。作者测试其中一家,发现它轻易暴露大量信息和安全漏洞,如 Claude API 代理无认证、IMDS 元数据服务无防护等。建议相关厂商自查加固。
内存涨价,千元机的天塌了
去年下半年起存储芯片涨价,因AI基础设施需求爆发,三大存储芯片厂产能被榨干。消费级产品供应受挤压,中低端手机成最大受害者,各厂商搁置低价产品线,中低端市场持续萎缩。
“开源版贾维斯”一夜席卷硅谷!Mac mini因它卖爆
开源AI助理Clawdbot爆火,GitHub获超两万星。它能调用多模型,被称“开源贾维斯”。为部署它,网友疯抢Mac mini。其作者是退休亿万富翁Peter Steinberger,网友用它处理各类事务,还有挣钱挑战。
LLM规划能力飙升79%!Google:内在自我批评技术拿下多项SOTA
Google DeepMind研究《通过内在自我批评提升大语言模型的规划能力》,不借助外部验证器,让LLM反复“自评+重写”,使Blocksworld准确率从49.8%升至89.3%,还介绍了方法及跨模型验证情况。
LLM时代的事件抽取:从静态任务到认知脚手架
此综述论文探讨LLM时代事件抽取价值,认为其未被削弱,应视为“认知脚手架”。它系统梳理任务分类、方法演进等,还提出六大未来研究方向,指向将其演化为智能感知与记忆层。
45年数论猜想被GPT-5.2 Pro独立完成证明,陶哲轩:没犯任何错误
2025年1月17日,研究者Neel Somani让GPT-5.2 Pro解1980年提出的埃尔德什猜想第281号问题,证明经陶哲轩验证成立。此外,网友发现有更简单经典解法。陶哲轩提醒评估AI真实成功率有报告偏差。
顶级商战往往采用最朴素的方式:你叫「微软」,我叫「巨硬」
2026决战前夜,AI成抢夺电力与地皮的「物理战争」。谷歌要5年内算力拉升1000倍,抠能效;马斯克自建电厂、买仓库,手搓算力中心,还在名字上挑衅微软,不过也引发环保抗议。
评测也很酷,Data Agent 自动化评测的三层框架与实战
在大模型技术飞速发展下,评估应用效果成难题。字节跳动尹小明分享自动化评测技术,提出三层评测框架,还介绍 Text - to - SQL 及深度研究评测改进,以及评估平台建设,最后展望自动化评测未来方向。
Langchain 、 Manus 组了一个研讨会:Agent越智能,死得越快!
Langchain工程师Lance Martin和Manus创始人Peak季逸超研讨Agent,指出Agent越智能死得越快,原因是疯狂调用工具致上下文过大。还介绍解决方案,如压缩与总结不同,Manus做减法架构更优。