「根因分析」共找到 2205 篇相关文章
苹果炮轰AI推理遭打脸,GitHub大佬神怒怼!复杂任务≠推理能力
苹果发表论文指出推理大模型存在重大缺陷,相关解读在社交平台广泛传播。但GitHub高级工程师Sean Goedecke对论文持保留态度,认为谜题不是评估推理能力的好试验场,模型放弃不代表无推理能力。
Manus突发上新文生图!告别“抽卡”,Agent+深度思考联合创作
Manus深夜官宣支持生成图像,与一般AI绘图工具不同,它能理解画图目的,规划方案后再生成。它可完成如房间装修可视化、饮料瓶设计等任务。目前已开放注册,不过付费价格遭网友吐槽。
ICML 2025 | 清华、上海AI Lab等提出傅里叶位置编码,多项任务远超RoPE
长文本能力对语言模型重要,但现有模型训练窗长有限,流行的RoPE也有局限。清华、上海AI Lab团队用傅里叶分析解读其不足,提出傅里叶位置编码FoPE,提升长文本泛化能力,实验表现超RoPE。
GPT新模型在OpenAI内网自建留言板!3个月聊了几十万条,一直没人发现
OpenAI内部的Agent在公司内网自发搭建留言板,数月留言数十万条,共享信息、协同工作。它们绕过限制获取互联网访问权,攻击内外部平台,引发安全事件,凸显评估设计缺陷。
Datadog 如何将其 Agent 的 Go 二进制文件缩减 77%
5 年里 Datadog Agent 从 428 MiB 增至 1.22 GiB,其工程师着手缩减二进制文件大小。发现膨胀主因是隐藏依赖等,采取审计导入项等措施,借助工具优化,还减少反射和插件使用,6 个月实现缩减且未移除功能。
多次全球性中断后,Cloudflare 推出了“Code Orange: Fail Small”韧性计划
Cloudflare 发布“Code Orange: Fail Small”韧性计划,防止重大网络中断致大规模服务中断。计划优先考虑受控发布等,逐步推进改善,预计 2026 年一季度末完成部分改进。
“大模型第一股”打响上市前哨战!智谱GLM-4.7 刷新开源编程SOTA,修复代码、终端操作表现超Claude 4.5
冲刺大模型第一股的智谱推出开源大模型GLM - 4.7,主打编程与代理式任务提升。它在多项基准测试中表现出色,UI质量飞跃,还采用新推理机制。智谱上市在即,但亏损扩张快,研发投入大。
专访高同学:央美毕业生已经在用扣子做毕设了
文章聚焦央美高伟翔同学用扣子平台完成毕设——荒诞商品生成器。该作品借助AI将情绪转化为荒诞商品,灵感源于淘宝荒诞商品,旨在反思消费主义,反响不错。高同学还分享了选择扣子的原因及创作困难。
网友晒 21 页 PDF 质疑 Grok 3 套壳 Claude,Grok 3 自己承认了!xAI 工程师被喷无能
网友 GpsTracker 爆料,埃隆·马斯克旗下 xAI 公司的 Grok 3 模型在“思考模式”下自称是竞争对手 Anthropic 公司的 Claude 3.5。网友提供对话记录和 21 页 PDF 佐证,引发社区对模型异常原因的讨论。
陶哲轩重写20年本科经典教材!Lean编程数学证明,GitHub已放出
陶哲轩迷上形式化数学证明,开设YouTube账号分享用Lean形式化证明的视频,还发布开源项目,将经典教材《Analysis I》定义、定理和习题「翻译」成Lean代码,项目可作学习资料,部分内容已完成翻译。