「里德·霍夫曼」共找到 295 篇相关文章
OpenAI o3封王,4比0横扫马斯克Grok 4!全球大模型对抗赛完美收官
Kaggle AI国际象棋锦标赛中,OpenAI o3以4-0横扫Grok 4夺冠,这场比赛也被视为OpenAI与xAI的“代理人战争”。季军战里,Gemini 2.5 Pro击败o4 - mini获铜牌。大赛旨在检验大模型多方面能力。
谢赛宁摊上事了!被曝论文藏「只给好评」提示词操纵AI 审稿
纽约大学助理教授Saining Xie被曝在参与的论文里埋「只给好评」提示词操纵AI审稿。他回应称是日本访问学生照搬他人想法所致,涉事学生已更新论文并寻求指导。此事暴露AI时代学术评审困境。
多 Agent 并行,手机也能用,已经 4 万星!
GitHub上项目Orca是专为「并行Agent」做的开发环境,开源4个月揽4万+ Star。它让多个Agent在独立git worktree里并行干活,互不干扰,还支持近30款主流Agent,另有多种实用功能,安装也简单。
Life of a Token:像调试代码一样看懂大模型如何生成 Token
文章类比 Chrome 的 Life of a Pixel,追踪 LLM 里 token 从输入到输出的全程。以 GPT - 2 Small 为例,详细讲解其管线各阶段,如 Tokenization、Embedding 等,还介绍了残差流、KV Cache 等概念及 GPU 性能瓶颈和优化方法。
模力工场 033 周 AI 应用榜:从评论区互动到游戏陪玩,AI 已悄悄加载完成
模力工场 033 周 AI 应用榜发布,展示了 AI 在各领域的应用。各大厂选择在原有产品里做能力延伸,开发者将分散的 AI 功能整合。榜单涵盖学习、生活、娱乐等多领域应用,AI 更便利、隐形地融入日常。
为何我的 Docker 镜像如此庞大?使用“dive”进行深度剖析以找出臃肿之处
在AI项目里,Docker镜像可能臃肿庞大,影响开发与部署。本文以朴素BERT分类器镜像为例,指出未优化镜像会导致开发慢、CI/CD低效等问题,还介绍用dive工具剖析镜像,找出臃肿之处以优化。
Codex正式开放1M上下文!解除GPT-5.6 Sol封印,三行配置搞定
现在3行配置就能让GPT - 5.6 Sol封印解除,在Codex里用上1M上下文。不过有网友警告轻易别用,因超出默认窗口,模型消耗token速度会翻倍,且模型上下文利用能力会下降。此外,Codex确定会上Astra。
SGLang Custom AllReduce v1 与 v2 实现原理详解
文章聚焦 SGLang 里两代自定义 all-reduce 实现(v1 和 v2),前者从 vLLM 移植,后者是默认版本。详述其负载特征、前提条件、分发链、同步机制、算法及 CUDA graph 支持等内容,还对比了两代差异,并提及相关环境变量。
Claude Opus 5深夜发布,以一半价格逼近Fable 5。
周六凌晨Claude Opus 5全量上线,在所有Claude产品里可用。它有100万上下文,知识最新到2026年5月。跑分显示其在很多领域逼近Fable 5,价格仅为一半。它和Fable 5各有优势,还带来Claude Code使用的变化。
Cursor改变了写代码的方式,云电脑改变了跑Cursor的方式
AI编程已成核心生产力,但Cursor等工具对硬件要求高,运行卡顿。问题不在电脑配置低,而在于AI工具不应挤在常用电脑里。无影云电脑作为‘第二桌面’,能让AI在云端运行,与第一桌面互不干扰。