「效率竞争」共找到 1908 篇相关文章
当黄仁勋反复提起OpenClaw,他到底在焦虑什么?|甲子光年
美国当地时间3月18日,「甲子光年」参加英伟达黄仁勋在GTC 2026的媒体会。黄仁勋多次提及OpenClaw,认为它很重要。英伟达不仅造GPU,还构建AI工厂,试图成为新计算秩序定义者。
融资 1200亿后 Kimi 再扔王牌,新架构爆改 Transformer 老配件,比 DeepSeek 同款还省钱
Kimi 发布新论文,提出“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推出“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。
全球AI算力大战变天!十万卡算力集群爆表,国产IB真香?
大模型竞赛进入万卡、十万卡时代,网络取代算力成新瓶颈。过去RoCE因成本优势受青睐,但集群规模扩大后运维复杂。IB架构以其稳定性迎来价值重估,国产IB方案突破或改变技术路线选择。
The Batch: 920 | Nano Banana 2 在性能/价格比方面实现提升
Google发布Nano Banana 2(正式名称Gemini 3.1 Flash Image),是图像生成系统。它速度快约4倍、成本减半,支持多功能,在多个排行榜中位列前三,以低价接近文字 - 图片排行榜领先位置。
GAN之父Ian Goodfellow病后归来,剑指高效世界模型
GAN之父Ian Goodfellow等提出,利用符号化表示和游戏虚拟世界数据,或为构建动作条件多模态世界模型最佳路径,该模型可支持长时序任务预测与规划,还探讨构建原因、数据来源等。
Context Mode:为你的AI开发工具节省98%的上下文token
开发者分享开源项目Context Mode,它在Claude Code和工具输出间加中间层,采用沙箱隔离和精准检索策略,能节省98%上下文空间,与Cloudflare Code Mode互补,可提升AI从业者工作效率。
Attention真的可靠吗?上海大学联合南开大学揭示多模态模型中一个被忽视的重要偏置问题
上海大学曾丹团队联合南开揭示Vision - Language Models中普遍的attention偏置问题,提出无需重训的去偏方法,在多模型、策略及基准上验证有效性,为多模态模型部署提供新思路。
如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证
大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。
OpenAI 关键九问:2026 AI 战局升级后迎来叙事反转
文章围绕OpenAI提出九个关键问题并给出判断。虽受Gemini影响,面临竞争,但作者对其2026年叙事反转有信心,还分析了用户增长、业务布局、技术突破等方面情况。
刚刚,DeepSeek 突发梁文峰署名新论文:V4 新架构提前曝光?
今天凌晨,DeepSeek在其GitHub官方仓库开源了新论文与模块Engram。该论文提出“查—算分离”机制,通过引入可扩展的查找记忆结构,在等参数、等算力条件下提升模型表现,代码与论文全文均已开源。