「中国的ASML」共找到 11082 篇相关文章
基于闪电注意力机制,创新高效开源大模型
传统Transformer架构处理长文本和复杂推理任务有效率瓶颈,多数领先模型仍依赖传统注意力设计。MiniMax开源基于闪电注意力机制的专家混合模型Minimax,从架构、创新模块、训练框架等多方面优化,表现突出。
GraphRAG太慢LightRAG延迟高?华东师大新方法一招破解双重难题
华东师大李翔老师带领的Planing Lab团队推出E²GraphRAG方法,解决GraphRAG索引慢、LightRAG查询延迟高的问题。该方法用SpaCy识别实体,结合图和树查询,在构建和查询时间上表现出色。
Claude王座失守!OpenAI一夜反超,神秘GPT‑6 Sol偷跑
本文报道AI大模型领域最新战局,OpenAI在OpenRouter平台的开发者Token消耗付费流水,首次超越Anthropic Claude,终结了Claude两年半的统治,同时神秘GPT-6 Sol偷跑曝光,双方开启终极对决。
IDE消亡之年?Steve Yegge两句狠话:2026年还用IDE就不行,每天烧500–1000美元Token才合理
Steve Yegge和Gene Kim认为,从2026年1月1日起,依赖传统IDE的工程师会被拉开差距,这是‘生产方式换代’。他们还提到AI将重塑软件开发,无开发或成现实,新开发方式价值更优。
2027年,人类最后一次抉择
Anthropic首席科学家Jared Kaplan预警,2027 - 2030年人类要抉择是否让AI递归自我进化。还介绍了AI进化三阶段,以及2027年关键的技术和硬件因素,同时Anthropic报告揭示AI对工程师工作的重塑。
一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”
NVIDIA 推出多模态大语言模型 OmniVinci,结合架构创新与数据合成流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发争议。
jiSGLang集成ktransformers:2TB内存运行Kimi K2 Thinking模型
对于内存多但GPU资源有限的用户,SGLang集成ktransformers的CPU内核,支持直接运行Kimi K2 Thinking模型。它无需等量化,还能微调,虽性能与GPU方案有差距,但给用户新选择。
Meta 即将上线全球最大算力集群
小扎在算力投入上毫不手软,Meta 即将上线全球首个 1GW+ 能耗的超级计算机机群,还在新建 Hyperion 算力集群,几年内功耗将达 5GW,远超老马 30 万张卡集群的 200 - 300 兆瓦。
狂揽81.8K star!Google Firebase 免费开源替代,真香啊~
在开发中后端搭建常令人困扰,Supabase作为开源的Firebase替代品出现。它基于一系列开源工具构建,提供完整且易用的后端解决方案,涵盖数据库管理等多项功能,有多种性能特色,还介绍了使用方法和体验,值得开发者尝试。
“毋在浮沙筑高台”:汪源谈智能体想从 80 分跨到 90 分,全卡在上下文
前网易副总裁汪源在2026奇点智能产品大会分享,指出智能体系统瓶颈正从模型能力、Harness工程,转移到上下文。他还介绍了做好上下文基础设施的要点,以及推出的新内容格式KRL。