Fast3Dcache」共找到 2031 篇相关文章

算法论文8

FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾

文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。

GiantPandaLLM
新闻资讯8

小扎豪掷143亿,却换不来AI燃料!数据之争下半场,中国冲出一匹黑马

2025年大模型高速进化,全球AI圈“数据大战”激烈。小扎花143亿抢占数据制高点却遇问题,马斯克裁员转招“专业AI导师”。中国澳鹏数据崛起,上半年营收3.06亿,有五大技术平台,未来目标2030年前中国区营收超20亿。

新智元
开源动态7

刚刚,马斯克开源Grok 2.5:中国公司才是xAI最大对手

马斯克主导xAI正式开源Grok 2.5,Grok 3将半年后开源。Grok可在HuggingFace下载,运行有条件。虽Grok 2曾有不错表现,但网友对其参数权重、开源协议等有诟病。此外,还更新APP视频生成功能,马斯克称中国公司是xAI最大对手。

量子位
新闻资讯7

御三家格局松动:Google和Meta同日发布新模型,第三名不再稳了?

2026年9月2日,Google推出Gemini 3.8 Flash,Meta发布Muse Spark 1.3。此前Google经历人事调整、旗舰延期,靠Flash维持节奏;Meta则重建团队、收窄战略。二者产品定位相似,各有优劣。

DeepTech深科技
算法论文8

夜光影像里的"暗船":双分支 YOLO11 如何用抓非法捕捞

非法捕捞的暗船常关掉 AIS 隐身,难被传统手段监控。论文提出双分支 YOLO11,通过夜光遥感数据精准检测,还设计预处理流程,在测试集表现优,规模化应用也得到暗船率等成果。

机器学习AI算法工程
新闻资讯7

The Batch: 977 | AI 对速度的需求为何如此迫切

开发者如今需更关注AI速度。OpenAI和Cerebras的Ultrafast、Google的Gemini 3.7 Flash、Nvidia的Nemotron 3.5 Lightning都主打速度。速度在AI领域对应延迟和吞吐量,影响应用体验和范围。

DeeplearningAI
开源动态8

性能飙升42%!人大&字节开源10万级 SWE数据集 Scale-SWE

近期,人大和字节开源10万级软件工程数据集Scale - SWE,用首创工作流从GitHub构建真实数据。基于此微调的Qwen3 - 30A3B - Instruct模型测试表现佳,其数据相比合成数据优势明显。

PaperAgent
新闻资讯7

AI遭遇灵魂拷问!这道题所有模型集体翻车,网友:我也不会啊

图像推理现新难题,在Reddit引发热议,目前无AI能真正解决。国内外支持图像输入的大模型答案不同,原因是对大立方体规格理解不同。结合提示多次尝试,部分大模型能找准方向,人类面对该问题也会困惑。

量子位
新闻资讯7

英伟达:祝贺谷歌TPU成功,但GPU领先一代

谷歌凭Nano Banana Pro、Gemini 3大获全胜,且Gemini 3用自研TPU。谷歌向客户推介TPU本地部署方案,欲抢占AI芯片算力市场。英伟达紧急发声强调自身核心地位,还砸钱拉拢大客户。

量子位
新闻资讯7

爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?

第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,仅做出一题,DeepSeek R1 挂零。不同模型架构在比赛中差异不大,暴露出大模型做算法题短板,推理模式模型表现更好。

AI前线