全栈式优化」共找到 2939 篇相关文章

新闻资讯7

谷歌黑魔法,没人能看懂的Gemini 3 Flash

Gemini 3 Flash速度快3倍且智力超Pro,但没人明白其更「聪明」的原因。它打破「参数即正义」逻辑,在多项测试领先。谷歌或靠TPU、算法、数据优化,还可能用了Titans架构,有重大战略意义。

新智元
新闻资讯8

上市后的摩尔线程,重心从造芯变成建生态

上市刚满15天的摩尔线程在MDC 2025大会展示栈技术成果,回应市场关注。其创始人强调生态是GPU行业核心,正构建MUSA生态体系,MUSA架构升级,还揭晓‘花港’架构及两款芯片技术路线。

InfoQ
算法论文8

腾讯与中科院联合提出R-4B,一个能自动决定是否思考的多模态大模型

多模态大语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在多评测中达SoTA,省资源且效果好。

深度学习自然语言处理
产品应用8

出海企业苦等的可信任AI营销产品,飞书深诺做出来了

出海生意进入困难模式,不少企业寄望于AI,但现有AI营销产品难达预期。飞书深诺推出Marvy 2.0,将出海营销流程装进系统,具备技术优势,有13年业务经验等,还计划推Marvy Lite,助力球数字营销平权。

量子位
推荐文章7

深入解析多邻国的 FinOps 之旅:将云支出转化为工程洞察

多邻国在《每位工程师都该了解的 FinOps》中分享实践经验,将财务意识融入工程流程,用成本可视化机制让开发者了解成本影响,采用相关指标平衡创新与效率,借助工具优化成本,行业正从‘削减成本’转向‘数据驱动责任制’。

InfoQ
算法论文8

阿里通义发布并行计算新策略:1.6B等效4.4B,内存消耗骤降95%

阿里通义团队提出PARSCALE并行计算新策略,受CFG双路径推理机制启发,将并行思想扩展到训练和推理流程。能让1.6B模型性能接近4.4B模型,内存占用大降,还可用于现有模型,无需从头训练。

量子位
开源动态7

macOS Harness:AI 自己写代码,操作你的整台 Mac

macOS Harness 是 browser - use 团队开源项目,目标是让 LLM 用持久化 Python 进程完成 Mac 上几乎所有任务。它仅提供六个原始操作,模型用其操作应用,还能在运行中补缺失部分。项目有诸多优势,目前仅支持 macOS。

AI工程化
开源动态8

Zvec: 开箱即用、高性能的嵌入式向量数据库

Zvec是轻量级嵌入式向量数据库,为终端侧设计,有开箱即用等四大优势。它基于Apache 2.0协议开源,能满足向量检索在多场景需求,相比现有方案功能更、资源管控强、性能出色,后续还将持续迭代。

阿里云开发者
推荐文章8

Kernel Design Agent(KDA) 的B200 GPU Kernel 编程准则 Skill

文章围绕 Kernel Design Agent(KDA) 的 B200 GPU Kernel 编程展开,介绍目标平台、架构参数,阐述独有特性与编程要点,给出关键性能准则调整方向,详述 16 条准则及特殊 Kernel 类型优化策略和编写前检查清单。

GiantPandaLLM
开源动态8

开源模型首超Opus4.6!智谱GLM-5.1登场,14小时后CUDA专家被冲了

智谱开源模型GLM - 5.1带来重大突破,14小时完成CUDA Kernel优化,加速比大幅提升。它解锁与顶尖闭源模型Claude Opus 4.6面对齐,在多测试中表现优异,展现长程任务能力,改写行业叙事逻辑。

量子位