整体工程」共找到 776 篇相关文章

算法论文8

142 TFLOPS 的差距:为什么在 Blackwell 上 FP4 MoE 算子工程至关重要

文章对三种主流MoE后端在Blackwell B200 GPU上做基准测试,发现SGLang与vLLM有142 TFLOPS差距,小batch时SGLang快1.84×。差异源于kernel融合、面向Blackwell的CUTLASS schedule及自适应grid sizing等优化。

GiantPandaLLM
新闻资讯8

美国启动人工智能「创世纪计划」:打造AI版曼哈顿工程,270天就要见到效果

2025年11月24日,美国白宫发布行政令启动「创世纪计划」,对标「曼哈顿计划」。该计划将战略重心转向AI赋能的科学发现,盘活联邦数据与算力,构建平台,锁定六大领域,设定时间节点确保执行力。

AI寒武纪
开源动态7

隐藏超多上下文工程(Context Engineering)技巧的框架,来试一试吧!

文章指出多数人构建的AI Agent像Shallow Agent,处理复杂任务能力弱。以Claude Code等为例,介绍深度Agent架构的秘密,如冗长提示词、规划工具等,还推出开源包deepagents方便上手。

CourseAI
推荐文章8

AI 编程别光凭感觉:手把手实操 SDD,把 Vibe Coding 拉回工程轨道。

在AI编程中,“Vibe Coding”模式在大型项目上存在弊端,易带来架构不一致等问题。规范驱动开发(SDD)应运而生,它将重心移到“定义规范”。文章介绍了SDD理念、工具、流程,还给出实操步骤与落地建议。

AI大模型应用实践
7

刚刚DeepSeek宣布大规模扩张,整体至少扩员一倍,全体岗位集体喊人加入

DeepSeek宣布大规模扩张,各部门规模至少扩一倍。其发力点包括底层算力与系统优化、高质量数据、Agent与应用落地及探索Next Level科研。用人反内卷、反官僚,岗位接受实习,还新增AGI核心业务管培生。

AI寒武纪
算法论文8

视觉思维链全新架构,加州大学让多模态大模型有了灵性,整体性能提升5.3%

加州大学伯克利分校等团队提出视觉思维链(CoVT)架构,让视觉语言模型推理时生成连续视觉信号。它内化轻量级专家能力,采用对齐策略和四阶段训练,实验显示性能提升,还具可解释性。

AIGC开放社区
推荐文章8

一文读懂 RAG 与 KAG:原理、工程落地与开源实战(含代码与链接)

文章介绍RAG与KAG,RAG从文档找证据回答,适合开放域、时效更新快场景;KAG将结构化知识融进生成过程,实体关系与事实一致性更稳。还给出实战建议、工作流要点、最小可跑示例、开源组件及项目等。

机器学习AI算法工程
新闻资讯7

AI大厂系统提示词泄露:2.7万token里,藏着最好的提示工程

GitHub上`system_prompts_leaks`仓库扒出Claude、GPT等AI系统提示词。这些提示词像事故档案,规则具体,其结构排序暴露优先级。普通使用者可借鉴,提升对AI提要求的质量。

AI Reading Hub
算法论文8

提示工程死亡?不,它刚刚重生为计算科学:一篇讲透Prompt设计的科学基础

大型语言模型在多步推理任务中受挫,因Transformer架构有计算深度限制。本文建立提示设计理论框架,揭示提示是信息选择器,优化提示可使推理性能提升超50%,将提示设计从试错艺术变为可计算科学。

深度学习自然语言处理
新闻资讯8

OpenClaw创始人:80%的应用会消失,花哨的AI工作流只会生产垃圾,工程思维才是超能力

OpenClaw创始人Peter Steinberger表示,OpenClaw这类AI助理将取代手机上80%的应用。他分享OpenClaw诞生过程,其能远程修复Bug等。他还批判花哨AI工作流,认为人类品味不可或缺,建议学习AI要去玩。

AI寒武纪