「全栈优化」共找到 3027 篇相关文章
TileLang深入详解-第二章-TileLang 核心编程抽象
文章深入解析TileLang核心编程抽象,介绍写kernel的方式,阐述TileLang三层抽象特点及适用场景,展示JIT工作流、接口和执行后端,还提及性能优化、基准测试、正确性校验,最后用GEMM示例对比三层抽象差异并给出使用建议。
万字长文 | 异构算力技术架构与核心组件解析
文章聚焦异构算力技术架构与核心组件,解析主流AI芯片特点、国产芯片技术路线;介绍高速互联技术、网络拓扑结构及优化方法;阐述大模型存储需求、分布式存储技术及数据预处理与加载技术,为AI计算提供全面方案。
刚刚,GPT-5内测抢先泄露!推理强到离谱,智商被曝140超越人类天才
周五凌晨,GPT-5、GPT-5 Mini和GPT-5 Nano将推出,全网可通过API和ChatGPT访问。GPT-5基准测试结果疯传,实测表现出色。同时,OpenAI发布开放权重模型GPT-oss,登顶开源王座,外媒分析其豪赌开源原因。
刚刚,MOSS孙天祥创业,直播AI4AI大规模科研
创业公司Analemma将全球公开直播部署端到端AI研究系统FARS,目标是全自动完成100篇论文,直播预计持续一个月。FARS是无人类干预、纯AI驱动的系统,能完成科研全流程。其创始人是孙天祥,团队年轻且获数千万美元融资。
Mini-sglang-01:从Client到Scheduler的消息流转之旅
文章围绕轻量化大模型推理系统mini - sglang,详细介绍消息从客户端经APIServer、Tokenizer到Scheduler的流转过程,分析核心组件功能、消息体系、正反向链路及优化策略,还预告后续分析调度和模型实现逻辑。
先说个暴论:不懂代码的人,才最喜欢 Vibe Coding。
文章指出不懂代码的人爱Vibe Coding,还介绍AI Coding赛道跨行、跨文件补全方向。分析基于AST的上下文构造、提升速度的方法,提及AI IDE采纳率问题,认为实际项目中NES可控度更高。
优理奇机器人完成两轮合计3亿元天使++++轮及天使+++++轮融资,“算法-硬件-场景”三位一体加速具身智能应用落地
优理奇机器人近日完成两轮合计3亿元融资,是半年内第五轮。其坚持“场景驱动”,产品在运动会获奖,量产交付订单超千台。构建完整技术栈,推出标准化机械臂产品,创始人看好具身智能统一发展。
一句话,性能暴涨49%!马里兰MIT等力作:Prompt才是大模型终极武器
马里兰大学、MIT、斯坦福等机构研究发现,AI性能提升一半靠模型,一半靠提示词。他们让DALL - E 2和DALL - E 3 PK,发现DALL - E 3性能提升中,模型升级贡献51%,提示词优化贡献49%。
AI Infra 工程师们如何应对大模型流水线里的“暗涌”?
InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。
Loop Engineering,4层循环自我进化
Loop Engineering旨在解决人工调度agent的问题,设计系统替人prompt。其系统是四层嵌套循环,从内到外分别让agent干活、干得对、知道何时干、越干越好,还指出优化循环结构收益渐增。