「协议细节」共找到 512 篇相关文章
Sglang 源码学习笔记(三)- 分布式和并行(以deepseek 为例)(WIP)
文章是 sglang 源码学习笔记,聚焦分布式和并行,以 deepseek 为例。介绍通信域类型,分析 ZMQ 和 torch.dist 通信,阐述 TP、DP、EP 实现,包括初始化、使用等,还涉及不同 Linear 层 TP 及 MoE 不同实现情况。
完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美元,复现DeepSeek的强化学习!
Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美元,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。
刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路
Claude Fable 5.1虽可兼容旧版提示词,但行为习惯有变化。官方整理提示词与工程落地指南,涵盖思考程度、工具调用进度汇报、独立工具批量调用等多方面使用技巧和避坑细节。
马斯克收购 Cursor,估值从 25 亿到 600 亿只用了 15 个月,最好终局
2026年4月21日,SpaceX宣布与AI编程工具明星公司Cursor达成战略合作,获以600亿美元收购选择权,若不行使需付100亿美元“合作费”。Cursor 15个月估值膨胀24倍,马斯克收购或为补齐短板、引入人才及助力IPO。
xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签!
SpaceX宣布协议,或600亿美元收购代码生成初创公司Cursor,也可能支付100亿美元合作费。xAI代码生成能力落后,此次交易为其带来更强市场立足点,也助Cursor解决算力瓶颈。
AI实践|基于 Spring AI 从0到1构建 AI Agent
本文是基于Spring AI构建AI Agent的实践分享。该项目集成RAG、Function Calling等核心能力。文章从六个核心模块剖析其架构与实现,涵盖配置、访问方式,还介绍各模块工作机制、代码及应用场景。
盘一下Anthropic 244页Claude Mythos报告中隐藏的SAE技术
Anthropic公布强大危险的大模型Claude Mythos Preview但未发布。文章深挖其244页报告中SAE技术细节,包括前期探索、技术框架、训练监控、攻击性行为分析及掩盖行为等,助了解模型内部思维。
CUTLASS 笔记 (2):混合精度 GEMM kernel
文章介绍实现支持不同精度的 GEMM 算子,解析精度转换技术细节,还介绍根据 PTX 文档实现自定义 FP8 精度的 GEMM kernel,包括揭开 MMA Atom 面纱、分析 TV 与 MN Layout 等,最后完成精度验证。
顶尖开发者都在用 skills.sh热门技能
发现全能Skills网站https://skills.sh/,它是Open Agent Skills Ecosystem载体,解决AI Agent能力碎片化等问题。提供一键安装的技能模块库,支持多主流AI Agent适配,有技能排行榜,还能解决AI Agent的能力痛点。
AI用3年时光,来了解你!首个AI Clone长期记忆基准
现有AI记忆评测存在数据源单一、忽视变化本质、注入成本高等局限。开源学术社区QuantaAlpha联合高校团队提出CloneMem基准测试,构建合成人生,设计评测任务,实验发现简单方法在检索上更有效,记忆系统应还原信息。