「并行控制」共找到 694 篇相关文章
近500页史上最全扩散模型修炼宝典,宋飏等人一书覆盖三大主流视角
宋飏等人所著《The Principles of Diffusion Models》共460多页,系统梳理扩散模型发展脉络与核心思想,以统一数学框架串联多种视角,是研究者参考资料与初学者入门读物。
首个MCP架构、只50行代码就能实现高效RAG的开源框架UltraRAG 2.0
检索增强生成系统(RAG)复杂度提升,使科研人员面临高昂工程实现成本。清华大学、东北大学、OpenBMB等联合推出UltraRAG 2.0,基于MCP架构,降低技术门槛与学习成本,让科研专注创新。
当未经检查的自动扩缩造成 12 万美元的云支出时
Reddit 上一个云成本恐怖故事引发热议,一集群遭 DDoS 攻击自动扩展,72 小时产生 12 万美元账单。Zero Cloud Waste 创始人给出预防措施,各方也发表看法,凸显需 FinOps 战略配合自动扩缩。
聊聊AI应用架构演进
本文按AI应用架构演进路线,介绍每次演进增加的架构内容及相关技术,涵盖从简易架构到Agent模式等各阶段,还提及监控、推理性能优化等,助读者整理新技术,为探讨AI与传统应用架构异同做调研。
LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析
文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍了该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述了数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式。
OpenAI官方发布【Codex 上手指南】
OpenAI 昨晚推出 Codex 研究预览版,这是强大的远程编码智能体,能导航代码库、解答疑问等。官方还发布使用指南视频,介绍了快速上手步骤、工作方式,以及提升效能的方法。
DeepMind 提出 CaMeL,抵御 LLM 提示词注入
谷歌DeepMind研究人员提出CaMeL,作为围绕LLM的防御层,通过提取查询中的控制流和数据流阻止恶意输入,能在AgentDojo基准测试中抵御67%攻击,采用传统软件安全原则。
Ropedia刘子纬:具身智能的Scaling Law,不是算力,是人类的经验
Ropedia刘子纬指出,当前物理AI面临差距,下一阶段需Scaling人类物理世界的经验。Ropedia构建真实世界经验引擎,形成经验飞轮,目标是打造能看见、记住、想象并行动的模型。
近5w颗星!一个能同时指挥多个AI写代码的开源工具来了
现在写代码,很多人想开多个AI助手。Orca是支持多AI Agent的编程开发环境,各Agent在独立git worktree里运行,互不干扰。它功能丰富,还支持多系统安装。
具身智能本体的重要性和技术差距,可能被大大低估了
目前,具身智能发展的讨论多聚焦模型和数据,而本体易被忽视。灵御智能凭借高性能本体在‘申智杯’夺冠,其灵御TA2机器人受关注。文章从多维度剖析本体重要性,并介绍了灵御TA2的优势。