分离式计算」共找到 1354 篇相关文章

推荐文章7

AI竞赛下半场:为什么说“超级工厂”是最优解?

2025年夏天,巨头们因Agent的崛起对AI热情高涨,砸钱堆算力的背后是算力供不应求的困境。云计算因其具备极致的规模化、先进的生产工艺、柔性生产、智能管理和生态链接能力,被认为是AI的“超级工厂”。阿里云作为实例,展示了其完整的AI生产体系。

InfoQ
开源动态8

一文彻底看懂 Google 最新开源 A2UI 协议:如何让 AI Agent “说出UI” ?

本文深入解读Google最新开源的A2UI协议,它让AI Agent学会“说UI的语言”,用安全、声明将UI需求发至前端渲染。文中分析Agent UI面临的挑战,介绍A2UI设计思想、工作流程,还提及它与AG - UI、CopilotKit的关系及未来展望。

AI大模型应用实践
算法论文8

ACM MM 2025 | 小红书AIGC团队提出风格迁移加速算法STD

小红书AIGC团队提出风格迁移加速算法STD。现有一致性模型在风格化任务有缺陷,文章提出从部分噪声状态出发的训练框架STD,设计轨迹状态库减轻计算负担,引入非对称对抗损失增强风格一致性,实验显示其效果优。

机器之心
算法论文8

CVPR 2025 | 如何稳定且高效地生成个性化的多人图像?ID-Patch带来新解法

本文围绕个性化多人图像生成展开,指出其面临身份特征泄露等挑战。介绍了早期方法的不足,提出全新的ID-Patch方案,阐述其设计思路、实验效果等,还探讨了提升空间与未来方向,该方案在多人物图像生成中有突破提升。

机器之心
新闻资讯7

误入人均10个顶级offer的技术天团活动,顶尖AI人才的选择逻辑我悟了

作者参加京东TGT计划活动,与两位入职京东的顶尖AI人才交流。Daniel因京东重视生成推荐项目、技术氛围纯粹而选择它;Kyrie则被创业热情、技术理想共鸣及数据优势吸引。入职后两人都获核心项目机会。

量子位
算法论文7

LLM已能自我更新权重,自适应、知识整合能力大幅提升,AI醒了?

近期,AI自我演进话题研究讨论渐热。OpenAI奥特曼畅想AI自我改进未来,有爆料称其内部运行递归自我改进AI。MIT论文提出SEAL框架让LLM自我更新权重,引发热议,实验显示其有提升但也有局限。

机器之心
算法论文7

谈一谈TP推理场景下MoE Group GEMM的优化思路

作者在使用H20测试SGLang CUTLASS MoE时,发现其在中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案在H20和Hx00上的实现细节及性能测试结果。

GiantPandaLLM
新闻资讯8

张一甲:2025人工智能产业30条判断 | 甲子光年

甲子光年创始人张一甲在「2025甲子引力年终盛典」发布《轰然成势 万象归一:2025人工智能产业30条判断》报告。报告指出AI已“轰然成势”,进入“默认AI”时代,还从技术、产品、产业、社会等方面给出30条判断。

甲子光年
产品应用8

文心X1.1三大能力狂飙,海内外实测还挺惊艳!

9日WAVE SUMMIT深度学习开发者2025大会上,文心大模型X1.1发布,事实性、指令遵循、智能体能力显著提升,多项测试表现佳。它能做到知识一致,精准遵循指令,智能体解决问题出色,代码、数学、多模态能力也有进化,得益于迭代混合强化学习训练框架。

新智元
开源动态8

R-HORIZON:长程推理时代来临,复旦NLP&美团LongCat重磅发布LRMs能力边界探测新范

复旦大学与美团LongCat Team联合推出R - HORIZON,它是首个系统性评估与增强LRMs长链推理能力的方法与基准。提出Query Composition方法构建评测基准和训练数据,评测发现主流模型长链推理性能断崖下降,还分析出三大瓶颈,训练后模型性能双重提升。

机器之心