云资源管理」共找到 1323 篇相关文章

新闻资讯7

小米小爱同学:资源受限下,实现端侧大模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,了解其团队在资源受限的端侧设备实现大模型高性能推理的策略。目前端侧大模型商业化落地慢,团队提前布局,自研框架,实现超180 tokens/s推理速度,还分享未来突破方向。

InfoQ
算法论文8

参数量暴降,精度反升!哈工大宾大联手打造点分析新SOTA

哈工大(深圳)和宾大联合团队推出基于KANs的3D感知解决方案PointKAN,能处理点数据下游任务。它替代MLP,有更强学习几何特征能力。还提出PointKAN - elite,降参保量。实验表现出色。

量子位
新闻资讯7

OpenAI发布GPT-5-Codex:独立编码7小时,能动态调整资源,token消耗更少

OpenAI发布专用于编程的GPT-5-Codex,属GPT-5特殊版本,有即时协作和独立执行的‘双模’特长。它能动态调整资源,token消耗少,擅代码审查。文中还介绍其命名由来及编程智能体竞争情况。

Founder Park
开源动态8

从亚百毫秒级启动到生产级部署,腾讯为何重构 Agent 沙箱?

2026 年初,OpenClaw 掀起本地终端 Agent 热潮,但也带来安全风险,让 Agent 沙箱受关注。腾讯 4 月开源 Cube Sandbox,InfoQ 采访金峰,了解其从 Serverless 到 Agent 沙箱过程及团队对下一代 Agent Infra 的判断。

InfoQ
产品应用8

AI时代CRM的重生之路:阿里上的Salesforce如何改写SaaS规则?

AI 浪潮下传统 CRM 面临效率、合规与智能融合等问题。阿里上的 Salesforce 展出“中国定制化 AI CRM”方案,历经六年探索,从合规、生态到 AI 闭环构建能力,通过多行业实践重塑企业增长逻辑,为 SaaS 行业提供范本。

AI前线
新闻资讯8

深度访谈:阿里X平头哥,模型推理提升13倍背后的秘密

这篇深度访谈聚焦阿里与平头哥,探讨模型推理提升13倍背后的秘密。随着AI焦点转向推理,行业面临算力、成本、监管等矛盾。嘉宾分析推理范式现状与变化,探讨推理加速技术及优化策略,还谈及瓶颈、未来发展及竞争方向。

InfoQ
8

上线一年用户破百万,这个AI健康管理产品只靠一只海獭? | 对话OtterLife

AI健康管理产品众多,多数陷入同质化或功能堆砌困局。OtterLife将虚拟海獭融入健康习惯养成,上线一年用户破百万。量子位智库对话其负责人相城,探讨产品特色、市场、设计等多方面问题。

量子位
新闻资讯7

在今天,投后管理的战略价值与退出路径规划在何处 | 甲子引力

在「甲子光年」2025甲子引力年终盛典上,澳银资本胡艳等多位投资界人士,结合案例探讨投后管理战略价值与退出路径规划。大家分享投后增值案例、应对挑战方法,还讨论了衡量投后价值及退出规划等问题。

甲子光年
产品应用8

实测腾讯 AndonQ:号称比肩原厂技术专家的 “领域虾”,到底有多能打?

文章实测腾讯 AndonQ,它号称全球首款 ITSM“领域虾”,可适配主流“虾”类工具,集成至 IM Bot。测评显示其成本低、上手轻量,在架构选型、故障排查等场景表现出色,将 ITSM 体系浓缩到对话框。

AI前线
推荐文章7

后端架构新范式!阿里专家亲揭:用RocketMQ彻底搞定多Agent异步协同难题

文章整理自阿里专家演讲,介绍基于 Apache RocketMQ 新特性构建异步化 Multi - Agent 系统,探讨 Agent 间异步通信等机制,指出 Multi - Agent 协同关键,还讲了 RocketMQ 新特性及如何构建异步系统。

AI科技大本营