华为云Stack智算平台推三大能力超节点集群利用率提升至70%
观点网讯:华为云 Stack 智算云平台宣布通过云硬协同、精细化运营、模型快速适配三大能力,重新定义政企 AI 落地的效率标尺。
根据公开资料整理,在算力利用方面,华为云 Stack 通过 Serverless NPU 弹性算力调度、训推共池错峰复用、多样性算力融合调度等技术,集群整体利用率可提升至 50% 以上;今年底结合新一代升腾超节点的深度池化与弹性算力复用技术,超节点集群利用率提升至 70%。
推理侧,华为 OceanStor A800 多级缓存架构中,KV Cache 优化让 TTFT(首 Token 时间)降低 70%,Token 吞吐量提升至 2 倍。
精细化运营方面,平台构建了 6 层全栈拓扑监控,覆盖从硬件到应用的全链路,配套 150+ 智算指标,故障定界从小时级压到分钟级,并支持超配缩容、闲置回收等 5 种算力优化场景。
模型适配上,华为云 Stack 智算云平台已支持 DeepSeek、MiniMax、Kimi、Qwen 等主流模型,实现 " 开箱即用 "。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
The End
