跳转到主要内容
Background

LKE:Managed Kubernetes Engine

在生产级 Kubernetes 上运行容器化与 AI 工作负载,无需承担复杂的运维负担

概览

运行 Kubernetes,而非控制平面。

部署、管理并弹性扩展容器化与 AI 工作负载,无需担心控制平面可用性、节点故障或版本升级问题。LKE 是一项通过 CNCF 认证、可用于生产环境的 Kubernetes 服务,运行于 Akamai Cloud。它在单个集群中提供 GPU 节点池以及预集成的开源 AI 技术栈。

专为需要可移植性和控制力的开发者打造

包含托管式控制平面

免去控制平面运维。可通过经过 CNCF 认证的托管式控制平面进行快速部署,而不会产生任何额外费用。

以透明的定价模式实现灵活扩展

清楚了解您的费用构成。全托管控制平面、透明的节点与存储定价,以及低至 0.005 美元/GB 的出站流量费用。

基于开放标准,沿用您现有的工具

借助 Akamai Cloud API、命令行工具(CLI)以及 Terraform Provider,轻松实现自动化,无缝融入您的 CI/CD 工作流。

默认支持自我修复

可配置的 Pod 支持自动恢复,节点故障后可在数秒内完成重新调度。

工作原理

为您的团队选择合适的托管 Kubernetes 服务级别

LKE:从简单开始LKE-Enterprise:从容地扩大规模
免费控制平面(高可用 HA 选项仅需 60 美元/集群)专属高可用控制平面,每月固定费用 300 美元
多达 250 个节点多达 500 个节点
Calico CNICilium CNI(性能更出色)
标准 NodeBalancers(负载均衡器)高级 NodeBalancers、VPC 隔离及增强的安全性
使用 Akamai 持续扩容的 GPU 节点集群提供相同的 GPU 节点池,并支持扩展至最多 5,000 个 GPU 的集群

一个集群,五层架构

基于 Akamai 全球网络构建,提供 CDN 交付、边缘安全以及 0.005 美元/GB 的数据出口费用。添加 GPU 和 CPU 计算资源,以及 Block Storage 和 Object Storage。在上层运行 LKE 或 LKE Enterprise,然后使用 App Platform 构建 AI 技术栈,最后运行您的工作负载。

描述 Akamai 架构的示意图,详细展示 AI 工作负载、适用于 LKE 的 App Platform、计算资源和全球网络组件。
AI 工作负载

LKE 上的 AI 工作负载

在与其他应用相同的托管 Kubernetes 平台上运行推理、RAG 流程、微调和 AI Agent

GPU 计算

采用 NVIDIA RTX PRO™ 6000 Blackwell Server Edition® 和 RTX 4000 Ada GPU 的节点,每个节点最多支持 8 个 GPU,并配备专用 vCPU 核心。

预先集成的 AI 堆栈

LKE 的 App Platform 预置 KServe、Kubeflow Pipelines、Istio、Knative 和 Open WebUI,这些组件经过统一测试和版本匹配。

参考架构

提供 LLM 推理、RAG 流程和 GPU 微调的指南,让您可以从已验证可运行的部署开始。

无缝迁移、预集成工具、零摩擦

平台工具已预先集成

一键将 App Platform 添加到任何 LKE 集群,即可使用已预先集成的 Argo CD、Harbor、CloudNative-pg、Prometheus、Grafana、Loki、Sealed Secrets、cert-manager 和 Istio。这些软件包均通过 CNCF 认证或采用开源方案,从而减少复杂迁移项目的需求。

从 EKS、GKE 或 AKS 迁移

带上您现有的清单、Helm Chart 和 CI/CD 流水线。LKE 已通过 CNCF 认证并兼容上游 Kubernetes,因此迁移只需重新部署,无需重新构建。从 GKE 迁移指南开始,或与解决方案架构师讨论您的集群。

赋能工程师,加速开发者效率

面向平台工程师的 LKE

利用标签、污点、RBAC 和版本策略来实施防护措施进行治理,以实现集群标准化。通过 API、CLI 和 Terraform 集成实现自动化,支持集群群组管理和 GitOps。通过选择您的首选 CNI 来保持灵活性。

面向开发人员的 LKE

支持将您现有的技术栈与 Helm、Operators 及更广泛的 CNCF 生态系统相结合。LKE 负责管理控制平面的运维、维护和恢复,让您能够专注于代码本身,从而加快功能交付速度。

功能

LKE 托管型 Kubernetes 核心功能特性

借助内置安全性、自动化扩缩容以及跨分布式云环境的高可用性,简化 Kubernetes 运维管理;同时具备出色的灵活性,全面支持 AI 与推理工作负载。

快速部署集群

只需数分钟即可部署一个生产级的 Kubernetes 集群。无需复杂设置,无需管理控制平面,也无需编写 YAML。

保持工作负载的开放性与可携带性

经过 CNCF 认证,并与上游兼容。您的清单、Helm 图表和工具都可以直接使用:无锁定,无意外。

为高性能和 AI 推理扩展规模

节节点池、自动扩展,以及配备 NVIDIA RTX PRO™ 6000 Blackwell GPU 的节点,每个节点最多支持 8 个 GPU,并配备专用 vCPU。

特性

  • 使用 Cloud Manager、CLI 或 API 在数分钟内即可启动生产级的集群
  • 一键添加 LKE 的 App Platform,获得预集成的 CNCF 技术栈:KServe,Kubeflow,Istio,Knative
  • 通过自动化、零停机的版本更新,确保集群始终与最新的 Kubernetes 版本保持同步
  • 系统会根据工作负载的变化自动增加或移除节点,同时为每个节点池提供了内置的数据加密功能
  • 以每 GB 0.005 美元的出口流量费用传输数据,并可在同一平台上使用 Akamai CDN。
  • 从开发/测试到生产级、多团队及 AI 工作负载,全面满足各种场景需求
  • 您可以在需要时增加 NodeBalancers,也可以进行升级以获得高级路由和更高的吞吐量
  • 在 LKE Enterprise 上实现 VPC 隔离和增强型网络安全,满足合规性和多租户需求
  • 选择您的 CNI:LKE 使用 Calico,简化网络管理;LKE Enterprise 使用 Cilium,提升性能和可观测性

使用通过 CNCF 认证的 Kubernetes,避免供应商锁定

我们通过了 CNCF 的 Certified Kubernetes Conformance Program 认证。这意味着您的 LKE 工作负载符合可移植性标准,并且您将始终可以访问最新的更新和功能。

客户案例

Deepsolver

Deepsolver 统一全球 AI 推理

AI 扑克求解器提供商统一全球基础设施,同时提升延迟、可扩展性和成本的可预测性

Eyevinn 彻底革新开源部署

该咨询公司借助 Akamai Cloud 为其创新型开源平台和可持续的收入共享模式提供支持。

MTI 简化了云端运营

借助 Akamai 云计算服务,不仅优化了 IT 基础架构,而且削减了成本。

SharePlay

SharePlay 优化游戏体验

通过从 AWS 迁移到 Akamai,某直播平台不仅获得高性能低延时,还降低了成本。

常见问题

常见问题

LKE 提供共享控制平面集群,适用于中小规模的工作负载。LKE-E 为生产工作负载提供专用的高可用(HA)控制平面、私有网络和 SLA 保障的可靠性。

Kubernetes 版本:请参阅最新的可用版本
API:完全兼容 Kubernetes API
区域:可用性
计算:Shared、Dedicated、High Memory、GPU
存储:通过 Block Storage 提供持久卷
网络:40 Gbps 入站带宽,免费入站传输

是的。您可以使用相同的 Kubernetes 版本和清单来迁移现有集群。

LKE Enterprise 为控制平面和工作节点提供 99.9% 的 SLA。LKE 提供尽力而为的正常运行时间,并提供标准的 Akamai 服务支持。

是的。您的费用仅限于您实际部署的资源(节点、存储、负载均衡器)。但如果您选择了 HA 控制平面,则会产生相关的费用。

LKE 使用 Calico 实现 Pod 网络。LKE Enterprise 使用 Cilium,提供基于 eBPF 的高性能和可观测性,并支持 VPC 隔离。网络策略在两个层级中均可使用。

LKE 与 LKE Enterprise 紧跟 Kubernetes 上游社区演进,但采用独立的发布计划,因此各层级所支持的版本可能有所不同。请参阅文档获取最新列表。两种层级均包含自动化、微停机的平滑升级服务。

GPU 节点池采用 NVIDIA RTX PRO™ 6000 Blackwell Server Edition® 与 RTX 4000 Ada,单节点最高支持 8 块 GPU 并配备专属 vCPU 内核。LKE 的 App Platform 增添了预集成的开源 AI 技术栈,官方已发布的指南涵盖 LLM 推理、RAG 管道以及模型微调。

是的。LKE 支持具备可扩展性的 AI 推理工作负载。它具备原生 GPU 支持、GPU 感知型自动扩缩容,以及企业级网络和存储能力。由于 LKE 符合 CNCF AI Conformant 标准,工作负载无需承担超大规模云服务提供商带来的复杂性和成本,即可满足业界认可的标准。

CNCF 认证意味着您的 Kubernetes 环境符合严格且与供应商无关的可靠性、兼容性和互操作性标准。实际上,这意味着无论您是在 LKE 上运行,还是在云原生生态系统中的其他平台上运行,您的工作负载、工具和 API 都能保持一致的运行方式。对于 AI 团队而言,CNCF AI Conformance 意味着 LKE 已针对现代 AI 部署所需的工作负载模式和基础设施要求进行验证。您可以获得经过验证的标准所带来的信心,同时避免供应商锁定。

探索在 Kubernetes 上部署 AI 的相关资源

了解您是否可以申请高达 5,000 美元的云服务抵扣额度

了解您是否可以申请高达 5,000 美元的云服务抵扣额度

我们将随时为您提供大规模部署、迁移、应用程序优化、架构评估、安全和可靠性审计等方面的帮助。如需获取支持或者遇到了帐户相关问题,请访问我们的支持页面。