在云原生时代,Kubernetes已成为容器编排的事实标准。对于生产环境,集群的高可用性(HA)是刚性需求——控制平面必须容忍节点故障,确保API服务连续性。本文不空谈理论,而是基于腾讯云CVM与CLB(云负载均衡器),使用kubeadm工具从零部署一套符合生产级标准的Kubernetes高可用集群。全文包含完整命令、配置文件、验证步骤及故障注入测试,技术深度直面一线运维场景。
堆叠etcd:etcd与控制平面组件(apiserver、controller-manager、scheduler)共宿主机,部署简单,但控制平面节点故障时etcd成员同时丢失,需至少3台控制平面节点。外部etcd:etcd独立集群,控制平面节点可水平扩展,资源隔离更佳,但运维复杂度高。
本文选用堆叠etcd 3个控制平面节点,兼顾可靠性与部署效率。控制平面通过腾讯云CLB实现四层(TCP)负载均衡,对外暴露一个VIP:6443,所有kubelet和kubectl均通过该VIP访问API Server。