运维复盘—高可用K8S VIP 原理
发布时间
阅读量:
阅读量
在项目开发与运维阶段,我们持续监控环境运行状况,发现K8S集群的各类指令均存在异常情况,经排查确认问题根源在于授权许可方面。在明确问题本质后,及时采取措施予以处理。
对于项目运维或开发工作而言,定期检查环境运行状态具有至关重要的意义 ,因此应当做到及时发现问题、迅速定位原因并尽快解决。本次对环境状况的深入分析过程已形成详细记录,并整理成文档形式,为今后相关工作的开展提供参考与积累。
事件经过概述
在应用UMC产品过程中,发现大量集群相关数据出现丢失现象,导致产品部署受阻且无法查阅日志信息。尽管该问题定位难度较大,但经过多环节排查与处理,最终成功攻克了这一难题。
1.情况反馈机制构建
在应用UMC产品过程中,开发人员反映其平台上所有与集群相关的数据已完全丢失,同时针对容器的创建、删除及更新等操作均无法响应。由于当前所处环境为开发环境,因此该问题具有高度紧迫性,亟需尽快处理和解决。
1.2问题定位
由于产品无法正常启动,所有点击操作均无响应,因此首次我推测可能是授权相关的问题。毕竟产品仍然在集群环境中运行,只是无法获取相关信息,而该集群此前已执行过K8S集群有效期延长的操作,我也怀疑此次延长操作可能未完全覆盖所有节点。
通过输入相关命令检查授权文件的日志信息,确认其尚未过期。因此,我在此处 _**对K8S集群及docker镜像库进行了
全部评论 (0)
还没有任何评论哟~
