虚拟机日常维护手册1目的 为提高处理虚拟化服务器故障的能力,形成科学、有效、反应迅速的日常管理流程和应急处理机制,确保虚拟化平台的安全和稳定运行,最大限度地减小服务器故障对生产的影响,降低业务中断风险,特制定本手册。2故障处理规范2.1硬件维护平台服务器出现硬件告警需要停机维护,服务器责任人应立即通知相关人员,将业务虚机迁移到集群中其他服务器主机上,再将故障服务器切换至维护模式并从HA集群中移除,负责陪同硬件厂家现场更换至成功恢复。 2.2虚拟化平台故障 发生平台故障后,相关人员应及时查找、确定故障原因,进行先期处置。若故障在短时间内无法修复,相关人员应将业务迁移到备用平台环境中,保持业务系统的正常运行;将故障服务器脱离网络,进行故障排除工作,并及时联系相关人员或厂商协助解决。2.3虚拟机软件系统故障 (1)日常做好虚拟机的定时备份和快照,系统崩溃后,应能够及时恢复虚拟机。(2)发生虚拟机系统故障后,相关人员应及时通知业务人员检查出现故障的原因并尽快排除。(3)如遇虚拟机系统需要启用备份系统进行恢复时,应在恢复后和业务管理员仔细检查业务