高可用性配置全解析
1. 高可用性概述
高可用性旨在通过避免计划外停机,为服务提供最大的正常运行时间。灾难恢复(DR)虽常与高可用性讨论相关,但它涵盖了灾难发生后用于恢复的业务和技术流程。
定义高可用性计划通常始于服务级别协议(SLA)。SLA 定义了应用程序或服务的可用性和性能必须满足的服务和指标。例如,Microsoft Exchange 服务器的 SLA 可能规定邮箱每月需向最终用户开放的时间,或定义电子邮件消息传递所需的时间等性能指标。
确定 SLA 时,还需考虑恢复点目标(RPO)和恢复时间目标(RTO):
- RTO :应用程序在必须恢复服务以满足 SLA 之前不可用的时长。例如,单个组件故障的 RTO 可能小于五分钟,而整个站点故障的 RTO 可能为三小时。
- RPO :故障发生时必须恢复的数据量。例如,单个服务器或组件故障时,RPO 为 0;而站点故障时,RPO 可能允许最多 20 分钟的数据丢失。
SLA 通常以应用程序可用时间的百分比表示,这些百分比也常以“几个 9”来提及,如下表所示:
| 可用性评级 | 每年允许的计划外停机时间 |
| ---- | ---- |
| 99(两个 9)% | 3.65 天 |
| 99.9(三个 9)% | 8.76 小时 |
| 99.99(四个 9)% | 52.56 分钟 |
| 99.999(五个 9)% | 5.26 分钟 |
| 99.9999(六个 9)% | 31.5 秒 |
| 99.99999(七个 9)%
超级会员免费看
订阅专栏 解锁全文

66

被折叠的 条评论
为什么被折叠?



