每个数据分片默认保留三个副本,分布在不同的物理节点甚至不同的可用区。写入数据时采用同步或半同步复制策略,等待多数副本确认持久化后才返回成功。即使某个节点突然宕机,剩余副本仍拥有完整数据,可无缝接管服务。
通过心跳监测、日志监控等方式实时追踪节点健康状态。一旦检测到主节点故障,分布式共识协议立即启动选主流程,在数秒内选举出新主节点并完成流量切换。整个切换过程对应用透明,连接池中的会话自动重试后路由到新主节点。
支持跨可用区(AZ)部署,将主实例和灾备实例部署在不同的物理机房。当某个可用区发生电力中断、网络故障等区域性问题时,其他可用区的节点可快速接管业务,确保业务不中断。部分方案支持同城双活架构,实现 RPO=0 及接近零的 RTO。
云原生数据库具备自动修复能力。当副本因磁盘损坏等原因出现数据不一致时,系统自动从健康副本同步数据完成修复。计算节点若因资源耗尽崩溃,编排平台会自动拉起新实例,无需人工干预。