一、异地容灾主要备份三种数据: 1、DB数据 2、操作系统 3、日志信息 二、恢复时间不能超过30分钟 三、图中为DB的备份方式,DB总的有四份备份:生产存储一份、移动硬盘一份、备份存储一份、灾备存储一份...备份方式为,平时通过生产系统的介质服务器传输到移动硬盘,通过CS传输数据到灾备中心的介质服务器,在通过介质服务器传输到备份存储、灾备存储。...生产中心发生异常时的DB切换方式为,将移动硬盘迅速转移挂载到灾备中心的介质服务器,然后再发起恢复 四、日常对OS进行每日备份,通过CS传输到灾备中心的介质服务器,再发送给备份存储和灾备存储,即OS的备份有三份...:生产存储、备份存储、灾备存储 五、日志的备份和OS一样 六、恢复切换步骤:日志恢复、OS恢复、修改IP和主机名、移动硬盘转移挂载 七、本地恢复 image.png 八、两地传输带宽的计算要考虑每日数据增量
同城双活和异地双活在数据同步技术上的区别,主要源于距离带来的网络延迟,这直接影响了数据一致性、可用性和架构设计的复杂度。...异地双活的数据同步 异地双活的数据中心距离通常超过百公里,网络延迟显著增加且稳定性挑战更大。因此,强一致性难以实现,普遍采用最终一致性(Eventual Consistency) 模型。...单元化(Sharding) 是异地双活(及多活)架构中的重要设计。...共享存储或数据库主从模式 单元化架构(按用户/业务分片) 成本 专线成本较高,但存储配置可能更简单 异步复制带宽成本相对较低,但架构复杂度和改造成本高 主要优势 高可用、数据零丢失(RPO=0)、故障切换迅速 城市级容灾...若能接受短暂数据不一致(如社交feed、商品库存),异地双活可行。 2、容灾等级要求:同城双活可应对机房级故障。若需防范城市级灾难(如地震、大规模停电),则需异地双活。
异地数据冷备方案2.1 API实现方案数据备份:云平台的数据库数据备份均为同地域,因此需要将该备份数据上传到异地COS存储桶。...2)通过url将备份下载到本地 3)调用cos上传api,将本地的备份文件上传到异地cos桶 4)按照备份业务规则,周期性的执行上面1-3步骤,将备份存储到异地COS存储桶。...目前云函数支持备份产品如下:图片跨地域复制:目前云函数只支持同地域备份,即备份数据库和cos需要同地域,因此通过存储桶的跨地域复制能力,将对应的备份文件复制到异地的存储桶。...2.3 数据库备份服务数据库备份服务拥有一套完整的数据备份和数据恢复解决方案,具备实时增量备份以及快速的数据恢复能力,同时具备异地容灾能力。...异地数据冷备案例3.1 异地冷备方案以某在线商城为例,涉及数据产品为mysql,reids以及cos,结合云平台的能力,具体方案架构如下:图片方案要点说明:数据备份:基于数据恢复的rto时长,mysql
今天跟大家分享的题目为《CKV+异地容灾探索和实践》。CKV+是一个兼容redis协议的内存数据库,现在大部分用户对内存数据库的要求越来越高,对一致性、异地容灾等方面也提出更高的要求。...04CKV+单活多可用区异地容灾实践 CKV+为了满足不同的容灾要求,已上线了单活多可用区特性,支持不同容灾级别: 单可用区:机架级容灾能力。 同地域多可用区:机架、可用区级容灾能力。...跨地域多可用区:跨城际容灾。 默认的情况下,CKV+的容灾级别是跨机架容灾,保证主备分片必须跨机架,避免一个机架掉电导致主备分片都不可用的问题。...如果希望更高的容灾级别,可以选择同地域多可用区以及跨地域多可用区,当然这样可能导致的访问和主备延时会更大。在不同的级别上,容灾对于性能和成本其实是一个很微妙的关系。...05CKV+多活架构异地容灾探索 异地单活虽然提供了不同的容灾级别,甚至不同可用区提供了读能力,但只能在主可用区执行写操作。
如果线上可靠性工程出现问题,那么前期在应用产品设计、研发测试、发布变更等环节的所有投入都可能变得毫无意义。...与同城容灾不同,异地容灾会有一个选择过程:先判断同城资源,如果同城资源不够,再考虑区域间的容灾策略。...字节海外容灾 由于海外业务的特殊性,我们的容灾架构首先采用了异地模式,然后发展成为异地加同城的双重容灾模式。...因此,在海外,先同城后异地不一定是最佳默认策略,我们可以考虑利用海外的天然特点,例如时区来做容灾的第一判断依据,根据事故发生时的时区特点来决策,第一优先级是同城容灾,或者是异地切流,因为容量是我们容灾首要考虑的因素...在国内容灾和海外容灾方面,我们目前都在采用同城容灾加异地多活的模式,并且我们正在持续不断地完善整体的容灾能力建设。
先和备份分清边界异地容灾,是在距离生产中心数百公里外的另一地点建立灾备中心,本地遭遇区域性灾难时,关键业务能在备站快速恢复。三个关键词:距离远、异地备、能接管。为什么必须"异地"?...它对容灾体系建设提了明确要求,覆盖全国或较大区域的金融机构,宜选择异地容灾体系。再看容灾等级标准。...这个速度,靠的是自动切换加健康探测配合得好。数据库异地容灾做得好不好,就看切换那一刻业务能不能起来。七、异地容灾选型,四步决策框架被各种方案绕晕时,我习惯按四步走。...八、异地容灾避坑清单最后四条坑,都是我亲眼见过的。先看把同城当异地这个坑。有人把“异地容灾”建在同城另一个区,直线距离18公里。真来一场区域性灾难,两个一起挂。...异地容灾,不是备份,是灾难来临时业务能接管的能力。监管在收紧,标准在量化,异地容灾已经成了金融、政务、医疗的刚需。核心业务走数据库原生同步,异构多云用增量复制,同城保秒级,异地保兜底。
加州AI硬件抢劫案警示:中科热备异地容灾的真实距离 写这篇文章,是给那些正在纠结“要不要把容灾中心挪远一点”的运维负责人看的。...更麻烦的是,他们的灾备策略里根本没考虑过“硬件在途被劫”这个场景。备份数据在本地做得挺勤,但物理意义上的“异地副本”,他们一直觉得“等扩容完了再说”。 物理安全威胁跟黑客攻击不一样。...距离怎么定:100公里是底线,不是拍脑袋 说到异地容灾,第一个绕不开的问题就是:离多远算“异地”?我见过不少企业的“异地容灾”,实际上就是同城另一个区的机房,直线距离18公里。...这个阶段可以重点看一些成熟的异地容灾服务方案,比如hbucloud.com上对异地容灾的架构设计有比较完整的介绍,从网络规划到切换演练都有覆盖,选型时值得对照参考。...演练完必须做反向同步,把容灾端的数据拉回主中心,这个环节最容易暴露出配置问题。 最常见的错误:把同城多机房当异地容灾 最后说一个我反复跟客户强调的点:同城多机房不是异地容灾。
同时业务异地多活有一个前提,就是业务支持单元化部署,这里对存量有历史技术债业务也存在非常大的挑战。因此本篇幅讨论异地多活前提是,业务已经具备单元化部署的能力。...具体技术架构如下:图片在本方案中,不涉及备份技术方案,详情请参考之前容灾系列的备份方案。方案要点说明如下:1)业务调度:目前通过DNS统一调度,调度路线设置通过地区或者运营商为区分。...接入层CLB具备跨AZ主备能力;应用层采用多可用区部署建议采用容器运行时;数据层采用一端写就近读的跨AZ高可用实例。3)容灾成本:业务备份的资源成本,具体可参考之前容灾文章系列。...详细技术架构图如下:图片在本方案中,不涉及备份技术和AS弹性扩容的技术细节,详情请参考之前容灾系列的备份方案。方案要点说明如下:1)业务调度:同方案一保持一致。...详细技术架构如下:图片在本方案中,不涉及备份技术和AS弹性扩容的技术细节,详情请参考之前容灾系列的备份方案。
其中,本地的存储网络连接的主备高可用适用于近距离的容灾建设,受距离限制较大;异地远距离的主备高可用,则会存在极小的数据延时。...最为稳固的、保护等级最高,也是成本最高的容灾方案,即“两地三中心”:本地的生产中心和灾备中心相距100km以上,进行应用级或业务级容灾保护,且在 300km 以外的异地建立灾备中心,进行数据级或应用级容灾保护...2.1数据级容灾 数据级容灾是指通过建立异地灾备中心,做数据的远程备份,在灾难发生之后要确保原有的数据不会丢失或者遭到破坏,但在数据级容灾这个级别,发生灾难时应用是会中断的。...在数据级容灾方式下,所建立的异地灾备中心可以简单地把它理解成一个远程的数据备份中心。数据级容灾的恢复时间比较长,但是相比其他容灾级别来讲它的费用比较低,而且构建实施也相对简单。...应用级容灾生产中心和异地灾备中心之间的数据传输是采用异类的广域网传输方式;同时应用级容灾系统需要通过更多的软件来实现,可以使多种应用在灾难发生时可以进行快速切换,确保业务的连续性。
数据存储容灾建设主要从数据可靠性和业务稳定性两个维度阐述。这两者有哪些区别呢?...1.数据可靠性 1.1 云硬盘(CBS) 云硬盘采用三副本的分布式机制,系统确认数据在三个副本中都完成写入后才会返回写入成功的响应。...https://cloud.tencent.com/document/product/362/16312 2.将CBS数据上传异地COS,调用cos分块上传接口。...例如COS如果开启了异地复制,业务可以临时读异地存储桶,虽然存在访问延时,只是影响用户体验,不会造成业务持续不可用;如果是CBS通过挂载新盘通过快照恢复,或者通过使用大内存机器周期性将核心数据读到内存供业务临时访问等等...这里最常用的就是新增COS和CBS盘的方式让业务进行临时写入,待故障恢复后,补齐数据。
3台不停止服务的最低限度是2台(X/2+1),而5台的最低限度是3台。 我们应该保证,集群中最低有3台ZooKeeper是启动的。...此外,重启时应保证先重启myid最小的机器,由小向大进行重启 Leader无论其myid大小,都放到最后重启 因为ZooKeeper的机制中,myid大的会向小的发起连接,而小的不会向大的发起连接。.../conf/zoo.cfgMode: follower 将其扩容为5节点的ZooKeeper 先查看原先的ZooKeeper集群情况 echo mntr|nc localhost 2181 这条4字命令可以查看集群的情况...STOPPED 查看新Leader ZooKeeper会尽可能的选择myid最大的机器为Leader,因此原本的idc02-kafka-ds-04其myid为5变为了Leader 12345 [hadoop...然后只要将现在的5台再缩小到3台且不包括原本myid为1-2的机器,就完成了迁移 将5台缩小回3台 修改idc02-kafka-ds-02 根据前面的注意事项,我们此时5台集群中启动的数量不得少于3台,
在现代企业中,数据库技术面临着日益严峻的挑战,如数据一致性问题、性能瓶颈和灾难恢复能力不足等。数据同步以及异地容灾是确保数据可用性和连续性的重要手段。...YashanDB作为一款高可用的数据库系统,采用多种部署架构和存储管理优化策略,为数据同步与异地容灾提供了全面的解决方案。...本文旨在解析YashanDB在数据同步与异地容灾方面的技术原理、优势和最佳实践,帮助企业更好地理解并应用这些技术。1....异地容灾方案同样重要的是YashanDB的异地容灾机制,对于数据的安全性、可靠性至关重要。3.1 级联备份级联备份模式中,多个备库形成层级结构。...结论YashanDB通过高效的同步手段和异地容灾策略,为企业提供了强有力的数据保护和服务可用性保障。通过了解并应用上述核心技术和最佳实践,企业可以更好地应对数据安全和业务连续性挑战。
加州抢劫案:异地容灾距离延迟与3秒RPO的中科热备 最近美国加州的新闻有点魔幻。AI数据中心的硬件在运输途中被劫,不是偷几块显卡那么简单,是成批的服务器、存储节点直接在路上消失。...这篇文章写给那些需要重新审视灾备架构的人,我们来认真算一笔账:当物理安全威胁上升到抢劫、火灾、地震这个级别,你的异地容灾距离够不够,数据同步策略扛不扛得住。...异地容灾的距离,为什么100公里是条红线 等保2.0对异地容灾有明确要求,同城灾备中心与生产中心的直线距离不低于100公里,跨区域容灾则更远。这个距离不是拍脑袋定的。...后来他们把灾备中心迁到了宿迁,距离拉到280公里。这个案例让我深刻体会到,距离不是成本问题,是生死问题。 同步还是异步?150公里光纤上的技术账 异地容灾绕不开同步复制和异步复制的选择。...三年TCO对比:本地备份加异地异步,到底值不值 很多人觉得异地容灾贵,我们算一笔账。假设一家中型企业,核心业务数据量50TB,每天增量约200GB。
云容灾在云容灾出现之前,企业通常采用传统容灾方案,如自建异地灾备中心或租用灾备机房。...相比之下,云容灾基于云计算技术,充分利用云平台的弹性和智能化能力,提供了一种更灵活、高效的灾备解决方案:对比项传统容灾云容灾基础设施自建或租用物理灾备中心依赖云服务,无需额外硬件成本投入高昂的硬件、机房...:在云端部署异地灾备中心,利用云存储进行数据备份,并启用云计算资源进行业务恢复。...五、总结云容灾作为现代企业 IT 战略的重要组成部分,提供了更经济、高效和智能的灾备解决方案。...对于企业而言,合理规划云容灾方案,不仅是降低 IT 运营成本的有效手段,更是提升市场竞争力和业务稳定性的关键步骤。随着云计算技术的不断发展,云容灾将成为未来企业灾备体系的核心趋势。
IDC时代,业务对网络容灾参与较少,主要依赖数据中心网络容灾建设程度;当到了云的时代,云服务商将底层网络能力产品化后,云上客户更多参与网络容灾建设,提升业务稳定性。...以腾讯云为例,在同地域选择机房地址的时候,距离大于60公里,要求不同可用区延时小于3ms,来满足云上客户同城容灾建设基本需求。...2.网络容灾复杂度 同城或者异地容灾建设,网络层面因素主要有三个: 1)跨区或者跨地域网络延时,对上层业务影响。 网络延时,通过优化基础设施手段是非常有限的,毕竟受限于实际物理距离和光速。...混合云容灾模式,这里考虑到IDC和云上线路容灾情况,一般建议两条专线接入不同的POP点来进行容灾建设;同时建立VPN或者GRE公网逃生通道来紧急恢复业务。...注意:对于入口VIP写死情况,客户端升级的成本较高。 image.png 3.2 混合云网络容灾 混合云网络容灾分为两个部分: 1)idc和云机房之间线路容灾,主要线路分为专线和VPN。
序言 同城异地灾备,主要是用来进行备份容灾的,从而当一个数据中心挂了,另外一个数据中心经过切换之后,能让服务迅速的恢复。...从最开始,业务不断的发展,各种流量拥上来,导致业务的吞吐量的剧增,从而促使底层的技术要不断的进行扩展,从而云平台的版本是否支持,必须要进行升级。。。...随着业务的进一步发展,需要提供高可用水平,从而需要从单机房扩展为多机房,从而也就有了同城容灾。。。 对于运维来说,多一次升级,多一次变更,就会多一个故障,多一个锅。。。...热升级了解一下,不可预知的中断了解一下 同城异地最关键的点在于存储,存储如何跨机房使用,从而分为几个方面进行探讨: 1、 DNS解析 在业务大量使用DNS解耦的时候,而且使用双机房的时候...在DNS解析的时候修改的时候,一般是依赖于高可用的SLB服务,从而在切换的时候,一般是对DNS进行动态的修改。 ?
去年写过一篇《做容灾,冷备是不是个好方案?》,当时提出来,冷备或者主备,其实并不是一个理想的方案,而且绝大多数情况下,只能是一个心理安慰,真正发生故障的情况下,这样的容灾模式根本起不到作用。...最近,公有云又出了些大故障,各大群和朋友圈又开始沸沸扬扬,但是整体看下来,声音无非两种: 单站点不靠谱,要有容灾,出现这种情况就得马上切,所以回去赶紧建设容灾站点; 鸡蛋不能放在一个篮子里,单云不靠谱,...既然要双活,必然会选择另一个跟当前机房有一定距离的机房(同城或异地),而且距离必须得拉开才有意义,如果都在一个园区里面,就没有任何容灾意义了。...我们可以得出的几个结论: 不管怎么选择容灾方案,我们自己的业务系统,从自身架构上,一定要支持单元化,一定要支持数据同步才行,如果这都不支持,讲双活和多活,就是特么的扯淡。...一个合理的建设节奏应该是,同城双活—异地双活—两地三中心(同城双活+异地多活),因为你要解决的问题的复杂度和难度也是在逐步上升的,不可能一蹴而就。
中科热备异地容灾切换实战手册 这篇文章写给谁看?写给那些负责核心业务系统、却被领导问过“如果机房断电了怎么办”的运维兄弟。也写给正在做年度容灾规划、却对切换时间心里没底的架构师。...先给个定义:异地容灾切换,就是当生产数据中心整体不可用时,把业务流量、存储、数据库在另一个物理位置重新拉起来的过程。...如果你依赖生产中心的监控告警,那大概率是收不到的。真正能发出告警的,是异地部署的探针或者第三方监控节点。...异地容灾切换SOP:把每一步都写成命令 下面这套SOP是我们给一个中等规模互联网公司做的,他们核心系统日请求量大约3000万,生产在苏州,灾备在南京,两地直线距离约220公里。...演练不是走过场,是发现问题的唯一方式 说一个数据:我们服务过的客户里,做过完整灾备演练的不到20%。很多公司买了灾备设备,配了复制链路,一年到头没切过一次。
在数字化转型的热潮中,业务数据无疑是企业的生命线。无论业务部署在IDC还是云平台,对数据备份都是有强烈诉求。随着共享经济的不断深化,越来越多企业将自身业务逐渐的搬迁到了云上。...为了让企业能更好用好云平台的数据安全能力,本文重点云平台数据备份冷备能力,以腾讯云为例,主要从以下两个维度介绍:同城数据冷备能解决企业什么问题,达到怎么样业务容灾效果?...同城冷备份方案同城数据冷备方案主要依赖于云平台能力备份能力,对现有业务架构没有任何改造,方案架构如下:图片该方案核心要点说明:数据备份:云侧数据库mysql和redis在控制台设置数据备份参数,数据备份存储在COS,具备地域级别容灾...本文小结同城冷备方案,在云平台的协助下,企业几乎0成本并拥有同城数据冷备能力来保障业务生命线。指标详细说明容灾能力具备同地域(不同可用区)数据备份能力,不具备不同地域的能力。...3.容灾演练能力建设,增加平时运维成本以及自动化工具开发功能。
备份(Backup)本质定义:在线数据→离线存储的迁移过程核心价值恢复逻辑错误(误删/病毒)保存历史数据版本不可替代性:容灾系统无法修复人为错误4....灾难恢复(Disaster Recovery)阶段定位:灾难发生后的系统重建与容灾关系:现代容灾系统集成恢复功能二、容灾与备份的协同关系1. 功能互补性2....典型建设路径初级阶段:本地备份+双机热备(中科热备HA方案)进阶阶段:同城双活+异地备份成熟阶段:多云容灾+区块链存证四、灾备技术体系详解1....:微隔离技术增强容灾环境安全性结语构建企业级灾备体系需遵循"预防-响应-恢复"的完整闭环,中科热备作为国产化灾备技术领军者,通过持续创新在金融、医疗、政务等领域成功部署超过2000个案例。...建议企业根据业务特性选择"备份+容灾+恢复"的三维防护策略,定期开展灾备演练,真正实现业务连续性保障。