一、异地容灾主要备份三种数据: 1、DB数据 2、操作系统 3、日志信息 二、恢复时间不能超过30分钟 三、图中为DB的备份方式,DB总的有四份备份:生产存储一份、移动硬盘一份、备份存储一份、灾备存储一份...备份方式为,平时通过生产系统的介质服务器传输到移动硬盘,通过CS传输数据到灾备中心的介质服务器,在通过介质服务器传输到备份存储、灾备存储。...生产中心发生异常时的DB切换方式为,将移动硬盘迅速转移挂载到灾备中心的介质服务器,然后再发起恢复 四、日常对OS进行每日备份,通过CS传输到灾备中心的介质服务器,再发送给备份存储和灾备存储,即OS的备份有三份...:生产存储、备份存储、灾备存储 五、日志的备份和OS一样 六、恢复切换步骤:日志恢复、OS恢复、修改IP和主机名、移动硬盘转移挂载 七、本地恢复 image.png 八、两地传输带宽的计算要考虑每日数据增量
即使云平台在建设数据中心之前,会遵循机房建设标准来选址,但是对于极端情况自然灾害,例如地震,台风等等,对同地域备份安全能力有非常大的风险,因此本文重点阐述腾讯云对异地数据冷备解决方案。1....异地数据备份挑战相对同城数据备份,异地数据冷备主要挑战是成本,主要是跨地域之数据传输带宽成本。...异地数据冷备方案2.1 API实现方案数据备份:云平台的数据库数据备份均为同地域,因此需要将该备份数据上传到异地COS存储桶。...2)通过url将备份下载到本地 3)调用cos上传api,将本地的备份文件上传到异地cos桶 4)按照备份业务规则,周期性的执行上面1-3步骤,将备份存储到异地COS存储桶。...2.3 数据库备份服务数据库备份服务拥有一套完整的数据备份和数据恢复解决方案,具备实时增量备份以及快速的数据恢复能力,同时具备异地容灾能力。
脑裂(Split-brain) 是需要注意的风险,即两个中心在网络隔离时都认为自己是主中心,通常需要通过仲裁机制(Tie-Breaker)来避免。...异地双活的数据同步 异地双活的数据中心距离通常超过百公里,网络延迟显著增加且稳定性挑战更大。因此,强一致性难以实现,普遍采用最终一致性(Eventual Consistency) 模型。...异步复制是主流方式,应用在本地中心写入数据后即可得到确认,数据随后异步地、批量地同步到异地中心。这牺牲了数据的实时一致性,但保证了写入性能和可用性。...共享存储或数据库主从模式 单元化架构(按用户/业务分片) 成本 专线成本较高,但存储配置可能更简单 异步复制带宽成本相对较低,但架构复杂度和改造成本高 主要优势 高可用、数据零丢失(RPO=0)、故障切换迅速 城市级容灾...若能接受短暂数据不一致(如社交feed、商品库存),异地双活可行。 2、容灾等级要求:同城双活可应对机房级故障。若需防范城市级灾难(如地震、大规模停电),则需异地双活。
今天跟大家分享的题目为《CKV+异地容灾探索和实践》。CKV+是一个兼容redis协议的内存数据库,现在大部分用户对内存数据库的要求越来越高,对一致性、异地容灾等方面也提出更高的要求。...对于城市级的故障,印象比较深的是,在2015年,天津机房附近的天津滨海新区危险品仓库发生大爆炸,导致天津数据中心岌岌可及,大量业务需要做迁移。...04CKV+单活多可用区异地容灾实践 CKV+为了满足不同的容灾要求,已上线了单活多可用区特性,支持不同容灾级别: 单可用区:机架级容灾能力。 同地域多可用区:机架、可用区级容灾能力。...跨地域多可用区:跨城际容灾。 默认的情况下,CKV+的容灾级别是跨机架容灾,保证主备分片必须跨机架,避免一个机架掉电导致主备分片都不可用的问题。...05CKV+多活架构异地容灾探索 异地单活虽然提供了不同的容灾级别,甚至不同可用区提供了读能力,但只能在主可用区执行写操作。
数据中心断电后业务多久恢复?中科热备异地容灾切换实战手册 这篇文章写给谁看?写给那些负责核心业务系统、却被领导问过“如果机房断电了怎么办”的运维兄弟。...也写给正在做年度容灾规划、却对切换时间心里没底的架构师。我们不讲虚的,直接拆开断电之后每一秒都发生了什么,以及怎么把恢复时间从小时级压到分钟级。...先给个定义:异地容灾切换,就是当生产数据中心整体不可用时,把业务流量、存储、数据库在另一个物理位置重新拉起来的过程。...如果你依赖生产中心的监控告警,那大概率是收不到的。真正能发出告警的,是异地部署的探针或者第三方监控节点。...异地容灾切换SOP:把每一步都写成命令 下面这套SOP是我们给一个中等规模互联网公司做的,他们核心系统日请求量大约3000万,生产在苏州,灾备在南京,两地直线距离约220公里。
数据中心断电频发,热备云异地容灾切换速度能有多快? 这篇文章写给正在管数据中心或核心业务系统的你。不管你是甲方运维、架构师,还是灾备负责人,我们都绕不开一个问题:机房断电那一刻,业务到底还能不能活?...今天不聊虚的,我们把数据中心供电风险、断电场景、异地容灾切换速度这些事掰开揉碎讲清楚。 科技巨头自建天然气电厂,美国电力碳排放要涨20% IT之家前阵子有条报道挺有意思。...断电后的灾备策略:异地容灾距离、UPS+柴发+热备云的组合 先说结论:无论你本地供电做得多么冗余,异地容灾节点都是业务连续性的最后一道防线。...UPS解决的是秒级到分钟级的电力切换,柴油发电机解决的是小时级的持续供电,而异地容灾解决的是“整个机房没了”的场景。这三个东西解决的是完全不同维度的问题,谁也不能替代谁。 异地容灾的距离有讲究。...异地容灾的切换时间,如果方案设计得当,可以控制在秒级到分钟级。我们在一个证券客户那里做过实测,生产中心模拟断电,异地灾备节点通过DNS切换把业务流量引过去,DNS切换耗时8到18秒。
在海外,我们首先采取了跨区域的异地多活模式,随后根据区域化业务发展的需要,进一步调整为异地多活和同城容灾的结合模式。...与同城容灾不同,异地容灾会有一个选择过程:先判断同城资源,如果同城资源不够,再考虑区域间的容灾策略。...字节海外容灾 由于海外业务的特殊性,我们的容灾架构首先采用了异地模式,然后发展成为异地加同城的双重容灾模式。...因此,在海外,先同城后异地不一定是最佳默认策略,我们可以考虑利用海外的天然特点,例如时区来做容灾的第一判断依据,根据事故发生时的时区特点来决策,第一优先级是同城容灾,或者是异地切流,因为容量是我们容灾首要考虑的因素...在国内容灾和海外容灾方面,我们目前都在采用同城容灾加异地多活的模式,并且我们正在持续不断地完善整体的容灾能力建设。
当前,市场上常见的容灾模式可分为同城容灾、异地容灾、双活数据中心、两地三中心几种。...同城容灾 同城容灾是在同城或相近区域内(≤200KM)建立两个数据中心:一个为数据中心,负责日常生产运行;另一个为灾难备份中心,负责在灾难发生后的应用系统运行。...异地容灾 异地容灾主备中心之间的距离较远(>200KM)因此一般采用异步镜像,会有少量的数据丢失。异地灾难备份不仅可以防范火灾、建筑物破坏等可能遇到的风险隐患,还能够防范战争、地震、水灾等风险。...两地三中心 结合近年国内出现的大范围自然灾害,以同城双中心加异地灾备中心的“两地三中心”的灾备模式也随之出现,这一方案兼具高可用性和灾难备份的能力。...异地灾备中心是指在异地的城市建立一个备份的灾备中心,用于双中心的数据备份,当双中心出现自然灾害等原因而发生故障时,异地灾备中心可以用备份数据进行业务的恢复。
一、异地容灾是什么?先和备份分清边界异地容灾,是在距离生产中心数百公里外的另一地点建立灾备中心,本地遭遇区域性灾难时,关键业务能在备站快速恢复。三个关键词:距离远、异地备、能接管。为什么必须"异地"?...二、政策在逼你认真做异地容灾容灾不是可选项了。监管在逐年收紧。2024年7月,中国人民银行发布《金融数据中心容灾建设指引》,标准号JR/T0264-2024,当天实施。...有个现成样本,深圳建成"两地三中心"容灾体系,500米同城双活加50公里异地备份,系统可用性做到99.99%,恢复时间缩到10分钟以内。政策要求加上标准量化,异地容灾从"锦上添花"变成了"合规刚需"。...六、案例复盘:银行怎么做异地容灾讲个真实案例。西部某省级银行的国际结算系统,属于典型核心业务,容灾要求很高。他们做了同城双中心,8个节点,同城走全同步复制。...金仓公布过一组实测数据:模拟主数据中心完全断网,中心内切换RTO不到8秒;异地场景10分钟以内;特定配置下RPO=0。银行的容灾切换有完整流程。
具体技术架构如下:图片在本方案中,不涉及备份技术方案,详情请参考之前容灾系列的备份方案。方案要点说明如下:1)业务调度:目前通过DNS统一调度,调度路线设置通过地区或者运营商为区分。...3)容灾成本:业务备份的资源成本,具体可参考之前容灾文章系列。4)业务恢复:可用区粒度的极端故障,基于云平台同城双活架构可实现RTO秒级切换恢复业务。...详细技术架构图如下:图片在本方案中,不涉及备份技术和AS弹性扩容的技术细节,详情请参考之前容灾系列的备份方案。方案要点说明如下:1)业务调度:同方案一保持一致。...详细技术架构如下:图片在本方案中,不涉及备份技术和AS弹性扩容的技术细节,详情请参考之前容灾系列的备份方案。...方案要点说明如下:1)业务调度:于方案二保持一致1)业务部署:相对于方案二,增加了数据双向同步,各个地域中心均具有全局数据能力,提升容灾的RTO指标,同时不同业务数据要有唯一主键来保证数据一致性。
,同城的两中心,异地的一中心,或者扩展到三地五中心模式。...对于有些用户来说,从投资成本、业务的重要性、客户网络的物理条件来说,没有办法去构成同城多中心加异地的的容灾架构,他可能只能选择两中心的方案,那么在这个过程当中的话,TiDB 经过这几年对这个方面的积累,...:TiDB 多中心多活容灾方案 在多中心里面,前面提到,我们通过 Multi Raft 的机制,以及相关的工程优化,实现了跨中心的容灾方案。...比如说,对于长距离的异地中心,我们在同城设了两个中心,通过光纤连接,异地的话,通常租用比如运营商的 MSTP 类型的线路,构成一个三中心的结构,通过 TiDB 内置的容灾和灾备的相关的一系列的机制与手段...:TiDB 两中心容灾方案 前面也提到,有些用户的网络,比如说一个中心在上海,一个在北京,延迟是非常大。
在至少有一个Leader存在的前提下,进行Zookeeper的在线增量、在线减量、在线迁移 在全过程中ZooKeeper不停止服务
数据存储容灾建设主要从数据可靠性和业务稳定性两个维度阐述。这两者有哪些区别呢?...1.2 对象存储(COS) COS将数据分散存储在城市中多个不同的数据中心,其中某数据中心故障了,多AZ存储架构依然可以为云上客户提供稳定可靠的数据服务,云上数据可靠性是12个9,即99.9999999999%...https://cloud.tencent.com/document/product/362/16312 2.将CBS数据上传异地COS,调用cos分块上传接口。...例如COS如果开启了异地复制,业务可以临时读异地存储桶,虽然存在访问延时,只是影响用户体验,不会造成业务持续不可用;如果是CBS通过挂载新盘通过快照恢复,或者通过使用大内存机器周期性将核心数据读到内存供业务临时访问等等
容灾的分类 从其对系统的保护程度来分,可以将容灾系统分为:数据容灾和应用容灾,数据容灾就是指建立一个异地的数据系统,该系统是本地关键应用数据的一个实时复制。...备份采用备份软件技术实现,而容灾通过复制或镜像软件实现,两者的根本区别在于: 容灾主要针对火灾、地震等重大自然灾害,因此备份中心与主中心间必须保证一定的安全距离;数据备份在同一数据中心进行。...容灾的分类 1、数据级 数据级容灾是最基础的手段,指通过建立异地容灾中心,做数据的远程备份,在灾难发生之后要确保原有的数据不会丢失或者遭到破坏,但在数据级容灾这个级别,发生灾难时应用是会中断的。...数据容灾是指建立一个异地的数据系统,该系统是对本地系统关键应用数据实时复制。 当出现灾难时,可由异地系统迅速接替本地系统而保证业务的连续性。...第0级:没有备援中心 这一级容灾备份,实际上没有灾难恢复能力,它只在本地进行数据备份,并且被备份的数据只在本地保存,没有送往异地。
数据同步以及异地容灾是确保数据可用性和连续性的重要手段。YashanDB作为一款高可用的数据库系统,采用多种部署架构和存储管理优化策略,为数据同步与异地容灾提供了全面的解决方案。...本文旨在解析YashanDB在数据同步与异地容灾方面的技术原理、优势和最佳实践,帮助企业更好地理解并应用这些技术。1....异地容灾方案同样重要的是YashanDB的异地容灾机制,对于数据的安全性、可靠性至关重要。3.1 级联备份级联备份模式中,多个备库形成层级结构。...技术建议与最佳实践对于企业使用YashanDB处理数据同步与异地容灾,以下技术建议和最佳实践值得考虑:选择合适的部署架构,确保根据业务需求综合考虑高可用性和成本效益。...结论YashanDB通过高效的同步手段和异地容灾策略,为企业提供了强有力的数据保护和服务可用性保障。通过了解并应用上述核心技术和最佳实践,企业可以更好地应对数据安全和业务连续性挑战。
云容灾在云容灾出现之前,企业通常采用传统容灾方案,如自建异地灾备中心或租用灾备机房。...相比之下,云容灾基于云计算技术,充分利用云平台的弹性和智能化能力,提供了一种更灵活、高效的灾备解决方案:对比项传统容灾云容灾基础设施自建或租用物理灾备中心依赖云服务,无需额外硬件成本投入高昂的硬件、机房...高可用性(High Availability)云容灾基于云计算的多区域、多数据中心架构,可提供跨地域的数据冗余备份,确保即使在某一区域发生故障,企业仍然能够切换到其他可用区继续运营。...例如,企业可以在云端模拟宕机情况,测试系统在不同故障场景下的恢复能力,并优化灾备策略。四、案例分析:某金融企业的灾备升级背景某大型金融企业依赖传统容灾方案,在本地数据中心部署了一套灾备系统。...:在云端部署异地灾备中心,利用云存储进行数据备份,并启用云计算资源进行业务恢复。
网络属于基础设施部分,网络容灾建设作为一个数据中心验收重要指标。试想一个数据中心的网络链路存在单点,就如一个城市道路都是单行道,一旦出现交通事故,小则导致道路拥堵,大则导致整个城市交通瘫痪。...IDC时代,业务对网络容灾参与较少,主要依赖数据中心网络容灾建设程度;当到了云的时代,云服务商将底层网络能力产品化后,云上客户更多参与网络容灾建设,提升业务稳定性。...2.网络容灾复杂度 同城或者异地容灾建设,网络层面因素主要有三个: 1)跨区或者跨地域网络延时,对上层业务影响。 网络延时,通过优化基础设施手段是非常有限的,毕竟受限于实际物理距离和光速。...2)跨区或者跨地域云基础设施容灾能力。 通常云服务厂家数据中心建设均有容灾能力,这里建议还是选择大厂。 3)IDC到云上网络高可用建设。...image.png 3.2 混合云网络容灾 混合云网络容灾分为两个部分: 1)idc和云机房之间线路容灾,主要线路分为专线和VPN。
加州AI硬件抢劫案警示:中科热备异地容灾的真实距离 写这篇文章,是给那些正在纠结“要不要把容灾中心挪远一点”的运维负责人看的。...距离怎么定:100公里是底线,不是拍脑袋 说到异地容灾,第一个绕不开的问题就是:离多远算“异地”?我见过不少企业的“异地容灾”,实际上就是同城另一个区的机房,直线距离18公里。...等保2.0里对“异地容灾”有一个基本要求:距离主中心100公里以上。这不是随便写的。100公里意味着什么?...部署清单:五步把异地容灾落地 如果你现在就要动手做异地容灾,我建议按下面这五步走,顺序别乱。 第一步:评估物理威胁面。...演练完必须做反向同步,把容灾端的数据拉回主中心,这个环节最容易暴露出配置问题。 最常见的错误:把同城多机房当异地容灾 最后说一个我反复跟客户强调的点:同城多机房不是异地容灾。
因此,云化数据中心的容灾建设也相应地从面向项目的传统容灾建设方式转变为面向平台的容灾建设方式。...,同城灾备中心实现全业务系统或部分关键业务系统的灾备 同城的两个中心共同承担所有业务系统的运行,并互为灾备,异地实现关键系统的灾备。...,对于通信数据链路带宽要求也较高;异步数据复制不需要对应用进行改造,对于通信链路带宽要求较低,通信距离也较远,可以在灾难发生时实现分钟级别的数据丢失,一般应用于异地的数据中心灾备。...总结 传统的容灾架构中,灾备中心往往被定义成成本中心,因为业务连续性定义灾难时关键业务需要快速恢复而灾备中心大部分时间处于闲置状态。云化数据中心的建设则可以改善容灾的投资回报,实现灾备中心更多价值。...综上所述,云化数据中心的容灾方案具备以下优势: •一体化的灾备管理 •通过云平台进行统一配置和调度; •支持快速的自动容灾切换流程; •应用级容灾的快速实现 •自动完成同步和异步的数据备份; •有效节省容灾投资
序言 同城异地灾备,主要是用来进行备份容灾的,从而当一个数据中心挂了,另外一个数据中心经过切换之后,能让服务迅速的恢复。...随着业务的进一步发展,需要提供高可用水平,从而需要从单机房扩展为多机房,从而也就有了同城容灾。。。 对于运维来说,多一次升级,多一次变更,就会多一个故障,多一个锅。。。...热升级了解一下,不可预知的中断了解一下 同城异地最关键的点在于存储,存储如何跨机房使用,从而分为几个方面进行探讨: 1、 DNS解析 在业务大量使用DNS解耦的时候,而且使用双机房的时候...核心数据库,要想高可用,并且不存在数据丢失,从而可以使用分布式数据库,在数据写入的时候,采用强同步的方式写入数据,对于master节点,可以采用三机房三中心的模式,使用paxos算法进行选主,从而达到高可用的目标