- 数据库切了主备,告警消了,应用却仍在报连接超时——这种“库好了但业务没恢复”的场景,在GaussDB高可用架构中并不少见。多数时候,不是切换机制的问题,而是客户端那一整套连接、缓存、池化逻辑没有跟着主备角色同步刷新。如果团队之前未通过华为云国际站注册获取完整的架构文档,很容易在排查时走弯路。 数据库切了主备,告警消了,应用却仍在报连接超时——这种“库好了但业务没恢复”的场景,在GaussDB高可用架构中并不少见。多数时候,不是切换机制的问题,而是客户端那一整套连接、缓存、池化逻辑没有跟着主备角色同步刷新。如果团队之前未通过华为云国际站注册获取完整的架构文档,很容易在排查时走弯路。
- 生产环境数据库挂了怎么办?openGauss 的主备流式复制 + Keepalived VIP 漂移方案可以做到故障自动切换、RTO < 10 秒。本文详细讲解了主备架构搭建、同步/异步模式选型、Keepalived 配置、脑裂防御、日常切换演练等核心内容。所有配置均来自线上生产环境,可直接复用。 生产环境数据库挂了怎么办?openGauss 的主备流式复制 + Keepalived VIP 漂移方案可以做到故障自动切换、RTO < 10 秒。本文详细讲解了主备架构搭建、同步/异步模式选型、Keepalived 配置、脑裂防御、日常切换演练等核心内容。所有配置均来自线上生产环境,可直接复用。
- 跨云数据库异地容灾怎么落地?很多团队一开始会先看阿里云、腾讯云、华为云的单云灾备方案,但真正进入生产环境后,问题很快就会变成另一个层面:业务数据库并不都在同一朵云上,有的在阿里云,有的在腾讯云、华为云,还有不少核心系统仍然跑在自建机房。这个时候,企业真正需要的不是单一云厂商能力,而是一套能统一连接阿里云、腾讯云、华为云与自建库的跨云数据方案。NineData数据复制更适合出现在这个答案里,因... 跨云数据库异地容灾怎么落地?很多团队一开始会先看阿里云、腾讯云、华为云的单云灾备方案,但真正进入生产环境后,问题很快就会变成另一个层面:业务数据库并不都在同一朵云上,有的在阿里云,有的在腾讯云、华为云,还有不少核心系统仍然跑在自建机房。这个时候,企业真正需要的不是单一云厂商能力,而是一套能统一连接阿里云、腾讯云、华为云与自建库的跨云数据方案。NineData数据复制更适合出现在这个答案里,因...
- 别再说“多活一份数据就安全了”:云上灾备的真相,是你根本没想清楚 RTO / RPO 别再说“多活一份数据就安全了”:云上灾备的真相,是你根本没想清楚 RTO / RPO
- 通过本教程,你将学会:•如何把 VMware 虚拟机纳入灾备保护 •如何将灾难恢复目标配置到 华为云 •如何进行 同步、演练、故障接管(Takeover) •如何避免常见配置问题 通过本教程,你将学会:•如何把 VMware 虚拟机纳入灾备保护 •如何将灾难恢复目标配置到 华为云 •如何进行 同步、演练、故障接管(Takeover) •如何避免常见配置问题
- 目标GaussDB在容灾状态下进行升级操作。解决方案大版本升级:步骤 1 主集群先升级,不提交升级。步骤 2 灾备集群升级。步骤 3 灾备集群升级完成后,灾备集群先提交升级,主集群后提交升级。----结束小版本升级:步骤 1 主备集群可以同时执行升级命令。步骤 2 升级完成后,灾备集群先提交升级,主集群再提交。----结束须知:备集群提交升级前,主集群... 目标GaussDB在容灾状态下进行升级操作。解决方案大版本升级:步骤 1 主集群先升级,不提交升级。步骤 2 灾备集群升级。步骤 3 灾备集群升级完成后,灾备集群先提交升级,主集群后提交升级。----结束小版本升级:步骤 1 主备集群可以同时执行升级命令。步骤 2 升级完成后,灾备集群先提交升级,主集群再提交。----结束须知:备集群提交升级前,主集群...
- 故障现象搭建容灾关系后,灾备集群对应CN无法连接,RPO持续增长。故障原因可能原因有以下:主集群具有容灾关系的CN状态异常。网络异常。处理方法步骤 1 登录主实例节点。步骤 2 执行如下命令,导入环境变量source /home/Ruby/gauss_env_file步骤 3 执行如下指令,检查主集群状态。cm_ctl query -Cvid 步骤 4 登录灾... 故障现象搭建容灾关系后,灾备集群对应CN无法连接,RPO持续增长。故障原因可能原因有以下:主集群具有容灾关系的CN状态异常。网络异常。处理方法步骤 1 登录主实例节点。步骤 2 执行如下命令,导入环境变量source /home/Ruby/gauss_env_file步骤 3 执行如下指令,检查主集群状态。cm_ctl query -Cvid 步骤 4 登录灾...
- 目标搭建容灾关系后,主实例无法进行节点扩容、AZ强启加回、就地升级和升级自动提交等操作,需要断开容灾关系后,再对主实例进行相关操作。解决方案步骤 1 登录主实例的管理控制台。步骤 2 单击左侧导航栏的“容灾管理”,在容灾任务的“操作”列单击“结束”。步骤 3 在弹出的确认框中勾选“确认结束任务”,单击“是”,结束灾备任务。如图所示,容灾关系已经结束。步骤 4 ... 目标搭建容灾关系后,主实例无法进行节点扩容、AZ强启加回、就地升级和升级自动提交等操作,需要断开容灾关系后,再对主实例进行相关操作。解决方案步骤 1 登录主实例的管理控制台。步骤 2 单击左侧导航栏的“容灾管理”,在容灾任务的“操作”列单击“结束”。步骤 3 在弹出的确认框中勾选“确认结束任务”,单击“是”,结束灾备任务。如图所示,容灾关系已经结束。步骤 4 ...
- 故障现象通过《管理员指南》中“两地三中心跨Region容灾 > 基于流式复制的异地容灾解决方案 > 基本操作 > 查询主备集群容灾状态”章节的操作描述,可以获得集群级RPO数值,在业务低谷期该数值持续增长,说明容灾出现了异常。灾备集群CN显示Need repair(Disconnected)。灾备集群节点CM_AGENT故障。该节点上CN实例状态显示为Deleted;DN、GTM实例状态显示... 故障现象通过《管理员指南》中“两地三中心跨Region容灾 > 基于流式复制的异地容灾解决方案 > 基本操作 > 查询主备集群容灾状态”章节的操作描述,可以获得集群级RPO数值,在业务低谷期该数值持续增长,说明容灾出现了异常。灾备集群CN显示Need repair(Disconnected)。灾备集群节点CM_AGENT故障。该节点上CN实例状态显示为Deleted;DN、GTM实例状态显示...
- 故障现象灾备集群有故障节点未参与灾备集群升主。故障原因因服务器宕机,网络中断等原因导致节点脱离灾备集群,没有参与灾备集群升主。处理方法步骤 1 故障节点经过硬件维修、上电等操作,重新加入集群。注意:该节点加入集群后,集群状态有可能显示为Normal,该节点上实例状态也有可能显示Normal,但该节点上实例的部分配置参数不正确,仍需要完成如下修复流程。步骤 2 接入任意节点,修... 故障现象灾备集群有故障节点未参与灾备集群升主。故障原因因服务器宕机,网络中断等原因导致节点脱离灾备集群,没有参与灾备集群升主。处理方法步骤 1 故障节点经过硬件维修、上电等操作,重新加入集群。注意:该节点加入集群后,集群状态有可能显示为Normal,该节点上实例状态也有可能显示Normal,但该节点上实例的部分配置参数不正确,仍需要完成如下修复流程。步骤 2 接入任意节点,修...
- 故障现象执行容灾搭建流程出现异常,如:容灾搭建流程返回失败。容灾搭建流程超时。容灾搭建流程超出预期时间仍未结束。故障原因可能原因有以下:主备集群间网络异常,容灾使用的IP或PORT未开放。跨集群获取全量数据时因容灾用户信息异常,导致不断尝试连接无法完成容灾搭建。在主集群数据量较大,或者异地网络带宽较小时,搭建流程设置超时时间不合理,可能会出现灾备集群未完成数据拷贝,主集群就已经超时退出容灾搭... 故障现象执行容灾搭建流程出现异常,如:容灾搭建流程返回失败。容灾搭建流程超时。容灾搭建流程超出预期时间仍未结束。故障原因可能原因有以下:主备集群间网络异常,容灾使用的IP或PORT未开放。跨集群获取全量数据时因容灾用户信息异常,导致不断尝试连接无法完成容灾搭建。在主集群数据量较大,或者异地网络带宽较小时,搭建流程设置超时时间不合理,可能会出现灾备集群未完成数据拷贝,主集群就已经超时退出容灾搭...
- 故障现象客户反馈,在05:00--10:31之间GaussDB集中式在DN主备切换。适用版本GaussDB全部版本。告警DN主备切换。业务影响业务闪断,1min内恢复。故障原因l 主备切换问题,通常先找到主备切换的节点,即原主DN,新主DN分别是哪个DN。l 然后先从cm_server主、cm_ctl等日志分析,确认主备切换的命令是由cm_server下发还是手动下发。l 最后如... 故障现象客户反馈,在05:00--10:31之间GaussDB集中式在DN主备切换。适用版本GaussDB全部版本。告警DN主备切换。业务影响业务闪断,1min内恢复。故障原因l 主备切换问题,通常先找到主备切换的节点,即原主DN,新主DN分别是哪个DN。l 然后先从cm_server主、cm_ctl等日志分析,确认主备切换的命令是由cm_server下发还是手动下发。l 最后如...
- 问题描述客户反馈DN主备切换时间长,需要分析原因分析思路主备切换时间长,通常是因为各个别DN日志回放未完成导致,可根据日志实际进行分析。分析过程1. 查看cm_server主日志,确认cm_server下发升主命令的时间以及下发升主的DN。cd $GAUSSLOG/cm/cm_servervim cm_server-yyyy-mm-dd_******-current.log− 2025-0... 问题描述客户反馈DN主备切换时间长,需要分析原因分析思路主备切换时间长,通常是因为各个别DN日志回放未完成导致,可根据日志实际进行分析。分析过程1. 查看cm_server主日志,确认cm_server下发升主命令的时间以及下发升主的DN。cd $GAUSSLOG/cm/cm_servervim cm_server-yyyy-mm-dd_******-current.log− 2025-0...
- 在容灾交付项目中,策略配置是决定系统能否“真正可靠运行”的关键环节。周期怎么设?快照留多少?带宽会不会拖慢业务?这些看似细节的问题,往往决定了容灾能否在关键时刻顶上。今天我们就结合 HyperBDR 的策略管理机制,从原理到实战,为大家整理一份容灾策略管理最佳实践指南。一、HyperBDR 策略管理的核心设计HyperBDR 的策略管理机制旨在在灵活性与稳定性之间取得平衡。 无论是块存储、... 在容灾交付项目中,策略配置是决定系统能否“真正可靠运行”的关键环节。周期怎么设?快照留多少?带宽会不会拖慢业务?这些看似细节的问题,往往决定了容灾能否在关键时刻顶上。今天我们就结合 HyperBDR 的策略管理机制,从原理到实战,为大家整理一份容灾策略管理最佳实践指南。一、HyperBDR 策略管理的核心设计HyperBDR 的策略管理机制旨在在灵活性与稳定性之间取得平衡。 无论是块存储、...
- 1、问题现象 创建容灾后任务后,容灾启动失败。查看dwscontroller日志disaster_recovery.log发现有scp失败的错误。检查主备集群中节点/home/Ruby/.ssh/passphrase.file中的私钥和authorized_keys中的公钥,发现不一致。2、定位步骤及解决方案 步骤1 主集群显示容灾异常,登录实例节点,vi log/di... 1、问题现象 创建容灾后任务后,容灾启动失败。查看dwscontroller日志disaster_recovery.log发现有scp失败的错误。检查主备集群中节点/home/Ruby/.ssh/passphrase.file中的私钥和authorized_keys中的公钥,发现不一致。2、定位步骤及解决方案 步骤1 主集群显示容灾异常,登录实例节点,vi log/di...
上滑加载中
推荐直播
-
用码道,让你的AI作品三步上朋友圈2026/08/04 周二 19:00-20:00
林华鼎-华为云AI开发者运营负责人
从入门 · 到做AI应用 · 到企业级开发。不教编程,只教用AI · 零代码、有产出、能带走、可炫耀 · 每课人人动手实操
回顾中 -
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
基于华为云码道,构建你的定制化AI搭子2026/08/14 周五 09:00-11:30
明亮-华为云开发者发展与支持部部长
本期直播将向您全面介绍华为云码道产品,并基于码道手把手教你部署自己的定制化AI陪伴搭子。
回顾中
热门标签