调整允许的corosync网络波动时间操作步骤


难度 中等
编写人 编写内容 编写时间
growdu 初稿 2023-06-08

调整允许的corosync网络波动时间仅需修改repmgr.conf配置文件,重启kbha和repmgrd进程,无需停止数据库,也不影响上层业务运行。按如下步骤修改配置并重启服务,经过本次修改重启后,允许的网络波动时间将从20秒增加到50秒。

停止observer,防止修改配置过程中触发跨中心切换

  1. 在observer节点查看集群状态是否正常,保证集群状态正常的情况下进行后续操作;

在observer节点使用如下命令查看集群状态:

./repmgr cluster show

如上图所示,可以看到生产中心和灾备中心的信息均能查询到,其各节点状态均正常,此时可以进行后续步骤。

  1. 停止observer;

使用如下命令停止observer,防止重启高可用服务时进行跨中心切换。

./ha_ctl.sh observer stop

修改生产中心配置,并重启kbha服务和repmgrd服务

在第一个节点上执行如下步骤

  1. 登录机器节点修改配置文件,具体为修改etc/repmgr.conf文件;

将repmgr.conf文件中的如下内容:

reconnect_attempts=5
reconnect_interval=6

替换为

reconnect_attempts=6
reconnect_interval=10
vim etc/repmgr.conf
  1. 停止kbha服务

使用如下命令停止kbha服务:

./ha_ctl.sh kbha stop

kbha 服务成功停止后,使用如下命令找到repmgrd的进程id,使用kill结束repmgrd进程。

ps -ef | grep repmgrd
kill pid

注意:非数据库节点没有repmgrd进程,则不需要结束repmgrd进程,仅重启kbha即可。

repmgrd停止后,使用如下命令确认repmgrd服务已停止。

./repmgr service status
  1. 重启kbha服务

执行如下命令重启kbha。

./ha_ctl.sh kbha start

repmgrd进程无需手动重启,kbha会自动启动repmgrd进程。

使用如下命令确认repmgrd进程已启动,待repmgrd进程启动后再进行后续步骤。

./repmgr service status

如上图所示repmgrd状态为running,且有有效的pid时,表面repmgrd已正常启动。

kbha和repmgrd重启成功后,查看本中心集群状态,确保集群状态正常,且查询无警告或报错,再进行后续步骤。

./repmgr cluster show

对中心内的其他节点按顺序重复以上步骤

每个节点都需要修改配置并重启kbha服务,且其操作步骤与第一个节点操作步骤相同。

若集群查询有告警或报错,可以在重启后等待几秒,待集群内部状态稳定后再进行后续操作。

修改灾备中心配置,并重启kbha服务和repmgrd服务

依次登录灾备中心的各个节点,执行和生产中心相同的步骤修改配置并重启kbha和repmgrd。

重启observer

待生产中心和灾备中心配置均修改完成后,修改observer配置并重启。

编辑repmgr.conf文件,修改如下配置参数:

tptc_corosync_reconnect_attempts=5
tptc_corosync_reconnect_interval=6

修改为:

tptc_corosync_reconnect_attempts=6
tptc_corosync_reconnect_interval=10

配置修改完成后,使用如下命令重启observer。

./ha_ctl.sh observer start

能正常查询到各中心集群信息,且各节点正常,则本次配置修改完成。


文章作者: growdu
版权声明: 本博客所有文章除特別声明外,均采用 CC BY 4.0 许可协议。转载请注明来源 growdu !
  目录
分类导航
随笔2 AI27 算法1 计算机基础13 博客搭建7 ChatGPT2 集群63 计算机通信1 数据库34 数据库深入80 DPDK26 Docker11 Elasticsearch4 编辑工具4 FAQ1 Go Web1 hometown2 编程语言16 网络9 OPC1 Linux38 openGauss4 页面12 PostgreSQL54 程序员自我修养1 协议11 成长之路1 stock1 存储5 工具20 VPP18 视频作品1 Vue13 Web1 代码示例11 数据库15 BenchmarkSQL1 PostgreSQL 源码修炼之路14
最热文章
1
13 逻辑复制深入
数据库深入🔥 1570
2
0 Postgresql存储、索引及系统优化、主备切换
PostgreSQL🔥 1495
3
一文读懂openguass dcf网络模块
集群🔥 1420
4
逻辑复制源码分析
数据库深入🔥 1327
5
PostgreSQL 分区表:从一行 `PARTITION BY` 到路由热路径的全链路拆解
数据库🔥 1094
6
applyparallelworker.c 之 LA 端源码深度解析:Leader Apply Worker 的指挥中枢
数据库深入🔥 1082
7
PostgreSQL Background Worker 全解:从 `RegisterBackgroundWorker` 到逻辑复制 4 类 worker 的全生命周期
数据库🔥 1078
8
PostgreSQL的后台进程walsender分析 - 关系型数据库 - 亿速云
PostgreSQL🔥 1033
9
PostgreSQL 逻辑复制的监控:六张视图 + 一组可执行 SQL,把 publisher/subscriber 的速率与健康度彻底看透
数据库🔥 1032
10
PostgreSQL 逻辑复制支持 DDL 之后:DDL 与 DML 的时序难题(重点:分区表)
数据库🔥 999
11
reorderbuffer.c 源码深度解析:PostgreSQL 逻辑复制的"事务重组引擎
数据库深入🔥 953
12
PostgreSQL 内核开发:读取一张表的 9 步标准流程与缓存全景
数据库🔥 938
13
从 `postgres` 二进制到生产级守护 —— PostgreSQL 最外层模块与启动全流程拆解
数据库🔥 936
14
支持逻辑复制同步 DDL 适配 SQL Server 方案
数据库深入🔥 934
15
PostgreSQL 逻辑复制的 ReorderBuffer 与事务机制:从一行 WAL 到一致性变更流的全链路绑定
数据库🔥 913
16
DDL同步架构(美化版)
数据库深入🔥 908
17
PostgreSQL Latch 机制详解:从一行 SetLatch 到 epoll 的内核之旅
数据库🔥 871
18
pgbench 源码全解:一个 C 文件如何撑起 PostgreSQL 官方压测工具
数据库🔥 860
19
PostgreSQL libpq 机制与缓冲区详解
数据库🔥 850
20
PostgreSQL 逻辑复制 spill 文件深度剖析:从 `xid-*.spill` 到 TPC-C 的增长方程
数据库🔥 845