corosync down网卡仍处于多数派问题分析


难度 中等

问题现象

corosync三节点集群,未启用vote_quorum,没有qdevice进程。使用ifdown停掉网卡后,节点仍处于quorate状态。

corosync使用的通信方式为udpu。

使用如下命令down掉网卡,格一段时间后查看节点的quorate状态,发现仍处于quorate。实际上网络不通应处于非quorate状态。

当前的同城双中心集群数据库fence依赖于corosync的quorate状态,只有当corosync处于非quorate状态超过20秒时才会停止数据库。
当down掉网卡时,实际网络不通,但因为仍处于quorate状态未停止数据库。但本中心已无法和observer及其他中心通信,因为会触发observer执行跨中心切换,将主库切换到另一个中心。当重新up网卡,网路恢复,此时生成中心的主库未停止,灾备中心也有了新主库,导致出现脑裂双主。

问题原因

在down掉网卡时,节点的quorate状态应改变为非quorate。

这个问题是corosync的已知问题,社区在这个补丁里对这个问题进行了修复,https://github.com/corosync/corosync/pull/685,我们的corosync没合入这个补丁。但这个补丁里提到udpu会存在这个问题,knet方式不会,补丁里的修复解决方式也不是最完美的,建议使用knet。

问题解决

这个问题是corosync的已知问题,社区在这个补丁里对这个问题进行了修复,https://github.com/corosync/corosync/pull/685,我们的corosync没合入这个补丁。但这个补丁里提到udpu会存在这个问题,knet方式不会,补丁里的修复解决方式也不是最完美的,建议使用knet。

对于开发来说

  1. 合入社区相关补丁代码;
  2. 详细分析udpu和knet的通信方式的区别,并输出分析文档,给出选择那种通信方式;
    knet是目前corosync默认的方式,能力和性能都更好,见《2017-Kronosnet-The-new-face-of-corosync-communications》,也是社区主推的。原来的通信方式目前看起来是只用于兼容。之前默认的transport不使用knet原因是测试环境发现knet方式会做广播,经验证:1. knet目前传输层默认用udp的单播,也支持sctp。 2. 经测试验证之前发现的问题应该是因为虚拟机环境的网络配置造成抓包可以抓到网卡上的全部传输信息。物理机验证没有问题。
  3. 对比我们当前的corosync代码与corosync社区的代码,有哪些bug是我们未合入的,并分析是否需要合入;
  4. 后续持续跟踪corosync社区的代码,并及时跟进更新;
    clusterware MDE应关注,和ES一样需要关注社区版本更新并选择,产出加入产品规划流程。

对于测试来说

应模拟测试多种故障场景,尤其是网络故障,不能光以关机重启或者chaos-blade工具模拟,应按照实际的使用场景来模拟测试。

在原有关机、重启,chaos-blade工具模拟网络故障外,还应增加如下测试场景:

  1. 开防火墙;
  2. 停网卡服务;
  3. ifdown网卡;
  4. 拔网线;

相关测试MDE也需要确认下其他故障场景的模拟是否也有类似问题。

结论

1. 后续会将corosync通信方式从udpu更改为knet,并进行测试验证;
2. 若现场poc测试比较紧急的话,可以修改V8R6_cluster_install.sh文件,
找到如下内容:

transport: udpu

将其删除或者修改为:

transport: knet

这样部署的集群可以规避该问题。


文章作者: growdu
版权声明: 本博客所有文章除特別声明外,均采用 CC BY 4.0 许可协议。转载请注明来源 growdu !
  目录
分类导航
随笔2 AI27 算法1 计算机基础13 博客搭建7 ChatGPT2 集群63 计算机通信1 数据库34 数据库深入80 DPDK26 Docker11 Elasticsearch4 编辑工具4 FAQ1 Go Web1 hometown2 编程语言16 网络9 OPC1 Linux38 openGauss4 页面12 PostgreSQL54 程序员自我修养1 协议11 成长之路1 stock1 存储5 工具20 VPP18 视频作品1 Vue13 Web1 代码示例11 数据库15 BenchmarkSQL1 PostgreSQL 源码修炼之路14
最热文章
1
13 逻辑复制深入
数据库深入🔥 1570
2
0 Postgresql存储、索引及系统优化、主备切换
PostgreSQL🔥 1495
3
一文读懂openguass dcf网络模块
集群🔥 1420
4
逻辑复制源码分析
数据库深入🔥 1327
5
PostgreSQL 分区表:从一行 `PARTITION BY` 到路由热路径的全链路拆解
数据库🔥 1094
6
applyparallelworker.c 之 LA 端源码深度解析:Leader Apply Worker 的指挥中枢
数据库深入🔥 1082
7
PostgreSQL Background Worker 全解:从 `RegisterBackgroundWorker` 到逻辑复制 4 类 worker 的全生命周期
数据库🔥 1078
8
PostgreSQL的后台进程walsender分析 - 关系型数据库 - 亿速云
PostgreSQL🔥 1033
9
PostgreSQL 逻辑复制的监控:六张视图 + 一组可执行 SQL,把 publisher/subscriber 的速率与健康度彻底看透
数据库🔥 1032
10
PostgreSQL 逻辑复制支持 DDL 之后:DDL 与 DML 的时序难题(重点:分区表)
数据库🔥 999
11
reorderbuffer.c 源码深度解析:PostgreSQL 逻辑复制的"事务重组引擎
数据库深入🔥 953
12
PostgreSQL 内核开发:读取一张表的 9 步标准流程与缓存全景
数据库🔥 938
13
从 `postgres` 二进制到生产级守护 —— PostgreSQL 最外层模块与启动全流程拆解
数据库🔥 936
14
支持逻辑复制同步 DDL 适配 SQL Server 方案
数据库深入🔥 934
15
PostgreSQL 逻辑复制的 ReorderBuffer 与事务机制:从一行 WAL 到一致性变更流的全链路绑定
数据库🔥 913
16
DDL同步架构(美化版)
数据库深入🔥 908
17
PostgreSQL Latch 机制详解:从一行 SetLatch 到 epoll 的内核之旅
数据库🔥 871
18
pgbench 源码全解:一个 C 文件如何撑起 PostgreSQL 官方压测工具
数据库🔥 860
19
PostgreSQL libpq 机制与缓冲区详解
数据库🔥 850
20
PostgreSQL 逻辑复制 spill 文件深度剖析:从 `xid-*.spill` 到 TPC-C 的增长方程
数据库🔥 845