pgsql架构


难度 中等

整体模式

pgsql采用C/S架构(客户端/服务端)模式。应用层通过INET或者Unix Socket利用既定的协议与数据库服务器进行通信。

pgsql把客户端称为前端,把服务端称为后端。前端通过调用libpq来与后端通信。
后端由多个进程组成,前端发送网络数据报文(查询请求)到后端,后端解析请求后回复相应的报文。

pgsql后端进程

  • postgres主进程(postmaster)

管理后端的常驻进程,也称为’postmaster’。
其默认监听UNIX Domain Socket和TCP/IP(Windows等,一部分的平台只监听tcp/ip)的5432端口,等待来自前端的的连接处理。
监听的端口号可以在PostgreSQL的设置文件postgresql.conf里面可以改。

当有前端连接过来的时候,postmaster会fork一个子进程来处理前端的连接请求。并通过共享内存进行进程间通信。

  • postgres子进程

子进程根据pg_hba.conf定义的安全策略来判断是否允许进行连接,根据策略,会拒绝某些特定的IP及网络,或者也可以只允许某些特定的用户或者对某些数据库进行连接。

  • 辅助进程

    • writer process
    • WAL wriiter process
    • archive process
    • stats collector process
    • logger process
    • autovacuum
    • wal sender/wal receiver

启动流程

graph TB main-->PostmasterMain-->SysLogger_Start-->fork_process-->InitPostmasterChild-->SysLoggerMain PostmasterMain-->maybe_start_bgworkers-->ServerLoop-->StartAutoVacLauncher-->MaybeStartWalReceiver PostmasterMain-->StartCheckpointer PostmasterMain-->StartBackgroundWriter

后端处理流程

  1. 接收前端发送过来的请求报文
  2. parse模块进行文本解析,得到查询树
  3. analyze模块进行分析处理
  4. 通过查询语句的重写实现视图和规则
  5. 查询优化,优化查询树
  6. executor执行处理
  7. 返回执行结果给前端
  8. 重复步骤1-7

后端运行主要逻辑

  1. initdb初始化一个数据库,创建data目录、模板数据库、默认用户、默认配置文件,主要涉及内容如下:

    • pg_wal:存放wal日志

    • base:存放表数据

  2. postgresql采用先写wal日志,再写数据的方式;通过保证wal数据库写入的方式来保证数据写入,并通过wal日志可以进行数据redo和undo;

  3. initdb初始化数据目录后,可以通过pg_ctl启动后端服务进程;

  4. 后端服务进程首先是启动了一个postgres进程,该进程会fork出startup、logger、bgwriter、walwriter、walreceiver等子进程,并通过共享内存和信号进行通信,同时该进程还会监听配置的ip和端口;

  5. postgres进程启动后会先启动startup进程,startup进程会读取control文件,确认是否需要恢复,即是否还有wal日志还没有转换为数据,若有或者配置recovery,则需要根据对应的control信息和检查点信息,找到离检查点或配置的最近的lsn,再根据lsn找到对应wal日志进程redo;

  6. redo完成后,若开启了流复制,则startup进程将唤醒walreceiver进程,walreceiver获取到最新的lsn后,将和主库walsender进程进行wal同步;

  7. postgres启动walreceiver进程时,walreceiver会和另外一个postgres服务端建立连接,另一端将会启动一个walsender进程来进行流复制同步;


文章作者: growdu
版权声明: 本博客所有文章除特別声明外,均采用 CC BY 4.0 许可协议。转载请注明来源 growdu !
  目录
分类导航
随笔2 AI27 算法1 计算机基础13 博客搭建7 ChatGPT2 集群63 计算机通信1 数据库34 数据库深入80 DPDK26 Docker11 Elasticsearch4 编辑工具4 FAQ1 Go Web1 hometown2 编程语言16 网络9 OPC1 Linux38 openGauss4 页面12 PostgreSQL54 程序员自我修养1 协议11 成长之路1 stock1 存储5 工具20 VPP18 视频作品1 Vue13 Web1 代码示例11 数据库15 BenchmarkSQL1 PostgreSQL 源码修炼之路14
最热文章
1
13 逻辑复制深入
数据库深入🔥 1570
2
0 Postgresql存储、索引及系统优化、主备切换
PostgreSQL🔥 1495
3
一文读懂openguass dcf网络模块
集群🔥 1420
4
逻辑复制源码分析
数据库深入🔥 1327
5
PostgreSQL 分区表:从一行 `PARTITION BY` 到路由热路径的全链路拆解
数据库🔥 1094
6
applyparallelworker.c 之 LA 端源码深度解析:Leader Apply Worker 的指挥中枢
数据库深入🔥 1082
7
PostgreSQL Background Worker 全解:从 `RegisterBackgroundWorker` 到逻辑复制 4 类 worker 的全生命周期
数据库🔥 1078
8
PostgreSQL的后台进程walsender分析 - 关系型数据库 - 亿速云
PostgreSQL🔥 1033
9
PostgreSQL 逻辑复制的监控:六张视图 + 一组可执行 SQL,把 publisher/subscriber 的速率与健康度彻底看透
数据库🔥 1032
10
PostgreSQL 逻辑复制支持 DDL 之后:DDL 与 DML 的时序难题(重点:分区表)
数据库🔥 999
11
reorderbuffer.c 源码深度解析:PostgreSQL 逻辑复制的"事务重组引擎
数据库深入🔥 953
12
PostgreSQL 内核开发:读取一张表的 9 步标准流程与缓存全景
数据库🔥 938
13
从 `postgres` 二进制到生产级守护 —— PostgreSQL 最外层模块与启动全流程拆解
数据库🔥 936
14
支持逻辑复制同步 DDL 适配 SQL Server 方案
数据库深入🔥 934
15
PostgreSQL 逻辑复制的 ReorderBuffer 与事务机制:从一行 WAL 到一致性变更流的全链路绑定
数据库🔥 913
16
DDL同步架构(美化版)
数据库深入🔥 908
17
PostgreSQL Latch 机制详解:从一行 SetLatch 到 epoll 的内核之旅
数据库🔥 871
18
pgbench 源码全解:一个 C 文件如何撑起 PostgreSQL 官方压测工具
数据库🔥 860
19
PostgreSQL libpq 机制与缓冲区详解
数据库🔥 850
20
PostgreSQL 逻辑复制 spill 文件深度剖析:从 `xid-*.spill` 到 TPC-C 的增长方程
数据库🔥 845