insert data


难度 中等

一条数据插入的流程如下:

graph TB PostgresMain-->exec_simple_query-->PortalRun-->PortalRunMulti-->ProcessQuery--> standard_ExecutorRun-->ExecutePlan-->ExecModifyTable-->ExecInsert--> heapam_tuple_insert-->heap_insert

以上流程数据仅仅只是到了内存里面,还没有真正到达磁盘,什么时候进入磁盘还需要BgWriter进程来操作。下面采用自底向上的方式来分析数据的插入及其实现逻辑。

heap_insert

void heap_insert(Relation relation, HeapTuple tup, CommandId cid,
      int options, BulkInsertState bistate)

插入需要提供五个参数,需终点关注以下四个,因为这四个是数据模型的重要数据结构。

  • Relation

    /*
     * Here are the contents of a relation cache entry.
     */
    
    typedef struct RelationData
    {
      RelFileNode rd_node;		/* relation physical identifier */
      SMgrRelation rd_smgr;		/* cached file handle, or NULL */
      int			rd_refcnt;		/* reference count */
      BackendId	rd_backend;		/* owning backend id, if temporary relation */
      bool		rd_islocaltemp; /* rel is a temp rel of this session */
      bool		rd_isnailed;	/* rel is nailed in cache */
      bool		rd_isvalid;		/* relcache entry is valid */
      bool		rd_indexvalid;	/* is rd_indexlist valid? (also rd_pkindex and
                     * rd_replidindex) */
      bool		rd_statvalid;	/* is rd_statlist valid? */
      SubTransactionId rd_createSubid;	/* rel was created in current xact */
      SubTransactionId rd_newRelfilenodeSubid;	/* highest subxact changing
                             * rd_node to current value */
      SubTransactionId rd_firstRelfilenodeSubid;	/* highest subxact changing
                             * rd_node to any value */
      SubTransactionId rd_droppedSubid;	/* dropped with another Subid set */
    
      ........
        
      bool		pgstat_enabled;	/* should relation stats be counted */
      /* use "struct" here to avoid needing to include pgstat.h: */
      struct PgStat_TableStatus *pgstat_info; /* statistics collection area */
    } RelationData;

    可以看到,成员非常多,此处我们先暂时关心其内部细节。只要知道这是个关系上下文,里面存储了很多的上下文信息,数据插入到什么地方与RelationData紧密相关。

  • HeapTuple

    typedef struct HeapTupleData
    {
      uint32		t_len;			/* length of *t_data */
      ItemPointerData t_self;		/* SelfItemPointer */
      Oid			t_tableOid;		/* table the tuple came from */
    #define FIELDNO_HEAPTUPLEDATA_DATA 3
      HeapTupleHeader t_data;		/* -> tuple header and data */
    } HeapTupleData;
  • CommandId

  • BulkInsertState

PageAddItemExtended


文章作者: growdu
版权声明: 本博客所有文章除特別声明外,均采用 CC BY 4.0 许可协议。转载请注明来源 growdu !
  目录
分类导航
随笔2 AI27 算法1 计算机基础13 博客搭建7 ChatGPT2 集群63 计算机通信1 数据库34 数据库深入80 DPDK26 Docker11 Elasticsearch4 编辑工具4 FAQ1 Go Web1 hometown2 编程语言16 网络9 OPC1 Linux38 openGauss4 页面12 PostgreSQL54 程序员自我修养1 协议11 成长之路1 stock1 存储5 工具20 VPP18 视频作品1 Vue13 Web1 代码示例11 数据库15 BenchmarkSQL1 PostgreSQL 源码修炼之路14
最热文章
1
13 逻辑复制深入
数据库深入🔥 1570
2
0 Postgresql存储、索引及系统优化、主备切换
PostgreSQL🔥 1495
3
一文读懂openguass dcf网络模块
集群🔥 1420
4
逻辑复制源码分析
数据库深入🔥 1327
5
PostgreSQL 分区表:从一行 `PARTITION BY` 到路由热路径的全链路拆解
数据库🔥 1094
6
applyparallelworker.c 之 LA 端源码深度解析:Leader Apply Worker 的指挥中枢
数据库深入🔥 1082
7
PostgreSQL Background Worker 全解:从 `RegisterBackgroundWorker` 到逻辑复制 4 类 worker 的全生命周期
数据库🔥 1078
8
PostgreSQL的后台进程walsender分析 - 关系型数据库 - 亿速云
PostgreSQL🔥 1033
9
PostgreSQL 逻辑复制的监控:六张视图 + 一组可执行 SQL,把 publisher/subscriber 的速率与健康度彻底看透
数据库🔥 1032
10
PostgreSQL 逻辑复制支持 DDL 之后:DDL 与 DML 的时序难题(重点:分区表)
数据库🔥 999
11
reorderbuffer.c 源码深度解析:PostgreSQL 逻辑复制的"事务重组引擎
数据库深入🔥 953
12
PostgreSQL 内核开发:读取一张表的 9 步标准流程与缓存全景
数据库🔥 938
13
从 `postgres` 二进制到生产级守护 —— PostgreSQL 最外层模块与启动全流程拆解
数据库🔥 936
14
支持逻辑复制同步 DDL 适配 SQL Server 方案
数据库深入🔥 934
15
PostgreSQL 逻辑复制的 ReorderBuffer 与事务机制:从一行 WAL 到一致性变更流的全链路绑定
数据库🔥 913
16
DDL同步架构(美化版)
数据库深入🔥 908
17
PostgreSQL Latch 机制详解:从一行 SetLatch 到 epoll 的内核之旅
数据库🔥 871
18
pgbench 源码全解:一个 C 文件如何撑起 PostgreSQL 官方压测工具
数据库🔥 860
19
PostgreSQL libpq 机制与缓冲区详解
数据库🔥 850
20
PostgreSQL 逻辑复制 spill 文件深度剖析:从 `xid-*.spill` 到 TPC-C 的增长方程
数据库🔥 845