跳转到主要内容

idle_replication_slot_timeout

idle_replication_slot_timeout:设置复制槽保持空闲多久后失效。实测在档范围为 PG18–19 Beta 3;最后在档的 PG19 Beta 3 启动默认值为 0 s,context 为 sighup。这是测试版快照事实,PostgreSQL 19 正式发布前仍可能变化。
说明

Fact — 官方简述译文:设置复制槽保持空闲多久后失效。

身份

类型 , integer
上游 pg_settings 类型
Context , sighup
配置 reload 后生效
单位 , s
原始单位
范围 , 02147483647
最后在档版本的原始上下限
枚举值 ,
非枚举类型记为 —
分类 , Replication / Sending Servers
上游分类
最后 boot 值 , 0
0 s

生命周期

Fact
首次观测 PG18
在档版本 PG18–19 Beta 3
移除版本
引入提交 ac0e33136abc — Invalidate inactive replication slots.
提交日期 2025-02-19
Discussion 讨论 1 · 讨论 2

默认值变迁

PG9.0–19 Beta 3 实测 boot 默认值
版本 原始 boot_val 单位 人类可读值
PG18–19 Beta 3 0 s 0 s

机制详解

设置复制槽保持空闲多久后失效。重新加载配置即可应用新值;已经开始的工作不会被追溯改变。

PostgreSQL 18 从 pg_replication_slots.inactive_since 计算空闲时间,并在超过阈值后的检查点使合格槽失效。零禁用策略;不保留 WAL 的槽与从主库同步来的备库槽不适用。

应把 idle_replication_slot_timeout 与 max_replication_slots、max_slot_wal_keep_size、primary_slot_name 一起监控和变更。先在对应角色与真实负载上验证,再按其 sighup context 选择会话修改、reload 或 restart;历史默认值并不等于当前有效值。

调优建议

提示

Advice。 以下建议是工作负载起点,必须用真实测量验证。

场景 建议
OLTP 按主备拓扑、故障切换角色、复制槽/订阅数量与断连余量规划 idle_replication_slot_timeout;上线前验证主库写延迟、备库重放和磁盘保留的最坏情况。
OLAP 读备库与逻辑订阅常有长查询或大事务,应给重放/应用留明确上界,并监控延迟、worker 饱和、槽 restart_lsn 与冲突取消。
小规格 只配置真实需要的复制能力。少量节点也应设置有界超时与槽生命周期,不要用无限保留换取表面稳定。

Pigsty 取值

以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。

模板 有效值 与上游 boot 比较 源表达式
OLTP 7d 不同于 boot 值 7d
OLAP 7d 不同于 boot 值 7d
CRIT 3d 不同于 boot 值 3d
TINY 7d 不同于 boot 值 7d
注意

Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG18–19 Beta 3 = 7d (dcs);OLAP: PG18–19 Beta 3 = 7d (dcs);CRIT: PG18–19 Beta 3 = 3d (dcs);TINY: PG18–19 Beta 3 = 7d (dcs)。 建议(待人工复核)——编辑推断(待维护者人工复核):该选择看起来意在使遗忘的 PG18 复制槽失效,并给 CRIT 更严格的窗口;发布前应结合当前 Pigsty 模板、硬件夹具和运维保证复核。

常见坑

  • 期待时长一到立刻失效,而不是等后续检查点。
  • 误以为同步来的备库槽也适用。
  • 自动失效前没有订阅者重建 runbook。
  • 在错误的主库、备库、发送端或订阅端角色上修改。
  • 只看字节/时间配置,不监控真实复制延迟、槽位置与 worker 状态。

max_replication_slots · max_slot_wal_keep_size · primary_slot_name · wal_keep_size · checkpoint_timeout · max_wal_senders

参考资料