跳转到主要内容

checkpoint_warning

checkpoint_warning:设置 WAL 容量触发的检查点过于频繁时发出警告的时间阈值。实测在档范围为 PG9.0–19 Beta 3;最后在档的 PG19 Beta 3 启动默认值为 30 s,context 为 sighup。这是测试版快照事实,PostgreSQL 19 正式发布前仍可能变化。
说明

Fact — 官方简述译文:设置 WAL 容量触发的检查点过于频繁时发出警告的时间阈值。

身份

类型 , integer
上游 pg_settings 类型
Context , sighup
配置 reload 后生效
单位 , s
原始单位
范围 , 02147483647
最后在档版本的原始上下限
枚举值 ,
非枚举类型记为 —
分类 , Write-Ahead Log / Checkpoints
上游分类
最后 boot 值 , 30
30 s

生命周期

Fact
首次观测 PG9.0(研究下界)
在档版本 PG9.0–19 Beta 3
移除版本
引入提交 不作断言:早于 PG9.0 研究边界
提交日期
Discussion

默认值变迁

PG9.0–19 Beta 3 实测 boot 默认值
版本 原始 boot_val 单位 人类可读值
PG9.0–19 Beta 3 30 s 30 s

机制详解

设置 WAL 容量触发的检查点过于频繁时发出警告的时间阈值。重新加载配置即可应用新值;已经开始的工作不会被追溯改变。

该参数只在 WAL 容量触发的检查点间隔短于阈值时写日志,并不会推迟检查点。频繁告警通常意味着 max_wal_size 相对 WAL 生成速率过小。

应把 checkpoint_warning 与 checkpoint_flush_after、checkpoint_timeout、checkpoint_completion_target 一起监控和变更。先在对应角色与真实负载上验证,再按其 sighup context 选择会话修改、reload 或 restart;历史默认值并不等于当前有效值。

调优建议

提示

Advice。 以下建议是工作负载起点,必须用真实测量验证。

场景 建议
OLTP 先保证耐久性与恢复目标,再以 WAL 生成速率、刷写延迟、检查点和 pg_wal 峰值调 checkpoint_warning;每次改动都做崩溃/恢复与归档监控验证。
OLAP 按批量装载峰值规划 WAL、归档带宽和恢复 I/O;需要降低峰值时应协调装载节奏与检查点,而不是牺牲恢复链。
小规格 从安全默认或实测 Pigsty 值开始,按有限磁盘容量设置明确告警;不要仅为节省少量 I/O 就关闭耐久性或破坏恢复链。

Pigsty 取值

以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。

模板 有效值 与上游 boot 比较 源表达式
OLTP 未修改
OLAP 未修改
CRIT 未修改
TINY 未修改
注意

Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG9.0–19 Beta 3 未修改;OLAP: PG9.0–19 Beta 3 未修改;CRIT: PG9.0–19 Beta 3 未修改;TINY: PG9.0–19 Beta 3 未修改。 未发现覆盖值,因此不推断 Pigsty 专属理由。

常见坑

  • 把告警阈值误当成会推迟或节流检查点的控制项。
  • 设为零,掩盖 WAL 容量触发检查点过于频繁的证据。
  • 只提高阈值,而不调查 WAL 速率、max_wal_size 与 requested checkpoint 频率。
  • 把 checkpoint_warning 设得高于 checkpoint_timeout,却期待时间触发检查点产生该告警。

checkpoint_flush_after · checkpoint_timeout · checkpoint_completion_target · max_wal_size · min_wal_size · archive_cleanup_command

参考资料