checkpoint_warning
Fact — 官方简述译文:设置 WAL 容量触发的检查点过于频繁时发出警告的时间阈值。
身份
生命周期
| Fact | 值 |
|---|---|
| 首次观测 | PG9.0(研究下界) |
| 在档版本 | PG9.0–19 Beta 3 |
| 移除版本 | 否 |
| 引入提交 | 不作断言:早于 PG9.0 研究边界 |
| 提交日期 | — |
| Discussion | — |
默认值变迁
| 版本 | 原始 boot_val |
单位 | 人类可读值 |
|---|---|---|---|
| PG9.0–19 Beta 3 | 30 |
s |
30 s |
机制详解
设置 WAL 容量触发的检查点过于频繁时发出警告的时间阈值。重新加载配置即可应用新值;已经开始的工作不会被追溯改变。
该参数只在 WAL 容量触发的检查点间隔短于阈值时写日志,并不会推迟检查点。频繁告警通常意味着 max_wal_size 相对 WAL 生成速率过小。
应把 checkpoint_warning 与 checkpoint_flush_after、checkpoint_timeout、checkpoint_completion_target 一起监控和变更。先在对应角色与真实负载上验证,再按其 sighup context 选择会话修改、reload 或 restart;历史默认值并不等于当前有效值。
调优建议
Advice。 以下建议是工作负载起点,必须用真实测量验证。
| 场景 | 建议 |
|---|---|
| OLTP | 先保证耐久性与恢复目标,再以 WAL 生成速率、刷写延迟、检查点和 pg_wal 峰值调 checkpoint_warning;每次改动都做崩溃/恢复与归档监控验证。 |
| OLAP | 按批量装载峰值规划 WAL、归档带宽和恢复 I/O;需要降低峰值时应协调装载节奏与检查点,而不是牺牲恢复链。 |
| 小规格 | 从安全默认或实测 Pigsty 值开始,按有限磁盘容量设置明确告警;不要仅为节省少量 I/O 就关闭耐久性或破坏恢复链。 |
Pigsty 取值
以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。
| 模板 | 有效值 | 与上游 boot 比较 | 源表达式 |
|---|---|---|---|
| OLTP | 未修改 | — | — |
| OLAP | 未修改 | — | — |
| CRIT | 未修改 | — | — |
| TINY | 未修改 | — | — |
Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG9.0–19 Beta 3 未修改;OLAP: PG9.0–19 Beta 3 未修改;CRIT: PG9.0–19 Beta 3 未修改;TINY: PG9.0–19 Beta 3 未修改。 未发现覆盖值,因此不推断 Pigsty 专属理由。
常见坑
- 把告警阈值误当成会推迟或节流检查点的控制项。
- 设为零,掩盖 WAL 容量触发检查点过于频繁的证据。
- 只提高阈值,而不调查 WAL 速率、max_wal_size 与 requested checkpoint 频率。
- 把 checkpoint_warning 设得高于 checkpoint_timeout,却期待时间触发检查点产生该告警。
关联参数
checkpoint_flush_after · checkpoint_timeout · checkpoint_completion_target · max_wal_size · min_wal_size · archive_cleanup_command