wal_receiver_timeout
Fact — 官方简述译文:设置等待发送端数据的最长时间。
身份
生命周期
| Fact | 值 |
|---|---|
| 首次观测 | PG9.3 |
| 在档版本 | PG9.3–19 Beta 3 |
| 移除版本 | 否 |
| 引入提交 | 6f60fdd7015b — Improve replication connection timeouts. |
| 提交日期 | 2012-10-11 |
| Discussion | — |
默认值变迁
| 版本 | 原始 boot_val |
单位 | 人类可读值 |
|---|---|---|---|
| PG9.3–19 Beta 3 | 60000 |
ms |
1 min |
机制详解
设置等待发送端数据的最长时间。重新加载配置即可应用新值;已经开始的工作不会被追溯改变。
它只在对应的发送端、主库、备库或订阅端角色上生效;级联复制与故障切换会改变服务器角色,因此相关容量和依赖应在所有候选节点一致规划。
应把 wal_receiver_timeout 与 primary_conninfo、primary_slot_name、restore_command 一起监控和变更。先在对应角色与真实负载上验证,再按其 sighup context 选择会话修改、reload 或 restart;历史默认值并不等于当前有效值。
调优建议
Advice。 以下建议是工作负载起点,必须用真实测量验证。
| 场景 | 建议 |
|---|---|
| OLTP | 按主备拓扑、故障切换角色、复制槽/订阅数量与断连余量规划 wal_receiver_timeout;上线前验证主库写延迟、备库重放和磁盘保留的最坏情况。 |
| OLAP | 读备库与逻辑订阅常有长查询或大事务,应给重放/应用留明确上界,并监控延迟、worker 饱和、槽 restart_lsn 与冲突取消。 |
| 小规格 | 只配置真实需要的复制能力。少量节点也应设置有界超时与槽生命周期,不要用无限保留换取表面稳定。 |
Pigsty 取值
以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。
| 模板 | 有效值 | 与上游 boot 比较 | 源表达式 |
|---|---|---|---|
| OLTP | 60s |
等于 boot 值 | 60s |
| OLAP | 60s |
等于 boot 值 | 60s |
| CRIT | 60s |
等于 boot 值 | 60s |
| TINY | 60s |
等于 boot 值 | 60s |
Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG9.3–19 Beta 3 = 60s (dcs);OLAP: PG9.3–19 Beta 3 = 60s (dcs);CRIT: PG9.3–19 Beta 3 = 60s (dcs);TINY: PG9.3–19 Beta 3 = 60s (dcs)。 建议(待人工复核)——编辑推断(待维护者人工复核):该选择看起来意在显式采用一分钟的 receiver 故障检测窗口;发布前应结合当前 Pigsty 模板、硬件夹具和运维保证复核。
常见坑
- 在错误的主库、备库、发送端或订阅端角色上修改。
- 只看字节/时间配置,不监控真实复制延迟、槽位置与 worker 状态。
- 故障切换后新主库缺少与旧主库一致的容量或依赖。
- 用无限等待或无限 WAL 保留掩盖失效消费者。
关联参数
primary_conninfo · primary_slot_name · restore_command · wal_retrieve_retry_interval · hot_standby · wal_receiver_status_interval