tcp_keepalives_count
tcp_keepalives_count 定义 TCP keepalive 的最大重传次数。
说明
Fact — 官方简述译文:设置 TCP keepalive 的最大重传次数。
身份
生命周期
| Fact | 值 |
|---|---|
| 首次观测 | PG9.0(研究下界) |
| 在档版本 | PG9.0–19 Beta 3 |
| 移除版本 | 否 |
| 引入提交 | 不作断言:早于 PG9.0 研究边界 |
| 提交日期 | — |
| Discussion | — |
默认值变迁
| 版本 | 原始 boot_val |
单位 | 人类可读值 |
|---|---|---|---|
| PG9.0–19 Beta 3 | 0 |
— | 0 |
机制详解
tcp_keepalives_count:设置 TCP keepalive 的最大重传次数。它与 idle、interval 一起决定多少次未响应探测后判定故障;在支持的平台上,零选择操作系统默认值。
tcp_keepalives_count 属于 USER 上下文。获授权角色可在会话内修改,ALTER ROLE 或 ALTER DATABASE 可为未来会话建立默认值。
有效故障发现窗口由 tcp_keepalives_idle、tcp_keepalives_interval 与 tcp_keepalives_count 共同推导,并受操作系统支持及更短网络设备超时约束。
调优建议
提示
Advice。 以下建议是工作负载起点,必须用真实测量验证。
| 场景 | 建议 |
|---|---|
| OLTP | 把 tcp_keepalives_count 与其他 keepalive 控制联合选择,使总故障发现时间符合负载均衡、故障转移与重试预算,并确认操作系统实现对应套接字选项。 |
| OLAP | 长分析连接的 keepalive 应短于中间网络设备的空闲过期时间,但不能激进到因短暂丢包终止健康作业。 |
| 小规格 | 除非实测网络故障模式要求覆盖,否则使用操作系统默认值;应整体调节 idle/interval/count,而不是只调 tcp_keepalives_count。 |
Pigsty 取值
以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。
| 模板 | 有效值 | 与上游 boot 比较 | 源表达式 |
|---|---|---|---|
| OLTP | 未修改 | — | — |
| OLAP | 未修改 | — | — |
| CRIT | 未修改 | — | — |
| TINY | 未修改 | — | — |
注意
Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG9.0–19 Beta 3 未修改;OLAP: PG9.0–19 Beta 3 未修改;CRIT: PG9.0–19 Beta 3 未修改;TINY: PG9.0–19 Beta 3 未修改。 未发现覆盖值,因此不推断 Pigsty 专属理由。
常见坑
- 只在一个会话中修改 tcp_keepalives_count,却认为角色默认值、数据库默认值或其他池化会话也已随之改变。
- 只调一个 keepalive 组成项,却未计算完整空闲加重传故障窗口。
- 误以为 PostgreSQL 请求值能覆盖不支持的平台,或更短的防火墙与负载均衡空闲策略。
- 误以为零表示不探测,而它实际选择操作系统默认值。
关联参数
tcp_keepalives_idle · tcp_keepalives_interval · tcp_user_timeout · client_connection_check_interval · authentication_timeout