跳转到主要内容

tcp_keepalives_interval

tcp_keepalives_interval 定义 TCP keepalive 重传之间的间隔。
说明

Fact — 官方简述译文:设置 TCP keepalive 重传之间的间隔。

身份

类型 , integer
上游 pg_settings 类型
Context , user
普通用户可在运行时修改
单位 , s
原始单位
范围 , 02147483647
最后在档版本的原始上下限
枚举值 ,
非枚举类型记为 —
分类 , Connections and Authentication / TCP Settings
上游分类
最后 boot 值 , 0
0 s

生命周期

Fact
首次观测 PG9.0(研究下界)
在档版本 PG9.0–19 Beta 3
移除版本
引入提交 不作断言:早于 PG9.0 研究边界
提交日期
Discussion

默认值变迁

PG9.0–19 Beta 3 实测 boot 默认值
版本 原始 boot_val 单位 人类可读值
PG9.0–19 Beta 3 0 s 0 s

机制详解

tcp_keepalives_interval:设置 TCP keepalive 重传之间的间隔。探测开始后,它规定重传间隔,并与 tcp_keepalives_count 共同决定总故障发现时间。

tcp_keepalives_interval 属于 USER 上下文。获授权角色可在会话内修改,ALTER ROLE 或 ALTER DATABASE 可为未来会话建立默认值。

有效故障发现窗口由 tcp_keepalives_idle、tcp_keepalives_interval 与 tcp_keepalives_count 共同推导,并受操作系统支持及更短网络设备超时约束。

调优建议

提示

Advice。 以下建议是工作负载起点,必须用真实测量验证。

场景 建议
OLTP 把 tcp_keepalives_interval 与其他 keepalive 控制联合选择,使总故障发现时间符合负载均衡、故障转移与重试预算,并确认操作系统实现对应套接字选项。
OLAP 长分析连接的 keepalive 应短于中间网络设备的空闲过期时间,但不能激进到因短暂丢包终止健康作业。
小规格 除非实测网络故障模式要求覆盖,否则使用操作系统默认值;应整体调节 idle/interval/count,而不是只调 tcp_keepalives_interval。

Pigsty 取值

以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。

模板 有效值 与上游 boot 比较 源表达式
OLTP 未修改
OLAP 未修改
CRIT 未修改
TINY 未修改
注意

Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG9.0–19 Beta 3 未修改;OLAP: PG9.0–19 Beta 3 未修改;CRIT: PG9.0–19 Beta 3 未修改;TINY: PG9.0–19 Beta 3 未修改。 未发现覆盖值,因此不推断 Pigsty 专属理由。

常见坑

  • 只在一个会话中修改 tcp_keepalives_interval,却认为角色默认值、数据库默认值或其他池化会话也已随之改变。
  • 只调一个 keepalive 组成项,却未计算完整空闲加重传故障窗口。
  • 误以为 PostgreSQL 请求值能覆盖不支持的平台,或更短的防火墙与负载均衡空闲策略。
  • 只调重传间隔,却未结合 tcp_keepalives_count 与总故障发现时间。

tcp_keepalives_idle · tcp_keepalives_count · tcp_user_timeout · client_connection_check_interval · authentication_timeout

参考资料