跳转到主要内容

这是本节的多页打印视图。 .

返回本页常规视图.

错误处理

Error Handling 分类下的 4 个 PostgreSQL 核心配置参数档案。

条目 URL 保持扁平;本分类仅用于侧栏与浏览组织。

1 - data_sync_retry

data_sync_retry:设置数据文件同步失败后是否继续运行。实测在档范围为 PG9.4–19 Beta 3;最后在档的 PG19 Beta 3 启动默认值为 off,context 为 postmaster。这是测试版快照事实,PostgreSQL 19 正式发布前仍可能变化。
说明

Fact — 官方简述译文:设置数据文件同步失败后是否继续运行。

身份

类型 , bool
上游 pg_settings 类型
Context , postmaster
修改后需要重启数据库
单位 ,
原始单位
范围 ,
最后在档版本的原始上下限
枚举值 ,
非枚举类型记为 —
分类 , Error Handling
上游分类
最后 boot 值 , off
off

生命周期

Fact
首次观测 PG9.4
在档版本 PG9.4–19 Beta 3
移除版本
引入提交 f1ff5f51d249 — PANIC on fsync() failure.
提交日期 2018-11-19
Discussion 讨论 1

默认值变迁

PG9.0–19 Beta 3 实测 boot 默认值
版本 原始 boot_val 单位 人类可读值
PG9.4–19 Beta 3 off off

机制详解

设置数据文件同步失败后是否继续运行。该值在服务器启动时固定,修改后必须重启。

数据文件 fsync 失败后,默认认为 shared buffers 可能已经不一致并触发 PANIC,让崩溃恢复重建状态。继续运行可能丢失对脏页的认知,只适合内核同步语义能保证安全重试的特定平台。

应把 data_sync_retry 与 restart_after_crash、recovery_init_sync_method、fsync 一起监控和变更。先在对应角色与真实负载上验证,再按其 postmaster context 选择会话修改、reload 或 restart;历史默认值并不等于当前有效值。

调优建议

提示

Advice。 以下建议是工作负载起点,必须用真实测量验证。

场景 建议
OLTP 根据故障模型与实际观测决定是否修改 data_sync_retry;先做会话/测试环境验证,再按 context 安全部署并保留回滚值。
OLAP 在长查询、批任务和峰值并发下单独验证,避免把 OLTP 经验直接套用到分析节点。
小规格 没有明确问题就保持默认;小规格环境更应避免以全局兼容性或故障策略换取微小收益。

Pigsty 取值

以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。

模板 有效值 与上游 boot 比较 源表达式
OLTP 未修改
OLAP 未修改
CRIT 未修改
TINY 未修改
注意

Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG9.4–19 Beta 3 未修改;OLAP: PG9.4–19 Beta 3 未修改;CRIT: PG9.4–19 Beta 3 未修改;TINY: PG9.4–19 Beta 3 未修改。 未发现覆盖值,因此不推断 Pigsty 专属理由。

常见坑

  • 在 fsync 失败会丢失脏页认知的平台上开启。
  • 不隔离坏存储就把 I/O 错误当成暂时故障。
  • 为表面可用性牺牲数据正确性。
  • 把 data_sync_retry 的启动默认值误当成当前有效值。
  • 忽略 postmaster context 对生效时机的约束。

restart_after_crash · recovery_init_sync_method · fsync · full_page_writes · exit_on_error

参考资料

2 - exit_on_error

exit_on_error:发生任何错误后终止会话。实测在档范围为 PG9.1–19 Beta 3;最后在档的 PG19 Beta 3 启动默认值为 off,context 为 user。这是测试版快照事实,PostgreSQL 19 正式发布前仍可能变化。
说明

Fact — 官方简述译文:发生任何错误后终止会话。

身份

类型 , bool
上游 pg_settings 类型
Context , user
普通用户可在运行时修改
单位 ,
原始单位
范围 ,
最后在档版本的原始上下限
枚举值 ,
非枚举类型记为 —
分类 , Error Handling
上游分类
最后 boot 值 , off
off

生命周期

Fact
首次观测 PG9.1
在档版本 PG9.1–19 Beta 3
移除版本
引入提交 不作断言:名称在 2008 Git 历史边界已经存在
提交日期 ≤ 2008-01-01
Discussion

默认值变迁

PG9.0–19 Beta 3 实测 boot 默认值
版本 原始 boot_val 单位 人类可读值
PG9.1–19 Beta 3 off off

机制详解

exit_on_error 这个名称在本项目 2008 年 Git 历史边界以及 PG9.0 源码的 GUC 表中已经存在。PG9.0 为它设置 GUC_NO_SHOW_ALL,因此该版 pg_settings 快照看不到它;PG9.1 的首次观测表示可见性变化,并不声称底层行为发明于 PG9.1。

启用后,任何错误都会在正常错误处理后终止整个后端会话,而不只是当前事务。它不同于 psql ON_ERROR_STOP 等客户端侧遇错停止行为,可能意外丢失会话状态、预备语句、临时对象以及应用连接。

它具有 user context,可用受控会话测试而无需改变全部连接。应与 restart_after_crash、事务错误处理、连接池重试、statement_timeout 和 idle_in_transaction_session_timeout 联合评估;终止服务器会话不能替代正确的事务恢复。

调优建议

提示

Advice。 以下建议是工作负载起点,必须用真实测量验证。

场景 建议
OLTP 根据故障模型与实际观测决定是否修改 exit_on_error;先做会话/测试环境验证,再按 context 安全部署并保留回滚值。
OLAP 在长查询、批任务和峰值并发下单独验证,避免把 OLTP 经验直接套用到分析节点。
小规格 没有明确问题就保持默认;小规格环境更应避免以全局兼容性或故障策略换取微小收益。

Pigsty 取值

以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。

模板 有效值 与上游 boot 比较 源表达式
OLTP 未修改
OLAP 未修改
CRIT 未修改
TINY 未修改
注意

Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG9.1–19 Beta 3 未修改;OLAP: PG9.1–19 Beta 3 未修改;CRIT: PG9.1–19 Beta 3 未修改;TINY: PG9.1–19 Beta 3 未修改。 未发现覆盖值,因此不推断 Pigsty 专属理由。

常见坑

  • 把 exit_on_error 的启动默认值误当成当前有效值。
  • 忽略 user context 对生效时机的约束。
  • 一次改变多个联动参数,无法归因结果。
  • 未在真实故障或负载边界上验证就全局发布。

restart_after_crash · statement_timeout · idle_in_transaction_session_timeout · data_sync_retry · recovery_init_sync_method

参考资料

3 - recovery_init_sync_method

recovery_init_sync_method:设置崩溃恢复前同步数据目录的方法。它是 PG14–18 的 sighup 参数;最新实测启动默认值为 fsync。
说明

Fact — 官方简述译文:设置崩溃恢复前同步数据目录的方法。

身份

类型 , enum
上游 pg_settings 类型
Context , sighup
配置 reload 后生效
单位 ,
原始单位
范围 ,
最后在档版本的原始上下限
枚举值 , fsync, syncfs
非枚举类型记为 —
分类 , Error Handling
上游分类
最后 boot 值 , fsync
fsync

生命周期

Fact
首次观测 PG14
在档版本 PG14–19 Beta 3
移除版本
引入提交 61752afb2640 — Provide recovery_init_sync_method=syncfs.
提交日期 2021-03-20
Discussion 讨论 1 · 讨论 2

默认值变迁

PG9.0–19 Beta 3 实测 boot 默认值
版本 原始 boot_val 单位 人类可读值
PG14–19 Beta 3 fsync fsync

机制详解

设置崩溃恢复前同步数据目录的方法。重新加载配置即可应用新值;已经开始的工作不会被追溯改变。

它定义故障发生后的服务器策略;选择会影响可用性与正确性边界。外部 supervisor、存储错误语义和恢复演练必须与该策略一致。

应把 recovery_init_sync_method 与 data_sync_retry、restart_after_crash、fsync 一起监控和变更。先在对应角色与真实负载上验证,再按其 sighup context 选择会话修改、reload 或 restart;历史默认值并不等于当前有效值。

调优建议

提示

Advice。 以下建议是工作负载起点,必须用真实测量验证。

场景 建议
OLTP 根据故障模型与实际观测决定是否修改 recovery_init_sync_method;先做会话/测试环境验证,再按 context 安全部署并保留回滚值。
OLAP 在长查询、批任务和峰值并发下单独验证,避免把 OLTP 经验直接套用到分析节点。
小规格 没有明确问题就保持默认;小规格环境更应避免以全局兼容性或故障策略换取微小收益。

Pigsty 取值

以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。

模板 有效值 与上游 boot 比较 源表达式
OLTP 未修改
OLAP 未修改
CRIT 未修改
TINY 未修改
注意

Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG14–19 Beta 3 未修改;OLAP: PG14–19 Beta 3 未修改;CRIT: PG14–19 Beta 3 未修改;TINY: PG14–19 Beta 3 未修改。 未发现覆盖值,因此不推断 Pigsty 专属理由。

常见坑

  • 把 recovery_init_sync_method 的启动默认值误当成当前有效值。
  • 忽略 sighup context 对生效时机的约束。
  • 一次改变多个联动参数,无法归因结果。
  • 未在真实故障或负载边界上验证就全局发布。

data_sync_retry · restart_after_crash · fsync · full_page_writes · exit_on_error

参考资料

4 - restart_after_crash

restart_after_crash:后端崩溃后重新初始化服务器。实测在档范围为 PG9.1–19 Beta 3;最后在档的 PG19 Beta 3 启动默认值为 on,context 为 sighup。这是测试版快照事实,PostgreSQL 19 正式发布前仍可能变化。
说明

Fact — 官方简述译文:后端崩溃后重新初始化服务器。

身份

类型 , bool
上游 pg_settings 类型
Context , sighup
配置 reload 后生效
单位 ,
原始单位
范围 ,
最后在档版本的原始上下限
枚举值 ,
非枚举类型记为 —
分类 , Error Handling
上游分类
最后 boot 值 , on
on

生命周期

Fact
首次观测 PG9.1
在档版本 PG9.1–19 Beta 3
移除版本
引入提交 5ffaa9005c45 — Add restart_after_crash GUC.
提交日期 2010-07-20
Discussion

默认值变迁

PG9.0–19 Beta 3 实测 boot 默认值
版本 原始 boot_val 单位 人类可读值
PG9.1–19 Beta 3 on on

机制详解

后端崩溃后重新初始化服务器。重新加载配置即可应用新值;已经开始的工作不会被追溯改变。

它定义故障发生后的服务器策略;选择会影响可用性与正确性边界。外部 supervisor、存储错误语义和恢复演练必须与该策略一致。

应把 restart_after_crash 与 data_sync_retry、recovery_init_sync_method、fsync 一起监控和变更。先在对应角色与真实负载上验证,再按其 sighup context 选择会话修改、reload 或 restart;历史默认值并不等于当前有效值。

调优建议

提示

Advice。 以下建议是工作负载起点,必须用真实测量验证。

场景 建议
OLTP 根据故障模型与实际观测决定是否修改 restart_after_crash;先做会话/测试环境验证,再按 context 安全部署并保留回滚值。
OLAP 在长查询、批任务和峰值并发下单独验证,避免把 OLTP 经验直接套用到分析节点。
小规格 没有明确问题就保持默认;小规格环境更应避免以全局兼容性或故障策略换取微小收益。

Pigsty 取值

以下值来自固定 8 核、32 GiB、100 GiB SSD 夹具,并按 PG19 Beta 3 渲染当前 Pigsty 模板;这不表示 Pigsty 当前支持该历史或测试版本。

模板 有效值 与上游 boot 比较 源表达式
OLTP 未修改
OLAP 未修改
CRIT 未修改
TINY 未修改
注意

Advice — 待人工复核。 当前 Pigsty 模板投影事实:OLTP: PG9.1–19 Beta 3 未修改;OLAP: PG9.1–19 Beta 3 未修改;CRIT: PG9.1–19 Beta 3 未修改;TINY: PG9.1–19 Beta 3 未修改。 未发现覆盖值,因此不推断 Pigsty 专属理由。

常见坑

  • 把 restart_after_crash 的启动默认值误当成当前有效值。
  • 忽略 sighup context 对生效时机的约束。
  • 一次改变多个联动参数,无法归因结果。
  • 未在真实故障或负载边界上验证就全局发布。

data_sync_retry · recovery_init_sync_method · fsync · full_page_writes · exit_on_error · statement_timeout

参考资料