時間:2024-02-21 13:55作者:下載吧人氣:22
一、問題
pg_ctl start啟動時報錯退出:pg_ctl:server did not start in time
。超時時間是多少?從什么時候到哪個階段算超時?
二、分析:該信息打印位置,從后面代碼段do_start函數(shù)中可以看出
1、pg_ctl start調(diào)用start_postmaster啟動PG的主進程后,每隔0.1ms檢查一次postmaster.pid文件,是否已寫入ready/standby
2、總共會檢查600次,即從啟動主進程后,最多等待60s,如果沒有寫入ready/standby則打印上述日志并退出
3、默認等待時間是60s,如果pg_ctl start -t指定等待時間,則等待時間為該指定時間
三、什么時候postmaster.pid文件寫入ready/standby
1、如果是主機不管有沒有設(shè)置hot standby
1)當startup進程恢復完成退出時,調(diào)用proc_exit函數(shù)向主進程發(fā)送SIGCHLD信號并退出
2)主進程接收到信號后,signal處理函數(shù)reaper調(diào)用AddToDataDirLockFile向postmaster.pid文件寫入ready
2、如果是備機即data目錄下有recovery.cnf文件,且設(shè)置了hot standby,在實際恢復前沒有到達一致性位置
1)startup進程向主進程發(fā)送PMSIGNAL_RECOVERY_STARTED信號,主進程調(diào)用信號處理函數(shù)sigusr1_handler,將pmState=PM_RECOVERY
2)每次讀取下一個xlog前都會調(diào)用CheckRecoveryConsistency函數(shù)進行一致性檢查:
2.1 進入一致性狀態(tài),starup進程向主進程發(fā)送PMSIGNAL_BEGIN_HOT_STANDBY信號,主進程接收到信號后調(diào)用sigusr1_handler->AddToDataDirLockFile向postmaster.pid文件寫入ready
3、如果是備機即data目錄下有recovery.cnf文件,且設(shè)置了hot standby,在實際恢復前沒有到達一致性位置
1)startup進程向主進程發(fā)送PMSIGNAL_RECOVERY_STARTED信號,主進程調(diào)用信號處理函數(shù)sigusr1_handler,將pmState=PM_RECOVERY
2)每次讀取下一個xlog前都會調(diào)用CheckRecoveryConsistency函數(shù)進行一致性檢查。如果沒有進入一致性狀態(tài)
3)本地日志恢復完成,切換日志源時同樣調(diào)用CheckRecoveryConsistency函數(shù)進行一致性檢查
3.1 進入一致性狀態(tài),starup進程向主進程發(fā)送PMSIGNAL_BEGIN_HOT_STANDBY信號,主進程接收到信號后調(diào)用sigusr1_handler->AddToDataDirLockFile向postmaster.pid文件寫入ready
4、如果是備機即data目錄下有recovery.cnf文件,且設(shè)置了hot standby,在實際恢復前到達一致性位置
1)startup進程向主進程發(fā)送PMSIGNAL_RECOVERY_STARTED信號,主進程調(diào)用信號處理函數(shù)sigusr1_handler,將pmState=PM_RECOVERY
2)CheckRecoveryConsistency函數(shù)進行一致性檢查,向主進程發(fā)送PMSIGNAL_BEGIN_HOT_STANDBY信號,主進程接收到信號后調(diào)用sigusr1_handler->AddToDataDirLockFile向postmaster.pid文件寫入ready
5、如果是備機即data目錄下有recovery.cnf文件,沒有設(shè)置hot standby
1)startup進程向主進程發(fā)送PMSIGNAL_RECOVERY_STARTED信號
2)主進程接收到信號后,向postmaster.將pmState=PM_RECOVERY
四、代碼分析
1、pg_ctl start流程
do_start-> pm_pid = start_postmaster(); if (do_wait){ print_msg(_("waiting for server to start...")); switch (wait_for_postmaster(pm_pid, false)){ case POSTMASTER_READY: print_msg(_(" donen")); print_msg(_("server startedn")); break; case POSTMASTER_STILL_STARTING: print_msg(_(" stopped waitingn")); write_stderr(_("%s: server did not start in timen"), progname); exit(1); break; case POSTMASTER_FAILED: print_msg(_(" stopped waitingn")); write_stderr(_("%s: could not start servern" "Examine the log output.n"), progname); exit(1); break; } }else print_msg(_("server startingn"));
網(wǎng)友評論