「完成の最後の仕上げ:回復検知の確認」 (recovery-detection-verification)
大人向け説明
heartbeat 監視は「故障検知」と「回復検知」の2つの機能があります。故障側は確認できたので、残りの回復側を確認します。これが動けば、次に scheduler が再び死んだ時にも新しいアラートが飛ぶ(古いフラグが残ったまま無音になることがない)、という保険が完成します。
小学生向け説明
さっきは「scheduler が死んだら server.py が気づく」を確認しました。
今度は「scheduler が 生き返ったら server.py が “あ、戻ってきた!” と気づく」を確認します。
なぜこれが大事かというと、もし戻ってきたことに気づかないと、次にまた死んだ時に「あ、もう前に通知したからいいや」 とサボってしまうからです。それだと2回目の死亡を見逃します。
戻ってきたフラグ(.server_alert_scheduler_dead.sent というファイル)が ちゃんと消えてくれるか が今回のチェックポイントです。
コメント