Monitoring a Failover Manager cluster¶
</ div>
Failover Manager
efm cluster-statusコマンドまたはPEMクライアントインタフェースを使用して、Failover
Managerクラスタの監視対象ノードの現在のステータスを確認できます。
クラスターステータスレポートの確認¶
efm cluster-status cluster properties
fileコマンドは、Failover
Managerクラスターのステータスに関する情報を含むレポートを返します。
# efm cluster-status <cluster_name>
次のステータスレポートは、3つのノードが実行されているedbという名前付けのクラスターに関するものです。
Agent Type Address Agent DB VIP
-----------------------------------------------------------------------
Standby 172.19.10.2 UP UP 192.168.225.190
Standby 172.19.12.163 UP UP 192.168.225.190
Primary 172.19.14.9 UP UP 192.168.225.190*
Allowed node host list:
172.19.14.9 172.19.12.163 172.19.10.2
Membership coordinator: 172.19.14.9
Standby priority host list:
172.19.12.163 172.19.10.2
Promote Status:
DB Type Address WAL Received LSN WAL Replayed LSN Info
--------------------------------------------------------------------
Primary 172.19.14.9 0/4000638
Standby 172.19.12.163 0/4000638 0/4000638
Standby 172.19.10.2 0/4000638 0/4000638
Standby database(s) in sync with primary. It is safe to promote.
クラスターステータスセクションには、クラスターの各ノードに存在するエージェントのステータスの概要が表示されます。
Agent Type Address Agent DB VIP
-----------------------------------------------------------------------
Standby 172.19.10.2 UP UP 192.168.225.190
Standby 172.19.12.163 UP UP 192.168.225.190
Primary 172.19.14.9 UP UP 192.168.225.190*
VIPアドレスの後のアスタリスク( *)は、アドレスが接続に使用可能であることを示します。 VIPアドレスの後にアスタリスクが付いていない場合、アドレスはプロパティファイルでノードに関連付けられていますが、アドレスは現在使用されていません。
フェールオーバーマネージャーエージェントは、クラスターステータスセクションに表示される情報を提供します。
Allowed node host listとStandby priority host listを使用すると、クラスターに結合できるノードとノードの昇格オーダーを簡単に確認できます。メンバーシップコーディネーターのIPアドレスもレポートに表示されます。
Allowed node host list:
172.19.14.9 172.19.12.163 172.19.10.2
Membership coordinator: 172.19.14.9
Standby priority host list:
172.19.12.163 172.19.10.2
レポートのPromote Statusセクションは、cluster-statusコマンドを呼び出しているノードからクラスター内の各データベースへの直接クエリーの結果です。クエリーは、各データベースのトランザクションログの場所も返します。各データベースへのクエリは異なる時間に結果れるため、クラスタでストリーミングレプリケーションが正常に動作していても、LSNはマッチしない場合があります。
Promote Status:
DB Type Address WAL Received LSN WAL Replayed LSN Info
-------------------------------------------------------------------
Primary 172.19.14.9 0/4000638
Standby 172.19.12.163 0/4000638 0/4000638
Standby 172.19.10.2 0/4000638 0/4000638
データベースがダウンしているか、データベースが再起動されたが、再開コマンドがまだ呼び出されていない場合、そのホストに存在するエージェントの状態はアイドル状態です。エージェントがアイドル状態の場合、クラスターステータスレポートにはアイドルノードの状態の概要が含まれます。例:
Agent Type Address Agent DB VIP
-----------------------------------------------------
Idle 172.19.18.105 UP UP 172.19.13.105
終了コード¶
クラスターステータスプロセスは、クラスターの状態に基づいて終了コードを返します。
0の終了コードは、すべてのエージェントが実行中であり、プライマリノードとスタンバイノードのデータベースが実行中であり、同期していることを示します。非ゼロの終了コードは、問題があることを示します。次の問題により、非ゼロの終了コードがトリガーされる場合があります。
データベースがダウンしているか、不明であるか、アイドルエージェントがあります。
フェールオーバーマネージャーは、指定されたデータベースパスワードを解読できません。
データベースに接続してWALの場所を取得する際に問題が発生しました。
プライマリエージェントはありません。
スタンバイエージェントはありません。
1つ以上のスタンバイノードがプライマリと同期していません。
Postgres Enterprise Managerを使用したストリーミングレプリケーションの監視¶
Postgres Enterprise Manager (PEM)を使用してサーバーをモニタする場合、Streaming Replication Analysisダッシュボード(PEMインタフェースのパート)を構成して、Streaming Replicationシナリオのパートであるプライマリノードまたはスタンバイノードの状態を表示できます。
The Streaming Replication dashboard (Primary node)¶
ストリーミングレプリケーション分析ダッシュボードには、ストリーミングレプリケーションが有効になっている監視対象サーバーのアクティビティに関する統計情報が表示されます。ダッシュボードヘッダーは、監視対象サーバーの状態(レプリケーションプライマリまたはレプリケーションスレーブのいずれか)を識別し、サーバーが最後に起動された日時、ページが最後に更新された日時、およびトリガーされたアラートの現在のカウントを表示しますサーバー。
レプリケーションスレーブ(スタンバイノード)のダッシュボードを確認すると、ダッシュボードの下部にあるlabelがサーバーのステータスを確認します。
The Streaming Replication dashboard (Standby node)¶
デフォルトでは、Streaming Replication Analysisダッシュボードに情報を提供するPEMレプリケーションプローブは無効になっています。
レプリケーションシナリオのプライマリノードのストリーミングレプリケーション分析ダッシュボードをビューするには、次のプローブを有効にする必要があります。
ストリーミングレプリケーション
WALアーカイブステータス
レプリケーションシナリオのスタンバイノードのストリーミングレプリケーション分析ダッシュボードをビューするには、次のプローブを有効にする必要があります。
ストリーミングレプリケーションの遅延時間
PEMの詳細については、Postgres Enterprise Manager documentationを参照してください。