Alerts#
PEMは、登録されたサーバーを継続的に監視します。パフォーマンスメトリックを、各統計について良好または許容可能なパフォーマンスを指定する事前定義されたユーザー指定のしきい値と比較します。許容可能なしきい値からの逸脱は、アラートをトリガーします。アラートは、PEMがシステム統計と比較するシステム定義またはユーザー定義の条件セットです。アラートは、注意が必要な登録サーバーの状態を通知します。
グローバルダッシュボードを介したアラートの表示#
システム統計がその統計に指定された境界から逸脱すると、アラートがトリガーされます。アラートは、グローバル概要ダッシュボードのアラートステータステーブルの左端の列に、重大度の高赤、低黄、または中オレンジの警告を表示します。
The Alert Status table#
PEMサーバーには、サーバーをアクティブに監視する多数の事前定義されたアラートが含まれています。アラート定義により、アラートの原因に関する詳細を利用できる場合があります。重大度警告の右側にある下矢印を選択して、アラートをトリガーした条件の詳細を含むダイアログボックスを開きます。
Alert details#
PEMは、カスタマイズされたアラートを作成できるインターフェイスも提供します。各アラートは、アラートテンプレートで定義されたメトリックを使用します。アラートテンプレートは、サーバーがリソースまたはメトリックの統計を評価する方法を定義します。 PEMサーバーには、事前定義されたアラートテンプレートが含まれており、カスタムアラートテンプレートを作成できます。
アラートダッシュボードを介したアラートの表示#
Dashboards メニュー Monitoring タブを使用して、Alertsダッシュボードを開きます。アラートダッシュボードには、アクティブなアラートの概要と各アラートのステータスが表示されます。
The Alerts Dashboard#
Alertsダッシュボードヘッダーには、ダッシュボードが最後に更新された日時と、現在のアラートの数が表示されます。
[Alerts Overview]セクションには、アクティブなアラートの視覚的表現と、現在の高、低、および中アラートの数が表示されます。グラフの左側の垂直バーは、各列に表示されるアラートの数を提供します。バーにカーソルを合わせると、グラフの右上隅に選択したアラートの重大度のアラート数が表示されます。
Alert Detailsテーブルは、現在トリガーされているアラートのリストを提供します。エントリは、重大度の高いものから低いものの順に表示されます。各エントリには、アラートを識別し、アラートをトリガーした条件を認識できる情報が含まれています。アラートを選択して、アラート定義に関する詳細情報を確認します。
Alert Errorsテーブルには、必要なプローブを誤って無効にしたり、アラートパラメーターの不適切な構成などの構成関連のエラーが表示されます。 [Error Message]列で提供される情報を使用して、エラーの原因となっている競合を特定して解決できます。
アラートダッシュボードのカスタマイズ#
アラートダッシュボードに表示されるテーブルとグラフをカスタマイズできます。テーブルまたはグラフをカスタマイズするには、右上隅にある 設定 を選択します。
[ Personalize Chart Configuration ]ダイアログボックスのフィールドを使用して、表示設定を提供します。
Auto Refresh フィールドを使用して、テーブルまたはチャートに表示されるデータの更新の間の秒数を指定します。
Download as フィールドを使用して、チャートをJPEG画像としてダウンロードするか、PNG画像としてダウンロードするかを示します。
カラーセレクター を使用して、チャートで使用する色を指定します。
Ack’ed列のチェックボックスで確認したアラートをテーブルに表示する場合は、 Show Acknowledged Alerts スイッチを Yes に設定します。確認されたアラートを非表示にするには、 No に設定します。確認されたアラートは、アラート定義で指定された時間が経過した場合にのみテーブルコンテンツから削除されます。
カスタマイズを保存するには、右上隅の Save チェックマークを選択します。以前の変更を削除し、デフォルト値に戻すには、 Delete を選択します。 Save および Delete メニューを使用して、設定をすべてのダッシュボードに適用するか、選択したサーバーまたはデータベースに適用するかを指定します。
アラートの管理#
PEMクライアントの Manage Alerts タブを使用して、アラートを定義、コピー、または管理します。 [ Manage Alerts ]タブを開くには、[ Management > Manage Alerts ]を選択します。
The Manage Alerts tab#
クイックリンクツールバーを使用して、アラートを管理するためのダイアログボックスとタブを開きます。
Copy Alerts を選択してCopy Alert Configurationダイアログボックスを開き、アラート定義をコピーします。
Alert Templates を選択して[ Alert Template ]タブを開き、アラートテンプレートを変更または作成します。
Send the notifications を選択して[ Email Template ]ダイアログボックスを開き、デフォルトのメールテンプレートを変更してメール通知をカスタマイズします。
Send the notifications を選択して[ Send the notifications ]タブを開き、メールグループを変更または作成します。
Webhooks を選択して[ Webhooks ]タブを開き、Webhookエンドポイントを作成または管理します。
Server Configurations を選択してServer Configurationダイアログボックスを開き、サーバー構成設定を確認または変更します。
Manage Alerts タブのAlertsセクションのテーブルを使用して、新しいアラートを作成するか、既存のアラートを管理します。
アラートテンプレート#
アラートテンプレートは、アラートのプロパティを定義するプロトタイプです。アラートは、監視対象オブジェクトの現在の状態をアラートテンプレートで指定されたしきい値と比較して、管理上の注意が必要な状況かどうかを判断するようにサーバーに指示します。
Alert Templates タブを使用して、カスタムアラートテンプレートを定義したり、既存のアラートテンプレートの定義を表示したりできます。 [ Alert Templates ]タブを開くには、[ Management > Manage Alerts ]を選択します。 [ Manage Alerts ]タブの[Quick Links]ツールバーで、[ Alert Templates ]を選択します。
Show System Template リストを使用して、Alert Templatesテーブルに表示されるアラートテンプレートをフィルタリングします。リストからPEM階層のレベルを選択して、そのレベルのすべてのテンプレートを表示します。
新しいアラートテンプレートの定義#
新しいアラートテンプレートを定義するには、 Show System Template リストから None を選択します。次に、アラートテンプレートテーブルの右上隅にあるプラス記号+をクリックします。アラートテンプレートエディターが開きます。
General タブのフィールドを使用して、テンプレートに関する一般的な情報を指定します。
Template name フィールドを使用して、新しいアラートテンプレートの名前を指定します。
Description フィールドを使用して、アラートテンプレートの説明を提供します。
Target type リストを使用して、アラートの焦点であるオブジェクトのタイプを選択します。
Applies to server リストを使用して、アラートを適用するサーバータイプEDB Postgres Advanced ServerまたはPostgreSQLを指定します。単一のサーバータイプまたは ALL を指定できます。
History recovery フィールドを使用して、PEMサーバーでアラートの実行の結果を保存する日数を指定します。
Thresholdunit フィールドを使用して、しきい値の単位タイプを指定します。
Auto create ボックスのフィールドを使用して、テンプレートを使用して自動アラートを生成するようにPEMが指定します。このオプションを有効にすると、PEMは、 ターゲットタイプ リストで指定された新しいサーバーまたはエージェントが追加されたときにアラートを作成し、ターゲットオブジェクトがドロップされたときにそのアラートを削除します。
Auto create? スライダーを Yes に設定して、テンプレートに基づいてアラートを作成するようにPEMに指定します。 Auto create? スライダーを Yes に変更して、既存のアラートテンプレートを変更すると、PEMは既存のエージェントとサーバーにアラートを作成します。スライダーを Yes から No に変更すると、既存のアラートのデフォルトのしきい値が消去され、復元することはできません。
Operator リストを使用して、演算子を選択します現在のシステム値を評価するときに使用するPEM。
システム値が しきい値 フィールドに入力された値より大きい場合にアラートをトリガーするには、大なり記号>を選択します。
小なり記号<を選択して、システム値が しきい値 フィールドに入力された値より小さい場合にアラートをトリガーすることを示します。
しきい値フィールドを使用して、システム値と比較するPEMの値を指定して、アラートを生成するかどうかを決定します。 3つのしきい値すべての値を指定する必要があります低、中、および高。
Check frequency フィールドを使用して、アラートを実行する間のデフォルトの分数を指定します。この値は、サーバーが定義で指定されたSQLコードを呼び出し、結果をテンプレートで指定されたしきい値と比較する頻度を指定します。
Probe dependency タブのフィールドを使用して、 SQL タブで指定されたSQLクエリーで参照されるプローブの名前を指定します。
Probes リストを使用して、使用可能なプローブのリストから選択します。
アラートテンプレートで使用されるプローブのリストにプローブを追加するには、プローブ名を選択し、 Add を選択します。
選択したプローブリストからプローブを削除するには、プローブ名を選択し、 Delete を選択します。
Parameters タブを使用して、 SQL タブで指定されたSQLコードで使用するパラメーターを定義します。プラス記号+を選択します。次に
Name フィールドを使用して、パラメーター名を指定します。
Data type リストを使用して、パラメーターのタイプを指定します。
Unit フィールドを使用して、指定された単位のタイプを指定しますパラメーターによる。
SQL タブの Code フィールドを使用して、アラートの実行時にサーバーが呼び出すSQLクエリのテキストを提供します。 SQLクエリーは、しきい値と比較する結果を提供します。アラート結果が指定されたしきい値から逸脱すると、アラートが発生します。
クエリでは、変数param_x を使用して、 Parameters
タブで定義されたパラメーターを順番に参照します。 x
は、パラメーターリスト内のパラメーター定義の位置を示します。たとえば、param_1はパラメーターリストの最初のパラメーターを参照し、param_2はパラメーターリストの2番目のパラメーターを参照します。
クエリーには、次の変数を含めることもできます。
Variable description |
Variable name |
|---|---|
agent identifier |
'${agent_id}' |
server identifier |
'${server_id}' |
database name |
'${database_name}' |
schema name |
'${schema_name}' |
Table |
'${object_name}' |
index |
'${object_name}' |
sequence |
'${object_name}' |
function name |
'${object_name}' |
Detailed Information SQL フィールドを使用して、アラートがトリガーされた場合に呼び出すSQLクエリーを提供します。クエリの結果セットは、詳細なアラート情報の一部として、アラートダッシュボードまたはグローバル概要ダッシュボードに表示される場合があります。
注釈
指定された照会がPEM階層のさまざまなレベルサーバー、データベース、スキーマなどの1つ以上のプローブに依存し、プローブが無効になる場合、結果のアラートは次のように表示されます。
アラート定義とクエリによって参照されるプローブがPEM階層内の同じレベルからのものである場合、サーバーはグローバルアラートダッシュボードのAlert Errorテーブルにアラートテンプレートを参照するアラートを表示します。 - アラート定義とクエリによって参照されるプローブがPEM階層の異なるレベルからのものである場合、サーバーは、アラートが定義された階層の[アラートの詳細]テーブルにアラートテンプレートを参照するトリガーされたアラートを表示します。
アラートテンプレート定義を保存し、テンプレート名をAlert Templatesリストに追加するには、 Save を選択します。カスタムアラートテンプレートを保存した後、[ Alerting ]ダイアログボックスを使用して、テンプレートに基づいてアラートを定義できます。
アラートテンプレートのエクスポートまたはインポート#
アラートテンプレートをエクスポートするには
Alert Templates タブからアラートテンプレートを選択します。
テーブルの右上隅にある Export を選択します。
Save File を選択します。
JSONファイルを生成するには、 OK を選択します。
アラートテンプレートをインポートするには
[ Alert Templates ]タブで、右上隅にある Import を選択します。
コードをインポートするJSONファイルを選択するには、 Browse を選択し、 Import を選択します。
インポートするファイルを選択した後、次のチェックボックスを選択できます。
Skip stable - 既に存在する場合、アラートテンプレートをスキップします。
Skip既存の依存プローブ - アラートテンプレートはプローブに依存しています。 。依存プローブが既に存在する場合、スキップするにはこのチェックボックスを選択します。
両方のチェックボックスが選択され、アラートテンプレートが既に存在する場合、アラートテンプレートのインポートはスキップされます。
Skip stable チェックボックスを選択せず、 Skip dependencies を選択し、アラートテンプレートが既に存在する場合、アラートテンプレートは正常にインポートされます。
両方のチェックボックスがオフで、アラートテンプレートが存在しない場合、アラートテンプレートは正常にインポートされます。
アラートテンプレートの変更または削除#
既存のテンプレートPEMの事前定義されたアラートテンプレートを含むの定義を表示するには、 Show System Template リストを使用して監視対象オブジェクトのタイプを選択します。オブジェクトタイプを選択すると、そのオブジェクトタイプに対応するアラートテンプレートがAlert Templatesテーブルに表示されます。
リストからテンプレート名を選択し、行の左端にある Edit を選択してテンプレート定義を確認します。
[ Alert Templates ]ダイアログボックスを使用して、アラートテンプレートに関する詳細情報を表示します。
General タブには、一般的な情報が表示されます。
Probe dependency タブには、テンプレートのデータを提供するプローブの名前がリストされます。
Parameters タブには、 SQLコードで参照されるパラメーターの名前がリストされます。
[ SQL ]タブには、アラートの動作を定義するSQLコードが表示されます。
アラートテンプレートを削除するには、アラートテンプレートテーブルでテンプレート名を選択し、テーブルの右上隅にある Delete を選択します。アラート履歴は、テンプレート定義の 履歴保持 フィールドで指定された時間持続します。
事前定義されたアラートテンプレート – リファレンス#
アラート定義には、PEMがシステム統計と比較するシステム定義またはユーザー定義の条件セットが含まれています。統計がその統計に指定された境界から逸脱すると、アラートがトリガーされ、PEMクライアントは[アラートの概要]ページに警告を表示し、オプションで監視ユーザーに通知を送信します。
以下の表は、アラートの作成に使用できるシステム定義のアラートテンプレートをリストしています。このリストは変更される場合があり、システムによって異なる場合があります。
エージェントに適用できるテンプレート#
Template name |
Description |
Probe dependency |
|---|---|---|
Load Average (1 minute) |
1分間のシステム負荷平均 |
load_average |
Load Average (5 minutes) |
5分間のシステム負荷平均 |
load_average |
Load Average (15 minutes) |
15分間のシステム負荷平均 |
load_average |
Load Average per CPU Core (1 minutes) |
CPUコアごとの1分間のシステム負荷平均 |
load_average |
Load Average per CPU Core (5 minutes) |
CPUコアごとの5分間のシステム負荷平均 |
load_average |
Load Average per CPU Core (15 minutes) |
CPUコアごとの15分間のシステム負荷平均 |
load_average |
CPU utilization |
平均CPU使用量 |
cpu_usage |
Number of CPUs running higher than a |
K%の使用率しきい値を超えて実行されているCPUの数 |
cpu_usage |
Free memory percentage |
合計システムメモリの割合としての空きメモリ |
memory_usage |
Memory used percentage |
使用されたメモリの割合 |
memory_usage |
Swap consumption |
消費されたスワップ領域メガバイト単位 |
memory_usage |
Swap consumption percentage |
消費されたスワップ領域の割合 |
memory_usage |
Disk Consumption |
消費されたディスク領域メガバイト単位 |
disk_space |
Disk consumption percentage |
消費されたディスクの割合 |
disk_space |
Disk Available |
使用可能なディスク領域メガバイト単位 |
disk_space |
Disk busy percentage |
ビジーなディスクの割合 |
disk_busy_info |
Most used disk percentage |
システムで最も使用されているディスクの使用率 |
disk_space |
Total table bloat on host |
ホスト上のテーブルによって浪費された合計領域MB単位 |
table_bloat, settings |
Highest table bloat on host |
ホスト上のテーブルによって浪費された最も多くの領域MB単位 |
table_bloat, settings |
Average table bloat on host |
ホスト上のテーブルによって浪費された平均領域MB単位 |
table_bloat, settings |
Table size on host |
ホスト上のテーブルのサイズMB単位 |
table_size |
Database size on host |
ホスト上のデータベースのサイズMB単位 |
database_size |
Number of ERRORS in the logfile on agent N in last X hours. |
過去X時間のエージェントNのログファイルのERRORSの数 |
N/A |
Number of ERRORS in the audit logfile on agent N in last X hours |
過去X時間のエージェントNの監査ログファイルのERRORSの数 |
N/A |
Number of WARNINGS in the logfile on agent N in last X hours |
過去X時間のエージェントNのログファイルのWARNINGの数 |
N/A |
Number of WARNINGS in the audit logfile on agent N in last X hours |
過去X時間のエージェントNの監査ログファイルのWARNINGの数 |
N/A |
Number of WARNINGS or ERRORS in the logfile on agent N in last X hours |
過去X時間のエージェントNのログファイルのWARNINGまたはERRORSの数 |
N/A |
Number of WARNINGS or ERRORS in audit the logfile on agent N in last X hours |
過去X時間のエージェントNのログファイルのWARNINGまたはERRORSの数 |
N/A |
Package version mismatch |
カタログごとにパッケージバージョンの不一致を確認します |
N/A |
Total materialized view bloat on host |
ホスト上のマテリアライズドビューによって浪費された合計領域MB単位 |
mview_bloat, settings |
Highest materialized view bloat on host |
ホスト上のマテリアライズドビューによって無駄にされる最大の領域MB単位 |
mview_bloat, settings |
Average materialized view bloat on host |
ホスト上のマテリアライズドビューによって浪費される平均領域MB単位 |
mview_bloat, settings |
Materialized view size on host |
ホスト上のマテリアライズドビューのサイズMB単位 |
mview_size |
Agent Down |
指定されたエージェントは現在ダウンしています |
N/A |
サーバーに適用できるテンプレート#
Template name |
Description |
Probe dependency |
|---|---|---|
Audit config mismatch |
監査構成パラメーターの不一致のチェック |
audit_configuration |
Average materialized view bloat in server |
サーバー内のマテリアライズドビューによって浪費される平均領域MB単位 |
mview_bloat, settings |
Average table bloat in server |
サーバー内のテーブルによって浪費された平均領域MB単位 |
table_bloat, settings |
Buffers allocated per second |
最後の2つのプローブサイクルで、1秒ごとに割り当てられたバッファーの数 |
background_writer_statistics |
Buffers written per second |
最後の2つのプローブサイクルで1秒ごとに書き込まれるバッファーの数 |
background_writer_statistics |
Committed transactions percentage |
過去N分間にコミットしたサーバー内のトランザクションとロールバックしたトランザクションの割合 |
database_statistics |
Conflicting replication slots |
特定のサーバーで競合しているスロットを確認する |
|
Connections in idle state |
サーバー内のアイドル状態にある接続の数 |
session_info |
Connections in idle-in-transaction state |
アイドル中トランザクション状態にあるサーバー内の接続の数 |
session_info |
Connections in idle-in-transaction state, as percentage of max_connections |
サーバーで許可される最大接続の割合としての、トランザクション中アイドル状態にあるサーバー内の接続の数、設定 |
session_info, settings |
Database size in server |
サーバー内のデータベースのサイズMB単位 |
database_size |
Dead Tuples |
サーバー内の推定デッドタプルの数 |
table_statistics |
Dead tuples percentage |
サーバー内の推定デッドタプルの割合 |
table_statistics |
EFM cluster failover detected |
フェールオーバーは、指定された時間内にEFMクラスターのフェールオーバーイベントが記録されると、トリガーされます。 |
failover_manager_node_status |
Function Count |
サーバー内のファンクションの合計数 |
oc_function |
Highest materialized view bloat in server |
サーバー内のマテリアライズドビューによって浪費された最も多くの領域MB単位 |
mview_bloat, settings |
Highest table bloat in server |
サーバー内のテーブルによって無駄にされた最も多くの領域MB単位 |
table_bloat, settings |
Hot update percentage |
過去N分間のサーバー内のホットアップデートの割合 |
table_statistics |
Inactive replication slots |
特定のサーバーで非アクティブなスロットを確認する |
|
Index Scans |
過去N分間のサーバー内のインデックススキャンの数 |
table_statistics |
Index size as a percentage of table size |
サーバー内のインデックスのサイズ、テーブルのサイズのパーセンテージ |
index_size, oc_index, table_size |
InfiniteCache buffers hit percentage |
過去N分間、InfiniteCacheによって満たされたサーバー内のブロック読み取り要求の割合 |
database_statistics |
Largest index by table-size percentage |
サーバー内の最大のインデックス、テーブルのサイズ、oc_index、table_sizeのパーセンテージとして計算されます。 |
index_size, oc_index, table_size |
Largest materialized view (by multiple of unbloated size) |
サーバー内で最大のマテリアライズドビュー。肥大化されていない独自の推定サイズの倍数として計算されます。 N MBより小さいマテリアライズドビューを除外する |
mview_bloat, settings |
Largest table (by multiple of unbloated size) |
サーバー内で最大のテーブル。肥大化されていない独自の推定サイズの倍数として計算されます。 N MBより小さいテーブルを除外する |
table_bloat, settings |
Last Analyze |
サーバーでの最後の分析からの時間 |
table_statistics |
Last AutoAnalyze |
サーバーでの最後の自動分析からの時間 |
table_statistics |
Last AutoVacuum |
サーバーでの最後の自動バキュームからの時間 |
table_statistics |
Last Vacuum |
サーバーでの最後のバキュームからの時間 |
table_statistics |
Live Tuples |
サーバー内の推定ライブタプルの数 |
table_statistics |
Log config mismatch |
ログ構成パラメーターの不一致のチェック |
log_configuration |
Long-running autovacuums |
N秒以上実行されているサーバー内の自動バキューム操作の数 |
session_info |
Long-running idle connections |
N秒以上アイドル状態になったサーバー内の接続の数 |
session_info |
Long-running idle connections and idle transactions |
N秒を超えてアイドル状態になったサーバー内の接続、またはトランザクション内アイドル状態のトランザクションの数 |
session_info |
Long-running idle transactions |
トランザクションでN秒を超えてアイドル状態になったサーバー内の接続の数 |
session_info |
Long-running queries |
N秒以上実行されているサーバー内のクエリーの数 |
session_info |
Long-running transactions |
N秒以上実行されているサーバー内のトランザクションの数 |
session_info |
Long-running vacuums |
N秒以上実行されているサーバー内のバキューム操作の数 |
session_info |
Materialized View Count |
サーバー内のマテリアライズドビューの合計数 |
oc_views |
Materialized view size in server |
サーバー内のマテリアライズドビューのサイズMB単位 |
mview_size |
Multixact ID exhaustion (wraparound) |
multixact IDの枯渇の確認ラップアラウンド |
|
Number of attacks detected in the last N minutes |
過去N分間に発生したSQLインジェクション攻撃の数 |
sql_protect |
Number of attacks detected in the last N minutes by username |
過去N分間に発生したユーザー名別のSQLインジェクション攻撃の数 |
sql_protect |
Number of ERRORS in the logfile on server M in the last X hours |
過去X時間のサーバーMのログファイルのERRORSの数 |
N/A |
Number of minutes lag of replica server from primary server |
ストリーミングレプリケーション レプリカノードがプライマリノードから遅れている分数 |
streaming_replication_lag_time |
Number of prepared transactions |
準備済み状態のトランザクションの数 |
number_of_prepared_transactions |
Number of replica servers lag behind the primary by flush location |
ストリーミングレプリケーション レプリカサーバーの数は、フラッシュロケーションごとにプライマリよりも遅れています |
streaming_replication |
Number of replica servers lag behind the primary by replay location |
ストリーミングレプリケーション レプリカサーバーの数は、再生場所ごとにプライマリよりも遅れています |
streaming_replication |
Number of replica servers lag behind the primary by write location |
ストリーミングレプリケーション レプリカサーバーの数は、書き込み場所ごとにプライマリよりも遅れています |
streaming_replication |
Number of users expiring in N days |
アカウントの有効期限がN日になるユーザーの数 |
user_info |
Number of users whose password expiring in N days |
パスワードの有効期限が切れた、またはN日で有効期限が切れるユーザーの数 |
user_info |
Number of WAL archives pending |
ストリーミングレプリケーション レプリカで再生保留中のWALファイルの数 |
wal_archive_status |
Number of WAL files |
先行書き込みログファイルの合計数 |
number_of_wal_files |
Number of WARNINGS in the logfile on server M in the last X hours |
過去X時間のサーバーMのログファイルのWARNINGの数 |
N/A |
Number of WARNINGS or ERRORS in the logfile on server M in the last X hours |
過去X時間のサーバーMのログファイルのWARNINGまたはERRORSの数 |
N/A |
Patroni cluster paused |
Patroni Patroniクラスターが一時停止され、フェールオーバーに使用できないかどうかを検出します。 |
patroni_cluster_status |
Patroni cluster failover detected |
Patroni フェールオーバーは、指定された時間内にPatroniクラスターのフェールオーバーイベントが記録されると、トリガーされます。 |
patroni_node_status |
Patroni DCS not healthy |
Patroni 分散構成ストアetcdが正常でないかどうかを検出します。 |
patroni_cluster_status |
Patroni down or out of contact |
Patroni Patroniプロセスが到達不能であるか、監視対象ノードで障害が発生しているかどうかを検出します。 |
patroni_cluster_status |
Patroni no leader detected |
Patroni Patroniクラスターにリーダー/マスターノードがない場合を検出します。 |
patroni_cluster_status |
Patroni timeline mismatch |
Patroni ノードのタイムラインがクラスタータイムラインと一致しないかどうかを検出します。 |
patroni_node_status, patroni_cluster_status |
Percentage of buffers written by backends |
バックエンドによって書き込まれたバッファーの割合と書き込まれた合計バッファーの割合 |
background_writer_statistics |
Percentage of buffers written by backends over the last N minutes |
バックエンドによって書き込まれたバッファの割合と最後のNのバッファバックエンドの合計 |
background_writer_statistics |
Percentage of buffers written by checkpoint |
チェックポイントによって書き込まれたバッファーの割合と書き込まれた合計バッファーの割合 |
background_writer_statistics |
PGD Group Raft Consensus |
PGDグループ Raftコンセンサスが機能しない |
bdr_monitor_group_raft |
PGD Group Raft Leader ID not matching |
PGDグループのRaftリーダーIDが一致しません |
bdr_group_raft_details |
PGD Group versions check |
PGDグループ内のPGD/pg論理バージョンが不一致です |
bdr_monitor_group_raft |
PGD worker error detected |
PGDノードで検出されたPGDワーカーエラーが報告されました |
|
Replica server lag behind the primary by flush location |
ストリーミングレプリケーション レプリカサーバーは、MB単位のフラッシュロケーションにより、プライマリよりも遅延します。 |
streaming_replication |
Replica server lag behind the primary by replay location |
ストリーミングレプリケーション レプリカサーバーは、MB単位の再生場所によりプライマリよりも遅延します。 |
streaming_replication |
Replica server lag behind the primary by size (MB) |
ストリーミングレプリケーション レプリカサーバーはMB単位のサイズでプライマリよりも遅延しています |
streaming_replication |
Replica server lag behind the primary by WAL pages |
ストリーミングレプリケーション レプリカサーバーはWALページごとにプライマリよりも遅延します |
streaming_replication |
Replica server lag behind the primary by WAL segments |
ストリーミングレプリケーション レプリカサーバーはWALセグメントごとにプライマリよりも遅延しています |
streaming_replication |
Replica server lag behind the primary by write location |
ストリーミングレプリケーション レプリカサーバーは、MB単位の書き込み場所によりプライマリよりも遅延します。 |
streaming_replication |
Sequence Count |
サーバー内のシーケンスの合計数 |
oc_sequence |
Sequential Scans |
過去N分間のサーバー内のフルテーブルスキャンの数 |
table_statistics |
Server Down |
指定されたサーバーは現在アクセスできません |
N/A |
Shared buffers hit percentage |
過去N分間、共有バッファによって満たされたサーバー内のブロック読み取り要求の割合 |
database_statistics |
Table Count |
サーバー内のテーブルの合計数 |
oc_table |
Table size in server |
サーバー内のテーブルのサイズMB単位 |
table_size |
Total connections |
サーバー内の合計接続数 |
session_info |
Total connections as percentage of max_connections |
サーバーで許可される最大接続の割合としてのサーバー内の合計接続数、設定 |
session_info, settings |
Total materialized view bloat in server |
サーバー内のマテリアライズドビューによって浪費された合計領域MB単位 |
mview_bloat, settings |
Total table bloat in server |
サーバー内のテーブルによって浪費された合計領域MB単位 |
table_bloat, settings |
Transaction ID exhaustion (wraparound) |
トランザクションIDの枯渇の確認ラップアラウンド |
|
Tuples deleted |
過去N分間にサーバーから削除されたタプル |
database_statistics |
Tuples fetched |
過去N分間にサーバーから取得されたタプル |
database_statistics |
Tuples hot updated |
過去N分間にサーバーでタプルがホット更新されました |
table_statistics |
Tuples inserted |
過去N分間にサーバーに挿入されたタプル |
database_statistics |
Tuples returned |
過去N分間にサーバーから返されたタプル |
database_statistics |
Tuples updated |
過去N分間にサーバーで更新されたタプル |
database_statistics |
Ungranted locks |
サーバー内の未付与のロックの数 |
blocked_session_info |
Unused, non-superuser connections |
サーバー上の未使用の非スーパーユーザー接続の数、user_info、設定 |
session_info, user_info, settings |
Unused, non-superuser connections as percentage of max_connections |
max_connections、user_info、settingsのmax_connectionsの割合としてのサーバー上の未使用の非スーパーユーザー接続の数 |
session_info, user_info, settings |
View Count |
サーバー内のビューの合計数 |
oc_views |
データベースに適用できるテンプレート#
Template name |
Description |
Probe dependency |
|---|---|---|
Total table bloat in database |
データベース内のテーブルによって浪費された合計領域MB単位 |
table_bloat, settings |
Largest table (by multiple of unbloated size) |
データベース内で最大のテーブル。肥大化していない独自の推定サイズの倍数として計算されます。 N MBより小さいテーブルを除外する |
table_bloat, settings |
Highest table bloat in database |
データベース内のテーブルによって浪費された最も多くの領域MB単位 |
table_bloat, settings |
Average table bloat in database |
データベース内のテーブルによって浪費された平均領域MB単位 |
table_bloat, settings |
Table size in database |
データベース内のテーブルのサイズMB単位 |
table_size |
Database size |
データベースのサイズMB単位 |
database_size |
Total connections |
データベース内の合計接続数 |
session_info |
Total connections as percentage of max_connections |
サーバーで許可される最大接続の割合としてのデータベース内の接続の合計数、設定 |
session_info, settings |
Ungranted locks |
データベース内の未付与のロックの数 |
blocked_session_info |
Connections in idle state |
データベース内のアイドル状態にある接続の数 |
session_info |
Connections in idle-in-transaction state |
データベース内のアイドルイントランザクション状態にある接続の数 |
session_info |
Connections in idle-in-transaction state,as percentage of max_connections |
サーバーで許可される最大接続の割合としての、トランザクション中アイドル状態にあるデータベース内の接続の数、設定 |
session_info, settings |
Long-running idle connections |
N秒以上アイドル状態であるデータベース内の接続の数 |
session_info |
Long-running idle connections and idle transactions |
N秒を超えてアイドルまたはトランザクション中アイドル状態であったデータベース内の接続の数 |
session_info |
Long-running idle transactions |
トランザクションでN秒を超えてアイドル状態になったデータベース内の接続の数 |
session_info |
Long-running transactions |
N秒以上実行されているデータベース内のトランザクションの数 |
session_info |
Long-running queries |
N秒以上実行されているデータベース内のクエリーの数 |
session_info |
Long-running vacuums |
N秒を超えて実行されたデータベースのバキューム操作の数 |
session_info |
Long-running autovacuums |
N秒以上実行されているデータベースの自動バキューム操作の数 |
session_info |
Committed transactions percentage |
過去N分間にコミットされたデータベース内のトランザクションとロールバックされたトランザクションの割合 |
database_statistics |
Shared buffers hit percentage |
過去N分間、共有バッファによって満たされたデータベース内のブロック読み取り要求の割合 |
database_statistics |
InfiniteCache buffers hit percentage |
過去N分間、InfiniteCacheによって満たされたデータベース内のブロック読み取り要求の割合 |
database_statistics |
Tuples fetched |
過去N分間にデータベースから取得されたタプル |
database_statistics |
Tuples returned |
過去N分間にデータベースから返されたタプル |
database_statistics |
Tuples inserted |
過去N分間にデータベースに挿入されたタプル |
database_statistics |
Tuples updated |
過去N分間にデータベースで更新されたタプル |
database_statistics |
Tuples deleted |
過去N分間にデータベースから削除されたタプル |
database_statistics |
Tuples hot updated |
過去N分間にデータベースのタプルがホット更新されました |
table_statistics |
Sequential Scans |
過去N分間のデータベースのフルテーブルスキャンの数 |
table_statistics |
Index Scans |
過去N分間のデータベースのインデックススキャンの数 |
table_statistics |
Hot update percentage |
過去N分間のデータベースのホット更新の割合 |
table_statistics |
Live Tuples |
データベース内の推定ライブタプルの数 |
table_statistics |
Dead Tuples |
データベース内の推定デッドタプルの数 |
table_statistics |
Dead tuples percentage |
データベース内の推定デッドタプルの割合 |
table_statistics |
Last Vacuum |
データベースの最後のバキュームからの時間 |
table_statistics |
Last AutoVacuum |
データベースの最後の自動バキュームからの時間 |
table_statistics |
Last Analyze |
データベースの最後の分析からの時間 |
table_statistics |
Last AutoAnalyze |
データベースの最後の自動分析からの時間 |
table_statistics |
Table Count |
データベース内のテーブルの合計数 |
oc_table |
Function Count |
データベース内のファンクションの合計数 |
oc_function |
Sequence Count |
データベース内の配列の合計数 |
oc_sequence |
Index size as a percentage of table size |
データベース内のインデックスのサイズ、テーブルのサイズのパーセンテージ |
table_size |
Largest index by table-size percentage |
テーブルのサイズ、oc_index、table_sizeのパーセンテージとして計算されたデータベース内の最大のインデックス |
index_size, oc_index, table_size |
Database Frozen XID |
データベースの凍結されたトランザクションIDの経過時間現在のトランザクションの前のトランザクション |
database_frozenxid |
Number of attacks detected in the last N minutes |
過去N分間に発生したSQLインジェクション攻撃の数 |
sql_protect |
Number of attacks detected in the last N minutes by username |
過去N分ごとにユーザー名ごとに発生したSQLインジェクション攻撃の数 |
sql_protect |
Queries that have been cancelled due to dropped tablespaces |
ストリーミングレプリケーション テーブルスペースが削除されたためにキャンセルされたクエリの数 |
streaming_replication_db_conflicts |
Queries that have been cancelled due to lock timeouts |
ストリーミングレプリケーション ロックタイムアウトのためにキャンセルされたクエリの数 |
streaming_replication_db_conflicts |
Queries that have been cancelled due to old snapshots |
ストリーミングレプリケーション 古いスナップショットが原因でキャンセルされたクエリの数 |
streaming_replication_db_conflicts |
Queries that have been cancelled due to pinned buffers |
ストリーミングレプリケーション 固定されたバッファのためキャンセルされたクエリの数 |
streaming_replication_db_conflicts |
Queries that have been cancelled due to deadlocks |
ストリーミングレプリケーション デッドロックのためにキャンセルされたクエリの数 |
streaming_replication_db_conflicts |
Total events lagging in all slony clusters |
Slonyレプリケーション すべてのSlonyクラスターで遅延しているイベントの合計 |
slony_cluster |
Events lagging in one slony cluster |
Slonyレプリケーション 1つのスロニークラスターで遅延しているイベント |
slony_cluster |
Lag time (minutes) in one slony cluster |
Slonyレプリケーション 1つのslonyクラスターでの遅延時間分 |
slony_cluster |
Total rows lagging in xdb single primary replication |
xDBレプリケーションxdbシングルプライマリレプリケーションの合計行遅延 |
xdb_smr_mmr_replication |
Total rows lagging in xdb multi primary replication |
xDBレプリケーションxdbマルチプライマリレプリケーションの合計行遅延 |
xdb_smr_mmr_replication |
Total materialized view bloat in database |
データベース内のマテリアライズドビューによって浪費された合計領域MB単位 |
mview_bloat, settings |
Largest materialized view (by multiple of unbloated size) |
データベース内の最大のマテリアライズドビュー。肥大化されていない推定サイズの倍数として計算されます。 N MBより小さいマテリアライズドビューを除外する |
mview_bloat, settings |
Highest materialized view bloat in database |
データベース内のマテリアライズドビューによって浪費された最も多くの領域MB単位 |
mview_bloat, settings |
Average materialized view bloat in database |
データベース内のマテリアライズドビューによって浪費された平均領域MB単位 |
mview_bloat, settings |
Materialized view size in database |
データベース内のマテリアライズドビューのサイズMB単位 |
mview_size |
View Count |
データベース内のビューの合計数 |
oc_views |
Materialized View Count |
データベース内のマテリアライズドビューの合計数 |
oc_views |
スキーマに適用できるテンプレート#
Template name |
Description |
Probe dependency |
|---|---|---|
Total table bloat in schema |
スキーマ内のテーブルによって浪費された合計領域MB単位 |
table_bloat, settings |
Largest table (by multiple of unbloated size) |
スキーマ内で最大のテーブル。肥大化されていない独自の推定サイズの倍数として計算されます。 N MBより小さいテーブルを除外する |
table_bloat, settings |
Highest table bloat in schema |
スキーマ内のテーブルによって浪費された最大領域MB単位 |
table_bloat, settings |
Average table bloat in schema |
スキーマ内のテーブルによって浪費された平均領域MB単位 |
table_bloat, settings |
Table size in schema |
スキーマ内のテーブルのサイズMB単位 |
table_size |
Tuples inserted |
過去N分間にスキーマに挿入されたタプル |
table_statistics |
Tuples updated |
過去N分間にスキーマで更新されたタプル |
table_statistics |
Tuples deleted |
過去N分間にスキーマから削除されたタプル |
table_statistics |
Tuples hot updated |
過去N分間にスキーマのタプルがホット更新されました |
table_statistics |
Sequential Scans |
過去N分間のスキーマのフルテーブルスキャンの数 |
table_statistics |
Index Scans |
過去N分間のスキーマのインデックススキャンの数 |
table_statistics |
Hot update percentage |
過去N分間のスキーマのホット更新の割合 |
table_statistics |
Live Tuples |
スキーマ内の推定ライブタプルの数 |
table_statistics |
Dead Tuples |
スキーマ内の推定デッドタプルの数 |
table_statistics |
Dead tuples percentage |
スキーマ内の推定デッドタプルの割合 |
table_statistics |
Last Vacuum |
スキーマの最後のバキュームからの時間 |
table_statistics |
Last AutoVacuum |
スキーマの最後の自動バキュームからの時間 |
table_statistics |
Last Analyze |
スキーマの最後の分析からの時間 |
table_statistics |
Last AutoAnalyze |
スキーマの最後の自動分析からの時間 |
table_statistics |
Table Count |
スキーマ内のテーブルの合計数 |
oc_table |
Function Count |
スキーマ内のファンクションの合計数 |
oc_function |
Sequence Count |
スキーマ内のシーケンスの合計数 |
oc_sequence |
Index size as a percentage of table size |
スキーマ内のインデックスのサイズ、テーブルのサイズのパーセンテージ |
table_size |
Largest index by table-size percentage |
テーブルのサイズ、oc_index、table_sizeのパーセンテージとして計算されるスキーマ内の最大のインデックス |
index_size, oc_index, table_size |
Materialized view bloat |
マテリアライズドビューによって無駄にされた領域MB単位 |
mview_bloat, settings |
Total materialized view bloat in schema |
スキーマのマテリアライズドビューによって浪費された合計領域MB単位 |
mview_bloat, settings |
Materialized view size as a multiple of unbloated size |
推定される肥大化されていないサイズの倍数としてのマテリアライズドビューのサイズ |
mview_bloat |
Largest materialized view (by multiple of unbloated size) |
スキーマ内の最大のマテリアライズドビュー。肥大化されていない独自の推定サイズの倍数として計算されます。 N MBより小さいマテリアライズドビューを除外する |
mview_bloat, settings |
Highest materialized view bloat in schema |
スキーマのマテリアライズドビューによって浪費される最大領域MB単位 |
mview_bloat, settings |
Average materialized view bloat in schema |
スキーマのマテリアライズドビューによって浪費される平均領域MB単位 |
mview_bloat, settings |
Materialized view size |
マテリアライズドビューのサイズMB単位 |
mview_size |
Materialized view size in schema |
スキーマのマテリアライズドビューのサイズMB単位 |
mview_size |
View Count |
スキーマ内のビューの合計数 |
oc_views |
Materialized View Count |
スキーマ内のマテリアライズドビューの合計数 |
ov_views |
Materialized View Frozen XID |
マテリアライズドビューの凍結されたトランザクションIDの経過時間現在のトランザクションの前のトランザクション |
mview_frozenxid |
テーブルに適用できるテンプレート#
Template name |
Description |
Probe dependency |
|---|---|---|
Table bloat |
テーブルによって無駄にされた領域MB単位 |
table_bloat, settings |
Table size |
テーブルのサイズMB単位 |
table_size |
Table size as a multiple of unbloated size |
推定される肥大化されていないサイズの倍数としてのテーブルのサイズ |
table_bloat |
Tuples inserted |
過去N分間にテーブルに挿入されたタプル |
table_statistics |
Tuples updated |
過去N分間にテーブルで更新されたタプル |
table_statistics |
Tuples deleted |
過去N分間にテーブルから削除されたタプル |
table_statistics |
Tuples hot updated |
過去N分間にテーブル内のタプルがホット更新されました |
table_statistics |
Sequential Scans |
過去N分間のテーブルのフルテーブルスキャンの数 |
table_statistics |
Index Scans |
過去N分間のテーブルのインデックススキャンの数 |
table_statistics |
Hot update percentage |
過去N分間のテーブル内のホット更新の割合 |
table_statistics |
Live Tuples |
テーブル内の推定ライブタプルの数 |
table_statistics |
Dead Tuples |
テーブル内の推定デッドタプルの数 |
table_statistics |
Dead tuples percentage |
テーブル内の推定デッドタプルの割合 |
table_statistics |
Last Vacuum |
テーブル上の最後のバキュームからの時間 |
table_statistics |
Last AutoVacuum |
テーブルの最後の自動バキュームからの時間 |
table_statistics |
Last Analyze |
テーブルでの最後の分析からの時間 |
table_statistics |
Last AutoAnalyze |
テーブルでの最後の自動分析からの時間 |
table_statistics |
Row Count |
テーブルの推定行数 |
table_statistics |
Index size as a percentage of table size |
テーブルのインデックスのサイズ、テーブルのサイズのパーセンテージ |
table_size |
Table Frozen XID |
テーブルの凍結されたトランザクションIDの経過時間現在のトランザクションの前のトランザクション |
table_frozenxid |
グローバルテンプレート#
Template name |
Description |
Probe dependency |
|---|---|---|
Agents Down |
最近報告されていないエージェントの数 |
N/A |
Servers Down |
現在アクセスできないサーバーの数 |
N/A |
Alert Errors |
エラー状態のアラートの数 |
N/A |
監査ログアラート#
PEMは、 Alertingダイアログを使用して、ERROR またはWARNING
ステートメントが特定のサーバーまたはエージェントのログファイルに書き込まれたときにトリガーされるアラートを作成できるアラートテンプレートを提供します。
Alertingダイアログを開くには、PEMクライアントオブジェクトブラウザツリーコントロールでサーバーまたはエージェントを選択し、
Management > Alerting を選択します。
特定のサーバーのログファイルにエラーまたは警告メッセージを通知するアラートを作成するには、次のいずれかのアラートテンプレートを使用するアラートを作成します。
過去X時間のサーバーMのログファイルのERRORSの数
過去X時間のサーバーMのログファイルのWARNINGの数
過去X時間のサーバーMのログファイルのエラーまたは警告の数
特定のエージェントのエラーまたは警告メッセージを通知するアラートを作成するには、次のいずれかのアラートテンプレートを使用するアラートを作成します。この機能は、EDB Postgres Advanced Serverでのみサポートされています。
過去X時間のエージェントMのログファイルのERRORSの数
過去X時間のエージェントMのログファイルのWARNINGの数
過去X時間のエージェントMのログファイルのエラーまたは警告の数
新しいアラートの定義#
PEMクライアントの Manage Alerts タブを使用して、アラートを定義、コピー、または管理します。 [ Manage Alerts ]タブを開くには、[ Management > Manage Alerts ]を選択します。
[ Manage Alerts ]タブには、PEMクライアントツリーで現在選択されているオブジェクトに定義されているアラートのテーブルが表示されます。 Alertsテーブルを使用して、既存のアラートを変更したり、新しいアラートを作成したりできます。
The Manage Alerts tab#
アラートエディターを開き、アラートを作成するには、テーブルの右上にあるプラス記号+を選択します。エディターが開きます。
General タブのフィールドを使用して、アラートに関する情報を提供します。
Name フィールドにアラートの名前を入力します。
Template リストを使用して、アラートのテンプレートを選択します。アラートテンプレートは、1つ以上のメトリックまたはパラメーターを使用して、PEMがユーザー指定のアラート境界を比較する値を生成するファンクションです。テンプレートファンクションによって返された値が、 演算子 および しきい値 フィールドで指定されたユーザー定義のアラートの境界内の値と評価された場合、PEM:
アラートを発生させますb_tran_4 通知を追加します表示されるアラートの概要b_tran_4 テンプレートで指定されたアクションを実行します
Enable? スイッチを使用して、アラートを有効にする Yes か、無効にする No を指定します。
Interval ボックスを使用して、アラート条件が満たされたかどうかをアラートが確認する頻度を指定します。 Minutes セレクターを使用して、間隔値を指定します。 Default スイッチを使用して、 Minutes 値を選択したテンプレートのデフォルト推奨値に設定またはリセットします。
History recovery ボックスを使用して、アラートによって収集されたデータをPEMが保存する日数を指定します。 Days セレクターを使用して、データを保存する日数を指定します。 Default スイッチを使用して、 Days 値をデフォルト値30日に設定またはリセットします。
しきい値 ボックスのコントロールを使用して、アラートのトリガー基準を定義します。 しきい値 フィールドで指定された値がシステム値演算子で指定より大きいまたは小さいと評価されると、PEMは低、中、または高のアラートレベルを引き上げます。
Operator リストを使用して、現在のシステム値を評価するときに使用するPEMの演算子を選択します。
システム値が入力された値より大きい場合にアラートをトリガーするには、大なり記号>を選択します しきい値 フィールド.
システム値が しきい値 フィールドに入力された値より小さい場合にアラートをトリガーするには、小なり記号<を選択します。
Threshold フィールドを使用して、システム値と比較するPEMの値を指定して、アラートを生成するかどうかを決定します。 3つのしきい値すべての値を指定する必要があります低、中、および高。
Parameter Optionsテーブルには、選択したテンプレートに必要なパラメーターのリストが含まれています。テーブルには、事前定義されたパラメーターと値を指定する必要があるパラメーターの両方が表示されます。 Value 列にプロンプトを表示するパラメーターの値を指定する必要があります。
PEMは、アラートがトリガーされた場合、またはアラートがクリアされた場合に、通知を送信したり、スクリプトを実行したりできます。 Notification タブを使用して、アラートが生成された場合にPEMがどのように動作するかを指定します。
電子メール通知 ボックスを使用して、指定したレベルでアラートがトリガーされた場合に電子メール通知を受信する電子メールグループを指定します。 メールグループの作成 タブを使用して、アラートがトリガーされたときに通知するユーザーのアドレスを含むメールグループを作成します。 [ Send the notifications ]タブにアクセスするには、[ Manage Alerts ]タブの[ Quick Links ]メニューにある Email Groups を選択します。
特定のアラートレベルに到達したときに電子メールを送信するようにPEMに指示するには、アラートレベルの横にあるスライダーを Yes に設定します。リストを使用して、通知する事前定義されたユーザーまたはグループを選択します。
PEMが電子メール通知を送信する前に、SMTPサーバーを使用して電子メールを配信するようにPEMサーバーを構成する必要があります。
指定したレベルでアラートがトリガーされる場合、 Webhook notification ボックスを使用して1つ以上のエンドポイントを指定します。 Webhook を使用して、アラートがトリガーされたときに通知を受信するWebhookエンドポイントを作成します。 [ Webhooks ]タブにアクセスするには、[ Manage Alerts ]タブの[ Quick Links ]メニューにある Webhooks を選択します。
アラート通知をWebhookエンドポイントに送信するには、 Enable? を Yes に設定します。
要件に従ってカスタマイズされたアラートレベルを設定するには、 Overridedefault configuration? を Yes に設定します。 Yes に設定すると、すべてのアラートレベルの構成が有効になります。
リストを使用して、 低アラート? 、 中程度のアラート? 、 高アラート? 、および クリアされたアラート? の通知を送信する事前定義されたエンドポイントを選択します。
Trap notification オプションを使用して、このアラートのトラップ通知を構成します。
このアラートの状態が変更されたときにSNMPトラップ通知を送信するには、 Send attempts を Yes に設定します。
SNMPバージョンを識別するには、 SNMP Ver を v1 、 v2 、または v3 に設定します。
低アラート 、 中アラート 、および 高アラート スライダーを使用して、トラップをトリガーするアラートレベルを選択します。たとえば、 高アラート の横にあるスライダーを Yes に設定すると、高重大度レベルのアラートがトリガーされたときにPEMは通知を送信します。
通知を送信する前に、SNMPトラップ/通知レシーバーに通知を送信するようにPEMサーバーを構成する必要があります。 SNMP v3トラップを送信するために、PEMエージェントはSNMPパケットの認証、暗号化、および復号化を担当する’User Security Model(USM)’を使用します。
SNMP v3トラップの送信中に、エージェントはsnmp_boot_counter
ファイルを作成します。このファイルは、 agent.cfg
のbatch_script_dir
パラメーターで指定された場所に作成されます。このパラメーターが構成されていない場合、または認証制限のためディレクトリにアクセスできない場合、ファイルはオペレーティングシステムの一時ディレクトリに作成されます。それも不可能な場合、ファイルはホームディレクトリに作成されます。
Nagios notification ボックスを使用して、アラートがトリガーまたはクリアされたときにNagiosネットワークアラートソフトウェアに通知するようにPEMサーバーに指示します。詳細はこちら NagiosでPEMを使用する
アラートがトリガーまたはクリアされたときにNagiosに通知するには、 Submit Passive service check result to Nagios スイッチを Yes に設定します。
Script attempts ボックスを使用して、アラートがトリガーされた場合に実行するスクリプトをオプションで定義し、スクリプトの実行に関する詳細を指定します。
Execute script スライダーを Yes に設定して、アラートがトリガーされた場合に提供されたスクリプトを実行するようにPEMに指示します。
Execute on agent individually スライダーを Yes に設定して、アラートをトリガーした状況が解決されたときに提供されたスクリプトを実行するようにPEMに指示します。
Execute script on オプションを使用して、PEMサーバーまたは監視対象サーバーで実行するスクリプトを示します。
Code フィールドに、実行するPEMのスクリプトを入力します。バッチ/シェルスクリプトを提供できます。スクリプトでは、次のプレースホルダーを使用できます。
%AlertName% - トリガーされたアラートの名前。
%ObjectName% -
アラートがトリガーされたサーバーまたはエージェントの名前。
%ThresholdValue% -
アラートがトリガーされたときにメトリックが到達したしきい値。
%CurrentValue% - アラートをトリガーしたメトリックの現在値。
%CurrentState% - アラートの現在の状態。
%OldState% - アラートの以前の状態。
%AlertRaisedTime% -
アラートが発生した時間、またはアラート状態が変更された最新の時間。
Linuxシステムでスクリプトを呼び出すには、agent.cfg
ファイルのbatch_script_user
パラメーターのエントリーを変更し、スクリプトの実行に使用するユーザーを指定する必要があります。このパラメーターには、非rootユーザーまたはrootを指定できます。ユーザーを指定しない場合、または指定されたユーザーが存在しない場合、スクリプトは実行されません。ファイルを変更した後、エージェントを再起動します。
Windowsシステムでスクリプトを呼び出すには、AllowBatchJobSteps
のレジストリエントリをtrueに設定し、PEMエージェントを再起動します。
PEMレジストリエントリはHKEY_LOCAL_MACHINE\Software\EnterpriseDB\PEM\agent
にあります。
アラート属性を定義したら、 Edit を選択してアラート定義エディターを閉じ、Alertsテーブルの右上隅にある Save を選択します。
変更を破棄するには、 Refresh を選択します。変更を破棄することを確認するメッセージが表示されます。
注釈
外部スクリプトでアラート構成プレースホルダー値を使用する必要があるとします。これは、コマンドライン引数として渡すか、環境変数としてエクスポートすることにより実行できます。外部スクリプトには、適切な実行権限が必要です。
プレースホルダーをコマンドライン引数として使用してスクリプトを実行できます。
例
#!/bin/bash
bash <path_to_script>/script.sh "%AlertName% %AlertLevel% %AlertDetails%"
プレースホルダーの環境変数を定義し、スクリプトでそれらの環境変数を使用できます。
例
#!/bin/bash
export AlertName=%AlertName%
export AlertState=%AlertState%
bash <path_to_script>/script.sh
アラートの変更#
Alertsテーブルを使用して、既存のアラートを管理するか、新しいアラートを作成します。 PEMクライアントツリーでオブジェクトを選択して、そのオブジェクトを監視するアラートを表示します。
Alertsテーブルでアラートの一部のプロパティを変更できます。
[Alert name]列には、アラートの名前が表示されます。アラート名を変更するには、テーブル内の名前を置き換えて、 Save を選択します。
アラートテンプレート列には、アラートで使用されるプロパティを指定するアラートテンプレートの名前が表示されます。リストを使用して、アラートに関連付けられているアラートテンプレートを変更できます。
Alert allow? スイッチを使用して、アラートを有効にする Yes か、無効にする No かを指定します。
Interval列を使用して、PEMがアラート条件が満たされるかどうかをチェックする頻度を指定します。 Default スイッチを No に設定し、代替値を分単位で指定します。または、 Default スイッチを Yes に設定して、値をデフォルト設定にリセットします。デフォルトでは、PEMは1分ごとに各アラートのステータスを確認します。
History recovery フィールドを使用して、アラートによって収集されたデータをPEMが保存する日数を指定します。 Default スイッチを No に設定し、日単位の代替値を指定します。または、 Default スイッチを Yes に設定して、値をデフォルト設定にリセットします。デフォルトでは、PEMは30日間の履歴データを保存します。
アラートを変更した後、テーブルの右上隅にある Save を選択して変更を保存します。
他のアラート属性を変更するには、アラート名の左側にある Edit を選択してエディターを開きます。エディターは、完全なアラート定義へのアクセスを提供します。
[ Alert Details ]ダイアログボックスを使用して、選択したアラートの定義を変更します。アラート定義を変更した後、[ Save ]を選択します。
アラートの削除#
削除するアラートをマークするには、 Alertsテーブルでアラート名前を選択します。次に、名前の左側にある Delete を選択します。アラートはリストに赤い取り消し線フォントで残ります。
Delete はトグルです。 2回目に選択すると、削除を元に戻すことができます。アラート定義を永続的に検出するには、 Save を選択します。
アラートのコピー#
PEMシステムでのアラートの展開を高速化するために、1つのオブジェクトから1つ以上のターゲットオブジェクトにアラート定義をコピーできます。
オブジェクトからアラートをコピーするには、メインPEMウィンドウのPEMクライアントツリーでオブジェクトを選択します。次に、 Management > Copy Alerts を選択します。 [ Manage Alerts ]タブで、[Quick Links]ツールバーから[ Copy Alerts ]を選択します。
Copy Alert Configurationダイアログボックスは、PEMクライアントツリーで選択したオブジェクトからダイアログボックスで選択したオブジェクトにすべてのアラートをコピーします。ツリーを展開して、ターゲットオブジェクトとして指定するノードを選択します。ツリーには、ソースオブジェクトの横に赤い警告インジケータが表示されます。
アラートを一度に複数のオブジェクトにコピーするには、ターゲットの親ノードを選択します。たとえば、1つのテーブルからスキーマ内のすべてのテーブルにアラートをコピーするには、スキーマの横にあるチェックボックスをオンにします。 PEMは、ソースオブジェクトと同じタイプのターゲットにのみアラートをコピーします。
PEMがコピーされるものと同じ名前のターゲットオブジェクトの既存のアラートを更新しないようにするには、 Ignore Duplications を選択します。
既存のアラートをソースオブジェクトからの同じ名前のアラートに置き換えるには、 Replace promotes を選択します。
Delete Existing Alerts を選択して、ターゲットオブジェクトからすべてのアラートを削除し、すべてのアラートをソースオブジェクトからターゲットオブジェクトにコピーします。
Configure Alerts を選択して、ソースオブジェクトからCopy Alert Configurationダイアログボックスで選択したオブジェクトまたはその下にある同じタイプのすべてのオブジェクトにアラートをコピーします。
アラートブラックアウトをスケジュールする#
Management > Schedule Alert Blackout を使用して、メンテナンス中にPostgresサーバーとPEMエージェントのアラートブラックアウトをスケジュールできます。定義されたブラックアウト期間中にアラートは生成されません。
アラートブラックアウトをスケジュールするには、 Management > Schedule Alert Blackout を選択します。
Schedule Alert Blackoutダイアログボックスで、タブを使用してサーバーとエージェントのブラックアウト期間を定義します。 [ Server ]タブで、行を追加するには、右上隅にあるプラス記号+を選択します。
[ Server ]タブを使用して、アラートのブラックアウト期間に関する情報を提供します。ブラックアウト期間を保存した後、編集することはできません。
開始時刻 フィールドを使用して、アラートブラックアウトを開始する日時を提供します。
Duration フィールドを使用して、アラートをブラックアウトする間隔を提供します。
Servers フィールドを使用して、アラートをブラックアウトするサーバー名を提供します。複数のサーバーを選択して、それらのすべてのサーバーのアラートをブラックアウトすることもできます。
詳細を入力したら、[ Save ]を選択します。アラートは、そのサーバーのスケジュールされた間隔でアラートダッシュボードに表示されません。
ダイアログボックスの エージェント タブを使用して、PEMエージェントのブラックアウト期間をスケジュールすることもできます。行を追加するには、 Agent タブで、右上隅にあるプラス記号+を選択します。
[ Agent ]タブを使用して、アラートのブラックアウト期間に関する情報を提供します。ブラックアウト期間を保存した後、編集することはできません。
開始時刻 フィールドを使用して、アラートブラックアウトを開始する日時を提供します。
Duration フィールドを使用して、アラートをブラックアウトする間隔を提供します。
Agents フィールドを使用して、アラートを黒く塗りつぶすエージェントの名前を提供します。そのエージェントにバインドされたサーバーのすべてのサーバーレベルのアラートがブラックアウトします。
詳細を入力したら、 Save を選択して詳細を保存します。アラートは、そのPEMエージェントのスケジュールされた間隔でアラートダッシュボードに表示されません。
ダイアログボックスの右上隅から Clone を選択して、アラートブラックアウトのスケジュールを複製できます。選択したすべてのサーバーまたはエージェントのクローンコピーを作成するには、クローンを作成するサーバーまたはエージェントを選択し、 Clone を選択します。必要に応じて、新しく作成したスケジュールを編集し、 Save を選択できます。
ダイアログボックスの右上隅から Delete を選択して、スケジュールされたアラートブラックアウトを削除します。サーバーまたはエージェントを選択し、 Delete を選択します。
スケジュールされたアラートブラックアウトを削除するサーバーを選択し、 Delete を選択します。サーバーは、その行を削除する前に確認を求めます。
リセット を選択して、[アラートブラックアウト]ダイアログボックスの詳細をデフォルト設定にリセットできます。保存されたブラックアウトは影響を受けません。
スケジュールが実行されると、 pem スキーマのevent_history
テーブルからスケジュールされたアラートのブラックアウトの詳細を表示できます。詳細については、
Monitoring event history を参照してください。