Introduction#
始めましょう#
Analytics Accelerator compatibility サポートされているPostgreSQLバージョン、オペレーティングシステム、およびその他の要件を確認します。
Analytics Accelerator architecture コアアーキテクチャとベクトル化されたエンジンがどのように動作するかを理解します。
Concepts ベクトル化された実行、データレイク統合、およびDirectScanの基本原理を理解します。
Analytics Accelerator quickstart guide PGAAをインストールし、保存場所を作成し、サンプルベンチマークデータセットからテーブルを読み取ります。
PGAAを使用する#
Installing Analytics Accelerator 拡張機能をインストールし、Seafowlバックグラウンドワーカーを有効にするためのステップバイステップの手順。
Configuring storage locations PGAAをAWS S3、GCS、およびAzure Blobストレージに安全に接続する方法。
Reading tables in object storage S3、GCS、またはAzure Blob Storageに直接接続し、PGFSストレージ場所を介してParquet、Delta、またはIcebergファイルを照会します。
Integrating with Iceberg catalogs 外部のIceberg RESTカタログと統合して、テーブルメタデータを管理します。
Writing to object storage
CREATE TABLE AS SELECTCTASを使用して、Postgresデータをオブジェクトストアに最適化されたレイクハウス形式にエクスポートします。
パフォーマンスと最適化#
Accelerate with Spark 大規模なデータセットと複雑な分散結合をSpark Connectを介してリモートSparkクラスターにオフロードします。
Monitoring and maintaining analytical tables ストレージ使用率の監査、テーブルの状態の監視、およびPGAA管理テーブルのテーブルメンテナンスタスクを実行します。
Optimizing query performance DirectScanの実行の管理、コンピューティングプッシュダウンの構成、およびパスフォールバックのトラブルシューティングにより、クエリ速度を最大化します。
リファレンス#
Configuration parameters PGAA拡張機能の動作は、Grand Unified ConfigurationGUC変数によって制御されます。これらのパラメーターを使用すると、エグゼキューターを切り替え、パフォーマンスの最適化を有効にし、セキュリティ資格情報を管理できます。
Functions PGAAは、新しいテーブルのマッピング、ストレージの状態の監視、メンテナンスバックグラウンドジョブの起動などの管理タスクのためのSQLファンクションスイートを導入しています。
Table options 分析テーブルをマッピングまたは作成するときに、特定のオプションを使用して、オブジェクトストアからデータを読み取る方法、またはオブジェクトストアにデータを書き込む方法を定義できます。
Data types and definitions PGAAは、ネイティブのPostgresデータ型をデータレイクの最適化されたカラムナー形式にマップします。
Benchmark datasets 分析データセットの事前構成されたスキーマとデータのロード指示にアクセスして、パフォーマンスのベースラインを設定します。