EDB Postgres Lakehouse
======================

EDB Postgres® Lakehouse は、Postgres ベースの分析に最新のレイクハウス
アーキテクチャをもたらします。

Apache Iceberg や Delta Lake などのオープン
テーブル形式を使用して、オブジェクト ストレージ (S3 互換)
に保存されたデータに対して高速なSQLベースの分析を可能にします。

Hybrid Manager (HM) での実装と管理については、 `EDB Postgres Lakehouse <https://enterprisedb.com/docs/edb-postgres-ai/hybrid-manager/analytics/lakehouse>`_ 
を参照してください。

EDB Postgres Lakehouseとは
--------------------------

EDB Postgres Lakehouse は、次のようなアーキテクチャ
パターンと機能のセットです。

- Postgres を最新のレイクハウスパターンと統合する

- オブジェクトストレージ内のデータに対して高速かつスケーラブルな分析を提供する

- ベクトル化されたクエリ実行と列指向のストレージ形式を使用する

- 相互運用性とデータガバナンスのためにオープンテーブル形式を活用する

関連概念: :ref:`データレイクハウス <データレイクハウス>` 

Lakehouse が EDB 分析にとって重要な理由
---------------------------------------

Lakehouse を使用すると、Analytics Accelerator
ユーザーは次のことが可能になります。

- オブジェクト ストレージ上で高速SQL分析を実行 - データ移動は不要

- コスト効率を高めるためにストレージとコンピューティングを分離する

- 外部ツール（Spark、Trino、Flink、データサイエンスフレームワーク）との相互運用性をサポート

- PGD階層化テーブルのクエリをIcebergにシームレスにオフロード

- Postgres を中心とした統合 OLTP + OLAP アーキテクチャを実現します

関連概念: :ref:`Analytics Accelerator concepts <Analytics Accelerator concepts>` 

EDBがレイクハウスアーキテクチャを実装する方法
---------------------------------------------

コアコンポーネント:

- **EDB Postgres Lakehouse ノード** :

- ステートレス分析コンピューティングノード

- ハイブリッドマネージャー（HM）またはセルフマネージドでプロビジョニングおよび管理

- **ベクトル化されたクエリエンジン** :

- `Apache DataFusion <https://datafusion.apache.org/>`_  によって提供

- Parquetやその他の列指向形式でデータを効率的に処理します

- **PGAA** :

- Lakehouse の動作を有効にする Postgres 拡張機能:

- 氷山とデルタ湖を見渡す外部テーブル

- PGDホットデータとオフロードされたコールドデータへの統合アクセス

- **PGFS** :

- オブジェクトストレージへの統合アクセス層

- S3、GCS、MinIO、Azure Data Lake Storage、および互換システムをサポート

- **オープンテーブル形式** :

- Apache Iceberg（カタログを含む完全サポート）

- Delta Lake（読み取り専用サポート）

関連概念:

- :ref:`ストレージとコンピューティングの分離 <ストレージとコンピューティングの分離>` 

- :ref:`ベクトル化されたクエリエンジン <ベクトル化されたクエリエンジン>` 

- :ref:`列指向ストレージ形式 <列指向ストレージ形式>` 

- :ref:`オープンテーブル形式 <オープンテーブル形式>` 

一般的な使用例
--------------

.. csv-table::
  :header: Use case,EDB Postgres Lakehouse capability
  :widths: 10,30
  :align: left
  :class: longtable

  Business intelligence & reporting,"Run fast, scalable SQL on data in object storage"
  Historical analytics,Seamlessly query offloaded PGD Tiered Tables
  Data lake analytics,Query existing Iceberg and Delta Lake tables without ETL
  Data science pipelines,Provide efficient access to training data and features
  Hybrid architectures,Enable Postgres-centered OLTP + OLAP patterns

役割ベースのガイダンス
----------------------

データベース管理者（DBA）

- :ref:`Analytics Accelerator for your role: DBA <a persona-based guide>` 

データサイエンティスト/アナリスト

- :ref:`Analytics Accelerator for your role: Data scientist / analyst <a persona-based guide>` 

DevOps / SRE

- :ref:`Analytics Accelerator for your role: DevOps / SRE <a persona-based guide>` 

アプリケーション開発者

- :ref:`Analytics Accelerator for your role: Application developer <a persona-based guide>` 

学習パス
--------

- :ref:`Analytics Accelerator 101: Foundational concepts <Foundational concepts>` 

- :ref:`Analytics Accelerator 201: Practical application and core solutions <Practical application and core solutions>` 

- :ref:`Analytics Accelerator 301: Advanced techniques and optimization <Advanced techniques and optimization>` 

関連概念
--------

- :ref:`データレイクハウス <データレイクハウス>` 

- :ref:`ストレージとコンピューティングの分離 <ストレージとコンピューティングの分離>` 

- :ref:`ベクトル化されたクエリエンジン <ベクトル化されたクエリエンジン>` 

- :ref:`列指向ストレージ形式 <列指向ストレージ形式>` 

- :ref:`オープンテーブル形式 <オープンテーブル形式>` 

次のステップ
------------

ハイブリッドマネージャーユーザー向け

- `EDB Postgres Lakehouse <https://enterprisedb.com/docs/edb-postgres-ai/hybrid-manager/analytics/lakehouse>`_ 

ハウツーガイド

- :ref:`Create a Lakehouse cluster <EDB Postgres Lakehouse>` 

- :ref:`Query existing Apache Iceberg tables <Apache Iceberg>` 

- `Query Delta Lake tables <https://enterprisedb.com/docs/edb-postgres-ai/hybrid-manager/analytics/learn/how-to/query-delta-lake-tables>`_ 

`Analytics Accelerator learning guide <https://enterprisedb.com/docs/edb-postgres-ai/hybrid-manager/analytics/learn/>`_  でさらに詳しく調べてください。
