Benchmarking datasets
=====================

Lakehouse ノードをプロビジョニングすると、サンプルのベンチマーク
データセットを含む AWS us-east-1 のパブリック S3
バケットを指すように事前構成されます。

..  note::
   これらのデータセットにアクセスすると、データ転送のコストが発生し、リージョン間の遅延が発生する可能性があります。

これらのデータセット内のテーブルをスキーマ名で参照することでクエリできます。

.. csv-table::
  :header: Schema name,Dataset
  :widths: 10,30
  :align: left
  :class: longtable

  `tpcds_sf_1`,"TPC-DS, Scale Factor 1"
  `tpcds_sf_10`,"TPC-DS, Scale Factor 10"
  `tpcds_sf_100`,"TPC-DS, Scale Factor 100"
  `tpcds_sf_1000`,"TPC-DS, Scale Factor 1000"
  `tpch_sf_1`,"TPC-H, Scale Factor 1"
  `tpch_sf_10`,"TPC-H, Scale Factor 10"
  `tpch_sf_100`,"TPC-H, Scale Factor 100"
  `tpch_sf_1000`,"TPC-H, Scale Factor 1000"
  `clickbench`,"ClickBench, 100 million rows"
  `brc_1b`,Billion row challenge

!!!note「ClickBenchデータに関する注意事項」

データ列 (``EventData`` ) は日付ではなく整数です。

ClickBenchの列名には大文字が含まれているため、引用符で囲む必要がありますが、Postgresでは引用符で囲まれていない識別子は大文字と小文字を区別しません。例：

✅ ``select "Title" from clickbench.hits;``

🚫 ``select Title from clickbench.hits;`` !!!
