- PostgreSQL のテーブルから読み取るために
PostgreSQLテーブルエンジンを使用する方法 - PostgreSQL のデータベースを ClickHouse のデータベースと同期するために、実験的な
MaterializedPostgreSQLデータベースエンジンを使用する方法
PostgreSQL テーブルエンジンを使用する
PostgreSQL table engineを使用すると、ClickHouse からリモートの PostgreSQL server に保存されているデータに対して、SELECT および INSERT 操作を実行できます。
この記事では、1 つのテーブルを使ったインテグレーションの基本的な方法を説明します。
1
PostgreSQL のセットアップ
postgresql.confに次のエントリを追加して、PostgreSQL がネットワークインターフェイスで接続を受け付けるようにします:
- ClickHouse から接続するためのユーザーを作成します。デモンストレーション用として、この例では完全なスーパーユーザー権限を付与します。
- PostgreSQL で新しいデータベースを作成します:
- 新しいテーブルを作成します:
- テスト用に数行追加してみましょう:
- レプリケーション用に、新しいユーザーによる新しいデータベースへの接続を許可するよう PostgreSQL を設定するには、次のエントリを
pg_hba.confファイルに追加します。アドレス行は、お使いの PostgreSQL server のサブネットまたは IP アドレスに合わせて更新してください:
pg_hba.confの設定を再読み込みします (バージョンに応じてこのコマンドを調整してください) :
- 新しい
clickhouse_userがログインできることを確認します:
この機能を ClickHouse Cloud で使用している場合は、ClickHouse Cloud の IP アドレスからご利用の PostgreSQL インスタンスへアクセスできるように許可する必要がある場合があります。
エグレストラフィックの詳細については、ClickHouse の Cloud Endpoints API を確認してください。
2
ClickHouse にテーブルを定義する
clickhouse-clientに接続します:
- 新しいデータベースを作成しましょう:
PostgreSQLを使用するテーブルを作成します:
パラメータの完全な一覧については、PostgreSQL テーブルエンジンのドキュメントページを参照してください。
3
インテグレーションをテストする
- ClickHouse で初期状態の行を確認します:
- PostgreSQL に戻り、テーブルに数行追加します。
- この 2 行の新しい行が ClickHouse のテーブルに表示されるはずです。
- ClickHouseのテーブルに行を追加すると何が起こるか見てみましょう:
- ClickHouse で追加した行が、PostgreSQL のテーブルに表示されるはずです:
PostrgeSQL テーブルエンジンを使用して、PostgreSQL と ClickHouse の基本的なインテグレーションを紹介しました。
スキーマの指定、一部のカラムだけを返す方法、複数のレプリカへの接続など、さらに多くの機能については、PostgreSQL テーブルエンジンのドキュメントページを参照してください。あわせて、ClickHouse and PostgreSQL - a match made in data heaven - part 1 のブログもご覧ください。MaterializedPostgreSQL データベースエンジンを使用する
psql) と ClickHouse CLI (clickhouse-client) を使用します。PostgreSQL サーバーは Linux にインストールされているものとします。以下は、PostgreSQL データベースが新規のテストインストールである場合の最小構成です
1
PostgreSQL で
postgresql.confで、最小の listen レベル、レプリケーション用の wal level、および replication slots を設定します。
wal level が少なくとも logical であり、レプリケーションスロットが少なくとも 2 つ必要です- 管理者アカウントを使用して、ClickHouse から接続するユーザーを作成します:
- 新しいデータベースを作成します:
psqlで新しいデータベースに接続します:
- 新しいテーブルを作成します:
- 初期の行を追加します:
- 新しいユーザーが新しいデータベースにレプリケーション用で接続できるよう、PostgreSQL を設定します。以下は、
pg_hba.confファイルに追加する最小限のエントリです。
- 次のように
pg_hba.confの設定を再読み込みします (使用しているバージョンに合わせて調整してください) :
- 新しい
clickhouse_userでのログインをテストします:
2
ClickHouse で
- ClickHouse CLI にログインします
- PostgreSQL データベースエンジンの実験的機能を有効にします:
- レプリケーション対象の新しいデータベースを作成し、初期テーブルを定義します:
PostgreSQL データベースエンジンの完全なガイドは、https://clickhouse.com/docs/engines/database-engines/materialized-postgresql/#settings を参照してください
- 初期テーブルにデータがあることを確認します:
3
基本的なレプリケーションをテストする
- PostgreSQL で新しい行を追加します:
- ClickHouse で、新しい行が表示されることを確認します:
4
まとめ
このインテグレーションガイドでは、テーブルを含むデータベースをレプリケートする方法のシンプルな例に焦点を当てましたが、データベース全体をレプリケートしたり、既存のレプリケーションに新しいテーブルやスキーマを追加したりする、より高度なオプションもあります。このレプリケーションでは DDL コマンドはサポートされていませんが、構造変更が行われた際に変更を検出してテーブルを再読み込みするようエンジンを設定できます。
高度なオプションで利用できるその他の機能については、リファレンスドキュメントを参照してください。