SELECT 和 INSERT 查询。
语法
参数
参数也可以通过命名集合传递。在这种情况下,需要分别指定
host 和 port。建议在生产环境中使用这种方式。
返回值
在
INSERT 查询中,为了将表函数 postgresql(...) 与带列名列表的表名区分开,必须使用关键字 FUNCTION 或 TABLE FUNCTION。请参见下面的示例。设置
postgresql 表函数 (以及 PostgreSQL 表引擎) 使用的连接池,可以通过在语句末尾添加 SETTINGS 子句来配置。未指定某项设置时,默认采用对应查询级别 postgresql_* 设置的值。有关 postgresql_connection_pool_* 和 postgresql_connection_attempt_timeout 设置及其默认值的完整列表,请参见表引擎的 设置 部分。
示例:
Implementation Details
SELECT 查询会在只读 PostgreSQL 事务中以 COPY (SELECT ...) TO STDOUT 的形式运行,并在每个 SELECT 查询后提交。
简单的 WHERE 子句 (如 =, !=, >, >=, <, <= 和 IN) 会在 PostgreSQL 服务器上执行。
所有 join、聚合、排序、IN [ array ] 条件以及 LIMIT 采样约束,都只会在对 PostgreSQL 的查询完成后由 ClickHouse 执行。
传递查询而非表名
SELECT 查询。结果表的结构会从查询结果中推断出来。该查询既可以写成子查询,也可以包装在 query 函数中:
INSERT。PostgreSQL 表引擎也支持相同的语法。
子查询形式
(SELECT ...) 会先由 ClickHouse 解析,并在发送到服务器之前按 PostgreSQL 方言 (PostgreSQL 标识符引用和字符串字面量转义) 重新序列化。因此,它必须是有效的 ClickHouse SQL。要传递 ClickHouse 无法解析的 PostgreSQL 特有语法,请使用 query('...') 形式,其文本会被原样发送到 PostgreSQL。外层 ClickHouse 查询中的任何 WHERE、LIMIT、聚合等都不会下推到传入的查询中——而是在完整查询结果被拉取后由 ClickHouse 执行。要限制从 PostgreSQL 读取的数据,请将过滤条件放在传入的查询内部。使用 external_table_strict_query = 1 时,无法下推的外层过滤条件会抛出异常,而不是在本地执行。INSERT 查询会在 PostgreSQL 事务中以 COPY "table_name" (field1, field2, ... fieldN) FROM STDIN 的形式运行,并在每个 INSERT 语句后自动提交。
PostgreSQL 的 Array 类型会转换为 ClickHouse 数组。
请注意,在 PostgreSQL 中,像 Integer[] 这样的数组数据类型列在不同的行中可能包含维度不同的数组,但在 ClickHouse 中,只允许所有行中的多维数组具有相同的维度。
| 分隔列出。例如:
map 中的数值越大,优先级越低。最高优先级为 0。
示例
使用 PeerDB 复制或迁移 Postgres 数据
除了表函数之外,您也始终可以使用 ClickHouse 的 PeerDB,建立从 Postgres 到 ClickHouse 的持续数据管道。PeerDB 是一款专为通过 CDC (变更数据捕获) 将数据从 Postgres 复制到 ClickHouse 而设计的工具。