parallel_distributed_insert_select
INSERT ... SELECT для Distributed.
Если выполняются запросы INSERT INTO distributed_table_a SELECT ... FROM distributed_table_b, обе таблицы используют один и тот же кластер, и обе таблицы либо реплицируемые, либо нереплицируемые, то этот запрос обрабатывается локально на каждом сегменте.
Возможные значения:
0— Отключено.1—SELECTбудет выполняться на каждом сегменте из базовой таблицы движка Distributed.2—SELECTиINSERTбудут выполняться на каждом сегменте из/в базовую таблицу движка Distributed.
INSERT ... SELECT из источника ReplicatedMergeTree или SharedMergeTree также можно распараллелить между репликами. Чтобы включить это:
parallel_distributed_insert_select = 2enable_parallel_replicas = 1
parallel_hash_join_threshold
hash, этот порог помогает выбрать между hash и parallel_hash (только если доступна оценка размера правой таблицы).
Первый вариант используется, когда известно, что размер правой таблицы меньше порогового значения.
parallel_non_joined_rows_processing
parallel_hash с большими таблицами.
Если настройка отключена, строки без совпадений обрабатываются одним потоком.