parallel_distributed_insert_select
INSERT ... SELECT.
Si se ejecutan consultas INSERT INTO distributed_table_a SELECT ... FROM distributed_table_b, ambas tablas usan el mismo clúster y ambas son replicated o no replicadas, esta consulta se procesa localmente en cada segmento.
Posibles valores:
0— Deshabilitado.1—SELECTse ejecutará en cada segmento sobre la tabla subyacente del motor Distributed.2—SELECTeINSERTse ejecutarán en cada segmento sobre/desde la tabla subyacente del motor Distributed.
INSERT ... SELECT desde un origen ReplicatedMergeTree o SharedMergeTree también puede paralelizarse entre réplicas. Para habilitarlo:
parallel_distributed_insert_select = 2enable_parallel_replicas = 1
parallel_hash_join_threshold
hash o parallel_hash (solo si se dispone de una estimación del tamaño de la tabla derecha).
El primero se usa cuando se sabe que el tamaño de la tabla derecha está por debajo del umbral.
parallel_non_joined_rows_processing
parallel_hash con tablas grandes.
Cuando está deshabilitado, las filas no unidas se procesan con un solo hilo.