parallel_distributed_insert_select
INSERT ... SELECT distribuída em paralelo.
Ao executar consultas INSERT INTO distributed_table_a SELECT ... FROM distributed_table_b, se ambas as tabelas usarem o mesmo cluster e forem replicadas ou não replicadas, essa consulta será processada localmente em cada shard.
Valores possíveis:
0— Desativado.1—SELECTserá executado em cada shard a partir da tabela subjacente do engine Distributed.2—SELECTeINSERTserão executados em cada shard, a partir da/para a tabela subjacente do engine Distributed.
INSERT ... SELECT de uma origem ReplicatedMergeTree ou SharedMergeTree também pode ser paralelizado entre réplicas. Para habilitar:
parallel_distributed_insert_select = 2enable_parallel_replicas = 1
parallel_hash_join_threshold
hash e parallel_hash (somente se a estimativa do tamanho da tabela da direita estiver disponível).
O primeiro é usado quando sabemos que o tamanho da tabela da direita está abaixo desse limite.
parallel_non_joined_rows_processing
parallel_hash com tabelas grandes.
Quando desabilitada, as linhas sem correspondência são processadas por uma única thread.