parallel_distributed_insert_select
INSERT ... SELECT.
Si nous exécutons des requêtes INSERT INTO distributed_table_a SELECT ... FROM distributed_table_b, que les deux tables utilisent le même cluster et qu’elles sont toutes deux soit répliquées, soit non répliquées, alors la requête est traitée localement sur chaque shard.
Valeurs possibles :
0— Désactivé.1—SELECTsera exécuté sur chaque shard à partir de la table sous-jacente du moteur Distributed.2—SELECTetINSERTseront exécutés sur chaque shard, respectivement depuis/vers la table sous-jacente du moteur Distributed.
INSERT ... SELECT à partir d’une source ReplicatedMergeTree ou SharedMergeTree peut également être parallélisé entre les répliques. Pour l’activer :
parallel_distributed_insert_select = 2enable_parallel_replicas = 1
parallel_hash_join_threshold
hash et parallel_hash (uniquement si une estimation de la taille de la table de droite est disponible).
Le premier est utilisé lorsque l’on sait que la taille de la table de droite est inférieure au seuil.
parallel_non_joined_rows_processing
parallel_hash avec de grandes tables.
Lorsqu’il est désactivé, les lignes sans correspondance sont traitées par un seul thread.