Skip to main content
Ces paramètres sont disponibles dans system.settings et sont générés automatiquement à partir du source.

cluster_table_function_buckets_batch_size

Définit la taille approximative d’un lot (en octets) utilisé pour le traitement distribué des tâches dans les fonctions de table de cluster avec une granularité de division bucket. Le système accumule les données jusqu’à atteindre au moins cette taille. La taille réelle peut être légèrement supérieure afin de respecter les limites des données.

cluster_table_function_split_granularity

Contrôle la façon dont les données sont réparties en tâches lors de l’exécution d’une FONCTION DE TABLE DE CLUSTER. Ce paramètre définit la granularité de la répartition du travail au sein du cluster :
  • file — chaque tâche traite un fichier entier.
  • bucket — des tâches sont créées pour chaque bloc de données interne d’un fichier (par exemple, les groupes de lignes Parquet).
Choisir une granularité plus fine (comme bucket) peut améliorer le parallélisme lorsque vous travaillez avec un petit nombre de fichiers volumineux. Par exemple, si un fichier Parquet contient plusieurs groupes de lignes, activer la granularité bucket permet de traiter chaque groupe indépendamment par différents workers.
Dernière modification le 23 juillet 2026