cluster_table_function_buckets_batch_size
bucket. O sistema acumula dados até que pelo menos essa quantidade seja atingida. O tamanho real pode ser ligeiramente maior para se alinhar aos limites dos dados.
cluster_table_function_split_granularity
file— cada tarefa processa um arquivo inteiro.bucket— as tarefas são criadas para cada bloco de dados interno em um arquivo (por exemplo, grupos de linhas do Parquet).
bucket) pode melhorar o paralelismo ao trabalhar com um pequeno número de arquivos grandes.
Por exemplo, se um arquivo Parquet contiver vários grupos de linhas, ativar a granularidade bucket permite que cada grupo seja processado de forma independente por diferentes workers.