Skip to main content
Essas configurações estão disponíveis em system.settings e são geradas automaticamente a partir do código-fonte.

cluster_table_function_buckets_batch_size

Define o tamanho aproximado de um batch (em bytes) usado no processamento distribuído de tarefas em funções de tabela de cluster com granularidade de divisão bucket. O sistema acumula dados até que pelo menos essa quantidade seja atingida. O tamanho real pode ser ligeiramente maior para se alinhar aos limites dos dados.

cluster_table_function_split_granularity

Controla como os dados são divididos em tarefas ao executar uma CLUSTER TABLE FUNCTION. Essa configuração define a granularidade da distribuição do trabalho no cluster:
  • file — cada tarefa processa um arquivo inteiro.
  • bucket — as tarefas são criadas para cada bloco de dados interno em um arquivo (por exemplo, grupos de linhas do Parquet).
Escolher uma granularidade mais fina (como bucket) pode melhorar o paralelismo ao trabalhar com um pequeno número de arquivos grandes. Por exemplo, se um arquivo Parquet contiver vários grupos de linhas, ativar a granularidade bucket permite que cada grupo seja processado de forma independente por diferentes workers.
Última modificação em 23 de julho de 2026