Essas configurações estão disponíveis em system.settings e são geradas automaticamente a partir do código-fonte.
cluster_table_function_buckets_batch_size
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.11 | 0 | Nova configuração. |
Define o tamanho aproximado de um batch (em bytes) usado no processamento distribuído de tarefas em funções de tabela de cluster com granularidade de divisão bucket. O sistema acumula dados até que pelo menos essa quantidade seja atingida. O tamanho real pode ser ligeiramente maior para se alinhar aos limites dos dados.
cluster_table_function_split_granularity
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.11 | file | Nova configuração. |
Controla como os dados são divididos em tarefas ao executar uma CLUSTER TABLE FUNCTION.
Essa configuração define a granularidade da distribuição do trabalho no cluster:
file— cada tarefa processa um arquivo inteiro.bucket— as tarefas são criadas para cada bloco de dados interno em um arquivo (por exemplo, grupos de linhas do Parquet).
Escolher uma granularidade mais fina (como bucket) pode melhorar o paralelismo ao trabalhar com um pequeno número de arquivos grandes.
Por exemplo, se um arquivo Parquet contiver vários grupos de linhas, ativar a granularidade bucket permite que cada grupo seja processado de forma independente por diferentes workers.