Эти настройки доступны в system.settings и автоматически сгенерированы на основе исходного кода.
cluster_table_function_buckets_batch_size
История версий
| Версия | Значение по умолчанию | Комментарий |
|---|---|---|
| 25.11 | 0 | Новая настройка |
Определяет примерный размер батча (в байтах), используемого при распределённой обработке задач в табличных функциях cluster с гранулярностью разделения bucket. Система накапливает данные, пока не достигнет как минимум этого объёма. Фактический размер может быть немного больше для выравнивания по границам данных.
cluster_table_function_split_granularity
История версий
| Версия | Значение по умолчанию | Комментарий |
|---|---|---|
| 25.11 | file | Новая настройка |
Управляет тем, как данные разбиваются на задачи при выполнении CLUSTER TABLE FUNCTION.
Эта настройка определяет гранулярность распределения работы по кластеру:
file— каждая задача обрабатывает файл целиком.bucket— задачи создаются для каждого внутреннего блока данных в файле (например, для групп строк в Parquet).
Выбор более мелкой гранулярности (например, bucket) может повысить параллелизм при работе с небольшим числом крупных файлов.
Например, если файл Parquet содержит несколько групп строк, включение гранулярности bucket позволяет обрабатывать каждую группу независимо разными воркерами.