Эти настройки доступны в system.settings и автоматически генерируются на основе исходного кода.
parallel_distributed_insert_select
История версий
| Версия | Значение по умолчанию | Комментарий |
|---|---|---|
| 25.7 | 2 | По умолчанию включает параллельный distributed insert select |
Включает параллельное выполнение запроса INSERT ... SELECT для Distributed.
Если выполняются запросы INSERT INTO distributed_table_a SELECT ... FROM distributed_table_b, обе таблицы используют один и тот же кластер, и обе таблицы либо реплицируемые, либо нереплицируемые, то этот запрос обрабатывается локально на каждом сегменте.
Возможные значения:
0— Отключено.1—SELECTбудет выполняться на каждом сегменте из базовой таблицы движка Distributed.2—SELECTиINSERTбудут выполняться на каждом сегменте из/в базовую таблицу движка Distributed.
Начиная с v25.4, INSERT ... SELECT из источника ReplicatedMergeTree или SharedMergeTree также можно распараллелить между репликами. Чтобы включить это:
parallel_distributed_insert_select = 2enable_parallel_replicas = 1
parallel_hash_join_threshold
История версий
| Версия | Значение по умолчанию | Комментарий |
|---|---|---|
| 25.5 | 100000 | новая настройка |
| 25.4 | 0 | новая настройка |
| 25.3 | 0 | новая настройка |
Когда используется алгоритм JOIN на основе hash, этот порог помогает выбрать между hash и parallel_hash (только если доступна оценка размера правой таблицы).
Первый вариант используется, когда известно, что размер правой таблицы меньше порогового значения.
parallel_non_joined_rows_processing
История версий
| Версия | Значение по умолчанию | Комментарий |
|---|---|---|
| 26.2 | 1 | Новая настройка для включения параллельной обработки строк без совпадений в RIGHT/FULL JOIN с алгоритмом parallel_hash. |
Позволяет нескольким потокам параллельно обрабатывать строки без совпадений из правой таблицы при RIGHT и FULL JOIN.
Это может ускорить этап обработки строк без совпадений при использовании алгоритма JOIN parallel_hash с большими таблицами.
Если настройка отключена, строки без совпадений обрабатываются одним потоком.
parallel_replica_offset
Это внутренний параметр, который не следует использовать напрямую; он относится к деталям реализации режима «параллельных реплик». Этот параметр автоматически задается сервером-инициатором для распределенных запросов и содержит индекс реплики, участвующей в обработке запроса в режиме параллельных реплик.
parallel_view_processing
Разрешает параллельную, а не последовательную отправку в присоединённые представления.