Skip to content
ClickHouse Docs
ClickHouse DocsClickHouse Docs

Настройки формата output_format_*

Эти настройки сгенерированы автоматически из исходного кода.

output_format_always_write_decimal_point_in_float_and_decimal

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
26.60Новая настройка: всегда выводить десятичную точку для чисел с плавающей запятой и чисел типа Decimal в текстовых форматах, даже если значение является целым числом.

Всегда выводить десятичную точку для чисел с плавающей запятой и чисел типа Decimal в текстовых форматах, даже если значение является целым числом. Например, выводить 1. вместо 1.

По умолчанию отключено.

output_format_arrow_compression_method

Тип
ArrowCompression
По умолчанию
lz4_frame
История версий
ВерсияЗначение по умолчаниюКомментарий
23.3lz4_frameПо умолчанию в формате вывода Arrow используется сжатие lz4

Метод сжатия для формата вывода Arrow. Поддерживаемые кодеки: lz4_frame, zstd, none (без сжатия)

output_format_arrow_date_as_uint16

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
26.20По умолчанию записывать Date в формате Arrow DATE32, а не как обычный UInt16.

Записывает значения Date как обычные 16-битные числа (при обратном чтении — как UInt16), а не преобразует их в 32-битный тип Arrow DATE32 (при обратном чтении — как Date32).

output_format_arrow_fixed_string_as_fixed_byte_array

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
23.21По умолчанию для FixedString используется тип Arrow FIXED_SIZE_BINARY

Использовать тип Arrow FIXED_SIZE_BINARY вместо Binary для столбцов FixedString.

output_format_arrow_low_cardinality_as_dictionary

Тип
Bool
По умолчанию
0

Включает вывод типа LowCardinality как типа Dictionary Arrow

output_format_arrow_string_as_string

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
24.31ClickHouse допускает произвольные бинарные данные в типе String, хотя обычно в нём используется UTF-8. Parquet/ORC/Arrow Strings поддерживают только UTF-8. Поэтому для типа String в ClickHouse можно выбрать, какой тип данных Arrow использовать — String или Binary. Хотя Binary был бы более корректным и совместимым вариантом, использование String по умолчанию в большинстве случаев лучше соответствует ожиданиям пользователей.

Использовать тип Arrow String вместо Binary для столбцов String

output_format_arrow_unsupported_types_as_binary

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
26.41Новая настройка для преобразования неподдерживаемых типов CH в бинарный формат Arrow вместо исключения UNKNOWN_TYPE.

Выводить типы, для которых нет преобразования, в виде необработанных двоичных данных. Если false — такие типы будут вызывать исключение UNKNOWN_TYPE.

output_format_arrow_use_64_bit_indexes_for_dictionary

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.10Разрешить использование 64-битного типа индексов в словарях Arrow
24.10Разрешить использование 64-битного типа индексов в словарях Arrow

Всегда использовать 64-битные целые числа для индексов словаря в формате Arrow

output_format_arrow_use_signed_indexes_for_dictionary

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
24.11По умолчанию использовать знаковый тип индексов для словарей Arrow, как рекомендуется

Использовать знаковые целые числа для индексов словарей в формате Arrow

output_format_avro_codec

Кодек сжатия, используемый для вывода данных. Возможные значения: 'null', 'deflate', 'snappy', 'zstd'.

output_format_avro_confluent_subject

История версий
ВерсияЗначение по умолчаниюКомментарий
26.5Новая настройка для указания subject, используемого для регистрации схемы в Confluent Schema Registry при записи в формате вывода AvroConfluent.

Для формата вывода AvroConfluent: subject, под которым схема регистрируется в Confluent Schema Registry. Обязательно при записи вывода AvroConfluent.

output_format_avro_rows_in_file

Тип
UInt64
По умолчанию
1

Максимальное число строк в файле (если это поддерживается хранилищем)

output_format_avro_string_column_pattern

Для формата Avro: шаблон регулярного выражения для столбцов типа String, которые следует выбирать как строки AVRO.

output_format_avro_sync_interval

Тип
UInt64
По умолчанию
16384

Интервал синхронизации, в байтах.

output_format_binary_encode_types_in_binary_format

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.70Добавлена новая настройка, позволяющая записывать имена типов в двоичном формате в формате вывода RowBinaryWithNamesAndTypes

Записывает типы данных в двоичном формате вместо имён типов в формате вывода RowBinaryWithNamesAndTypes

output_format_binary_write_json_as_string

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.100Добавлена новая настройка для записи значений типа JSON в виде значений JSON-строки в формате вывода RowBinary

Записывает значения типа данных JSON в виде значений JSON String в формате вывода RowBinary.

output_format_bson_string_as_string

Тип
Bool
По умолчанию
0

Использовать тип BSON String вместо Binary для столбцов типа String.

output_format_compression_level

Тип
UInt64
По умолчанию
3
История версий
ВерсияЗначение по умолчаниюКомментарий
24.13Добавлена возможность изменять уровень сжатия в выводе запроса

Уровень сжатия по умолчанию, если вывод запроса сжат. Эта настройка применяется, когда запрос SELECT содержит INTO OUTFILE или при записи в табличные функции file, url, hdfs, s3 или azureBlobStorage.

Возможные значения: от 1 до 22

output_format_compression_zstd_window_log

Тип
UInt64
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.10Позволяет изменять логарифм окна zstd в выводе запроса при использовании сжатия zstd

Можно использовать, если для вывода выбран метод сжатия zstd. Если значение больше 0, этот параметр явно задаёт размер окна сжатия (степень 2) и включает для сжатия zstd режим дальнего диапазона. Это может помочь добиться более высокого коэффициента сжатия.

Возможные значения: неотрицательные числа. Обратите внимание: если значение слишком маленькое или слишком большое, zstdlib сгенерирует исключение. Обычно используются значения от 20 (размер окна = 1MB) до 30 (размер окна = 1GB).

output_format_csv_crlf_end_of_line

Тип
Bool
По умолчанию
0

Если задать значение true, в формате CSV в конце строки будет использоваться \r\n вместо \n.

output_format_csv_header_serialize_tuple_into_separate_columns

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
26.71Новая настройка. Когда включен output_format_csv_serialize_tuple_into_separate_columns, заголовок CSVWithNames/CSVWithNamesAndTypes теперь раскрывает столбцы Tuple в их конечные поля, чтобы ширина заголовка соответствовала данным. Установите false, чтобы вернуть прежний заголовок с одним именем.

Когда включен output_format_csv_serialize_tuple_into_separate_columns, строки заголовка CSVWithNames и CSVWithNamesAndTypes раскрывают каждый обычный столбец Tuple в его конечные поля (имена с точками, такие как t.a, t.b, и имена конечных типов), так что заголовок содержит столько же столбцов, сколько и данные. Столбец Nullable(Tuple) никогда не раскрывается (его данные остаются одним полем CSV), поэтому в его заголовке сохраняются одно имя столбца верхнего уровня и один тип. Для CustomSeparated* это раскрытие применяется только если format_custom_escaping_rule = 'CSV' и format_custom_field_delimiter — одиночный символ, совпадающий с format_csv_delimiter; в противном случае (например, при разделителе табуляции по умолчанию или format_custom_field_delimiter = '|') заголовок остается нераскрытым, чтобы по-прежнему соответствовать данным. Установите значение 0, чтобы сохранить прежнее поведение, при котором заголовок содержит одно имя и один тип Tuple верхнего уровня.

Примечание: раскрытый заголовок не считывается обратно в Tuple по имени, когда input_format_with_names_use_header = 1. Чтобы прочитать такие данные обратно в Tuple, либо установите для этой настройки значение 0 при выводе, либо читайте с input_format_with_names_use_header = 0 (а для форматов *WithNamesAndTypesCSVWithNamesAndTypes и CustomSeparatedWithNamesAndTypes — также input_format_with_types_use_header = 0, поскольку иначе раскрытая строка типов будет проверяться на соответствие единственному входному полю Tuple верхнего уровня и будет отклонена).

output_format_csv_serialize_tuple_into_separate_columns

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
24.61Добавлен новый способ интерпретации Tuple в формате CSV.
24.31Добавлен новый способ интерпретации Tuple в формате CSV.

Если установлено значение true, то обычные столбцы Tuple в формате CSV сериализуются как отдельные столбцы (то есть их вложенность в Tuple теряется).

Это преобразование применяется только к обычному Tuple. Nullable(Tuple) всегда сериализуется как одно поле CSV (чтобы строки с NULL и не-NULL занимали одинаковое число полей) независимо от этой настройки.

output_format_decimal_trailing_zeros

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
21.90По умолчанию не выводить конечные нули в текстовом представлении типов Decimal для более наглядного вывода

Выводить конечные нули при отображении значений Decimal. Например, 1.230000 вместо 1.23.

По умолчанию отключено.

output_format_float_precision

Тип
UInt64
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
26.60Новая настройка для управления количеством десятичных знаков при выводе чисел с плавающей запятой

Если значение не равно нулю, вывод чисел с плавающей запятой (Float32, Float64, BFloat16) форматируется максимум с таким количеством знаков после десятичной точки (конечные нули удаляются). Если значение равно 0 (по умолчанию), используется кратчайшее представление, допускающее точное восстановление значения.

Значения, слишком большие для записи в фиксированном формате, а также значения, модуль которых настолько мал, что округление до запрошенной точности привело бы к потере всех значащих цифр (мантисса стала бы ±0), вместо этого выводятся в научной нотации. В этих случаях мантисса может содержать больше знаков дробной части, чем указано в запрошенной точности.

Допустимый диапазон: от 0 до 100.

output_format_image_height

Тип
UInt64
По умолчанию
1024
История версий
ВерсияЗначение по умолчаниюКомментарий
26.61024Новая настройка, задающая высоту выходного изображения для форматов вывода изображений, таких как PNG.

Высота выходного изображения в пикселях для форматов вывода изображений, таких как PNG.

Значение по умолчанию: 1024.

output_format_image_streaming_animation

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
26.80Новая настройка, управляющая тем, записывают ли форматы вывода изображений, такие как `PNG`, каждый кадр анимации сразу после появления следующего значения `t`, вместо буферизации всех кадров в памяти.

Для форматов вывода изображений, таких как PNG, записывать каждый кадр анимации сразу после появления следующего значения в столбце t вместо буферизации всех кадров в памяти до завершения запроса.

В памяти хранится только один кадр, а кадры выводятся ещё во время выполнения запроса. Взамен значения t должны быть неубывающими, иначе запрос генерирует исключение. Кроме того, на момент записи заголовка анимации число кадров неизвестно, поэтому указанное число кадров является верхней границей, а не точным значением. Браузеры воспроизводят такой файл, но декодеры, полагающиеся на указанное число кадров, сообщают об ошибке после последнего фактического кадра.

Значение по умолчанию: false.

output_format_image_terminal_mode

История версий
ВерсияЗначение по умолчаниюКомментарий
26.6Новая настройка, определяющая, будут ли форматы вывода изображений, такие как PNG, отображаться прямо в терминале с помощью inline-протокола изображений.

Для форматов вывода изображений, таких как PNG, выводить изображение прямо в терминал с помощью inline-протокола изображений вместо записи сырых байтов изображения.

Возможные значения:

  • `` (пусто) — записывать сырые байты изображения (по умолчанию).
  • iterm — использовать inline-протокол изображений iTerm2.
  • kitty — использовать графический протокол Kitty.
  • sixel — использовать протокол Sixel.
  • auto — если вывод направлен в терминал, определить его возможности и использовать iterm, kitty или sixel (в этом порядке); в противном случае записывать сырые байты изображения.

Значение по умолчанию: `` (пусто).

output_format_image_time_divisor_seconds

Тип
UInt64
По умолчанию
60
История версий
ВерсияЗначение по умолчаниюКомментарий
26.860Новая настройка, определяющая знаменатель единицы времени столбца `t`, благодаря чему форматы вывода изображений, такие как `PNG`, могут создавать анимацию.

Знаменатель единицы времени столбца t в секундах для форматов вывода изображений, таких как PNG.

См. output_format_image_time_multiplier_seconds.

Значение по умолчанию: 60.

output_format_image_time_multiplier_seconds

Тип
UInt64
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
26.81Новая настройка, задающая числитель единицы времени для столбца `t`, благодаря чему форматы вывода изображений, такие как `PNG`, создают анимацию.

Числитель единицы времени для столбца t в секундах для форматов вывода изображений, таких как PNG.

При наличии столбца t формат создаёт анимацию, в которой t задаёт относительное смещение времени кадра. Одна единица t соответствует output_format_image_time_multiplier_seconds / output_format_image_time_divisor_seconds секундам. При значениях по умолчанию (1 и 60) одна единица t равна 1/60 секунды.

Значение по умолчанию: 1.

output_format_image_width

Тип
UInt64
По умолчанию
1024
История версий
ВерсияЗначение по умолчаниюКомментарий
26.61024Новая настройка, задающая ширину выводимого изображения для форматов вывода изображений, таких как PNG.

Ширина выводимого изображения в пикселях для форматов вывода изображений, таких как PNG.

Значение по умолчанию: 1024.

output_format_json_array_of_rows

Тип
Bool
По умолчанию
0

Включает вывод всех строк в виде JSON-массива в формате JSONEachRow.

Возможные значения:

  • 1 — ClickHouse выводит все строки в виде массива, где каждая строка представлена в формате JSONEachRow.
  • 0 — ClickHouse выводит каждую строку отдельно в формате JSONEachRow.

Пример запроса с включенной настройкой

Запрос:

SET output_format_json_array_of_rows = 1;
SELECT number FROM numbers(3) FORMAT JSONEachRow;

Результат:

[
{"number":"0"},
{"number":"1"},
{"number":"2"}
]

Пример запроса при отключённой настройке

Запрос:

SET output_format_json_array_of_rows = 0;
SELECT number FROM numbers(3) FORMAT JSONEachRow;

Результат:

{"number":"0"}
{"number":"1"}
{"number":"2"}

output_format_json_escape_forward_slashes

Тип
Bool
По умолчанию
1

Управляет экранированием символов прямой косой черты в строковом выводе в формате JSON. Это нужно для совместимости с JavaScript. Не путайте с обратной косой чертой, которая экранируется всегда.

Включено по умолчанию.

output_format_json_map_as_array_of_tuples

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
25.70новая настройка

Сериализует столбцы типа Map в JSON-массивы кортежей.

Отключено по умолчанию.

output_format_json_named_tuples_as_objects

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
22.61По умолчанию позволяет сериализовать именованные кортежи как объекты JSON в JSON-форматах

Сериализует столбцы именованных кортежей как объекты JSON.

Включено по умолчанию.

output_format_json_pretty_print

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
25.11По умолчанию выводить значения в удобочитаемом виде в формате вывода JSON

Этот параметр определяет, как вложенные структуры, такие как Tuples, Maps и Arrays, отображаются в массиве data при использовании формата вывода JSON.

Например, вместо вывода:

"data":
[
  {
    "tuple": {"a":1,"b":2,"c":3},
    "array": [1,2,3],
    "map": {"a":1,"b":2,"c":3}
  }
],

Вывод будет представлен в следующем формате:

"data":
[
    {
        "tuple": {
            "a": 1,
            "b": 2,
            "c": 3
        },
        "array": [
            1,
            2,
            3
        ],
        "map": {
            "a": 1,
            "b": 2,
            "c": 3
        }
    }
],

Включено по умолчанию.

output_format_json_quote_64bit_floats

Тип
Bool
По умолчанию
0

Управляет тем, будут ли 64-битные числа с плавающей точкой заключаться в кавычки при выводе в форматах JSON*.

По умолчанию отключено.

output_format_json_quote_64bit_integers

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
25.80По умолчанию отключает заключение 64-битных целых чисел в кавычки в JSON

Управляет тем, будут ли 64-битные и более крупные целые числа (например, UInt64 или Int128) заключаться в кавычки при выводе в формате JSON. По умолчанию такие целые числа заключаются в кавычки. Такое поведение совместимо с большинством реализаций JavaScript.

Возможные значения:

  • 0 — Целые числа выводятся без кавычек.
  • 1 — Целые числа заключаются в кавычки.

output_format_json_quote_decimals

Тип
Bool
По умолчанию
0

Управляет выводом десятичных чисел в кавычках в формате вывода JSON.

Отключено по умолчанию.

output_format_json_quote_denormals

Тип
Bool
По умолчанию
0

Включает вывод значений +nan, -nan, +inf, -inf в формате вывода JSON.

Возможные значения:

  • 0 — Отключено.
  • 1 — Включено.

Пример

Рассмотрим следующую таблицу account_orders:

┌─id─┬─name───┬─duration─┬─period─┬─area─┐
│  1 │ Andrew │       20 │      0 │  400 │
│  2 │ John   │       40 │      0 │    0 │
│  3 │ Bob    │       15 │      0 │ -100 │
└────┴────────┴──────────┴────────┴──────┘

Когда output_format_json_quote_denormals = 0, запрос возвращает значения null в выводе:

SELECT area/period FROM account_orders FORMAT JSON;
{
        "meta":
        [
                {
                        "name": "divide(area, period)",
                        "type": "Float64"
                }
        ],

        "data":
        [
                {
                        "divide(area, period)": null
                },
                {
                        "divide(area, period)": null
                },
                {
                        "divide(area, period)": null
                }
        ],

        "rows": 3,

        "statistics":
        {
                "elapsed": 0.003648093,
                "rows_read": 3,
                "bytes_read": 24
        }
}

Когда output_format_json_quote_denormals = 1, запрос возвращает:

{
        "meta":
        [
                {
                        "name": "divide(area, period)",
                        "type": "Float64"
                }
        ],

        "data":
        [
                {
                        "divide(area, period)": "inf"
                },
                {
                        "divide(area, period)": "-nan"
                },
                {
                        "divide(area, period)": "-inf"
                }
        ],

        "rows": 3,

        "statistics":
        {
                "elapsed": 0.000070241,
                "rows_read": 3,
                "bytes_read": 24
        }
}

output_format_json_skip_null_value_in_named_tuples

Тип
Bool
По умолчанию
0

Пропускать пары ключ-значение со значением NULL при сериализации столбцов именованных кортежей в виде объектов JSON. Действует только если output_format_json_named_tuples_as_objects имеет значение true.

output_format_json_validate_utf8

Тип
Bool
По умолчанию
0

Управляет проверкой последовательностей UTF-8 в формате вывода JSON и не влияет на форматы JSON/JSONCompact/JSONColumnsWithMetadata — в них проверка UTF-8 выполняется всегда.

По умолчанию отключено.

output_format_markdown_escape_special_characters

Тип
Bool
По умолчанию
0

Если включено, специальные символы в Markdown экранируются.

Common Mark определяет следующие специальные символы, которые можно экранировать с помощью :

! " # $ % & ' ( ) * + , - . / : ; < = > ? @ [ \ ] ^ _ ` { | } ~

Возможные значения:

  • 0 — Отключено.
  • 1 — Включено.

output_format_msgpack_uuid_representation

Тип
MsgPackUUIDRepresentation
По умолчанию
ext

Способ представления UUID в формате MsgPack при выводе.

output_format_native_encode_types_in_binary_format

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.70Добавлена новая настройка, позволяющая записывать имена типов в двоичном виде в формате вывода Native

Записывает типы данных в двоичном виде вместо имён типов в формате вывода Native

output_format_native_use_flattened_dynamic_and_json_serialization

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
25.60Добавлена уплощенная сериализация Dynamic/JSON для формата Native

Записывает данные из столбцов JSON и Dynamic в уплощенном формате (все типы/пути — как отдельные подстолбцы).

output_format_native_write_json_as_string

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.100Добавлена новая настройка, позволяющая записывать JSON-столбец как один столбец String в Native format

Записывает данные JSON столбца как столбец String, содержащий JSON-строки, вместо стандартной нативной JSON-сериализации.

output_format_orc_compression_block_size

Тип
UInt64
По умолчанию
262144
История версий
ВерсияЗначение по умолчаниюКомментарий
25.8262144новая настройка

Размер блока сжатия в байтах для формата вывода ORC.

output_format_orc_compression_method

Тип
ORCCompression
По умолчанию
zstd
История версий
ВерсияЗначение по умолчаниюКомментарий
24.3zstdParquet/ORC/Arrow поддерживают множество методов сжатия, включая lz4 и zstd. ClickHouse поддерживает все эти методы сжатия. Некоторые менее функциональные инструменты, например 'duckdb', не поддерживают более быстрый метод сжатия `lz4`, поэтому по умолчанию используется zstd.
23.3lz4_frameПо умолчанию используется сжатие lz4 в выходном формате ORC

Метод сжатия для выходного формата ORC. Поддерживаемые кодеки: lz4, snappy, zlib, zstd, none (без сжатия)

output_format_orc_dictionary_key_size_threshold

Тип
Double
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.90Для строкового столбца в формате вывода ORC: если число различных значений превышает эту долю от общего числа строк с не-NULL значениями, кодирование с использованием словаря отключается. В противном случае оно включается

Для строкового столбца в формате вывода ORC: если число различных значений превышает эту долю от общего числа строк с не-NULL значениями, кодирование с использованием словаря отключается. В противном случае оно включается

output_format_orc_row_index_stride

Тип
UInt64
По умолчанию
10000

Целевой шаг индекса строк для выходного формата ORC

output_format_orc_string_as_string

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
24.31ClickHouse допускает хранение произвольных бинарных данных в типе String, хотя обычно в нём используется UTF-8. Строки Parquet/ORC/Arrow поддерживают только UTF-8. Поэтому для типа String в ClickHouse можно выбрать, какой тип данных Arrow использовать — String или Binary. Хотя Binary был бы более корректным и совместимым вариантом, использование String по умолчанию в большинстве случаев лучше соответствует ожиданиям пользователей.

Использовать тип ORC String вместо Binary для столбцов String

output_format_orc_writer_time_zone_name

Тип
String
По умолчанию
GMT
История версий
ВерсияЗначение по умолчаниюКомментарий
25.1GMTНазвание часового пояса для ORC writer; часовой пояс ORC writer по умолчанию — GMT.

Название часового пояса для ORC writer; часовой пояс ORC writer по умолчанию — GMT.

output_format_parallel_formatting

Тип
Bool
По умолчанию
1

Включает или отключает параллельное форматирование данных. Поддерживается только для форматов TSV, TSKV, CSV и JSONEachRow.

Возможные значения:

  • 1 — Включено.
  • 0 — Отключено.

output_format_parquet_batch_size

Тип
NonZeroUInt64
По умолчанию
1024

Проверять размер страницы через каждые столько строк. Рассмотрите возможность уменьшить значение, если у вас есть столбцы, у которых средний размер значений превышает несколько КБ.

output_format_parquet_bloom_filter_bits_per_value

Тип
Double
По умолчанию
10.5
История версий
ВерсияЗначение по умолчаниюКомментарий
25.210.5Новая настройка.

Приблизительное количество битов для каждого уникального значения в bloom-фильтрах Parquet. Оценочные уровни ложноположительных срабатываний:

  • 6 бит — 10%
  • 10.5 бита — 1%
  • 16.9 бита — 0.1%
  • 26.4 бита — 0.01%
  • 41 бит — 0.001%

output_format_parquet_bloom_filter_flush_threshold_bytes

Тип
UInt64
По умолчанию
134217728
История версий
ВерсияЗначение по умолчаниюКомментарий
25.2134217728Новая настройка

Где в файле Parquet размещать bloom-фильтры. Bloom-фильтры будут записываться порциями примерно такого размера. В частности:

  • если значение равно 0, bloom-фильтры каждой группы строк записываются сразу после соответствующей группы строк,
    • если значение больше общего размера всех bloom-фильтров, bloom-фильтры для всех групп строк будут накапливаться в памяти, а затем записываться вместе ближе к концу файла,
    • в противном случае bloom-фильтры будут накапливаться в памяти и записываться, как только их общий размер превысит это значение.

output_format_parquet_compression_method

Тип
ParquetCompression
По умолчанию
zstd
История версий
ВерсияЗначение по умолчаниюКомментарий
24.3zstdParquet/ORC/Arrow поддерживают множество методов сжатия, включая lz4 и zstd. ClickHouse поддерживает все эти методы сжатия. Некоторые менее функциональные инструменты, такие как 'duckdb', не поддерживают более быстрый метод сжатия `lz4`, поэтому по умолчанию используется zstd.
23.3lz4По умолчанию в выходном формате Parquet используется сжатие lz4

Метод сжатия для выходного формата Parquet. Поддерживаемые кодеки: snappy, lz4, brotli, zstd, gzip, none (без сжатия)

output_format_parquet_data_page_size

Тип
UInt64
По умолчанию
1048576

Целевой размер страницы в байтах до сжатия.

output_format_parquet_date_as_uint16

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
25.80Добавлена настройка совместимости для небольшого изменения, нарушающего совместимость и введённого ещё в 24.12.
24.120Записывать значения Date как Date32 вместо простого UInt16 (это два типа Parquet, наиболее близких к Date).

Записывать значения Date как простые 16-битные числа (при чтении возвращаются как UInt16) вместо преобразования в 32-битный тип DATE в Parquet (при чтении возвращается как Date32).

output_format_parquet_datetime_as_uint32

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.120Записывать значения DateTime как DateTime64(3), а не как UInt32 (это два типа Parquet, наиболее близкие к DateTime).

Записывает значения DateTime как исходную Unix-временную метку (при обратном чтении — как UInt32), а не преобразует их в миллисекунды (при обратном чтении — как DateTime64(3)).

output_format_parquet_enum_as_byte_array

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
25.81По умолчанию включить запись Enum как массива байтов в Parquet
25.70Записывать enum с использованием физического типа Parquet: BYTE_ARRAY и логического типа: ENUM

Записывать enum с использованием физического типа Parquet: BYTE_ARRAY и логического типа: ENUM

output_format_parquet_fixed_string_as_fixed_byte_array

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
23.21По умолчанию использовать тип Parquet FIXED_LENGTH_BYTE_ARRAY для FixedString

Использовать тип Parquet FIXED_LEN_BYTE_ARRAY вместо Binary для столбцов типа FixedString.

output_format_parquet_geometadata

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
25.71Новая настройка, позволяющая записывать информацию о геопространственных столбцах в метаданные Parquet и кодировать столбцы в формате WKB.

Позволяет записывать информацию о геопространственных столбцах в метаданные Parquet и кодировать столбцы в формате WKB.

output_format_parquet_max_dictionary_size

Тип
UInt64
По умолчанию
1048576
История версий
ВерсияЗначение по умолчаниюКомментарий
25.81048576новая настройка

Если размер словаря превышает указанное количество байт, используется кодирование без словаря. Установите значение 0, чтобы отключить кодирование с использованием словаря.

output_format_parquet_parallel_encoding

Тип
Bool
По умолчанию
1

Выполняет кодирование Parquet в нескольких потоках.

output_format_parquet_row_group_size

Тип
UInt64
По умолчанию
1000000

Целевой размер группы строк в количестве строк.

output_format_parquet_row_group_size_bytes

Тип
UInt64
По умолчанию
536870912

Целевой размер группы строк в байтах, до сжатия.

output_format_parquet_string_as_string

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
24.31ClickHouse допускает произвольные двоичные данные в типе String, который обычно содержит UTF-8. Строки Parquet/ORC/Arrow поддерживают только UTF-8. Поэтому для типа String в ClickHouse можно выбрать, какой тип данных Arrow использовать — String или Binary. Хотя Binary был бы более корректным и совместимым вариантом, использование String по умолчанию в большинстве случаев лучше соответствует ожиданиям пользователей.

Использовать тип String в Parquet вместо Binary для столбцов String.

output_format_parquet_wide_integer_as_decimal

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
26.80Новая настройка для записи значений `Int128`, `UInt128`, `Int256` и `UInt256` как стандартных значений Parquet `DECIMAL`. Предыдущее значение сохраняет устаревшее представление `FIXED_LEN_BYTE_ARRAY` в порядке little-endian.

Записывать значения Int128, UInt128, Int256 и UInt256 как соответствующие стандарту Parquet значения DECIMAL с порядком байтов big-endian. Значение по умолчанию сохраняет устаревшее представление FIXED_LEN_BYTE_ARRAY без аннотации в порядке little-endian для совместимости со старыми версиями ClickHouse. Десятичное представление обеспечивает совместимость числовой статистики, однако некоторые ридеры Parquet не поддерживают точность свыше 38 или 76.

output_format_parquet_write_bloom_filter

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
25.21Добавлена поддержка записи bloom-фильтров в файлы Parquet.

Записывать bloom-фильтры в файлы Parquet.

output_format_parquet_write_checksums

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
25.111Новая настройка

Добавляет контрольные суммы CRC32 в заголовки страниц Parquet.

output_format_parquet_write_page_index

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
24.71Добавлена возможность записывать индекс страниц в файлы Parquet.

Записывает индекс столбцов и индекс смещений (то есть статистику по каждой странице данных, которую можно использовать для pushdown фильтров при чтении) в файлы Parquet.

output_format_pretty_color

Тип
UInt64Auto
По умолчанию
auto
История версий
ВерсияЗначение по умолчаниюКомментарий
24.1autoНастройка изменена: теперь также допускается значение auto; ANSI-последовательности экранирования отключаются, если вывод не направлен в tty

Использовать ANSI-последовательности экранирования в форматах Pretty. 0 — отключено, 1 — включено, 'auto' — включено, если вывод идёт в терминал.

Тип
UInt64
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
24.61Добавлена настройка для отображения имён столбцов в нижнем колонтитуле при большом количестве строк. Пороговое значение задаётся параметром output_format_pretty_display_footer_column_names_min_rows.

Отображает имена столбцов в нижнем колонтитуле, если в таблице много строк.

Возможные значения:

  • 0 — Имена столбцов не отображаются в нижнем колонтитуле.
  • 1 — Имена столбцов отображаются в нижнем колонтитуле, если количество строк больше или равно пороговому значению, заданному в output_format_pretty_display_footer_column_names_min_rows (по умолчанию — 50).

Пример

Запрос:

SELECT *, toTypeName(*) FROM (SELECT * FROM system.numbers LIMIT 1000);

Результат:

      ┌─number─┬─toTypeName(number)─┐
   1. │      0 │ UInt64             │
   2. │      1 │ UInt64             │
   3. │      2 │ UInt64             │
   ...
 999. │    998 │ UInt64             │
1000. │    999 │ UInt64             │
      └─number─┴─toTypeName(number)─┘
Тип
UInt64
По умолчанию
50
История версий
ВерсияЗначение по умолчаниюКомментарий
24.650Добавлена настройка, управляющая пороговым значением для output_format_pretty_display_footer_column_names_min_rows. Значение по умолчанию — 50.

Задает минимальное количество строк, при котором будет отображаться нижний колонтитул с именами столбцов, если включена настройка output_format_pretty_display_footer_column_names.

output_format_pretty_fallback_to_vertical

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
25.11новая настройка

Если настройка включена и таблица широкая, но содержит мало строк, формат Pretty будет выводить её так же, как формат Vertical. Подробную настройку этого поведения см. в output_format_pretty_fallback_to_vertical_max_rows_per_chunk и output_format_pretty_fallback_to_vertical_min_table_width.

output_format_pretty_fallback_to_vertical_max_rows_per_chunk

Тип
UInt64
По умолчанию
10
История версий
ВерсияЗначение по умолчаниюКомментарий
25.110Новая настройка

Переключение на формат Vertical (см. output_format_pretty_fallback_to_vertical) будет выполняться только в том случае, если количество записей во фрагменте не превышает указанное значение.

output_format_pretty_fallback_to_vertical_min_columns

Тип
UInt64
По умолчанию
5
История версий
ВерсияЗначение по умолчаниюКомментарий
25.15новая настройка

Переключение на формат Vertical (см. output_format_pretty_fallback_to_vertical) произойдёт только в том случае, если количество столбцов больше указанного значения.

output_format_pretty_fallback_to_vertical_min_table_width

Тип
UInt64
По умолчанию
250
История версий
ВерсияЗначение по умолчаниюКомментарий
25.1250новая настройка

Переход к формату Vertical (см. output_format_pretty_fallback_to_vertical) выполняется только если суммарная длина столбцов таблицы не меньше указанного значения либо хотя бы одно значение содержит символ перевода строки.

output_format_pretty_glue_chunks

Тип
UInt64Auto
По умолчанию
auto
История версий
ВерсияЗначение по умолчаниюКомментарий
25.5autoНовая настройка, которая делает форматы Pretty более удобными для восприятия.

Если данные, отображаемые в форматах Pretty, поступили в нескольких фрагментах, даже с задержкой, но следующий фрагмент имеет ту же ширину столбцов, что и предыдущий, используйте ANSI-последовательности экранирования, чтобы вернуться к предыдущей строке и перезаписать нижний колонтитул предыдущего фрагмента, продолжив его данными из нового фрагмента. Это делает результат визуально более приятным.

0 — отключено, 1 — включено, 'auto' — включено при выводе в терминал.

output_format_pretty_grid_charset

Тип
String
По умолчанию
UTF-8

Набор символов для отображения границ таблицы. Доступные наборы символов: ASCII, UTF-8 (по умолчанию).

В interactive mode clickhouse-client автоматически переключается на ASCII, если терминал не поддерживает UTF-8 (это определяется переменными окружения LC_ALL, LC_CTYPE и LANG), если только этот параметр не задан явно.

output_format_pretty_highlight_digit_groups

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
24.31Если параметр включен и вывод осуществляется в терминал, цифры, соответствующие тысячам, миллионам и т. д., подчеркиваются.

Если параметр включен и вывод осуществляется в терминал, цифры, соответствующие тысячам, миллионам и т. д., подчеркиваются.

output_format_pretty_highlight_trailing_spaces

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
25.11Новая настройка.

Если настройка включена и вывод идет в терминал, конечные пробелы подсвечиваются серым цветом и подчеркиваются.

output_format_pretty_max_column_name_width_cut_to

Тип
UInt64
По умолчанию
24
История версий
ВерсияЗначение по умолчаниюКомментарий
25.124новая настройка

Если имя столбца слишком длинное, оно будет обрезано до этой длины. Имя столбца будет обрезано, если его длина превышает сумму output_format_pretty_max_column_name_width_cut_to и output_format_pretty_max_column_name_width_min_chars_to_cut.

output_format_pretty_max_column_name_width_min_chars_to_cut

Тип
UInt64
По умолчанию
4
История версий
ВерсияЗначение по умолчаниюКомментарий
25.14новая настройка

Минимальное количество символов, на которое нужно сократить имя столбца, если оно слишком длинное. Имя столбца будет сокращено, если его длина превышает output_format_pretty_max_column_name_width_cut_to плюс output_format_pretty_max_column_name_width_min_chars_to_cut.

output_format_pretty_max_column_pad_width

Тип
UInt64
По умолчанию
250

Максимальная ширина заполнения для всех значений в столбце в форматах Pretty.

output_format_pretty_max_rows

Тип
UInt64
По умолчанию
1000
История версий
ВерсияЗначение по умолчаниюКомментарий
25.21000Так удобнее: меньше прокручивать.

Ограничение количества строк для форматов Pretty.

output_format_pretty_max_value_width

Тип
UInt64
По умолчанию
10000

Максимальная ширина значения, отображаемого в форматах Pretty. Если ширина больше, значение будет обрезано. Значение 0 означает, что обрезка не выполняется.

output_format_pretty_max_value_width_apply_for_single_value

Тип
UInt64
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.30Одиночные значения в форматах Pretty не будут обрезаться.

Обрезать значения (см. настройку output_format_pretty_max_value_width) только в том случае, если это не одиночное значение в блоке. В противном случае выводить его полностью, что особенно полезно для запроса SHOW CREATE TABLE.

output_format_pretty_multiline_fields

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
25.11Новая настройка

Если включено, форматы Pretty будут отображать многострочные поля внутри ячейки таблицы, благодаря чему сохранятся границы таблицы. Если нет, они будут отображаться как есть, что может исказить таблицу (при этом у отключения этой настройки есть и плюс: многострочные значения будет проще копировать и вставлять).

output_format_pretty_named_tuples_as_json

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
25.121Новая настройка, определяющая, выводятся ли именованные Tuple в формате Pretty как объекты JSON

Определяет, выводятся ли именованные Tuple в формате Pretty в виде красиво отформатированных объектов JSON.

output_format_pretty_row_numbers

Тип
Bool
По умолчанию
1
История версий
ВерсияЗначение по умолчаниюКомментарий
24.31Это удобнее в использовании.

Добавляет номера перед каждой строкой в формате вывода Pretty

output_format_pretty_single_large_number_tip_threshold

Тип
UInt64
По умолчанию
1000000
История версий
ВерсияЗначение по умолчаниюКомментарий
24.21000000Выводить справа от таблицы понятную числовую подсказку, если блок состоит из одного числа, превышающего это значение (кроме 0)

Выводить справа от таблицы понятную числовую подсказку, если блок состоит из одного числа, превышающего это значение (кроме 0)

output_format_pretty_squash_consecutive_ms

Тип
UInt64
По умолчанию
50
История версий
ВерсияЗначение по умолчаниюКомментарий
25.150Добавлена новая настройка

Ожидает следующий блок в течение указанного количества миллисекунд и перед выводом объединяет его с предыдущим. Это позволяет избежать слишком частого вывода слишком маленьких блоков, сохраняя при этом возможность отображать данные в режиме стриминга.

output_format_pretty_squash_max_wait_ms

Тип
UInt64
По умолчанию
1000
История версий
ВерсияЗначение по умолчаниюКомментарий
25.11000Добавлена новая настройка

Выводить отложенный блок в форматах Pretty, если с момента предыдущего вывода прошло больше указанного количества миллисекунд.

output_format_pretty_use_nbsp_for_padding

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
26.60Новая настройка. Если включена, дополнение в форматах вывода `Pretty` отображается с помощью `U+00A0`, поэтому оно сохраняется при копировании и вставке через инструменты, которые сжимают последовательности обычных пробелов.

Если включено, дополнение в форматах вывода Pretty отображается с помощью U+00A0 вместо пробела ASCII. В моноширинном шрифте вывод визуально остается тем же, но дополнение сохраняется при использовании инструментов, которые сжимают или обрезают последовательности обычных пробелов. Действует только если output_format_pretty_grid_charset имеет значение UTF-8.

output_format_protobuf_nullables_with_google_wrappers

Тип
Bool
По умолчанию
0

При сериализации столбцов с типом Nullable с помощью обёрток Google значения по умолчанию сериализуются как пустые обёртки. Если этот параметр отключён, значения по умолчанию и значения NULL не сериализуются

output_format_schema

Путь к файлу, в который будет сохранена автоматически сгенерированная схема в формате Cap'n Proto или Protobuf.

output_format_sql_insert_include_column_names

Тип
Bool
По умолчанию
1

Добавлять имена столбцов в запрос INSERT

output_format_sql_insert_max_batch_size

Тип
UInt64
По умолчанию
65409

Максимальное количество строк в одном операторе INSERT.

output_format_sql_insert_quote_names

Тип
Bool
По умолчанию
1

Заключать имена столбцов в символы «`»

output_format_sql_insert_table_name

Тип
String
По умолчанию
table

Название таблицы в выводимом запросе INSERT

output_format_sql_insert_use_replace

Тип
Bool
По умолчанию
0

Использовать оператор REPLACE вместо оператора INSERT

output_format_trim_fixed_string

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
26.30Новая настройка для удаления завершающих нулевых байтов из значений FixedString в текстовых форматах вывода

Удаляет завершающие null-байты из значений FixedString в текстовых форматах вывода. Например, toFixedString('John', 8) выводится как John, а не John\0\0\0\0.

output_format_tsv_crlf_end_of_line

Тип
Bool
По умолчанию
0

Если установлено значение true, в формате TSV в качестве конца строки будет использоваться \r\n вместо \n.

output_format_values_escape_quote_with_quote

Тип
Bool
По умолчанию
0
История версий
ВерсияЗначение по умолчаниюКомментарий
24.20Если true, экранировать ' как '', иначе использовать \'

Если true, экранировать ' как '', иначе использовать \'

output_format_write_statistics

Тип
Bool
По умолчанию
1

Записывает статистику о количестве прочитанных строк, байтов и затраченном времени в подходящих форматах вывода.

Включено по умолчанию

Navigation