Essas configurações são geradas automaticamente a partir do código-fonte.
output_format_always_write_decimal_point_in_float_and_decimal
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.6 | 0 | Nova configuração para sempre exibir o separador decimal em números de ponto flutuante e Decimal em formatos de texto, mesmo quando o valor for um número inteiro. |
Sempre exibe o separador decimal em números de ponto flutuante e Decimal em formatos de texto, mesmo quando o valor for um número inteiro. Por exemplo, gera 1. em vez de 1.
Desativado por padrão.
output_format_arrow_compression_method
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 23.3 | lz4_frame | Usa compressão lz4 no formato de saída Arrow por padrão |
Método de compressão para o formato de saída Arrow. Codecs suportados: lz4_frame, zstd, none (sem compressão)
output_format_arrow_date_as_uint16
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.2 | 0 | Grava valores Date como Arrow DATE32 em vez de UInt16 simples por padrão. |
Grava valores Date como números simples de 16 bits (lidos novamente como UInt16), em vez de convertê-los para o tipo Arrow DATE32 de 32 bits (lido novamente como Date32).
output_format_arrow_fixed_string_as_fixed_byte_array
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 23.2 | 1 | Usa o tipo Arrow FIXED_SIZE_BINARY para FixedString por padrão |
Use o tipo Arrow FIXED_SIZE_BINARY em vez de Binary para colunas do tipo FixedString.
output_format_arrow_low_cardinality_as_dictionary
Habilita a saída do tipo LowCardinality como o tipo Dictionary do Arrow
output_format_arrow_string_as_string
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.3 | 1 | O ClickHouse permite dados binários arbitrários no tipo de dado String, que normalmente usa UTF-8. Strings de Parquet/ORC/Arrow oferecem suporte apenas a UTF-8. Por isso, é possível escolher qual tipo de dado do Arrow usar para o tipo de dado String do ClickHouse: String ou Binary. Embora Binary seja mais correto e compatível, usar String por padrão atenderá às expectativas do usuário na maioria dos casos. |
Usar o tipo String do Arrow em vez de Binary para colunas String
output_format_arrow_unsupported_types_as_binary
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.4 | 1 | Nova configuração para converter tipos do CH sem suporte em binário do Arrow, em vez de gerar a exceção UNKNOWN_TYPE. |
Produz, como dados binários brutos, tipos sem conversão. Se false - esses tipos gerariam a exceção UNKNOWN_TYPE.
output_format_arrow_use_64_bit_indexes_for_dictionary
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.1 | 0 | Permite usar o tipo de índice de 64 bits em dicionários Arrow |
| 24.1 | 0 | Permite usar o tipo de índice de 64 bits em dicionários Arrow |
Sempre usa inteiros de 64 bits para índices de dicionário no formato Arrow
output_format_arrow_use_signed_indexes_for_dictionary
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.1 | 1 | Usa o tipo de índice com sinal para dicionários Arrow por padrão, como recomendado |
Use inteiros com sinal para os índices de dicionário no formato Arrow
output_format_avro_codec
codec de compressão usado na saída. Valores possíveis: 'null', 'deflate', 'snappy', 'zstd'.
output_format_avro_confluent_subject
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.5 | Nova configuração para especificar o nome do subject para registrar o schema no Confluent Schema Registry ao gravar a saída AvroConfluent. |
Para o formato de saída AvroConfluent: o nome do subject sob o qual o schema é registrado no Confluent Schema Registry. Obrigatório ao gravar a saída AvroConfluent.
output_format_avro_rows_in_file
Número máximo de linhas em um arquivo (se o armazenamento permitir)
output_format_avro_string_column_pattern
Para o formato Avro: regexp das colunas String a serem selecionadas como String AVRO.
output_format_avro_sync_interval
Intervalo de sincronização, em bytes.
output_format_binary_encode_types_in_binary_format
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.7 | 0 | Adicionada nova configuração para permitir gravar nomes de tipos em formato binário no formato de saída RowBinaryWithNamesAndTypes |
Gravar tipos de dados em formato binário em vez de nomes de tipos no formato de saída RowBinaryWithNamesAndTypes
output_format_binary_write_json_as_string
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.10 | 0 | Adiciona nova configuração para gravar valores do tipo JSON como valores String com conteúdo JSON no formato de saída RowBinary |
Grava valores do tipo de dados JSON como valores String com conteúdo JSON no formato de saída RowBinary.
output_format_bson_string_as_string
Use o tipo String do BSON em vez de Binary para colunas do tipo String.
output_format_compression_level
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.1 | 3 | Permite alterar o nível de compressão na saída da consulta |
Nível de compressão padrão quando a saída da consulta é comprimida. A configuração é aplicada quando a consulta SELECT usa INTO OUTFILE ou ao gravar em funções de tabela file, url, hdfs, s3 ou azureBlobStorage.
Valores possíveis: de 1 a 22
output_format_compression_zstd_window_log
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.1 | 0 | Permite alterar o window log do zstd na saída da consulta quando a compressão zstd é usada |
Pode ser usado quando o método de compressão de saída é zstd. Se for maior que 0, essa configuração define explicitamente o tamanho da janela de compressão (potência de 2) e ativa o modo de longo alcance da compressão zstd. Isso pode ajudar a obter uma melhor razão de compressão.
Valores possíveis: números não negativos. Observe que, se o valor for muito pequeno ou muito grande, zstdlib lançará uma exceção. Os valores típicos variam de 20 (tamanho da janela = 1MB) a 30 (tamanho da janela = 1GB).
output_format_csv_crlf_end_of_line
Se estiver definido como true, o final de linha no formato CSV será \r\n em vez de \n.
output_format_csv_header_serialize_tuple_into_separate_columns
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.7 | 1 | Nova configuração. Quando output_format_csv_serialize_tuple_into_separate_columns está habilitada, o cabeçalho de CSVWithNames/CSVWithNamesAndTypes agora achata colunas Tuple em seus campos folha para que a largura do cabeçalho corresponda aos dados. Defina como false para restaurar o cabeçalho anterior com um único nome. |
Quando output_format_csv_serialize_tuple_into_separate_columns está habilitada, as linhas de cabeçalho de CSVWithNames e CSVWithNamesAndTypes achatam cada coluna Tuple simples em seus campos folha (nomes com ponto como t.a, t.b e os nomes de tipo dos campos folha), para que o cabeçalho tenha o mesmo número de colunas que os dados. Uma coluna Nullable(Tuple) nunca é achatada (seus dados permanecem como um único campo CSV), portanto seu cabeçalho mantém o único nome e tipo de coluna de nível superior. Para CustomSeparated*, esse achatamento se aplica somente quando format_custom_escaping_rule = 'CSV' e format_custom_field_delimiter é um único caractere igual a format_csv_delimiter; caso contrário (por exemplo, o delimitador de tabulação padrão ou format_custom_field_delimiter = '|'), o cabeçalho permanece não achatado para continuar correspondendo aos dados. Defina como 0 para manter o comportamento anterior, em que o cabeçalho mantém o único nome e tipo Tuple de nível superior.
Nota: um cabeçalho achatado não é lido de volta em uma Tuple por nome quando input_format_with_names_use_header = 1. Para ler esses dados de volta em uma Tuple, defina essa configuração como 0 na saída ou leia com input_format_with_names_use_header = 0 (e, para os formatos *WithNamesAndTypes CSVWithNamesAndTypes e CustomSeparatedWithNamesAndTypes, também input_format_with_types_use_header = 0, já que, caso contrário, a linha de tipos achatada é validada em relação ao único campo de entrada Tuple de nível superior e é rejeitada).
output_format_csv_serialize_tuple_into_separate_columns
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.6 | 1 | Foi adicionada uma nova forma de interpretar Tuplas no formato CSV. |
| 24.3 | 1 | Foi adicionada uma nova forma de interpretar Tuplas no formato CSV. |
Se estiver definido como true, colunas Tuple simples no formato CSV serão serializadas como colunas separadas (ou seja, sua estrutura aninhada na tupla é perdida).
Esse achatamento se aplica apenas a Tuple simples. Um Nullable(Tuple) é sempre serializado como um único campo CSV (para que linhas NULL e não nulas ocupem o mesmo número de campos), independentemente dessa configuração.
output_format_decimal_trailing_zeros
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 21.9 | 0 | Não exibe zeros à direita na representação textual de tipos Decimal por padrão, para uma saída visualmente melhor |
Exibe zeros à direita ao imprimir valores Decimal. Ex.: 1.230000 em vez de 1.23.
Desabilitado por padrão.
output_format_float_precision
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.6 | 0 | Uma nova configuração para controlar os dígitos decimais na saída de valores de ponto flutuante |
Quando diferente de zero, formata a saída de valores de ponto flutuante (Float32, Float64, BFloat16) com no máximo esta quantidade de dígitos após o separador decimal (os zeros à direita são removidos).
Quando 0 (o padrão), usa a representação round-trip mais curta.
Valores grandes demais para notação fixa e valores cuja magnitude é tão pequena que o arredondamento para a precisão solicitada faria perder todos os dígitos significativos (a mantissa se tornaria ±0) são emitidos em notação científica. Nesses casos de fallback, a mantissa pode conter mais dígitos fracionários do que o número solicitado.
Intervalo válido: de 0 a 100.
output_format_image_height
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.6 | 1024 | Nova configuração que define a altura da imagem de saída para formatos de saída de imagem, como PNG. |
A altura, em pixels, da imagem de saída para formatos de saída de imagem, como PNG.
Valor padrão: 1024.
output_format_image_streaming_animation
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.8 | 0 | Nova configuração que controla se formatos de saída de imagem, como `PNG`, gravam cada quadro de uma animação assim que o próximo valor de `t` é recebido, em vez de manter todos os quadros em buffer na memória. |
Para formatos de saída de imagem, como PNG, grave cada quadro de uma animação assim que o próximo valor da coluna t for recebido, em vez de manter todos os quadros em buffer na memória até o fim da consulta.
Apenas um quadro é mantido na memória, e os quadros são enviados para a saída enquanto a consulta ainda está em execução. Em contrapartida, os valores de t devem ser não decrescentes; caso contrário, a consulta lança uma exceção. Além disso, o número de quadros não é conhecido quando o cabeçalho da animação precisa ser gravado, portanto, a contagem declarada de quadros é um limite superior, e não o valor exato. Os navegadores reproduzem esse arquivo, mas os decodificadores que confiam na contagem declarada relatam um erro após o último quadro real.
Valor padrão: false.
output_format_image_terminal_mode
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.6 | Nova configuração que controla se formatos de saída de imagem, como PNG, são renderizados diretamente no terminal usando um protocolo de imagem inline. |
Para formatos de saída de imagem, como PNG, renderize a imagem diretamente no terminal usando um protocolo de imagem inline em vez de gravar os bytes brutos da imagem.
Valores possíveis:
- `` (vazio) — grava os bytes brutos da imagem (padrão).
iterm— usa o protocolo de imagem inline do iTerm2.kitty— usa o protocolo gráfico do Kitty.sixel— usa o protocolo Sixel.auto— se a saída for um terminal, detecta as capacidades dele e usaiterm,kittyousixel(nessa ordem); caso contrário, grava os bytes brutos da imagem.
Valor padrão: `` (vazio).
output_format_image_time_divisor_seconds
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.8 | 60 | Nova configuração que controla o denominador da unidade de tempo da coluna `t`, fazendo com que formatos de saída de imagem, como `PNG`, produzam uma animação. |
O denominador da unidade de tempo da coluna t, em segundos, para formatos de saída de imagem, como PNG.
Consulte output_format_image_time_multiplier_seconds.
Valor padrão: 60.
output_format_image_time_multiplier_seconds
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.8 | 1 | Nova configuração que controla o numerador da unidade de tempo da coluna `t`, fazendo com que formatos de saída de imagem, como `PNG`, produzam uma animação. |
O numerador, em segundos, da unidade de tempo da coluna t para formatos de saída de imagem, como PNG.
A presença de uma coluna t faz com que o formato produza uma animação, na qual t representa o deslocamento temporal relativo
do quadro. Uma unidade de t corresponde a output_format_image_time_multiplier_seconds / output_format_image_time_divisor_seconds segundos.
Com os valores padrão (1 e 60), uma unidade de t equivale a 1/60 de segundo.
Valor padrão: 1.
output_format_image_width
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.6 | 1024 | Nova configuração que controla a largura, em pixels, da imagem de saída para formatos de saída de imagem, como PNG. |
A largura, em pixels, da imagem de saída para formatos de saída de imagem, como PNG.
Valor padrão: 1024.
output_format_json_array_of_rows
Habilita a saída de todas as linhas como um array JSON no formato JSONEachRow.
Valores possíveis:
- 1 — o ClickHouse retorna todas as linhas como um array, com cada linha no formato
JSONEachRow. - 0 — o ClickHouse retorna cada linha separadamente no formato
JSONEachRow.
Exemplo de uma consulta com essa configuração habilitada
Consulta:
SET output_format_json_array_of_rows = 1;
SELECT number FROM numbers(3) FORMAT JSONEachRow;Resultado:
[
{"number":"0"},
{"number":"1"},
{"number":"2"}
]Exemplo de consulta com a configuração desativada
Consulta:
SET output_format_json_array_of_rows = 0;
SELECT number FROM numbers(3) FORMAT JSONEachRow;Resultado:
{"number":"0"}
{"number":"1"}
{"number":"2"}output_format_json_escape_forward_slashes
Controla o escape de barras (/) em saídas de strings no formato de saída JSON. Isso é destinado à compatibilidade com JavaScript. Não confunda com barras invertidas, que são sempre escapadas.
Habilitado por padrão.
output_format_json_map_as_array_of_tuples
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.7 | 0 | Nova configuração |
Serializa colunas do tipo map como arrays JSON de tuplas.
Desativada por padrão.
output_format_json_named_tuples_as_objects
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 22.6 | 1 | Permite serializar colunas de tuplas nomeadas como objetos JSON nos formatos JSON por padrão |
Serializa colunas de tuplas nomeadas como objetos JSON.
Ativado por padrão.
output_format_json_pretty_print
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 1 | Exibe valores no formato Pretty no formato de saída JSON por padrão |
Essa configuração determina como estruturas aninhadas, como Tuples, Maps e Arrays, são exibidas dentro do array data ao usar o formato de saída JSON.
Por exemplo, em vez da seguinte saída:
"data":
[
{
"tuple": {"a":1,"b":2,"c":3},
"array": [1,2,3],
"map": {"a":1,"b":2,"c":3}
}
],A saída será formatada como:
"data":
[
{
"tuple": {
"a": 1,
"b": 2,
"c": 3
},
"array": [
1,
2,
3
],
"map": {
"a": 1,
"b": 2,
"c": 3
}
}
],Habilitado por padrão.
output_format_json_quote_64bit_floats
Controla o uso de aspas em floats de 64 bits quando são gerados em formatos JSON*.
Desabilitado por padrão.
output_format_json_quote_64bit_integers
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.8 | 0 | Desativa, por padrão, as aspas em inteiros de 64 bits no JSON |
Controla o uso de aspas em inteiros de 64 bits ou maiores (como UInt64 ou Int128) quando são gerados no formato JSON.
Por padrão, esses inteiros são colocados entre aspas. Esse comportamento é compatível com a maioria das implementações de JavaScript.
Valores possíveis:
- 0 — Os inteiros são gerados sem aspas.
- 1 — Os inteiros são colocados entre aspas.
output_format_json_quote_decimals
Controla o uso de aspas em valores decimais nos formatos de saída JSON.
Desativado por padrão.
output_format_json_quote_denormals
Habilita a saída de +nan, -nan, +inf, -inf no formato de saída JSON.
Valores possíveis:
- 0 — Desabilitado.
- 1 — Habilitado.
Exemplo
Considere a seguinte tabela account_orders:
┌─id─┬─name───┬─duration─┬─period─┬─area─┐
│ 1 │ Andrew │ 20 │ 0 │ 400 │
│ 2 │ John │ 40 │ 0 │ 0 │
│ 3 │ Bob │ 15 │ 0 │ -100 │
└────┴────────┴──────────┴────────┴──────┘Quando output_format_json_quote_denormals = 0, a consulta retorna valores null na saída:
SELECT area/period FROM account_orders FORMAT JSON;{
"meta":
[
{
"name": "divide(area, period)",
"type": "Float64"
}
],
"data":
[
{
"divide(area, period)": null
},
{
"divide(area, period)": null
},
{
"divide(area, period)": null
}
],
"rows": 3,
"statistics":
{
"elapsed": 0.003648093,
"rows_read": 3,
"bytes_read": 24
}
}Quando output_format_json_quote_denormals = 1, a consulta retorna:
{
"meta":
[
{
"name": "divide(area, period)",
"type": "Float64"
}
],
"data":
[
{
"divide(area, period)": "inf"
},
{
"divide(area, period)": "-nan"
},
{
"divide(area, period)": "-inf"
}
],
"rows": 3,
"statistics":
{
"elapsed": 0.000070241,
"rows_read": 3,
"bytes_read": 24
}
}output_format_json_skip_null_value_in_named_tuples
Ignora pares chave-valor com valor NULL ao serializar colunas de tuplas nomeadas como objetos JSON. Isso só é válido quando output_format_json_named_tuples_as_objects é true.
output_format_json_validate_utf8
Controla a validação de sequências UTF-8 nos formatos de saída JSON; não afeta os formatos JSON/JSONCompact/JSONColumnsWithMetadata, que sempre validam UTF-8.
Desabilitado por padrão.
output_format_markdown_escape_special_characters
Quando ativado, escapa caracteres especiais em Markdown.
Common Mark define os seguintes caracteres especiais que podem ser escapados por :
! " # $ % & ' ( ) * + , - . / : ; < = > ? @ [ \ ] ^ _ ` { | } ~Valores possíveis:
- 0 — Desativado.
- 1 — Ativado.
output_format_msgpack_uuid_representation
A forma de representar UUID no formato MsgPack.
output_format_native_encode_types_in_binary_format
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.7 | 0 | Adicionada nova configuração para permitir gravar nomes de tipos em formato binário no formato de saída Native |
Grava os tipos de dados em formato binário em vez dos nomes dos tipos no formato de saída Native
output_format_native_use_flattened_dynamic_and_json_serialization
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.6 | 0 | Adiciona serializações achatadas de Dynamic/JSON ao Native format |
Grava os dados de colunas JSON e Dynamic em formato achatado (todos os tipos/caminhos como subcolunas separadas).
output_format_native_write_json_as_string
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.10 | 0 | Adiciona nova configuração para permitir gravar uma coluna JSON como uma única coluna String no formato Native |
Grava os dados de uma coluna JSON como uma coluna String contendo strings JSON, em vez da serialização JSON nativa padrão.
output_format_orc_compression_block_size
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.8 | 262144 | Nova configuração |
O tamanho, em bytes, do bloco de compressão do formato de saída ORC.
output_format_orc_compression_method
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.3 | zstd | Parquet/ORC/Arrow suportam vários métodos de compressão, incluindo lz4 e zstd. O ClickHouse oferece suporte a todos esses métodos de compressão. Algumas ferramentas mais limitadas, como 'duckdb', não suportam o método de compressão `lz4`, que é mais rápido; por isso, definimos zstd como padrão. |
| 23.3 | lz4_frame | Usa compressão lz4 no formato de saída ORC por padrão |
Método de compressão para o formato de saída ORC. Codecs compatíveis: lz4, snappy, zlib, zstd, none (sem compressão)
output_format_orc_dictionary_key_size_threshold
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.9 | 0 | Para uma coluna String no formato de saída ORC, se o número de valores distintos for maior que esta fração do número total de linhas não NULL, desative a codificação de dicionário. Caso contrário, a codificação de dicionário permanecerá habilitada |
Para uma coluna String no formato de saída ORC, se o número de valores distintos for maior que esta fração do número total de linhas não NULL, desative a codificação de dicionário. Caso contrário, a codificação de dicionário permanecerá habilitada
output_format_orc_row_index_stride
Stride alvo do índice de linha no formato de saída ORC
output_format_orc_string_as_string
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.3 | 1 | O ClickHouse permite dados binários arbitrários no tipo de dado String, que normalmente usa UTF-8. Strings em Parquet/ORC/Arrow oferecem suporte apenas a UTF-8. Por isso, você pode escolher qual tipo de dado do Arrow usar para o tipo de dado String do ClickHouse: String ou Binary. Embora Binary seja mais correto e compatível, usar String por padrão corresponderá às expectativas dos usuários na maioria dos casos. |
Usar o tipo String do ORC em vez de Binary para colunas String
output_format_orc_writer_time_zone_name
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | GMT | O nome do fuso horário do gravador ORC; o fuso horário padrão do gravador ORC é GMT. |
O nome do fuso horário do gravador ORC; o fuso horário padrão do gravador ORC é GMT.
output_format_parallel_formatting
Ativa ou desativa a formatação paralela nos formatos de dados. Suportado apenas para os formatos TSV, TSKV, CSV e JSONEachRow.
Valores possíveis:
- 1 — Ativado.
- 0 — Desativado.
output_format_parquet_batch_size
Verifique o tamanho da página a cada esse número de linhas. Considere reduzir esse valor se você tiver colunas com tamanho médio dos valores acima de alguns KBs.
output_format_parquet_bloom_filter_bits_per_value
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.2 | 10.5 | Nova configuração. |
Número aproximado de bits a serem usados para cada valor distinto nos filtros de Bloom do Parquet. Taxas estimadas de falsos positivos:
- 6 bits - 10%
- 10.5 bits - 1%
- 16.9 bits - 0.1%
- 26.4 bits - 0.01%
- 41 bits - 0.001%
output_format_parquet_bloom_filter_flush_threshold_bytes
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.2 | 134217728 | Nova configuração. |
Em que ponto do arquivo Parquet os filtros de Bloom devem ser colocados. Os filtros de Bloom serão gravados em grupos de aproximadamente esse tamanho. Em particular:
- se for 0, os filtros de Bloom de cada grupo de linhas serão gravados imediatamente após o grupo de linhas,
- se for maior que o tamanho total de todos os filtros de Bloom, os filtros de Bloom de todos os grupos de linhas serão acumulados na memória e depois gravados juntos perto do fim do arquivo,
- caso contrário, os filtros de Bloom serão acumulados na memória e gravados sempre que seu tamanho total ultrapassar esse valor.
output_format_parquet_compression_method
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.3 | zstd | Parquet/ORC/Arrow oferecem suporte a vários métodos de compressão, incluindo lz4 e zstd. O ClickHouse oferece suporte a todos eles. Algumas ferramentas mais limitadas, como 'duckdb', não oferecem suporte ao método de compressão `lz4`, que é mais rápido; por isso, definimos zstd como padrão. |
| 23.3 | lz4 | Usa compressão lz4 por padrão no formato de saída Parquet |
Método de compressão do formato de saída Parquet. Codecs compatíveis: snappy, lz4, brotli, zstd, gzip, none (sem compressão)
output_format_parquet_data_page_size
Tamanho alvo da página em bytes, antes da compressão.
output_format_parquet_date_as_uint16
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.8 | 0 | Adicionada uma configuração de compatibilidade para uma pequena alteração incompatível introduzida anteriormente na versão 24.12. |
| 24.12 | 0 | Grava Date como Date32 em vez de UInt16 simples (esses são os dois tipos Parquet mais próximos de Date). |
Grava valores Date como números simples de 16 bits (lidos de volta como UInt16), em vez de convertê-los para um tipo DATE do Parquet de 32 bits (lido de volta como Date32).
output_format_parquet_datetime_as_uint32
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.12 | 0 | Grava valores DateTime como DateTime64(3) em vez de UInt32 (estes são os dois tipos Parquet mais próximos de DateTime). |
Grava valores DateTime como timestamp Unix bruto (lidos de volta como UInt32), em vez de convertê-los em milissegundos (lidos de volta como DateTime64(3)).
output_format_parquet_enum_as_byte_array
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.8 | 1 | Habilita, por padrão, a gravação de Enum como array de bytes em Parquet |
| 25.7 | 0 | Gravar enum usando o tipo físico do Parquet: BYTE_ARRAY e o tipo lógico: ENUM |
Gravar enum usando o tipo físico do Parquet: BYTE_ARRAY e o tipo lógico: ENUM
output_format_parquet_fixed_string_as_fixed_byte_array
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 23.2 | 1 | Usar o tipo Parquet FIXED_LENGTH_BYTE_ARRAY para FixedString por padrão |
Use o tipo Parquet FIXED_LEN_BYTE_ARRAY em vez de Binary para as colunas FixedString.
output_format_parquet_geometadata
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.7 | 1 | Uma nova configuração para permitir gravar informações sobre colunas geoespaciais nos metadados do Parquet e codificar colunas no formato WKB. |
Permite gravar informações sobre colunas geoespaciais nos metadados do Parquet e codificar colunas no formato WKB.
output_format_parquet_max_dictionary_size
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.8 | 1048576 | Nova configuração |
Se o tamanho do dicionário exceder essa quantidade de bytes, mude para a codificação sem dicionário. Defina como 0 para desativar a codificação por dicionário.
output_format_parquet_parallel_encoding
Codifica em Parquet usando várias threads.
output_format_parquet_row_group_size
Tamanho alvo do grupo de linhas, em linhas.
output_format_parquet_row_group_size_bytes
Tamanho alvo do grupo de linhas, em bytes, antes da compressão.
output_format_parquet_string_as_string
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.3 | 1 | O ClickHouse permite dados binários arbitrários no tipo de dado String, que normalmente usa UTF-8. Strings em Parquet/ORC/Arrow aceitam apenas UTF-8. Por isso, você pode escolher qual tipo de dado do Arrow usar para o tipo de dado String do ClickHouse: String ou Binary. Embora Binary seja mais correto e compatível, usar String por padrão atende melhor às expectativas do usuário na maioria dos casos. |
Use o tipo String do Parquet em vez de Binary para colunas String.
output_format_parquet_wide_integer_as_decimal
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.8 | 0 | Nova configuração para gravar valores `Int128`, `UInt128`, `Int256` e `UInt256` como valores `DECIMAL` padrão do Parquet. O valor anterior mantém a representação legada `FIXED_LEN_BYTE_ARRAY` little-endian. |
Grava valores Int128, UInt128, Int256 e UInt256 como valores DECIMAL do Parquet em conformidade com o padrão, na ordem de bytes big-endian. O padrão mantém a representação legada FIXED_LEN_BYTE_ARRAY não anotada e little-endian para garantir a compatibilidade com versões mais antigas do ClickHouse. A representação decimal permite estatísticas numéricas interoperáveis, mas alguns leitores de Parquet não oferecem suporte a precisões superiores a 38 ou 76.
output_format_parquet_write_bloom_filter
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.2 | 1 | Adicionado suporte à gravação de filtros de Bloom em arquivos Parquet. |
Grava filtros de Bloom em arquivos Parquet.
output_format_parquet_write_checksums
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.11 | 1 | Nova configuração. |
Grava checksums crc32 nos cabeçalhos de página do Parquet.
output_format_parquet_write_page_index
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.7 | 1 | Adiciona a possibilidade de gravar o índice de páginas em arquivos Parquet. |
Grava o índice de coluna e o índice de deslocamento (isto é, estatísticas sobre cada página de dados, que podem ser usadas para pushdown de filtros na leitura) em arquivos Parquet.
output_format_pretty_color
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.1 | auto | A configuração foi alterada para também permitir o valor auto, desabilitando as sequências de escape ANSI se a saída não for um tty |
Use sequências de escape ANSI nos formatos Pretty. 0 - desabilitado, 1 - habilitado, 'auto' - habilitado se for um terminal.
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.6 | 1 | Adiciona uma configuração para exibir os nomes das colunas no rodapé quando houver muitas linhas. O valor limite é controlado por output_format_pretty_display_footer_column_names_min_rows. |
Exibe os nomes das colunas no rodapé quando houver muitas linhas na tabela.
Possíveis valores:
- 0 — Nenhum nome de coluna é exibido no rodapé.
- 1 — Os nomes das colunas são exibidos no rodapé se a contagem de linhas for maior ou igual ao valor limite definido por output_format_pretty_display_footer_column_names_min_rows (50 por padrão).
Exemplo
Consulta:
SELECT *, toTypeName(*) FROM (SELECT * FROM system.numbers LIMIT 1000);Resultado:
┌─number─┬─toTypeName(number)─┐
1. │ 0 │ UInt64 │
2. │ 1 │ UInt64 │
3. │ 2 │ UInt64 │
...
999. │ 998 │ UInt64 │
1000. │ 999 │ UInt64 │
└─number─┴─toTypeName(number)─┘Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.6 | 50 | Adiciona uma configuração para controlar o valor limite da configuração output_format_pretty_display_footer_column_names_min_rows. Padrão: 50. |
Define o número mínimo de linhas a partir do qual um rodapé com nomes de colunas será exibido, se a configuração output_format_pretty_display_footer_column_names estiver habilitada.
output_format_pretty_fallback_to_vertical
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 1 | Nova configuração |
Se estiver habilitada e a tabela for larga, mas curta, o formato Pretty a exibirá como o formato Vertical.
Consulte output_format_pretty_fallback_to_vertical_max_rows_per_chunk e output_format_pretty_fallback_to_vertical_min_table_width para ajustar esse comportamento em mais detalhes.
output_format_pretty_fallback_to_vertical_max_rows_per_chunk
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 10 | Nova configuração |
O fallback para o formato Vertical (consulte output_format_pretty_fallback_to_vertical) só será ativado se o número de registros em um fragmento não exceder o valor especificado.
output_format_pretty_fallback_to_vertical_min_columns
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 5 | Nova configuração |
O fallback para o formato Vertical (consulte output_format_pretty_fallback_to_vertical) será ativado apenas se o número de colunas for maior que o valor especificado.
output_format_pretty_fallback_to_vertical_min_table_width
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 250 | Nova configuração |
O fallback para o formato Vertical (consulte output_format_pretty_fallback_to_vertical) será ativado apenas se a soma dos comprimentos das colunas em uma tabela for, no mínimo, o valor especificado ou se pelo menos um valor contiver um caractere de nova linha.
output_format_pretty_glue_chunks
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.5 | auto | Uma nova configuração para deixar os formatos Pretty mais bonitos. |
Se os dados renderizados nos formatos Pretty chegarem em vários fragmentos, mesmo com atraso, mas o próximo fragmento tiver as mesmas larguras de coluna que o anterior, use sequências de escape ANSI para voltar à linha anterior e sobrescrever o rodapé do fragmento anterior, continuando-o com os dados do novo fragmento. Isso torna o resultado visualmente mais agradável.
0 - desabilitado, 1 - habilitado, 'auto' - habilitado se for um terminal.
output_format_pretty_grid_charset
Conjunto de caracteres para imprimir as bordas da grade. Conjuntos de caracteres disponíveis: ASCII, UTF-8 (padrão).
No modo interativo, o clickhouse-client alterna automaticamente para ASCII quando o terminal não oferece suporte a UTF-8 (conforme determinado pelas variáveis de ambiente LC_ALL, LC_CTYPE e LANG), a menos que essa configuração seja especificada explicitamente.
output_format_pretty_highlight_digit_groups
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.3 | 1 | Se estiver habilitado e a saída for um terminal, destaque com sublinhado cada grupo de dígitos correspondente a milhares, milhões etc. |
Se estiver habilitado e a saída for um terminal, destaque com sublinhado cada grupo de dígitos correspondente a milhares, milhões etc.
output_format_pretty_highlight_trailing_spaces
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 1 | Nova configuração. |
Se estiver habilitado e a saída for um terminal, destaque os espaços à direita em cinza e com sublinhado.
output_format_pretty_max_column_name_width_cut_to
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 24 | Nova configuração |
Se o nome da coluna for muito longo, ele será truncado para este comprimento.
A coluna será truncada se for maior que output_format_pretty_max_column_name_width_cut_to mais output_format_pretty_max_column_name_width_min_chars_to_cut.
output_format_pretty_max_column_name_width_min_chars_to_cut
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 4 | Nova configuração |
Número mínimo de caracteres a serem cortados se o nome da coluna for longo demais.
A coluna será cortada se for maior que output_format_pretty_max_column_name_width_cut_to mais output_format_pretty_max_column_name_width_min_chars_to_cut.
output_format_pretty_max_column_pad_width
Largura máxima de preenchimento de todos os valores em uma coluna nos formatos Pretty.
output_format_pretty_max_rows
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.2 | 1000 | É melhor para a usabilidade — é preciso rolar menos. |
Limite de linhas para formatos Pretty.
output_format_pretty_max_value_width
Largura máxima do valor a ser exibido nos formatos Pretty. Se for maior, será cortado. O valor 0 significa que ele nunca será cortado.
output_format_pretty_max_value_width_apply_for_single_value
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.3 | 0 | Valores individuais em formatos Pretty não serão cortados. |
Corte os valores (consulte a configuração output_format_pretty_max_value_width) apenas quando não se tratar de um valor individual em um bloco. Caso contrário, gere-o por completo, o que é útil para a consulta SHOW CREATE TABLE.
output_format_pretty_multiline_fields
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 1 | Nova configuração |
Se ativado, os formatos Pretty renderizarão campos com várias linhas dentro da célula da tabela, preservando o contorno da tabela. Caso contrário, eles serão renderizados como estão, o que pode deformar a tabela (uma vantagem de mantê-lo desativado é que ficará mais fácil copiar e colar valores com várias linhas).
output_format_pretty_named_tuples_as_json
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.12 | 1 | Nova configuração para controlar se tuplas nomeadas no formato Pretty são exibidas como objetos JSON |
Controla se tuplas nomeadas no formato Pretty são exibidas como objetos JSON com formatação legível.
output_format_pretty_row_numbers
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.3 | 1 | Melhora a usabilidade. |
Adiciona números de linha antes de cada linha no formato de saída Pretty
output_format_pretty_single_large_number_tip_threshold
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.2 | 1000000 | Exibe uma indicação numérica legível no lado direito da tabela se o bloco consistir em um único número que exceda esse valor (exceto 0) |
Exibe uma indicação numérica legível no lado direito da tabela se o bloco consistir em um único número que exceda esse valor (exceto 0)
output_format_pretty_squash_consecutive_ms
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 50 | Nova configuração |
Aguarde o próximo bloco por até o número especificado de milissegundos e junte-o ao anterior antes de gravá-lo. Isso evita a saída frequente de blocos muito pequenos, mas ainda permite exibir os dados de forma contínua.
output_format_pretty_squash_max_wait_ms
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 25.1 | 1000 | Adiciona nova configuração |
Emite o bloco pendente nos formatos Pretty se tiver decorrido mais que o número especificado de milissegundos desde a saída anterior.
output_format_pretty_use_nbsp_for_padding
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.6 | 0 | Nova configuração. Quando habilitada, o espaçamento de preenchimento na saída `Pretty` é renderizado com `U+00A0`, para que seja preservado ao copiar e colar em ferramentas que comprimem sequências de espaços comuns. |
Quando habilitada, o espaçamento de preenchimento nos formatos de saída Pretty é renderizado com U+00A0 em vez de um espaço ASCII.
A saída continua visualmente idêntica em fonte monoespaçada, mas o espaçamento de preenchimento é preservado em ferramentas que comprimem ou removem sequências de espaços comuns.
Só se aplica quando output_format_pretty_grid_charset é UTF-8.
output_format_protobuf_nullables_with_google_wrappers
Ao serializar colunas Nullable com wrappers do Google, serializa os valores padrão como wrappers vazios. Se estiver desativado, os valores padrão e NULL não serão serializados
output_format_schema
O caminho do arquivo em que o esquema gerado automaticamente será salvo nos formatos Cap'n Proto ou Protobuf.
output_format_sql_insert_include_column_names
Inclui os nomes das colunas na consulta INSERT
output_format_sql_insert_max_batch_size
O número máximo de linhas em uma única instrução INSERT.
output_format_sql_insert_quote_names
Coloca os nomes das colunas entre caracteres '`'
output_format_sql_insert_table_name
O nome da tabela na consulta INSERT gerada na saída
output_format_sql_insert_use_replace
Use a instrução REPLACE em vez da instrução INSERT
output_format_trim_fixed_string
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 26.3 | 0 | Nova configuração para remover bytes nulos à direita de valores FixedString em formatos de saída de texto |
Remove bytes nulos à direita de valores FixedString em formatos de saída de texto. Por exemplo, toFixedString('John', 8) é exibido como John em vez de John\0\0\0\0.
output_format_tsv_crlf_end_of_line
Se definido como true, o fim de linha no formato TSV será \r\n em vez de \n.
output_format_values_escape_quote_with_quote
Histórico de versões
| Versão | Valor padrão | Comentário |
|---|---|---|
| 24.2 | 0 | Se true, escapa ' como ''; caso contrário, coloca entre aspas com \' |
Se true, escapa ' como ''; caso contrário, coloca entre aspas com \'
output_format_write_statistics
Escreve estatísticas sobre linhas lidas, bytes e o tempo decorrido em formatos de saída adequados.
Ativado por padrão