Descripción
Contiene métricas que se calculan periódicamente en segundo plano. Por ejemplo, la cantidad de RAM utilizada.
Una métrica es escalar (un único número en la columna value) o de clave-valor: desglosada por entidad, como por núcleo de CPU, dispositivo de bloques, interfaz de red o disco. Las métricas de clave-valor se representan como una única fila con un Map en la columna key_values (por ejemplo, CPUFrequencyMHz asigna la frecuencia a cada núcleo de CPU), y su columna value es NaN.
Columnas
metric(String) — Nombre de la métrica.value(Float64) — Valor de la métrica. Para las métricas de clave-valor (desglosadas por núcleo de CPU, dispositivo de bloque, …) es NaN y los valores se encuentran en la columnakey_values.key_values(Map(LowCardinality(String), Float64)) — Valores de una métrica de clave-valor, por ejemplo, con clave de número de núcleo de CPU o al nombre del dispositivo de bloque. Vacío para las métricas escalares.description(String - Descripción de la métrica)
Ejemplo
SELECT metric, value, key_values
FROM system.asynchronous_metrics
WHERE metric IN ('MemoryResident', 'OSUserTime', 'DiskTotal', 'BlockReadBytes', 'NetworkReceiveBytes')
ORDER BY metric┌─metric──────────────┬─────────────value─┬─key_values──────────────────────────────────────┐
│ BlockReadBytes │ nan │ {'nvme0n1':67420160} │
│ DiskTotal │ nan │ {'backups':34359738368,'default':5199475388416} │
│ MemoryResident │ 970743808 │ {} │
│ NetworkReceiveBytes │ nan │ {'docker0':0,'ens66':334554363} │
│ OSUserTime │ 32.11807291562506 │ {} │
└─────────────────────┴───────────────────┴─────────────────────────────────────────────────┘Se puede extraer una entidad individual de una métrica de clave-valor mediante el subíndice de Map:
SELECT key_values['default'] AS default_disk_total
FROM system.asynchronous_metrics
WHERE metric = 'DiskTotal'Descripción de las métricas
Las descripciones siguientes se generan a partir del código fuente en C++ mediante utils/generate-async-metrics-docs. La fuente única de referencia es la cadena literal que aparece junto al registro de cada métrica en src/Common/AsynchronousMetrics.cpp, src/Interpreters/ServerAsynchronousMetrics.cpp y src/Coordination/KeeperAsynchronousMetrics.cpp. Los nombres de las métricas que incluyen una parte variable (actualmente solo el grupo de conexiones HTTP) se muestran con un marcador de posición *name*; el servidor en ejecución los informa con el nombre concreto sustituido.
AsynchronousHeavyMetricsCalculationTimeSpent
Tiempo, en segundos, dedicado al cálculo de métricas pesadas asíncronas (relacionadas con tablas) (esta es la sobrecarga de las métricas asíncronas).
AsynchronousHeavyMetricsUpdateInterval
Intervalo de actualización de métricas pesadas relacionadas con tablas
AsynchronousMetricsCalculationTimeSpent
Tiempo en segundos dedicado al cálculo de las métricas asíncronas (esta es la sobrecarga de las métricas asíncronas).
AsynchronousMetricsUpdateInterval
Intervalo de actualización de métricas
AsyncLoggingQueueSize
Número de mensajes asíncronos en cola, pendientes de registro, con clave de nombre del canal de registro.
BlockActiveTime
Tiempo en segundos durante el cual cada dispositivo de bloques tuvo solicitudes de IO en cola. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockActiveTimePerOp
Similar a la métrica BlockActiveTime, pero el valor se divide entre el número de operaciones de IO para calcular el tiempo por operación. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockDiscardBytes
Número de bytes descartados en cada dispositivo de bloques. Estas operaciones son relevantes para las SSD. ClickHouse no utiliza operaciones de descarte, pero otros procesos del sistema pueden utilizarlas. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockDiscardMerges
Número de operaciones de descarte solicitadas a cada dispositivo de bloques y fusionadas por el planificador de E/S del sistema operativo. Estas operaciones son relevantes en SSD. ClickHouse no utiliza operaciones de descarte, pero pueden ser utilizadas por otros procesos del sistema. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockDiscardOps
Número de operaciones de descarte solicitadas a cada dispositivo de bloques. Estas operaciones son relevantes para las unidades SSD. ClickHouse no utiliza operaciones de descarte, pero pueden ser utilizadas por otros procesos del sistema. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockDiscardTime
Tiempo en segundos empleado en las operaciones de descarte solicitadas a cada dispositivo de bloques, acumulado entre todas las operaciones. Estas operaciones son relevantes para los SSD. Las operaciones de descarte no son utilizadas por ClickHouse, pero pueden ser utilizadas por otros procesos del sistema. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockInFlightOps
Este valor cuenta el número de solicitudes de E/S emitidas al controlador del dispositivo que aún no se han completado, para cada dispositivo de bloques. No incluye las solicitudes de E/S que están en la cola, pero que aún no se han emitido al controlador del dispositivo. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockQueueTime
Este valor cuenta el número de milisegundos que las solicitudes de IO han permanecido en espera en cada dispositivo de bloques. Si hay varias solicitudes de IO esperando, este valor aumentará como el producto del número de milisegundos por el número de solicitudes en espera. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockQueueTimePerOp
Similar a la métrica BlockQueueTime, pero el valor se divide por el número de operaciones de IO para calcular el tiempo por operación. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockReadBytes
Número de bytes leídos de cada dispositivo de bloques. Puede ser inferior al número de bytes leídos del sistema de archivos debido al uso de la caché de páginas del sistema operativo, que ahorra E/S. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockReadMerges
Número de operaciones de lectura solicitadas desde cada dispositivo de bloques y combinadas por el planificador de E/S del sistema operativo. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockReadOps
Número de operaciones de lectura solicitadas desde cada dispositivo de bloques. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockReadTime
Tiempo en segundos empleado en las operaciones de lectura solicitadas a cada dispositivo de bloques, acumulado entre todas las operaciones. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockWriteBytes
Número de bytes escritos en cada dispositivo de bloques. Puede ser inferior al número de bytes escritos en el sistema de archivos debido al uso de la caché de páginas del sistema operativo, que reduce la E/S. Una escritura en el dispositivo de bloques puede producirse más tarde que la escritura correspondiente en el sistema de archivos debido a la caché write-through. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockWriteMerges
Número de operaciones de escritura solicitadas a cada dispositivo de bloques y combinadas por el planificador de E/S del sistema operativo. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockWriteOps
Número de operaciones de escritura solicitadas a cada dispositivo de bloques. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
BlockWriteTime
Tiempo en segundos empleado en las operaciones de escritura solicitadas a cada dispositivo de bloques, acumulado entre todas las operaciones. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt
CGroupMaxCPU
El número máximo de núcleos de CPU según los CGroups.
CGroupMemoryTotal
La cantidad total de memoria del cgroup, en bytes. Si se indica como cero, el límite es el mismo que OSMemoryTotal.
CGroupMemoryUsed
La cantidad de memoria usada en el cgroup, en bytes. En cgroup v2, esto corresponde a anon + sock + la memoria no reclamable del kernel; en cgroup v1, esto es RSS. En ambos casos, se excluye la caché de páginas del sistema operativo del kernel (caché respaldada por archivos).
CGroupMemoryUsedWithoutPageCache
La cantidad de memoria utilizada en cgroup, en bytes, excluida la caché de páginas en espacio de usuario de ClickHouse. Se calcula como CGroupMemoryUsed menos el tamaño de la caché de páginas en espacio de usuario. Cuando la caché de páginas en espacio de usuario está deshabilitada, este valor equivale a CGroupMemoryUsed.
CGroupSystemTime
La proporción de tiempo durante la que el núcleo de la CPU estuvo ejecutando código del kernel del sistema operativo (system).
CGroupSystemTimeNormalized
El valor es similar a CGroupSystemTime, pero se divide entre el número de núcleos de CPU disponibles para medirse en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo la métrica media de utilización de recursos. Si se especifica, puede usarse la cuota de CPU de cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
CGroupUserTime
La proporción de tiempo durante la cual el núcleo de la CPU estuvo ejecutando código en espacio de usuario. Esto también incluye el tiempo durante el cual la CPU estuvo infrautilizada por razones internas de la propia CPU (cargas de memoria, paradas de la canalización, predicciones erróneas de bifurcación, ejecución de otro núcleo SMT).
CGroupUserTimeNormalized
El valor es similar a CGroupUserTime, pero se divide por el número de CPU cores disponibles para que se mida en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo la métrica media de utilización de recursos. Si se especifica, puede usarse la Cgroup CPU quota dividida por su período en lugar del número real de CPU cores, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
CompiledExpressionCacheBytesMax
Máximo de bytes configurado para la caché de expresiones compiladas. Holgura disponible = este valor menos CompiledExpressionCacheBytes (CurrentMetric).
CompiledExpressionCacheCountMax
Número máximo configurado de entradas en la caché de expresiones compiladas. Holgura disponible = este valor menos CompiledExpressionCacheCount (CurrentMetric).
CPUFrequencyMHz
La frecuencia actual de cada núcleo de CPU, en MHz, con clave de número de núcleo de CPU. La mayoría de las CPU modernas ajustan la frecuencia de forma dinámica para ahorrar energía y aprovechar Turbo Boost.
DeadBlobsQueueEstimate
Número estimado de blobs en cola para eliminarse del almacenamiento de objetos del disco (la cola de elementos eliminados del manager de blobs), con clave de nombre del disco. Los discos sin replicación de blobs notifican 0.
DiccionarioMaxUpdateDelay
El retraso máximo (en segundos) en la actualización del diccionario
DiccionarioTotalFailedUpdates
Número de errores desde la última carga exitosa en todos los diccionarios.
DiskAvailable
Bytes disponibles en cada disco (sistema de archivos virtual), con clave de nombre del disco. Los sistemas de archivos remotos pueden no proporcionar esta información y mostrar un valor elevado, como 16 EiB.
DiskGetObjectThrottlerAvailable
Número de solicitudes GetObject que pueden emitirse actualmente sin alcanzar el límite de throttling en cada disco (sistema de archivos virtual), con clave de nombre del disco. Es posible que los sistemas de archivos locales no proporcionen esta información.
DiskGetObjectThrottlerRPS
Límite de solicitudes GetObject por segundo en cada disco (sistema de archivos virtual), con clave en el nombre del disco. Es posible que los sistemas de archivos locales no proporcionen esta información.
DiskPutObjectThrottlerAvailable
Número de solicitudes PutObject que pueden emitirse actualmente sin alcanzar el límite de throttling en cada disco (sistema de archivos virtual), con clave en el nombre del disco. Es posible que los sistemas de archivos locales no proporcionen esta información.
DiskPutObjectThrottlerRPS
Límite de solicitudes PutObject por segundo en cada disco (sistema de archivos virtual), con clave en el nombre del disco. Es posible que los sistemas de archivos locales no proporcionen esta información.
DiskTotal
El tamaño total, en bytes, de cada disco (sistema de archivos virtual), con clave de nombre del disco. Es posible que los sistemas de archivos remotos no proporcionen esta información y puedan mostrar un valor elevado, como 16 EiB.
DiskUnreserved
Bytes disponibles en cada disco (sistema de archivos virtual), sin incluir las reservas para fusiones, recuperaciones y movimientos, con clave en nombre de disco. Es posible que los sistemas de archivos remotos no proporcionen esta información y puedan mostrar un valor elevado, como 16 EiB.
DiskUsed
Bytes usados en cada disco (sistema de archivos virtual), con clave en el nombre del disco. Los sistemas de archivos remotos no siempre proporcionan esta información.
EDACCorrectable
Número de errores de memoria ECC corregibles, con clave de número de controlador de memoria. Un valor alto de este indicador señala una RAM defectuosa que debe sustituirse de inmediato, ya que, en presencia de una gran cantidad de errores corregidos, también pueden producirse errores silenciosos, lo que provoca corrupción de datos. Fuente: /sys/devices/system/edac/mc/
EDACUncorrectable
El número de errores de memoria ECC no corregibles, con clave en el número del controlador de memoria. Un valor distinto de cero indica que la RAM está defectuosa y debe sustituirse de inmediato, ya que puede provocar corrupción de datos. Fuente: /sys/devices/system/edac/mc/
ExecutableUserDefinedFunctionMemoryResidentBytes
Suma del tamaño del conjunto residente (VmRSS) de todos los procesos en ejecución de las funciones definidas por el usuario executable y executable_pool, y de sus procesos descendientes, en bytes. Se incluyen los workers inactivos de executable_pool. Las páginas compartidas se contabilizan una vez por proceso, por lo que la suma constituye un límite superior y puede superar la huella única de memoria física de los procesos UDF.
ExecutableUserDefinedFunctionProcesses
Número de procesos en ejecución iniciados para las funciones definidas por el usuario de tipo executable y executable_pool, incluidos los procesos descendientes.
FilesystemCacheBytes
Total de bytes en el sistema de archivos virtual cache. Esta caché se almacena en disco.
FilesystemCacheCapacity
Capacidad total en el sistema de archivos virtual cache. Esta caché se almacena en disco.
FilesystemCacheFiles
Número total de segmentos de archivo almacenados en caché en el sistema de archivos virtual cache. Esta caché se almacena en disco.
FilesystemLogsPathAvailableBytes
Bytes disponibles en el volumen en el que está montada la ruta de logs de ClickHouse. Si este valor se aproxima a cero, debe ajustar la rotación de logs en el archivo de configuración.
FilesystemLogsPathAvailableINodes
El número de inodos disponibles en el volumen en el que está montada la ruta de logs de ClickHouse.
FilesystemLogsPathTotalBytes
El tamaño, en bytes, del volumen en el que está montada la ruta de logs de ClickHouse. Se recomienda disponer de al menos 10 GB para los logs.
FilesystemLogsPathTotalINodes
El número total de inodos en el volumen donde está montada la ruta de los logs de ClickHouse.
FilesystemLogsPathUsedBytes
Bytes usados en el volumen donde está montada la ruta de logs de ClickHouse.
FilesystemLogsPathUsedINodes
El número de inodos en uso en el volumen donde está montada la ruta de logs de ClickHouse.
FilesystemMainPathAvailableBytes
Bytes disponibles en el volumen en el que está montada la ruta principal de ClickHouse.
FilesystemMainPathAvailableINodes
La cantidad de inodos disponibles en el volumen donde está montada la ruta principal de ClickHouse. Si está cerca de cero, indica una configuración incorrecta y aparecerá el error 'no space left on device' incluso cuando el disco no esté lleno.
FilesystemMainPathTotalBytes
El tamaño, en bytes, del volumen donde está montada la ruta principal de ClickHouse.
FilesystemMainPathTotalINodes
El número total de inodos del volumen donde está montada la ruta principal de ClickHouse. Si es inferior a 25 millones, indica una mala configuración.
FilesystemMainPathUsedBytes
Bytes en uso en el volumen donde está montada la ruta principal de ClickHouse.
FilesystemMainPathUsedINodes
El número de inodos en uso en el volumen donde está montada la ruta principal de ClickHouse. Este valor corresponde, en su mayor parte, al número de archivos.
GRPCRejectedConnections
Número de conexiones rechazadas del protocolo GRPC.
GRPCThreads
Número de hilos del servidor del protocolo GRPC.
HashTableStatsCacheEntries
La cantidad de entradas en la caché de tamaños de las tablas hash. La caché de tamaños de las tablas hash se utiliza para la optimización predictiva de GROUP BY.
HashTableStatsCacheHits
Número de veces en que fue correcta la predicción del tamaño de una tabla hash.
HashTableStatsCacheMisses
Número de veces que la predicción del tamaño de una tabla hash fue incorrecta.
HTTPConnectionPoolgroup_nameTCPRcvBufTotalBytes
Memoria total del búfer de recepción TCP del kernel (sk_rmem_alloc) en todos los sockets del grupo de conexiones HTTP.
HTTPConnectionPoolgroup_nameTCPSndBufTotalBytes
Memoria total del búfer de transmisión TCP del kernel (sk_wmem_alloc) en todos los sockets del grupo de conexiones HTTP.
HTTPRejectedConnections
Número de conexiones rechazadas en la interfaz HTTP (sin TLS).
HTTPSecureRejectedConnections
Número de conexiones rechazadas de la interfaz HTTPS.
HTTPSecureThreads
Número de hilos del servidor de la interfaz HTTPS.
HTTPThreads
Número de hilos del servidor de la interfaz HTTP (sin TLS).
InterserverRejectedConnections
Número de conexiones rechazadas del protocolo de comunicación entre réplicas (sin TLS).
InterserverSecureRejectedConnections
Número de conexiones rechazadas del protocolo de comunicación entre réplicas (con TLS).
InterserverSecureThreads
Número de hilos del servidor del protocolo de comunicación entre réplicas (con TLS).
InterserverThreads
Número de hilos del servidor del protocolo de comunicación entre réplicas (sin TLS).
jemalloc.active
Métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.allocated
Métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.arenas.all.dirty_purged
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.arenas.all.muzzy_purged
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.arenas.all.pactive
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.arenas.all.pdirty
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.arenas.all.pmuzzy
Métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.arenas.dirty_decay_ms
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.background_thread.num_runs
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.background_thread.num_threads
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.background_thread.run_intervals
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.cache_arena.pactive
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.cache_arena.pdirty
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.epoch
Un número interno de actualización incremental de las estadísticas de jemalloc (el asignador de memoria de Jason Evans), que se utiliza en todas las demás métricas de jemalloc.
jemalloc.fragmentation
La diferencia entre jemalloc.active y jemalloc.allocated: representa la fragmentación interna del asignador de memoria (páginas activas que las asignaciones no utilizan por completo).
jemalloc.jit_arena.active_bytes
Bytes activos en la arena JIT dedicada de jemalloc. Incluye tanto (a) el estado del heap de LLVM (TargetMachine y su Subtarget específico del destino, módulos de IR, análisis de pases de optimización y tablas de reubicación de RuntimeDyld) como (b) los bloques reservados, alineados a página, que JITModuleMemoryManager asigna mediante posix_memalign para secciones ejecutables y de datos (interceptado por je_posix_memalign, por lo que pasa por jemalloc). CompiledExpressionCacheBytes (CurrentMetric) es un subconjunto de esta métrica: solo realiza el seguimiento de la capacidad reservada en bloques de página para secciones ejecutables y de datos, no de los bytes reales de código y datos en uso dentro de esos bloques.
jemalloc.jit_arena.dirty_bytes
Bytes sucios en la arena JIT que pueden purgarse y devolverse al SO.
jemalloc.jit_arena.pactive
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.jit_arena.pdirty
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.mapped
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.mergetree_arena.active_bytes
Bytes activos sumados en el grupo de arenas dedicadas de jemalloc para MergeTree (arenas jemalloc.mergetree_arena.count). Contiene el estado de heap de MergeTree de larga duración: metadatos por parte (SerializationInfoByName, el árbol MergeTreeDataPartChecksums, los delegados Poco::LRUCache<String, ColumnSize> dentro de cada IMergeTreeDataPart, los mapas ColumnSize/IndexSize por parte, MinMaxIndex, VersionMetadataOnDisk y el propio objeto MergeTreeDataPart{Compact,Wide}), metadatos compartidos entre las partes de una tabla (NamesAndTypesList, column_name_to_position, el mapa serializations y ColumnsSubstreams; véase SharedPartColumns.h), además de metadatos por tabla (los clones de StorageInMemoryMetadata / ColumnsDescription / VirtualColumnsDescription creados por setProperties, la agregación serialization_hints y shared_part_columns_cache). Contribuyen tanto las partes activas como las partes obsoletas pendientes de limpieza. Es independiente de la arena de caché y de la arena JIT. Las columnas por parte system.parts.primary_key_bytes_in_memory[_allocated] y system.parts.index_granularity_bytes_in_memory[_allocated] son subconjuntos de esta métrica (cuando sus valores no son cero). El índice primario se asigna aquí incluso cuando es propiedad de PrimaryIndexCache (deliberadamente: reubicarlo en el límite de la caché podría fallar después de que una parte ya haya hecho commit), por lo que PrimaryIndexCacheBytes se superpone con esta métrica.
jemalloc.mergetree_arena.count
Número de arenas de jemalloc dedicadas a metadatos de MergeTree de larga duración, controlado por la configuración del servidor jemalloc_merge_tree_arenas. 0 significa que el grupo de arenas dedicadas está deshabilitado y que los metadatos se asignan en las arenas predeterminadas por CPU; 1 corresponde a una única arena compartida; N > 1 corresponde a un grupo segmentado por CPU. Consulte jemalloc.mergetree_arena.active_bytes.
jemalloc.mergetree_arena.dirty_bytes
Total de bytes sucios del grupo dedicado de arenas MergeTree de jemalloc que pueden purgarse y devolverse al SO.
jemalloc.mergetree_arena.pactive
Total de páginas activas del grupo de arenas MergeTree dedicado de jemalloc.
jemalloc.mergetree_arena.pdirty
Páginas sucias sumadas en el grupo dedicado de arenas MergeTree de jemalloc.
jemalloc.metadata
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.metadata_thp
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.prof.active
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.prof.lg_sample
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.prof.thread_active_init
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.resident
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
jemalloc.retained
Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html
Jitter
La diferencia de tiempo entre el momento en que estaba previsto que se despertara el hilo encargado de calcular las métricas asíncronas y el momento en que efectivamente se despertó. Un indicador indirecto de la latencia general y de la capacidad de respuesta del sistema.
KeeperApproximateDataSize
El tamaño aproximado de los datos en ClickHouse Keeper, en bytes.
KeeperAvgLatency
Latencia media de las solicitudes de ClickHouse Keeper.
KeeperCommitLogsCacheEntries
Número de entradas de log decodificadas actualmente almacenadas temporalmente en el búfer antes del hilo de commit por el lector de lectura anticipada del changelog
KeeperCommitLogsCacheSize
Tamaño total de las entradas de log decodificadas almacenadas temporalmente en el búfer, por delante del hilo de commit, por el lector de lectura anticipada del changelog
KeeperEphemeralsCount
La cantidad de nodos efímeros en ClickHouse Keeper.
KeeperFollowers
El número de nodos follower de ClickHouse Keeper.
KeeperIsExceedingMemorySoftLimitHit
1 si ClickHouse Keeper está superando el límite blando de memoria; 0 en caso contrario.
KeeperIsFollower
1 si ClickHouse Keeper es un follower, 0 en caso contrario.
KeeperIsLeader
1 si ClickHouse Keeper es leader, 0 en caso contrario.
KeeperIsObserver
1 si ClickHouse Keeper es un observador; 0 en caso contrario.
KeeperIsStandalone
1 si ClickHouse Keeper está en modo independiente; 0 en caso contrario.
KeeperLastCommittedLogIdx
Índice del último log confirmado en ClickHouse Keeper.
KeeperLastLeaderElectionTime
Duración, en milisegundos, de la ventana sin leader más reciente observada localmente, que finalizó cuando esta instancia de ClickHouse Keeper asumió el liderazgo. No se registran las transferencias de liderazgo que no exponen un estado sin leader muestreado. 0 si esta instancia no es el leader activo o no tiene registrada ninguna ventana completada.
Duración, en milisegundos, de la ventana sin líder completado más reciente observado localmente por este leader de ClickHouse Keeper. 0 si esta instancia no es el leader activo o no tiene registrado ningún período sin líder completado.
KeeperLastLogIdx
Índice del último log almacenado en ClickHouse Keeper.
KeeperLastLogTerm
Término de Raft del último registro almacenado en ClickHouse Keeper.
KeeperLastSnapshotIdx
Índice del último log presente en la última instantánea creada.
KeeperLatestLogsCacheEntries
Número de entradas almacenadas en la caché en memoria de los logs más recientes
KeeperLatestLogsCacheSize
Tamaño total de la caché en memoria de los logs más recientes
KeeperLatestSnapshotSize
El tamaño en bytes, sin comprimir, de la instantánea más reciente creada por ClickHouse Keeper.
KeeperMaxFileDescriptorCount
El número máximo de descriptores de archivo abiertos en ClickHouse Keeper. -1 si no se puede determinar el valor.
KeeperMaxLatency
Latencia máxima de solicitud de ClickHouse Keeper.
KeeperMinLatency
Latencia mínima de las solicitudes de ClickHouse Keeper.
KeeperOpenFileDescriptorCount
El número de descriptores de archivo abiertos en ClickHouse Keeper. -1 si no se puede determinar el valor.
KeeperPacketsReceived
Número de paquetes recibidos por ClickHouse Keeper.
KeeperPacketsSent
Número de paquetes enviados por ClickHouse Keeper.
KeeperPathsWatched
El número de paths distintos observados por los Clients de ClickHouse Keeper.
KeeperSessionWithWatches
El número de sesiones de Client en ClickHouse Keeper que tienen watches.
KeeperSyncedFollowers
La cantidad de followers de ClickHouse Keeper que también están sincronizados.
KeeperTargetCommitLogIdx
Índice hasta el cual se puede hacer commit de los logs en ClickHouse Keeper.
KeeperTCPRejectedConnections
Número de conexiones rechazadas del protocolo TCP de Keeper (sin TLS).
KeeperTCPSecureRejectedConnections
Número de conexiones rechazadas del protocolo TCP de Keeper (con TLS).
KeeperTCPSecureThreads
Número de hilos en el servidor del protocolo TCP de Keeper (con TLS).
KeeperTCPThreads
Número de hilos en el servidor del protocolo TCP de Keeper (sin TLS).
KeeperWatchCount
La cantidad de watches en ClickHouse Keeper.
KeeperZnodeCount
El número de nodos (entradas de datos) de ClickHouse Keeper.
KeeperZxid
El número de identificación de la transacción actual (zxid) en ClickHouse Keeper.
LoadAverage1
La carga de todo el sistema, promediada mediante suavizado exponencial durante 1 minuto. La carga representa el número de hilos de todos los procesos (las entidades de planificación del kernel del sistema operativo) que en ese momento se están ejecutando en la CPU, están esperando E/S, o están listos para ejecutarse pero no se les está asignando tiempo de CPU. Este número incluye todos los procesos, no solo clickhouse-server. Puede ser mayor que el número de núcleos de CPU si el sistema está sobrecargado y hay muchos procesos listos para ejecutarse, pero esperando CPU o E/S.
LoadAverage15
La carga de todo el sistema, promediada mediante suavizado exponencial durante 15 minutos. La carga representa el número de hilos de todos los procesos (las entidades de planificación del kernel del sistema operativo) que en ese momento se están ejecutando en la CPU, están esperando E/S, o están listos para ejecutarse pero no se les está asignando tiempo de CPU. Este número incluye todos los procesos, no solo clickhouse-server. Puede ser mayor que el número de núcleos de CPU si el sistema está sobrecargado y hay muchos procesos listos para ejecutarse, pero esperando CPU o E/S.
LoadAverage5
La carga de todo el sistema, promediada mediante suavizado exponencial durante 5 minutos. La carga representa el número de hilos de todos los procesos (las entidades de planificación del kernel del sistema operativo) que en ese momento se están ejecutando en la CPU, están esperando E/S, o están listos para ejecutarse pero no se les está asignando tiempo de CPU. Este número incluye todos los procesos, no solo clickhouse-server. Puede ser mayor que el número de núcleos de CPU si el sistema está sobrecargado y hay muchos procesos listos para ejecutarse, pero esperando CPU o E/S.
LongestRunningMerge
Tiempo transcurrido, en segundos, del merge en segundo plano actualmente en ejecución que más tiempo lleva ejecutándose.
MaxPartCountForPartition
Número máximo de partes por partición en el conjunto de todas las particiones de todas las tablas de la familia MergeTree. Los valores superiores a 300 indican una configuración incorrecta, sobrecarga o una carga masiva de datos.
MemoryCode
La cantidad de memoria virtual mapeada para las páginas de código de máquina del proceso del servidor, en bytes.
MemoryDataAndStack
La cantidad de memoria virtual mapeada para usar como pila y para la memoria asignada, en bytes. No se especifica si incluye las pilas por hilo ni la mayor parte de la memoria asignada con la llamada al sistema 'mmap'. Esta métrica existe solo por razones de exhaustividad. Recomiendo usar la métrica MemoryResident para la monitorización.
MemoryResident
Cantidad de memoria física utilizada por el proceso del servidor, en bytes.
MemoryResidentMax
Cantidad máxima de memoria física que utiliza el proceso del servidor, en bytes.
MemoryResidentWithoutPageCache
La cantidad de memoria física utilizada por el proceso del servidor, excluida la caché de páginas en espacio de usuario, en bytes. Esto proporciona una visión más precisa del uso real de memoria cuando se utiliza la caché de páginas en espacio de usuario. Cuando la caché de páginas en espacio de usuario está deshabilitada, este valor es igual a MemoryResident.
La cantidad de memoria utilizada por el proceso del servidor que también se comparte con otros procesos, en bytes. ClickHouse no utiliza memoria compartida, pero el sistema operativo puede marcar parte de la memoria como compartida por sus propios motivos. No tiene mucho sentido vigilar esta métrica y existe solo por completitud.
MemoryThreadStacksCount
Número de áreas de memoria virtual (VMA) de las pilas pthread etiquetadas con [anon:clickhouse_stack] en /proc/self/smaps. Se actualiza con la cadencia de las métricas pesadas. Requiere Linux 5.17 o posterior; no está disponible en kernels anteriores (consulte la entrada MEMORY_THREAD_STACKS_METRIC_UNAVAILABLE en system.warnings).
Número de regiones de memoria virtual de la tarea etiquetadas como VM_MEMORY_STACK (excluidas las regiones de guarda inaccesibles). Se actualiza con la cadencia de las métricas pesadas.
MemoryThreadStacksResident
Tamaño aproximado del conjunto residente de las pilas de pthread, calculado a partir de los valores Rss: de las áreas de memoria virtual (VMA) de /proc/self/smaps etiquetadas con [anon:clickhouse_stack] mediante prctl(PR_SET_VMA_ANON_NAME). Se actualiza con la cadencia de métricas pesadas. Requiere Linux 5.17 o posterior; no está disponible en kernels anteriores (consulte la entrada MEMORY_THREAD_STACKS_METRIC_UNAVAILABLE en system.warnings).
Tamaño aproximado del conjunto residente de las pilas de pthread, calculado a partir de las páginas residentes de las regiones de memoria virtual de la tarea etiquetadas con VM_MEMORY_STACK (excepto las regiones de guarda inaccesibles). Se actualiza con la cadencia de métricas pesadas.
MemoryThreadStacksVirtual
Tamaño virtual aproximado de las pilas pthread, calculado como la suma del valor Size: de las áreas de memoria virtual (VMA) de /proc/self/smaps etiquetadas con [anon:clickhouse_stack]. Se actualiza con la cadencia de métricas pesadas. Requiere Linux 5.17 o una versión posterior; no está disponible en kernels anteriores (consulte la entrada MEMORY_THREAD_STACKS_METRIC_UNAVAILABLE de system.warnings).
Tamaño virtual aproximado de las pilas pthread, calculado como la suma de los tamaños de las regiones de memoria virtual de la tarea etiquetadas con VM_MEMORY_STACK (sin incluir las regiones de guarda inaccesibles). Se actualiza con la cadencia de métricas pesadas.
MemoryVirtual
El tamaño del espacio de direcciones virtual asignado por el proceso del servidor, en bytes. El tamaño del espacio de direcciones virtual suele ser mucho mayor que el consumo de memoria física y no debe usarse como referencia para estimar el consumo de memoria. Los valores altos de esta métrica son totalmente normales y solo tienen significado técnico.
MissingBlobsQueueEstimate
Número estimado de blobs pendientes de replicación en otras ubicaciones del disco (la cola de blobs faltantes del manager de blobs), agrupado por nombre de disco. Los discos sin replicación de blobs notifican 0.
MySQLRejectedConnections
Número de conexiones rechazadas del protocolo de compatibilidad de MySQL.
MySQLThreads
Número de hilos en el servidor del protocolo de compatibilidad con MySQL.
NetworkReceiveBytes
Número de bytes recibidos a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
NetworkReceiveDrop
Número de bytes de paquetes descartados al recibirse a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
NetworkReceiveErrors
Número de veces que se produjo un error al recibir datos a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
NetworkReceivePackets
Número de paquetes de red recibidos a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
NetworkSendBytes
Número de bytes enviados a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
NetworkSendDrop
Número de veces que se descartó un paquete al enviarlo a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
NetworkSendErrors
Número de veces que se produjo un error (p. ej., una retransmisión TCP) al enviar a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
NetworkSendPackets
Número de paquetes de red enviados a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
NetworkTCPReceiveQueue
Tamaño total de las colas de recepción de los sockets de red utilizados en el servidor para TCPv4 y TCPv6.
NetworkTCPSocketRemoteAddresses
Número total de direcciones remotas únicas de los sockets de red utilizados en el servidor, tanto en TCPv4 como en TCPv6.
NetworkTCPSockets
Número total de sockets de red utilizados en el servidor en TCPv4 y TCPv6, en todos los estados.
NetworkTCPSockets_descripción
Número total de sockets de red del servidor en el estado especificado, entre TCPv4 y TCPv6.
NetworkTCPTransmitQueue
Tamaño total de las colas de transmisión de los sockets de red utilizados por el servidor en TCPv4 y TCPv6.
NetworkTCPUnrecoveredRetransmits
Tamaño total de las retransmisiones actuales (aún no recuperadas en este momento) de los sockets de red utilizados en el servidor a través de TCPv4 y TCPv6.
NumberOfDatabases
Número total de bases de datos en el servidor.
NumberOfDetachedByUserParts
El número total de partes separadas de tablas MergeTree por los usuarios mediante la consulta ALTER TABLE DETACH (a diferencia de las partes inesperadas, dañadas o ignoradas). El servidor no tiene en cuenta las partes separadas y pueden eliminarse.
NumberOfDetachedParts
El número total de partes separadas de las tablas MergeTree. Un usuario puede separar una parte con la consulta ALTER TABLE DETACH, o el propio servidor puede hacerlo si la parte está dañada, es inesperada o no es necesaria. El servidor no tiene en cuenta las partes separadas y se pueden eliminar.
NumberOfPendingMutations
El número total de mutaciones que quedan pendientes de aplicar.
NumberOfPendingMutationsOverExecutionTime
El número total de mutaciones con partes de datos pendientes de mutación que superan la configuración max_pending_mutations_execution_time_to_warn especificada.
NúmeroDeTablas
Número total de tablas sumado en todas las bases de datos del servidor, excluidas las bases de datos que no pueden contener tablas MergeTree. Los motores de base de datos excluidos son aquellos que generan el conjunto de tablas sobre la marcha, como Lazy, MySQL, PostgreSQL, SQlite.
NumberOfTablesSystem
Número total de tablas de la base de datos del sistema en el servidor, almacenadas en tablas de la familia MergeTree.
OSContextSwitches
El número de cambios de contexto que se produjeron en el sistema de la máquina host. Es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSCPUOverload
Déficit relativo de CPU, calculado de la siguiente manera: cuántos hilos están esperando CPU en relación con el número de hilos que están usando la CPU. Si es mayor que cero, el servidor se beneficiaría de más CPU. Si es significativamente mayor que cero, el servidor podría dejar de responder. La métrica se acumula entre las actualizaciones de las métricas asíncronas.
OSGuestNiceTime
La proporción de tiempo dedicada a ejecutar una CPU virtual para sistemas operativos invitados bajo el control del kernel de Linux, cuando un sistema invitado se configuró con una prioridad más alta (consulte man procfs). Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Esta métrica no es relevante para ClickHouse, pero aun así existe por exhaustividad. El valor para un solo núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].
OSGuestNiceTimeCPU
La proporción de tiempo que cada núcleo de CPU dedicó a ejecutar una CPU virtual para sistemas operativos invitados con mayor prioridad, igual que OSGuestNiceTime, pero sin sumar entre los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSGuestNiceTimeNormalized
El valor es similar a OSGuestNiceTime, pero se divide entre el número de núcleos de CPU para que se mida en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y aun así obtener la métrica de utilización media de recursos. Si se especifica, puede utilizarse la cuota de CPU del cgroup dividida entre su período en lugar del número real de núcleos de CPU y, en ese caso, el valor de esta métrica puede superar 1 en determinados momentos.
OSGuestTime
La proporción de tiempo empleada en ejecutar una CPU virtual para sistemas operativos invitados bajo el control del kernel de Linux (consulte man procfs). Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina anfitriona, no solo clickhouse-server. Esta métrica no es relevante para ClickHouse, pero aun así existe por exhaustividad. El valor para un único núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..número de núcleos].
OSGuestTimeCPU
La proporción de tiempo que cada núcleo de CPU pasó ejecutando una CPU virtual para sistemas operativos invitados, igual que OSGuestTime, pero sin sumar entre los núcleos. Las claves son los números de núcleo de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSGuestTimeNormalized
El valor es similar a OSGuestTime, pero se divide por el número de núcleos de CPU para que se mida en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, aunque el número de núcleos no sea uniforme, y aun así obtener la métrica promedio de utilización de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
OSIdleTime
La proporción de tiempo en que el núcleo de la CPU estuvo inactivo (sin estar siquiera listo para ejecutar un proceso en espera de E/S) desde el punto de vista del kernel del sistema operativo. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. No incluye el tiempo en que la CPU estuvo infrautilizada por motivos internos de la propia CPU (cargas de memoria, bloqueos de pipeline, fallos de predicción de saltos, ejecución de otro núcleo SMT). El valor para un solo núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].
OSIdleTimeCPU
La proporción de tiempo que cada núcleo de CPU estuvo inactivo, igual que OSIdleTime, pero sin sumar los valores de todos los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSIdleTimeNormalized
El valor es similar a OSIdleTime, pero se divide entre el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, aunque el número de núcleos no sea uniforme, y aun así obtener la métrica promedio de utilización de recursos. Si se especifica, puede usarse la cuota de CPU del cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
Interrupciones del sistema operativo
El número de interrupciones en el host. Se trata de una métrica de todo el sistema: incluye todos los procesos del host, no solo clickhouse-server.
OSIOWaitTime
La proporción de tiempo durante la cual el núcleo de CPU no estuvo ejecutando código y en la que el kernel del SO no ejecutó ningún otro proceso en esta CPU porque los procesos estaban esperando operaciones de E/S. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. El valor de un único núcleo de CPU estará en el intervalo [0..1]. El valor de todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].
OSIOWaitTimeCPU
La proporción de tiempo durante el cual cada núcleo de CPU estuvo esperando operaciones de E/S, igual que OSIOWaitTime, pero sin sumar los valores de los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSIOWaitTimeNormalized
El valor es similar a OSIOWaitTime, pero se divide entre el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y aun así obtener la métrica de utilización promedio de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
OSIrqTime
La proporción de tiempo dedicada a ejecutar solicitudes de interrupción de hardware en la CPU. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Un valor alto de esta métrica puede indicar una configuración incorrecta del hardware o una carga de red muy elevada. El valor para un solo núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].
OSIrqTimeCPU
La proporción de tiempo dedicada a atender solicitudes de interrupción de hardware en cada núcleo de CPU, igual que OSIrqTime pero sin sumar entre los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSIrqTimeNormalized
El valor es similar a OSIrqTime, pero se divide entre el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo la métrica promedio de utilización de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
MemoriaDisponibleDelSO
La cantidad de memoria disponible para que los programas la utilicen, en bytes. Es muy similar a la métrica OSMemoryFreePlusCached. Es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSMemoryBuffers
La cantidad de memoria utilizada por los búferes del kernel del sistema operativo, en bytes. Normalmente debería ser baja, y los valores elevados pueden indicar una configuración incorrecta del sistema operativo. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSMemoryCached
La cantidad de memoria que usa la caché de páginas del sistema operativo, en bytes. Normalmente, casi toda la memoria disponible la usa la caché de páginas del sistema operativo; los valores altos de esta métrica son normales y esperables. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSMemoryFreePlusCached
La cantidad de memoria libre más la memoria de la caché de páginas del sistema operativo en el host, en bytes. Esta memoria está disponible para que la utilicen los programas. El valor debería ser muy similar a OSMemoryAvailable. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSMemoryFreeWithoutCached
La cantidad de memoria libre del sistema host, en bytes. No incluye la memoria utilizada por la caché de páginas del SO. La memoria de la caché de páginas también está disponible para los programas, por lo que el valor de esta métrica puede resultar confuso. Consulte en su lugar la métrica OSMemoryAvailable. Para mayor comodidad, también proporcionamos la métrica OSMemoryFreePlusCached, que debería ser más o menos similar a OSMemoryAvailable. Consulte también https://www.linuxatemyram.com/. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSMemorySwapCached
La cantidad de memoria en swap que también se cargó en RAM. El swap debe estar deshabilitado en los sistemas de producción. Si el valor de esta métrica es alto, indica una configuración incorrecta. Es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
Memoria total del SO
La cantidad total de memoria del sistema host, en bytes.
OSNiceTime
La proporción de tiempo durante la cual el núcleo de la CPU estuvo ejecutando código en espacio de usuario con mayor prioridad. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. El valor para un único núcleo de la CPU estará en el intervalo [0..1]. El valor para todos los núcleos de la CPU se calcula como la suma de todos ellos [0..num cores].
OSNiceTimeCPU
La proporción de tiempo durante el cual cada núcleo de CPU ejecutó código en espacio de usuario con mayor prioridad, igual que OSNiceTime pero sin sumar los núcleos. Las claves son los números de núcleo de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSNiceTimeNormalized
El valor es similar a OSNiceTime, pero se divide entre el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, aunque el número de núcleos no sea uniforme, y aun así obtener la métrica de uso promedio de recursos. Si se especifica, puede usarse la cuota de CPU del cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
OSOpenFiles
El número total de archivos abiertos en el host. Es una métrica de todo el sistema; incluye todos los procesos del host, no solo clickhouse-server.
OSProcessesBlocked
Número de hilos bloqueados en espera de que finalice la E/S (man procfs). Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSProcessesCreated
El número de procesos creados. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSProcessesRunning
El número de hilos en ejecución (ejecutándose o listos para ejecutarse) del sistema operativo. Es una métrica de todo el sistema: incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSSoftIrqTime
La proporción del tiempo dedicado a ejecutar interrupciones de software en la CPU. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Un valor alto de esta métrica puede indicar la ejecución de software ineficiente en el sistema. El valor para un único núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].
OSSoftIrqTimeCPU
La proporción de tiempo dedicada a procesar interrupciones de software en cada núcleo de CPU, igual que OSSoftIrqTime, pero sin sumar los valores de todos los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo se encuentra en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSSoftIrqTimeNormalized
El valor es similar a OSSoftIrqTime, pero se divide por el número de núcleos de CPU para que se mida en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo una métrica de utilización media de recursos. Si se especifica, puede usarse la cuota de CPU del cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
OSStealTime
La proporción del tiempo que la CPU dedica a otros sistemas operativos cuando se ejecuta en un entorno virtualizado. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. No todos los entornos virtualizados exponen esta métrica y, de hecho, la mayoría no lo hacen. El valor para un solo núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].
OSStealTimeCPU
La proporción de tiempo que cada núcleo de CPU pasó en otros sistemas operativos al ejecutarse en un entorno virtualizado, igual que OSStealTime pero sin sumar entre los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSStealTimeNormalized
El valor es similar a OSStealTime, pero se divide por el número de núcleos de CPU para que se mida en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, aunque el número de núcleos no sea uniforme, y aun así obtener la métrica promedio de utilización de recursos. Si se especifica, puede usarse la cuota de CPU del cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
OSSystemTime
La proporción de tiempo durante la que el núcleo de la CPU estuvo ejecutando código del kernel del sistema operativo (system). Esta es una métrica de todo el sistema; incluye todos los procesos del host, no solo clickhouse-server. El valor de un solo núcleo de CPU estará en el intervalo [0..1]. El valor de todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].
OSSystemTimeCPU
La proporción de tiempo durante la cual cada núcleo de CPU ejecutó código del kernel del sistema operativo (sistema), igual que OSSystemTime pero sin sumar entre los núcleos. Las claves son los números de núcleo de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSSystemTimeNormalized
El valor es similar a OSSystemTime, pero se divide por el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo la métrica promedio de uso de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.
OSThreadsRunnable
El número total de hilos «listos para ejecutarse», según los ve el planificador del kernel del sistema operativo.
OSThreadsTotal
El número total de hilos, según lo ve el planificador del kernel del sistema operativo.
OSUptime
El tiempo de actividad del host (la máquina en la que se ejecuta ClickHouse), en segundos.
OSUserTime
La proporción de tiempo durante la cual el núcleo de la CPU estuvo ejecutando código en espacio de usuario. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Esto también incluye el tiempo durante el cual la CPU estuvo infrautilizada por razones internas de la propia CPU (cargas de memoria, paradas de la canalización, predicciones erróneas de bifurcación, ejecución de otro núcleo SMT). El valor de un único núcleo de la CPU estará en el intervalo [0..1]. El valor para todos los núcleos de la CPU se calcula como la suma entre ellos [0..num cores].
OSUserTimeCPU
La proporción de tiempo durante el cual cada núcleo de CPU ejecutó código en espacio de usuario, igual que OSUserTime, pero sin sumar entre los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.
OSUserTimeNormalized
El valor es similar a OSUserTime, pero se divide por el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y aun así obtener la métrica de uso promedio de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU y, en ese caso, el valor de esta métrica puede superar 1 en determinados momentos.
PageCacheMaxBytes
Límite actual del tamaño de la caché de páginas en espacio de usuario, expresado en bytes.
PostgreSQLRejectedConnections
Número de conexiones rechazadas del protocolo de compatibilidad de PostgreSQL.
PostgreSQLThreads
Número de hilos del servidor del protocolo de compatibilidad con PostgreSQL.
ProcessSignalQueueLimit
Límite total de la cola de señales (cuando alcanza ProcessSignalQueueSize, puede que se produzcan errores CANNOT_CREATE_TIMER)
ProcessSignalQueueSize
Tamaño de la cola de señales (señales pendientes, temporizadores para el perfilado de consultas)
PrometheusRejectedConnections
Número de conexiones rechazadas del endpoint de Prometheus. Nota: los endpoints de Prometheus también se pueden usar a través de los puertos HTTP/HTTPS habituales.
PrometheusThreads
Número de hilos en el servidor del endpoint de Prometheus. Nota: los endpoints de Prometheus también pueden usarse a través de los puertos HTTP/HTTPS habituales.
PSI_type_stall_type
Microsegundos de tiempo de bloqueo desde la última medición. La documentación upstream sobre las métricas y cómo interpretarlas está disponible en https://docs.kernel.org/accounting/psi.html
UsoDeMemoriaDeConsultas
Memoria total utilizada actualmente por todas las consultas en ejecución en el servidor, en bytes. Sirve para atribuir la presión sobre la memoria a la carga de consultas concurrentes.
QueriesPeakMemoryUsage
Suma de los picos de memoria de las consultas por usuario de todos los usuarios registrados en ProcessList, en bytes. El pico de cada usuario es la marca máxima de su rastreador de memoria, que se restablece cuando el usuario no tiene consultas en ejecución. Por lo tanto, se trata de un agregado de los picos por usuario registrados actualmente, no de un único pico de todo el servidor correspondiente a todas las consultas desde el inicio.
ReaderExecutorModeledCostMsPerRequestedMiB
Eficiencia experimental de la ruta de lectura de ReaderExecutor: coste modelado (ms) por MiB de bytes solicitados durante el último intervalo de actualización en toda la instancia – la relación entre los deltas de los ProfileEvents ReaderExecutorModeledCostMicroseconds y ReaderExecutorDeliveredBytes. Cuanto menor, mejor: el límite inferior del ancho de banda es de ~20 (una lectura limpia desde el origen), los aciertos de caché tienden a 0, y la sobrelectura y las conexiones incompletas lo incrementan. 0 significa que no hubo lecturas del ejecutor durante el intervalo.
ReplicasMaxAbsoluteDelay
Diferencia máxima en segundos entre la parte replicada más reciente y la parte de datos más reciente que aún está pendiente de replicarse, en las tablas Replicated. Un valor muy alto indica una réplica sin datos.
ReplicasMaxInsertsInQueue
Número máximo de operaciones INSERT en cola (pendientes de replicarse) en las tablas Replicated.
ReplicasMaxMergesInQueue
Número máximo de operaciones de merge en la cola (aún pendientes de aplicarse) en las tablas Replicated.
ReplicasMaxQueueSize
Tamaño máximo de la cola (expresado en número de operaciones como get y merge) en las tablas Replicated.
ReplicasMaxRelativeDelay
Diferencia máxima entre el retraso de una réplica y el de la réplica más actualizada de la misma tabla, en tablas Replicated.
ReplicasSumInsertsInQueue
Suma de operaciones INSERT en cola (pendientes de replicación) en las tablas Replicated.
ReplicasSumMergesInQueue
Suma de las operaciones de merge en cola (pendientes de aplicarse) en las tablas Replicated.
ReplicasSumQueueSize
Tamaño total de la cola (en número de operaciones como get y merge) en las tablas Replicated.
Silkcounter_name
Valor del contador de bajo nivel del mismo nombre del runtime de fibras silk, acumulado desde la inicialización del planificador de fibras. Los contadores que incluyen Time en el nombre se expresan en nanosegundos.
TCPRejectedConnections
Número de conexiones TCP rechazadas (sin TLS).
TCPSecureRejectedConnections
Número de conexiones rechazadas del protocolo TCP (con TLS).
TCPSecureThreads
Número de hilos del servidor para el protocolo TCP (con TLS).
TCPThreads
Número de hilos del servidor para el protocolo TCP (sin TLS).
Temperatura
La temperatura indicada por cada sensor, en ℃. Un sensor puede devolver un valor poco realista. Las claves son los números de las zonas térmicas (fuente: /sys/class/thermal) o los nombres de los monitores de hardware y sus sensores (fuente: /sys/class/hwmon).
TotalBytesOfMergeTreeTables
Cantidad total de bytes (comprimidos, incluidos los datos y los índices) almacenados en todas las tablas de la familia MergeTree.
TotalBytesOfMergeTreeTablesSystem
Cantidad total de bytes (comprimidos, incluidos los datos y los índices) almacenados en las tablas de la familia MergeTree en la base de datos del sistema.
TotalIndexGranularityBytesInMemory
La cantidad total de memoria (en bytes) utilizada por los gránulos de índice (solo se tienen en cuenta las partes activas).
TotalIndexGranularityBytesInMemoryAllocated
La cantidad total de memoria (en bytes) reservada para los gránulos del índice (solo se tienen en cuenta las partes activas).
TotalPartsOfMergeTreeTables
Cantidad total de partes de datos en todas las tablas de la familia MergeTree. Los valores superiores a 10 000 afectarán negativamente al tiempo de arranque del servidor y pueden indicar una elección poco adecuada de la clave de partición.
TotalPartsOfMergeTreeTablesSystem
Cantidad total de partes de datos en las tablas de la familia MergeTree de la base de datos del sistema.
TotalPrimaryKeyBytesInMemory
La cantidad total de memoria (en bytes) utilizada por los valores de la clave primaria (solo considera las partes activas).
TotalPrimaryKeyBytesInMemoryAllocated
La cantidad total de memoria (en bytes) reservada para los valores de la clave primaria (solo se tienen en cuenta las partes activas).
TotalProjectionIndexGranularityBytesInMemory
La cantidad total de memoria (en bytes) consumida por la granularidad del índice de proyección (solo se tienen en cuenta las partes activas).
TotalProjectionIndexGranularityBytesInMemoryAllocated
La cantidad total de memoria (en bytes) reservada para la granularidad del índice de proyección (solo se tienen en cuenta las partes activas).
TotalProjectionPrimaryKeyBytesInMemory
La cantidad total de memoria (en bytes) utilizada por los valores de la clave primaria de la proyección (solo se tienen en cuenta las partes activas).
TotalProjectionPrimaryKeyBytesInMemoryAllocated
La cantidad total de memoria (en bytes) reservada para los valores de la clave primaria de la proyección (solo se tienen en cuenta las partes activas).
TotalRowsOfMergeTreeTables
Cantidad total de filas (registros) almacenadas en todas las tablas de la familia MergeTree.
TotalRowsOfMergeTreeTablesSystem
Cantidad total de filas (registros) almacenadas en las tablas de la familia MergeTree de la base de datos del sistema.
TotalUncompressedBytesOfMergeTreeTables
Cantidad total de bytes sin comprimir, según se indica en las sumas de comprobación de las partes, almacenados en todas las tablas de la familia MergeTree. Procede de la misma fuente que la columna total_bytes_uncompressed de system.tables y no incluye los archivos almacenados sin comprimir, como las marcas y los índices de clave primaria.
TotalUncompressedBytesOfMergeTreeTablesSystem
Cantidad total de bytes sin comprimir, según las sumas de comprobación de las partes, almacenados en tablas de la familia MergeTree de la base de datos del sistema. Es la misma fuente que la columna total_bytes_uncompressed de system.tables y no incluye los archivos que se almacenan sin comprimir, como las marcas y los índices de clave primaria.
TrackedMemory
Memoria registrada por ClickHouse (debería coincidir con la métrica MemoryTracking), en bytes.
UntrackedMemory
Suma de los búferes por hilo con asignaciones y liberaciones recientes que aún no se han propagado a TrackedMemory.
Tiempo de actividad
El tiempo de actividad del servidor, en segundos. Incluye el tiempo dedicado a la inicialización del servidor antes de que acepte conexiones.
VMMaxMapCount
El número máximo de mapeos de memoria que puede tener un proceso (/proc/sys/vm/max_map_count).
VMNumMaps
El número actual de mapeos de memoria del proceso (/proc/self/maps). Si está cerca del máximo (VMMaxMapCount), debe aumentar el valor límite de vm.max_map_count en /etc/sysctl.conf
ZooKeeperClientLastZXIDSeen
El último ZXID observado por la sesión actual del Client de ZooKeeper. Este valor aumenta de forma monótona a medida que el Client observa transacciones de ZooKeeper.
Véase también
- Monitorización — Conceptos básicos de la monitorización de ClickHouse.
- system.metrics — Contiene métricas calculadas instantáneamente.
- system.events — Contiene una serie de eventos ocurridos.
- system.metric_log — Contiene un historial de los valores de las métricas de las tablas
system.metricsysystem.events.