Skip to main content
Consultas en ClickHouse CloudLos datos de esta tabla del sistema se almacenan localmente en cada nodo de ClickHouse Cloud. Por lo tanto, para obtener una vista completa de todos los datos, es necesario usar la función clusterAllReplicas. Consulta aquí para más detalles.

Descripción

Contiene métricas que se calculan periódicamente en segundo plano. Por ejemplo, la cantidad de RAM utilizada. Una métrica es escalar (un único número en la columna value) o de clave-valor: desglosada por entidad, como por núcleo de CPU, dispositivo de bloques, interfaz de red o disco. Las métricas de clave-valor se representan como una única fila con un Map en la columna key_values (por ejemplo, CPUFrequencyMHz asigna la frecuencia a cada núcleo de CPU), y su columna value es NaN.

Columnas

  • metric (String) — Nombre de la métrica.
  • value (Float64) — Valor de la métrica. Para las métricas de clave-valor (desglosadas por núcleo de CPU, dispositivo de bloque, …) es NaN y los valores se encuentran en la columna key_values.
  • key_values (Map(LowCardinality(String), Float64)) — Valores de una métrica de clave-valor, por ejemplo, con clave de número de núcleo de CPU o al nombre del dispositivo de bloque. Vacío para las métricas escalares.
  • description (String - Descripción de la métrica)

Ejemplo

Se puede extraer una entidad individual de una métrica de clave-valor mediante el subíndice de Map:

Descripción de las métricas

Las descripciones siguientes se generan a partir del código fuente en C++ mediante utils/generate-async-metrics-docs. La fuente única de referencia es la cadena literal que aparece junto al registro de cada métrica en src/Common/AsynchronousMetrics.cpp, src/Interpreters/ServerAsynchronousMetrics.cpp y src/Coordination/KeeperAsynchronousMetrics.cpp. Los nombres de las métricas que incluyen una parte variable (actualmente solo el grupo de conexiones HTTP) se muestran con un marcador de posición *name*; el servidor en ejecución los informa con el nombre concreto sustituido.

AsynchronousHeavyMetricsCalculationTimeSpent

Tiempo, en segundos, dedicado al cálculo de métricas pesadas asíncronas (relacionadas con tablas) (esta es la sobrecarga de las métricas asíncronas).

AsynchronousHeavyMetricsUpdateInterval

Intervalo de actualización de métricas pesadas relacionadas con tablas

AsynchronousMetricsCalculationTimeSpent

Tiempo en segundos dedicado al cálculo de las métricas asíncronas (esta es la sobrecarga de las métricas asíncronas).

AsynchronousMetricsUpdateInterval

Intervalo de actualización de métricas

AsyncLoggingQueueSize

Número de mensajes asíncronos en cola, pendientes de registro, con clave de nombre del canal de registro.

BlockActiveTime

Tiempo en segundos durante el cual cada dispositivo de bloques tuvo solicitudes de IO en cola. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockActiveTimePerOp

Similar a la métrica BlockActiveTime, pero el valor se divide entre el número de operaciones de IO para calcular el tiempo por operación. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockDiscardBytes

Número de bytes descartados en cada dispositivo de bloques. Estas operaciones son relevantes para las SSD. ClickHouse no utiliza operaciones de descarte, pero otros procesos del sistema pueden utilizarlas. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockDiscardMerges

Número de operaciones de descarte solicitadas a cada dispositivo de bloques y fusionadas por el planificador de E/S del sistema operativo. Estas operaciones son relevantes en SSD. ClickHouse no utiliza operaciones de descarte, pero pueden ser utilizadas por otros procesos del sistema. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockDiscardOps

Número de operaciones de descarte solicitadas a cada dispositivo de bloques. Estas operaciones son relevantes para las unidades SSD. ClickHouse no utiliza operaciones de descarte, pero pueden ser utilizadas por otros procesos del sistema. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockDiscardTime

Tiempo en segundos empleado en las operaciones de descarte solicitadas a cada dispositivo de bloques, acumulado entre todas las operaciones. Estas operaciones son relevantes para los SSD. Las operaciones de descarte no son utilizadas por ClickHouse, pero pueden ser utilizadas por otros procesos del sistema. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockInFlightOps

Este valor cuenta el número de solicitudes de E/S emitidas al controlador del dispositivo que aún no se han completado, para cada dispositivo de bloques. No incluye las solicitudes de E/S que están en la cola, pero que aún no se han emitido al controlador del dispositivo. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockQueueTime

Este valor cuenta el número de milisegundos que las solicitudes de IO han permanecido en espera en cada dispositivo de bloques. Si hay varias solicitudes de IO esperando, este valor aumentará como el producto del número de milisegundos por el número de solicitudes en espera. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockQueueTimePerOp

Similar a la métrica BlockQueueTime, pero el valor se divide por el número de operaciones de IO para calcular el tiempo por operación. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockReadBytes

Número de bytes leídos de cada dispositivo de bloques. Puede ser inferior al número de bytes leídos del sistema de archivos debido al uso de la caché de páginas del sistema operativo, que ahorra E/S. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockReadMerges

Número de operaciones de lectura solicitadas desde cada dispositivo de bloques y combinadas por el planificador de E/S del sistema operativo. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockReadOps

Número de operaciones de lectura solicitadas desde cada dispositivo de bloques. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockReadTime

Tiempo en segundos empleado en las operaciones de lectura solicitadas a cada dispositivo de bloques, acumulado entre todas las operaciones. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockWriteBytes

Número de bytes escritos en cada dispositivo de bloques. Puede ser inferior al número de bytes escritos en el sistema de archivos debido al uso de la caché de páginas del sistema operativo, que reduce la E/S. Una escritura en el dispositivo de bloques puede producirse más tarde que la escritura correspondiente en el sistema de archivos debido a la caché write-through. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockWriteMerges

Número de operaciones de escritura solicitadas a cada dispositivo de bloques y combinadas por el planificador de E/S del sistema operativo. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockWriteOps

Número de operaciones de escritura solicitadas a cada dispositivo de bloques. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

BlockWriteTime

Tiempo en segundos empleado en las operaciones de escritura solicitadas a cada dispositivo de bloques, acumulado entre todas las operaciones. Las claves son los nombres de los dispositivos de bloques. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Fuente: /sys/block. Consulte https://www.kernel.org/doc/Documentation/block/stat.txt

CGroupMaxCPU

El número máximo de núcleos de CPU según los CGroups.

CGroupMemoryTotal

La cantidad total de memoria del cgroup, en bytes. Si se indica como cero, el límite es el mismo que OSMemoryTotal.

CGroupMemoryUsed

La cantidad de memoria usada en el cgroup, en bytes. En cgroup v2, esto corresponde a anon + sock + la memoria no reclamable del kernel; en cgroup v1, esto es RSS. En ambos casos, se excluye la caché de páginas del sistema operativo del kernel (caché respaldada por archivos).

CGroupMemoryUsedWithoutPageCache

La cantidad de memoria utilizada en cgroup, en bytes, excluida la caché de páginas en espacio de usuario de ClickHouse. Se calcula como CGroupMemoryUsed menos el tamaño de la caché de páginas en espacio de usuario. Cuando la caché de páginas en espacio de usuario está deshabilitada, este valor equivale a CGroupMemoryUsed.

CGroupSystemTime

La proporción de tiempo durante la que el núcleo de la CPU estuvo ejecutando código del kernel del sistema operativo (system).

CGroupSystemTimeNormalized

El valor es similar a CGroupSystemTime, pero se divide entre el número de núcleos de CPU disponibles para medirse en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo la métrica media de utilización de recursos. Si se especifica, puede usarse la cuota de CPU de cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

CGroupUserTime

La proporción de tiempo durante la cual el núcleo de la CPU estuvo ejecutando código en espacio de usuario. Esto también incluye el tiempo durante el cual la CPU estuvo infrautilizada por razones internas de la propia CPU (cargas de memoria, paradas de la canalización, predicciones erróneas de bifurcación, ejecución de otro núcleo SMT).

CGroupUserTimeNormalized

El valor es similar a CGroupUserTime, pero se divide por el número de CPU cores disponibles para que se mida en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo la métrica media de utilización de recursos. Si se especifica, puede usarse la Cgroup CPU quota dividida por su período en lugar del número real de CPU cores, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

CompiledExpressionCacheBytesMax

Máximo de bytes configurado para la caché de expresiones compiladas. Holgura disponible = este valor menos CompiledExpressionCacheBytes (CurrentMetric).

CompiledExpressionCacheCountMax

Número máximo configurado de entradas en la caché de expresiones compiladas. Holgura disponible = este valor menos CompiledExpressionCacheCount (CurrentMetric).

CPUFrequencyMHz

La frecuencia actual de cada núcleo de CPU, en MHz, con clave de número de núcleo de CPU. La mayoría de las CPU modernas ajustan la frecuencia de forma dinámica para ahorrar energía y aprovechar Turbo Boost.

DeadBlobsQueueEstimate

Número estimado de blobs en cola para eliminarse del almacenamiento de objetos del disco (la cola de elementos eliminados del manager de blobs), con clave de nombre del disco. Los discos sin replicación de blobs notifican 0.

DiccionarioMaxUpdateDelay

El retraso máximo (en segundos) en la actualización del diccionario

DiccionarioTotalFailedUpdates

Número de errores desde la última carga exitosa en todos los diccionarios.

DiskAvailable

Bytes disponibles en cada disco (sistema de archivos virtual), con clave de nombre del disco. Los sistemas de archivos remotos pueden no proporcionar esta información y mostrar un valor elevado, como 16 EiB.

DiskGetObjectThrottlerAvailable

Número de solicitudes GetObject que pueden emitirse actualmente sin alcanzar el límite de throttling en cada disco (sistema de archivos virtual), con clave de nombre del disco. Es posible que los sistemas de archivos locales no proporcionen esta información.

DiskGetObjectThrottlerRPS

Límite de solicitudes GetObject por segundo en cada disco (sistema de archivos virtual), con clave en el nombre del disco. Es posible que los sistemas de archivos locales no proporcionen esta información.

DiskPutObjectThrottlerAvailable

Número de solicitudes PutObject que pueden emitirse actualmente sin alcanzar el límite de throttling en cada disco (sistema de archivos virtual), con clave en el nombre del disco. Es posible que los sistemas de archivos locales no proporcionen esta información.

DiskPutObjectThrottlerRPS

Límite de solicitudes PutObject por segundo en cada disco (sistema de archivos virtual), con clave en el nombre del disco. Es posible que los sistemas de archivos locales no proporcionen esta información.

DiskTotal

El tamaño total, en bytes, de cada disco (sistema de archivos virtual), con clave de nombre del disco. Es posible que los sistemas de archivos remotos no proporcionen esta información y puedan mostrar un valor elevado, como 16 EiB.

DiskUnreserved

Bytes disponibles en cada disco (sistema de archivos virtual), sin incluir las reservas para fusiones, recuperaciones y movimientos, con clave en nombre de disco. Es posible que los sistemas de archivos remotos no proporcionen esta información y puedan mostrar un valor elevado, como 16 EiB.

DiskUsed

Bytes usados en cada disco (sistema de archivos virtual), con clave en el nombre del disco. Los sistemas de archivos remotos no siempre proporcionan esta información.

EDACCorrectable

Número de errores de memoria ECC corregibles, con clave de número de controlador de memoria. Un valor alto de este indicador señala una RAM defectuosa que debe sustituirse de inmediato, ya que, en presencia de una gran cantidad de errores corregidos, también pueden producirse errores silenciosos, lo que provoca corrupción de datos. Fuente: /sys/devices/system/edac/mc/

EDACUncorrectable

El número de errores de memoria ECC no corregibles, con clave en el número del controlador de memoria. Un valor distinto de cero indica que la RAM está defectuosa y debe sustituirse de inmediato, ya que puede provocar corrupción de datos. Fuente: /sys/devices/system/edac/mc/

ExecutableUserDefinedFunctionMemoryResidentBytes

Suma del tamaño del conjunto residente (VmRSS) de todos los procesos en ejecución de las funciones definidas por el usuario executable y executable_pool, y de sus procesos descendientes, en bytes. Se incluyen los workers inactivos de executable_pool. Las páginas compartidas se contabilizan una vez por proceso, por lo que la suma constituye un límite superior y puede superar la huella única de memoria física de los procesos UDF.

ExecutableUserDefinedFunctionProcesses

Número de procesos en ejecución iniciados para las funciones definidas por el usuario de tipo executable y executable_pool, incluidos los procesos descendientes.

FilesystemCacheBytes

Total de bytes en el sistema de archivos virtual cache. Esta caché se almacena en disco.

FilesystemCacheCapacity

Capacidad total en el sistema de archivos virtual cache. Esta caché se almacena en disco.

FilesystemCacheFiles

Número total de segmentos de archivo almacenados en caché en el sistema de archivos virtual cache. Esta caché se almacena en disco.

FilesystemLogsPathAvailableBytes

Bytes disponibles en el volumen en el que está montada la ruta de logs de ClickHouse. Si este valor se aproxima a cero, debe ajustar la rotación de logs en el archivo de configuración.

FilesystemLogsPathAvailableINodes

El número de inodos disponibles en el volumen en el que está montada la ruta de logs de ClickHouse.

FilesystemLogsPathTotalBytes

El tamaño, en bytes, del volumen en el que está montada la ruta de logs de ClickHouse. Se recomienda disponer de al menos 10 GB para los logs.

FilesystemLogsPathTotalINodes

El número total de inodos en el volumen donde está montada la ruta de los logs de ClickHouse.

FilesystemLogsPathUsedBytes

Bytes usados en el volumen donde está montada la ruta de logs de ClickHouse.

FilesystemLogsPathUsedINodes

El número de inodos en uso en el volumen donde está montada la ruta de logs de ClickHouse.

FilesystemMainPathAvailableBytes

Bytes disponibles en el volumen en el que está montada la ruta principal de ClickHouse.

FilesystemMainPathAvailableINodes

La cantidad de inodos disponibles en el volumen donde está montada la ruta principal de ClickHouse. Si está cerca de cero, indica una configuración incorrecta y aparecerá el error ‘no space left on device’ incluso cuando el disco no esté lleno.

FilesystemMainPathTotalBytes

El tamaño, en bytes, del volumen donde está montada la ruta principal de ClickHouse.

FilesystemMainPathTotalINodes

El número total de inodos del volumen donde está montada la ruta principal de ClickHouse. Si es inferior a 25 millones, indica una mala configuración.

FilesystemMainPathUsedBytes

Bytes en uso en el volumen donde está montada la ruta principal de ClickHouse.

FilesystemMainPathUsedINodes

El número de inodos en uso en el volumen donde está montada la ruta principal de ClickHouse. Este valor corresponde, en su mayor parte, al número de archivos.

GRPCRejectedConnections

Número de conexiones rechazadas del protocolo GRPC.

GRPCThreads

Número de hilos del servidor del protocolo GRPC.

HashTableStatsCacheEntries

La cantidad de entradas en la caché de tamaños de las tablas hash. La caché de tamaños de las tablas hash se utiliza para la optimización predictiva de GROUP BY.

HashTableStatsCacheHits

Número de veces en que fue correcta la predicción del tamaño de una tabla hash.

HashTableStatsCacheMisses

Número de veces que la predicción del tamaño de una tabla hash fue incorrecta.

HTTPConnectionPoolgroup_nameTCPRcvBufTotalBytes

Memoria total del búfer de recepción TCP del kernel (sk_rmem_alloc) en todos los sockets del grupo de conexiones HTTP.

HTTPConnectionPoolgroup_nameTCPSndBufTotalBytes

Memoria total del búfer de transmisión TCP del kernel (sk_wmem_alloc) en todos los sockets del grupo de conexiones HTTP.

HTTPRejectedConnections

Número de conexiones rechazadas en la interfaz HTTP (sin TLS).

HTTPSecureRejectedConnections

Número de conexiones rechazadas de la interfaz HTTPS.

HTTPSecureThreads

Número de hilos del servidor de la interfaz HTTPS.

HTTPThreads

Número de hilos del servidor de la interfaz HTTP (sin TLS).

InterserverRejectedConnections

Número de conexiones rechazadas del protocolo de comunicación entre réplicas (sin TLS).

InterserverSecureRejectedConnections

Número de conexiones rechazadas del protocolo de comunicación entre réplicas (con TLS).

InterserverSecureThreads

Número de hilos del servidor del protocolo de comunicación entre réplicas (con TLS).

InterserverThreads

Número de hilos del servidor del protocolo de comunicación entre réplicas (sin TLS).

jemalloc.active

Métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.allocated

Métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.arenas.all.dirty_purged

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.arenas.all.muzzy_purged

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.arenas.all.pactive

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.arenas.all.pdirty

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.arenas.all.pmuzzy

Métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.arenas.dirty_decay_ms

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.background_thread.num_runs

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.background_thread.num_threads

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.background_thread.run_intervals

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.cache_arena.pactive

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.cache_arena.pdirty

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.epoch

Un número interno de actualización incremental de las estadísticas de jemalloc (el asignador de memoria de Jason Evans), que se utiliza en todas las demás métricas de jemalloc.

jemalloc.fragmentation

La diferencia entre jemalloc.active y jemalloc.allocated: representa la fragmentación interna del asignador de memoria (páginas activas que las asignaciones no utilizan por completo).

jemalloc.jit_arena.active_bytes

Bytes activos en la arena JIT dedicada de jemalloc. Incluye tanto (a) el estado del heap de LLVM (TargetMachine y su Subtarget específico del destino, módulos de IR, análisis de pases de optimización y tablas de reubicación de RuntimeDyld) como (b) los bloques reservados, alineados a página, que JITModuleMemoryManager asigna mediante posix_memalign para secciones ejecutables y de datos (interceptado por je_posix_memalign, por lo que pasa por jemalloc). CompiledExpressionCacheBytes (CurrentMetric) es un subconjunto de esta métrica: solo realiza el seguimiento de la capacidad reservada en bloques de página para secciones ejecutables y de datos, no de los bytes reales de código y datos en uso dentro de esos bloques.

jemalloc.jit_arena.dirty_bytes

Bytes sucios en la arena JIT que pueden purgarse y devolverse al SO.

jemalloc.jit_arena.pactive

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.jit_arena.pdirty

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.mapped

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.mergetree_arena.active_bytes

Bytes activos sumados en el grupo de arenas dedicadas de jemalloc para MergeTree (arenas jemalloc.mergetree_arena.count). Contiene el estado de heap de MergeTree de larga duración: metadatos por parte (SerializationInfoByName, el árbol MergeTreeDataPartChecksums, los delegados Poco::LRUCache<String, ColumnSize> dentro de cada IMergeTreeDataPart, los mapas ColumnSize/IndexSize por parte, MinMaxIndex, VersionMetadataOnDisk y el propio objeto MergeTreeDataPart{Compact,Wide}), metadatos compartidos entre las partes de una tabla (NamesAndTypesList, column_name_to_position, el mapa serializations y ColumnsSubstreams; véase SharedPartColumns.h), además de metadatos por tabla (los clones de StorageInMemoryMetadata / ColumnsDescription / VirtualColumnsDescription creados por setProperties, la agregación serialization_hints y shared_part_columns_cache). Contribuyen tanto las partes activas como las partes obsoletas pendientes de limpieza. Es independiente de la arena de caché y de la arena JIT. Las columnas por parte system.parts.primary_key_bytes_in_memory[_allocated] y system.parts.index_granularity_bytes_in_memory[_allocated] son subconjuntos de esta métrica (cuando sus valores no son cero). El índice primario se asigna aquí incluso cuando es propiedad de PrimaryIndexCache (deliberadamente: reubicarlo en el límite de la caché podría fallar después de que una parte ya haya hecho commit), por lo que PrimaryIndexCacheBytes se superpone con esta métrica.

jemalloc.mergetree_arena.count

Número de arenas de jemalloc dedicadas a metadatos de MergeTree de larga duración, controlado por la configuración del servidor jemalloc_merge_tree_arenas. 0 significa que el grupo de arenas dedicadas está deshabilitado y que los metadatos se asignan en las arenas predeterminadas por CPU; 1 corresponde a una única arena compartida; N > 1 corresponde a un grupo segmentado por CPU. Consulte jemalloc.mergetree_arena.active_bytes.

jemalloc.mergetree_arena.dirty_bytes

Total de bytes sucios del grupo dedicado de arenas MergeTree de jemalloc que pueden purgarse y devolverse al SO.

jemalloc.mergetree_arena.pactive

Total de páginas activas del grupo de arenas MergeTree dedicado de jemalloc.

jemalloc.mergetree_arena.pdirty

Páginas sucias sumadas en el grupo dedicado de arenas MergeTree de jemalloc.

jemalloc.metadata

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.metadata_thp

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.prof.active

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.prof.lg_sample

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.prof.thread_active_init

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.resident

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

jemalloc.retained

Una métrica interna del asignador de memoria de bajo nivel (jemalloc). Consulte https://jemalloc.net/jemalloc.3.html

Jitter

La diferencia de tiempo entre el momento en que estaba previsto que se despertara el hilo encargado de calcular las métricas asíncronas y el momento en que efectivamente se despertó. Un indicador indirecto de la latencia general y de la capacidad de respuesta del sistema.

KeeperApproximateDataSize

El tamaño aproximado de los datos en ClickHouse Keeper, en bytes.

KeeperAvgLatency

Latencia media de las solicitudes de ClickHouse Keeper.

KeeperCommitLogsCacheEntries

Número de entradas de log decodificadas actualmente almacenadas temporalmente en el búfer antes del hilo de commit por el lector de lectura anticipada del changelog

KeeperCommitLogsCacheSize

Tamaño total de las entradas de log decodificadas almacenadas temporalmente en el búfer, por delante del hilo de commit, por el lector de lectura anticipada del changelog

KeeperEphemeralsCount

La cantidad de nodos efímeros en ClickHouse Keeper.

KeeperFollowers

El número de nodos follower de ClickHouse Keeper.

KeeperIsExceedingMemorySoftLimitHit

1 si ClickHouse Keeper está superando el límite blando de memoria; 0 en caso contrario.

KeeperIsFollower

1 si ClickHouse Keeper es un follower, 0 en caso contrario.

KeeperIsLeader

1 si ClickHouse Keeper es leader, 0 en caso contrario.

KeeperIsObserver

1 si ClickHouse Keeper es un observador; 0 en caso contrario.

KeeperIsStandalone

1 si ClickHouse Keeper está en modo independiente; 0 en caso contrario.

KeeperLastCommittedLogIdx

Índice del último log confirmado en ClickHouse Keeper.

KeeperLastLeaderElectionTime

Duración, en milisegundos, de la ventana sin leader más reciente observada localmente, que finalizó cuando esta instancia de ClickHouse Keeper asumió el liderazgo. No se registran las transferencias de liderazgo que no exponen un estado sin leader muestreado. 0 si esta instancia no es el leader activo o no tiene registrada ninguna ventana completada.

KeeperLastLeaderUnavailableTime

Duración, en milisegundos, de la ventana sin líder completado más reciente observado localmente por este leader de ClickHouse Keeper. 0 si esta instancia no es el leader activo o no tiene registrado ningún período sin líder completado.

KeeperLastLogIdx

Índice del último log almacenado en ClickHouse Keeper.

KeeperLastLogTerm

Término de Raft del último registro almacenado en ClickHouse Keeper.

KeeperLastSnapshotIdx

Índice del último log presente en la última instantánea creada.

KeeperLatestLogsCacheEntries

Número de entradas almacenadas en la caché en memoria de los logs más recientes

KeeperLatestLogsCacheSize

Tamaño total de la caché en memoria de los logs más recientes

KeeperLatestSnapshotSize

El tamaño en bytes, sin comprimir, de la instantánea más reciente creada por ClickHouse Keeper.

KeeperMaxFileDescriptorCount

El número máximo de descriptores de archivo abiertos en ClickHouse Keeper. -1 si no se puede determinar el valor.

KeeperMaxLatency

Latencia máxima de solicitud de ClickHouse Keeper.

KeeperMinLatency

Latencia mínima de las solicitudes de ClickHouse Keeper.

KeeperOpenFileDescriptorCount

El número de descriptores de archivo abiertos en ClickHouse Keeper. -1 si no se puede determinar el valor.

KeeperPacketsReceived

Número de paquetes recibidos por ClickHouse Keeper.

KeeperPacketsSent

Número de paquetes enviados por ClickHouse Keeper.

KeeperPathsWatched

El número de paths distintos observados por los Clients de ClickHouse Keeper.

KeeperSessionWithWatches

El número de sesiones de Client en ClickHouse Keeper que tienen watches.

KeeperSyncedFollowers

La cantidad de followers de ClickHouse Keeper que también están sincronizados.

KeeperTargetCommitLogIdx

Índice hasta el cual se puede hacer commit de los logs en ClickHouse Keeper.

KeeperTCPRejectedConnections

Número de conexiones rechazadas del protocolo TCP de Keeper (sin TLS).

KeeperTCPSecureRejectedConnections

Número de conexiones rechazadas del protocolo TCP de Keeper (con TLS).

KeeperTCPSecureThreads

Número de hilos en el servidor del protocolo TCP de Keeper (con TLS).

KeeperTCPThreads

Número de hilos en el servidor del protocolo TCP de Keeper (sin TLS).

KeeperWatchCount

La cantidad de watches en ClickHouse Keeper.

KeeperZnodeCount

El número de nodos (entradas de datos) de ClickHouse Keeper.

KeeperZxid

El número de identificación de la transacción actual (zxid) en ClickHouse Keeper.

LoadAverage1

La carga de todo el sistema, promediada mediante suavizado exponencial durante 1 minuto. La carga representa el número de hilos de todos los procesos (las entidades de planificación del kernel del sistema operativo) que en ese momento se están ejecutando en la CPU, están esperando E/S, o están listos para ejecutarse pero no se les está asignando tiempo de CPU. Este número incluye todos los procesos, no solo clickhouse-server. Puede ser mayor que el número de núcleos de CPU si el sistema está sobrecargado y hay muchos procesos listos para ejecutarse, pero esperando CPU o E/S.

LoadAverage15

La carga de todo el sistema, promediada mediante suavizado exponencial durante 15 minutos. La carga representa el número de hilos de todos los procesos (las entidades de planificación del kernel del sistema operativo) que en ese momento se están ejecutando en la CPU, están esperando E/S, o están listos para ejecutarse pero no se les está asignando tiempo de CPU. Este número incluye todos los procesos, no solo clickhouse-server. Puede ser mayor que el número de núcleos de CPU si el sistema está sobrecargado y hay muchos procesos listos para ejecutarse, pero esperando CPU o E/S.

LoadAverage5

La carga de todo el sistema, promediada mediante suavizado exponencial durante 5 minutos. La carga representa el número de hilos de todos los procesos (las entidades de planificación del kernel del sistema operativo) que en ese momento se están ejecutando en la CPU, están esperando E/S, o están listos para ejecutarse pero no se les está asignando tiempo de CPU. Este número incluye todos los procesos, no solo clickhouse-server. Puede ser mayor que el número de núcleos de CPU si el sistema está sobrecargado y hay muchos procesos listos para ejecutarse, pero esperando CPU o E/S.

LongestRunningMerge

Tiempo transcurrido, en segundos, del merge en segundo plano actualmente en ejecución que más tiempo lleva ejecutándose.

MaxPartCountForPartition

Número máximo de partes por partición en el conjunto de todas las particiones de todas las tablas de la familia MergeTree. Los valores superiores a 300 indican una configuración incorrecta, sobrecarga o una carga masiva de datos.

MemoryCode

La cantidad de memoria virtual mapeada para las páginas de código de máquina del proceso del servidor, en bytes.

MemoryDataAndStack

La cantidad de memoria virtual mapeada para usar como pila y para la memoria asignada, en bytes. No se especifica si incluye las pilas por hilo ni la mayor parte de la memoria asignada con la llamada al sistema ‘mmap’. Esta métrica existe solo por razones de exhaustividad. Recomiendo usar la métrica MemoryResident para la monitorización.

MemoryResident

Cantidad de memoria física utilizada por el proceso del servidor, en bytes.

MemoryResidentMax

Cantidad máxima de memoria física que utiliza el proceso del servidor, en bytes.

MemoryResidentWithoutPageCache

La cantidad de memoria física utilizada por el proceso del servidor, excluida la caché de páginas en espacio de usuario, en bytes. Esto proporciona una visión más precisa del uso real de memoria cuando se utiliza la caché de páginas en espacio de usuario. Cuando la caché de páginas en espacio de usuario está deshabilitada, este valor es igual a MemoryResident.

MemoryShared

La cantidad de memoria utilizada por el proceso del servidor que también se comparte con otros procesos, en bytes. ClickHouse no utiliza memoria compartida, pero el sistema operativo puede marcar parte de la memoria como compartida por sus propios motivos. No tiene mucho sentido vigilar esta métrica y existe solo por completitud.

MemoryThreadStacksCount

Número de áreas de memoria virtual (VMA) de las pilas pthread etiquetadas con [anon:clickhouse_stack] en /proc/self/smaps. Se actualiza con la cadencia de las métricas pesadas. Requiere Linux 5.17 o posterior; no está disponible en kernels anteriores (consulte la entrada MEMORY_THREAD_STACKS_METRIC_UNAVAILABLE en system.warnings). Número de regiones de memoria virtual de la tarea etiquetadas como VM_MEMORY_STACK (excluidas las regiones de guarda inaccesibles). Se actualiza con la cadencia de las métricas pesadas.

MemoryThreadStacksResident

Tamaño aproximado del conjunto residente de las pilas de pthread, calculado a partir de los valores Rss: de las áreas de memoria virtual (VMA) de /proc/self/smaps etiquetadas con [anon:clickhouse_stack] mediante prctl(PR_SET_VMA_ANON_NAME). Se actualiza con la cadencia de métricas pesadas. Requiere Linux 5.17 o posterior; no está disponible en kernels anteriores (consulte la entrada MEMORY_THREAD_STACKS_METRIC_UNAVAILABLE en system.warnings). Tamaño aproximado del conjunto residente de las pilas de pthread, calculado a partir de las páginas residentes de las regiones de memoria virtual de la tarea etiquetadas con VM_MEMORY_STACK (excepto las regiones de guarda inaccesibles). Se actualiza con la cadencia de métricas pesadas.

MemoryThreadStacksVirtual

Tamaño virtual aproximado de las pilas pthread, calculado como la suma del valor Size: de las áreas de memoria virtual (VMA) de /proc/self/smaps etiquetadas con [anon:clickhouse_stack]. Se actualiza con la cadencia de métricas pesadas. Requiere Linux 5.17 o una versión posterior; no está disponible en kernels anteriores (consulte la entrada MEMORY_THREAD_STACKS_METRIC_UNAVAILABLE de system.warnings). Tamaño virtual aproximado de las pilas pthread, calculado como la suma de los tamaños de las regiones de memoria virtual de la tarea etiquetadas con VM_MEMORY_STACK (sin incluir las regiones de guarda inaccesibles). Se actualiza con la cadencia de métricas pesadas.

MemoryVirtual

El tamaño del espacio de direcciones virtual asignado por el proceso del servidor, en bytes. El tamaño del espacio de direcciones virtual suele ser mucho mayor que el consumo de memoria física y no debe usarse como referencia para estimar el consumo de memoria. Los valores altos de esta métrica son totalmente normales y solo tienen significado técnico.

MissingBlobsQueueEstimate

Número estimado de blobs pendientes de replicación en otras ubicaciones del disco (la cola de blobs faltantes del manager de blobs), agrupado por nombre de disco. Los discos sin replicación de blobs notifican 0.

MySQLRejectedConnections

Número de conexiones rechazadas del protocolo de compatibilidad de MySQL.

MySQLThreads

Número de hilos en el servidor del protocolo de compatibilidad con MySQL.

NetworkReceiveBytes

Número de bytes recibidos a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

NetworkReceiveDrop

Número de bytes de paquetes descartados al recibirse a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

NetworkReceiveErrors

Número de veces que se produjo un error al recibir datos a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

NetworkReceivePackets

Número de paquetes de red recibidos a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

NetworkSendBytes

Número de bytes enviados a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

NetworkSendDrop

Número de veces que se descartó un paquete al enviarlo a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

NetworkSendErrors

Número de veces que se produjo un error (p. ej., una retransmisión TCP) al enviar a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

NetworkSendPackets

Número de paquetes de red enviados a través de cada interfaz de red. Las claves son los nombres de las interfaces de red. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

NetworkTCPReceiveQueue

Tamaño total de las colas de recepción de los sockets de red utilizados en el servidor para TCPv4 y TCPv6.

NetworkTCPSocketRemoteAddresses

Número total de direcciones remotas únicas de los sockets de red utilizados en el servidor, tanto en TCPv4 como en TCPv6.

NetworkTCPSockets

Número total de sockets de red utilizados en el servidor en TCPv4 y TCPv6, en todos los estados.

NetworkTCPSockets_descripción

Número total de sockets de red del servidor en el estado especificado, entre TCPv4 y TCPv6.

NetworkTCPTransmitQueue

Tamaño total de las colas de transmisión de los sockets de red utilizados por el servidor en TCPv4 y TCPv6.

NetworkTCPUnrecoveredRetransmits

Tamaño total de las retransmisiones actuales (aún no recuperadas en este momento) de los sockets de red utilizados en el servidor a través de TCPv4 y TCPv6.

NumberOfDatabases

Número total de bases de datos en el servidor.

NumberOfDetachedByUserParts

El número total de partes separadas de tablas MergeTree por los usuarios mediante la consulta ALTER TABLE DETACH (a diferencia de las partes inesperadas, dañadas o ignoradas). El servidor no tiene en cuenta las partes separadas y pueden eliminarse.

NumberOfDetachedParts

El número total de partes separadas de las tablas MergeTree. Un usuario puede separar una parte con la consulta ALTER TABLE DETACH, o el propio servidor puede hacerlo si la parte está dañada, es inesperada o no es necesaria. El servidor no tiene en cuenta las partes separadas y se pueden eliminar.

NumberOfPendingMutations

El número total de mutaciones que quedan pendientes de aplicar.

NumberOfPendingMutationsOverExecutionTime

El número total de mutaciones con partes de datos pendientes de mutación que superan la configuración max_pending_mutations_execution_time_to_warn especificada.

NúmeroDeTablas

Número total de tablas sumado en todas las bases de datos del servidor, excluidas las bases de datos que no pueden contener tablas MergeTree. Los motores de base de datos excluidos son aquellos que generan el conjunto de tablas sobre la marcha, como Lazy, MySQL, PostgreSQL, SQlite.

NumberOfTablesSystem

Número total de tablas de la base de datos del sistema en el servidor, almacenadas en tablas de la familia MergeTree.

OSContextSwitches

El número de cambios de contexto que se produjeron en el sistema de la máquina host. Es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSCPUOverload

Déficit relativo de CPU, calculado de la siguiente manera: cuántos hilos están esperando CPU en relación con el número de hilos que están usando la CPU. Si es mayor que cero, el servidor se beneficiaría de más CPU. Si es significativamente mayor que cero, el servidor podría dejar de responder. La métrica se acumula entre las actualizaciones de las métricas asíncronas.

OSGuestNiceTime

La proporción de tiempo dedicada a ejecutar una CPU virtual para sistemas operativos invitados bajo el control del kernel de Linux, cuando un sistema invitado se configuró con una prioridad más alta (consulte man procfs). Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Esta métrica no es relevante para ClickHouse, pero aun así existe por exhaustividad. El valor para un solo núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].

OSGuestNiceTimeCPU

La proporción de tiempo que cada núcleo de CPU dedicó a ejecutar una CPU virtual para sistemas operativos invitados con mayor prioridad, igual que OSGuestNiceTime, pero sin sumar entre los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSGuestNiceTimeNormalized

El valor es similar a OSGuestNiceTime, pero se divide entre el número de núcleos de CPU para que se mida en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y aun así obtener la métrica de utilización media de recursos. Si se especifica, puede utilizarse la cuota de CPU del cgroup dividida entre su período en lugar del número real de núcleos de CPU y, en ese caso, el valor de esta métrica puede superar 1 en determinados momentos.

OSGuestTime

La proporción de tiempo empleada en ejecutar una CPU virtual para sistemas operativos invitados bajo el control del kernel de Linux (consulte man procfs). Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina anfitriona, no solo clickhouse-server. Esta métrica no es relevante para ClickHouse, pero aun así existe por exhaustividad. El valor para un único núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..número de núcleos].

OSGuestTimeCPU

La proporción de tiempo que cada núcleo de CPU pasó ejecutando una CPU virtual para sistemas operativos invitados, igual que OSGuestTime, pero sin sumar entre los núcleos. Las claves son los números de núcleo de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSGuestTimeNormalized

El valor es similar a OSGuestTime, pero se divide por el número de núcleos de CPU para que se mida en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, aunque el número de núcleos no sea uniforme, y aun así obtener la métrica promedio de utilización de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

OSIdleTime

La proporción de tiempo en que el núcleo de la CPU estuvo inactivo (sin estar siquiera listo para ejecutar un proceso en espera de E/S) desde el punto de vista del kernel del sistema operativo. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. No incluye el tiempo en que la CPU estuvo infrautilizada por motivos internos de la propia CPU (cargas de memoria, bloqueos de pipeline, fallos de predicción de saltos, ejecución de otro núcleo SMT). El valor para un solo núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].

OSIdleTimeCPU

La proporción de tiempo que cada núcleo de CPU estuvo inactivo, igual que OSIdleTime, pero sin sumar los valores de todos los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSIdleTimeNormalized

El valor es similar a OSIdleTime, pero se divide entre el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, aunque el número de núcleos no sea uniforme, y aun así obtener la métrica promedio de utilización de recursos. Si se especifica, puede usarse la cuota de CPU del cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

Interrupciones del sistema operativo

El número de interrupciones en el host. Se trata de una métrica de todo el sistema: incluye todos los procesos del host, no solo clickhouse-server.

OSIOWaitTime

La proporción de tiempo durante la cual el núcleo de CPU no estuvo ejecutando código y en la que el kernel del SO no ejecutó ningún otro proceso en esta CPU porque los procesos estaban esperando operaciones de E/S. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. El valor de un único núcleo de CPU estará en el intervalo [0..1]. El valor de todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].

OSIOWaitTimeCPU

La proporción de tiempo durante el cual cada núcleo de CPU estuvo esperando operaciones de E/S, igual que OSIOWaitTime, pero sin sumar los valores de los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSIOWaitTimeNormalized

El valor es similar a OSIOWaitTime, pero se divide entre el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y aun así obtener la métrica de utilización promedio de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

OSIrqTime

La proporción de tiempo dedicada a ejecutar solicitudes de interrupción de hardware en la CPU. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Un valor alto de esta métrica puede indicar una configuración incorrecta del hardware o una carga de red muy elevada. El valor para un solo núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].

OSIrqTimeCPU

La proporción de tiempo dedicada a atender solicitudes de interrupción de hardware en cada núcleo de CPU, igual que OSIrqTime pero sin sumar entre los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSIrqTimeNormalized

El valor es similar a OSIrqTime, pero se divide entre el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente de cuántos núcleos haya. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo la métrica promedio de utilización de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

MemoriaDisponibleDelSO

La cantidad de memoria disponible para que los programas la utilicen, en bytes. Es muy similar a la métrica OSMemoryFreePlusCached. Es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSMemoryBuffers

La cantidad de memoria utilizada por los búferes del kernel del sistema operativo, en bytes. Normalmente debería ser baja, y los valores elevados pueden indicar una configuración incorrecta del sistema operativo. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSMemoryCached

La cantidad de memoria que usa la caché de páginas del sistema operativo, en bytes. Normalmente, casi toda la memoria disponible la usa la caché de páginas del sistema operativo; los valores altos de esta métrica son normales y esperables. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSMemoryFreePlusCached

La cantidad de memoria libre más la memoria de la caché de páginas del sistema operativo en el host, en bytes. Esta memoria está disponible para que la utilicen los programas. El valor debería ser muy similar a OSMemoryAvailable. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSMemoryFreeWithoutCached

La cantidad de memoria libre del sistema host, en bytes. No incluye la memoria utilizada por la caché de páginas del SO. La memoria de la caché de páginas también está disponible para los programas, por lo que el valor de esta métrica puede resultar confuso. Consulte en su lugar la métrica OSMemoryAvailable. Para mayor comodidad, también proporcionamos la métrica OSMemoryFreePlusCached, que debería ser más o menos similar a OSMemoryAvailable. Consulte también https://www.linuxatemyram.com/. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSMemorySwapCached

La cantidad de memoria en swap que también se cargó en RAM. El swap debe estar deshabilitado en los sistemas de producción. Si el valor de esta métrica es alto, indica una configuración incorrecta. Es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

Memoria total del SO

La cantidad total de memoria del sistema host, en bytes.

OSNiceTime

La proporción de tiempo durante la cual el núcleo de la CPU estuvo ejecutando código en espacio de usuario con mayor prioridad. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. El valor para un único núcleo de la CPU estará en el intervalo [0..1]. El valor para todos los núcleos de la CPU se calcula como la suma de todos ellos [0..num cores].

OSNiceTimeCPU

La proporción de tiempo durante el cual cada núcleo de CPU ejecutó código en espacio de usuario con mayor prioridad, igual que OSNiceTime pero sin sumar los núcleos. Las claves son los números de núcleo de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSNiceTimeNormalized

El valor es similar a OSNiceTime, pero se divide entre el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, aunque el número de núcleos no sea uniforme, y aun así obtener la métrica de uso promedio de recursos. Si se especifica, puede usarse la cuota de CPU del cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

OSOpenFiles

El número total de archivos abiertos en el host. Es una métrica de todo el sistema; incluye todos los procesos del host, no solo clickhouse-server.

OSProcessesBlocked

Número de hilos bloqueados en espera de que finalice la E/S (man procfs). Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSProcessesCreated

El número de procesos creados. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSProcessesRunning

El número de hilos en ejecución (ejecutándose o listos para ejecutarse) del sistema operativo. Es una métrica de todo el sistema: incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSSoftIrqTime

La proporción del tiempo dedicado a ejecutar interrupciones de software en la CPU. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Un valor alto de esta métrica puede indicar la ejecución de software ineficiente en el sistema. El valor para un único núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].

OSSoftIrqTimeCPU

La proporción de tiempo dedicada a procesar interrupciones de software en cada núcleo de CPU, igual que OSSoftIrqTime, pero sin sumar los valores de todos los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo se encuentra en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSSoftIrqTimeNormalized

El valor es similar a OSSoftIrqTime, pero se divide por el número de núcleos de CPU para que se mida en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo una métrica de utilización media de recursos. Si se especifica, puede usarse la cuota de CPU del cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

OSStealTime

La proporción del tiempo que la CPU dedica a otros sistemas operativos cuando se ejecuta en un entorno virtualizado. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. No todos los entornos virtualizados exponen esta métrica y, de hecho, la mayoría no lo hacen. El valor para un solo núcleo de CPU estará en el intervalo [0..1]. El valor para todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].

OSStealTimeCPU

La proporción de tiempo que cada núcleo de CPU pasó en otros sistemas operativos al ejecutarse en un entorno virtualizado, igual que OSStealTime pero sin sumar entre los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSStealTimeNormalized

El valor es similar a OSStealTime, pero se divide por el número de núcleos de CPU para que se mida en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, aunque el número de núcleos no sea uniforme, y aun así obtener la métrica promedio de utilización de recursos. Si se especifica, puede usarse la cuota de CPU del cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

OSSystemTime

La proporción de tiempo durante la que el núcleo de la CPU estuvo ejecutando código del kernel del sistema operativo (system). Esta es una métrica de todo el sistema; incluye todos los procesos del host, no solo clickhouse-server. El valor de un solo núcleo de CPU estará en el intervalo [0..1]. El valor de todos los núcleos de CPU se calcula como la suma de todos ellos [0..num cores].

OSSystemTimeCPU

La proporción de tiempo durante la cual cada núcleo de CPU ejecutó código del kernel del sistema operativo (sistema), igual que OSSystemTime pero sin sumar entre los núcleos. Las claves son los números de núcleo de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSSystemTimeNormalized

El valor es similar a OSSystemTime, pero se divide por el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y seguir obteniendo la métrica promedio de uso de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU, y en ese caso el valor de esta métrica puede superar 1 en determinados momentos.

OSThreadsRunnable

El número total de hilos «listos para ejecutarse», según los ve el planificador del kernel del sistema operativo.

OSThreadsTotal

El número total de hilos, según lo ve el planificador del kernel del sistema operativo.

OSUptime

El tiempo de actividad del host (la máquina en la que se ejecuta ClickHouse), en segundos.

OSUserTime

La proporción de tiempo durante la cual el núcleo de la CPU estuvo ejecutando código en espacio de usuario. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server. Esto también incluye el tiempo durante el cual la CPU estuvo infrautilizada por razones internas de la propia CPU (cargas de memoria, paradas de la canalización, predicciones erróneas de bifurcación, ejecución de otro núcleo SMT). El valor de un único núcleo de la CPU estará en el intervalo [0..1]. El valor para todos los núcleos de la CPU se calcula como la suma entre ellos [0..num cores].

OSUserTimeCPU

La proporción de tiempo durante el cual cada núcleo de CPU ejecutó código en espacio de usuario, igual que OSUserTime, pero sin sumar entre los núcleos. Las claves son los números de los núcleos de CPU y el valor de cada núcleo está en el intervalo [0..1]. Esta es una métrica de todo el sistema; incluye todos los procesos de la máquina host, no solo clickhouse-server.

OSUserTimeNormalized

El valor es similar a OSUserTime, pero se divide por el número de núcleos de CPU para medirse en el intervalo [0..1], independientemente del número de núcleos. Esto permite promediar los valores de esta métrica entre varios servidores de un clúster, incluso si el número de núcleos no es uniforme, y aun así obtener la métrica de uso promedio de recursos. Si se especifica, puede usarse la cuota de CPU de Cgroup dividida por su período en lugar del número real de núcleos de CPU y, en ese caso, el valor de esta métrica puede superar 1 en determinados momentos.

PageCacheMaxBytes

Límite actual del tamaño de la caché de páginas en espacio de usuario, expresado en bytes.

PostgreSQLRejectedConnections

Número de conexiones rechazadas del protocolo de compatibilidad de PostgreSQL.

PostgreSQLThreads

Número de hilos del servidor del protocolo de compatibilidad con PostgreSQL.

ProcessSignalQueueLimit

Límite total de la cola de señales (cuando alcanza ProcessSignalQueueSize, puede que se produzcan errores CANNOT_CREATE_TIMER)

ProcessSignalQueueSize

Tamaño de la cola de señales (señales pendientes, temporizadores para el perfilado de consultas)

PrometheusRejectedConnections

Número de conexiones rechazadas del endpoint de Prometheus. Nota: los endpoints de Prometheus también se pueden usar a través de los puertos HTTP/HTTPS habituales.

PrometheusThreads

Número de hilos en el servidor del endpoint de Prometheus. Nota: los endpoints de Prometheus también pueden usarse a través de los puertos HTTP/HTTPS habituales.

PSI_type_stall_type

Microsegundos de tiempo de bloqueo desde la última medición. La documentación upstream sobre las métricas y cómo interpretarlas está disponible en https://docs.kernel.org/accounting/psi.html

UsoDeMemoriaDeConsultas

Memoria total utilizada actualmente por todas las consultas en ejecución en el servidor, en bytes. Sirve para atribuir la presión sobre la memoria a la carga de consultas concurrentes.

QueriesPeakMemoryUsage

Suma de los picos de memoria de las consultas por usuario de todos los usuarios registrados en ProcessList, en bytes. El pico de cada usuario es la marca máxima de su rastreador de memoria, que se restablece cuando el usuario no tiene consultas en ejecución. Por lo tanto, se trata de un agregado de los picos por usuario registrados actualmente, no de un único pico de todo el servidor correspondiente a todas las consultas desde el inicio.

ReaderExecutorModeledCostMsPerRequestedMiB

Eficiencia experimental de la ruta de lectura de ReaderExecutor: coste modelado (ms) por MiB de bytes solicitados durante el último intervalo de actualización en toda la instancia — la relación entre los deltas de los ProfileEvents ReaderExecutorModeledCostMicroseconds y ReaderExecutorDeliveredBytes. Cuanto menor, mejor: el límite inferior del ancho de banda es de ~20 (una lectura limpia desde el origen), los aciertos de caché tienden a 0, y la sobrelectura y las conexiones incompletas lo incrementan. 0 significa que no hubo lecturas del ejecutor durante el intervalo.

ReplicasMaxAbsoluteDelay

Diferencia máxima en segundos entre la parte replicada más reciente y la parte de datos más reciente que aún está pendiente de replicarse, en las tablas Replicated. Un valor muy alto indica una réplica sin datos.

ReplicasMaxInsertsInQueue

Número máximo de operaciones INSERT en cola (pendientes de replicarse) en las tablas Replicated.

ReplicasMaxMergesInQueue

Número máximo de operaciones de merge en la cola (aún pendientes de aplicarse) en las tablas Replicated.

ReplicasMaxQueueSize

Tamaño máximo de la cola (expresado en número de operaciones como get y merge) en las tablas Replicated.

ReplicasMaxRelativeDelay

Diferencia máxima entre el retraso de una réplica y el de la réplica más actualizada de la misma tabla, en tablas Replicated.

ReplicasSumInsertsInQueue

Suma de operaciones INSERT en cola (pendientes de replicación) en las tablas Replicated.

ReplicasSumMergesInQueue

Suma de las operaciones de merge en cola (pendientes de aplicarse) en las tablas Replicated.

ReplicasSumQueueSize

Tamaño total de la cola (en número de operaciones como get y merge) en las tablas Replicated.

Silkcounter_name

Valor del contador de bajo nivel del mismo nombre del runtime de fibras silk, acumulado desde la inicialización del planificador de fibras. Los contadores que incluyen Time en el nombre se expresan en nanosegundos.

TCPRejectedConnections

Número de conexiones TCP rechazadas (sin TLS).

TCPSecureRejectedConnections

Número de conexiones rechazadas del protocolo TCP (con TLS).

TCPSecureThreads

Número de hilos del servidor para el protocolo TCP (con TLS).

TCPThreads

Número de hilos del servidor para el protocolo TCP (sin TLS).

Temperatura

La temperatura indicada por cada sensor, en ℃. Un sensor puede devolver un valor poco realista. Las claves son los números de las zonas térmicas (fuente: /sys/class/thermal) o los nombres de los monitores de hardware y sus sensores (fuente: /sys/class/hwmon).

TotalBytesOfMergeTreeTables

Cantidad total de bytes (comprimidos, incluidos los datos y los índices) almacenados en todas las tablas de la familia MergeTree.

TotalBytesOfMergeTreeTablesSystem

Cantidad total de bytes (comprimidos, incluidos los datos y los índices) almacenados en las tablas de la familia MergeTree en la base de datos del sistema.

TotalIndexGranularityBytesInMemory

La cantidad total de memoria (en bytes) utilizada por los gránulos de índice (solo se tienen en cuenta las partes activas).

TotalIndexGranularityBytesInMemoryAllocated

La cantidad total de memoria (en bytes) reservada para los gránulos del índice (solo se tienen en cuenta las partes activas).

TotalPartsOfMergeTreeTables

Cantidad total de partes de datos en todas las tablas de la familia MergeTree. Los valores superiores a 10 000 afectarán negativamente al tiempo de arranque del servidor y pueden indicar una elección poco adecuada de la clave de partición.

TotalPartsOfMergeTreeTablesSystem

Cantidad total de partes de datos en las tablas de la familia MergeTree de la base de datos del sistema.

TotalPrimaryKeyBytesInMemory

La cantidad total de memoria (en bytes) utilizada por los valores de la clave primaria (solo considera las partes activas).

TotalPrimaryKeyBytesInMemoryAllocated

La cantidad total de memoria (en bytes) reservada para los valores de la clave primaria (solo se tienen en cuenta las partes activas).

TotalProjectionIndexGranularityBytesInMemory

La cantidad total de memoria (en bytes) consumida por la granularidad del índice de proyección (solo se tienen en cuenta las partes activas).

TotalProjectionIndexGranularityBytesInMemoryAllocated

La cantidad total de memoria (en bytes) reservada para la granularidad del índice de proyección (solo se tienen en cuenta las partes activas).

TotalProjectionPrimaryKeyBytesInMemory

La cantidad total de memoria (en bytes) utilizada por los valores de la clave primaria de la proyección (solo se tienen en cuenta las partes activas).

TotalProjectionPrimaryKeyBytesInMemoryAllocated

La cantidad total de memoria (en bytes) reservada para los valores de la clave primaria de la proyección (solo se tienen en cuenta las partes activas).

TotalRowsOfMergeTreeTables

Cantidad total de filas (registros) almacenadas en todas las tablas de la familia MergeTree.

TotalRowsOfMergeTreeTablesSystem

Cantidad total de filas (registros) almacenadas en las tablas de la familia MergeTree de la base de datos del sistema.

TotalUncompressedBytesOfMergeTreeTables

Cantidad total de bytes sin comprimir, según se indica en las sumas de comprobación de las partes, almacenados en todas las tablas de la familia MergeTree. Procede de la misma fuente que la columna total_bytes_uncompressed de system.tables y no incluye los archivos almacenados sin comprimir, como las marcas y los índices de clave primaria.

TotalUncompressedBytesOfMergeTreeTablesSystem

Cantidad total de bytes sin comprimir, según las sumas de comprobación de las partes, almacenados en tablas de la familia MergeTree de la base de datos del sistema. Es la misma fuente que la columna total_bytes_uncompressed de system.tables y no incluye los archivos que se almacenan sin comprimir, como las marcas y los índices de clave primaria.

TrackedMemory

Memoria registrada por ClickHouse (debería coincidir con la métrica MemoryTracking), en bytes.

UntrackedMemory

Suma de los búferes por hilo con asignaciones y liberaciones recientes que aún no se han propagado a TrackedMemory.

Tiempo de actividad

El tiempo de actividad del servidor, en segundos. Incluye el tiempo dedicado a la inicialización del servidor antes de que acepte conexiones.

VMMaxMapCount

El número máximo de mapeos de memoria que puede tener un proceso (/proc/sys/vm/max_map_count).

VMNumMaps

El número actual de mapeos de memoria del proceso (/proc/self/maps). Si está cerca del máximo (VMMaxMapCount), debe aumentar el valor límite de vm.max_map_count en /etc/sysctl.conf

ZooKeeperClientLastZXIDSeen

El último ZXID observado por la sesión actual del Client de ZooKeeper. Este valor aumenta de forma monótona a medida que el Client observa transacciones de ZooKeeper. Véase también
  • Monitorización — Conceptos básicos de la monitorización de ClickHouse.
  • system.metrics — Contiene métricas calculadas instantáneamente.
  • system.events — Contiene una serie de eventos ocurridos.
  • system.metric_log — Contiene un historial de los valores de las métricas de las tablas system.metrics y system.events.
Última modificación el 27 de agosto de 2026