Данные мониторинга, описанные в этом руководстве, доступны в ClickHouse Cloud. Помимо встроенной панели мониторинга, описанной ниже, базовые и расширенные метрики производительности также можно просматривать напрямую в основной консоли сервиса.
- Использование аппаратных ресурсов.
- Метрики сервера ClickHouse.
Встроенная расширенная панель обсервабилити
$HOST:$PORT/dashboard (требуются имя пользователя и пароль), где отображаются следующие метрики:
- Запросов в секунду
- Использование CPU (ядра)
- Выполняющиеся запросы
- Активные слияния
- Выбранные байты в секунду
- Ожидание ввода-вывода
- Ожидание CPU
- Использование CPU ОС (пользовательское пространство)
- Использование CPU ОС (ядро)
- Чтение с диска
- Чтение из файловой системы
- Память (отслеживаемая)
- Вставленные строки в секунду
- Общее количество частей MergeTree
- Максимум частей в партиции
Использование ресурсов
- Нагрузку и температуру процессоров.
- Использование системы хранения, оперативной памяти и сети.
system.asynchronous_metric_log.
Метрики сервера ClickHouse
- Различные метрики использования сервером вычислительных ресурсов.
- Общую статистику по обработке запросов.
HTTP GET на /ping. Если сервер доступен, он отвечает 200 OK.
Чтобы отслеживать серверы в кластерной конфигурации, следует задать параметр max_replica_delay_for_distributed_queries и использовать HTTP-ресурс /replicas_status. Запрос к /replicas_status возвращает 200 OK, если реплика доступна и не отстаёт от других реплик. Если реплика отстаёт, возвращается 503 HTTP_SERVICE_UNAVAILABLE с информацией о величине отставания.