고급 관측성 대시보드
- 고급 대시보드: 모니터링 → 고급 대시보드에서 접근할 수 있는 기본 대시보드 인터페이스로, 쿼리 비율, 리소스 사용량, 시스템 상태, 스토리지 성능을 실시간으로 확인할 수 있습니다. 이 대시보드는 별도의 인증이 필요 없고, 인스턴스의 유휴 상태 전환을 막지 않으며, 프로덕션 시스템에 쿼리 부하를 추가하지도 않습니다. 각 시각화는 사용자 지정 가능한 SQL 쿼리를 기반으로 하며, 기본 제공 chart는 ClickHouse 관련 메트릭, 시스템 상태 메트릭, Cloud 관련 메트릭으로 그룹화되어 있습니다. SQL 콘솔에서 직접 사용자 지정 쿼리를 만들어 모니터링을 확장할 수 있습니다.
이 메트릭에 접근해도 기본 서비스에 쿼리가 실행되지 않으며, 유휴 상태의 서비스를 깨우지 않습니다.
- 네이티브 고급 대시보드: 모니터링 섹션의 “You can still access the native advanced dashboard”를 통해 접근할 수 있는 대체 대시보드 인터페이스입니다. 별도의 탭에서 인증과 함께 열리며, 시스템 및 서비스 상태 모니터링을 위한 대체 UI를 제공합니다. 이 대시보드에서는 기본 SQL 쿼리를 수정할 수 있어 고급 분석을 수행할 수 있습니다.
쿼리 인사이트 및 리소스 모니터링
- 쿼리 인사이트: 쿼리 성능 분석 및 문제 해결을 위한 기본 제공 인터페이스
- 리소스 사용량 대시보드: 메모리, CPU 할당량, 데이터 전송 패턴을 추적합니다. CPU 사용량 및 메모리 사용량 그래프는 특정 시간 범위의 최대 사용률 메트릭을 표시합니다. CPU 사용량 그래프는 시스템 수준의 CPU 사용률 메트릭을 표시하며, ClickHouse CPU 사용률 메트릭은 아닙니다.
Prometheus 호환 메트릭 엔드포인트
- 필터링된 메트릭 옵션: 선택적
filtered_metrics=true매개변수를 사용하면 1000개 이상의 사용 가능한 메트릭이 125개의 “핵심” 메트릭으로 줄어들어 비용을 최적화하고 모니터링 대상을 더 쉽게 집중할 수 있습니다 - 캐시된 메트릭 제공: 1분마다 갱신되는 구체화된 뷰(Materialized View)를 사용해 운영 시스템의 쿼리 부하를 최소화합니다
이 방식은 서비스의 유휴 상태 전환 동작을 고려하므로, 서비스가 쿼리를 적극적으로 처리하지 않을 때 비용을 최적화할 수 있습니다. 이 API 엔드포인트를 사용하려면 ClickHouse Cloud API 자격 증명이 필요합니다. 전체 엔드포인트 구성에 대한 자세한 내용은 cloud Prometheus 문서를 참조하십시오.
통합 예시
Grafana Cloud 모니터링
Datadog 모니터링
ClickStack
이 방식에서는 HyperDX가 시스템 테이블을 직접 쿼리하므로 유휴 상태의 서비스가 활성화될 수 있다는 점에 유의하십시오.
ClickStack 배포 옵션
- ClickHouse Cloud의 HyperDX (비공개 프리뷰): 모든 ClickHouse Cloud 서비스에서 HyperDX를 실행할 수 있습니다.
- Helm: Kubernetes 기반 디버깅 환경에 권장됩니다. ClickHouse Cloud 통합을 지원하며,
values.yaml을 통해 환경별 구성, 리소스 제한, 스케일링을 설정할 수 있습니다. - Docker Compose: 각 구성 요소(ClickHouse, HyperDX, OTel collector, MongoDB)를 개별적으로 배포합니다. ClickHouse Cloud와 통합하는 경우에는 compose 파일을 수정해 사용하지 않는 구성 요소, 특히 ClickHouse와 OpenTelemetry Collector를 제거할 수 있습니다.
- HyperDX Only: 독립 실행형 HyperDX 컨테이너입니다.
OpenTelemetry Collector를 통해 ClickHouse Cloud Prometheus 엔드포인트에서 메트릭을 수집한 후, 시각화를 위해 별도의 ClickStack 배포로 전달할 수도 있습니다.
Grafana 플러그인 직접 통합
Datadog 직접 통합
이 통합은 비용 최적화를 위한 유휴(idle) 동작과 호환되지 않고 클라우드 프록시 계층의 운영상 제한도 있어 ClickHouse Cloud 배포에는 권장되지 않습니다.
시스템 테이블 직접 사용하기
system.query_log에 연결해 직접 쿼리하면 쿼리 성능을 심층적으로 분석할 수 있습니다. SQL 콘솔 또는 clickhouse client를 사용하면 느린 쿼리를 식별하고, 리소스 사용량을 분석하며, 조직 전반의 사용 패턴을 추적할 수 있습니다.
쿼리 성능 분석
시스템 테이블의 쿼리 로그를 사용해 쿼리 성능을 분석할 수 있습니다.
예시 쿼리: 모든 클러스터 레플리카에서 실행 시간이 가장 긴 상위 5개 쿼리 찾기:
커뮤니티 모니터링 솔루션
다른 직접 데이터베이스 모니터링 방식과 마찬가지로, 이 솔루션은 ClickHouse 시스템 테이블(system tables)을 직접 쿼리하므로 인스턴스가 유휴 상태로 전환되지 않으며 비용 최적화에도 영향을 줍니다.