Painel avançado de observabilidade
- Advanced Dashboard: A principal interface de dashboard, acessível em monitoramento → Advanced dashboard, oferece visibilidade em tempo real das taxas de consulta, do uso de recursos, da integridade do sistema e do desempenho de armazenamento. Esse dashboard não exige autenticação separada, não impede que instâncias fiquem ociosas e não adiciona carga de consultas ao seu sistema de produção. Cada visualização é baseada em consultas SQL personalizáveis, com gráficos prontos para uso agrupados em métricas específicas do ClickHouse, de integridade do sistema e específicas do Cloud. Você pode expandir o monitoramento criando consultas personalizadas diretamente no SQL Console.
O acesso a essas métricas não emite uma consulta para o serviço subjacente e não reativa serviços ociosos.
- Native advanced dashboard: Uma interface de dashboard alternativa acessível por meio de “You can still access the native advanced dashboard” na seção monitoramento. Ela é aberta em uma guia separada, com autenticação, e oferece uma UI alternativa para monitorar a integridade do sistema e do serviço. Esse dashboard permite analytics avançados, nos quais você pode modificar as consultas SQL subjacentes.
Query Insights e monitoramento de recursos
- Query Insights: Interface integrada para análise de desempenho de consultas e solução de problemas
- Resource Utilization Dashboard: Acompanha padrões de uso de memória, alocação de CPU e transferência de dados. Os gráficos de uso de CPU e de memória mostram a métrica de utilização máxima em um determinado período. O gráfico de uso de CPU mostra uma métrica de utilização de CPU em nível de sistema (NÃO uma métrica de utilização de CPU do ClickHouse).
Endpoint de métricas compatível com Prometheus
- Opção de métricas filtradas: o parâmetro opcional filtered_metrics=true reduz o payload de mais de 1000 métricas disponíveis para 125 métricas “essenciais”, otimizando custos e facilitando o foco no monitoramento
- Entrega de métricas em cache: usa visões materializadas atualizadas a cada minuto para minimizar a carga de consultas nos sistemas de produção
Essa abordagem respeita o comportamento de inatividade do serviço, permitindo otimizar custos quando os serviços não estão processando consultas ativamente. Esse endpoint de API usa credenciais da ClickHouse Cloud API. Para ver os detalhes completos de configuração do endpoint, consulte a documentação do Prometheus do ClickHouse Cloud.
Exemplos de integração
Monitoramento do Grafana Cloud
Monitoramento do Datadog
ClickStack
Observe que essa abordagem reativará serviços inativos, pois o HyperDX consulta diretamente as tabelas de sistema.
Opções de implantação do ClickStack
- HyperDX no ClickHouse Cloud (private preview): o HyperDX pode ser executado em qualquer serviço do ClickHouse Cloud.
- Helm: Recomendado para ambientes de depuração baseados em Kubernetes. Oferece suporte à integração com o ClickHouse Cloud e permite configurações específicas por ambiente, limites de recursos e escalonamento via
values.yaml. - Docker Compose: Implanta cada componente (ClickHouse, HyperDX, OTel collector, MongoDB) individualmente. Você pode modificar o arquivo do Compose para remover componentes não utilizados ao integrar com o ClickHouse Cloud, especificamente o ClickHouse e o OpenTelemetry Collector.
- Somente HyperDX: Contêiner HyperDX autônomo.
Você também pode coletar métricas do endpoint Prometheus do ClickHouse Cloud por meio de um OpenTelemetry Collector e encaminhá-las para uma implantação separada do ClickStack para visualização.
Integração direta com o plugin do Grafana
Integração direta com o Datadog
Essa integração não é recomendada para implantações no ClickHouse Cloud devido à incompatibilidade com o comportamento de inatividade usado para otimizar custos e às limitações operacionais da camada de proxy da Cloud.
Usando tabelas de sistema diretamente
system.query_log, e consultando-as diretamente. Usando o Console SQL ou o clickhouse client, as equipes podem identificar consultas lentas, analisar o uso de recursos e acompanhar padrões de uso em toda a organização.
Análise de desempenho de consultas
Você pode usar os logs de consulta da tabela de sistema para realizar uma análise de desempenho de consultas.
Consulta de exemplo: encontre as 5 consultas com maior tempo de execução em todas as réplicas do cluster:
Soluções de monitoramento da comunidade
Assim como outras abordagens de monitoramento direto do banco de dados, esta solução consulta diretamente as tabelas de sistema do ClickHouse, o que impede que as instâncias fiquem ociosas e afeta a otimização de custos.