基于 Prometheus 的集成架构
- 完整的指标暴露:可获取 ClickHouse 提供的全部指标,且没有内置过滤
- 实时指标:在抓取时直接从系统表生成
集成示例
Grafana Cloud 监控
Datadog 监控
ClickStack
请注意,由于 HyperDX 会直接查询系统表,这种方式会唤醒空闲服务。
ClickStack 部署选项
- Helm:推荐用于基于 Kubernetes 的调试环境。可通过
values.yaml进行环境特定的配置,并设置资源限制和扩缩容。 - Docker Compose:分别部署各个组件 (ClickHouse、HyperDX、OTel collector、MongoDB) 。
- 仅 HyperDX:独立部署的 HyperDX 容器。
直接集成 Grafana 插件
Datadog 直接集成
clusterAllReplicas 功能提供具备集群感知能力的全面数据库监控。
由于该集成与为优化成本而设计的空闲机制以及 Cloud proxy 层的运行限制不兼容,因此不建议在 ClickHouse Cloud 部署中使用。
直接使用系统表
system.query_log,以便深入分析查询性能。团队可通过 SQL 控制台或 clickhouse client 识别慢查询、分析资源使用情况,并跟踪整个组织内的使用模式。
查询性能分析
你可以使用系统表中的查询日志来进行查询性能分析。
示例查询:查找所有集群副本中耗时最长的前 5 个查询:
社区监控解决方案
与其他直接监控数据库的方法一样,该方案会直接查询 ClickHouse 系统表,这会使实例无法进入空闲状态,从而影响成本优化。