Introducción
En esta guía, veremos cómo conectar ClickHouse a Kafka mediante colecciones con nombre. Usar el archivo de configuración para las colecciones con nombre ofrece varias ventajas:- Gestión centralizada y más sencilla de los ajustes de configuración.
- Los cambios en los ajustes pueden realizarse sin modificar las definiciones de tablas SQL.
- Revisión y solución de problemas de configuración más sencillas al inspeccionar un único archivo de configuración.
Supuestos
Este documento da por hecho que cuentas con:- Un clúster de Kafka en funcionamiento.
- Un clúster de ClickHouse configurado y en ejecución.
- Conocimientos básicos de SQL y familiaridad con la configuración de ClickHouse y Kafka.
Requisitos previos
Asegúrese de que el usuario que cree la colección con nombre tenga los permisos de acceso necesarios:Configuración
Añade la siguiente sección al archivoconfig.xml de ClickHouse:
Notas de configuración
- Ajusta las direcciones de Kafka y la configuración relacionada según la configuración de tu clúster de Kafka.
- La sección anterior a
<kafka>contiene los parámetros del motor Kafka de ClickHouse. Para ver la lista completa de parámetros, consulta parámetros del motor Kafka . - La sección dentro de
<kafka>contiene opciones adicionales de configuración de Kafka. Para ver más opciones, consulta la configuración de librdkafka. - Este ejemplo usa el protocolo de seguridad
SASL_SSLy el mecanismoPLAIN. Ajusta estos valores según la configuración de tu clúster de Kafka.
Creación de tablas y bases de datos
Cree las bases de datos y tablas necesarias en su clúster de ClickHouse. Si ejecuta ClickHouse en un solo nodo, omita la parte del clúster en el comando SQL y use cualquier otro motor en lugar deReplicatedMergeTree.
Crear la base de datos
Crear tablas de Kafka
Cree la primera tabla de Kafka para el primer clúster de Kafka:Crear tablas replicadas
Cree una tabla para la primera de las tablas de Kafka:Crear vistas materializadas
Cree una vista materializada para insertar datos de la primera tabla de Kafka en la primera tabla replicada:Verificación de la configuración
Ahora deberías ver los grupos de consumidores correspondientes en tus clústeres de Kafka:cluster_1_clickhouse_consumerencluster_1cluster_2_clickhouse_consumerencluster_2
Nota
En esta guía, los datos que se ingieren en ambos topics de Kafka son los mismos. En su caso, serían distintos. Puede añadir tantos clústeres de Kafka como desee. Salida de ejemplo:config.xml de ClickHouse, puede administrar y ajustar los parámetros con mayor facilidad, lo que garantiza una integración más ágil y eficiente.