Introdução
Neste guia, vamos ver como conectar o ClickHouse ao Kafka usando coleções nomeadas. Usar o arquivo de configuração para coleções nomeadas oferece várias vantagens:- Gerenciamento centralizado e mais simples das configurações.
- As configurações podem ser alteradas sem modificar as definições SQL das tabelas.
- Fica mais fácil revisar e solucionar problemas de configuração ao inspecionar um único arquivo de configuração.
Premissas
Este documento pressupõe que você tenha:- Um cluster Kafka em funcionamento.
- Um cluster ClickHouse configurado e em execução.
- Conhecimento básico de SQL e familiaridade com as configurações do ClickHouse e do Kafka.
Pré-requisitos
Certifique-se de que o usuário que está criando a coleção nomeada tenha as permissões de acesso necessárias:Configuração
Adicione a seção a seguir ao arquivoconfig.xml do ClickHouse:
Observações sobre a configuração
- Ajuste os endereços do Kafka e as configurações relacionadas para que correspondam à configuração do seu cluster Kafka.
- A seção anterior a
<kafka>contém os parâmetros do motor Kafka do ClickHouse. Para ver a lista completa de parâmetros, consulte parâmetros do motor Kafka. - A seção dentro de
<kafka>contém opções avançadas de configuração do Kafka. Para ver mais opções, consulte a configuração do librdkafka. - Este exemplo usa o protocolo de segurança
SASL_SSLe o mecanismoPLAIN. Ajuste essas configurações de acordo com a configuração do seu cluster Kafka.
Criando tabelas e bancos de dados
Crie os bancos de dados e as tabelas necessários no seu cluster do ClickHouse. Se estiver executando o ClickHouse em um único nó, omita a parte referente ao cluster no comando SQL e use qualquer outro engine em vez deReplicatedMergeTree.
Criar o banco de dados
Criar tabelas do Kafka
Crie a primeira tabela do Kafka para o primeiro cluster Kafka:Criar tabelas replicadas
Crie uma tabela para a primeira tabela do Kafka:Criar visões materializadas
Crie uma visão materializada para inserir dados da primeira tabela do Kafka na primeira tabela replicada:Verificando a configuração
Agora você deve ver os grupos de consumidores correspondentes nos seus clusters do Kafka:cluster_1_clickhouse_consumeremcluster_1cluster_2_clickhouse_consumeremcluster_2
Observação
Neste guia, os dados ingeridos em ambos os tópicos do Kafka são os mesmos. No seu caso, eles seriam diferentes. Você pode adicionar quantos clusters Kafka quiser. Saída de exemplo:config.xml do ClickHouse, você pode gerenciá-las e ajustá-las com mais facilidade, garantindo uma integração mais simples e eficiente.