DataLakeCatalog vous permet de connecter ClickHouse à des
catalogues de données externes et d’interroger des données dans un format de table ouvert, sans avoir à dupliquer les données.
Cela transforme ClickHouse en un puissant moteur de requête qui s’intègre parfaitement à
votre infrastructure de lac de données existante.
Catalogues pris en charge
Le moteurDataLakeCatalog prend en charge les catalogues de données suivants :
- AWS Glue Catalog - Pour les tables Iceberg dans des environnements AWS
- Databricks Unity Catalog - Pour les tables Delta Lake et Iceberg
- Hive Metastore - Catalogue traditionnel de l’écosystème Hadoop
- Catalogues REST - Tout catalogue compatible avec la spécification REST d’Iceberg
Création d’une base de données
Vous devrez activer les paramètres appropriés ci-dessous pour utiliser le moteurDataLakeCatalog :
DataLakeCatalog peuvent être créées selon la syntaxe suivante :
Exemples
Consultez les sections ci-dessous pour voir des exemples d’utilisation du moteurDataLakeCatalog :
- Unity Catalog
- Glue Catalog
- Catalog OneLake
Peut être utilisé en activant
allow_database_iceberg.
onelake_bearer_token sur un Bearer jeton obtenu au préalable
(limité à https://storage.azure.com) au lieu de
onelake_client_id/onelake_client_secret. ClickHouse ne renouvelle pas le jeton ; la
base de données doit donc être recréée après son expiration.