L’intégration avec le Nessie Catalog fonctionne uniquement avec les tables Iceberg.
Cette intégration prend en charge aussi bien AWS S3 que d’autres fournisseurs de cloud storage.
- un contrôle de version des données inspiré de Git, avec des branches et des commits
- des transactions inter-tables et des garanties de visibilité
- la conformité de l’API REST à la spécification REST Catalog d’Iceberg
- une approche open data lake compatible avec Hive, Spark, Dremio, Trino, et plus encore
- un déploiement prêt pour la production sur Docker ou Kubernetes
Cette fonctionnalité étant expérimentale, vous devez l’activer avec :
SET allow_experimental_database_iceberg = 1;Configuration d’un environnement de développement local
Prérequis
- Docker et Docker Compose : assurez-vous que Docker est installé et en fonctionnement
- Configuration d’exemple : vous pouvez utiliser la configuration officielle
docker-composede Nessie
Configuration d’un Nessie Catalog local
docker-compose.yml avec la configuration suivante :
La configuration Nessie utilise un magasin de versions en mémoire et nécessite que les données d’exemple soient d’abord chargées dans les tables Iceberg. Assurez-vous que l’environnement a bien créé et rempli les tables avant de tenter de les interroger via ClickHouse.
Se connecter au Nessie Catalog local
Interroger les tables du Nessie Catalog avec ClickHouse
Si vous ne voyez aucune table, cela signifie généralement que :
- L’environnement n’a pas encore créé les tables d’exemple
- Le service de catalogue Nessie n’est pas encore complètement initialisé
- Le processus de chargement des données d’exemple n’est pas encore terminé
Accents graves obligatoiresLes accents graves doivent être utilisés, car ClickHouse ne prend pas en charge plusieurs espaces de noms.
Chargement des données de votre data lake dans ClickHouse
INSERT INTO SELECT :