Ingestion de fichiers Parquet depuis un bucket S3
- créez des clés d’accès et des clés secrètes pour un utilisateur de service IAM. les utilisateurs de connexion classiques ne fonctionnent généralement pas, car ils peuvent avoir été configurés avec une politique MFA.
- définissez les autorisations de la politique afin de permettre à l’utilisateur de service d’accéder au bucket et aux dossiers.
** permet de spécifier récursivement tous les sous-répertoires.
https://clickhouse.com/docs/sql-reference/table-functions/s3/
Par exemple, en supposant que les chemins et la structure du bucket ressemblent à ceci :
https://your_s3_bucket.s3.amazonaws.com/<your_folder>/<year>/<month>/<day>/<filename>.parquet
https://mars-doc-test.s3.amazonaws.com/system_logs/2022/11/01/my-app-logs-0001.parquet
Cela récupérera tous les fichiers du 1er jour de chaque mois entre 2021 et 2022
https://mars-doc-test.s3.amazonaws.com/system_logs/{2021-2022}/**/01/*.parquet