ClickHouseCluster : le volume de données principal, l’ajout de disques supplémentaires dans une
configuration multi-disques (JBOD), l’extension de capacité et les règles qui définissent ce que vous
pouvez ou non modifier une fois le cluster créé.
Pour une référence détaillée champ par champ, consultez
Configuration → Configuration du stockage
et la Référence de l’API.
spec.dataVolumeClaimSpec est un PersistentVolumeClaimSpec Kubernetes standard.
L’opérateur le convertit en volumeClaimTemplate de StatefulSet, de sorte que le
contrôleur StatefulSet crée et conserve un PersistentVolumeClaim par réplique et le monte
dans le chemin de données ClickHouse /var/lib/clickhouse.
- Lorsque
accessModesest omis, l’opérateur le définit par défaut surReadWriteOnce. - Le PVC de chaque réplique est conservé lorsque le cluster est supprimé, de sorte que les données sont préservées après la suppression puis la recréation de la ressource personnalisée. Pour les données relevant d’une politique chiffrée, cela nécessite en outre de préserver la clé de chiffrement — voir la note dans cette section.
- Le même champ existe sur
KeeperClusteret se comporte de la même façon.
Exécution sans volume de données persistant
dataVolumeClaimSpec est facultatif. Si vous l’omettez et ne montez pas votre propre volume
sur le chemin de données, ClickHouse écrit dans le système de fichiers éphémère du conteneur, et le webhook d’admission
renvoie un avertissement indiquant que les données risquent d’être perdues si le cluster redémarre.
Cette configuration est uniquement prévue pour les clusters de test ou jetables. Pour fournir votre propre stockage
à la place de dataVolumeClaimSpec — par exemple un emptyDir ou un volume préprovisionné —
définissez-le via spec.podTemplate.volumes et montez-le sur
/var/lib/clickhouse avec spec.containerTemplate.volumeMounts.
dataVolumeClaimSpec et un volume personnalisé sur le chemin de données sont mutuellement exclusifs.
Si dataVolumeClaimSpec est défini, le montage d’un volume personnalisé sur /var/lib/clickhouse
est rejeté. Les noms de volumes réservés clickhouse-storage-volume,
clickhouse-server-tls-volume et clickhouse-server-custom-ca-volume ne peuvent pas être
utilisés dans podTemplate.volumes.Extension du stockage
resources.requests.storage et appliquez la modification. L’opérateur met à jour les PVC existants directement.
L’extension ne fonctionne que si le StorageClass sous-jacent utilise
allowVolumeExpansion: true. Kubernetes ne prend pas en charge la réduction d’un PVC. La
nouvelle taille doit donc être supérieure ou égale à la taille actuelle.Stockage multi-disques (JBOD)
spec.additionalVolumeClaimTemplates ajoute des disques supplémentaires à chaque
réplique ClickHouse, en complément du dataVolumeClaimSpec principal. Chaque entrée est un modèle de PVC nommé
— un metadata.name plus une spec de PVC — reconcilié exactement comme le
disque de données principal, de sorte que le contrôleur StatefulSet crée et conserve un PVC par
réplique nommé <name>-<statefulset>-0.
/var/lib/clickhouse/disks/<name>
et génère la storage_configuration de ClickHouse pour vous — vous n’avez pas à
la rédiger manuellement. Il enregistre chaque disque supplémentaire et l’ajoute à la
politique de stockage default intégrée.
Le disque de données principal (default) et chaque disque supplémentaire partagent un
même volume de la politique default, de sorte que ClickHouse répartit les nouvelles
data parts entre eux selon un mécanisme de round-robin. La capacité utilisable est la somme
de tous les disques, et chaque table qui ne définit pas sa propre storage_policy — y
compris les tables system.* — utilise cet ensemble combiné.
Le chemin de montage conserve le nom du modèle tel quel, mais l’identifiant du disque dans
storage_configuration remplace les traits d’union par des underscores. Un modèle nommé
cold-disk est monté dans /var/lib/clickhouse/disks/cold-disk et apparaît sous la forme
cold_disk dans la configuration générée.Politiques de stockage personnalisées
extraConfig pour la configuration JBOD ci-dessus — l’opérateur génère
automatiquement la politique default. N’utilisez spec.settings.extraConfig que si
vous avez besoin de politiques de stockage en plus de celle générée par défaut, par exemple une politique
hot/cold à plusieurs niveaux avec move_factor et prefer_not_to_merge, ou un disque basé sur S3.
La configuration que vous y ajoutez est fusionnée par-dessus la storage_configuration générée.
Consultez la
documentation de stockage ClickHouse
pour les champs de la politique.
Chiffrement au repos
spec.settings.encryption active le chiffrement au repos des données des
tables. L’opérateur génère une clé AES de 16 octets — stockée dans le Secret du
cluster géré, ou fournie via externalSecret — ainsi qu’une politique de stockage
dédiée qui enveloppe chaque disque de données avec le type de disque encrypted de ClickHouse.
encryption.policyName pour utiliser un autre nom de politique.
Cela chiffre les parties de données MergeTree écrites via la politique chiffrée avec
AES-128-CTR. Les métadonnées du serveur ClickHouse et les logs à la racine des données ne sont pas couverts —
utilisez un chiffrement au niveau du disque, comme LUKS ou un pilote CSI, pour ceux-ci.
L’activation du chiffrement sur un cluster en cours d’exécution déclenche un redémarrage progressif ponctuel afin
d’injecter la clé ; les répliques peuvent brièvement signaler une erreur de rechargement de la configuration jusqu’à
ce que ce redémarrage soit terminé.La clé est stockée dans le Secret du cluster géré par l’opérateur, qui appartient à la
ressource personnalisée et est supprimé avec elle. Les parties chiffrées sont illisibles sans la
clé : si les données chiffrées doivent survivre à la suppression du CR (les PVC sont conservés), fournissez
la clé via
externalSecret ou sauvegardez l’entrée disk-encryption-key
avant la suppression. Ne supprimez pas le Secret géré — l’opérateur générerait
une nouvelle clé et les parties chiffrées existantes deviendraient illisibles.Ce que vous ne pouvez pas modifier après la création
- La présence de
dataVolumeClaimSpecest immuable — vous ne pouvez pas ajouter un volume de données à un cluster créé sans ce volume, ni le supprimer d’un cluster créé avec un tel volume. - L’ensemble des
additionalVolumeClaimTemplatesest figé — vous ne pouvez pas ajouter, supprimer ni renommer d’entrées après la création. - L’augmentation de
resources.requests.storagesur une entrée existante est autorisée (sous réserve de la prise en charge par la StorageClass, voir Extension du stockage). - Le chiffrement ne peut pas être désactivé une fois activé, et
encryption.policyNamene peut pas être renommé — les tables utilisant déjà la politique de chiffrement deviendraient inaccessibles.
Référence de validation
- Configuration — la référence complète des champs, y compris
extraConfig. - Mise à l’échelle des clusters — comment ajouter et supprimer des répliques et des shards.