نظرة عامة
MergeTree من خلال S3BackedMergeTree. ويتيح لك محرك الجداول هذا الاستفادة من مزايا قابلية التوسّع والتكلفة التي يوفّرها S3، مع الحفاظ على أداء insert وquery لمحرك MergeTree.
يرجى ملاحظة أن تنفيذ وإدارة معمارية فصل التخزين والحوسبة أكثر تعقيدًا مقارنةً بعمليات نشر ClickHouse القياسية. وبينما يتيح Self-managed ClickHouse فصل التخزين والحوسبة كما هو موضّح في هذا الدليل، فإننا نوصي باستخدام ClickHouse Cloud، الذي يتيح لك استخدام ClickHouse بهذه المعمارية من دون أي تهيئة، وذلك باستخدام محرك الجداول SharedMergeTree.
يفترض هذا الدليل أنك تستخدم ClickHouse الإصدار 22.8 أو أحدث.
1
استخدم S3 كقرص لـ ClickHouse
إنشاء قرص
أنشئ ملفًا جديدًا في الدليلconfig.d الخاص بـ ClickHouse لتخزين تهيئة التخزين:BUCKET وACCESS_KEY_ID وSECRET_ACCESS_KEY بتفاصيل حاوية AWS التي تريد تخزين بياناتك فيها:region أو إرسال ترويسة HTTP مخصّصة header — فيمكنك العثور على قائمة الإعدادات ذات الصلة هنا.يمكنك أيضًا استبدال access_key_id وsecret_access_key بما يلي، والذي سيحاول الحصول على بيانات الاعتماد من متغيرات البيئة وبيانات Amazon EC2 الوصفية:clickhouse:2
إنشاء جدول يعتمد على S3
لاختبار أن قرص S3 قد أُعدّ على نحو صحيح، يمكننا محاولة إنشاء جدول وتنفيذ query عليه.أنشئ جدولًا مع تحديد storage policy الجديدة الخاصة بـ S3:لاحظ أننا لم نحتج إلى تحديد المحرّك على أنه يجب أن تظهر لك النتيجة التالية:لنُدرج الآن بعض الصفوف في جدولنا الجديد:لنتحقق من أنه تم إدراج الصفوف:في وحدة تحكم AWS، إذا أُدرجت بياناتك بنجاح في S3، فيجب أن ترى أن ClickHouse أنشأ ملفات جديدة في الحاوية التي حددتها.إذا سار كل شيء بنجاح، فأنت تستخدم الآن ClickHouse مع فصل التخزين عن الحوسبة!
S3BackedMergeTree. يحوّل ClickHouse نوع المحرّك تلقائيًا داخليًا إذا اكتشف أن الجدول يستخدم S3 للتخزين.أظهِر أن الجدول أُنشئ باستخدام السياسة الصحيحة:3
إعداد النسخ المتماثل لتحمّل الأعطال (اختياري)
لتحمّل الأعطال، يمكنك استخدام عدة عُقد لخادم ClickHouse موزعة عبر عدة مناطق AWS، مع حاوية S3 لكل عقدة.يمكن تحقيق النسخ المتماثل باستخدام أقراص S3 عبر محرك الجداول
ReplicatedMergeTree. راجع الدليل التالي للاطلاع على التفاصيل: