ClickHouse의 오픈 테이블 포맷 통합 및 데이터 카탈로그 연결에 대한 종합적인 지원 매트릭스입니다.
이 페이지에서는 ClickHouse의 데이터 레이크 통합에 대한 종합적인 지원 매트릭스를 제공합니다. 각 오픈 테이블 포맷에서 사용할 수 있는 기능, ClickHouse가 연결할 수 있는 카탈로그, 그리고 각 카탈로그에서 지원되는 기능을 다룹니다.지원 여부는 ClickHouse Cloud와 자가 관리형 ClickHouse에 대해 별도로 표시됩니다. 실험적 기능은 ClickHouse Cloud에서 기본적으로 비활성화되어 있으며 Support를 통해 요청해야 합니다. 사용 가능 여부는 기능에 따라 다르므로, 특정 실험적 기능을 활성화할 수 있는지 확인하려면 Support에 문의하십시오. 배포별 구성 및 제한 사항은 참고 컬럼에 설명되어 있습니다.
Experimental. Iceberg v2 이상, allow_insert_into_iceberg = 1, allow_iceberg_remove_orphan_files = 1이 필요합니다. 고아 파일 제거를 참조하십시오.
파티션 쓰기
✅ 베타
✅ 베타
Iceberg 쓰기 작업에서 지원됩니다.
파티션 변경
❌
❌
ClickHouse에서는 파티셔닝 방식을 변경할 수 없습니다. ClickHouse는 파티셔닝 방식이 변경된 Iceberg 테이블에 쓸 수 있습니다.
메타데이터
브랜치 및 태그 지정
❌
❌
Iceberg 브랜치/태그 참조는 지원되지 않습니다.
메타데이터 파일 해상도
✅
✅
카탈로그, 디렉터리 나열, version-hint 및 특정 경로를 통한 해상도를 지원합니다. 메타데이터 파일 해상도를 참조하십시오.
데이터 캐싱
✅
✅
S3/Azure/HDFS 저장 엔진과 동일한 메커니즘을 사용합니다. 데이터 캐시를 참조하십시오.
메타데이터 캐싱
✅
✅
use_iceberg_metadata_files_cache를 통해 기본적으로 활성화됩니다. 메타데이터 캐시를 참조하십시오.
25.6 버전부터 ClickHouse는 Delta Lake Rust kernel을 사용해 Delta Lake 테이블을 읽으며, 이를 통해 더 폭넓은 기능을 지원합니다. 하지만 Azure Blob Storage의 데이터에 액세스할 때 알려진 문제가 발생합니다. 따라서 Azure Blob Storage에서 데이터를 읽을 때는 Kernel이 비활성화됩니다. 아래 표에서 이 kernel이 필요한 기능을 확인할 수 있습니다.
ClickHouse는 DataLakeCatalog 데이터베이스 엔진을 사용해 외부 데이터 카탈로그에 연결할 수 있으며, 이 엔진은 카탈로그를 ClickHouse 데이터베이스로 노출합니다. 카탈로그에 등록된 테이블은 자동으로 표시되며, 표준 SQL로 쿼리할 수 있습니다.현재 다음 카탈로그를 지원합니다. 전체 설정 방법은 각 카탈로그의 참고 가이드를 참조하십시오.
현재 모든 카탈로그 통합은 Experimental 또는 베타 설정을 활성화해야 사용할 수 있습니다. Microsoft OneLake, Databricks Unity Catalog, SeaweedFS를 제외한 모든 카탈로그는 읽기 전용 액세스만 제공합니다. 즉, 카탈로그 연결을 통해 테이블을 쿼리할 수는 있지만, 테이블을 생성하거나 데이터를 쓸 수는 없습니다. 카탈로그의 데이터를 ClickHouse로 로드해 더 빠르게 분석하려면 분석 가속화 가이드에 설명된 대로 INSERT INTO SELECT를 사용하십시오. 오픈 테이블 포맷에 데이터를 다시 쓰려면 데이터 쓰기 가이드에 설명된 대로 독립형 Iceberg 테이블을 생성하십시오.