input_format_allow_errors_num
input_format_allow_errors_ratio와 함께 사용하십시오.
행을 읽는 동안 오류가 발생했더라도 오류 카운터가 아직 input_format_allow_errors_num보다 작으면 ClickHouse는 해당 행을 무시하고 다음 행으로 넘어갑니다.
input_format_allow_errors_num와 input_format_allow_errors_ratio를 모두 초과하면 ClickHouse는 예외를 발생시킵니다.
input_format_allow_errors_ratio
input_format_allow_errors_num과 함께 사용하십시오.
행을 읽는 중 오류가 발생하더라도 오류 카운터가 아직 input_format_allow_errors_ratio보다 작으면 ClickHouse는 해당 행을 무시하고 다음 행을 계속 읽습니다.
input_format_allow_errors_num과 input_format_allow_errors_ratio를 모두 초과하면 ClickHouse는 예외를 발생시킵니다.
input_format_allow_seeks
input_format_arrow_allow_missing_columns
input_format_arrow_case_insensitive_column_matching
input_format_arrow_skip_columns_with_unsupported_types_in_schema_inference
input_format_arrow_use_native_reader
input_format_avro_allow_missing_fields
input_format_avro_null_as_default
input_format_binary_decode_types_in_binary_format
input_format_binary_max_type_complexity
Map(String, UInt32)는 3개의 노드입니다. 악의적인 입력을 방지합니다. 0은 무제한입니다.
input_format_binary_read_json_as_string
input_format_bson_skip_fields_with_unsupported_types_in_schema_inference
input_format_capn_proto_skip_fields_with_unsupported_types_in_schema_inference
input_format_column_name_matching_mode
- match_case: 대소문자를 구분하여 일치
- ignore_case: 대소문자를 구분하지 않고 일치
- auto: 먼저 대소문자를 구분하여 일치를 시도하고, 실패하면 대소문자를 구분하지 않고 일치를 시도합니다.
input_format_connection_handling
이 옵션을 활성화하면 병렬 파싱이 비활성화되며 중복 제거를 사용할 수 없게 됩니다
input_format_csv_allow_cr_end_of_line
input_format_csv_allow_variable_number_of_columns
input_format_csv_allow_whitespace_or_tab_as_delimiter
input_format_csv_arrays_as_nested_csv
input_format_csv_deserialize_separate_columns_into_tuple
input_format_csv_detect_header
input_format_csv_empty_as_default
input_format_csv_enum_as_number
input_format_csv_missing_nullable_as_empty_string
Nullable(String)으로 읽는 방식을 제어합니다. 누락된 값은 따옴표로 둘러싸이지 않은 상태에서 쉼표 사이, 앞 또는 뒤에 있는 빈 공간을 의미합니다. 이 설정을 활성화하면 input_format_csv_empty_as_default 값과 관계없이 Nullable(String)의 누락된 값은 NULL이 아니라 빈 String으로 해석됩니다.
input_format_csv_skip_first_lines
input_format_csv_skip_trailing_empty_lines
input_format_csv_trim_whitespaces
input_format_csv_try_infer_numbers_from_strings
input_format_csv_try_infer_strings_from_quoted_tuples
input_format_csv_use_best_effort_in_schema_inference
input_format_csv_use_default_on_bad_values
input_format_custom_allow_variable_number_of_columns
input_format_custom_detect_header
input_format_custom_skip_trailing_empty_lines
input_format_defaults_for_omitted_fields
INSERT 쿼리를 수행할 때 생략된 입력 컬럼 값을 해당 컬럼의 기본값으로 대체합니다. 이 옵션은 JSONEachRow(및 기타 JSON 포맷), CSV, TabSeparated, TSKV, Parquet, Arrow, Avro, ORC, Native 포맷과 WithNames/WithNamesAndTypes 접미사가 있는 포맷에 적용됩니다.
이 옵션을 활성화하면 확장된 테이블 메타데이터가 서버에서 클라이언트로 전송됩니다. 이로 인해 서버에서 추가 컴퓨팅 리소스가 사용되며 성능이 저하될 수 있습니다.
- 0 — 비활성화됨.
- 1 — 활성화됨.
input_format_force_null_for_omitted_fields
input_format_geojson_unsupported_geometry_handling
GeoJSON 입력을 읽는 동안 ClickHouse의 Geometry 타입으로 표현할 수 없는 유효한 GeoJSON geometry 타입(GeometryCollection 또는 MultiPoint 등)을 geometry 컬럼에 저장해야 하는 경우의 처리 방식을 제어합니다.
가능한 값:
'throw'(기본값) — 예외를 발생시킵니다.'null'—geometry컬럼에NULL값을 삽입하고 파싱을 계속합니다.
geometry 컬럼이 구체화된 경우에만 적용됩니다. 해당 컬럼이 요청된 출력 컬럼이 아닌 경우에는 이러한 geometry의 형식 유효성만 검증하며, 이 처리 방식은 적용되지 않습니다.
input_format_hive_text_allow_variable_number_of_columns
input_format_hive_text_collection_items_delimiter
input_format_hive_text_fields_delimiter
input_format_hive_text_map_keys_delimiter
input_format_import_nested_json
- 0 — 비활성화됨.
- 1 — 활성화됨.
JSONEachRow포맷의 중첩 구조 사용.
input_format_ipv4_default_on_conversion_error
input_format_ipv6_default_on_conversion_error
input_format_json_compact_allow_variable_number_of_columns
input_format_json_defaults_for_missing_elements_in_named_tuple
input_format_json_named_tuples_as_objects 설정이 활성화된 경우에만 작동합니다.
기본적으로 활성화되어 있습니다.
input_format_json_empty_as_default
input_format_defaults_for_omitted_fields도 함께 활성화해야 합니다.
가능한 값:
- 0 — 비활성화.
- 1 — 활성화.
input_format_json_ignore_unknown_keys_in_named_tuple
input_format_json_ignore_unnecessary_fields
input_format_json_infer_array_of_dynamic_from_array_of_different_types
input_format_json_infer_incomplete_types_as_strings
Null/{}/[]만 포함된 JSON 키에 대해 String 타입을 사용할 수 있도록 허용합니다.
JSON 포맷에서는 모든 값을 String으로 읽을 수 있으므로, 타입을 알 수 없는 키에 String 타입을 사용하면 스키마 추론 중 Cannot determine type for column 'column_name' by first 25000 rows of data, most likely this column contains only Nulls or empty Arrays/Maps와 같은 오류를 방지할 수 있습니다.
예시:
input_format_json_map_as_array_of_tuples
input_format_json_max_depth
input_format_json_named_tuples_as_objects
input_format_json_read_arrays_as_strings
input_format_json_read_bools_as_numbers
input_format_json_read_bools_as_strings
input_format_json_read_numbers_as_strings
input_format_json_read_objects_as_strings
input_format_json_throw_on_bad_escape_sequence
input_format_json_try_infer_named_tuples_from_objects
input_format_json_try_infer_numbers_from_strings
input_format_json_use_string_type_for_ambiguous_paths_in_named_tuples_inference_from_objects
input_format_json_validate_types_from_metadata
input_format_max_block_size_bytes
input_format_max_block_wait_ms
이 옵션은
input_format_connection_handling이 활성화된 경우에만 동작합니다. 값을 설정하면 병렬 파싱도 비활성화되며 중복 제거도 불가능해집니다.스트리밍 방식으로 삽입할 때는
min_insert_block_size_rows=0 및 min_insert_block_size_bytes=0도 설정해야 합니다. 그렇지 않으면 파싱된 블록이 해당 임계값에 도달할 때까지 block squashing 단계에서 메모리에 계속 누적될 수 있어, 시의적절한 삽입이 이루어지지 않을 수 있습니다.input_format_max_bytes_to_read_for_schema_inference
input_format_max_rows_to_read_for_schema_inference
input_format_msgpack_number_of_columns
input_format_mysql_dump_map_column_names
input_format_mysql_dump_table_name
input_format_native_allow_types_conversion
input_format_native_decode_types_in_binary_format
input_format_null_as_default
NULL을 삽입할 때 예외가 발생합니다. 컬럼 타입이 널 허용이면 이 설정과 관계없이 NULL 값이 그대로 삽입됩니다.
이 설정은 대부분의 입력 형식에 적용됩니다.
복잡한 기본 표현식의 경우 input_format_defaults_for_omitted_fields도 함께 활성화해야 합니다.
가능한 값:
- 0 — 널 허용이 아닌 컬럼에
NULL을 삽입하면 예외가 발생합니다. - 1 —
NULL필드는 컬럼의 기본값으로 초기화됩니다.
input_format_orc_allow_missing_columns
input_format_orc_case_insensitive_column_matching
input_format_orc_dictionary_as_low_cardinality
input_format_orc_filter_push_down
input_format_orc_reader_time_zone_name
input_format_orc_row_batch_size
input_format_orc_skip_columns_with_unsupported_types_in_schema_inference
input_format_orc_use_fast_decoder
input_format_parallel_parsing
- 1 — 활성화됨.
- 0 — 비활성화됨.
input_format_parquet_allow_geoparquet_parser
input_format_parquet_allow_missing_columns
input_format_parquet_bloom_filter_push_down
input_format_parquet_case_insensitive_column_matching
input_format_parquet_enable_json_parsing
input_format_parquet_enable_row_group_prefetch
input_format_parquet_filter_push_down
input_format_parquet_local_file_min_bytes_for_seek
input_format_parquet_local_time_as_utc
input_format_parquet_max_block_size
input_format_parquet_memory_high_watermark
input_format_parquet_memory_low_watermark
input_format_parquet_page_filter_push_down
input_format_parquet_prefer_block_bytes
input_format_parquet_preserve_order
ORDER BY _row_number를 사용하세요.
input_format_parquet_skip_columns_with_unsupported_types_in_schema_inference
input_format_parquet_use_offset_index
input_format_parquet_verify_checksums
input_format_protobuf_flatten_google_wrappers
input_format_protobuf_oneof_presence
input_format_protobuf_skip_fields_with_unsupported_types_in_schema_inference
input_format_record_errors_file_path
input_format_skip_unknown_fields
- JSONEachRow (및 기타 JSON 포맷)
- BSONEachRow (및 기타 JSON 포맷)
- TSKV
- 접미사 WithNames/WithNamesAndTypes가 붙는 모든 포맷
- MySQLDump
- Native
- 0 — 비활성화됨.
- 1 — 활성화됨.
input_format_try_infer_dates
Date 유형을 추론하려고 합니다. 입력 데이터의 한 컬럼에 있는 모든 필드가 날짜로 성공적으로 파싱되면 결과 유형은 Date가 되고, 하나라도 날짜로 파싱되지 않으면 결과 유형은 String이 됩니다.
기본적으로 활성화되어 있습니다.
input_format_try_infer_datetimes
DateTime64 유형을 추론하려고 합니다. 입력 데이터의 한 컬럼에 있는 모든 필드가 datetime으로 성공적으로 파싱되면 결과 유형은 DateTime64가 되며, 하나 이상의 필드가 datetime으로 파싱되지 않으면 결과 유형은 String이 됩니다.
기본적으로 활성화되어 있습니다.
input_format_try_infer_datetimes_only_datetime64
input_format_try_infer_exponent_floats
input_format_try_infer_integers
Int64이고, 숫자 중 하나라도 부동소수점 값이면 결과 유형은 Float64입니다.
기본적으로 활성화되어 있습니다.
input_format_try_infer_variants
Variant 타입 추론을 시도합니다.
가능한 값:
- 0 — 비활성화됨.
- 1 — 활성화됨.
input_format_tsv_allow_variable_number_of_columns
input_format_tsv_crlf_end_of_line
\n 대신 \r\n을 사용하는 TSV 포맷을 읽습니다.
input_format_tsv_detect_header
input_format_tsv_empty_as_default
input_format_tsv_enum_as_number
input_format_tsv_skip_first_lines
input_format_tsv_skip_trailing_empty_lines
input_format_tsv_use_best_effort_in_schema_inference
input_format_values_accurate_types_of_literals
input_format_values_deduce_templates_of_expressions
input_format_values_interpret_expressions
input_format_with_names_use_header
- CSVWithNames
- CSVWithNamesAndTypes
- TabSeparatedWithNames
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNames
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNames
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNames
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNames
- CustomSeparatedWithNamesAndTypes
- 0 — 비활성화됨.
- 1 — 활성화됨.
input_format_with_types_use_header
- CSVWithNamesAndTypes
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNamesAndTypes
- 0 — 비활성화됨.
- 1 — 활성화됨.