input_format_allow_errors_num
input_format_allow_errors_ratio と組み合わせて使用してください。
行の読み込み中にエラーが発生しても、エラーカウンターが input_format_allow_errors_num 未満であれば、ClickHouse はその行を無視して次の行へ進みます。
input_format_allow_errors_num と input_format_allow_errors_ratio の両方のしきい値を超えると、ClickHouse は例外をスローします。
input_format_allow_errors_ratio
input_format_allow_errors_num と組み合わせて使用してください。
行の読み取り中にエラーが発生しても、エラーカウンターが input_format_allow_errors_ratio 未満であれば、ClickHouse はその行を無視して次の行へ進みます。
input_format_allow_errors_num と input_format_allow_errors_ratio の両方を超えた場合、ClickHouse は例外をスローします。
input_format_allow_seeks
input_format_arrow_allow_missing_columns
input_format_arrow_case_insensitive_column_matching
input_format_arrow_skip_columns_with_unsupported_types_in_schema_inference
input_format_arrow_use_native_reader
input_format_avro_allow_missing_fields
input_format_avro_null_as_default
input_format_binary_decode_types_in_binary_format
input_format_binary_max_type_complexity
Map(String, UInt32) = 3 ノード。悪意のある入力を防ぎます。0 = 無制限。
input_format_binary_read_json_as_string
input_format_bson_skip_fields_with_unsupported_types_in_schema_inference
input_format_capn_proto_skip_fields_with_unsupported_types_in_schema_inference
input_format_column_name_matching_mode
- match_case: 大文字・小文字を区別して照合
- ignore_case: 大文字・小文字を区別せずに照合
- auto: まず大文字・小文字を区別して照合を試み、失敗した場合は大文字・小文字を区別しない照合を試みます。
input_format_connection_handling
このオプションを有効にすると、並列パースが無効になり、重複排除はできなくなります
input_format_csv_allow_cr_end_of_line
input_format_csv_allow_variable_number_of_columns
input_format_csv_allow_whitespace_or_tab_as_delimiter
input_format_csv_arrays_as_nested_csv
input_format_csv_deserialize_separate_columns_into_tuple
input_format_csv_detect_header
input_format_csv_empty_as_default
input_format_csv_enum_as_number
input_format_csv_missing_nullable_as_empty_string
Nullable(String) の欠損値をどのように読み取るかを制御します。欠損値とは、引用符で囲まれていない、カンマの間・前・後にある空の項目のことです。この設定を有効にすると、input_format_csv_empty_as_default の値にかかわらず、Nullable(String) の欠損値は NULL ではなく空の String として解釈されます。
input_format_csv_skip_first_lines
input_format_csv_skip_trailing_empty_lines
input_format_csv_trim_whitespaces
input_format_csv_try_infer_numbers_from_strings
input_format_csv_try_infer_strings_from_quoted_tuples
input_format_csv_use_best_effort_in_schema_inference
input_format_csv_use_default_on_bad_values
input_format_custom_allow_variable_number_of_columns
input_format_custom_detect_header
input_format_custom_skip_trailing_empty_lines
input_format_defaults_for_omitted_fields
INSERT クエリの実行時に、省略された入力カラムの値を、対応するカラムのデフォルト値に置き換えます。このオプションは、JSONEachRow (およびその他の JSON フォーマット) 、CSV、TabSeparated、TSKV、Parquet、Arrow、Avro、ORC、Native フォーマット、および WithNames/WithNamesAndTypes 接尾辞を持つフォーマットに適用されます。
このオプションを有効にすると、拡張テーブルのメタデータがサーバーからクライアントに送信されます。これにより、サーバーで追加の計算リソースが消費され、パフォーマンスが低下する可能性があります。
- 0 — 無効。
- 1 — 有効。
input_format_force_null_for_omitted_fields
input_format_geojson_unsupported_geometry_handling
GeoJSON 入力の読み込み時に、ClickHouse の Geometry 型で表現できない有効な GeoJSON のジオメトリ型 (GeometryCollection や MultiPoint など) を geometry カラムに格納する必要がある場合の動作を制御します。
設定可能な値:
'throw'(デフォルト) — 例外をスローします。'null'—geometryカラムにNULL値を挿入し、パースを続行します。
geometry カラムが materialized されている場合にのみ適用されます。要求された出力カラムでない場合、そのようなジオメトリは形式の妥当性のみ検証され、この処理はトリガーされません。
input_format_hive_text_allow_variable_number_of_columns
input_format_hive_text_collection_items_delimiter
input_format_hive_text_fields_delimiter
input_format_hive_text_map_keys_delimiter
input_format_import_nested_json
- 0 — 無効。
- 1 — 有効。
JSONEachRowフォーマットでの Nested 構造の使用。
input_format_ipv4_default_on_conversion_error
input_format_ipv6_default_on_conversion_error
input_format_json_compact_allow_variable_number_of_columns
input_format_json_defaults_for_missing_elements_in_named_tuple
input_format_json_named_tuples_as_objects 設定が有効な場合にのみ機能します。
デフォルトで有効です。
input_format_json_empty_as_default
input_format_defaults_for_omitted_fields も有効にする必要があります。
設定可能な値:
- 0 — 無効。
- 1 — 有効。
input_format_json_ignore_unknown_keys_in_named_tuple
input_format_json_ignore_unnecessary_fields
input_format_json_infer_array_of_dynamic_from_array_of_different_types
input_format_json_infer_incomplete_types_as_strings
Null/{}/[] のみを含む JSON キーに対して String 型を使用できるようにします。
JSON フォーマットでは任意の値を String として読み取れるため、型が不明なキーに String 型を使うことで、スキーマ推論時に Cannot determine type for column 'column_name' by first 25000 rows of data, most likely this column contains only Nulls or empty Arrays/Maps のようなエラーを回避できます。
例:
input_format_json_map_as_array_of_tuples
input_format_json_max_depth
input_format_json_named_tuples_as_objects
input_format_json_read_arrays_as_strings
input_format_json_read_bools_as_numbers
input_format_json_read_bools_as_strings
input_format_json_read_numbers_as_strings
input_format_json_read_objects_as_strings
input_format_json_throw_on_bad_escape_sequence
input_format_json_try_infer_named_tuples_from_objects
input_format_json_try_infer_numbers_from_strings
input_format_json_use_string_type_for_ambiguous_paths_in_named_tuples_inference_from_objects
input_format_json_validate_types_from_metadata
input_format_max_block_size_bytes
input_format_max_block_wait_ms
このオプションは、
input_format_connection_handling が有効な場合にのみ機能します。値を設定すると、並列パースも無効になり、重複排除もできなくなります。ストリーミング挿入では、
min_insert_block_size_rows=0 と min_insert_block_size_bytes=0 も設定する必要があります。そうしないと、パース済みのブロックがそれらの閾値に達するまで、ブロックをまとめる段階でメモリ内に蓄積され続け、適時に挿入されなくなる可能性があります。input_format_max_bytes_to_read_for_schema_inference
input_format_max_rows_to_read_for_schema_inference
input_format_msgpack_number_of_columns
input_format_mysql_dump_map_column_names
input_format_mysql_dump_table_name
input_format_native_allow_types_conversion
input_format_native_decode_types_in_binary_format
input_format_null_as_default
NULL を挿入すると例外が発生します。カラム型が Nullable の場合は、この設定に関係なく、NULL 値はそのまま挿入されます。
この設定は、ほとんどの入力フォーマットに適用されます。
複雑なデフォルト式を使用する場合は、input_format_defaults_for_omitted_fields も有効にする必要があります。
設定可能な値:
- 0 — Nullable でないカラムに
NULLを挿入すると例外が発生します。 - 1 —
NULLフィールドはカラムのデフォルト値で初期化されます。
input_format_orc_allow_missing_columns
input_format_orc_case_insensitive_column_matching
input_format_orc_dictionary_as_low_cardinality
input_format_orc_filter_push_down
input_format_orc_reader_time_zone_name
input_format_orc_row_batch_size
input_format_orc_skip_columns_with_unsupported_types_in_schema_inference
input_format_orc_use_fast_decoder
input_format_parallel_parsing
- 1 — 有効。
- 0 — 無効。
input_format_parquet_allow_geoparquet_parser
input_format_parquet_allow_missing_columns
input_format_parquet_bloom_filter_push_down
input_format_parquet_case_insensitive_column_matching
input_format_parquet_enable_json_parsing
input_format_parquet_enable_row_group_prefetch
input_format_parquet_filter_push_down
input_format_parquet_local_file_min_bytes_for_seek
input_format_parquet_local_time_as_utc
input_format_parquet_max_block_size
input_format_parquet_memory_high_watermark
input_format_parquet_memory_low_watermark
input_format_parquet_page_filter_push_down
input_format_parquet_prefer_block_bytes
input_format_parquet_preserve_order
ORDER BY _row_number を使用してください。
input_format_parquet_skip_columns_with_unsupported_types_in_schema_inference
input_format_parquet_use_offset_index
input_format_parquet_verify_checksums
input_format_protobuf_flatten_google_wrappers
input_format_protobuf_oneof_presence
input_format_protobuf_skip_fields_with_unsupported_types_in_schema_inference
input_format_record_errors_file_path
input_format_skip_unknown_fields
- JSONEachRow (およびその他の JSON フォーマット)
- BSONEachRow (およびその他の JSON フォーマット)
- TSKV
- WithNames/WithNamesAndTypes の接尾辞を持つすべてのフォーマット
- MySQLDump
- Native
- 0 — 無効。
- 1 — 有効。
input_format_try_infer_dates
Date を推論しようとします。入力データ内のあるカラムのすべてのフィールドが日付として正常に解析された場合、結果の型は Date になります。少なくとも 1 つのフィールドが日付として解析されなかった場合、結果の型は String になります。
デフォルトで有効です。
input_format_try_infer_datetimes
DateTime64 型を推論しようとします。入力データ内のあるカラムのすべてのフィールドを日時として正常に解析できた場合、結果の型は DateTime64 になります。1 つでも日時として解析できないフィールドがある場合、結果の型は String になります。
デフォルトで有効です。
input_format_try_infer_datetimes_only_datetime64
input_format_try_infer_exponent_floats
input_format_try_infer_integers
Int64 になります。少なくとも 1 つが浮動小数点数であれば、結果の型は Float64 になります。
デフォルトで有効です。
input_format_try_infer_variants
Variant 型の推論を試みます。
設定可能な値:
- 0 — 無効。
- 1 — 有効。
input_format_tsv_allow_variable_number_of_columns
input_format_tsv_crlf_end_of_line
input_format_tsv_detect_header
input_format_tsv_empty_as_default
input_format_tsv_enum_as_number
input_format_tsv_skip_first_lines
input_format_tsv_skip_trailing_empty_lines
input_format_tsv_use_best_effort_in_schema_inference
input_format_values_accurate_types_of_literals
input_format_values_deduce_templates_of_expressions
input_format_values_interpret_expressions
input_format_with_names_use_header
- CSVWithNames
- CSVWithNamesAndTypes
- TabSeparatedWithNames
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNames
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNames
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNames
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNames
- CustomSeparatedWithNamesAndTypes
- 0 — 無効。
- 1 — 有効。
input_format_with_types_use_header
- CSVWithNamesAndTypes
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNamesAndTypes
- 0 — 無効。
- 1 — 有効。