input_format_allow_errors_num
input_format_allow_errors_ratio.
Si une erreur se produit lors de la lecture de lignes, mais que le compteur d’erreurs reste inférieur à input_format_allow_errors_num, ClickHouse ignore la ligne et passe à la suivante.
Si les seuils de input_format_allow_errors_num et de input_format_allow_errors_ratio sont tous deux dépassés, ClickHouse lève une exception.
input_format_allow_errors_ratio
input_format_allow_errors_num.
Si une erreur se produit lors de la lecture de lignes, mais que le compteur d’erreurs reste inférieur à input_format_allow_errors_ratio, ClickHouse ignore la ligne et passe à la suivante.
Si input_format_allow_errors_num et input_format_allow_errors_ratio sont tous deux dépassés, ClickHouse lève une exception.
input_format_allow_seeks
input_format_arrow_allow_missing_columns
input_format_arrow_case_insensitive_column_matching
input_format_arrow_skip_columns_with_unsupported_types_in_schema_inference
input_format_arrow_use_native_reader
input_format_avro_allow_missing_fields
input_format_avro_null_as_default
input_format_binary_decode_types_in_binary_format
input_format_binary_max_type_complexity
Map(String, UInt32) = 3 nœuds. Protège contre les entrées malveillantes. 0 = illimité.
input_format_binary_read_json_as_string
input_format_bson_skip_fields_with_unsupported_types_in_schema_inference
input_format_capn_proto_skip_fields_with_unsupported_types_in_schema_inference
input_format_column_name_matching_mode
- match_case : correspondance sensible à la casse
- ignore_case : correspondance insensible à la casse
- auto : essaie d’abord une correspondance sensible à la casse ; en cas d’échec, essaie une correspondance insensible à la casse.
input_format_connection_handling
L’activation de cette option désactive l’analyse parallèle et rend la déduplication impossible
input_format_csv_allow_cr_end_of_line
input_format_csv_allow_variable_number_of_columns
input_format_csv_allow_whitespace_or_tab_as_delimiter
input_format_csv_arrays_as_nested_csv
input_format_csv_deserialize_separate_columns_into_tuple
input_format_csv_detect_header
input_format_csv_empty_as_default
input_format_csv_enum_as_number
input_format_csv_missing_nullable_as_empty_string
Nullable(String) est lu lorsqu’une valeur est manquante dans un CSV. Une valeur manquante correspond à un espace vide entre, avant ou après des virgules, sans être entouré de guillemets. Si ce paramètre est activé, quelle que soit la valeur de input_format_csv_empty_as_default, la valeur manquante de Nullable(String) sera interprétée comme une String vide, et non comme NULL.
input_format_csv_skip_first_lines
input_format_csv_skip_trailing_empty_lines
input_format_csv_trim_whitespaces
input_format_csv_try_infer_numbers_from_strings
input_format_csv_try_infer_strings_from_quoted_tuples
input_format_csv_use_best_effort_in_schema_inference
input_format_csv_use_default_on_bad_values
input_format_custom_allow_variable_number_of_columns
input_format_custom_detect_header
input_format_custom_skip_trailing_empty_lines
input_format_defaults_for_omitted_fields
INSERT, remplacez les valeurs des colonnes d’entrée omises par les valeurs par défaut des colonnes correspondantes. Cette option s’applique aux formats JSONEachRow (et aux autres formats JSON), CSV, TabSeparated, TSKV, Parquet, Arrow, Avro, ORC, Native, ainsi qu’aux formats avec les suffixes WithNames/WithNamesAndTypes.
Lorsque cette option est activée, des métadonnées de table étendues sont envoyées du serveur au client. Cela consomme des ressources de calcul supplémentaires sur le serveur et peut réduire les performances.
- 0 — Désactivé.
- 1 — Activé.
input_format_force_null_for_omitted_fields
input_format_geojson_unsupported_geometry_handling
GeoJSON valide qui ne peut pas être représenté par le type Geometry de ClickHouse (comme GeometryCollection ou MultiPoint) doit être stocké dans la colonne geometry lors de la lecture d’une entrée au format GeoJSON.
Valeurs possibles :
'throw'(par défaut) — lever une exception.'null'— insérer une valeurNULLdans la colonnegeometryet poursuivre l’analyse.
geometry est matérialisée. Lorsqu’il ne s’agit pas d’une colonne de sortie demandée, une telle géométrie est bien validée pour vérifier qu’elle est correctement formée, mais ne déclenche pas cette gestion.
input_format_hive_text_allow_variable_number_of_columns
input_format_hive_text_collection_items_delimiter
input_format_hive_text_fields_delimiter
input_format_hive_text_map_keys_delimiter
input_format_import_nested_json
- 0 — Désactivé.
- 1 — Activé.
- Utilisation des structures Nested avec le format
JSONEachRow.
input_format_ipv4_default_on_conversion_error
input_format_ipv6_default_on_conversion_error
input_format_json_compact_allow_variable_number_of_columns
input_format_json_defaults_for_missing_elements_in_named_tuple
input_format_json_named_tuples_as_objects est activé.
Activé par défaut.
input_format_json_empty_as_default
input_format_defaults_for_omitted_fields doit également être activé.
Valeurs possibles :
- 0 — Désactivé.
- 1 — Activé.
input_format_json_ignore_unknown_keys_in_named_tuple
input_format_json_ignore_unnecessary_fields
input_format_json_infer_array_of_dynamic_from_array_of_different_types
input_format_json_infer_incomplete_types_as_strings
Null/{}/[] dans l’échantillon de données lors de l’inférence du schéma.
Dans les formats JSON, toute valeur peut être lue comme String, ce qui permet d’éviter des erreurs telles que Cannot determine type for column 'column_name' by first 25000 rows of data, most likely this column contains only Nulls or empty Arrays/Maps lors de l’inférence du schéma
en utilisant le type String pour les clés de type inconnu.
Exemple :
input_format_json_map_as_array_of_tuples
input_format_json_max_depth
input_format_json_named_tuples_as_objects
input_format_json_read_arrays_as_strings
input_format_json_read_bools_as_numbers
input_format_json_read_bools_as_strings
input_format_json_read_numbers_as_strings
input_format_json_read_objects_as_strings
input_format_json_throw_on_bad_escape_sequence
input_format_json_try_infer_named_tuples_from_objects
input_format_json_try_infer_numbers_from_strings
input_format_json_use_string_type_for_ambiguous_paths_in_named_tuples_inference_from_objects
input_format_json_validate_types_from_metadata
input_format_max_block_size_bytes
input_format_max_block_wait_ms
Cette option fonctionne uniquement si
input_format_connection_handling est activé. Le fait de définir une valeur désactive également l’analyse parallèle et rend la déduplication impossible.Pour les insertions en streaming, vous devez également définir
min_insert_block_size_rows=0 et min_insert_block_size_bytes=0. Sinon, les blocs analysés peuvent encore être accumulés en mémoire à l’étape de compactage des blocs jusqu’à ce que ces seuils soient atteints, ce qui empêche des insertions rapides.input_format_max_bytes_to_read_for_schema_inference
input_format_max_rows_to_read_for_schema_inference
input_format_msgpack_number_of_columns
input_format_mysql_dump_map_column_names
input_format_mysql_dump_table_name
input_format_native_allow_types_conversion
input_format_native_decode_types_in_binary_format
input_format_null_as_default
NULL provoque une exception. Si le type de la colonne est nullable, les valeurs NULL sont insérées telles quelles, quel que soit ce paramètre.
Ce paramètre s’applique à la plupart des formats d’entrée.
Pour les expressions par défaut complexes, input_format_defaults_for_omitted_fields doit également être activé.
Valeurs possibles :
- 0 — L’insertion de
NULLdans une colonne non nullable provoque une exception. - 1 — Les champs
NULLsont initialisés avec les valeurs par défaut de la colonne.
input_format_orc_allow_missing_columns
input_format_orc_case_insensitive_column_matching
input_format_orc_dictionary_as_low_cardinality
input_format_orc_filter_push_down
input_format_orc_reader_time_zone_name
input_format_orc_row_batch_size
input_format_orc_skip_columns_with_unsupported_types_in_schema_inference
input_format_orc_use_fast_decoder
input_format_parallel_parsing
- 1 — Activé.
- 0 — Désactivé.
input_format_parquet_allow_geoparquet_parser
input_format_parquet_allow_missing_columns
input_format_parquet_bloom_filter_push_down
input_format_parquet_case_insensitive_column_matching
input_format_parquet_enable_json_parsing
input_format_parquet_enable_row_group_prefetch
input_format_parquet_filter_push_down
input_format_parquet_local_file_min_bytes_for_seek
input_format_parquet_local_time_as_utc
input_format_parquet_max_block_size
input_format_parquet_memory_high_watermark
input_format_parquet_memory_low_watermark
input_format_parquet_page_filter_push_down
input_format_parquet_prefer_block_bytes
input_format_parquet_preserve_order
ORDER BY _row_number.
input_format_parquet_skip_columns_with_unsupported_types_in_schema_inference
input_format_parquet_use_offset_index
input_format_parquet_verify_checksums
input_format_protobuf_flatten_google_wrappers
input_format_protobuf_oneof_presence
input_format_protobuf_skip_fields_with_unsupported_types_in_schema_inference
input_format_record_errors_file_path
input_format_skip_unknown_fields
- JSONEachRow (et autres formats JSON)
- BSONEachRow (et autres formats JSON)
- TSKV
- Tous les formats avec les suffixes WithNames/WithNamesAndTypes
- MySQLDump
- Native
- 0 — Désactivé.
- 1 — Activé.
input_format_try_infer_dates
Date à partir des champs de type chaîne lors de l’inférence de schéma pour les formats texte. Si tous les champs d’une colonne dans les données d’entrée ont été correctement analysés comme des dates, le type résultant sera Date ; si au moins un champ n’a pas été analysé comme une date, le type résultant sera String.
Activé par défaut.
input_format_try_infer_datetimes
DateTime64 à partir de champs texte lors de l’inférence de schéma pour les formats texte. Si tous les champs d’une colonne des données d’entrée sont correctement interprétés comme des valeurs de date et d’heure, le type résultant sera DateTime64 ; si au moins un champ ne peut pas être interprété comme une valeur de date et d’heure, le type résultant sera String.
Activé par défaut.
input_format_try_infer_datetimes_only_datetime64
input_format_try_infer_exponent_floats
input_format_try_infer_integers
Int64 ; si au moins un nombre est à virgule flottante, le type résultant sera Float64.
Activé par défaut.
input_format_try_infer_variants
Variant lors de l’inférence de schéma pour les formats texte lorsqu’il existe plusieurs types possibles pour les éléments de colonnes ou de tableaux.
Valeurs possibles :
- 0 — Désactivé.
- 1 — Activé.
input_format_tsv_allow_variable_number_of_columns
input_format_tsv_crlf_end_of_line
input_format_tsv_detect_header
input_format_tsv_empty_as_default
input_format_tsv_enum_as_number
input_format_tsv_skip_first_lines
input_format_tsv_skip_trailing_empty_lines
input_format_tsv_use_best_effort_in_schema_inference
input_format_values_accurate_types_of_literals
input_format_values_deduce_templates_of_expressions
input_format_values_interpret_expressions
input_format_with_names_use_header
- CSVWithNames
- CSVWithNamesAndTypes
- TabSeparatedWithNames
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNames
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNames
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNames
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNames
- CustomSeparatedWithNamesAndTypes
- 0 — Désactivé.
- 1 — Activé.
input_format_with_types_use_header
- CSVWithNamesAndTypes
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNamesAndTypes
- 0 — Désactivé.
- 1 — Activé.