input_format_allow_errors_num
input_format_allow_errors_ratio.
Si se produce un error al leer filas, pero el contador de errores sigue siendo inferior a input_format_allow_errors_num, ClickHouse ignora la fila y pasa a la siguiente.
Si se superan tanto input_format_allow_errors_num como input_format_allow_errors_ratio, ClickHouse lanza una excepción.
input_format_allow_errors_ratio
input_format_allow_errors_num.
Si se produce un error al leer filas, pero el contador de errores sigue siendo inferior a input_format_allow_errors_ratio, ClickHouse ignora la fila y pasa a la siguiente.
Si se superan tanto input_format_allow_errors_num como input_format_allow_errors_ratio, ClickHouse lanza una excepción.
input_format_allow_seeks
input_format_arrow_allow_missing_columns
input_format_arrow_case_insensitive_column_matching
input_format_arrow_skip_columns_with_unsupported_types_in_schema_inference
input_format_arrow_use_native_reader
input_format_avro_allow_missing_fields
input_format_avro_null_as_default
input_format_binary_decode_types_in_binary_format
input_format_binary_max_type_complexity
Map(String, UInt32) = 3 nodos. Protege frente a entradas maliciosas. 0 = ilimitado.
input_format_binary_read_json_as_string
input_format_bson_skip_fields_with_unsupported_types_in_schema_inference
input_format_capn_proto_skip_fields_with_unsupported_types_in_schema_inference
input_format_column_name_matching_mode
- match_case: coincidencia sensible a mayúsculas y minúsculas
- ignore_case: coincidencia no sensible a mayúsculas y minúsculas
- auto: primero intenta hacer coincidir de forma sensible a mayúsculas y minúsculas; si falla, intenta hacerlo de forma no sensible a mayúsculas y minúsculas.
input_format_connection_handling
Al habilitar esta opción, se desactiva el análisis en paralelo y la deduplicación deja de ser posible
input_format_csv_allow_cr_end_of_line
input_format_csv_allow_variable_number_of_columns
input_format_csv_allow_whitespace_or_tab_as_delimiter
input_format_csv_arrays_as_nested_csv
input_format_csv_deserialize_separate_columns_into_tuple
input_format_csv_detect_header
input_format_csv_empty_as_default
input_format_csv_enum_as_number
input_format_csv_missing_nullable_as_empty_string
Nullable(String) cuando hay un valor ausente en un CSV. Un valor ausente es un espacio vacío entre/antes/después de comas, no delimitado por comillas. Si esta configuración está habilitada, independientemente del valor de input_format_csv_empty_as_default, el valor ausente de Nullable(String) se interpretará como una String vacía, no como NULL.
input_format_csv_skip_first_lines
input_format_csv_skip_trailing_empty_lines
input_format_csv_trim_whitespaces
input_format_csv_try_infer_numbers_from_strings
input_format_csv_try_infer_strings_from_quoted_tuples
input_format_csv_use_best_effort_in_schema_inference
input_format_csv_use_default_on_bad_values
input_format_custom_allow_variable_number_of_columns
input_format_custom_detect_header
input_format_custom_skip_trailing_empty_lines
input_format_defaults_for_omitted_fields
INSERT, sustituye los valores omitidos de las columnas de entrada por los valores predeterminados de las columnas correspondientes. Esta opción se aplica a los formatos JSONEachRow (y otros formatos JSON), CSV, TabSeparated, TSKV, Parquet, Arrow, Avro, ORC, Native, y a los formatos con los sufijos WithNames/WithNamesAndTypes.
Cuando esta opción está habilitada, se envían metadatos de tabla ampliados del servidor al client. Esto consume recursos de cómputo adicionales en el servidor y puede reducir el rendimiento.
- 0 — Deshabilitado.
- 1 — Habilitado.
input_format_force_null_for_omitted_fields
input_format_geojson_unsupported_geometry_handling
GeoJSON válido que no puede representarse en el tipo Geometry de ClickHouse (como GeometryCollection o MultiPoint) debe almacenarse en la columna geometry al leer la entrada GeoJSON.
Posibles valores:
'throw'(por defecto) — lanzar una excepción.'null'— insertar un valorNULLen la columnageometryy continuar el procesamiento.
geometry está materializada. Cuando no es una columna de salida solicitada, esa geometría se valida para comprobar que está bien formada, pero no activa este tratamiento.
input_format_hive_text_allow_variable_number_of_columns
input_format_hive_text_collection_items_delimiter
input_format_hive_text_fields_delimiter
input_format_hive_text_map_keys_delimiter
input_format_import_nested_json
- 0 — Deshabilitado.
- 1 — Habilitado.
- Uso de estructuras Nested con el formato
JSONEachRow.
input_format_ipv4_default_on_conversion_error
input_format_ipv6_default_on_conversion_error
input_format_json_compact_allow_variable_number_of_columns
input_format_json_defaults_for_missing_elements_in_named_tuple
input_format_json_named_tuples_as_objects.
Habilitada de forma predeterminada.
input_format_json_empty_as_default
input_format_defaults_for_omitted_fields.
Valores posibles:
- 0 — Deshabilitado.
- 1 — Habilitado.
input_format_json_ignore_unknown_keys_in_named_tuple
input_format_json_ignore_unnecessary_fields
input_format_json_infer_array_of_dynamic_from_array_of_different_types
input_format_json_infer_incomplete_types_as_strings
Null/{}/[] en la muestra de datos durante la inferencia de esquemas.
En los formatos JSON, cualquier valor puede leerse como String, y se pueden evitar errores como Cannot determine type for column 'column_name' by first 25000 rows of data, most likely this column contains only Nulls or empty Arrays/Maps durante la inferencia de esquemas
usando el tipo String para claves con tipos desconocidos.
Ejemplo:
input_format_json_map_as_array_of_tuples
input_format_json_max_depth
input_format_json_named_tuples_as_objects
input_format_json_read_arrays_as_strings
input_format_json_read_bools_as_numbers
input_format_json_read_bools_as_strings
input_format_json_read_numbers_as_strings
input_format_json_read_objects_as_strings
input_format_json_throw_on_bad_escape_sequence
input_format_json_try_infer_named_tuples_from_objects
input_format_json_try_infer_numbers_from_strings
input_format_json_use_string_type_for_ambiguous_paths_in_named_tuples_inference_from_objects
input_format_json_validate_types_from_metadata
input_format_max_block_size_bytes
input_format_max_block_wait_ms
Esta opción solo funciona si
input_format_connection_handling está habilitado. Establecer un valor también desactiva el análisis en paralelo y hace imposible la deduplicación.Para las inserciones en streaming, también debe establecer
min_insert_block_size_rows=0 y min_insert_block_size_bytes=0. De lo contrario, los bloques analizados pueden seguir acumulándose en memoria durante la etapa de compactación de bloques hasta que se alcancen esos umbrales, lo que impide que las inserciones se realicen a tiempo.input_format_max_bytes_to_read_for_schema_inference
input_format_max_rows_to_read_for_schema_inference
input_format_msgpack_number_of_columns
input_format_mysql_dump_map_column_names
input_format_mysql_dump_table_name
input_format_native_allow_types_conversion
input_format_native_decode_types_in_binary_format
input_format_null_as_default
NULL provoca una excepción. Si el tipo de columna es Nullable, los valores NULL se insertan tal cual, independientemente de esta configuración.
Esta configuración se aplica a la mayoría de los formatos de entrada.
Para expresiones predeterminadas complejas, input_format_defaults_for_omitted_fields también debe estar habilitado.
Valores posibles:
- 0 — Insertar
NULLen una columna no Nullable provoca una excepción. - 1 — Los campos
NULLse inicializan con los valores predeterminados de la columna.
input_format_orc_allow_missing_columns
input_format_orc_case_insensitive_column_matching
input_format_orc_dictionary_as_low_cardinality
input_format_orc_filter_push_down
input_format_orc_reader_time_zone_name
input_format_orc_row_batch_size
input_format_orc_skip_columns_with_unsupported_types_in_schema_inference
input_format_orc_use_fast_decoder
input_format_parallel_parsing
- 1 — Habilitado.
- 0 — Deshabilitado.
input_format_parquet_allow_geoparquet_parser
input_format_parquet_allow_missing_columns
input_format_parquet_bloom_filter_push_down
input_format_parquet_case_insensitive_column_matching
input_format_parquet_enable_json_parsing
input_format_parquet_enable_row_group_prefetch
input_format_parquet_filter_push_down
input_format_parquet_local_file_min_bytes_for_seek
input_format_parquet_local_time_as_utc
input_format_parquet_max_block_size
input_format_parquet_memory_high_watermark
input_format_parquet_memory_low_watermark
input_format_parquet_page_filter_push_down
input_format_parquet_prefer_block_bytes
input_format_parquet_preserve_order
ORDER BY _row_number en su lugar.
input_format_parquet_skip_columns_with_unsupported_types_in_schema_inference
input_format_parquet_use_offset_index
input_format_parquet_verify_checksums
input_format_protobuf_flatten_google_wrappers
input_format_protobuf_oneof_presence
input_format_protobuf_skip_fields_with_unsupported_types_in_schema_inference
input_format_record_errors_file_path
input_format_skip_unknown_fields
- JSONEachRow (y otros formatos JSON)
- BSONEachRow (y otros formatos JSON)
- TSKV
- Todos los formatos con sufijos WithNames/WithNamesAndTypes
- MySQLDump
- Native
- 0 — Deshabilitado.
- 1 — Habilitado.
input_format_try_infer_dates
Date a partir de campos de texto durante la inferencia de esquema para formatos de texto. Si todos los campos de una columna de los datos de entrada se interpretan correctamente como fechas, el tipo resultante será Date; si al menos un campo no se interpreta como fecha, el tipo resultante será String.
Habilitada de forma predeterminada.
input_format_try_infer_datetimes
DateTime64 a partir de campos de tipo cadena durante la inferencia de esquema para formatos de texto. Si todos los campos de una columna de los datos de entrada se analizaron correctamente como valores datetime, el tipo resultante será DateTime64; si al menos un campo no se analizó como datetime, el tipo resultante será String.
Habilitado de forma predeterminada.
input_format_try_infer_datetimes_only_datetime64
input_format_try_infer_exponent_floats
input_format_try_infer_integers
Int64; si al menos uno es de coma flotante, el tipo de resultado será Float64.
Está habilitado de forma predeterminada.
input_format_try_infer_variants
Variant durante la inferencia de esquema en formatos de texto cuando haya más de un tipo posible para los elementos de columnas/arrays.
Valores posibles:
- 0 — Deshabilitado.
- 1 — Habilitado.
input_format_tsv_allow_variable_number_of_columns
input_format_tsv_crlf_end_of_line
input_format_tsv_detect_header
input_format_tsv_empty_as_default
input_format_tsv_enum_as_number
input_format_tsv_skip_first_lines
input_format_tsv_skip_trailing_empty_lines
input_format_tsv_use_best_effort_in_schema_inference
input_format_values_accurate_types_of_literals
input_format_values_deduce_templates_of_expressions
input_format_values_interpret_expressions
input_format_with_names_use_header
- CSVWithNames
- CSVWithNamesAndTypes
- TabSeparatedWithNames
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNames
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNames
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNames
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNames
- CustomSeparatedWithNamesAndTypes
- 0 — Desactivado.
- 1 — Activado.
input_format_with_types_use_header
- CSVWithNamesAndTypes
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNamesAndTypes
- 0 — Deshabilitado.
- 1 — Habilitado.