input_format_allow_errors_num
input_format_allow_errors_ratio.
Si se produce un error al leer filas, pero el contador de errores sigue siendo inferior a input_format_allow_errors_num, ClickHouse ignora la fila y pasa a la siguiente.
Si se superan tanto input_format_allow_errors_num como input_format_allow_errors_ratio, ClickHouse lanza una excepción.
input_format_allow_errors_ratio
input_format_allow_errors_num.
Si se produce un error al leer filas, pero el contador de errores sigue siendo inferior a input_format_allow_errors_ratio, ClickHouse ignora la fila y pasa a la siguiente.
Si se superan tanto input_format_allow_errors_num como input_format_allow_errors_ratio, ClickHouse lanza una excepción.
input_format_allow_seeks
input_format_arrow_allow_missing_columns
input_format_arrow_case_insensitive_column_matching
input_format_arrow_skip_columns_with_unsupported_types_in_schema_inference
input_format_avro_allow_missing_fields
input_format_avro_null_as_default
input_format_binary_decode_types_in_binary_format
input_format_binary_max_type_complexity
Map(String, UInt32) = 3 nodos. Protege frente a entradas maliciosas. 0 = ilimitado.
input_format_binary_read_json_as_string
input_format_bson_skip_fields_with_unsupported_types_in_schema_inference
input_format_capn_proto_skip_fields_with_unsupported_types_in_schema_inference
input_format_column_name_matching_mode
- match_case: coincidencia sensible a mayúsculas y minúsculas
- ignore_case: coincidencia no sensible a mayúsculas y minúsculas
- auto: primero intenta hacer coincidir de forma sensible a mayúsculas y minúsculas; si falla, intenta hacerlo de forma no sensible a mayúsculas y minúsculas.
input_format_connection_handling
Al habilitar esta opción, se desactiva el análisis en paralelo y la deduplicación deja de ser posible
input_format_csv_allow_cr_end_of_line
input_format_csv_allow_variable_number_of_columns
input_format_csv_allow_whitespace_or_tab_as_delimiter
input_format_csv_arrays_as_nested_csv
input_format_csv_deserialize_separate_columns_into_tuple
Tuple simple. Un Nullable(Tuple) siempre se escribe como un único campo CSV (consulte output_format_csv_serialize_tuple_into_separate_columns) y, del mismo modo, se vuelve a leer desde un único campo, nunca desde columnas independientes, independientemente de esta configuración. El análisis de columnas independientes no es compatible con Nullable(Tuple) porque un campo inicial \N es ambiguo (puede ser el NULL externo de la tupla o el NULL de su primer elemento).
Como una Tuple simple ocupa entonces un campo por elemento, un \N en el campo de un elemento directo de nivel superior corresponde a ese elemento y no a toda la columna, por lo que input_format_null_as_default se aplica a ese elemento. Una fila que proporciona un único campo para toda la tupla carece de los elementos restantes y se rechaza en lugar de usar el valor predeterminado de la columna. Establezca esta configuración en 0 para volver a leer dicho campo como toda la columna. Un \N en el campo de un elemento de una Tuple anidada sigue leyéndose como todo ese elemento anidado.
input_format_csv_detect_header
input_format_csv_empty_as_default
input_format_csv_enum_as_number
input_format_csv_missing_nullable_as_empty_string
Nullable(String) cuando hay un valor ausente en un CSV. Un valor ausente es un espacio vacío entre/antes/después de comas, no delimitado por comillas. Si esta configuración está habilitada, independientemente del valor de input_format_csv_empty_as_default, el valor ausente de Nullable(String) se interpretará como una String vacía, no como NULL.
input_format_csv_skip_first_lines
input_format_csv_skip_trailing_empty_lines
input_format_csv_trim_whitespaces
input_format_csv_try_infer_numbers_from_strings
input_format_csv_try_infer_strings_from_quoted_tuples
input_format_csv_use_best_effort_in_schema_inference
input_format_csv_use_default_on_bad_values
input_format_custom_allow_variable_number_of_columns
input_format_custom_detect_header
input_format_custom_skip_trailing_empty_lines
input_format_defaults_for_omitted_fields
INSERT, sustituye los valores omitidos de las columnas de entrada por los valores predeterminados de las columnas correspondientes. Esta opción se aplica a los formatos JSONEachRow (y otros formatos JSON), CSV, TabSeparated, TSKV, Parquet, Arrow, Avro, ORC, Native, y a los formatos con los sufijos WithNames/WithNamesAndTypes.
Cuando esta opción está habilitada, se envían metadatos de tabla ampliados del servidor al client. Esto consume recursos de cómputo adicionales en el servidor y puede reducir el rendimiento.
- 0 — Deshabilitado.
- 1 — Habilitado.
input_format_force_null_for_omitted_fields
input_format_geojson_unsupported_geometry_handling
GeoJSON válido que no puede representarse en el tipo Geometry de ClickHouse (como GeometryCollection) debe almacenarse en la columna geometry al leer la entrada GeoJSON.
Posibles valores:
'throw'(por defecto) — lanzar una excepción.'null'— insertar un valorNULLen la columnageometryy continuar el procesamiento.
geometry está materializada. Cuando no es una columna de salida solicitada, esa geometría se valida para comprobar que está bien formada, pero no activa este tratamiento.
input_format_hive_text_allow_variable_number_of_columns
input_format_hive_text_collection_items_delimiter
input_format_hive_text_fields_delimiter
input_format_hive_text_map_keys_delimiter
input_format_import_nested_json
- 0 — Deshabilitado.
- 1 — Habilitado.
- Uso de estructuras Nested con el formato
JSONEachRow.
input_format_ipv4_default_on_conversion_error
input_format_ipv6_default_on_conversion_error
input_format_json_compact_allow_variable_number_of_columns
input_format_json_defaults_for_missing_elements_in_named_tuple
input_format_json_named_tuples_as_objects.
Habilitada de forma predeterminada.
input_format_json_empty_as_default
input_format_defaults_for_omitted_fields.
Valores posibles:
- 0 — Deshabilitado.
- 1 — Habilitado.
input_format_json_ignore_unknown_keys_in_named_tuple
input_format_json_ignore_unnecessary_fields
input_format_json_infer_array_of_dynamic_from_array_of_different_types
input_format_json_infer_incomplete_types_as_strings
Null/{}/[] en la muestra de datos durante la inferencia de esquemas.
En los formatos JSON, cualquier valor puede leerse como String, y se pueden evitar errores como Cannot determine type for column 'column_name' by first 25000 rows of data, most likely this column contains only Nulls or empty Arrays/Maps durante la inferencia de esquemas
usando el tipo String para claves con tipos desconocidos.
Ejemplo:
input_format_json_map_as_array_of_tuples
input_format_json_max_depth
input_format_json_max_object_size
input_format_json_max_string_column_growth_step
input_format_json_named_tuples_as_objects
input_format_json_read_arrays_as_strings
input_format_json_read_bools_as_numbers
input_format_json_read_bools_as_strings
input_format_json_read_numbers_as_strings
input_format_json_read_objects_as_strings
input_format_json_throw_on_bad_escape_sequence
input_format_json_try_infer_named_tuples_from_objects
input_format_json_try_infer_numbers_from_strings
input_format_json_use_string_type_for_ambiguous_paths_in_named_tuples_inference_from_objects
input_format_json_validate_types_from_metadata
input_format_max_block_size_bytes
input_format_max_block_wait_ms
Esta opción solo funciona si
input_format_connection_handling está habilitado. Establecer un valor también desactiva el análisis en paralelo y hace imposible la deduplicación.Para las inserciones en streaming, también debe establecer
min_insert_block_size_rows=0 y min_insert_block_size_bytes=0. De lo contrario, los bloques analizados pueden seguir acumulándose en memoria durante la etapa de compactación de bloques hasta que se alcancen esos umbrales, lo que impide que las inserciones se realicen a tiempo.input_format_max_bytes_to_read_for_schema_inference
input_format_max_rows_to_read_for_schema_inference
input_format_msgpack_number_of_columns
input_format_mysql_dump_map_column_names
input_format_mysql_dump_table_name
input_format_native_allow_types_conversion
input_format_native_decode_types_in_binary_format
input_format_null_as_default
NULL provoca una excepción. Si el tipo de columna es Nullable, los valores NULL se insertan tal cual, independientemente de esta configuración.
Esta configuración se aplica a la mayoría de los formatos de entrada.
Para expresiones predeterminadas complejas, input_format_defaults_for_omitted_fields también debe estar habilitado.
Valores posibles:
- 0 — Insertar
NULLen una columna no Nullable provoca una excepción. - 1 — Los campos
NULLse inicializan con los valores predeterminados de la columna.
input_format_orc_allow_missing_columns
input_format_orc_case_insensitive_column_matching
input_format_orc_dictionary_as_low_cardinality
input_format_orc_filter_push_down
input_format_orc_reader_time_zone_name
input_format_orc_row_batch_size
input_format_orc_skip_columns_with_unsupported_types_in_schema_inference
input_format_parallel_parsing
- 1 — Habilitado.
- 0 — Deshabilitado.
input_format_parquet_allow_geoparquet_parser
input_format_parquet_allow_missing_columns
input_format_parquet_bloom_filter_push_down
input_format_parquet_case_insensitive_column_matching
input_format_parquet_dictionary_filter_push_down
input_format_parquet_enable_json_parsing
input_format_parquet_enable_row_group_prefetch
input_format_parquet_filter_push_down
input_format_parquet_local_file_min_bytes_for_seek
input_format_parquet_local_time_as_utc
input_format_parquet_max_block_size
input_format_parquet_memory_high_watermark
input_format_parquet_memory_low_watermark
input_format_parquet_page_filter_push_down
input_format_parquet_prefer_block_bytes
input_format_parquet_preserve_order
ORDER BY _row_number en su lugar.
input_format_parquet_skip_columns_with_unsupported_types_in_schema_inference
input_format_parquet_spatial_filter_push_down
input_format_parquet_page_filter_push_down, páginas individuales en función de los predicados espaciales de la cláusula WHERE y de las estadísticas del cuadro delimitador de la geometría (columnas geospatial_statistics.bbox o covering.bbox) en los metadatos de Parquet.
input_format_parquet_use_offset_index
input_format_parquet_verify_checksums
input_format_protobuf_flatten_google_wrappers
input_format_protobuf_oneof_presence
input_format_protobuf_skip_fields_with_unsupported_types_in_schema_inference
input_format_read_datetime_number_as_raw_value
DateTime/DateTime64 como el valor subyacente sin procesar: segundos para
DateTime y ticks según la precisión de la columna para DateTime64, en lugar de como una marca de tiempo Unix en segundos.
Desactivada de forma predeterminada, un número sin comillas se interpreta como una marca de tiempo Unix en segundos (con precisión subsegundo opcional),
de forma coherente con el formato Values, CAST y toDateTime64. Actívela (o use SET compatibility = '26.7') para
restaurar el comportamiento de las versiones hasta la 26.7 incluida, en el que un entero sin comillas proporcionado a una columna DateTime64
se interpretaba como el valor escalado sin procesar (ticks). La ruta legacy solo acepta este tipo de entero:
con la configuración activada, las rutas de entrada de filas rechazan los números con parte fraccionaria o exponente
(como antes de la versión 26.8), mientras que en JSONExtract y el tipo JSON tipado, los números fraccionarios se siguen interpretando como
segundos para DateTime64 y se rechazan para DateTime (también como antes de la versión 26.8). En el propio formato Values,
si el analizador de streaming rechaza un número, se recurre a la evaluación de expresiones SQL y se interpreta como segundos,
tanto antes de la versión 26.8 como con esta configuración activada; por lo tanto, el comportamiento de Values para los números fraccionarios es el
mismo en todas las configuraciones.
Esta configuración rige únicamente las rutas JSON, Values/Quoted y JSONExtract/JSON tipado (la ruta Quoted
abarca todos los formatos que analizan campos con la regla de escaping Quoted: Values, MySQLDump y
Template/CustomSeparated/Regexp configurados con escaping de campos Quoted). Los formatos separados por tabulaciones, CSV y otros
formatos escapados/de texto completo no se ven afectados: en ellos, los números DateTime64 grandes sin comillas se siguen interpretando como ticks.
input_format_record_errors_file_path
input_format_skip_unknown_fields
- JSONEachRow (y otros formatos JSON)
- BSONEachRow (y otros formatos JSON)
- TSKV
- Todos los formatos con sufijos WithNames/WithNamesAndTypes
- MySQLDump
- Native
- 0 — Deshabilitado.
- 1 — Habilitado.
input_format_try_infer_dates
Date a partir de campos de texto durante la inferencia de esquema para formatos de texto. Si todos los campos de una columna de los datos de entrada se interpretan correctamente como fechas, el tipo resultante será Date; si al menos un campo no se interpreta como fecha, el tipo resultante será String.
Habilitada de forma predeterminada.
input_format_try_infer_datetimes
DateTime64 a partir de campos de tipo cadena durante la inferencia de esquema para formatos de texto. Si todos los campos de una columna de los datos de entrada se analizaron correctamente como valores datetime, el tipo resultante será DateTime64; si al menos un campo no se analizó como datetime, el tipo resultante será String.
Habilitado de forma predeterminada.
input_format_try_infer_datetimes_only_datetime64
input_format_try_infer_exponent_floats
input_format_try_infer_integers
Int64; si al menos uno es de coma flotante, el tipo de resultado será Float64.
Está habilitado de forma predeterminada.
input_format_try_infer_variants
Variant durante la inferencia de esquema en formatos de texto cuando haya más de un tipo posible para los elementos de columnas/arrays.
Valores posibles:
- 0 — Deshabilitado.
- 1 — Habilitado.
input_format_tsv_allow_variable_number_of_columns
input_format_tsv_crlf_end_of_line
input_format_tsv_detect_header
input_format_tsv_empty_as_default
input_format_tsv_enum_as_number
input_format_tsv_skip_first_lines
input_format_tsv_skip_trailing_empty_lines
input_format_tsv_use_best_effort_in_schema_inference
input_format_values_accurate_types_of_literals
input_format_values_deduce_templates_of_expressions
input_format_values_interpret_expressions
input_format_with_names_use_header
- CSVWithNames
- CSVWithNamesAndTypes
- TabSeparatedWithNames
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNames
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNames
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNames
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNames
- CustomSeparatedWithNamesAndTypes
- 0 — Desactivado.
- 1 — Activado.
input_format_with_types_use_header
- CSVWithNamesAndTypes
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNamesAndTypes
- 0 — Deshabilitado.
- 1 — Habilitado.