input_format_allow_errors_num
input_format_allow_errors_ratio と組み合わせて使用してください。
行の読み込み中にエラーが発生しても、エラーカウンターが input_format_allow_errors_num 未満であれば、ClickHouse はその行を無視して次の行へ進みます。
input_format_allow_errors_num と input_format_allow_errors_ratio の両方のしきい値を超えると、ClickHouse は例外をスローします。
input_format_allow_errors_ratio
input_format_allow_errors_num と組み合わせて使用してください。
行の読み取り中にエラーが発生しても、エラーカウンターが input_format_allow_errors_ratio 未満であれば、ClickHouse はその行を無視して次の行へ進みます。
input_format_allow_errors_num と input_format_allow_errors_ratio の両方を超えた場合、ClickHouse は例外をスローします。
input_format_allow_seeks
input_format_arrow_allow_missing_columns
input_format_arrow_case_insensitive_column_matching
input_format_arrow_skip_columns_with_unsupported_types_in_schema_inference
input_format_avro_allow_missing_fields
input_format_avro_null_as_default
input_format_binary_decode_types_in_binary_format
input_format_binary_max_type_complexity
Map(String, UInt32) = 3 ノード。悪意のある入力を防ぎます。0 = 無制限。
input_format_binary_read_json_as_string
input_format_bson_skip_fields_with_unsupported_types_in_schema_inference
input_format_capn_proto_skip_fields_with_unsupported_types_in_schema_inference
input_format_column_name_matching_mode
- match_case: 大文字・小文字を区別して照合
- ignore_case: 大文字・小文字を区別せずに照合
- auto: まず大文字・小文字を区別して照合を試み、失敗した場合は大文字・小文字を区別しない照合を試みます。
input_format_connection_handling
このオプションを有効にすると、並列パースが無効になり、重複排除はできなくなります
input_format_csv_allow_cr_end_of_line
input_format_csv_allow_variable_number_of_columns
input_format_csv_allow_whitespace_or_tab_as_delimiter
input_format_csv_arrays_as_nested_csv
input_format_csv_deserialize_separate_columns_into_tuple
Tuple にのみ適用されます。Nullable(Tuple) は常に単一の CSV フィールドとして書き込まれ (output_format_csv_serialize_tuple_into_separate_columns を参照) 、同様に単一のフィールドからのみ読み戻されます。この設定にかかわらず、個別のカラムから読み取られることはありません。先頭の \N フィールドが曖昧になるため、Nullable(Tuple) では個別カラムからのパースはサポートされません (タプル全体の外側の NULL を表す場合もあれば、最初の要素の NULL を表す場合もあるためです) 。
単体の Tuple では各要素が 1 つのフィールドを占めるため、直接の最上位要素のフィールドにある \N はカラム全体ではなくその要素を表します。したがって、input_format_null_as_default はその要素に適用されます。タプル全体に単一のフィールドを指定する行は、残りの要素が不足しているため、カラムのデフォルト値を使用するのではなく拒否されます。このようなフィールドを再びカラム全体として読み取るには、この設定を 0 にします。ネストされた Tuple の要素のフィールドにある \N は、引き続きそのネストされた要素全体として読み取られます。
input_format_csv_detect_header
input_format_csv_empty_as_default
input_format_csv_enum_as_number
input_format_csv_missing_nullable_as_empty_string
Nullable(String) の欠損値をどのように読み取るかを制御します。欠損値とは、引用符で囲まれていない、カンマの間・前・後にある空の項目のことです。この設定を有効にすると、input_format_csv_empty_as_default の値にかかわらず、Nullable(String) の欠損値は NULL ではなく空の String として解釈されます。
input_format_csv_skip_first_lines
input_format_csv_skip_trailing_empty_lines
input_format_csv_trim_whitespaces
input_format_csv_try_infer_numbers_from_strings
input_format_csv_try_infer_strings_from_quoted_tuples
input_format_csv_use_best_effort_in_schema_inference
input_format_csv_use_default_on_bad_values
input_format_custom_allow_variable_number_of_columns
input_format_custom_detect_header
input_format_custom_skip_trailing_empty_lines
input_format_defaults_for_omitted_fields
INSERT クエリの実行時に、省略された入力カラムの値を、対応するカラムのデフォルト値に置き換えます。このオプションは、JSONEachRow (およびその他の JSON フォーマット) 、CSV、TabSeparated、TSKV、Parquet、Arrow、Avro、ORC、Native フォーマット、および WithNames/WithNamesAndTypes 接尾辞を持つフォーマットに適用されます。
このオプションを有効にすると、拡張テーブルのメタデータがサーバーからクライアントに送信されます。これにより、サーバーで追加の計算リソースが消費され、パフォーマンスが低下する可能性があります。
- 0 — 無効。
- 1 — 有効。
input_format_force_null_for_omitted_fields
input_format_geojson_unsupported_geometry_handling
GeoJSON 入力の読み込み時に、ClickHouse の Geometry 型で表現できない有効な GeoJSON のジオメトリ型 (GeometryCollection など) を geometry カラムに格納する必要がある場合の動作を制御します。
設定可能な値:
'throw'(デフォルト) — 例外をスローします。'null'—geometryカラムにNULL値を挿入し、パースを続行します。
geometry カラムが materialized されている場合にのみ適用されます。要求された出力カラムでない場合、そのようなジオメトリは形式の妥当性のみ検証され、この処理はトリガーされません。
input_format_hive_text_allow_variable_number_of_columns
input_format_hive_text_collection_items_delimiter
input_format_hive_text_fields_delimiter
input_format_hive_text_map_keys_delimiter
input_format_import_nested_json
- 0 — 無効。
- 1 — 有効。
JSONEachRowフォーマットでの Nested 構造の使用。
input_format_ipv4_default_on_conversion_error
input_format_ipv6_default_on_conversion_error
input_format_json_compact_allow_variable_number_of_columns
input_format_json_defaults_for_missing_elements_in_named_tuple
input_format_json_named_tuples_as_objects 設定が有効な場合にのみ機能します。
デフォルトで有効です。
input_format_json_empty_as_default
input_format_defaults_for_omitted_fields も有効にする必要があります。
設定可能な値:
- 0 — 無効。
- 1 — 有効。
input_format_json_ignore_unknown_keys_in_named_tuple
input_format_json_ignore_unnecessary_fields
input_format_json_infer_array_of_dynamic_from_array_of_different_types
input_format_json_infer_incomplete_types_as_strings
Null/{}/[] のみを含む JSON キーに対して String 型を使用できるようにします。
JSON フォーマットでは任意の値を String として読み取れるため、型が不明なキーに String 型を使うことで、スキーマ推論時に Cannot determine type for column 'column_name' by first 25000 rows of data, most likely this column contains only Nulls or empty Arrays/Maps のようなエラーを回避できます。
例:
input_format_json_map_as_array_of_tuples
input_format_json_max_depth
input_format_json_max_object_size
input_format_json_max_string_column_growth_step
input_format_json_named_tuples_as_objects
input_format_json_read_arrays_as_strings
input_format_json_read_bools_as_numbers
input_format_json_read_bools_as_strings
input_format_json_read_numbers_as_strings
input_format_json_read_objects_as_strings
input_format_json_throw_on_bad_escape_sequence
input_format_json_try_infer_named_tuples_from_objects
input_format_json_try_infer_numbers_from_strings
input_format_json_use_string_type_for_ambiguous_paths_in_named_tuples_inference_from_objects
input_format_json_validate_types_from_metadata
input_format_max_block_size_bytes
input_format_max_block_wait_ms
このオプションは、
input_format_connection_handling が有効な場合にのみ機能します。値を設定すると、並列パースも無効になり、重複排除もできなくなります。ストリーミング挿入では、
min_insert_block_size_rows=0 と min_insert_block_size_bytes=0 も設定する必要があります。そうしないと、パース済みのブロックがそれらの閾値に達するまで、ブロックをまとめる段階でメモリ内に蓄積され続け、適時に挿入されなくなる可能性があります。input_format_max_bytes_to_read_for_schema_inference
input_format_max_rows_to_read_for_schema_inference
input_format_msgpack_number_of_columns
input_format_mysql_dump_map_column_names
input_format_mysql_dump_table_name
input_format_native_allow_types_conversion
input_format_native_decode_types_in_binary_format
input_format_null_as_default
NULL を挿入すると例外が発生します。カラム型が Nullable の場合は、この設定に関係なく、NULL 値はそのまま挿入されます。
この設定は、ほとんどの入力フォーマットに適用されます。
複雑なデフォルト式を使用する場合は、input_format_defaults_for_omitted_fields も有効にする必要があります。
設定可能な値:
- 0 — Nullable でないカラムに
NULLを挿入すると例外が発生します。 - 1 —
NULLフィールドはカラムのデフォルト値で初期化されます。
input_format_orc_allow_missing_columns
input_format_orc_case_insensitive_column_matching
input_format_orc_dictionary_as_low_cardinality
input_format_orc_filter_push_down
input_format_orc_reader_time_zone_name
input_format_orc_row_batch_size
input_format_orc_skip_columns_with_unsupported_types_in_schema_inference
input_format_parallel_parsing
- 1 — 有効。
- 0 — 無効。
input_format_parquet_allow_geoparquet_parser
input_format_parquet_allow_missing_columns
input_format_parquet_bloom_filter_push_down
input_format_parquet_case_insensitive_column_matching
input_format_parquet_dictionary_filter_push_down
input_format_parquet_enable_json_parsing
input_format_parquet_enable_row_group_prefetch
input_format_parquet_filter_push_down
input_format_parquet_local_file_min_bytes_for_seek
input_format_parquet_local_time_as_utc
input_format_parquet_max_block_size
input_format_parquet_memory_high_watermark
input_format_parquet_memory_low_watermark
input_format_parquet_page_filter_push_down
input_format_parquet_prefer_block_bytes
input_format_parquet_preserve_order
ORDER BY _row_number を使用してください。
input_format_parquet_skip_columns_with_unsupported_types_in_schema_inference
input_format_parquet_spatial_filter_push_down
geospatial_statistics.bboxまたはcovering.bboxカラム) に基づき、行グループ全体をスキップします。また、input_format_parquet_page_filter_push_downと組み合わせることで、個々のページもスキップします。
input_format_parquet_use_offset_index
input_format_parquet_verify_checksums
input_format_protobuf_flatten_google_wrappers
input_format_protobuf_oneof_presence
input_format_protobuf_skip_fields_with_unsupported_types_in_schema_inference
input_format_read_datetime_number_as_raw_value
DateTime/DateTime64 カラムの引用符なし整数を、秒単位の Unix timestamp ではなく、生の内部値 (DateTime では秒、
DateTime64 ではカラムの精度における tick) として読み取ります。
デフォルトでは無効です。引用符なし数値は、オプションの秒未満精度を含む秒単位の Unix timestamp として扱われ、
Values フォーマット、CAST、toDateTime64 と同様です。これを有効にする (または SET compatibility = '26.7' を設定する) と、
DateTime64 カラムに渡された引用符なし整数が生のスケーリング済み値 (tick) として解釈されていた、26.7 以前のバージョンの
動作を復元できます。レガシーパスで受け入れられるのは、このような引用符なし整数のみです。
この設定を有効にすると、小数部または指数部を含む数値は行入力パスで拒否されます
(26.8 より前と同様) 。一方、JSONExtract と型付き JSON 型では、小数は引き続き
DateTime64 では秒として読み取られ、DateTime では拒否されます (これも 26.8 より前と同様です) 。Values フォーマット自体では、
ストリーミングパーサーが拒否した数値は SQL 式評価にフォールバックし、秒として読み取られます。
これは 26.8 より前でも、この設定を有効にした場合でも同じです。そのため、小数を含む数値に対する Values の動作は
すべての構成で同一です。
この設定が適用されるのは、JSON、Values/Quoted、および JSONExtract/型付き JSON のパスのみです (Quoted パスは、
Quoted エスケープ規則でフィールドをパースするすべてのフォーマットを対象とします: Values、MySQLDump、および
Quoted フィールドエスケープを設定した Template/CustomSeparated/Regexp) 。タブ区切り、CSV、その他の
エスケープ済み/テキスト全体を扱うフォーマットは影響を受けません。これらでは、大きな引用符なしの DateTime64 数値は引き続き tick として読み取られます。
input_format_record_errors_file_path
input_format_skip_unknown_fields
- JSONEachRow (およびその他の JSON フォーマット)
- BSONEachRow (およびその他の JSON フォーマット)
- TSKV
- WithNames/WithNamesAndTypes の接尾辞を持つすべてのフォーマット
- MySQLDump
- Native
- 0 — 無効。
- 1 — 有効。
input_format_try_infer_dates
Date を推論しようとします。入力データ内のあるカラムのすべてのフィールドが日付として正常に解析された場合、結果の型は Date になります。少なくとも 1 つのフィールドが日付として解析されなかった場合、結果の型は String になります。
デフォルトで有効です。
input_format_try_infer_datetimes
DateTime64 型を推論しようとします。入力データ内のあるカラムのすべてのフィールドを日時として正常に解析できた場合、結果の型は DateTime64 になります。1 つでも日時として解析できないフィールドがある場合、結果の型は String になります。
デフォルトで有効です。
input_format_try_infer_datetimes_only_datetime64
input_format_try_infer_exponent_floats
input_format_try_infer_integers
Int64 になります。少なくとも 1 つが浮動小数点数であれば、結果の型は Float64 になります。
デフォルトで有効です。
input_format_try_infer_variants
Variant 型の推論を試みます。
設定可能な値:
- 0 — 無効。
- 1 — 有効。
input_format_tsv_allow_variable_number_of_columns
input_format_tsv_crlf_end_of_line
input_format_tsv_detect_header
input_format_tsv_empty_as_default
input_format_tsv_enum_as_number
input_format_tsv_skip_first_lines
input_format_tsv_skip_trailing_empty_lines
input_format_tsv_use_best_effort_in_schema_inference
input_format_values_accurate_types_of_literals
input_format_values_deduce_templates_of_expressions
input_format_values_interpret_expressions
input_format_with_names_use_header
- CSVWithNames
- CSVWithNamesAndTypes
- TabSeparatedWithNames
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNames
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNames
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNames
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNames
- CustomSeparatedWithNamesAndTypes
- 0 — 無効。
- 1 — 有効。
input_format_with_types_use_header
- CSVWithNamesAndTypes
- TabSeparatedWithNamesAndTypes
- JSONCompactEachRowWithNamesAndTypes
- JSONCompactStringsEachRowWithNamesAndTypes
- RowBinaryWithNamesAndTypes
- CustomSeparatedWithNamesAndTypes
- 0 — 無効。
- 1 — 有効。