optimize_trivial_approximate_count_query
count в хранилищах, поддерживающих такую оценку, например EmbeddedRocksDB.
Возможные значения:
- 0 — Оптимизация отключена.
- 1 — Оптимизация включена.
optimize_trivial_count_query
SELECT count() FROM table с использованием метаданных MergeTree. Если требуется использовать безопасность на уровне строки, отключите этот параметр.
Возможные значения:
- 0 — Оптимизация отключена.
- 1 — Оптимизация включена.
optimize_trivial_count_with_sparsity_filter
SELECT count() FROM t WHERE col <op> const, где <op> const
точно разделяет строки на значения по умолчанию и все остальные для col. В этом случае результат count
берётся из счётчиков num_defaults / num_rows для каждого столбца, которые MergeTree уже
хранит в serialization.json, без сканирования данных.
Распознаваемые шаблоны:
col = default(col)/col != default(col)дляInt*/UInt*,String/FixedString,Date/DateTime/DateTime64,Decimal*,UUID,IPv4/IPv6.IS NULL/IS NOT NULLдля столбцовNullable.empty(col)/notEmpty(col)для столбцовString.col = true/col != trueдля столбцовBool.col > 0,col >= 1,col < 1,col <= 0для беззнаковых целочисленных столбцов.- Просто
col/NOT colдля столбцовInt*,UInt*,Bool(проверка на истинность).
Float*, Enum*, Nullable, LowCardinality
или составным типам (Tuple, Array, Map, …) — для них count вычисляется по
обычному пути сканирования.
Чтобы это работало, счётчик num_defaults для каждой части должен быть точным. Включите настройку таблицы MergeTree
compute_exact_num_defaults_for_sparse_columns в целевой таблице до
вставок и слияний. Части, записанные без неё, молча исключаются из rewrite, поэтому
одного включения optimize_trivial_count_with_sparsity_filter недостаточно.
Для шаблонов IS NULL / IS NOT NULL на столбцах Nullable у столбца также должна
быть запись num_defaults в serialization.json, что происходит только когда настройка таблицы MergeTree
nullable_serialization_version установлена в allow_sparse во время вставки /
слияния. При значении по умолчанию basic столбцы Nullable не получают записи для каждого столбца, поэтому
оптимизация молча не применяется.
Возможные значения:
- 0 — Оптимизация отключена.
- 1 — Оптимизация включена.
optimize_trivial_group_by_limit_query
SELECT key_expr FROM table GROUP BY key_expr LIMIT n (без агрегатных функций в проекции, без секций HAVING/ORDER BY/LIMIT BY/window и без модификаторов GROUP BY) за счет установки max_rows_to_group_by = n + offset и group_by_overflow_mode = 'any'. Агрегация прекращается, как только будет получено n + offset различных ключей.
Оптимизация не применяется, если пользователь явно установил для group_by_overflow_mode значение, отличное от any (чтобы сохранить явно заданное поведение throw/break), а также если пользователь уже задал более строгое значение max_rows_to_group_by (в этом случае оптимизация ничего бы не изменила).
Возможные значения:
- 0 — Оптимизация отключена.
- 1 — Оптимизация включена.