Как вычислить долю пустых/нулевых значений в каждом столбце таблицы
ratio_of_defaults_for_sparse_serialization, чтобы оптимизировать сериализацию.
Этот полезный запрос может выполняться некоторое время, но он анализирует каждую строку таблицы и определяет долю значений, равных нулю (или значению по умолчанию), в каждом столбце указанной таблицы:
sensors, которая содержит более 20B строк и 19 столбцов:
- столбец
sensor_idсовсем не разреженный. Более того, в каждой строке у него ненулевое значение sensor_typeразрежен только примерно в 15,9% случаев- столбец
P0очень разреженный: 99,9% значений равны нулю - столбец
pressureдовольно разреженный — 83% - а в столбце
temperature53,2% значений отсутствуют или равны нулю