Lanzamiento de ClickHouse 26.8 LTS, 2026-08-27, FIXME (en curso)
Cambio incompatible con versiones anteriores
- La cabecera de solicitud HTTP
X-ClickHouse-Formatahora selecciona explícitamente el formato de la respuesta: es un alias de la configuraciónoutput_format, por lo que anula la cláusulaFORMATde la consulta y la extensión de la ruta. En versiones anteriores, solo establecía el valor predeterminado cuando no se especificaba el formato de salida, como el parámetrodefault_format. Esto proporciona una opción “fuera de banda” para solicitar datos en el formato deseado. Nunca cambia cómo se analiza el cuerpo de la solicitud de unINSERT; useinput_formatoformatpara ello. #105249 (Alexey Milovidov). - Los números JSON sin comillas de las columnas
DateTimeyDateTime64enJSONEachRowy formatos similares ahora se interpretan como timestamps Unix con precisión subsegundo opcional, al igual que enValues,CASTytoDateTime64. Anteriormente, se rechazaba un número fraccionario como1703363853.035, y un entero sin comillas como1703363853se leía como el valor escalado sin procesar deDateTime64, lo que producía un timestamp1970-.... Las cadenas entre comillas y la salida JSON propia de ClickHouse no se ven afectadas. #108091 (Alexey Milovidov). - El valor predeterminado de
max_insert_threadscambió de1aauto, que se resuelve como el número de núcleos de CPU disponibles para el servidor. De forma predeterminada, esto paralelizaINSERT SELECT, y ahoramax_insert_threadstambién puede paralelizar la parte de escritura de unINSERTsimple cuando la ruta de escritura de destino puede distribuir el trabajo de forma segura. Esto puede cambiar el número de partes creadas por dichas consultas y el orden de las filas insertadas. Para restaurar el comportamiento anterior, establezcamax_insert_threadsen1ocompatibilityen una versión anterior a26.8. #109000 (Alexey Milovidov). #109006 (Alexey Milovidov). - Los motores de base de datos
PostgreSQLyMaterializedPostgreSQLahora respetanremote_url_allow_hosts, al igual que el motor de tablaPostgreSQL, la función de tablapostgresqly los diccionarios creados mediante DDL. Conremote_url_allow_hostsconfigurado,CREATE DATABASEy los comandosATTACH DATABASEemitidos por usuarios ahora rechazan las bases de datosPostgreSQLyMaterializedPostgreSQLque apuntan a hosts no permitidos conUNACCEPTABLE_URL. Las bases de datos existentes se siguen cargando al iniciar el servidor. #111135 (Alexey Milovidov). - El códec experimental
ALP(STD)ahora realiza la aritmética de escalado deFloat32enFloat64. Esto mejora las relaciones de compresión y elimina la compresión de datos decimales que genera muchas excepciones, pero los valoresFloat32escritos por versiones anteriores ahora pueden decodificarse con una diferencia de 1 ULP. #111627 (Raufs Dunamalijevs). - Se eliminó la fuente de diccionario
library.SOURCE(LIBRARY(...))ahora falla conUNKNOWN_ELEMENT_IN_CONFIG, y la configuración del servidordictionaries_lib_pathestá obsoleta y no tiene efecto. #111980 (Alexey Milovidov). - Se eliminaron el reader y writer basados en la biblioteca Apache Arrow para los formatos
ArrowyArrowStream. La implementación nativa de ClickHouse, que es la predeterminada desde la versión 26.7, ahora es la única disponible. Las configuracionesinput_format_arrow_use_native_readeryoutput_format_arrow_use_native_writerestán obsoletas: se siguen aceptando, pero no tienen efecto, por lo que una consulta que las establecía en0para forzar la implementación de Apache Arrow ahora usa la nativa. #111996 (Alexey Milovidov). - Rechazar valores de configuración de intervalos de tiempo (milisegundos/segundos) que desborden los microsegundos de Int64. #112757 (Azat Khuzhin). Esto podría ser una incompatibilidad solo si utilizó valores absurdamente grandes que se desbordaron.
- Las credenciales TLS de un origen
MySQL(ssl_ca,ssl_cert,ssl_key) ya no pueden especificarse como rutas de archivo desde SQL, por ejemplo, enCREATE NAMED COLLECTION, argumentos de consulta oCREATE DICTIONARY, porque el servidor abre esos archivos con sus propios privilegios. Las rutas siguen siendo compatibles en el archivo de configuración del servidor. En otros casos, proporcione el contenido del certificado o de la clave en los nuevos parámetrosssl_ca_pem,ssl_cert_pemyssl_key_pem, que se enmascaran en los registros y en las consultasSHOW, al igual que las contraseñas. #112070 (Alexey Milovidov). - Las comprobaciones de privilegios para los comandos
SYSTEM ... CACHE ON CLUSTERahora usan el privilegio específico de cada comando en lugar del grupo de privilegiosSYSTEM DROP CACHE. Esto permite a quienes tienen un único privilegio granular de caché ejecutar el comando correspondiente e impide que quienes tienen el grupo ejecutenSYSTEM SYNC FILESYSTEM CACHE ON CLUSTERsinSYSTEM SYNC FILESYSTEM CACHE. #114042 (Groene AI). - Para las vistas cuyo cuerpo es un
SELECTsimple sobre una única tablaDistributed, toda la consulta externa ahora se envía a los segmentos (nuevo ajusteoptimize_trivial_view_pushdown_to_distributed, habilitado de forma predeterminada). Esto cambia el comportamiento observable de dichas vistas:FINALySAMPLEespecificados en la referencia a la vista ahora se propagan a la tabla local del segmento en lugar de ignorarse, yextremesno se informa en clústeres de un solo segmento. Establezcaoptimize_trivial_view_pushdown_to_distributed = 0para restaurar el comportamiento anterior. #101791 (simonmichal). - Las partes de parche de
UPDATEligero ahora usan un nuevo formato en disco v2, ordenado por (sorting_key..., _block_number, _block_offset), y se aplican con un nuevo algoritmo de fusión. El pico de memoria queda limitado por la mayor secuencia de claves de ordenación iguales, en lugar de por el parche completo, y las actualizaciones que cruzan límites de fusión ya no recurren a la aplicación mediante Join en memoria. Las partes de parche en formato antiguo siguen siendo legibles. Durante una actualización progresiva desde una versión anterior a la 26.8, mantengapatch_parts_version = 'v1'o use el ajustecompatibilityhasta que se actualicen todas las réplicas. #103182 (Anton Popov). - Se añadió la cláusula
VALID FOR <interval>aCREATE USERyALTER USERcomo abreviatura deVALID UNTIL. La fecha límite de expiración se calcula como la hora actual más el intervalo indicado en el momento de ejecutar la consulta y se almacena en la formaVALID UNTIL. La columnavalid_untilde la tablasystem.usersahora tiene el tipoArray(DateTime64(0))en lugar deArray(DateTime), para que las fechas límite posteriores al año 2106 se representen con exactitud; las herramientas que leen esta columna deben admitir el nuevo tipo. #110171 (Alexey Milovidov). EXPLAIN SYNTAXahora devuelve la consulta reformateada como un único registroString(con saltos de línea incrustados) en lugar de un registro por línea, por lo que la salida es una única fila recuperable y de uso directo (por ejemplo,SELECT count() FROM (EXPLAIN SYNTAX ...)devuelve1). Esto se controla mediante la nueva opciónsingle_record, cuyo valor predeterminado es1; establezcasingle_record = 0para restaurar la salida histórica de un registro por línea. Los demás tipos deEXPLAIN(PLAN/PIPELINE/AST) conservan su salida en árbol por línea. #110479 (Alexey Milovidov).- Se amplió el rango admitido de
Date32de[1900-01-01, 2299-12-31]a[0000-01-01, 9999-12-31], igualándolo aDateTime64. El análisis sintáctico y las conversiones ahora aceptan el rango ampliado en lugar de ajustarse silenciosamente a los límites anteriores. Notas de compatibilidad con versiones anteriores: en la conversión numéricatoDate32(N), los valores de[120530, 2932896]ahora se interpretan como números de día (fechas de2300-01-01a9999-12-31) en lugar de timestamps Unix de principios de 1970, conforme a la regla de que un número que cabe en el rango de números de día es un número de día; los números inferiores al número de día de0000-01-01y los timestamps posteriores a9999-12-31se saturan en los nuevos límites. #111534 (Alexey Milovidov). arrayIntersectyarraySymmetricDifferenceya no tratan un valor repetido dentro de un único argumento como si apareciera en varios argumentos. Las consultas que dependan del comportamiento anterior ahora pueden devolver resultados distintos:arrayIntersect([1], [2], [1, 1])devuelve[]en lugar de[1],arrayIntersect([1, 2], [2], [1, 1, 2])devuelve[2]en lugar de[1, 2], yarraySymmetricDifference([1], [2], [1, 1])devuelve[2, 1]en lugar de[2]. ParaarraySymmetricDifference, ya bastan dos argumentos:arraySymmetricDifference([1], [2, 2])devuelve[2, 1]en lugar de[1]. Ahora un valor se cuenta para un argumento solo si estaba presente en todos los argumentos anteriores, por lo que el resultado contiene exactamente los valores presentes en todos los argumentos. Como parte del mismo cambio,arrayIntersectcrea su tabla hash a partir del argumento más pequeño en lugar de todos ellos, lo que la hace hasta 1,85 veces más rápida y reduce el uso de memoria en un tercio cuando los argumentos difieren mucho en tamaño.arrayUnionno se ve afectada. #113021 (Alexey Milovidov).disable_insertion_and_mutationahora impide el consumo en segundo plano de las tablasKafka,RabbitMQyNATS, pero sigue permitiendo escrituras directas en almacenamiento externo. Las tablasKafka2,NATSyRabbitMQsujetas a esta restricción no inicializan consumidores para operacionesSELECTdirectas. La configuraciónmessage_queue_disable_insertion, introducida recientemente, ahora requiere reiniciar el servidor. #113660 (Christoph Wurm).- Una
PARTITION BYuORDER BYde ventana sobre una columnaAggregateFunctionahora se rechaza conILLEGAL_COLUMN, como ya ocurría con unaORDER BYde nivel superior sobre esa columna. Anteriormente, al menos un analizador aceptaba esa consulta, y laPARTITION BYde ventana particionaba de forma distinta segúnmax_threads. El rechazo también abarca un estado anidado enArray,Tuple,Map,VariantoSimpleAggregateFunction. UnaSimpleAggregateFunctionsobre un tipo ordinario,QBit, así comoGROUP BYyDISTINCTsobre un estado, no se ven afectados. #113878 (Groene AI). - La configuración
include_fromya no tiene որպես valor predeterminado/etc/metrika.xml. Anteriormente, ese archivo se utilizaba para sustituciones de configuración siempre que existía, aunque nada en la configuración de ClickHouse hacía referencia a él. Si dependía de ese archivo de sustituciones implícito, agregue explícitamente<include_from>/etc/metrika.xml</include_from>a cada archivo de configuración afectado; los archivosusers.xmlcargados por separado y las configuraciones XML de diccionarios necesitan su propio elementoinclude_from. #114161 (Alexey Milovidov). - El motor de tabla
NATSacepta credenciales en línea mediante la nueva configuraciónnats_credentials(con la misma carga útil que un archivo.creds) y ya no aceptanats_credential_filedesde SQL: la ruta hace referencia a un archivo en el sistema de archivos del servidor, que este abre con sus propios privilegios, por lo que solo puede especificarse en una colección con nombre definida en el archivo de configuración del servidor o comonats.credential_fileen la propia configuración del servidor. Una consulta puede sustituir una ruta configurada de este modo pornats_credentialsen línea, salvo que el operador la haya fijado con<nats_credential_file overridable="false">. Las tablas creadas antes de esta restricción siguen funcionando tras una actualización. #114644 (Alexey Milovidov). - Las métricas asíncronas ahora pueden tener el tipo de datos
Map, y las métricas por núcleo de CPU y por dispositivo se han convertido en métricas de clave-valor únicas:OSUserTimeCPU0,OSUserTimeCPU1, … se convirtieron en una única métricaOSUserTimeCPUcon un mapa que asocia el número de núcleo de CPU con el valor (y de forma similar para las demás métricasOS*TimeCPU*,CPUFrequencyMHz_*,Temperature*,EDAC*,Block*_*,Network(Receive|Send)*_*,Disk*_*,*BlobsQueueEstimateyAsyncLogging*QueueSize).system.asynchronous_metricstiene una nueva columnakey_values Map(LowCardinality(String), Float64)(la columnavalueesNaNpara estas métricas),system.asynchronous_metric_loglas registra como una fila por clave mediante una nueva columnakey, el endpoint de Prometheus las exporta con una etiqueta (por ejemplo,ClickHouseAsyncMetrics_BlockReadBytes{device="sda"}) yMetricsTransmitterde Graphite las envía como<prefix>.<Metric>.<key>. Si su sistema de monitorización lee los nombres de métricas antiguos, establezca la nueva configuración del servidorasynchronous_metrics_key_values_modeenlegacy_namespara publicar cada clave de nuevo como una métrica escalar independiente con su nombre anterior, o enbothpara publicar ambas formas al mismo tiempo mientras se migra el sistema de monitorización; la configuración se aplica medianteSYSTEM RELOAD CONFIG, sin reiniciar. #115333 (Alexey Milovidov). #116791 (Alexey Milovidov).
Nueva funcionalidad
- Se añadieron las sentencias
CREATE HANDLER,ALTER HANDLERyDROP HANDLERpara definir handlers HTTP personalizados desde SQL, almacenados de forma persistente en almacenamiento local o en Keeper. También se añadieron las funcionescurrentHandlerycurrentRequestURL, la tablasystem.handlersy las columnashttp_handler_name/http_request_urlensystem.query_log. #106231 (Alexey Milovidov). - Se añadió la posibilidad de acceder a tablas y bases de datos mediante rutas URL en la interfaz HTTP (p. ej., `/database/table.format.gz?filter=a>0`), además de nuevas configuraciones (`http_allow_database_as_path`, `http_allow_table_as_file`, `http_allow_filters_as_path`, `http_allow_filters_as_unrecognized_url_parameters`, `select`, `order`, `sort`, `filter`, `page`, `compression`, `format`, `input_format`, `output_format`, `default_format`, `database`) que se pueden combinar entre sí y con el parámetro URL
queryexistente. #105249 (Alexey Milovidov). - Se añadieron formatos de framing, seleccionados mediante la nueva configuración
framing_output_format: multiplexan distintas partes de la respuesta de la consulta en un único flujo de respuesta HTTP: fragmentos de datos, totales y valores extremos, paquetes de progreso, eventos de perfil, logs del servidor y excepciones. Formatos de framing implementados:None(predeterminado; todo funciona como antes),EventStream(eventos enviados por el servidor HTTP),JSONEachPacketBase64yJSONEachPacketString(un objeto JSON por paquete con datos codificados en Base64 o como cadena). #110127 (Alexey Milovidov). - Se añadió la configuración de servidor
default_session_user: el usuario con el que autenticarse cuando un cliente se conecta sin especificar un nombre de usuario (anteriormente estaba codificado de forma fija comodefault; los protocolos nativo, MySQL y PostgreSQL ahora aceptan un nombre de usuario vacío en lugar de rechazarlo, y Arrow Flight respeta esta configuración en lugar de su propio valordefaultcodificado de forma fija). Los endpoints de protocolo componible de la secciónprotocolspueden anularla para cada endpoint mediante una clavedefault_session_user, de modo que distintos puertos de escucha puedan atender a diferentes usuarios anónimos. Establecerla como una cadena vacía prohíbe las conexiones sin nombre de usuario. Las conexiones entre servidores nunca usan el usuario de sesión predeterminado. #110179 (Alexey Milovidov). - Se admiten operadores de canalización en consultas SQL:
FROM t |> WHERE x > 1 |> AGGREGATE count() AS c GROUP BY y |> ORDER BY c DESC |> LIMIT 10, de forma similar a la sintaxis de canalización de GoogleSQL. Cualquier consultaSELECTpuede ir seguida de una cadena de operadores|>, y cada operador envuelve la consulta precedente en una subconsulta, por lo que el AST resultante es el mismo que el de la consulta equivalente con subconsultas anidadas. En una consulta que comienza con la cláusulaFROM, la cláusulaSELECTahora es opcional y, de forma predeterminada, esSELECT *. #111151 (Alexey Milovidov). - Se añadieron las funciones
parseQueryToJSONyformatQueryFromJSONpara serializar y deserializar AST como JSON, así como un dialecto experimentalclickhouse_jsonhabilitado medianteenable_json_ast_dialect. #100412 (Alexey Milovidov). #113480 (Nikita Fomichev). - Nueva configuración
run_query_in_background. El servidor acepta la consulta, devuelve inmediatamente un resultado vacío y la ejecuta hasta completarla, independientemente de lo que ocurra con la conexión. El resultado se descarta. Realice el seguimiento de la consulta mediante suquery_idensystem.processesysystem.query_log. Está destinada a consultas largas comoINSERT ... SELECT,CREATE TABLE … AS SELECToCREATE MATERIALIZED VIEW … POPULATEque no deben interrumpirse al perderse la conexión. #112816 (Miсhael Stetsyuk). - Se añadió una nueva tabla del sistema,
system.user_query_log, que muestra a cada usuario sus propios registros de consultas sin requerir acceso a la tabla de registro de consultas. La implementación original y la idea pertenecen a Yue Ni (@niyue), #104462. #110156 (Alexey Milovidov). - Se implementaron los elementos restantes de la unificación de URL (issue #59617). La nueva configuración
s3_baseresuelve URL relativas en la función de tablas3y el motor de tablaS3(así como en las funciones que comparten su configuración:s3Cluster,gcs,oss), de forma similar aurl_base. El nuevo motor de base de datosURLtrata los nombres de tabla como URL, los resuelve respecto a una URL base opcional y los enruta según el esquema de URL, de modo que los archivos, la web y el almacenamiento de objetos se gestionan de forma uniforme. ReemplazaFilesystemen la base de datos predeterminada (Overlay) declickhouse-localpor una URL basefile://, por lo que los nombres de archivo simples siguen funcionando y también puede escribirSELECT * FROM 'https://example.com/data.csv'. #111512 (Alexey Milovidov). - Se añadieron la función de tabla
bigqueryy el motor de tablaBigQuerypara leer y escribir en tablas de Google BigQuery, incluidos los conjuntos de datos públicos. La estructura de la tabla se infiere del esquema de la tabla de BigQuery. La autenticación admite un token de acceso OAuth, una clave de cuenta de servicio en formatoJSONy un cliente OAuth con un token de actualización. #110166 (Alexey Milovidov). - El uso simple de
CREATE MATERIALIZED VIEW ... POPULATEahora es atómico localmente: la vista se suscribe a los nuevos inserts de la tabla de origen y se toma una instantánea de los datos existentes bajo un breve bloqueo exclusivo sobre el origen, por lo que las filas insertadas a través del mismo servidor de forma concurrente con la carga inicial ya no se omiten ni se duplican (nueva configuraciónmaterialized_views_populate_atomically, activada de forma predeterminada). La garantía solo cubre la ruta de insert local; los inserts que llegan a otra réplica o a través de una ruta de escritura distribuida quedan fuera de este alcance, y se requiere un origen que pueda proporcionar una instantánea fijada (la familiaMergeTreeyMemory); otros orígenes, así comoCREATE OR REPLACE/REPLACEy las vistas creadas en bases de datosReplicated, mantienen la carga inicial no atómica heredada. Ahora también se puede usarPOPULATEjunto conTOpara rellenar la tabla de destino. #108715 (Alexey Milovidov). - Keeper ahora puede almacenar datos en disco mediante un árbol LSM personalizado. Su rendimiento es similar al del almacenamiento anterior. Use la configuración de coordinación
use_lsmt_storage = truepara activarlo,storage_memory_only = falsepara almacenar archivos en disco y añadadata_storage_pathodata_storage_diska la configuración para especificar dónde almacenar los archivos. Para escribir en S3, apuntedata_storage_diska un disco de tipos3_plain. #113903 (Michael Kolupaev). - El catálogo de motores de “tablas S3” para data lakes, igual que #103220, pero con un
INSERTfuncional. #113505 (Konstantin Vedernikov). - Se añadió compatibilidad con Snowflake Horizon. Ahora puede consultar tablas Iceberg a través del catálogo Horizon de Iceberg. También puede escribir en tablas Iceberg mediante el catálogo. #114547 (Melvyn Peignon).
- Se añadió compatibilidad con el formato de archivo
Puffin. Se puede usar con las funciones de tablafile,url,s3y otras similares. #103936 (Konstantin Vedernikov). - Se añadió compatibilidad con el modo de marco
GROUPSpara las funciones de ventana (SQL:2011), por ejemplo,any(price) OVER (PARTITION BY symbol ORDER BY ts GROUPS BETWEEN CURRENT ROW AND 1 FOLLOWING). En un marcoGROUPS, los límites cuentan grupos de pares completos —conjuntos de filas con el mismo valor para la claveORDER BY—, por lo queN PRECEDING/N FOLLOWINGsignificanNgrupos de pares antes/después del grupo de pares de la fila actual, en lugar de filas físicas (ROWS) o distancias entre valores deORDER BY(RANGE). #108653 (Nihal Z. Miaji). - Se añadió la función de tabla
mergeTreeCodecBlockCounts, que informa de cuántos bloques comprimidos usan cada códec para cada parte, columna y subflujo de una tablaMergeTree. #109623 (Raufs Dunamalijevs). - Se añadió el tipo de datos geográficos
MultiPoint, almacenado comoArray(Point), y se incluyó en el tipoGeometry. #109951 (David Meng). - Se añadió la columna virtual
_etagpara el almacenamientoHDFS. #108255 (Zhang Yifan). - El lector nativo y el formato de salida
ORCahora admitenuniontypey lo asignan al tipoVariantde ClickHouse. Anteriormente, la lectura de esas columnas fallaba conUnsupported ORC typey su escritura conILLEGAL_COLUMN. #110078 (Alexey Milovidov). #110085 (Alexey Milovidov). - Se añadió un tokenizador
japanesepara los índices de texto y las funcionestokens,hasAnyTokensyhasAllTokens, que utiliza el analizador morfológico MeCab. El diccionario se carga en tiempo de ejecución desde una ubicación definida en la configuración del servidor y se verifica con una suma de comprobación SHA-256 antes de usarse. #111420 (Jimmy Aguilar Mena). - Se añadió un tokenizador
chinesepara la funcióntokensy los índices de texto deMergeTree. Segmenta texto chino en palabras mediante un diccionario y un modelo oculto de Markov (el algoritmo sigue a jieba), con granularidadcoarse_grained(predeterminada) yfine_grained. Continúa #80174. #89945 (Amos Bird). - Se añadió un nuevo tokenizador
icupara los índices de texto y las funcionestokens,hasAnyTokensyhasAllTokens, que proporciona segmentación de palabras Unicode adaptada a la configuración regional, incluida la segmentación basada en diccionario para idiomas como el chino, el japonés y el tailandés. #109940 (Jimmy Aguilar Mena). - Se añadió un tokenizador
splitByRegexppara índices de texto y la funcióntokens. Divide la entrada en tokens mediante una expresión regular como separador; por ejemplo,tokenizer = splitByRegexp('[^\p{L}\p{N}#+]+'), lo que permite conservar tokens que contienen caracteres especiales, comoC++oC#, que otros tokenizadores dividirían. #110002 (Jimmy Aguilar Mena). - El panel de control HTTP de Keeper ahora incluye una pestaña Clúster que muestra la pertenencia a Raft como un gráfico de topología con colores de estado, retraso y prioridad, lo que permite ver qué nodos están en buen estado, presentan retraso o son inaccesibles, y abrir directamente el panel de control del líder. #111655 (yanglongwei).
- Una nueva sección de configuración del servidor,
create_union_system_log_tables, solicita la creación y el mantenimiento automáticos de tablasall_...(por ejemplo,system.all_query_log) que consultan la unión de una tabla de registro del sistema, sus versiones rotadas o las mismas tablas en todas las réplicas de un clúster. Las funciones de tablaremote,remoteSecure,clusteryclusterAllReplicasahora aceptan una cláusulaSETTINGSfinal con los ajustes del almacenamientoDistributedque crean; por ejemplo,clusterAllReplicas('default', system.query_log, SETTINGS skip_unavailable_shards = 1). #112670 (Alexey Milovidov). - Se añadió el ajuste
nats_credentialsal motor de tabla NATS, lo que permite a los usuarios especificar credenciales de NATS en línea como una cadena que coincide con el contenido de un archivo.creds. #110733 (addshore). - Se añadió el algoritmo
IEJoin, basado en ordenación, para joins cuya cláusulaONcontiene dos comparaciones de desigualdad (<,<=,>,>=) entre las tablas unidas. Se habilita añadiendoie_joinal ajustejoin_algorithm. Los tipos compatibles sonALL INNER/LEFT/RIGHT/FULL JOINySEMI/ANTI LEFT/RIGHT JOIN. Anteriormente, estas consultas se ejecutaban como unCROSS JOINcon un filtro (soloINNER), lo cual resulta mucho más lento en tablas grandes. #109920 (Vladimir Cherkasov). - Se añadió la función de agregación
gini, que calcula el coeficiente de Gini de valores numéricos finitos y no negativos, incluidas las agregaciones agrupadas y distribuidas. #112280 (Amirreza Akhondi). #114643 (Groene AI). - Se añadió el formato de salida
HiveText, que escribe textoLazySimpleSerDede Apache Hive. Los campos se separan mediante\x01; las filas, mediante el ajusteformat_hive_text_rows_delimiter(predeterminado:\n); y los valores anidadosArray,MapyTupleusan la lista de separadores de Hive. La salida está destinada alLazySimpleSerDepredeterminado de Hive y no es simétrica con la entradaHiveTextde ClickHouse para valores anidados ni delimitadores de filas personalizados. #107582 (Alexey Milovidov). - Se añadió compatibilidad con etiquetas constantes en el endpoint de métricas de Prometheus: una nueva sección
<labels>dentro de<prometheus>añade las etiquetas configuradas a cada métrica expuesta, lo que ayuda a distinguir varios clústeres recopilados por el mismo Prometheus. Los valores de las etiquetas admiten sustituciones de configuración estándar, comofrom_env. Cierra #85969. #111672 (Valery Petrov). - Se añadió la configuración
always_fetch_mutated_part. Cuando está habilitada, una réplica puede descargar partes modificadas de otra réplica en lugar de ejecutar las mutaciones localmente. #113020 (Rory Shanks). - Se añadió la función de agregación
mergedJSONPatchpara agregar parches de combinación de estilo RFC 7396 sobre valoresJSON, con compatibilidad para combinar estados y usarAggregatingMergeTree. Se puede agregar una columnaJSONusando una marca de tiempo u otra columna de ordenación como clave de ordenación para calcular el estado más reciente. #108349 (larryluogit). - Se añadió la función
aiSimilarity, que calcula la similitud semántica entre dos textos mediante un modelo de embedding. Devuelve unNullable(Float32)en[-1, 1], donde1significa que los textos son idénticos, oNULLsi un operando esNULL/está vacío o si no se pudo generar su embedding. #110777 (David Meng). - Se añadieron las configuraciones de restauración
restore_table_data,restore_access_entitiesyrestore_functionspara controlar de forma granular qué se restaura. Estas pueden anularstructure_onlypara categorías individuales; por ejemplo,structure_only=true, restore_access_entities=truerestaura las definiciones de tablas y las entidades de acceso sin restaurar los datos de las tablas. #102402 (Nikita Fomichev). - El operador de subíndice de arrays admite un array de enteros como índice:
arr[indexes]devuelve los elementos de todas las posiciones indicadas, de forma equivalente aarrayMap(i -> arr[i], indexes). #108371 (folly). - Se añadió la función
notHas, la negación dehaspara arrays, mapas y JSON. Cuando el conjunto de búsqueda es un array constante,notHas(constant_array, x)se reescribe comox NOT IN constant_arraymedianteoptimize_rewrite_has_to_in(habilitada de forma predeterminada), por lo que se ejecuta mediante una búsqueda en un conjunto y puede realizar poda mediante el índice de clave primaria, comoNOT IN. #109926 (Nihal Z. Miaji). - Las funciones
arrayElement(el operadorvec[n]) yarraySliceahora funcionan con el tipo de datosQBit:qbit[n]devuelve el elemento n-ésimo del vector con precisión completa, yarraySlice(qbit, offset, length)devuelve una proyección sobre un subconjunto de dimensiones. Ambas leen únicamente los planos de bits de los grupos de stride necesarios, y los segmentos alineados con los límites de los grupos de stride reutilizan los flujos almacenados sin copiar datos. Esto resuelve #109942. #109953 (Utkal Singh). - Se admite PNG animado en el formato de salida
PNG. Una columnatconvierte el resultado de una consulta en una animación; la escala temporal detse establece medianteoutput_format_image_time_multiplier_secondsyoutput_format_image_time_divisor_seconds, mientras queoutput_format_image_streaming_animationpermite escribir los fotogramas a medida que los produce la consulta, en lugar de almacenarlos en memoria. #112846 (Alexey Milovidov). - Nueva función
aiRedactque detecta y redacta información de identificación personal (PII) en texto mediante un proveedor de LLM. Especifique las categorías que se deben redactar (por ejemplo,['email', 'name']) o pase un array vacío para usar un conjunto predeterminado de categorías de PII. Los valores coincidentes se sustituyen por un token ([REDACTED]de forma predeterminada). #110464 (David Meng). - Añade la función
aiFilter, que evalúa una condición en lenguaje natural sobre texto mediante un LLM y devuelveUInt8para usarla enWHERE,PREWHEREyJOIN ... ON. #110594 (yanglongwei). - Admite conexiones TLS/SSL a PostgreSQL para el motor de tabla
PostgreSQL, la función de tablapostgresql, los motores de base de datosPostgreSQLyMaterializedPostgreSQL, y los diccionariosPostgreSQL:sslmode, además de certificados y clave, proporcionados como contenido literal (sslrootcert_pem,sslcert_pem,sslkey_pem; ocultos como contraseñas) o como rutas (sslrootcert,sslcert,sslkey; aceptadas únicamente desde una colección con nombre definida en el archivo de configuración del servidor). #110615 (Alexey Milovidov). - El servidor de ClickHouse ahora cuenta con un puerto de introspección. Es un receptor TCP del protocolo nativo que se inicia antes de que el servidor comience a adjuntar tablas y se detiene solo después de que finalice la desvinculación de las tablas. Durante estos intervalos, un operador puede conectarse a él con
clickhouse clienty ejecutar consultas comoSHOW PROCESSLIST,SELECT * FROM system.stack_traceoSYSTEM INSTRUMENT ADD 'QueryMetricLog::startQuery' SLEEP ENTRY 0.5. Además, el valor predeterminado de la configuración del servidorshutdown_wait_unfinishedaumenta de 5 a 120 segundos. El valor predeterminado anterior era menor que el intervalo de sondeo de conexiones, por lo que el servidor podía forzar su salida durante el apagado en lugar de esperar a que finalizaran las conexiones pendientes. #110838 (Miсhael Stetsyuk). - Introduce métricas de ZooKeeper emuladas en el comando
mntrde Keeper:zk_leader_uptime,zk_sum_election_time,zk_cnt_election_time,zk_sum_leader_unavailable_time,zk_cnt_leader_unavailable_time; también introduce métricas relacionadas con el líder, exclusivas de Keeper:KeeperLastLeaderElectionTime,KeeperLastLeaderUnavailableTime. #113334 (Maxim Orlovsky). - Admite ALTER TABLE … MODIFY PROJECTION para cambiar la configuración a nivel de proyección (p. ej., index_granularity) de una proyección existente sin reconstruirla. La nueva configuración se aplica de forma diferida mediante fusiones. #113343 (Diego Gomes Tomé).
- Añade una columna
finish_timeasystem.mutationsque registra cuándo se completó una mutación. Las mutaciones sin finalizar y aquellas cuyo momento de finalización se desconoce notifican cero. #113474 (Nikita Mikhaylov). - Añade un nuevo nivel de funcionalidad
private previewentreexperimentalybeta, de modo que los niveles de funcionalidad ahora se ordenan comoexperimental < private preview < beta < production. La configuración del servidorallow_feature_tierincorpora un nivel:0permite todos los niveles,1excluye experimental,2también excluye private preview y3permite únicamente configuraciones de producción. Las configuraciones que anteriormente fijabanallow_feature_tier = 2para permitir únicamente configuraciones de producción ahora deben usar3. Cierra #113481. #113581 (Groene AI). - La UI web de SQL integrada (
/play) ahora permite ordenar un resultado por sus columnas, filtrarlo por sus valores y paginarlo sin editar la consulta. En cada encabezado de columna aparecen flechas de ordenación y un campo de filtro; al seleccionar una celda, se ofrecen las comparaciones adecuadas para su valor; y, debajo de los resultados que no caben en una sola pantalla, aparece un paginador con tamaño de página ajustable. Todo se realiza en el servidor mediante los ajustes de construcción de consultasorder,filter,limitypage, por lo que se configura el resultado completo, no solo las filas que se muestran; la ordenación, los filtros y la página seleccionados se incluyen en la URL, de modo que un enlace compartido reproduce el resultado. #115540 (Alexey Milovidov). chdigv26.8.1: ratatui, paneles de tmux, sesiones de tmuxinator, logs compartidos con colores y recorrido por las funcionalidades. #115216 (Azat Khuzhin).
Funcionalidad experimental
- Se añadió un optimizador de costo basado en Cascades experimental para planes de consultas distribuidas, habilitado mediante
enable_cascades_optimizer = 1junto conmake_distributed_plan = 1. Elige, en función del costo estimado, entre estrategias de join shuffle, broadcast, replicado y local; agregación en dos fases, shuffle y local; top-N distribuido en dos etapas; y lecturas paralelas y replicadas, e inserta operadores exchange según sea necesario. #86353 (Alexander Gololobov). - Se añadió la configuración experimental de
MergeTreeenable_adaptive_codec_selection. Cuando está habilitada, las fusiones y mutaciones seleccionan, para las columnas que usan el códec predeterminado, el códec que genera la menor salida por bloque. #111834 (Raufs Dunamalijevs). * La selección adaptativa de códecs ahora comprime con cada códec candidato como máximo una vez por bloque, en lugar de medir todos los candidatos y volver a comprimir con el ganador. #113511 (Raufs Dunamalijevs). - El binario
clickhousese compila para WebAssembly (wasm64, mediante Emscripten), yclickhouse localejecuta consultas, incluidas las de tablasMergeTree, con Node.js ≥ 24 y en el navegador. Un nuevo trabajo de CI,Build (wasm64), fija la compilación y la ruta de ejecución de Node.js (la ruta del navegador todavía no está cubierta por CI) y proporciona el módulo de WebAssembly como artefacto. #113404 (Alexey Milovidov). parallel_replicas_plan_basedahora determina el límite local/remoto optimizando el plan de consulta, puede paralelizar consultas sobre vistas con unUNIONsinparallel_replicas_allow_view_over_mergetree, recurre al plan local para consultasIN (subquery)en lugar de producir un error y también distribuyeJOINs aptos (INNER,LEFT,RIGHT, incluidosSEMI/ANTI). #111063 (Igor Nikonov). #112268 (Igor Nikonov). #112443 (Igor Nikonov).- Los planes de consultas distribuidas (
make_distributed_plan) ahora también admiten consultas cuya fuente se sabe durante la planificación que no producirá filas, como lecturas de una tablaMergeTreevacía. #111941 (Groene AI). - Se añadió la configuración
use_projection_index_in_read_pools, deshabilitada de forma predeterminada. Cuando está habilitada, los rangos completamente filtrados por una proyección o un índice de salto se descartan dentro de los grupos de lectura deMergeTreeantes de crear tareas de lectura para ellos, en lugar de omitirse gránulo a gránulo durante la lectura. Esto evita crear tareas de lectura y configurar lectores para datos que no se van a leer. #110291 (Nikolai Kochetov). #112296 (Anton Popov). - PromQL: se corrigieron las operaciones con vectores instantáneos sin etiquetas, p. ej.,
vector(1) + vector(2),topk(1, vector(1)),label_replace(vector(1), ...)y operadores binarios conon(), que fallaban con un error de tipo. #111872 (Valery Petrov). - PromQL: se implementaron las funciones
changesyresets. #112352 (Valery Petrov). - Informa del error que canceló una consulta distribuida (
make_distributed_plan = 1) en lugar de simplementeQUERY_WAS_CANCELLED. Anteriormente, el error real de una tarea de worker fallida solo era visible en el registro del servidor. #112590 (Alexander Gololobov). - Cuando
make_distributed_plan = 1, ClickHouse ahora deshabilita las funcionalidades que los planes de consulta distribuida todavía no admiten, en lugar de dejar que fallen más adelante. Cierra #109476. #112463 (alesapin). - Los planes de consulta distribuida (
make_distributed_plan) ahora usan materialización diferida para consultasORDER BY ... LIMIT k. #113111 (Shankar Iyer). - Admite funciones de ventana sin particionar (
OVER (ORDER BY ...)) en planes de consulta distribuida (make_distributed_plan). Anteriormente, cualquier consulta con una función de ventana fallaba porqueWindowStepno se podía serializar para su ejecución remota; por ahora, las ventanas conPARTITION BYsiguen rechazándose. #109802 (Vighnesh Pathrikar). - Se añadió la configuración
use_query_condition_cache_for_top_k, que habilita el uso de la caché de condiciones de consulta para consultasORDER BY ... LIMIT n(TopK). #111492 (Alexey Milovidov). La caché de condiciones de consulta ahora está habilitada de forma predeterminada para las consultas que usan la optimizaciónORDER BY <column> LIMIT n(TopK). Puede volver a deshabilitarse con la configuraciónuse_query_condition_cache_for_top_k. #114539 (Alexey Milovidov). - Se añadió afinidad estática entre particiones y segmentos para
StorageKafka2mediante las configuracioneskafka_partition_shard_numykafka_shard_count, lo que permite que varios segmentos de ClickHouse consuman de forma determinista subconjuntos disjuntos de particiones de Kafka. #108886 (johnjing). - Refuerza las funciones de IA experimentales: deniega de forma predeterminada los endpoints inseguros (
http) hacia hosts remotos (nueva configuraciónai_function_allow_insecure_endpoint), limita de forma predeterminada las llamadas salientes a la API por consulta (ai_function_max_api_calls_per_queryahora tiene un valor predeterminado de1000) y depura las respuestas de error del proveedor que se escriben en los registros. #111286 (George Larionov). - PromQL:
quantilecon un nivel de cuantíl fuera de [0, 1] ahora devuelve -Inf/+Inf/NaN, como Prometheus, en lugar de generar un error, yhistogram_quantileahora ignora las series de entrada cuya etiquetalefalta o no se puede analizar, como Prometheus. #111871 (Valery Petrov). - Permite identificadores de varios componentes en tablas TimeSeries. #112799 (Vitaly Baranov).
- Se añadieron las configuraciones de
TimeSeriessamples_index_granularityytags_inner_granularitypara controlar la granularidad del índice de las tablas internas. #113075 (Vitaly Baranov). - PromQL: se añadió la función
derivy se corrigió un error por el que la función de agregación en la que se basa devolvía valores 1000 veces menores con marcas de tiempo de resolución de milisegundos. #112360 (Valery Petrov). - PromQL: rechazar secuencias de escape entre delimitadores no válidas en cadenas y puntos de código sustitutos de Unicode no válidos. #113587 (Minh Vu). #113203 (Minh Vu).
- PromQL: conservar los valores finitos al usar el operador módulo con un divisor infinito. #113746 (Minh Vu).
- PromQL: las funciones de fecha y hora
hour,minute,month,year,day_of_week,day_of_month,day_of_yearydays_in_monthahora se pueden llamar sin argumentos; de forma predeterminada usanvector(time()), como en Prometheus. #111869 (Valery Petrov). - PromQL ahora admite el parámetro
lookback_deltade la API HTTP de Prometheus para consultas instantáneas y de intervalo. #113971 (Minh Vu). - Los planes de consulta distribuidos (
make_distributed_plan) ahora admitenIN (subquery)sin reescribirlo como unJOIN: el conjunto se crea una vez en el iniciador y sus valores se envían junto con las tareas de los workers. Se elimina la sobrescritura forzadarewrite_in_to_join; la reescritura sigue disponible como configuración explícita. #113826 (Alexander Gololobov). - Las consultas de streaming admiten marcas de agua. #106169 (Mikhail Artemenko).
- Se añadió una caché de sistema de archivos de lectura directa a la ruta de lectura experimental de
ReaderExecutor(use_reader_executor, deshabilitada de forma predeterminada). #110029 (Sema Checherinda). - PromQL: se implementaron las funciones
clamp,clamp_min,clamp_maxyround. #111870 (Valery Petrov). - Recopilar correctamente las estadísticas de inserción y las consultas a través del endpoint remote-write de Prometheus. #112825 (James Cunningham).
- Los operadores de agregación de PromQL ahora aceptan combinaciones de mayúsculas y minúsculas, como Prometheus. #114076 (Minh Vu).
- TimeSeries: almacenar todas las etiquetas en la columna
tags. #114300 (Vitaly Baranov). - Aplicar la optimización de lectura en orden a las consultas
ORDER BYcuandoparallel_replicas_plan_basedestá habilitado: la ordenación ahora se envía a las réplicas y se combina en el iniciador, de modo que cada réplica lee según el orden de la clave de ordenación. También corrigeUnknown function __topKFilterparaORDER BYen una columna que no forma parte de la clave primaria cuando esta configuración está habilitada. #114315 (Igor Nikonov). - Rechazar saltos de línea literales en cadenas PromQL normales entre comillas. #114381 (Minh Vu).
- Corregir las claves
GROUP BYduplicadas en la estrategia de agregación parcial demake_distributed_plany permitir esta estrategia para agregaciones sobre una lectura distribuida. #114523 (Alexander Gololobov). - Generar una excepción cuando se infrinja la lista de permitidos de tipos de índices hipotéticos para WHATIF. #114646 (Yarik Briukhovetskyi).
- Restaura la lectura de subcolumnas cuantizadas para la búsqueda vectorial (introducida en la versión 26.7). #114763 (Shankar Iyer).
- El motor de tabla experimental
TimeSeriesya no aplica el códecGorillaa las columnasvaluecreadas automáticamente en la tabla interna de muestras; ahora usanCODEC(ZSTD(1))de forma predeterminada. Las columnas declaradas explícitamente conservan los códecs especificados por el usuario. El valor predeterminado de la columnatimestampno cambia (CODEC(DoubleDelta, ZSTD(1))). #114790 (Nikita Mikhaylov). - Una consulta con plan distribuido (
make_distributed_plan) ahora detiene las etapas anteriores cuando se alcanza unLIMIT, en lugar de calcular y descartar el resultado completo. #114806 (Alexander Gololobov). - Se añadió un nivel de caché de páginas en espacio de usuario a la ruta de lectura del
ReaderExecutorexperimental (use_reader_executor, desactivado de forma predeterminada). Ante un fallo de caché, el ejecutor ahora rellena la caché de páginas en espacio de usuario y sirve desde ella las lecturas posteriores, sin copia. #114890 (Sema Checherinda). - Admite
ROLLUP,CUBE,GROUPING SETSy la funcióngroupingen consultas ejecutadas conmake_distributed_plan = 1. #114950 (Alexander Gololobov). - Corrige el error
Illegal type Decimal(18, 0) of argument of function toIntervalNanosecondcuando una consulta PromQL usaoffsetdentro de un selector de rango; por ejemplo,rate(m[2m] offset 5m). #114997 (Nikita Mikhaylov). - Un valor muy elevado de
distributed_plan_workers_numya no hace que el servidor se aborte con unstd::length_errorcuando están habilitados los experimentalesmake_distributed_planyenable_cascades_optimizer. Este número de nodos ahora se rechaza conINVALID_SETTING_VALUE. #115398 (Groene AI). - Admite la agregación
GROUPING SETSen planes distribuidos creados por el optimizador Cascades (make_distributed_plan = 1, enable_cascades_optimizer = 1). #115426 (Alexander Gololobov). - Las tablas
TimeSeriesahora pueden conservar una tabla de “muestras recientes”: cuando la nueva configuración del motorrecent_samples_ttl_secondses distinta de cero, el motor crea una copia de la tabla de muestras con TTL (particionada porrecent_samples_partition_by; por día de forma predeterminada) en la que se escribe con cada inserción. Las consultas PromQL cuyo intervalo de tiempo se ajusta a la ventana de TTL leen automáticamente de ella, lo que acelera varias veces las reglas de alerta/registro y los dashboards de intervalos cortos en tablas grandes. La preferencia se puede desactivar con la nueva configuración a nivel de consultatime_series_prefer_recent_samples_table. #115441 (Nikita Mikhaylov). - Implementa consultas SELECT desde TimeSeries. #115622 (Vitaly Baranov).
- Implementa el endpoint
/api/v1/seriesde la API HTTP de Prometheus para las tablasTimeSeries: selectores de seriesmatch[](los valores repetidos se unen), un intervalo de tiempostart/endopcional y un parámetrolimitopcional. #115676 (Nikita Mikhaylov). - Los planes de consultas distribuidas (
make_distributed_plan) ahora detienen de inmediato las etapas upstream inactivas tras satisfacerse unLIMIT: un sink de exchange inactivo leeNoMoreDataNeededen cuanto llega, y un source de exchange inactivo detecta que su salida se ha cerrado y propaga la detención upstream. Anteriormente, estas etapas seguían leyendo y procesando datos que nadie consume. #115690 (Alexander Gololobov). - Las réplicas paralelas automáticas ahora pueden recopilar estadísticas de tiempo de ejecución y habilitar réplicas paralelas para consultas compatibles cuando
parallel_replicas_plan_basedestá habilitado. #115788 (Igor Nikonov). - Registrar una tabla externa de muestras recientes de una tabla TimeSeries como dependencia referencial. #115944 (Groene AI).
Mejora del rendimiento
- Nuevo algoritmo adaptativo para
GROUP BYparalelo (controlado mediante la configuraciónenable_adaptive_aggregator, habilitada de forma predeterminada): cada hilo agrega datos en su propia tabla hash hasta alcanzaradaptive_aggregator_freeze_thresholdclaves y, después, la congela. De este modo, las claves frecuentes continúan actualizando las pequeñas tablas residentes en caché sin necesidad de coordinación, mientras que las claves poco frecuentes se enrutan según su hash a acumulaciones pendientes por bucket y se agregan exactamente una vez durante la combinación paralela por bucket. #111459 (Nihal Z. Miaji). - Se redujo el uso de memoria de las tablas
MergeTreecon muchas partes de datos al compartir entre las partes de una tabla los metadatos por parte derivados del esquema (lista de columnas, descripciones de columnas, serializaciones y subflujos de columnas), en lugar de copiarlos en cada parte. El efecto es mayor en tablas anchas con muchas partes pequeñas. #109816 (Raúl Marín). - Optimiza las consultas
GROUP BY ... ORDER BY ... LIMITyGROUP BY ... LIMITal mantener un montón acotado durante la agregación para descartar grupos que no pueden aparecer en el resultado, lo que reduce significativamente el uso de memoria y el tiempo de ejecución en agrupaciones de alta cardinalidad. Controlado por la configuraciónenable_group_by_top_k_optimization. Basado en la implementación inicial de Dmitriy Terenichev (#78553). #96630 (Konstantin Bogdanov). - Reduce el tamaño de las celdas de las tablas hash para claves de agregación formadas por un único
String, lo que mejora las cargas de trabajo deGROUP BYcon muchas cadenas. La nueva configuraciónenable_packed_string_keys_in_aggregationestá habilitada de forma predeterminada; al deshabilitarla o establecercompatibilitypor debajo de26.8, se restaura el método heredadoStringHashTable, que aún puede ser más rápido para agregaciones de muy baja cardinalidad con claves de más de 11 bytes. #110573 (Harikrishnan Prabakaran). #112089 (Harikrishnan Prabakaran). - Paraleliza la combinación final de tablas hash de agregación de un solo nivel con la nueva configuración
enable_parallel_single_level_merge, habilitada de forma predeterminada. Esto acelera las consultasGROUP BYcuyas tablas hash por hilo permanecen por debajo del umbral de dos niveles, pero en las que la combinación domina el tiempo de ejecución. #110395 (Nihal Z. Miaji). - Mejora el rendimiento de
DISTINCTcuando el flujo de entrada está ordenado por un prefijo de las columnas deDISTINCT; por ejemplo,SELECT DISTINCT a, b FROM table ORDER BY a. Estas consultas se ejecutan hasta 2,4 veces más rápido. #110170 (Nihal Z. Miaji). - Acelera y reduce el uso de memoria de las consultas
DISTINCTen tablasMergeTreeparticionadas al mantener las filas de cada partición dentro de un único flujo, de modo que elDISTINCTpreliminar de cada flujo opera sobre un conjunto disjunto de claves, en lugar de que el mismo conjunto de claves aparezca en variosDISTINCTpreliminares. Esto se aplica cuando la expresión de partición es una función determinista de las columnas deDISTINCTy está condicionado por una heurística de coste basada en el número de particiones y el sesgo (que se puede activar mediante la configuraciónforce_distinct_partitions_independently, deshabilitada de forma predeterminada). La misma disjunción por partición se propaga a través de los pasosExpression,FilteryARRAY JOINhasta los consumidores finalesDISTINCT,LIMIT BYyGROUP BY, para que también puedan omitir la combinación. Controlado por las nuevas configuracionesallow_distinct_partitions_independently(habilitada de forma predeterminada) ymax_number_of_partitions_for_independent_distinct, que permite ajustar la heurística. #108326 (Nihal Z. Miaji). - Se optimizaron las funciones
uniq,uniqExactyuniqHLL12para la agregación sin clave. #110150 (Anton Popov). - El lector V3 de
Parquetahora puede omitir grupos de filas completos mediante la página de diccionario, además de las estadísticas de mínimo/máximo y los filtros de Bloom, para condiciones de igualdad eINcuando un fragmento de columna está totalmente codificado mediante diccionario. Se controla con el nuevo ajusteinput_format_parquet_dictionary_filter_push_down. #106952 (Alexey Milovidov). #110567 (Alexey Milovidov). - Materialización diferida al leer archivos
Parquetdesde el almacenamiento de objetos, incluidas las tablasIceberg: para consultasORDER BY ... LIMIT n, las columnas que no se necesitan para ordenar ni filtrar se leen solo para lasnfilas que sobreviven alLIMIT. En un archivoParquetde 200 MB enS3,SELECT k, s ... ORDER BY k DESC LIMIT 10lee 3.3 MB en lugar de 171 MB (51 veces menos E/S y 8 veces más rápido). Se controla con el nuevo ajustequery_plan_optimize_lazy_materialization_for_object_storage(habilitado de forma predeterminada y que también requierequery_plan_optimize_lazy_materialization). #110970 (Alexey Milovidov). * La materialización diferida para consultasORDER BY ... LIMIT n(#110970) ahora también se aplica a archivos Parquet locales leídos con la función de tablafiley el motor de tablaFile: las columnas que no se necesitan para ordenar ni filtrar se leen solo para lasnfilas que sobreviven alLIMIT. La segunda lectura de un archivo que ha sobrevivido falla con el nuevo errorFILE_CHANGED_DURING_READsi el archivo se modificó entre las dos pasadas. Se controla con el nuevo ajustequery_plan_optimize_lazy_materialization_for_file(habilitado de forma predeterminada). También corrige un fallo de la materialización diferida para el almacenamiento de objetos conNot found column or subcolumn ... in blockcuando se aplaza una subcolumna solicitada (por ejemplo, de una columnaJSON). #114262 (Alexey Milovidov). - Las estadísticas de columna ahora se materializan en
INSERTde forma predeterminada cuando el tamaño activo actual de la tabla más el tamaño del bloque escrito no supera el nuevo ajustematerialize_statistics_on_insert_max_table_size(25 GiB de forma predeterminada); la comprobación se realiza para cada bloque escrito, por lo que una primera carga masiva en una tabla vacía aún puede materializar estadísticas para cada bloque escrito. Esto proporciona al optimizador de uniones basado en costes estimaciones precisas para tablas de dimensiones recién cargadas y evita órdenes de unión patológicos (por ejemplo, TPC-H Q5 y Q8 ya no agotan el tiempo de espera con un factor de escala de 40), mientras que las tablas de hechos grandes ya establecidas siguen materializando estadísticas durante las fusiones. #109454 (Alexey Milovidov). - Acelera las funciones de ventana en tablas
MergeTreeparticionadas leyendo cada partición mediante su propio flujo y evaluando las ventanas por partición, evitando la dispersión hash que normalmente redistribuye cada fila entre hilos antes de la ordenación de ventana. Esto se aplica cuando la expresión de partición de la tabla es una función determinista de las columnasPARTITION BYde la ventana y está sujeto a la misma heurística de costes queGROUP BY/DISTINCTpor partición (suficientes particiones en relación conmax_threadsy ninguna partición dominante). Se controla con los nuevos ajustesallow_window_partitions_independently(habilitado de forma predeterminada),force_window_partitions_independentlyymax_number_of_partitions_for_independent_window. #114783 (Nihal Z. Miaji). - Reduce el uso de memoria al escribir partes empaquetadas transmitiendo el archivo final directamente al archivo de destino, en lugar de mantener una segunda copia completa en memoria durante la confirmación de la parte. #111995 (Alexey Milovidov).
- Se añadió un nuevo valor de
join_algorithm,parallel_full_sorting_merge: para joins de igualdad compatibles con hash, fragmenta un join de fusión con ordenación completa en joins de fusión independientes por segmento, según el hash de las claves de join, que se ejecutan en todos los hilos. Mantiene el bajo uso de memoria en streaming de un join de fusión mientras lo paraleliza (en una prueba comparativa, ~2,4 veces más rápido y con ~3,3 veces menos memoria queparallel_hash). Los joinsASOFrecurren a un únicofull_sorting_merge; los tipos de clave incompatibles con hash (de coma flotante,JSON,Object,Dynamic) solo omiten la reescritura de dispersión por hash y aún pueden fragmentarse en el origen mediante rangos de clave primaria cuandoquery_plan_join_shard_by_pk_rangesestá habilitado. El resultado no está ordenado. #109005 (Alexey Milovidov). - Añade poda espacial de GeoParquet a nivel de grupo de filas y de página al lector de
Parquet. La poda de grupos de filas omite grupos completos cuyo cuadro delimitador no se superpone con la geometría de la consulta. La poda a nivel de página utiliza el índice de columnacovering.bboxpara omitir páginas irrelevantes dentro de los grupos de filas, y la inserción de predicados espaciales ahora también se aplica durante la lectura de filas deParquet. #104435 (Vasily Chekalkin). - La inserción de filtros en Parquet (poda de grupos de filas e índice de columna) admite más conversiones de tipos:
DateTime64(x) <-> DateTime64(y),Decimal(x) <-> Decimal(y),Float32 <-> Float64. #110457 (Michael Kolupaev). - Reduce las solicitudes de lectura duplicadas en discos remotos cuando los rangos de marcas están fragmentados, por ejemplo, por índices primarios o índices de omisión. #113584 (Anton Popov).
- Acelera la ejecución de
INen columnas agrupadas (p. ej., ordenadas por clave primaria) reutilizando el resultado de la fila anterior para filas consecutivas iguales. #114853 (Nikita Mikhaylov). - Una agregación sin claves
GROUP BYya no distribuye su salida de una sola fila entremax_threadsflujos, por lo que las consultas cuyo plan continúa después de dicha agregación tienen una canalización mucho más pequeña (menos procesadores que crear, programar y perfilar) sin perder paralelismo. #115170 (Nikita Mikhaylov). - Keeper ahora lee entradas de changelog con menos contención de bloqueos: las lecturas de puesta al día se planifican bajo un bloqueo compartido y realizan operaciones de E/S de disco sin bloqueos; además, tanto la puesta al día de los seguidores como la ruta de confirmación pueden predecodificar entradas en un thread pool en segundo plano, lo que reduce las lecturas redundantes de disco y la decodificación por CPU en el líder. #108473 (Antonio Andelic).
- Acelera el inicio de Keeper leyendo varios archivos de changelog simultáneamente en lugar de hacerlo de forma secuencial, mediante los nuevos ajustes
log_startup_read_max_streamsylog_startup_read_buffer_size. #109881 (Antonio Andelic). - Añade un nuevo tipo de esquema
bucketedparasystem.metric_log, que almacena todas las métricas en una única columnaMap(Enum16(...), Int64)mediante la serialización deMappor cubetas con 128 cubetas, además de una columnaALIASpor métrica para mantener la compatibilidad: la tabla consta de unas pocas columnas en lugar de miles, los valores cero no se almacenan y la lectura de una sola métrica solo lee una de las 128 cubetas. Además, ahora se puede indexar unMapcon clavesEnummediante el nombre de cadena del valor de la enumeración, p. ej.,map['name']. #115380 (Alexey Milovidov). - Se añadió una optimización del plan de consulta que desplaza las funciones que reducen el volumen (
length,lengthUTF8,empty,notEmpty) por debajo de los pasosSortingyFilter, sustituyendo el argumento anchoString/FixedStringpor el resultado de tamaño fijo, de modo que no se almacena en búfer durante la ordenación ni se copia durante el filtrado. Se controla mediante la nueva configuraciónquery_plan_push_down_volume_reducing_functions, habilitada de forma predeterminada. #106199 (Peng). - Se habilitó
read_in_order_use_virtual_rowde forma predeterminada. Al leer en el orden de la clave primaria (p. ej.,ORDER BY primary_key LIMIT n) en una tabla con muchas partes, solo se leen las partes que realmente pueden contribuir al resultado, además de una ventana de lectura anticipada de como máximomax_threadspartes que mantiene la lectura en paralelo, lo que reduce significativamente el consumo máximo de memoria. #106215 (Alexey Milovidov). - Las consultas de agregación sin funciones de agregado ahora usan métodos basados en
HashSeten lugar deHashMap(para los tipos de clave compatibles). Se observaron mejoras de rendimiento de hasta 1,8 veces. #108862 (Nikita Taranov). - Se evita la sobrecarga de los filtros de tiempo de ejecución de
JOINcuando se estima que el lado de sondeo es pequeño. El umbral se controla mediante la nueva configuraciónjoin_runtime_filter_min_probe_rows(valor predeterminado:1000). #104860 (Vladimir Cherkasov). - Las consultas con predicados como
nullIf(key, sentinel) = constahora pueden aprovechar la poda por clave primaria, partición e índices de salto. #107308 (Aditya Kumar). - Se añadió la configuración de servidor
jemalloc_merge_tree_arenaspara controlar las arenas jemalloc dedicadas a los metadatos de partes y tablasMergeTree. En servidores con muchos núcleos, un grupo por CPU puede reducir la contención de bloqueos del asignador entre fusiones simultáneas, y la arena dedicada ahora solo contiene metadatos de larga duración. #109490 (Raúl Marín). - Se aceleró la descompresión ZSTD en
x86_64para columnas con desplazamientos de coincidencia pequeños, como las columnas de enteros de ancho fijo, mediante la vectorización de copias superpuestas con desplazamiento corto usandopshufbde SSSE3. Por ejemplo, la descompresión de una columnaUInt64es hasta ~1,2 veces más rápida en AMD Zen 5. #110909 (Konstantin Bogdanov). - Se aceleró
groupUniqArraypara tipos numéricos hasta 3 veces mediante el uso de hash CRC32, como enuniqExact, y la inserción en línea por fila. #110917 (Manuel). - Se aceleró
estimateCompressionRatiocon el códecNONE. #111107 (Raufs Dunamalijevs). - Se redujo el valor predeterminado de
max_snapshot_commit_thread_pool_sizea16, igualándolo abackup_threads, para reducir la limitación de CFS al confirmar instantáneas de tablas con muchas partes. #111417 (Han Fei). - Se redujo el uso de CPU al confirmar instantáneas de tablas con una enorme cantidad de archivos. #112297 (Han Fei).
- Se omite el precalentamiento de hashes de deduplicación de inserciones asíncronas cuando la deduplicación está deshabilitada. #111549 (Sema Checherinda).
- Un
JOINcuya condiciónONsiempre es falsa, por ejemplo,ON 1 = 2,ON NULLoa.t = 'A' AND a.t = 'B', ya no lee el lado que no aporta resultados. Se controla mediante la configuraciónquery_plan_short_circuit_constant_false_join(habilitada de forma predeterminada). #110234 (Groene AI). - Acelera la lectura de tablas
Icebergmediante la precarga del siguiente archivo de manifiesto mientras se analiza el actual, solapando las operaciones de E/S con el trabajo de CPU. #108543 (Asya Shneerson). - Las consultas con
FINALque leen en orden de clave primaria con unLIMITpequeño ya no usansplit_intersecting_parts_ranges_into_layers_final. #110431 (Nikolai Kochetov). - Mejora el rendimiento de
RIGHTyFULL JOINcon el algoritmoparallel_hashcuando el lado derecho contiene claves de joinNULLo filas filtradas por la expresiónON, evitando reconstruir el mapa de valores nulos. #111258 (Hechem Selmi). - Acelera
countSubstringsCaseInsensitiveUTF8al corregir una complejidad cuadrática que podía hacer que la función tardara minutos con una cadena de búsqueda de unos pocos megabytes y muchas coincidencias. #112003 (Groene AI). - La API de consultas de Prometheus (
/api/v1/query,/api/v1/query_range) del motor experimentalTimeSeriesahora ejecuta consultas en paralelo en lugar de usar un único hilo. #112108 (Nikita Mikhaylov). - Las columnas
timestampyvaluecreadas automáticamente en la tabla interna de muestras deTimeSeriesahora usan de forma predeterminadaCODEC(DoubleDelta, ZSTD(1))yCODEC(Gorilla, ZSTD(1)), respectivamente. #112110 (Nikita Mikhaylov). - Corrige una regresión de rendimiento en la ingestión de
system.query_log. La creación de las columnas de mapaSettingsyasynchronous_read_countersera aproximadamente seis veces más lenta que antes, lo que podía hacer queSYSTEM FLUSH LOGS query_logsuperara su tiempo de espera de 180 segundos en servidores que registran muchas consultas con numerosas configuraciones modificadas. Cierra #112191. #112210 (Groene AI). - Mejora el rendimiento de los hash JOIN RIGHT y FULL con múltiples disyunciones
ORen la cláusula ON, así como de los JOIN RIGHT/FULL con condiciones residuales (de desigualdad). #111590 (Hechem Selmi). - Reduce el uso de memoria de
UNLOCK SNAPSHOTal no cargar los metadatos de cada parte de datos que no utiliza la ruta de desbloqueo, evitando errores de falta de memoria en snapshots con un número muy elevado de partes. #111849 (Julia Kartseva). - Restaura la preasignación de memoria para las rutas dinámicas de una columna
JSONdurante los vaciados asíncronos deINSERT, evitando reasignaciones repetidas a medida que se añaden filas por lotes. #112222 (Groene AI). - Vuelve a habilitar la optimización de claves consecutivas para la agregación
TTL ... GROUP BYdurante las fusiones. Se había deshabilitado accidentalmente en esa ruta, por lo que los resultados seguían siendo correctos, pero las fusiones realizaban más trabajo del necesario. #112314 (Groene AI). - Se aceleró la lectura de columnas
Nestedde tipos codificados en binario, comoNativeyRowBinary, cuandoinput_format_binary_decode_types_in_binary_formatestá habilitado, y los nombres malformados de tiposTupleanidados ahora se notifican como errores de sintaxis en lugar de invertir un tiempo exponencial en analizarlos. #112560 (Alexey Milovidov). - Se mejoró el rendimiento de la compactación y combinación de columnas
DynamicyObjectcon muchas variantes dinámicas o rutas JSON. #110583 (Christoph Viebig). - Se aceleraron
minymaxpara tipos de 128 y 256 bits (Int128,UInt128,Int256,UInt256,Decimal128,Decimal256). Hasta 1,8 veces más rápido para enteros de gran tamaño y hasta 3,4 veces más rápido para decimales de gran tamaño. #111965 (Manuel). - Se habilitaron de forma predeterminada (y se promovieron a beta) dos funcionalidades en disco: 1)
packed_skip_index_max_bytes = '1M': los subflujos de índices de omisión de hasta 1 MiB ahora se escriben en un único archivoskp_idx.packedpor parte, lo que reduce el número de objetos y las solicitudes de escritura en el almacenamiento de objetos. Compatibilidad: solo se ven afectadas las partes recién escritas y siguen siendo totalmente legibles en versiones anteriores; las versiones anteriores a la 26.6 simplemente no usan los índices empaquetados para la poda (se tratan como no materializados). Establezcapacked_skip_index_max_bytes = 0para mantener la disposición independiente por archivo. 2)compute_exact_num_defaults_for_sparse_columnsjunto conoptimize_trivial_count_with_sparsity_filter: los contadores exactosnum_defaultspor columna se conservan y se usan para responder aSELECT count() FROM t WHERE <pred>sin escanear datos cuando el predicado divide las filas entre valores predeterminados y no predeterminados. Compatibilidad: las versiones anteriores ignoran la marcaexact_num_defaultsenserialization.json, por lo que las partes siguen siendo totalmente legibles después de una reversión de versión; la reescritura decountsolo se aplica a las partes que contienen contadores exactos, por lo que los resultados siguen siendo correctos en tablas con partes mixtas. #111816 (Raúl Marín). - Se añadió almacenamiento en caché opcional para tokens ausentes en índices de texto. #112742 (Rory Shanks).
- Se corrigió la reasignación cuadrática al replicar un
Arraycuyos elementos contienen valoresJSONen datos compartidos, por ejemplo, unArray(JSON)constante pasado a una función de agregación. Estas consultas copiaban una cantidad de bytes que crecía cuadráticamente con el número de filas. #112897 (Groene AI). - Se usa el índice de clave primaria para
pointInPolygoncuando el argumento del punto es una columna de clave completa de tipoPoint(u otroTuplede dos elementos numéricos), por ejemplo,pointInPolygon(coord, [...])para una tabla ordenada porcoord. Anteriormente, solo se analizaba la formapointInPolygon((x, y), [...])con dos columnas de clave escalares. Cierra #54805. #112956 (Alexey Milovidov). - Se omite por completo la lectura de datos en las combinaciones
TTLDroppara reducir el uso de memoria, especialmente en los búferes de lectura y precarga. Cierra #105639. #105859 (Pavel Kruglov). - Se redujeron las asignaciones de memoria al leer metadatos de copias de seguridad moviendo las entradas de archivos a mapas en memoria en lugar de copiarlas. #111718 (Julia Kartseva).
- Utiliza el índice de texto cuando su expresión contenga una comparación con una cadena vacía, como
arrayFilter(s -> s != '', ...), incluso cuandooptimize_empty_string_comparisons = 1la reescriba comonotEmpty. Cierra #111788. #112115 (Jimmy Aguilar Mena). - Restaura la poda de la caché de condiciones de consulta después de una
lightweight DELETE: las consultas selectivas repetidas sobre una tabla que hubiera sido afectada alguna vez por unalightweight DELETEya no recurren a leer cada marca. #112947 (Nikita Fomichev). - Las funciones de orden superior ya no copian físicamente las columnas capturadas para cada elemento del array cuando
enable_lazy_columns_replicationestá habilitado, lo que reduce el uso de memoria y el tiempo de copia de las lambdas que capturan columnas grandes. #111581 (Diego Gomes Tomé). - Corrige una regresión de rendimiento de aproximadamente 1,5 veces introducida en la versión 26.5 en
GROUP BYsobre clavesDynamicy subcolumnas de rutasJSON. #112316 (Utkal Singh). text_index_posting_list_apply_modeahora tienelazycomo valor predeterminado, por lo que las consultas sobre índices de texto decodifican las listas de postings bajo demanda, con granularidad de bloques empaquetados y mediante un cursor, en lugar de materializarlas anticipadamente en mapas de bits para los índices de texto conposting_list_codecconfigurado. #113521 (Anton Popov).- Acelera las consultas PromQL sobre tablas
TimeSeries:timeSeriesIdToGroupahora reutiliza el grupo de la fila anterior cuando filas consecutivas tienen el mismo ID de serie, evitando la serialización del ID y la búsqueda hash por fila. #113580 (Nikita Mikhaylov). - Los operadores de agregación PromQL
topk,bottomkylimitkahora utilizan un plan de ejecución paralelo y de streaming con memoria acotada, en lugar de recopilar todas las series en una sola fila. Las consultas sobre métricas de alta cardinalidad que antes fallaban conMEMORY_LIMIT_EXCEEDEDahora se ejecutan con memoria acotada. #113656 (Nikita Mikhaylov). #114409 (Alexey Milovidov). - Acelera la división de enteros de 256 bits (
Int256,UInt256yDecimal256), lo que afecta aintDiv,modulo, la aritmética deDecimal256y la conversión de estos tipos a texto. #112477 (Konstantin Bogdanov). - Mejora el rendimiento de lectura de
MergeTreepara subcolumnasJSONreutilizando los metadatos de las subcolumnas resueltas durante las conversiones necesarias. #113008 (Rory Shanks). - Acelera la creación de índices de omisión basados en texto y filtros Bloom con el tokenizador
sparseGrams. #110541 (UnamedRus). - La creación de instantáneas ahora utiliza un grupo de hilos dedicado, por lo que un
BACKUPsimultáneo intensivo ya no la deja sin recursos. #113509 (Han Fei). - Evalúa una sola vez, en lugar de dos, las subexpresiones de PromQL compartidas por varios pasos del plan (el operando de
topk/bottomk/limitky el lado izquierdo deor): el SQL generado a partir de PromQL ahora materializa las subconsultas compartidas. Esto elimina un escaneo duplicado de la tabla de muestras;topksobreratees ~2 veces más rápido en frío, y las consultas de reglas de kubernetes-mixin mejoran entre un 10 y un 29 %. #113772 (Nikita Mikhaylov). - Ahora puede habilitar, durante el análisis, el plegado anticipado de cortocircuito para las funciones integradas
andyorcon la configuraciónenable_function_early_short_circuit. Esto permite omitir la ejecución de subconsultas escalarescount()de una sola fila que no se alcanzan, conservando la inferencia de tipos y la validación semántica habituales. Resuelve #83017. #83505 (fhw12345). - Combina el coste de E/S con la selectividad al ordenar las condiciones
PREWHERE. Esto corrige una regresión de rendimiento en la ejecución dePREWHEREen algunos casos, introducida después de #101275. Parte de #110462. #110695 (Pavel Kruglov). - Mejora el rendimiento de
levenshteinDistance(yeditDistance) para cadenas de longitud media en ARM al evitar asignaciones en el montón por fila en la ruta de código Myers por bloques. #108185 (Groene AI). - Añade la configuración de
MergeTreemerge_use_batch_sorting_queuepara usar opcionalmente la cola de ordenación por lotes en fusiones ordinarias deMergeTree, lo que reduce el uso de CPU y el tiempo de reloj para cargas de trabajo de fusión en las que la fusión ordenada supone un coste significativo. #108468 (Rory Shanks). - Añade la configuración
merge_tree_min_bytes_per_read_streampara reducir el exceso de flujos de lectura y la sobrecarga de la canalización en escaneos locales, no ordenados y ordinarios de columnas estrechas deMergeTreeen servidores con un gran número de núcleos. #109035 (Jiebin Sun). - Acelera la función
toStartOfInterval(aliastime_bucket,date_bin) hasta 5 veces para intervalosSECOND,MINUTEyHOUR. #109729 (Manuel). - El protocolo nativo ahora envía las columnas
Stringcomo un flujo independiente de desplazamientos acumulados en bytes (la misma disposición queArrayusa para sus desplazamientos), seguido de los datos concatenados, en lugar de un prefijo de longitud varint por valor, cuando ambos extremos usan la revisión de protocolo 54489 o posterior. Un client puede entonces leer columnasStringcon preasignación exacta del búfer y una única copia masiva, unas 4 veces más rápido que con la disposición por valor. Los clientes y servidores antiguos no se ven afectados: la disposición se negocia mediante la revisión del protocolo. La misma disposición está disponible en los formatosNativeyBuffersmediante las nuevas configuracionesoutput_format_native_write_string_with_size_stream/input_format_native_read_string_with_size_stream(desactivadas de forma predeterminada, por lo que los formatos siguen siendo portables). #110320 (vahid-sohrabloo). - Evita la serialización anticipada a JSON de entradas de manifiesto de Iceberg cuando iceberg_metadata_log_level está por debajo del umbral del sitio de llamada. #110437 (Andy Bradshaw).
- Mejora el rendimiento de full sorting merge join hasta 1,5-3 veces en escenarios dispersos. #111200 (Vladimir Cherkasov).
- Mejora la eficiencia de las estadísticas minmax y las estadísticas básicas de las columnas de punto flotante. #111221 (Christoph Viebig).
- Habilita
join_runtime_filter_from_fixed_hash_tablecuando difieren los tipos de las claves de join de probe y build (por ejemplo, una clave de probe Nullable y una clave de build no Nullable). #111244 (Hechem Selmi). - Devuelve las consultas
COUNT()directamente a partir de los metadatos de cardinalidad del índice de texto. #111494 (Elmi Ahmadov). - Acelera el cálculo de hash por fila de los valores de columnas JSON/
Objectalmacenados en datos compartidos (utilizado, por ejemplo, poruniq/uniqExacten una columna JSON y por claves con hash deGROUP BY/DISTINCT) al evitar la reconstrucción deColumnDynamicpara cada valor. Los valores hash no cambian. #111501 (Valery Petrov). - Las funciones
mapContainsKeyLike,mapContainsValueLike,mapExtractKeyLikeymapExtractValueLikecon un patrón no constante consumen menos memoria y tiempo cuando enable_lazy_columns_replication está habilitado. El patrón ya no se copia anticipadamente para cada entrada del map al capturarse; la copia se difiere hasta la ejecución de la lambda interna y se libera antes, por lo que hay una copia expandida menos del patrón en el pico de uso. #111749 (Diego Gomes Tomé). - Acelera la ordenación y otras operaciones basadas en comparaciones en columnas
JSONcuyas rutas se almacenan en datos compartidos. Antes, cada comparación de valores materializaba una columnaDynamictemporal y ejecutaba una deserialización binaria completa en ambos lados, lo que hacía queORDER BYen esas columnas fuera extremadamente lento. #111894 (Groene AI). clickhouse-clientya no hace ping al servidor antes de cada consulta, lo que elimina un viaje de ida y vuelta de red por consulta. Tampoco restablece la conexión —iniciando silenciosamente una nueva sesión y, por tanto, perdiendo las tablas temporales, la base de datos actual y la configuración de sesión— solo porque el servidor tarde demasiado en responder a un ping. #111990 (Alexey Milovidov).- Utiliza la optimización de condiciones transitivas de forma más inteligente: el filtro adicional creado por transitividad ahora se usa solo para el análisis de índices cuando no se puede aplicar el filtro completo. Consulte la configuración
optimize_and_compare_chain. #112076 (Yarik Briukhovetskyi). - Añade dos configuraciones,
shrink_over_allocated_columns_min_waste_ratioyshrink_over_allocated_columns_min_waste_bytes, que hacen que los INSERT reduzcan las columnas con sobreasignación de memoria (cuya memoria reservada supera la utilizada debido al crecimiento en potencias de dos de las columnas de longitud variable) antes de la materialización y la escritura de partes, lo que reduce el uso máximo de memoria. Están deshabilitadas de forma predeterminada. #112161 (Pavel Kruglov). - La replicación diferida de columnas para
ARRAY JOINya no se pierde al serializar un plan de consulta. Conserialize_query_plan = 1, el nodo que ejecutaba un fragmento de plan remoto solía ignorarenable_lazy_columns_replicationy siempre materializaba cada copia replicada, aunque esta opción está habilitada de forma predeterminada. #112330 (Groene AI). - El formateo de valores
Decimalcomo texto es mucho más rápido: hasta 190 veces más para unDecimal256con una escala grande y aproximadamente 1,6 veces más para unDecimal64. En procesadores con AVX-512 IFMA, la conversión de enteros de 64 bits a texto es aproximadamente 1,4 veces más rápida. También se corrigió el redondeo detoDecimalString, que perdía un acarreo de la parte fraccionaria:toDecimalString(toDecimal64('9.995', 3), 2)devolvía9.00y ahora devuelve10.00. #112457 (Konstantin Bogdanov). - Una igualdad en
WHEREahora se incorpora a la condiciónJOINcuando sus operandos tienen tipos distintos pero un supertipo común, comoInt32yNullable(Int32). Esto permite convertir un CROSS JOIN en un INNER JOIN. #112630 (Hechem Selmi). - Las consultas en tablas Iceberg con muchos archivos de eliminación ahora se inician más rápido. ClickHouse lee y decodifica los archivos de manifiesto de eliminación de forma concurrente, en lugar de uno por uno, por lo que las lecturas de almacenamiento se superponen. La nueva opción
iceberg_delete_manifest_decode_concurrency(valor predeterminado:4) controla cuántos se decodifican simultáneamente. #112679 (Asya Shneerson). - El registro asíncrono ahora utiliza una cola acotada sin bloqueos: los hilos que escriben mensajes de registro nunca se bloquean en un mutex ni reactivan los hilos de registro. #112803 (Alexey Milovidov).
randomHadamardTransformaplicado a un vector constante ahora se evalúa una sola vez, en lugar de una vez por fila. Esto acelera las consultas de búsqueda vectorial que rotan el vector de consulta conrandomHadamardTransformantes de compararlo con una columnaQBit. #112921 (Alexey Milovidov).- Se restaura el uso compartido de conjuntos entre las tareas de partes de una mutación que filtra con
IN (subquery)en una columna de clave primaria.enable_sharing_sets_for_mutationsestá activado de forma predeterminada, pero el conjunto creado para el análisis de la clave primaria dejó de participar en la caché compartida, por lo que una tabla con N partes materializaba el mismo conjunto N veces. #112941 (Groene AI). - Se corrigió la complejidad cúbica de la planificación de consultas para un JOIN con una tabla
Mergesobre muchas tablas con estructuras diferentes. Anteriormente, estas consultas podían dedicar minutos a la planificación sin responder amax_execution_timeni aKILL QUERY. #113140 (Alexey Milovidov). - La caché de región de bucket del cliente
S3ahora también funciona con catálogos de lagos de datos; anteriormente, cada solicitud a estos volvía a resolver la región. #113330 (Konstantin Vedernikov). - Se corrigió una regresión de rendimiento por la que una agregación sin claves
GROUP BYserializaba en cada ejecución todo el subárbol del plan de entrada, incluido el contenido completo de los literales evaluados como constantes, para calcular una clave de caché del tamaño de la tabla hash que nunca podía utilizar. Una consulta comoSELECT quantileMerge(arrayJoin(arrayMap(x -> state, range(5000000))))dedicaba aproximadamente 63 ms por ejecución a la optimización del plan de consulta y ahora dedica 0,15 ms. #113333 (Groene AI). - Añade la serialización opcional de UInt128/UInt256/Int128/Int256 como DECIMAL en Parquet para permitir la poda de grupos de filas y páginas. #113347 (Ivan Babrou).
- Acelera la planificación de consultas cuando se utilizan estadísticas de columna
uniq_v2. El número estimado de valores distintos ahora se almacena en caché en lugar de recalcularse en cada solicitud, algo que la planificación de consultas realiza muchas veces por consulta. (issue #113038). #113357 (Groene AI). - No preobtiene subflujos innecesarios al leer una ruta JSON completa de datos compartidos avanzados. #113380 (Pavel Kruglov).
- La aplicación de filtros ahora funciona para subcolumnas
Tupleen archivos Parquet y ORC. Un predicado comoWHERE tup.1 = 555555aplicado afile,s3ourlahora poda grupos de filas e intervalos del índice de filas usando las estadísticas del propio elemento de la tupla, en lugar de leer el archivo completo. #113383 (Groene AI). - Sustituye el mapa hash por bucket dentro de las funciones de agregado
timeSeries*ToGridpor una matriz plana y ordenada de muestras: la ingestión de muestras se convierte en una operación de adición O(1) para entradas en orden (el caso abrumadoramente más habitual) y elimina la copia y ordenación por bucket durante la finalización. #113681 (Nikita Mikhaylov). - Mejora el rendimiento de las consultas PromQL sobre el motor TimeSeries: el SQL interno del selector ahora lee directamente las columnas de clave primaria de la tabla de muestras (sin conversiones sin efecto) y comprueba el rango de marcas de tiempo antes del conjunto de ID de serie, lo que hace que las consultas en frío con muchos selectores sean entre un 30 % y un 44 % más rápidas. #113768 (Nikita Mikhaylov).
- Usa mapas de ID tipados en el recolector de etiquetas de series temporales. #113839 (Vitaly Baranov).
- Omite la comprobación redundante de ordenación al escribir partes de MergeTree cuyas claves de ordenación son todas constantes. #113899 (Perfloop Agent).
- Los selectores PromQL que coinciden con todas las series de una métrica ahora filtran la tabla de muestras de una tabla
TimeSeriesmediante un rango continuo de clave primaria eniddurante el análisis de índices, en lugar de usar una condición grandeid IN <set>, cuando el diseño de ID es una tupla de dos componentes con el generador canónico de ID. Elimina el coste dominante del análisis de índices monohilo en consultas PromQL con muchos selectores: hasta un −45 % de latencia en frío para patrones de consultas de paneles y reglas, y un −11 % de media geométrica en frío en toda la suite sobre una tabla de 62 mil millones de muestras. #114131 (Nikita Mikhaylov). - Acelera las transformaciones vectorizadas de etiquetas de TimeSeries sustituyendo la reasignación basada en hash por indexación directa cuando los ID de grupos de etiquetas ocupan un rango compacto. #114244 (Minh Vu).
- Los endpoints de la API HTTP de Prometheus
/api/v1/queryy/api/v1/query_rangeahora evalúan una subconsulta PromQL compartida por varios pasos del plan una sola vez, como ya hacían las funciones de tablaprometheusQueryyprometheusQueryRange. Anteriormente, una solicitud realizada conenable_analyzer = 0, o por un usuario cuyo perfil lo establece, volvía a recorrer la subconsulta compartida una vez por cada paso que la referenciaba. #114261 (Groene AI). - Se limitó el coste de estimar la selectividad de
col IN (...)a partir de estadísticas de columnas, lo que podía añadir cientos de milisegundos a la planificación de una sola consulta. El estimador ya no ejecuta la subconsulta decol IN (subquery)para rellenar un conjunto del que solo necesita un valor de selectividad; en su lugar, se omite el conjunto sin construir. Para conjuntos mayores que el nuevo ajustestatistics_max_set_size_for_exact_selectivity_estimation(10000 de forma predeterminada), la selectividad se deriva ahora del tamaño del conjunto y de su rango delimitador. #114389 (Nikita Taranov). - El análisis de una solicitud HTTP que contiene muchos parámetros de consulta o encabezados con el mismo nombre (por ejemplo, miles de parámetros
role=repetidos) ya no requiere tiempo cuadrático. #114410 (James). - Se corrigió una regresión en 26.7: en una tabla
MergeTreeordenada portoUnixTimestamp(u otra conversión a entero) de una columnaDateTime64, un filtro de rango simple sobre esa columna dejó de usar la clave primaria y leía todos los gránulos de las partes coincidentes. Además, un filtro comotoInt64(ts) >= cen una tabla ordenada por la columnaDateTime64sin transformar ahora usa la clave primaria. #114413 (Alexey Milovidov). - La costosa comprobación de consistencia de
ColumnArrayahora solo se realiza en compilaciones de depuración. #114469 (Anton Popov). - Se evita la ordenación por mezcla de una recopilación distribuida cuando su descripción de ordenación es totalmente constante. #114626 (Groene AI).
- Se acelera la creación de conjuntos para
IN (subquery)en tablasMergeTreeparticionadas al mantener las filas de cada partición en un único flujo y eliminar los duplicados de cada flujo de forma independiente, de modo que la única transformación que rellena el conjunto —que antes aplicaba hash serialmente a cada fila— solo procesa filas únicas. Esto se aplica cuando la expresión de partición es una función determinista de las columnas de salida de la subconsulta. La optimización no se aplica cuando la partición más grande contiene más del doble de filas que la partición media; el nuevo ajusteforce_creating_set_partitions_independently(deshabilitado de forma predeterminada) omite esta comprobación. Se controla mediante el nuevo ajusteallow_creating_set_partitions_independently(habilitado de forma predeterminada). #114645 (Nihal Z. Miaji). - Se paraleliza la conversión de un nivel a dos niveles de los estados de agregación por hilo antes de fusionarlos. Esto corrige una regresión de 2-3x en consultas cortas con
GROUP BYy estados de agregación pesados (p. ej.,COUNT(DISTINCT ...), ClickBench Q10/Q11) en máquinas con muchísimos núcleos, introducida en las compilaciones de desarrollo de 26.7 al hacer preciso el cálculo de memoria de la agregación. #114691 (Alexey Milovidov). - Se aceleran las funciones de agregación
timeSeries*ToGrid: los cálculos de buckets por muestra ahora evitan la división Int128, y las muestras consecutivas del mismo bucket omiten la búsqueda en el mapa hash. #114889 (Nikita Mikhaylov). - Al añadir elementos a una cola de registros del sistema, ya no se realiza una copia profunda de toda la cola cuando esta crece. #115030 (Groene AI).
- Se procesan las muestras de las funciones de agregación
timeSeries*ToGriden secuencias de muestras consecutivas que caen en un mismo bucket de la cuadrícula, lo que acelera entre 1,2 y 2 veces la etapa de ingesta de muestras detimeSeriesRateToGridy funciones relacionadas en datos de series temporales ordenados. #115041 (Nikita Mikhaylov). - Usa máscaras de presencia compactas para los operadores de conjuntos de PromQL. #115224 (Minh Vu).
- Evaluación más rápida de consultas instantáneas de PromQL: las funciones de agregación
timeSeries*ToGridusan la ruta vectorizada de clasificación de muestras para cuadrículas de un solo punto, ytimeSeriesIdToGrouprellena directamente su columna de resultados. #115267 (Nikita Mikhaylov). - Un
JOINcuya secciónONcontiene varias igualdades unidas medianteORya no materializa las columnas clave del lado derecho que no selecciona la consulta. #115465 (Nikita Taranov). - Al especificar un tipo
DateTimeoDateTime64, ya no se crea una tabla de búsqueda de zonas horarias UTC que no se utiliza, lo que agiliza la construcción de estos tipos y, por tanto, el inicio declickhouse localyclickhouse client. #115488 (Konstantin Bogdanov). - Al adjuntar las tablas del sistema, ya no se copian dos veces los metadatos de cada tabla, incluida la descripción completa de sus columnas, solo para establecer el comentario de la tabla. #115490 (Konstantin Bogdanov).
- El hostname del client ahora se resuelve la primera vez que se informa, en lugar de en cada invocación de
clickhouse clientyclickhouse local. #115491 (Konstantin Bogdanov). - Se corrigió la complejidad cuadrática al construir resultados sobre muchas filas con las funciones
h3kRing,h3ToChildren,h3PolygonToCellsyh3PolygonToCellsWithContainment. Una consulta sobre 196 000 filas dedicaba 838 segundos a copiar memoria en una ejecución de estrés de CI; ahora tarda unos 5 segundos. #115773 (Groene AI). - Acelera las comprobaciones de series duplicadas para vectores de condición de PromQL con todos los valores en cero. #115822 (Minh Vu).
- Acelera
GROUP BYsin funciones de agregación sobre clavesString,FixedStringyLowCardinality: la consulta ya no reescribe un marcador de posición no utilizado en la tabla hash para cada fila, sino solo para las filas que añaden una clave nueva. #115834 (Nikita Taranov). - Acelera
toUTCTimestamp/to_utc_timestampyfromUTCTimestamp/from_utc_timestamppara argumentosDateTime64, restaurando el rendimiento que tenían antes de la corrección de overflow en #109738. Los resultados no cambian. Cierra #115802. #115838 (Groene AI). - Redujo el uso de memoria y el tiempo de optimización del plan de consulta para agregaciones con clave sobre grandes literales sometidos a plegado de constantes. La clave de caché de las estadísticas de la tabla hash de agregación ahora se calcula como hash durante su serialización, en lugar de acumularse primero en memoria, por lo que un plan que contiene un literal grande ya no conserva una copia de este durante la optimización. Para un literal de 80 MB, la memoria máxima se reduce en unos 250 MB y el tiempo de optimización aproximadamente 2,5 veces. La clave calculada no cambia. #115847 (Groene AI).
Mejora
- Las solicitudes HTTP salientes en formato OpenAI ahora se etiquetan con el nombre SQL de la función de IA invocadora para identificar el endpoint ascendente. #110449 (George Larionov).
- Se reduce la latencia de cancelación de las formas positivas de
LIMIT BY:KILL QUERYy Ctrl+C ahora interrumpen en un único fragmento, en lugar de esperar a que finalice todo el paso. #106070 (Roman Vasin). - Cuando un
INSERTfalla porque la tabla de destinoTOde una vista materializada rechaza la escritura durante la creación de la canalización de inserción, el mensaje de error ahora indica la vista materializada y su tabla de destino, en lugar de informar solo del error de almacenamiento. #107234 (Groene AI). - Con
input_format_protobuf_oneof_presence, ClickHouse ya no requiere que la enumeración de presenciaoneofincluya exactamente las etiquetas declaradas en el esquema Protobuf: ahora se permiten etiquetas adicionales sin columnas correspondientes en la tabla de destino, lo que facilita los cambios de esquema. #109174 (Ilya Golshtein). - Las funciones de distancia transpuestas sobre
QBit(L2DistanceTransposed,cosineDistanceTransposed,dotProductTransposedy sus variantes cuantizadas) ahora aceptan un vector de referencia más largo que el número de dimensiones buscadas e ignoran los elementos finales adicionales. Esto permite reutilizar un vector de consulta de tamaño completo para una búsqueda Matryoshka de dimensión reducida sin tener que segmentarlo primero. #109388 (Alexey Milovidov). - La subestadística
NullCountde las estadísticasbasicpasa a llamarseDefaultCounty ahora cuenta las filas iguales al valor predeterminado del tipo de columna, no solo las filasNULLde columnasNullable. #109977 (Han Fei). - Se admiten escrituras simultáneas en tablas
Icebergen disco local:LocalObjectStorageahora implementa escrituras condicionales, por lo que el mecanismo de comparación e intercambio que publica una nueva instantánea medianteversion-hint.textfunciona también allí y los escritores simultáneos no pueden perder las actualizaciones de los demás. #112556 (Alexey Milovidov). ALTER TABLE ... MOVE/REPLACE PARTITIONentre dos tablasMergeTreecon granularidad incompatible ahora generaBAD_ARGUMENTSen lugar deLOGICAL_ERROR. #110535 (Groene AI).- El formato
Valuesya no registra falsos errores de análisis ensystem.errorsysystem.error_logcuando el análisis en streaming recurre correctamente al análisis de expresiones SQL. #111141 (Pablo Marcos). - Se añadió el
ProfileEventDuplicationDataHashComputations, que cuenta los cálculos de hash de datos por columna realizados al eliminar duplicados de bloquesINSERTen tablas*MergeTree. #111173 (Valery Petrov). - Se resaltan los comandos
./clickhouseysudo ./clickhouse installen la salida del script de instalación universal. #111514 (Alexey Milovidov). - Los joins cartesianos y los joins con predicados constantes planificados por el analizador ya no fallan debido a una configuración incompatible de
join_algorithmcuando se utiliza el analizador. #108289 (János Benjamin Antal). bitmaskToArrayybitmaskToListahora admiten argumentosInt128,UInt128,Int256yUInt256.bitPositionsToArraytambién es más rápida para argumentos de enteros grandes, ya que ahora escala según el número de bits establecidos, en lugar de según la posición del bit establecido más alto. #110743 (Manuel).- Se corrigió un bloqueo en expresiones compiladas con JIT en compilaciones nativas de macOS/aarch64 desde el código fuente, mediante el uso del triple de host de LLVM correcto para el sistema operativo anfitrión. #111591 (Raúl Marín).
- Se corrigieron
JSON_EXISTS,JSON_VALUEyJSON_QUERYcon entradasDynamiccuando los argumentos de ruta de tuplas contienen elementosLowCardinality, lo que evita excepcionesLOGICAL_ERROR. Cierra #110345. #109944 (Groene AI). - Los archivos
ORCcorruptos cuyo árbol de tipos declara más columnas que el pie de página de la franja ahora hacen que la inferencia de esquema falle conCANNOT_EXTRACT_TABLE_STRUCTURE, en lugar de abortar en compilaciones de depuración/con sanitizador. #110967 (Groene AI). - Las tablas de registros del sistema rotadas, como
system.metric_log, ahora se pueden marcar comotable_readonlyincluso cuando sus metadatos superanmax_query_size, por lo que la rotación ya no registraQUERY_IS_TOO_LARGEy continúa con normalidad. #111703 (Alexey Milovidov). - En Play, se añadió un botón para cerrar todas las pestañas excepto la actual. #111835 (Mikhail Artemenko). Se corrigió el foco del teclado tras activarlo con Intro o Espacio cuando el botón se oculta. #111899 (Alexey Milovidov).
- En Play, al mantener pulsado
Ctrl(Cmden Mac) mientras se pasa el cursor sobre una celda de tabla cuyo valor es una URL de imagen, ahora se muestra una vista previa de la imagen. #109347 (Alexey Milovidov). - En Linux, ClickHouse ahora añade una entrada a
system.warningsal iniciarse cuandorseqno está disponible, ya que los contadores de perfil por CPU recurren entonces a la rutasched_getcpu, más lenta. #109283 (Azat Khuzhin). COUNT(*)sobre la función de tablafileya no lanza una excepción cuando la inferencia de esquema envuelve las columnas enNullable. Cierra #102044. #102509 (Rory Shanks).- Las funciones
L1Normalize,L2Normalize,LinfNormalizeyLpNormalize(y sus alias) ahora funcionan con argumentosArray, no solo con argumentosTuple, de forma coherente conL2Normy las funciones de distancia. #110052 (Alexey Milovidov). - Se eliminó el lector heredado de
ORCbasado en Apache Arrow. El formato de entradaORCahora siempre utiliza el decodificador nativo de ClickHouse, que ya era el predeterminado. La configuracióninput_format_orc_use_fast_decoderestá obsoleta y no tiene efecto. #110074 (Alexey Milovidov). - Hizo configurables desde XML argumentos habituales de
clickhouse-client(<hints/>,<highlight/>,<echo/>,<echo_query_id/>,<echo_formatted/>,<print-profile-events/>) y conservó los valores de configuración del cliente cuando se omiten las opciones de CLI correspondientes con valores predeterminados, para ajustes comohistory_max_entries,suggestion_limit,progress,progress-table,enable_progress_table_toggle,print-memory-to-stderr,chime-threshold-secondsyprofile-events-delay-ms. #110607 (Larry Snizek). - Añadió el ajuste
analyzer_compatibility_apply_final_to_all_joined_tablespara restaurar el comportamiento anterior, en el queFINALen la tabla más a la izquierda de unJOINtambién se aplica a las demás tablas unidas. El ajuste se registra en el historial de cambios de ajustes, por lo quecompatibilitycon versiones anteriores a la 26.6 restaura automáticamente la semántica anterior. #111589 (Nikita Fomichev). - En Play, el botón
+(nueva pestaña) ahora se muestra con la altura correcta en Firefox. #109524 (Alexey Milovidov). - Una subconsulta
EXISTScorrelacionada y anidada que hace referencia a una columna de un ámbito situado más allá de su consulta externa inmediata ahora falla conNOT_IMPLEMENTEDen lugar de la excepción internaNOT_FOUND_COLUMN_IN_BLOCK. #110310 (Groene AI). - El formateo de una consulta
EXECUTE ASdespués de reescrituras del AST ya no genera una excepción del lado del cliente, por ejemplo, en el fuzzer de AST. #111725 (Groene AI). - Mejora la compatibilidad de las consultas
DESCRIBEcon vistas parametrizadas y permite usar vistas parametrizadas en expresiones escalares con el nuevo analyzer. Cierra #66307. Cierra #69598. #68978 (Dmitry Novik). - Las expresiones
CREATE INDEXyCREATE HYPOTHETICAL INDEXmalformadas que no superan un ciclo de formato-análisis-formato ahora generan una excepción en lugar de provocar el error lógicoInconsistent AST formattingen compilaciones de depuración y con sanitizadores. #109175 (Groene AI). - Web UI: corrige el problema por el que el campo de usuario/contraseña permanece en rojo incluso cuando las credenciales son correctas y el servidor es accesible, y vuelve a comprobar las credenciales tras editar la conexión para que un valor correcto se muestre en verde. #109414 (Alexey Milovidov).
- Añadió los ajustes
text_index_max_processed_tokens_before_flushytext_index_max_memory_usage_before_flushpara controlar cuándo los creadores de índices de texto vacían segmentos temporales. #111573 (Rory Shanks). - Añadió el ajuste
system_cache_extensionspara controlar qué extensiones de archivo se almacenan en la caché del sistema cuandouse_split_cacheestá habilitado. #111575 (Kirill). - Los mensajes de error en compilaciones basadas en musl ahora muestran el texto de
strerrorlegible para humanos en lugar de un valor vacío o numérico, comostrerror: 0. #111620 (Konstantin Bogdanov). - El tipo de almacenamiento efectivo de las colecciones con nombre ahora está disponible como
named_collections_storage.typeensystem.server_settingsy mediantegetServerSetting('named_collections_storage_type'). #111806 (Pablo Marcos). - Flexibiliza una comprobación excesivamente estricta del tamaño de la permutación en
ColumnReplicated::permutepara que respete el contrato general deIColumn::permute, que permite una permutación más corta que la columna cuando se establece un límite. #109897 (Groene AI). - Mejora la planificación de consultas de streaming al unificar el plan interno de lectura de streaming, lo que evita optimizar dos veces las lecturas directas de índices de texto. #111821 (Mikhail Artemenko).
- UI web: el espacio entre los botones
Run oneyRun allahora coincide con el margen izquierdo antes del primer botón. #111988 (Alexey Milovidov). - La planificación de reservas de memoria (experimental) ya no desaloja una asignación cuando una liberación de memoria pendiente liberaría el espacio necesario para aumentar una reserva por encima del límite: la decisión de desalojo ahora espera a que se apliquen las reducciones en curso, lo que evita cancelaciones innecesarias de consultas bajo presión de memoria. #112299 (Sergei Trifonov).
- Iceberg v2 requiere
sequence_numberen los archivos de manifiesto, pero otros motores, como BigQuery, pueden escribir archivos de manifiesto sin él. ClickHouse ahora puede leer esas tablas. #112431 (Konstantin Vedernikov). - Muestra una advertencia cuando faltan estadísticas para la reordenación de join. #107666 (Vladimir Cherkasov).
- Se añadieron columnas de compatibilidad con MySQL a las vistas
INFORMATION_SCHEMA:SCHEMATA.DEFAULT_COLLATION_NAMEyDEFAULT_ENCRYPTION;TABLES.ENGINEy otras columnas relacionadas con MySQL; yCOLUMNS.COLUMN_KEY,PRIVILEGES,GENERATION_EXPRESSION,SRS_ID. Esto permite que los clientes compatibles con MySQL ejecuten consultas de introspección de catálogo sin encontrarUNKNOWN_IDENTIFIER. #109351 (Alexey Milovidov). - Una referencia sin calificar a una clave de
INNER JOINigualada en la condiciónON(por ejemplo,SELECT id FROM a INNER JOIN b ON a.id = b.id) ya no se informa como un identificador ambiguo, ya que se garantiza que ambos lados contienen el mismo valor. #109366 (Alexey Milovidov). - Devuelve el código HTTP
403 Forbidden(en lugar de500 Internal Server Error) para excepcionesACCESS_DENIEDa través de la interfaz HTTP. #111043 (Schum). - Escribe el SST del índice UNIQUE KEY directamente en el almacenamiento de la parte, en lugar de prepararlo en un archivo temporal local, lo que elimina la dependencia de un volumen temporal local y evita una copia adicional. #111189 (johnjing).
UTMToGeoahora acepta como cuarto argumento la letra de la banda de latitud MGRS devuelta porgeoToUTM(además de la marca entera de hemisferio), de modo que un resultado degeoToUTMpuede convertirse directamente de ida y vuelta medianteUTMToGeo. #111521 (Alexey Milovidov).- Corrige un
LOGICAL_ERROR(“El índice min-max de nivel de parte se construyó a partir de un conjunto de columnas inesperado”) que podía abortar una fusión en segundo plano en compilaciones de depuración con sanitizador después de reducirpart_minmax_index_columns(por ejemplo, dewith_block_number_offsetapartition_key_only). #111511 (Groene AI). - Corrige la subestimación en
ProfileEvents['JoinResultRowCount']del tamaño del resultado de unJOINque se desborda a disco. Las filas emitidas desde buckets retrasados solo se contabilizaban enJoinDelayedJoinedTransformRowCounty no se incluían en el total. Los resultados de las consultas siempre fueron correctos; solo era incorrecto el evento de perfil. #112673 (Groene AI). SYSTEM DISABLE FAILPOINTahora rechaza los nombres de puntos de fallo inexistentes y generaBAD_ARGUMENTS, como ya hacíaSYSTEM ENABLE FAILPOINT. Anteriormente, un nombre mal escrito indicaba que la operación se había realizado correctamente, pero dejaba habilitado el punto de fallo previsto, sin indicar que no se había deshabilitado nada. #112680 (Groene AI).- Se añadió una nueva columna,
skipping_indices_types, a la tablasystem.tables. Contiene los tipos distintos de índices de omisión de datos definidos para cada tabla. #106388 (Anton Popov). - Se añadió una comprobación de coherencia para garantizar que una consulta distribuida siempre incluya una versión de cliente conocida, generando un error lógico en lugar de reenviar silenciosamente una versión cero a los segmentos remotos. Las consultas iniciadas por el servidor (vaciados en segundo plano, consumidores de streaming, recargas de diccionarios y vaciados de inserciones asíncronas) ahora informan de la propia versión del servidor como versión del iniciador. #109408 (Alexey Milovidov).
- Se redujo la verbosidad de los diagnósticos de búsqueda binaria de la clave principal por parte en
MergeTree, cambiándolos del registro de trazas al registro de pruebas. #110324 (Alexey Milovidov). - La ruta de ejemplo de particionamiento Hive para tablas de almacenamiento de objetos (p. ej.,
S3) se resuelve al usar la tabla por primera vez, en lugar de duranteCREATE/ATTACH, por lo que un endpoint inaccesible ya no bloquea la creación de tablas ni el inicio del servidor. #111842 (Nikolay Degterinsky). - Se corrigió
ReadBufferFromPocoSocketBase::setReceiveTimeout, que aplicaba su argumento como segundos en lugar de microsegundos, así como las compilaciones configuradas con-DENABLE_LIBFIU=OFF, que no compilaban. En compilaciones sin libfiu,SYSTEM ENABLE FAILPOINTy los comandos relacionados ahora generan una excepción en lugar de no hacer nada silenciosamente. #112767 (Alexey Milovidov). - Corrige la subestimación de
rows_ready otros contadores de progreso por parte declickhouse-localen lasstatisticsde la salidaJSON/XMLy en la barra de progreso: se descartaba un incremento de progreso que llegaba mientras se ensamblaba el paquete de progreso. #112958 (Alexey Milovidov). - Se corrigió el error informado cuando un
INSERTasíncrono en una tablaDistributednecesita un directorio de cola cuyo nombre supera el límite de 255 bytes del sistema de archivos (posible conuse_compact_format_in_distributed_parts_names = 0). Era unLOGICAL_ERRORpara un segmento coninternal_replicationy unCode: 1001. std::exceptionsin atribución en otros casos; ahora ambos informanARGUMENT_OUT_OF_BOUNDe indican la tabla, el clúster y el límite. #113083 (Groene AI). - Rechaza los límites de cuota de
execution_timefuera de rango conBAD_ARGUMENTS, en lugar de depender de un comportamiento indefinido al escalarlos a nanosegundos internos. #113178 (Alexey Milovidov). - Las réplicas paralelas automáticas ahora admiten consultas
JOIN. #106073 (Nikita Taranov). - Se admite la autenticación con token de actualización para el catálogo
OneLake. #110413 (alesapin). - La configuración de
Keeperwrite_snapshot_versionahora admite recarga en caliente. #112150 (alesapin). - Paraleliza
SYSTEM DROP FILESYSTEM CACHE. #112532 (Kseniia Sumarokova). - El anidamiento no admitido de una vista
SQL SECURITY DEFINERoSQL SECURITY NONEsobres3Cluster,urlClusterofileClusterahora se rechaza con un error de consulta normal, en lugar de generar unLOGICAL_ERRORen compilaciones de depuración y con sanitizadores. #113371 (Groene AI). - Se añadió la configuración
analyzer_compatibility_multiple_joins_qualify_column_names(valor predeterminado:false). Cuando está habilitada y la cláusulaFROMde una consulta contiene dos o másJOIN, los nombres de las columnas de resultado generados por el analizador imitan la reescritura de múltiples joins del analizador anterior: las columnas expandidas desde*se denominan<alias-or-table>.<column>, y una referencia a una columna sin alias en la listaSELECTconserva exactamente el nombre con el que se escribió. Esto permite que las consultas externas que hacen referencia a esos nombres calificados, comoSELECT ll.Date FROM (SELECT * FROM t AS ll JOIN t1 ON ... JOIN t2 ON ...), funcionen como lo hacían con el analizador anterior. También corrige la pérdida de nombres calificados de columnas de resultado por parte del analizador para las columnas expandidas desde*cuandogroup_by_use_nullsse combina conROLLUP,CUBEoGROUPING SETS, lo que producía nombres de columnas de resultado duplicados e impedía referencias externas a esas columnas. #110746 (Dmitry Novik). - Se cambió el nombre de
allow_experimental_delta_kernel_rsaallow_delta_kernel_rs. El nombre anterior se conserva como alias. #113476 (Kseniia Sumarokova). - Cuando se proporciona una colección con nombre inexistente a las funciones de tabla
remote/remoteSecureo a los motores de tablaRemote/RemoteSecurejunto con una anulaciónkey = value, ClickHouse ahora informa de la colección con nombre inexistente en lugar de volver a analizar la llamada de forma posicional e informar de un error no relacionado. #113510 (Groene AI). - El inicio de la shell con la autocompletación de
clickhouse-bootstrapya no muestra variables de entorno cuando la autocompletación se carga desde el hook de autocompletación del usuario. #113694 (Azat Khuzhin). - Se añadió el valor
sainte_lagueparashared_merge_tree_merge_coordinator_distribution_algorithm, que ahora es el valor predeterminado en lugar dewater_filling. #113442 (Mikhail Artemenko). - Se añadió la configuración
filesystem_cache_wait_for_concurrent_download_timeout_millisecondspara limitar el tiempo que una lectura espera a que finalice la descarga, en la caché del sistema de archivos, de un único fragmento (de aproximadamente 1 MiB) por parte de otra consulta, y no de un segmento de archivo completo. #113322 (Kseniia Sumarokova). - Se añadió la configuración de Keeper
min_time_between_fsyncs_ms(valor predeterminado:5ms), que agrupa las adiciones al changelog que llegan poco después del vaciado anterior, en lugar de iniciar otro vaciado inmediatamente. #113749 (Michael Kolupaev). - Las tablas Kafka con offsets almacenados en Keeper (
kafka_keeper_path) ahora generanABORTEDen lugar deLOGICAL_ERRORcuando la tabla queda inactiva tras perder una sesión de Keeper, por ejemplo durante una lectura directa o la transmisión de una vista materializada. #113913 (Alexey Milovidov). - Se corrigió el formato incoherente del AST de
viewIfPermitted: la forma de función de tabla ya no formatea incorrectamente un operador comonoten su ramaELSE, y la forma de expresiónviewIfPermitted(...)ya no recibe unELSEespurio. #113652 (Alexey Milovidov). - Se corrigió un error espurio
Failed to drop temporary table after refresh. Table ... is left behind and requires manual cleanup.que se registraba al cancelar la actualización de una vista materializada actualizable (por ejemplo, al apagar el servidor) mientras estaba habilitadodatabase_atomic_wait_for_drop_and_detach_synchronously. En realidad, la tabla temporal se eliminaba, por lo que no era necesaria ninguna limpieza manual. #113957 (Groene AI). - El servidor ahora genera
UNKNOWN_ELEMENT_IN_CONFIGcuando encuentra opciones desconocidas en su configuración, lo que ayuda a detectar pronto errores tipográficos y opciones mal configuradas. La comprobación se puede deshabilitar con<skip_check_for_incorrect_settings>. #100332 (Alexey Milovidov). - En la interfaz web, el historial del navegador y la URL ya no se actualizan con cada pulsación de tecla; se guardan al ejecutar correctamente una consulta o al cambiar de pestaña. #113596 (Alexey Milovidov).
- ClickHouse ahora informa de un desbordamiento de pila en lugar de finalizar silenciosamente: los controladores de señales fatales se ejecutan en una pila de señales alternativa, por lo que
SIGSEGV,SIGABRT,SIGILL,SIGBUS,SIGSYS,SIGFPEySIGTRAPgeneran un seguimiento de pila incluso cuando el hilo que provocó el fallo ha agotado su pila. #113927 (Groene AI). ALTER TABLE ... MODIFY COLUMN <col> Tuple(...)en unTuplecon nombre ahora es una operación de solo metadatos cuando solo se añaden subcampos, con una velocidad equivalente a la deADD COLUMNde nivel superior. Se habilita conSETallow_metadata_only_named_tuple_alter= 1. #107305 (Amos Bird).- Se añade la configuración
input_format_json_max_object_sizepara limitar el tamaño de los objetos JSON durante el análisis. Cierra #106704. #107669 (Pavel Kruglov). - Se evita registrar
sasl.kerberos.kinit.cmd configuration parameter is ignored.en configuraciones del motorKafkaque no usan autenticación Kerberos mediante keytab. #108235 (Ivan Shelestov). - Se añade system.s3(azure)_queue_metadata. #108522 (Kseniia Sumarokova).
- Los fallos de conexión tolerados con bases de datos MySQL/PostgreSQL remotas ahora se registran como advertencias en lugar de errores. #109472 (Shaohua Wang).
- Cuando no se especifican ni
portnisecure,clickhouse-clientprueba simultáneamente el puerto predeterminado 9000 y el puerto seguro 9440, y utiliza el que responde primero. Así,clickhouse-client --host play.clickhouse.com --user playse conecta mediante TLS sin--secure, aunque el puerto sin cifrar de ese servidor se descarta silenciosamente en lugar de rechazarse. Si el puerto que respondió resulta inutilizable —por ejemplo, un puerto seguro con un certificado no confiable—, el cliente recurre al otro, ya que el protocolo no se solicitó explícitamente. #110130 (Alexey Milovidov). - Al hacer clic en el logotipo de la nube en el Playground, ahora se abre el sitio web de ClickHouse en una pestaña nueva para que no pierdas el progreso mientras se ejecutan las consultas. #110422 (William Hatcher).
- Se añadió el modificador STREAM BOUNDED, que lee solo la primera instantánea de una consulta de streaming y luego finaliza, en lugar de suscribirse a actualizaciones. #110653 (Smita Kulkarni).
- Se añadió información sobre el estado interno de las uniones a
EXPLAIN ANALYZE. #110892 (Kirill Kopnev). - Cuando se activa una aserción de reentrada de
RWLockImpl::getLock()(RWLock is already locked in exclusive mode/Cannot acquire exclusive lock while RWLock is already locked), el mensaje de error ahora indica qué otrosquery_idposeen el bloqueo y cuántos bloqueos ya mantiene elquery_idsolicitante, lo que permite diagnosticar estos errores de orden de bloqueo. #110971 (Groene AI). - ClickHouse Keeper ahora registra el evento “Client has not sent any data” en el nivel
Informationen lugar deWarning, igual que el manejador TCP del servidor. Esto evita advertencias espurias de las sondas de comprobación de estado TCP (por ejemplo, las sondas de actividadtcpSocketde Kubernetes), que abren e inmediatamente cierran una conexión al puerto de cliente de Keeper. #111217 (Zeynel). MaterializedPostgreSQLahora conserva los valoresTOASTde PostgreSQL que no han cambiado durante las actualizaciones, en lugar de reemplazarlos por valores predeterminados. #111552 (OrpheusAgent).- keeper: Se aumentó el valor predeterminado de
write_snapshot_versiona 8 y ahora se puede recargar en caliente. #111715 (Michael Kolupaev). - Se añadió el modificador STREAM UNORDERED: omite la ordenación por orden de confirmación de cada instantánea. #111794 (Smita Kulkarni).
- Se añadió una nueva configuración de MergeTree,
text_index_version, que controla la versión del formato en disco de los índices de texto:v0_initial,v1_with_codecov2_with_positions. Durante una actualización progresiva o antes de una reversión de versión, establécela en una versión anterior para que los servidores más nuevos sigan escribiendo partes de índices de texto en un formato que los servidores más antiguos aún puedan leer; la configuración de compatibilidad la ajusta automáticamente. #111803 (Anton Popov). - Las funciones de texto de IA (
aiGenerate,aiClassify,aiExtract,aiTranslate) ahora rechazan respuestas del proveedor truncadas o incompletas por otros motivos (por ejemplo, cuando el modelo alcanza el límite demax_tokens) en lugar de devolver silenciosamente resultados parciales. El comportamiento se rige por la configuraciónai_function_throw_on_error. #111830 (George Larionov). - Se mejoraron
L2DistanceTransposedQuantized,cosineDistanceTransposedQuantizedydotProductTransposedQuantizedde precisión reducida al reconstruir códigosQBit(Int8)conp < 8mediante centroides de prefijo de media condicional gaussiana. La precisión completa (p = 8) sigue siendo exacta a nivel de bits; las distancias aproximadas de precisión reducida pueden cambiar y las mejoras en recuperación y latencia dependen de la carga de trabajo. #111867 (Sergey Kuznetsov). - Se corrigió un problema por el que la caché de condiciones de consulta no se rellenaba para los gránulos eliminados por cualquier conjunción salvo la última de una cláusula
WHEREcon varias condicionesAND. #112083 (Shankar Iyer). - Se añadió una nueva configuración,
input_format_json_max_string_column_growth_step, que limita el crecimiento en potencias de dos de los búferes internos de String al crear una columna JSON, lo que reduce el pico de memoria al insertar documentos JSON grandes. Está desactivada de forma predeterminada. #112159 (Pavel Kruglov). - Se redujo el pico de memoria al escribir columnas JSON con serialización de datos compartidos con buckets (
map_with_bucketsy avanzada), al dividir los datos compartidos en buckets de uno en uno durante la escritura, en lugar de materializar todos los buckets simultáneamente. Esto resulta especialmente beneficioso para las columnas Array(JSON): en el caso de JSON escalar, los datos compartidos se dividen por gránulo (limitado por index_granularity_bytes), por lo que el ahorro es pequeño; en cambio, un único gránulo de Array(JSON) puede contener muchas filas anidadas y, por tanto, una gran cantidad de datos compartidos, por lo que dividirlos de un bucket a la vez reduce considerablemente el pico de memoria. #112172 (Pavel Kruglov). - La documentación de una configuración en
system.documentation—mostrada en la página integrada/docsy mediante el comandohelp— ahora incluye el historial de cambios de su valor predeterminado: la versión en la que se introdujo la configuración y cada cambio posterior de su valor predeterminado, junto con el valor anterior, el nuevo valor y el motivo del cambio. #112177 (Alexey Milovidov). EXPLAIN ANALYZEahora funciona con consultas en streaming. #112445 (Kirill Kopnev).- Los modificadores de una declaración de columna —
COMMENT,CODEC,STATISTICS,TTL,COLLATE,PRIMARY KEYySETTINGSpor columna— ahora pueden escribirse en cualquier orden enCREATE TABLE, y cada uno de ellos como máximo una vez. Anteriormente, solo se aceptaba un orden fijo y, por ejemplo,x UInt64 CODEC(ZSTD) COMMENT 'text'provocaba un error de sintaxis. EnALTER TABLE ... ADD COLUMN/MODIFY COLUMN, los modificadores compatibles —COMMENT,CODEC,STATISTICS,TTLySETTINGSpor columna— también pueden escribirse en cualquier orden;SETTINGSpor columna enADD COLUMNy unSTATISTICSdeclarado enADD COLUMN/MODIFY COLUMNahora se aplican en lugar de descartarse silenciosamente, yCOLLATEyPRIMARY KEYen estos comandosALTERahora generan una excepción en lugar de ignorarse silenciosamente. #112788 (Alexey Milovidov). - El método de lectura
pread_threadpoolrequiere la llamada al sistemapreadv2con el indicadorRWF_NOWAITpara leer los datos que ya se encuentran en la caché de páginas sin delegar la lectura a un grupo de hilos. Ahora, al iniciarse, se comprueba si puede usarse esa llamada al sistema y, si no es posible —porque el kernel de Linux es anterior a 5.11 o porque un perfilseccompde un entorno de ejecución de contenedores la rechaza—, el valor predeterminado delocal_filesystem_read_methodcambia apready se informa del motivo en el registro del servidor. Anteriormente, en esos sistemas cada lectura incurría en el coste de delegarla a un grupo de hilos, y un perfilseccompque respondíaEPERMhacía que las consultas fallaran conCANNOT_READ_FROM_FILE_DESCRIPTOR. #112945 (Alexey Milovidov). - Los metadatos thrift de Parquet malformados se notifican como INCORRECT_DATA. #113311 (Groene AI).
- Se corrigió el manejo del códec GCD de valores de ancho fijo con signo y números negativos. Anteriormente, calculaba el divisor directamente a partir de valores con signo, lo que podía no detectar el divisor común y reducir significativamente la eficiencia de compresión de las columnas de enteros y decimales con signo. Ahora calcula el divisor a partir de las magnitudes para los tipos con signo, manteniendo el comportamiento existente para los tipos sin signo y la descompresión. #113798 (Kirill Shcherbatov).
- Añade las opciones
enable_alp_codec,enable_sz3_codec,enable_zxc_codecyenable_quantized_codecpara habilitar cada códec de compresión experimental de forma independiente. #113824 (Raufs Dunamalijevs). - Permite aplicar
ALTER TABLE ... MODIFY COLUMNa una columna cuyas subcolumnas se utilizan en la clave primaria o de partición, siempre que las subcolumnas usadas en la clave conserven un tipo compatible en disco. Anteriormente, cualquier ALTER de este tipo estaba prohibido. #113862 (Pavel Kruglov). - Añade el dashboard
Filesystem cacheasystem.dashboards. #113884 (Kseniia Sumarokova). - Hace que los registros de caché de cada recarga de búfer solo se emitan con
filesystem_cache_verbose_logging. #113885 (Groene AI). - Cuando el tipo declarado de una columna y sus datos difieren durante una lectura de
MergeTree(por tipos de origen mixtos, por ejemplo, después de unALTER TABLE ... MODIFY COLUMNcuya mutación aún no ha finalizado), el servidor ahora informa de una excepción clara que indica la columna y ambas estructuras, en lugar de realizar una conversión no comprobada: anteriormente, las compilaciones de depuración y con sanitizador se abortaban con un simpleBad cast from type A to Bque no indicaba ninguna columna, y las compilaciones de lanzamiento recorrían silenciosamente memoria incompatible. #114087 (Alexey Milovidov). - Una función de ventana con
PARTITION BYahora funciona conmake_distributed_plan. Cuando la estructura del plan lo permite, la función de ventana se ejecuta en paralelo en buckets que reciben particiones completas. #114111 (Vighnesh Pathrikar). - UI web: el indicador de carga con forma de reloj de arena del panel de bases de datos vuelve a estar animado. #114187 (Alexey Milovidov).
- Ahora se utiliza una función hash de 64 bits para los métodos externos de agregación anulable de ancho fijo, lo que evita problemas graves de colisiones en agregaciones de cardinalidad muy alta. #114210 (Nikita Taranov).
- Las tablas
DistributedyBufferque omiten su lista de columnas ahora siempre infieren la estructura según los derechos de acceso del usuario que las crea. #114211 (Pedro Ferreira). x IN (subquery)sobre una columnaLowCardinalityahora devuelveLowCardinality(UInt8)— el mismo tipo quex IN (literal list). Anteriormente, ambas formas devolvían tipos distintos, y los planes distribuidos con este tipo deINrequerían un caso especial en la comprobación de tipos del plan. #114229 (Alexander Gololobov).- Habilita
ie_joinde forma predeterminada: el valor predeterminado dejoin_algorithmahora esdirect,parallel_hash,hash,ie_join. UnJOINcuya secciónONsolo contiene condiciones de desigualdad (dos comparaciones<,<=,>,>=entre expresiones de las tablas unidas) ahora se ejecuta con el algoritmo IEJoin basado en ordenación, en lugar de unCROSS JOINcon filtro, y se admiten joinsLEFT/RIGHT/FULL/SEMI/ANTIcon dichas condiciones. Comoie_joines el último de la lista, solo se utiliza cuando no se aplican los demás algoritmos. #114327 (Vladimir Cherkasov). - Se corrigieron los gráficos de la interfaz web que, al pasar el cursor, mostraban en el globo informativo los datos de un punto reflejado para resultados ordenados por
xde forma descendente. Ahora se pueden representar columnasDate,Date32,DateTimeyDateTime64; anteriormente, solo funcionaban las marcas de tiempo Unix enteras. Las fechas de los ejes y los globos se muestran en formato ISO 8601, y las cantidades con los sufijosK/M/G/…, igual que en el panel avanzado. #114349 (Alexey Milovidov). - Se admite el análisis de enteros que superan el rango de 64 bits en el tipo de datos
JSON,JSONExtracteisValidJSON. Estos valores se leen como tipos enteros amplios, comoInt128/UInt256, en lugar de provocar el rechazo de todo el documento. #114379 (Pavel Kruglov). - Las tablas QueryRunner ahora inician hilos de trabajo según sea necesario y los liberan cuando quedan inactivos, en lugar de ocuparlos durante toda la vida útil de la tabla. #114522 (Miсhael Stetsyuk).
- Se añadió observabilidad para las pilas de fibras, utilizadas para la comunicación asíncrona con réplicas remotas: eventos de perfil
FiberStackAllocs,FiberStackAllocBytes,FiberStackAllocNanoseconds,FiberStackFreeNanosecondsy métricasFiberStacks,FiberStackBytes. #114541 (Alexey Milovidov). - PromQL: se admiten los modificadores de marca de tiempo
@ start()y@ end(). #114558 (Minh Vu). - Se propaga el contexto de trazas de OpenTelemetry a las fibras utilizadas para el establecimiento asíncrono de conexiones y la ejecución de consultas remotas (solicitudes hedged,
async_socket_for_remote,async_query_sending_for_remote). Los spans de consultas remotas de una consulta distribuida ahora se asignan correctamente como hijos del spanConnection::sendQuerydel iniciador, en lugar de adjuntarse directamente al contexto de trazas proporcionado por el cliente, y cada ejecución de tarea asíncrona genera su propio span. #114813 (Diego Gomes Tomé). - Con este cambio, al utilizar los índices WHATIF, la línea base servida por proyección informa
not_applicablepara cada candidato en lugar de producir un error en la sentencia. #114846 (Yarik Briukhovetskyi). DROP DATABASEahora elimina las tablas en orden topológico inverso según las dependencias de carga y referenciales (anteriormente, solo según las dependencias de carga), por lo que un fallo duranteDROP DATABASEno puede dejar una tabla cuyas dependencias ya se hayan eliminado. #114952 (Alexey Milovidov).- En los dashboards de la interfaz web, la pantalla global de error se sustituye por una nota sobre los dashboards, de modo que un gráfico con errores ya no oculta toda la página. #115019 (Mikhail Artemenko).
- Se externalizan las tablas de la fase de aprendizaje del agregador adaptativo cuando hay presión de memoria. #115038 (Groene AI).
clickhouse-localahora responde a las solicitudes CORS de preflight con los mismos encabezados permisivos queclickhouse-server, por lo que la interfaz HTTP abierta medianteSYSTEM START LISTEN HTTPse puede utilizar directamente desde un navegador, incluida la interfaz web abierta desde una URLfile://. #115045 (Alexey Milovidov).- Se admiten operadores de coincidencia de expresiones regulares al estilo PostgreSQL:
~(un alias de la funciónmatch),~*(coincidencia sin distinguir entre mayúsculas y minúsculas),!~y!~*(negaciones). Los comandos\d,\dt,\dvdepsqlahora funcionan al conectarse a ClickHouse mediante el protocolo de compatibilidad con PostgreSQL, y una consulta fallida ya no cierra la conexión. #115066 (Alexey Milovidov). clickhouse-clientya no imprime dos veces el mensajeConnecting to ...cuando solicita una contraseña de forma interactiva. #115081 (Alexey Milovidov).EXPLAIN WHATIFahora indica por qué se omitió la estimación empírica en una nueva línea,empirical_reason, que se muestra cuandoempirical_statusesunsupported. #115140 (Yarik Briukhovetskyi).- Cuando ningún algoritmo de JOIN habilitado mediante la configuración
join_algorithmpuede ejecutar unJOIN, el mensaje de error ahora indica los algoritmos que se probaron, así como la estrictitud y el tipo del JOIN que falló, en lugar de limitarse a informar de que ninguno funcionó. #115226 (Alexey Elkin). - Las consultas de búsqueda vectorial ahora pueden usar el índice de similitud vectorial cuando el vector de referencia es un literal de Array de enteros, por ejemplo,
ORDER BY L2Distance(vec, [1, 2]). Anteriormente, estas consultas recurrían silenciosamente a un escaneo por fuerza bruta. #115255 (Robert Schulze). - Los errores de red del lado del cliente de Azure (conexión restablecida o rechazada, y errores de DNS y TLS) ahora se reintentan como errores de transporte en lugar de aparecer como un
500sintético, al igual que en el cliente S3. #115269 (Arsen Muk). - La documentación de todas las sentencias SQL (por ejemplo, nombre, sintaxis, descripción y ejemplos) ahora se puede recuperar de la tabla del sistema
system.statements. #115341 (Robert Schulze). BACKUPya no deja un archivo de bloqueo en su destino cuando el intento que lo creó falla antes de escribir nada, ya sea al reservar el destino o al abrir un archivo. Ningún backup posterior podía coincidir con dicho bloqueo, por lo que todos los reintentos en el mismo destino fallaban hasta que el archivo se eliminaba manualmente. Los backups en destinosS3yAzuretambién crean el bloqueo de forma exclusiva, y un bloqueo perteneciente a otro backup se informa como un backup simultáneo en lugar de como el error devuelto por el almacenamiento. #115387 (Julia Kartseva).- Se admite la autenticación mediante token de portador en BuilderRWBufferFromHTTP (intento 2). #115400 (Sergei Trifonov).
- Se añadieron algunas métricas dimensionales para S3Queue. #115422 (Bharat Nallan).
- Se añadió
keywordcomo alias del tokenizadorarraydel índice de texto para mejorar la compatibilidad con OpenSearch, Elasticsearch, SolR y Lucene. #115507 (Robert Schulze). - Se permite crear tablas S3 propias. #115652 (Konstantin Vedernikov).
- No se registra memoria sin seguimiento por hilo en errores MEMORY_LIMIT_EXCEEDED que no afectan a todo el servidor. #115658 (Azat Khuzhin).
- El protocolo remote-write de Prometheus ahora admite inserciones asíncronas: los datos de varias solicitudes remote-write concurrentes se agrupan antes de formar partes, según la configuración
async_insert(habilitada de forma predeterminada; añadaasync_insert=0a la URL del controlador para mantener el comportamiento síncrono). Una solicitud solo se confirma después de que los datos se hayan escrito en todas las tablas internas de la tablaTimeSeriesde destino. #115688 (Nikita Mikhaylov). - Todas las funciones de agregación
timeSeries*ahora gestionan las marcas de tiempo duplicadas según una única regla (gana el valor más alto; NaN pierde frente a cualquier otro valor), lo que corrige los resultados dependientes del orden detimeSeriesInstantRateToGrid,timeSeriesInstantDeltaToGrid,timeSeriesLastTwoSamplesytimeSeriesResampleToGridWithStalenesscuando algunos valores con una misma marca de tiempo son NaN. La regla ya está documentada y probada. #115920 (Vitaly Baranov).
Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)
- Corrige la corrupción de nombres de columnas y las excepciones
BAD_ARGUMENTSconinject_random_order_for_select_without_order_by: las consultasSELECTde varias columnas ya no fallan y se conservan los nombres de las columnas de salida enCREATE TABLE AS SELECT,CREATE VIEW AS SELECTy formatos con nombre comoJSONEachRow, en lugar de sustituirlos por alias internos__subquery_column_<UUID>. Cierra #102812. Cierra #101107. #105896 (Groene AI). - Corrige
NOT_FOUND_COLUMN_IN_BLOCKen el lector nativoParquetV3 cuando unPREWHEREcontiene conjunciones que comparten una expresión intermedia. #107059 (Groene AI). - Corrige
NOT_FOUND_COLUMN_IN_BLOCKen consultas que usan las columnas virtuales_part_starting_offseto_part_offsetenWHEREjunto con la materialización diferida. #108287 (Vladimir Cherkasov). - Corrige
Not found column or subcolumn c.null in blockal ejecutarWHERE col IS NULLoIS NOT NULLen una columnaIcebergcon evolución de esquema añadida después de escribir archivos de datos antiguos, conoptimize_functions_to_subcolumns = 1(el valor predeterminado). #109515 (Groene AI). - Corrige falsos errores
ICEBERG_SPECIFICATION_VIOLATIONal leer una tablaIcebergcuyo tipo decimal u otro tipo primitivo parametrizado se serializa con distintos espacios en blanco en los archivos de metadatos, comodecimal(20,0)en los metadatos de la tabla ydecimal(20, 0)en el manifiesto. #109676 (Groene AI). - Corrige
PREWHEREdiferidos conoptimize_move_to_prewhere = 1cuandoPREWHEREse aplica después deFINAL: las condiciones deWHEREya no se adelantan a una política de filas diferida, lo que podía alterar los resultados de la consulta. #109703 (Yarik Briukhovetskyi). - Corrige
BAD_GETal comparar una columnaArray(String)con un literal de array comoarr = ['x']cuando la columna tiene un índice de omisióntext,tokenbf_v1ongrambf_v1. Estas comparaciones ahora recurren a un escaneo completo en lugar de provocar un error en la consulta. #110057 (Groene AI). - Corrige resultados incorrectos para
has,mapContainsKeyymapContainsValuecon una búsqueda vacía cuando hay un índice de texto. #110246 (Robert Schulze). - Corrige
Host is empty in S3 URIcuando se utiliza una subconsulta escalar como argumento de URL de la función de tablas3, o como argumento de cualquier otra función de tabla, en consultasCREATE TABLE ... AS SELECT. #110254 (Sema Checherinda). - Corrige las comprobaciones de privilegios de
ON CLUSTERparaSYSTEM STOP/START CLEANUPySYSTEM STOP/START VIRTUAL PARTS UPDATE: ya no requierenSYSTEM PULLING REPLICATION LOGy ahora usanSYSTEM CLEANUPoSYSTEM VIRTUAL PARTS UPDATE. #110289 (Groene AI). - Corrige que una réplica de almacenamiento de objetos de solo lectura, con
read_only = true, no detectara nuevas partes medianterefresh_parts_interval, y quetable_disk = truefallara en ese disco contable_disk is not supported for non-ObjectStorage disks. #110460 (Julia Kartseva). - Corrige que las escrituras mediante funciones de tabla de lago de datos como
INSERT INTO FUNCTION icebergS3(...)generaran archivosParquetcuyas columnas de cadenas perdían la anotación de tipoString, lo que impedía que lectores externos como Spark pudieran leer los datos escritos. #110465 (Shaohua Wang). - Corrige un fallo en la inferencia de esquema con
Map cannot have a key of type LowCardinality(Nullable(String))al leer archivosORCcuyas claves de mapa están codificadas mediante diccionario, incluidos archivos escritos por Spark y por ClickHouse conoutput_format_orc_dictionary_key_size_thresholdhabilitado. #110492 (Shaohua Wang). - Corrige resultados incorrectos de
IS NULL/IS NOT NULL/count()conoptimize_functions_to_subcolumnsen una columna convertida enNullablemediante unALTER MODIFY COLUMN Tde solo metadatos aNullable(T). Para las partes escritas antes de la conversión, la subcolumna.nullahora se deriva de la columna principal presente físicamente, en lugar del valor predeterminado del tipo de almacenamiento. #110584 (Groene AI). - Corrige resultados de consulta incorrectos de la optimización
optimize_and_compare_chaincuando las condiciones transitivas combinan tipos con distintas semánticas de comparación, comoEnumconString,DecimalconFloat64o valoresFixedStringde distintos anchos. #110621 (Yarik Briukhovetskyi). - Corrige resultados incorrectos en algunas consultas de lectura en orden cuando el optimizador amplía el prefijo de la clave de ordenación. #110725 (Groene AI).
- Corrige que las sentencias
CREATEcon una cláusulaCOMMENTgeneren un error de sintaxis cuando falte el literal de cadena del comentario, en lugar de aceptar silenciosamente una consulta analizada de forma incorrecta. Por ejemplo,CREATE VIEW v COMMENT AS SELECT 1ya no crea una vista sin comentario. #111159 (Shaohua Wang). - Corrige resultados incorrectos de
SummingMergeTreeyCoalescingMergeTreeconFINALcuandooptimize_move_to_prewhere_if_final = 1y la cláusulaWHEREes una condición booleana implícita sobre una columna de la clave de ordenación, comoWHERE k. #111342 (Groene AI). - Corrige excepciones espurias
Directory '...' was created concurrently with remote path '...'en operaciones de solo metadatos sobre bases de datos y tablas respaldadas por almacenamiento de objetos, comoDROP DATABASE. #111353 (Mikhail Artemenko). - Los catálogos REST de lago de datos ahora informan de credenciales obsoletas mediante la excepción adecuada, en lugar de tratarlas silenciosamente como una tabla inexistente o devolver
UNKNOWN_TABLE. #111379 (alesapin). - Corrige que
SQL SECURITY DEFINERySQL SECURITY NONEno se respetaran en vistas parametrizadas cuando el analizador está deshabilitado (enable_analyzer = 0). Anteriormente, consultar una de estas vistas como un usuario sin privilegios sobre la tabla subyacente fallaba conACCESS_DENIED, aunque la misma vista funciona con el analizador habilitado. #111458 (Groene AI). - Rechazar una columna
Nullable(Nothing)o cualquier otro tipo no permitido en tablas al ejecutarCREATE TABLEcuando el esquema se infiere a partir del almacenamiento; por ejemplo, en una tablaremote,RemoteoDistributedsin columnas sobre una vista que ejecutaSELECT NULL. Así se evita persistir metadatos que no se pueden cargar tras el siguiente reinicio del servidor y que bloquean la carga de tablas no relacionadas. #111487 (Groene AI). - Corregir
std::bad_variant_accessy la evolución incorrecta del esquema deIcebergpara columnasArray(Map(...))anidadas cuyoStructinterno se modifica. #111489 (Konstantin Vedernikov). - Corregir el fallo de
ALTER MODIFY COLUMNal convertir una columnaNullablea otro tipo con unDEFAULT, por ejemplo, deNullable(UInt8)aString,LowCardinality(String)oArray(UInt8). #102156 (DQ). - Corregir
BAD_ARGUMENTS(Dictionary not found) dedictGetdespués de que se rechaceDETACH DICTIONARY ... PERMANENTLYconHAVE_DEPENDENT_OBJECTS; el diccionario ahora permanece disponible cuando se rechaza la desconexión. #105259 (Groene AI). - Los archivos de datos escritos por ClickHouse para tablas
Icebergahora incorporan ID de campo deIcebergenAvroyORC; las columnasStringdeORCse escriben comostringen lugar de como binarios, y los campos complejos opcionales deORC(Array,Map,Tuple) ahora conservan los metadatos correctos deiceberg.required. Esto corrige resultadosNULLsilenciosos tras cambiar el nombre de columnas y restablece la compatibilidad con lectores que cumplen la especificación, como Spark eiceberg-java. #109994 (Groene AI). #111775 (Groene AI). - Corregir la lectura de archivos en discos
plain_rewritabledespués de reescribir una ruta existente con contenido de distinto tamaño: de lo contrario, los metadatos obsoletos en memoria podrían provocarUNEXPECTED_END_OF_FILE. #110304 (Konstantin Bogdanov). - Corregir la desviación del rastreador de memoria por usuario causada por registros de logs del sistema como
query_logyquery_views_log, que de otro modo podrían activar falsamente el límitemax_memory_usage_for_userpara usuarios con cargas de trabajo continuas. #110708 (Raúl Marín). - Corregir una condición de carrera poco frecuente en la que un
ALTERque solo modifica un comentario o la configuración de una tablaReplicatedMergeTreepodía eliminar silenciosamente una columna añadida por unALTER ... ADD COLUMNconcurrente, dejando una réplica con metadatos de tabla obsoletos. #111029 (Shaohua Wang). - Corregir la poda incorrecta de la clave primaria en tablas con un sufijo descendente en la clave de ordenación, como
ORDER BY (g, r DESC), que podía descartar filas coincidentes. #111059 (Nihal Z. Miaji). - Corregir una fuga de memoria del certificado del par en cada handshake TLS cuando la verificación de certificados está habilitada. #111425 (Konstantin Bogdanov).
- Corregir mutaciones que usan un parámetro de consulta como partición en
ALTER TABLE ... UPDATE/DELETE ... IN PARTITION {param:Type}: ahora el valor de partición serializado se puede volver a analizar correctamente, por lo queALTERya no escribe entradas de mutación que impiden cargar la tabla. #111518 (Michael Kolupaev). - Corrige un fallo en macOS/aarch64 al capturar una traza de pila en una pila de corrutina o fibra, por ejemplo mediante el generador de perfiles de memoria. #111656 (Raúl Marín).
- Corrige un fallo del servidor al leer datos
Protobufconinput_format_allow_errors_num > 0cuando un mensaje válido precede a un mensaje erróneo pero omitible en el mismo bloque. #107739 (Andrey Tsarevskiy | Андрей Царевский ). - Corrige
NOT_FOUND_COLUMN_IN_BLOCKcuando una consulta sobre una tablaDistributedusa_shard_numoshardNum, que pasa a serNullable, por ejemplo conFULL JOINyjoin_use_nulls = 1, junto conORDER BYy el analyzer. #109798 (Groene AI). - Corrige resultados incorrectos y excepciones
UNKNOWN_ELEMENT_OF_ENUMenLEFT/RIGHT/FULL/ASOF JOINconjoin_algorithm = 'full_sorting_merge', donde las filas sin unión podían rellenarse con0en lugar del valor predeterminado del tipo de columna. #111197 (Groene AI). - Corrige una excepción
LOGICAL_ERRORcuando el cuerpo de la lambda de una función de orden superior es unifomultiIfcon condición constante que combina una rama con un literalBooly otra con una comparaciónUInt8, por ejemploarrayFilter(p -> multiIf(false, true, p = 'ALL'), ['ALL']). #111245 (Groene AI). - Un marcador de posición
{_partition_id}en la ruta de los motoresS3,AzureBlobStorage,URLy otros similares a archivos, sin unapartition_strategyexplícita, vuelve a implicar la estrategiawildcard, lo que restaura la compatibilidad con DDL anteriores a la versión 26.6 que habían empezado a fallar conBAD_ARGUMENTS. #111279 (Nikita Fomichev). - Corrige
NUMBER_OF_COLUMNS_DOESNT_MATCHen consultasGROUP BYsobre una tablaMergeque envuelve una tablaDistributedcuando la clave de agrupación es una función de una columna y una agregación lee esa misma columna. #111334 (Groene AI). GRANT role TO rolesobre el mismo rol ahora se rechaza conBAD_ARGUMENTSen lugar de crear silenciosamente una entrada autorreferencial ensystem.role_grants. #103315 (zxuhan7).- Corrige las escrituras en tablas
Icebergcuando el archivo de metadatos no contiene una secciónrefs. #106896 (Aleksandr Musorin). - Corrige que
system.session_logquedara ilegible después de un inicio de sesión mediante Arrow Flight: la columnainterfacees unEnum8, pero el valorArrowFlightfaltaba en su enumeración, por lo que un inicio de sesión a través del protocolo Arrow Flight escribía el valor sin procesar10y cualquierSELECTque leyera esa fila generaba la excepciónUnexpected value 10 in enum. #110758 (Alexey Milovidov). - Corrige un desbordamiento de enteros con signo en
toStartOfIntervalcon intervalos inferiores a un segundo: para valoresDateTime64situados a menos de un intervalo del límite inferior deInt64, el resultado redondeado se desbordaba silenciosamente y pasaba a ser un valor positivo inválido; ahora la función genera una excepciónDECIMAL_OVERFLOW. #111370 (Alexey Milovidov). - Se corrige que
readWKTPointyreadWKTdevolvieran coordenadas sin inicializar (escalares) o de la fila anterior (vectorizadas) para puntos vacíos con etiqueta de dimensión, comoPOINT M EMPTY. Estas entradas ahora se rechazan conCANNOT_PARSE_TEXT, de forma coherente conPOINT EMPTY. #111517 (Groene AI). - Se corrigen las excepciones
Unexpected number of columns in result sample blockenRIGHTyFULL JOINcuando el lado izquierdo contiene una columna duplicada con el mismo nombre, por ejemplo,1 AS b, 1 AS b, que se conserva tras unUNION ALL. #111554 (Groene AI). - Se corrigen las excepciones
CANNOT_CONVERT_TYPEyLOGICAL_ERRORen consultas distribuidas que usan el combinador-Tuplecon el modificadorRESPECT NULLSoIGNORE NULLSdentro de combinadores anidados, por ejemplo,anyRespectNullsStateTuple(...) IGNORE NULLS. #111570 (Alexey Milovidov). - Se corrige el resaltado de sintaxis SQL en Play para iPhone, donde el aumento automático del tamaño del texto de Safari en iOS podía desalinear la capa de resaltado. #111683 (Alexey Milovidov).
- Se corrige
UNKNOWN_QUERY_PARAMETERal llamar a una vista parametrizada con un argumento cuyo valor es una subconsulta y cuyo tipo esArray,TupleoLowCardinality, por ejemplo,SELECT * FROM v(param = (SELECT groupArray(x) FROM t)). #111790 (Groene AI). - Se corrige
TYPE_MISMATCH(Key type for complex key ... does not match) cuando unJOINcon un diccionario usa una clave de joinNullable,LowCardinalityoLowCardinality(Nullable), mientras que la clave del diccionario no está envuelta. La búsqueda directa en el diccionario ahora normaliza la clave al tipo de clave declarado en el diccionario, como ya hacendictGetydictHas, y una claveNULLnunca coincide. #111857 (Groene AI). - Con
fsync_part_directory = 1, el cambio de nombre de un directorio de parte de su nombre temporal a su nombre final ahora se hace duradero mediante un fsync del directorio padre y, en el caso de movimientos entre directorios padre distintos, también del directorio padre de origen. Anteriormente, solo se aplicaba fsync al directorio movido, por lo que una pérdida de energía justo después de confirmar una parte podía hacer que la parte no estuviera presente en disco y se perdieran filas, pese a tener habilitada esta configuración. #111861 (Groene AI). - Se corrigen bloqueos en
randChiSquared,randStudentT,randFisherFyrandBinomialcon parámetros extremos. Estas consultas no podían interrumpirse mediantemax_execution_timeoKILL QUERY. Estos parámetros ahora se rechazan incluso cuandomax_rand_distribution_parameteromax_rand_distribution_trialsse establece en0, ymax_rand_distribution_trialsya no puede aumentarse por encima de su valor predeterminado de10^9pararandBinomial. #111909 (Alexey Milovidov). - Se corrigen resultados incorrectos cuando el analizador reescribe cadenas de comparaciones como
x = c1 OR x = c2 OR ...,x != c1 AND x != c2 AND ...ohas(const_array, x)comoINyNOT IN. También se corrigen excepcionesIllegal type ... of argument of function inen expresiones con estructuraDynamic,Array(Dynamic)oJSON. #111924 (Groene AI). - Se corrigieron resultados incorrectos y
LOGICAL_ERRORal seleccionar una columnaNullable(Tuple(...))junto con una de las subcolumnas de sus elementos que admiten valores nulos (Variant,DynamicoLowCardinality) de una tablaMergeTree. #111949 (Groene AI). - Se rechazan los handshakes del protocolo nativo que usan
USER_INTERSERVER_MARKERpara un clúster desconocido o configurado sin un elemento<secret>. Anteriormente, estos handshakes podían entrar en modo interservidor antes de la autenticación y leer información sobre las tablas locales. #99675 (Dan Anderson). - Se corrigió
JOINcon tablasEmbeddedRocksDB,RedisyKeeperMapque podía devolver silenciosamente cero filas al usarDirectKeyValueJoincon clavesStringoNullable(String). #105253 (Vladimir Cherkasov). - Se corrigieron las vistas materializadas actualizables coordinadas de una base de datos
Replicatedque se bloqueaban tras volver a adjuntarse a un Keeper sin la marca de funcionalidadMULTI_READ; ahora la vista se detiene correctamente con el estadoDisabled, en lugar de registrar indefinidamenteUnexpected exception in refresh scheduling. #108890 (Groene AI). - Se corrigió que el cliente ZooKeeper enviara un prefijo de longitud
int32desbordado para solicitudes de más deINT32_MAXbytes. Las solicitudes demasiado grandes ahora se rechazan del lado del cliente. El límite se puede configurar mediantemax_request_sizeen<zookeeper>; de lo contrario, se obtiene de Keeper. Cierra #109165. #109190 (Arsen Muk). - Se corrigió el modo ordenado de
S3Queue/AzureQueuecon nodos de procesamiento persistentes: los bloqueos de bucket ahora se renuevan durante el streaming, por lo que la limpieza de TTL controlada porpersistent_processing_node_ttl_secondsno elimina los bloqueos de un procesador activo. Si aun así se pierde la propiedad del bloqueo, se detecta y notifica, y el streaming se recupera con un nuevo iterador de archivos. #110292 (Kseniia Sumarokova). - Se corrigieron datos incorrectos y posibles lecturas fuera de límites al leer columnas
Stringconstring_serialization_version = 'with_size_stream'después de omitir filas iniciales, así como al leer subobjetos de columnasJSONalmacenadas conobject_shared_data_serialization_version = 'map'. #110471 (Alexey Milovidov). - Se corrigieron
CREATE TABLEyALTER TABLEcon el analizador, que aceptaba una expresiónDEFAULToMATERIALIZEDque hacía referencia a una columna virtual como_tableo_database. Estas expresiones ahora se rechazan al definirlas, en lugar de fallar posteriormente durante la inserción conNOT_FOUND_COLUMN_IN_BLOCK. #111776 (Groene AI). - Se corrigió una condición de carrera en las UDF ejecutables, el motor de tabla
executabley los diccionarios ejecutables, por la que unfcntlaplicado a un descriptor de archivo ya cerrado podía corromper un descriptor no relacionado de una consulta concurrente y hacer que las consultas se bloquearan indefinidamente. #111779 (Raúl Marín). - La creación de estadísticas
minmaxobsoletas ahora emite una advertencia en lugar de lanzar una excepción. #111785 (Han Fei). - Se corrigió que las tablas
Icebergescritas por ClickHouse no pudieran leerse con lectores externos como PyIceberg y Spark. Los esquemasAvrode la lista de manifiestos y de los manifiestos ahora incluyen las propiedadesfield-idobligatorias deIceberg. #111786 (Groene AI). - Regenera las columnas
block_numberyblock_offsetmaterializadas en la parte durante las operaciones de adjuntar, desadjuntar, mover o clonar partes, para que dejen de quedar obsoletas tras manipularlas. #111801 (Mikhail Artemenko). - Corrige la optimización
query_plan_split_filter, que dejaba una columna interna__split_filteren una rama deINTERSECToUNION, lo que podía provocar la excepciónBlock structure mismatch in IntersectOrExceptStep stream: different number of columns. #111930 (Groene AI). - Corrige
AMBIGUOUS_COLUMN_NAMEen consultas que repiten una condiciónJOIN ONenWHEREconjoin_use_nulls = 1; ahora estas consultas devuelven resultados en lugar de fallar. #112007 (Groene AI). - Corrige la autenticación DLF en el catálogo REST de
Paimon: las solicitudes posteriores a la primera ya no fallan con HTTP 401, y las comprobaciones de existencia de tablas ahora detectan correctamente HTTP 404. #112015 (JIaQi Tang). - Corrige
LOGICAL_ERRORdurante la limpieza simultánea de tablasKafkaen Keeper; la creación o eliminación ya no falla si la ruta de Keeper de la tabla desaparece tras expirar la sesión. #112078 (Groene AI). - Corrige las fusiones y mutaciones cuando está habilitado el índice min-max a nivel de parte para las columnas
_block_numbery_block_offset. #109281 (Mikhail Artemenko). - Corrige los
INSERTfallidos en tablasDeltaLakeLocalodeltaLakeque dejaban un archivo de datos sin finalizar después de iniciar la escritura. #109328 (Groene AI). - Corrige filtraciones de credenciales en
SHOW CREATE,system.query_log, los registros del servidor y la salida deEXPLAINparas3/s3Cluster, los motores basados enS3,BACKUP ... TO S3y los argumentos secretos de las funcionesencrypt,decrypty HMAC creadas mediante expresiones o UDF de SQL. #109768 (Raúl Marín). - Corrige la lectura de archivos
Parquetgrandes desde entradas zipSTOREDsin comprimir mediantes3yfile. #110495 (Eva Wuuu). - Corrige el bloqueo de
EXPLAIN ANALYZEen consultas con una lectura de streamingFROM ... STREAMoculta en una subconsulta, CTE o vista. Estas consultas ahora se rechazan conNOT_IMPLEMENTED, al igual que las lecturas de streaming de nivel superior. #110935 (Groene AI). - Rechaza vectores cuya magnitud al cuadrado se desborda a infinito al usar un índice
vector_similaritycon cuantizacióni8. Anteriormente, estos vectores producían resultados incorrectos sin aviso. #111085 (Groene AI). - Ejecuta fsync en los archivos del índice de texto de una parte fusionada o materializada cuando se configuran
min_rows_to_fsync_after_merge,min_compressed_bytes_to_fsync_after_mergeofsync_part_directory. Anteriormente, estos archivos eran los únicos de la parte que quedaban sin sincronizar, por lo que un corte de energía justo después de una fusión podía dejar una parte confirmada pero dañada y provocar pérdida de datos. #111335 (Groene AI). - Corrige la validación de rutas con respecto a
user_files. #111442 (Alexander Tokmakov). - Se corrige un problema por el que
SYSTEM REFRESHen una tablaRabbitMQdetenida a veces no consumía el trabajo pendiente en cola. La operación de actualización ahora espera a que se inicie el bucle de entrega de AMQP antes de consumir su único ciclo de streaming fuera de orden. #111480 (Groene AI). - Se restringe el acceso a objetos locales a la ruta
user_files. #111483 (Konstantin Vedernikov). - Se corrige un segfault debido a un acceso a memoria fuera de límites al deserializar un estado de función de agregación malformado que contiene un valor
String. Estos estados ahora se validan y rechazan. #111606 (Miсhael Stetsyuk). - Se corrige un desbordamiento de enteros al analizar
system.zookeeper_info. #111629 (Kseniia Sumarokova). - Se corrige
NOT_FOUND_COLUMN_IN_BLOCKcuando una consultaFINALfiltra por una columna de la clave de ordenación que no está en la listaSELECTy el filtro se mueve aPREWHERE; por ejemplo,SELECT s FROM t FINAL WHERE k GROUP BY sconoptimize_move_to_prewhere_if_final = 1. #111721 (Groene AI). - Se corrige un problema por el que un
INSERTparticionado enDeltaLakeconallow_experimental_delta_lake_writes = 1corrompía valores de partición que contienen caracteres de ruta y rechazaba valores de particiónNULL. Los valores de partición ahora se codifican mediante codificación porcentual en un único segmento de ruta, y los valoresNULLo cadenas vacías se escriben como__HIVE_DEFAULT_PARTITION__con una entradapartitionValuesnula. #111793 (Groene AI). - Se corrigen una excepción y la omisión silenciosa de datos al leer una subcolumna dinámica a través de una tabla
Buffer. #111948 (Alexey Milovidov). - Se corrige un problema por el que
clickhouse-clientperdía la base de datos actual después deUSE {db:Identifier}. Si el cliente debía reconectarse más tarde, cambiaba silenciosamente la sesión a la base de datosdefault. #111982 (Alexey Milovidov). - Se corrige una excepción
LOGICAL_ERROR(Type mismatch when building statistics for column) durante mutaciones deMergeTreedespués de que una operación de solo metadatosALTER MODIFY COLUMNcambie el tipo de una columna que contiene estadísticas. Las columnas que la mutación reescribe ahora recalculan sus estadísticas, mientras que las columnas sin modificar conservan las existentes. #112009 (Groene AI). - Se corrigen lecturas de tablas
Paimonque podían fallar mientras la sugerencia mutablesnapshot/LATESTse reemplazaba simultáneamente. Las sugerencias no válidas u obsoletas ahora se ignoran y, en su lugar, el snapshot se carga desde el catálogo. #112010 (JIaQi Tang). - Se corrige la lectura de archivos
GeoParquet,ArrowyArrowStreamcuya columna de geometría codificada en WKT utiliza una palabra clave de tipo en minúsculas, comopoint(1 2), o un contenedor vacío, comoLINESTRING EMPTYoPOLYGON(). Esto también corrige la lectura de archivos que almacenan la salida dewktpara una geometría vacía. #112020 (Groene AI). - Se corrige un problema por el que las sobrescrituras de configuración a nivel de consulta no se aplicaban a la copia nativa de Azure. #112037 (Smita Kulkarni).
- Corrige que
query_masking_rulesreescribiera el tipo de una columnaEPHEMERAL, lo que podía provocar queCREATE TABLEalmacenara un tipo incorrecto o fallara. #112048 (Alexey Milovidov). - Los parámetros de las funciones de tabla ya no aceptan estados de agregación, que anteriormente provocaban un error lógico, ya que estos parámetros no son compatibles. Cierra #112085. #112087 (Pedro Ferreira).
- Corrige resultados incorrectos en un
JOINcuya expresiónONcontiene una conjunción constante, por ejemplo,ON l.id = r.id AND CAST(NULL AS Nullable(UInt8)). #112155 (Vladimir Cherkasov). - Corrige resultados incorrectos en
hasAllTokensy otras búsquedas de índices de texto con varios tokens en compilaciones que no usansimdcomp, comoaarch64, cuandotext_index_posting_list_apply_mode = 'lazy'. #112178 (Groene AI). - Corrige resultados incorrectos cuando se llama a una vista parametrizada con un argumento que no es una asignación
parameter = value. Estas llamadas ahora se rechazan conUNKNOWN_QUERY_PARAMETERen ambas rutas de ejecución. #112194 (Groene AI). - Corrige que las vistas parametrizadas cuyo cuerpo
SELECTusaINTERSECT,EXCEPTo una cadena deUNIONque mezclaUNION DISTINCTconUNION ALLse clasificaran erróneamente como vistas ordinarias, lo que impedía cargar sus metadatos. #112211 (Groene AI). - Corrige la inferencia de esquema para la familia
TSV, que inferíaStringpara valores decimales escritos con un cero inicial, como0.0o0.5, y trataba esa primera fila como un encabezado. También corrige queTSKVinfiriera un tipo numérico para un valor codificado con escapes comox=1\x2E5. Cierra #112105. #112226 (Groene AI). - Corrige que
system.s3_queue_settingsinformara valores incorrectos parabucketing_mode,partitioning_mode,partition_regexypartition_component. #112300 (Bharat Nallan). - Corrige resultados incorrectos, una salida de
ORDER BYmal ordenada y excepcionesBAD_TYPE_OF_FIELDcuando la clave primaria es unArrayoTupley la consulta le aplicaplus,minus,multiply,divideointDiv. #112339 (Groene AI). - Corrige la ejecución remota de consultas que contienen
PASTE JOIN, por ejemplo, mediante una tablaDistributedo una función de tabla*Cluster. ClickHouse ya no formatea la consulta con la sintaxis no válidaALL PASTE JOIN. #112404 (Groene AI). - Corrige un
LOGICAL_ERROR(Invalid number of rows in Chunk) enJoiningTransformpara unLEFT JOINcon claves únicas en el lado derecho, una condiciónONmixta y un valor pequeño demax_joined_block_size_rows. #106928 (Groene AI). - Se corrigió la columna virtual
_tagsdel motor de tablaS3Queue: estaba declarada, pero nunca se poblaba, por lo queSELECT _tagssiempre devolvía un mapa vacío. Ahora devuelve las etiquetas del objeto, al igual que el motorS3y la función de tablas3. #108676 (Groene AI). - Se corrigió la pérdida de datos de una columna sin expresión predeterminada cuando una fusión se ejecutaba simultáneamente con
ALTER TABLE... RENAME COLUMN, o cuando los únicos valores de la columna procedían de una actualización ligeraUPDATE. La columna podía eliminarse de la parte fusionada, por lo que todos sus valores se leían como NULL. #109356 (Groene AI). - Se corrigió la eliminación de índices de omisión de una parte de datos (o el fallo de
CHECK TABLEconUNEXPECTED_FILE_IN_DATA_PART) después de una mutación que reescribía una parte completa, comoALTER TABLE... DROP COLUMNde una columnaMATERIALIZED, en una parteWide. #109616 (Groene AI). - Se corrigieron dos errores en la ruta de
DateTime64detoUTCTimestamp/fromUTCTimestamp(y sus aliasto_utc_timestamp/from_utc_timestamp) y detoTime64. El primero era un desbordamiento de enteros con signo cerca del límite deInt64(ahora se calcula enInt128y se limita al rango representable). El segundo producía un resultado incorrecto para valores fraccionarios negativos cerca de un límite de desplazamiento de zona horaria: la división de los segundos se truncaba hacia cero, por lo quetimezoneOffset()inspeccionaba el segundo siguiente y podía elegir el lado incorrecto de un cambio de horario de verano/desplazamiento. #109738 (Groene AI). - Se corrigió un error lógico (“Cannot determine row level filter; 0 columns deleted, 0 columns added”) al leer de una tabla
Mergecuya tabla secundaria tiene una política de filas cuyo filtro es una columna existente sin modificadores (por ejemplo,CREATE ROW POLICY... USING flag). #109843 (Groene AI). - Se corrigieron dos errores que se producían cuando una consulta con
GROUP BY GROUPING SETS(o una subconsulta escalar o de mutación que contiene uno) se ejecutaba conforce_aggregation_in_order = 1:Trying to get name of not a column: ExpressionListcon el analizador antiguo (enable_analyzer = 0), yMemory bound merging of aggregated results is not supported for grouping sets.en una consulta distribuida conenable_memory_bound_merging_of_aggregation_results = 1bajo el analizador. #109862 (Groene AI). - Se corrigió el análisis de los valores numéricos
1/0como valoresBooldentro de tipos contenedor (por ejemplo,Array(Bool),Tuple(Bool,...)). Anteriormente,[1,0]fallaba conCANNOT_READ_ARRAY_FROM_TEXT, mientras que[true,false]funcionaba. #109976 (Groene AI). - Se corrigió un error espurio
ILLEGAL_COLUMNdeALTER TABLE... ADD COLUMN IF NOT EXISTScuando la columna ya existía en el momento de aplicar la operación. Esto ocurría cuando la misma columna se añadía dos veces conIF NOT EXISTSen una instrucción, o cuando unALTERsimultáneo añadía la columna entre las fases de preparación y aplicación. #110080 (Groene AI). - Se corrigió un resultado incorrecto por el que
length(y la dimensión QBit) de una columnaFixedStringdevolvía0en lugar del tamaño fijoNcon réplicas paralelas cuando la consulta tenía un filtro selectivo. #110427 (Groene AI). - Se corrigió la pérdida del tipo
GeometryenflipCoordinates: para un argumentoGeometry, el resultado vuelve a tener el tipoGeometryen lugar delVariant(...)subyacente, por lo que puede pasarse directamente a funciones comoareaCartesian. #110694 (Groene AI). - Se corrigió que
optimize_injective_functions_in_group_bymodificara los resultados de las consultas conGROUP BY GROUPING SETSyGROUP BY... WITH TOTALS. La configuración está documentada como preservadora de resultados, pero eliminar una función inyectiva de una clave de agrupación producía un valor incorrecto (o eliminaba una fila) en las filas donde esa clave no está presente en el conjunto agregado (un conjunto que no pertenece aGROUPING SETS) o en la filaWITH TOTALS. El valor incorrecto podía coincidir con un valor de clave real, lo que hacía indistinguible una fila de superagregación de un grupo real en el mismo conjunto de resultados. #110721 (Groene AI). - Los valores numéricos
1/0al analizar JSON comoBoolahora respetan la configuraciónallow_special_bool_values. Anteriormente, una entrada JSON como{"v":1}paraVariant(Bool, UInt32)se interpretaba comoBoolincluso conallow_special_bool_values_inside_variant = 0, porque los analizadores JSON deBoolignoraban la configuración yBooltiene mayor prioridad de deserialización enVariantque los tipos enteros. #110835 (Groene AI). - Se corrigió un error lógico
block.rows() == getRows()(una lectura fuera de límites y una deduplicación de inserciones defectuosa en compilaciones de lanzamiento) cuando unINSERTpasa por una vista materializada dependiente cuyo destino es unAlias, cuya consulta interna cambia el número de filas y a la que se puede acceder a una tabla con deduplicación a través del alias. #111103 (Alexey Milovidov). - Se corrigió un error lógico
Block structure mismatch(en compilaciones de depuración y con sanitizadores) y un errorIllegal types of argumentsen operaciones de conjuntos sobre columnas compatibles con estados de agregación (p. ej.,quantileStateyquantilesState(0.9)) anidadas en columnas contenedoras comoTuple,Array,Map,NullableoVariant. #111191 (Alexey Milovidov). - Se corrigió que
DISTINCTconLIMIT/OFFSETordenados devolviera filas incorrectas cuando la sugerencia de límite para la detención temprana de DISTINCT no podía acotar el inicio del resultado: unLIMITnegativo (devolvía el inicio en lugar del final), unLIMIT/OFFSETfraccionario (la fracción solo se resuelve tras una lectura completa) y unOFFSETsinLIMIT(se descartaba el final posterior al desplazamiento). Por ejemplo,SELECT DISTINCT intDiv(x, 100) FROM t ORDER BY intDiv(x, 100) LIMIT -1sobre una tabla con varias partes devolvía el valor distinto más pequeño en lugar del más grande. #111326 (Groene AI). - Se corrigieron resultados incorrectos cuando una consulta tiene un índice de omisión
sety un predicado de la forma(x AND <null-value>) OR y, donde el NULL es generado por una función (p. ej.,toInt64OrNull('x'),nullIf(1, 1),CAST(NULL AS Nullable(Int64))). Ese valor se envolvía con__bitWrapperFuncy propagabaNULLen lugar de la máscara de “desconocido”, por lo que el índicesetpodía descartar gránulos que sí coincidían y la consulta devolvía menos filas de las debidas. #111604 (Groene AI). - Se corrigió que
DELETE/UPDATEen una tabla Iceberg eliminara silenciosamente filas incorrectas (o generaraNOT_FOUND_COLUMN_IN_BLOCK) cuando la tabla contiene archivos de datos escritos antes y después deALTER TABLE... ADD COLUMNyoptimize_move_to_prewhereestá habilitado. #111693 (Groene AI). - Se corrigió un
LOGICAL_ERROR(“Invalid number of rows in Chunk”) —y, en compilaciones reforzadas, un aborto relacionado por acceso fuera de límites— paraORDER BY ... WITH FILL ... INTERPOLATEsobre una tablaDistributedcon dos o más segmentos, conclusterAllReplicaso con réplicas paralelas de clave personalizada, incluso para resultados vacíos. AhoraWITH FILLse aplica solo en el nodo que produce el resultado final, lo que también corrige la duplicación de las filas de relleno generadas entre segmentos/réplicas. #111919 (Yakov Olkhovskiy). - Se corrigió
randBinomialpara que siga siendo utilizable con las probabilidades degeneradas0y1para cualquier número de pruebas. #112021 (Alexey Milovidov). - Corrige resultados incorrectos causados por una consulta de búsqueda vectorial que contaminaba la caché de condiciones de consulta. Una consulta
SELECT... WHERE <condition> ORDER BY <distance function> LIMIT nsobre una tabla con un índicevector_similaritypodía registrar gránulos como no coincidentes con<condition>, por lo que una consulta ordinaria posteriorSELECT... WHERE <condition>sobre la misma tabla devolvía silenciosamente menos filas. Las lecturas de búsqueda vectorial ya no escriben en la caché de condiciones de consulta. #112086 (Groene AI). - Corrige un error por el que se acepta un
CREATE VIEWoCREATE FUNCTIONcuya definición llama asubstr,midobyteSlicede una forma que la gramática desubstringno puede volver a analizar, pero los metadatos que ClickHouse escribe para ello no son SQL válido. Leer posteriormente esa definición falla conSYNTAX_ERRORy, al iniciar el servidor, aborta la carga de metadatos, por lo que el servidor no puede iniciarse en absoluto. Estas definiciones ahora se pueden escribir y leer correctamente, y los archivos de metadatos existentes de la formasubstring(x, a, b, c)vuelven a poder leerse, por lo que un servidor afectado se inicia sin intervención manual. #112195 (Groene AI). - Corrige una tabla
TimeSeriescuyos metadatos locales divergían de Keeper, lo que hacía que la recuperación de réplicas en una base de datosReplicatedse bloqueara indefinidamente, de modo que la réplica nunca volvía a estar disponible para la base de datos y permanecía dañada tras los reinicios. Las tablas internas de dicha tabla ahora se eliminan mientras la transacción de metadatos de recuperación sigue disponible, en lugar de aplazarse a una tarea en segundo plano que no podía ejecutar elDROPen absoluto. #112218 (Groene AI). - Se corrigió la lectura de una subcolumna de una columna
Nullable(Tuple(...))cuyo elemento es unLowCardinality(T)no anulable cuando la misma consulta también lee la subcolumna padre. En una parte compacta, la subcolumna padre devolvía valores incorrectos, o la consulta fallaba conUnexpected return type from assumeNotNull, o el servidor era terminado por una aserción de protección destring_view, porque la subcolumna extraída se deserializaba en un búferLowCardinality(Nullable(T))cuyos subflujos se compartían después con la lectura de la subcolumna padre. #112232 (Groene AI). - Se corrigió un bloqueo permanente del servidor en macOS causado por la pérdida de despertares de
pthread_rwlockcuando el perfilador de consultas por muestreo está habilitado (error de Apple FB24027930):pthread_rwlockahora se reemplaza por una implementación robusta ante señales en Darwin. #112267 (Raúl Marín). - Corrige que se ignoraran
max_execution_timeyKILL QUERYmientras una consulta evalúageohashesInBox,arrayFold,sleep,base58Decode,h3PolygonToCellsoh3PolygonToCellsWithContainment. Tales consultas podían seguir ejecutándose durante minutos después de la cancelación. Esto ahora también cubre evaluaciones dentro de expresiones almacenadas en los metadatos de la tabla, como claves de ordenación, índices de omisión y clavesPARTITION BY. #112273 (Groene AI). #113456 (Groene AI). - Corrige un error lógico
Cannot add step Expression to QueryPlan because it has incompatible header with root step JoinLazyColumnsStepen una consulta conFINAL, un filtroPREWHERE, unLIMITreducido ymake_distributed_plan = 1, cuando las columnas seleccionadas se enumeran en un orden distinto al de las columnas de la tabla. La materialización diferida reemplazaba un nodo del plan sin conservar su cabecera de salida, lo que hacía que el plan de consulta fuera incoherente. #112303 (Groene AI). - Corrige la escritura de tablas Iceberg cuyo esquema contiene una tupla anidada dentro de otra tupla. Los metadatos publicados de la tabla reemplazaban los nombres de los campos de la tupla interna por nombres posicionales
1,2,…, por lo que, con el formatoParquetpredeterminado, elINSERTfallaba conINCORRECT_DATAy, conAvro, no se podía volver a leer la columna. #112480 (Groene AI). - Corrige el error
ATTEMPT_TO_READ_AFTER_EOFal fusionar partes con un índice de texto si una de las partes fusionadas estaba vacía, por ejemplo, después de una mutación que eliminó todas las filas de la parte. #112490 (Anton Popov). - Corrige resultados incorrectos y un error lógico cuando un argumento que debe ser constante, como la escala de
toDecimal32o la zona horaria detoDateTime, procede de una subconsulta escalar y se utiliza el analizador antiguo. Dicho argumento se analizaba como si su valor fuera cero o estuviera vacío, por lo que el tipo de resultado declarado no coincidía con el valor calculado, yCREATE VIEWyCREATE MATERIALIZED VIEWpersistían un tipo de columna incorrecto. #112492 (Groene AI). - Corrige un
LOGICAL_ERROR(“Part… contains column… that is absent in table…”) cuando una réplicaReplicatedMergeTreemuta una parte obtenida de otra réplica antes de aplicar su propioALTER... ADD COLUMNpendiente. Ahora, dicha mutación se pospone hasta que se aplique el cambio de metadatos. #112510 (Groene AI). - Corrige resultados de consulta incorrectos al usar GROUP BY con ORDER BY y
arrayJoinen la proyección. #101775 (Yash ). - Corrige un bloqueo del servidor (acceso fuera de límites) en
S3Queue/AzureQueueconenable_hash_ring_filtering = 1cuando un lote contenía un archivo que no se podía procesar y, al mismo tiempo, fallaba la solicitud a Keeper para marcar el lote como en procesamiento. #108977 (Groene AI). - Corrige un error lógico
Stream <col>.variant_discr... is not found(aborto del servidor en compilaciones de depuración y con sanitizadores) cuandoALTER TABLE... MODIFY COLUMNcambia una columna a un tipo con subcolumnas dinámicas (por ejemplo, deVariantaDynamic) en una tabla con partes anchas, y posteriormente se lee o fusiona la parte. #110204 (Groene AI). - Corrige un desbordamiento de entero con signo (UBSan) al convertir un valor extremo de
DateTime64(p. ej.,INT64_MIN) aTime/Time64en una zona horaria con desplazamiento negativo. #110451 (Groene AI). - Corrige un problema por el que una tabla MergeTree con una proyección
_part_offseto de orden de commit quedaba permanentemente sin posibilidad de adjuntarse después de deshabilitarallow_part_offset_column_in_projectionsoallow_commit_order_projectiony separar la tabla o reiniciar el servidor. Estas dos configuraciones son controles en el momento de CREATE, por lo que ya no se vuelven a comprobar en ATTACH. #110570 (Groene AI). - Con
analyzer_compatibility_join_using_top_level_identifier = 1, ahora un identificador enJOIN... USINGpuede resolverse a partir de un alias definido en una subexpresión dentro de la lista SELECT (por ejemplo,SELECT uniqExact(lower(x) AS id) FROM t1 JOIN t2 USING (id)), de acuerdo con el comportamiento del analizador anterior. Antes solo se consideraban los alias de proyección de nivel superior, y dichas consultas fallaban con una excepciónUNKNOWN_IDENTIFIERincluso con la configuración habilitada. La sugerencia de error que recomienda habilitar esta configuración ahora también se muestra cuando el alias coincidente está anidado. #110739 (Dmitry Novik). - Corrige un problema por el que las solicitudes no autenticadas podían hacer que ClickHouse resolviera nombres de host incluidos en encabezados de direcciones de cliente reenviadas. Ahora ClickHouse solo acepta direcciones IP numéricas de estos encabezados. Los valores no válidos se ignoran para la atribución de cuotas basada en direcciones reenviadas, sin realizar resolución DNS. Cuando
auth_use_forwarded_addressestá habilitado, las direcciones reenviadas no válidas se rechazan durante la autenticación. Los rechazos se registran en el nivel de depuración. #111060 (Dmitriy Borisenko). - Corrige
NOT_FOUND_COLUMN_IN_BLOCKcuando una política de filas yadditional_table_filtershacen referencia a la misma columna, que no se selecciona de otro modo en la consulta. #111099 (Groene AI). - Corrige el error
UNKNOWN_IDENTIFIERpara columnas calificadas por el nombre de una CTE (cte_name.column) en consultas almacenadas en vistas cuando el analizador está habilitado. #111386 (Dmitry Novik). - Corrige un
LOGICAL_ERROR(Got read request from replica N for unknown stream...) que podía detener el servidor al leer con réplicas paralelas cuando la consulta se respondía por completo mediante una optimización de proyección (recuento exacto, recuento minmax o una proyección agregada/normal almacenada que no selecciona rangos) en el iniciador. #111689 (Groene AI). - Se corrigió un desbordamiento de enteros con signo en la sobrecarga de tres argumentos de
toStartOfInterval: para un argumentoorigincercano al límite inferior deInt64, la función devolvía un valor con desbordamiento en lugar de informar de un error. #112045 (Alexey Milovidov). - Corrige una excepción
LOGICAL_ERROR(Block structure mismatch in joined block stream) en una unión de varias tablas cuyas dos subuniones no producen columnas de salida, por ejemploSELECT count() FROM t1, t2, t3, t4 WHERE (t1.b = t2.b) AND (t3.a = t4.a)conquery_plan_optimize_join_order_limitestablecido en0o1. #112205 (Groene AI). - Se corrigió un problema por el que la función de tabla
valuesrepresentaba una constanteBoolno literal (p. ej.,CAST(true, 'Nullable(Bool)')) insertada en una columnaStringo textual como1o0en lugar detrueofalse. #112308 (Yakov Olkhovskiy). - Corrige un
LOGICAL_ERROR(partitions_count > 0) al particionar fragmentos de datos deIcebergvaciados mediante eliminaciones por posición, p. ej., durante la compactación de una tablaIcebergparticionada con archivos de datos completamente eliminados. #112432 (Pedro Ferreira). - Se corrigió la inferencia de esquema que proponía un tipo numérico para valores de texto que el analizador de valores no puede volver a leer. La inferencia aceptaba un exponente incompleto (
1e+), una mantisa ausente (.) o un signo repetido (++inf), quereadFloatTextPreciserechazaba posteriormente conCANNOT_PARSE_NUMBERal leer el esquema inferido; en una columnaDynamic, esto provocaba un error al ejecutar INSERT. Ahora, la inferencia valida el número con el analizador que utiliza realmente el lector. Esto también elimina un caso en el que el tipo inferido dependía demax_read_buffer_sizey permite que las formas de exponente válidas con cero inicial, como0e5, infieranFloat64en TSV, como ya ocurre en CSV. Sigue #112226 y resuelve la parte relativa al exponente de #112105. #112453 (Groene AI). - Informa de la posición correcta de los errores en las consultas PromQL. #112494 (Minh Vu).
- Corrige un
LOGICAL_ERROR(Cannot add transform Resize to Pipes because it has no outputs) cuando una consulta que realiza agregaciones en un clúster se ejecuta conserialize_query_plan = 1y réplicas paralelas basadas en el plan, debido a que el paso de combinación redimensionaba el pipeline a cero flujos. #112506 (Groene AI). - Corrige un desbordamiento por defecto sin signo en la comprobación de la longitud del nombre de tabla que permitía crear una tabla que nunca se podía eliminar. Cuando el nombre de la base de datos escapado alcanzaba 214 bytes, el límite calculado para el nombre de archivo
metadata_droppedse desbordaba, por lo que se aceptabaCREATE TABLEy el posteriorDROP TABLEoDROP DATABASEfallaba conFile name too long. Ahora ese nombre se rechaza conARGUMENT_OUT_OF_BOUND, el mismo error que ya se devolvía justo por debajo de ese límite. #112527 (Groene AI). - Corrige la excepción
Context has expiredcuando se utilizagetClientHTTPHeaderdentro de una subconsulta. #112533 (Alexey Milovidov). - Se corrigió que
s3_allow_server_credentials_in_user_queriesrechazara incorrectamente unasextra_credentials(role_arn = '...')proporcionadas en la consulta. Ahora, la asunción de un rol de STS con un rol explícito siempre está permitida: no expone las propias credenciales del servidor a la consulta y es la forma documentada de conceder acceso a un bucket de S3 privado. #112603 (Raúl Marín). - Corrige que los contadores de lectura (
read_rows,read_bytes,ProfileEvents['SelectedRows'],ProfileEvents['SelectedBytes']) y las cuotasREAD_ROWSyREAD_BYTESse contabilizaran en exceso para las consultas cuyoORDER BYse vuelca a disco. Las filas releídas de los archivos temporales de ordenación externa se contaban de nuevo como lecturas de origen, por lo que una consulta con spilling sobreestimaba lo que había leído y podía rechazarse conQUOTA_EXCEEDEDaunque se mantuviera dentro de su cuota. #112645 (Groene AI). - Corrige una tabla Iceberg cuyo formato de escritura es
Avro, que serializaba como obligatorio un campo declarado"required": falsecuyo tipo eslist,mapostruct, sin una unión["null", T], de modo que el propio esquema del archivo de datos no coincidía con los metadatos de la tabla y otros lectores de Iceberg veían un campo obligatorio. Ahora, ese campo se escribe como la unión["null", T]que la especificación de Iceberg utiliza para un campo opcional. #112648 (Groene AI). - Corrige que las tablas
DeltaLakedevuelvan muy pocas filas cuando el predicadoWHEREcontiene una subexpresión bajo unNOTque el traductor de predicados de delta-kernel no puede procesar. Ahora, dicha subexpresión se comunica a delta-kernel explícitamente como un predicado desconocido, en lugar de como el final del iterador hijo, lo que antes truncaba silenciosamente la conjunción circundante. #112652 (Groene AI). - Corrige una corrupción del heap que podía provocar el cierre inesperado del servidor durante el apagado, causada por el método
constAccessRights::getFilters, que modificaba un árbol de derechos de acceso compartido por consultas concurrentes. #112692 (Groene AI). - Corrige un error lógico en el formateo de consultas cuando una cláusula
ARRAY JOINno contiene expresiones. Ahora, dicha cláusula se rechaza durante el análisis conSYNTAX_ERROR, de forma coherente con unUSINGvacío, en lugar de aceptarse y formatearse como texto que no puede volver a analizarse. #112699 (Groene AI). - Corrige un bloqueo de consultas durante la ejecución local de planes de consultas distribuidas (
distributed_plan_execute_locally = 1): el lector de intercambio en memoria podía bloquear el único hilo de la canalización antes de que se iniciaran las fuentes que producían sus datos. #111762 (Alexander Gololobov). - Corrige que los campos de
Icebergdeclarados con"required": falsey de tipolist,mapostructse escribieran comoREQUIREDen el pie de página deParquet. Ahora, estos campos se escriben comoOPTIONAL, en consonancia con el esquema publicado deIcebergy con otros lectores. #112669 (Groene AI). - Corrige un uso del heap después de su liberación en el ejecutor de la canalización que podía provocar el cierre inesperado del servidor cuando una consulta elimina procesadores en tiempo de ejecución (por ejemplo,
FINALcon lecturas diferidas u ordenación externa), detectado por el AST fuzzer. #111017 (Groene AI). - Corrige un uso después de liberación (fallo de segmentación) cuando una consulta con una instantánea de almacenamiento compartido (configuración
enable_shared_storage_snapshot_in_query) elimina partes de datos de la instantánea; por ejemplo, una subconsulta de streaming que lee la misma tablaMergeTreeque otra parte de la consulta lee simultáneamente. #111192 (Alexey Milovidov). - Rechaza usos no admitidos de columnas
AggregateFunctionen expresiones TTL al ejecutarCREATE TABLE(por ejemplo,TTL toDateTime(state)) en lugar de fallar más adelante durante la ejecución de TTL conILLEGAL_TYPE_OF_ARGUMENT. Esto también incluye estados presentes en alternativasVarianty valoresDynamic. Los consumidores válidos que admiten estados, comofinalizeAggregation, se siguen aceptando. #107366 (Ria Khatoniar). - Corrige un
LOGICAL_ERROR(CTE '...' does not have query tree, but was not planned yet) cuando se hace referencia a un CTEMATERIALIZEDdesde más de una posición del árbol de joins (por ejemplo, dos subconsultas unidas, o una subconsulta unida y una subconsulta escalar enWHERE) en una consulta sobre una tablaDistributed. Ahora la consulta se ejecuta en lugar de generar la excepción (que abortaba el servidor en compilaciones de depuración o con sanitizers). #108924 (Groene AI). - Conserva el orden original de las claves en la serialización segmentada de Map para corregir operaciones de comparación que dependen de él. #109178 (Pavel Kruglov).
- Se corrigió un problema por el que
made_current_atensystem.iceberg_historypasaba a ser1970-01-01para una instantánea retenida tras ejecutarALTER TABLE... EXECUTE expire_snapshotsen una tabla Iceberg. También se corrigió el caso en quesystem.iceberg_historyno devolvía filas para una tabla cuyos metadatos no contienensnapshot-log. #111781 (Groene AI). - Corrige un análisis de prueba de texto
FixedStringque deja bytes añadidos parcialmente en la columna cuando falla el análisis, lo que puede provocar un error lógicoSizes of nested column and null map of Nullable column are not equaldurante la serialización de columnasVariant/Array/Nullable, o desplazar silenciosamente los bytes del resultado. #111908 (Groene AI). - Corrige que
replaceOne,replaceAll,replaceRegexpOneyreplaceRegexpAllignoraranmax_execution_timeyKILL QUERY. Ahora, cada llamada comprueba si se ha solicitado una cancelación mientras se ejecuta, de modo que un reemplazo de larga duración sobre un valor grande o un gran número de filas se detiene en lugar de ocupar un hilo del servidor hasta finalizar. Estas llamadas no pueden devolver resultados parciales, por lo que, contimeout_overflow_mode = 'break', notifican que se ha superado el plazo como un error: siempre durante el plegado de constantes y, en la canalización, cuando se alcanza este punto de comprobación antes de la comprobación entre bloques del ejecutor, que sigue deteniendo la consulta silenciosamente. #112483 (Groene AI). - Corrige un error lógico y un registro de dependencia incorrecto cuando el cuerpo de una
VIEWnormal hace referencia a una tabla o un diccionario mediante un parámetro de consulta, como enCREATE VIEW v AS SELECT x FROM {db:Identifier}.t. Esta vista ya no registra una dependencia referencial de una tabla con el mismo nombre en la base de datos actual, por lo que las tablas no relacionadas pueden volver a eliminarse. #112704 (Groene AI). - Corrige una lectura con un tipo incorrecto de una subcolumna de elemento
Nestedcuya columna se eliminó y se volvió a añadir. Al seleccionar esa subcolumna junto con su columna principal, se devolvía el elemento completo en la posición de la subcolumna, aunque el bloque seguía declarando el tipo del elemento, lo que producía valores arbitrarios en compilaciones de lanzamiento y un error lógico en compilaciones de depuración y con sanitizador. #112769 (Groene AI). - Se corrigió
Cannot read all data of type FixedStringal leer la subcolumnaproduct_quantization_codebookde una columna con un códecQuantized('product',...). El libro de códigos de cada parte se escribe después de los datos de todos los gránulos, por lo que no está delimitado por marcas, y una lectura cuyo rango de marcas terminaba antes de la marca final de la parte podía leerlo de forma incompleta. #112818 (Alexey Milovidov). - Corrige un fallo de segmentación y la corrupción silenciosa de datos cuando un
INSERTen el motorFileo la función de tablafileañade datos a un archivo no vacío en un formato que no admite la adición de datos, comoAvro. Escribir mediante un descriptor de archivo o una ruta particionada omitía la comprobación existente, por lo que se suprimía el prefijo de formato y se escribía un segundo encabezado después de los bytes existentes, dejando el archivo ilegible. Ahora, eseINSERTse rechaza conCANNOT_APPEND_TO_FILE, como ya ocurre con una ruta simple. #112839 (Groene AI). - Corrige que
connectionIdgeneraraContext has expiredcuando se utiliza dentro de una subconsulta, capturando el ID de conexión del cliente al crear la función. Cierra #112533. #112870 (ClickGap AI Bot). - Se corrigió el análisis de enteros que no caben en el tipo de destino en
Poco::NumberParser, utilizado para leer números JSON. Estos números se analizaban silenciosamente como valores incorrectos (por ejemplo,18446744073709551617se convertía en1) en lugar de rechazarse, y un númeroUInt64superior al máximo deInt64no conservaba su valor tras una conversión de ida y vuelta de AST a JSON. #112904 (Alexey Milovidov). - Se corrigió
IS DISTINCT FROMpara valoresArrayyMapcomparados conNULL. Cierra #103042. #103162 (yanglongwei). - Se evita que los reintentos agotados del DDL distribuido replicado ejecutado por el líder bloqueen permanentemente las consultas DDL
ON CLUSTERposteriores. #108505 (Ahaan Limaye). - Se corrigió un
LOGICAL_ERROR(“Trying to extract chunk from ChunkBuffer before all inputs are finished”) al combinar una operación de conjuntos (INTERSECT/UNION ALL/EXCEPT) ramas que usan subconsultas correlacionadas ycorrelated_subqueries_default_join_kind = 'left'. #108554 (Groene AI). - La conversión de valores de coma flotante fuera de rango (
BFloat16,Float32,Float64) y de valoresUInt64superiores aInt64::max()aDateTimeyTimeahora se satura de forma fiable en los límites del rango en todas las arquitecturas (anteriormente, el resultado de una conversión fuera de rango dependía de la arquitectura y podía desbordarse en x86-64), y los valores no finitos (NaN,inf) ahora lanzan una excepción en lugar de producir un resultado arbitrario. La misma corrección se aplica a la ruta de conversión de coma flotante aDatedetoDatey a las conversiones deUInt64y enteros anchos ((U)Int128,(U)Int256) aDateyDate32, que podían devolver un día anterior a la época en lugar de saturarse. La conversión de un número aTimeahora se satura al rango del tipo para todos los tipos de origen numéricos (anteriormente, los valores procedentes de tipos sin signo estrechos o enteros anchos se almacenaban sin limitar y solo se limitaban al imprimirse), y la conversión precisa aTimeya no rechaza los valores negativos que admiteTimeni satura silenciosamente los valores que no caben en él. La conversión precisa de un número aDate32(accurateCast,accurateCastOrNull) ya no satura silenciosamente los valores fuera de rango o no finitos, sino que lanza una excepción o devuelveNULL, como ya hacía paraDateyDateTime; las variantesOrDefaultdevuelven el valor predeterminado deDate32para dichas entradas. La conversión precisa de un número de coma flotante no entero aDate,Date32,DateTimeoTimeahora se rechaza en lugar de truncarse silenciosamente. También se corrigió la documentación de la funcióntoDateTime32, que por error mostraba ejemplos detoDateTime64y describía el rango de valores deDateTime64. #110459 (Alexey Milovidov). ALTER TABLE... DETACH PARTITION/PARTahora ejecuta fsync en el clon que crea bajodetached/(el subárbol de la parte y la cadena de directorios hasta la raíz del disco) cuando está habilitada la configuraciónfsync_part_directoryde la tabla, tanto para el almacenamiento de partes Full (directorio) como Packed. Anteriormente, nunca se ejecutaba fsync en el clon, mientras que sí se hacía en la parte de cobertura vacía que elimina las filas del conjunto activo, por lo que una pérdida de energía justo después de la confirmación podía destruir los datos separados en btrfs (las entradas de directorio no sincronizadas del clon se revierten, dejandodetached/vacío y sin nada queATTACH). Está controlado por la configuración existentefsync_part_directory; el comportamiento predeterminado no cambia. #111426 (Groene AI).- Corrige un problema por el que
CREATE OR REPLACEdejaba el objeto reemplazado con un nombre interno cuando el autor de la llamada no tenía privilegios para eliminarlo. #111466 (Nikolay Degterinsky). - Se corrigió un fallo al ejecutar una lectura
STREAM(enable_streaming_queries = 1) sobre una tabla con más de una partición y una política de filas definida. En las builds de depuración y con sanitizers, fallaba con el error lógicoFilter column... not found in DAG outputs; en las builds de lanzamiento podía provocar un segfault. #111572 (Groene AI). - Corrige
count()en tablas Iceberg cuyo resumen de snapshot es inexacto o corrupto: la optimización de recuento trivial ahora obtiene recuentos exactos de filas a partir de los archivos de manifiesto y recurre a un análisis completo cuando las eliminaciones a nivel de fila hacen que los recuentos de metadatos sean inexactos. También corrige queOPTIMIZE TABLEde Iceberg escriba recuentos y linaje incorrectos en la lista de manifiestos, y hace que los metadatos detotalBytessean resistentes a resúmenes corruptos. #111617 (Melvyn Peignon). - Corrige un problema por el que una columna DEFAULT ausente en una parte se rellenaba con el valor predeterminado del tipo en lugar de con la expresión DEFAULT cuando la condición PREWHERE se dividía en varios pasos de lectura. Cierra #111757. #111795 (Yarik Briukhovetskyi).
- Se corrigieron los errores lógicos
Expected UInt64 column for __grouping_set, got BLOByColumnBLOB should be converted to a regular column before usageen una consulta distribuida ejecutada en un shard conenable_parallel_blocks_marshalling(habilitado de forma predeterminada), por ejemplo, conGROUP BY GROUPING SETSen un clúster con una réplica local, o al leer una tablaMergeque abarca una tabla local y una tabla distribuida.BlocksMarshallingStepya no se añade a los planes cuyos bloques se consumen en el mismo proceso. #111997 (Groene AI). - Las operaciones ahora fallan al cargar estadísticas MergeTree corruptas, en lugar de ignorar el error. #112201 (Sergey Kuznetsov).
- Corrige un error lógico al usar PREWHERE en una tabla Merge sobre otra tabla Merge o una vista materializada con un tipo de columna distinto. También corrige un problema por el que una política de filas se ignoraba silenciosamente en tablas que leen de servidores remotos —una tabla Distributed o una tabla que la envuelve—, lo que podía exponer filas que la política debía ocultar; ahora dichas consultas se rechazan con un error ILLEGAL_PREWHERE. En su lugar, defina estas políticas en las tablas locales subyacentes de cada servidor remoto; tenga en cuenta que esta política sigue sin aplicarse a las lecturas enviadas con
serialize_query_plan = 1, lo que constituye un error independiente ya existente. #112326 (Pedro Ferreira). - Corrige
connection_pool_max_wait_mspara que su valor documentado y predeterminado,0, signifique un tiempo de espera infinito. Antes, una consulta que encontraba el grupo de conexiones lleno reintentaba en un bucle cerrado, consumiendo CPU y registrandoNo free connections in pool. Waiting 0 ms.en cada iteración. Ahora espera hasta que se devuelva una conexión al grupo. Cierra #112053. #112380 (Groene AI). - Corrige la pérdida silenciosa de escrituras Iceberg confirmadas en HDFS: un commit de Iceberg publica cada nuevo archivo de metadatos mediante una escritura condicional, pero
HDFSObjectStoragedescartaba la condición y realizaba una sobrescritura normal, por lo que se confirmaban todos los escritores simultáneos mientras el snapshot de uno de ellos quedaba inaccesible. Ahora HDFS rechaza las escrituras condicionales, por lo que las escrituras Iceberg en HDFS administradas por el almacenamiento —incluidas las deCREATE TABLE... ENGINE = IcebergHDFS(...)con una lista explícita de columnas— fallan. Las lecturas no se ven afectadas. #112437 (Groene AI). - Corrige una lectura fuera de límites (un bloqueo en compilaciones de lanzamiento) en la deduplicación de inserciones cuando un
INSERTpasa por una vista materializada cuya consulta interna cambia el número de filas y la tabla de destino de la deduplicación está particionada.DeduplicationInfo::filterToPartitionasignaba cada token de deduplicación a particiones recorriendo su rango de filas de origen en un selector de particiones dimensionado según el bloque de salida —más pequeño— de la vista, lo que provocaba lecturas fuera de sus límites. Ahora conserva todos los tokens en todas las particiones para cualquier destino de vista materializada —donde, tras cambiar el número de filas, ya no existe la asignación de filas de origen a particiones— en lugar de realizar ese recorrido fuera de límites (y de generar elNOT_IMPLEMENTEDque una comprobación posterior producía para la misma inserción). #112649 (Sema Checherinda). - Corrige un error lógico (que provoca una abortación en compilaciones de depuración y con sanitizadores) cuando se aplica
finalizeAggregationa una columna cuyos estados de agregación proceden de funciones distintas que comparten una representación de estado, pero se finalizan en tipos diferentes; por ejemplo,quantileStateyquantilesState(0.9)combinados mediante unUNIONo generados conarrayReduce. Estas consultas ahora generan un error normal en lugar de bloquearse. #112662 (Zain Ul Abidin). - Corrige que
DELETEen tablasKeeperMapelimine solo las primerasmax_block_sizefilas coincidentes mientras informa de que la mutación se completó correctamente. También corrige queDELETEconkeeper_map_strict_mode = 1no sea atómico: podía recurrir a eliminaciones sin versión y eliminar filas actualizadas de forma concurrente, y aplicaba las filas coincidentes bloque a bloque, por lo que un conflicto podía dejar la eliminación aplicada parcialmente. #112777 (Alexey Milovidov). - Corrige que
ALTERen tablasMergeTreese aplique mientras aún está en curso una mutaciónRENAME COLUMNincompleta. Esto podía actualizar los metadatos de almacenamiento de forma incompatible y bloquear por completo las mutaciones posteriores. #112783 (Mikhail Artemenko). - Corrige el fallo al iniciar el servidor y al ejecutar
ATTACHconWITH RECURSIVE is not supported with the old analyzeren una vista con una CTE recursiva cuandoenable_analyzer = 0es el valor predeterminado del servidor. #112784 (Nikolay Degterinsky). - Corrige un error lógico al utilizar un motor de tabla
Joinen el lado derecho de un JOIN cuya secciónONcontiene una condición que hace referencia a columnas de ambas tablas, por ejemplo,ON (t.key = j.key) AND (t.a < j.a). Ahora esta consulta se rechaza con una excepción clara en lugar de generarrequired columns:... but not found any in left tableostd::bad_variant_access. #112815 (Groene AI). - Corrige resultados incorrectos en un
JOINcuya cláusulaONcontiene una condición mixta, es decir, una condición residual no equi entre ambos lados, comoON (t1.key = t2.key) AND (t1.a * 10 < t2.a). Solo la familia hash evalúa estas condiciones, perofull_sorting_merge,partial_mergey la unión directa clave-valor indicaban que podían ejecutar estos JOIN y luego ignoraban silenciosamente la condición residual, devolviendo filas adicionales. Ahora no los admiten, por lo que se utiliza un algoritmo hash. #112831 (Groene AI). - Corrige el error lógico
ReadBufferFromEncryptedFile: Wrong file positional leer una parteCompactde un discoencryptedcon E/S directa, que provocaba que las fusiones se bloquearan ensystem.replication_queue. #112943 (Alexey Milovidov). - Se corrige una ralentización cuadrática al analizar una consulta PromQL con una larga secuencia final de caracteres no reconocidos (por ejemplo, un valor
FixedStringrellenado con bytes NUL): el análisis de una entrada no válida de un megabyte podía mantener un hilo ocupado durante decenas de minutos y no se podía cancelar, ya que ocurre durante el análisis de la consulta. Ahora el analizador se detiene en el primer error. #112944 (Alexey Milovidov). - Se rechazan las duraciones de PromQL cuyas unidades se repiten o no están ordenadas de la mayor a la menor. #112954 (Minh Vu).
- Se corrige un bloqueo al escribir
Parquetconoutput_format_parquet_parallel_encodinghabilitado (el valor predeterminado) ymax_threadsmayor que 1. Si el codificador no lograba planificar un hilo adicional, su contador de hilos activos sufría un desbordamiento por defecto y la escritura podía dejar de avanzar de forma permanente, en lugar de finalizar o informar de un error. #112959 (Groene AI). #113170 (Alexey Milovidov). - Se corrigió que
geohashesInBoxconsumiera una cantidad de tiempo ilimitada para un rectángulo de área cero, comogeohashesInBox(0., 0., 180., 0., 12). Esta consulta devolvía el único geohash correcto, pero ejecutaba aproximadamente 5e8 iteraciones vacías de bucle por fila e ignoraba tantomax_execution_timecomoKILL QUERY. #112976 (Groene AI). - Se corrigió un comportamiento indefinido (se pasaba un puntero nulo a
memcpy) enreplaceRegexpOne/replaceRegexpAllcuando la cadena de reemplazo sustituye un grupo de captura que no participó en la coincidencia, por ejemploreplaceRegexpAll('abc', '(a)|(b)', '\\2'). #113012 (Alexey Milovidov). - Se rechaza un cambio de
SETTINGSmarcado como escrito sin valor cuando incluye un valor distinto detrue, y ya no se omite el valor de dicho cambio al formatear una consulta. Anteriormente, una carga útil JSON de AST manipulada podía ejecutar una configuraciónBoolconfalse, mientras quesystem.query_logyformatQueryFromJSONmostraban la forma sin valor. #113025 (Alexey Milovidov). - Se corrigieron un comportamiento indefinido y un error silencioso de planificación cuando se programa una tarea en segundo plano con un retraso muy grande, por ejemplo, mediante una vista materializada actualizable con un período
REFRESH AFTERenorme. Los retrasos ahora se limitan al mayor valor representable en lugar de desbordarse. #113041 (Groene AI). - Se corrigió una escritura fuera de límites al leer una columna
DECIMALdeParquetcuyo tipo físico es más ancho que el tipo al que corresponde su precisión declarada, por ejemplo,DECIMAL(9, 2)almacenado físicamente comoINT64. Estos archivosParquetson válidos y otros escritores los generan, pero el lector dimensionaba la columna de destino según la precisión declarada, mientras que el decodificador escribía el ancho físico, lo que corrompía la memoria. Ahora, al leer uno de estos archivos también se generaDECIMAL_OVERFLOWcuando un valor no cabe en la precisión declarada, en lugar de devolver datos corruptos, y se realiza una lectura sin pérdida si se proporciona una indicación de tipo de al menos el ancho del tipo físico. #113046 (Groene AI). - Se corrigió
intDiven una columna no constante con el divisor constante -1, que envolvía silenciosamente la división del menor número con signo (p. ej.,intDiv(-9223372036854775808, -1)) en lugar de generar la excepciónILLEGAL_DIVISION, como hacen las demás rutas de ejecución. Este desbordamiento silencioso también podía producir resultados incorrectos deORDER BY/DISTINCT, porque la optimización de lectura en orden trata correctamenteintDivcon una constante negativa como una función monotónica, pero el valor envuelto infringía el orden resultante. #113048 (Alexey Milovidov). - Se corrigió una incompatibilidad que impedía cargar en versiones posteriores los índices de texto creados en ClickHouse 26.3 con el tokenizador
unicode_word. #113061 (Robert Schulze). - Se corrigió un error lógico
Pipeline stucken consultas que distribuyen datos por partición, como una función de ventana conPARTITION BYo un join conjoin_algorithm = 'parallel_full_sorting_merge', cuando la fase posterior de un shard finalizaba mientras un bloque solo se había distribuido parcialmente. #113190 (Groene AI). - Se corrigieron resultados incorrectos cuando un hash join tiene una sola clave
LowCardinalityde un tipo de más de 8 bytes (UInt128,Int128,UInt256,Int256y sus variantesNullable). Este join devolvía silenciosamente filas cuyos valores de clave no eran iguales. #113230 (Groene AI). - Se corrigió un problema por el que
ALTER TABLE ... ADD PROJECTIONsobre una columnaALIASde nivel de tabla dejaba la tabla inutilizable y losINSERTposteriores fallaban conUNKNOWN_IDENTIFIER(Missing columns) cuando la sesión teníaoptimize_respect_aliases = 0. #109091 (Groene AI). - Se corrigieron las excepciones
NOT_FOUND_COLUMN_IN_BLOCKyLOGICAL_ERRORen unJOINdirectsobre una tabla derechaMergeTree, así como abortos relacionados en compilaciones de depuración y con sanitizador. #109932 (Groene AI). - Se corrigieron comparaciones que anteriormente generaban
ILLEGAL_TYPE_OF_ARGUMENTcuando los operandos no tenían un supertipo común mínimo. Ahora se pueden comparar lexicográficamente arrays comoArray(Int64)frente aArray(UInt64)yArray(Int256)frente aArray(UInt256)con=,!=,<,<=,>,>=,IS DISTINCT FROMeIS NOT DISTINCT FROM.isDistinctFromeisNotDistinctFromahora también comparan por valor pares compatibles de tipos numéricos y decimales que no son arrays, en lugar de generar una excepción, y también se corrigió la comparación de igualdad para arrays anidados dentro deTuple(Nullable(...)). Cierra #33897. #110245 (Diego Gomes Tomé). - Se corrigió un
LOGICAL_ERROR(Bad cast from ColumnString to ColumnLowCardinality) durante el análisis del índice de clave primaria cuando una columna de claveLowCardinalityestá envuelta en una cadena anidada deCASTque reintroduceLowCardinality, p. ej.,WHERE CAST(CAST(s, 'LowCardinality(String)'), 'String') < '5'. En compilaciones de depuración y con sanitizador esto abortaba el servidor; en compilaciones de lanzamiento, la consulta fallaba. #111050 (Groene AI). - Se corrigieron resultados incorrectos en un
FULL JOINsobre una tabla con motorJoinque usaUSINGcuando la clave izquierda esNullabley la clave de almacenamiento no lo es: una fila izquierda sin coincidencia con una claveNULLdevolvía0en lugar deNULL. #111371 (Groene AI). - Corrige la visibilidad de versiones obsoletas y eliminadas de filas al leer una base de datos
MaterializedPostgreSQLmediante una tablaMerge. Estas lecturas ahora pasan por el envoltorioMaterializedPostgreSQL, con el mismo filtrado porFINALy_sign = 1que las lecturas directas. #112382 (Alexey Milovidov). - Corrige
Bad cast from ColumnNullable to ColumnStringcuando una mutación que reescribe toda la parte se ejecuta en una parte cuyo tipo de columna es anterior al indicado en los metadatos de la tabla, por ejemplo, después deALTER TABLE ... MODIFY COLUMNseguido deALTER TABLE ... MATERIALIZE PROJECTION. #112501 (Alexey Milovidov). - Corrige que los formatos de entrada basados en filas ignoren
KILL QUERYymax_execution_timedurante varios minutos mientras analizan un bloque. Ahora comprueban si se ha solicitado la cancelación cada 8192 filas, por lo que unINSERTcancelado (incluida una descarga en segundo plano de inserciones asíncronas) se detiene rápidamente en lugar de ejecutarse hasta el final del bloque. #112646 (Groene AI). - Corrige que
RENAME TABLEcompruebe la longitud máxima del nombre de la tabla con respecto a la base de datos de origen en lugar de la de destino. Renombrar una tabla a una base de datos con un nombre largo podía generar una tabla queDROP TABLEno podía eliminar, y renombrar una tabla desde dicha base de datos se rechazaba incorrectamente. #113019 (Groene AI). - Corrige
UNKNOWN_IDENTIFIERal seleccionar desde unaVIEWcuyos tipos de columna declarados difieren de los tipos que produce su consulta interna, por ejemplo,SELECT sum(length(arr)) FROM v, dondevdeclaraarr Array(UInt8)sobre una columnaString. Con el valor predeterminadooptimize_functions_to_subcolumns = 1, el optimizador reescribíalength(arr)como una lectura de la subcolumnaarr.size0y redirigía ese nombre a la consulta interna, que no tiene dicha subcolumna. #113057 (Groene AI). - Corrige una excepción (en compilaciones de lanzamiento, un error que impide el inicio del servidor) cuando un predicado de mutación usa la función de tabla
mergesin especificar explícitamente el nombre de la base de datos. Ahora se usa la base de datos de la tabla mutada, igual que para los nombres de tabla. #113185 (Alexey Milovidov). - Corrige resultados incorrectos y un
LOGICAL_ERRORal leer una subcolumna de un miembroNestedeliminado y vuelto a añadir junto con un miembro existente del mismo grupo, en una tablaMergeTreeconshare_nested_offsets = 1. Los miembros existentes devolvían valores de un bloque posterior siempre que la lectura abarcaba más de un bloque. #113225 (Groene AI). - Corrige un bloqueo de las sentencias
ALTER,OPTIMIZE,TRUNCATEy de manipulación de particiones conalter_sync = 2enReplicatedMergeTreecuando la tabla empieza a apagarse mientras la sentencia espera a otra réplica, por ejemplo, debido a unDROP DATABASE ... SYNCsimultáneo. Ahora dicha sentencia falla conUNFINISHEDy también respetamax_execution_timeyKILL QUERY. #113228 (Groene AI). - No escribe secuencias de escape ANSI en
INTO OUTFILEcuandostdoutes un TTY. #113252 (Azat Khuzhin). - Corrige un caso poco frecuente de uso de memoria liberada en la cola de inserciones asíncronas cuando distintas entradas tienen plazos idénticos. #113363 (Miсhael Stetsyuk).
- Corrige tablas que quedaban silenciosamente vacías cuando se crea más de una base de datos
ENGINE = Backupa partir de la misma copia de seguridad o cuando dicha base de datos se vuelve a crear con otro nombre. La política de almacenamiento que respalda una base de datosBackupahora se identifica mediante un nombre que también incluye el nombre de la base de datos local, de modo que cada base de datos obtiene el disco creado para su propia ruta de datos. #113378 (Groene AI). - Corrige que las filas nunca se eliminen cuando una tabla
MergeTreetiene dos o más reglasTTL ... DELETE WHEREcon la misma expresión de tiempo y que solo difieren en la condiciónWHERE. Tras una fusión de eliminación por TTL, elrows_where_ttl_infode la parte se restablecía a cero, por lo que nunca se programaba otra fusión TTL y las filas expiradas se conservaban indefinidamente sin ningún error ni mensaje de registro. Cierra #113116. #113384 (Groene AI). - Una consulta sobre una tabla
Merge(o la función de tablamerge) que coincide con muchas tablas ahora responde aKILL QUERYymax_execution_timemientras se generan los planes de consulta de cada tabla, en lugar de hacerlo solo después de finalizar la planificación de todas las tablas hijas. Contimeout_overflow_mode = 'break', también deja de generar planes de consulta para las tablas coincidentes restantes y devuelve el resultado parcial sin error, tal como documenta ese modo. #113415 (Alexey Milovidov). #113642 (Groene AI). - Corrige que
clickhouse-clientsalga con el código139en lugar de0después de cancelar una consulta con Ctrl+C o después de unINSERTque lee datos de stdin. #113431 (Groene AI). - Permite que las expresiones de preprocesador y posprocesamiento de un índice de texto hagan referencia a columnas
ALIAS. #110014 (Jimmy Aguilar Mena). - Se corrigieron varios casos en los que las réplicas paralelas devolvían filas duplicadas:
distributed_aggregation_memory_efficientera ignorado por las réplicas paralelas basadas en planes, por lo que los buckets de la fusión eficiente en memoria llegaban desordenados y se fusionaban dos veces; además, se leían todas las réplicas de un fragmento aunque los datos no estuvieran divididos entre ellas, cuando las réplicas paralelas no eran aplicables a la consulta o cuandoparallel_replicas_modesolicitaba filtrado por clave personalizada sinparallel_replicas_custom_key. #112942 (Nikita Taranov). - Se corrigió que
CREATE TABLE ... AS SELECTno pudiera finalizarse cuando fallaba elSELECTque lo llenaba ydatabase_atomic_wait_for_drop_and_detach_synchronouslyestaba habilitado: elDROPinterno de limpieza de la tabla temporal esperaba la cola de eliminación en segundo plano e ignoraba tantoKILL QUERYcomomax_execution_time. #113504 (Groene AI). - Se corrigió que
ALTER TABLE ... EXECUTE remove_orphan_fileseliminara un archivo activometadata/version-hint.textde una tablaIceberg. Su entrada en el conjunto de archivos accesibles se creaba mediante concatenación de cadenas, suponiendo una barra diagonal final en un valor que nunca la tiene, por lo que el archivo de sugerencia real nunca se reconocía como accesible y se eliminaba al superar el umbralolder_than. Coniceberg_use_version_hint = 1, la tabla dejaba de poder leerse por completo. #113548 (Groene AI). - Se corrigió un problema por el que una vista parametrizada perdía su base de datos cuando una consulta que hacía referencia a ella sin calificar se enviaba a un segmento, haciendo que este resolviera el nombre en su propia base de datos predeterminada. Según el contenido de esa base de datos, la consulta fallaba con
UNKNOWN_FUNCTIONo devolvía silenciosamente filas de una vista distinta. Afecta aIN,JOINyremotea través de una tablaDistributed. #113550 (Groene AI). - Se corrigió un
LOGICAL_ERRORcuando una consulta filtrasystem.databasespor la columnanamemediante una subconsulta dentro deindexHint, por ejemploSELECT count() FROM system.databases WHERE indexHint(name IN (SELECT 'foo')). #113556 (Groene AI). - Se corrigió un bucle infinito en las fusiones en segundo plano y
OPTIMIZEcuandomerge_max_block_size_bytesse configuraba por debajo debyteSize()de una columna vacía. Una columnaLowCardinalityvacía conserva su diccionario, por lo que el límite de bytes podía alcanzarse antes de fusionar una sola fila; la fusión producía entonces bloques vacíos indefinidamente, consumiendo el 100 % de un núcleo de CPU y sin liberar nunca su ranura en el grupo en segundo plano. #113585 (Groene AI). - Se corrigió un problema por el que una consulta sobre una columna
Variantignorabamax_execution_timeyKILL QUERY. Al llamar a una función con varios argumentosVariant, la función se resolvía una vez por cada alternativa de cada argumento, y ninguno de los dos bucles que realizaban ese trabajo comprobaba si se había cancelado, por lo que la consulta no podía detenerse hasta que finalizara. #113612 (Groene AI). - Se corrigió
Unknown compression methodpara las sugerencias de compresiónautoynonecuando se escribían con una combinación de mayúsculas y minúsculas distinta de todo en minúsculas, por ejemplofile('data.csv.gz', 'CSV', 'x String', 'AUTO'). Los nombres de códecs comoGZIPya se aceptaban sin distinguir entre mayúsculas y minúsculas; las dos sugerencias especiales ahora se comportan igual. #113631 (Groene AI). - Se corrigió el plegado de constantes con el nuevo analizador, que cambiaba el tipo de un valor constante
Geometry.Geometryes unVariantcon nombre cuyas alternativas pueden compartir la misma disposición de almacenamiento (LineString/Ring,MultiLineString/Polygony valores vacíos), por lo que dos constantes plegadas que solo diferían en su alternativa podían colapsar en una sola; por ejemplo,MULTIPOLYGON EMPTYse convertía enLINESTRING(). #110709 (Groene AI). - Se corrigió una excepción (
Cannot calculate columns sizes when columns or checksums are not initialized) durante la fusión de una tablaMergeTreede una sola columna, cuya única columna tiene unTTLque expira por completo, conmin_bytes_for_wide_part = 1. #111169 (Groene AI). - No poder iniciar un pool de programación en segundo plano (por ejemplo, el pool
icebergcuando se agota el pool global de hilos) ya no aborta el servidor: el error ahora es una excepción recuperable. Leersystem.background_schedule_pooltampoco crea ya esos pools como efecto secundario. #111209 (Groene AI). - Se corrigió una lectura fuera de límites en el protocolo nativo con datos de índice corruptos. #112331 (Pavel Kruglov).
- Se corrigió un interbloqueo que bloqueaba permanentemente una base de datos
FilesystemoHDFScuando dos consultas resolvían el mismo nombre de tabla al mismo tiempo. Todas las consultas posteriores contra esa base de datos se bloqueaban indefinidamente y no podían interrumpirse, por lo que era necesario reiniciar el servidor para recuperarse. #112495 (Groene AI). - Corrige que
max_execution_timeyKILL QUERYno surtieran efecto silenciosamente en una consulta distribuida que establece conexiones con réplicas. Ahora, la consulta se detiene en el siguiente intento de conexión, en lugar de probar cada réplica y reintento restantes. #112689 (Groene AI). - Corrige que
DROP TABLEySYSTEM STOP VIEWse bloquearan cuando una vista materializada actualizable estaba bloqueada al planificar su consulta de actualización. #113188 (Nikolay Degterinsky). - Se corrigió que
CREATE TABLEconENGINE = Distributed(...)oENGINE = Buffer(...)y sin lista de columnas revelara la estructura de una tabla referenciada que el usuario creador no tiene permiso para ver. En unCREATElocal, la estructura ahora se infiere en el contexto del propio usuario, por lo que se requiereSHOW COLUMNSen la tabla referenciada. No se aplica a unCREATEreproducido desde la cola DDL (ON CLUSTERo dentro de una base de datosReplicated). #113220 (Groene AI). #113372 (Groene AI). - Se corrigió la lectura de la base de datos interna
_temporary_and_external_tablesmediante la función de tablamergey el motor de tablaMerge, que permitía a una sesión leer las tablas temporales de otras sesiones y usuarios. Ahora, una expresión regular para bases de datos omite esa base de datos, y se deniega especificarla explícitamente, igual que se deniega el acceso directo a ella. #113224 (Alexey Milovidov). - Se corrigió que
countSubstrings,countSubstringsCaseInsensitive,countSubstringsCaseInsensitiveUTF8,countMatchesycountMatchesCaseInsensitiveignoraranKILL QUERYymax_execution_time: una llamada sobre muchas filas, muchas coincidencias o un valor grande podía ejecutarse durante minutos después de cancelar la consulta. #113369 (Groene AI). #113886 (Groene AI). - Se corrigió que una mutación de una parte Compact produjera resultados distintos según si la información de serialización de la parte aún estaba en memoria o se había recargado desde
serialization.json, cuando la tabla usaserialization_info_version = 'basic'. EnReplicatedMergeTree, esto hacía que dos réplicas con una parte de origen idéntica byte por byte escribieran partes mutadas diferentes y que la mutación fallara conCHECKSUM_DOESNT_MATCH. Cierra #113500. #113588 (Groene AI). - Se corrigió que
made_current_atensystem.iceberg_historyinformara de la primera hora en que una instantánea pasó a ser actual, en lugar de la última, cuando el mismosnapshot-idaparece más de una vez en elsnapshot-logdeIceberg(como sucede tras una reversión). #113598 (Groene AI). - Corrige valores incorrectos en columnas virtuales como
_tableo_databaseseleccionadas desde el lado derecho de unJOINcon un origen de clave-valor comoEmbeddedRocksDB,KeeperMap,Rediso un diccionario. En su lugar, la consulta podía devolver un valor de columna de datos o fallar conLOGICAL_ERROR. #113698 (Groene AI). - Corrige que
EXPLAIN ANALYZEsobre una tablaMergecon varios hijos, unPREWHEREcon una columna sin expresión y unWHEREindependiente fallara conRequired output position N is out of range for pass-through inputs. Cierra #113621. #113725 (Groene AI). - Se corrigió un fallo de
clickhouse-disks moveal mover un directorio que producíaDIRECTORY_ALREADY_EXISTSen discos conmetadata_type = plain_rewritable(por ejemplo,s3_plain_rewritable) y que además dejaba un directorio de destino vacío. #113727 (Groene AI). - Se corrigió un fallo en las lecturas de tablas
MergeconNo set is registered for key ...cuando una tabla secundaria declara una columnaALIASque contieneINy las tablas secundarias difieren en el valor predeterminado de esa columna. #113757 (Groene AI). - Se corrigió
UNKNOWN_IDENTIFIERconenable_analyzer = 0cuando unWHEREhace referencia a una columna producida poruntupledentro de una subconsulta, por ejemplo,SELECT t.keys FROM (SELECT untuple(arrayJoin(m)) AS t FROM ...) WHERE t.values > 0. La reescritura deenable_optimize_predicate_expressioninsertaba ese predicado en la subconsulta como unHAVING, donde el nombre aún no existe. #113760 (Groene AI). - Se corrigió un fallo de
ALTER TABLE ... MODIFY COLUMNconCannot specify codec for column type ALIAScuando una instrucción convierte una columnaALIASen una columna física (DEFAULToMATERIALIZED) y especifica unCODEC. Cierra #113693. #113853 (Groene AI). - Se corrigieron
ORDER BY ALLyGROUP BY ALLen una tablaMergecombinada mediante un join con el analizador anterior (allow_experimental_analyzer = 0). La consulta ya no falla con una excepción interna, y las compilaciones de depuración y con sanitizador ya no se interrumpen. #109139 (Groene AI). - Se corrigió una excepción esporádica
Cannot parse string ... as UInt64 ... While executing ValuesBlockInputFormatque podía producirse al insertar valores cuyas expresiones contienen una conversión numérica, comoinitializeAggregation('sumState', 0::UInt64). #110637 (Groene AI). - Se corrigió la comprobación periódica de discos locales que notificaba fallos en un disco en buen estado. Cuando un servidor ejecuta un Keeper integrado junto con un disco
local, dos hilos de comprobación podían sondear el mismo archivo, registrar transitoriamenteFILE_DOESNT_EXIST,CANNOT_READ_ALL_DATAoCANNOT_UNLINKe incluir temporalmente el disco en la métricaBrokenDisks. #110773 (Groene AI). - Se corrigieron resultados incorrectos y un error lógico
Cannot serialize FutureSetFromSubquery with no query planen consultas sobre tablasMergey la función de tablamergecuando estaban habilitadas las réplicas paralelas basadas en planes. #112849 (Alexey Milovidov). - Una tabla del motor de base de datos
URLya no revela a un usuario sin el privilegio de lectura de la fuente si existe un archivo local. TantoEXISTS TABLE, que solo requiere el privilegioSHOW TABLES, como la resolución del nombre de la tabla ahora esperan a la comprobación de privilegios antes de sondear el sistema de archivos. #113029 (Alexey Milovidov). - Se corrigió el caso en que una expresión TTL quedaba inutilizable cuando el plegado de constantes eliminaba las columnas a las que hace referencia; por ejemplo,
TTL d + INTERVAL 1 DAY DELETE WHERE isNull(x)en unaxnoNullable, lo que hacía que cadaINSERTen la tabla fallara conMissing columns. También se corrigió el fallo al iniciar el servidor cuando una tabla tenía una expresión TTL sobre una columnaVariantcreada convariant_throw_on_type_mismatch = 0. #113042 (Alexey Milovidov). - Se corrigió la cancelación de lecturas de la función de tabla
postgresqly del motor de tablaPostgreSQL. Cancelar mientras la lectura aún se estaba iniciando podía provocar una condición de carrera en el puntero de la transacción y hacer que se perdiera la cancelación, dejando la consulta en ejecución hasta que PostgreSQL la finalizara. #113150 (Groene AI). - Ahora
UNDROP TABLEpuede interrumpirse conKILL QUERYmientras espera a que las consultas en ejecución liberen la tabla eliminada. #113263 (Alexey Milovidov). - Se corrigió una fuga de memoria de todo el analizador XML cuando un controlador XML de
Pocolanza una excepción durante el análisis; por ejemplo, debido a un desbordamiento dePoco::XML::NamePoolal analizar un documento con muchos nombres de elementos únicos. #113348 (Alexey Milovidov). - Se corrigieron las escrituras en el disco
HDFS: ya no fallan conParent directory doesn't existcuando la clave de objeto generada contiene prefijos de directorios anidados, ya que ahora se crean los directorios principales que faltan. #113396 (Alexey Milovidov). - Se corrigieron resultados incorrectos y, en compilaciones con aserciones habilitadas, un fallo de aserción en un
JOINcon un diccionario cuya cláusulaONincluye una condición no equitativa entre ambas tablas, comoON (t.key = d.key) AND (t.a * 10 < d.a), cuandojoin_use_nullsestá habilitado. #113534 (Alexey Milovidov). - Se corrigió el bloqueo de una consulta durante hasta
receive_timeoutsegundos cuando finalizaba muy rápidamente en el iniciador. #113551 (Nikita Taranov). - Se corrigió que
UPDATEy la eliminación ligeraDELETEleyeran tablas incorrectas cuando la base de datos de la tabla actualizada difiere de la base de datos de la sesión. Los nombres de tabla no cualificados y la función de tablamergeahora se resuelven en la base de datos de la tabla actualizada, por lo que la instrucción ya no actualiza ni elimina silenciosamente filas seleccionadas de otra tabla. #113748 (Groene AI). - Se corrigió un rechazo espurio con
TOO_MANY_PARTSde unINSERTparalelo: cuandomax_insert_threadsparaleliza unINSERTsimple, la consulta ya no cuenta las partes confirmadas por sus propios receptores hermanos. Cierra #114015. #114016 (Alexey Milovidov). - Se corrigieron
NO_SUCH_COLUMN_IN_TABLEcuando una consulta con réplicas paralelas selecciona una columnaALIASde una tabla enviada como tabla temporal deGLOBAL JOIN,MULTIPLE_EXPRESSIONS_FOR_ALIAScuando ambos lados de unJOINdistribuido declaran una columnaALIAScon el mismo nombre, yUNKNOWN_IDENTIFIERcuando una tablaDistributeddeclara una columnaALIASbasada en otra columnaALIAS, incluso como clave deJOIN USING. #107700 (Yakov Olkhovskiy). - Se corrigió la lectura de un
TupleCSV cuyo primer elemento esNULL. Coninput_format_csv_deserialize_separate_columns_into_tupleeinput_format_null_as_defaulthabilitados, un\Ninicial en una fila como\N,1se interpretaba como si toda la columna fueraNULL, por lo que la fila se sustituía por un valor predeterminado y las celdas de los elementos restantes provocaban un error de análisis. Ahora, elNULLinicial se considera el valor del primer elemento yinput_format_null_as_defaultse aplica a ese elemento. Una fila que proporciona un único campo\Npara unTuplesimple completo carece ahora de los elementos restantes y se rechaza; establezcainput_format_csv_deserialize_separate_columns_into_tuple = 0para volver a leer ese campo como la columna completa. #109744 (Groene AI). - Se corrigió un caso poco frecuente de
Logical error: 'No more packets are available.'en una consulta distribuida válida con unLIMIT. En compilaciones de depuración y con sanitizadores, también provocaba la interrupción del servidor. #110334 (Groene AI). - Se corrigió un error lógico (
!part.empty()) al usar una tablaDistributeddefinida con un nombre de base de datos remota vacío en unJOINcondistributed_product_mode = 'local'. #110677 (Groene AI). - Se corrigió la resolución de nombres de columna completos, como
db.table.column, en el analizador para tablas que tienen el mismo nombre que su base de datos. Cierra #82084. #110976 (Alexey Milovidov). - Se corrigió la pérdida de optimizaciones posteriores a la construcción en las uniones hash (conversión a una tabla hash fija, filtro de tiempo de ejecución compartido y reorganización por rangos de la tabla derecha) cuando se configuraba un umbral automático de desbordamiento a disco, que es el valor predeterminado desde la versión 26.5. #111972 (Alexey Milovidov).
- Se corrigió un error por el que
ALTER TABLE ... MODIFY COLUMN, al cambiar una sugerencia de tipoJSON(conallow_experimental_json_lazy_type_hintshabilitado) en una columna cuya subcolumna se utiliza en la clave primaria o de ordenación, la clave de partición o un índice de omisión explícito, podía corromper la clave o el índice en disco. Las lecturas normales lo ocultaban mediante la estructura almacenada en caché, pero, tras volver a cargarla (por ejemplo, al reiniciar el servidor), las consultas fallaban conCANNOT_READ_ALL_DATAo devolvían resultados incorrectos. EstosALTERse rechazan ahora siempre que cambien el tipo en disco de una subcolumnaJSONreferenciada. Los cambios de sugerencias de tipo en columnas ajenas a esas estructuras, o los cambios que no modifican el tipo en disco de las subcolumnas referenciadas (por ejemplo, añadir una ruta tipada no relacionada), siguen siendo operaciones de solo metadatos. #112302 (Pavel Kruglov). - Se corrigieron resultados incorrectos cuando
query_plan_join_swap_tableintercambia las tablas de unANY JOINmientrasjoin_any_take_last_row = 1: ClickHouse ahora conserva el orden original de los lados de la unión para queANY JOINsiga devolviendo la última fila coincidente. Cierra #111645. #112458 (Vladimir Cherkasov). - Se corrigió que
listObjectsen un discoAzureBlobStoragecon un endpoint con prefijo devolviera nombres de blob incorrectos en cada página después de la primera, porque la paginación omitía el envoltorio de cliente que elimina el prefijo del endpoint. Ahora, la paginación vuelve a pasar por el envoltorio mediante el token de continuación, de modo que los nombres de blob son correctos en todas las páginas. #112872 (Arsen Muk). - Se corrigió la asignación de memoria sin límites al leer un archivo
Parquetcuyos metadatos Thrift declaran una longitud de contenedor o cadena mayor que los propios metadatos. Ahora, dicha longitud se rechaza en lugar de asignarle memoria. #113212 (Groene AI). - Se corrigió
Cannot insert element into Set(NOT_IMPLEMENTED) cuandoread_in_order_use_virtual_rowestá habilitado y una consultaMergeTreede lectura ordenada combinaWITH FILL ... INTERPOLATEcon un filtroINohas. #113264 (Groene AI). - Se corrigió la omisión silenciosa de
optimize_read_in_orderen algunas consultasORDER BY, incluidas las que usan una fila virtual otoString/CAST(..., 'Nullable(String)')sobre una clave de ordenaciónString. También se corrigieron resultados incorrectos en filtros uORDER BYaplicados atoStringde valoresTime,Time64oDateTimeen zonas horarias con horario de verano. #113291 (Vladimir Cherkasov). - Se rechazan expresiones
parallel_replicas_custom_keyno válidas, comotuple()o(x, y), conILLEGAL_TYPE_OF_COLUMN_FOR_FILTER, en lugar de leer más allá del final de la lista de tipos de claves personalizadas. #113359 (Nikita Taranov). - Se corrigió un fallo al reiniciar el servidor después de que se terminara durante un
DROP TABLEde una tabla que usa una colección con nombre: unDROP NAMED COLLECTIONposterior podía completarse correctamente, dejando metadatos de tabla que hacían referencia a una colección con nombre inexistente y provocando que el siguiente inicio fallara conNAMED_COLLECTION_DOESNT_EXIST. #113524 (Alexey Milovidov). - Se corrigieron dos casos en los que una base de datos
DataLakeCatalogde AWS Glue informaba de que una tabla no existía en lugar de informar de un error.SHOW TABLESysystem.tablesya no fallan conDATALAKE_DATABASE_ERROR(“Exception calling GetTables … not found”) cuando falta una base de datos de Glue mientras se enumeran sus tablas, por ejemplo, porque se eliminó simultáneamente una base de datos no relacionada de la misma cuenta de AWS; en ese caso, la base de datos no aporta tablas en lugar de interrumpir la enumeración.EXISTS TABLEya no devuelve0para una tabla existente cuando la llamada subyacente aGetTablefalla por un motivo distinto de que la tabla no exista, como un fallo de autenticación, DNS o 5xx. Cualquier otro error de Glue sigue propagándose en ambas rutas. #113591 (Groene AI). - Se corrigió un error de durabilidad de Keeper por el que un bloqueo mientras se persistía el archivo de estado de Raft (que almacena
termyvoted_for) podía dejar el nodo sin un estado válido ni una copia de seguridad. Al reiniciarse, el nodo podía restablecerse aterm = 0y conceder un voto que ya había concedido en ese término, lo que podía provocar dos líderes y la pérdida de datos confirmados. El estado anterior ahora se conserva hasta que el nuevo archivo de estado se escribe y sincroniza por completo. #113654 (Alexey Bakharew). - Se corrigió una carrera de dato cuando se destruye una tabla
MergeTreemientras sus tareas en segundo plano de actualización de estadísticas, actualización de partes o carga de partes obsoletas/inesperadas aún se están ejecutando. #113722 (Alexey Milovidov). - Se corrigieron
ORDER BY ALLen unaWINDOW VIEWy los erroresUNKNOWN_IDENTIFIERparaINTERPOLATE,WINDOWyLIMIT BYen consultas sobre una tablaMergeoDistributedcon una unión, al usar el analizador antiguo. #113759 (Alexey Milovidov). - Se corrigió una fuga de memoria en el códec de compresión experimental
SZ3: cuando la compresión de datos poco comprimibles o corruptos fallaba con una excepción, los búferes temporales de trabajo permanecían asignados. #113916 (Alexey Milovidov). - Se corrigió la complejidad cuadrática al analizar el argumento de dirección de las funciones de tabla
remote,mysqly similares: una dirección muy larga (por ejemplo, unFixedStringde un megabyte rellenado con ceros) hacía que la consulta se bloqueara durante el análisis y no pudiera cancelarse. #113918 (Alexey Milovidov). - Se corrigió un fallo de
OPTIMIZE TABLEen una tablaIcebergcon el errorUnsupported snapshot's operation type OVERWRITEcuando el historial de la tabla contenía una eliminación de filas que eliminaba más de una fila por archivo de eliminación por posición. Cierra #113745. #113964 (Groene AI). - No replicar
ALTER TABLE ATTACH PARTITION FROMen bases de datos replicadas. #94835 (MikhailBurdukov). - Los ajustes no válidos del tamaño de carga en Azure (por ejemplo,
azure_min_upload_part_size = 0oazure_max_blocks_in_multipart_upload = 0) ahora se rechazan de forma anticipada con un error claro, en lugar de provocar una excepción interna (second_size > 0) en una fase profunda de la ruta de escritura. Esto se aplica tanto a los ajustes de consulta como a la configuración de discos de Azure. #103394 (Statxc). - Se corrigió el escape incorrecto de literales SQL en
StorageSQLitey en la función de tablasqlite()al hacer pushdown de predicadosWHEREa SQLite: las comillas simples y los caracteres de control (\n,\r,\t,\) se escapaban con barras invertidas, que SQLite no interpreta, lo que provocaba errores de sintaxis o resultados de consulta incorrectos. También se corrigió el escape de literales de cadena enviados mediante pushdown a PostgreSQL: las cadenas anidadas en listasINconservaban el escape de ClickHouse, y los caracteres de control se enviaban como secuencias de barras invertidas que PostgreSQL interpreta como bytes diferentes. #104217 (Shaohua Wang). - Se corrigió la excepción
NOT_FOUND_COLUMN_IN_BLOCKen consultasINNER JOIN ... ON arrayJoin(...) = ...cuandoquery_plan_convert_join_to_inestá habilitado y el SELECT hace referencia a la columna de array de origen. #104809 (Shaohua Wang). - Se corrigieron las expresiones IN y NOT IN con operandos no constantes en el lado derecho que hacen referencia a columnas de la fila actual, y se alineó el manejo de tuplas en el lado derecho del nuevo analizador con la semántica IN existente de ClickHouse. Con el analizador anterior, una columna de origen sin calificar en el lado derecho (
x IN (arr)) todavía se resuelve como un nombre de tabla y queda fuera del ámbito. #104993 (Yue Ni). - Se corrigió el error
Cannot add column ...: column with this name already existsenINSERT SELECTdesde una función de tabla comofile,s3oinput, cuando se selecciona la misma columna de origen más de una vez. #105982 (etienne). - Rechazar
max_replication_lag_to_enqueue = 0en bases de datosReplicated. Este valor hacía que la comprobación de falta de sincronización posterior a la recuperación fuera trivialmente verdadera y abortaba el servidor conLOGICAL_ERRORen compilaciones de depuración y con sanitizadores. Ahora0se rechaza durante el análisis conBAD_ARGUMENTSdesde cualquier origen (CREATE DATABASE ... SETTINGS, bloque de configuración del servidor<database_replicated>, reproducción deATTACHy reproducción, durante una actualización, de metadatos existentes). El valor válido más pequeño es1. Cierra #98823. #106006 (Groene AI). - Corrige el error
Logical error: 'Pipeline stuck'en consultas que usanenable_sharding_aggregator = 1junto conUNION ALLy un valor demax_streams_for_union_stepinferior al ancho del pipeline.BufferedShardByHashTransformahora finaliza los puertos de salida con colas vacías en cuanto se agota la entrada y sigue obteniendo datos de entrada cuando un puerto vacío solicitado no tiene nada que drenar, incluso si una cola asociada ha alcanzado el límite de contrapresión. #106251 (Groene AI). - Se corrigió un desbordamiento de enteros con signo cuando un ajuste de tiempo de espera, como
interactive_delay, se establecía en un valor muy grande: la espera podía agotar el tiempo de espera inmediatamente en lugar de esperar, y el servidor podía abortar bajo el sanitizador de comportamiento indefinido. #106961 (Groene AI). - Ahora se rechaza con un error claro la exportación al formato
Arrowde valoresTime/Time64fuera de un intervalo de hora del día válido (negativos o>= 24h), en lugar de escribir datostime32/time64de Arrow no válidos. #107179 (Shaohua Wang). - Corrige resultados incorrectos de
GROUP BYen una tablaDistributedcon columnasALIASduplicadas que se expanden a la misma expresión (p. ej., dos columnas definidas comotoString(x)) con agregación distribuida de dos niveles o eficiente en memoria. Las claves duplicadas se contraían en una sola en los segmentos, pero se fusionaban usando el conjunto completo de claves en el iniciador; por ello, con la agregación de dos niveles, grupos iguales de distintos segmentos acababan en cubos diferentes y no se fusionaban, devolviendo un grupo por segmento con uncount()dividido. #108855 (Groene AI). - Se corrigió un error espurio de
Inconsistent AST formattingparaALTER TABLE ... MOVE PART ... TO SHARD '<path>'. El formateador de consultas eliminaba la palabra claveSHARD, por lo que la consulta reformateada no podía volver a analizarse y generaba unLOGICAL_ERROR(una excepción controlada en las compilaciones de lanzamiento y un aborto en las compilaciones de depuración y con sanitizadores). #109060 (Groene AI). - Rechaza desplazamientos no monotónicos de
Arrayen todas las rutas de lectura que los decodifican como valores absolutos, en lugar de hacerlo solo en el formatoNative. Anteriormente, un gránulo de índice de omisiónsetcorrupto no se comprobaba y después se leía fuera de los límites. #109212 (Groene AI). JSONExtractahora respetacast_string_to_date_time_modeal convertir valores JSON de cadena aDateTime/DateTime64, de forma coherente conCAST. Cierra #109126. #109252 (Utkal Singh).- Corrige un posible error lógico “Unexpected substream … for column …” al aumentar el ajuste de compatibilidad. #109496 (Pavel Kruglov).
- Establece el componente de coordinación que faltaba en el cálculo del tamaño de system.detached_parts. #109553 (Den Kalantaevskii).
- Se corrigió un problema por el que el tiempo de espera para bloques de las inserciones en streaming (
input_format_max_block_wait_ms) podía no expirar nunca mientras el perfilador de consultas estuviera activo: el sondeo del descriptor de archivo se reiniciaba con el tiempo de espera completo después de cada señal del perfilador, por lo que una fuente de entrada bloqueada podía retrasar indefinidamente el vaciado del bloque parcial en lugar de vaciarlo al alcanzar el límite de espera. #109602 (Shaohua Wang). - El plegado de constantes durante la planificación de consultas ya no ejecuta una función cuyo tipo de argumento difiere del tipo para el que se resolvió durante el análisis. Esta discrepancia solía generar un
LOGICAL_ERRORal calcular la cabecera de salida, lo que provoca un fallo de aserción en compilaciones de depuración y con sanitizadores. Ahora se omite el plegado y una consulta realmente no válida sigue notificando un error recuperableILLEGAL_TYPE_OF_ARGUMENTa través de la ruta de ejecución normal. #109747 (Groene AI). - Corrige una mutación que hace referencia a la columna virtual
_sample_factory fallaba a mitad de ejecución conUnexpected const virtual column: _sample_factor, dejando la mutación bloqueada. Ahora la mutación la lee como1, el mismo valor que devuelve una consulta sinSAMPLE. #109813 (Groene AI). - Corrige tres problemas con
use_constant_folding_in_index_analysis: un error lógicoInvalid partition key sizeque podía abortar unSELECTque usaba una proyección normal cuando la tabla establecepart_minmax_index_columns = 'with_block_number_offset'; resultados incorrectos (filas descartadas silenciosamente) para un filtro sobre una clave de partición por módulo comoPARTITION BY id % 200; y un fallo (carrera de dato) al consultar un índicetextcon un tokenizadorsparseGramsmediante un predicadoLIKEen muchas particiones conmax_threads > 1. #109896 (Groene AI). - Corrige una carrera de dato (y un fallo poco frecuente) cuando se informa de un error de análisis o de procesamiento al leer una tabla de archivo o almacenamiento de objetos. Un error de análisis generado durante la inicialización diferida de
KeyConditionse compartía como un único objeto de excepción entre los hilos de lectura, y dos hilos podían añadir simultáneamente(in file/uri ...)a su mensaje, provocando una condición de carrera en la cadena del mensaje de excepción. #109911 (Groene AI). - Corrige la propagación de ajustes de consulta en
accurateCastOrDefaulty conserva los valoresNULLde origen codificados porDynamicyVariant. Cierra #109943. #109946 (Pavel Kruglov). #114912 (Alexey Milovidov). - Se corrigieron resultados incorrectos de
subBitmap,bitmapSubsetInRangeybitmapSubsetLimitpara bitmaps que aún usaban la representación pequeña, incluidos valores de elementosUInt64eInt64superiores a2^32, que se truncaban a 32 bits. Las comparaciones en funciones de bitmap sobre tipos de elementos con signo ahora usan de forma coherente el valor sin signo del tipo de elemento, por lo que en un bitmapInt8el elemento-1se compara como255en lugar de como4294967295con extensión de signo; esto también corrigebitmapMin,bitmapMax,bitmapContainsybitmapTransformen bitmaps que han superado la representación pequeña. Deben ajustarse las consultas que pasaban umbrales con extensión de signo: en un bitmapInt8,bitmapSubsetInRange(bm, 4294967168, 4294967296)pasa a serbitmapSubsetInRange(bm, 128, 256). También se corrigió quegroupNumericIndexedVectordevolviera resultados distintos para columnas del índiceInt8eInt16que para tipos de índice más amplios, y quenumericIndexedVectorGetValuedevolviera0para índices negativos. Se corrigió la documentación de las funciones de bitmap, incluidas las funciones de subconjuntos, que se describían como si usaran indexación basada en 1, y la compatibilidad conbitmapBuild/bitmapToArraycon signo. #110072 (Rami Darwiche). - Se corrige que
optimize_aggregation_in_orderignorase la cancelación de consultas.AggregatingInOrderTransformahora comprueba la cancelación mientras agrega un fragmento, por lo que una consulta detenida medianteKILL QUERYo pormax_execution_time(con el valor predeterminadotimeout_overflow_mode = 'throw') se detiene de inmediato en lugar de procesar todo el fragmento. #110104 (Groene AI). - Se corrigió una condición de carrera entre
KILL TRANSACTIONyALTER TABLE ... UPDATE/DELETEejecutados dentro de una transacción: una reversión producida entre el registro de la mutación en la transacción y su registro en la tabla dejaba una entrada de mutación huérfana, lo que generaba un error lógico (Cannot find transaction ... that has started mutation ...) en tareas en segundo plano y bloqueaba todas las mutaciones posteriores de las partes afectadas hasta reiniciar el servidor. #110226 (Shaohua Wang). - Se corrige un
LOGICAL_ERROR(Left and right columns have same names) en el optimizador del orden de join que podía activarse mediante un join separado por comas en una vista de varias tablas cuandoquery_plan_merge_expression_into_joinestá habilitado. #110227 (Groene AI). - La estimación de cardinalidad del orden de join ahora combina las estadísticas de columna de las partes que sobreviven a la poda por partición/PK, en lugar de las de todas las partes activas. Anteriormente, una consulta podada a una partición pequeña se planificaba con estadísticas de toda la tabla (se observó una sobreestimación de 2500 veces del número de filas que invertía el lado de construcción del hash join), y deshabilitar las estadísticas producía, paradójicamente, un plan mejor. También se corrigió que FINAL diferido se deshabilitara silenciosamente para relaciones MergeTree bajo un JOIN porque el resultado memorizado del análisis de índices del optimizador del orden de join se confundía con una proyección aplicada. #110283 (Sergey Kuznetsov).
- Se corrigieron resultados incorrectos de subconsultas escalares correlacionadas cuando la consulta externa tiene valores duplicados para la columna correlacionada y la subconsulta se descorrelaciona mediante la ruta CROSS JOIN. Anteriormente, agregaciones como
count()ysum()se multiplicaban por el número de duplicados. Esto afecta a la funcionalidad experimentalallow_experimental_correlated_subqueries. #110311 (Groene AI). - Se corrige un error lógico (
Function node with name '...' is not resolved as ordinary function) que podía producirse conoptimize_or_like_chainhabilitado cuando una función de agregación o de ventana aparecía en el lado izquierdo de unLIKE/ILIKE/matchdentro de una cadenaOR. #110641 (Groene AI). - Se corrige que un
TTL ... DELETE WHERE <cond>nunca eliminase filas que pasaban a coincidir con<cond>debido a unALTER TABLE ... UPDATEen una columna a la que hace referencia elWHERE. La mutación ahora recalcula el TTL de la fila, por lo que las filas expiradas que ahora coinciden se eliminan en lugar de conservarse silenciosamente. #110648 (Groene AI). - Se corrige una fuga en la contabilización del seguimiento de memoria: cuando una asignación era rechazada por un memory tracker principal (por ejemplo, el límite de memoria de todo el servidor), los rastreadores de nivel de hilo, consulta y usuario conservaban la cantidad rechazada. El error se acumulaba con el tiempo, inflando
MemoryTrackingy el uso de memoria por consulta y por usuario, y podía provocar errores espuriosMEMORY_LIMIT_EXCEEDED. #110784 (Seva Potapov). - Se corrigió la serialización WKB no canónica de un polígono vacío:
wkb(POLYGON EMPTY)ahora emitenumRings = 0en lugar de un anillo espurio de cero puntos, por lo que un recorrido de ida y vuelta en WKB de un polígono vacío estándar preserva su identidad. #110796 (Groene AI). - Corrige un caso al usar alias de columnas de CTE con consultas
INTERSECToEXCEPT, p. ej.,WITH t (a, b) AS (SELECT 1, 2 INTERSECT SELECT 1, 2) SELECT a, b FROM t, en el que la consulta fallaba con el error UNKNOWN_IDENTIFIER. Cierra #104770. #110885 (Yarik Briukhovetskyi). - Se corrigió un
std::length_error(LOGICAL_ERROR) al leer una tabla MergeTree con un valor problemático demax_streams_for_merge_tree_reading(cercano al máximo deUInt64) junto conallow_asynchronous_read_from_io_pool_for_merge_tree = 1. La configuración ahora se limita al mismo máximo quemax_threads. #110936 (Groene AI). - Corrige un fallo (desreferenciación de puntero nulo durante el análisis de consultas) cuando se llama a
getSubcolumnen un argumentoJSONcon un nombre interno de subcolumna de indicación de tipo, es decir, uno que comienza con un marcador de tipo de acento grave. #110940 (Groene AI). - Se corrigió
Nested type LineString cannot be inside Nullable type (ILLEGAL_TYPE_OF_ARGUMENT)al leer una columna espacial nullable de MySQL (LINESTRING,POLYGON,MULTILINESTRING,MULTIPOLYGON,MULTIPOINTo el tipo genéricoGEOMETRY) mediante la función de tablamysqlo los motores de tabla/base de datosMySQL. Estas columnas ahora usanNullable(String), que contiene el valor tal como lo devuelve MySQL (un prefijo SRID de 4 bytes seguido de la carga útil WKB).POINTmantiene la asignación aNullable(Point). #110943 (Groene AI). - Corrige la serialización
Nativede envolturasSimpleAggregateFunctionque contienen estados de agregación versionados para pares antiguos. #110997 (Groene AI). - Se corrigió un
LOGICAL_ERROR: ReadBuffer is canceled. Can't read from it.que podía producirse en una unióngrace_hashcuando la lectura de bloques volcados fallaba a mitad de la operación mientras varios hilos compartían el lector. #111056 (Groene AI). - Cada clave SSH ahora cuenta individualmente para el límite
max_authentication_methods_per_user, por lo que este se aplica de forma coherente independientemente de la sintaxis. Antes, varias claves en un único métodossh_keycontaban como una. #111181 (Yecine Megdiche). - Corrige un
LOGICAL_ERROR(Reading from materialized CTE '...' before its materialization completed - DelayedPortsProcessor gate is missing in the query plan) cuando se lee una CTE materializada reutilizada (enable_materialized_cte) en una rama cuya salida deWITH TOTALSoextremesse descarta, incluidos los casos de agregación externa,INSERT ... SELECT, operaciones de conjuntos yEXPLAIN ANALYZE. #111194 (Groene AI). - Se corrigió que
map[key]devolviera el valor de una clave duplicada posterior en lugar del de la primera. Cuando una columnaMapcontenía claves duplicadas, el resultado demap[key]podía depender de las filas anteriores del mismo bloque y de la configuraciónoptimize_functions_to_subcolumns, por lo que unSELECTy unWHEREsobre la misma fila podían no coincidir. #111246 (Groene AI). - Corrige un error lógico
!rhs_literal->getValue().isNull()en el optimizador de expresiones lógicas cuando una cadena de condicionesANDcompara una columna con una constante de valor NULL de tipo noNullable(por ejemplo, unVariantde valor NULL) conuse_variant_default_implementation_for_comparisons = 0. #111292 (Groene AI). - Se corrigieron errores
NOT_FOUND_COLUMN_IN_BLOCK/THERE_IS_NO_COLUMN(y, en algunas versiones, resultados incorrectos sin que se notificara ningún error) en unRIGHT JOINcuando se configuraparallel_replicas_min_number_of_rows_per_replicay se proyecta una columna de la tabla izquierda. #111332 (Groene AI). RESTOREahora ejecuta fsync en los archivos de las partes restauradas cuando la tabla de destino tiene habilitadofsync_after_insert, por lo que una parte restaurada es tan resistente a pérdidas de energía como una parte insertada. Anteriormente, los archivos restaurados solo se escribían y cerraban (sin ejecutar fsync), por lo que una pérdida de energía justo después de queRESTOREdevolvieraRESTOREDpodía dejar las partes dañadas y la tabla vacía. #111378 (Groene AI).- Corrige una infrecuente ventana de pérdida de datos de Keeper en discos de snapshots locales: la ruta de escritura de snapshots ahora ejecuta fsync en el directorio de snapshots tras eliminar el marcador
tmp_, por lo que una pérdida de energía ya no puede eliminar el marcador y conservar el contenido del snapshot. Anteriormente, un fallo de este tipo hacía que Keeper tratara un snapshot correcto y completamente sincronizado como incompleto y lo eliminara al reiniciarse, con la consiguiente pérdida de escrituras confirmadas incluso conforce_sync=true. No se incluyen los discos de snapshots respaldados por almacenamiento de objetos. #111397 (Groene AI). - Corrige una lectura fuera de límites (en versiones de lanzamiento) / error lógico (en depuración) en la optimización de materialización diferida, y un error lógico en
Pipe::unitePipespara tablasMerge, cuando la optimización de lectura directa desde el índice de texto deja una columna virtual de índice sin usar en la cabecera de lectura de una tablaMergeTreecon varios índicestext. #111467 (Groene AI). - Se corrigió que la columna virtual
_timede las funciones de tablaurl/urlClusterfuera siempreNULLen compilaciones basadas en musl debido al análisis no portable de la cabecera HTTPLast-Modified. #111619 (Konstantin Bogdanov). - Se corrigió un
LOGICAL_ERROR(Cannot create part with type Compact and storage type Full because table does not support polymorphic parts) que se generaba cuando una tablaMergeTreecargaba una parteCompactpreexistente mientras su configuración actual deshabilitaba las partes polimórficas (granularidad no adaptativa). Esto podía ocurrir, por ejemplo, cuando una tabla de solo lectura comparte una ruta en disco con otra tabla y recarga sus partes medianteSYSTEM RESTART DISKo al iniciar el servidor. En compilaciones de depuración y con sanitizers, la excepción aborta el servidor. #111626 (Groene AI). - Se corrigió que
CREATE TABLE ... ENGINE = KeeperMapfallara conCoordination error: No node, path .../metadata/drop_lock_versioncuando otra tabla en la misma ruta de Keeper se elimina simultáneamente. La creación ahora considera el subárbol de metadatos desaparecido como una limpieza completada y vuelve a intentarlo, como ya hace en la misma situación una instrucción más adelante. #111966 (Groene AI). - Corrige una condición de carrera entre una mutación de
ReplicatedMergeTreey la eliminación de directorios temporales antiguos que podía publicar una parte mutada a la que le faltaban algunos archivos, lo que provocaba fallos al leer esa parte y en todas sus mutaciones posteriores. #111992 (Alexey Milovidov). - Corrige que
quantileDeterministic,quantilesDeterministicymedianDeterministicdevolvieran resultados distintos para los mismos datos en cada ejecución cuando la consulta utiliza réplicas paralelas, una tabla distribuida o agregación externa, o cuando los estados se almacenan en una tabla (incluso dentro de un valorDynamic). Los estados escritos antes de esta versión con la notación de tipo sin versión conservan el comportamiento anterior, ya que su diseño no puede cambiar. #112052 (Alexey Milovidov). - Corrige la omisión de
serialize_string_in_memory_with_zero_bytedel plan de consulta serializado. Conserialize_query_plan = 1, un clúster que se ejecutaba con esta configuración deshabilitada podía presentar diferencias en la representación de cadenas en memoria entre el iniciador y el nodo que ejecutaba el plan deserializado, porque la configuración se leía durante la deserialización, pero nunca se escribía durante la serialización y, por tanto, siempre tomaba su valor predeterminado en el nodo ejecutor. #112131 (Groene AI). - Corrige que un marco de pila se mostrara como
?en lugar del nombre de su función en mensajes de registro fatales y en la columnatrace_fulldesystem.crash_log. Afectaba a marcos de funciones normales con código atribuido a una cabecera__functionalde libc++, algo habitual en compilaciones de lanzamiento. #112152 (Alexey Milovidov). - Corrige casos de filas que faltaban silenciosamente cuando una consulta filtraba con
intDiv(constant, key)odivide(constant, key). El análisis de la clave primaria y de las particiones informaba una dirección de monotonicidad incorrecta para una constante dividida por una columna clave, por lo que se descartaban los gránulos coincidentes y la consulta devolvía menos filas sin errores. También corrigeintDivcon un dividendo constante sin signo cuyo bit alto está establecido, deja de indicar monotonicidad cuando un operandoDecimalhace que la división se calcule con el ancho nativo del decimal y evita que el análisis de claves genereCannot compare DB::IPv4 with longpara una consulta válida que divide una constanteIPv4/IPv6por una columna clave. #112156 (Groene AI). - Corrige que
DROP TABLE ... SYNCse bloqueara indefinidamente cuando se había cancelado una consulta sobresystem.replicasantes de que se procesaran sus solicitudes de estado. #112164 (Nikolay Degterinsky). - Corrige un aborto del servidor (
SIGABRT) cuando una UDF de WebAssemblyBUFFERED_V1devuelve un búfer de resultados vacío; ahora la consulta falla con unWASM_ERRORcapturable y el servidor permanece activo. #112182 (Nikolai Ovchinnikov). - Corrige un uso de memoria después de liberarla cuando un
JOINconjoin_algorithm = 'direct'sobre un diccionario recibía una clave de unión almacenada con serialización dispersa.getColumnVectorDatadevolvía una referencia a una columna temporal, por lo que la búsqueda en el diccionario leía memoria liberada: las compilaciones de lanzamiento podían devolver resultados incorrectos y las compilaciones de depuración o con sanitizador se abortaban. #112327 (Groene AI). - Corrige casos en los que no se aplicaba la política de filas a las proyecciones de MergeTree durante la ejecución de consultas. #112329 (Yarik Briukhovetskyi).
- Se corrigió la corrupción de datos al insertar en una tabla Iceberg a la que se accede mediante una
MATERIALIZED VIEW. El archivo de datos se escribía conforme a los tipos de columna del destino en el momento deCREATE, en lugar de a su esquema Iceberg actual, por lo que un valorDateTimese almacenaba como unintAvro sin formato y se leía como microsegundos; conDateTime64(0)oDateTime64(9), el archivo ni siquiera podía volver a leerse. Como consecuencia,INSERT INTO <materialized view>en un destino cuyo esquema Iceberg tiene más columnas que las declaradas en la vista ahora generaTYPE_MISMATCHen lugar de escribir una fila corrupta. #112359 (Groene AI). - Keeper ya no rechaza una solicitud
Setcon datos vacíos cuando superamax_memory_usage_soft_limit. Dicha solicitud no puede aumentar la cantidad de datos almacenados, y rechazarla impedía que los clientes restablecieran su sesión, lo que podía mantener las tablas en modo de solo lectura durante todo un evento de memoria de Keeper. #112386 (Shaohua Wang). - Se corrigió un problema por el que un follower de Keeper podía quedar fuera del quórum durante mucho tiempo y provocar errores masivos de
Session expireddespués de instalar correctamente un snapshot grande: el líder descartaba el acknowledgement del follower cuando la aplicación del snapshot tardaba más que el tiempo de espera de instalación y, a continuación, retrocedía el índice de log de ese follower una entrada por cada viaje de ida y vuelta. También se añadió la configuración de Keepernuraft_snapshot_sync_ctx_timeout_mspara controlar este tiempo de espera, que antes solo podía modificarse medianteraft_limits_response_limity, por tanto, no sin ralentizar también la detección de pares inactivos. #112405 (Shaohua Wang). - Se corrigieron carreras de datos en los eventos de perfil y el rastreador de memoria. #112466 (Miсhael Stetsyuk).
- Corrección de un error relacionado con la seguridad. #112479 (Kseniia Sumarokova).
- Se corrige la lectura de un índice secundario de omisión obsoleto después de un cambio de tipo mediante
ALTER TABLE ... MODIFY COLUMNcuya mutación nunca se ejecutó, por ejemplo, porqueKILL MUTATIONla eliminó: los gránulos en disco se escribieron con el tipo anterior, pero se decodificaron con el nuevo, lo que generabaLOGICAL_ERROR, solicitaba asignaciones de varios exabytes o devolvía silenciosamente resultados incorrectos. También se corrige un resultado incorrecto de un índice sobre una expresión cuyo significado cambia aunque todos los bytes almacenados permanezcan idénticos, por lo que no se crea ninguna mutación: unMODIFY COLUMNque cambia únicamente la zona horaria deDateTime, o solo un nombre de tipo personalizado, como deUInt8aBool. Este índice ahora se omite para la parte afectada. Cierra #112213. #112484 (Groene AI). - Se corrigió un bloqueo al leer un archivo Parquet con metadatos incoherentes de filtro bloom. Estos archivos también podían devolver silenciosamente menos filas de las debidas. #112498 (Shaohua Wang).
- Se corrige la carrera de datos en readBigAt de AsynchronousBoundedReadBuffer. Cierra #109678. #112573 (Kseniia Sumarokova).
- Se corrige que una lista de alias de columnas como
(SELECT 1) AS t(x)oWITH t(x) AS (SELECT 1)no fuera visible dentro de la función de tablaview, donde una referencia at.xfallaba conUNKNOWN_IDENTIFIERaunque la misma construcción funciona fuera deview. #112690 (Groene AI). - Se corrigió el error lógico
SortingAggregatedTransform already got bucket with number Nque podía producirse en consultasGROUP BYdistribuidas de varias capas que utilizan agregación de dos niveles. #112794 (Nikita Taranov). - Se corrigió el problema por el que una tabla
NATSconnats_streamconfigurado dejaba de consumir silenciosamente tras reiniciar el servidor NATS. La suscripciónJetStreamahora se restablece automáticamente, sin necesidad de ejecutarDETACH TABLEyATTACH TABLE. #112828 (Groene AI). - Se corrigió un error transitorio de Azure Blob Storage en la ruta de lectura o fusión —un
403 Forbiddendebido a la propagación de permisos RBAC, un fallo de autenticación de credenciales o un tiempo de espera de conexión que se mostraba como408— que se clasificaba erróneamente como no reintentable y se notificaba comoPOTENTIALLY_BROKEN_DATA_PART(código 740), lo que generaba una alerta crítica falsa para una parte en buen estado. Estos fallos transitorios ahora se consideran reintentables, y un fallo realmente persistente se muestra como un error normal de Azure en lugar de una parte de datos dañada inexistente. #112871 (Arsen Muk). - Se corrigió el problema por el que la eliminación por lotes de objetos de Azure no registraba eventos Delete en
system.blob_storage_logcuando fallaba la propia solicitud por lotes, dejando todo el lote sin registrar. Ahora se registra un evento Delete para cada objeto si se produce un fallo a nivel de lote. #112873 (Arsen Muk). - Se corrigió la pérdida del índice MinMax por parte sobre
_block_numbery_block_offsettras recargar una tabla cuando la parte se generaba mediante una mutación que no reescribe la parte completa. #112878 (Alexey Milovidov). - Se corrigieron un error lógico y resultados incorrectos cuando una condición
JOIN ONno equi que se evalúa durante el join contienearrayJoin. Un joinhash,parallel_hashograce_hashahora rechaza esa condición conINVALID_JOIN_ON_EXPRESSION. Cuando la expansión depende de un solo lado, muévala a unARRAY JOINen una subconsulta antes del join; una condición cuyo argumento dearrayJoinlee columnas de ambos lados debe reestructurarse. #112889 (Groene AI). - Se corrigieron resultados incorrectos de
ORDER BYal leer de una tablaMergesobre tablasDistributed: las filas podían devolverse desordenadas y podían faltar filas que debían incluirse en el resultado cuando se utilizabaLIMIT. #112931 (Alexey Milovidov). - Se corrigió el problema por el que una constante
Boolsituada a la derecha deINse convertía al tipoStringdel lado izquierdo como'1'/'0', en lugar de los valores canónicos'true'/'false'(ahora es coherente conCASTy la función de tablavalues). #113051 (Yakov Olkhovskiy). - Se corrigió la columna
viewsdequery_logpara las inserciones en una tablaAliascuyo destino activa vistas materializadas, que siempre estaba vacía. #113076 (Enric Calabuig). - Se corrigió
LOGICAL_ERRORal leer una tabla con un índice de omisiónsetdefinido sobre una expresión cuando la consulta repite esa expresión con un operandoNullable, por ejemplo,WHERE intDiv(id, (SELECT 1000)) = 3sobreINDEX b_set intDiv(id, 1000) TYPE set(100). Basta una subconsulta escalar para desencadenarlo, ya que se tipa comoNullable. #113244 (George Larionov). - Corrige un error lógico (excepción)
Chunk info was not set for chunk in MergingAggregatedTransformcuando está habilitada la configuracióninject_random_order_for_select_without_order_byy una consulta de agregación lee de una tablaMergeque contiene una tabla secundariaDistributed: el envoltorio aleatorioORDER BY rand()ya no se inyecta en consultas planificadas únicamente hasta una etapa intermedia. #113266 (Alexey Milovidov). - Se corrigió un bloqueo durante la optimización del plan de consulta cuando una cláusula
WHEREcontiene una constante de cadena grande con muchos puntos y la tabla tiene un índice de omisiónbloom_filter,tokenbf_v1,ngrambf_v1otext. Al comparar el nombre de una columna de filtro con las columnas de índiceJSONAllPaths(...), se enumeraban todas las divisiones del nombre por puntos, lo que hacía que la creación de condiciones para el índice de omisión tuviera una complejidad cuadrática respecto a la longitud de la constante. Cierra #113003. #113289 (Groene AI). - Se corrigió
ATTACHde una tablaKafkacuandokafka_num_consumerssupera el límite derivado del número de núcleos de CPU. #113390 (Nikolay Degterinsky). - Se corrigieron un bloqueo permanente de
DROP TABLEy una fuga de memoria después de que fallara una consulta que usaba una CTE materializada. La tabla permanecía atascada en la cola de eliminación hasta que se reiniciaba el servidor. #113397 (Shaohua Wang). - Corrige un error lógico
IDENTIFIER is not a table expressioncuando se usa una función de tabla de la familia remote con un argumentoview(...)en el lado izquierdo de unJOIN ... USINGcuya clave es un alias de la listaSELECT, conanalyzer_compatibility_join_using_top_level_identifier = 1. #113400 (Groene AI). - Se corrigió la lectura de tablas Paimon particionadas por una columna
TIMESTAMPcon una precisión superior a milisegundos, que fallaba conscale 6 is not supported, only support scale <= 3. Cierra #112768. #113401 (JIaQi Tang). - Corrige un fallo de segmentación y un
LOGICAL_ERROR(No host found for exchange stream final_result__0_0) cuando una subconsulta establecedistributed_plan_execute_locallyen su propia cláusulaSETTINGSconmake_distributed_plan. El plan distribuido y el código que lo ejecuta leían la configuración desde dos contextos diferentes y podían no coincidir, por lo que el iniciador construía una canalización contradictoria. #113422 (Groene AI). - Se corrigió la lectura de tablas Paimon que contienen una columna
ARRAYoMAPanulable. Estas tablas no podían leerse en absoluto, porque el asignador de esquemas envolvía el tipo compuesto enNullable, lo que ClickHouse prohíbe; por ello, tantoDESCcomoSELECTfallaban conNested type Array(Nullable(Int32)) cannot be inside Nullable type. Ahora, una columna compuesta anulable se asigna a un tipo compuesto noNullabley un valorNULLse lee como uno vacío. Cierra #113337. #113450 (Groene AI). - Corrige la poda de partes y gránulos para una condición
JOIN ONque incluye columnas constantes del otro lado. #113484 (Vladimir Cherkasov). - Se dejó de escribir una parte cuyo diseño
Mapcontradice sus propios metadatos para un valorMapdentro de una columnaDynamic. Las tablas que solo diferían enmap_serialization_versioncompartían un objeto de serialización en caché, por lo que una parte podía adoptar el diseñoMapbasicmientras sus metadatos declarabanwith_buckets, y su lectura posterior fallaba conLOGICAL_ERROR: Stream ...buckets_info ... is not found. Las partes que una versión anterior ya escribió de esta forma siguen siendo ilegibles y deben eliminarse. #113514 (Groene AI). - Se corrigió que el tipo de columna inferido dependiera del orden de las consultas anteriores para una fuente cuyo esquema está en caché. Las configuraciones que modifican un tipo inferido no se incluían en la clave de caché de inferencia de esquema, por lo que el valor de la primera consulta determinaba el tipo que verían todas las consultas posteriores:
input_format_try_infer_exponent_floats,max_parser_depth,input_format_json_infer_array_of_dynamic_from_array_of_different_typesy, paraParquet, tambiéninput_format_parquet_local_time_as_utc,input_format_parquet_allow_geoparquet_parser,input_format_parquet_skip_columns_with_unsupported_types_in_schema_inferenceyschema_inference_make_json_columns_nullable. También se registra el getter de clave de caché que faltaba paraFormy se hace que el getter deTemplateuse la regla de escape de su propio formato de fila. #113533 (Groene AI). - Se corrigió una condición de carrera teórica en los eventos de perfil al usar la configuración
trace_profile_events_listpara escribir trazas de pila de determinados eventos de perfil ensystem.trace_log. #113553 (Miсhael Stetsyuk). - Se corrigió que
RENAME DATABASEaceptara un nombre de destino lo suficientemente largo como para imposibilitar la eliminación de las tablas de la base de datos. La comprobación de longitud del nombre de tabla ahora se ejecuta independientemente decheck_table_dependenciesy también cubre las tablas desconectadas, que nunca se comprobaban y, por tanto, se veían afectadas incluso con la configuración predeterminada. Cierra #101747. #113557 (Groene AI). - Se corrigió el error
LOGICAL_ERRORReading from materialized CTE '...' before its materialization completed - DelayedPortsProcessor gate is missing in the query plan, que se producía cuando una tablaMergecon más de un elemento hijo leía una CTE materializada a la que hacía referencia la consulta externa. #113558 (Alexey Milovidov). - Se corrigió que una política de fila que contiene una subconsulta escalar se evaluara una sola vez y luego se reutilizara indefinidamente tras leer la tabla mediante una tabla
Merge. La condición de política analizada se almacena en caché y se comparte entre todas las consultas; al leerla medianteMerge, la expresión almacenada en caché se reescribía in situ, lo que también provocaba una condición de carrera entre consultas simultáneas que usaban la misma política. #113563 (Alexey Milovidov). - Se corrigió
Unsupported JOIN keys of type keys256 in StorageJoinal leer una tabla con motorJoincuya clave es compuesta (varias columnas) o un único valor de 16/32 bytes, comoUUID,Int256oFixedString(4). Era posible crear esta tabla, escribir en ella y usarla en un join, pero no volver a leerla conSELECT. Cierra #74362 y #77394. #113578 (Groene AI). - En la UI web, abrir un enlace con
run=1ya no provoca que las URL de otras pestañas ejecuten automáticamente sus consultas en la siguiente recarga de la página. #113595 (Alexey Milovidov). - Se corrigió un error lógico al comparar arrays cuyo tipo de elemento es
Nothing. #113609 (Groene AI). - Las copias de seguridad ahora notifican el error subyacente de acceso al archivo de bloqueo, en lugar de indicar incorrectamente una copia de seguridad simultánea cuando el almacenamiento de destino no puede leer el archivo .lock. #113637 (Kirill Shokhin).
- Corrige un error lógico
Sending a distributed query with unknown (zero) client versioncuando se adjunta una tablaDistributedsin estructura sobre un segmento remoto o se carga a partir de metadatos escritos por una versión anterior del servidor. #113675 (Alexey Milovidov). - Trata un byte NUL como un literal normal en los patrones de match(). #113690 (Vitaly Baranov).
- Corrige que
theilsUsobre un marco de ventana devolviera un valor arbitrario en lugar de 0 cuando el primer argumento es constante dentro del marco. #113691 (Alexey Milovidov). - Corrige
Logical error: Duplicate announcement received for replica number Ncuando las réplicas paralelas automáticas (automatic_parallel_replicas_mode) adoptan un plan cuya variante de nodo único se segmentó mediantequery_plan_join_shard_by_pk_ranges. #113730 (Alexey Milovidov). - Corrige
CANNOT_CONVERT_TYPEy una excepción enGroupingAggregatedTransformal leer una tablaMergecon una tablaDistributedcomo elemento secundario en réplicas paralelas con clave personalizada (parallel_replicas_mode = 'custom_key_sampling'o'custom_key_range'). Cierra #113741. #113742 (Alexey Milovidov). - Se corrigió un
LOGICAL_ERRORcuando unSELECTusaba el modificadorSTREAMen una tabla con nombre junto con réplicas paralelas en modo de tareas de lectura. Con una CTE materializada utilizada como conjuntoINenPREWHERE, el servidor generabaReading from materialized CTE ... DelayedPortsProcessor gate is missing in the query plan(un aborto del servidor en compilaciones de depuración y con sanitizador). Las tablas conSTREAMahora se rechazan cuando se solicitan réplicas paralelas: conenable_parallel_replicas = 2, la consulta falla conSUPPORT_IS_DISABLED; con1, se ejecuta sin ellas, exactamente como ya ocurre conFINAL. #113754 (Groene AI). - Se corrigió un fallo del servidor al realizar un join con una expresión
ONconstante contra un lado derecho que contiene unARRAY JOIN. Al leer de forma diferida una columna replicada del lado derecho se utilizaba unColumnReplicatedya liberado. Cierra #113859. #113901 (Groene AI). - Corrige comportamientos indefinidos y resultados incorrectos en
avgsobreDate/DateTime/DateTime64/Time/Time64: el promedio ahora se calcula con exactitud en el espacio de enteros, lo que corrige tanto el desbordamiento en el límite deInt64(UB y resultados incorrectos en x86) como la pérdida de precisión deFloat64por encima de 2^53 (visible a escala de nanosegundos). #113912 (Alexey Milovidov). - Corrige resultados incorrectos en
JOINconjoin_algorithm = 'partial_merge'cuando el lado derecho incluye totales: podía quedar sin combinar, por lo que los joinsLEFTsustituían las coincidencias reales por valores predeterminados y los joinsINNER/RIGHTno devolvían ninguna fila. En la ruta no unida deRIGHT/FULL, el mismo estado desreferenciaba un puntero nulo, lo que provocaba un fallo del servidor. #113936 (Groene AI). - Se corrigió un defecto en las integraciones de
MySQLque permitía sobrescribir una credencial TLS de una colección con nombre con un valor vacío dessl_ca_pem/ssl_cert_pem/ssl_key_pemcuando la colección almacenaba la credencial en formato de contenido, descartando silenciosamente la CA o el certificado de cliente configurado en lugar de rechazar la sobrescritura. #113947 (Alexey Milovidov). - Corrige una excepción
std::out_of_range(Logical error: 'std::exception. Code: 1001, type: std::out_of_range', que también aborta el servidor en compilaciones de depuración y con sanitizadores) en el lector de Parquet v3 cuando una columna necesaria únicamente para evaluar filtros se programaba para decodificarse después de que su ranura de salida ya se hubiera descartado. #113956 (Groene AI). - Corrige un error lógico (
Unexpected return type) al hacer pushdown al almacenamiento de un filtro sobre una vista cuyo tipo de columna difiere del almacenamiento subyacente (por ejemplo,information_schema.tables, dondeengineesNullable(String), sobresystem.tables, donde esString). #113984 (Alexey Milovidov). - Corrige que ClickHouse Keeper se negara a iniciarse con
CORRUPTED_DATAdespués de un bloqueo durante el truncamiento entre segmentos del registro de Raft (writeAt), lo que podía dejar una entrada de registro confirmada aislada tras segmentos obsoletos del registro de cambios. #114003 (Nishant Agarwal). - Una tabla o base de datos cuyo nombre se sustituya en una ruta de ZooKeeper de
ReplicatedMergeTreemediante la macro{database}o{table}ahora se rechaza si el nombre no constituye un único componente de ruta seguro. Anteriormente, un nombre que contenía/se insertaba sin escape, por lo que la tabla registraba sus znodes dentro del subárbol de Keeper de otra tabla y dañaba permanentementeALTERyOPTIMIZEallí. También se rechazan los componentes.y.., los caracteres de control y la sintaxis de macros. Las tablas existentes siguen cargándose y adjuntándose. #114006 (Groene AI). - Corrige una fuga de memoria con
optimize_aggregation_in_order = 1cuando la clave de ordenación de la tabla es un prefijo estricto de la clave deGROUP BYy se usa una función de agregación cuyo estado ocupa memoria del montón, comoquantileDD. La memoria del servidor aumenta con cada una de estas consultas hasta reiniciar el servidor. #114010 (Groene AI). - Corrige un error lógico cuando un plan de consulta distribuida contiene una función de ventana que produce un estado de función de agregación, por ejemplo,
theilsUState(a, b) OVER (ORDER BY a)conmake_distributed_plan = 1. Afecta a las familiascramersV,cramersVBiasCorrected,theilsUycontingency. #114020 (Groene AI). - Corrige resultados incorrectos para
SELECT DISTINCTcon unLIMITque debe leer toda su entrada:LIMIT n WITH TIESdescartaba filas empatadas,exact_rows_before_limit = 1informaba un valor truncado derows_before_limit_at_leastyGROUP BY ... WITH TOTALScalculaba la fila de totales a partir de un prefijo del flujo. #114025 (Groene AI). - Se corrigió que
isProbablePrimeenUInt128/UInt256ignoraramax_execution_timeyKILL QUERY. Un bloque de valores de gran tamaño se ejecutaba hasta completarse dentro de una sola llamada de función, sin ningún punto de cancelación, por lo que una consulta podía seguir ejecutándose durante minutos después de superar su plazo límite. #114032 (Groene AI). - Corrige la ausencia de una fila en
system.query_views_logpara una vista materializada que falla mientras se recopilan sus dependencias conmaterialized_views_ignore_errorshabilitado. En compilaciones de depuración y con sanitizadores, esto también provocaba que el servidor se abortara constd::out_of_rangeen lugar de registrar la vista. #114064 (Groene AI). - Corrige el error
Code: 46. DB::Exception: Unknown function exists. (UNKNOWN_FUNCTION)que se producía cuando una cláusulaPREWHEREcontiene un predicadoIN (subquery)y se establecerewrite_in_to_join = 1(omake_distributed_plan = 1, que lo habilita de forma forzada). La misma consulta conWHEREfuncionaba correctamente. #114067 (RohithPariki). - Corrige que
ORDER BY ... LIMITdevolviera menos filas de las solicitadas, posiblemente ninguna, cuando una política de filas era el único filtro de la consulta y la columna de ordenación tenía un índice de omisiónminmax. La optimización top-K restringía la lectura antes de aplicar la política de filas. #114073 (Alexey Milovidov). - Corrige que
hasAny,hasAll,has,indexOf,mapContainsKey,mapContainsValueymapContainsdevolvieran muy pocas filas o fallaran conTOO_LARGE_STRING_SIZEal consultar un índicebloom_filtercon una constanteFixedString. El índice calculaba el hash de la forma con relleno de la constante, mientras que la función compara la forma sin relleno, por lo que se omitía un gránulo coincidente. #114089 (Alexey Milovidov). - Corrige un
LOGICAL_ERROR“Not-ready Set is passed as the second argument for functionglobalNullIn” y la pérdida del mensaje de error real de la consulta, que podían producirse cuando la poda de partes mediante estadísticas ejecutaba especulativamente una subconsultaIN/GLOBAL INdurante el análisis de índices y dicha subconsulta fallaba. #114121 (Groene AI). - Respeta la configuración
allow_calculating_subcolumns_sizes_for_merge_tree_readingen la optimización de PREWHERE. #114146 (Pavel Kruglov). - Rechaza un diccionario corrupto o malicioso en el que
lcpsupera el token anterior olcp + data_sizese desborda, antes de escribir en el búfer. #114155 (Elmi Ahmadov). - Corrige que
minymaxen columnasDateTime64devolvieran resultados incorrectos una vez que la agregación se compilaba con JIT y los datos contenían marcas de tiempo anteriores a 1970.is_signedno estaba especializado paraDateTime64yTime64, que derivan deDecimal64, por lo que el código generado comparaba los recuentos de ticks como enteros sin signo y una marca de tiempo anterior a 1970 obtenía el máximo y no el mínimo. #114168 (Groene AI). - Corrige una excepción al leer una tabla
MergeTreemediante capas de rangos de clave primaria cuando una capa produce una canalización vacía. #114177 (Alexey Milovidov). - Corrige el código de error notificado para algunas columnas serializadas como
Replicatedmalformadas recibidas mediante el protocolo nativo: ahora se rechazan conINCORRECT_DATAen lugar deLOGICAL_ERROR(que abortaba el servidor en compilaciones de depuración y con sanitizadores). #114186 (Pavel Kruglov). - Se corrigió un fallo en
ATTACH PARTITION FROM,REPLACE PARTITION,MOVE PARTITION TO TABLEy al añadir una réplicaReplicatedMergeTree, que producíaTables have different ...,METADATA_MISMATCHoINCOMPATIBLE_COLUMNSen tablas cuyas definiciones se habían escrito con paréntesis redundantes, comoPARTITION BY (a),ORDER BY (b),INDEX ix (b * c) TYPE minmax,PROJECTION p (SELECT (b) ...),CONSTRAINT c CHECK (a > 0),TTL (d + INTERVAL 10 YEAR)oDEFAULT (a + 1). #114188 (Alexey Milovidov). - Se corrigió la omisión por parte de
ALP,FPCyGCDde su parámetro derivado del tipo en el hash del códec. En una parte compacta, el escritor comparte un flujo comprimido por cada hash de códec distinto, por lo que dos columnas con distinto ancho de valores que usaban el mismo códec entraban en conflicto y compartían un objeto de códec con un ancho incorrecto. Esto rechazaba inserciones válidas conCANNOT_COMPRESScuando los anchos diferían y, de lo contrario, comprimía una de las columnas peor de lo debido. #114189 (Groene AI). - Se corrigió
std::out_of_range: map::at: key not foundcuando una expresión de clave deMergeTreecontiene una llamada amortonEncodeohilbertEncodeque no es en sí misma una columna de clave, por ejemploORDER BY mortonEncode(hilbertEncode(x, y), x, y)oPARTITION BY mortonEncode(x, y) % 4. #114233 (Groene AI). - Se eliminó LIMIT/OFFSET sin modificadores en la consulta de origen para el relleno histórico de vistas de ventana. #114247 (Alexey Milovidov).
- Se corrigió un
LOGICAL_ERRORenarrayAutocorrelationcuando el argumento es un array no vacío cuyo tipo de elemento esNothing, por ejemploSELECT arrayAutocorrelation([arrayMax([])]). Este tipo de argumento ahora se rechaza conILLEGAL_COLUMN. El literal de array vacío[]sigue devolviendo[]. #114249 (Groene AI). - Se corrigió que un servidor Keeper nunca se uniera al clúster cuando
nuraft_use_bg_thread_for_snapshot_ioestá habilitado: el lote de registros enviado a un servidor que se estaba uniendo se descartaba silenciosamente, por lo que el cambio de miembros nunca se completaba. #114275 (Shaohua Wang). - Se corrigió la lectura de
XDG_CACHE_HOMEdesdeXDG_STATE_HOME. #114278 (Alexey Milovidov). - Se registró el espacio de nombres de Iceberg en el catálogo antes de escribir los archivos de tabla (necesario para SeaweedFS). #114285 (Azat Khuzhin).
- Se corrigieron resultados incoherentes cuando se hacía pushdown de un filtro sobre una columna que no era de clave de la tabla derecha por debajo de un ANY INNER JOIN. #114313 (Kirill Shokhin).
- Se corrigió el autocompletado de bash con bash-completion 2.12+ (_comp_get_words). #114339 (Azat Khuzhin).
- Corrige un fallo al leer una tabla de lago de datos cuyo esquema declara una columna con un nombre vacío. Los metadatos de Iceberg malformados se rechazan con
ICEBERG_SPECIFICATION_VIOLATION; un esquema proporcionado por un catálogo, Delta Lake o Paimon se rechaza conAMBIGUOUS_COLUMN_NAME. La comprobación es incondicional, por lo que una tabla Iceberg que simplemente conserva un esquema histórico sin usar con un nombre de campo vacío también pasa a ser ilegible, en vez de abortar al leer ese esquema. #114394 (Groene AI). - Corrige un error por el que un cliente que se conectaba a ClickHouse Keeper durante un cambio de líder de Raft podía permanecer bloqueado durante todo el
session_timeout_ms(30 segundos de forma predeterminada) antes de que se rechazara la conexión, en vez de rechazarse en cuanto se descartaba la solicitud en curso. Ahora el cliente puede volver a conectarse antes a otra réplica. #114401 (Groene AI). BACKUP,RESTOREyENGINE = Backupahora autorizan la ubicación de la copia de seguridad conforme a los privilegiosSOURCESdel usuario, del mismo modo ques3(),file()yazureBlobStorage(). Anteriormente, un usuario conBACKUPpero sinSOURCESpodía escribir una copia de seguridad en cualquier ubicación a la que pudiera acceder el servidor y leerla desde allí. Escribir una copia de seguridad ahora requiere el permisoWRITEen el origen del destino (WRITE ON S3,WRITE ON AZURE,WRITE ON FILE), mientras que leerla requiereREAD; los destinosDisk(...)siguen restringidos únicamente porbackups.allowed_disk. #114405 (Groene AI).- Corrige que
CREATE OR REPLACEdejara una tabla interna_tmp_replace_*sin eliminar y queCREATE OR REPLACE VIEWfallara conNOT_IMPLEMENTEDcuando se estableceignore_drop_queries_probability. Las operaciones DROP que emite internamente forman parte de una única instrucción de usuario, por lo que la inyección de fallos de DROP ya no se les aplica. #114420 (Groene AI). - Corrige un
LOGICAL_ERROR(Bad cast from type DB::ASTLiteral to DB::ASTPartition) y SQL formateado imposible de analizar cuando un comandoALTER TABLE ... MOVEdeserializado desde un AST JSON (dialect = clickhouse_json) emparejaba la formaPARTconTO TABLE, o la formaPARTITIONconTO SHARD. Estas cargas útiles ahora se rechazan conBAD_ARGUMENTS. #114429 (Groene AI). - No elimina columnas cuando se hace referencia a ellas en las condiciones de filtro
PREWHEREyWHERE, aunque se reescriban como una columna virtual de índice de texto. #114460 (Elmi Ahmadov). - Corrige un error
Not-ready Set is passed as the second argument for function 'in'cuando se cancela una mutación cuyo predicado contieneIN (subquery), por ejemplo medianteKILL MUTATIONoDETACH DATABASE, mientras aún se está creando el conjunto de la subconsulta. Relacionado: #107619. #114463 (Groene AI). ALTER TABLE ... DROP COLUMNde una columna utilizada en la clave de ordenación, primaria o de partición ahora falla conALTER_OF_COLUMN_IS_FORBIDDENy una explicación, igual queALTER TABLE ... CLEAR COLUMN. Anteriormente, fallaba con el confuso errorUNKNOWN_IDENTIFIER: Missing columnsderivado del recálculo de las expresiones clave. Lo mismo se aplica a eliminar o limpiar un grupoNestedcompleto mediante su prefijo común cuando una columna del grupo se utiliza en una clave; anteriormente, esto podía destruir silenciosamente los datos del grupo o dejar una mutación que nunca termina. Eliminar una columna utilizada únicamente en una expresiónTTLahora también indica qué expresión TTL se ve afectada. #114468 (Maksim Dergousov).- Se corrigió la lectura de una columna
Tuplecuyo primer elemento esNULLen los formatosCustomSeparated,RegexpyTemplatecon la regla de escapeCSV. UnTuplesin envolver ocupa aquí un campo por elemento, por lo que el campo inicial\Ncorresponde a ese elemento y no a toda la columna. Anteriormente se consumía como si fuera toda la columna, desplazando los campos de los elementos restantes a las columnas siguientes, por lo queCustomSeparatedno podía volver a leer su propia salida. Cierra #114402. #114471 (Groene AI). - Corrige que
arrayExists(x -> x = needle, arr)devolviera un resultado incorrecto o fallara conTOO_LARGE_STRING_SIZEcuando el elemento del array y la cadena buscada son de tipos de cadena distintos (por ejemplo, una cadena buscadaStringfrente a un elementoArray(FixedString(N))). La optimizaciónoptimize_rewrite_array_exists_to_has, habilitada de forma predeterminada, reescribía dicha llamada comohas, que no compara valores rellenados con ceros de la misma forma que=. #114496 (Groene AI). - Leer una tabla Iceberg cuyos metadatos describen una evolución de esquema prohibida por la especificación Iceberg ya no aborta el servidor. Cuatro infracciones de la especificación en
IcebergSchemaProcessorse notificaban comoLOGICAL_ERROR, que se trata como una aserción fallida, o llegaban sin comprobar a una aserción fatal; ahora generanICEBERG_SPECIFICATION_VIOLATION. #114518 (Groene AI). - Se corrigió que el formato de entrada
Regexpdescartara silenciosamente la parte sin analizar de un campo coincidente, lo que almacenaba un valor truncado o inventado en lugar de informar un error:v=-1enUInt64se leía como0, yv=2020-01-01junkenDatese leía como1975-07-14con la reglaJSON. Los campos malformados ahora se rechazan con las reglasEscaped,CSVyJSON, de acuerdo con el comportamiento documentado para los formatos correspondientes. ConRaw, un campo coincidente que contiene una tabulación ahora se lee completo en lugar de truncarse en la tabulación. #114520 (Groene AI). - Corrige
LOGICAL_ERRORal filtrar una columna Iceberg queALTER TABLE ... MODIFY COLUMNconvirtió enNullable. Cierra #85029. #114521 (Groene AI). CREATE TABLEyALTER TABLEahora rechazan códecs con pérdida, comoSZ3, en columnas utilizadas en la clave de ordenación. #114531 (Groene AI).- Se corrigió un
LOGICAL_ERRORal leer una tabla de Delta Lake cuyometaData.partitionColumnsnombra una columna quemetaData.schemaStringno declara. Esos metadatos ahora se rechazan conBAD_ARGUMENTSen el lector delta-kernel y conINCORRECT_DATAen el lector heredado siempre que la tabla o su esquema se lean desde un snapshot, no solo cuando la consulta incluye un predicado. #114538 (Groene AI). - Rechaza un Variant cuyas ramas ORC se leen como un único tipo. #114540 (Groene AI).
- Corrige la evaluación del índice de texto del operador
LIKE/ILIKEaplicado a contenedores Map o JSON. #114544 (Elmi Ahmadov). - Compatibilidad con nombres de etiquetas entre comillas en los modificadores de agrupación de PromQL. #114545 (Minh Vu).
- Corrige literales
Time64y constantes de listasINincorrectos, a menudo con el signo invertido, generados al reescalar unDecimal64de menor escala que desbordabaInt64. Esta conversión ahora informa deDECIMAL_OVERFLOW, igual que la ramaDateTime64y elCASTexplícito. #114546 (Groene AI). - Acepta comas finales en listas de etiquetas de agrupación de PromQL.. #114548 (Minh Vu).
- Admite nombres de métricas y etiquetas entre comillas en selectores de PromQL. #114551 (Minh Vu).
- Una consulta podía cancelarse hasta 1 ms antes de que transcurriera su
max_execution_timey fallar con el mensaje contradictorioTimeout exceeded: elapsed 999.672 ms, maximum: 1000 ms. #114559 (Alexey Milovidov). - Se corrigió la lectura de una tabla mientras una mutación está en curso: una columna
MATERIALIZEDpodía devolver un valor obsoleto, y seleccionarla junto con una columna actualizada podía provocar un error. #114561 (Shaohua Wang). - Corrige que
clickhouse-localaceptara unCREATE TABLEcuyo nombre era demasiado largo para la--default_databaseconfigurada, lo que producía una tabla que no podía eliminarse.DatabaseOverlayahora comprueba la longitud del nombre de la tabla igual que la base de datos en disco en la que escribe. #114567 (Groene AI). - Se corrigió una omisión de RBAC en el motor de tabla
Aliasque permitía a usuarios sin privilegios sobre la tabla de destino revelar su esquema, número de filas, tamaño y existencia. #114596 (Kai Zhu). - Se corrigió que las estadísticas de tablas hash —y, con ellas, la preasignación de tablas hash para agregación— se deshabilitaran de forma silenciosa y permanente en todo el servidor cuando una consulta que usaba la optimización
FINALdiferida (query_plan_optimize_lazy_final) era la primera agregación en ejecutarse tras el inicio del servidor. #114597 (Alexey Milovidov). - Se corrigió que una columna renombrada, eliminada y añadida de nuevo en un único
ALTERdevolviera los valores de la columna eliminada en lugar de su propio valor predeterminado mientras la mutación aún estaba pendiente. #114601 (Shaohua Wang). - Se corrigió un bucle infinito que no se podía cancelar en las funciones
hopywindowIDcuando la duración, en segundos, de un argumento de intervalo es múltiplo de 2^32 (por ejemplo,toIntervalDay(2147483648)): la resta con ajuste evitaba la comprobación de desbordamiento de tiempo y, con argumentos constantes, el bucle se ejecutaba durante el análisis, cuando ni siquiera se podía cancelar la consulta. El mismo intervalo también podía hacer que un hilo en segundo plano de unaWINDOW VIEWse ejecutara indefinidamente; ahora dicha vista de ventana se rechaza al crearla. #114607 (Alexey Milovidov). - Corrige un error por el que una entidad de acceso con una configuración de valor
Map, como un perfil de configuración conhttp_response_headersoadditional_table_filters, se almacenaba en un formato que ClickHouse no podía volver a leer, dejando la entidad permanentemente imposible de cargar tras un reinicio. #114620 (Groene AI). - Se corrigió que una vista materializada actualizable dejara sin eliminar su tabla de destino anterior al rotarla cuando
ignore_drop_queries_probabilityestá habilitado. ElDROPque emite una actualización para limpiar el destino anterior es un paso de la actualización, no unDROPsolicitado por el usuario, por lo que la inyección de fallos ya no se le aplica. #114622 (Groene AI). - Corrige que
has,indexOf,countEqual,mapContainsKey,mapContainsValuey el operador de subíndice deMapdevolvieran “not found” para un valor buscado constante de tipoLowCardinalityigual al valor predeterminado del tipo de elemento, como unStringvacío o el número cero. #114624 (Groene AI). - Se corrigió el error lógico
Multi-block postings must be compresseden consultas sobre tablas con un índice de texto en modo de aplicación diferida de listas de postings cuando la consulta se cancelaba durante la lectura. #114636 (Anton Popov). - Se corrigió el formato de un argumento de subconsulta de las funciones de tabla
viewyviewIfPermittedcuando la consulta contenedora tiene una cláusulaSETTINGSal final. Dicha consulta se formateaba comoview((SELECT ...)), que no puede volver a analizarse, por lo que no superaba la comprobación interna de formato-análisis-formato y generabaInconsistent AST formatting. #114658 (Groene AI). - Se corrigió la corrupción de memoria del montón al leer Parquet mediante un formato de entrada que posee su propio búfer de lectura, por ejemplo, un diccionario con
SOURCE(FILE(... format 'Parquet')). Las tareas de prelectura y decodificación en segundo plano aún podían leer y escribir mediante el búfer después de que la canalización lo liberara, lo que podía provocar la interrupción del servidor. #114668 (Groene AI). - Corrige la lectura de una subcolumna (
.size0,.null, un elemento de tupla,String.size) mediante una tablaMergecuando la tabla subyacente declara la columna principal comoALIAS. Esta lectura devolvía el valor predeterminado del tipo y, cuando la columna principal se seleccionaba en la misma consulta, podía devolver el valor de una columna no relacionada. #114673 (Groene AI). - Corrige que
ANY RIGHT JOINySEMI RIGHT JOINcon varias condiciones unidas medianteORen la secciónONdevolvieran dos veces algunas filas de la tabla derecha y perdieran coincidencias de otras. UnANY LEFT JOINescrito explícitamente también se veía afectado, porque el planificador puede intercambiar las tablas y ejecutarlo comoANY RIGHT JOIN. #114676 (Vladimir Cherkasov). - Se corrigieron resultados incorrectos de la optimización trivial
GROUP BY ... LIMIT(configuraciónoptimize_trivial_group_by_limit_query) para consultas conDISTINCT,QUALIFY, funciones de ventana oarrayJoinen la proyección: estas operaciones consumen o filtran los grupos después de la agregación, por lo que limitar la agregación aLIMIT + OFFSETclaves podía devolver muy pocas filas o valores incorrectos. La optimización ya no se aplica a estas consultas. #114695 (Alexey Milovidov). - Se corrigieron filas ausentes en el resultado de un
SELECTfiltrado porpointInPolygonsobre una clave principal de MergeTree cuando el argumento de polígono es un literal constante no válido yvalidate_polygons = 0. El análisis de la clave principal derivaba la poda de gránulos a partir de un polígono que nunca validó y descartaba gránulos que contenían filas coincidentes. #114710 (Groene AI). - Corrige un bloqueo del servidor que se produce cuando los estados de agregación de los combinadores
-OrNullo-OrDefaultse fusionan congroup_by_overflow_mode = 'any'y un valor demax_rows_to_group_bydistinto de cero, por ejemplo, cuando una consulta lee mediante una proyección de agregación. #114740 (Groene AI). - Se corrigió un
LOGICAL_ERROR(“Unexpected number of kept output positions after removing unused columns fromReadFromMergeTree”) generado por unSELECT ... FINALcuyoPREWHEREusa una columna queFINALnecesita para la fusión (ver,is_deleted,sign) pero que no se selecciona. #114746 (Groene AI). - Corrige un error lógico (
Block structure mismatch) al leer una tablaMergeconmake_distributed_planhabilitado en nodos hijo con operaciones de conjuntos internas. #114753 (Alexey Milovidov). - Rechaza un valor de
kafka_num_consumersabsurdamente grande con un mensaje de error claro, en lugar de que se produzca un error de asignación dentro del motor de tablaKafka. Anteriormente, conkafka_disable_num_consumers_limithabilitado, dicho valor generaba una excepciónstd::length_error. #114764 (Alexey Milovidov). - Corrige una excepción
LOGICAL_ERROR: Context has expiredcuando una expresión almacenada que contieneaccurateCastOrDefaulto una funciónto<Type>OrDefaultse evalúa después de que finalice la consulta que la creó, por ejemplo, en un valor predeterminado de columnaMATERIALIZEDdurante unINSERTo en una expresión de mutación. #114769 (Groene AI). - Corrige un
LOGICAL_ERROR(Cannot find input column ... on its position in inputs of expression actions DAG) cuando una consulta tiene unJOINsobre una tabla cuya columna indexada por texto se usa tanto en un predicado de búsqueda de textoPREWHEREcomo en unoWHERE. #114771 (Groene AI). - Corrige la pérdida de una señal de activación del hilo de reinicio durante el arranque desde el hilo de adjunción. #114802 (Azat Khuzhin).
OPTIMIZE TABLEen una tabla de almacenamiento de objetos cuyo motor no implementa la compactación informaba de éxito sin hacer nada. Ahora genera un error, como cualquier otro motor que no admite la instrucción. Esto afecta aDeltaLake,Paimon,Hudiy a los motores simples de almacenamiento de objetos (S3,GCS,COSN,OSS,AzureBlobStorage,HDFSyURLrespaldado por almacenamiento de objetos);Iceberg, que sí implementa compactación, no cambia. Cierra #114765. #114805 (Groene AI).timeSeriesRangeytimeSeriesFromGridgeneraban un falsoDECIMAL_OVERFLOWpara marcas de tiempo anteriores a 1970 porque las marcas de tiempo de inicio y fin se leían como valores sin signo. Además, para marcas de tiempoDateTime/UInt32, el paso se truncaba silenciosamente a sus 32 bits inferiores. Ahora todos los cálculos se realizan enInt64. #114815 (Vitaly Baranov).- Corrige un aborto del servidor (
Logical error: Part patch-... doesn't exist) cuando unDROP TABLEse ejecuta simultáneamente con una actualización ligeraUPDATEen una tablaReplicatedMergeTree. La actualización ahora mantiene el bloqueo compartido de la tabla hasta que se confirma su parte de parche, por lo queDROPespera en lugar de eliminarla. #114826 (Groene AI). - Corrige varios errores en las inserciones asíncronas (posible cierre inesperado si algunas consultas fallaban con
MEMORY_LIMIT_EXCEEDEDyasync_insert_queue_flush_on_shutdown, que nunca funcionaba). #114839 (Azat Khuzhin). - Se corrigió
LOGICAL_ERROR: Unexpected return type from tuple. Expected Tuple(..., UInt8). Got Tuple(..., LowCardinality(UInt8))al leer mediantetuple(...)una columnaLowCardinalitycomparada conIN (subquery)a través del límite de una subconsulta y conenable_analyzer = 0. Con el analizador antiguo,x IN (subquery)sobre una columnaLowCardinalityahora devuelveLowCardinality(UInt8), el mismo tipo quex IN (literal list)y que conenable_analyzer = 1. #114856 (Nikita Fomichev). - La configuración de cuota para funciones de IA (
ai_function_max_api_calls_per_query,ai_function_max_input_tokens_per_query,ai_function_max_output_tokens_per_query) se aplicaba por bloque en lugar de por consulta, lo que permitía que una consulta superara el límite configurado en proporción al número de bloques e hilos procesados. Ahora limita la consulta completa por servidor: el límite de llamadas a la API es estricto (reserva atómica), y los límites de tokens se aplican en la medida de lo posible. Una consulta distribuida aplica los límites de forma independiente en cada servidor o fragmento participante. #114885 (George Larionov). - Corrige un aborto del servidor que se produce cuando el grupo global de hilos se satura momentáneamente mientras las tablas aún se están cargando.
AsyncLoaderahora continúa ejecutándose si no puede crear un worker de carga adicional y algún worker seguirá procesando los trabajos en cola, en lugar de llamar astd::terminate. #114897 (Groene AI). - Se corrigieron comportamientos indefinidos y resultados incorrectos en los límites en
quantileyquantilespara valoresDateTime64yDecimalde gran tamaño. #114919 (Alexey Milovidov). - Corrige un aborto del servidor ante un pie de franja ORC dañado. #114924 (Groene AI).
- Corrige un posible fallo debido a un uso después de liberar de ThreadGroup (para INSERT asíncronos/MV/EXPLAIN ANALYZE). #114940 (Azat Khuzhin).
- Se corrigió un bloqueo al eliminar una tabla
TimeSeriescuyo nombre se ordena lexicográficamente antes que los nombres de sus tablas internas, por ejemplo,DROP TABLE `-ts`, o al eliminar una vista materializada declarada conENGINE = TimeSeries. La operación de eliminación se autobloqueaba en la protección DDL y no podía cancelarse conKILL QUERY. #114953 (Groene AI). - Corrige
BAD_DATA_PART_NAME(“Trying to get part name in new format for old format version”) en unReplicatedMergeTreecreado con la sintaxis posicional obsoleta medianteallow_deprecated_syntax_for_merge_tree. Una mutación podía notificarse como completada en una réplica que no la había aplicado, y la tabla podía permanecer en modo readonly tras reiniciarse. #114980 (Groene AI). - Corrige el error lógico
Not-ready Set is passed as the second argument for function 'in'en una consulta con una subconsultaINque lee de un clúster remoto: ahora la consulta falla con el error real de la subconsulta, como un fallo de conexión. #114983 (Alexey Milovidov). - Corrige un error lógico para IN con una tupla no constante idéntica en ambos lados en el analizador antiguo. #114988 (Groene AI).
- Corrige la lectura de un elemento de una tupla mediante una sugerencia de estructura Tuple posicional. #115000 (Groene AI).
- No asigne alias a los estados de preagregación de un agregado de tamaño cero en arrayReduceInRanges. #115008 (Groene AI).
- Se corrigió un
INSERTen una tablaLog,TinyLogoStripeLogque fallaba al confirmar los tamaños de archivo registrados. Dicho insert podía conservar sus filas en la tabla aunque notificara un error, o dejar inconsistentes entre sí los archivos de datos de una columna de array. Ahora, al leer una tablaLogoTinyLogcuya columna de array no contiene elementos aunque sus offsets indiquen lo contrario, se genera un error que identifica la columna, en lugar de leer más allá del final de los elementos. Ya se rechazaba una columna de elementos escrita parcialmente. #115027 (Groene AI). - Corrige una interrupción del agregador adaptativo en columnas replicadas de forma diferida. #115034 (Groene AI).
- Se corrigió una lectura fuera de límites en
pointInPolygoncon un polígono constante cuyo cuadro delimitador no está acotado, por ejemplo, cuando una coordenada alcanza+-DBL_MAX. Dicho polígono ahora se rechaza conBAD_ARGUMENTS, y un polígono con un anillo vacío se considera sin interior. Anteriormente, la consulta podía devolver un resultado incorrecto o interrumpir el servidor en compilaciones con hardening o sanitizers habilitados. #115035 (Groene AI). - Se corrigió una excepción
out_of_rangegenerada como error internoCode: 1001cuando un patrón desequenceMatch,sequenceCountosequenceMatchEventscontiene el número de evento0, por ejemplo,sequenceMatch('(?0)'). Dicho patrón ahora se rechaza conBAD_ARGUMENTS. Una condición temporal que contiene un signo aislado, comosequenceMatch('(?1)(?t>+)(?2)'), se trataba silenciosamente como(?t>0)y ahora se rechaza conSYNTAX_ERROR. #115056 (Groene AI). - Se corrigió
Found patch part ... that intersects mutation with version ...(LOGICAL_ERROR) en tablas con actualizaciones ligeras. Una fusión de partes de parche podía producir un parche cuyo rango de versiones de datos abarcaba la versión de datos de una parte existente; ese parche no podía aplicarse ni omitirse, por lo que todas las operaciones posteriores en la partición fallaban y la cola de replicación se bloqueaba. Estas fusiones ya no se asignan. #115064 (Alexey Milovidov). - Corrige un
LOGICAL_ERROR(Cache file segment is in detached state) al leer a través de la caché del sistema de archivos con la configuración experimentaluse_reader_executor. La regresión fue introducida por #110029 y no está presente en ninguna versión, por lo que no requiere retroportación. #115070 (Groene AI). - Servidor Arrow Flight: acepta credenciales de autenticación
Basiccodificadas en Base64 sin relleno, como las enviadas por clientes de Flight basados en Go, como el controlador ADBC Flight SQL, y devuelve un error de autenticación adecuado en lugar de un error genéricoUnexpected error in RPC handlingcuando el encabezadoauthorizationtiene un formato incorrecto. #115085 (Alexey Milovidov). - Corrige la autocompletación (sugerencias y completado con TAB desde
system.completions) en el client integrado utilizado por la interfaz SSH y el terminal web: las sugerencias se cargaban mediante una conexión independiente que se autenticaba como el usuariodefaultcon una contraseña vacía, lo que fallaba en servidores dondedefaulttiene contraseña y, en caso contrario, filtraba nombres de entidades a las que el usuario que inició sesión no tiene acceso. Las sugerencias ahora se cargan mediante la propia conexión de la sesión. #115086 (Alexey Milovidov). - Se corrigió un problema que impedía iniciar el servidor después de crear una tabla con
CREATE TABLE ... AS url('http://host/**/', ...)mientrasallow_experimental_url_wildcard_from_index_pagesestaba habilitado. Al cargar los metadatos de esa tabla, se volvía a evaluar la comprobación experimental y fallaba conSUPPORT_IS_DISABLED, lo que interrumpía el inicio. #115095 (Groene AI). - Se reescribió bucketIndexForTimestamp usando aritmética de 64 bits. #115097 (Vitaly Baranov).
- Se corrigió el formato de
ALTER TABLE ... MATERIALIZE INDEX,MATERIALIZE STATISTICSyMATERIALIZE PROJECTION, que omitía la cláusulaIF EXISTS, por lo que la consulta formateada no coincidía con la consulta analizada. También se rechazaron cuatro cargas útiles JSON del AST deALTER ... STATISTICSque el analizador de SQL no puede generar y que se formateaban como un comando distinto. #115099 (Groene AI). - Se corrigió una excepción (
Block structure mismatch in Expression for FilterSortedStreamByRange) en algunas consultasSELECT ... FINALconPREWHEREsobre una tabla cuya clave de ordenación es una expresión. #115113 (Shaohua Wang). - Se corrigieron las sobrescrituras de CORS de la CLI de clickhouse-local. #115129 (Alexey Milovidov).
- Se deshabilitó el análisis distribuido de índices con proyecciones (resultados incorrectos). #115132 (Azat Khuzhin).
- Se corrigieron
ifymultiIf, que devolvían un valor positivo grande en lugar de uno negativo cuando una ramaTimese combina conTime64,DateTimeoDateTime64y la expresión se compila con JIT. #115146 (Groene AI). - Un terminal web integrado en otra página, como la consola SQL o
play.html, recibe sus credenciales de esa página y ya no abre una conexión propia antes de recibirlas. Anteriormente, se conectaba dos veces: una con una contraseña vacía y otra con las credenciales reales, e imprimíaConnecting...dos veces. #115148 (Alexey Milovidov). - Se corrigieron resultados incorrectos cuando una cláusula
WHEREcontenía una expresiónNULLdentro de unNOT, por ejemplo,SELECT count() FROM t WHERE NOT (id >= 20 AND NULL). El análisis de índices trataba dicha condición como demostrablemente verdadera para todo el rango, por lo que se omitía el filtro:count()devolvía filas que la consulta debía rechazar yALTER TABLE ... DELETEcon esa condición eliminaba filas que debería haber conservado. #115152 (Groene AI). - Se corrigió que
EXPLAIN ANALYZEperdiera las estadísticas de join de una vista declarada conSQL SECURITY DEFINERoSQL SECURITY NONEcuyo cuerpo contiene un JOIN. En compilaciones de depuración y con sanitizadores, la consulta se interrumpía con el error lógicoJoinStep analyzed without the analyze mode. #115156 (Groene AI). - Se corrigió una lectura fuera de límites al deserializar listas de publicaciones corruptas de un índice de texto. #115222 (Anton Popov).
- Se corrigieron resultados incorrectos para
SELECT count(arrayJoin(arr))con el valor predeterminadooptimize_trivial_count_query = 1. Se devolvía el recuento de filas almacenado en lugar del número de elementos del array y, enfile()yurl(), la consulta devolvía0. Cierra #115123. #115227 (Groene AI). - Corrige
NOT_FOUND_COLUMN_IN_BLOCKen cadaINSERTen una tabla que declaraSTATISTICS(...)en una columnaALIASoEPHEMERAL, lo que hacía que esas tablas fueran de solo lectura. #115231 (Groene AI). - Corrige que las estadísticas finales de una consulta completada (
N rows in result,Read ... rows) se mostraran en un color invisible en la interfaz web. #115245 (Alexey Milovidov). - Corrige resultados incorrectos silenciosos y comportamiento indefinido al leer un estado
AggregateFunction(uniq, ...)malformado. El camposkip_degreedel estado serializado se utilizaba como exponente de desplazamiento sin validación, por lo que un valor fuera de rango producía una cardinalidad arbitraria en lugar de un error. Estos estados ahora se rechazan conINCORRECT_DATA. #115276 (Groene AI). - Corrige una omisión de políticas de fila por la que la función de tabla mergeTreeIndex exponía valores de clave primaria e índice minmax de las filas ocultas por una política de fila
SELECTen la tabla de origen; ahora se deniega la lectura de mergeTreeIndex para tablas con una política de fila. #115304 (Yarik Briukhovetskyi). - Corrige que
CREATE QUOTAyALTER QUOTAdescartaran silenciosamente todos los bloquesFOR INTERVALexcepto el último cuando se omitía la coma separadora entre intervalos. Dicha instrucción se ejecutaba correctamente sin aplicar ninguno de los límites anteriores. Los intervalos ahora vuelven a acumularse, como antes de 2020. Cierra #115282. #115320 (Groene AI). - Corrige resultados incorrectos de
if,multiIfyCASEcuando una rama esDateoDate32y el tipo de resultado esDateTimeoDateTime64. Concompile_expressions = 1(el valor predeterminado), la expresión compilada copiaba el recuento de días de la fecha en la columna de marca de tiempo sin convertir los días a segundos, por lo queif(cond, toDate32('1900-01-01'), toDateTime64('1970-01-01', 3))devolvía1969-12-31 23:59:34.433. Cierra #115272. #115325 (Groene AI). - Evita que queden metadatos que hagan referencia a una colección con nombre eliminada. #115326 (Groene AI).
- Corrige que
timezoneOffset(aliastimeZoneOffset) devolviera un desplazamiento incorrecto de exactamente un día para zonas horarias cuyo desplazamiento UTC difiere en un día completo del que tenían el 1970-01-01, comoPacific/KiritimatiyPacific/Apiadespués de cruzar la línea internacional de cambio de fecha, así como para la mayoría de las zonas antes de 1970. También corrigeparseDateTime,parseDateTimeOrNull,parseDateTime64,parseDateTimeInJodaSyntax,EXTRACT(TIMEZONE_HOUR / TIMEZONE_MINUTE ...),%zdeformatDateTime,toUTCTimestampyfromUTCTimestamp, que usan ese desplazamiento. Cierra #115281. #115332 (Groene AI). - Corrige una omisión de las restricciones de configuración:
SET <name> = DEFAULTrestablecía una configuración sin comprobar las restricciones del perfil del usuario, por lo que una restricciónMIN/MAX/CONSTpodía eludirse restableciendo la configuración en lugar de asignarle un valor, y una sesión podía salir del modo de solo lectura conSET readonly = DEFAULT. #115334 (Alexey Milovidov). - Servidor Arrow Flight: se rechazan las credenciales de autenticación básica malformadas que omiten el separador entre el nombre de usuario y la contraseña. #115347 (Alexey Milovidov).
- Se corrigió un
LOGICAL_ERROR(Join is supported only for pipelines with one output port) en un JOINfull_sorting_mergeconquery_plan_join_shard_by_pk_rangeshabilitado cuando uno de los dos lados se descarta por completo, ya sea por la clave primaria, por las estadísticas de columna o porque la tabla está vacía. #115352 (Alexey Milovidov). - Se deshabilitó la caché de condiciones de consulta para los filtros sobre _part_starting_offset. #115358 (Azat Khuzhin).
- Se corrigió que
randConstantdevolviera dos valores distintos en una misma consulta cuando sus llamadas tenían alias diferentes. La documentación derandConstantindica que mantiene un único valor durante toda la consulta, ySELECT randConstant() = randConstant()ya devolvía1, pero añadir alias como enSELECT randConstant() AS a, randConstant() AS bproducía dos valores no relacionados. #115384 (Alexey Milovidov). - Se corrigió que
uniq,uniqExact,uniqHLL12yuniqThetadevolvieran un resultado incorrecto para un argumento envuelto en una función inyectiva que oculta la nulabilidad, comouniqExact(tuple(x))sobre una columnaNullable. La optimizaciónoptimize_injective_functions_inside_uniqeliminaba la función envolvente, por lo que las filas NULL se omitían en lugar de contarse. #115466 (Vladimir Cherkasov). - Se corrigió que
GroupingAggregatedTransformprodujera fragmentos duplicados para el mismo bucket. #115487 (Nikita Taranov). - Se corrigió el mensaje de error de
geoToH3, que indicaba una posición de argumento y un tipo incorrectos cuando una coordenada no eraFloat64. Con el orden predeterminadogeotoh3_argument_order = 'lat_lon', el mensaje señalaba el otro argumento e imprimía su tipo. Cierra #101813. #115503 (Groene AI). - Se rechaza un retorno de carro aislado (
\r), además de un salto de línea (\n), en los nombres y valores de encabezados HTTP que pasan por el filtro de encabezados HTTP. Esto corrige una vulnerabilidad de inyección de encabezados HTTP (división de solicitudes/respuestas) en funciones que admiten encabezados proporcionados por el usuario, como la función de tabla y el motorurl, los diccionarios HTTP y los catálogos de lagos de datos. #115510 (Sergei Trifonov). - Se corrigió que las cachés configuradas con un número máximo de entradas (política
SLRU) dejaran silenciosamente de admitir nuevas entradas una vez que se hubiera accedido al menos dos veces a esa cantidad de entradas. Las cachés afectadas incluyen las cachés de archivos de metadatos de Iceberg y Paimon, la caché de metadatos de Parquet, las cachés de índices de texto, la caché de índices de similitud vectorial, la caché de expresiones compiladas y la caché de estado de archivos de ObjectStorageQueue. #115517 (Groene AI). - Se corrigió un bloqueo de hasta una hora en
BACKUP/RESTORE ... TO S3, discos GCS y la función de tablas3cuando la colección con nombre establecehttp_client = 'gcp_oauth'y el punto de conexión de tokens OAuth2 de Google acepta la conexión, pero nunca responde. La solicitud del token Bearer ya no hereda el tiempo de espera de la solicitud de transferencia de datos del llamador; la espera de respuesta está limitada a 10 segundos, igual que el límite de las solicitudesAssumeRolede STS. #115531 (Groene AI). - Se corrigieron
dictGety sus variantes en consultas distribuidas: un nombre de diccionario sin calificar ahora se asocia a la base de datos actual del iniciador, en lugar de resolverse con la base de datos actual de cada shard, donde no se encontraba o se resolvía como otro diccionario con el mismo nombre. #115541 (Alexey Milovidov). - Se corrigió una condición de carrera que podía hacer que una consulta
STREAM BOUNDEDdevolviera menos filas de las confirmadas antes de iniciarse, normalmente ninguna. #115543 (Alexey Milovidov). - Se corrigió la escritura de snapshots de Keeper como archivos vacíos cuando
compress_snapshots_with_zstd_formatestá deshabilitado. El servidor registrabaCreated persistent snapshot, pero el archivo de snapshot tenía 0 bytes y el nodo se negaba a iniciarse conCORRUPTED_DATA. Cierra #115388. #115553 (Groene AI). - Se corrigió que
read_rows,read_bytes,written_rowsywritten_bytesdesystem.query_thread_loginformaran del total acumulado durante la vida de un hilo, en lugar de los valores de la consulta registrada. Se veían afectadas las filas de hilos agrupados de larga duración, en particular el hiloHTTPHandlerque inicia la consulta. #115596 (Groene AI). - Se corrigió una lectura fuera de límites de los hashes de diccionario almacenados en caché al agregar o realizar un join con una clave
LowCardinality(String)cuyo diccionario crece durante la agregación, accesible desdeTTL ... GROUP BY. Podía generar un hash incorrecto y un heap-buffer-overflow notificado en compilaciones con sanitizador. #115604 (Groene AI). CREATE TABLEyALTER TABLEahora rechazan un códec con pérdida comoSZ3en una columna utilizada en la clave de partición. #115626 (Groene AI).- Se corrigieron caracteres de escape de barra invertida no válidos en los índices text, tokenbf_v1 y ngrambf_v1. #115634 (Elmi Ahmadov).
- Se corrigió
removePartAndCoveredPartscuando se llama para una parte presente en el conjunto de partes de datos activas. #115640 (Mikhail Artemenko). - Se permite que los lectores de KeeperMap acepten metadatos compartidos cuando claves primarias equivalentes solo difieren por paréntesis exteriores redundantes. #115642 (Sergey Kuznetsov).
- Se corrigió un error por el cual, al restaurar una base de datos o tabla con un nombre nuevo, se eliminaban los alias de tabla de los cuerpos de las vistas almacenadas, por lo que la lectura de una vista restaurada fallaba con
UNKNOWN_IDENTIFIER. Cierra #115479. #115645 (Groene AI). - Se corrigió
Code: 349. Cannot convert NULL value to non-Nullable typecuando un predicadohasonotHascontiene un elemento NULL de Array y la clave primaria esString,Array(String)oMap(String, String), y se corrigieron resultados incorrectos cuando ese elemento es unDynamicoVariantque contiene NULL. Ahora se elimina el NULL del conjunto durante el análisis de claves, como ya ocurría con otros tipos de clave. #115647 (Groene AI). - Se corrigió un error en la función
formatRowNoNewlineque podía producir resultados incorrectos o un error lógico cuando una fila se formatea como un resultado vacío. #115669 (Alexey Milovidov). - Se rechazan valores de
stepiguales a cero o negativos en consultas de rango de Prometheus de un único punto. #115679 (Minh Vu). - Se rechazan timestamps y duraciones de PromQL que excedan el rango de Int64. #115682 (Minh Vu).
- Se corrigen bloqueos del servidor ante entradas profundamente anidadas en
readWKB,JSONMergePatch, el analizador de direcciones de las funciones de tablaurl/remote/cluster/mysql/postgresql, el analizador de la cláusulaCURSORy el analizador de esquemas CapnProto. Se corrige un bloqueo en el analizador de la instrucciónEXECUTEcuando un argumento no es un literal. #115700 (Alexey Milovidov). - Se evita devolver memoria sin inicializar en el resultado de un literal de cadena binaria cuya longitud no es múltiplo de ocho, así como desde el descompresor LZ4 cuando un bloque comprimido no tiene cuerpo. #115704 (Alexey Milovidov).
- Se limita el tamaño del mensaje de inicio del protocolo wire de PostgreSQL, que se lee antes de la autenticación. #115708 (Alexey Milovidov).
- Se corrige el error
MULTIPLE_EXPRESSIONS_FOR_ALIASen consultas donde un alias de columna coincide con el alias de una expresión de tabla en la secciónFROM(una regresión del analyzer en la versión 25.2). #115714 (Alexey Milovidov). - Se corrige que
clickhouse-localterminara todo el proceso cuando un handler de conexión de un listener iniciado conSYSTEM START LISTENgeneraba una excepción, por ejemplo, porque un cliente enviaba un paquete malformado o reiniciaba un socket keep-alive. Ahora, dicho proceso registra el error y sigue atendiendo solicitudes, como lo haceclickhouse-server. #115715 (Groene AI). - Se corrige
LOGICAL_ERROR: No available columnscuando una consulta no lee columnas de una expresión de tabla que no tiene ninguna columna; por ejemplo,SELECT count() FROM loop(db, tbl), dondetbles una tablaAliascuyo destino se eliminó, o una vista parametrizada. Ahora, dicha consulta falla conUNSUPPORTED_METHODen lugar de abortar el servidor en compilaciones de depuración y con sanitizador. #115716 (Groene AI). - Se corrige
LOGICAL_ERROR“Lectura desde la CTE materializada ‘X’ antes de que se completara su materialización: falta la compuerta DelayedPortsProcessor en el plan de consulta” cuando se lee una CTEMATERIALIZEDdentro de una subconsultaINsobre una tablaDistributed. Cierra #113184. #115740 (Groene AI). - Se rechazan nombres no válidos de proyecciones e índices. #115824 (Alexander Tokmakov).
- Se rechazan modificadores de coincidencia de vectores de PromQL cuando uno de los operandos es un escalar. #115828 (Minh Vu).
- Se corrige que
cast_keep_nullableno preservara la capacidad de admitir NULL cuando el tipo de destino esLowCardinality. La conversión de un valor que admite NULL aLowCardinality(T)generabaCANNOT_INSERT_NULL_IN_ORDINARY_COLUMNen lugar de producirLowCardinality(Nullable(T)). Cierra #103485. #115851 (Groene AI). - Añade las rutas de Objects al hash de deduplicación para evitar deduplicaciones incorrectas. #115866 (Mikhail f. Shiryaev).
- Corrige
TYPE_MISMATCH(“CAST AS Array can only be performed between same-dimensional array types”) en una consulta con una constante de tipoArray(Map(...)), comohas([map('k', 'v')], m), ejecutada sobre una tablaDistributedo con réplicas paralelas. #115883 (Alexey Milovidov). - Corrige
Unknown identifier, generado durante la optimización del plan de consulta conmake_distributed_plan = 1, cuando la columna de ordenación de una consulta de ventana pasa por un pasoExpressionque no la menciona. Cierra #115737. #115890 (Groene AI). - Corrige que
h3kRing,h3HexRing,h3Lineyh3ToChildrenignorasenmax_execution_timeyKILL QUERYal expandir un bloque de filas. #115893 (Alexey Milovidov). - La lectura a través de una tabla
Mergeque coincide con una tablaAliascuyo destino es una vista parametrizada ya no generaLOGICAL_ERROR: Table has no columns.(lo que aborta el servidor en compilaciones de depuración y con sanitizador). Esta tabla ahora informa deSTORAGE_REQUIRES_PARAMETER, el mismo error que informa la propia vista parametrizada. Cualquier otra tabla coincidente que no pueda proporcionar columnas ahora informa deUNSUPPORTED_METHODen lugar de un error interno. #115896 (Groene AI). - Corrige la vista previa sobre la marcha de una mutación pendiente cuya expresión hace referencia a
_sample_factor. Conapply_mutations_on_fly = 1y una cláusulaSAMPLE, la expresión se evaluaba con el factor de muestreo de la consulta de lectura en lugar del valor que persiste la materialización en segundo plano, por lo que las filas previsualizadas no coincidían con el resultado materializado final, y unALTER TABLE t DELETE WHERE _sample_factor > 1pendiente podía hacer que una lecturaSAMPLEno devolviera ninguna fila. La columna_sample_factorpropia de la consulta no cambia. #115906 (Groene AI). - Corrige un caso en el que
ATTACH TABLEcon una definiciónENGINE = URL(...)no comprobaba el permisoTABLE ENGINEdel motor al que se dirige el esquema de URL. Un usuario que solo teníaTABLE ENGINE ON URLpodía adjuntar una tabla respaldada porFile,S3,AzureBlobStorageoHDFSy leer de ella, algo queCREATE TABLErechaza correctamente. #115914 (Groene AI). - Evita que un nodo de metadatos de KeeperMap que no se puede analizar impida el inicio del servidor. #115941 (Groene AI).
- Corrige un bloqueo de la función
showCertificateen un servidor que obtiene su certificado TLS mediante ACME (Let’s Encrypt). La función ahora informa del certificado que realmente se sirve, incluso después de recargarlo. #115976 (Alexey Milovidov). - Corrige un aborto del servidor en compilaciones de depuración y con sanitizador al insertar en una vista materializada cuyo destino
TOes otra vista materializada. Esta inserción ya fallaba en las versiones publicadas con unCode: 1001 STD_EXCEPTIONpoco informativo; ahora informa deNOT_IMPLEMENTEDe indica la vista problemática. #115985 (Groene AI). - Los archivos de estadísticas con la versión de formato
V3ahora se leen en lugar de rechazarse conILLEGAL_STATISTICS. Estos archivos solo se generaron en builds demasterdurante un breve periodo, pero las partes que los contenían eran completamente ilegibles y, en un disco de solo lectura,ALTER TABLE ... MATERIALIZE STATISTICSno puede regenerarlos. #116030 (Alexey Milovidov). - Se corrigió
LOGICAL_ERROR: Index with name auto_minmax_index_<column> already existscuando una sola instrucciónALTER TABLEcombinabaRENAME COLUMNcon otro comando, comoMODIFY SETTING, en una tabla con índices minmax implícitos (add_minmax_index_for_numeric_columnsy similares). Renombrar una columna común tampoco provoca ya que unDROP COLUMNposterior falle conUNKNOWN_IDENTIFIERni que unADD COLUMNposterior se realice sin su índice implícito. #116063 (Groene AI). - Se corrigió el fallo de los workers sin estado con almacenamiento de objetos. #116067 (Konstantin Vedernikov).
Mejora en compilación/pruebas/empaquetado
- Se proporcionan artefactos firmados para macOS. #115169 (Konstantin Bogdanov).
- Se corrigió la compilación desde el código fuente con clang 23. #112288 (Azat Khuzhin).
- Se redujeron las dependencias y el tamaño del código del analizador de SQL, que ahora puede compilarse de forma independiente; consulte
utils/wasm-parserpara obtener una compilación independiente en WebAssembly. Las tablas de palabras clave de SQL y tipos de acceso ahora se generan en tiempo de compilación, en lugar de en cada inicio del servidor. #112067 (Alexey Milovidov). - La compilación desde el código fuente ahora falla durante la generación de CMake, en lugar de corromper
StorageSystemLicenses.generated.cppcuando falla la generación de licencias. #111222 (Mikhail Artemenko). - Se actualizó la biblioteca Apache Thrift incluida a la versión 0.24.0. #111278 (Groene AI).
- Se añadió
libucontextpara compilaciones con musl, lo que habilita el backenducontextdeboost::contextutilizado por las compilaciones con sanitizador. #111437 (Konstantin Bogdanov). - Se corrigieron problemas de portabilidad a nivel de código fuente al compilar con musl. #111631 (Konstantin Bogdanov).
- Editar
Core/ProtocolDefines.hya no provoca una recompilación casi completa al compilar desde el código fuente: se eliminó la inclusión deBlockInfo.hy se añadió únicamente a los archivos que usan sus constantes. #111650 (Alexander Gololobov). - Se corrigió un aborto durante el inicio en compilaciones de depuración de macOS al deshabilitar las comprobaciones de depuración del rastreador de memoria para las asignaciones realizadas por bibliotecas del sistema. #112080 (Arsen Muk).
- Se actualizó la biblioteca
libarchiveincluida a la versión 3.8.9. #112434 (Konstantin Bogdanov). - Se actualizó
StringZillaa la versión 5.0.5. #112319 (Konstantin Bogdanov). - Se actualizó
jwt-cppa v0.7.2. #112595 (Konstantin Bogdanov). - Se actualizó la amalgama de SQLite incluida de la versión 3.41.2 a la 3.53.4. #112599 (Konstantin Bogdanov).
- Se actualizó
aws-c-httpa la versión 0.11.0. #112413 (Govind R Nair). - Se actualizó
libcotpa v4.2.1. #112596 (Konstantin Bogdanov). - OpenSSL ahora puede compilarse a partir de sus fuentes C portables en arquitecturas sin código ensamblador escrito a mano en la descripción de compilación, en lugar de fallar durante el enlazado final con símbolos sin definir. La nueva opción de CMake
OPENSSL_NO_ASMselecciona explícitamente la misma ruta. #112863 (Alexey Milovidov). - Se añadió una opción de CMake
ENABLE_ORC(activada de forma predeterminada), de modo que una compilación puede incluir Parquet sin ORC ni los componentes protobuf yprotocque este incorpora. #112864 (Alexey Milovidov). Common/Exception.cppya no requiere la libc++ parcheada de ClickHouse para compilar, por lo que las compilaciones que enlazan una biblioteca estándar de C++ distinta obtienen excepciones sin una traza de pila del punto donde se lanzan, en lugar de no compilar. #112865 (Alexey Milovidov).- El desenrollado de pila en compilaciones musl para aarch64 ahora continúa a través de los marcos de señales y las llamadas al sistema bloqueadas, en lugar de detenerse en el marco de libc, lo que mejora las trazas de pila del manejador de errores fatales y del perfilador de consultas por muestreo. #112592 (Konstantin Bogdanov).
- Se actualizó
libexpatincorporado a la versión 2.8.2. #112593 (Konstantin Bogdanov). - Se actualizó
simdjsona la versión 4.6.5. #112594 (Konstantin Bogdanov). - Se actualizaron Apache Arrow a la versión 25.0.0 y Apache ORC a la versión 2.3.1. #112604 (Konstantin Bogdanov).
- Las compilaciones de cobertura (
WITH_COVERAGE) ahora enlazan el entorno de ejecución de perfil compilado dentro del árbol a partir de las fuentes LLVM incorporadas, en lugar del archivo incluido con la cadena de herramientas clang del host. #112607 (Konstantin Bogdanov). - Se actualizaron Protocol Buffers a la versión 35.1 y gRPC a la versión 1.83.0. #112614 (Konstantin Bogdanov).
- Se añadió un destino experimental de WebAssembly (
wasm64, mediante Emscripten):emcmake cmakeahora configura el árbol y compila las capas inferiores. También se corrigió-DENABLE_LIBFIU=OFF, que no compilaba en ninguna plataforma. #112911 (Alexey Milovidov). - Se corrigieron todos los casos de
-Wunique-object-duplication: singletons mutables definidos en encabezados que obtenían una copia por cada objeto compartido en lugar de una por proceso, principalmente moviendo la definición a un archivo.cpp. #112995 (Alexey Milovidov). - Al instalar un paquete
tgzsobre un enlace simbólico colgante, ahora se conserva la cadena de enlaces simbólicos y se aplican el modo y el propietario del destino empaquetado, en lugar de un modo derivado deumask. #112766 (Alexey Milovidov). - En las compilaciones musl para
aarch64,memmoveahora utiliza la implementación en ensamblador de rutinas optimizadas para ARM (compartida conmemcpy) en lugar del bucle genérico de C que procesa una palabra a la vez. #113502 (Konstantin Bogdanov). - En las compilaciones musl,
getaddrinfoconAI_ADDRCONFIGahora sigue la semántica de glibc, por lo quelocalhostya no se resuelve primero como un::1inutilizable en entornos solo IPv4, ysysconfdevuelve las sugerencias de tamaño de búfer de glibc paragetpwuid_r/getgrgid_ren lugar de -1, lo que corrige libhdfs3. #113485 (Konstantin Bogdanov). - En las compilaciones con musl,
sched_getcpuahora es una lectura de rseq (~1 ns) en lugar de una syscall, igual que en glibc, lo que elimina la sobrecarga de tiempo del sistema depercpu_arenade jemalloc en cargas de trabajo con muchas asignaciones; musl también registra rseq de forma inmediata y exporta la ABI__rseq_*de glibc. #113501 (Konstantin Bogdanov). - Se corrigieron las compilaciones locales (sin CI) que compilaban todo el código Rust de terceros incluido (el codec
PCO, lecturas de Delta Lake mediantedelta-kernel-rs,prqlc,chdig,wasmtimey la búsqueda difusa del historial del client medianteskim) conopt-level = 0. La variable de CMakeSANITIZEse declaró conoption, por lo que su valor predeterminado era el BOOLOFF, que no superaba las comprobacionesSTREQUAL ""de «sin sanitizador», y todas las compilaciones configuradas sin un-DSANITIZE=...explícito seguían la ruta alternativa del sanitizador, que desactiva la optimización de Rust. #114083 (Alexey Milovidov). - Envío de capas de imágenes Docker comprimidas con zstd. #114342 (Alexey Milovidov).
- Creación de paquetes Debian únicamente para las compilaciones de release. #114739 (Alexey Milovidov).
- Se corrigió la compilación de
unit_tests_dbmsen configuraciones sin el conjunto completo de bibliotecas (ENABLE_LIBRARIES=0oENABLE_ROCKSDB=0). #115655 (Alexey Milovidov).
Lanzamiento de ClickHouse 26.7, 2026-07-22. Presentación, Vídeo
Cambio incompatible con versiones anteriores
- El acceso a S3 originado desde SQL de usuario ya no resuelve de forma predeterminada las credenciales en la nube del propio servidor (entorno, IMDS/IRSA, perfil de instancia, archivos de configuración de AWS, STS basado en
role_arn, metadatos OAuth de GCP); esa solicitud debe usar credenciales explícitas oNOSIGN. Las colecciones con nombre ahora establecenuse_environment_credentialsen0de forma predeterminada. El comportamiento anterior puede restaurarse por solicitud conuse_environment_credentials = 1(o globalmente mediante la configuración<s3>) junto con el nuevo ajustes3_allow_server_credentials_in_user_queries(deshabilitado de forma predeterminada). Las credenciales proporcionadas explícitamente y las credenciales de configuración aprovisionadas por el operador no se ven afectadas. Al iniciar el servidor o enRESTORE, una tabla persistenteS3/S3Queue, un disco S3 dinámico o unDataLakeCatalogcuya definición resuelva dichas credenciales se carga de forma anónima (inaccesible hasta volver a proporcionar credenciales) en lugar de abortar el inicio, controlado por el nuevo ajuste del servidors3_load_table_anonymously_if_credentials_restricted(habilitado de forma predeterminada). #106855 (Raúl Marín). - El glob
**/(cualquier número de directorios) ahora también coincide con el mismo directorio. Antes,**/en los patrones glob no se trataba como un caso especial, por lo quedata/**/file.txtno coincidía condata/file.txt(cero niveles de directorio). #97676 (Alexey Milovidov). - Se rechaza el formato de archivo de copia de seguridad
zip/zipxpara copias de seguridad almacenadas en almacenamiento de objetos — destinos directosS3(...)/AzureBlobStorage(...)y destinosDisk(...)respaldados por S3 o Azure — tanto paraBACKUPcomo paraRESTORE. Zip requiere posicionamiento para leer su directorio central, lo que es muy lento sobre almacenamiento de objetos. Use en su lugar un formato basado en tar, comotar.gz. #101770 (Yash ). - Se amplió el rango admitido de
DateTime64de[1900-01-01, 2299-12-31]a[0000-01-01, 9999-12-31]. Los valores fuera del rango anterior ahora se calculan correctamente (mediante cctz) en lugar de saturarse en el límite. Con precisión 8 o 9, el rango sigue siendo más estrecho porque los ticks se almacenan comoInt64(con precisión de nanosegundos, el máximo sigue siendo2262-04-11). Compatibilidad con versiones anteriores: si antes usaba fechas y horas fuera de rango, pero dependía de las reglas de saturación muy específicas dentro del rango antiguo, tenga en cuenta que ahora los resultados cambian para ser más correctos. #107907 (Alexey Milovidov). AggregatingMergeTreeahora rechaza, en el momento de crear la tabla, esquemas en los que una columna no forma parte de la clave de ordenación ni es una medida de estado de agregación (AggregateFunction/SimpleAggregateFunction). Esas columnas se reducen silenciosamente a un valor arbitrario durante las fusiones en segundo plano, lo que produce resultados incorrectos para las consultas que usanGROUP BYo filtran sobre ellas. Establezcaallow_dimensions_outside_sorting_key = 1para restaurar el comportamiento anterior. Cierra #751. #108087 (Alexey Milovidov).- Se eliminó la configuración de planificación de cargas de trabajo basada en configuración (las secciones de configuración del servidor
resourcesyworkload_classifiers). Use en su lugar las consultasCREATE RESOURCEyCREATE WORKLOAD. Las secciones de configuración obsoletas se ignoran con una advertencia. #108286 (Sergei Trifonov). - ClickHouse ahora usa siempre el hash unificado de deduplicación de inserciones tanto para las inserciones síncronas como para las asíncronas; se han eliminado los comportamientos heredados de deduplicación por inserción. La configuración del servidor
insert_deduplication_versionse mantiene como salvaguarda de migración: el servidor se niega a iniciarse si está establecida en un valor heredado (old_separate_hashesocompatible_double_hashes). Para actualizar desde una versión que usaba un valor heredado, primero ejecute una versión que admitacompatible_double_hashes(que escribe tanto los hashes heredados como los unificados). En el caso de las tablas replicadas, ejecútela durante al menosreplicated_deduplication_window_seconds(una hora de forma predeterminada; las ventanas predeterminadas conservan los hashes unificados de todas las inserciones durante esa ventana, lo que se considera suficiente para un bucle de reintento de inserciones). En el caso de las tablas no replicadas connon_replicated_deduplication_window> 0, esa ventana se basa en el número de inserciones y no en el tiempo, así que ejecutecompatible_double_hashesdurante al menos esa cantidad de inserciones. Después, elimine la configuración (o establézcala ennew_unified_hash) antes de actualizar a esta versión. #108361 (Sema Checherinda). Si nunca configuróinsert_deduplication_version, puede ignorar este punto. - Se eliminaron las funciones obsoletas desde hace tiempo
snowflakeToDateTime,snowflakeToDateTime64,dateTimeToSnowflakeydateTime64ToSnowflake. Ya habían quedado obsoletas en la v24.6 en favor desnowflakeIDToDateTime,snowflakeIDToDateTime64,dateTimeToSnowflakeIDydateTime64ToSnowflakeID, que son las que deben usarse ahora. La configuraciónallow_deprecated_snowflake_conversion_functions(que antes permitía volver a habilitarlas) ahora también está obsoleta y no tiene ningún efecto. #108711 (Alexey Milovidov). - La configuración
use_legacy_to_timeahora tiene0como valor predeterminado, por lo quetoTimeconvierte los valores al tipo de datoTimeen lugar de convertir una fecha con hora en una fecha fija. El comportamiento heredado sigue disponible mediante la funcióntoTimeWithFixedDateo estableciendouse_legacy_to_time = 1. #108729 (Alexey Milovidov). - Los modelos de Naive Bayes (utilizados por
naiveBayesClassifier) ahora se configuran como un diccionario con el layoutNAIVE_BAYES, construido en el momento de la carga a partir de una tabla de recuentos de n-gramas preagregados por clase, en lugar de la configuración anterior del lado del servidor (un archivo de configuración XML que hacía referencia a archivos de modelo.binserializados), que ya no es compatible; los modelos existentes deben recrearse como diccionarios. Además denaiveBayesClassifier, se añaden tres funciones nuevas:naiveBayesClassifierWithProbdevuelve la clase predicha junto con su probabilidad,naiveBayesClassifierWithAllProbsdevuelve todas las clases con su probabilidad, ynaiveBayesNgramstokeniza el texto en n-gramas de la misma manera que lo hace el diccionario, para construir los datos de entrenamiento a partir de texto etiquetado sin procesar. Además, se han aplicado varias optimizaciones de rendimiento: en un modelo de lenguaje de trigramas de puntos de código de 9.7 MiB, usa ~49× menos memoria (de 1.84 GiB a 38 MiB), carga ~11× más rápido y clasifica ~11× más rápido. #108773 (Nihal Z. Miaji). - La función
hasColumnInTableya no acepta los argumentos opcionaleshostname,usernameypasswordpara comprobar una columna en un servidor remoto arbitrario; solo se mantiene la formahasColumnInTable(database, table, column). El modo remoto eliminado suponía un problema de seguridad: permitía a cualquier usuario iniciar conexiones salientes a hosts arbitrarios y filtraba credenciales en los registros de consultas, y no estaba protegido por ningún privilegio. #110881 (Alexey Milovidov).
Nueva funcionalidad
- Se añadió
EXPLAIN ANALYZEpara analizar el rendimiento de las consultas: la consulta se ejecuta y las métricas reales de ejecución se muestran en el formato habitual del plan de consulta. #106586 (Kirill Kopnev). #110668 (Kirill Kopnev). - Se añadió compatibilidad con cláusulas
WHEREen las definiciones de proyecciones. Las proyecciones conWHEREsolo materializan las filas que cumplen el predicado, y el optimizador puede utilizarlas (basándose en costes) cuando elWHEREde la consulta implica elWHEREde la proyección. #102347 (S Bala Vignesh). - Se añadió la configuración
skip_unavailable_shards_mode(también disponible como configuración del motorDistributed) para controlar qué excepciones de un segmento remoto se ignoran silenciosamente cuandoskip_unavailable_shardsestá habilitado. #79091 (cjw). - Se añadió la función de agregación
groupFormat, que da formato a las filas de cada grupo usando un formato de salida especificado y devuelve el resultado como una cadena. #93201 (Yang Hu). - Se añadió
AWS_MSK_IAMcomo valor admitido parakafka_sasl_mechanism, lo que permite a ClickHouse autenticarse con Amazon MSK mediante roles de IAM sin tener que gestionar credenciales SASL/SCRAM. #96100 (kalavt). - Se añadió el combinador de funciones de agregación
-Tuple, que aplica la función de agregación subyacente a cada elemento de una columnaTuplede forma independiente y devuelve unTuplecon los resultados, preservando los nombres de los elementos:sumTuple(t)parat = (a, b)devuelve(sum(a), sum(b)). Las funciones de agregación con varios argumentos toman una tupla por argumento, emparejada por posición:corrTuple((a1, a2), (b1, b2))devuelve(corr(a1, b1), corr(a2, b2)). A diferencia de-ForEachsobre arrays, los elementos pueden tener tipos diferentes, y se conservan los tipos y nombres de los resultados de cada elemento. #98190 (RinChanNOW). - Los índices de texto ahora admiten un argumento
postprocessor: una expresión arbitraria que transforma cada token después de la tokenización (por ejemplo,lower). #98939 (Jimmy Aguilar Mena). #108606 (Jimmy Aguilar Mena). - Se añadió la tabla del sistema
system.stemmers, que enumera todos los idiomas que pueden especificarse para la funciónstem. #100611 (Jimmy Aguilar Mena). - Se añadió compatibilidad con
WITH TIESparaLIMITnegativo. #100930 (Nihal Z. Miaji). - Se añadió compatibilidad con los operadores postfijos
AT TIME ZONEyAT LOCALde SQL estándar como azúcar sintáctico detoTimeZone. La expresiónexpr AT TIME ZONE zoneahora equivale atoTimeZone(expr, zone), yexpr AT LOCALequivale atoTimeZone(expr, timeZone()). #106092 (lizepeng). - El motor de tabla
URLy la función de tablaurlahora redirigen al backend adecuado según el esquema de la URL:file://lo atiende el motorFile,s3:///gs:///gcs:///oss://S3,az:///azure:///abfss:///abfs://AzureBlobStorage,hdfs://HDFSyhttp(s)://el motorURL, como antes. La configuraciónurl_basese aplica antes de la redirección por esquema. Solo se redirigen los esquemas de S3 resueltos por losurl_scheme_mapperspredeterminados; otros esquemas de proveedores compatibles con S3 (cos,obs, …) no se redirigen y requieren usar directamente el motor o la funcións3. #106093 (Alexey Milovidov). - Se añadieron los motores de tabla
RemoteyRemoteSecure, las contrapartes persistentes de las funciones de tablaremoteyremoteSecure.CREATE TABLE ... ENGINE = Remote('addresses', db, table, ...)ahora funciona además deCREATE TABLE ... AS remote(...). #106189 (Alexey Milovidov). - Se añadieron los comandos independientes del motor
SYSTEM STOP,SYSTEM START,SYSTEM PAUSE,SYSTEM CANCELySYSTEM REFRESH, junto con sus variantes para todo el servidor... ALL BACKGROUND, para controlar la actividad en segundo plano de las tablasKafka,RabbitMQ,NATS,S3Queue/AzureQueuey de las vistas materializadas actualizables mediante una interfaz unificada. En el caso de las vistas materializadas actualizables, actúan como alias de los comandos existentesSYSTEM ... VIEW. Como parte del soporte de estos controles en NATS, las tablas JetStream ahora confirman los mensajes solo después de un insert correcto (al menos una vez; antes los mensajes se confirmaban automáticamente al entregarse y podían perderse si fallaba el insert). Una nueva configuraciónnats_wait_for_flush_interval(valor predeterminadofalse, para preservar el comportamiento anterior de baja latencia) permite mantener abierto un ciclo de consumo durante todo el intervalo de flush, en lugar de hacer flush en cuanto se vacía la cola. Una nueva configuraciónnats_commit_on_selecthace que unSELECTdirecto sobre una tabla JetStream consuma (confirme) los mensajes que lee. #107476 (Samuel Krempaský). - Se añadió soporte para que las funciones de tabla y los motores de tabla
mysql,postgresqlysqliteacepten una consulta del usuario (en lugar de un nombre de tabla) y la pasen tal cual a la base de datos externa, ya sea escrita como una subconsulta(SELECT ...)o comoquery('SELECT ...'). La estructura de la tabla resultante se infiere a partir del resultado de la consulta, y dicha tabla es de solo lectura. Cierra #46758. Basado en la implementación inicial de Denis Vidiaev (#79652). #107740 (Alexey Milovidov). - Se añadieron pestañas a la UI web de ClickHouse (Play) para trabajar con varias consultas a la vez. Las pestañas, sus títulos, parámetros, estado activo y pequeñas instantáneas de resultados se conservan entre recargas (los resultados grandes y las imágenes no se restauran), se integran con el historial del navegador y la URL, y se puede cambiar entre ellas con la rueda del ratón. #107826 (Alexey Milovidov).
- Se introduce el motor de tabla
QueryRunner. Los registros insertados en una tablaQueryRunnerrepresentan consultas que ejecuta el motor. El motor puede usarse para la ejecución asíncrona de consultas, la ejecución por lotes de consultas generadas, el envío de consultas a clusters remotos, benchmarks, fuzzing y pruebas con tráfico en sombra. #107888 (Miсhael Stetsyuk). - Se añade el formato de salida
GeoJSONpara escribir documentosFeatureCollectionde GeoJSON, generando una feature por fila. La única columna de tipo geo (Point,LineString,MultiLineString,Polygon,MultiPolygon,RingoGeometry) pasa a ser lageometryde cada feature; una columna llamadaidpasa a ser elidde la feature; y todas las columnas restantes pasan a ser laspropertiesde la feature, donde una única columna de tipo objeto llamadaproperties(unJSON,MapoTuplecon nombre) se escribe directamente como el objetoproperties. UnRingse escribe como unPolygonde un solo anillo. El nuevo ajusteformat_geojson_validate_geometry(habilitado de forma predeterminada) controla si las geometrías que no son formas GeoJSON válidas —como unPolygoncon menos de cuatro puntos o un anillo dePolygonno cerrado— se rechazan al leer y escribir. Además, el formato de entradaGeoJSONahora infiere la columnaidcomoNullable(String)en lugar deString, de modo que una feature con un miembro"id": nullausente o explícito se lea comoNULLy se mantenga diferenciada de una cadena vacía"". Basado en la implementación inicial de Mark Needham (#98124). #108065 (Nihal Z. Miaji). - Se añadió la función
dotProductTransposed(aliasscalarProductTransposed), que calcula el producto interno aproximado entre una columnaQBity un vector de referencia, complementando las funciones existentesL2DistanceTransposedycosineDistanceTransposed. #108100 (Alexey Milovidov). También se añadieron las funciones de distancia transpuesta cuantizadacosineDistanceTransposedQuantized,L2DistanceTransposedQuantizedydotProductTransposedQuantized, que operan sobre unQBit(Int8)de códigos Lloyd-Max dequantizeBFloat16ToInt8, descuantizando los códigos almacenados sobre la marcha. Un vector de referencia de coma flotante es la consulta de precisión completa, comparada con precisiónFloat32(una consultaFloat64se reduce); una referenciaArray(Int8)también se descuantiza, para una distancia simétrica entre cuantizado y cuantizado. #109405 (Alexey Milovidov). - Se añadió un parámetro
strideopcional al tipo de datoQBit(QBit(T, dimension, stride)) que almacena grupos de dimensiones en flujos separados, de modo que una búsqueda vectorial pueda leer eficientemente solo las primeras dimensiones (por ejemplo, para Matryoshka embeddings). Las funciones de distancia transpuesta aceptan un cuarto argumento opcional,used_dims, para leer un número reducido de dimensiones. #108103 (Alexey Milovidov). - Se añadió soporte para el tipo de elemento
Int8en el tipo de datoQBit, lo que permite el almacenamiento y la búsqueda vectorial por distancia transpuesta (L2DistanceTransposed,cosineDistanceTransposed) sobre vectores enteros cuantizados de 8 bits. #108105 (Alexey Milovidov). - Nueva función
randomHadamardTransform(vector[, seed[, output_dims]]): una transformada Hadamard aleatorizada determinista de un vector de coma flotante —una rotación ortogonal que preserva la norma, útil para el preprocesamiento de embeddings antes de la cuantización y, cuando se trunca, como proyección aleatoria de Johnson–Lindenstrauss / Hadamard aleatorizada con submuestreo. #108227 (Alexey Milovidov). - Soporte para configurar la carga diferida de diccionarios de forma individual con el ajuste
dictionary_lazy_loaden la definición del diccionario, anulando el ajuste global de servidordictionaries_lazy_load, de modo que algunos diccionarios puedan cargarse de forma diferida mientras que otros se cargan inmediatamente. #108314 (Miсhael Stetsyuk). - Se añadió una página integrada de búsqueda de documentación, disponible en la ruta
/docsde la interfaz HTTP, que ofrece búsqueda instantánea en la tablasystem.documentationy muestra la documentación de referencia (con resaltado de sintaxis, fórmulas matemáticas y enlaces cruzados). #108345 (Alexey Milovidov). - Se añadió la función
xxHash64Spark, que calcula valoresxxHash64compatibles con Spark para entradasStringyNULLusando la semilla42y devuelveInt64. #108436 (Lalit Yadav). ALTER USER,ALTER ROLEyALTER SETTINGS PROFILEahora aceptanSET name = valuecomo alias deMODIFY SETTING name = value. Esto modifica configuraciones individuales in situ sin afectar al resto, a diferencia de la cláusulaSETTINGSsimple, que reemplaza toda la lista de configuraciones. Así es menos probable borrar accidentalmente otras configuraciones de un usuario. #108722 (Groene AI).- Se admite
ALTER TABLE ... MODIFY CONSTRAINT [IF EXISTS] name CHECK exprpara cambiar in situ la expresión de una restricción existente. #108768 (Alexey Milovidov). - Web UI: se añadió un selector de codificación por colores por columna (el icono 🌈 en el encabezado de una columna) para alternar entre barras, heatmap, categórico y sin visualización. Los modos seleccionados se conservan en la URL y en el historial del navegador. #108873 (Alexey Milovidov).
Keeperahora maneja correctamente el opcodeCreateContainer(19) deZooKeeper, controlado mediante un nuevo indicador de feature opcionalcreate_container(deshabilitado de forma predeterminada, igual quecreate_ttl). Una vez habilitado tras una upgrade completa del ensemble, los client externos deZooKeeper(p. ej., JavaZooKeeper3.9+) pueden crear nodos contenedor enKeeperen lugar de recibirConnectionLoss; los nodos contenedor informan el valor centinelaephemeralOwneresperado, y un hilo de GC en segundo plano en el líder elimina automáticamente los contenedores sin hijos. Una solicitudCreatenormal que incluya el indicador de modo de creaciónCONTAINERsin el opcode 19 sigue siendo rechazada (ZBADARGUMENTS): no se conoce ningún client deZooKeeperque emita esa combinación. Esto es solo compatibilidad de protocolo del lado del servidor: el propio clientZooKeeperde ClickHouse (zkutil) no cambia y no tiene API para crear nodos contenedor por sí mismo. #108908 (unintended).- Se añadieron las funciones
geoToUTM,UTMToGeo,geoToMGRSyMGRSToGeopara convertir entre coordenadas geográficas WGS84 y los sistemas de coordenadas UTM y MGRS. #108939 (Alexey Milovidov). - Se añadió la función
digits(n, offset[, length]), que devuelve los dígitos dena partir deloffsetde base 1 y con una longitud delengthdígitos, o hasta el final del número si se omitelength. #109012 (Umang Agrawal). - Se añadió la función aritmética
sqrpara calcular el cuadrado de un número. #109061 (Lalit Yadav). - Se añadió una nueva función
dictGetRootque devuelve el ancestro más alto (la raíz) de una clave en un diccionario jerárquico. Es un equivalente práctico dedictGetHierarchy(dict_name, key)[-1]. #109459 (Alexey Milovidov). - Se añaden los comandos
SYSTEM UNLOAD DICTIONARYySYSTEM UNLOAD DICTIONARIESpara liberar la memoria del diccionario sin eliminar su definición. Los diccionarios se volverán a cargar de forma diferida en el siguiente acceso. #109639 (Matheus Nerone). - Se añaden las funciones
geometryIntersectCartesianygeometryIntersectSpherical, que devuelven si dos geometrías se intersecan. A diferencia depolygonsIntersectCartesian/polygonsIntersectSpherical, aceptan cualquier tipo de datos geométrico (Point,LineString,MultiLineString,Ring,Polygon,MultiPolygon), incluido el tipo comúnGeometry, y los dos argumentos pueden ser de tipos distintos. #110062 (Alexey Milovidov). - Los parámetros de consulta (sustituciones
{name:Type}) ahora pueden usarse como valores de configuración, tanto en la cláusulaSETTINGSde una consulta (comoSELECToINSERT) como en consultasSETindependientes; por ejemplo,SELECT ... SETTINGS max_threads = {threads:UInt64}ySET max_threads = {threads:UInt64}. #108760 (Alexey Milovidov).
Funcionalidad experimental
- Expansión de comodines para la table function
urly el table engineURL: los comodines en la ruta de la URL se expanden enumerando páginas índice HTTP (listados de directorios en HTML o plaintext) y extrayendo las URL coincidentes, con límites tanto en el tamaño de la página índice como en el número de directorios leídos. Se habilita mediante la configuraciónallow_experimental_url_wildcard_from_index_pages. #95181 (Yue Ni). - Los índices de texto ahora pueden almacenar posiciones de tokens (el argumento de índice
support_phrase_search) para permitir la coincidencia exacta de frases con lecturas directas para la funciónhasPhrase. Requiere habilitar la configuración deMergeTreeallow_experimental_text_index_phrase_search. #103172 (Elmi Ahmadov). El argumento se introdujo inicialmente con el nombrepositions. #109900 (Elmi Ahmadov). - Se añade compatibilidad con la compactación de manifest files para tablas
IcebergmedianteOPTIMIZE TABLE ... MANIFEST(protegido por la configuraciónallow_experimental_iceberg_compaction). Cierra #95174. #98178 (Smita Kulkarni). Se corrigeOPTIMIZE TABLE ... MANIFESTpara tablasIcebergcuando las tuplas de partición del manifiesto no coinciden con su especificación de partición. #111368 (Smita Kulkarni). - Se añade una variante Real Doubles (RD) y un argumento opcional
ALP(AUTO|STD|RD)al códec experimentalALP.ALPsin argumentos ahora selecciona automáticamente entre el esquemaSTDexistente yRDen lugar de usar siempreSTD. #99654 (Nazarii Piontko). - Se añade una caché SLRU en memoria para metadata files deserializados de
Paimon(manifest lists y manifests). Cuando se habilita mediante la configuraciónuse_paimon_metadata_files_cache, las consultas repetidas sobre la misma tablaPaimonevitan volver a descargar y analizar los metadatos desde object storage. #104657 (XiaoBinMu). - Se añadieron “drivers” para funciones definidas por el usuario ejecutables. Un driver declarado en
<user_defined_executable_function_drivers_config>puede usarse enCREATE FUNCTION name ARGUMENTS (...) RETURNS T ENGINE = DriverName(...) AS '...code...'para compilar o procesar de otro modo un fragmento de code de usuario en el momento de crear la función y producir una executable UDF utilizable. La configuración resultante se almacena en<dynamic_user_defined_executable_functions_path>, y la consulta original se conserva comoATTACH FUNCTIONpara que la función sobreviva a los reinicios del servidor. Un driverc_function_bodyde prueba de concepto compila y ejecuta cuerpos de funciones C dentro de contenedores Docker aislados en modoexecutable_pool. Basado en la implementación inicial de Daniil Timižev (#77128). #105131 (Alexey Milovidov). - Atiende
SELECT count(*) FROM t WHERE col <op> default(col)a partir de estadísticas de dispersión por columna enserialization.json, sin escanear datos, cuando el predicado divide exactamente la columna entre valores predeterminados y no predeterminados (bajo la nueva configuración experimentaloptimize_trivial_count_with_sparsity_filter, desactivada de forma predeterminada). #105890 (Raúl Marín). - Las API request de Prometheus Query API a
/api/v1/queryy/api/v1/query_rangeahora se registran ensystem.query_logcon las métricasread_rowsyread_bytes. #106611 (James Cunningham). - La ruta de lectura experimental de
ReaderExecutor(use_reader_executor, desactivada de forma predeterminada) ahora puede mantener abierta una conexión remota al origen y reutilizarla en lecturas secuenciales, lo que reduce la cantidad de solicitudes al almacenamiento de objetos durante los escaneos. #107735 (Sema Checherinda). Ahora también admite la lectura de archivos cifrados, con una caché global de encabezados de cifrado configurada mediante la configuración del servidorencryption_header_cache_sizey vaciada conSYSTEM DROP ENCRYPTION HEADERS CACHE. #109702 (Sema Checherinda). - Se admiten lecturas del plan de consultas distribuidas para
SELECT ... FINALen tablas de la familiaMergeTreecuandomake_distributed_planestá habilitado. #108148 (Alexander Gololobov). - Se añade la ejecución experimental de réplicas paralelas basada en planes para consultas de
MergeTree. #108504 (Igor Nikonov). - Se añadió la familia experimental de códecs vectoriales
Quantizey una reescritura opcional de búsqueda vectorial aproximada en dos etapas sobre flujos complementarios cuantizados. #108565 (Shankar Iyer). - Se recupera el códec de compresión con pérdidas experimental
SZ3, con error acotado, para columnasFloat32/Float64(y sus arrays), implementado originalmente por Konstantin Vedernikov (#83088). Requiereallow_experimental_codecs. #108788 (Alexey Milovidov). Se corrigió la lectura de datos comprimidos conSZ3('ALGO_LORENZO_REG', ...), que antes fallaba conCORRUPTED_DATA, y se evitó un comportamiento indefinido al comprimir valores de coma flotante no finitos (NaNe infinitos). #110762 (Alexey Milovidov). - Se añadió el códec experimental
ZXC—un códec LZ asimétrico con compresión lenta y descompresión muy rápida, con una relación de compresión entreLZ4yZSTD. Requiereallow_experimental_codecs = 1, ysystem.compression_codecslo informa como experimental. #110620 (Alexey Milovidov). #111007 (Alexey Milovidov). - Ahora puede autenticarse en OneLake usando un token Bearer obtenido previamente mediante la configuración
onelake_bearer_token, en lugar deonelake_client_idyonelake_client_secret. Esto evita compartir un secreto de client de larga duración. El token no se renueva, por lo que la base de datos debe recrearse una vez que expire. #109104 (Asya Shneerson). - Las funciones de IA ya no toman la colección con nombre como primer argumento posicional. Las credenciales provienen de las configuraciones
ai_function_text_default_credentials/ai_function_embedding_default_credentialso de una clavecredentialsen un argumento final opcionalMap(String, String), que también incluye parámetros ajustables (model,max_tokens,temperature,system_prompt,instructions,dimensions). #109232 (George Larionov). La funciónaiEmbedahora tomamodelcomo argumento posicional obligatorio (aiEmbed(text, model[, params])) en lugar de leerlo de la colección con nombre, lo que garantiza la reproducibilidad de los embeddings. #110619 (George Larionov). - Se corrigió
data_uncompressed_bytespara los índices de omisión empaquetados enskp_idx.packed(mediantepacked_skip_index_max_bytes): el tamaño sin comprimir informado era en realidad el tamaño comprimido, lo que también podía impedir la activación dedistributed_index_analysis. #109272 (Raúl Marín). - Se añadió almacenamiento experimental de partes de datos empaquetadas para tablas
MergeTree, que guarda la mayoría de los archivos de una parte en un único archivodata.packeden lugar de un archivo por flujo (las proyecciones y unos pocos archivos de servicio, comotxn_version.txt, todavía se escriben por separado). Se controla mediante los ajustesmin_bytes_for_full_part_storage,min_rows_for_full_part_storageymin_level_for_full_part_storage, y está deshabilitado de forma predeterminada. Una vez que una tabla escribe partes empaquetadas, las versiones anteriores del servidor ya no pueden leerlas, por lo que habilitar este formato impide volver a una versión anterior del servidor. #108118 (Raúl Marín). - Se añadió la función de tabla experimental
eval, que evalúa una expresión constante como una cadena de consulta y ejecuta la única consultaSELECTresultante. La funcionalidad está deshabilitada de forma predeterminada y puede habilitarse con el ajusteallow_experimental_eval_table_function. Autor: Yue Ni. #110132 (Alexey Milovidov). - Se añadió compatibilidad con compresión
zstdal handler HTTP v1 experimental de remote-write de Prometheus. #110907 (James Cunningham). - La escritura en tablas
DeltaLake(el ajusteallow_experimental_delta_lake_writes) pasó a Beta. #107034 (Kseniia Sumarokova). - Se añadieron los
ProfileEventsDistributedPlanRemoteTasks,DistributedPlanLocalExecutionyDistributedPlanHostsUsedpara observar la ejecución de planes de consulta distribuidos experimentales (make_distributed_plan). #107985 (Shankar Iyer). - Se eliminó el almacenamiento experimental basado en RocksDB en Keeper (
experimental_use_rocksdb). Pronto llegará un nuevo almacenamiento en disco mejorado. #108000 (Michael Kolupaev). - El análisis de índices distribuido (una funcionalidad experimental controlada por el ajuste
distributed_index_analysis) ahora envía listas grandes de nombres de partes de datos a servidores remotos como escalares, en lugar de incrustarlas en el texto de la consulta. Esto evita posibles fallos debidos a los límites demax_ast_elements/max_query_sizey elimina la sobrecarga del análisis del AST. #110419 (Azat Khuzhin). - Se optimizaron las funciones experimentales de agregación
timeSeries*ToGrid: los buckets ahora se alinean tanto con el paso como con la ventana, y la agregación final es mucho más rápida cuando la ventana es mucho mayor que el paso. El formato de serialización del estado de agregación se cambió de forma incompatible (estas funciones son experimentales). #106724 (Vitaly Baranov). - Las tablas de destino externas de una tabla
TimeSeriesahora se registran como dependencias referenciales: al igual que con las vistas materializadas, esto impide eliminar una tabla de destino externa antes de eliminar la tablaTimeSeriesque la referencia (sicheck_referential_table_dependenciesestá habilitado). #108388 (Vitaly Baranov). - Se añadió la función de PromQL
increase. #111023 (Vitaly Baranov).
Mejora del rendimiento
- Los
JOINahora pueden usar el índice de la primary key o los skip indexes de la tabla del lado izquierdo para podar gránulos. Esto se controla con la configuraciónenable_join_runtime_filters_index_analysis. #109085 (Shankar Iyer). - La serialización y deserialización de vectores de tipos trivialmente serializables ahora usan una única llamada de E/S del búfer en lugar de procesar los elementos individualmente. #89842 (Jimmy Aguilar Mena).
- Optimiza las búsquedas inversas en diccionarios: un predicado de igualdad constante como
WHERE dictGet(dict, attr, key_expr) = valueahora se pliega directamente en un filtro por clave constante (key_expr = const,key_expr IN [...]oWHERE 0) en lugar de reescribirse como una subconsultaIN (SELECT ... FROM dictionary(...)), y la ruta constante dedictGetKeysahora se ejecuta en paralelo. #91164 (Nihal Z. Miaji). - Añade una nueva configuración
merge_tree_generic_exclusion_search_max_stepsque limita el número de pasos que el algoritmo de búsqueda de exclusión genérica dedica a analizar el índice de la primary key de cada parte de datos. El presupuesto se consume primero en los rangos de clave restantes más grandes, por lo que incluso un presupuesto pequeño poda la mayor parte de los datos; los rangos que no se hayan analizado por completo se leen enteros, por lo que los resultados de la consulta siguen siendo correctos, aunque pueden leerse más gránulos. El límite se aplica de forma flexible: puede superarse como máximo enmerge_tree_coarse_index_granularitypasos, más un paso por cada rango en el que la parte ya esté dividida (por ejemplo, por la caché de condiciones de consulta). El valor predeterminado 0 significa pasos ilimitados. #92779 (Michael Jarrett). - Las consultas con
ORDER BYyLIMITen vistas sobre tablasDistributedahora usan la optimización de flujos ordenados por fusión: elORDER BY/LIMITexterno se inserta en la consulta interna de una vista simple, de modo que cada shard ordena sus datos localmente y el coordinator fusiona flujos previamente ordenados en lugar de realizar una ordenación completa. #94102 (matanper). - Habilita
optimize_or_like_chainde forma predeterminada. Cierra #87779. #94517 (Alexey Milovidov). - Marca las tablas de log del sistema
MergeTreerotadas no replicadas sin TTL comotable_readonlypara evitar operaciones en segundo plano innecesarias. La configuracióntable_readonlydeMergeTreeahora también suprime todo el trabajo en segundo plano en una tablaMergeTreenormal — merges normales, de TTL (DELETE/MOVE/recompresión) y de recompresión, mutations en segundo plano y movimientos de partes en segundo plano — y rechaza los comandos de partición mutantes (ATTACH/MOVE/DROP/DROP DETACHED/FETCH/REPLACE PARTITIONyMOVE PARTITION ... TO TABLEhacia la tabla), además de los inserts, mutations yOPTIMIZEque ya rechazaba. Como resultado, una tablatable_readonlycon TTL ya no elimina sus datos expirados mientras esta configuración esté habilitada. #95079 (Mathuranath Metivier). - Mejora el rendimiento al recuperar un único registro de usuario de
system.userscuando el servidor tiene muchos usuarios. #96699 (Alistair Evans). - La lectura en orden con réplicas paralelas ahora usa la misma lógica que la lectura local para dividir la tabla en
max_threadspartes, con el fin de mejorar el paralelismo. #101434 (Nikita Taranov). - Usa los límites del índice minmax de la partición para descartar más gránulos durante el análisis de la clave primaria en tablas
MergeTree, cuando una columna de la clave primaria también es una columna de entrada de la clave de partición. Por ejemplo, en una tablaMergeTreeconORDER BY (id, event_time)yPARTITION BY toYYYYMM(event_time), ClickHouse usará el índice minmax de la partición sobreevent_timedurante el análisis del índice de la clave primaria para tomar decisiones más precisas al descartar gránulos. Controlado por la nueva configuraciónuse_partition_minmax_for_primary_key_pruning(habilitada de forma predeterminada). #103480 (UnamedRus). - Habilita la caché de condiciones de consulta para las consultas que usan filtrado dinámico Top-K (
ORDER BY ... LIMIT n). La entrada de caché se divide según los parámetros del plan Top-K, de modo que la misma consulta reutiliza los resultados en caché del filtroWHERE, mientras que unLIMIT, una columna de ordenación o una dirección de ordenación distintos generan una entrada nueva. #104478 (Alexey Milovidov). - Se añadió la configuración
use_constant_folding_in_index_analysis(deshabilitada de forma predeterminada). Cuando está habilitada, el análisis de la clave primaria,MinMaxy los índices de omisión deMergeTreeaplica por separado a cada parte el plegado de constantes a nivel de partición en el predicado de filtro, lo que mejora el descarte en filtros cuyas ramas dependen de valores de partición; por ejemplo,(a = 1 AND b >= 1) OR (a = 2 AND b > 10)conPARTITION BY a. #104582 (Mikhail Artemenko). - Inserta
LIMITen la agregación en orden para permitir la finalización anticipada cuando la clave deGROUP BYcoincide con la clave deORDER BYy con la clave de ordenación de la tabla, lo que reduce significativamente el número de filas leídas. #104859 (Konstantin Bogdanov). - Actualizar los eventos de perfil ahora es hasta 30 veces más rápido gracias al uso de operaciones atómicas por CPU para contadores globales del servidor y por usuario. Controlado por la configuración de servidor
user_profile_events_per_cpu(usa alrededor de 640 KiB por usuario en 64 núcleos, así que con un número muy grande de usuarios puede tener sentido mantenerla deshabilitada). #105056 (Azat Khuzhin). - Habilita
allow_aggregate_partitions_independentlyde forma predeterminada. Cuando una clave deGROUP BYencaja con la clave de partición, ClickHouse puede agregar cada partición de forma independiente y omitir el paso de fusión global. Las heurísticas en tiempo de ejecución omiten automáticamente la optimización cuando la distribución de las particiones la hace desfavorable (muy pocas particiones, demasiadas particiones o tamaños de partición muy desiguales). #105128 (Alexey Milovidov). - Las consultas de búsqueda vectorial con rescoring (
vector_search_with_rescoring = 1) ahora calculan la distancia exacta solo para las filas devueltas por el índice vectorial, aplicando un filtro exacto por posición de fila en lugar de hacer rescoring por fuerza bruta de filas vecinas del mismo gránulo deMergeTree. #105591 (Sergey Kuznetsov). #108846 (Sergey Kuznetsov). - Mejora el rendimiento del algoritmo de join
partial_mergecon clavesFixedStringal comparar secuencias de valores de una sola vez, en lugar de hacer una llamada de comparación por cada valor. #105737 (Artem Zuikov). SHOW TABLESysystem.tablesen catálogos de lago de datos (Iceberg REST, Glue, Unity, Hive, Paimon) ahora trasladan al catálogo los predicados acotados por el espacio de nombres, evitando un escaneo completo del catálogo. Cierra #105022. #106029 (Smita Kulkarni).- Se limitó la memoria no rastreada por CPU para evitar
overcommity errores por falta de memoria (los límites se configuran con la configuración del servidormax_per_cpu_untracked_memoryyper_cpu_untracked_memory_thread_buffer). #106055 (Azat Khuzhin). - Se aceleraron los operadores que escanean un stream ordenado en busca de secuencias de valores de clave iguales:
DISTINCTin order,LIMIT BYin order,LIMIT BYnegativo in order, y los joinsfull_sorting_mergeypartial_merge. #106502 (Nihal Z. Miaji). - Se implementaron un reader y un writer nativos para los formatos
ArrowyArrowStreamque no usan la biblioteca Apache Arrow, lo que evita copias y conversiones de datos adicionales. Ahora es la opción predeterminada (settingsinput_format_arrow_use_native_readeryoutput_format_arrow_use_native_writer) y es más rápida tanto para lectura como para escritura. #106522 (Alexey Milovidov). - Se volvió a habilitar LTO para jemalloc tras corregir una corrupción de la caché de hilos que aparecía con LTO, lo que mejora el rendimiento. #106898 (Azat Khuzhin).
- Se redujo el uso de memoria y se mejoró el rendimiento de los
JOIN. El lado derecho de un hash join ahora usa una referencia compacta a filas de 8 bytes basada en índices, por lo que las entradas de la tabla hash de los joinsALLson tan pequeñas como las de los joinsANYpara cualquier tipo de clave. Se hicieron benchmarks sobre consultas grandes de joinparallel_hash: joinsINNERyANYde tablas de entre 100 y 300 millones de filas con clavesUInt64yString, tanto únicas como duplicadas; la consulta mediana pasó a ser aproximadamente un 12% más rápida y usó alrededor de un 15% menos de memoria máxima, sin que ninguna consulta se volviera más lenta. Los joinsINNERsobre clavesUInt64obtuvieron la mayor mejora (mediana de aproximadamente un 21% más rápida con un 38% menos de memoria). #107189 (Harikrishnan Prabakaran). - Las join keys de una sola columna
LowCardinality(String)noNullableahora son compatibles de forma nativa en el hash join. #107264 (Nikita Taranov). - Se añadió el algoritmo
dpsubpara enumerar el orden de los joins (programación dinámica sobre subconjuntos), que proporciona planes de join óptimos con menor sobrecarga de optimización quedpsizey compatibilidad con joins no internos. #107351 (Fisnik Kastrati). - Se aceleró la carga de la filesystem cache al iniciar, codificando el tamaño de cada archivo de caché en su nombre (
<offset>_<size>), lo que evita unstatpor archivo. La carga de archivos de caché escritos por versiones anteriores sigue siendo compatible. #107415 (Alexey Milovidov). - Se mejoró el rendimiento de
arrayElementenArray(LowCardinality(String))y de las funcionesLIKEde map enMapcon claves o valoresLowCardinality(String), evitando la materialización innecesaria de cadenas. #107450 (Michael Jarrett). - Se evita convertir una agregación de un solo nivel en una agregación de dos niveles cuando el uso de memoria es bajo, mediante el seguimiento de la memoria del propio estado de agregación en lugar de la memoria de toda la consulta. #107490 (Hechem Selmi).
- Se aceleró el análisis de las consultas de agregación: la clave de caché para las estadísticas del tamaño de la tabla hash de agregación ahora se calcula a partir del plan de consulta en lugar de construir el AST completo de la consulta. #107643 (Dmitry Novik).
- Mejora varias veces el rendimiento de
INTERSECT ALLyEXCEPT ALL(el modo predeterminado deINTERSECTyEXCEPT) usando el valor de la fila como clave del multiconjunto, en lugar de aplicar SipHash a cada fila. #107649 (Raúl Marín). - Reconstruye los filtros de ROW POLICY sin mantener bloqueada la caché, lo que mejora la escalabilidad de las consultas durante
CREATE ROW POLICYyDROP ROW POLICYconcurrentes. #107917 (Azat Khuzhin). - Acelera las funciones
match,extract,extractAll,replaceRegexpOneyreplaceRegexpAllpara expresiones regulares simples compilándolas a código nativo con LLVM. Se controla con la nueva configuracióncompile_regular_expressions(habilitada de forma predeterminada); los patrones que quedan fuera del subconjunto admitido recurren de forma transparente al motor RE2. #108004 (Alexey Milovidov). - Se aceleró la descompresión de ZSTD en AArch64 (ARM) para columnas con pequeños desplazamientos de coincidencia, como las columnas de enteros de ancho fijo, mediante la vectorización con NEON de copias solapadas con desplazamientos cortos. Por ejemplo, la descompresión de una columna
UInt64es hasta ~2.3x más rápida en AWS Graviton 4. #108049 (Alexey Milovidov). - Usa la biblioteca
libdeflatepara la compresión y descompresión gzip/zlib/deflate, haciéndolas más rápidas (compresión ~1.15× con una mejor relación, descompresión ~1.4–1.5×) para datos.gz/HTTP/url/s3y el codec GZIP de Parquet. #108074 (Alexey Milovidov). - Se mejoró el rendimiento de las consultas de búsqueda de texto combinadas con un filtro de clave primaria. #108114 (Anton Popov).
- Usa estadísticas en tiempo de ejecución recopiladas durante la primera ejecución de una consulta para optimizar las siguientes: el algoritmo de join
hashpuede cambiar automáticamente aparallel_hashen función de las estadísticas recopiladas. #108125 (Hechem Selmi). El tamaño de los filtros en tiempo de ejecución de join se optimiza usando el tamaño de la tabla hash obtenido de las estadísticas en tiempo de ejecución del join, controlado por la nueva configuraciónjoin_runtime_filter_size_from_hash_table_stats. #108313 (Hechem Selmi). - Se mejoró la velocidad de descompresión de LZ4 para columnas de tamaño fijo y baja cardinalidad. #108175 (Nikita Taranov).
- Acelera las funciones
trimLeft/trimRight/trimBothpara espacios en blanco predeterminados (y sus aliasltrim/rtrim/trim): las filas consecutivas que no necesitan recorte se copian en un solo lote, y el escaneo de espacios por fila solo se ejecuta en las filas que realmente tienen un espacio inicial o final. #108177 (Groene AI). - Mejora el rendimiento de
replaceAllyreplaceRegexpAllcuando el patrón es un único carácter y el reemplazo es un único carácter (por ejemplo,replaceRegexpAll(s, ' ', '_')). Estos reemplazos ya no cambian la disposición de la cadena, por lo que ahora la columna se copia una sola vez y los bytes coincidentes se reescriben in situ, en lugar de ejecutar un bucle de búsqueda por coincidencia. #108178 (Groene AI). - Mejora el rendimiento de la función
pointInPolygoncon un polígono constante. La caché de polígonos preprocesados ahora se indexa por los argumentos constantes en bruto, por lo que un polígono constante se analiza solo una vez (en un fallo de caché) en lugar de volver a analizarse en cada bloque de entrada. #108184 (Groene AI). - Acelera el análisis de la representación canónica de fecha y hora
YYYY-MM-DD hh:mm:ssen modo best-effort (date_time_input_format = 'best_effort',cast_string_to_date_time_mode = 'best_effort'), que es el valor predeterminado. Esto corrige una regresión de rendimiento en el parsing introducida cuando esos valores predeterminados cambiaron debasicabest_effort. #108187 (Groene AI). - Evita mantener los contadores de selectividad de
system.predicate_statistics_logen la ruta de lectura deMergeTreecuando la funcionalidad está deshabilitada (predicate_statistics_sample_rate = 0, el valor predeterminado). Esto elimina una actualización atómica por gránulo y un popcount de filtroO(rows)en cada lectura, corrigiendo una regresión de rendimiento que se apreciaba sobre todo en AArch64. #108190 (Groene AI). - Acelera el análisis de números de coma flotante a partir de texto con
precise_float_parsing = 1, de modo que sea tan rápido como, o más rápido que, el parser predeterminado en casi todas las entradas. También actualiza la bibliotecafast_floatincluida a la versión 8.2.10. #108205 (Raúl Marín). - Usa la biblioteca
simdutfpara las funciones de codificación y decodificación base64, mejorando su rendimiento. #108333 (Konstantin Bogdanov). - Optimiza
DISTINCTpara claves costosas de alta cardinalidad. #108366 (Nihal Z. Miaji). - En compilaciones que no son de Linux (macOS y FreeBSD), jemalloc ya no purga las páginas sucias de forma agresiva (una syscall
madvisepor cadafree); ahora usa un hilo de purga en segundo plano con undirty_decay_msfinito, igual que en Linux. Esto acelera significativamente los workloads con alta rotación de asignaciones, como los CTE recursivos (~2x en un benchmark de CTE recursivo en macOS), con un impacto despreciable en RSS. #108430 (Alexey Milovidov). - Acelera la planificación de consultas en el analyzer para expresiones que hacen referencia al mismo alias
WITHo repiten la misma subexpresión muchas veces (por ejemplo, cadenasif/multiIfprofundamente anidadas), al no reconstruir las subexpresiones compartidas al construir el DAG de acciones. #108523 (Dmitry Novik). - Los Runtime Filters ahora se construyen sobre claves de igualdad incluso cuando la cláusula
ONtambién contiene predicados de no igualdad, lo que reduce el número de filas que entran en el hash join en joins que combinan condiciones de igualdad y no igualdad.LEFT ANTI JOINno se ve afectado. #108579 (Antonio Álvarez Caballero). - Habilita
-fno-math-errnoglobalmente en toda la base de código, lo que permite al compilador optimizar mejor las funciones matemáticas. #108628 (Nikita Taranov). - Reduce el umbral de precarga por software para las tablas hash de agregación y join de
4 * L2 cache sizeaL2 cache size, de modo que la precarga se habilite una vez que la tabla hash ya no quepa en L2. Esto corrige una regresión enGROUP BYyJOINsobre tablas hash de tamaño mediano (~1-8 MiB) en plataformas cuyo L2 reportado es grande (p. ej., AArch64 con un L2 de 2 MiB). #108655 (Groene AI). - Mejora el rendimiento de las funciones de ventana. Las consultas de ventana sobre tablas anchas que incluyen
SELECT *ahora usan mucha menos memoria y se ejecutan más rápido. Las agregaciones de ventana, incluidasquantile*,uniq*ygroupArray, son más rápidas conOVER ()yOVER (ORDER BY ... RANGE ...). La funcióncume_disttambién es más rápida, y las ventanas que usanPARTITION BYuORDER BYahora rinden mejor en columnas con muchos valores repetidos. #108688 (Nihal Z. Miaji). - Se aceleró el análisis de consultas para consultas con muchas cadenas
ANDde comparaciones, o con cadenasANDmuy grandes: la optimizaciónoptimize_and_compare_chainahora está limitada por un presupuesto de trabajo (nuevo ajusteoptimize_and_compare_chain_max_hash_work) en lugar de aplicar hash a una gran parte del árbol de consultas, y la resolución de lambda ya no vuelve a calcular los hashes del cuerpo de la lambda para su protección contra recursión. #108757 (Alexey Milovidov). - Se corrigió una regresión de rendimiento al leer columnas
JSON/Dynamiccon varios hilos: una búsqueda por valor del ajusteinput_format_binary_max_type_complexityprovocaba contención en el recuento de referencias del contexto de consulta compartido, lo que serializaba las lecturas en paralelo; ahora el valor del ajuste se almacena en caché por hilo. #108797 (Seva Potapov). - Se corrigió una regresión de rendimiento (introducida en #71781) por la que la lectura de muchos archivos pequeños desde almacenamiento de objetos mediante
s3y otras funciones de tabla dejó de hacer prefetch y pasó a lecturas síncronas, lo que ralentizaba considerablemente las lecturas monohilo y de baja concurrencia de gran cantidad de archivos diminutos. #108872 (Nikita Fomichev). El prefetch inicial de objetos pequeños ahora también se lanza cuando las lecturas desde almacenamiento de objetos pasan por la caché del sistema de archivos (filesystem_cache_name), por lo que las lecturas de muchos archivos pequeños (por ejemplo, la ingestión deS3Queue) con la caché habilitada ya no son síncronas ni están limitadas por la latencia. #109478 (Nikita Fomichev). - Analiza literales de arrays y tuplas profundamente anidados en tiempo lineal en lugar de cuadrático. #108892 (Alexey Milovidov).
- Reduce la sobrecarga derivada de la contención de bloqueos en el algoritmo de join
parallel_hash. #108938 (Hechem Selmi). - Acelera
estimateCompressionRatiopara columnas codificadas conT64al calcular analíticamente el tamaño comprimido en lugar de comprimir. #109054 (Raufs Dunamalijevs). - Elimina un cuello de botella monohilo en la fase de shuffle de los planes de consultas distribuidas: ahora cada stream ascendente distribuye sus filas de forma independiente por bucket de destino, en lugar de hacer pasar todo el flujo de datos por una única transformación. #109206 (Alexander Gololobov).
- Se redujo el uso de CPU en inactividad del Keeper server. #109255 (Michael Kolupaev).
- Acelera la serialización y las fusiones de columnas
JSONcuyos datos compartidos contienen muchas rutas dispersas: al aplanar los datos compartidos en columnas por ruta, se elimina el escaneo por fila de todas las columnas de ruta acumuladas, y los huecos se rellenan en bloque en lugar de insertar valores predeterminados celda por celda. #109341 (Groene AI). - Reduce la sobrecarga de CPU de la evaluación de expresiones en consultas con un gran número de columnas (p. ej., vector search sobre una columna
QBitcon un stride pequeño, donde cada vector se expande en cientos de sub-columnas de planos de bits que se pasan todas a una sola llamada*DistanceTransposed). #109380 (Alexey Milovidov). - Mejora el rendimiento de las funciones Geo de H3 (
h3ToGeoBoundary,h3ToGeo,h3CellAreaM2/h3CellAreaRads2,geoToH3) al calcular conjuntamente pares seno/coseno y eliminar llamadas trigonométricas redundantes en las transformadas de coordenadas. Los resultados no cambian (idénticos bit a bit). #109399 (Alexey Milovidov). - Mejora el rendimiento de las comparaciones (
<,>,<=,>=) de tipos enteros de gran tamaño (Int128,UInt128,Int256,UInt256y tipos basados en ellos, comoDecimal128) hasta 7 veces, así como de la conversión de enteros con signo aInt256(hasta 7 veces en datos con signos mixtos), al hacer que el código de comparación y extensión de signo no use ramas. #109474 (Manuel). - Se optimizó
uniqCombined(incluido el caso de aggregation sin claves) yuniqHLL12. #109794 (Anton Popov). #109831 (Anton Popov). - Las funciones
arraySortyarrayReverseSortson varias veces más rápidas con arrays numéricos (incluidosDecimalyDateTime64) cuando se llaman sin una lambda. #109832 (Manuel). - Acelera
addDays,addWeeks,subtractDaysysubtractWeekspara valoresDateTimeyDateTime64en zonas horarias con desplazamiento fijo (como UTC) utilizando una ruta rápida aritmética. #109836 (Manuel). - Se optimizó el análisis del índice de texto. #109886 (Anton Popov).
- Paraleliza el procesamiento de filas no emparejadas en el join algorithm
parallel_hashen dos casos más: cuando hay un filtro residual y cuando las join keys son pequeñas (mapa hash de un solo nivel). #110008 (Hechem Selmi). - Las respuestas de la interfaz web integrada (la UI de Play, dashboards y handlers de archivos estáticos) ahora se comprimen según el header
Accept-Encodingdel client, usando zstd, gzip, deflate, brotli, lz4, xz, snappy o bzip2. Por ejemplo, la página/playpasa de ~350 KB sin comprimir a menos de 120 KB con zstd, lo que reduce los tiempos de carga en connections lentas. Las respuestas ya comprimidas se dejan intactas y se emiteVary: Accept-Encodingpara una partición correcta de la CDN y la caché. #110108 (Sayantanu Dey). - Inserta un filtro por debajo de una función de ventana o de
LIMIT BYcuando sea seguro: un predicado escrito por encima de ellos (unWHEREexterno alrededor de la subconsulta, o una conjunción enQUALIFY) que haga referencia solo a las columnas dePARTITION BYde la ventana, o solo a las columnas clave deLIMIT BY(paraLIMIT n BYconn >= 1y sinOFFSET), ahora llega hasta el almacenamiento y permite la poda por clave primaria y por partición, los skip indexes y las proyecciones. Por ejemplo,SELECT ... row_number() OVER (PARTITION BY key ORDER BY ts) AS rn ... QUALIFY rn = 1 AND key = 'x'ya no lee ni aplica funciones de ventana a toda la tabla. #110114 (Groene AI). #110116 (Groene AI). - Con
join_use_nulls = 1, unWHEREque rechaza NULL y hace referencia a columnas de ambos lados de un join externo (p. ej.,WHERE l.k = 42 AND r.k = 42) ahora convierte el join enINNER(oLEFT/RIGHT) y aplica poda por clave primaria, igual que conjoin_use_nulls = 0. Anteriormente, esta conversión se omitía en este caso y ambas tablas se leían por completo. #110121 (Groene AI). - Las funciones con un único argumento
Nullableno constante ahora comparten el mapa de NULL del argumento con el resultado, en lugar de asignar y fusionar uno nuevo. #110151 (Manuel). - Evita una asignación en el heap por cada comprobación de hiperrectángulo en el análisis del índice de clave primaria, lo que acelera el filtrado de marcas entre un 5 y un 26 % según la forma de la consulta. #110153 (Manuel).
- Mejora el rendimiento de las funciones
arrayMinyarrayMaxsobre arrays numéricos en ~1,3-1,5x mediante una reducción vectorizada en lugar de un bucle de comparación elemento por elemento. #110163 (Manuel). - Vectoriza la descompresión del códec
Delta. La decodificación ahora es entre 1,5 y 5 veces más rápida para tipos de datos de 8/16/32 bits, lo que hace que los escaneos de columnas comprimidas conDeltasean hasta un 20 % más rápidos. #110189 (Manuel). - Acelera las funciones de búsqueda de cadenas (
like,position,match,countSubstrings,hasToken, etc.) sobre columnasEnumcon una aguja constante buscando solo los nombres de enum distintos y reasignando los resultados a cada fila, en lugar de buscar en todas las filas. #110325 (Alexey Milovidov). - Acelera las funciones de agregación
groupBitOr/groupBitAnd/groupBitXory la familia de varianza (varPop,varSamp,stddevPop,stddevSamp,skewPop,skewSamp,kurtPop,kurtSamp,covarPop,covarSamp,corr) con procesamiento por lotes vectorizado: hasta 4x más rápido con el combinador-Ifen condiciones impredecibles, y hasta 3x más rápido para la familia de varianza sin él. #110461 (Manuel). - Acelera el análisis del índice de texto (la etapa que selecciona qué gránulos leer): usa búsqueda por exclusión en lugar de iterar sobre todos los gránulos y evita crear un bitmap temporal para cada comprobación de rango. #110530 (Anton Popov).
- Tener en cuenta el tamaño en disco de las subcolumnas de
Mapen la optimización automática dePREWHERE. Esto corrige una regresión de rendimiento enPREWHEREintroducida en #99200. Parte de #110462. #110623 (Pavel Kruglov). - Acelerar el análisis de valores
UUIDa partir de texto (p. ej.,JSONExtractaLowCardinality(UUID),toUUID,CAST AS UUID) validando y convirtiendo dígitos hexadecimales en una sola pasada en lugar de dos. #110625 (Groene AI). - Mejorar significativamente el rendimiento de las funciones de agregación
timeSeries*ToGridmediante implementaciones más rápidas de ordenación y tablas hash. #110875 (Nikita Mikhaylov). - Las consultas como
SELECT * FROM t WHERE idahora usan omisión de índices en la columnaid. Cierra #89222. #89603 (Aditya Chopra). - Se añadió la configuración
query_plan_merge_expression_into_join(habilitada de forma predeterminada) para permitir la fusión de pasos de expresiones en pasos deJOINdurante la optimización de reordenamiento de joins. Esto permite reordenar joins entre subconsultas que encapsulan joins (p. ej., cuando unJOINestá dentro de una subconsulta con columnas calculadas), lo que da lugar a una mejor optimización de árboles de joins complejos. #98533 (Vladimir Cherkasov). - Optimizar cadenas de
ANDcon múltiples condiciones de comparación sobre la misma expresión: detectar contradicciones (p. ej.,a < 3 AND a > 5→false) y eliminar condiciones redundantes (p. ej.,a = 3 AND a < 5→a = 3). #99736 (Xiaozhe Yu). - Los Materialized CTEs referenciados desde múltiples ramas de una consulta
UNIONahora se materializan una sola vez y se comparten entre todas las ramas. Antes, cada rama recibía su propia copia del CTE, que se insertaba en línea y se evaluaba por separado. #102107 (Dmitry Novik). - Los hilos de
BackgroundSchedulePoolahora se crean de forma diferida y bajo demanda, en lugar de todos a la vez al iniciar el servidor. Una nueva configuración del servidor,background_schedule_pool_initial_size(valor predeterminado:16), controla cuántos workers se generan previamente; el grupo crece hastabackground_schedule_pool_sizecuando es necesario. Esto reduce el número de hilos inactivos en servidores con poca carga. Cierra #85265. #105066 (Alexey Milovidov). - Omitir cargas innecesarias de archivos de marcas para la serialización avanzada de datos compartidos del tipo
JSON. #107051 (Pavel Kruglov). - La caché de polígonos constantes preprocesados para la función
pointInPolygonahora se comparte entre consultas e hilos, y está limitada por la nueva configuración del servidorpoint_in_polygon_cache_size(valor predeterminado: 256 MiB;0desactiva la caché; puede cambiarse en tiempo de ejecución). Antes, la caché mantenía hastamax_threadscopias de cada polígono preprocesado, crecía sin límite con polígonos distintos y no se liberaba hasta reiniciar el servidor. Puede vaciarse conSYSTEM DROP POINT IN POLYGON CACHE, y el uso actual se informa ensystem.metricscomoPointInPolygonCacheBytes,PointInPolygonCacheCellsyPointInPolygonCacheSizeLimit. Cierra #106393. #107247 (Nihal Z. Miaji). - Keeper ya no mantiene el bloqueo interno de snapshots mientras serializa y escribe un snapshot en disco o mueve snapshots entre discos, por lo que las transferencias de snapshots a otros nodos y el procesamiento de Raft ya no se ven bloqueados por la creación local de snapshots. #107595 (Antonio Andelic).
- Paraleliza la expulsión en segundo plano de la caché del sistema de archivos (controlada por la configuración
keep_free_space_ratio). Se añadió una nueva configuración,keep_free_space_eviction_threads, para controlar el paralelismo, y se aumentó el valor predeterminado dekeep_free_space_remove_batchde100a250. #108147 (Kseniia Sumarokova). - Limita el número de partes preparadas simultáneamente en la copia de Azure blob storage de lectura y posterior escritura (usada por las copias de seguridad cuando la copia nativa no está disponible) a
max_inflight_parts_for_one_file, lo que evita un uso excesivo de memoria cuando se copian muchos archivos grandes en paralelo. #108232 (Smita Kulkarni). - Se habilitaron globalmente las tres cachés del índice de texto; antes, solo estaban habilitadas dentro de las consultas. Además, el tamaño de la caché de las posting lists ahora es cero, lo que en la práctica vuelve a desactivarla, porque las posting lists son grandes y almacenarlas en caché resulta demasiado costoso. #108274 (Robert Schulze).
- Añade compresión en memoria de marks en streaming durante la carga de marks para reducir el pico de uso de memoria. Cierra #108285. #108325 (Pavel Kruglov).
- La nueva configuración de la caché del sistema de archivos
reserve_granularity(valor predeterminado: 4 MiB) reserva espacio por adelantado en gránulos más grandes, lo que reduce la contención de bloqueos en la ruta crítica de reserva de espacio de la caché del sistema de archivos. #108369 (Kseniia Sumarokova). - Reduce la cantidad de memoria utilizada por los metadatos de la caché del sistema de archivos (por file segment y por clave). #108477 (Kseniia Sumarokova).
- Las consultas a
system.iceberg_historycon filtrosWHEREsobre las columnasdatabaseytableahora acceden solo a las bases de datos coincidentes, lo que puede ahorrar tiempo si tienes muchas bases de datos remotas no relacionadas en el servidor. #108492 (Den Kalantaevskii). - Se eliminó el bloqueo innecesario en la caché del sistema de archivos para reducir la contención de bloqueos. #108932 (Kseniia Sumarokova).
- Se redujo el uso de memoria en el manejo de metadatos de
BACKUPyRESTORE. Al abrir una copia de seguridad (paraRESTOREo como base de unBACKUPincremental), ahora se analizan los metadatos.backupcomo un flujo en lugar de cargarlos en un árbol de documentos XML en memoria, lo que en copias de seguridad grandes (especialmente incrementales) evita asignar un árbol DOM de varios gigabytes. #109107 (Julia Kartseva). Al finalizar unBACKUP, ya no se copia la información de todos los archivos a un vector temporal, lo que en copias de seguridad con millones de archivos podía costar transitoriamente varios gigabytes. #109861 (Julia Kartseva). Al escribir entrada de copia de seguridad, tampoco se vuelve a copiar la lista de metadatos de archivos del host actual. #111162 (Julia Kartseva). - Se redujo el consumo de memoria en el agregador. #109224 (Konstantin Vedernikov).
- Se añadió compatibilidad con la caché de condiciones de consulta para archivos
Parquetlocales leídos mediante el motor de tablaFile(antes compatible solo con almacenamiento de objetos y lagos de datos). #109247 (Alexey Milovidov). - Se redujo entre 2 y 2,5 veces el uso de memoria de la caché de cabeceras del índice de texto. En la caché caben más cabeceras de partes de datos (configuración
text_index_header_cache_size), lo que reduce las lecturas de disco en las consultas de búsqueda de texto. #109332 (Anton Popov). - Las funciones de distancia vectorial transpuestas
L2DistanceTransposed,cosineDistanceTransposedydotProductTransposedahora aplican la optimización de lectura parcial por plano de bits a columnasNullable(QBit), leyendo solo los planos de bits solicitados en lugar de la columna completa. #109358 (Alexey Milovidov). IS NOT DISTINCT FROMyIS TRUEahora usan índices de clave primaria y MinMax para podar gránulos, igual que=. Antes,k IS NOT DISTINCT FROM 42y(k = 42) IS TRUEescaneaban todos los gránulos. #110006 (Groene AI).- Las conexiones agrupadas ya no reciben ping antes de cada uso. Esto elimina un viaje de ida y vuelta
Ping-Pongque se añadía a cada conexión reutilizada, lo que reduce la latencia de las consultas distribuidas y declickhouse-benchmark. Una conexión agrupada obsoleta se detecta con unpollde tiempo de espera cero (una comprobación sin bloqueo que no añade ningún viaje de ida y vuelta) y se recupera reconectando. #110068 (Alexey Milovidov). - Se corrigieron reconexiones espurias de conexiones HTTP keep-alive agrupadas sobre TLS (HTTPS, S3). La comprobación de conexiones obsoletas usaba
pollsobre el socket, lo que informaba erróneamente de que una conexión segura activa que transportaba un registro TLS posterior al handshake aún no leído (un ticket de sesión oKeyUpdate) estaba cerrada; ahora usaMSG_PEEKsin bloqueo en sockets sin TLS ySSL_peek/SSL_has_pendingen sockets TLS, lo que también detecta correctamente un cierre ordenado de TLS y un registro TLS que solo ha llegado de forma parcial. #110402 (Alexey Milovidov). - Las consultas aceleradas mediante filtrado dinámico TopK (
ORDER BY ... LIMIT k) ahora aprovechan mejor la caché de condiciones de consulta: la caché se rellena incluso cuando se aplica lazy materialization a la consulta, y esas consultas pueden reutilizar entradas escritas previamente por una consulta normal que tuviera el mismo predicadoWHERE. #110507 (Shankar Iyer). - Un patrón
LIKE/NOT LIKEsin comodines (%,_) ahora usa un rango exacto de clave primaria, por lo que lee el mismo número de gránulos que el predicado equivalente=/!=en lugar de un rango de prefijo más amplio. #107077 (Groene AI). - Se corrigió la contención redundante del bloqueo de file segment (una regresión de rendimiento introducida en la versión 26.1) al leer datos a través de la caché del sistema de archivos. #109577 (Kseniia Sumarokova).
- Se corrigió que los skip indexes definidos en subcolumnas de
Tupleno se utilizaran cuando se accede al campo mediantetupleElement(t, 'name'),tupleElement(t, N)ot.N, mientras que la tupla completa también se lee en la misma consulta (p. ej.,SELECT *). Todas estas formas ahora descartan gránulos de la misma manera que el acceso a la subcolumna con nombret.name. #110056 (Groene AI). - Se corrigieron las consultas lentas con
ORDER BY ... LIMITen tablasDistributedcuandoprefer_localhost_replicaselecciona una réplica local: se eliminó el límite preliminar del plan de la partición local, lo que impedía la materialización diferida y el filtrado dinámico top-K. #110136 (Michael Jarrett). - Se corrigió que el índice de texto no se usara para el operador
ILIKEcuando el índice se define sobre una expresión en lugar de una columna simple (por ejemplo,assumeNotNull(col)con un preprocessorlower(...)): esas consultas leían todos los gránulos en lugar de usar el índice. Esto cierra #110350. #110595 (Elmi Ahmadov). - Se redujo la contención de bloqueos en la caché del sistema de archivos: las consultas que leen desde la caché ya no se bloquean en el bloqueo de la cola de prioridad al actualizar la prioridad LRU de una entrada. #109065 (Antonio Andelic).
- Las consulta sobre índice de texto que usan una expresión de
postprocessorsolo para filtrado (por ejemplo,if(..., '', token)) ahora descartan por adelantado los tokens vacíos en lugar de materializarlos fila por fila, lo que mejora el rendimiento. #109049 (Elmi Ahmadov). - Se redujo la contención de bloqueos en las colas del registro del sistema, lo que reduce la latencia de cola de las consultas en clusters con mucha carga. #110539 (Sean Haynes).
- Se mejoró hasta 1,5 veces el rendimiento de las funciones de búsqueda de subcadenas (
position,countSubstrings,multiSearch*,replaceAll,replaceOney sus variantes que no distinguen entre mayúsculas y minúsculas y UTF-8) con una aguja no constante, mediante el uso de buscadores de cadenas basados en SIMD en la ruta por fila en lugar de una implementación ingenua. #110580 (Raúl Marín). - La materialización diferida ahora se aplica a consultas
ReplacingMergeTreeconFINAL, un filtro y unLIMITpequeño incluso sinORDER BY. Las columnas que no son necesarias para el filtro ni para el mergeFINALse obtienen solo para las filas que permanecen después del límite, lo que hace que estas consultas sean mucho más rápidas cuando seleccionan columnas anchas con un filtro selectivo. Controlado porquery_plan_optimize_lazy_materializationyquery_plan_max_limit_for_lazy_materialization. #110722 (Nikolai Kochetov). - Se mejoró el rendimiento de async insert cuando la deduplicación está habilitada y un vaciado se divide entre múltiples particiones: ClickHouse ahora reutiliza los hashes de deduplicación calculados entre particiones en lugar de recalcularlos para cada una. #111150 (Valery Petrov).
Mejora
- Se añadió la configuración
input_format_csv_missing_nullable_as_empty_string(deshabilitada de forma predeterminada). Cuando está habilitada, un valor ausente de una columnaNullable(String)en la entrada CSV se interpreta como unStringvacío en lugar deNULL, independientemente deinput_format_csv_empty_as_default. #58225 (kevinyhzou). #107577 (Alexey Milovidov). - Las funciones
toDateOrNull,toDateTimeOrNullytoDateTime64OrNullahora aceptan argumentos enteros de todos los tipos enteros nativos (interpretados igual que entoDate,toDateTimeytoDateTime64, con un argumento opcional de timezone) y devuelvenNULLpara los valores que quedan fuera del rango del tipo de resultado. Por ejemplo,toDateTimeOrNull(1583851242, 'Asia/Shanghai')devuelve2020-03-10 22:40:42ytoDateTimeOrNull(4294967296)devuelveNULL. #79791 (Jitendra). - Se añadió una columna
is_wildcarda la tablasystem.grantsque indica si un grant usa coincidencia de prefijo con comodín (por ejemplo,GRANT SELECT ON db*.*). Antes, los grants con comodín y los exactos sobre el mismo nombre no se podían distinguir ensystem.grants. Cierra #92835. #98577 (DQ). - Se permite la compresión Snappy en la interfaz HTTP (
Accept-Encoding: snappy) y se añade la configuraciónsnappy_modepara elegir entre el formato de bloques de Hadoop Snappy y el formato de framing de Snappy para I/O genérico con Snappy defile/url. #100752 (Alexey Milovidov). - Se admite compatibilidad con el analyzer anterior mediante la configuración
analyzer_compatibility_allow_non_aggregate_in_having. Si está habilitada, las conjunciones no agregadas se mueven deHAVINGaWHERE. #104232 (Dmitry Novik). - Se añadió una nueva configuración del servidor
memory_worker_rss_speculative_reserve_ratio(valor predeterminado:1.0) que hace que el memory tracker global reserve memoria de forma especulativa por encima del RSS observado cuando el crecimiento del RSS supera el seguimiento contable del tracker entre muestras. Con esto, las allocations recibenMEMORY_LIMIT_EXCEEDEDantes y es menos probable que el OOM-killer del kernel se active primero. Establezca la proporción en0para deshabilitar esta especulación. #104976 (Alexey Milovidov). - Se añadieron métricas de Prometheus opcionales para la actividad de eviction de la filesystem cache (
filesystem_cache_evictions_total,filesystem_cache_evicted_bytes_total,filesystem_cache_evicted_segment_hits,filesystem_cache_evicted_segment_size_bytesy sus variantes por usuario etiquetadas conuser_id), expuestas por caché a través desystem.dimensional_metrics,system.histogram_metricsy el Prometheus endpoint. Están controladas por las configuraciones del cache diskexpose_prometheus_eviction_metricsyexpose_prometheus_eviction_metrics_per_user(ambas desactivadas de forma predeterminada), que pueden activarse o desactivarse en runtime medianteSYSTEM RELOAD CONFIG. #105020 (Sacheendra Talluri). EXPLAIN [PLAN] actions=1, compact=1, pretty=1pasa a ser el valor predeterminado. #105036 (Kirill Kopnev).- Se actualizó
delta-kernel-rs(la biblioteca detrás de la integraciónDeltaLake) a la versión 0.23.0. #105861 (Smita Kulkarni). - Añade los comandos
duywcaclickhouse-disks. Imprimen, respectivamente, el tamaño total en bytes de un archivo o directorio determinado, y muestran la cantidad de bytes, líneas y palabras de un archivo. #106268 (Asya Shneerson). - Se añadió una nueva métrica asíncrona,
UntrackedMemory(visible ensystem.asynchronous_metrics), que informa de la memoria ya asignada por los hilos pero aún no contabilizada en el contador global de seguimiento de memoria: cada hilo acumula pequeñas asignaciones localmente y las reporta en bloque. Esto ayuda a explicar las discrepancias entreMemoryTrackingy el uso real de memoria del proceso. Los mensajes de errorMEMORY_LIMIT_EXCEEDEDahora también incluyen la cantidad de memoria no rastreada, lo que facilita entender por qué una consulta o el servidor alcanzó su límite de memoria. #106386 (Miсhael Stetsyuk). - Actualiza ClickStack (la interfaz de observabilidad) a la versión 2.28.0. #106406 (Aaron Knudtson).
- Se añadió compatibilidad con
BFloat16endotProducty se mejoró su rendimiento agrupando en lotes la ruta SIMD. #106569 (Nikita Taranov). - Los ajustes
max_named_collection_num_to_throw,max_table_num_to_throw,max_replicated_table_num_to_throw,max_view_num_to_throw,max_dictionary_num_to_throwymax_database_num_to_throwahora pueden modificarse sin reiniciar el servidor. #106821 (Maxim Orlovsky). - Se admiten los valores
REDUCED_REDUNDANCY,STANDARD_IA,ONEZONE_IA,GLACIER_IRyEXPRESS_ONEZONE(además deSTANDARDeINTELLIGENT_TIERING) para el ajustes3_storage_class_name. #107251 (Aditya Kumar). - Se añadió el ajuste de creación
materialized_postgresql_use_extended_date_and_time_typespara el database engineMaterializedPostgreSQL. De forma predeterminada (habilitado), las columnasdate/timestampde PostgreSQL se infieren comoDate32/DateTime64; si se establece en0al ejecutarCREATE DATABASE, se infieren los tipos más restringidosDate/DateTime. El ajuste no se aplica al table engineMaterializedPostgreSQL. #107428 (Alexey Milovidov). - El cuantificador
SOME/ALLde Array (expr OP SOME(array)/expr OP ALL(array)) ahora también admite los predicates de comparación por palabra claveIS DISTINCT FROMyIS NOT DISTINCT FROM, así como los predicates de búsqueda en cadenasLIKE,ILIKE,NOT LIKE,NOT ILIKEyREGEXP, reescritos comoarrayExists/arrayAll. #107454 (Alexey Milovidov). - Se corrigió una fuga de memoria que se producía cuando fallaba la apertura de una base de datos SQLite (por ejemplo, cuando se proporciona a la función de tabla
sqliteo al database engineSQLiteuna ruta que no puede abrirse). #107807 (Alexey Milovidov). - En la interfaz web (
play.html), la indicación del atajo de ejecución ahora muestraCmd+Enteren Mac yCtrl+Enteren otras plataformas, en lugar de mostrar siempreCtrl/Cmd+Enter; además, la parte, +Shift to run allde la indicación solo se muestra cuando hay varias consultas. #107817 (Alexey Milovidov). #108957 (Alexey Milovidov). - El motor de tabla
Aliasahora admite lecturas con réplicas paralelas cuando la tabla de destino es de la familiaMergeTree. #107830 (Kai Zhu). - Se añadió el tipo de estadísticas de columna
uniq_v2, una alternativa ligera a las estadísticasuniq, basada en el sketchuniqCombined64. #107863 (Han Fei). Además, se marcó como obsoleto el tipo de estadísticas de columnaminmaxy se cambió el valor predeterminado deauto_statistics_typesabasic, uniq_v2. #108680 (Han Fei). - Las funciones de IA (
aiGenerate,aiEmbed,aiClassify,aiExtract,aiTranslate) ahora reintentan fallos transitorios de red (restablecimientos de conexión, fallos de conexión TLS, timeouts y direcciones inaccesibles) cuando se estableceai_function_max_retries, igualando el comportamiento de reintento de la table functionurl. Antes, solo se reintentaban las respuestas de error HTTP del lado del proveedor. #107927 (Alexey Milovidov). INSERTen una tablaMergeTreeahora respeta la cancelación de consultas ymax_execution_timeal escribir muchas partes, en lugar de poder seguir ejecutándose durante mucho tiempo después de haber sido cancelada. #107929 (Michael Kolupaev).- En la interfaz web (
play.html), el icono del Terminal web ahora puede abrirse en una nueva pestaña del navegador con un clic del botón central o con Ctrl/Cmd/Shift+clic. #108006 (Alexey Milovidov). - La generación de SQL con IA en el cliente ya no envía el parámetro
temperature, a menos que se establezca explícitamente medianteai.temperatureen la configuración. Esto corrige la generación de SQL con IA para modelos que rechazan el parámetrotemperature. #108014 (Alexey Milovidov). - Se añadieron la tabla
system.masking_policiesy la introspecciónSHOW MASKING POLICIESa las compilaciones open-source. Las políticas de enmascaramiento en sí siguen siendo una funcionalidad de ClickHouse Cloud, por lo que la tabla está vacía en las compilaciones open-source, pero las consultas de introspección ya no fallan con un error. #108030 (Alexey Milovidov). - El consumer de Kafka basado en Keeper ahora aleatoriza el orden en que adquiere bloqueos temporales de partición entre réplicas, lo que mejora el reparto equitativo de las particiones y reduce la contención de bloqueos. Antes, la aleatorización prevista no tenía ningún efecto. #108033 (Alexey Milovidov).
- Se añadió autocompletado a la interfaz web (
play.html), basado ensystem.completionsy en el analizador léxico SQL basado en WASM. #108059 (Alexey Milovidov). clickhouse-clientyclickhouse-localahora muestran sugerencias de autocompletado a medida que escribes (texto “fantasma” en línea) con la mejor coincidencia cuando el cursor está al final de la entrada. Las sugerencias más relevantes (las usadas recientemente y los identificadores ya presentes en la consulta) aparecen primero. Navega con Arriba/Abajo (o Ctrl-Arriba/Ctrl-Abajo); acepta una sugerencia única o la seleccionada con Tab o Flecha derecha, y acepta la sugerencia seleccionada con Enter; Tab también abre la lista clásica de autocompletado. Se controla con la nueva opción--hints(activada de forma predeterminada; requiere--highlight). #108070 (Alexey Milovidov).- Se admite la función
lengthpara el tipo de datoQBit: devuelve la dimensión del vector como una constante. #108071 (Alexey Milovidov). También se admiteCASTdeQBitaArray, reconstruyendo el vector original: la inversa de la conversión existente deArrayaQBit. #108072 (Alexey Milovidov). - Las solicitudes a catálogos REST de lago de datos (como OneLake) ahora incluyen un encabezado
User-Agentde ClickHouse. #108117 (Konstantin Vedernikov). arrayFoldahora respeta la cancelación de consultas ymax_execution_time. Antes, un fold sobre un array muy largo se ejecutaba por completo dentro de una sola llamada a función y no podía interrumpirse, por lo queKILL QUERYy los límites de tiempo se ignoraban hasta que terminaba. #108192 (Groene AI).MVTEncodeGeomahora ajusta la geometría a la cuadrícula de píxeles enteros antes de recortarla y recorta polígonos con la bibliotecawagyu, de modo que la salida recortada sea válida (se reparan los anillos autointersecados) y quede alineada con los bordes, igual que en PostGISST_AsMVTGeom. #108248 (Saarthak Gupta).- Se añadieron
ProfileEventsde preejecución de consultas por fase:QueryParseMicroseconds,QueryAnalysisMicroseconds,QueryPlanBuildMicrosecondsyQueryPipelineBuildMicroseconds. Muestran dónde se invierte el tiempo antes de la ejecución de la consulta (análisis sintáctico, análisis, creación del plan de consulta y creación del pipeline) y están disponibles ensystem.query_logysystem.events. #108282 (Jordi Villar). - Las operaciones
ALTER TABLEque producirían metadatos de tabla que superaranmax_query_sizeahora se rechazan de antemano, lo que evita que las tablas queden imposibles de cargar para componentes como la distribución DDL y la recuperación de réplicas. #108283 (Andrew Kravchuk). - Se añadieron las columnas
settingsyengine_settingsasystem.backupsysystem.backup_log.settingsexpone los ajustes específicos de backup/restore solicitados para una operación (p. ej.,allow_s3_native_copy,deduplicate_files,structure_only), yengine_settingsexpone los ajustes efectivamente usados por el lector y el escritor del engine de backup (p. ej., los ajustes de solicitudes a S3, comoallow_native_copy, que pueden diferir de lo solicitado tras fusionar la configuración del endpoint). Esto permite ver con qué ajustes se ejecutó realmente una operaciónBACKUP/RESTORE. #108334 (Julia Kartseva). - Se añadió una columna
sourceasystem.documentationque contiene la ruta del archivo fuente en el que se define la documentación de cada entidad. La tabla ahora también documenta códecs de compresión, eventos de perfil, métricas actuales, métricas asíncronas y las propias tablas del sistema (con sus columnas), y la documentación de los ajustes ahora incluye su tipo y valor predeterminado. #108346 (Alexey Milovidov). Un valor predeterminado vacío para un ajuste ahora se representa como cadena vacía en lugar de backticks vacíos. #108708 (Alexey Milovidov). - Se añadieron lecturas asíncronas desde réplicas remotas (
async_socket_for_remote) en macOS mediante la implementación, sobrekqueue, de primitivas de sondeo basadas en epoll. Esto permite que las consultas distribuidas lean shards en paralelo en macOS en lugar de hacerlo en serie. #108403 (Raúl Marín). - Se añadió compatibilidad con
BFloat16en funciones matemáticas binarias. #108442 (Zhang Yifan). MergeTreeahora puede leer un flujo comprimido cuyos bloques usan distintos códecs. Este es el requisito previo del lado de la lectura para la selección adaptativa de códecs (#105404). #108592 (Raufs Dunamalijevs).- El valor automático de
max_threadsy ajustes similares ahora se muestra ensystem.settingscomoauto(8)en lugar de'auto(8)'; las comillas simples que lo rodeaban eran un artefacto heredado incrustado en el valor. Se conserva la compatibilidad entre versiones: la forma heredada entrecomillada sigue aceptándose al interpretar ajustes recibidos de servidores más antiguos. #108657 (Alexey Milovidov). - Varias mejoras de usabilidad para la interfaz web de
/schema: cargar el esquema al pulsar Enter, barras de desplazamiento adaptadas al tema, nombres de tabla legibles, agrupación coherente por base de datos de tablas independientes, sin selección de texto al arrastrar y un formulario de autenticación estiloplay(Credential Management API, credenciales proporcionadas por URL con eliminación de contraseñas y validación de credenciales en tiempo real). #108724 (Alexey Milovidov). - El modo diferido de aplicación de posting lists del índice de texto ya no es experimental y puede seleccionarse con
text_index_posting_list_apply_mode = 'lazy'sinallow_experimental_text_index_lazy_apply. El ajuste de umbral de densidad pasó a llamarse detext_index_density_thresholdatext_index_lazy_intersection_density_threshold. #108814 (Anton Popov). - Se añadió un nuevo tipo de catálogo
delta_sharingaDataLakeCatalogpara el endpoint REST de Iceberg de Databricks Delta Sharing, cuyos espacios de nombres son planos y que ignora el filtro de listadoparent. Úselo en lugar decatalog_type = 'rest'para esos endpoints, donde de otro modoSHOW TABLESse quedaría bloqueado. #108865 (Seva Potapov). - Se añadió una nueva opción de
clickhouse-client/clickhouse-local,--echo-query-separator, que imprime un separador personalizado antes de la consulta reformateada que se muestra como eco, lo que facilita distinguir la consulta escrita de su eco reformateado. Deshabilitada de forma predeterminada. #108888 (David Meng). - Mejoras en el panel de bases de datos de la Web UI: el número de tablas se muestra entre paréntesis junto al nombre de la base de datos cuando está expandida. #108891 (Alexey Milovidov). Un botón de actualización junto a una base de datos expandida recarga su lista de tablas. #108958 (Alexey Milovidov). Al volver a abrir el panel, se restauran las bases de datos que estaban expandidas anteriormente. #108964 (Alexey Milovidov).
- Permite calcular el beneficio combinado de los skip indexes en
EXPLAIN WHATIF: muestra la proporción de datos correspondiente a la intersección de todos los índices hipotéticos adecuados existentes. #108934 (Yarik Briukhovetskyi). - Se corrigió el restablecimiento de la posición de desplazamiento horizontal de la tabla de resultados en la Web UI al hacer clic en un enlace dentro de una celda y volver a la página. #108941 (Alexey Milovidov).
- El database engine, el table engine y la table function de
MySQLahora asignan los tipos de columna espaciales de MySQL (LINESTRING,POLYGON,MULTILINESTRING,MULTIPOLYGONy el tipo genéricoGEOMETRY) a los tipos geométricos correspondientes de ClickHouse en lugar deString. Esto se controla mediante la nueva opcióngeometryde la configuraciónmysql_datatypes_support_level, habilitada de forma predeterminada.POINTse sigue convirtiendo siempre aPoint. La columna genéricaGEOMETRYse asigna al tipo genéricoGeometry; leer un valor cuyo subtipo no tiene equivalente en ClickHouse (MULTIPOINT,GEOMETRYCOLLECTION) lanza una excepción en tiempo de lectura. #108944 (Alexey Milovidov). - Web UI (
play.html): navegación completa por teclado — navegación con las teclas de flecha en el panel de bases de datos y la tabla de resultados, acceso por teclado a los botones de la barra de herramientas, al selector de tema y al menú de descarga, y contornos de enfoque visibles. #108972 (Alexey Milovidov). - HTTP interface: cuando se proporcionan credenciales tanto mediante URL parameters (
user/password) como mediante una cabeceraAuthorization, los URL parameters ahora tienen prioridad en lugar de que se rechace la solicitud. Esto corrige el fallo al descargar resultados desde la Web UI (play.html) conAUTHENTICATION_FAILED(error 516) cuando el navegador ha recordado credenciales Basic. #108980 (Alexey Milovidov). - Se restaura
show_data_lake_catalogs_in_system_tablescomo la configuración que controla únicamente la visibilidad deDataLakeCatalogensystem.tables,system.columnsysystem.completions. Se añadióshow_remote_databases_in_system_tables, habilitada de forma predeterminada, para permitir a los usuarios ocultar por separado las bases de datosMySQLyPostgreSQLde esas system tables. #109082 (Pablo Marcos). - Se usa de forma predeterminada el algoritmo preciso de parsing de Float (el valor representable más cercano) y se aplica la configuración
precise_float_parsinga los input formats (CSV,TSV,JSON,VALUES, …) y a los literals numéricos, no solo atoFloat*/CAST. Establezcaprecise_float_parsing = 0para recuperar el comportamiento anterior, más rápido en algunos casos pero menos preciso. Cierra #60146. Cierra #74647. Cierra #68914. #109086 (Raúl Marín). - Una consulta con un solo CTE ahora se formatea con el mismo salto de línea y la misma sangría que una consulta con varios CTE. Antes,
WITH a AS (...)mantenía el CTE en la misma línea queWITH, mientras que con dos o más CTE,WITHiba en su propia línea y cada CTE aparecía con sangría. #109092 (Groene AI). - Web UI: cuando la finalización resaltada coincide con la palabra ya escrita, o con la misma palabra pero con distinto uso de mayúsculas/minúsculas (p. ej.,
HASHsugerido para unhashya escrito), al pulsar Right/Tab/Enter la palabra ya no se reescribe ni la autocompletación intercepta la tecla; la tecla mueve el cursor o inserta un salto de línea, como se espera. #109106 (Alexey Milovidov). #109384 (Alexey Milovidov). - Se añadió a la Web UI (
play.html) el resaltado arcoíris de paréntesis, el resaltado de corchetes coincidentes, el resaltado de identificadores coincidentes y el resaltado de grupos de dígitos, en consonancia conclickhouse-client. #109108 (Alexey Milovidov). - En la Web UI,
TabyShift+Tabahora aplican y quitan una sangría de 4 espacios a las líneas seleccionadas. #109110 (Alexey Milovidov). - Web UI: resalta la posición de un error de sintaxis en el editor de consultas con un fondo rojo. El resaltado se borra en cuanto el usuario vuelve a poner el foco en el editor. #109112 (Alexey Milovidov).
clickhouse-compressor --staty la detección del códec predeterminado para partes antiguas ahora informan los encabezados de bloque corruptos como corrupción, en lugar de como un engañoso error de fin de archivo. #109157 (Raufs Dunamalijevs).- ClickHouse Keeper ahora respeta la configuración
os_collect_psi_metricsy omite la recopilación de métricas PSI cuando está deshabilitada. #109179 (Maxim Orlovsky). - En la Web UI, cuando se muestran pestañas de consultas, los parámetros de conexión (host, user, password) se ocultan tras un icono de llave en la esquina superior derecha y se muestran en un menú desplegable a demanda. #109243 (Alexey Milovidov).
- Web UI: muestra un resultado de un solo valor (una fila, una columna, p. ej.,
SHOW CREATE TABLE) con altura completa en lugar de limitarlo a tres líneas. #109245 (Alexey Milovidov). - En la Web UI, al hacer clic en una tabla del panel de bases de datos con el botón central del ratón, con Shift o con el modificador de nueva pestaña de la plataforma (Cmd en macOS, Ctrl en otros sistemas), ahora se abre su consulta en una nueva pestaña de la Web UI. #109246 (Alexey Milovidov).
- La caché de condiciones de consulta para archivos
Parquetremotos (almacenamiento de objetos) ahora usa también el ETag, además de la ruta, como clave, para que sobrescribir un objeto en el mismo lugar ya no sirva resultados obsoletos en caché. #109310 (Alexey Milovidov). - En la Web UI, las cadenas vacías y los NULL ya no se colorean en el modo de coloreado categórico. #109342 (Alexey Milovidov).
- Web UI: al hacer clic en el icono de una tabla en el panel de la base de datos, ahora se muestra la lista de sus columnas, con iconos de tipo, una barra de tamaño proporcional al tamaño comprimido y un tooltip con el tamaño comprimido/sin comprimir y la relación de compresión. #109346 (Alexey Milovidov).
- Web UI: mostrar el título completo de la pestaña en un tooltip al pasar el cursor cuando esté truncado. #109354 (Alexey Milovidov).
- En la Web UI, al hacer clic con el botón central en el título de una pestaña (o Ctrl/Shift/Cmd+clic sobre él), ahora se duplica la pestaña. #109357 (Alexey Milovidov).
- Web UI: redimensionar uniformemente las áreas de progreso final y estadísticas de la consulta para que no se partan de forma extraña cuando la ventana del navegador sea estrecha. #109363 (Alexey Milovidov).
- Web UI: al seleccionar una base de datos en el panel de bases de datos, ahora se usa como base de datos predeterminada para las consultas ejecutadas desde el editor. #109372 (Alexey Milovidov).
- Compatibilidad con
reinterpretde unArrayde elementos de tamaño fijo como unString, el inverso delreinterpretexistente de unString/FixedStringcomo unArray. #109383 (Alexey Milovidov). - En la Web UI, no mostrar los controles de alternancia de codificación por colores por columna cuando el resultado no tenga más de una sola fila. #109385 (Alexey Milovidov).
- Permitir
CASTentre tiposQBitque difieran en el tipo de elemento y/o el stride, siempre que la dimensión siga siendo la misma (por ejemplo,CAST(x AS QBit(Float64, N))desde unQBit(Float32, N)). Los cambios solo de stride no tienen pérdida; los cambios de tipo de elemento siguen la semántica de conversión correspondiente deArray(por ejemplo, deFloat32aBFloat16puede haber pérdida de precisión, yaccurateCast/accurateCastOrNullrechazan las filas que no pueden representarse exactamente). #109387 (Alexey Milovidov). - Las funciones
quantizeBFloat16ToInt8ydequantizeInt8ToBFloat16ahora también aceptan argumentosArrayyQBit, aplicando el codec Lloyd-Max a todo el vector (devolviendoArray/QBitdel tipo de elemento correspondiente), además de las sobrecargas escalares existentes. #109398 (Alexey Milovidov). - Web UI: el enlace a la documentación ahora incluye el nombre del usuario actual en la URL. #109419 (Alexey Milovidov).
- Compatibilidad con
arraySum,arrayAvgyarrayProductpara arrays deBFloat16. #109420 (Alexey Milovidov). - El especificador de formato de estilo MySQL
%fenparseDateTime/parseDateTime64(y sus variantesOrZero/OrNull) ahora acepta entre 1 y 6 dígitos fraccionarios, interpretados como microsegundos alineados a la izquierda, como enSTR_TO_DATEde MySQL, en lugar de exigir exactamente 6. También se corrigieron tablasPrettyCompactdesalineadas en los ejemplos de la documentación de funciones integradas. #109421 (Alexey Milovidov). - Web UI: las pestañas de consulta ahora son persistentes — cada pestaña conserva su resultado renderizado (incluidas imágenes y gráficos) y su consulta en ejecución cuando cambias a otra y vuelves, y las consultas largas siguen ejecutándose en segundo plano. Los títulos de las pestañas muestran un spinner, una barra de progreso y una marca de verificación de finalización para su consulta. #109425 (Alexey Milovidov).
- Web UI: ahora se muestra correctamente un error cuando una consulta falla después de que parte de su resultado ya se haya transmitido, en lugar de mostrar un
SyntaxError: Unexpected end of JSON inputdel lado del client (o, conhttp_write_exception_in_output_format, marcar la consulta fallida como exitosa). #109430 (Alexey Milovidov). - Se añadieron columnas fijadas a la Web UI: una columna puede fijarse desde su encabezado para que permanezca visible (pegada al borde) mientras la tabla de resultados se desplaza horizontalmente. #109439 (Alexey Milovidov).
- En el Advanced dashboard (
/dashboard), ahora se pueden añadir directamente charts para métricas específicas por el metric name tal como aparece en el Source Code o en la documentación, lo que facilita añadir varias métricas durante las sesiones de debugging. #109449 (Mikhail Artemenko). - Web UI: se corrigió el cierre del menú desplegable de configuración de la connection al seleccionar texto con el ratón y arrastrar más allá de su borde. #109451 (Alexey Milovidov).
- Web UI: al pasar el cursor sobre el encabezado de una columna de la tabla de resultados, ahora se muestra el column name completo y el Type en una información sobre herramientas, para que los encabezados truncados puedan leerse completos. #109463 (Alexey Milovidov). Se corrigió que los títulos de los encabezados de columna se recortaran con puntos suspensivos incluso cuando la columna era lo bastante ancha para mostrar el título completo. #110397 (Alexey Milovidov).
- Compatibilidad con diccionarios SSD cache (layout
SSD_CACHE) y el table engineFileLogen builds de MacOS. #109493 (Raúl Marín). - Web UI: no restaurar pestañas con consultas vacías al abrir la página. #109529 (Alexey Milovidov).
- Se corrigieron las sugerencias de autocompletado ilegibles mientras se escribe y los colores brillantes en el client interactivo en terminales cuyo
TERMno contiene256(p. ej., Ghostty, kitty, Alacritty, foot): ahora los colores brillantes se emiten incondicionalmente como códigos de color brillante aixterm en lugar de recurrir a negrita + color oscuro, que los terminales modernos renderizan como un color oscuro y difícil de leer sobre fondos oscuros. #109622 (Alasdair Brown). - Se habilitan las arenas por CPU de jemalloc y el perfilado de asignaciones en builds de MacOS. #109684 (Raúl Marín).
- Permitir modificar algunos ajustes de authentication de una database de Data Lake Catalog
OneLakeconALTER DATABASE ... MODIFY SETTING. #110019 (alesapin). - El engine
Hiveahora lee los metadata de archivosORC(índices mín./máx., recuentos de filas) con el lectorORCnativo de ClickHouse en lugar del adapterORCde Apache Arrow. #110086 (Alexey Milovidov). - Se redujo el tamaño del binario en ~10.5 MB al ejecutar operaciones aritméticas y de comparación sobre pares de tipos mixtos poco usados (
Decimalfrente a enteros de distinto ancho, y pares que involucranInt128/UInt128/Int256/UInt256) mediante la conversión a un tipo común, en lugar de usar un kernel compilado dedicado para cada combinación de tipos. Los pares del mismo tipo, los pares de uso habitual y las operacionesplus/minus/multiplylimitadas por memoria conservan sus kernels dedicados; los resultados, los tipos de resultado y los casos excepcionales no cambian. #110131 (Alexey Milovidov). - Una subquery en el lado derecho de
INcuya única columna es un array con una dimensión más que el argumento de la izquierda ahora se interpreta como el conjunto de elementos del array (como un literal de array o una función que devuelve un array), en lugar de fallar con un confuso error de incompatibilidad de tipos. Por ejemplo,x IN (SELECT groupArray(x) FROM ...)ahora funciona. #110169 (Alexey Milovidov). - La lectura desde un table engine
SQLiteo una table functionsqliteya no consume activamente un CPU core completo cuando la base de datos SQLite está bloqueada por otra conexión. Ahora la lectura queda inactiva mientras espera el bloqueo y sigue pudiéndose cancelar. #110248 (Groene AI). - Redondea a tres dígitos los valores de tiempo transcurrido, tasa y ratio en los mensajes de log y excepción, para que números como
1.345844286 sec.ya no se impriman con toda su precisión. #110277 (Alexey Milovidov). - En la web UI (Play),
BFloat16ahora se reconoce como un número de coma flotante y sus columnas se alinean a la derecha y se colorean en consecuencia. #110433 (Alexey Milovidov). - Se admite la cláusula
SETTINGSpara el table enginePostgreSQLy la table functionpostgresql(por ejemplo,SETTINGS postgresql_connection_pool_size = 50), lo que aporta paridad funcional con el engineMySQL. #110614 (Alexey Milovidov). SHOW CREATE TABLE(ySHOW CREATE VIEW/SHOW CREATE DICTIONARY) ahora sugiere en el mensaje de error una tabla con un nombre parecido cuando la tabla solicitada no existe, igual que hacen las consultasSELECT. #110633 (Alexey Milovidov).- Se habilita de forma predeterminada la setting
merge_selector_enable_heuristic_to_lower_max_parts_to_merge_at_once: el merge selector ahora reduce automáticamente el número máximo de partes que se pueden fusionar a la vez según lo llena que esté la partición. Consulte #91163. #110726 (Mikhail Artemenko). - Se aceptan los comandos de limpieza de PostgreSQL
RESET,UNLISTENyDISCARDcomo operaciones sin efecto en el PostgreSQL wire protocol, en lugar de hacer que fallen con un error de sintaxis. Esto mejora la compatibilidad con drivers como Skunk, que envíanRESET ALLyUNLISTEN *durante la configuración y la limpieza de la conexión. #110780 (Alexey Milovidov). - Cambia el valor predeterminado de la setting
auto_statistics_typesdebasic, uniqabasic, uniq_v2. #110878 (Han Fei). randomHadamardTransformahora calcula una transformada exacta que preserva la longitud para cualquier longitud de vector cuyo mayor factor impar sea como máximo 64 (por ejemplo,3584 = 512 * 7, habitual en modelos de embedding), ampliando las familias anteriores2^N,2^k * {12, 20}y2^k * 9. Una transformada completa de una longitud que no puede representarse exactamente ahora genera una excepción en lugar de rellenar silenciosamente con ceros hasta un vector más largo; paseoutput_dimspara calcular una proyección truncada de longitud arbitraria. #111006 (Alexey Milovidov).- Se corrigió una excepción
LOGICAL_ERRORdurante la copia de seguridad de una base de datosReplicatedque se está eliminando y recreando de forma concurrente; esas copias de seguridad ahora fallan limpiamente conCANNOT_GET_REPLICATED_DATABASE_SNAPSHOT. #100651 (Alexey Milovidov). - Ahora se muestra el error subyacente real cuando un archivo ZIP no puede descomprimirse (por ejemplo, cuando el archivo se lee desde S3 y el búfer de lectura rechaza un seek). Antes, el error real quedaba oculto tras el mensaje genérico
Couldn't unpack zip archive: Code = -100/Couldn't open zip archive. #105103 (Groene AI). - Se corrigió la confusa sugerencia “Maybe you meant X?” después de reiniciar el servidor (o tras
DETACH DATABASE/ATTACH DATABASE): al eliminar una tabla ya eliminada, podía sugerirse como alternativa el nombre recién eliminado. #106238 (Groene AI). - Se corrigió un error lógico (
Logical error: 'removed', que abortaba el servidor en compilaciones de depuración) en la cola en segundo plano de eliminación de tablas, que se activaba cuando el mismo UUID explícito se reutilizaba en varias consultasCREATE OR REPLACE TABLE, lo que encolaba más de una tabla eliminada con ese UUID compartido. #107031 (Groene AI). - Se corrigió un error lógico
Inconsistent AST formattingque podía abortar el servidor en compilaciones de depuración y con sanitizador cuando se usaba una lambda con alias como operando de un operador de acceso (elemento de tupla.No elemento de array[]) en una posición que no fuera la primera dentro de una lista de expresiones; por ejemplo,SELECT 1, ((p0, p1) -> p0 AS a7).4[3] FROM t. #107092 (Groene AI). - Una table function de clúster (
urlCluster,fileCluster,s3Cluster, …) anidada dentro de otra consulta distribuida, comoclusterAllReplicas(..., urlCluster(...)), ahora se rechaza con un errorBAD_ARGUMENTSen lugar de fallar con un error lógico (Distributed task iterator is not initialized). #107107 (Groene AI). OPTIMIZE ... DRY RUNinterrumpido por un timeout de consulta (max_execution_timecontimeout_overflow_mode = 'break') ahora devuelveTIMEOUT_EXCEEDEDen lugar de un error lógico relacionado conrows_sources(que abortaba el servidor en compilaciones de depuración/con sanitizador). #107114 (Groene AI).- Se dejó de registrar el error benigno
Net Exception: Socket is not connecteddurante la finalización de la sesión deZooKeeperen macOS.clickhouse keeper-clientya no imprime este error espurio en stderr al salir. #107438 (Groene AI). - Se corrigió un overflow de enteros con signo cuando una vista materializada actualizable reintenta una actualización fallida con
refresh_retriesconfigurado con un valor muy grande (cerca del máximo deInt64). El overflow podía abortar el servidor en compilaciones con el sanitizador de comportamiento indefinido. #108005 (Groene AI). - Corrige un
LOGICAL_ERROR(aborto del servidor en compilaciones de depuración/sanitizador) cuando unJOINusa el operador de comparación null-safe (<=>/IS NOT DISTINCT FROM) y una de las claves es una subconsulta escalar, p. ej.... JOIN t2 ON (SELECT x FROM t1) <=> t2.k, con el analizador antiguo (enable_analyzer = 0). Ahora, esa consulta devuelve un errorNOT_FOUND_COLUMN_IN_BLOCKnormal en lugar de un error lógico. #108123 (Groene AI). - Las consultas de búsqueda vectorial que seleccionan la columna
_distanceahora devuelven un error adecuado en lugar de fallar con un error lógico. #108423 (Robert Schulze). - Corrige un
std::future_error(The associated promise has been destructed prior to the associated state becoming ready) que podía aparecer y abortar el servidor en compilaciones de depuración y sanitizador cuando fallaba la planificación de la tarea asíncrona final que completa la carga multiparte en S3/Azure (por ejemplo, por agotamiento del pool de hilos). Ahora, en su lugar, se informa del error real de planificación. #108730 (Groene AI). - Evita una salida excesiva del log del servidor y un mensaje de error desmesurado al compilar una expresión regular muy grande (por ejemplo, un patrón
LIKEomatchcon cientos de miles de comodines); ahora esos patrones fallan con un errorCANNOT_COMPILE_REGEXPclaro. #108821 (Raúl Marín). - Corrige un comportamiento indefinido al convertir en cadena un tipo de paquete de protocolo fuera de rango (p. ej., en los mensajes de error
Unexpected packet from server/Received ... packet) en una conexión desincronizada o sometida a fuzzing. #108885 (Groene AI). - Corrige un error interno confuso (
Method getResultType is not supported for TABLE query tree node) cuando se usaba una expresión de tabla como argumento izquierdo del operadorIN; ahora esas consultas producen un mensaje de error claro. #109412 (Alexey Milovidov). - Corrige la lectura de una tabla Iceberg con un archivo de metadatos cuyo número de versión contiene solo dígitos, pero excede el rango de enteros de 32 bits (por ejemplo,
v99999999999999999999.metadata.json). Antes, ese nombre producía unstd::out_of_rangeopaco (STD_EXCEPTION) en lugar de un errorBAD_ARGUMENTSclaro. #109619 (Groene AI). - Corrige un posible
Logical error: 'ReadBuffer is canceled. Can't read from it.'cuando un formato de entrada basado en filas (p. ej.TSV/CSV) no podía analizar la entrada y la lectura subyacente ya había sido cancelada (por ejemplo, un fragmento HTTP malformado o un cuerpo truncado). La generación de diagnósticos detallados del análisis ya no lee desde un búfer cancelado. #109708 (Groene AI). - Las expresiones de filtro de las políticas de fila que usan
arrayJoin(o su aliasunnest) ahora se rechazan con un error claro; antes, esas políticas provocaban un error lógicocolumn->size() == num_rowsen tiempo de consulta. #109753 (Raúl Marín). #109973 (Raúl Marín). - La lectura de una tabla Paimon cuyo esquema contiene un tipo anidado no compatible (por ejemplo, un campo
ROW) ahora informa de un errorBAD_ARGUMENTSclaro que indica el tipo no compatible, en lugar de un simpleDB::Exception. (OK)con código de error 0 y sin mensaje. #109762 (Groene AI). - Se corrigió un
LOGICAL_ERROR(std::length_error) cuando una consulta con la configuración experimentalmake_distributed_plan = 1usaba un valor muy grande paradistributed_plan_default_reader_bucket_countodistributed_plan_default_shuffle_join_bucket_count. Estos valores ahora se rechazan conINVALID_SETTING_VALUE. #109770 (Groene AI). - Se corrigió un
LOGICAL_ERROR(query tree node does not have valid source node) cuando un CTE recursivo resolvía un identificador de un ámbito externo como una columna correlacionada (conallow_experimental_correlated_subqueries = 1). Estas consultas ahora devuelven un errorUNSUPPORTED_METHODclaro. #109863 (Groene AI). - Se corrigió un desbordamiento de enteros con signo cuando
ORDER BY ... WITH FILLomite un hueco muy grande en una columnaInt64/UInt64(por ejemplo, un paso de 2 sobre un hueco cercano a 2^63). El desbordamiento era un comportamiento indefinido en compilaciones con sanitizadores y se ajustaba silenciosamente por desbordamiento en compilaciones de lanzamiento. #109937 (Groene AI). - Se corrigió un error lógico
Bad cast from type DB::FunctionNode to DB::ConstantNode(aborto del servidor en compilaciones de depuración/con sanitizador) al ejecutarSELECT ... ORDER BY ... WITH FILLsobre una tablaDistributedcon un valor bajo deoptimize_const_name_size. #109938 (Groene AI). - Se corrigió un error lógico
Invalid number of rows in Chunkcuando un destinoINTERPOLATEes un alias de una columnaWITH FILLcon el analyzer antiguo (enable_analyzer = 0). Estas consultas ahora se rechazan con un errorINVALID_WITH_FILL_EXPRESSIONclaro. #110103 (Groene AI). - Se corrigió un error lógico (aborto del servidor en compilaciones de depuración/con sanitizador) cuando las funciones
indexHint/ignore/isZeroOrNullreciben un argumento cuyo tipo se resuelve comoNothing, por ejemplo, dentro de expresiones comoindexHint(assumeNotNull(materialize(NULL))). #110192 (Groene AI). - Se corrigió un error lógico
Too large size (...) passed to allocatorque podía producirse cuando se establecía un valor fuera de rango para una configuración de tamaño del búfer de lectura, comomax_read_buffer_sizeomax_read_buffer_size_local_fs. Estos valores ahora se limitan a 256 MiB mediante la comprobación de coherencia de la configuración y, además, en el punto de consumo paraINSERT ... FROM INFILE, que lee archivos dentro declickhouse-client, donde esa comprobación no se aplica. #110207 (Alexey Milovidov). CHECK TABLEahora informa de la corrupción real de una projection part que no pudo cargar sus metadatos, en lugar del engañoso errorColumns doesn't match ... Expected: 0 columns. #110262 (Raúl Marín).- Una incompatibilidad de tipos cuando un valor leído de una fuente PostgreSQL (por ejemplo, la table function
postgresqlo el table enginePostgreSQL) no puede convertirse al tipo de columna declarado (por ejemplo, una columnatextdeclarada comoInt32) ahora se informa como un error de consulta adecuado; anteriormente provocaba el aborto del servidor en compilaciones de depuración y con sanitizador. #110264 (Groene AI). - Se añade compatibilidad en macOS para el query profiler, los profilers de memoria y de trace, y la simbolización de
system.trace_log. #109825 (Raúl Marín). - Actualiza
chdiga v26.7.1: trazas de pila comprimidas para compartir, patrones de consulta, compatibilidad con memoria de arena separada, mejoras en Perfetto y correcciones de compatibilidad. #110938 (Azat Khuzhin). - Corrige una inferencia incorrecta de monotonicidad para
intDiven una clave sin signo dividida por una constante con signo, lo que podía desactivar la poda del índice de clave primaria para predicadosIN/NOT INque cruzan el límite de signo del tipo de resultado; los builds de depuración también provocaban unLOGICAL_ERRORInvalid binary search result in MergeTreeSetIndex. #107586 (Groene AI). - Se añadió la configuración
allow_lossy_numeric_supertype(deshabilitada de forma predeterminada). Cuando se habilita,if,multiIf,coalesce,ifNull,arrayymapsobre argumentos numéricos que no tienen un tipo común sin pérdida (por ejemplo,DecimalyFloat64, oInt64yFloat64) se resuelven comoFloat64en lugar deVariant, de modo que el resultado pueda usarse con funciones de agregación comosum,avg,minymax. Los mensajes de error relevantes de las funciones de agregación ahora mencionan la configuración por su nombre. Cierra #106707. #107236 (Groene AI). - Inicia el endpoint de Prometheus (para configuraciones solo de métricas) y la recopilación asíncrona de métricas antes de que se carguen las tablas, para que las métricas estén visibles durante la fase de carga de metadatos, que puede ser larga. #108402 (Christoph Wurm).
Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)
- Corrige el fallo de
TRUNCATE TABLEyDROP PARTITIONen tablas con muchos bloques de deduplicación, donde eliminarlos en una sola solicitud a ZooKeeper podía superar el límite predeterminado de 1 MB dejute.maxbuffer. #105991 (Clayton McClure). Esto solo le afecta si usa Apache ZooKeeper (no recomendado) en lugar de ClickHouse Keeper. - Corrige el uso de nombres de columna completos (
database.table.column) en la cláusulaWHEREde las mutaciones, comoDELETE FROMyALTER TABLE ... UPDATE/DELETE, en tablas de la familiaMergeTree; anteriormente, estas consultas fallaban con un error de columnas ausentes. Cierra #71760. #109491 (Mikhail Artemenko). - Corrige la caché de resultados de consultas para consultas PromQL. El dialecto
promqlomitía la comprobación de funciones no deterministas y podía servir resultados obsoletos anclados ennow(); la API HTTP de Prometheus (/api/v1/query,/api/v1/query_range) nunca almacenaba entradas de caché. #110887 (Nikita Mikhaylov). - Corrige el fallo del servidor al arrancar cuando la variable de entorno
TZestá vacía. Cierra #68920. #68921 (Ardenwick). - Se corrigió el fallo del servidor al arrancar cuando un motor de base de datos
Backuphace referencia a una copia de seguridad que ha dejado de estar disponible (por ejemplo, cuando se eliminaron sus archivos o el almacenamiento subyacente no es accesible). La base de datos ahora se carga sin tablas en lugar de impedir el arranque de todo el servidor. #83188 (Vitaly Orlov). - Al usar inserciones en segundo plano en tablas con el motor
Distributed, los retrasos provocados por errores repetidos al enviar datos a shards remotos ahora disminuyen una vez resueltos esos errores. Anteriormente, el retraso solo aumentaba y nunca se restablecía. #87378 (Andrei Kochemirovskii). - Corrige que
broken_data_filesensystem.distribution_queuey la métricaBrokenDistributedFilesToInsertsiempre informaran0para los archivos dañados detectados al escanear la cola de inserción asíncrona deDistributeddurante el arranque. #92124 (KG.Xu). - Corrige la recuperación del logging tras un error por disco lleno. Anteriormente, cuando el disco del log se llenaba, ClickHouse entraba en un estado fallido y saturaba syslog de forma continua con mensajes de error (potencialmente escribiendo más de 100 GB/hora), sin recuperarse nunca incluso después de liberar espacio en disco. Ahora el sistema de logging se recupera automáticamente en cuanto vuelve a haber espacio en disco disponible, sin necesidad de reiniciar el servidor. #93127 (jaehanbyun).
- Reenvía las credenciales estáticas de S3 a las lecturas de tablas
DataLakeCatalogde Unity cuandovended_credentialsestá deshabilitado, evitando fallos de acceso anónimo al almacenamiento de objetos. #96910 (kgeg401). - Corrige un fallo en el código de análisis de esquemas del motor de tablas
DeltaLake. #97112 (Kseniia Sumarokova). - Corrige un problema de seguridad por el que un cliente TCP no autenticado podía comprobar la existencia de tablas y el estado de la replicación a través del puerto interserver. #99854 (Shaohua Wang).
- Se corrigió un error de sintaxis cuando un alias sigue a una subconsulta en
DESCRIBE TABLE. Soluciona #100031. #100205 (Yarik Briukhovetskyi). - Se corrigió una excepción en subconsultas correlacionadas cuando las columnas externas pasan a ser
Nullablecongroup_by_use_nullsyROLLUP/CUBE. #100365 (Alexey Milovidov). - Se corrigió una terminación abrupta del servidor (en compilaciones con sanitizador) y una pérdida silenciosa de datos durante el arranque de la tabla cuando una parte
MergeTreetransaccional revertida se intersecta con una parte confirmada. #100992 (Tuan Pham Anh). - Se corrigió que
indexOfAssumeSorteddevolviera resultados incorrectos para columnasArray(LowCardinality(String))en tablasMergeTree. #101771 (Yash ). - Se corrigió una poda incorrecta de la clave primaria cuando la sorting key de una tabla envuelve una columna
DateentoDateTime(por ejemplo,ORDER BY toDateTime(date_column)) y una consulta filtra por la columna original con una comparación comoWHERE date_column >= '...'.toDateTime(Date)produce overflow para valoresDatefuera del rango deDateTime(después de2106-02-07), por lo que la clave almacenada no es monotónica; ClickHouse ya no usa la poda de clave primaria para esta combinación de clave/predicado porque hacerlo podría descartar gránulos que contienen filas coincidentes. Cierra #101744. #101814 (Nihal Z. Miaji). - Se corrigió que
intDivOrNull,moduloOrNullypositiveModuloOrNulldevolvieran0en lugar deNULL, y queintDivOrNulleintDivOrZerolanzaran una excepción en lugar de devolverNULL/0, cuando la división provoca una excepción de coma flotante (división por cero oINT_MIN / -1), incluso con argumentos mixtos con y sin signo. #101976 (Yarik Briukhovetskyi). - Se corrigieron excepciones
LOGICAL_ERRORal leer tablasIcebergoDeltaLakeen casos límite, como actualizaciones concurrentes de metadata deIcebergo lecturas mediante la table functionmergesobre tablasDeltaLake. #102033 (Groene AI). - Se corrigieron fallos en requests HTTP salientes (p. ej., la función
aiGenerate, la table functionurl, S3) conNo route to hosten hosts que anuncian direcciones IPv4 e IPv6 cuando solo una familia de direcciones es enrutable. El HTTP connection pool ahora recurre a la siguiente dirección resuelta cuando la primera falla con un error de red, en lugar de propagar el error en la primera request. #103786 (Alexey Milovidov). - Se corrigió una terminación abrupta del servidor durante
RESTOREde copias de seguridad que contienen tablas con dependencias cíclicas. #103824 (Konstantin Bogdanov). - La inferencia de esquema para columnas Arrow
time32/time64(p. ej.,SELECT * FROM file(..., 'Arrow')) ahora infiereTime64en lugar deDateTime64; cualquier elemento posterior que dependa del tipo inferido anterior observará el nuevo tipo tras una actualización. Además, los valoresTime/Time64ahora pueden exportarse a Arrow con el tipo temporal de Apache Arrow adecuado, seleccionado según la precisión. Soluciona #104038. #104316 (/bin/cat). - Se corrigió una condición de carrera entre
ALTER TABLE ... RENAME COLUMNy unOPTIMIZE TABLE ... FINALconcurrente (o cualquier merge en segundo plano) enMergeTreeque podía reemplazar silenciosamente los datos de la columna renombrada por valores predeterminados. #104822 (Groene AI). - Se corrigió un error lógico
Block structure mismatchdurante unINSERTconcurrente mientras unALTER TABLE ... RENAME COLUMNestaba en curso, en una base de datosAtomicconlazy_load_tables = 1después deDETACH DATABASE/ATTACH DATABASE. #104852 (Groene AI). - Se corrigió
groupConcatcuando se mezclan las formas paramétrica y de dos argumentos, por ejemplogroupConcat(',', 2)(x, '/'): el parámetro de límite de filas se ignoraba silenciosamente, por lo que se devolvían todas las filas en lugar del número solicitado; el delimitador del segundo argumento ahora prevalece correctamente sobre el parámetro. #104882 (Yarik Briukhovetskyi). - Se corrigió un
LOGICAL_ERROR(Expected one block from input stream) lanzado porKILL QUERY/KILL MUTATION/KILL PART_MOVE_TO_SHARD/KILL TRANSACTIONcuando su cláusulaWHEREcontiene una subconsulta por fila, o cuandomax_block_sizees lo bastante pequeño como para que elSELECTinterno sobre la tablasystem.*correspondiente emita más de un bloque. #104927 (Groene AI). - Se corrigió
CASTde unidades de interval más pequeñas a unidades más grandes que devolvía resultados incorrectos (por ejemplo,CAST(toIntervalSecond(60) AS IntervalMinute)devolvía0en lugar de1). Cierra #104986. #105058 (Yarik Briukhovetskyi). - Se corrigió un error lógico (
Assertion 'row < chunk.getNumRows()' failed) en consultasLIMIT ... WITH TIESejecutadas con la canalización de lectura en orden (optimize_read_in_order = 1yread_in_order_use_virtual_row_per_block = 1). #105102 (Groene AI). - Se corrigió una fuga en las vistas materializadas actualizables (
MATERIALIZED VIEW ... REFRESH ...): la tabla interna temporal que una actualización intercambiaba medianteEXCHANGE TABLESno podía eliminarse si era mayor quemax_table_size_to_drop, por lo que cada actualización posterior creaba otra tabla interna temporal más, haciendo crecer el directorio de datos de la vista hasta agotar el disco. La operación interna de eliminación de la tarea de actualización ahora omitemax_table_size_to_dropymax_partition_size_to_drop; estas salvaguardas siguen aplicándose alDROP TABLEde la propia vista emitido por el usuario. Cierra #104900. #105106 (Groene AI). - Se corrigió un error inesperado
DATA_TYPE_CANNOT_BE_USED_IN_KEYen consultasALTERque no cambian la clave de ordenación (cambiar settings, comments, codecs, añadir una columna que no forma parte de la clave, etc.) en tablasMergeTreeque tienen unaSimpleAggregateFunction(u otro tipo permitido solo conallow_suspicious_primary_key = 1) en la clave de ordenación. #105111 (Groene AI). - Se corrigió un error de uso de memoria después de su liberación al consultar las columnas de estado de las réplicas de
system.clusters(comois_active,unsynced_after_recovery,recovery_time) mientras se elimina o se desacopla una base de datosReplicated. Además, las excepciones benignas de Keeper que se ignoraban en esta ruta de código (la base de datos afectada se trata como temporalmente no disponible y se omite) ahora se registran en el nivelInformationen lugar deError, por lo que ya no llegan a los clientes con el valor predeterminadosend_logs_level = 'warning'. #105149 (Groene AI). - Se corrigió un problema por el que, al ejecutar varias sentencias en
clickhouse-local --ignore-error, se mostraban todas las sentencias posteriores dentro del mensaje de error para cada error léxico o de paréntesis no emparejados. #105480 (Groene AI). - Se corrigió un fallo poco frecuente del servidor cuando las vistas materializadas actualizables se eliminan o sustituyen al mismo tiempo que se planifica su actualización. #105588 (Groene AI).
- Ahora se rechazan
ALTER TABLE ... DELETEyALTER TABLE ... UPDATEen tablasIcebergcuyo formato de archivo de datos no seaParquet, con un errorNOT_IMPLEMENTEDclaro, en lugar de provocar un fallo del servidor o corromper silenciosamente la tabla. #105893 (Groene AI). - Se corrigieron resultados incorrectos en una vista definida con
EXCEPToINTERSECTcuyo operando es una cadenaUNION, después deDETACH/ATTACHo de reiniciar el servidor. Al formateador le faltaban paréntesis alrededor de los elementosUNIONhijos deINTERSECT/EXCEPT, por lo que el SQL almacenado se volvía a analizar con la precedencia invertida. #105935 (Groene AI). - Se corrigió la detección errónea de datos
JSONcomoTSKVdurante la autodetección de formato. Cierra #100797. #106009 (Pavel Kruglov). - Ahora se prohíbe crear un índice de omisión
minmaxdirectamente sobre columnasJSON: más adelante podía hacer fallar las inserciones con una excepciónNO_COMMON_TYPEcuando se insertaban matrices de tipos mixtos. En su lugar, cree el índice sobre subcolumnas tipadas (por ejemplo,INDEX idx json.field TYPE minmax). #106094 (linhaojie). - Se corrigió un error lógico (
Parsed partition value ... doesn't match partition value for an existing part with the same partition ID) producido porOPTIMIZE TABLE ... PARTITION ...y otras consultas que resuelven un valor de partición, en tablas con una clave de partición de tipoTime. #106202 (Groene AI). - Se corrigió un caso en el que una data part se marcaba incorrectamente como si tuviera una proyección dañada después de que una eliminación ligera no dejara ninguna projection part: ya fuera porque la proyección se reconstruía con cero filas de salida o porque se eliminaba (
lightweight_mutation_projection_mode = 'rebuild'/'drop'). Antes, este estado deshabilitaba la optimización de proyecciones para las consultas sobre esa parte. #106273 (Shaohua Wang). - Se corrigió que
removeDirectoryen discosplainde object storage (comos3_plain) eliminara todos los archivos dentro de un directorio no vacío como si la eliminación fuera recursiva; ahora, eliminar un directorio no vacío falla conCANNOT_RMDIR, y la eliminación recursiva gestiona el contenido explícitamente. #106281 (RinChanNOW). - Se corrigió un error lógico (
Part ... doesn't exist) que podía abortar el servidor durante la recuperación de unINSERTcon quorum tras un error de hardware de Keeper cuando el quorum se marcaba simultáneamente como fallido. #106424 (Alexey Milovidov). - Corrige una excepción
LOGICAL_ERRORpor nombres de columna duplicados al aplicar políticas de fila. #106438 (János Benjamin Antal). - Corrige que
CREATE OR REPLACE TABLEyREPLACE TABLEdejaran una tabla_tmp_replace_*huérfana en disco y sustituyeran la tabla original por una vacía cuando el destino existente superabamax_table_size_to_drop. La comprobación de tamaño ahora se realiza antes del intercambio, de modo que la infracción se aborta limpiamente con el nombre de la tabla visible para el usuario en el error. #106782 (Groene AI). - Corrige que
JSON_QUERY/JSON_VALUE/JSON_EXISTSdevolvieranDynamicen lugar deString/UInt8con argumentosDynamic. Cierra #106461. #106877 (Pavel Kruglov). - Corrige resultados incorrectos al consultar una tabla
ReplacingMergeTreeconFINALy un filtro sobre un text index cuandoquery_plan_optimize_lazy_finalestaba habilitado. La optimización deFINALdiferido construía pasos de lectura que no reproducían la lectura directa desde el text index, por lo que el filtro descartaba todas las filas coincidentes. #106894 (Jimmy Aguilar Mena). - Aplica
query_masking_rulesa los mensajes añadidos a las excepciones, para que las credenciales codificadas en URL en los sufijos(in file/uri ...)de los errores de las table functionsjdbc/odbcno se filtren cuando haya masking rules configuradas. #106916 (Gaurav Dubey). - Corrige que las partes se marcaran como dañadas y se desacoplaran en cualquier recarga de parte (reinicio del server,
DETACH/ATTACH) en tablas con una columnaLowCardinality(Nullable(...))en la partition key. Desde la versión 26.5, el archivo de índice minmax por parte no se escribía cuando el valor mínimo y máximo de esa columna eranNULL, mientras que la comprobación de consistencia de la parte seguía exigiendo ese archivo. Las partes escritas por las versiones afectadas no tienen el archivo de índice minmax y aún deben volver a adjuntarse manualmente. Cierra #106837. #106945 (Pedro Ferreira). - Corrige un
LOGICAL_ERROR(Unexpected expression in JOIN ON section. Expected boolean (UInt8), got 'Nothing') cuando un predicado no equi deJOIN ... ONhace referencia a una columna de tipoNothing, como una generada porARRAY JOIN []. #106981 (Groene AI). - Corrige un
LOGICAL_ERRORpoco frecuente (Attempt to release query context that does not exist) y el cierre inesperado del server asociado al leer tablasMergeTreea través de un cache disk del filesystem creado conenable_filesystem_query_cache_limit = 1. #107028 (Groene AI). - Corrige un cierre inesperado del server al mover una parte vacía a un disco
plain_rewritable(por ejemplo, conALTER TABLE ... MOVE PARTITION ... TO DISKpara una parte vacía conservada porremove_empty_parts = 0). #107040 (Groene AI). - Corrige el orden incorrecto de las filas en consultas
ORDER BYsobreUNION ALLconoptimize_read_in_orderyread_in_order_use_virtual_rowhabilitados. Cierra #106879. #107053 (Vladimir Cherkasov). - Se corrigió un
LOGICAL_ERROR(Unsupported argument types) en la funcióngeohashesInBoxcuando sus argumentos de coordenadas mezclaban valores constantes y no constantes, o cuando una coordenada eraBFloat16. Los argumentosFloat32mixtos const/no-const ahora funcionan, y los argumentosBFloat16se rechazan con un error claro. #107063 (Groene AI). - Se corrigieron resultados incorrectos (filas duplicadas) para
SELECT DISTINCTsobre unGROUP BYconWITH CUBE,WITH ROLLUPoGROUPING SETSen las mismas claves. La optimizaciónquery_plan_remove_redundant_distinctya no eliminaDISTINCTen estos casos, porque los modificadores de agrupación generan filas adicionales con las columnas clave en sus valores predeterminados, que pueden colisionar con valores reales de grupo. #107072 (Groene AI). - Se corrigió un resultado incorrecto en un
OUTER JOINcuando el filtroWHEREes una conjunción que contiene un término constante (por ejemplo,p AND 1, oWHERE p QUALIFY NULL, dondeQUALIFY NULLse fusiona enWHERE). El término constante de la conjunción podía propagarse al lado no conservado del join y eliminarse del filtro posterior al join, de modo que el join producía filas sin coincidencia con las columnas de ese lado en sus valores predeterminados, y esas filas pasaban incorrectamente el filtro. #107084 (Groene AI). - Se corrigió que las user-defined functions
executable_poolconfiguradas con<lifetime>no detectaran cambios en el script subyacente. Anteriormente, soloSYSTEM RELOAD FUNCTIONSvolvía a leer un script editado; las recargas periódicas de<lifetime>seguían ejecutando la versión anterior. #107087 (Groene AI). - Se corrigió una excepción
LOGICAL_ERROR(Cannot find input column ... on its position in inputs of expression actions DAG) en una scalar subquery correlacionada sobre un origen que proyecta dos veces el mismo identificador de columna (p. ej.,SELECT number, *) cuandocorrelated_subqueries_default_join_kind = 'left'. #107112 (Groene AI). - Se corrigió una condición de carrera en el recopilador global de trazas del server entre el inicio del perfilador de un worker thread y el apagado del server. #107307 (Groene AI).
- Los incremental backups ya no almacenan credenciales de
S3en el localizador<base_backup>del archivo de metadata.backup. Los backups creados conuse_same_s3_credentials_for_base_backup = 1, o con credenciales explícitas del backup base que coinciden con este localizador de backup, almacenan un marcador no secreto y se restauran sin settings adicionales en el momento de la restauración; en el caso de backups creados con credenciales explícitas distintas para el backup base o con argumentos adicionales de authentication base, páselos aRESTOREcon el settingbase_backup. Los backups creados por versiones anteriores con embedded credentials siguen siendo restaurables. #107357 (Pablo Marcos). - Se corrigió que el encabezado de
CSVWithNamesyCSVWithNamesAndTypestuviera menos columnas que los datos cuandooutput_format_csv_serialize_tuple_into_separate_columnsestá habilitado (valor predeterminado). El encabezado (y la fila de tipos) ahora aplana las columnasTupleen sus fields hoja con nombres separados por puntos (p. ej.,t.a,t.b), de modo que el número de columnas del encabezado coincida con los datos. Un nuevo settingoutput_format_csv_header_serialize_tuple_into_separate_columns(predeterminado1) controla este comportamiento y puede establecerse en0para restaurar el encabezado anterior de nombre único. #107371 (Groene AI). - Se corrigió la lectura de tablas
Icebergv3 cuyos data filesParquetcontienen columnas reservadas de linaje de filas (como_row_id); el lector nativo deParquetya no generaICEBERG_SPECIFICATION_VIOLATIONpara ID de field reservados que no forman parte del table schema. #107377 (Greg Maher). - Se corrigió un raro cierre inesperado del servidor durante el apagado (
std::future_error:The associated promise has been destructed prior to the associated state becoming ready) causado porque una tarea programada se eliminaba de la cola del thread pool antes de ejecutarse. #107383 (Groene AI). - Se corrigieron los motores de tabla y base de datos
MaterializedPostgreSQLpara que una sola tabla o base de datos pueda replicarse desde un esquema no predeterminado de PostgreSQL (materialized_postgresql_schema), incluido el caso en que existan tablas con el mismo nombre en varios esquemas de la misma base de datos (antes compartían una publication y un replication slot, y se interferían entre sí). #107425 (Alexey Milovidov). - Se corrigió que
MaterializedPostgreSQLdejara de replicar una base de datos completa (conLOGICAL_ERROR: Columns number mismatch) cuando cambiaba la estructura de una sola tabla replicada mientras el servidor estaba caído. Ahora solo se omite la tabla afectada y puede recuperarse conDETACH/ATTACH. #107427 (Alexey Milovidov). BACKUPde una base de datosMaterializedPostgreSQLya no se queda bloqueado indefinidamente conTable ... were created or changed its definition during scanning, y ahora sí respalda los datos de la tabla (delegado alReplacingMergeTreesubyacente), que puede restaurarse como unReplacingMergeTreestandalone. #107433 (Alexey Milovidov).- Se corrigió una regresión por la que establecer
compatibility = '26.6'(que habilita implícitamente la estrategia de particiónhive) aceptaba silenciosamente{_partition_id}en rutas de tablas S3/object storage en lugar de generarBAD_ARGUMENTS. #107437 (Lefteris). - Se corrigió una fuga de memoria en el
mongo-c-driverincluido que podía producirse al leer desde MongoDB (por ejemplo, mediante un Diccionario de MongoDB o la table functionmongodb) si un error de lectura retryable iba seguido de un fallo en la selección del servidor durante el reintento. #107448 (Groene AI). - Se corrigió una excepción al insertar en una tabla
Icebergcuyos metadatos fueron creados por un external engine y omiten los arrays opcionalessnapshots,metadata-logosnapshot-log. Estas inserciones ahora se completan correctamente en lugar de fallar. #107473 (Shaohua Wang). - Se corrigió que
DELETE FROM(eliminación ligera) requiriera el privilegeALTER UPDATEademás deALTER DELETE. Un usuario al que solo se le concedióALTER DELETEahora puede ejecutarDELETE FROM, como se documenta. #107491 (Shaohua Wang). - Se corrigió
NOT_FOUND_COLUMN_IN_BLOCKal leer archivos particionados por Hive conuse_hive_partitioning = 1y una cláusulaWHERE/PREWHEREque filtra una columna real (no virtual) mientras también se selecciona una columna de partición de Hive. #107505 (Groene AI). - Se corrigió un
LOGICAL_ERROR(Different order of columns in UNION subquery) cuando el analyzer antiguo (enable_analyzer = 0) lee un subconjunto de columnas de una subquery cuyos hijos deUNIONson operaciones de conjuntosINTERSECT/EXCEPT. #107511 (Groene AI). - Se corrigió que los valores
NULLse convirtieran silenciosamente en cadenas vacías al insertar datosArrow/ORCen una columnaLowCardinality(Nullable(...)). Fue una regresión introducida en la versión 26.5. #107532 (Jimmy Aguilar Mena). - Se corrigió un error lógico (
Stream ... variant_discr ... is not found) que podía producirse al fusionar o leer una parte deMergeTreegenerada por una mutación de una tabla con una columnaDynamic. #107562 (Alexey Milovidov). - Se corrigió un error lógico (
WhichDataType(const_type).isArray()) durante el análisis de la clave primaria cuando se llama apointInPolygoncon un argumento de polígono constante de un tipo contenedor, comoVariantoDynamic(por ejemplo,pointInPolygon((x, y), if(c, [(0, 0), ...], NULL))). #107589 (Groene AI). - Se corrigió un error lógico (
Last stored last_written_position in meta file ... is bigger than current last_written_pos) en el motorFileLogque podía producirse cuando se eliminaba un archivo supervisado y se volvía a crear reutilizando el mismo inode. #107617 (Groene AI). - Se corrigió una rara interrupción del servidor (
std::future_error:The associated promise has been destructed prior to the associated state becoming ready) durante el procesamiento de solicitudes del cliente ZooKeeper, cuando una solicitud asíncrona a Keeper se descartaba mientras se enviaba, por ejemplo, bajo presión de memoria. #107647 (Groene AI). - Se corrigió
RESTOREpara las tablasReplicatedMergeTree, de modo que las partes con contenido duplicado de una copia de seguridad se conserven en lugar de deduplicarse silenciosamente. #107652 (Pablo Marcos). - Se corrigió el filtro de join en tiempo de ejecución que producía resultados incorrectos para columnas
JSON. Cierra #107646. #107663 (Pavel Kruglov). - Se corrigieron resultados incorrectos en consultas distribuidas que seleccionaban columnas
ALIASque comparten una subexpresión común: las columnas podían desalinearse y devolver valores bajo la columna equivocada. #107675 (Vladimir Cherkasov). - Las cuotas indexadas por
normalized_query_hashahora contabilizan todos los recursos (read_rows,read_bytes,result_rows,result_bytes,execution_time,written_bytes,errors) por patrón de consulta, igual que los contadores de número de consultas, en lugar de contabilizarlos en un único bucket compartido por usuario. #107681 (Alexey Milovidov). - Se corrigió un error lógico
Block structure mismatch in UnionStep stream(interrupción del servidor en compilaciones de debug/sanitizador,Code: 49en compilaciones de lanzamiento) que se producía cuando ramas hermanas de unUNION/INTERSECT/EXCEPTdiferían solo en su predicadoWHEREy el predicado de una de las ramas se plegaba como constante a una columnaConst. #107719 (Groene AI). - Se corrigieron errores lógicos (
Bad cast) causados por la eliminación inconsistente deLowCardinalityanidado dentro de columnasVariantyDynamic, por ejemplo, enconcat,formaty el análisis de la clave primaria. Cierra #107598. #107773 (Pavel Kruglov). - Se corrigió un grave desequilibrio en la distribución del trabajo con réplicas paralelas cuando el clúster contiene réplicas inactivas (por ejemplo, entradas obsoletas dejadas tras el escalado automático). El coordinador de lectura ya no cuenta esas réplicas, por lo que el trabajo se equilibra entre las réplicas en línea en lugar de acumularse en una sola. #107805 (Alexey Milovidov).
- Se corrige la excepción
Not-ready Set is passed as the second argument, que podía producirse cuando la construcción de un conjunto para una subconsultaINdurante el análisis de la clave primaria fallaba silenciosamente (por ejemplo, por un timeout de subconsulta conoverflow_mode = 'break'), dejando el conjunto permanentemente sin construir en la canalización de consultas. #107924 (Alexey Milovidov). - Se corrige un fallo del servidor en el pushdown de predicados (
enable_optimize_predicate_expression, analyzer heredado) cuando una subconsultaUNIONaparece dentro de una condiciónJOIN ... ON. #107930 (Groene AI). - Se corrigen errores espurios de
CHECKSUM_DOESNT_MATCHy de lectura deParquet(y, en algunos formatos, resultados silenciosamente incorrectos) cuando un objeto de S3 o compatible con S3 (p. ej., GCS) se sobrescribe en el mismo lugar mientras se está leyendo. Ahora estas lecturas fallan con un error claro y reintentable, en lugar de devolver datos ensamblados a partir de dos versiones del objeto; esto se controla mediante el nuevo ajustes3_validate_etag_on_read(activado de forma predeterminada). #107934 (Shaohua Wang). - Se corrige un
SELECTque fallaba conNOT_FOUND_COLUMN_IN_BLOCKen una tabla que tiene un índice de omisión de datossetcuando una política de filas la filtra usando una condición siempre verdadera combinada con una comprobación sobre una columna no indexada. #107971 (Shaohua Wang). - Se corrige el análisis de los parámetros de comando de las funciones definidas por el usuario ejecutables para que no se acepten como parámetros placeholders con nombres vacíos o no válidos. #107983 (Goutam Adwant).
- Se corrige una regresión de rendimiento en las subcolumnas de
MapconPREWHERE. Cierra #107912. Provocada por #99200. #107988 (Pavel Kruglov). - Se corrige una escritura fuera de los límites al leer una columna
Variantdesde un bloqueNativemal formado cuyos discriminadores hacen referencia a un índice de variante que no existe. #107991 (uwezkhan). - Se corrigen resultados de consulta incorrectos debidos a una poda incorrecta de la clave primaria y de particiones cuando
toStartOfDay,toStartOfISOYear,toDaysSinceYearZero,toRelativeSecondNum,toRelativeMinuteNum,toRelativeHourNum,toRelativeWeekNum,toRelativeDayNum,toMonthNumSinceEpochotoYearNumSinceEpochse aplican a una columna claveDate32que contiene fechas fuera del rango que la función puede representar (en particular, fechas anteriores a1970-01-01). Estas funciones se presentaban como monotónicas para el índice primario, pero antes hacían wraparound con esos argumentos, por lo que el índice podía podar gránulos que en realidad contenían filas coincidentes; ahora se saturan en los límites de su tipo de resultado y siguen siendo monotónicas en todo el rango deDate32. #108018 (Nihal Z. Miaji). - Se corrige
accurateCastOrNullde unTuplecuyo elemento esDynamic/Variant: unNULLgenuino del origen se trataba como un fallo de conversión. Para un elemento de destinoNullable, unNULLdel origen ahora sigue siendo un elementoNULL(como ocurre con un origenTuple(Nullable(...))simple); para un elemento de destino noNullable, unNULLdel origen ahora hace que toda la tupla seaNULLen lugar de producir el valor predeterminado del elemento; los fallos de análisis o desbordamiento siguen haciendo que toda la tupla seaNULL. #108023 (Groene AI). También se corrige un error lógico al convertir una columnaDynamicoVariantanidada dentro de unTuplea un tipo de elemento noNullableconaccurateCastOrNulloaccurateCastOrDefault. #108061 (Alexey Milovidov). - Se corrigió que
numericIndexedVectorPointwiseMultiplydevolviera un resultado vacío al multiplicar por un vector de solo unos con una configuración BSI (bit-sliced index) diferente. #108027 (Alexey Milovidov). - Se corrigió que
toTime64yCAST(... AS Time64)no limitaran los valores fuera de rango al intervalo deTime64en los modos de desbordamientosaturateeignore, lo que podía producir valores que se muestran de forma idéntica pero se comparan como distintos. #108028 (Alexey Milovidov). getClientHTTPHeaderahora se trata correctamente como no determinista, por lo que su resultado ya no se reutiliza incorrectamente en la caché de resultados de consultas. #108029 (Alexey Milovidov).clickhouse-client --port 9440vuelve a habilitar automáticamente una conexión segura (TLS); esto se había roto por una refactorización que dejó de pasar el puerto a la comprobación de conexión segura. #108032 (Alexey Milovidov).- Un error transitorio al actualizar data parts de una tabla de solo lectura ya no detiene permanentemente la tarea de actualización en segundo plano. #108034 (Alexey Milovidov).
- Se corrigió que las advertencias de sobrecarga de memoria/CPU/mutation en
system.warningsfueran con un ciclo de métricas asíncronas de retraso (y que estuvieran ausentes en el primer ciclo). #108035 (Alexey Milovidov). - La función de tabla
mongodbahora aceptaoid_columnspasado como argumento con nombre (por ejemplo,oid_columns='_id'), en lugar de rechazarlo conBAD_ARGUMENTS. #108039 (Alexey Milovidov). - Se corrige una excepción
Bad cast from type DB::ColumnNullable to DB::ColumnVector<...>(error lógico) cuando un asterisco calificado (t.*) selecciona una claveJOIN USINGy ese join está anidado debajo de un joinPASTE/CROSS/por coma o de un joinONexterno, conjoin_use_nulls = 0. #108043 (Groene AI). - Se corrigió el manejo incorrecto de las aserciones de anchura cero (
\b,^,$) en las funciones regexp de “match all”extractAll,extractAllGroupsVertical,extractAllGroupsHorizontal,countMatchesysplitByRegexp. Por ejemplo,extractAll('new york is the greatest', '\b(\w)')ahora devuelve correctamente la primera letra de cada palabra en lugar de cada letra. #108047 (Alexey Milovidov). - Se corrigió
CREATE TABLE ... AS SELECTen bases de datosAtomic, que dejaba una tabla vacía cuando fallaba la consulta; por ejemplo, cuando el usuario no tiene acceso a una tabla referenciada desde una subconsulta. Antes, al reintentar se informaba de que la tabla ya existía en lugar de mostrar el error original. Ahora la tabla se crea mediante una tabla temporal y solo pasa a ser visible una vez que se ha poblado por completo. #108048 (Alexey Milovidov). - Ahora se permite consultar un diccionario
range_hashedocomplex_key_range_hashedque use un rangoDateTime64,Decimalo de coma flotante con un argumento correspondiente paradictGet/dictHas. Antes, esas consultas fallaban conmust be convertible to Int64, y los intervalos abiertos de rangosDecimal/DateTime64devolvían incorrectamente el valor predeterminado. #108052 (Alexey Milovidov). - Se corrigió una excepción (
CANNOT_PARSE_TEXT) al cargar un diccionario con una clave compuesta cuyas columnas clave no eran las primeras de la definición del diccionario, con una fuente local deClickHouseque usaba una consulta explícita. Ahora las columnas de origen se hacen coincidir con la estructura del diccionario por nombre en lugar de por posición. #108053 (Alexey Milovidov). - Se corrigió un fallo de la función de tabla
valuesconARGUMENT_OUT_OF_BOUNDcuando se usa un literal decimal que no puede representarse exactamente en una columna estrecha de coma flotante (como0.1para una columnaFloat32); por ejemplo,SELECT * FROM values('x Float32', 0.1). Ahora esos valores se aceptan y se convierten al valor representable más cercano, de forma coherente conCASTeINSERT ... VALUES. #108055 (Alexey Milovidov). - Se corrigió un
LOGICAL_ERROR(No available columns) al ejecutarSELECT count()(u otras consultas triviales) sobre una tabla en la que al usuario solo se le había concedido accesoSELECTa una columnaALIAS. #108056 (Alexey Milovidov). - Se corrigió que
mapFilter,mapSort(y sus variantes) ymapConcateliminaranLowCardinalityde los tipos de clave y valor de unMap. Antes,mapFiltersobre una columnaMap(LowCardinality(String), String)devolvíaMap(String, String), lo que podía corromper los metadatos de una tabla creada medianteCREATE TABLE ... AS SELECTy hacer queCHECK TABLEfallara. #108057 (Alexey Milovidov). - Se corrigieron resultados incorrectos al usar
hasTokenen índices de texto con un tokenizador distinto desplitByNonAlpha. #108066 (Robert Schulze). - Se corrigió un bloqueo de
SYSTEM RELOAD DICTIONARIES(yRELOAD DICTIONARY) cuando muchos diccionarios MySQL definidos en XML compartían un único grupo de conexiones medianteshare_connection. Ahora esos grupos respetan los valores deconnection_pool_sizeyconnection_wait_timeout(5 segundos de forma predeterminada) de la configuración, igual que los diccionarios definidos mediante colecciones con nombre. #108083 (Alexey Milovidov). - Ahora se permite
EXISTS <dictionary>para un usuario que solo tiene el privilegioSHOW DICTIONARIESsobre el diccionario (antes requeríaSHOW TABLES). #108084 (Alexey Milovidov). - Se corrigió que
CREATE TABLE dst AS src SETTINGS ...(y variantes similares conORDER BY/PARTITION BY, pero sin unENGINEexplícito) descartara silenciosamente el engine de la tabla de origen, las cláusulas de almacenamiento (como elTTLde la tabla y las claves) y la configuración. Ahora, el engine y las cláusulas de almacenamiento no sobrescritas se heredan de la tabla de origen, y la configuración especificada se aplica sobre la configuración de la tabla de origen. #108085 (Alexey Milovidov). - Se corrigió que
INSERTen tablasMergeTreefallara confilesystem error: in rename: Permission denieden sistemas de archivos basados en Windows (WSL, CIFS/SMB, montajes bind de Docker Desktop), debido a que el escritor de partes dejaba descriptores de archivo abiertos durante el cambio de nombre del directorio de la parte. #108089 (Alexey Milovidov). - Se corrigió un fallo (desreferenciación de puntero nulo) al consultar una tabla
Hivesin una cláusulaWHERE, por ejemplo,SELECT * FROM hive_table. #108094 (Alexey Milovidov). - Se corrigió un
LOGICAL_ERROR(“Unexpected return type from if”) al leer una columna conapply_mutations_on_fly = 1después de unALTER UPDATE col = ... WHERE <cond>con una condición no constante o falsa, seguido deALTER MODIFY COLUMN col <new type>. #108128 (Groene AI). - Se corrigió que
toStartOfIntervalydateTruncdevolvieran un valor redondeado en lugar del inicio del intervalo correspondiente cuando la entrada tiene una precisión más fina que la unidad del intervalo; por ejemplo,toStartOfInterval(toDateTime64('2023-10-09 10:11:12.000999', 6), INTERVAL 1 millisecond)devolvía10:11:12.001en lugar de10:11:12.000. La sobrecarga con un origen explícito también se veía afectada. Cierra #103535. #108186 (Yarik Briukhovetskyi). - Se oculta la información sensible en la columna
view_querydesystem.query_views_log. #108214 (Valerii Mordovskii). - Se corrigió un bloqueo en una tabla
MergeTreeadjunta con un skip index heredadohypothesis(un tipo de índice eliminado que se conserva solo por compatibilidad conATTACH). Antes, una eliminación ligeraDELETE,OPTIMIZE, unINSERTsimple o unSELECTfiltrado sobre una tabla de este tipo fallaban conILLEGAL_INDEX(“Index of type ‘hypothesis’ is no longer supported”), y la mutaciónDELETEse reintentaba indefinidamente. Ahora, el índice obsoleto se trata como inerte: se conserva intacto durante merge/mutation, se omite en insert y en la planificación de consultas, y aún puede eliminarse conALTER TABLE ... DROP INDEX. #108217 (Groene AI). - Se corrigió que la configuración
type_json_allow_duplicated_key_with_literal_and_nested_objectno funcionara con rutas tipadas enJSON. #108218 (Pavel Kruglov). - Se corrigió un
LOGICAL_ERROR(Different list of shards in child plans) al ejecutar una consulta conmake_distributed_plan = 1sobre una tablaMergeTreeque tiene una proyección normal/de agregación. #108256 (Groene AI). - Se corrigió
replaceRegexpOneyreplaceRegexpAllpara que.coincida con caracteres de nueva línea de forma predeterminada, de manera coherente con otras funciones de expresiones regulares. #108265 (linjiayu1025-collab). - Corrige un error lógico al convertir un
Array(Dynamic)oArray(Variant)aQBitconaccurateCastOrNull, p. ej.accurateCastOrNull(CAST(range(114), 'Array(Dynamic)'), 'QBit(Float32, 114)'). #108288 (Groene AI). index_granularity_bytesahora se respeta para las columnas de estado deAggregateFunction. Anteriormente, el límite de bytes del gránulo se ignoraba para esas columnas (por ejemplo, estadosuniqExacten tablasAggregatingMergeTreey proyecciones de agregación), lo que producía gránulos mucho más grandes que el límite configurado y aumentaba la amplificación de lectura y la memoria en tiempo de consulta. #108297 (Groene AI).- Corrige que las condiciones de
UPDATE/DELETEligeros se evaluaran dos veces, lo que podía provocar un comportamiento incorrecto en condiciones no deterministas y trabajo adicional en las deterministas. Cierra #86032. #108323 (ofeliacode). - Corrige una excepción en un controlador HTTP predefinido cuando falta en la solicitud un header cuya expresión regular
headers_regexppermite un valor vacío. #108324 (Vitaly Baranov). - Corrige
arrayPartialSortcon un argumento de límite no constante. #108327 (Vitaly Baranov). - Se corrigió que un
INSERTcancelado o terminado conKILLsiguiera ejecutándose durante mucho tiempo mientras construía un skip index (por ejemplo, un índiceset(0)sin límite en una columna de alta cardinalidad). La construcción del índice ahora se detiene rápidamente cuando se cancela la consulta. #108351 (Shaohua Wang). - Se corrigió que un
SELECTdesde la función de tablaprimesno respondiera a la cancelación: con unstep(olimit) grande, la consulta podía seguir ejecutándose durante mucho tiempo después deKILL QUERYo de un tiempo de espera. Ahora se detiene rápidamente. #108353 (Shaohua Wang). - Se corrigió el análisis de nombres de tipos de datos cuyo nombre contiene la subcadena
INT(por ejemplo, un nombre similar a una función comoquantileInterpolatedWeightedusado en una posición de tipo de dato). Esos nombres se confundían con tipos enteros de MySQL y su primer grupo de argumentos(...)se consumía silenciosamente como modificador de ancho de visualización, lo que podía romper el round-trip del formato de la consulta. #108354 (Groene AI). - Se corrigió una inconsistencia por la que un
ARRAY JOINmal formado seguido de una coma y una lista de tablas entre paréntesis se interpretaba incorrectamente como un cross join en lugar de ser rechazado. #108365 (Raúl Marín). - Oculta los argumentos secretos de funciones como
encrypt,decryptyHMACen la salida deEXPLAIN actions,EXPLAIN headeryEXPLAIN PIPELINEcuandoformat_display_secrets_in_show_and_selectestá deshabilitado (valor predeterminado). #108386 (Raúl Marín). - Corrige
CREATE OR REPLACEde una vista materializada actualizable con un destinoTO: se rechazaba incorrectamente porque la tabla de destino ya pertenece a la vista que se está reemplazando. #108392 (Nikolay Degterinsky). - Se corrigió un fallo del servidor (
Received signal 4, illegal instruction) que podía desencadenarse por un flujo malformado o desincronizado del protocolo TCP nativo. Ahora se valida que la dirección inicial proporcionada por el cliente sea unhost:portnumérico antes de analizarla, en lugar de permitir que un puerto no numérico llegue a la función de libcgetservbyname, que provocaba la trampa. #108410 (Groene AI). - Se corrigió un fallo del servidor durante el apagado cuando al cerrar una base de datos se produce una excepción (por ejemplo, cuando el
flushde una tabla agota el tiempo de espera de ZooKeeper). El resto de la secuencia de apagado ya no se omite, por lo que los registros del sistema se vacían y se espera a que finalicen sus hilos antes de que el servidor se cierre. #108417 (Groene AI). - Se corrigió que las funciones de expresiones regulares (
match,extract,extractAll,replaceRegexpOne,replaceRegexpAll, etc.) devolvieran silenciosamente resultados incorrectos cuando el patrón contenía un byte NUL (\0). Ahora el NUL se trata como un byte literal normal, en consonancia con RE2. #108427 (Alexey Milovidov). - Se corrigió que
clickhouse-localdevolviera una respuesta vacía a las solicitudes HTTPOPTIONScuando no hay ningúnhttp_options_responseconfigurado, lo que hacía que la interfaz web (/play) mostrara la conexión como interrumpida aunque las consultas funcionaran. #108428 (Alexey Milovidov). - Se corrigió una excepción
LOGICAL_ERROR(“Invalid action query tree node …”) cuando una consulta distribuida desduplicaba columnasALIASduplicadas y estructuralmente idénticas, y además hacía referencia a una table function con un argumento de colección con nombrekey = value(por ejemplo,oss(s3_conn, filename = '...')). #108435 (Groene AI). - Se corrigió un fallo del servidor (
LOGICAL_ERROR: 'Unexpected exception in refresh scheduling') que podía ocurrir durante el arranque cuando se adjuntaba una vista materializada actualizable coordinada en una base de datosReplicateda un Keeper que no admite la marca de funcionalidadMULTI_READ(por ejemplo, tras una degradación de Keeper). Ahora la vista se detiene correctamente en lugar de abortar el servidor. #108441 (Groene AI). - Se corrigió el error
NOT_FOUND_COLUMN_IN_BLOCK(p. ej.,Column _part not found) al seleccionar columnas virtuales de una tablaMergeTreecon réplicas paralelas, incluso medianteSELECT *conasterisk_include_virtual_columns = 1. #108451 (Groene AI). SYSTEM RESET DDL WORKERahora requiere el nuevo privilegioSYSTEM RESET DDL WORKER. Antes, cualquier usuario autenticado (incluidos losreadonly) podía ejecutarlo y restablecer repetidamente el estado del worker de DDL, bloqueando el DDLON CLUSTER. #108460 (Groene AI).- Se restringió la ruta del modelo de
catboostEvaluateal directoriouser_files, igual que la table functionfiley las fuentes de diccionario. Antes, la función aceptaba una ruta arbitraria del sistema de archivos sin ninguna comprobación de contención, lo que permitía comprobar la existencia de archivos fuera deuser_filesy activar lecturas de ellos. Ahora los modelos deben estar ubicados dentro deuser_files. #108463 (Groene AI). - La función
hasColumnInTableahora requiere el privilegioSHOW COLUMNSsobre la tabla de destino, el mismo permiso que exigenDESCRIBEySHOW CREATE TABLE. Antes, cualquier usuario podía llamar ahasColumnInTablepara comprobar nombres de columnas y verificar la existencia de tablas y bases de datos sin ninguna comprobación de acceso. #108464 (Groene AI). - Se corrigió la asignación excesiva de memoria al deserializar estados manipulados de funciones de agregación para
mannWhitneyUTest,rankCorr,largestTriangleThreeBuckets,quantileGK,sequenceMatch/sequenceCountygroupArrayIntersect. Un estado malformado podía declarar un número enorme de elementos y hacer que el servidor intentara reservar decenas de gigabytes a partir de unos pocos bytes de entrada; ahora esos estados se rechazan conTOO_LARGE_ARRAY_SIZE. #108465 (Groene AI). - Se valida el destino de redirección de una respuesta
301 Moved Permanentlyde S3 frente aremote_url_allow_hosts(RemoteHostFilter). Anteriormente, el manejo de 301 del SDK de AWS seguía el endpoint proporcionado por el atacante en la respuesta (cabeceraLocationo elemento<Endpoint>) sin comprobar el host, por lo que un servidor S3-compatible malicioso o comprometido podía redirigir ClickHouse a un host arbitrario (SSRF). La ruta de redirección 307 ya realizaba esta comprobación; ahora ambas rutas son coherentes. #108466 (Groene AI). - Se corrigió una filtración de credenciales por la que los ajustes heredados
storage_aws_access_key_id,storage_aws_secret_access_key,storage_catalog_credentialystorage_auth_headerdel motor de base de datosDataLakeCatalogse mostraban en texto plano ensystem.databases.engine_fullySHOW CREATE DATABASE. Ahora se ocultan como[HIDDEN]. #108470 (Groene AI). - Se corrigió la identificación de usuarios mediante
ssl_certificatepara que un comodín*coincida exactamente con un solo componente del nombre (RFC 6125 6.4.3). Anteriormente, un comodín en un sujeto SANCNoDNS:(por ejemplo,*.corp.example.com) también coincidía con nombres de varias etiquetas comoevil.deep.corp.example.com, lo que permitía que el titular de un certificado para un subdominio más profundo se autenticara como el usuario comodín. La coincidencia de SANURI:no cambia. #108472 (Groene AI). - Se corrigió una inyección SQL en el protocolo MySQL wire protocol: el argumento de
SHOW TABLE STATUS LIKEy el valor deSET <mysql_setting>enviado a través de la MySQL interface (puerto 9004) ahora se analizan y se vuelven a entrecomillar en lugar de concatenarse literalmente en la consulta reescrita. También se corrigió queKILL QUERY <id>a través de la MySQL interface ignorara silenciosamente los ID de conexión de varios dígitos. #108474 (Groene AI). - Los valores sensibles pasados como parámetros de cadena de consulta HTTP (por ejemplo, el enlace de parámetros de consulta
param_*, comoparam_secret_key/param_aws_secret_access_key, el parámetropasswordo parámetrossignatureal estilo de S3) ya no se escriben literalmente ensystem.text_logni en spans de OpenTelemetry. La línea de LogRequest URIahora oculta los valores de los parámetros cuyos nombres parecen sensibles, sustituyéndolos por[HIDDEN]. #108475 (Groene AI). - Se aplica la configuración
http_forbid_headersdurante la inferencia de esquema para la table functionurly el motor de almacenamientoURL. Anteriormente, una cabecera prohibida seguía enviándose por la red durante la inferencia del esquema (por ejemplo, con el formatoRegexpoDESCRIBE), y su response body podía reflejarse en un error de análisis, filtrando secretos. Ahora el filtro de cabeceras se comprueba antes de cualquier acceso a la red en la ruta de inferencia, en consonancia con el comportamiento existente deurlCluster. #108476 (Groene AI). - Se corrigieron resultados incorrectos al usar
SELECT ... SAMPLE ...junto con la query condition cache (ajusteuse_query_condition_cache, habilitado de forma predeterminada). #108488 (Groene AI). - Se corrigió un fallo del servidor (stack overflow) provocado por expresiones profundamente anidadas como
[[[ ... ]]]oarray(array( ... ))cuandomax_parser_depthse establece en un valor alto. #108493 (Raúl Marín). - Se corrigió un problema por el que el engine de tabla
RabbitMQpodía quedar bloqueado indefinidamente enDROP TABLEo durante el apagado del servidor cuando el broker cerraba la conexión AMQP debido a heartbeats perdidos sin enviar un TCP RST. Todas las llamadas bloqueantes del bucle de eventos ahora tienen un tiempo de espera de 30 segundos, por lo que el apagado siempre se completa. #108497 (Aly Ayman). - Las consultas secundarias ejecutadas como parte de consultas internas ahora se registrarán como consultas internas. #108506 (Miсhael Stetsyuk).
- El engine de tabla
ArrowFlighty la función de tablaarrowFlightahora respetan la lista de permitidos de<remote_url_allow_hosts>. Antes, no se validaban el host ni el puerto de la conexión, por lo que una consulta podía llegar a hosts no incluidos en la lista de permitidos. #108507 (Groene AI). - Los comandos del protocolo MySQL
COM_FIELD_LIST(mysql_list_fields) yCOM_INIT_DB(USE database) ahora aplican el mismo control de acceso que sus equivalentes en SQL (SHOW COLUMNS/DESCRIBEyUSE). Antes, podían revelar nombres de columna de tablas sobre las que el usuario solo tenía permisos parciales a nivel de columna, y cambiar la base de datos actual sin el privilegioSHOW DATABASES. #108508 (Groene AI). http_forbid_headersahora distingue mayúsculas y minúsculas de forma insensible. Los nombres de los encabezados HTTP no distinguen entre mayúsculas y minúsculas, por lo que prohibirAuthorizationahora también bloqueaauthorization,AUTHORIZATIONy otras variantes. Los patronesheader_regexpconfigurados ahora también se comparan sin distinguir entre mayúsculas y minúsculas, sin necesidad de indicar explícitamente la marca(?i). #108509 (Groene AI).- Se corrigió un fallo del servidor (segmentation fault) que podía producirse cuando una consulta distribuida hacía referencia a un CTE
MATERIALIZEDaún no materializado como tabla externa y el origen remoto se creaba de forma diferida. #108547 (Groene AI). - Se corrigieron resultados incorrectos cuando la caché de condiciones de consulta (
use_query_condition_cache = 1) reutilizaba una exclusión de marcas derivada de un skip index para una consulta que ejecutaba un conjunto distinto de skip indexes, por ejemplo conuse_skip_indexes = 0,ignore_data_skipping_indiceso un modo diferente deuse_skip_indexes_for_disjunctions. Las entradas de caché derivadas de skip indexes ahora se indexan según el conjunto efectivo de skip indexes que se ejecutó. #108548 (Groene AI). - Se corrigieron varios errores en
changeYear,changeMonth,changeDay,changeHour,changeMinuteychangeSecondcon argumentosDateTime64: la columna de resultado se creaba con la escala predeterminada 3 codificada de forma fija en lugar de la escala del argumento, lo que provocaba unLOGICAL_ERROR(writeSlice expects same column types) cuando el resultado se pasaba aarrayPushBack/arrayPushFront/arrayConcat; las entradas con precisión de nanosegundos (escala 9) generabanDECIMAL_OVERFLOW; y las entradas con fracciones de segundo anteriores al epoch devolvían un segundo de calendario incorrecto. También se corrigió quetimeSlotssobreDateTime64ignorara la escala del argumento opcionalSizeen su tipo de retorno declarado y devolviera timestamps incorrectos para la escala más alta enSize. #108551 (Groene AI). #108681 (Takumi Hara). #108994 (Groene AI). - Corrige el error
NOT_FOUND_COLUMN_IN_BLOCKcuando se asigna un alias a un predicado compuesto enGROUP BYy luego se vuelve a hacer referencia a él, conenable_identifier_resolve_cachehabilitado (valor predeterminado). #108553 (Groene AI). - Corrige un error lógico (
Equal values are not contiguous within the range assumed to be sorted) al ejecutarDISTINCTsobre una lecturaSTREAM(SELECT DISTINCT ... FROM table STREAM). Las optimizaciones de lectura en orden ya no se aplican a las lecturasSTREAM, que producen filas en orden de commit en lugar de en el orden de la clave de ordenación. #108568 (Groene AI). - Se corrigieron las proyecciones que devolvían el valor predeterminado del tipo de una columna (por ejemplo,
0) en lugar de su valorDEFAULTdeclarado (por ejemplo,-1) en dos casos: al leer una columna añadida conALTER TABLE ... ADD COLUMN ... DEFAULTdespués de crear la proyección (las lecturas desde la tabla base ya eran correctas), y después de que expirara elTTLde la columna en una wide part. #108569 (Shaohua Wang). #109013 (Shaohua Wang). - Se corrigió un error
ReadBuffer is canceled. Can't read from it.que podía producirse al reintentar una carga a S3 (por ejemplo, una copia de seguridad) después de un error transitorio de lectura. #108573 (Groene AI). - Corrige que
ATTACH PARTITION ... FROMrechazara tablas cuyas claves primarias son equivalentes pero están declaradas de forma distinta (una conPRIMARY KEYexplícita y la otra implícita a partir deORDER BY). #108590 (Jordi Orihuela). - Se corrigió el fallo de direct read desde el text index cuando varios text indexes están materializados parcialmente. Corrige #108530. #108607 (Anton Popov).
- Corrige una divulgación de metadata por la que
DESCRIBE loop('db', 'table')yDESCRIBE loop(<inner table function>)omitían la comprobación de acceso aSHOW COLUMNSo al origen, lo que permitía a un usuario sin privilegios leer el esquema de columnas de una tabla. #108624 (Groene AI). - Se corrigió la columna virtual
_etagpara los table enginesS3QueueyAzureQueue: estaba declarada, pero nunca se poblaba, por lo queSELECT _etagsiempre devolvía una cadena vacía. Ahora devuelve el ETag del objeto, igual que el engineS3y la table functions3. #108625 (Groene AI). - Se corrigió la lectura de archivos
Arrow,ArrowStreamyORCbasados en Arrow cuya columna timestamp tiene un desplazamiento UTC numérico fijo (por ejemplo,+05:30,-08:00,00:00) o el marcador no IANAfixedcomo timezone, lo que antes fallaba conCannot load time zone ...(BAD_ARGUMENTS). #108633 (Groene AI). - Se corrigió una excepción (
LOGICAL_ERROR: Join is supported only for pipelines with one output portoNOT_IMPLEMENTED: MergeJoinAlgorithm is not implemented for strictness Semi) cuando se usabajoin_algorithm = 'full_sorting_merge'para un joinSEMI/ANTI, incluidos los joins generados al descorrelacionar una subquery correlacionadaEXISTS.full_sorting_mergeahora descarta las combinaciones de strictness/tipo que no puede ejecutar, de modo que el planificador recurre a otro algoritmo habilitado o informa de que el join no puede ejecutarse. #108658 (Groene AI). - Se corrigió un desbordamiento de búfer en el montón al construir un text index con
positions = 1sobre muchos tokens cortos distintos. #108659 (Groene AI). - Una consulta que lee de S3 o escribe en S3 y se cancela (p. ej., con
KILL QUERY) mientras hay una s3 request en curso ahora se informa como cancelada, en lugar de mostrar un error de red/S3 engañoso. En particular, un backup o restore cancelado en S3 ahora informaBACKUP_CANCELLED/RESTORE_CANCELLEDensystem.backups. #108673 (Julia Kartseva). - Se corrigió un fallo de inicio en el que una database
DataLakeCatalogcreada por una versión anterior (25.12 o anterior) con unauth_headermalformado no podía adjuntarse después de actualizar a la versión 26.2 o posterior, lo que impedía que el server arrancara. Ahora,auth_headerse valida solo enCREATE, y enATTACHel catalog se construye de forma diferida en el primer uso en lugar de durante el arranque, de modo que una sola database de catálogo mal configurada o inaccesible ya no bloquea el inicio del server. #108674 (Groene AI). - Se corrigió un logical error (
Sort order of blocks violated) durante una fusión, así como lecturas incorrectas, cuando un elementoLowCardinalityno anulable de una columnaNullable(Tuple(...))se usa como subcolumn (por ejemplo, como clave de ordenación). #108679 (Groene AI). - Se corrige un posible crash (use-after-free) cuando
SYSTEM FLUSH DISTRIBUTEDse ejecuta de forma concurrente conDROP TABLEde la misma tablaDistributed. #108684 (Groene AI). - Se corrige un crash en la decodificación Base64 de la key de la cuenta de Azure, alcanzable mediante
azureBlobStorage(y las table functions y storages relacionadas de Azure) cuando la key no es un Base64 válido: un byte>= 0x80provocaba una lectura fuera de límites, y cualquier byte no válido provocaba comportamiento undefined. Las keys no válidas ahora se rechazan correctamente. #108716 (Groene AI). - Se corrige el error
NUMBER_OF_COLUMNS_DOESNT_MATCHcuando una subquery sobre una tablaDistributedlee dos o más columnasALIASque se expanden a la misma expression (por ejemplo,a1 String ALIAS toString(x), a2 String ALIAS toString(x)) y la subquery alimenta una consulta externa, p. ej.SELECT count() FROM (SELECT a1, a2 FROM dist GROUP BY a1, a2). #108725 (Groene AI). - Se corrigió que
CREATE OR REPLACE MATERIALIZED VIEW ... POPULATEdejara la nueva vista materializada sin suscribirse a su source table, lo que descartaba silenciosamente cada fila insertada después del reemplazo. #108728 (Alexey Milovidov). - Se corrige una excepción (
Cannot find sharding key column, y en builds de depuración y con sanitizador un aborto del server) cuando la sharding key de una tablaDistributedes una expression que el analyzer pliega como constante, por ejemploif(1, toInt32(id), toInt32(id) + 1), conoptimize_skip_unused_shards = 1. #108737 (Groene AI). - Se corrigió un logical error (
Bad cast from type DB::ColumnNullable to DB::ColumnString) y posibles resultados incorrectos al usargroup_by_use_nullscon una grouping key constanteLowCardinalityenGROUPING SETS/ROLLUP/CUBE. #108771 (Alexey Milovidov). - Se corrigió que la poda de particiones y de la clave primaria se desactivara silenciosamente cuando una columna clave
LowCardinality(FixedString)(oLowCardinality(Nullable(FixedString))) se envolvía en una función dentro de la clave, por ejemploPARTITION BY sipHash64(k) % NconWHERE k = 'literal'. Estas consultas escaneaban todas las particiones en lugar de descartarlas mediante poda. #108777 (Groene AI). - Se corrigió un error lógico (una terminación del servidor en compilaciones de debug y con sanitizador) cuando un
INSERT ... SELECTa través de una tablaAlias, o en una tablaTimeSeries, se cancela sin una excepción, por ejemplo contimeout_overflow_mode = 'break'. #108783 (Groene AI). #108796 (Shaohua Wang). - Se corrigió el error lógico
Bad cast from type DB::ColumnSparse to DB::ColumnString(una terminación del servidor en compilaciones de debug y con sanitizador) cuandogroupConcatse aplica a unaTuplecuyo elementoStringse almacena de forma dispersa. #108790 (Groene AI). - Se corrigió
TYPE_MISMATCHenmapFilter,mapSort,mapReverseSort,mapPartialSortymapConcatcuando un valorMapcontiene unMapanidado conLowCardinality, p. ej.,mapFilter((k, v) -> 1, map('a'::LowCardinality(String), map('x'::LowCardinality(String), 'y'))). #108798 (Groene AI). - Se corrigió que
insert_quorum = 'auto'no rechazara las inserciones de inmediato cuando había menos de la mayoría de las réplicas activas. Ahora esas inserciones fallan inmediatamente conTOO_FEW_LIVE_REPLICASen lugar de escribir una parte local y más tarde agotar el tiempo de espera conUNKNOWN_STATUS_OF_INSERT. #108800 (Gagan Dhakrey). - Se corrigió un bug por el que la fila
WITH TOTALSde unJOINpodía contener valores predeterminados (como0) en lugar de los valores constantes procedentes de una subconsulta constante en uno de los lados del join. El resultado incorrecto aparecía solo con determinados órdenes de join o con la configuraciónquery_plan_join_swap_table. #108807 (Vladimir Cherkasov). - Se corrigió un fallo de segmentación (desreferenciación de puntero nulo) que podía producirse cuando el apagado del servidor coincidía con el apagado de una tabla
S3Queue/AzureQueue. #108810 (Miсhael Stetsyuk). - Se corrigió una interrupción durante el arranque (
Cannot allocate ThreadStack,EINVAL) en compilaciones con glibc que se ejecutaban en CPU con un tamaño grande de pila de señales (por ejemplo, Intel Sapphire Rapids / Granite Rapids con un kernel compatible con AMX), donde el tamaño de la pila alternativa de señales no se redondeaba a un múltiplo del tamaño de página. #108813 (Groene AI). - Se corrigió que las consultas distribuidas fallaran ocasionalmente con
UNEXPECTED_PACKET_FROM_SERVER(expected TablesStatusResponse, got ProfileInfo) cuando se reutilizaba del pool una conexión que una consulta cancelada anterior había dejado desincronizada. #108854 (Alexey Milovidov). - Se corrigió un error lógico (una excepción en builds de release y un aborto del server en builds de debug y con sanitizador) que podía producirse en una llamada a función con más de un argumento
LowCardinalitysobre una tabla distribuida; por ejemplo,concatAssumeInjective((SELECT toLowCardinality('p')), s)usada como clave deGROUP BYcon la table functionremote. Los mensajes eranDefault functions implementation for LowCardinality is supported only with a single LowCardinality argumentoExpected the argument ... to have N rows, but it has M. #108871 (Groene AI). - Se corrigió
reinterpret(x, 'Decimal128(scale)')(y los destinosDecimal32/Decimal64/Decimal256/DateTime64), que producía una columna de resultado cuya scale interna era la scale de origen en lugar de la scale de destino solicitada cuando el origen y el destino tenían el mismo tipo físico. Los valores eran correctos, pero el objeto columna era estructuralmente inconsistente con su tipo declarado. #108878 (Groene AI). - Se corrigió un
LOGICAL_ERROR(New empty part is about to materialize but the directory already exist) que podía abortar el server en builds de debug y con sanitizador cuando una operaciónDROP/DETACH/MOVE/REPLACE PARTITIONsobre una tablaMergeTreese ejecutaba después de que una operación previa de ese tipo se interrumpiera (por ejemplo, por una transaction revertida o un fallo) y dejara un directorytmp_empty_<part>obsoleto. Ahora ese directory obsoleto se recupera en lugar de provocar un fallo. #108879 (Groene AI). - Se corrigió que ClickHouse Keeper devolviera un
dataLength = 0incorrecto en elStatde las respuestasCreate2, y que el cliente ZooKeeper de ClickHouse no deserializara elStatde las respuestasCreate2. #108909 (unintended). - Se corrigió que
clickhouse-localrechazara un valor de opción vacío escrito junto a=(por ejemplo,--format_csv_null_representation=''); ahora se comporta igual que--format_csv_null_representation ""ySET format_csv_null_representation = ''. #108910 (Vismay). - Se corrigió un
LOGICAL_ERROR(Inconsistent AST formatting) que abortaba el server en builds de debug y con sanitizador al dar formato a un tipo de datoTupleque mezcla elementos con nombre y sin nombre (por ejemplo,Tuple(a UInt8, UInt16)). #108915 (Groene AI). - Se corrigió una falla de segmentación al fusionar estados de agregación de
uniqExactconGROUPING SETS,ROLLUPoCUBEymax_threads > 1. #108928 (Raúl Marín). - Se corrigieron posibles resultados incorrectos o lecturas fuera de límites cuando se revierte un
INSERTtras un error a mitad del lote (por ejemplo, en tablasBuffer, inserciones asíncronas o los enginesKafka/RabbitMQ/FileLog) mientras está habilitada la replicación diferida de columnas (enable_lazy_columns_replication). #108935 (Groene AI). - Ahora
join_any_take_last_rowse respeta en todas las rutas compatibles de join basadas en hash, incluidas las joins que usan spilling to disk automático. #108936 (János Benjamin Antal). - Se corrigió un bug en el analyzer por el que
FINALen una tabla de unJOIN(p. ej.,FROM t1 FINAL JOIN t2) también se aplicaba incorrectamente a las demás tablas unidas, lo que podía ralentizar esas consultas. #108979 (Vladimir Cherkasov). - Corrige un
LOGICAL_ERROR(“Cannot find__grouping_setcolumn in header of MergingAggregatedTransform with grouping sets”, o “Chunk info was not set for chunk in MergingAggregatedTransform”) que podía producirse, con el analizador deshabilitado, en unUNION ALL/INTERSECT/EXCEPTdonde una rama usaGROUP BY GROUPING SETScon réplicas en paralelo y otra rama usaFINAL. #109003 (Groene AI). - Corrige un
LOGICAL_ERRORen el planificador automático de réplicas en paralelo que podía producirse cuandoautomatic_parallel_replicas_modeestá habilitado junto conparallel_replicas_min_number_of_rows_per_replicamayor que 0. #109011 (Groene AI). - Corrige una asignación excesiva de memoria durante la inferencia de esquemas del formato
MsgPack: una entrada corrupta cuyo encabezado de array/map/string/binary declara un número enorme de elementos ya no provoca una única asignación de varios gigabytes y se rechaza como entrada malformada. Esto corrige una condición de falta de memoria en compilaciones de lanzamiento (y un abortoallocation-size-too-bigcon sanitizadores). #109019 (Groene AI). - Corrige que
use_client_time_zonese ignorara para literales de cadenaDateTime/DateTime64interpretados en el servidor (INSERTasíncrono, literalesSELECT). El client ahora propaga su zona horaria local comosession_timezonecuandouse_client_time_zoneestá habilitado, de modo que el análisis del lado del servidor coincida con la ruta deINSERTsíncrona. #109051 (Groene AI). - Corrige el error
NOT_FOUND_COLUMN_IN_BLOCKcuandoquery_plan_optimize_lazy_finalestá habilitado junto con un filtroWHEREtransferido parcialmente aPREWHERE(medianteoptimize_move_to_prewhere_if_final). #109073 (Groene AI). - Corrige un error al usar un asterisco calificado como
b.*en una consulta dondebes un alias de tabla (o subconsulta/CTE) que comparte nombre con una columna no compuesta de otra tabla. Estas consultas ya no fallan y seleccionan correctamente todas las columnas deb. #109078 (Vladimir Cherkasov). - Corrige un error lógico
Block structure mismatch in JoinStep(un aborto del servidor en compilaciones de depuración y con sanitizadores) cuando una subconsulta correlacionada se decorrelaciona en un join y la relación de origen lleva el mismo nombre de columna más de una vez, por ejemploWITH t AS (SELECT number, * FROM numbers(3)) SELECT *, (SELECT t.number WHERE t.number >= 0) FROM tconcorrelated_subqueries_default_join_kind = 'right'. #109114 (Groene AI). - Corrige un bloqueo por el que una consulta que leía a través de la filesystem cache podía seguir esperando una descarga en curso después de cancelarse con
KILL QUERY, y por el que eliminar o aplicarSYSTEM STOP VIEWa una vista materializada actualizable cuya actualización se hubiera quedado atascada en esa espera podía bloquearse. #109116 (Murphy). - Corrige que la configuración
parallel_view_processingse ignorara al insertar en una tabla con vistas materializadas: desde la versión 25.10, las vistas siempre se ejecutaban en paralelo independientemente de esta configuración. #109170 (Antonio Andelic). - Corrige una inconsistencia del analizador por la que una lista de columnas de
INSERTaceptaba un selector de columnas calificado escrito comot.* LIKE '<pattern>'/t.* ILIKE '<pattern>', pero rechazaba su forma canónicat.COLUMNS('<regexp>'), rompiendo el recorrido de ida y vuelta del formato de consulta (y provocando el aborto del servidor en compilaciones de depuración y con sanitizadores). #109176 (Groene AI). - Se corrigieron los incrementos no monotónicos de
ProfileEvents: los contadoresNetworkReceiveBytesyAIOWriteBytespodían incrementarse en una cantidad negativa (desbordándose hasta un valor enorme) en caso de timeout de socket o fallo de AIO, yMemoryOvercommitWaitTimeMicrosecondsse medía con un reloj no monotónico. #109180 (Azat Khuzhin). - Se corrigió la inferencia de esquema para los formatos
Arrow,ArrowStream,Avroy los lectores heredados deORCyParquet, que devolvíanNullable(Tuple)para columnas struct anulables cuando el tipoNullable(Tuple)no está permitido (allow_experimental_nullable_tuple_typeestá deshabilitado).DESCRIBEdevolvía un tipo queCREATE TABLErechaza, por lo que al crear una tabla o insertar datos usando el esquema inferido se producía el errorNullable Tuple type is not allowed. #109185 (Nihal Z. Miaji). - Se corrigió un resultado incorrecto de
EXISTScorrelacionado y de subconsultas escalares cuando la correlación aparece solo en la proyección de la subconsulta junto con una cláusulaWHEREno correlacionada (la subconsulta podía evaluarse como false /NULLpara cada fila). Corrige #105760. #109186 (Dmitry Novik). - Se corrigió que
CREATE USER ... HOST LIKE 'a', 'b'(y elALTER USERequivalente) conservara silenciosamente solo el primer patrón. Ahora todos los patronesHOST LIKEespecificados se almacenan en la lista de hosts permitidos del usuario. #109187 (Groene AI). - Se corrigió que un índice de texto definido sobre
mapValues(map)omapKeys(map)no se utilizara silenciosamente cuando se consultaba una tabla a través de una tabla con motorDistributedusando el analizador. El índice se usaba para la tabla local y mediante las table functionscluster/remote, pero una consulta a través de una tabla con motorDistributedlo omitía (y fallaba conINDEX_NOT_USEDbajoforce_data_skipping_indices). #109188 (Groene AI). - Se corrigió un
LOGICAL_ERRORfalso (There was an error on <host>: Cannot obtain error message (probably it's a bug)) que podía abortar el servidor en compilaciones de depuración y con sanitizador al ejecutar una consulta DDL sobre una base de datosReplicatedcuando su nodo de estadofinishedpor host en Keeper ya se había limpiado. #109192 (Groene AI). - Se corrigió que las proporciones de
SAMPLEcon un exponente cuya magnitud desbordaInt32(por ejemplo,SAMPLE 1e-3000000000) se trataran silenciosamente comoSAMPLE 1. #109197 (Raúl Marín). - Se corrigió la comprobación de acceso para
SYSTEM PREWARM PRIMARY INDEX CACHE ... ON CLUSTER, que incorrectamente requería el privilegioSYSTEM PREWARM MARK CACHEen lugar deSYSTEM PREWARM PRIMARY INDEX CACHE. #109198 (Raúl Marín). - Se corrigió que las consultas
ALTERfallaran para tablasMergeTreecreadas con una configuración personalizada dedisk(SETTINGS disk = disk(...)). Corrige #63019. #109199 (Mikhail Artemenko). - Se corrigió un fallo del servidor al combinar estados de las funciones de agregación
cramersV,cramersVBiasCorrected,contingencyotheilsUprocedentes de un contexto de ventana (OVER ()) y de una agregación simple mediante operaciones de conjuntos encadenadas (EXCEPT,INTERSECT) oUNION ALLanidados, y leerlos después, por ejemplo, mediante el combinador-Merge. #109200 (Groene AI). - Se corrigió un resultado incorrecto en
ANY JOINcon una condiciónONconstante (p. ej.,t1 ANY INNER JOIN t2 ON 1): la consulta devolvía el producto cartesiano completo en lugar del resultado deANY JOIN. #109207 (Vladimir Cherkasov). - Se corrigió un fallo del servidor en inserciones asíncronas con deduplicación cuando
optimize_on_insertdeja vacío el bloque insertado (por ejemplo, filas cuya suma es cero enSummingMergeTree). #109229 (Den Kalantaevskii). - Se corrigió
SYSTEM DROP REPLICAySYSTEM DROP DATABASE REPLICA ... FROM ZKPATHpara que rechacen rutas de ZooKeeper vacías o que solo contengan la raíz en tiempo de análisis conBAD_ARGUMENTS, enruten las rutas auxiliares de Keeper al Keeper especificado y normalicen las rutas de Keeper para que las comprobaciones locales de autoprotección no apunten a la réplica equivocada ni eludan la réplica prevista. #109230 (Groene AI). - Se corrigió la prioridad de la configuración de S3 para que un bloque de endpoint
<s3>con ámbito de URL tenga prioridad sobre los valores predeterminados de<s3>de nivel superior. #109251 (Bharat Nallan). - Se corrigió un error por el que los valores
DEFAULTde una columna no se aplicaban enINSERT INTO TABLE FUNCTION(por ejemplo,remoteofile) con datosVALUESinline cuando el servidor analiza por sí mismo esos datos inline (send_table_structure_on_insert_with_inline_data = 0). UnNULLexplícito insertado en una columna noNullableconDEFAULTpasaba a ser0en lugar del valor predeterminado declarado. Ahora se comporta igual que unINSERTen una tabla normal y que el protocolo HTTP. #109258 (Groene AI). - Se corrigió el fallo de
CREATE TABLE ... AS SELECTdesdes3Cluster(y otras cluster table functions comofileCluster/urlCluster) con errorNOT_FOUND_COLUMN_IN_BLOCKdentro de una base de datosReplicated. #109266 (Groene AI). - Se corrigió que
SHOW TABLESySELECT ... FROM system.tablesdevolvieran resultados distintos en bases de datos de Data Lake Catalog: las tablas que ClickHouse no puede leer ahora se ocultan de forma coherente en ambos casos. #109273 (Smita Kulkarni). - Se corrigió un error por el que, al fusionar una tabla
MergeTreecon proyecciones mientras está habilitada la configuraciónenable_block_number_columnoenable_block_offset_column, se generaban projection parts que contenían una columna_block_number/_block_offsetespuria. La projection part fusionada dejaba entonces de coincidir con la definición de la proyección y con las projection parts generadas por insert, por lo queCHECK TABLEyOPTIMIZE ... DRY RUNla marcaban como corrupta (CORRUPTED_DATA). #109284 (Groene AI). - Ahora se permite leer un
arrayde Avro de registros{key, value}de dos campos en una columnaMapde ClickHouse. Esta es la codificación que Iceberg y Spark generan para unMAP<K, V>con una clave que no es de tipo string (los maps nativos de Avro solo admiten claves string). Antes, ese archivo podía leerse comoArray(Tuple(key, value)), pero no comoMap(K, V), y fallaba conType Map(...) is not compatible with Avro array. #109289 (Groene AI). - Se corrigió un fallo del servidor en
CREATE HYPOTHETICAL INDEX ... TYPE set(yngrambf_v1/tokenbf_v1) cuando se omite el argumento de índice requerido. Estas sentencias ahora se rechazan con un error claro. #109294 (Groene AI). - Se corrigió un
LOGICAL_ERROR(Current component is empty) que podían provocar operaciones de mutation comoKILL MUTATIONen una tablaMergeTreeque almacena sus metadatos en Keeper, cuando la configuración del servidorenforce_keeper_component_trackingestá habilitada. #109297 (Groene AI). - Se corrigió la lectura de timestamps
ORCposteriores aproximadamente al año 2262 en una columnaDateTime64con una scale inferior a 9. El lector nativo deORCsolía convertir cada timestamp mediante un valor intermedio fijoDateTime64(9), lo que provoca un overflow deInt64a escala de nanosegundos y rechazaba esos valores conVALUE_IS_OUT_OF_RANGE_OF_DATA_TYPE, incluso cuando la scaleDateTime64solicitada (por ejemplo,DateTime64(6), como produce Iceberg) puede representar el valor. Ahora los timestamps se leen directamente con la scale solicitada, ydate_time_overflow_behaviorse respeta incluso cuando ni siquiera la scale de destino puede contener el valor. #109302 (Groene AI). clickhouse-local, al actuar como servidor (después deSYSTEM START LISTEN HTTP), ahora sirve conexiones HTTP usando el formato de salida predeterminadoTabSeparated, igual queclickhouse-server, en lugar del predeterminado interactivoPrettyCompact. Esto corrige la conexión aclickhouse-localmediante HTTP con drivers comoclickhouse-connect. La sesión interactiva de terminal sigue mostrando los resultados comoPrettyCompact. #109362 (Alexey Milovidov).- Se corrigió un fallo transitorio
Code: 499 ... InvalidPart(S3_ERROR) en cargas multiparte de S3. MinIO puede informar brevemente de que una part recién subida no está presente enCompleteMultipartUpload; ahora este error se reintenta igual que elNoSuchKeyya manejado, dentro del límite des3_max_unexpected_write_error_retries. #109364 (Groene AI). - Se corrigió el error
UNKNOWN_IDENTIFIERenALTER TABLE ... DROP COLUMNcuando otra columna tiene una expresiónDEFAULToMATERIALIZEDque define y hace referencia a un alias en línea. #109374 (Alexey Milovidov). - Se corrigió una carrera de dato (y el consiguiente fallo poco frecuente) en la merge paralela de estados de agregación
uniqExactcon sets de dos niveles, que podía ocurrir conGROUPING SETS,ROLLUPyCUBE. #109389 (Groene AI). - Se corrigió un error (
NOT_FOUND_COLUMN_IN_BLOCK, ostd::bad_function_callen versiones anteriores) al ejecutarCREATE TABLE ... ON CLUSTER ... AS SELECTleyendo una tablaDistributeden un cluster con dos o más shards. #109407 (Alexey Milovidov). - Se corrigieron las merges para tablas con
TTL ... GROUP BY(rollup): las parts que ya estaban completamente agregadas podían volver a programarse para fusionarse una y otra vez indefinidamente, y las tablas con columnasMATERIALIZEDo con columnas virtuales persistentes habilitadas se manejaban incorrectamente; ahora esas columnas se agregan conany. Cierra #105647. #109410 (Mikhail Artemenko). #109532 (Mikhail Artemenko). - Se corrigió el caso de
INcon una array column simple en el argumento derecho, que devolvía silenciosamente un resultado incorrecto (siempre falso) o lanzaba una excepción, de modo quex IN arrahora se comporta comohas(arr, x). #109416 (Alexey Milovidov). - Se corrigieron errores
UNKNOWN_IDENTIFIERen operacionesALTER TABLE(RENAME/ADD/MODIFY COLUMNyMATERIALIZE INDEXen una tabla con partes recién insertadas) en tablasMergeTreecon un índice min-max implícito sobre las columnas virtuales persistentes_block_number/_block_offset(habilitado poradd_minmax_index_for_block_number_column/add_minmax_index_for_block_offset_column). #109428 (Groene AI). #110236 (Groene AI). - Se corrigió un
LOGICAL_ERRORenarrayFoldsobre un argumentoArray(LowCardinality(T))no constante (por ejemplo,arrayFold((acc, x) -> acc + x, materialize([1, 2, 3]::Array(LowCardinality(Int64))), toInt64(0))), que fallaba conArguments of 'plus' have incorrect data types(provocando un aborto del server en compilaciones de depuración y con sanitizadores). #109462 (Groene AI). - Se corrigió
CHECK TABLEen una tablaReplicatedMergeTree, que informaba una parte en buen estado como dañada cuando se producía un error transitorio y reintentable de ZooKeeper (por ejemplo, pérdida de conexión) durante la comprobación; ahora esos errores aparecen como un error de consulta reintentable. #109465 (Alexey Milovidov). - Se corrigieron fallos de segmentación en
groupArrayLastMergey en la función de agregaciónlargestTriangleThreeBuckets: ahora se valida la deserialización de estados de funciones de agregación, para que un estado dañado no provoque un acceso a memoria fuera de los límites. #109485 (Miсhael Stetsyuk). #109492 (Miсhael Stetsyuk). - Se corrigió que no se aplicara el límite global
max_rows_in_join/max_bytes_in_joinal join algorithmparallel_hash, donde una consulta conjoin_overflow_mode = 'throw'podía completarse silenciosamente en lugar de generarSET_SIZE_LIMIT_EXCEEDED. #109488 (Hechem Selmi). - Se corrigió la lectura de tablas Paimon particionadas por una columna
BIGINTcuyo valor no cabe enInt32. Esos valores de partición se truncaban (por ejemplo,9223372036854775807pasaba a-1), lo que producía una ruta de partición incorrecta y provocaba un error del sistema de archivos. #109510 (Groene AI). - Se corrigió un crash al leer tablas Iceberg con archivos de eliminación por igualdad. Si una columna era Nullable en el archivo de eliminación por igualdad pero no anulable en el esquema de la tabla (o viceversa), los valores leídos del archivo de eliminación se insertaban en una columna de otro tipo mediante un cast no verificado (una confusión de tipos de columna), lo que corrompía la columna y hacía fallar el server. #109551 (Miсhael Stetsyuk).
- Se corrigió que
connect_timeouty los timeouts de lectura y escritura de MySQL no surtieran efecto: un intento de conexión a un MySQL server que no respondía podía quedarse bloqueado durante más de dos minutos incluso conconnect_timeout = 1, porque las señales periódicas del sampling query profiler seguían restableciendo el plazo interno de sondeo del cliente MySQL. #109592 (Shaohua Wang). - Se corrigió un
LOGICAL_ERROR(creation_csn is not set while removal_csn is set to 1) que podía producirse cuando unTRUNCATEno transaccional se ejecutaba de forma concurrente con una transacción no confirmada que había insertado en la misma tabla. EseTRUNCATEya no elimina partes creadas por transacciones que aún no se han confirmado. #109598 (Tuan Pham Anh). - Se corrigieron errores
TYPE_MISMATCHal leer columnasstructdeParquetcuya nulabilidad física difiere del tipo de ClickHouse solicitado: ahora un grupoParquetno nullable puede leerse comoNullable(Tuple(...)), y el lector nativo deParquetpuede leer un struct físicamente nullable (un grupoOPTIONALdeParquet) comoNullable(Tuple(...)). #109615 (Groene AI). #109898 (Groene AI). - Se corrigió una pérdida silenciosa de datos cuando un
INSERT ... VALUESen un flujo de múltiples consultas va seguido de un comentario SQL al final (por ejemplo,VALUES (1) -- comment) en la ruta de análisis del insert inline en el servidor (send_table_structure_on_insert_with_inline_data = 0). El comentario final se analizaba como datos de fila más allá del;de terminación, lo que hacía que las consultas siguientes del flujo se omitieran silenciosamente. #109643 (Groene AI). - Se corrigió un segfault cuando una consulta llega en una ventana estrecha durante el apagado del servidor tras un error en el arranque. #109675 (Miсhael Stetsyuk).
- Se corrigieron índices de omisión obsoletos (
text,bloom_filter, etc.) y proyecciones tras materializar actualizaciones ligeras conALTER TABLE ... APPLY PATCHES. Antes, los archivos de índice y proyección que dependen de una columna actualizada mediante patch quedaban sin cambios, por lo que las consultas que los usaban podían devolver resultados incorrectos (por ejemplo,hasTokenomitiendo una fila actualizada, o una proyección devolviendo agregados obsoletos una vez eliminada la patch part ya consumida). #109709 (Groene AI). - Se corrigió que
system.tablesomitiera silenciosamente bases de datos para usuarios con permisos por base de datos cuando la consulta leía solo las columnasname/database. Introducido en 26.2. #109723 (Samay Sharma). - Se corrigió un
LOGICAL_ERRORal escribir una columnaLowCardinality(Time)en el formatoArrowconoutput_format_arrow_low_cardinality_as_dictionary = 1. #109730 (Groene AI). - Se corrigió que
ObjectStorageQueue/AzureQueue(y la función de tablaazureBlobStorage) omitieran silenciosamente objetos cuando el almacenamiento de objetos devuelve una página de listado vacía junto con un token de continuación. Azure Blob Storage hace esto (por ejemplo, cuando un listado cruza un límite interno de partición), y el iterador asíncrono de listados trataba la página vacía como el final del listado y descartaba el token. Ahora sigue el token de continuación. #109761 (Gal Ben Moshe). - Se corrigió que la poda de particiones no devolviera ninguna fila para tablas Iceberg particionadas por una columna de marca temporal (
DateTime64). #109764 (Den Kalantaevskii). - Se corrigió una excepción
ILLEGAL_COLUMNen la funciónconvpara argumentosFixedString; ahora se convierten correctamente aString. Cierra #109670. #109771 (hp). - La función
getClientHTTPHeaderahora trata los nombres de los encabezados sin distinguir entre mayúsculas y minúsculas, de acuerdo con RFC 9110; en particular, el encabezadoauthorizationahora se filtra independientemente de cómo se escriba. Cierra #103957. #109791 (Mikhail f. Shiryaev). - Se corrige un problema por el que
max_execution_time(contimeout_overflow_mode = 'throw') a veces no cancelaba nunca una consulta: cuando el supervisor interno de timeout ya estaba esperando una consulta con una deadline posterior, una consulta con una deadline anterior registrada después podía pasar completamente desapercibida, lo que le permitía seguir ejecutándose mucho más allá de su límite de tiempo. #109792 (Shaohua Wang). - Se corrigió el nombre de archivo de los archivos de metadatos de Iceberg comprimidos con gzip. ClickHouse los escribía como
v{N}.gzip.metadata.json(el token HTTPContent-Encoding), mientras que la especificación de Iceberg espera la extensióngz, es decir,v{N}.gz.metadata.json. Como resultado, Spark y otros lectores de catálogos de Hadoop no podían encontrar los metadatos escritos por ClickHouse. ClickHouse ahora escribev{N}.gz.metadata.jsony sigue leyendo el nombre heredadogzippor compatibilidad con versiones anteriores. #109812 (Groene AI). - Se corrigió el error
NOT_IMPLEMENTED(“Method getDataAt is not supported for Nullable(String)”) que podía producirse en un join conenable_join_runtime_filters = 1(activado por defecto desde la versión 26.2) cuando la clave de join del lado de construcción eraLowCardinality(Nullable(...))con valoresNULLy el runtime filter recurría a su bloom filter. #109824 (Groene AI). - Los engine de base de datos externos (por ejemplo,
PostgreSQL) ya no aplican pushdown de comparaciones de rango (>=,>,<=,<) sobre columnasUUID. ClickHouse y las bases de datos externas ordenan los UUID de forma distinta, por lo que aplicar este pushdown descartaba filas del resultado de forma silenciosa; ahora ClickHouse evalúa esos predicados en su lugar. #109833 (Vismay). - Se corrigió un fallo del servidor cuando se pasaba una expresión lambda donde una higher-order function espera un valor concreto (por ejemplo, el acumulador de
arrayFold, como enarrayFold(lambda, arr, another_lambda)). Estas consultas ahora se rechazan conILLEGAL_TYPE_OF_ARGUMENTen lugar de provocar un fallo cuandoenable_analyzer = 0. #109840 (Groene AI). - Se corrigió que la table function
icebergLocaly el engineIcebergLocaldeclararanazureen lugar delocalcomo su tipo de object storage, lo que hacía que no superaran la comprobación del tipo de disco (Disk type doesn't match) cuando se usaban con un disco local medianteSETTINGS disk = '...'. #109872 (Pedro Ferreira). - Se corrige la lectura de tablas Iceberg particionadas por la misma columna de origen más de una vez (por ejemplo,
PARTITIONED BY (hours(ts), ts)). Anteriormente, estas tablas fallaban conCannot add column ...: column with this name already exists (ILLEGAL_COLUMN). #109895 (Groene AI). - Se corrigen resultados de consulta incorrectos causados por que el índice de clave primaria descartaba incorrectamente gránulos en tablas con una columna clave invertida (
DESC) cuando las partes no tienen marca final (granularidad no adaptativa,index_granularity_bytes = 0). #109901 (Nihal Z. Miaji). - Se corrigió un caso en el que
generateRandomStructureproducía ocasionalmente una cadena de estructura no válida con dos tipos de datos concatenados (por ejemplo,Decimal32(7)IPv4) cuando el anidamiento de tipos superaba el límite interno de profundidad, lo que hacía que el resultado no se pudiera interpretar. #109928 (Groene AI). - Se corrigió el error
NOT_IMPLEMENTED(Method getDataAt is not supported for Nullable(String) in case if value is NULL) al construir un índicetextsobreArray(LowCardinality(Nullable(String)))(incluidos los camposNestedalmacenados de esa forma) cuando un array indexado contiene un elementoNULL. Ahora, los elementosNULLdel array se omiten durante la construcción del índice, en consonancia conArray(Nullable(String)). #110055 (Groene AI). - Se corrigieron resultados incorrectos al construir un skip index
minmaxsobre una columnaLowCardinality(Nullable(...)): antes, los predicadosWHERE/PREWHERE/HAVING ... IS NULLenviados al almacenamiento descartaban todos los gránulos y devolvían 0 filas aunque la columna contenía valoresNULL. #110061 (Groene AI). - Se corrigió
distinct_overflow_mode = 'break':DISTINCTahora devuelve el resultado parcial acumulado hasta el límite y deja de leer el origen, tal como se documenta. Antes, el fragmento que superabamax_rows_in_distinct/max_bytes_in_distinctse descartaba (produciendo resultados truncados o vacíos) y la consulta seguía leyendo e insertando en el conjunto hash hasta el final de la entrada, lo que podía acabar enMEMORY_LIMIT_EXCEEDED. #110075 (Sergey Kuznetsov). - Se corrigió un error lógico
ChunkInfoRowNumbers does not existenOPTIMIZE TABLEde una tabla Iceberg que contenía un archivo de datos en un formato distinto deParquet(por ejemplo,ORC) más reciente que todos los archivos de borrado por posición. #110107 (Alexey Milovidov). - Se corrigieron
max_bytes_in_distinctymax_bytes_in_set: las claves de cadena se almacenan en un arena que no se contabilizaba en las comprobaciones de límites, por lo queDISTINCT/INsobre claves de cadena podían retener más memoria que el límite de bytes por el tamaño completo del payload de la clave (sin límite en la longitud de la clave). Ahora los límites tienen en cuenta el arena, en consonancia con la documentación; las consultas con claves de cadena cercanas a un límite de bytes pueden alcanzarlo antes (correctamente). #110120 (Sergey Kuznetsov). - Se corrigió un
LOGICAL_ERROR(Bad cast from type ColumnLowCardinality to ColumnString) cuandoidentity(o el resultado de una subconsulta escalar) envuelve un valor que contiene unLowCardinalityanidado y la consulta usaWITH TOTALS/WITH ROLLUP. #110138 (Groene AI). - Se corrigió la lectura de archivos
Npycon dimensiones internas de tamaño cero: ahora coinciden el número de filas materializadas y los resultados decountoptimizados y no optimizados. #110146 (Yanjun Qiu). - Se corrigió un aumento de tiempo cuadrático (y la falta de respuesta a
max_execution_time) en aggregation in order al agrupar por varias claves cuyo orden de clasificación es solo un prefijo de la clave de agrupación. #110159 (Alexey Milovidov). - Se corrigió un error lógico (
Unexpected number of columns in result sample block) cuando un filtro que contiene una subconsulta correlacionada (por ejemplo,exists((SELECT ...))) se optimiza conconvert_query_to_cnfooptimize_and_compare_chain. #110187 (Alexey Milovidov). - Se corrigió una excepción (
UNION mode UNION_DEFAULT must be normalized) cuando una mutaciónDELETEoALTER UPDATEusaba una operación de conjuntos (UNION/UNION ALL/UNION DISTINCT/EXCEPT/INTERSECT) dentro de una subconsulta en la condiciónWHEREo en una asignación deUPDATE. #110196 (Alexey Milovidov). - Se corrigió un logical error
ReadBuffer is canceled. Can't read from it.(aborto del servidor en builds de depuración/sanitizador) que podía producirse al leer un archivo zip (por ejemplo, duranteRESTOREdesde una copia de seguridad en zip) después de que una lectura previa del mismo archivo fallara a mitad del flujo. #110197 (Groene AI). - Se corrigieron el apagado lento del servidor y la falta de respuesta de
KILL MUTATIONcuando una mutación conx IN (subquery)estaba construyendo el conjunto de la subconsulta durante el análisis de la clave primaria; ahora la construcción del conjunto se cancela de inmediato. #110198 (Alexey Milovidov). - Keeper ahora rechaza que los ajustes de coordination
max_requests_batch_sizeymax_requests_append_sizese establezcan en0, en lugar de quedarse atascado en un bucle infinito de append-entries en una configuración multinodo. #110200 (Alexey Milovidov). - Se corrigió un error
NOT_FOUND_COLUMN_IN_BLOCKal usarGROUP BY ALLsobre una expresión de tupla junto conORDER BY. #110206 (Alexey Milovidov). - Se corrigió un error
NOT_FOUND_COLUMN_IN_BLOCKenINSERTsobre una tabla que tiene una restricciónCHECKque hace referencia a una subcolumna (comox.nullde una columnaNullableoarr.size0de unArray). #110208 (Alexey Milovidov). - Se corrigió la lectura de tablas Iceberg cuyo orden de clasificación predeterminado hace referencia a una columna que requiere comillas (por ejemplo,
@timestamp). Esas tablas no se podían leer porque elORDER BYde almacenamiento sintetizado se construía a partir del nombre de la columna sin comillas y fallaba al analizarse conSYNTAX_ERROR. #110233 (Groene AI). - Se corrigió que
system.tablespara una base de datosDataLakeCatalog(Iceberg/Glue) abortara toda la consulta o descartara tablas silenciosamente cuando no se podían resolver los metadatos de una sola tabla. Esa tabla ahora sigue apareciendo por nombre con valores predeterminados/NULL para las columnas que necesitan el objeto de almacenamiento abierto (engine,total_rows, etc.), independientemente dedatabase_datalake_require_metadata_access. El acceso directo a la tabla dañada sigue informando el error. #110242 (Groene AI). - Se corrigió un posible fallo (heap-buffer-overflow) cuando una columna de estado de función de agregación de la familia
quantileTDigestse usaba como clave deGROUP BYy era serializada de forma concurrente por varios hilos. #110263 (Groene AI). - Se corrigió que
INSERTen una tablaDataLakeCatalogde Microsoft Fabric / OneLake fallara conIncorrectEndpointError(HTTP 400) al dirigir las escrituras de ADLS Gen2 (DFS) al host del endpoint.dfsen lugar del host.blob. Nota: conremote_url_allow_hosts, ambos hosts de Fabric,.blob(lectura) y.dfs(escritura), deben incluirse en la lista de permitidos paraINSERT. #110290 (Mohammad Lareb Zafar). - Se corrigió un cierre abrupto del server al analizar ciertas consultas PRQL (
SET dialect = 'prql'). Un panic dentro del compiladorprqlchacía que el proceso abortara en lugar de notificarse como un error de consulta. #110316 (Groene AI). - Se corrigieron resultados de consulta incorrectos que se producían silenciosamente cuando una projection part escrita antes de que cambiara el conjunto de columnas de la projection (por ejemplo, tras actualizar entre versiones que materializan de forma distinta el origen de una columna
ALIAS, o después de queALTER TABLE ... MODIFY COLUMNreasigne una columnaALIASusada por una projection) se leía a través de la projection o se fusionaba: la columna faltante se rellenaba con valores predeterminados en lugar de con los datos reales. Ahora esas parts se leen desde la base table, y las fusiones reconstruyen la projection a partir de los datos base. #110328 (Shaohua Wang). - Se corrigió que
ORDER BY ... WITH FILLno respetaramax_execution_timey tardara en cancelarse al generar un rango de relleno grande (especialmente conINTERPOLATE). #110332 (Alexey Milovidov). - Se corrigió un logical error (un cierre abrupto del server en builds de depuración/sanitizador) cuando se ejecutaba un
ALTERcon varios comandos, comoUPDATE ..., DELETE ..., sobre una tabla Iceberg. Ahora esas mutations se rechazan con un errorNOT_IMPLEMENTEDclaro. #110347 (Groene AI). - Se corrigió un bug del parser por el que
COMMENTse interpretaba incorrectamente como un alias implícito cuando una consultaSELECTterminaba justo después de un identificador de tabla simple (p. ej.,... FROM t COMMENT 'x'), lo que provocaba un error de sintaxis engañoso en lugar de aplicar el comentario a la vista/tabla. #110372 (Aditya Kumar). - Se corrigió un fallo del server (desbordamiento nativo de pila) al copiar o destruir un literal
Array/Tuple/Map/Objectprofundamente anidado, por ejemplo, una consulta con un literal muy profundamente anidado con unmax_parser_depthelevado. #110393 (Raúl Marín). - Se corrigieron dos casos en los que vector search podía devolver menos filas de las esperadas: los valores de
vector_search_index_fetch_multiplierinferiores a 1.0 podían truncar a cero el recuento de fetch calculado y producir un resultado vacío (ahora esos valores se rechazan), y ahora la optimization de vector search se omite para consultasLIMIT ... WITH TIES, porque la optimization limitaba la búsqueda a exactamente N candidatos y descartaba filas empatadas con la N.ª fila. #110452 (Tamish Mhatre). #110453 (Tamish Mhatre). - Se corrigieron el logical error
Expected CommonSubplanReferenceStep to reference CommonSubplanStep, el errorSubplan cannot be used to build pipeliney el logical errorTrying to extract chunk from ChunkBuffer before all inputs are finishedparaIN (subquery)cuando la subquery contiene una subquery correlacionada y el set se construye durante el análisis de índices. #110491 (Alexey Milovidov). - Se corrigió la sustitución de query parameters dentro de las definiciones de una cláusula
WINDOWcon nombre. Anteriormente, los parameters allí permanecían sin sustituirse de forma silenciosa, y un parámetroIdentifierno establecido podía provocar la excepciónLogical error: '!part.empty()'duranteEXPLAIN SYNTAX. #110506 (Alexey Milovidov). - Se corrigió un fallo al iniciar el server para tablas
MergeTreeen object storage disks cuando un archivo residualtxn_version.txt.tmpdeja corruptos los metadata a nivel de disco. #110519 (Alexey Milovidov). - Se corrige un error lógico en la filesystem cache (
Expected file ... not to exist) que podía producirse cuando una descarga de caché en segundo plano fallaba con un error no relacionado con el sistema de archivos (por ejemplo, al ejecutarOPTIMIZEen una tabla Iceberg), y dejaba un archivo de caché huérfano y vacío. #110549 (Groene AI). - Se corrige la lectura de un stream en formato
Nativecorrupto cuyo recuento de tiposDynamico de rutasJSON/Objectse acerca aSIZE_MAX: ahora esa entrada malformada se rechaza con un errorINCORRECT_DATAclaro en lugar de unstd::length_errorno controlado. #110590 (Alexey Milovidov). - Se corrige un fallo del servidor en el database engine
MaterializedPostgreSQLque podía producirse cuando una tabla se detached (o cambiaba su estructura) mientras todavía estaba en cola para sincronizarse. #110596 (Alexey Milovidov). - Se corrige el comportamiento incorrecto de
SET param_<name>en el cliente (y de las opciones--param_<name>) cuando el nombre del parámetro coincide con el setting name de una configuración integrada, comolimit,offset,max_threadsolog_comment. Según el ajuste en conflicto, la consulta fallaba conCANNOT_PARSE_QUOTED_STRING, el valor se normalizaba silenciosamente (p. ej.,max_threads=0pasaba aauto(N)), o se perdía un nombre de alias del ajuste. Ese parámetro también rompía todos losSET param_*posteriores en la misma sesión. #110597 (Raúl Marín). - Se corrige la lectura de subcolumns de una columna que tiene una expresión
DEFAULTy no está materializada en una part (p. ej., después deALTER TABLE ADD COLUMNo duranteALTER TABLE MATERIALIZE COLUMN): la subcolumna se rellenaba con los valores predeterminados del tipo en lugar de con la expresiónDEFAULTevaluada, y las funciones transpuestas de distancia vectorial (cosineDistanceTransposedy otras) sobre esas columnasQBitfallaban con el errorSIZES_OF_ARRAYS_DONT_MATCH. Esto cierra #110634. #110636 (Alexey Milovidov). - Se corrige un
LOGICAL_ERRORInvalid partition key size: 0que podía hacer fallar unINSERTen una tablaMergeTreeparticionada connon_replicated_deduplication_windowhabilitado, cuando un lote de async insert solo se deduplicaba parcialmente (algunos valores deinsert_deduplication_tokeneran duplicados y otros eran nuevos). #110651 (Groene AI). - Un flush en segundo plano de una inserción asíncrona ahora se detiene rápidamente cuando se cancela con
KILL QUERY; antes, el vaciado de una carga grande almacenada en búfer seguía analizándose hasta el final e ignoraba la cancelación. #110652 (Shaohua Wang). - Se corrigen resultados incorrectos de
GROUP BYconoptimize_aggregation_in_ordery deDISTINCTconoptimize_distinct_in_orderaplicados sobre un JOINpartial_merge. La optimización de lectura en orden se propagaba a través del join partial-merge, que vuelve a ordenar su entrada izquierda por la clave de join y, por tanto, no conserva el orden original del stream izquierdo, por lo que las filas se agrupaban de forma incorrecta. #110671 (Groene AI). - Se corrige un overflow de entero con signo en
toStartOfIntervalcon un recuento extremo de intervalosMONTH,WEEKoDAYsobre valoresDate/Date32/DateTime64. #110688 (Groene AI). - Se corrige el error
NOT_FOUND_COLUMN_IN_BLOCKen consultas con una subconsulta enFROMcuando las réplicas paralelas se ejecutan en modocustom_key_sampling/custom_key_range. Estas consultas (p. ej.,SELECT * FROM (SELECT id, k, v FROM t WHERE id < 20) ORDER BY k) antes fallaban conNot found column __table2.id in block .... #110690 (Groene AI). - Se corrigió que
readWKTrechazara cadenas WKT con espacios iniciales (p. ej.,readWKT(' POINT(1 2)')), que sí aceptan los lectores tipadosreadWKTPoint/readWKTPolygon/… y la gramática WKT. #110706 (Groene AI). - Se corrige un error lógico (
Column ... already added for reading, una interrupción del servidor en compilaciones de debug/sanitizador) cuando el mismo predicado de índice de texto se usa tanto enPREWHEREcomo enWHEREde una consulta sobre una tablaMergeencima de una tablaDistributed. #110710 (Groene AI). - Se corrige el error
NOT_FOUND_COLUMN_IN_BLOCKen las funciones de distancia transpuestas sobre columnasQBit(comocosineDistanceTransposed) llamadas con una subconsulta escalar o un vector de referencia constante cuando las réplicas paralelas están habilitadas. Esto cierra #110719. #110729 (Alexey Milovidov). - Se corrige un raro
LOGICAL_ERROR(Unexpected number of parts to remove from parts_queue; una interrupción del servidor en compilaciones de debug/sanitizador) enReplicatedMergeTreecuando dos operaciones de partición (por ejemplo, dos consultasMOVE PARTITION/REPLACE PARTITION, o una en carrera con unDROP_RANGEen segundo plano) cancelaban al mismo tiempo la comprobación en segundo plano de partes sobre rangos superpuestos. #110738 (Groene AI). - Se corrigió un error lógico
Hash is not set for serializationque podía producirse cuando una columna con un códecQuantized(...)estaba envuelta dentro de otra serialización, por ejemplo en una tablaMergesobre fuentes cuya columna del mismo nombre tiene tipos distintos (fusionados en unVariant). #110776 (Groene AI). - Se corrige un bloqueo del servidor al multiplicar un estado de función de agregación
median/quantilepor una constante entera enorme (p. ej.,medianState(x) * 18446744073709551615). La consulta dejaba de responder a la cancelación y podía ejecutarse indefinidamente. #110779 (Groene AI). - Se corrige una caída del servidor (división entera por cero) cuando se consumía una cuota con un intervalo de longitud cero (por ejemplo,
CREATE QUOTA q FOR INTERVAL 0 SECOND MAX queries = 1000). Ahora se rechaza al crearla cualquier duración de intervalo de cuota no positiva. #110846 (Pedro Ferreira). - Se corrigió que
throwIf(notLike(col, pattern))(y otrosthrowIfaplicados sobre una función) lanzara una excepción incondicionalmente cuandocolesLowCardinality. La implementación predeterminada deLowCardinalityejecutabathrowIfsobre todo el diccionario, que siempre contiene el valor predeterminado reservado incluso cuando ninguna fila lo referencia, por lo que un valor distinto de cero en esa posición no utilizada hacía quethrowIflanzara una excepción para datos que no cumplen la condición. #110864 (Groene AI). - Propaga los roles activos de una consulta (
SET ROLEo el parámetrorole) a los nodos remotos en lecturas con réplica paralela yDistributedsobre un clúster protegido con un secreto interserver; anteriormente, los nodos remotos recurrían a los roles predeterminados del usuario y evaluaban las políticas de fila de forma distinta al iniciador. #110867 (Nikolay Degterinsky). - Se corrigió que las tablas Iceberg produjeran ID de campo duplicados después de
ALTER TABLE ... ADD COLUMNcuando el esquema inicial contiene campos anidados (Tuple/Array/Map).last-column-idahora registra el ID de campo máximo asignado, incluidos los hijos anidados, por lo que una columna añadida posteriormente ya no reutiliza un ID de campo anidado y las lecturas ya no fallan conICEBERG_SPECIFICATION_VIOLATION(Duplicate field id). #110884 (Groene AI). - Se corrigió un fallo en compilaciones FIPS al usar una clave SSH Ed25519 (
CREATE USER ... IDENTIFIED WITH ssh_key ... TYPE 'ssh-ed25519', o una clave de ese tipo enusers.xml). Ed25519 no está aprobado por FIPS; esas claves ahora se rechazan con un errorLIBSSH_ERRORclaro. #110891 (Konstantin Bogdanov). - Se corrigieron los resultados de precisión reducida de las funciones de distancia transpuestas sobre columnas
QBit(cosineDistanceTransposed,L2DistanceTransposed,dotProductTransposed). Los valores truncados aprecisionplanos de bits se reconstruían rellenando con ceros los bits descartados, lo que sesgaba todos los valores reconstruidos hacia cero y producía un caso degenerado con baja precisión: paraQBit(BFloat16)con precisión 1, solo sobrevive el bit de signo, por lo que todos los valores se reconstruían como±0.0y la distancia era la misma constante para cada fila, sin aportar información de ranking. Los valores truncados ahora se reconstruyen al punto medio acotado de la celda de precisión restante (los códigosInt8sin procesar a su centro de celda; se conservan los ceros exactos y los infinitos), de modo que unaprecisionmenor intercambia exactitud por velocidad sin producir resultados excesivamente sesgados. Los resultados de precisión completa no cambian. Esto cierra #110898. #110911 (Alexey Milovidov). - Se corrigió un fallo del servidor (use-after-free) durante un apagado ordenado después de consultar tablas Iceberg desde sesiones que también usaban tablas temporales. #110914 (Miсhael Stetsyuk).
- Se corrigió un
LOGICAL_ERROR: Cannot sum Bools(un abort del servidor en compilaciones de depuración/sanitizador) al fusionar estados de agregaciónsumMap/sumMapWithOverflow/sumMapFilteredcon valoresBoolque se habían serializado en el formato de estado antiguo (versión 0). La misma corrección también arregla dos casos silenciosos de resultados incorrectos con estadosBoolde versión 0: las claves de mapa de tipoBoolno se deduplicaban entre estados, y la compactación de valores cero eliminaba las entradas incorrectas. #110922 (Groene AI). - Se corrigió un fallo cuando una función de agregación con el combinador
-Tuplese usaba conRESPECT NULLSy producía un estado intermedio (-State, agregación distribuida,WITH ROLLUP/WITH CUBE). La función combinada tomaba el nombre de la variante de estado incorrecta, por lo que su tipoAggregateFunctionserializado volvía a resolverse a una disposición en memoria incompatible al hacer un round-trip. #110930 (Groene AI). - Se corrigió que
PREWHERE(y las policies a nivel de fila) sobre una columna Iceberg renombrada por schema evolution devolviera silenciosamente0filas para data files antiguos. Esas consultas ahora devuelven las filas correctas, igual queWHERE. #110941 (Groene AI). - Corrige un
LOGICAL_ERROR(LazyMaterializingTransform: Number of rows in lazy chunk N does not match number of offsets M) que podía producirse en consultas de vector search convector_search_with_rescoring = 1combinadas con materialización diferida cuando varias distancias empataban. #111003 (Groene AI). - Se corrigió la lectura de datos
Arrow/ArrowStreamcon columnas anidadasArray/Mapvacías generadas por Apache Arrow Java < 19.0.0 (incluido con Apache Spark), que antes se rechazaban con un errorINCORRECT_DATAporque el búfer de desplazamiento era demasiado pequeño. #111101 (Raúl Marín). - Corrige lecturas obsoletas en discos
plain_rewritablecon la page cache habilitada. #111105 (Mikhail Artemenko). - Corrige el error
CANNOT_CONVERT_TYPEpara constantes de tipoVariant(incluidoGeometry) en consultas distribuidas y consultas con réplicas paralelas. #111136 (Nikita Fomichev). - Corrige un error por el que la lectura de archivos grandes desde HDFS podía fallar o devolver datos incorrectos cuando una única solicitud de lectura superaba el límite de tamaño de 32 bits de
hdfsPread(INT_MAX). #98470 (Arup Chauhan). - Corrige el uso incorrecto del text index en comparaciones de igualdad con una cadena de búsqueda vacía. #108340 (Robert Schulze).
- Se corrigió un bloqueo en
SYSTEM SYNC MERGEScon el merge selectorManualcuando no se podía colocar una merge programada en un background pool lleno. #108770 (Alexey Milovidov). - Corrige que
ATTACH TABLE ... AS REPLICATEDdescartara datos committed y resucitara filas anteriores a la mutation cuando quedaba un archivotxn_version.txt.tmpobsoleto en una data part. #108772 (Alexey Milovidov). - Corrige una posible race condition en
ALTER TABLE ... MOVE PARTITION TO TABLEcon tablasMergeTreeno replicadas que podía producir data parts intersectadas, porque el commit de las partes movidas y la asignación del número de bloque no estaban bajo el mismo lock. #108922 (Mikhail Artemenko). - Corrige la lectura de tablas
Icebergescritas por Databricks UniForm, que escribe un esquema placeholder degenerado (con una lista de campos vacía) en los manifest files. #108945 (Konstantin Vedernikov). - Corrige un use-after-free al leer una tabla
Hivesin partición con varios hilos. #109164 (Alexey Milovidov). - Corrige que el log level de la consola no volviera a su valor original tras el inicio del server cuando se establece
logger.startup_console_log_level: el nivel se tomaba de la clave de configuration incorrecta, por lo que la consola permanecía en el Startup level elevado durante toda la lifetime del server. Cierra #103472. #109858 (Garrett Thomas). - Corrige anomalías de aislamiento de snapshot en transacciones de metadata del disco
plain_rewritable. Corrige #92055. #110948 (Mikhail Artemenko). - Corrige un abort (
front() called on an empty vector) enclickhouse-client --logincuando el host no se pasaba como argumento--hostexplícito, por ejemplo, cuando provenía de--connection, del archivo de configuración o de la variable de entornoCLICKHOUSE_HOST. Cierra #103603. #110279 (Christoph Wurm). - Corrige un error lógico (
!part.empty()) cuando un argumento lambda es un identificador entre acentos graves cuyo nombre contiene un punto (por ejemplo,__table1.). Antes, esa consulta producía una excepción controlada en compilaciones release y abortaba el servidor en compilaciones de depuración y con sanitizador al formatear un mensaje de error. #108735 (Groene AI). - Corrige un
LOGICAL_ERROR(No set is registered for key) en mutacionesALTER TABLE ... DROP COLUMN,ALTER TABLE ... DELETE/UPDATEyDELETE FROMlightweight, en tablas que tienen una columnaALIAScuya expresión usa un operadorIN(incluso a través de otra columnaALIAS). #111039 (Pedro Ferreira). - Corrige una pérdida silenciosa de datos con async inserts y deduplicación (
async_insert=1,async_insert_deduplicate=1). Cuando varias entradas de inserción asíncrona con valoresinsert_deduplication_tokendistintos se consolidaban en un único flush que escribía en particiones disjuntas, cada token se registraba en el log de deduplicación de cada partición afectada por el flush, y no solo en la partición en la que acababan sus propias filas. Después, una inserción posterior que reutilizaba uno de esos tokens en una partición en la que nunca había escrito se deduplicaba silenciosamente. Ahora los tokens se registran solo en la partición en la que realmente acaban sus filas. Cierra #111031. #111049 (Groene AI). - Corrige una excepción
LOGICAL_ERROR(ScatterExchangeStep should have one source shard, got 8) y filas duplicadas al consultar una tablaMergesobre tablas o vistasDistributedcon la configuración experimentalmake_distributed_plan = 1. Cierra #107946. #108401 (Groene AI). - Serializa una columna
Nullable(Tuple(...))como un único campoCSVen lugar de aplanarla en columnas separadas. Antes, un valor no nulo se escribía como varios camposCSV, mientras queNULLera un único\N, lo que daba un recuento de columnas dependiente de la fila y rompía los encabezadosCSVWithNames/CSVWithNamesAndTypesy las operaciones de ida y vuelta. #108959 (Groene AI). - Corrige un error lógico (
KeyCondition uses PREWHERE output) en el lectorParquetv3 cuando una condición de clave a nivel de formato hace referencia a una columna que no se lee del archivoParquet. #109267 (Groene AI). - Corrige resultados incorrectos en lecturas de funciones de tabla con
FINALoSAMPLEbajoserialize_query_plan = 1. También corrige la clave de caché de las estadísticas de la tabla hash de agregación para funciones de tabla, de modo que distintas funciones de tabla ya no compartan la misma entrada de preasignación. #109847 (Azat Khuzhin). - Corrige la limpieza de un
BACKUP ... TO Memory(...)que falla antes de finalizar: la copia de seguridad fallida quedaba registrada, por lo que su nombre no podía reutilizarse. #109947 (Julia Kartseva). - Se corrige la aritmética de intervalos extrema para
WITH FILL STEPy las funciones de intervalo de fecha/horaadd*/subtract*: los deltas fuera de rango ya no dependen del desbordamiento con signo, yWITH FILLcon un pasoYEARenorme ya no se queda bloqueado al hacer retroceder el calendario. #110158 (Groene AI). - Se corrigen los errores
411 Length Requiredde los servicios de Azure: el transporte HTTP de Azure basado en Poco ahora estableceContent-Lengtha partir del cuerpo de la solicitud para los SDK client que no lo establecen por sí mismos, como Azure Key Vault. #110299 (Konstantin Bogdanov). - La optimización diferida de
FINAL(query_plan_optimize_lazy_final, deshabilitada de forma predeterminada) ya no se aplica cuando la consulta lee en el orden de la clave de ordenación, porque su plan de reemplazo no preserva ese orden y podía devolver resultados en un orden incorrecto. Tampoco se aplica ya cuando unLIMITmenor que el número de filas que se van a leer se aplica directamente al paso de lectura, donde la pasada obligatoria de construcción del conjunto impide la finalización anticipada. #110576 (Nikolai Kochetov). - Se corrigió que
readWKTyreadWKTPointdevolvieran coordenadas sin inicializar (escalares) o heredadas de la fila anterior (vectorizadas) paraPOINT EMPTY.POINT EMPTYahora se rechaza conCANNOT_PARSE_TEXT, ya quePointde ClickHouse es unaTuple(Float64, Float64)fija sin representación vacía. #110692 (Groene AI). - Se corrige el manejo incorrecto de la zona horaria al materializar columnas del lado derecho en hash joins. Cierra #111033. #111074 (Yarik Briukhovetskyi).
- Se corrigieron resultados incorrectos de
count()y la omisión de filas cuando una claveString(o unaFixedStringmás estrecha) o un skip index minmax se filtra mediante una comparación con una constanteFixedStringmás ancha, por ejemplotoFixedString('abc', 257) = string_col. La poda por clave primaria y minmax construía el rango a partir de la constante rellenada con NUL y omitía incorrectamente los gránulos coincidentes. #111106 (Groene AI). - Se corrigieron las inserciones asíncronas en formato
Nativepara que una entrada en búfer que se vuelva incompatible después deALTER ... MODIFY COLUMNya no haga fallar todo el lote. Cierra #111064. #111108 (Mikhail f. Shiryaev). - Se corrige
CREATE OR REPLACEde un Diccionario con un objeto de otro tipo: fallaba conCANNOT_DETACH_DICTIONARY_AS_TABLEdespués de que el reemplazo ya se hubiera confirmado, dejando una tabla huérfana_tmp_replace_*. #111142 (Nikolay Degterinsky). - Se corrigió
INCOMPATIBLE_TYPE_OF_JOINpara un joinANYen una tabla del engineJoincuando un filtroWHEREsobre una columna del lado derecho permitía al planner de consultas reescribir el join aSEMIoANTI. Una tabla del engineJointiene una strictness declarada fija que no puede cambiarse, por lo que ahora se rechaza esa conversión para dichas tablas. #111362 (Groene AI). - Se corrige que la table function
formatno devolviera columnas cuando los datos de entrada se interpretan como cero filas (por ejemplo, un documento JSON vacío o unaFeatureCollectionde GeoJSON sin features). Ahora devuelve un resultado vacío con las columnas correctas en lugar de lanzarNOT_FOUND_COLUMN_IN_BLOCK. Cierra #111390. #111428 (Groene AI).
Mejora en compilación/pruebas/empaquetado
- Las compilaciones con sanitizador ahora capturan el informe del sanitizador en el búfer global
sanitizer_report, para que el analyzer de core dumps pueda leerlo desde el core dump. #109333 (Miсhael Stetsyuk). - Compilar
musldesde el código fuente en lugar de usar binarios integrados. #97452 (Konstantin Bogdanov). - Usar implementaciones SIMD de
memcmp/memcpy/memmove/memset/bcmp/memmemde LLVM-libc. #107566 (Konstantin Bogdanov). Se corrige una corrupción silenciosa dememmoveen compilaciones de Debug con-O0(-DDEBUG_O_LEVEL=0) en máquinas con AVX-512. #110904 (Konstantin Bogdanov). - Eliminar los usos de la biblioteca
curlen toda la base de código y en las bibliotecas de terceros incluidas. #108296 (Konstantin Bogdanov). - Se actualizó
mariadb-connector-ca 3.4.9. #108328 (Konstantin Bogdanov). - Actualizar
libssha 0.12.0. #108329 (Konstantin Bogdanov). - Se corrige un bloqueo durante el
COMMITde una transacción en macOS. #108375 (Raúl Marín). - Se añadió una opción de CMake
COMPRESS_DEBUG_SECTIONSque comprime las secciones de depuración DWARF en archivos objeto (-gz), habilitada automáticamente cuando el compilador lo admite, para reducir el tamaño de los directorios de compilación de Debug; los binarios finales se dejan sin comprimir, por lo que la simbolización de stack traces en runtime no se ve afectada. #109306 (Murphy). La toolchain de LLVM incluida ahora se compila con zlib, por lo que su clang admite-gz=zlib, y se añadió el enlace simbólicoclang++-21que faltaba. #109596 (Murphy). - Las compilaciones de Debug ahora compilan los crates de Rust integrados con información de depuración reducida (
debug = 1, nivellimitedde cargo) y sin caché incremental (REDUCE_RUST_DEBUG_INFO, activado de forma predeterminada), lo que reduce el tamaño de los artifacts de compilación de Rust (~12 → ~7 GB desde cero) y evita el crecimiento ilimitado de la caché de cargo entre recompilaciones. Establezca-DREDUCE_RUST_DEBUG_INFO=OFFpara restaurar DWARF completo y la compilación incremental. #109471 (Murphy). - Se admite el exchange de consultas distribuidas en streaming y las lecturas
STREAMen macOS. #109769 (Raúl Marín). - Actualizar
libarchivede 3.8.7 a 3.8.8. #109874 (Robert Schulze). - Actualizar
c-aresde 1.34.6 a 1.34.8. #109905 (Robert Schulze). - Actualizar
krb5para corregir CVE-2026-40355 y CVE-2026-40356. #109910 (Robert Schulze). - Se eliminó la dependencia de terceros
libpng.FORMAT PNGahora usa en su lugar un pequeño codificador PNG integrado (basado en la zlib incluida). #110051 (Alexey Milovidov). - Se registran en el memory tracker de macOS las asignaciones sin procesar de C (que no pasan por
operator new) al envolver la zona malloc de jemalloc, de modo que se les apliquen los límites de memoria. #110370 (Raúl Marín). - Las imágenes de Docker
-distrolessparaclickhouse-serveryclickhouse-keeperahora se construyen a partir de la etapa de producción sin shell; antes se construían a partir de la etapa de depuración e incluían/busybox/sh. Cierra #105677. #105678 (ashishch432). - Se actualizó
abseil-cppa la versión LTS20260526.0. #108991 (Konstantin Bogdanov).
Lanzamiento de ClickHouse 26.6, 2026-06-25. Presentación, Video
Cambio incompatible con versiones anteriores
- Este cambio elimina la funcionalidad
allow_experimental_query_deduplication. Esta funcionalidad llevaba mucho tiempo en estado experimental, no tiene pruebas y no se va a seguir soportando (las pruebas iniciales eran inestables y se eliminaron en #49579). #99398 (Igor Nikonov). - La funcionalidad
SYSTEM INSTRUMENTbasada en XRay ahora usaargumentsen lugar deparameters: la columnasystem.instrumentation.parametersse renombró aarguments, y la sintaxisSYSTEM INSTRUMENT ADD ... HANDLER PARAMETERS ...se cambió porSYSTEM INSTRUMENT ADD ... HANDLER ARGUMENTS .... Las consultas o automatizaciones que usen la columna o la sintaxis antiguas deben actualizarse para usar los nombres nuevos; los nombres antiguos ya no son compatibles. #103854 (Pablo Marcos). - La configuración
show_data_lake_catalogs_in_system_tablesse renombró ashow_remote_databases_in_system_tablesy se amplió: cuando su valor es 0 (el valor predeterminado), las bases de datosMySQLyPostgreSQLtambién se ocultan desystem.tables,system.columnsysystem.completions, además de los catálogos del lago de datos. El nombre antiguo de la configuración se mantiene como alias. #104416 (Pablo Marcos). - La build x86 predeterminada ahora apunta a x86-64-v3 (AVX2) en lugar de x86-64-v2 (SSE4.2). Esto requiere una CPU con soporte para AVX2 (Intel Haswell o posterior, AMD Excavator o posterior). Si tu CPU no admite AVX2, usa la build
amd64compat, que apunta a x86-64 básico. #105019 (Raúl Marín). - Se rechazan
Dynamic/Variantanidados en agregacionesmin/maxe índicesminmax. Antes solo se comprobaban losDynamic/Variantde nivel superior. Cierra #104747. #105468 (Pavel Kruglov). icebergHashyicebergBucketahora rechazan argumentosInt128,UInt128,Int256,UInt256yDecimal256con un error explícito. Antes truncaban silenciosamente los valores más grandes y producían hash con colisiones. La spec de Iceberg solo define el hashing para enteros de 32/64 bits y decimales con una precisión de hasta 38; convierte aInt64oDecimal128para mantener el comportamiento anterior en los valores que quepan. #105866 (Raúl Marín).- Se añadió control granular sobre el eco de consultas en la CLI. La opción
--echoahora acepta un valor booleano opcional y funciona tanto en modo interactivo como en batch mode. Las nuevas opciones--echo-formattedy--echo-query-idcontrolan, respectivamente, si las consultas reproducidas con eco se formatean y si se imprimequery_id. La opción--hilite/--highlightahora también controla el resaltado de las consultas reproducidas con eco. Como efecto secundario,--echoahora es una opción con valor booleano, por lo que una consulta posicional colocada justo después de un--echosin valor se interpreta como su valor; usa--echo --query "..."o--echo=falseen su lugar. #106191 (Alexey Milovidov). - Se eliminaron las funciones experimentales de KQL (Kusto)
array_sort_ascyarray_sort_desc, junto con sus backends SQLkql_array_sort_ascykql_array_sort_desc. Estas funciones eran experimentales, estaban implementadas con baja calidad y eran el origen de errores de corrección y del parser. Las consultas que usan estos nombres ahora devuelvenUNKNOWN_FUNCTION. #108101 (Groene AI). ALTER TABLE ... REPLACE PARTITION ... FROM ...ya no elimina silenciosamente los datos de la partición de destino cuando la tabla de origen no tiene partes en la partición solicitada. Antes, una solicitud de este tipo eliminaba la partición de destino y no escribía nada en su lugar: una trampa que podía provocar pérdida de datos. Ahora, de forma predeterminada, se rechaza conBAD_ARGUMENTS. Para restaurar el comportamiento anterior de vaciado silencioso, establezca la nueva configuraciónallow_replace_partition_from_empty_source = 1, o bien establezcacompatibilityen26.5o una versión anterior; para eliminar explícitamente los datos de destino, useALTER TABLE ... DROP PARTITION. #104939 (Groene AI).- El valor predeterminado de la configuración del servidor
insert_deduplication_versioncambia decompatible_double_hashesanew_unified_hash. La deduplicación de inserciones ahora funciona sobre todo el bloque insertado (por inserción) en lugar de hacerlo por parte/partición: un reintento de la misma inserción sigue deduplicándose, pero dos inserciones distintas que producen una parte idéntica ya no se deduplican entre sí, y las inserciones de las mismas filas en distinto orden ya no se deduplican. Establezcainsert_deduplication_version = compatible_double_hashespara restaurar el comportamiento anterior. Las instancias que se actualicen directamente desde una release cuyo valor predeterminado eraold_separate_hashesprimero deben ejecutarse concompatible_double_hasheshasta que haya transcurrido la ventana de deduplicación relevante más larga antes de pasar a depender denew_unified_hash. #107886 (Sema Checherinda).
Nueva funcionalidad
- Se agregó compatibilidad con consultas continuas sobre tablas
MergeTree, implementadas mediante una serie de lecturas de instantáneas. Este es un primer paso hacia la compatibilidad general con consultas en streaming. #105114 (Mikhail Artemenko). - Se agregaron índices de omisión hipotéticos (what-if). Use
CREATE HYPOTHETICAL INDEX ... ON t (expr) TYPE ...para definir un índice de omisión virtual con alcance de sesión y luegoEXPLAIN WHATIF SELECT ...para estimar su tasa de omisión y su costo sin materializarlo. Los índices definidos son visibles en la nueva tablasystem.hypothetical_indexes. #104608 (Yarik Briukhovetskyi). - Se agregó una interfaz web integrada en
/schemaaclickhouse-serverque visualiza el grafo de dependencias entre tablas, vistas materializadas, vistas materializadas actualizables, diccionarios, tablas distribuidas y vistas. #105276 (Nikita Mikhaylov). - Se agregó compatibilidad con el formato de salida
PNG, lo que permite renderizar directamente los resultados de las consultas como imágenes PNG. #74691 (Maksim Dergousov). - Se agregó la detección del agente de codificación con IA (Claude Code, Cursor, Codex, Gemini CLI, Goose, etc.) que invocó
clickhouse-clientoclickhouse-local, en función de las variables de entorno. El agente detectado se informa en la nueva columnaclient_agentdesystem.query_log,system.query_thread_logysystem.processes. #106619 (Alexey Milovidov). - Se agregó una nueva tabla del sistema,
system.documentation, que recopila en una sola tabla la documentación de referencia integrada de los componentes uniformes del sistema (funciones, motores de tabla, tipos de datos, ajustes, formatos y otros), con la documentación renderizada en Markdown. #107463 (Alexey Milovidov). - Se agregó el formato de entrada
GeoJSONpara leer documentosFeatureCollectionde GeoJSON, produciendo una fila por feature con columnasid(String),geometry(Geometry) yproperties(Nullable(JSON)). Las geometríasPoint,LineString,MultiLineString,PolygonyMultiPolygonse leen en el tipo nativoGeometryde ClickHouse.GeometryCollectionyMultiPoint, que el tipoGeometryno puede representar, generan una excepción de forma predeterminada, o pueden almacenarse comoNULLmediante el ajusteinput_format_geojson_unsupported_geometry_handling. Contribuye a #91533. #98124 (Mark Needham). - Se agregaron funciones para servir Mapbox Vector Tiles directamente desde SQL:
MVTEncodeGeomproyecta una geometría en el espacio de píxeles de un tile slippy-map y la recorta,MVTEncodeagrega las geometrías proyectadas de un grupo en los bytes binarios de un tile de una sola capa, yMVTBoundingBox/MVTBoundingBoxMercatordevuelven el cuadro delimitador de un tile para restringir las filas a él. Se admite geometría de punto, línea y polígono. También están disponibles con los alias de PostGISST_AsMVTGeomyST_AsMVT. #106107 (Saarthak Gupta). clickhouse-localahora admite las consultasSYSTEM START LISTENySYSTEM STOP LISTEN, lo que permite transformarlo en un servidor que acepta conexiones TCP y HTTP. #101143 (Alexey Milovidov).- Se añadió un comando interactivo
helpaclickhouse-clientyclickhouse-local. Al escribirhelp <name>(también/help,mano/man) se muestra la documentación de una función, table engine, tipo de dato, formato, setting u otro componente, renderizada a partir de Markdown en la terminal con resaltado de sintaxis SQL. Cuando la palabra es ambigua, se muestran todas las coincidencias; si no se encuentra, se sugieren nombres similares. #108042 (Alexey Milovidov). - Se admite la escritura en Azure Data Lake Storage Gen2. #105406 (Konstantin Vedernikov).
- Se añade el formato
RowBinaryWithNamesAndTypesAndDefaultspara ofrecer mejor compatibilidad con schema evolution. #105736 (Mark Zitnik). - Se implementa
ADD ENUM VALUESen consultasALTER TABLEpara simplificar la adición de nuevos valores a un tipoEnumexistente sin tener que volver a especificar todos los valores actuales deEnum. #93830 (Ilya Golshtein). - La vista materializada actualizable ahora admite
REFRESH DEPENDS ONpara desencadenar actualizaciones en función de las actualizaciones de otra RMV, en lugar de hacerlo según una programación basada en tiempo. (REFRESH EVERY ... DEPENDS ONya existía, pero no podía usarse de forma fiable para este caso de uso). Consulte la documentación deCREATE MATERIALIZED VIEW. #104440 (Michael Kolupaev). - Se añade soporte para seleccionar columnas por patrón de nombre con
* LIKE '<pattern>'y* ILIKE '<pattern>', incluidas formas calificadas comotable.* LIKE '<pattern>'ytable.* ILIKE '<pattern>'.LIKEhace coincidir los nombres de columna de forma sensible a mayúsculas y minúsculas, mientras queILIKElo hace de forma no sensible a mayúsculas y minúsculas. #104569 (Yue Ni). - Se añadió la sintaxis
ESCAPE, que define un carácter de escape personalizado en un patrónLIKE, lo que permite tratar%y_como caracteres literales en lugar de wildcards. #99774 (Ilya Yatsishin). - Se añaden los table settings de
MergeTreematerialize_projections_on_insertymaterialize_projections_on_merge. Cuandomaterialize_projections_on_insert = 0, las operacionesINSERTomiten la creación de projection parts, lo que mejora el throughput de inserción en tablas con muchas projections. Cuandomaterialize_projections_on_merge = 1, una merge vuelve a crear una projection que falta en todas sus partes de origen, de modo que las projections pueden generarse durante las merges en lugar de on insert. Las merges siguen combinando solo partes que comparten el mismo conjunto de projections. #100993 (Christoph Wurm). - Se añade un nuevo setting inmutable de
MergeTree,allow_tuple_element_aggregation, desactivado de forma predeterminada. Cuando está habilitado,SummingMergeTree,AggregatingMergeTreeyCoalescingMergeTreeaplanan recursivamente las columnasTupley realizan la agregación de cada elemento hoja de forma independiente durante las merges, exactamente igual que si fuera una columna de nivel superior:SummingMergeTreelo suma,AggregatingMergeTreefusiona su estado de función de agregación yCoalescingMergeTreeconserva su último valor no NULL. El setting debe especificarse al crear la tabla y los engines que no lo admiten lo ignoran silenciosamente. #98039 (johnjing). - Nuevas funciones
quantizeBFloat16ToInt8ydequantizeInt8ToBFloat16: un códec escalar que comprime componentes de embeddings a 8 bits mediante un cuantizador gaussiano Lloyd-Max de 256 niveles, del que pueden extraerse códigos Int4/Int2/binarios mediante truncamiento de bits. #108102 (Alexey Milovidov). - Se agregan las funciones
arrayTopKyarrayBottomK: -arrayTopK(k, array)devuelve los K elementos más grandes en orden descendente -arrayBottomK(k, array)devuelve los K elementos más pequeños en orden ascendente. #104563 (Vitaly Baranov). - Se agregó una nueva tabla del sistema
system.iceberg_filesque expone metadatos por archivo para las tablasIceberg, con una fila por cada archivo de datos o de eliminación en la instantánea actual de cada tabla. Esto cierra #98777. #104415 (Asya Shneerson). - Se agregó la tabla
system.constraints, que proporciona información sobre todas las restriccionesCHECKyASSUMEde todas las tablas, incluido el nombre de la restricción, el tipo y la expresión. #105337 (Pedro Ferreira). - Se agregó una nueva tabla
system.dictionary_layoutsque enumera las estructuras de diccionario disponibles junto con documentación integrada (description,syntax,examples,introduced_in,related). #106182 (Alexey Milovidov). - Se agregó una nueva tabla
system.dictionary_sourcesque enumera los orígenes de diccionario disponibles junto con documentación integrada (description,syntax,examples,introduced_in,related). #106184 (Alexey Milovidov). - Se agregó una nueva tabla
system.data_skipping_index_typesque enumera los tipos de índices de omisión de datos disponibles junto con documentación integrada (description,syntax,examples,introduced_in,related). #106186 (Alexey Milovidov). - Se agregó una nueva tabla
system.disk_typesque enumera los tipos de disco disponibles junto con documentación integrada (description,syntax,examples,introduced_in,related). #106187 (Alexey Milovidov). - Se implementó
SYSTEM RESTART DISK <name>: ahora vuelve a cargar los metadatos en memoria de un disco y vuelve a escanear las partes de datos de las tablas con réplica de solo lectura ubicadas en él. Esto permite que una réplica de solo lectura de una tabla en almacenamiento compartidoplain_rewritablevea bajo demanda los datos escritos por otro servidor, sin esperar arefresh_parts_intervalni reiniciar el servidor. #106645 (Jordi Villar). - Ahora se admite la sintaxis de estilo PostgreSQL
expr OP SOME(array)/expr OP ALL(array)(con un lado derecho que no es una subconsulta), y se reescribe comohas/NOT haspara=/<>, o como lambdasarrayExists/arrayAllpara otros operadores de comparación. No se aceptaANYpara la forma de array porqueanytambién es una función de agregación; useSOMEen su lugar. La forma con subconsulta deANY/SOME/ALLse sigue reduciendo aIN/NOT IN. #105129 (Alexey Milovidov). - Se agregaron dos nuevas estrategias de
load_balancing,hostname_longest_common_prefixyhostname_longest_common_suffix, que prefieren la réplica cuyo hostname comparte el prefijo común más largo (respectivamente, sufijo) con el hostname del iniciador. Son útiles cuando el centro de datos está codificado como prefijo o sufijo de hostnames cuyos segmentos numéricos tienen longitud variable, donde las estrategias existentesnearest_hostnameyhostname_levenshtein_distanceeligen la réplica incorrecta. #107360 (Denny [DBA at Innervate]). - Se agregó información del certificado de cliente TLS (subjects, número de serie, emisor y período de validez) a la tabla
system.session_logpara mejorar la observabilidad de la autenticación basada en certificados. #107679 (Alexey Milovidov). - Se agregó una credencial opcional
external_idpara el acceso aS3basado en roles. #106941 (Elian Gidoni). - Se agregó una nueva configuración de
S3Queue,after_processing_move_preserve_path. Cuando se habilita junto conafter_processing='move'yafter_processing_move_prefix, los objetos procesados se mueven conservando su ruta de origen completa bajo el prefijo de destino, en lugar de aplanarse y dejar solo el nombre del archivo. #105354 (Asya Shneerson). - Se agregó la configuración del servidor
message_queue_disable_insertionpara deshabilitar la inserción desde motores de cola de mensajes (Kafka,RabbitMQ,NATS) en vistas materializadas adjuntas. Es útil para escenarios de réplicas de solo lectura. #104911 (JIaQi Tang). - Se agregaron
LOCALTIMEyLOCALTIMESTAMP(sintaxis estándar de SQL / PostgreSQL).LOCALTIMESTAMPes un alias denow()(devuelveDateTime);LOCALTIMEdevuelve la hora actual del día como un valorTime. #106139 (Thomas Cabral). - Se agregó
date_part('unit', expr)como azúcar sintáctico paraEXTRACT(unit FROM expr). Se admiten todos los tipos de interval estándar y los extras de PostgreSQL (epoch,dow,doy,isodow,isoyear,century,decade,millennium). #105127 (Alexey Milovidov). EXTRACT(TIMEZONE_HOUR FROM dt)yEXTRACT(TIMEZONE_MINUTE FROM dt)compatibles con PostgreSQL para las partes de hora y minuto de un desfase de zona horaria, yEXTRACT(<unit> FROM INTERVAL n <unit>)/date_part('<unit>', INTERVAL n <unit>)para extraer el valor de un intervalo. #106227 (Vinayak Joshi).- Se agregaron alias de agregación
min_byymax_byparaargMinyargMax. #105712 (Joey Yu). Estos alias son estúpidos; los ingenieros de verdad usan los nombres originales de ClickHouse. - Se agregó
REGEXP_SUBSTRcomo alias que no distingue entre mayúsculas y minúsculas deregexpExtractpara compatibilidad con Oracle/MySQL/Snowflake. #105122 (Alexey Milovidov). - Se agregó
SESSION_USERcomo alias que no distingue entre mayúsculas y minúsculas decurrentUser()para compatibilidad con PostgreSQL / SQL estándar. #106081 (Takumi Hara). - Ahora se admite un modificador final
NULL/NOT NULLenALTER TABLE ... ADD/MODIFY COLUMN, en consonancia conCREATE TABLE. #106150 (Takumi Hara). - Ahora puede usar la función
h3PolygonToCellsWithContainmentde h3 para aprovechar su nuevo algoritmo, que admite modos de contención basados en centro, totalmente contenidos y superpuestos. #104455 (Youssef Kadry). - Añade los indicadores
IPV4_PREFIX_BITS and IPV6_PREFIX_BITScuando la generación de claves se realiza medianteIP_ADDRESSoFORWARDED_IP_ADDRESS. #89270 (Aditya Chopra). formatReadableTimeDeltaahora acepta como entrada una expresiónINTERVALde un tipo distinto deMonthyYear. #64315 (Francisco J. Jurado Moreno).- El usuario ahora puede especificar un argumento de precisión opcional para las funciones
formatReadableSize,formatReadableDecimalSizeyformatReadableQuantity, que controla la cantidad de dígitos después del punto decimal. El valor predeterminado es 2, lo que conserva el comportamiento anterior. #104648 (Antonio Filipovic). - Añade la configuración
output_format_float_precisionpara controlar la cantidad de dígitos decimales en la salida de texto de números de coma flotante. #99721 (phulv94). - Se añadió la configuración
output_format_always_write_decimal_point_in_float_and_decimalpara imprimir siempre un punto decimal en números de coma flotante yDecimalen formatos de texto, incluso cuando el valor es un número entero. Por ejemplo, genera1.en lugar de1. Está desactivada de forma predeterminada. #62614 (Ilya Yatsishin). - Añade compatibilidad con los nuevos elementos de configuración de handler HTTP
<url_prefix>y<full_url_prefix>(coinciden con todas las rutas bajo una ruta base; son útiles, por ejemplo, para handlers de Prometheus), así como con<url_regexp>,<full_url_regexp>y<headers_regexp>. La forma antigua<url>regex:...</url>ahora está obsoleta. #107492 (Vitaly Baranov). - Añade compatibilidad con las estadísticas
basic, una estadística compacta por columna que almacena mínimos y máximos numéricos, la longitud media de las cadenas y el recuento de NULL cuando corresponde. #106048 (Han Fei). - Añade compatibilidad con nodos TTL en ClickHouse Keeper, con activación explícita mediante el indicador de feature
create_ttl. #100397 (Konstantin Vedernikov). - Introduce una función de reserva de memoria para cargas de trabajo. Consulte la documentación sobre planificación de cargas de trabajo. #82414 (Sergei Trifonov).
Funcionalidad experimental
- Ejecución distribuida de consultas en varias etapas: el planificador divide el plan de consulta en etapas conectadas mediante intercambios scatter / broadcast / gather / shuffle y distribuye los fragmentos del plan entre los nodos worker. Los datos entre etapas se transmiten por TCP o se pasan mediante archivos temporales en object storage compartido; esta ruta admite shuffle distribuido y broadcast hash joins, agregación por shuffle y ordenación distribuida. La funcionalidad es experimental y está deshabilitada de forma predeterminada. #106020 (Alexander Gololobov). El motor experimental de planes de consulta distribuidos (
make_distributed_plan) ahora puede usar, para cada worker, un puerto distinto para el envío de tareas y otro para el intercambio de streaming, configurados por réplica en<remote_servers>constateless_worker_portystreaming_exchange_port. Si no se establecen, se usan los puertos anteriores a nivel de server (stateless_worker_client.portydistributed_query.streaming_exchange_port). Esto permite ejecutar varios workers en un mismo host. #107885 (Alexander Gololobov). - Se añadió el algoritmo experimental de reordenación de join
dphyppara inner joins como opción de la configuraciónquery_plan_optimize_join_order_algorithm, así como la configuraciónquery_plan_optimize_join_order_max_searched_plans, que limita la búsqueda del orden de join y recurre al siguiente algoritmo de la cadena cuando se supera ese límite; establézcala en0para mantener el comportamiento anterior de búsqueda sin límite. #98798 (Alexander Gololobov). - Se añadió la función
aiEmbedpara usar API de LLM y generar embeddings desde ClickHouse. #102922 (George Larionov). - Se añadió un canario experimental de Linux OOM: un proceso hijo de sacrificio al que el Linux OOM killer apunta antes que al proceso principal del server. Cuando se habilita con
oom_canary_enable, alivia la presión de memoria purgando las cachés del asignador, cancelando consultas, cancelando merges y registrando un evento ensystem.crash_log. La respuesta al OOM requiere evidencia de OOM-kill enmemory.eventsde cgroup v2. #101942 (Peng). - La interfaz de terminal web en
/webterminalahora es una funcionalidad lista para producción y está habilitada de forma predeterminada. Está controlada por la nueva configuración de serverenable_webterminal; la antigua configuraciónallow_experimental_webterminalestá obsoleta, pero sigue respetándose por compatibilidad con versiones anteriores. Para deshabilitar el endpoint, establezcaenable_webterminalenfalse. #106255 (Alexey Milovidov). - Los endpoints HTTP de PromQL ahora permiten especificar la base de datos y la tabla mediante query parameters de la URL (
database=,table=, otable=db.table). Se eliminó el fallback implícito anterior a la tabladefault.prometheus: si ni la configuración del handler ni la URL especifican una tabla, el handler ahora devuelveThe time series table name is not set. Para mantener el comportamiento anterior, configure<table>default.prometheus</table>o pasetable=...en la URL. #107553 (Vitaly Baranov). - Se añadió soporte para la función
histogram_quantilede PromQL en las Table functionsprometheusQueryyprometheusQueryRange. Esto permite calcular cuantiles sobre buckets de histogramas clásicos de Prometheus identificados por la etiquetale. #103477 (Joe Smith). - Se añadió el modo diferido de aplicación de posting list para el índice de texto. Cuando se habilita mediante
SET allow_experimental_text_index_lazy_apply = 1ySET text_index_posting_list_apply_mode = 'lazy', las posting lists se decodifican bajo demanda con granularidad de bloque empaquetado mediante un enfoque basado en cursores, en lugar de materializarse por completo en Roaring Bitmaps, lo que reduce el uso de memoria y el tiempo de CPU en las consultas sobre índice de texto selectivas. #100035 (Peng). - Se agregó compatibilidad con la ABI de AssemblyScript para UDFs de WebAssembly. Puede probar la ABI de AssemblyScript sin instalar la cadena de herramientas localmente usando el playground en el navegador, que compila código de AssemblyScript y carga el módulo de WebAssembly resultante en ClickHouse local. #104606 (Vladimir Cherkasov).
- Ahora se pueden adjuntar handler de Prometheus en el puerto HTTP principal con un prefijo opcional. #104975 (James Cunningham).
- Se agregó una configuración experimental de
MergeTree,packed_skip_index_max_bytes, que agrupa substreams pequeños de índices de omisión en un único archivoskp_idx.packedpor parte, lo que reduce la presión sobre los inodos cuando se definen muchos índices de omisión en una tabla. La decisión se toma por substream en el momento de la escritura: los substreams cuyo tamaño serializado se mantiene por debajo del umbral se incluyen en el archivo; los de mayor tamaño conservan el layout independienteskp_idx_<name>.idx2/.mrk2. Una misma parte puede mezclar layouts. Los índices de texto completo no son compatibles y siempre se almacenan por archivo. El valor predeterminado es 0 (empaquetado deshabilitado). #105321 (Raúl Marín). - Se admite la serialización
Bufferspara UDFs de WebAssembly conABI BUFFERED_V1, y se agregawebassembly_udf_enable_fuelcomo una configuración persistente para funciones UDF de WASM. #105574 (Antonio Andelic). - Se agrega una configuración experimental
use_reader_executor(desactivada de forma predeterminada) que dirige las lecturas a un nuevoReaderExecutorbasado en pipeline en lugar de la cadena heredada de read buffers. #106570 (Sema Checherinda). Se agregaron métricas de observabilidad para la ruta de lectura experimentaluse_reader_executor, incluido un KPI modelado de costo de lectura (ReaderExecutorModeledCostMsPerRequestedMiB). #106968 (Sema Checherinda). Se introdujo el búferChainedBuffersdetrás de la ruta de lectura experimentaluse_reader_executor, con la métricaReaderExecutorChainedBufferBytes. #107210 (Sema Checherinda). - El orden descendente en las sorting keys de
MergeTree(por ejemplo,ORDER BY (time DESC, key)) ahora siempre es compatible y ya no requiere la configuración experimentalallow_experimental_reverse_key, que quedó obsoleta. #106440 (Nikita Mikhaylov). Nullable(Tuple(...))ahora es Beta. Está deshabilitado de forma predeterminada; establezcaenable_nullable_tuple_type = 1para usarlo. #107754 (Nihal Z. Miaji).
Mejora del rendimiento
- Varios cambios en Keeper lo hacen, en conjunto, aproximadamente 2 veces más rápido (mejor procesamiento por lotes, canalización de mensajes al líder y canalización de escrituras en el log). #101757 (Michael Kolupaev).
- Reduce la sobrecarga por consulta en consultas
SELECTsimples (análisis sintáctico, análisis y planificación). Por ejemplo,SELECT count() FROM hitsdesde una sola conexión es aproximadamente un 50 % más rápido. #104513 (Raúl Marín). - Optimiza el análisis del índice de clave primaria para claves primarias largas y de alta cardinalidad. En una clave primaria larga, el tiempo de ejecución del análisis del índice ahora depende principalmente de la complejidad del filtro de la consulta (las columnas clave que realmente utiliza), no de la longitud de la clave primaria; por tanto, ampliar la clave de ordenación añade una sobrecarga prácticamente insignificante al análisis del índice en consultas que filtran solo por unas pocas de sus columnas. En una clave primaria de alta cardinalidad, donde ClickHouse mantiene en memoria solo un prefijo selectivo de las columnas clave y no carga las columnas finales, el análisis del índice ahora trabaja únicamente con ese prefijo en memoria en lugar de con la clave completa. La optimización está habilitada de forma predeterminada y puede desactivarse con la nueva configuración
use_lightweight_primary_key_index_analysis. Cierra #65103. #91836 (Nihal Z. Miaji). - La build x86 predeterminada ahora tiene como objetivo x86-64-v3 (AVX2) en lugar de x86-64-v2 (SSE4.2). Esto requiere una CPU compatible con AVX2 (Intel Haswell o posterior, AMD Excavator o posterior). Si tu CPU no es compatible con AVX2, usa la build
amd64compat, que apunta a x86-64 básico. #105019 (Raúl Marín). - Usa
ipnsortydriftsort(ordenación estable), versiones portadas a C++ de las implementaciones de ordenación de la biblioteca estándar de Rust, para las ordenaciones de propósito general basadas en comparación. AceleraORDER BYen columnas no numéricas y las ordenaciones estables, y elimina un caso desfavorable con entradas ordenadas en orden inverso. #106650 (Alexey Milovidov). - Nueva optimización de
GROUP BYpara claves de alta cardinalidad distribuidas uniformemente, que reparte las filas entre hilos aplicando hash a la clave de agrupación, de modo que cada hilo agrega un subconjunto disjunto de claves sin fase de merge. Estableceenable_sharding_aggregator = 1para habilitarla. #104233 (Nihal Z. Miaji). - Habilita el prefetching de tablas hash para consultas
GROUP BYcon claves de tipo cadena, lo que mejora en ~8 % el rendimiento de la agregación de cadenas de alta cardinalidad. #101007 (Le Zhang). - Se redujo el uso máximo de memoria al fusionar resultados parciales de agregación de dos niveles con estados de agregación grandes (por ejemplo,
groupArray), liberando de forma incremental los estados de origen de cada bucket durante el merge en lugar de mantenerlos todos activos hasta completarlo. #102330 (Yuri Fedoseev). - Se optimizó la representación en memoria de
EnumDataType. La huella de memoria de las tablas que incluyen el tipoEnumpuede mejorar hasta 10 veces para el componenteEnum. El tiempo necesario para recuperar el nombre a partir del valor (número) es similar o menor. La búsqueda por nombre es ligeramente más lenta, pero este patrón de acceso es menos habitual. #95668 (Ilya Yatsishin). - Agrega almacenamiento en caché para la resolución de identificadores, evitando resoluciones duplicadas durante el análisis de consultas. #88043 (Max Justus Spransy).
- Mejora el rendimiento del análisis de consultas sobre tablas con muchas columnas: evita calcular los hashes de los nodos de columna (que incluyen toda la expresión de la tabla de origen) cuando no es necesario. El análisis de subconsultas
SELECT *anidadas sobre una tabla con ~1200 columnas ahora es unas 50 veces más rápido. #106957 (Dmitry Novik). - Se aceleró el análisis de consultas con muchas llamadas a funciones o con llamadas a funciones profundamente anidadas al eliminar un hash redundante del árbol de consultas de la caché de resolución de funciones. #107516 (Dmitry Novik).
- Se corrigieron las largas pausas al iniciar sesión y al arrancar consultas con almacenamiento de acceso replicado cuando muchas entidades de acceso (políticas de fila, roles, cuotas y perfiles de configuración) cambian a la vez. Ahora, cada caché por entidad se vuelve a calcular una vez por batch de notificaciones en lugar de una vez por cada entidad modificada, lo que elimina el trabajo cuadrático que podía mantener bloqueado el acceso durante minutos. #107672 (Azat Khuzhin).
- Comparte el
FixedHashMapdel hash join como filtro en tiempo de ejecución de JOIN en el lado de sondeo. Cuando la tabla hash del lado de construcción es (o puede convertirse en) unFixedHashMap, se publica como filtro en tiempo de ejecución y sustituye alSet/BloomFilterqueBuildRuntimeFilterStepinstalaría de otro modo. Se controla con el nuevo settingjoin_runtime_filter_from_fixed_hash_table(valor predeterminado:true). #105640 (Xiaozhe Yu). - Aplicación diferida de los índices de selector y replicación en caso de
JOINseguido de unLIMITselectivo,TopNu otroJOIN. Para controlar el número de columnas de carga útil necesario para habilitar los índices de selector diferidos, use el settingquery_plan_min_columns_for_join_lazy_indexing(0 significa que la optimización está deshabilitada). Para controlar elLIMITa partir del cual se aplica la optimización, use el settingquery_plan_max_limit_for_join_lazy_indexing. #106566 (Hechem Selmi). - La reordenación de JOIN mediante DP (programación dinámica) ahora está permitida con réplicas paralelas. #105889 (Nikita Taranov).
- Se mejoró el plan de consulta cuando JOIN usa Runtime Filters (
enable_join_runtime_filters, activado de forma predeterminada): el modelo de costes de reordenación de join ahora atraviesaWindowTransform(y otros pasos del plan que preservan filas) en el subárbol derecho y usa el recuento de filas subyacente y el NDV por columna en lugar de asumir que no hay estadísticas. #107229 (UnamedRus). - Desvirtualiza la emisión de filas no emparejadas en RIGHT y FULL join agrupándolas en batch. #105679 (Hechem Selmi).
- Admite métodos
keys32ykeys64packed enHashJoin. #107202 (Nikita Taranov). - Admite métodos
keys32ykeys64packed enSet. #107564 (Nikita Taranov). - Manejo más eficiente de columnas Nullable en aggregation. #106015 (Nikita Taranov).
- Mejora el rendimiento de las consultas
LIMIT BY. #103349 (Nihal Z. Miaji). - Acelera las consultas
ORDER BY ... LIMIT BYejecutandoLIMIT BYdentro de cada flujo ordenado en paralelo duranteSortcuando las columnas deLIMIT BYson un prefijo deORDER BY. Esto reduce el número de filas que pasan por la fusión de ordenación final y por cualquier etapa posterior del pipeline. Esta optimización está controlada por la nueva configuraciónquery_plan_push_limit_by_into_sort(habilitada de forma predeterminada). #104000 (Nihal Z. Miaji). - Acelera las consultas
SELECT ... LIMIT N BY <cols>cuando<cols>son un prefijo de la clave de ordenación de la tabla, o pasan a serlo después de queWHERE col = constfije las columnas iniciales. Con esta opción habilitada,MergeTreelee los datos en orden de clave primaria yLIMIT BYprimero filtra en modo streaming con memoria O(1) por flujo ordenado, lo que descarta la mayor parte de los datos; después, ejecutaLIMIT BYnormal sobre los datos reducidos para obtener el resultado final. Está controlado por la nueva configuraciónoptimize_limit_by_in_order(habilitada de forma predeterminada). #105135 (Nihal Z. Miaji). - Acelera las consultas
LIMIT BYen tablasMergeTreeparticionadas ejecutandoLIMIT BYdentro del flujo de cada partición en paralelo, en lugar de fusionar todos los flujos en uno antes de aplicar el límite. Esto se aplica cuando la expresión de partición es una función determinista de las columnas deLIMIT BY, de modo que ningún grupo deLIMIT BYpueda abarcar dos particiones. Está controlado por la nueva configuraciónallow_limit_by_partitions_independently(habilitada de forma predeterminada). #105126 (Nihal Z. Miaji). - Acelera las consultas
LIMIT BYeliminando expresiones de clave redundantes: se descarta una clave que sea una función determinista de las demás claves (p. ej.,LIMIT 5 BY x, f(x)pasa a serLIMIT 5 BY x) y una función inyectiva de una clave se sustituye por su argumento (p. ej.,LIMIT 5 BY toString(x)pasa a serLIMIT 5 BY x). Esto hace que se evalúen menos expresiones, y más baratas, por fila. Está controlado por las nuevas configuracionesoptimize_limit_by_function_keysyoptimize_injective_functions_in_limit_by, ambas habilitadas de forma predeterminada. #106818 (Nihal Z. Miaji). - Acelera la agregación por segmentos, la distribución en buckets de joins
grace_hashy la partición de ventanas en paralelo reemplazando el hash por columna y por fragmento con un kernel que usa CRC32C por hardware. #106538 (Harikrishnan Prabakaran). - Optimiza
L1Distance,L2Distance,L2SquaredDistance,LinfDistanceycosineDistancepara argumentos de tipo Array con vectorización automática multidestino en x86-64-v4/v3. Para argumentos Array no constantes, ahora todos ellos exceptoLpDistance, que usastd::powcon un exponente en tiempo de ejecución, pueden usar kernels vectorizados por el compilador. Se conservan las rutas rápidas existentes para argumentos constantes con AVX-512 yBFloat16de Sapphire Rapids enL2DistanceycosineDistance. #101310 (Peng). - Se mejoró el rendimiento de las funciones
{Norm}DistanceydotProduct. #106007 (Nikita Taranov). - Se mejoró el rendimiento de la función
arrayNorm. #106211 (Nikita Taranov). - El rendimiento de
dotProductmejoró en algunos casos. #106210 (Nikita Taranov). - Se mejoró el rendimiento de las rutas const-left de AVX-512 para
L2DistanceycosineDistanceenArray(Float32),Array(Float64)yArray(BFloat16)cuando la longitud del array es divisible exactamente por el ancho del procesamiento vectorizado. #104625 (Sergey Kuznetsov). - Se habilitó la generación de código AVX-512 para AMD y se mejoró la generación de código para
arrayDistance. #106505 (Nikita Taranov). - Se mejoró el rendimiento de las funciones
L2DistanceTransposedycosineDistanceTransposedpara el tipo de datoQBit. #106701 (Raufs Dunamalijevs). - Se mejoró el rendimiento de las funciones
encrypt,decrypt,tryDecrypt,aes_encrypt_mysqlyaes_decrypt_mysqlhasta en un orden de magnitud, recuperando el rendimiento perdido en la migración de BoringSSL a OpenSSL 3.x (24.4). #107339 (Konstantin Bogdanov). - Se mejoró el rendimiento de las funciones
encrypt,decryptyhalfMD5al evitar búsquedas implícitas del proveedor de OpenSSL por fila en OpenSSL 3.x. #99105 (Konstantin Bogdanov). - Se añadió una implementación SIMD de
SHA1que calcula el hash de múltiples entradas en paralelo con AVX-512, lo que mejora el rendimiento. #105459 (Joanna Hulboj). - Se añadió un backend AArch64 ASIMD/NEON para la implementación de
MD5con múltiples búferes. #105563 (Venkata Vineel ). - Se compactan los bloques de origen antes de calcular la proyección durante
MATERIALIZE PROJECTIONpara reducir el número de partes de proyección temporales y la sobrecarga de las fusiones. ~3,4x más rápido en una tabla de 50 millones de filas. #100047 (Amos Bird). - Se redujo la latencia de
INSERTpara las tablasMergeTreecon índices de omisión en columnasORDER BYal evitar permutaciones redundantes de columnas durante la escritura de partes (~17 % en cargas de trabajo de tipo trazas). #101101 (Amos Bird). - Se habilitaron las rutas de código SIMD de Arrow’s (NEON en ARM, SSE4.2/AVX2/AVX512 en x86) y se utilizaron para acelerar la decodificación de columnas Parquet
FLOAT/DOUBLEcodificadas conBYTE_STREAM_SPLIT. #106376 (Raúl Marín). - Se mejoró el rendimiento de inserción para columnas
LowCardinalitycon índicesbloom_filter. #106410 (Michael Jarrett). - Se paralelizaron las copias de blobs en
DiskObjectStorageTransaction::copyFilemediante un pool de hilos por disco. #105089 (Asya Shneerson). - Se evitó leer el contenido de los archivos al usar el formato de entrada
Onecon funciones de tabla de tipo archivo comofileys3. #105157 (Yue Ni). - Se aceleró el arranque de
clickhouseen macOS aproximadamente 3x al no exportar símbolos dinámicos, que de otro modo el enlazador dinámico procesaría en cada inicio. #107768 (Raúl Marín). - Se acelera la carga de la filesystem cache al iniciar al evitar una apertura redundante del directorio por cada clave de caché. #107414 (Alexey Milovidov).
- Se acelera la carga de la filesystem cache al iniciar permitiendo que los hilos que listan directorios ayuden a cargar los metadatos de la caché una vez finalizado el listado, en lugar de dejar inactiva a la mitad de los hilos. #107416 (Alexey Milovidov).
- Se redujo la sobrecarga de inicio del proceso
clickhouseal actualizar la library WasmEdge incluida, que ya no genera un hash secreto aleatorio en un inicializador global en cada arranque. #107869 (Raúl Marín). - La primary key de
MergeTreey los skip indexes ahora pueden descartar granules para filters en los queifNullocoalesceenvuelven una condición, comoifNull(key = 0, 0)ocoalesce(key = 0, 0). Estos predicates —a menudo generados por generadores de consultas para convertir una comparación posiblementeNULLen un valor booleano definido— antes eran opacos para el análisis de índices y no podían omitir granules. Esto amplía la configuración existenteallow_key_condition_coalesce_rewrite(habilitada de forma predeterminada). Cierra #106264. #106272 (Andy Zhao). - La evaluación de skip index sobre tipos
DateTime64debería consumir menos CPU en la versión 26.6. #107707 (Shankar Iyer). - Se mejoró el rendimiento del análisis de text index en búsquedas de varios tokens optimizando el manejo de tokens poco frecuentes. #98226 (Anton Popov).
- Se usa una caché para los segments comprimidos de las listas de postings del text index. #106299 (Anton Popov).
- Se mejoró el rendimiento de la búsqueda de exclusión genérica para consultas que seleccionan grandes rangos consecutivos de la tabla. #93813 (Michael Jarrett).
- Los client
S3con el mismo endpoint y bucket comparten una caché, lo que evita el descubrimiento duplicado de regiones. Cierra #92482. #96802 (Andrey Zvonov). - Si una consulta contiene
has(<constant array>, <expr>), el analyzer transformará el nodo para usar una implementación deinmás rápida si es viable hacerlo. #97341 (Shankar Iyer). - Cuando se programa un nuevo job en
ThreadPool, se activa el worker thread inactivo más reciente (LIFO) en lugar de uno arbitrario. Esto reduce la fragmentación de memoria causada por las cachés de allocator por hilo. El orden en que se procesan los jobs no cambia. #100177 (Alexey Milovidov). - Se mejoró el rendimiento de los Runtime Filters aproximados y de los Bloom filter indexes. #100201 (Christoph Viebig).
- Se permite que
ASOF JOINuse el join algorithmparallel_hash, paralelizando la construcción entre distintos valores de clave de igualdad. Antes,ASOFquedaba excluido incondicionalmente deparallel_hash. #105375 (Greg Maher). - Se evita leer entradas no acotadas para consultas
INTERSECTyEXCEPTcuando una entrada vacía permite saber de antemano que el resultado estará vacío. #105393 (Yue Ni). - Se añadió
constinitpara varios bloqueadores deMemoryTracker. #105490 (Azat Khuzhin). - Se mejoró el rendimiento de
bitmapContainspara estadosgroupBitmapque no sonUInt64, evitando llamadas repetidas arb_maxdurante las comprobaciones de rango. #105960 (Yue Ni). - Consultas discontinuas más rápidas para columnas
LowCardinalityrespaldadas por un único diccionario. #103662 (Ivan Babrou). - Se añadió una ruta rápida para la fase de probe de
HashJoincuando el bloque tiene una sola fila. #106008 (Nikita Taranov). - Los predicados de consultas como
SELECT ... FROM view(SELECT ... FROM remote(...)) WHERE ...ahora se insertan en la consulta enviada al shard remoto. A la optimizaciónallow_push_predicate_ast_for_distributed_subqueriesle faltaba un caso para las funciones de tabla. #105986 (Nikolai Kochetov). enable_join_transitive_predicatesahora está activado de forma predeterminada. #103724 (Alexander Gololobov).- Se añadió compatibilidad con las funciones
multiSearchAny,multiSearchAnyUTF8ymultiMatchAnyen índices de texto. También se mejoró el análisis de índices de texto para la funciónmatch: ahora los patrones con grupos alternativos pueden omitir más gránulos. #106279 (Anton Popov). - Se permite que los filtros introducidos después de la selección PREWHERE inicial (predicate pushdown, runtime filters o un PREWHERE explícito más un WHERE establecido por el planificador) se fusionen con el PREWHERE existente en una segunda pasada del optimizador, en lugar de permanecer como un paso Filter independiente sobre la lectura de
MergeTree. #105445 (Yarik Briukhovetskyi). QueryConditionCacheahora registra individualmente los gránulos descartados por filtrado, incluso dentro de lotes de lectura que solo pasan PREWHERE de forma parcial, lo que reduce el número de marcas releídas por consultas posteriores con la misma condición. #105335 (Han Fei).- Se añadió la configuración de Keeper
nuraft_use_bg_thread_for_snapshot_io, activada de forma predeterminada, para queNuRaftlea objetos de snapshot desde un hilo en segundo plano en lugar de desde los hilos de trabajo de Raft. #106285 (Antonio Andelic). - Se reduce el uso máximo de memoria al aplicar snapshots recibidos en ClickHouse Keeper con
KeeperMemoryStorage. #105851 (Antonio Andelic). - Las allocations de LLVM/JIT ahora se enrutan a una arena dedicada de jemalloc. Esto reduce la fragmentación de RSS causada por intercalar la contabilidad de JIT de larga duración con allocations de consultas de corta duración. Añade nuevas métricas asíncronas
jemalloc.jit_arena.active_bytes,jemalloc.jit_arena.dirty_bytes,CompiledExpressionCacheBytesMaxyCompiledExpressionCacheCountMaxpara la observabilidad.SYSTEM DROP COMPILED EXPRESSION CACHEahora también elimina las instancias subyacentes de CHJIT y purga la arena de JIT. #104113 (Raúl Marín). - Se corrige la reserva excesiva de memoria al leer columnas
Nullable(String)dispersas y codificadas con diccionario desdeParquetcon el lector nativo V3. #102805 (Francisco). - Se corrigió que
CREATE TABLE ... CLONE AS (and REPLACE / ATTACH PARTITION ... FROM)en discos cifrados copiara los datos en lugar de crear hardlinks. #106731 (Nikita Mikhaylov). - Se mejoró la estimación de cardinalidad en el optimizador del plan de consulta: una columna producida por una función determinista de un solo argumento (p. ej.,
toYear(date)) ahora hereda, como límite superior, el número de valores distintos de su argumento en lugar de quedar sin estadísticas, lo que permite una reordenación dejoinmás precisa. #107757 (Alexander Gololobov). - Se redujo la sobrecarga de CPU del registro asíncrono con altas tasas de logs al notificar al consumidor de logs solo en la transición de cola vacía a cola no vacía, en lugar de hacerlo en cada mensaje. #107352 (Nikita Mikhaylov).
- Se eliminaron cálculos duplicados durante la ejecución de consultas en más casos. #106113 (Yarik Briukhovetskyi).
- Se paralelizó el procesamiento del resultado de una CTE recursiva: una operación
GROUP BYu otra operación sobre un resultado grande deWITH RECURSIVEya no está limitada a un solo hilo. #107694 (Alexey Milovidov). - Se mejoró el rendimiento de la búsqueda de subcadenas sin distinguir entre mayúsculas y minúsculas (
positionCaseInsensitiveUTF8,ILIKE,multiSearchAnyCaseInsensitiveUTF8y funciones relacionadas) al añadir una ruta SIMD NEON en ARM y un kernel AVX2 más amplio en x86. #107882 (Raúl Marín). - Se corrigió una regresión de ~16 % en el rendimiento del códec
FPCde coma flotante en ARM que se introdujo cuando sus tablas predictoras empezaron a usarVectorWithMemoryTracking. #108182 (Groene AI).
Mejora
- El
MemoryWorkeren segundo plano ahora actualiza periódicamente el límite estricto de memoria del server en función del uso actual de memoria y de la cantidad de memoria que el kernel informa como disponible, para que ClickHouse deje margen para otros procesos que se ejecutan en el mismo host. La fórmula es(resident memory + system MemAvailable) * max_server_memory_usage_to_ram_ratio. El mismo server settingmax_server_memory_usage_to_ram_ratiocontrola tanto el límite al inicio como el ajuste dinámico; establézcalo en0para desactivar ambos. Para mantener solo el límite estático al inicio/recarga (el comportamiento de las versiones anteriores), establezca el nuevo server settingmemory_worker_dynamic_hard_limiten0. #104964 (Alexey Milovidov). - Compatibilidad con PostgreSQL client para C# en el protocolo
PostgreSQL. Esto cierra #18611. #80785 (Konstantin Vedernikov). - Las mutations ahora usan el analyzer. #98884 (Nikolai Kochetov).
- Se añadió un control granular sobre la repetición de consultas en la CLI. La opción
--echoahora acepta un valor booleano opcional y funciona tanto en modo interactivo como en batch mode. Las nuevas opciones--echo-formattedy--echo-query-idcontrolan si las consultas repetidas se formatean y si se imprimequery_id, respectivamente. La opción--hilite/--highlightahora también controla el resaltado de las consultas repetidas. Como efecto secundario,--echoahora es una opción con valor booleano, por lo que una consulta posicional situada justo después de un--echosin valor se interpreta como su valor; use--echo --query "..."o--echo=falseen su lugar. #106191 (Alexey Milovidov). - Compatibilidad con schema evolution junto con comprobaciones de consistencia concurrentes para catálogos de lago de datos. #106102 (Konstantin Vedernikov).
- Se permite cache disk para los table engines de datalake. #102017 (RinChanNOW).
- Se corrigió la lectura de datos de table en databases de
DataLakeCatalogconcatalog_type = 'onelake'usando de forma predeterminada el endpoint Blob de OneLake (.blob.fabric.microsoft.com). Establezcaonelake_use_blob_endpoint = falsepara mantener el comportamiento anterior del endpoint DFS (.dfs.fabric.microsoft.com). #106843 (Konstantin Vedernikov). - Se actualizó el valor predeterminado del setting
persistent_processing_node_ttl_secondsdeS3(Azure)Queuede1 houra6 hours(que representa el tiempo de limpieza debido a reinicios no limpios del service, etc.). El valor predeterminado anterior era adecuado para el ttl de los processing nodes, pero también se usa para el ttl del bloqueo del bucket, que puede mantenerse durante más tiempo; por lo tanto, 1 hora no era suficiente. #106838 (Kseniia Sumarokova). - Se redujo el tamaño predeterminado de la metadata cache de
Icebergde 1 GB a 128 MB. #106492 (Konstantin Vedernikov). - Se propaga el
query_idde la tarea de streaming deS3Queuea los inserts de table dependientes. #106494 (Christoph Wurm). - Se puebla
used_storagesensystem.query_logcon el nombre del storage engine al consultar tables medianteDataLakeCatalog. #100706 (Melvyn Peignon). - Puede comprobar qué ‘operation’ y qué ‘summary’ tienen los snapshots de Iceberg. Es útil para pruebas y depuración. #106246 (Den Kalantaevskii).
- Completa de forma asíncrona la solicitud final de multipart upload de
S3mediante el rastreador de tareas, para que pueda solaparse con la carga de la última parte en lugar de ejecutarse en serie durante la finalización. #105487 (Asya Shneerson). - Se añadieron cuatro nuevas configuraciones de tabla de
MergeTreepara controlar los parámetros predeterminados de los índices de texto:text_index_dictionary_block_size,text_index_dictionary_block_frontcoding_compression,text_index_posting_list_block_sizeytext_index_posting_list_codec. Estas configuraciones permiten ajustar el comportamiento de los índices de texto a nivel de tabla sin tener que especificar parámetros en cada definición de índice. Los argumentos explícitos por índice siguen teniendo prioridad. #100626 (Anton Popov). - Permite que las projections sobrescriban configuraciones adicionales de
MergeTree(compresión, formato de part, serialización), además deindex_granularity, con una lista de configuraciones permitidas y su correspondiente validación. #101170 (Amos Bird). - Añade las columnas
current_projection,current_projection_progress,projections_completedyprojections_remainingasystem.mergespara exponer el progreso de merge de las projections. #102611 (Amos Bird). - Se corrigió
PREWHEREcon una subconsultaINsobre columnas de la primary key que no usaba el primary key index para la poda de gránulos, lo que provocaba full table scans en lugar de leer solo los gránulos relevantes. #102570 (Nikita Mikhaylov). - La función
h3PolygonToCellsahora aplica el tamaño máximo de array a todos los polígonos de unMultiPolygon, valida los códigos de retorno de la biblioteca H3 subyacente y rechaza argumentosMultiLineStringen lugar de devolver silenciosamente un resultado vacío. #106399 (Raúl Marín). - Añade una nueva tabla
system.keeper_snapshots, solo para keeper, con información sobre snapshots locales de ClickHouse Keeper. #105571 (Miсhael Stetsyuk). - Añade una nueva tabla
system.keeper_changelogs, solo para keeper, con información sobre archivos changelog locales de ClickHouse Keeper (log de Raft). #105617 (Miсhael Stetsyuk). - Añade una tabla
system.keeper_cluster, solo para keeper. Contiene una fila por cada miembro del cluster de Raft, tal como lo ve el Keeper actual. #105646 (Miсhael Stetsyuk). - Añade más eventos de perfil de Keeper (server-side + client-side) para watches. Cierra #97703. #105336 (Konstantin Vedernikov).
- Se añadieron
coordination_settingsde Keeper para limitar la admisión de log entries no confirmadas deNuRafty para el throttling del sondeo hacia atrás de append-entries. #106108 (Antonio Andelic). - Añade la configuración
enable_compressionpara la table functionmysql, el table engineMySQL, el database engineMySQL, el DiccionarioSOURCE(MYSQL)y las named collections. Cuando está habilitada, ClickHouse negocia la compresión a nivel del protocolo MySQL para todos los datos transferidos a través de la conexión. #103229 (Bernard Lim). - Se redujo la latencia de cancelación de las consultas que se ejecutan a través del PostgreSQL wire protocol:
KILL QUERYahora interrumpe la serialización de salida dentro de un solo fragmento en lugar de esperar a que se envíe el fragmento completo al client. #106535 (Roman Vasin). - Se redujo la latencia de cancelación de las consultas que se ejecutan a través del MySQL wire protocol:
KILL QUERYahora interrumpe la serialización de salida dentro de un solo fragmento en lugar de esperar a que se envíe el fragmento completo al client. #107228 (Roman Vasin). - Se corrigió la lectura de la longitud de
auth_responseen el handshake de MySQL, donde un byte de longitud>= 128se interpretaba como un valor de varios gigabytes porque se leía como uncharcon signo. #107384 (uwezkhan). MaterializedPostgreSQLahora asigna las columnas PostgreSQLnumeric(p, 0)con precisión superior a 76 (p. ej.,numeric(78, 0)usado para enteros de 256 bits) aInt256de ClickHouse en lugar de fallar con “Precision too big”. Los valores que no caben enInt256se rechazan con un error claro. #107431 (Alexey Milovidov).- Envía una excepción al client cuando falla el establecimiento de la TCP connection. #107317 (Nikolai Kochetov).
- Los usuarios ahora pueden insertar campos
FixeddeAvropara variantes de enteros de 8, 16, 32 y 64 bits. #98139 (Patrick Pichler). - El format
AvroConfluentahora reintenta el Confluent Schema Registry HTTP client ante fallos transitorios (timeouts de transporte, conexión rechazada, errores de DNS, HTTP5xx/408/429) con backoff exponencial, en lugar de abortar el INSERT ante el primer fallo de red. Los nuevos Settingsformat_avro_schema_registry_max_retries(valor predeterminado5) yformat_avro_schema_registry_retry_initial_backoff_ms(valor predeterminado100) controlan esta política. Los errores de validación del schema (HTTP409, JSON de Avro malformado) siguen siendo fatales. #106661 (Groene AI). - Registra los privileges en
system.query_log.used_privilegespara todas las comprobaciones de acceso concedidas, incluidas las que pasan por la rutaisGrantedque no lanza excepciones (checkAccessWithFilter). Antes, solo se registraban los privileges comprobados mediante entry points que sí lanzan excepciones (checkAccess/checkGrantOption), lo que hacía queREAD ON FILE/READ ON S3/READ ON AZURE/READ ON URLfueran invisibles en el registro de auditoría paraDESCRIBE,CREATE TABLE ASy consultas similares que usan table functionsfile/s3/azure/url. La aplicación del control de acceso no cambia. #104693 (Alexey Bakharew). - Se añadieron las métricas asíncronas
TotalUncompressedBytesOfMergeTreeTablesyTotalUncompressedBytesOfMergeTreeTablesSystem, que informan del tamaño total sin comprimir de los datos almacenados en tablas de la familia MergeTree. #106364 (Alexey Milovidov). - Añade el evento de perfil
GlobalMemoryLimitExceededpara que los operadores puedan supervisar cuándo se alcanza el límite de memoria global del servidor. #106466 (Sacheendra Talluri). - Se rellenan los contadores
ExecutableUserDefinedFunction*deProfileEventspara las UDFexecutable_pool. El número de invocaciones por llamada, el tiempo total y el tiempo de espera en el grupo, la CPU y la memoria pico de los procesos hijo, y los bytes de stdin/stdout ahora son visibles ensystem.query_log.ProfileEvents. #105010 (Xu Jia) #105618 (Ilya Andreev). - Se añadieron las métricas asíncronas
ExecutableUserDefinedFunctionMemoryResidentBytesyExecutableUserDefinedFunctionProcesses, que informan de la memoria residente (VmRSS) y del número de procesos activos de las user-defined functionsexecutableyexecutable_pool, incluidos los procesos descendientes y los workers inactivos del grupo. #107300 (Hanzi Jiang). - Se añadieron tres métricas async solo para Linux —
MemoryThreadStacksCount,MemoryThreadStacksVirtualyMemoryThreadStacksResident— que informan por separado de la memoria de pila de pthread con respecto al resto de la memoria anónima. Se habilitan medianteasynchronous_metrics_enable_heavy_metrics. Requiere Linux 5.17+ (prctl(PR_SET_VMA_ANON_NAME)) y que/proc/self/smapssea legible; de lo contrario, las métricas no estarán disponibles y la limitación se notificará ensystem.warnings. #106230 (Raúl Marín). - Se exponen en macOS las métricas asíncronas
MemoryThreadStacks*(tamaño residente/virtual y número de pilas de threads). #107752 (Raúl Marín). - Los motores de tabla ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas
description,syntax,examples,introduced_inyrelatedde la tablasystem.table_engines. #106177 (Alexey Milovidov). - Los motores de base de datos ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas
description,syntax,examples,introduced_inyrelatedde la tablasystem.database_engines. #106178 (Alexey Milovidov). - Los tipos de datos ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas
description,syntax,examples,introduced_inyrelatedde la tablasystem.data_type_families. #106180 (Alexey Milovidov). - Los formatos de entrada/salida ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas
description,examples,introduced_inyrelatedde la tablasystem.formats. #106181 (Alexey Milovidov). - Los combinadores de funciones de agregación ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas
description,syntax,examples,introduced_inyrelatedde la tablasystem.aggregate_function_combinators. #106185 (Alexey Milovidov). - Se añadió la opción de línea de comandos
--chimeaclickhouse-client,clickhouse-localy al client integrado. Cuando una consulta finaliza (con éxito o con error) tras ejecutarse durante al menos N segundos, el client escribe el carácter de control ASCIIBEL(\x07) en stderr. Los terminales deciden si emiten un sonido o un destello visual según las preferencias del usuario. Está habilitada de forma predeterminada con un umbral de 5 segundos; pase--chime Npara usar un umbral personalizado o--chime 0para deshabilitarla. Cierra #92718. #104545 (Groene AI). - En
clickhouse-client, cuando el terminal no admite el pegado entre corchetes, los saltos de línea incrustados de una consulta multilínea pegada ahora se integran en el mismo búfer de edición en lugar de pasar al prompt de continuación en cada línea. La consulta pegada permanece bajo un único prompt y las teclas de flecha permiten desplazarse entre sus líneas. Se trata de una mejora aplicada en la medida de lo posible, que depende del comportamiento típico del pegado con búfer TTY. #104299 (Alexey Milovidov). Ahora también funciona con el resaltado de sintaxis desactivado (--highlight 0). #106665 (Alexey Milovidov). - Se añade control del paginador en runtime al estilo de MySQL para
clickhouse-client/clickhouse-local. #105706 (Azat Khuzhin). clickhouse-clientahora respeta los terminales no UTF-8: cuando la codificación de caracteres del terminal no es UTF-8 (por ejemplo, conLANG=C), los formatosPrettyusan bordes de cuadrícula ASCII en lugar de imprimir caracteres Unicode de dibujo de cuadros que corromperían el terminal. #106213 (Alexey Milovidov).- Se sanean las cadenas de visualización proporcionadas por el server en el manejo del paquete
Hellodeclickhouse-client(nombre del server, zona horaria, nombre para mostrar, patterns y mensajes de las reglas de contraseña) para que un server malicioso no pueda inyectar bytes que el client renderice literalmente, y se limita su tamaño para evitar una allocation sin límites. #105243 (Raúl Marín). - La web UI ahora muestra el resultado como una image cuando una consulta usa un output format de image como
FORMAT PNG, en lugar de mostrar los bytes sin procesar como una table. #107638 (Alexey Milovidov). - Se añade la configuración
output_format_pretty_use_nbsp_for_paddingpara renderizar el padding del diseño de tabla en los formatosPrettyde estilo tabla comoU+00A0NO-BREAK SPACE cuandooutput_format_pretty_grid_charsetesUTF-8. Esto ayuda a que la Output dePrettycopiada conserve la alineación de la table en herramientas que contraen los espacios normales. La configuración está desactivada de forma predeterminada, y la Output con juego de caracteresASCIIconserva los espacios normales. #103559 (Ashrith Bandla). - El script de instalación universal ahora también instala
clickhousectlen~/.local/binen Linux y macOS, con un enlace simbólicochctl. EstablezcaCLICKHOUSE_ONLY=1para omitirlo. #105399 (Alasdair Brown). - Se corrigió un
Syntax error: Unterminated quoted stringespurio que podía producirse de forma intermitente al instalar ClickHouse mediantecurl https://clickhouse.com/ | shcuando ya existía un binarioclickhouseen el directorio actual. #106417 (Alexey Milovidov). - Se corrige la altura del panel izquierdo en la página
play.htmlcuando el terminal web está abierto, para que el botón de alternancia del terminal en la parte inferior siga siendo visible. #105087 (Alexey Milovidov). - Se evita seleccionar la única consulta en la web UI después de ejecutarla. #105711 (Joey Yu).
- La web SQL UI ahora expande el editor de consultas cuando una consulta tiene como máximo un 30 % más de altura que la altura actual del editor. #105713 (Joey Yu).
- En la interfaz web, dispone los iconos del menú inferior (Terminal web y GitHub) horizontalmente cuando el panel izquierdo está expandido, dando más espacio vertical a la lista de bases de datos y tablas. #106427 (Alexey Milovidov).
- En la interfaz web (
play.html), al pulsarEscapeahora se desactiva la celda seleccionada de la tabla de resultados. #107777 (Alexey Milovidov). - Mejoras en el panel de bases de datos de la interfaz web SQL (Play): un tooltip en el icono de la base de datos, un botón para ocultar el panel, nombres de bases de datos y tablas clicables en todo el ancho, y una corrección del cambio de ancho del panel cuando aparece la barra de desplazamiento. #108013 (Alexey Milovidov).
- Añade una configuración del servidor (
min_allocation_size_to_throw_on_memory_limit) para permitir que cualquier asignación lanceMEMORY_LIMIT_EXCEEDED; esto debería ayudar a evitar OOM. #105265 (Azat Khuzhin). - Permite la autenticación
NONEpara SSH (evita pedir contraseña a los usuariosno_password). #105476 (Azat Khuzhin). - Restablece la lista de grupos suplementarios en
clickhouse suantes de descartar privilegios, igualando el comportamiento de/bin/suysudo. Antes, el proceso con privilegios descartados heredaba los grupos suplementarios del invocador. #105247 (Raúl Marín). - Añade compatibilidad con
BFloat16para las funciones de predicado numérico (isFinite,isNaN). #105391 (Mohamed Hussain S). - Reduce el uso de memoria de los diccionarios de polígonos (
polygon_index_cell,polygon_index_each) y hace quesystem.dictionaries.bytes_allocatedrefleje correctamente el índice de búsqueda que construyen. #105431 (Raúl Marín). - Corrige los consumers del motor de tabla Kafka que seguían usando un intervalo de sondeo corto después de la asignación de particiones, para que vuelvan al
kafka_poll_timeout_msconfigurado y eviten sondeos vacíos excesivos, partes insertadas más pequeñas y sobrecarga adicional de merge tras los reequilibrios. #100431 (sugaf1204). - Identifica las columnas por posición (en lugar de por nombre) al eliminar columnas no utilizadas en el query plan. Esto permite eliminar columnas no utilizadas cuando hay nombres de columna duplicados. #100586 (János Benjamin Antal).
- ClickHouse lanza una excepción adecuada cuando se intenta usar
table_readonlycon motores replicados, con un mejor manejo de excepciones para las consultas DDL (yDatabaseReplicated) relacionadas con esta configuración. #100950 (alesapin).OPTIMIZE TABLE ... ON CLUSTERy otras DDL ya no se bloquean cuando la tabla de destino tienetable_readonly = 1. La configuración ahora lanza un nuevo código de error específico,TABLE_IS_PERMANENTLY_READ_ONLY, queDDLWorkertrata como no reintentable (distinto deTABLE_IS_READ_ONLY, transitorio, que surge durante desconexiones temporales de ZooKeeper enReplicatedMergeTree). La configuracióntable_readonlyahora también se rechaza explícitamente paraReplicatedMergeTree, tanto durante la creación como medianteALTER MODIFY SETTING. Seguimiento de #97652. #105109 (Alexey Milovidov). - Se corrigieron las actualizaciones de la vista materializada actualizable que podían fallar con
UNKNOWN_TABLEdespués de reemplazar la tabla de destino (por ejemplo, medianteEXCHANGE TABLESo eliminándola y volviéndola a crear): ahora la actualización resuelve la tabla de destino por nombre en lugar de depender de un UUID obsoleto. #102724 (Seva Potapov). - Se añadió una configuración
wait_for_part_commit_in_dependent_materialized_views(valor predeterminado:false). Cuando elSELECTde una vista materializada vuelve a leer de su propia tabla de origen (por ejemplo, mediante unINNER JOINcon el origen), la cascada podía omitir la fila que se estaba insertando en ese momento, porque la parte insertada solo se confirma después de que se ejecutan las vistas dependientes. Al habilitar esta configuración, la parte se confirma antes de que se activen las vistas dependientes, para que puedan ver la fila en tránsito, a costa de un menor paralelismo de inserción. #105943 (Elmi Ahmadov). - No ocultar errores fatales (p. ej.,
MEMORY_LIMIT_EXCEEDED) entryDeserialize. #106808 (Azat Khuzhin). - Comprobar de forma diferida el permiso
CREATE TEMPORARY TABLEenInverseDictionaryLookupPass. #107098 (Azat Khuzhin). - Se corrige un error
ILLEGAL_TYPE_OF_ARGUMENTen consultas distribuidas conserialize_query_plan = 1que contienen una lambda con un argumento constante (p. ej.,arrayMap(t -> t.2, ...)). Las columnas constantes de los nodosINPUTdeActionsDAGahora se conservan durante la serialización del plan de consulta. #107124 (Alexey Milovidov). - La deserialización de los estados de las funciones de agregación
contingency,cramersV,cramersVBiasCorrectedytheilsUahora valida que los recuentos almacenados formen una tabla de contingencia coherente y, de lo contrario, lanza una excepciónCORRUPTED_DATA. Cierra #106899. #107185 (Nihal Z. Miaji). - Se conservan los códigos de error originales de las excepciones encapsuladas en
arrow::Status. #107267 (Azat Khuzhin). - Se admite
keyed_by_normalized_query_hashpara las cuotas definidas en la configuración estática del servidor (users.xml), en consonancia con la sintaxis DDL existenteCREATE QUOTA ... KEYED BY normalized_query_hash. #107654 (Alexey Milovidov). - La configuración de compatibilidad ya no aplica configuraciones obsoletas, por lo que no las marca como modificadas ni genera advertencias de configuración obsoleta. #107737 (Maxim Orlovsky).
- Las inserciones asíncronas ya no registran la lista completa de
query_iden el niveltrace/debug, lo que desde la versión 26.2 podía hacer quetext_logcreciera en exceso en servicios con mucho tráfico de inserciones asíncronas. Las líneas detalladas ahora están en el niveltest. #107852 (Sema Checherinda). - Mejora de la caché del sistema de archivos: se evita que las entradas de prioridad invalidadas mantengan fijado
KeyMetadata. Seguimiento de #106387. #107903 (Kseniia Sumarokova). - Mejora de las métricas de
FileCache. #106116 (Kseniia Sumarokova). - No se imprime el preámbulo “Seguimiento de pila (al copiar este mensaje, incluya siempre las líneas siguientes):” en los mensajes de excepción cuando el seguimiento de pila está realmente vacío. #106524 (Alexey Milovidov).
- Corrige un posible desbordamiento en
roundUpToMultipleal calcular la alineación de límites de la filesystem cache para desplazamientos muy grandes. #92579 (Bharat Nallan). EXPLAIN SYNTAXahora formatea los operadores como llamadas a función de forma coherente en la salida de explicación (por ejemplo,plus(1, 2)en lugar de1 + 2). #94681 (Mohamed Abdelhalim ).- Se mejoraron las sugerencias de nombres de tablas en los mensajes de error: ya no se sugiere exactamente el mismo nombre y ahora se incluye el nombre de la base de datos en la sugerencia (p. ej., “¿Quizá quiso decir
other_db.my_table?”). #95116 (Mathuranath Metivier). - Se mejoró el mensaje de error para identificadores no resueltos en consultas sin cláusula
FROM, sugiriendo añadir una. #101769 (Yash ). - Añade la opción
EXPLAIN PIPELINEpara compactar chains de processors repetidas. #104662 (Yue Ni). - Corrige una lectura con desbordamiento de búfer en el heap al construir el mensaje de error de sintaxis (
UTF8::computeWidthImpla través deparseQuery.cpp), que se producía cuando el parser había retrocedido más allá del primer token de punto y coma / fin de flujo; las builds release insertaban bytes de memoria vecina del heap en el error mostrado, mientras que las builds con ASan abortaban. #105086 (Groene AI). - Hace que la estrategia de partición de Hive sea la predeterminada en la compatibility setting
file_like_engine_default_partition_strategy. #86746 (Kseniia Sumarokova). - Usa una pila de thread más grande (8 MiB) en macOS para igualar el valor predeterminado de Linux, corrigiendo bloqueos poco frecuentes del server por desbordamiento de pila durante la compilación JIT. #107033 (Raúl Marín).
- El límite de tamaño del almacenamiento temporal de
clickhouse-localya no está fijado de forma rígida en 1 GiB. El valor predeterminado aumenta a 1 TiB y puede configurarse con la server settingmax_temporary_data_on_disk_size. #106689 (Alexey Milovidov). - Añade el comando
read-checksumsaclickhouse-disks. Lee el archivochecksums.txtde unMergeTreeDataParty lo imprime como una tabla legible para humanos, separada por tabulaciones. #106901 (Asya Shneerson). - Se añadió un comando
read-bitmapaclickhouse-disks. #107834 (murphy-4o). - Chdig: habilita TLS para secure connections (antes esto provocaba “unknown setting
skip_verify” o “connection reset by peer”). #105864 (Azat Khuzhin). chdigv26.5.1. #105918 (Azat Khuzhin).chdigv26.6.1 -{asynchronous_,}metric_log, patrones de consulta, mapas de calor, logs/trazas almacenados en disco (anteriormente podía usar >40GiB para 1 hora de trazas). #107678 (Azat Khuzhin).- La configuración del servidor (
programs/server/config.xml) ahora establecekeep_alive_timeouten 30 (antes 10), en consonancia con el valor predeterminado real documentado e implementado. #107779 (Dan Checkoway). - El valor predeterminado de la configuración del servidor
disk_connections_rcvbufcambió de0(autotuning TCP del kernel) a204800(200 KB), lo que limita el búfer de recepción TCP por socket para las conexiones a discos de almacenamiento de objetos (S3/Azure/GCS). #107859 (Sema Checherinda). - El optimizador
PREWHEREahora agrupa los conjuncts que hacen referencia al mismo conjunto de columnas antes de estimar la selectividad, de modo que condiciones comoa > 2500 AND a < 2502se evalúan juntas como un rango combinado en lugar de como dos predicados independientes, lo que produce una estimación de selectividad más precisa. #106337 (Han Fei). - Se añadieron implementaciones de sockets seguras y sin cifrar compatibles con silk fiber. #107680 (Miсhael Stetsyuk).
- Se corrigieron un mensaje de error confuso (argumentos intercambiados) y un error tipográfico en la función
nested. #108031 (Alexey Milovidov). - Se añadió un comando
sedaclickhouse-disksque aplica una expresión de sed directamente sobre una ruta dada. #107131 (Asya Shneerson). - Se añadió la configuración
materialized_postgresql_use_extended_date_and_time_typespara el motor de base de datosMaterializedPostgreSQL, que se aplica en el momento de la creación. De forma predeterminada (habilitada), las columnasdate/timestampde PostgreSQL se infieren comoDate32/DateTime64; si se establece en0al ejecutarCREATE DATABASE, se infieren los tipos más estrechosDate/DateTime. #107428 (Alexey Milovidov).
Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)
- Hacer posible eliminar detached parts con el sufijo
tryN. #58957 (János Benjamin Antal). - Corregir una excepción
MULTIPLE_EXPRESSIONS_FOR_ALIASen consultas con alias de proyección duplicados (por ejemplo,SELECT *, day + 365 AS day) dentro de subconsultas anidadas al ejecutarse con réplicas paralelas. #80310 (Alexey Milovidov). - Corregir un error por el que
splitMultipartQuerylanzaba un error “Empty query” en consultas que terminan con un comentario después del punto y coma. #85491 (Yarik Briukhovetskyi). - Corregir una excepción con
ARRAY JOIN:Function writeSlice expects same column types for GenericArraySlice and GenericArraySink, que se produce cuando se usan tipos numéricosLowCardinality(issue #57243). #91784 (Jimmy Aguilar Mena). - Corregir la excepción
NOT_FOUND_COLUMN_IN_BLOCKal usarLIMIT BYcon columnas constantes junto conDISTINCTyORDER BYcon el nuevo analizador. #93195 (Ashrith Bandla). - Corregir que las columnas
NOT NULLse creen silenciosamente comoNullablecuandodata_type_default_nullable = 1y la tabla se crea en una base de datosReplicatedo medianteON CLUSTER. #97572 (xiaohuanlin). - Se corrigió la estabilidad de la conexión de HiveCatalog añadiendo un mecanismo de reintento automático y lógica de reconexión para manejar errores TTransportException al comunicarse con Hive Metastore. #98471 (Dmitriy Borisenko).
- Se corrigió que la función
nested(usada internamente porARRAY JOIN) eliminaraLowCardinalityde los tipos de columna, haciendo queArray(LowCardinality(String))pasara a serArray(String)en la salida. Cierra #95582. #98974 (Yash ). - Corregir la excepción “Distributed task iterator is not initialized” al usar
url,s3u otras funciones de tabla similares en consultas con réplicas paralelas habilitadas. #100146 (Alexey Milovidov). - Corregir una excepción de error lógico al leer tablas Iceberg cuya versión de formato fue actualizada por una herramienta externa (p. ej., Spark). #100407 (Alexey Milovidov).
- Las funciones
like,ilike,notLike,notILikeymatchahora admiten una cadena de búsqueda constante con un patrón no constante (p. ej.,'foo' LIKE pattern_column), lo que antes lanzabaILLEGAL_COLUMN. #100479 (Yash ). - Se corrigió el recuento incorrecto de filas devuelto por una consulta
MaterializedViewconquery_plan_enable_optimizations = 0cuando la vista asigna una columna entera a una columnaBool. #100692 (Maksim Moisiuk). - Corregir una excepción (
LOGICAL_ERROR: 'PREWHERE passed to format that doesn't support it') al leer tablas Iceberg que contienen archivos de datos ORC con la optimización de PREWHERE habilitada. #101206 (Groene AI). - Corrige una condición de carrera en RestCatalog. #101216 (Smita Kulkarni).
- Corrige el error
NOT_FOUND_COLUMN_IN_BLOCKal seleccionar desde una VIEW sobre una tabla con una proyección normal. #101218 (Amos Bird). - Corrige metadatos obsoletos en FileLog cuando se elimina y se vuelve a crear un archivo. #101408 (Azat Khuzhin).
- Corrige una reordenación de join que descartaba silenciosamente filas no emparejadas de un
RIGHT/LEFT JOINcuando se combinaba mediante comas (cross) con otra tabla, p. ej.,t1 RIGHT JOIN t2 ON t1.c = t2.c, t3. Antes, la consulta devolvía el resultado de un inner join en lugar del de un outer join. #101684 (Groene AI). - Corrige que la cláusula
FORMATfuera consumida porINSERTen lugar de aplicarse a la salida deEXPLAINenEXPLAIN INSERT INTO ... SELECT ... FORMAT .... #101772 (Yash ). - Corrige la selección incorrecta del códec de compresión para las partes de
MergeTreecuando la configuracióndefault_compression_codeca nivel de tabla se establecía explícitamente. Las partes escritas on insert, durante merges y para proyecciones usaban el códec predeterminado global del servidor en lugar de la configuración de la tabla (ahora también se cubre la parte vacía producida por una mutation que elimina todo el contenido). #101784 (Yash ). - Rechaza valores negativos de
Float64(p. ej.,-100.5) en workload settings comomax_bytes_per_second,max_cpus, etc. Antes solo se validaban enteros negativos, lo que permitía que valores float negativos crearan silenciosamente nodos defectuosos en el scheduler. Cierra #101825. #101842 (Groene AI). - Corrige un
LOGICAL_ERROR(“Port is not connected”, código 49) que podía producirse al ejecutar consultas que involucraban una VIEW con aggregation dentro de un JOIN. #102574 (Jimmy Aguilar Mena). - Corrige metadatos inconsistentes de partes tras mutations de columnas con serializaciones no predeterminadas. #102817 (Eduard Karacharov).
- Corrige que actualizar los metadatos antes de ejecutar la mutation resuelve #96806. #102882 (Smita Kulkarni).
- Corrige que las consultas SELECT fueran significativamente más lentas cuando se ejecutaban
INSERTconcurrentes. Antes, un pipeline deINSERTreservaba CPU slots hastamax_threadsal inicio de la consulta, incluso cuando la mayoría de los slots nunca llegaban a usarse, dejando sin recursos a los SELECT concurrentes. La asignación de CPU slots ahora se hace según la demanda: el pipeline solo solicita slots a medida que realmente envía trabajo paralelizable. Esto se aplica tanto al control de concurrencia como al scheduler preventivo de CPU para workloads. La nueva server settingconcurrent_threads_lazy_allocation(predeterminadatrue) actúa como mecanismo de rollback. #102928 (Seva Potapov). - Corrige la propagación de
NULLal leer subcolumnas extraídas de columnasNullable(Tuple(...)). Por ejemplo, paratup Nullable(Tuple(s Nullable(String))),SELECT tup.sahora devuelve correctamenteNULLen las filas en las que la tupla externa esNULL, en lugar de valores basura. Esto cubre todos los tipos de elemento que pueden representarNULL:Nullable,Dynamic,VariantyLowCardinality(Nullable(...)). Cierra #105356. #102942 (Nihal Z. Miaji). - Lanza
INCORRECT_DATAen lugar deLOGICAL_ERRORcuando los datos proporcionados por el client en Native format están truncados o malformados. #102975 (János Benjamin Antal). - Se agregó una comprobación de cancelación a la operación de lectura de ObjectStorage. Cierra #98165. #103016 (Smita Kulkarni).
- Respeta
input_format_binary_max_type_complexityal decodificar parámetros de funciones de agregación. Cierra #102903. #103026 (Pavel Kruglov). - Corrige la inferencia de nulabilidad de las columnas Geo en el lector de Parquet basado en Arrow. Cierra #101845. #103032 (Pavel Kruglov).
- Se corrigió que
recursiveRemoveLowCardinalityeliminara nombres personalizados de tipos de geometría (p. ej.,LineStringfrente aRing,MultiLineStringfrente aPolygon), lo que provocaba una interpretación errónea del tipo de geometría. Cierra #103207. #103041 (Joanna Hulboj). - Se corrigió que
input_format_max_block_size_bytesse ignorara silenciosamente durante el análisis deINSERTcuandomax_insert_block_size_byteses0(el valor predeterminado). La configuración ahora limita correctamente el tamaño de los bloques producidos por los formatos de entrada basados en filas. #103068 (Kirill Kopnev). - Se corrigió que ClickHouse produjera ocasionalmente tokens GSSAPI no válidos debido a una eliminación incorrecta de bytes nulos finales. #103114 (Michael Jarrett).
- Corrige el plegado de constantes en tiempo de analyzer para funciones de short-circuit (
if,multiIf,and,or, etc.), de modo que las ramas estáticamente inalcanzables ya no generen excepciones en tiempo de análisis. Por ejemplo,WITH 0 AS n SELECT multiIf(n = 0, 0, intDiv(100, n))ahora devuelve correctamente0en lugar de fallar con un error de división por cero. #103157 (Peng). EXPLAIN SYNTAXexpande vistas parametrizadas. #103263 (Jordi Villar).- Corrige la corrupción de datos al escribir archivos Parquet (y otros formatos con tráiler, como ORC y Arrow) en HDFS mediante
INSERT INTO FUNCTION hdfs(...). Desde la versión 26.1,WriteBufferFromHDFSno vaciaba su búfer de trabajo enfinalize(), por lo que se perdían silenciosamente los últimos hastaDBMS_DEFAULT_BUFFER_SIZEbytes de cada archivo, incluido el footerPAR1de Parquet. Al leer esos archivos, se devolvíaNot a Parquet file (wrong magic bytes at the end of file). #103268 (Groene AI). - Corrige resultados incorrectos y un posible error lógico en subconsultas correlacionadas cuando se establece un límite de tamaño de join (
max_rows_in_join/max_bytes_in_join) junto conjoin_overflow_mode = 'break'. El join creado internamente para evaluar una subconsulta correlacionada ahora ignora esos límites del usuario, por lo que ya no puede detenerse antes de tiempo ni descartar filas. #103322 (Groene AI). - Corrige un bug por el que
ALTER TABLE ... MODIFY SETTINGen una tablaEmbeddedRocksDBpodía conservar un valor de configuración no válido en el archivo de metadatos de la tabla incluso cuando el servidor rechazaba la consulta. En el siguiente reinicio del servidor, la tabla no podría adjuntarse conCANNOT_PARSE_BOOL(o un error de parsing similar), y en bases de datos donde los fallos de carga son fatales, el servidor se negaría a iniciarse. Los valores de configuración no válidos ahora se rechazan antes de que se escriba cualquier metadato. #103417 (Groene AI). - Se corrigió una interrupción del servidor al crear una tabla con un motor de almacenamiento de objetos (
AzureBlobStorage,DeltaLakeAzure,S3,HDFS) usando un número no compatible de argumentos. El servidor ahora devuelve un errorNUMBER_OF_ARGUMENTS_DOESNT_MATCHclaro en lugar de abortar en compilaciones de depuración/sanitizador. #103544 (Groene AI). - Corrige un fallo del servidor en el parsing de parámetros de los tipos de datos
JSONyDynamiccuando el árbol de sintaxis abstracta (AST) estaba malformado estructuralmente (por ejemplo, generado por el AST fuzzer): la expresión de parámetroequals(name, value)podía quedarse con menos de dos hijos, queDataTypeObjectyDataTypeDynamicluego desreferenciaban sin comprobación de límites. #103545 (Groene AI). - Corrige errores lógicos en el analyzer con colisión de nombres de columna en una lambda usada en prewhere. Cierra #103584. #103627 (Pavel Kruglov).
- Corrige errores esporádicos
Logical error: 'Database <name> not found'deDataLakeConfiguration::getCatalogcuando una tabla del engineIcebergse carga dentro de una base de datos normal durante la carga asíncrona de metadatos. #103775 (Groene AI). - Corrige errores
MULTIPLE_EXPRESSIONS_FOR_ALIASlanzados por réplicas remotas al ejecutar consultas que hacen referencia a alias de proyección dentro dePREWHERE/WHERE/HAVING/QUALIFY(p. ej.,SELECT x AS a, y AS b, (a AND b) AS c FROM t PREWHERE c) oSELECT *sobre autouniones con nombres de columna superpuestos, con réplicas paralelas yparallel_replicas_local_plan = 0. Cierra #74324. #103806 (Groene AI). - Corrige la interrupción del servidor cuando una consulta usa comparaciones anidadas
coalesce/ifNull(p. ej.,WHERE coalesce(a, b, coalesce(c, d), e) = const) en una tablaMergeTreecon múltiples índices de saltominmaxyuse_skip_indexes_for_disjunctions = 1. La reescritura del índice de salto de<op>(coalesce(...), const)ahora se aplica recursivamente a los argumentos internos de coalesce, de modo que la RPN deKeyConditionpor índice coincida con la RPN de la plantilla, como ya asume el código de seguimiento de disyunciones. #103929 (Groene AI). - Se corrige que
max_rows_to_transferymax_bytes_to_transferse ignoraran silenciosamente en las consultasGLOBAL INyGLOBAL JOINcon el nuevo analizador. Ahora estos ajustes generanSET_SIZE_LIMIT_EXCEEDED(o interrumpen la ejecución, segúntransfer_overflow_mode) cuando la tabla externa materializada supera el límite configurado, igualando el comportamiento del analizador anterior. Cierra #103333. #104119 (Groene AI). - Se corrige la lectura excesiva de metadatos del catálogo/S3 cuando una sentencia
INSERTo una sentencia DDL hace referencia a una tabla inexistente en una base de datos de catálogo DataLake conshow_data_lake_catalogs_in_system_tableshabilitado. La ruta de sugerencia para corregir errores tipográficos cargaba los metadatos completos de Iceberg de cada tabla para todo el catálogo, lo que podía agotar la memoria en catálogos grandes. #104124 (DQ). - Se corrige un fallo (
LOGICAL_ERROR“Columns are assumed to be of identical types, but they are different in Nullable” en compilaciones de depuración, un SIGSEGV por puntero nulo enColumnString::compareAten compilaciones release) y un resultado incorrecto que podía producirse en consultas que usandirectjoin_algorithmcon una tablaMergeTreeen el lado derecho cuando el plan de consulta reordenaba columnas durante la optimización. Las columnas del lado derecho podían acabar en posiciones con nombres incorrectos, por lo que un filtro o una comparación sobre la clave de join veía una columna del tipo incorrecto. Detectado por AST fuzzer como STID 2139-5111 y reportado en #107272. #104174 (Groene AI). - Se rechaza un ID de partición entero fuera de rango para
Dateen lugar de producir un overflow silencioso o unLOGICAL_ERRORenALTER. #104250 (Azat Khuzhin). - Se deshabilita
additional_table_filterscon réplicas paralelas y el analizador sin serialización del plan de consulta. Antes, esto podía dar lugar a resultados incorrectos. #104296 (Azat Khuzhin). - Se corrige que
dictGetOrNullsobrescribiera silenciosamente otras columnas de la proyecciónSELECTconNULLcuando se llamaba con una columna claveNullablecuyos valores faltaban en el diccionario. La función estaba mutando in situ un mapa de nulos con alias de entrada; ahora clona en profundidad la columna de resultado antes de la mutación. Cierra #73633. #104327 (Groene AI). - Se corrige una patch part dañada después de
ALTER TABLE ... DROP PARTITION ID 'patch-...'seguido deDETACH/ATTACH TABLE. Antes, la parte de cobertura vacía se escribía sinpartition.datnisource_parts.dat, lo que provocaba una entradabroken-on-start_patch-...ensystem.detached_partstras el siguiente attach o reinicio del servidor. Cierra #93132. Cierra #102103. #104353 (Groene AI). - Se corrigió el
INSERTen streaming coninput_format_max_block_wait_mspara la interfazHTTPy paraINSERT SELECT FROM input, de modo que los bloques de entrada parciales se vacíen antes de que finalice la solicitud. #104534 (Alexey Milovidov). - Se corrigió un error por el que las consultas que combinaban
arrayJoinconORDER BY ... LIMITdespués de unJOINpodían devolver cero filas sin advertencia. La optimización del plan de consulta que eleva la evaluación de funciones por encima deSortingStepya no se aplica cuando la expresión elevada contienearrayJoin, ya quearrayJoinpuede cambiar el número de filas. Cierra #82279. #104558 (Groene AI). - Se corrige una abortación poco frecuente del servidor durante la destrucción de tablas de la familia
MergeTree. La abortación podía producirse cuandoshutdownlanzaba una excepción antes de que el scheduler de trabajos en segundo plano se detuviera por completo: si una background task se activaba en esa breve ventana, despachaba una llamada virtual a través de un objeto de almacenamiento parcialmente destruido y alcanzaba__cxa_pure_virtual. #104561 (Groene AI). - Se corrige un resultado inconsistente en una subcolumna combinada
JSONcon una indicación de tipo que contiene un valor NULL. #104584 (Pavel Kruglov). - Se corrigen resultados incorrectos o una proyección omitida cuando una proyección de agregación contiene varias agregaciones
sumIfcon distintas condicionesIN (...). #104765 (Jimmy Aguilar Mena). - Se corrige un recuento incorrecto de filas de
arrayJoin()usado dentro deJOIN ON: el resultado se multiplicaba una vez más por la longitud del array. #104785 (Shaohua Wang). - Se corrige que
deltaSumTimestampdevolviera resultados incorrectos para tipos enteros con signo al cruzar cero. Resuelve #104750. #104830 (Konstantin Bogdanov). - Se corrige una discrepancia en la estructura de bloques en UnionStep tras el pushdown de filtros con constantes NULL. Cierra #104821. #104853 (Pavel Kruglov).
- Se corrige
Logical error: 'Metadata is not initialized'generado porDELETE FROMen una tablaIceberg,DeltaLakeoHudirecién adjunta cuyo archivo de metadata está corrupto o no se puede cargar. En su lugar, ahora se informa una excepción normal de cara al usuario, y el servidor sigue en ejecución. Cierra #104891. #104917 (Groene AI). - Se corrigió que
max_memory_usage_soft_limitno se actualizara sobre la marcha cuando cambiaba la configuración. El soft memory limit se calculaba una sola vez al inicio y se almacenaba en caché, por lo que las recargas posteriores de la configuración no tenían efecto. Tras esta corrección, el límite se recalcula y se aplica de inmediato en cada recarga de configuración, sin necesidad de reiniciar Keeper. #104940 (Kai Zhu). - Se corrige la resolución de símbolos JIT en macOS para que la compilación JIT de sort, expression y agregación ya no falle con
CANNOT_COMPILE_CODE: Could not find symbol _<name>. #104946 (Alexei Fedotov). - Se corrige una excepción (
Received signal 6 (abort)en el endurecimiento de vectores, observable comoTuple::back()en un vector vacío) al ejecutar una consulta de la formaSELECT ... FROM <Distributed table> WHERE/HAVING/GROUP BY ... (sharding_key_column IN tuple())conoptimize_skip_unused_shards_rewrite_inhabilitado en el nuevo analyzer. #104966 (Alexey Milovidov). - Se corrige un aborto del servidor por
Logical error: 'Inconsistent AST formatting'(STID 1941-1bfa) en consultas comoCREATE TABLE t (c0 Int CODEC(not((not(materialize(1), materialize(2)))), ZSTD)) ENGINE = Memoryen compilaciones de depuración / con sanitizers. El formateador ya no emite paréntesis externos redundantes alrededor de una llamada a la funcióntuple(...)con varios argumentos que aparece dentro de listas de argumentos deCODEC/STATISTICS/BACKUP_NAME(donde la forma de operador(a, b)está deshabilitada), lo que mantiene estable el round-trip de formatear-analizar-formatear. #104991 (Groene AI). - Se corrige
NOT_FOUND_COLUMN_IN_BLOCKlanzado porALTER TABLE ... MATERIALIZE INDEXen parts creados en 25.8 que contienen un skip index sobre una columna añadida mediante unALTER TABLE ... ADD COLUMNindependiente. La mutation ahora lee correctamente cada columna requerida por cada skip index y projection preexistentes en el part durante el recálculo forzado. Cierra #104872. #105039 (Groene AI). - Se corrigieron dos casos de
LOGICAL_ERROR: Reading from materialized CTE 'X' before it has been materializedlanzados por consultas conenable_materialized_cte: (1) una materialized CTE reutilizada filtrada porIN (subquery)sobre otra materialized CTE, y (2) una materialized CTE referenciada tanto directamente como dentro de un filtroWHERE ... IN (...)que alcanza una clave primaria de MergeTree mediante una subqueryINanidada.EXPLAINsobre esas mismas consultas también se veía afectado porque los errores se activaban durante la optimización del plan. Cierra #101940, cierra #102320. #105041 (Dmitry Novik). - Se corrige la estimación de selectividad de
PREWHEREpara estadísticascountminen columnasFloat32. Dos errores hacían que las estadísticascountminprodujeran silenciosamente estimaciones incorrectas para columnasFloat32:ConditionSelectivityEstimatoromitía por completo las estadísticas cuando el tipo de la columna (Float32) era más estrecho que el tipo del literal (Float64), recurriendo a la selectividad predeterminada e ignorando el sketch; yStatisticsCountMinSketch::estimateEqualcalculaba el hash de los primeros N bytes de un objetoField, peroFieldalmacenaFloat32comoFloat64(NearestFieldType<Float32>=Float64), por lo que el patrón de bytes usado en tiempo de consulta difería de los bytes reales deFloat32almacenados durante la build. #105047 (Han Fei). - Las consultas
ATTACH TABLE name <clauses>;que proporcionan cláusulas de almacenamiento (ORDER BY,PARTITION BY,PRIMARY KEY,SAMPLE BY,TTL,UNIQUE KEYoSETTINGSdel engine) sin unENGINEahora lanzanBAD_ARGUMENTSen lugar de volver a adjuntar silenciosamente la tabla con su definición almacenada y descartar las cláusulas proporcionadas por el usuario. LosSETTINGSde sesión a nivel de consulta (comolog_comment) se siguen aplicando. UseATTACH TABLE t;para volver a adjuntarla con los metadatos almacenados, oALTER TABLE t MODIFY SETTING ...después deATTACHpara cambiar la configuración. #105068 (Groene AI). - Se corrige un use-after-free en
runningAccumulatecuando se llama sobre una columna cuya función de agregación devuelve su propio state (por ejemplo,uniqStateOrDefaultState,sumStateOrDefaultState,uniqStateForEachState). #105085 (János Benjamin Antal). - Se corrigió un error en la UI web (
play.html): al ejecutar una consulta mientras el cursor estaba después del único;final, se mostraba “empty query” en lugar de ejecutar la consulta. #105107 (Alexey Milovidov). - Se corrige
LOGICAL_ERROR: 'No user in current context, it's a bug'cuando unCREATE TABLE ... AS SELECTdentro de una base de datosReplicatedlee desystem.current_rolesosystem.enabled_roles. La consulta ahora se ejecuta correctamente y devuelve un conjunto de resultados vacío en este contexto interno del worker de DDL. #105150 (Groene AI). - Se corrigió
ILLEGAL_TYPE_OF_ARGUMENTal fusionar estados de agregación dequantileExactWeightedInterpolated,quantileDDoquantilePrometheusHistogramcon sus equivalentes pluralesquantilesXxxMerge(y viceversa). Las variantes singulares y plurales de estas tres familias de quantile comparten el mismo estado de agregación interno, pero no estaban incluidas en la tabla interna de asignación de nombres, por lo que se rechazaban tanto la fusión de estados entre funciones como la optimización de fusión de funciones para estas familias. #105189 (Groene AI). - Se corrigen los resultados incorrectos de
toStartOfWeek,toLastDayOfWeek,toMonday,toStartOfMonth,toLastDayOfMonth,toStartOfQuarterytoStartOfYearpara argumentosDate32yDateTime64cuyo resultado queda fuera del rango deDate: en lugar de desbordarse a fechas arbitrarias, los resultados anteriores a1970-01-01ahora se limitan a1970-01-01y los posteriores a2149-06-06se limitan a2149-06-06. Esto también corrige resultados de consulta erróneos (partes y gránulos podados incorrectamente) cuando estas funciones se usaban enWHEREsobre una claveDate32oDateTime64que contenía valores fuera de rango. #105244 (Yarik Briukhovetskyi). - Se corrige un error lógico en
arrayRemovecuando el primer argumento es un Array deVariantcuyas alternativas son todas incompatibles con el tipo del segundo argumento yvariant_throw_on_type_mismatchestá deshabilitado. La función ahora trata la comparación como “nunca igual” y devuelve el Array sin cambios, en lugar de provocar un fallo deassertTypeEqualitydel lado del servidor. #105248 (Groene AI). - La consulta puede ejecutarse correctamente incluso si
FileCacheno logra crear algún directorio en disco para el almacenamiento en caché. #105250 (Den Kalantaevskii). - Se corrige el cierre abrupto del servidor con
Assertion 'px != 0' failedenExtremesTransformcuando una consulta conextremes = 1encuentra una excepción (por ejemplo,MEMORY_LIMIT_EXCEEDED) mientras la transformada construye sus columnas de extremos a partir del primer chunk. El cliente ahora recibe la excepción original en lugar de que se cierre el servidor. #105264 (Groene AI). LEFT ANTI JOINahora devuelve correctamente la columna de clave de join del lado derecho con valores predeterminados para las filas sin coincidencia, en lugar de duplicar el valor de la clave izquierda. Antes,SELECT a.x AS l, b.x AS r FROM a LEFT ANTI JOIN b ON a.x = b.xpodía devolverr = a.xpara las filas sin coincidencia cuando debería devolver el valor predeterminado (0paraInt32,''paraString,NULLparaNullable). Solo se veía afectada la columna de clave de join; las columnas derechas que no eran clave ya recibían correctamente sus valores predeterminados. El mismo bug aparecía enRIGHT ANTI JOINsiempre que el optimizador intercambiaba los lados. Cierra #99959. #105278 (Groene AI).- Se corrige la pérdida de datos en
clickhouse-localcuando se inicia repetidamente con un--default_databasedistinto dedefault(por ejemplo,clickhouse-local --path X -- --default_database=mydb): la búsqueda del UUID de la base de datos persistida estaba fijada enmetadata/default, por lo que cada reinicio generaba un UUID nuevo y las tablas de la ejecución anterior quedaban invisibles. Cierra #101831. #105284 (Groene AI). - Se corrige un logical error
Mutation ofMemorytable produced incomplete outputque se producía al ejecutarALTER TABLE <memory_table> APPLY PATCHESoALTER TABLE <memory_table> APPLY DELETED MASK. Las tablasMemoryno tienen patch parts ni máscaras de eliminación, por lo que ahora ambos comandos se tratan correctamente como operaciones sin efecto. #105286 (Groene AI). - Se corrigen las consultas de larga duración con Unity Catalog pasando un parámetro
table_iden la solicitud de la consulta. #105303 (Konstantin Vedernikov). - Se corrige
CANNOT_CONVERT_TYPEparaMergesobreMergesobreDistributedcondistributed_group_by_no_merge=1. #105330 (Azat Khuzhin). - Se corrige que
clickhouse localyclickhouse clientignoraran silenciosamente--query/-qcuando también se proporcionaba un argumento posicional de archivo. Ahora ambas variantes producenBAD_ARGUMENTSde forma consistente. #105334 (Raúl Marín). - Se corrige que
REPLACE TEMPORARY TABLEcreara silenciosamente una tabla nueva cuando el destino no existía. Ahora lanzaUNKNOWN_TABLE, en consonancia con la semántica deREPLACE TABLE. UseCREATE OR REPLACE TEMPORARY TABLEpara mantener el comportamiento de crear o reemplazar. #105373 (Groene AI). - Se corrige que las lecturas de larga duración (p. ej.,
INSERT ... SELECT) desde una base de datosDataLakeCatalogconcatalog_type = 'glue'fallaran con un errorExpiredTokenuna vez que las credenciales de sesión de STS capturadas en el momento de cargar los metadatos de la tabla superaban su vencimiento. Ahora las credenciales de AWS STS se actualizan durante la consulta, por lo que estas lecturas continúan después del vencimiento del token. #105381 (Pratima Patel). - Se corrige un logical error en
LIMIT BYnegativo en algunos casos cuando se usa conARRAY JOIN. #105403 (Nihal Z. Miaji). - Se corrige la inflación de
read_bytes(y de los bytes/s derivados que se muestran ensystem.query_log, la barra de progreso, etc.) al leer archivos Parquet. La implementación anterior informaba el compressed size total del row group en cada fragmento, por lo que leer K de N columnas sobrecontaba enN / K. Ahora solo se suma en las columnas seleccionadas. También corrige el seguimiento del progreso a nivel de archivo para las tablas Iceberg, que antes nunca informaban el tamaño del archivo de datos. #105413 (Groene AI). - Se corrige un posible segfault del servidor en las cluster table functions (
s3Cluster,urlCluster,fileCluster, …) cuando el planificador produce unSELECTcon la marcarecursive_withactivada pero sin una expresiónWITH. Cierra #105370. #105433 (Groene AI). - Se corrige un resultado incorrecto de
countDistinct/uniqExacten columnasNullablecuandocount_distinct_optimization = 1(el grupoNULLse contaba incorrectamente). #105439 (Raúl Marín). - Se corrigió un heap-buffer-overflow al leer archivos Arrow o ArrowStream con desplazamientos intermedios corruptos en una columna binaria o de cadena, así como una desreferenciación de puntero nulo al leer columnas Arrow con etiquetas geográficas. #105449 (Raúl Marín).
- Se validaron los tipos
Dynamic/Varianten la cláusula de ventanaPARTITION BY; antes no se comprobaban cuandoallow_suspicious_types_in_group_byestá deshabilitado. Cierra #105028. #105450 (Pavel Kruglov). - Se corrigió que
input_format_json_empty_as_defaultno funcionara en los formatos JSONStrings*. Cierra #104913. #105453 (Pavel Kruglov). - Se corrigió la inserción de
NULLen una columnaVariantmediante el formatoVALUESdurante el análisis de expresiones. Cierra #104909. #105455 (Pavel Kruglov). - Se corrigió que
dictGetOrDefaultlanzaraCANNOT_INSERT_NULL_IN_ORDINARY_COLUMNcuando el argumento predeterminado es una expresiónNullableyshort_circuit_function_evaluationestá habilitado con una mezcla de claves de diccionario encontradas y no encontradas. #105461 (Raúl Marín). - Se corrigió el truncamiento silencioso de valores en columnas
Dynamiccuando el lector de textoQuoted(Values) recurría aStringpara tipos inferidos incompletos comoMap(Array(Nothing), ...). Antes, el mecanismo alternativo envolvía el campo sin procesar con una concatenación ingenua de'...', por lo que una comilla simple interna (siempre presente en estos casos) cerraba prematuramente la cadena entrecomillada y se perdía el resto del valor. #105463 (Groene AI). - Se corrigió un SIGSEGV al leer subcolumnas
Dynamicde una tablaMemorycomprimida después deALTER. Cierra #104901. #105464 (Pavel Kruglov). - Se corrigió que
toFloat64/toUInt32/toString/etc. enDynamicignoraracast_keep_nullable. Cierra #104789. #105467 (Pavel Kruglov). - Se incluyó
skip_first_linesen la clave de caché del esquema para los formatosWithNames. Cierra #104527. #105469 (Pavel Kruglov). - Se corrigió un fallo de segmentación del servidor en
uniqStateOrNull/uniqStateOrDefault/uniqOrNullState(y cadenas de combinadores similares sobreuniq) cuando se usan conGROUP BY ... WITH ROLLUP,WITH CUBEoWITH TOTALSy un argumento Nullable. #105470 (Groene AI). - Se corrigió la excepción
NOT_FOUND_COLUMN_IN_BLOCKal combinarORDER BY ... WITH FILL INTERPOLATEyLIMIT N BYcon el analizador habilitado. Cierra #103474. #105481 (Yakov Olkhovskiy). - Se corrigió
toStartOfMillisecondytoStartOfMicrosecond, que devolvían un resultado desfasado por casi un segundo para valoresDateTime64negativos (anteriores al epoch), y se corrigió el signed-integer-overflow deUndefinedBehaviorSanitizerentoStartOfSecond,toStartOfMillisecondytoStartOfMicrosecondpara entradasDateTime64cercanas aINT64_MIN. #105482 (Groene AI). - Se añadió una nueva compatibility setting
analyzer_compatibility_prefer_alias_over_subcolumn(deshabilitada de forma predeterminada). Cuando está habilitada, el nuevo analizador prioriza la interpretación con prefijo de alias frente a las coincidencias con subcolumnas deTupleo columnas con puntos en identificadores de varias partes, restaurando el comportamiento del intérprete anterior. Esto evita erroresAMBIGUOUS_IDENTIFIER(y relacionados) cuando una consulta hace join con una tabla cuyo nombre coincide con una tabla interna de una CTE/subquery que usaSELECT *sobre un join, donde las columnas renombradas por asterisco (por ejemplo,b.id) podrían, de otro modo, filtrar los identificadores de la tabla interna al ámbito externo. #105491 (Vladimir Cherkasov). - Una consulta de vector search ejecutada con la optimization de solo índice ahora devuelve el valor correcto de
L2Distance()si aparece en la listaSELECT. La función devolvía incorrectamente el valor de la distancia L2 al cuadrado. Tenga en cuenta que la consulta de vector search devolvía los resultados correctamente ordenados; solo las aplicaciones que recuperaban e interpretaban explícitamente el valor deL2Distance()habrían visto el valor al cuadrado. #105495 (Shankar Iyer). - Se corrigió un problema poco frecuente en el nuevo Kafka table engine por el que los mensajes podían procesarse incorrectamente durante la reasignación de particiones de topic, lo que podía provocar que se omitieran mensajes tras un rollback de offset. #105500 (János Benjamin Antal).
- Se corrigió una excepción (
Trying to execute PLACEHOLDER actionlogical error) cuando una CTEMATERIALIZEDcuyo cuerpo es una subquery correlacionada se usa como lado derecho deIN. Ahora esa CTE se rechaza en tiempo de análisis, en consonancia con cómo ese mismo patrón ya se rechaza cuando se hace referencia directamente a la CTE enFROM. #105518 (Groene AI). - Se corrigió que la compresión de stdout/stdin no se aplicara cuando el format se especificaba explícitamente. Cierra #104441. #105528 (Pavel Kruglov).
- Se corrigió un SEGFAULT en la deserialization de
singleValueOrNullpara el tipoJSON. Cierra #103630. #105535 (Pavel Kruglov). - Se corrigió que
clickhouse-format --backslashdescartara silenciosamente los datos deINSERTVALUES. Cierra #103533. #105536 (Pavel Kruglov). - Se corrigió que
variant_throw_on_type_mismatch/dynamic_throw_on_type_mismatch=falseno capturara excepciones durante la ejecución de funciones. Cierra #103484. #105543 (Pavel Kruglov). - Se corrigió que se ignorara
input_format_try_infer_datetimesdurante la inserción en shared data enJSON. Cierra #103221. #105544 (Pavel Kruglov). - Corrige
histogram, que producía resultados incorrectos con entradas pequeñas sin ordenar. Cierra #103109. #105548 (Pavel Kruglov). - Corrige el desbordamiento circular de
DateTimecon valores fuera de rango enJSONExtracty en deserializaciones de texto. Cierra #103094. #105551 (Pavel Kruglov). - Corrige el uso de la insertion table en las table functions cuando
optimize_trivial_insert_selectestá habilitado. Cierra #103083. #105555 (Pavel Kruglov). - Corrige que la expression
CASEdevolviera la ramaELSEen lugar de la ramaTHENcorrespondiente cuando tanto la expresión como un valorWHENeranNULL. #105556 (Raúl Marín). - Corrige un fallo en
replxxcausado por alcanzar la limitaciónFD_SETSIZEdeselect(ahora sustituido porpoll). Anteriormente, con SSH o el terminal web habilitados, esto podía hacer fallar el server. #105559 (Azat Khuzhin). - Materializa las subcolumns en
executePartitionByExpressionantes de ejecutar la expresión. Cierra #103057. #105573 (Pavel Kruglov). - Corrige la excepción
NOT_FOUND_COLUMN_IN_BLOCKcuando la expresiónTTLhace referencia a una subcolumn. #105578 (Pavel Kruglov). - Corrige un fallo del server (SIGSEGV) al que podía llegar cualquier usuario con permisos de
CREATE TABLEal enviarCREATE TABLE ... TO INNER UUID '...'sin una clauseENGINEpor HTTP o el native protocol. El mismo error también hacía fallar al client. Ahora el parser informa correctamente de un errorBAD_ARGUMENTSen lugar de desreferenciar un puntero nulo. #105579 (Groene AI). - Corrige que la window function
estimateCompressionRatioperdiera los datos acumulados entre filas. Cierra #101738. #105581 (Pavel Kruglov). - Corrige un fallo al insertar tuples de distintos tamaños en la misma cláusula VALUES en una columna
String. Cierra #101727. #105582 (Pavel Kruglov). - La extracción del valor de partición de Hive ahora respeta la configuración
cast_string_to_date_time_modey acepta de forma predeterminada timestamps ISO 8601 con suffixes de zona horaria (p. ej.,+0000,+00:00,Z) en las claves de partición. #105584 (Alexey Milovidov). - Corrige el error
NOT_IMPLEMENTEDentoStringdesdeDateTimecon Timezone que contiene un valorNULL. Cierra #103712. #105587 (Yarik Briukhovetskyi). - Corrige una lectura OOB en la deserialización Native de la columna
Dynamicaplanada. #105666 (Pavel Kruglov). - Corrige un
LOGICAL_ERROR(Unexpected return type from if) que se producía durante la planificación de consultas para expresionesifcuyo tipo de resultado esVarianty cuya segunda o tercera rama es unifde condición constante sobre un literalUInt64que cabe enInt64. Cierra #105649. #105680 (Groene AI). - Corrige resultados incorrectos al leer una tabla Iceberg con
iceberg_use_version_hint = 1después de que otro writer (como la table functionicebergLocal/icebergS3), sin este ajuste, haga avanzar la tabla.version-hint.textahora se mantiene sincronizado por cada writer una vez que el archivo existe, de modo que los lectores posteriores que usan la pista vean el snapshot más reciente. #105682 (Groene AI). - Corrige un recuento inferior al real que se producía silenciosamente en consultas
SELECTcuandouse_query_condition_cache = 1(valor predeterminado). Una consulta con la formaPREWHERE pk_prefix = X WHERE non_pk IN (...)sobre una columna con un skip index de filtro Bloom contaminaba laQueryConditionCachepara el predicadopk_prefix = X, por lo que unSELECT count() ... WHERE pk_prefix = Xbenigno posterior devolvía un resultado incorrecto, por debajo del real. Afectaba a todas las releases 26.x. #104781. #105686 (Groene AI). - Corrige que
singleValueOrNullMergedevolviera un valor concreto en lugar deNULLal fusionar un estado que ya había observado varios valores distintos. #105734 (Minh Vu). - Corrige la recuperación ante errores del input format
Templatedespués de filas malformadas. #105735 (Yue Ni). - Corrige un fallo en la table function
mongodb, el almacenamiento de MongoDB y el origen de diccionario de MongoDB cuando el nombre de la collection está vacío o contiene bytes NUL. #105776 (Raúl Marín). - Corrige la limpieza de snapshots de
Keepertras writes fallidos para que los snapshots parciales se eliminen de forma segura y los writes fallidos puedan reintentarse sin avanzarlatest_snapshot_meta. #105779 (Antonio Andelic). - Corrige que
ALTER TABLE ... CLEAR COLUMNse rechazara para columnascolumns_to_sumexplícitas deSummingMergeTreeyCoalescingMergeTree. #105785 (Antonio Andelic). - Corrige una aserción en
DatabaseCatalog::tryGetDatabase(y el errorUNKNOWN_DATABASEresultante en compilaciones de release) al crear una parameterized view cuyo nombre de base de datos se proporciona mediante un query parameter, por ejemploCREATE VIEW {db:Identifier}.v AS SELECT {p:UInt64}. Los parámetros en las partes DDL de la sentenciaCREATEahora se sustituyen en el momento de la creación, mientras que los parámetros del cuerpo deSELECTsiguen disponibles para su sustitución al invocar la vista. #105799 (Groene AI). - Corrige
Bad get: has Decimal32, requested Decimal128ensumMapysumMapWithOverflowsobre una columnaNested(... Nullable(Decimal(P, S)))cuando el estado de agregación se serializa (p. ej., parallel replicas,sumMapStatemediante un formatter de estado binario, agregación externa). #105816 (Groene AI). - Se corrigen los errores
Expected ColumnLowCardinality, got String/Bad cast from type DB::ColumnString to DB::ColumnLowCardinalitycuando se usaapply_mutations_on_fly = 1en una tabla con mutacionesUPDATE/DELETEpendientes aplicadas sobre la marcha y en cola antes de una mutaciónALTER MODIFY COLUMN ... LowCardinality(...). #105847 (Raúl Marín). - Las escrituras de Iceberg ahora conservan los valores NULL en las columnas de partición
Nullable(T). Antes, un NULL escrito por ClickHouse aparecía como el valor predeterminado del tipo interno (0paraint) al volver a leerse con Spark u otros lectores de Iceberg. Cierra #105852. #105862 (Groene AI). - Se corrigió el pushdown de filtros de
ParquetyORCpara predicadosIN (subquery), lo que permite que la poda de grupos de filas/páginas/filtros bloom funcione en lecturas defile,url,s3y almacenamiento de objetos. #105863 (Arsen Muk). - Se corrige la lectura en orden para tablas
Merge(con un nuevo analizador). #105867 (Nikolai Kochetov). - Se corrigió que las eliminaciones posicionales merge-on-read de Iceberg v2 devolvieran filas incorrectas cuando un único archivo de eliminación hace referencia a varios archivos de datos y varios de esos archivos de eliminación se aplican al mismo archivo de datos. El lector de streaming (
use_roaring_bitmap_iceberg_positional_deletes = 0) ahora filtra las filas del archivo de eliminación porfile_pathen C++ en lugar de depender de la poda de grupos de filas de Parquet, restaurando el invariante de posiciones ascendentes. #105888 (Groene AI). - Se corrige el error
Cannot find columnen consultas distribuidas con filtroIN Array(...)para el nuevo analizador. #105894 (Nikolai Kochetov). - Se corrige un SIGSEGV en
ALTER TABLE ... MODIFY COLUMN ... Nullable(...)en tablasMergeTreecuando otra instrucciónALTERelimina concurrentemente una columna conSTATISTICS. Cierra #105912. #105917 (Groene AI). - Se corrigió un fallo del servidor que podía producirse cuando se cancelaba una consulta que leía desde PostgreSQL —mediante la table function postgresql, el PostgreSQL table engine o un diccionario con un origen PostgreSQL— (por ejemplo, con KILL QUERY) y fallaba la cancelación de la consulta remota en PostgreSQL. #105949 (Rory Shanks).
- Se corrige el formatting de
SYSTEM INSTRUMENT ADDpara que los argumentos del controlador estén separados por un solo espacio, y se rechazan listas no válidas de argumentos de instrumentaciónSLEEPcon más de dos valores o con un rango en el que el mínimo es mayor que el máximo. #105984 (Pablo Marcos). - Se corrigen posibles resultados incorrectos en consultas que combinan un outer join con un inner join posterior que hace referencia al lado del outer join que aporta los valores nulos. La reordenación de joins podía elegir un plan que llevaba las condiciones del inner join a la cláusula ON del outer join. #105992 (Vladimir Cherkasov).
- Se corrigió un posible fallo debido a un literal de cadena demasiado grande enviado dentro de la consulta. #105996 (Nikita Taranov).
- Se corrige la excepción
INVALID_WITH_FILL_EXPRESSIONal usarINTERPOLATE ()(vacío) con un prefijo de ordenación enORDER BYyuse_with_fill_by_sorting_prefixhabilitado. Las columnas del prefijo de ordenación ahora se excluyen correctamente del conjunto de interpolación implícita, en línea con el comportamiento deINTERPOLATE (col)cuando se nombra explícitamente. #106001 (Yakov Olkhovskiy). - Se corrigen las operaciones de partición de
ALTER TABLEque fallaban silenciosamente con claves de particiónBool. Cierra #101722. #106004 (Pavel Kruglov). - Se corrigen
JSONExtractRawyJSONHaspara rutasJSONtipadas con valores predeterminados. Cierra #101721. #106005 (Pavel Kruglov). - Se corrige la adición incorrecta del prefijo ’/’ en rutas base vacías en configuraciones de lago de datos. Cierra #105989. #106013 (thewisenerd).
- Se corrige que el motor de tabla
IcebergLocalpasara a modo de solo lectura después de un cicloDETACH+ATTACHo de reiniciar el servidor, lo que hacía que cualquierINSERTposterior fallara conLocal object storage Local is readonly. (READONLY). #106016 (Groene AI). - Se corrigen fallos de
Keeperdurante la sincronización del follower cuando la nueva cola de respuestas del despachador de solicitudes podía llenarse antes de que se iniciara el hilo de respuestas. #106049 (Antonio Andelic). - Mejor compatibilidad con el analyzer antiguo. Si la tabla tiene columnas como
x.a Array, x.b Array, x String, se da prioridad a los arrays paraARRAY JOIN x. #106069 (Nikolai Kochetov). - Se corrige que la caché del sistema de archivos se deshabilitara silenciosamente para Azure Blob Storage (por ejemplo, tablas de Delta Lake sobre Azure) porque los metadatos del objeto no incluían el ETag del blob. #106091 (thewisenerd).
- Se corrige que
system.dictionariesdevolviera 0 filas con una revocación parcial deSHOW DICTIONARIES. #106105 (Pavel Kruglov). - Se corrige un fallo del servidor al consultar tablas de DeltaLake con
allow_experimental_delta_kernel_rshabilitado y una credencial u opción que contenía bytes no válidos (la FFI de Rust entraba en pánico al cruzar el límiteextern "C"). #106109 (Raúl Marín). - Se corrigen resultados incorrectos en consultas contra tablas cuyo
ORDER BYcontiene una función monótonamente decreciente, como(c0 / -42)ointDiv(c0, -42). Los predicados sobre la columna subyacente (por ejemplo,c0 < 0) podían podar erróneamente gránulos que contenían filas coincidentes, lo que provocaba resultados ausentes. Cierra #106084. Cierra #106124. Cierra #106080. #106136 (Nihal Z. Miaji). - Se corrige el soporte para usar UDF SQL de
WASMen definiciones deMATERIALIZED VIEW. #106161 (Yue Ni). - La poda de particiones de Iceberg ahora maneja correctamente los filtros
WHERE partition_col = (SELECT ... FROM ...)en los que el analyzer envuelve el resultado de la subquery escalar en un_CAST(Const, 'TargetType')interno con tipos de origen y destino coincidentes. Antes, estos filtros desactivaban la poda de particiones y provocaban un escaneo completo de la tabla. #106204 (Groene AI). - Se corrigió el parámetro
--query_idde clickhouse local para que permita especificar un Query id personalizado. #106205 (Yue Ni). - Se corrigió que la clase de almacenamiento S3 (
s3_storage_class/s3_storage_class_name) se ignorara en los objetos escritos mediante multipart upload en discosS3y object storage, lo que hacía que los objetos grandes se crearan con la claseSTANDARDpredeterminada. El nombre de la opción ahora se acepta tanto comos3_storage_classcomos3_storage_class_namepara discos, object storage y backups. #106214 (Alexey Milovidov). - Se corrigió un problema por el que Keeper a veces se quedaba bloqueado al iniciar cuando la configuración
nuraft_max_log_gap_in_streamse establecía en un valor no predeterminado (el valor predeterminado es 0; es decir, desactiva el pipelining de las requestsappend_entries). #106220 (Michael Kolupaev). - Ahora se valida en la inserción el estado corrupto de la función de agregación
DDSketch(claves de bin) en lugar de aceptar datos malformados. #106236 (Yarik Briukhovetskyi). - Se corrigió un desajuste en el modo coordinator cuando las subqueries aplican una sobrescritura de la configuración de orden. #106243 (Nikita Taranov).
- Se corrigió un problema por el que
optimize_skip_unused_shardsno se aplicaba (yforce_optimize_skip_unused_shardsfallaba erróneamente) cuando se consultaba una tablaDistributeda través de una tablaMergeo de la table functionmerge, con el predicado aplicado por encima. #106250 (Nikolai Kochetov). - Se corrigió que
INTERPOLATE ()arrojaraINVALID_WITH_FILL_EXPRESSIONcuando se asignaban alias a columnasORDER BYen la listaSELECTcon el analyzer antiguo. Cierra #106248. #106252 (Yakov Olkhovskiy). - Se corrigió un abort al deserializar un estado malformado de
AggregateFunction(uniqTheta, ...)desde una entradaRowBinaryo un query parameter. La entrada no válida ahora se rechaza conCORRUPTED_DATAen lugar de escapar como unastd::exceptiony abortar el proceso medianteabortOnFailedAssertion. #106260 (Groene AI). - Ahora se rechazan los bytes
IntervalKindfuera de rango durante la decodificación de tipos deRowBinaryWithNamesAndTypes(input_format_binary_decode_types_in_binary_format = 1) con un errorINCORRECT_DATAclaro, en lugar de construir unDataTypeIntervalcon un tipo no válido que posteriormente podría desencadenar un comportamiento indefinido en rutas hash. #106261 (Groene AI). - Se corrigió un issue de rollback por fallo de downgrade de
SLRUen26.1+. Se corrigió la prioridad de la división de cachéSystem/Datacon la featurekeep_free_space_ratio. #106286 (Kseniia Sumarokova). - Se corrigió la lectura de la subcolumna
nullcomo una rutaJSONenNullable(JSON)en lugar de hacerlo como mapa de nulos. Cierra #106085. #106295 (Pavel Kruglov). - Se corrigió que
RestCatalog::emptydevolviera un resultado incorrecto cuando un catálogo REST de Iceberg contiene tablas. #106301 (Lefteris). - Se corrigió una excepción en consultas
INNER JOINcon una tablaMergeTreeizquierda vacía cuandoenable_parallel_replicas,query_plan_use_new_logical_join_stepyquery_plan_optimize_join_order_algorithm = 'greedy'están habilitados. #106338 (Nikolai Kochetov). - Se corrigió una conversión incorrecta de valores subnormales
Float16aFloat32(por ejemplo, al leerlos desde archivos.npyde Numpy), causada por un desplazamiento de la mantisa desfasado en una unidad. #106343 (Joanna Hulboj). - Se corrigió un fallo y un posible error
NOT_FOUND_COLUMN_IN_BLOCKcuando la optimización basada en restricciones (optimize_using_constraints) se usa con subconsultas correlacionadas. #106349 (Raúl Marín). - Se corrigió una lectura fuera de los límites en
sipHash64Keyed,sipHash128KeyedysipHash128ReferenceKeyedal calcular el hash de una columna cuyas matrices están todas vacías y cuya clave no es constante. #106355 (Raúl Marín). - Se corrigió que
SYSTEM RELOAD CONFIGdescartara la configuración de Azure Blob Storage por endpoint (comouse_native_copy), lo que provocaba que la configuración del disco se ignorara paraBACKUP/RESTOREhasta que se reiniciara el servidor. #106357 (Julia Kartseva). - Se corrigió
regexpExtract(haystack, pattern)para que los patrones sin grupo de captura devuelvan la coincidencia completa en lugar de lanzarINDEX_OF_POSITIONAL_ARGUMENT_IS_OUT_OF_RANGE. #106374 (Groene AI). - Se corrigió la excepción
LOGICAL_ERRORdurante la predescarga de caché cuando un objeto remoto de S3 se sobrescribe con contenido más corto entre el listado y la lectura. #106375 (Nikita Fomichev). - Se corrigió el aumento del uso de memoria en la caché del sistema de archivos. #106387 (Kseniia Sumarokova).
- Se corrigieron múltiples lecturas fuera de los límites del montón en el lector del formato Arrow IPC (
ArrowColumnToCHColumn). Un archivo Arrow malformado podía declarar más filas de las que contienen sus búferes, declarar longitudes de elementos hijo de list/struct/map incompatibles con su elemento padre, proporcionar desplazamientos de lista no monótonos o truncar un bitmap de validez hijo, lo que causaba lecturas más allá del final de las asignaciones del montón. Esto puede ser explotado por cualquier usuario con privilegioSELECTmediantefile(),format(), funciones de tabla o entradas ArrowFlight. Ahora se validan todos los búferes de datos, desplazamientos, view-struct y bitmap de validez antes de cualquier acceso a punteros sin procesar, y se comprueba la consistencia de las formas y los desplazamientos de list/struct/map. #106395 (Raúl Marín). - Se corrigió que las copias de seguridad fallaran con
FILE_DOESNT_EXISTcuando el destino REPLACE de una vista materializada actualizable se recopila en una base de datos Replicated o Shared cuya vista materializada aún no está instanciada en la réplica que inicia la copia de seguridad. #106411 (Julia Kartseva). - Corrige un error lógico
Column identifier ... is already registeredcuando un predicado de mutation (DELETE/UPDATE) contiene una subconsultaIN/EXISTSque lee de una expresión de tabla predeterminada anidada dentro de otra subconsulta. #106414 (Alexey Milovidov). - Corrige un error lógico (
Left and right columns have same names) en el optimizador del orden de join que podía producirse en joins ejecutados con réplicas paralelas cuando dos relaciones del grafo de join comparten nombres de columna. #106418 (Alexey Milovidov). - Corrige un error lógico al construir un diccionario de polígonos a partir de datos de origen que contienen coordenadas de punto
NaNo infinitas. Ahora, esas coordenadas se rechazan con un mensaje de error claro. #106423 (Alexey Milovidov). - Se corrigió un error por el que las columnas
used_privilegesymissing_privilegesdesystem.query_logpodían contener cadenas de privilegios filtradas de consultas anteriores no relacionadas, de otro usuario, base de datos o sesión. #106425 (Alexey Milovidov). - Las funciones
base58Encode,base58DecodeytryBase58Decodeahora respetanmax_execution_timey la cancelación de consultas con entradas grandes, y rechazan entradas de más de 10 KB en lugar de ejecutarse durante demasiado tiempo. El límite se puede configurar mediante el nuevo ajustefunction_base58_max_input_size(0lo desactiva). #106428 (Alexey Milovidov). - Corrige resultados incorrectos esporádicos en consultas
ORDER BY ... DESCal leer wide parts en orden inverso conread_in_order_use_virtual_row_per_block = 1y unmax_block_sizepequeño. #106429 (Vladimir Cherkasov). - Se corrigió una excepción
NOT_FOUND_COLUMN_IN_BLOCKal consultar una tabla Iceberg o una tabla S3 con unWHEREcompuesto que contieneIS NOT NULLsobre una columna que no está en la listaSELECT, usando el Native reader de Parquet V3. #106443 (Shaohua Wang). - Permite al usuario especificar encabezados para
HTTPDictionarymediante named collections. #106459 (Jan Rada). - Corrige un caso en el que un worker thread podía quedar asociado a un grupo de hilos obsoleto después de que
CurrentThread::attachToGroupfallara a mitad del proceso, provocando que tareas posteriores en el mismo hilo fallaran conThread is already attached to a group. #106462 (Mikhail f. Shiryaev). - Se corrigió una excepción cuando una consulta de vector search usa un vector index y también otro skip index como
minmax, conuse_skip_indexes_on_data_read = 1. #106473 (Shankar Iyer). - Los valores de enum
Avromal formados ahora se validan y se rechazan con un error, en lugar de provocar una lectura fuera de límites y un aborto al deserializar datosAvrocorruptos. #106476 (Miсhael Stetsyuk). - Corrige informes de progreso inflados al leer tablas Iceberg con filtros
_fileo_path. Antes, el progreso detotal_bytes_to_readincluía todos los archivos del manifest independientemente del filtrado. #106491 (Pedro Ferreira). - Se corrigió una
Bad cast exceptionen diccionarios de Redis que usanSTORAGE_TYPE 'simple'con layoutcache/directy una única clave de cadena (compleja); ahora estos diccionarios funcionan, y las claves compuestas sobre almacenamientosimplemuestran un error claro. #106501 (Vladimir Cherkasov). - Se corrigió un error de resultados incorrectos por el que
WHERE c0 = constno devolvía filas en tablas conORDER BY f(c0)cuandof(const)se evalúa como NaN; por ejemplo,ORDER BY sqrt(c0)con una constante negativa. El análisis de la clave primaria descartaba incorrectamente todos los gránulos y contaminaba la caché de condiciones de consulta para consultas posteriores. #106507 (Groene AI). - Se corrigió que
LIMIT WITH TIESyLIMIT WITH TIESfraccional no respetaran la colación deORDER BY ... COLLATEal determinar los empates. Las filas que eran iguales según la colación (por ejemplo,'1'y'01'con colación numérica) se comparaban byte a byte, por lo que algunas filas empatadas se omitían incorrectamente del resultado. #106539 (Nihal Z. Miaji). - Se corrigieron las optimizaciones
DISTINCTin order yLIMIT BYin order (incluidoLIMIT BYnegativo), que devolvían resultados incorrectos cuando la entrada estaba ordenada con una colación (ORDER BY ... COLLATE). Las filas que son iguales según la colación (por ejemplo,'a'y'A'con una colación insensible a mayúsculas y minúsculas) se ordenan por clave de colación y no quedan adyacentes por valor, por lo que ahora la optimización in order se omite cuando se usa un comparador de colación. #106564 (Nihal Z. Miaji). - Se corrigieron resultados incorrectos para
SELECT c, count() FROM t WHERE c GROUP BY cen tablas con_minmax_count_projectionimplícita, una proyección de agregación explícita o una proyección normal: antes, todos los grupos colapsaban en una sola fila con una clave constante y el recuento total de filas. #106590 (Groene AI). - Se corrige un error por el que los usuarios no podían usar subconsultas escalares en el primer argumento de
INcuando el segundo argumento es una tupla no constante. #106610 (Yarik Briukhovetskyi). - Se corrigió la excepción
Mutation ofMemorytable produced incomplete outputque se producía al ejecutar comandosALTER TABLE <memory_table>sin efecto por fila sobre datos en un motorMemory, concretamenteAPPLY PATCHES,APPLY DELETED MASK,MATERIALIZE STATISTICS,MATERIALIZE INDEX,MATERIALIZE PROJECTIONyREWRITE PARTS. Las tablasMemoryno poseen esas estructuras, por lo que esos comandos ahora se tratan como no-ops. #106621 (Groene AI). - Se corrigió que
session_timezonese ignorara al serializar columnasLowCardinality(DateTime)a formatos de texto (CSV, TSV, JSONEachRow, etc.). Antes, tras la primera escritura de una columnaLowCardinality(DateTime)en un servidor, cualquier consulta posterior que escribiera una columna de ese tipo mostraba la cadena de hora local en la primera zona horaria observada, independientemente desession_timezone. #106634 (Groene AI). - Se corrigió un
LOGICAL_ERROR“Trying to get name of not a column:ExpressionList” generado por consultas que pasan un asterisco dentro demultiIfa un argumento de función de tabla; por ejemplo,numbers(multiIf(*, ...), 2). La consulta ahora rechaza el matcher no resoluble conUNSUPPORTED_METHOD. #106647 (Groene AI). - Se corrige el fallo del servidor al iniciar con
Too many marks in file ...skp_idx_idx.cmrk4, marks expected 0 (bytes size 0)cuando una tablaMergeTreetiene una parte de índice de omisión con cero granules y un archivo de marks no vacío en disco. #106675 (Groene AI). - Se rechazan los glob patterns patológicos de
fileque provocarían una recursión no acotada en el listado de directorios. Ahora se aplica una profundidad máxima de recursión de 1000; las consultas que la superen generanTOO_DEEP_RECURSIONen lugar de hacer que el servidor falle por stack overflow. #106676 (Groene AI). - Se corrige el aborto del servidor
Bad cast from type DB::ColumnNothing to DB::ColumnVector<char8_t>enFunctionIf::executeForConstAndNullableConditioncuando la condiciónif/multiIfse pliega como constante aConst(Nullable(Nothing))(por ejemplo, un subíndice fuera de rango sobre un array vacío, comoarraySort(x -> x, [])[toNullable(1)]). #106678 (Groene AI). - Se corrige la Exception
'Trying to read from input() twice.'que se producía cuando la función de tablainputestaba envuelta en una CTE no MATERIALIZED a la que se hacía referencia desde más de un lugar de la consulta. Ahora la consulta se rechaza con un error claroINVALID_USAGE_OF_INPUTen tiempo de planificación.inputes un flujo de client de un solo uso y solo puede ser consumido por un único origen en el plan de consulta. #106682 (Groene AI). - Hace que
FORMATse aplique también a la salida deEXPLAINdeEXPLAIN ... INSERT ... SELECT ... FORMAT ...cuandoSETTINGSprecede aFORMATo cuando el output format esValues. Seguimiento de #101772. #106686 (Alexey Milovidov). - Se corrigió un error
RESOURCE_ACCESS_DENIEDespurio y poco frecuente (“Scheduler queue with resource request is about to be destructed”) para una consulta a la que en realidad se le había concedido acceso a un recurso de carga de trabajo, causado por la reutilización de un objeto request local al hilo que retenía el fallo de una request anterior. #106690 (Alexey Milovidov). - Se corrige una condición de carrera entre la destrucción de objetos
INATSConsumery las llamadas aINATSConsumer::onMsgsobre ellos mediante callbacks en la biblioteca NATS. #106692 (Miсhael Stetsyuk). - Se corrigió que
match,extract,extractAllycountMatchesdevolvieran resultados incorrectos para expresiones regulares que contienen secuencias de escape hexadecimales u octales. #106709 (ofeliacode). - El TLS interno de Raft de Keeper ahora respeta la configuración
openSSL.client.verificationMode. Antes, la verificación de certificados de los pares siempre estaba habilitada para la comunicación Raft entre nodos de Keeper, independientemente de esta configuración, por lo quenonese ignoraba silenciosamente. Ahoranonedeshabilita explícitamente la verificación de certificados de pares de Raft, mientras que la ausencia de esta configuración mantiene el comportamiento anterior, seguro por defecto. Las configuraciones que establezcan explícitamentenonedejarán de verificar los certificados de pares de Raft después de la actualización, en consonancia con la intención configurada. #106726 (Antonio Andelic). - Se corrige un error lógico en los scripts de inicio en
SYSTEM RELOAD CONFIG. Además, se cargan los scripts de inicio enSYSTEM RELOAD CONFIG(funcionalidad actualmente disponible solo de forma privada). #106727 (Miсhael Stetsyuk). - Revierte un cambio que hacía que
sumMap/ el combinador-Maprechazaran tipos numéricos de valor con nombres personalizados (comoSimpleAggregateFunction(sum, T)yBool) conILLEGAL_TYPE_OF_ARGUMENT: Values for -Map cannot be summed, lo que rompía agregaciones que antes funcionaban. #106729 (Nikita Fomichev). - Se corrigieron varios problemas de seguridad de memoria y agotamiento de recursos en lectores de formato accesibles desde entradas no confiables: una lectura fuera de los límites del montón en el manejo de la longitud de los niveles de definición/repetición de
DataPageV2del lector nativo de Parquet, un desbordamiento de pila en archivos Parquet con esquemas profundamente anidados y asignaciones de memoria que ignorabanmax_memory_usageal analizar geometrías WKB/WKT de GeoParquet y cadenas/bytes de Avro. #106739 (Raúl Marín). - Se corrigió un heap buffer overflow (fallo del servidor) en
decodeHTMLComponental decodificar cadenas que contienen las entidades HTML expansivas≫⃒o≪⃒, explotable por cualquier usuario con un soloSELECT. #106741 (Raúl Marín). - Rechaza
CREATE TABLE,ALTER TABLE ADD INDEXyCREATE INDEXconGRANULARITY 0para skipping indexes con un errorBAD_ARGUMENTSclaro. Antes, esto provocaba una excepciónInconsistent AST formattingen compilaciones de depuración. #106783 (Groene AI). - Se corrigió que Azure BACKUP/RESTORE ignorara la configuración del endpoint para discos
azure_blob_storagecon formato heredado. #106784 (Julia Kartseva). - Se corrigió una excepción
Bad castal podar partes mediante estadísticasMinMaxcuando una columna clave esLowCardinalityy la constante del predicado esLowCardinality(Nullable(...)). #106793 (Groene AI). - Corrige columnas incoherentes (que más tarde provocan
LOGICAL_ERROR) en caso de excepción (es decir,MEMORY_LIMIT_EXCEEDED) durante el análisis sintáctico. #106802 (Azat Khuzhin). - Corrige que, después de configurar
keeper_server.http_control.secure_port, el servidor devolviera una respuesta HTTP al realizar solicitudes desde clientes HTTPS. #106822 (linjiayu1025-collab). - Corrige un error lógico en
parseDateTimecon bytes de entrada no ASCII. #106856 (Pavel Kruglov). - Corrige que
SHOW CREATE ROW POLICYemitierarestrictive/permissiveen minúsculas en lugar de mayúsculas, de forma inconsistente con otras palabras clave. #106865 (Valery Petrov). - Corrige el caso en que parallel replicas no se aplicaba a una vista con
UNIONdebido a una tabla vacía en elUNION. #106900 (Igor Nikonov). - Corrige un fallo del servidor (SIGSEGV) al leer datos
Protobuftruncados coninput_format_allow_errors_num > 0. #106905 (Andrey Tsarevskiy | Андрей Царевский ). - Corrige la excepción
THERE_IS_NO_COLUMNen consultas distribuidas que involucran la optimizaciónoptimize_rewrite_aggregate_function_with_ifcuando el argumento de la función de agregación requiere un cast al tipoNullable. #106908 (Yakov Olkhovskiy). - Corrige una excepción (
LOGICAL_ERROR) en el filtro en tiempo de ejecución de JOIN cuando la clave de join contiene un tipoVariantoDynamicanidado dentro de unTuple,ArrayoMap, y el lado derecho del join tiene un único valor distinto. #106931 (Groene AI). - Se corrigió un desbordamiento de enteros con signo (comportamiento indefinido) en
arrayLevenshteinDistanceWeightedyarraySimilaritycuando los arrays de pesos contienen valores enteros grandes. La distancia ponderada ahora se acumula en un entero de mayor tamaño para pesos integrales, por lo que los pesos enteros grandes ya no se desbordan y siguen siendo exactos. #106934 (Groene AI). - Corrige un fallo del servidor (desreferenciación de puntero nulo) al ejecutar
TRUNCATEoDROPen una tablaEmbeddedRocksDBcuyo identificador de RocksDB se había liberado; por ejemplo, una tablaread_onlycuyo directorio de datos había sido vaciado por unTRUNCATEanterior. #106940 (Groene AI). - Corrige una excepción (
std::length_errorreportada comoLOGICAL_ERROR) al leer desde una table function*ClustercomourlClustercon una configuraciónmax_streams_for_files_processing_in_cluster_functionsmuy alta. El número de streams ahora se limita a un valor razonable. #106946 (Groene AI). - Corrige un fallo del servidor (desreferenciación de puntero nulo de
DB::IConnections) enRemoteQueryExecutorcuando una consulta distribuida se cancela justo antes de enviarse a un shard. #106950 (Groene AI). - Se corrigió que
elapsed_usfuera siempre cero y queread_rows/read_bytesse contabilizaran por debajo de su valor real ensystem.processors_profile_logysystem.query_logpara consultas de flush de inserción asíncrona (AsyncInsertFlush). #106982 (Christoph Wurm). - Corrige un fallo (
Source column is not Map/SIGSEGV) al fusionar bloques ordenados que contienen una columnaVariantcon una varianteMapcuyo orden de almacenamiento local difiere de su orden global. #107011 (Groene AI). - Corrige un error lógico
conflicted_part_name.has_value()generado durante una inserción síncrona en una tablaReplicatedMergeTreecuando el bloque insertado se deduplicó por completo y el nodo de deduplicación de la parte en conflicto ya había sido eliminado (por ejemplo, mediante unDROP PARTITIONconcurrente). #107026 (Groene AI). - Se corrigió una excepción (error lógico
this->visited_views == right->visited_views) enINSERTcuando dos vistas materializadas sobre la misma source table escriben en la misma target table y una vista dependiente lee esa target table, conmaterialized_views_squash_parallel_insertshabilitado. #107027 (Groene AI). - Se corrigió un error lógico
Block structure mismatch in UnionStep stream(aborto del servidor en builds de depuración/sanitizer,Code: 49en builds de release) que se producía cuando una rama de unUNION/INTERSECT/EXCEPTleía una columna serializada comoSparsemientras que la rama hermana leía esa misma columna comoFull(por ejemplo, al enviarla a una vista materializada). #107041 (Groene AI). - Se corrigió una excepción
LOGICAL_ERRORal insertar en una tabla DeltaLake con columnas que no coinciden con su esquema de escritura (por ejemplo, una columnaNestedque se descompone en subcolumns, o una table function con un subconjunto explícito de columnas). Ahora, esas inserciones fallan con un errorINCOMPATIBLE_COLUMNSvisible para el usuario. Cierra #87402. #107058 (Groene AI). - Se corrige el error
TYPE_MISMATCH(“No se puede convertir la cadena … al tipo …”) en consultasORDER BY <numeric column> ... LIMIT ncuando la materialización diferida colocaba otra columna antes de la columna de ordenación. Ahora, el umbral top-K se lee de la columna de ordenación correcta. #107060 (Groene AI). - Se corrigió un error de sintaxis cuando una cláusula
FORMAT,SETTINGSoINTO OUTFILEsigue aSHOW ROW POLICIESoSHOW MASKING POLICIES(p. ej.,SHOW ROW POLICIES FORMAT TabSeparated). #107061 (Groene AI). - Se corrige un
ALTER TABLE ... RENAME COLUMN a TO b, RENAME COLUMN c TO acompuesto que reutiliza un nombre de columna liberado (un “intercambio”) entre columnas de distintos tipos. La part materializada registraba el tipo de columna incorrecto, por lo que unSELECTposterior fallaba conConversion between numeric types and IPv6 is not supported(o se abortaba al cargar la part en builds de depuración). #107064 (Groene AI). - Se corrigieron los resultados no deterministas de la función
roundDowncuando el array de boundaries contieneNaN. El mismo valor de entrada podía devolver un boundary finito oNaNsegún las filas circundantes del lote. Ahora, los boundariesNaNse ignoran, por lo que el resultado depende solo de los boundaries finitos. #107065 (Groene AI). - Se corrigió que
quantileTDigestyquantileTDigestWeightedlanzaranDECIMAL_OVERFLOWpara argumentosDateyDateTimecuando el quantile interpolado es fraccionario pero está dentro del rango (por ejemplo,quantileTDigestWeighted(date, weight)sobre valores que todos caben en el tipo). Ahora, el resultado fraccionario se trunca al tipo de resultado, en consonancia conquantilesTDigestWeighted; los valores realmente fuera de rango siguen generando un error. Cierra: #106722. #107066 (Groene AI). - Se corrige que
trimLeft,trimRightytrimBoth(y los aliasesltrim,rtrim,trim) lanzaranTOO_LARGE_STRING_SIZEcuando el character set de recorte personalizado tiene más de 16 caracteres. Los conjuntos de recorte de cualquier longitud vuelven a estar admitidos. #107071 (Nikita Fomichev). - Se corrigió el truncamiento silencioso de valores enteros fuera de rango en definiciones de tipo
Enum8/Enum16. Ahora,Enum8('a' = 200)lanzaARGUMENT_OUT_OF_BOUNDen lugar de crear silenciosamenteEnum8('a' = -56). #107081 (Groene AI). - Se corrige el orden incorrecto de las filas (y un
LOGICAL_ERROR“Rows are not sorted with permutation” en builds de depuración) en consultasORDER BY ... LIMITde varias columnas que ordenan por columnasNullablecuando varias filas empatan en las columnas principales. #107094 (Groene AI). - Se corrige un
LOGICAL_ERROR(Expected the argument N to have X rows, but it has Y) al ejecutar una función sobre una columnaDynamicgenerada por un JOIN sobreDynamic(por ejemplo, las filas no emparejadas de unRIGHT/FULL JOIN, o una subconsultaEXISTScorrelacionada y descorelacionada en un JOIN). #107095 (Groene AI). - Se corrige la recreación espuria de la sesión de ZooKeeper al recargar la configuración. #107096 (Azat Khuzhin).
- Se evita mantener el mutex durante las lecturas de ZooKeeper al actualizar las entidades de acceso. #107097 (Azat Khuzhin).
- Se corrige una excepción
Logical error: Too large size passed to allocatoral hacerINSERTen una tablaMergeTreecuandoadaptive_write_buffer_initial_sizese establece en un valor extremadamente grande. El tamaño inicial del búfer de escritura adaptativo ahora se limita al máximo del búfer. #107104 (Groene AI). - Se corrige
LOGICAL ERROR(Bad cast from type DB::ColumnString to DB::ColumnLowCardinality) cuando se compara una constanteVariantque contiene un miembroLowCardinalitycon una columna clave cuya expresión clave es una función determinista no monótona (por ejemplo, un skip indexminmaxsobresipHash64(col)). #107111 (Groene AI). - Se corrige un error lógico
Bad cast from type DB::IColumn const* to DB::ColumnNullable const*cuando se pasa un asterisco calificado (t.*) sobre una claveJOIN ... USINGa una función de agregación y el otro lado de un OUTER JOIN tiene una claveNullable(conjoin_use_nulls = 0). #107129 (Groene AI). - Se corrigen lotes de
ALTER TABLE ... ON CLUSTERque mezclanMODIFY SETTING/RESET SETTINGcon un cambio de comentario (por ejemplo,MODIFY COMMENT 'x', MODIFY SETTING old_parts_lifetime = 123) y que se aplicaban solo en la réplica líder, dejando desincronizadas las demás réplicas. También se corrige que unMODIFY COLUMN ... COMMENTposicional o conSETTINGSpor columna se clasificara erróneamente como un cambio local de metadatos solo de comentario, lo que dejaba el reordenamiento de columnas fuera de los metadatos replicados y podía causarINCOMPATIBLE_COLUMNSal reiniciar la réplica. #107142 (Groene AI). - Se corrige un
LOGICAL_ERROR(“Table expression … data must be initialized”) que se producía cuando un selector de asterisco calificado (por ejemplo,x.*) hacía referencia por nombre a una CTE recursiva dentro de su propio término recursivo. Estos selectores ahora expanden las columnas de la tabla recursiva, igual que ya lo hacen en esa posición una columna calificada (x.a) o un selector no calificado (*). #107144 (Groene AI). - Se corrigieron resultados de consulta incorrectos causados por la caché de condiciones de consulta cuando las mutations sobre la marcha (
apply_mutations_on_fly) o las patch parts filtraban filas antes dePREWHERE. Una consulta leída conapply_mutations_on_fly = 1podía contaminar la caché, de modo que una consulta posterior conapply_mutations_on_fly = 0y el mismo predicado omitiera marcas que debería haber leído y devolviera muy pocas filas. La misma corrección también cubre las políticas de seguridad a nivel de fila, que se anteponen como un filtro antes dePREWHERE: una consulta ejecutada bajo una política de fila restrictiva podía contaminar la caché para una consulta posterior que usa el mismo predicado sin esa política. #107145 (Groene AI). - Se corrigió
BACKUPenAzureBlobStorage: al copiar un archivo de datos dentro de una copia de seguridad, el objeto de destino se escribía fuera del directorio de la copia. Las comprobaciones de existencia de objetos de Backup en destinosS3ahora usan solicitudesHeadObjectexactas en lugar de listar por prefijo, lo que evita coincidencias falsas con claves de prefijos similares. #107153 (Pablo Marcos). - Se corrigió un desbordamiento de enteros con signo en
quantileExactExclusive,quantilesExactExclusive,quantileExactInclusiveyquantilesExactInclusiveque podía producir resultados incorrectos para entradasInt64que abarcan un rango amplio. #107154 (Groene AI). - Se corrigió un
LOGICAL_ERROR(“Unexpected exception in refresh scheduling”) que podía hacer que el servidor entrara en un bucle de fallos al reiniciarse cuando una vista materializada actualizable tiene una dependenciaREFRESH ... DEPENDS ON <name>cuyo nombre no calificado coincide con una tabla temporal o con el nombre de una CTE. #107156 (Groene AI). - Se asegura que no se ejecuten scripts de inicio al recargar la configuración, ya que eso es semánticamente incorrecto, inesperado para los usuarios y, además, propenso a errores. #107187 (Miсhael Stetsyuk).
- Se limita el valor máximo de
queue_sizepara la prerreserva. #107205 (Elian Gidoni). - Se corrige el error
Argument ... of GROUPING function is not a part of GROUP BY clauseen consultas que usan la funcióngroupingcon la configuracióngroup_by_use_nullshabilitada. #107206 (Nikolai Kochetov). - Se corrige el orden incorrecto de los resultados para
ORDER BYsobreUNION ALLconoptimize_read_in_orderhabilitado cuando la canalización deUNIONse estrechaba debido a la configuraciónmax_streams_for_union_step; ahora ese estrechamiento se omite cuando el plan depende de streams de salida deUNIONordenados. Cierra #106880. #107208 (Vladimir Cherkasov). - Se corrigió una posible desreferenciación de puntero nulo al resolver la configuración del proxy durante la fase final del apagado del servidor. #107231 (Pedro Ferreira).
- Se corrigen las consultas de actualización ligera
UPDATEcon réplicas paralelas heredadas habilitadas para tablasMergeTreeno replicadas. #107246 (Groene AI). - Se corrigió una abortación del servidor (error lógico
std::out_of_range) al insertar en una tablaIcebergcuyos nombres de columna del bloque de escritura no coinciden con los ID de campo del esquema más reciente (por ejemplo, después de que un escritor concurrente cambie el nombre de una columna dentro de la ventanaiceberg_metadata_staleness_ms). Ahora la inserción falla con un error de consulta claro en lugar de provocar el cierre del servidor. #107279 (Groene AI). - Se corrige el bloqueo durante el apagado en server y local debido a que los pool de hilos estáticos mantenían hilos inactivos indefinidamente si
max_*_thread_pool_free_size > 0. #107291 (Miсhael Stetsyuk). - Se corrige que la función de tabla
s3ignorara silenciosamente unpartition_strategyposicional en minúsculas (por ejemplo,hive). #107297 (Julia Kartseva). - Se corrige el manejo de
low_cardinality_allow_in_native_format=0en la serialización de bloques en paralelo. #107319 (Azat Khuzhin). - Corrige resultados incorrectos (a menudo vacíos) de
ORDER BY <col> LIMIT ncuando la optimizaciónuse_skip_indexes_for_top_kestá activa y una parte con un índice de omisiónminmaxen la columna de ordenación tiene filas eliminadas mediante una eliminación ligeraDELETE. La optimización ya no prioriza elminmaxobsoleto de las partes afectadas por una eliminación ligera frente a las partes que contienen las filas superiores activas. #107320 (Groene AI). - Se corrigió un error en ClickHouse Keeper por el que los metadatos de la instantánea informados mediante
last_snapshot(yzk_latest_snapshot_sizeenmntr) podían retroceder tras instalar una instantánea obsoleta o duplicada. Esto también podía permitir que una instantánea local con el mismo índice sobrescribiera en su lugar un archivo de instantánea registrado mientras todavía se estaba transmitiendo a un par o subiendo a S3. #107321 (Antonio Andelic). - Se corrigió un posible desbordamiento de pila del servidor (crash) al leer un esquema o valor profundamente anidado en los formatos
MsgPack,BSON,ORC,Parquet,JSON,DeltaLake,IcebergyPaimon. Este tipo de entrada profundamente anidada ahora se rechaza con una excepción. #107341 (Raúl Marín). - Corrige un posible logical error en
SYSTEM SYNC DATABASE REPLICA ... STRICTy hace que el modificadorSTRICTsurta efecto realmente en las réplicas de base de datos. #107344 (Pedro Ferreira). - Corrige una finalización abrupta del servidor en builds de depuración/sanitizador al leer una tabla
DeltaLakecuyo esquema de ClickHouse nombra una columna que no está presente en el mapeo de columnas de Delta, por ejemplo, después de que una columna se haya renombrado o eliminado en el log de Delta. Ahora la consulta falla con un errorINCORRECT_DATAcapturable. #107347 (Groene AI). - Corrige que
ORDER BY ... WITH FILLprodujera filas adicionales cuando una columna deORDER BYanterior a la columna de relleno usa una intercalaciónCOLLATE. Ahora las filas se agrupan por el prefijo de ordenación usando esa intercalación, en consonancia con el orden de clasificación. #107365 (Groene AI). - Se corrigió un crash (
LOGICAL_ERRORen builds de depuración) y un error silencioso de resultados incorrectos (en builds de lanzamiento) al leer una tabla Iceberg cuyos metadatos vuelven a asociar unschema-idexistente con un esquema distinto entre versiones de metadatos. Esos metadatos ahora se rechazan conICEBERG_SPECIFICATION_VIOLATION. #107370 (Groene AI). - Corrige un
LOGICAL_ERROR(Variant N (T) has size X, but expected Y) cuando una función comotoStringoconcatse aplica a una columnaVariantoDynamicque contiene una única variante no vacía junto con valores NULL, y la función devuelve su columna de entrada sin cambios. #107374 (Groene AI). - Corrige
Logical error: 'Duplicate announcement received for replica number N', que podía producirse con réplicas paralelas cuando una subconsulta escalar contenía subconsultas anidadas que leían la misma tabla. #107381 (Groene AI). - Corrige
getServerSettingpara que devuelva el valor efectivo en uso de los ajustes del servidor que pueden cambiarse en tiempo de ejecución (comomax_server_memory_usage,mark_cache_size,max_concurrent_queries, los tamaños de los thread pool, etc.), en línea con lo que informasystem.server_settings. #107388 (Alexey Milovidov). - Se corrige
arrayResizecon un argumento de tamañoDecimal: ahora el tamaño se interpreta según su valor real (p. ej.,arrayResize([1, 2, 3], 1.5::Decimal(2, 1))devuelve un elemento) en lugar de según la representación bruta sin escala. #107389 (Alexey Milovidov). - Se corrige un
LOGICAL_ERROR(block.rows() == getRows()) que se producía en unINSERTasíncrono en una tablaAliascuandouse_strict_insert_block_limitsestaba habilitado. #107400 (Groene AI). - Se corrige un error lógico (
Unexpected return type from equals. Expected Nullable(UInt8). Got UInt8) cuando la optimización de push-down de disyunciones (predicado parcial) empuja una condición sobre una claveUSINGcuyo tipo el JOIN amplía. También se corrige un cierre inesperado del servidor (fallo de segmentación) en el analizador al resolver identificadores en consultasJOIN ... USINGque contienen ramasif/multiIfreducibles a constantes que hacen referencia a identificadores desconocidos. #107407 (Groene AI). - Se corrige un heap buffer overflow (cierre inesperado del servidor) en
windowFunnelal finalizar un estado de función de agregación manipulado con un tipo de evento fuera de rango, explotable por cualquier usuario con una solaSELECT. #107412 (uwezkhan). - Se corrige el comportamiento indefinido cuando se pasa un valor de coma flotante no finito (como
nanoinf) como argumento de timestamp/duración de las Table functionsprometheusQuery/prometheusQueryRange. Ese argumento ahora generaBAD_ARGUMENTSen lugar de producir un timestamp inválido. #107417 (Groene AI). - Se corrige que
MaterializedPostgreSQLdejara de replicar cambios silenciosamente cuando el nombre de la base de datos o de la tabla de PostgreSQL contenía letras mayúsculas (el consumidorpgoutputsolicitaba un nombre de publication sin comillas y en minúsculas que no coincidía con la publication que preservaba mayúsculas y minúsculas). #107423 (Alexey Milovidov). - Se corrige una excepción (
Logical error: Not-ready Set is passed as the second argument for function 'in') cuando una key expression (ORDER BY,PRIMARY KEY,PARTITION BYo unINDEXde omisión) contenía un operadorINcon una tabla en el lado derecho; por ejemplo,ORDER BY (x IN some_table). Estas key expressions ahora se rechazan al crear la tabla. #107424 (Groene AI). - Se corrigen resultados incorrectos de la optimización
optimize_rewrite_aggregate_function_with_ifpara aggregate functions que preservan valores de carga útilNULL(la familia*_respect_nulls:anyRespectNulls,first_value_respect_nulls,anyLast_respect_nulls,last_value_respect_nulls). La optimización ya no reescribef(if(cond, x, NULL))a la forma-Ifpara esas funciones. #107430 (Groene AI). - Se corrige una excepción espuria
filesystem error: in last_write_time: No such file or directoryal listar un directorio de object storage en disco local (por ejemplo, una tabla Iceberg en un discolocal) mientras los archivos se reemplazan de forma concurrente. Una entrada eliminada de forma concurrente ahora se omite de la lista en lugar de abortarla. #107432 (Groene AI). - Se corrige el error
THERE_IS_NO_COLUMNcuandooptimize_if_transform_strings_to_enum = 1y la expresión optimizadaif/transformsobre literales de cadena es una claveGROUP BYuORDER BYsobre una tabla Distributed o réplicas paralelas. #107455 (Groene AI). - Se corrigió un fallo raro del servidor en el procesamiento de
DISTINCTque podía producirse cuando fallaba una asignación de memoria (por ejemplo, al alcanzar un límite de memoria) mientras se inicializaba el conjunto de claves distintas. #107467 (Groene AI). - Se corrigió
LOGICAL_ERROR: Unexpected return type from materialize(y errores similares de incompatibilidad de tipos) cuandoapply_mutations_on_fly = 1se usa en una tabla con unUPDATEon-fly pendiente cuya columna de destino también se lee como entrada de una función mediante unUPDATEon-fly anterior, antes de una mutaciónALTER MODIFY COLUMN ... LowCardinality(...). #107475 (Groene AI). - Se corrigieron credenciales obsoletas de AWS STS al leer tablas
DeltaLakesobreS3: el motor ahora conserva el clienteS3con credenciales actualizadas al refrescar su instantánea, por lo que las lecturas de larga duración ya no fallan después de que expire el TTL del token de STS. El proveedor de credenciales STS assume-role ahora también respeta la actualización de credenciales para cualquier acceso aS3que use STS. #107480 (Elmi Ahmadov). - Se corrigió que
SELECT ... FINALyOPTIMIZE TABLE ... FINALdevolvieran filas duplicadas después de queCREATE TABLE ... CLONE AS,ATTACH PARTITION ... FROMoMOVE PARTITION ... TO TABLEadoptaran partes de unMergeTreesimple en unReplacingMergeTree,SummingMergeTreeoAggregatingMergeTree. El nivel de fusión de la parte adoptada ahora se restablece a 0 cuando los motores de origen y destino difieren, para que el destino la deduplique en la siguiente fusión. #107481 (Groene AI). - Se corrigió un underflow de enteros en el parser del PostgreSQL wire protocol, donde un mensaje con un campo de longitud menor que 4 provocaba un wraparound en
size - 4y unresize/ignoresobredimensionado. #107485 (uwezkhan). - La cancelación de consultas ahora se rastrea mejor mientras se espera el quórum en ReplicatedMergeTree. #107513 (Nikita Taranov).
- Se corrigió
Not-ready Set is passed as the second argument for function 'in'(LOGICAL_ERROR) al consultar una tabla con una clavePARTITION BYy una subconsultaIN/NOT INenvuelta dentro de una expresión más grande, por ejemploWHERE (c0 IN (SELECT ...)) != 0. #107515 (Groene AI). - Se corrigió que
currentUser(),user(),SESSION_USERyauthenticatedUser()se evaluaran como una cadena vacía en la ruta de vaciado de inserción asíncrona (conasync_insert = 1). Esto afectaba a las expresiones de columnaDEFAULT/MATERIALIZEDy a las vistas materializadas que hacen referencia a estas funciones, que almacenaban silenciosamente una cadena vacía en lugar del usuario que realizaba la inserción. #107541 (Groene AI). - Con
enable_analyzer = 1(el valor predeterminado), al consultar una tabla por su nombre simple cuando solo existe en otra base de datos, ahora se sugiere la tabla correcta; por ejemplo,SELECT * FROM functionsinformaMaybe you meant system.functions?. Antes, el nuevo analizador devolvía un errorUnknown table expression identifiersin sugerencias, mientras que el analizador antiguo ya ofrecía esa sugerencia útil. #107550 (Groene AI). - La memoria utilizada por la biblioteca rapidjson (en
prettyPrintJSON,JSONMergePatchy el parser JSON de rapidjson) ahora se contabiliza en el memory tracker, para que las entradas patológicas se rechacen conMEMORY_LIMIT_EXCEEDEDen lugar de asignar memoria sin límite. #107555 (Raúl Marín). - Corrige un
LOGICAL_ERROR(updateFormatPrewhereInfo called more than once) que podía producirse al ejecutar una consulta sobre una fuentefile(),url()o de almacenamiento de objetos con unPREWHEREexplícito y unWHEREcuandooptimize_prewhere_after_pushdownestaba habilitado. #107568 (Groene AI). - Corrige un fallo (desreferenciación de puntero nulo) que podía producirse cuando un plan de consulta distribuida se ejecutaba localmente (
make_distributed_plan+distributed_plan_execute_locally) conlog_formatted_queries = 1. #107570 (Groene AI). - Se corrigió un abortado del servidor (
std::terminate, señal 6) durante el desmontaje de una consulta con plan distribuido (make_distributed_plan = 1) cuando una comprobación de estado del worker no lograba reprogramar la siguiente comprobación (por ejemplo,CANNOT_SCHEDULE_TASKdurante el apagado oMEMORY_LIMIT_EXCEEDED). Ahora la consulta falla limpiamente y el servidor sigue en ejecución. #107575 (Groene AI). - Se añadieron las comprobaciones de límites que faltaban en el análisis de Elf y DWARF. #107579 (Michael Kolupaev).
- Se añadieron las comprobaciones de límites que faltaban en el lector ORC. #107580 (Michael Kolupaev).
- Se corrigió una excepción (error lógico
Digest does not match) que podía producirse enRENAME TABLE,RENAME DATABASEoCREATE OR REPLACE TABLEal trabajar con una tablaTimeSeriesdentro de una base de datosReplicated. Ahora ya se admite cambiar el nombre de una tablaTimeSeries. #107583 (Groene AI). - Corrige una denegación de servicio no autenticada por agotamiento de memoria en el puerto del protocolo MySQL. #107599 (Shaohua Wang).
- Corrige
DROP TABLEde una tablaTimeSeriesen una base de datosReplicated, que antes dejaba huérfanas las tablas internas y hacía que la tarea de eliminación en segundo plano reintentara indefinidamente (DROP TABLE ... SYNCse quedaba bloqueado). #107604 (Groene AI). - Se corrigieron dos problemas de path traversal en el protocolo de obtención de partes replicadas que podían permitir que una réplica maliciosa escribiera archivos fuera del directorio de la parte. #107606 (Antonio Andelic).
- Se corrigió el error ‘Account must be specified error’ al leer una tabla de Delta Lake a través de Azure. #107620 (Smita Kulkarni).
- Se corrigió que
ALTER TABLE ... REPLACE PARTITIONen una tablaMergeTreesimple resucitara las partes sustituidas tras reiniciar el servidor, lo que hacía que la tabla devolviera tanto las filas de reemplazo como las filas sustituidas obsoletas. #107623 (Groene AI). - Corrige un fallo del servidor al leer una vista materializada cuyo destino es una tabla
Distributedmientras la consulta se ejecuta conenable_analyzer = 0. #107653 (Groene AI). - Cuando se asignan varias cuotas al mismo usuario o rol, ahora se aplican todas conjuntamente (una consulta se rechaza si se supera cualquiera de ellas), en lugar de aplicarse solo una cuota elegida de forma no determinista.
SHOW QUOTAysystem.quota_usageahora muestran todas las cuotas aplicadas al usuario actual. #107664 (Alexey Milovidov). - Se corrigió que
s3y otras table functions de object storage lanzaranLOGICAL_ERRORen lugar deBAD_ARGUMENTScuando se duplica un argumento de tipo key-value, por ejemplos3('http://...', format = 'CSV', format = 'TSV'). #107670 (Groene AI). - Se corrigió que la interfaz MySQL fuera incompatible con
MySQL Connector/J8.2.0 y versiones posteriores (incluida la rama 9.x). El campoinfodel paqueteOKahora usa codificación con longitud, igual que en el servidor MySQL, para que el JDBC driver pueda conectarse. #107693 (Alexey Milovidov). - Se corrigió un
LOGICAL_ERROR(“Input nodes size mismatch in dag”) cuando una consulta conmake_distributed_plan = 1hace un join sobre una clave envuelta en una función cuyos dos lados no tienen ningún tipo en común (por ejemplo,ON intDiv(-1, t1.key) = t2.keycon una clave derechaUInt64). #107701 (Groene AI). - Leer datos Arrow/ArrowStream con columnas
String/Binaryvacías generadas por Apache Arrow Java < 19.0.0 (incluido Apache Spark) ya no lanzaINCORRECT_DATA. #107764 (Raúl Marín). - Se corrigió una excepción
BAD_GET(“Bad get: has String, requested UInt64”) en la estimación de column statisticscountmincuando una consulta compara una columna con un literal de otro tipo que no se convierte previamente, comonumeric_col IN (SELECT '5')ostring_col IN (SELECT 5). #107793 (Groene AI). - Se corrigió que las table functions
odbcyjdbcse quedaran bloqueadas durante minutos e ignoraran la cancelación de consultas (KILL QUERY,max_execution_time) cuando el bridge deja de responder mientras infiere la estructura de la tabla remota. #107809 (Alexey Milovidov). - Se corrigió una excepción (
Logical error: 'index >= result.start') al dar formato a una consulta malformada que mezcla las formas posicional y con nombre del argumentosecretde las table functionss3/gcs, por ejemplos3('url', 'a', 'b', secret_access_key = 'c'). #107818 (Groene AI). - Se corrige que el skip index de tipo
Setno haga pruning de granules en columnasLowCardinality. #107868 (Konstantin Bogdanov). - Se corrigió que la insert deduplication calculara hashes incorrectos para columnas
StringyArraycon la server settinginsert_deduplication_version = new_unified_hash: inserts idénticos podían no deduplicarse porque el hash de deduplicación dependía de la posición de la fila dentro del inserted block. #107915 (Sema Checherinda). - Se corrigen resultados incorrectos de
ORDER BYen columnasNullablecon varias claves de ordenación en macOS (Apple Silicon), causados por la falta de extensión de signo en el comparador de ordenación JIT-compiled. #107973 (Raúl Marín). - Se corrige una regresión de rendimiento al leer columnas
Dynamiccon varios threads. Causada por #100730. Cierra #107942. #107997 (Pavel Kruglov). - La configuración obsoleta del lago de datos
storage_catalog_urlahora es rechazada correctamente por el mecanismo de protección del catálogo (antes solo se comprobabanstorage_catalog_typeystorage_aws_access_key_id), y el mensaje de error enumera todas las configuraciones obsoletas. #108040 (Alexey Milovidov). - Se corrigió un error lógico
Bad cast from type DB::ColumnSparse to DB::ColumnVector<char8_t>cuando una consultaLIKElee desde un índicetexta través de la ruta de fallback de lectura directa sobre una columna almacenada de forma dispersa. #108068 (Groene AI). - Ahora siempre se ejecutan los handler de finalización de lote de la caché de acceso, incluso cuando el lote está vacío. #108124 (Azat Khuzhin).
- Se corrigió un
LOGICAL_ERROR(Column identifier is already registered) en algunas consultas conUNION ALL. #100770 (Shaohua Wang). - Se corrigió un uso después de liberar el mutex del almacenamiento de workload durante el apagado del servidor. #101447 (Tuan Pham Anh).
- Se corrigió un interbloqueo en
ALTER DATABASE MODIFY COMMENTcon el catálogoShared. #103683 (Nikolay Degterinsky). - Un identificador Unicode entrecomillado vacío ahora genera
SYNTAX_ERRORen lugar deCANNOT_PARSE_QUOTED_STRING. #104173 (leonard9893). - Se preservan los tipos de parámetro originales de las funciones de agregación
timeSeries*para que los tiposAggregateFunctionhagan correctamente el round-trip al volver a adjuntar tablas y con réplicas paralelas. #104812 (Vitaly Baranov). - Se corrigió un
LOGICAL_ERRORpara un CTE materializado conserialize_query_plany réplicas paralelas. #104896 (Igor Nikonov). - Se corrigió un desbordamiento de enteros con signo en las funciones
timeSeries*ToGridcuando el parámetro de staleness (window) está cerca deINT64_MAX. #105319 (Groene AI). - Un valor de la configuración
compatibilityya no revierteapply_row_policy_after_finalafalse, por lo que las políticas de fila siempre se aplican correctamente conFINAL. #105637 (Yarik Briukhovetskyi). - Se corrigió
clickhouse chdig clientrespetandoSETPGROUP/RESETIDS/SETSIGDEFen el stub deposix_spawn. #105858 (Azat Khuzhin). - Se corrigió una excepción durante las comprobaciones de integridad de merge-tree en projections cuando el executor de merge/mutate no estaba inicializado. #105919 (Mikhail Artemenko).
- Durante el análisis de índices en projections, el índice
minmaxahora se carga desde la propia projection en lugar de desde la parte padre, lo que produce resultados correctos. #105940 (Mikhail Artemenko). - Se corrigió una excepción en
addMonotonicChainparamaterialize(monotonic_chain(...)). #106050 (Nikolai Kochetov). - Se corrigió el fallo de
RESTOREen backups que incluyen objetos dependientes deMASKING POLICY. #106086 (Julia Kartseva). - Se corrigió una posible corrupción de memoria al expandir funciones SQL definidas por el usuario con
prefer_column_name_to_aliashabilitado. #106121 (Nikolai Kochetov). - Un Diccionario que usa la conexión del bridge ahora se recarga después de reiniciar el servidor, restableciendo la conexión. Cierra #106151. #106152 (Pedro Ferreira).
- Se corrigió la caché del sistema de archivos para
LocalObjectStorage. #106239 (Kseniia Sumarokova). - Se corrigió el source remoto diferido para funciones de tabla con
use_delayed_remote_source. #106470 (Nikolay Degterinsky). - Se corrigió
timeSeriesLastToGridpara timestamps anteriores al inicio de la cuadrícula y timestamps fuera de la ventana. #106504 (Vitaly Baranov). #106577 (Vitaly Baranov). - Se corrigió un
LOGICAL_ERROR(Inconsistent AST formatting) en un nombre de función que contenía parámetros de consulta. #106635 (Vitaly Baranov). - Se corrigió un error lógico cuando una tabla se elimina antes de la deserialización de tareas del plan distribuido. #106944 (Alexander Gololobov).
- Se usa una comparación exacta para las claves
NullabledeGROUP BY. #107050 (Nikolai Kochetov). - Se corrigió un
LOGICAL_ERROR(Trying to get name of not a column) que se producía cuando un argumento de función de una función de tabla no era una expresión de columna (por ejemplo, un matcher*sin resolver demultiIf/CASE). #107411 (Alexey Milovidov). - Se corrigió el crecimiento sin límites de la caché de zona horaria (
DateLUT) cuando se procesan muchos nombres de zona horaria no válidos distintos. #107464 (Alexey Milovidov). - Ahora se escribe la entrada de
part_logantes de informar que una mutation simple deMergeTreeha finalizado. #107741 (Azat Khuzhin). arrayFoldahora valida su argumento de array frente a entradas malformadas. #107932 (Michael Kolupaev).- Se corrigió una rara carrera de dato y un posible uso de memoria ya liberada en el lector en caché del archivo de índices de omisión de una part de
MergeTree, que podía ocurrir cuando una consulta leía índices de omisión mientras la part se movía o se renombraba. #107995 (Raúl Marín). - Se corrigió la regresión de rendimiento de las subcolumnas de
MapconPREWHERE. #107988 (Pavel Kruglov). - Se corrige
parseDateTimeBestEffortcon una zona horaria que lanzabaCANNOT_PARSE_DATETIMEen filas NULL detoString(Nullable(DateTime64)). #108310 (Yarik Briukhovetskyi). - Se corrigieron la función de tabla y el engine
ArrowFlight, que rechazaban una colección con nombre que omitía la clave opcionaldatasetcon el errorNo such key 'dataset'. #108041 (Alexey Milovidov). - Se corrigió un error lógico
Inconsistent AST formattingen una función de ventana sin argumentos dentro de una declaraciónCODECo de engine (por ejemplo,CODEC(cume_dist() OVER (...))); esa función ahora conserva sus paréntesis para que la consulta supere correctamente un ciclo de formato y análisis. #107806 (Alexey Milovidov). - Se corrige
hasTokencon una needle que contiene separadores y que devolvía resultados silenciosamente mediante un text index en lugar de generarBAD_ARGUMENTS. #108189 (Jimmy Aguilar Mena). - La configuración
use_skip_indexes_on_data_readahora puede revertirse a su valor predeterminado anterior a la 26.1 (false) mediante la configuracióncompatibility, lo que proporciona una vía de escape para una regresión de rendimiento en la que la ruta de lectura sobre datos impide la poda de rangos de marcas de índices de omisiónminmax/set/bloom_filter. #108330 (egor romanov). - Se corrigió un posible fallo (desreferencia de puntero nulo) cuando la sobrescritura
database/dbde una colección con nombre pasada aremote/remoteSecureno es un nombre de base de datos constante, por ejemploremote(nc, database = (SELECT 1)). La consulta ahora falla con un error claro en lugar de provocar un fallo. #108271 (Groene AI). - Se corrigió que una vista materializada actualizable se quedara bloqueada si la conexión con ZooKeeper se perdía en un mal momento. #108234 (Michael Kolupaev).
- Se corrige
Bad cast from type DB::ColumnVector<...> to DB::ColumnTupleal leer una columnaArray(Tuple(...))cuyo valor se rellena con valores predeterminados, por ejemplo después deALTER TABLE ... ADD COLUMNo tras una mutaciónALTER TABLE ... CLEAR COLUMNsin finalizar aplicada sobre la marcha. #107232 (Groene AI). - Se corrige un error lógico
Bad cast from type DB::ColumnDynamic to DB::ColumnNullablecuando una referencia explícita a una claveJOIN ... USINGcuyo common supertype esDynamicse pasa a una función de agregado, por ejemplocount(t.key) IGNORE NULLS. #107289 (Groene AI). - Se corrige la pérdida silenciosa de datos en
MergeTreesimple (no replicado) cuandoREPLACE PARTITION,MOVE PARTITION,DETACH PARTITIONoDETACH PARTse ejecuta sobre una partición que todavía tiene parches de actualización ligera sin aplicar. Estas operaciones ahora rechazan el comando, tal como ya haceReplicatedMergeTree. #107386 (Groene AI). - Se corrige un fallo (SIGSEGV en compilaciones release, aserción de incompatibilidad de tipos en compilaciones debug) en
hassobre unMapcon una claveDynamiccuando el argumento de búsqueda esLowCardinality, por ejemplohas(map('a'::Dynamic, ...), toLowCardinality('b')). #107956 (Groene AI). - Se corrigió un
LOGICAL_ERROR(“Block structure mismatch … betweenConvertingTransformandRemovingReplicatedColumnsTransform”) al insertar en una vista materializada cuya tabla de destinoTOdeclara una columna con unEnummás amplio que el que produce elSELECTde la vista. Ahora se aplica correctamente la ampliación válida deEnum. #107648 (Groene AI). - Se corrigió el error
NUMBER_OF_COLUMNS_DOESNT_MATCHal consultar una tablaDistributed(o al usar réplicas paralelas) que tiene varias columnasALIASque se expanden a la misma expresión y que se referencian junto conORDER BY/GROUP BY/HAVING. #107913 (Yakov Olkhovskiy). - Se corrigió un comportamiento no definido (se pasó un puntero nulo a
memcpy) en las funcionesdetectCharsetydetectLanguageUnknowncuando la cadena de entrada supera los 32768 bytes y no se puede detectar ningún conjunto de caracteres. #108250 (Groene AI). - Se corrigió un
signed integer overflow(comportamiento no definido) endateDiffcon las unidadeshouryminuteen valores extremos deDateTime64, cercanos a los límites del rango deInt64. #108229 (Groene AI). - Se corrigió
Too many marksen un índice de texto sobre una parte fusionada vacía. #106867 (Azat Khuzhin). - Se corrigió un
LOGICAL_ERROR(“Unexpected return type from if”) al leer una columna conapply_mutations_on_fly = 1después de unALTER UPDATE col = ... WHERE <cond>con una condición no constante o falsa, seguido deALTER MODIFY COLUMN col <new type>. #108128 (Groene AI). - Se corrigió una interrupción del server (
Logical errorenIColumn::insertFrom) al convertir unArray(Dynamic)oArray(Variant)aQBitconaccurateCastOrNull, por ejemploaccurateCastOrNull(CAST(range(114), 'Array(Dynamic)'), 'QBit(Float32, 114)'). #108288 (Groene AI). - Se corrigió un error de sintaxis cuando un alias sigue a una subconsulta en
DESCRIBE TABLE (...) AS .... #100205 (Yarik Briukhovetskyi). getClientHTTPHeaderahora se trata correctamente como no determinista, por lo que su resultado ya no se reutiliza incorrectamente en la caché de resultados de consultas. #108029 (Alexey Milovidov).
Mejora en compilación/pruebas/empaquetado
- Compilar
delta-kernel-rscon la featuredefault-engine-native-tlspara que su propio HTTP client (reqwest) pueda reutilizar el OpenSSL que ClickHouse ya tiene enlazado. Esta es solo una habilitación parcial denative-tls:object_storesigue forzandoreqwest/rustls-tls-native-roots, por lo quereqwestacaba con los backendsnative-tlsyrustls. Por ahora,delta-kernel-rssigue deshabilitado en MSan porqueringtodavía se compila a través deobject_store(tanto de forma transitiva medianterustlscomo directamente para la firma HMAC de solicitudes de AWS), y su ensamblador escrito a mano no genera los símbolos que requiere MSan (registrado en el proyecto upstream en arrow-rs-object-store#585). #96856 (Austin Bonander). - Añadir optimización posenlazado con PGO (Profile-Guided Optimization) y BOLT (Binary Optimization and Layout Tool) para el binario
clickhouse. Los profiles se recopilan a partir de workloads de CI y se aplican como una medida de mejor esfuerzo durante los builds de release; ambas etapas recurren a una salida no optimizada si un profile está desactualizado o es incompatible. A día de hoy, PGO no aporta beneficios. #100938 (Alexey Milovidov). - Añadir el modo
--storageaclickhouse keeper-benchpara ejecutar benchmarks deKeeperStorageen el mismo proceso (sin red, sin raft, sin máquina de estados), usando las mismas secciones de configuraciónsetup/generatorque el modo de red. #103081 (Michael Kolupaev). - Corregir la compilación con
ENABLE_AWS_S3=OFF. #105390 (Yue Ni). - Actualizar
mongo-cxx-drivera r4.3.0. #105522 (Konstantin Bogdanov). - Corregir la compilación con RapidJSON. #105674 (Ilya Golshtein).
- Acelerar la compilación eliminando includes transitivos de las cabeceras
base/de uso extendido y quitando código no utilizado dePoco/Logger.h, incluido como dependencia vendorizada. #105702 (Raúl Marín). - Actualizar
libxml2de 2.15.1 a 2.15.3. #105985 (Konstantin Bogdanov). - Usar
expat2.8.1 dentro de Poco. #105988 (Konstantin Bogdanov). - Actualizar
thriftav0.23.0. #105993 (Konstantin Bogdanov). - Usar la etiqueta
REL_18_4depostgres. #105994 (Konstantin Bogdanov). - Actualizar
krb5a 1.22.2. #106076 (Konstantin Bogdanov). - Actualizar
curlintegrado a 8.20.0. #106077 (Konstantin Bogdanov). - Se actualizó
mariadb-connector-ca la versión 3.1.29. Se conservaron todos los parches relevantes para ClickHouse. #106287 (Nikita Mikhaylov). - Se actualizaron los digests de la base image distroless para corregir CVE en libssl3t64. #106360 (Rahul Nair).
- Se utiliza
wasmtimev45.0.1. #106836 (Konstantin Bogdanov). - Se actualizó
openssla la versión 3.5.7. #106844 (Konstantin Bogdanov). - La build distroless de Docker ahora también actualiza las tags flotantes
:X.Y-distrolessy:X.Y.Z-distroless, no solo la tag de la versión completa. #106932 (Rahul Nair). - Se deshabilitaron features de
curlque no se usan, como la autenticación NTLM, cookies, alt-svc, HSTS, DNS-over-HTTPS, netrc, MIME y AWS SigV4. #107226 (Konstantin Bogdanov). - Se actualizó
NuRaftcon una corrección para un livelock durante la instalación de snapshots que se producía cuando el snapshot IO se ejecutaba en un background thread. La configuración de Keepernuraft_use_bg_thread_for_snapshot_iosigue deshabilitada de forma predeterminada; ahora CI la aleatoriza para cubrir ambos modos. #107338 (Antonio Andelic). - Se corrigió la compilación de
abseilcuando la ruta de checkout de ClickHouse contiene una substring que coincide con una extension de header. #107349 (zhiqiang). - El cache size de L2 ahora se determina a partir de
CPUIDen x86_64 en lugar desysconf(_SC_LEVEL2_CACHE_SIZE), específico de glibc, que no está disponible en musl libc. #107469 (Konstantin Bogdanov). - Se aumentó el stack size de las builds con musl a 8 MiB para admitir queries con anidamiento profundo. #107470 (Konstantin Bogdanov).
- El conjunto de símbolos de la biblioteca C localizados en bibliotecas estáticas de Rust ahora se deriva de las bibliotecas de referencia reales en lugar de una allowlist mantenida manualmente, para cubrir todos los builtins de compiler-rt y las funciones de libm de la plataforma. #107571 (Raúl Marín).
- Se cambiaron las image distroless de server y Keeper a
gcr.io/distroless/base-nossl-debian13para que solo incluyan las bibliotecas con las que ClickHouse realmente enlaza y dejen de incorporar las que ya enlazamos estáticamente. #107837 (Rahul Nair). - Se reactivaron 50 stateless tests en macOS (
arm_darwin) que se omitían por estar stale, y se usafsyncen lugar deF_FULLFSYNCpara la sincronización de directory en macOS. #107887 (Raúl Marín).
Lanzamiento de ClickHouse 26.5, 2026-05-21. Presentación, Vídeo
Cambio incompatible con versiones anteriores
- Se cambiaron los valores predeterminados de
date_time_input_formatycast_string_to_date_time_modedebasicabest_effort. Las consultas que antes no podían interpretar cadenas de fecha y hora no básicas (por ejemplo,2024 April 4,Apr 15, 2020 10:30:00) ahora pueden ejecutarse correctamente de forma predeterminada. Para mantener el comportamiento estricto anterior de análisis, configure estos ajustes enbasic(o usecompatibility). #89334 (Alexey Milovidov). - El nombre de elemento de Tuple
nullahora está prohibido porque entra en conflicto con el nombre de subcolumna usado para los mapas nulos de Nullable, lo que provoca una resolución ambigua de subcolumnas. #98377 (Alexey Milovidov). - Se añadieron los ajustes
dynamic_disk_allow_from_env,dynamic_disk_allow_from_zk,dynamic_disk_allow_includepara impedir el uso defrom_env,from_zkeincludeen discos dinámicos. Es un cambio incompatible con versiones anteriores porque prohíbe de forma predeterminada un comportamiento que antes estaba permitido de forma predeterminada. #99138 (Kseniia Sumarokova). - Ya no se puede usar el lector y escritor de Parquet obsoleto basado en Arrow. En su lugar, se usará la implementación nativa. #100949 (Alexey Milovidov).
SHOW CREATE TABLE tahora da preferencia a la tabla temporal cuando existen tanto una tabla permanente como una tabla temporal llamadasty no se especifica ninguna base de datos, en consonancia con el comportamiento existente deDESCRIBE TABLE. Además, ahora se admite la sintaxisDESCRIBE TEMPORARY TABLE. #100966 (Alexey Milovidov).- Se redujo el valor predeterminado de
http_max_fieldsde 1,000,000 a 1,000 y el dehttp_max_field_name_sizede 128 KB a 4 KB para limitar el uso de memoria antes de la autenticación por parte de las conexiones HTTP. Se añadieron los ajusteshttp_max_request_header_sizeyhttp_headers_read_timeout. Los usuarios que dependan de los límites superiores anteriores pueden restaurarlos mediante ajustes. #103285 (Sema Checherinda). - Se añadió una columna anidada
histogramsasystem.metric_logque toma una instantánea de cada métrica de histograma registrada por fila, con un nuevo ajustesystem_metric_log_show_zero_values_in_histogramspara controlar la emisión de valores cero. Deja obsoleta la tablasystem.histogram_metric_log. #103770 (Miсhael Stetsyuk). CASTaDateTimeoDateTime64sin una zona horaria explícita ahora conserva la zona horaria de su argumento de origen (cuando el origen es unDateTime/DateTime64con una zona horaria explícita), en consonancia con el comportamiento de las funcionestoDateTime/toDateTime64. Cierra #55072. #104433 (Alexey Milovidov).- Se eliminó la table function
kql. UseSET dialect = 'kusto'para ejecutar consultas en el dialecto KQL. #105101 (Alexey Milovidov). - Las window functions
RANKyDENSE_RANKahora rechazan argumentos y lanzanNUMBER_OF_ARGUMENTS_DOESNT_MATCH, en línea con el estándar SQL. Antes, consultas comoRANK(x) OVER (ORDER BY id)se aceptaban silenciosamente, ignorando el argumento. Para restaurar el comportamiento permisivo anterior, configureallow_rank_dense_rank_arguments = 1. Cierra #49526. #104324 (Groene AI).
Nueva funcionalidad
- Se agregó una nueva configuración
max_bytes_ratio_before_external_join, que reflejamax_bytes_ratio_before_external_group_byymax_bytes_ratio_before_external_sort. Expresa el umbral de spill a disco para hash joins como una fracción de la memoria disponible; combinada con el valor absolutomax_bytes_before_external_join, se aplica el umbral resultante más bajo. #103862 (Alexey Milovidov). La nueva configuraciónmax_bytes_ratio_before_external_joinahora está habilitada de forma predeterminada con un valor de 0.5, reflejandomax_bytes_ratio_before_external_group_byymax_bytes_ratio_before_external_sort. Los hash joins pasan automáticamente a grace hash join una vez que los datos del lado derecho superan la mitad de la memoria disponible del sistema (cuando hay límites de memoria configurados). #104285 (Alexey Milovidov). - Se agregó la table function
filesystem. Permite representar la estructura de directorios como una tabla y consultar con SQL los metadatos y el contenido de los archivos. Originalmente #42039 por @perst20. Consulte #42039. Consulte #50208. #53610 (Alexey Milovidov). - Permite pasar nombres de funciones sin envoltura a funciones de orden superior como
arrayMap,arrayFilter, etc. Por ejemplo,arrayMap(negate, [1, 2, 3])ahora es equivalente aarrayMap(x -> negate(x), [1, 2, 3]). #101033 (Alexey Milovidov). - Se agregan la configuración
send_table_structure_on_insert_with_inline_datay la opción--inline-insert-datadel client para permitir que el server analice por sí mismo los datos de INSERT en línea a través del native protocol, evitando el viaje de ida y vuelta para recibir la estructura de la tabla y mejorando el rendimiento en muchas inserciones pequeñas. #101034 (Alexey Milovidov). - Se agregan las funciones
tokenizeQueryyhighlightQuerypara la tokenización de consultas SQL y el resaltado de sintaxis.tokenizeQuerydevuelve tokens del lexer con desplazamientos de bytes y tipos de token;highlightQuerydevuelve rangos de resaltado de sintaxis basados en el parser con categorías de resaltado (keyword, identificador, función, número, cadena, etc.). #101054 (Alexey Milovidov). - Se agrega la configuración
url_basepara resolver URL relativas en la table functionurly el table engineURL, siguiendo la semántica de RFC 3986. #101113 (Alexey Milovidov). - Se admiten valores negativos en la cláusula
LIMIT BYpara seleccionar filas desde el final de cada grupo en lugar del inicio. Por ejemplo,LIMIT -2 BY iddevuelve las dos últimas filas porid. También se admiten desplazamientos negativos (LIMIT -1 OFFSET -1 BY id) y signos mixtos (LIMIT -2 OFFSET 1 BY id). #103222 (Nihal Z. Miaji). - Se admite la función
json_valuepara generar salida contupleyarray, lo que mejora el rendimiento de múltiples consultas JSON. #78362 (kevinyhzou). Se admite el argumento JSONPath de múltiples rutasTuple/ArrayenJSON_VALUE,JSON_EXISTSyJSON_QUERY, por @KevinyhZou. #101102 (Alexey Milovidov). - Se introduce un nuevo parámetro
kafka_autodetect_client_rack. Si se configura, detecta la zona de disponibilidad mediante las capacidades de la nube y la propaga como parámetroclient.rackdelibrdkafkapara evitar comunicaciones entre zonas. #81323 (Ilya Golshtein). - Se añade el tipo de evento
Readasystem.blob_storage_logpara hacer seguimiento de las operaciones de lectura en el almacenamiento de objetos, controlado por la nueva configuraciónenable_blob_storage_log_for_read_operations. #96867 (Alexey Milovidov). - Los usuarios ahora pueden ver los watches de ZooKeeper emitidos por
clickhouse-servermediante la nueva tablasystem.zookeeper_watches. #99277 (Den Kalantaevskii). - Se añadió el evento de perfil
Shards, que cuenta el número de segmentos implicados en las consultas distribuidas, sumado en todas las tablas. #99470 (Alexey Milovidov). - Las UDF de
WASMpueden declararse comoDETERMINISTICy pasar a estar sujetas al plegado de constantes. #100005 (Vasily Chekalkin). - Se añade la configuración
parallel_replicas_prefer_local_replica: cuando está deshabilitada, las réplicas paralelas se seleccionan únicamente mediante el algoritmo de equilibrio de carga, lo que permite que incluso las consultas conmax_parallel_replicas = 1se dirijan a otro host. #100139 (Alexey Milovidov). - Se añaden las configuraciones de servidor
{disk,storage,http}_connections_rcvbufy{disk,storage,http}_connections_sndbufpara controlar el tamaño de los búferes de socket TCP en las conexiones HTTP salientes, lo que permite a los operadores anular el autotuning del kernel y limitar el uso de memoria por conexión. #100478 (Sema Checherinda). - Se admite
CREATE OR REPLACE MATERIALIZED VIEWcon la misma semántica de intercambio atómico queCREATE OR REPLACE TABLE. Funciona con tablas internas, tablasTO,POPULATE,REFRESHyON CLUSTER. #100539 (DQ). - Se añaden las métricas de histograma
s3_read_request_duration_microsecondsys3_read_request_bytespara observar la duración de la conexión de las solicitudes GET a S3 y los bytes consumidos, visibles ensystem.histogram_metricsy en el endpoint de Prometheus. #102058 (Sema Checherinda). - Se añaden los motores de tabla
Paimon,PaimonS3,PaimonAzure,PaimonHDFSyPaimonLocal, con compatibilidad con lectura incremental respaldada por el seguimiento del progreso de snapshots de Keeper. El modo incremental devuelve solo las filas nuevas desde el último snapshot confirmado. Las lecturas delta de snapshots específicos están disponibles mediantepaimon_target_snapshot_id, y los límites de snapshots por consulta, mediantemax_consume_snapshots. La actualización de metadatos en segundo plano se puede configurar conpaimon_metadata_refresh_interval_sec. Controlado porallow_experimental_paimon_storage_engine. #102343 (XiaoBinMu). - Se añadió una nueva configuración de tabla de Kafka,
kafka_map_virtual_columns_on_write. Cuando está habilitada, las columnas llamadas_key,_timestamp,_headers.namey_headers.valueen el esquema de la tabla de Kafka se emiten como la clave, la marca temporal y los encabezados correspondientes del mensaje de Kafka enINSERT, y se excluyen de la carga útil del mensaje. #103243 (Alexey Milovidov). - Se añadieron las consultas
SYSTEM PAUSE VIEW [db.]nameySYSTEM PAUSE VIEWSpara vistas materializadas actualizables. A diferencia deSYSTEM STOP VIEW,SYSTEM PAUSE VIEWno interrumpe la actualización que se esté ejecutando en ese momento: deja que la actualización en curso termine y solo impide las actualizaciones posteriores. Esto se deshace conSYSTEM START VIEWoSYSTEM START VIEWS, que ahora eliminan de forma uniforme tanto el estado detenido como el pausado. #103252 (Nikita Mikhaylov). - Se añadió la función
regexpPosition(con los alias compatibles con PostgreSQLregexpInstryregexp_instr) que devuelve la posición en bytes de la coincidencia número N de una expresión regular en una cadena. Admite desplazamiento inicial, modo de devolución tras la coincidencia, indicadores de regex y selección de grupo de captura. #104172 (Abhinav Agarwal). - Nuevas funciones
isPrimeeisProbablePrimepara comprobaciones de primalidad.isPrimedevuelve un resultado exacto para enteros sin signo de hastaUInt64.isProbablePrimetambién admiteUInt128yUInt256; para esos tipos más amplios,0significa definitivamente compuesto y1significa probablemente primo. El segundo argumento opcional deisProbablePrime,rounds, controla la confianza (con un máximo de256); el valor predeterminado de25rondas limita la tasa de falsos positivos para un compuesto aleatorio a menos de10^-15, yisProbablePrimepuede cancelarse. #104234 (Nihal Z. Miaji). #104639 (Alexey Milovidov). #104806 (Nihal Z. Miaji). cleary/clearahora limpian la terminal en las herramientas de línea de comandos de ClickHouse en lugar de ejecutarse como una consulta por error. #104318 (Tyler Hannan).- Se permite que la table function
fileacepte unArray(String)de paths en consultasSELECT. #104442 (Yue). - Se añaden las columnas
deterministicyhigher_ordera la tablasystem.functions. #104479 (Pedro Ferreira). - Se añade un parámetro opcional de variante de codificación a
bech32Encode(bech32/bech32m) y un modo de decodificación en bruto abech32Decodepara la codificación de direcciones no SegWit (p. ej., Cosmos SDK, Injective, Osmosis). #98986 (Yash ). - Ahora puede write data en formato
AvroConfluent, que antes era solo de entrada. Esto permite generar mensajes Avro con el framing de Confluent Schema Registry directamente desde ClickHouse, por ejemplo, al escribir en Kafka. El schema se registra automáticamente en el registry. Use la nueva configuraciónoutput_format_avro_confluent_subjectpara especificar el nombre del subject. #101935 (János Benjamin Antal). - Se añadió la función
prettyPrintJSONpara dar formato a una cadena JSON de forma legible para humanos. Resulta útil para dashboards o informes en los que antes embellecerlo requería un paso adicional del lado del client. Cierra #62523. #102594 (Dmitry Prokofyev). - Se añadió
STRING_AGGcomo alias que no distingue entre mayúsculas y minúsculas degroupConcatpara ofrecer compatibilidad con PostgreSQL y el estándar SQL. #105125 (Alexey Milovidov). - Los resultados de subconsultas individuales ahora pueden almacenarse en caché de forma independiente mediante
SETTINGS use_query_cache = trueen subconsultas específicas, sin almacenar en caché toda la consulta externa. Un nuevo ajuste,query_cache_for_subqueries = true, permite propagaruse_query_cachede forma masiva a todas las subconsultas. Nota:use_query_cacheen la consulta externa ya no se propaga automáticamente a las subconsultas. #99804 (Vincent Voyer). - Se añadió resaltado de sintaxis basado en lexer al editor de consultas de la Web UI (
play.html), siguiendo los colores declickhouse-client. #105105 (Alexey Milovidov).
Funcionalidad experimental
- Se añadió una interfaz experimental de terminal web en
/webterminalque ofrece una sesión interactiva declickhouse-clienten el navegador a través de WebSocket. Está deshabilitada de forma predeterminada; actívela con la configuración del servidorallow_experimental_webterminal. Véala aquí. #100277 (Alexey Milovidov). #105191 (Alexey Milovidov). #105059 (Alexey Milovidov). - El motor
Kafka2(experimental, con almacenamiento de offset basado en Keeper) ahora admite consultasSELECTdirectas y la configuraciónkafka_commit_on_select. #100276 (Alexey Milovidov). - Las UDFs de
WASMahora pueden convertir más tipos numéricos: enteros más pequeños a enteros más amplios (p. ej., deInt8aUInt64) y cualquier entero a punto flotante (p. ej., deInt32aFloat32). #100435 (Vasily Chekalkin). - Se admite la función
LIKEen la consultaDELETE FROM system.webassembly_modules. #104397 (Vladimir Cherkasov). - Compatibilidad con tipos geo para
Iceberg. #103113 (Konstantin Vedernikov). - Se añadió la funcionalidad de sentencias preparadas al servidor ArrowFlight SQL. #103047 (Yakov Olkhovskiy).
- Se mejoró la robustez del parser de KQL (para la compatibilidad con el lenguaje Kusto) al preservar la profundidad del parser y los contadores de retroceso entre las distintas etapas del parser de KQL, de modo que los límites del parser se apliquen de forma coherente en consultas KQL complejas. #103528 (Yakov Olkhovskiy).
Mejora del rendimiento
- Reutiliza la caché de metadatos del pie de página de Parquet al leer archivos Parquet locales mediante la table function
fileo el table engineFile. Anteriormente, la caché solo se consultaba para backends de almacenamiento de objetos. #104260 (Alexey Milovidov). - Propaga
ORDER BY ... LIMIT na través de joinsLEFT/RIGHTcuando la clave de ordenación solo hace referencia a columnas del lado conservado por el join, lo que restringe cuántas filas debe producir la entrada de ese lado antes de realizar el join. Esto se controla con la nueva configuraciónquery_plan_top_k_through_join(habilitada de forma predeterminada). #104268 (Alexey Milovidov). - Habilita de forma predeterminada las configuraciones
use_top_k_dynamic_filteringyuse_skip_indexes_for_top_kpara mejorar el rendimiento de las consultasORDER BY ... LIMIT N. #99537 (Alexey Milovidov). Restringeuse_top_k_dynamic_filteringde forma predeterminada a columnas de ordenación de longitud fija, evitando regresiones en consultasORDER BY <var-length-column> LIMIT Nen las que el coste de comparar el umbral por fila supera el ahorro de E/S. El comportamiento anterior sigue disponible mediante la nueva configuraciónuse_top_k_dynamic_filtering_for_variable_length_types. #104216 (Alexey Milovidov). - Usa la funcionalidad de arena sobredimensionada de
jemallocpara reducir los fallos de página. #103958 (Nikita Taranov). - Limita los streams activos simultáneamente en
UNION ALLpara reducir el uso máximo de memoria. #100176 (Alexey Milovidov). - Optimiza ligeramente la caché de páginas en espacio de usuario. #100300 (Alexey Milovidov). Ahora la caché de páginas en espacio de usuario siempre es mejor que la caché de páginas del SO.
- Las lecturas en frío de almacenamiento de objetos a través de la caché de páginas en espacio de usuario (
use_page_cache_for_object_storage = 1) ahora son significativamente más rápidas, porque los fallos consecutivos de caché se consolidan en una sola solicitud HTTP en lugar de una solicitud por bloquepage_cache_block_size. #104230 (Alexey Milovidov). - Acelera el análisis de índices que implica conversión de tipos y aplicación de funciones. Cierra #55653. #100366 (Alexey Milovidov).
- Acelera las consultas muy grandes en tablas
Mergesobre un gran número de tablas subyacentes. Cierra #32465. #100369 (Alexey Milovidov). - Elimina la vtable de los tipos de campo de configuración, reduciendo el tamaño de copia de
Settingsen ~28x y mejorando la localidad de caché mediante una disposición en arrays tipados para todos los tipos de configuración. #102269 (Raúl Marín). - Añade las configuraciones
max_threads_min_free_memory_per_threadymax_insert_threads_min_free_memory_per_threadpara reducir automáticamente el paralelismo de las consultas cuando el servidor tiene poca memoria libre. #100383 (Alexey Milovidov). - Reduce el uso de memoria en sistemas con poca memoria (< 4 GiB). #100389 (Alexey Milovidov).
- Se añadió
OptimizeTrivialGroupByLimitPass. Para consultas trivialesSELECT ... FROM t GROUP BY k LIMIT n(sinHAVING,ORDER BYni funciones de ventana), el analizador ahora establecemax_rows_to_group_by = n + offsetcongroup_by_overflow_mode = 'any', de modo que la agregación se detiene en cuanto se han generadonclaves distintas, en lugar de agrupar todo el conjunto de entrada. Controlado por la nueva opciónoptimize_trivial_group_by_limit_query(habilitada de forma predeterminada). #104473 (Amos Bird) (Alexey Milovidov). - Índice min-max implícito a nivel de gránulo para las columnas virtuales
_part_offsety_block_number, también para proyecciones. Permite una poda rápida de gránulos basada en predicados sobre columnas virtuales. #103952 (Mikhail Artemenko). #104746 (Mikhail Artemenko). #105137 (Mikhail Artemenko). - Para la familia de métodos de agregación
prealloc_serialized, se precalculan los hash por fila durante la pasada de serialización por lotes y se usan para (a) evitar volver a calcular el hash enemplaceKey/findKeyy (b) realizar prefetch por software del bucket de la siguiente fila. Esto acelera la agregación serializada o de cadenas con múltiples claves al ocultar la latencia de los fallos de caché de la tabla hash. #104475 (Amos Bird) (Alexey Milovidov). - Caché de condiciones de consulta para tablas
Iceberg. #102115 (Konstantin Vedernikov). - Se optimizaron
cramersV,cramersVBiasCorrected,theilsUycontingencycuando se usan con funciones de ventana. Cierra #83521. #93384 (Nihal Z. Miaji). - Se añadió una optimización de consultas que reescribe
tupleElement(dictGet('dict', ('a', 'b', 'c'), key), N)comodictGet('dict', 'a', key), evitando recuperar atributos de diccionario innecesarios. Controlado por la opciónoptimize_dictget_tuple_element(habilitada de forma predeterminada). #100186 (Alexey Milovidov). - Se habilitó el almacenamiento en búfer para los pasos de ordenación en el iniciador de consultas distribuidas con ordenación. #100661 (Nikita Taranov).
- Mejora del rendimiento de
partial_mergeJOIN. #100945 (Artem Zuikov). - Se redujo ligeramente la sobreasignación de memoria en
partial_mergeJOIN. #100963 (Artem Zuikov). - Se optimizaron las asignaciones/liberaciones de memoria almacenando en caché la configuración de muestreo en lugar de recorrer toda la jerarquía del rastreador de memoria. #101267 (Azat Khuzhin).
- Se redujo la sobrecarga de asignación de memoria durante las cargas multiparte a S3 preasignando contenedores internos de seguimiento. #101799 (Gagan Dhakrey).
- Se añadió prefetch por software en la fase de sondeo de hash join para reducir la latencia de acceso a memoria en tablas hash grandes, controlado por la opción
enable_software_prefetch_in_join. #102444 (Xiaozhe Yu). - Optimiza la estructura de
MemoryTracker, mejorando su rendimiento en ~25%. #103464 (Azat Khuzhin). - Reescribe los predicados
coalesce(a, b, ...) <op> constyifNull(a, b) <op> constantes del análisis de índices para que la primary key por columna y los skip indexes de cada argumento puedan descartar gránulos. Se controla con la nueva configuraciónallow_key_condition_coalesce_rewrite(activada de forma predeterminada). #103468 (Manuel). - Se mejoró significativamente el rendimiento de las consultas al leer catálogos Iceberg con archivos JSON de metadatos grandes al optimizar el procesamiento de barras escapadas. #103998 (Mohaidoss).
- Evita la sobrecarga de la caché sin comprimir de índices cuando la caché está deshabilitada (configuración del servidor
index_uncompressed_cache_size = 0, que es el valor predeterminado). #104063 (Michael Kolupaev). - Corrige consultas
ORDER BY ... LIMITcon límites pequeños que leían demasiados gránulos al combinarse con un filtroWHEREno selectivo. Antes, cualquier filtro por encima de una lectura en orden deshabilitaba la división de tareas por rango de marcas, por lo que el pipeline no podía cancelarse entre gránulos y leía toda la parte para cada flujo. #104112 (Vladimir Cherkasov). - Se corrigió la falta de reutilización de la caché de tamaños de hash table tras reordenar los lados del JOIN. #104131 (Nikita Taranov).
- Cuando
fsync_after_insertestá habilitada, ahora el fsync de los archivos de la parte se realiza en paralelo usando el IO thread pool, lo que acelera la finalización de inserciones en wide tables. La carga completa de ClickBenchhitses aproximadamente un 22% más rápida. #104137 (Alexey Milovidov). - Vectoriza
find_first_symbols,find_first_not_symbols,find_last_symbols_or_null,find_last_not_symbols_or_nullysplitIntoen AArch64 usando NEON. Antes, estas funciones auxiliares solo tenían una ruta SIMD en x86 (SSE2 / SSE4.2) y en ARM recurrían a un bucle escalar. Acelera el parsing de TSV en ~2x, las funciones de URL ysplitByCharen ~1.3x en el datasethitsde ClickBench; el parsing de JSON muy denso (cadencia de campos de menos de 16 bytes) empeora ligeramente, en línea con la compensación ya existente en SSE2. #104228 (Alexey Milovidov). - La lectura de datos a través de una columna
ALIAStrivial (p. ej.,some_alias['key']dondesome_alias ALIAS m) ahora sigue la misma ruta de lectura por subcolumna que al referenciar directamente la columna subyacente, restaurando un importante ahorro de E/S para columnas con aliasMap,Array,TupleyNullable. #104245 (Raúl Marín). - Reduce la contención de bloqueos en la ruta de lectura asíncrona de sistemas de archivos remotos al hacer que
AsyncReadCounterspor consulta no use bloqueos. #104374 (Nikita Mikhaylov). - Plan de consulta ligeramente mejor para el escaneo en orden de projections. #103723 (Mikhail Artemenko).
- Amplía
optimizeUseNormalProjectionspara que también maneje un caso específico en el que no se filtró nada, pero la sorting key de la projection puede eliminar el paso de ordenación del plan de consulta. #104680 (Mikhail Artemenko). - Permitir que el azúcar sintáctico
json.path[]y las indicaciones de tipo explícitas funcionen correctamente en rutasJSONtipadas. #99179 (Pavel Kruglov). - Optimizar
json.path[N].nested.path(que se expande atupleElement(tupleElement(json.path[N], 'nested'), 'path')) ajson.path[].nested.path[N], que lee muchos menos datos. #99802 (Pavel Kruglov). - Optimizar las comprobaciones de acceso de
SHOW TABLESensystem.partssacando del bucle por tabla las comprobaciones de permisos a nivel de base de datos. #100860 (Shaohua Wang). - Eliminar una comprobación redundante de acceso por tabla para
SHOW TABLESen la ruta rápida deSELECT name/SELECT database, namedesystem.tables. #100881 (Shaohua Wang). - Habilitar la compilación JIT en macOS. #100947 (Alexey Milovidov).
- Omitir el aplazamiento de la política de filas después de
FINALcuando depende solo de las columnas de la clave de ordenación y es determinista, y omitir el aplazamiento correspondiente dePREWHEREque la política de filas estaba forzando en ese caso. #102884 (Yarik Briukhovetskyi). - Se añadió soporte para
hasAnyyhasAllcomo predicados de filtro en índices de texto. #103266 (Anton Popov). - Dirigir el estado de heap persistente de MergeTree (metadatos por parte y por tabla) a una arena dedicada de jemalloc, expuesta mediante las métricas asíncronas
jemalloc.mergetree_arena.*. Reduce la fragmentación de la arena predeterminada en estado estable y evita que los supervivientes por parte retengan páginas que, de otro modo, podrían liberarse por decaimiento. #104136 (Raúl Marín). - Mejorar el manejo del tiempo de espera del client de ZooKeeper bajo carga elevada cuando muchas solicitudes se canalizan por una sola sesión. El client de ZooKeeper ahora usa un tiempo de espera basado en el progreso: mientras se reciba cualquier dato del servidor dentro de
session_timeout_ms, la espera se amplía. Un límite estricto de3 * session_timeout_mspor solicitud sigue acotando la latencia del llamador. Cierra #100466. #104351 (Antonio Andelic). - Mover los indicadores de trace por evento a un array separado y asignarlos de forma diferida, reduciendo la sobrecarga del tracing de
ProfileEvents. #105030 (Azat Khuzhin). - Añadir
compareTrackAtparaColumnDecimal, mejorando el rendimiento de las comparaciones en columnasDecimal. #105110 (Artem Zuikov). - Se añadió una implementación SIMD de
MD5(AVX2/AVX512) que calcula hashes de múltiples entradas en paralelo, mejorando el rendimiento. #105161 (Joanna Hulboj).
Mejora
- Mejora la salida de ayuda de todas las aplicaciones de ClickHouse:
--helpahora devuelve siempre el código de salida0, escribe enstdoutyclickhouse --helpen el nivel superior muestra todos los subcomandos. Añade una opción--no-sudoparaclickhouse start/restart(útil en Docker) y un subcomandoclickhouse help. Continuación de #58244 de @qoega. #98148 (Alexey Milovidov). - El valor predeterminado de
input_format_column_name_matching_modecambia dematch_caseaauto. Los formatos de entrada que comparan los nombres de las columnas de entrada con el esquema de la tabla (JSONEachRow,CSVWithNames,JSONColumns,BSONEachRow,RowBinaryWithNames, etc.) ahora primero intentan una coincidencia sensible a mayúsculas y minúsculas y, si falla, recurren a una coincidencia no sensible a mayúsculas y minúsculas. El comportamiento estricto anterior se conserva concompatibility. #104320 (Alexey Milovidov). - Se añadió
STDDEVcomo alias no sensible a mayúsculas y minúsculas destddevSamppara compatibilidad con PostgreSQL/el estándar SQL. #105120 (Alexey Milovidov). - Se añadió
array_to_stringcomo alias no sensible a mayúsculas y minúsculas dearrayStringConcatpara compatibilidad con PostgreSQL. #105121 (Alexey Milovidov). - Se añadió
unnestcomo alias no sensible a mayúsculas y minúsculas dearrayJoinpara compatibilidad con PostgreSQL (en forma de llamada de función). #105124 (Alexey Milovidov). - La barra de progreso de
clickhouse-clientahora muestra el uso de disco de los datos temporales (p. ej., para ordenación externa, aggregation o JOIN) junto a la RAM, incluido un desglose por host para las consultas distribuidas. #105190 (Alexey Milovidov). - Se añadió
system.predicate_statistics_log, un nuevo log muestreado de la selectividad de los filtros de predicado y de la poda de gránulos de índice de MergeTree por consulta. Está deshabilitado de forma predeterminada; actívelo mediante la configuración del servidorpredicate_statistics_sample_rate. Es necesario para las recomendaciones automáticas de índices y proyecciones. #98727 (Yarik Briukhovetskyi). - Permite omitir el segmento local con una tabla ausente cuando
skip_unavailable_shardsestá habilitado. #100141 (Alexey Milovidov). - Añade advertencias al iniciar (visibles en
system.warnings) cuando se está resincronizando un arreglo mdraid de Linux o este se encuentra en estado degradado, ya que ambas situaciones pueden afectar al rendimiento de E/S del disco o indicar fallos de disco. #100941 (Alexey Milovidov). - Las UDFs de WASM ahora aparecen en
system.functionscon las columnasorigin(WasmUserDefined),syntax,argumentsyreturned_valuecorrectas, rellenadas a partir de sus metadatos de tipos de ClickHouse. Antes faltaban o aparecían duplicadas con un origen incorrecto. #101053 (Vasily Chekalkin). - La table function
generate_seriesahora admite valores negativos de step para generar secuencias descendentes; por ejemplo,SELECT * FROM generate_series(99, 0, -1). #101056 (Alexey Milovidov). - Corrige las excepciones
Context has expiredque generaban algunas funciones (dotProduct,formatRow,structureToCapnProtoSchema/structureToProtobufSchema, funciones definidas por el usuario) al usarse en rutas de ejecución diferida, como expresionesDEFAULT/MATERIALIZEDy configuraciones del motor de tabla, asegurando que esas funciones conserven una referencia fuerte al contexto cuando sea necesario. #101109 (Alexey Milovidov). - Corrige errores lógicos espurios
Cache limits violateden prioridades creadas con límites cero (como la prioridad de filesystem cache por consulta que se usa cuandoenable_filesystem_query_cache_limitestá activado). #101428 (Alexey Milovidov). - Detecta automáticamente la región de los endpoints
s3express. #101520 (Pradeep Chhetri). - Añade soporte para IDs de campo en archivos de datos al escribir en
Iceberg. Cierra #102322. #102362 (Konstantin Vedernikov). - El panel izquierdo de la interfaz web (
play.html) ahora se desplaza de forma independiente, permanece visible al desplazarse por la página y, al hacer clic en una tabla, lleva al área de consulta. #102498 (Alexey Milovidov). - Permite abrir la interfaz de Play en una pestaña nueva mediante Ctrl/Cmd/Shift+clic o clic central sobre el logotipo de ClickHouse en el panel izquierdo. #102501 (Alexey Milovidov).
- Nuevas métricas para rastrear la memoria utilizada por las claves primarias de las proyecciones y la granularidad del índice de las proyecciones en todas las tablas. #102587 (Narasimha Pakeer).
- Aplica
max_network_bandwidth_for_userymax_network_bandwidth_for_all_usersa las lecturas y escrituras en sistemas de archivos remotos. #103080 (Azat Khuzhin). - Mejora la resiliencia de las copias de seguridad cuando las vistas materializadas actualizables se refrescan constantemente, tomando decisiones basadas en el estado de las tablas de la instantánea en lugar de en un estado global. #103384 (Nikita Mikhaylov).
SELECT * FROM system.databasesahora siempre muestra las bases de datos de los catálogos de lago de datos, independientemente de la configuraciónshow_data_lake_catalogs_in_system_tables. Antes estaban ocultas de forma predeterminada, lo que no era coherente conSHOW DATABASES, que siempre las mostraba. #103444 (Alsu Giliazova).- Alinea en el código el valor predeterminado de la configuración del servidor
concurrent_threads_soft_limit_ratio_to_corescon el valor incluido enconfig.xml(2), para que el scheduler predeterminado de hilos concurrentesmax_min_fairlimite los hilos de procesamiento de consultas a 2x núcleos desde el inicio, incluso cuando no se use elconfig.xmldistribuido. #103446 (Alexey Milovidov). - Mejora la robustez del sanitizador en casos límite del parser y de funciones de cadenas: maneja entradas vacías en
getURLScheme, evita la aritmética con punteros nulos en las comprobaciones demax_query_sizedeLexer::nextTokeny corta la evaluación de subsecuencias UTF-8 en haystacks vacíos antes de decodificar. #103489 (Yakov Olkhovskiy). - Se mejoró la corrección de la inferencia de monotonicidad para
divide(0, x)eintDiv(0, x): antes, las funciones se marcaban incondicionalmente como monotónicas, pero0 / xno es monotónica en ningún rango que incluya 0 porque0 / 0no está definido (NaN/Infparadivide, excepción de división por cero paraintDiv). Esta suposición incorrecta hacía queKeyCondition::applyMonotonicFunctionsChainToRangeprodujera rangos conleft > right, lo que provocaba unLOGICAL_ERRORInvalid binary search result in MergeTreeSetIndexen compilaciones de depuración cuando una expresiónIN/NOT INsobre la primary key envolvía la clave endivide(0, key)ointDiv(0, key). Las compilaciones de release no se vieron afectadas: la aserción está condicionada por#ifndef NDEBUG. #103621 (Groene AI). - Se reemplazaron las métricas asíncronas
HTTPConnectionPool*TCP{Rcv,Snd}BufBytes_{p50,p75,p90,p95}por un histograma basado en bucketshttp_pool_tcp_buf_bytes(labelsgroup,direction) ensystem.histogram_metrics. Se conservan las métricas asíncronas totales por grupo. #103704 (Sema Checherinda). - Los server settings
{disk,storage,http}_connections_{rcvbuf,sndbuf}ahora se muestran como modificables sin reinicio ensystem.server_settings. Sus values pueden actualizarse medianteSYSTEM RELOAD CONFIG; la ruta de aplicación en runtime ya existía desde #100478. #103772 (Sema Checherinda). - Se añadió soporte para símbolos resueltos (
Array(String)) enflameGraph. #103816 (Azat Khuzhin). - El client de la CLI ahora puede especificar
<rainbow_parentheses>false</rainbow_parentheses>en su configuración en entornos donde los colores del terminal interfieren con los paréntesis (de forma similar,clickhouse formatahora tiene--no_rainbow_parentheses). #103851 (Larry Snizek). - Se corrigió la búsqueda UTF-8 sin distinción entre mayúsculas y minúsculas de
MultiVolnitskyrevirtiendo inserciones parciales deputNGramen caso de fallo y cambiando los needles fallidos a buscadores de fallback, para evitar estados inconsistentes. #103864 (Yakov Olkhovskiy). - Se implementó
sched_getcpumedianterseqTLS en musl con compatibilidad con glibc. #104016 (Azat Khuzhin). - Una vista materializada actualizable replicada en modo APPEND ya no se actualizará dos veces si la connection con ZooKeeper se pierde brevemente durante la actualización. #104051 (Michael Kolupaev).
- Se permite que las tablas Distributed sin una lista explícita de columnas validen las claves de sharding con respecto a la structure inferida de la tabla remota. #104111 (Yue).
- Se corrigió REST catalog con la path
Azureabfss. #104120 (Konstantin Vedernikov). - Se respetan los ajustes de authentication
role_arnyrole_session_nameen el client de snapshots S3 de Keeper, lo que permite que las cargas de snapshots usen autenticación basada en STSAssumeRole. #104140 (Alexey Milovidov). - Corrige una fuga de memoria al ejecutar consultas con CTE
MATERIALIZED. #104153 (Alexey Milovidov). - Corrige la excepción de
lowerUTF8/upperUTF8al procesar grandes conjuntos de datos no ASCII (p. ej., durante la creación de índices de texto) en los que el búfer de salida acumulado superaría los 2 GiB; rechaza las filas individuales excesivamente largas con un error claro. #104229 (Shaohua Wang). - Refuerza la carga de estadísticas de columnas de MergeTree frente a fallos transitorios de E/S para evitar que se desactiven permanentemente las optimizaciones basadas en estadísticas para las partes afectadas. #104372 (zoomxi).
INSERT INTO ... SELECT FROM input(...)ya no requiere el privilegioCREATE TEMPORARY TABLE. #104470 (Alexey Milovidov).- Se añadió una nueva configuración de MergeTree,
concurrent_part_removal_threshold_for_remote_disk(valor predeterminado:16), que se usa en lugar deconcurrent_part_removal_thresholdcuando al menos una de las partes que se va a eliminar está almacenada en un disco remoto. El umbral anterior de100podía hacer queDROP TABLEy otras operaciones de eliminación de partes en backends de object storage se quedaran bloqueadas durante decenas de segundos porque las eliminaciones se realizaban en serie, aunque cada una implicaba una ida y vuelta de red independiente. La nueva configuración hace que la ruta de eliminación en paralelo se active mucho antes en el almacenamiento remoto, sin cambiar el comportamiento en disco local. #104676 (Groene AI). - La nueva configuración
defer_partition_pruning_after_final(valor predeterminado:1) hace que el comportamiento introducido en la versión 26.3 de omitir la partition pruning bajoFINALpase a ser opcional. Establécela en0para restaurar la partition pruning anterior a la 26.3, sustancialmente más rápida en cargas de trabajo de registros de eventos donde las filas con la misma PK no pueden abarcar particiones.compatibility = '26.2'la cambia a0automáticamente. #104705 (Nikita Fomichev). - Corrige que
intExp2devolviera resultados incorrectos para entradas fuera de rango (desplazamientos>= 64bajo JIT, y enteros con magnitud superior aINT_MAXen ambas rutas de código). #105054 (Raúl Marín). - Pone entre comillas los argumentos del shell construidos a partir de opciones de CLI y de la entrada analizada en
clickhouse installyclickhouse git-importpara que las rutas, los nombres de usuario/grupo y los hash de commit que contienen espacios en blanco o metacaracteres del shell se manejen correctamente. #105232 (Raúl Marín). - El table engine
Aliasya no es experimental y está disponible sin la configuraciónallow_experimental_alias_table_engine. #103488 (Alexey Milovidov). - Se añadió la opción
--queries-formataclickhouse-benchmarkpara elegir entre el formato de entrada predeterminado, con una consulta por línea y tabulaciones escapadas (tsv), y el análisis de la entrada estándar como un script con varias consultas separadas por;(script). #99972 (Aleksandr Musorin). - Los operadores de tuplas por elemento
tuplePlus,tupleMinus,tupleMultiply,tupleDivide,tupleModulo,tupleIntDivytupleIntDivOrZeroahora son variádicos y aceptan dos o más tuplas del mismo tamaño, aplicándose elemento por elemento como un left fold. Antes aceptaban exactamente dos argumentos. #104659 (Aruj Bansal). - Se añadió una nueva interfaz web integrada en
/processors-profileque visualiza el pipeline de cualquier consultaSELECTanterior como un mapa de calor, a partir desystem.query_logysystem.processors_profile_log. Cada procesador se colorea según suelapsed_usy muestra estadísticas por procesador (filas, bytes, tiempos de espera) al pasar el cursor. #104614 (Nikita Mikhaylov). - La configuración
query_plan_use_logical_join_step(y su aliasquery_plan_use_new_logical_join_step) ahora está obsoleta y no tiene ningún efecto; el paso lógico de JOIN se usa siempre. #104017 (Vladimir Cherkasov). - El campo
userenplay.htmly en las demás páginas web integradas (dashboard.html,jemalloc.html,merges.html,binary.html,webterminal.html) ya no se rellena previamente con el texto literaldefault. Ahora muestra una sugerencia de marcador de posiciónusery está vacío de forma predeterminada. Cuando se deja vacío, la página no envía un parámetro de URLuser=(y el JSON de autenticación de WebTerminal omite el campouser), por lo que el servidor aplica su comportamiento habitual y recurre al usuariodefault; además, las credenciales HTTP proporcionadas a través de otros canales (X-ClickHouse-User, HTTP Basic, configuración<handler><user>por handler) ya no se sobrescriben. #105254 (Alexey Milovidov). - Lector
ORC: se desacopla la lectura basada en offsets (readBigAt) deuse_prefetch, para que los datos codificados con EC enHDFSpuedan leerse correctamente incluso cuandouse_prefetch = false(por ejemplo, con Gluten). #103348 (zhanglistar). - Los archivos descargados desde
play.htmlcon el formatoCSVWithNamesahora usan la extensión de archivo.csv. #103737 (JackFielding). - Se añadió más validación de entrada para el catálogo BigLake. #105117 (Konstantin Vedernikov).
Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)
- Corrige el formato inconsistente al recordar si una expresión estaba entre paréntesis. #92340 (Alexey Milovidov).
- Corrige la comparación correcta entre los tipos Decimal y Float. #94293 (zoomxi).
- Permite argumentos posicionales en consultas distribuidas. #94359 (simonmichal).
- Corrige un fallo de aserción en
DatabaseCatalog::updateDependenciesal eliminar y volver a crear una vista materializada con el mismo nombre; también corrige la pérdida silenciosa de dependencias de vistas duranteRENAME TABLEoEXCHANGE TABLEScuando las dependencias referenciales estaban vacías. #98779 (Alexey Milovidov). - Se corrigió una interrupción del servidor (fallo de aserción en
DatabaseCatalog::getTableImpl) que se producía al crear una tabla medianteON CLUSTERcon un UUID idéntico al de una base de datos existente. #98861 (xiaohuanlin). - Se corrigió el uso de índices de omisión en lecturas de datos (con la configuración
use_skip_indexes_on_data_readhabilitada) y en patch parts existentes creados por actualizaciones ligeras. #99543 (Alexey Milovidov). - Corrige la excepción “Not-ready Set” cuando un filtro con
IN (subquery)es movido a PREWHERE por el optimizador de consultas. #100375 (Alexey Milovidov). - Corrige el error “Cannot find column” al combinar
ADD COLUMNconRENAME COLUMNen una sola instrucciónALTER TABLE. #100387 (Alexey Milovidov). - Corrige las vistas con operadores
UNIONyINTERSECT/EXCEPTmixtos que devolvían resultados incorrectos después deDETACH/ATTACHo de reiniciar el servidor. #100390 (Alexey Milovidov). - Corrige la excepción “Trying to execute PLACEHOLDER action” que podía producirse durante pruebas de estrés con el AST fuzzer cuando aparecía una subconsulta correlacionada en una cláusula IN. #100398 (Alexey Milovidov).
- Corrige una excepción de error lógico al insertar en una tabla Iceberg con una columna
Dateparticionada por transformacionesyear,monthoday. #100404 (Alexey Milovidov). - Corrige el uso de un índice de omisión con datos incompatibles después de que
ALTER TABLE MODIFY COLUMNcambie el tipo de la columna, lo que podía provocar fallos del servidor en compilaciones con sanitizador o resultados de consulta incorrectos. #100526 (Alexey Milovidov). - Corrige la filtración de credenciales en
query_logpara las funciones de tablapaimonCluster,paimonS3Cluster,paimonAzureClusterydeltaLakeS3. #100529 (JIaQi Tang). - Corrige que
DROP TABLEen tablas con motor Kafka pudiera quedar bloqueado indefinidamente debido a un interbloqueo enrd_kafka_consumer_close. #100604 (Alexey Milovidov). - Sustituye la lista
source_table_enginescodificada de forma fija por una búsqueda en tiempo de ejecución medianteStorageFactoryyDatabaseFactory. Añadesource_access_typeaDatabaseFactory::EngineFeaturespara queCREATE DATABASEcon motores de origen (PostgreSQL, MySQL, S3, etc.) requiera los mismos permisos de origen queCREATE TABLE. Corrige el fallo deGRANT TABLE ENGINE ON *contable_engines_require_grant=false. Cierra #71544. #100746 (pufit). - Corrige un fallo del servidor al leer desde una tabla cuya columna
ALIAScontenía una subconsulta correlacionada anidada dentro de una llamada a función (p. ej.,ALIAS toString(intDivOrZero(x, (SELECT ...)))).CREATE TABLEyALTER TABLEahora rechazan cualquier subconsulta, a cualquier profundidad, en expresiones de columnaDEFAULT/ALIAS/MATERIALIZEDconTHERE_IS_NO_DEFAULT_VALUE. Antes, la validación superficial aceptaba subconsultas anidadas, por lo que el caso correlacionado provocaba un fallo en tiempo de lectura y el caso anidado no correlacionado parecía funcionar, pero podía dar lugar a comportamientos inesperados; ahora ambos se rechazan en tiempo de DDL. #100753 (Groene AI). - Se corrigió un fallo del servidor (
Logical error: Bad cast from type DB::FunctionNode to DB::ColumnNode) que podía producirse al usar consultas con subconsultas correlacionadas en tablas que tienen definicionesCONSTRAINT ... ASSUME, cuando están habilitadas las settingsoptimize_substitute_columnsyconvert_query_to_cnf. #100756 (Groene AI). - Corrige una excepción que podía producirse al insertar una fila en una columna JSON cuando la fila introducía un nuevo campo dinámico junto con un campo tipado con un valor incompatible, y la columna se usaba posteriormente como clave de GROUP BY. #100758 (Jimmy Aguilar Mena).
- Corrige que la planificación de IO de la carga de trabajo se omitiera silenciosamente para escrituras en S3 o almacenamiento de objetos que pasan por la ruta
DiskObjectStorageTransaction(usada por los discoss3_with_keepery explícitamente cuandouse_fake_transaction=false). Antes, las escrituras de INSERT en tablas MergeTree sobre esos discos ignoraban la limitación deCREATE RESOURCE/CREATE WORKLOADporque el enlace del recurso nunca se inyectaba enWriteSettingspara la ruta de escritura transaccional. #100777 (JIaQi Tang). - Corrige una colisión de caché de esquema compartida entre
ProtobufyProtobufList: leer primero un mensaje comoFORMAT Protobufy luego comoFORMAT ProtobufListpodía fallar porqueProtobufListforzaba el esquema en caché a su forma de sobre.ProtobufListahora recurre al tipo de mensaje almacenado en caché cuando no hay ningún esquema de sobre disponible. #100849 (Callum Cooper). - Corrige un desbordamiento de búfer en el montón en el puente Rust CXX debido a una incompatibilidad de ABI de
std::exception. #100931 (Azat Khuzhin). FunctionVariantAdaptorahora lanzaILLEGAL_TYPE_OF_ARGUMENTcuando todas las alternativas deVariantson incompatibles con una función, en lugar de devolver silenciosamenteNullable(Nothing). Antes, un predicadoWHERE function(variant_col)en el que ningún tipo alternativo era compatible devolvía 0 filas sin error, mientras que el contexto equivalente deSELECTya lanzaba correctamente la excepción. #100939 (Vasily Chekalkin).TRUNCATE ALL TABLESya no falla cuando la base de datos contiene vistas. #100943 (Alexey Milovidov).- Se corrigió la optimización
optimize_rewrite_array_exists_to_haspara que maneje correctamente los casos con tipos incompatibles (p. ej., Date frente a String) y se volvió a habilitar de forma predeterminada. #100944 (Alexey Milovidov). - Se corrigió la prioridad de la configuración de S3 para que la configuración de disco de
storage_configurationprevalezca sobre la sección global<s3>, y la configuración a nivel de usuario/perfil/consulta prevalezca sobre ambas. #100975 (Alexey Milovidov). - Se corrigió la serialización dispersa, que perdía el signo del cero negativo (-0.0) en columnas BFloat16, Float32 y Float64. #100983 (Takumi Hara).
- Se corrigieron dos errores en el parser de geometría WKT usado al leer archivos GeoParquet y Arrow codificados en WKT: las geometrías
MULTILINESTRINGse analizaban incorrectamente comoPolygon(lo que provocaba una excepción en las columnas tipadas y corrupción silenciosa de datos en columnasGeometrymixtas), y una cadena WKT malformada sin palabra clave de tipo desencadenaba un comportamiento indefinido en lugar de un error claro. #100997 (Vasily Chekalkin). - Se corrigieron las consultas
grouping/GROUPING SETSen tablas distribuidas con un solo segmento que fallaban con “Method executeImpl is not supported for ‘grouping’ function”. #101030 (Alexey Milovidov). - Se corrigió
LOGICAL_ERROR“Column identifier is already registered” en el planificador, que podía producirse cuando la misma expresión de tabla se procesaba varias veces. #101048 (Alexey Milovidov). - Se corrigió la excepción LOGICAL_ERROR “Column identifier is already registered” cuando se usa la configuración
additional_result_filtercon consultas UNION o EXCEPT. #101051 (Alexey Milovidov). - Se corrigió un fallo del servidor (Logical error: Bad cast from ColumnVector to ColumnNullable) al usar
* APPLYcon funciones de agregación ygroup_by_use_nulls=1con GROUPING SETS, ROLLUP o CUBE. #101062 (Groene AI). - Se corrigió un bucle infinito cuando
input_format_csv_skip_first_linesoinput_format_tsv_skip_first_linessupera el número de líneas del archivo. #101111 (Alexey Milovidov). - Se corrigió un acceso fuera de límites en la optimización de materialización diferida que podía provocar una excepción en builds de depuración. #101144 (Alexey Milovidov).
- Se corrigió la inferencia de tipos en CTE recursivas: los tipos de columna ahora se amplían iterativamente mediante
getLeastSupertypeentre las partes no recursiva y recursiva delUNION ALLhasta converger, lo que evita el desbordamiento de enteros en expresiones comox + 1. #101155 (Alexey Milovidov). - Se limitó la configuración del tamaño de bloque de compresión de MergeTree (max_compress_block_size, min_compress_block_size, marks_compress_block_size, primary_key_compress_block_size) a 256 MiB para evitar fallos del servidor cuando se establecen valores extremos mediante CREATE TABLE SETTINGS. #101159 (Groene AI).
- Corrige un fallo LOGICAL_ERROR en
QueryAnalyzer::resolve()cuando una ROW POLICY usa una subconsulta escalar en su cláusulaUSING(p. ej.,USING (SELECT 1)). Cierra #100695. #101263 (Groene AI). - Corrige un comportamiento indefinido en
MergeTreeDataPartWriterCompact::cancelcuando falla la asignación de un stream. #101292 (Alexey Milovidov). - Corrige un caso en el que no se incluía la timezone durante la asignación en la sentencia ALTER. Cierra #101328. Relacionado: https://github.com/ClickHouse/ClickHouse/pull/100647. #101403 (Yarik Briukhovetskyi).
- Corrige un fallo del server (LOGICAL_ERROR) en consultas INSERT SELECT con ORDER BY ALL cuando el pipeline de SELECT produce múltiples streams. #101443 (Groene AI).
- Corrige resultados incorrectos de consultas causados por el reordenamiento de join al mover un filtro de INNER JOIN (que solo hace referencia al lado preservado de un outer join) a la cláusula ON del outer join. #101504 (Vladimir Cherkasov).
- Omite aplicar materialización diferida a planes con arrayJoin, ya que esto podía hacer que no se respetara el límite. Cierra #101608. #101644 (Vladimir Cherkasov).
- Corrige resultados incorrectos en consultas JOIN cuando la optimización
mergeFilterIntoJoinConditiondescartaba silenciosamente una condición de igualdad en WHERE con tipos incompatibles. #101652 (Xiaozhe Yu). - Corrige que la pista de prueba
errorno funcionara para errores de sintaxis/análisis: antes,-- { error SYNTAX_ERROR }en una consulta malformada fallaba con “Expected server error” en lugar de coincidir con el error de análisis del lado del client. #101675 (Groene AI). - Corrige que
INTO OUTFILE ... TRUNCATEno usara realmente el renombrado atómico: la escritura se hacía directamente en el archivo original en lugar de en un archivo temporal, por lo que, si la consulta fallaba, se destruía el contenido original. Ahora los datos se escriben en un archivo temporal y solo se renombran si la operación finaliza correctamente. #101884 (Pablo Marcos). - Corrige una excepción
Unsupported DeltaLake type: varchar(n)al leer tablas Delta Lake cuyo schema contiene tipos de columna varchar(n) o char(n). Estos tipos ahora se asignan a String, en consonancia con cómo el protocolo Delta Lake los almacena como matrices de bytes simples en Parquet. #101973 (Flavio Malavazi). - Corrige una pérdida silenciosa de datos al leer archivos tar desde S3 con
schema_inference_mode=uniony schemas de Parquet heterogéneos: la caché de metadatos de Parquet reutilizaba incorrectamente los metadatos del primer archivo para todos los archivos posteriores del archivo tar. #101990 (Ahaan Limaye). - Corrige un fallo del server (LOGICAL_ERROR) al ejecutar ALTER TABLE UPDATE/DELETE en tablas Iceberg cuando no se había hecho ningún SELECT o INSERT previo en la tabla durante el mismo lifetime del server. #102113 (Alexey Milovidov).
- Se corrige un posible crash cuando se ejecuta una consulta ALTER en tablas de una base de datos en memoria (p. ej., tablas temporales). #102360 (Den Kalantaevskii).
- Se corrigió que
formatQueryprodujera grants duplicados comoGRANT FILE ON *.*, FILE ON *.* TO xen lugar deGRANT FILE ON *.* TO xal dar formato a grants READ/WRITE retrocompatibles sobre la misma source. #102411 (Groene AI). - Se corrige la pérdida de paralelismo en la agregación después de consultas read-in-order cuando
max_streams_to_max_threads_ratioes mayor que 1. #102467 (Alexey Milovidov). - Se corrigió un crash (
LOGICAL_ERROR: Unknown virtual column) al seleccionar subcolumns (como.nullpara Nullable,.size0para Array, elementos de Tuple o keys/values de Map) desde una tabla con el engine Buffer. #102470 (Groene AI). - Se corrige la excepción “Cannot fold actions for projection” en la optimización de reordenación de join cuando un LEFT/RIGHT JOIN con
join_use_nullsse combina con otros joins que involucran más de dos tablas. #102516 (Alexey Milovidov). - Se corrigió un overflow silencioso en operaciones escalares pointwise sobre numericIndexedVector (p. ej.,
numericIndexedVectorPointwiseAdd) cuando el escalar está fuera de rango. Estas entradas ahora generanINCORRECT_DATAen lugar de devolver valores corruptos. #102546 (FriendLey). - Se corrige el formato inconsistente del AST para INSERT con SAMPLE y OFFSET a nivel de consulta. Cierra #102523. #102547 (zoomxi).
- Se corrige la excepción
LOGICAL_ERRORengroupConcatal deserializar un estado malformado de aggregate function. #102558 (Christoph Wurm). - Ya no se acepta contenido no válido al final de los valores CSV de Time64 con
input_format_csv_use_default_on_bad_values=0. Cierra #102490. #102596 (Yarik Briukhovetskyi). - Se corrige la excepción UNKNOWN_ELEMENT_OF_ENUM al insertar el valor predeterminado en una JSON column con paths tipados como Enum. Cierra #102359. #102687 (Pavel Kruglov).
- Se corrige la corrupción de columns_substreams.txt al renombrar columnas en algunos casos. Cierra #102259. #102689 (Pavel Kruglov).
- Se corrige la inserción en el tipo de dato Time durante el parsing de JSON. Cierra #102016. #102690 (Pavel Kruglov).
- Se corrige la codificación hexadecimal de la muestra de contenido en nombres de archivo de schema en caché. Cierra #101904. #102703 (Pavel Kruglov).
- Se corrigió una infracción del orden de clasificación (
crashen debug, corrupción silenciosa de datos en release) durante la operación demergedeSummingMergeTreecuando la claveORDER BYes una expresiónhashsobre una columnaFloat32que contiene valores NaN de señalización. #102791 (Groene AI). - Se hicieron cancelables mediante
KILL QUERYDETACH DATABASE ... SYNCy otras operaciones que llaman awaitDetachedTableNotInUse, y se hizo que respondieran al apagado del server, evitando bloqueos indefinidos cuando una consulta concurrente mantiene una referencia a una tabla. #102804 (Antonio Andelic). - Se corrigió un posible resultado incorrecto de
ANY RIGHT JOIN. #102893 (Nikita Taranov). - Se corrigió un problema por el que las solicitudes a S3 fallaban con
ios_base::clear: unspecified iostream_category erroren lugar de reintentarse, debido a queBufferedStreamBuf::flushBufferde Poco no manejaba escrituras cortas desde la capa de socket. #102894 (Sema Checherinda). - Se corrigió el fallo de la función de tabla
input('auto')a través de la interfaz HTTP en consultas INSERT SELECT. #102902 (Miсhael Stetsyuk). - Se deshabilitó la optimización trivial de LIMIT con row policies/additional_table_filters (para permitir el análisis paralelo de índices). #102921 (Azat Khuzhin).
- Se ocultó la clave secreta en la función SQL
HMAC. Corrige #102927. #102997 (Mikhail f. Shiryaev). - Se corrigió la excepción
MULTIPLE_EXPRESSIONS_FOR_ALIASgenerada en consultas distribuidas que hacen referencia varias veces a la misma llamada aquantile(por ejemplo, enSELECT,HAVINGyORDER BY) conoptimize_syntax_fuse_functionshabilitado. #103014 (tanner-bruce). - Se corrige un caso detectado por CI en el que se pasaba un set no preparado cuando el filtro depende de la columna del lado izquierdo. Cierra #102966. #103029 (Yarik Briukhovetskyi).
- Se corrige
castOrNulla JSON en algunos casos. Cierra #101818. #103036 (Pavel Kruglov). - Se corrigió un problema por el que
SELECT DISTINCTdevolvía silenciosamente resultados incompletos cuando una proyección de agregación coincidía con la consulta y algunas partes de la tabla no tenían datos de proyección (por ejemplo, la proyección se añadió a una tabla que ya contenía datos y no se ejecutóMATERIALIZE PROJECTION). Cierra #102951. #103052 (Nihal Z. Miaji). - Se corrigió la excepción
TOO_FEW_ARGUMENTS_FOR_FUNCTIONcuando un predicadoWHEREcomoAND(OR(A, A), A)se reduce a un único argumento de nivel superior durante la extracción de expresiones comunes en el analizador. #103072 (Peng). - Corrige un error lógico
Function writeSlice expects same column types for GenericArraySlice and GenericArraySinkque se producía al evaluarif/ifNullsobre tuplas, mapas o arrays que contenían un elementoQBit.ColumnQBit::structureEqualscomparaba incorrectamente la tupla interna de una columnaQBitcon el envoltorio externo de la otra, por lo que columnasQBitestructuralmente idénticas se reportaban como diferentes. #103084 (Groene AI). - Hace que
DETACH DATABASEcondatabase_atomic_wait_for_drop_and_detach_synchronouslyrespeteKILL QUERYen lugar de quedar bloqueado indefinidamente cuando se mantiene una referencia a una tabla. #103095 (Alexey Milovidov). - Corrige un segfault al eliminar un módulo WASM usando un predicado que no es un identificador (por ejemplo,
WHERE 1=1). #103101 (Joe Redfern). - Corrige una ruptura de compatibilidad con versiones anteriores por la que clientes antiguos fallaban con
UNEXPECTED_PACKET_FROM_SERVERal insertar en un servidor más reciente medianteremote()o tablas distribuidas, causada por una llamada incondicional asendProgressal final deprocessInsertQuery. #103148 (Sema Checherinda). - IN con un segundo argumento de tipo tuple no constante no debe aplicar CAST a los elementos de la tuple reduciéndolos al tipo del lado izquierdo, ya que esto puede provocar overflow. Cierra #103055. #103169 (Yarik Briukhovetskyi).
- Corrige el uso de un valor no inicializado en una función del protocolo. #103187 (Pavel Kruglov).
- Corrige
LOGICAL_ERROR(Bad cast … to ColumnLowCardinality) durante el análisis de índices de MergeTree cuando una cláusulaWHEREcompara una columna claveLowCardinalitycon una constante convertida a un tipo que contieneLowCardinalityanidado (por ejemplo,Variant(LowCardinality(Date), String)). #103211 (Groene AI). - Corrige
Logical error: 'index < bucket_count'en la familia de funciones de agregacióntimeSeries*ToGrid(por ejemplo,timeSeriesResampleToGridWithStaleness,timeSeriesChangesToGrid,timeSeriesResetsToGrid,timeSeriesRateToGrid) cuando se llamaba con parámetros de timestamp extremos que provocarían overflow en la aritmética con signo de 64 bits durante el cálculo del número de buckets. También limita el número total de buckets de la cuadrícula a 16 millones para evitar asignaciones accidentales de grandes cantidades de memoria a partir de entradas maliciosas. #103223 (Groene AI). - Corrige la excepción
Logical error: 'Port is already connected'durante la expansión de la pipeline en la rutaFINALdiferida paraReplacingMergeTree. El error afectaba a las consultas conquery_plan_optimize_lazy_final = 1cuandoReadFromMergeTree::initializePipelineinsertaba transformaciones internas (por ejemplo, unResize) que conectaban entre sí los procesadores de la sub-pipeline, lo que hacía queLazyUnorderedReadFromMergeTreeSource::expandPipelineintentara conectar puertos de salida que ya estaban conectados. #103230 (Groene AI). - Corrige resultados incorrectos de
LIMIT BYyDISTINCTcuando la entrada es unUNION ALLde subconsultas ordenadas. El optimizador del plan de consulta trataba incorrectamente esa unión como si estuviera ordenada globalmente, lo que provocaba que se devolvieran filas adicionales. #103231 (Nihal Z. Miaji). - Corrige un posible fallo durante el cálculo de estadísticas en el tipo Map con replicación diferida. Cierra #102390. #103273 (Pavel Kruglov).
- Corrige una carrera de dato en las fuentes de diccionario de ClickHouse, MySQL, PostgreSQL y XDBC, donde
clone() constlee de la misma cadenainvalidate_query_responseen la queisModified() constescribe. #103277 (Miсhael Stetsyuk). - Corrige la detección incorrecta de monotonicidad para
Date32. Cierra #101265. #103283 (Yarik Briukhovetskyi). - Limita a 64 KB las cadenas del paquete TCP Hello previas a la autenticación y añade la configuración de servidor
handshake_timeout_millisecondspara limitar el tiempo total de handshake, evitando que clientes no autenticados consuman memoria en exceso o mantengan hilos ocupados indefinidamente. #103284 (Sema Checherinda). - Corrige
min_value > max_valueen las estadísticas de Parquet ColumnIndex para columnas String. #103334 (Saurabh Kumar Ojha). - Corrige el manejo incorrecto de filas NULL para entradas
Nullable(Tuple(...))enflattenTupleytupleToNameValuePairs.flattenTupleahora conserva el mapa nulo externo para que las filas NULL sigan siendo NULL.tupleToNameValuePairsahora cambia el tipo de valor del resultado aNullable(T)cuando es posible si la entrada esNullable(Tuple(...)), de modo que las filas NULL produzcan[('a', NULL), ('b', NULL)]en lugar de[('a', 0), ('b', 0)]. Cuando el tipo de elemento no puede envolverse enNullable(por ejemplo,Array), se usan valores predeterminados en lugar de NULL. Cierra #103312. #103383 (Nihal Z. Miaji). - Comprueba si hay datos Dynamic aplanados malformados en Native format. #103392 (Pavel Kruglov).
- Corrige una RPC obsoleta que provocaba que la replicación se quedara bloqueada tras la sincronización del snapshot. #103406 (Seva Potapov).
- Corrige un fallo del servidor por
LOGICAL_ERROR“Cannot pop N rows from X” (en builds de depuración / con sanitizador) al leer un documento BSON malformado que contenía un valor cuyo tipo BSON es incompatible con el tipo de la columna de destino dentro de una columnaNullable(T)oArray(Nullable(T)). La fila malformada ahora produce una excepciónILLEGAL_COLUMNlimpia, como estaba previsto. #103418 (Groene AI). - Corrige un fallo del servidor en
arrayFillyarrayReverseFillcuando se aplican a una columnaArray(String)cuya primera fila está vacía junto con una lambda constantemente falsa. El índicesize_tdel bucle de agregación / subarreglo sufría un underflow hastaSIZE_MAX, lo que luego provocaba una lectura fuera de límites dentro deColumnString::doInsertManyFrom. Misma familia de errores que #12263. #103424 (Groene AI). - Corrige ACCESS_DENIED / UNKNOWN_TABLE en RMV APPEND descendentes con SQL SECURITY DEFINER cuando el EXCHANGE de un RMV REPLACE ascendente cambia la identidad del almacenamiento de destino a mitad de la resolución. #103427 (Alexander Gololobov).
- Pobla la columna
_timea partir de la table functionurl. #103437 (Nikita Taranov). - Corrige una posible lectura fuera de los límites en la ruta de descompresión del codec
ALPal procesar una entrada malformada con un ancho de bits no válido. #103457 (Raufs Dunamalijevs). - Corrige un error por el que
SYSTEM SYNC FILESYSTEM CACHE '<name>' ON CLUSTER ...podía perder el nombre de la caché al dar formato a la consulta, lo que provocaba que los nodos remotos sincronizaran todas las cachés del filesystem en lugar de solo la caché solicitada. #103469 (Asish Kumar). - Corrige el procesamiento de la ruta codificada en URL en
deltaLakeAzure. Cierra #103509. #103525 (Smita Kulkarni). - Corrige un uso de memoria después de su liberación en el heap al multiplicar un estado de
AggregateFunctionpor un entero (por ejemplo,quantilesExactState(...) * N). El bucle de exponenciación por cuadrados fusionaba el estado consigo mismo, lo que no está definido cuando lamergede la función de agregación reasigna su almacenamiento interno. Cierra STID 0988-40af. #103536 (Groene AI). - Corrige un raro
LOGICAL_ERROR“Part X intersects previous part Y” que se producía durante el arranque de una tablaReplicatedMergeTreecuando dos partes vacías inesperadas en disco tenían rangos de bloques superpuestos, pero sin que una contuviera a la otra. La excepción abortaba el hilo de asociación de la tabla e impedía que la tabla se iniciara. #103537 (Groene AI). - Corrige
Logical error: Incorrect mark rows for part ...(aserción solo de depuración) que se activaba por mutaciones en tablasMergeTreecon granularidad de índice no adaptativa (index_granularity_bytes = 0) cuya última marca de datos estaba incompleta (se reproduce de forma más fiable conDETACH/ATTACHseguido de una eliminación ligeraDELETE). #103538 (Groene AI). - Corrige que
clickhouse-localdevolviera silenciosamente 0 filas al leer desde los pseudoficheros/procy/sysmediante la table functionfile()(por ejemplo,SELECT * FROM file('/proc/cpuinfo', 'RawBLOB')). #103548 (Ashrith Bandla). - Corrige el manejo del argumento
max_string_lengthpara el table engineGenerateRandom. #103550 (Alex Kuleshov). - Corrige el enmascaramiento de credenciales anidadas en los logs. #103552 (Vitaly Baranov).
- Corrige la detección de SVE que usaba instrucciones SVE cuando no estaban disponibles. #103568 (Raúl Marín).
- Corrige el análisis de los argumentos de almacenamiento de
GenerateRandom. #103574 (Konstantin Bogdanov). - Corrige un bucle infinito en
WITH FILLpara datos que empiezan con ±inf. #103580 (Konstantin Bogdanov). - Se corrige que
JSONExtracten un tipoVarianttruncara silenciosamente los números JSON fraccionarios. Antes,JSONExtract('{"x": 3.14}', 'x', 'Variant(Int64, Float64)')devolvíaInt64=3yJSONExtract('{"x": 3.14}', 'x', 'Variant(String, Int64)')devolvíaInt64=3, perdiendo la parte fraccionaria. Ahora el valor fraccionario se conserva sin pérdida: un miembroFloat64/Decimallo toma cuando está presente; de lo contrario, un miembroStringcaptura el JSON original. Los tiposVariantque contienen solo miembros enteros (p. ej.,Variant(Int64, Int32)) y la extracción directa como entero (JSONExtract(json, 'Int64'),JSONExtractInt, etc.) no cambian. #103620 (Groene AI). - Se corrige que
SYSTEM INSTRUMENT REMOVEsin argumentos produjerastd::bad_optional_access(código de error 1001) en lugar deSYNTAX_ERROR(código de error 62). #103622 (Pablo Marcos). - Se corrige un error lógico/comportamiento indefinido en la window view
windowIDytumblecuando se llamaban con una cadena de zona horaria como tercer argumento. #103641 (Alexey Milovidov). - El logging del client de S3 ahora trata las respuestas HTTP 400 que incluyen un encabezado x-amz-bucket-region no vacío (región de firma SigV4 incorrecta) como un caso informativo de región incorrecta, con una línea de log más clara en lugar de la ruta genérica de error. El proveedor de credenciales de identidad web de STS se añade a la cadena de credenciales de S3 solo cuando la identidad web está configurada, lo que reduce las advertencias espurias en implementaciones que no la usan. Cierra #99140. #103673 (MeltonSmith).
- Se corrige
SYSTEM SYNC REPLICA <db>.<tbl> IF EXISTSpara que finalice correctamente y sin errores cuando la base de datos no exista, en consonancia con el comportamiento actual para una table inexistente y con el precedente establecido porDROP TABLE IF EXISTS. Antes, la consulta lanzabaUNKNOWN_DATABASEpese aIF EXISTS. Cierra #103629. #103689 (Groene AI). - Se corrige el error lógico
Arguments of 'plus' have incorrect data typeslanzado porFunctionBinaryArithmetic::executeImpl2cuando una tableMergeTreeteníaArray(LowCardinality(...))en su clave de ordenación y una cláusulaWHEREusabaplus/minusentre esa columna y una constanteArrayde un tipo de elemento distinto.KeyCondition::getMonotonicityForRangeahora eliminaLowCardinalityde forma recursiva antes de invocar el despacho numérico interno. #103701 (Groene AI). - Se corrige una condición de carrera al redimensionar dinámicamente la cache en 26.1+. #103702 (Kseniia Sumarokova).
- Se corrige un problema por el que los índices de omisión text y bloom_filter en columnas
ALIAScuya expresión contenía una lambda con constantes capturadas (p. ej.,arrayMap((k, v) -> concat(k, '=', v), mapKeys(m), mapValues(m)))se ignoraban silenciosamente. #103708 (Anton Popov). - Se corrige que
positionypositionCaseInsensitivecon unstart_poscercano aUINT64_MAXse quedaran bloqueados o provocaran un fallo de segmentación debido a un desbordamiento en la aritmética de punteros. #103766 (Raúl Marín). - Se corrige un comportamiento indefinido al analizar
DateTimecon una parte fraccionaria doble. #103773 (Yarik Briukhovetskyi). - Se corrigió una regresión de corrección de datos en 26.x por la que
ifymultiIfcompilados con JIT, con un tipo de resultadoDecimaly un literal noDecimal(entero o de coma flotante) en una rama, devolvían silenciosamente un valor10^scaledemasiado pequeño. La ruta lenta (sin JIT) no se veía afectada. Solución temporal en las versiones afectadas:SET compile_expressions = 0. #103809 (Groene AI). - Corrige el reenvío del tokenizer desde el text index a las funciones compatibles. #103826 (Elmi Ahmadov).
- Corrige resultados incorrectos de
numbers,generate_seriesy fuentes similares que respetan rangos cuando la cláusulaWHEREusaINoNOT INsobre una tupla cuyos elementos se deduplican en una única columna clave (por ejemplo,WHERE tuple(number, number) NOT IN (tuple(1, 2))). Cierra #103660. #103835 (Groene AI). - Mantiene el pico real de memoria del hash join con spilling automático por debajo de
max_bytes_before_external_join. Antes, la preasignación basada en estadísticas, el redimensionamiento in situ de la hash table y los buckets en memoria sin límite deGraceHashJoinpodían hacer que la consulta superara el límite configurado y provocaraMEMORY_LIMIT_EXCEEDED. #103838 (Alexey Milovidov). - Corrige un bloqueo durante el cierre de
clickhouse-localcuando hay logs del sistema configurados (comotext_logofilesystem_cache_log).SystemLogs::flushImplllamaba aBaseDaemon::instance().flushTextLogs(), que lanzastd::bad_castfuera declickhouse-server, y dejaba los hilos de guardado en ejecución hasta quepthread_cond_destroybloqueaba la destrucción de las colas de logs del sistema. #103874 (Alexey Milovidov). - Rechaza las consultas CTE
MATERIALIZEDcuyo body se resuelve en distintos tipos de columna inferidos según la referencia, con un error claroTYPE_MISMATCHen lugar de hacer que el server falle con unBad castLOGICAL_ERROR. Esto ocurría cuando el body del CTE hacía referencia a identificadores de un ámbito externo (por ejemplo, un alias de la proyección de la subconsulta llamante) que se expandían en línea como constantes distintas para cada referencia. #103879 (Groene AI). - Corrige un uso de valor no inicializado en los optimizadores del query plan de conversión de JOIN (
tryConvertAnyOuterJoinToInnerJoin,tryConvertAnyJoinToSemiOrAntiJoin) cuando el filtro sobre unANYOUTERJOINcontiene una función no determinista comorand,noworowNumberInAllBlocks. El optimizador ya no intenta plegar constantes en esos filtros y deja el JOIN sin cambios, lo que también evita conversiones incorrectas aINNER/SEMI/ANTI JOINque podían descartar filas silenciosamente. #103880 (Groene AI). - Corrige un uso de memoria tras su liberación en
StorageKafka2que podía hacer que el server fallara cuando se sustituye una session de Keeper mientras el consumer mantiene bloqueos efímeros de partición de tópico. #103890 (Groene AI). - Se corrigió un
LOGICAL_ERROR“Primary key type mismatch” lanzado al hacer JOIN de una tablaEmbeddedRocksDBmedianteJOIN ... USING (key)con una subconsulta cuya columna clave tiene un tipo distinto (por ejemplo,Nullable(UInt64),Int64,Decimal) al de la primary key del almacenamiento. El planner ahora descartaDirectKeyValueJoincuando hay incompatibilidad de tipos y recurre aHashJoin, que gestiona la conversión de tipos. #103928 (Groene AI). SET max_threads = DEFAULT(y lo mismo paramax_final_threadsymax_parsing_threads) ya no pierde el estadoauto. Anteriormente, después de restablecer una de estas configuraciones,system.settingsmostraba el recuento de núcleos resuelto (p. ej.,32) en lugar de'auto(32)', y el servidor se comportaba como si el valor se hubiera fijado explícitamente. #103991 (Groene AI).- Corrige
SIZES_OF_ARRAYS_DONT_MATCHal leer columnasAggregateFunction(topK(N), String)cuyoalpha_sizepersistido había aumentado debido a un ciclo de deserialize+serialize anterior a la versión 25.12. #104002 (Raúl Marín). - Se corrigió una vulnerabilidad de inyección SQL en dictionary sources de PostgreSQL, Cassandra y XDBC: las claves de tipo cadena que contenían comillas simples se escapaban con
\'(barra invertida), que estos backends interpretan como una barra invertida literal en lugar de una secuencia de escape, lo que permitía inyectar SQL arbitrario en las consultas de lookup del diccionario.ExternalQueryBuilderahora emite el escape estándar de SQL''para esos backends; los dictionary sources de ClickHouse y MySQL siguen usando escape con barra invertida. #104009 (Shaohua Wang). - Se corrigió una posible incompatibilidad de tipos en la agregación cuando el tipo de una columna se cambiaba a o desde LowCardinality y no se reconstruía la proyección min-max. #104013 (Nikita Taranov).
- Corrige un bucle infinito de optimizaciones de consultas provocado por no propagar la prevención de eliminar columnas no usadas al fusionar expresiones. #104083 (János Benjamin Antal).
- Corrige
LOGICAL_ERRORenStreamingStorageRegistry::renameTableal renombrar por lotes tablas de streaming (S3Queue, Kafka, RabbitMQ) mediante seguimiento de identidad basado en UUID en lugar de nombres. #104101 (Nikita Taranov). - Se corrigieron resultados incorrectos cuando un CTE construido con
UNION ALLcontenía una ramaSELECT DISTINCTy la consulta externa proyectaba solo un subconjunto de las columnas del CTE. El nuevoanalyzerRemoveUnusedProjectionColumnsPasseliminaba incorrectamente la columna no referenciada de la proyecciónDISTINCTinterna, lo que hacía que filas que debían seguir siendo distintas (mismo valor en la columna proyectada, pero distinto valor en la columna eliminada) colapsaran en una sola. #104114 (Groene AI). - Corrige varios problemas de exactitud en casos límite en la configuración
optimize_inverse_dictionary_lookup, donde la optimización podía descartar filas silenciosamente o suprimir excepciones. Cierra #103270. Cierra #103085. #104133 (Nihal Z. Miaji). - Corrige una escritura fuera de límites al deserializar el estado
quantileTiming. #104141 (Alexey Milovidov). - Corrige un comportamiento indefinido cuando un valor
Float64fuera de rango se convierte a un tipo entero wide (UInt64,Int64,Int128,UInt128,Int256,UInt256). Anteriormente, valores iguales aFloat64(numeric_limits<T>::max())(que se redondea hacia arriba a un valor por encima del máximo real) eludían la comprobación de límites y producían UB en el cast posterior. Esto afectaba al parsing de parámetros de funciones de agregación (topK,histogram,uniqUpTo,groupArrayInsertAt, etc.) y a configuraciones de tipo entero medianteSET <setting> = <Float64>. Cierra #103817. #104154 (Groene AI). - Se corrige la excepción
LOGICAL_ERROR“Unexpected return type from comparison. ExpectedUInt8. GotConst(Nullable(UInt8))” al comparar unTuple(Tuple(Nullable(...)))anidado (o con un nivel de anidamiento mayor) con un literalString. El tipo de retorno de la comparación ahora se infiere correctamente comoNullable(UInt8), en consonancia con el comportamiento en tiempo de ejecución. #104171 (Groene AI). - Se corrigió un aborto del servidor (
UndefinedBehaviorSanitizer: reference binding to null pointer, segfault en versiones release) enSELECT ... FROM <ReplacingMergeTree(version, is_deleted)> FINAL PREWHERE is_deleted = <expr> AND <other column expr>cuandoquery_plan_optimize_lazy_final = 1. El paso de lectura lazy-FINAL sin intersección perdió la columnais_deletedde su encabezado de salida porquePREWHEREla consumió como entrada sin volver a exponerla como salida. El paso posterioraddIsDeletedFilteracabó desreferenciando un puntero nuloActionsDAG::Node. #104177 (Groene AI). - Al llamar a la tabla system.failpoints, se usaba un failpoint, por lo que podía quedar deshabilitado. #104237 (Pedro Ferreira).
- Se corrige
MemorySanitizer: use-of-uninitialized-valueen las funcionesdetectLanguage*cuando la entrada contiene un carácter UTF-8 que termina exactamente en el límite del búfer. #104257 (Raúl Marín). - Se corrige un error lógico (
Bad cast from type DB::CachedObjectStorage to DB::S3ObjectStorage) que abortaba el análisis de argumentos de los motores y las table functions de data lake (icebergS3,deltaLakeS3, etc.) cuando se invocaban conSETTINGS disk = '...'sobre un disco cuyo object storage subyacente está envuelto por un decorador, como una filesystem cache. Cierra #89300. #104258 (Groene AI). - Se corrige el análisis de expresiones de subíndice entre paréntesis en columnas llamadas
values, por ejemplo(values['a']), para que ya no se interpreten como expresiones de tablaVALUESestándar de SQL. #104312 (Desel72). - Se corrige un aborto del servidor/
LOGICAL_ERRORen el hilo de eviction en segundo plano de la filesystem cache (SLRUFileCachePriority::collectEvictionInfo) que podía producirse cuandokeep_free_space_size_ratiookeep_free_space_elements_ratioeran lo bastante altos como para activar la eviction mientras todas las cache entries ya habían sido promovidas a la protected queue de SLRU (con la probationary vacía). #104313 (Groene AI). - Se corrigen excepciones (
NOT_FOUND_COLUMN_IN_BLOCK,LOGICAL_ERROR,AMBIGUOUS_COLUMN_NAME) al usar projections con vistas UNION ALL, window functions o colisiones de nombres entre alias y columnas. Regresión de #88798. #104317 (Amos Bird). - Se corrige un posible underflow en el análisis de arrays de Postgres. #104322 (Grant Holly).
- Las funciones que devuelven un tipo no
Nullable(comoArray,TupleoMap) ahora aceptan argumentosNullable. Las funciones afectadas incluyenextractAll,extractAllGroups,extractAllGroupsHorizontal,extractAllGroupsVertical,extractGroups,splitByChar,splitByString,splitByRegexp,splitByWhitespace,splitByNonAlphayalphaTokens. Las filas de entradaNULLahora producen el valor predeterminado del tipo de resultado (por ejemplo, un array vacío) en lugar de generar “Nested type is not allowed inside Nullable type”. #104326 (Alexey Milovidov). - Corrige las estadísticas de Iceberg en tablas particionadas. Esto cierra #104321. #104329 (Konstantin Vedernikov).
- Corrige un error lógico fatal durante el arranque del servidor en macOS (y compilaciones similares de jemalloc), en el que
Jemalloc::verifySetupinformaba incorrectamente de una discrepancia enjemalloc_enable_background_threadsporque los mallctls opcionalesbackground_thread/max_background_threadsno existen; la verificación se omite cuando esos mallctls no están disponibles, ygetValueya no deja la salida sin inicializar si falla. Cierra #102183. #104330 (SAYON DEEP). - Corrige una regresión que afectaba a la corrección, por la que las consultas
SELECTconmax_rows_to_read_leafyread_overflow_mode_leaf = 'throw'podían lanzar incorrectamenteTOO_MANY_ROWSincluso cuando un skip index habría reducido la lectura por debajo del límite del leaf. La configuración simétrica para non-leaf (max_rows_to_read/read_overflow_mode) ya estaba contemplada. #104331 (Groene AI). toUUID,toUUIDOrNull,toUUIDOrZero,toUUIDOrDefault,CASTaUUIDyNullable(UUID),accurateCastOrNullaUUID, y los formatos de entrada que interpretan un UUID a partir de texto (Avro,MsgPack,JSONExtract, …) ahora rechazan cadenas con la longitud correcta pero que contienen caracteres no hexadecimales. Antes, estas entradas se convertían silenciosamente en un UUID fabricado al leer más allá del final de la tabla de búsqueda de dígitos hexadecimales; ahoratoUUIDlanzaCANNOT_PARSE_UUID, y las variantesOr*devuelvenNULL/ el UUID cero / el valor predeterminado proporcionado. #104370 (Groene AI).- Corrige
Bad castLOGICAL_ERRORencaseWithExpression(y en SQLCASE expr WHEN ... THEN ... ELSE ...) cuando el supertype solo de THEN y el supertype de (THENs + ELSE) acaban en distintos almacenamientosColumnDecimal; por ejemplo, valores THEN(UInt16, Int8)con un ELSE deDecimal(9, 2). Cierra #104335. #104378 (Groene AI). - Los fallos internos informados mediante
logExceptionBeforeStart(flushes de asynchronous insert, refreshes de vistas materialized, errores de parse lanzados durante consultas internas) ahora incrementan correctamente los ProfileEventsFailedInternalQuery,FailedInternalSelectQueryyFailedInternalInsertQuery, junto con los contadores visibles para el usuarioFailedQuery,FailedSelectQueryyFailedInsertQuery. Antes, estos contadores internos permanecían en cero para los fallos ocurridos antes de que empezara la ejecución de la consulta, por lo que no contabilizaban una clase importante de fallos internos. #104399 (Groene AI). - Corrige el error
Code: 36. BAD_ARGUMENTS Expected literal, got {name:Type}que se producía al usar un parámetro de consulta dentro del ajustebase_backupde una sentenciaBACKUPoRESTORE(p. ej.,BACKUP ... SETTINGS base_backup = S3({backup_name:String}, ...)). La regresión se introdujo en26.1.5con el PR #99205. Cierra #103324. #104413 (Groene AI). - Corrige un abort del servidor en escrituras de
IcebergLocal/IcebergS3cuando aALTER TABLE ... DROP COLUMNle sigue unINSERTconiceberg_metadata_staleness_msmayor que cero. AhoraALTERinvalida la caché local de archivos de metadatos de Iceberg para que las lecturas y escrituras posteriores vean el nuevo esquema. #104419 (Groene AI). - Corrige
DROP ROLE,DROP USER,DROP SETTINGS PROFILE,DROP ROW POLICY,DROP QUOTAyDROP MASKING POLICYpara eliminar las referencias a la entidad eliminada de cualquier otra entidad de acceso que la referenciara (p. ej., la listaDEFAULT ROLEde un usuario, la listaTOde un perfil de ajustes o los beneficiarios de una política de filas) y persistir esa limpieza en disco. Antes, el estado en memoria parecía correcto porqueSHOW CREATEfiltra los UUID desconocidos, pero los archivos.sqlen disco conservaban entradas colgantesID('<dropped-uuid>'), y las referencias reaparecían en el siguiente reinicio del servidor, manifestándose como erroresACCESS_ENTITY_NOT_FOUNDdurante la ejecución distribuida de consultas. #104427 (Groene AI). - Corrige un abort del servidor provocado por
azureBlobStorage, el engineAzureBlobStoragey DeltaLake-on-Azure con una cadena de conexión cuya URLBlobEndpointtiene un puerto vacío, no numérico o fuera de rango (p. ej.,BlobEndpoint=http://host:abc/). Ahora el servidor devuelve un errorBAD_ARGUMENTSclaro en lugar de abortar en builds de depuración o con sanitizador. #104460 (Groene AI). - Permite usar un identificador sin comillas como nombre de usuario en las Table functions
remoteyremoteSecure, igual que los argumentos de base de datos y tabla aceptan identificadores sin comillas. Antes, esa consulta fallaba con un error de autenticación engañoso que hacía referencia al usuariodefault. #104465 (Alexey Milovidov). - Corrige
Logical error: Incorrect ASTSelectWithUnionQuery (modes: M, selects: N)que se activaba cuando el cuerpo de una función definida por el usuario en SQL contiene unUNION ALLinterno entre paréntesis (p. ej.,CREATE FUNCTION f AS x -> (SELECT 1 UNION ALL (SELECT 1 UNION ALL SELECT 1))). #104477 (Groene AI). - Corrige que
uniqThetaIntersectdevolviera la cardinalidad del primer argumento en lugar de0cuando el segundo argumento es un estadouniqThetavacío; por ejemplo, el resultado deuniqThetaMergeStateIf(s, predicate)cuando el predicado excluye todas las filas. #104529 (Groene AI). - Corrige
SHOW TABLESysystem.tables, que truncaban silenciosamente el listado de las bases de datosDataLakeCatalogrespaldadas por catálogos REST de Iceberg (iceberg-rest,onelake,biglake). Cuando el servidor del catálogo paginaba la respuesta de list-tables o list-namespaces (por ejemplo, Microsoft Fabric / OneLake con más de ~50 tablas por espacio de nombres), las tablas de las páginas posteriores quedaban silenciosamente ocultas paraSHOW TABLESysystem.tables, aunque se podían consultar medianteSELECTdirecto.RestCatalogahora sigue el token de continuaciónnext-page-tokendefinido por la especificación OpenAPI de Iceberg REST, en consonancia con el comportamiento existente dePaimonRestCatalogyUnityCatalog. #104531 (Groene AI). - La función de tabla
inputahora infiere su estructura a partir de la cláusulaFORMATde la consultaINSERTcircundante cuando ese formato tiene un esquema fijo (LineAsString,RawBLOB,JSONAsString, etc.), por lo que los usuarios ya no tienen que repetir la estructura comoinput('line String')para estos formatos. #104532. #104533 (Groene AI). - Se actualizó el tipo de dato de los campos del historial de Iceberg de
Int32aInt64. Cierra #94176. #104579 (Smita Kulkarni). - Se corrigió
Inconsistent AST formattingLOGICAL_ERRORal analizar una llamada a función en la que una lambda va después de una coma, por ejemploSELECT substring(x, `x` -> `x`). Antes, el parser fusionaba silenciosamente los argumentos anteriores en el lado izquierdo de la lambda, produciendo una llamada de un solo argumento que no podía volver a analizarse para reconstruir el mismo AST. Ahora preserva la aridad original de la función. #104626 (Groene AI). CHECK TABLE tahora da preferencia a una tablaTEMPORARYfrente a una permanente con el mismo nombre cuando no se proporciona un calificador de base de datos, en consonancia con la precedencia ya utilizada porSHOW CREATE TABLE,DESCRIBE TABLE,OPTIMIZE TABLEyALTER TABLE. Anteriormente,CHECK TABLE tomitía por completo las tablas temporales, por lo que fallaba conUNKNOWN_TABLEen una tabla temporalLogoFile, aunque esos motores admitenCHECK. Continuación de #100966. #104637 (Groene AI).- Corrige el bucle de terminación y reinicio de Keeper cuando se envía
get /keeper/availability_zoneconquorum_reads=truea un Keeper sin<placement>configurado. #104663 (myeongjun). - Corrige una carrera de dato TOCTOU en
FutureSetFromTuple::buildOrderedSetInplaceque provoca un error lógico. #104673 (Miсhael Stetsyuk). - Corrige varias funciones que devolvían resultados distintos para la misma entrada según si los argumentos llegaban como columnas o constantes:
bitRotateLeft/bitRotateRight(recuentos de desplazamiento en los límites),length(FixedString)/concatWithSeparatorcon entradasLowCardinality(Nullable),roundDownsobre NaN yrightUTF8sobre UTF-8 no válido. #104710 (Raúl Marín). - Se corrigió que
anyHeavydevolviera un valor no dominante cuando el valor más frecuente era el valor predeterminado de la columna y los datos estaban repartidos en varias partes deMergeTree(ruta de lectura de columnas dispersas). #104712 (Raúl Marín). - Se corrigen varios defectos en el manejo de restricciones de configuración: las restricciones de
MergeTreeSettingsdeclaradas sobre el nombre canónico de una configuración podían eludirse escribiendo en un alias de esa configuración; la comprobación de la restriccióndisallowed_valueslanzaba una excepción en rutas de clamp (consultas secundarias, workersON CLUSTER, vistasSQL SECURITY DEFINER) en lugar de descartar silenciosamente el cambio. #104737 (Raúl Marín). - Se corrige una excepción
LOGICAL_ERROR(Metadata is not initialized) provocada porOPTIMIZE TABLE,ALTER TABLE ... DELETE,ALTER TABLE ... ADD COLUMNy otras variantes de ALTER en una tablaIceberg/IcebergLocal/DeltaLake/Hudiadjunta de forma diferida cuyo metadata aún no se había cargado (algo típico después de un reinicio del server, o después de que una escritura previa de metadata fallara y dejara en disco un archivo de metadata corrupto). Ahora la operación continúa normalmente si el metadata se carga correctamente o, en caso contrario, muestra el fallo de carga subyacente como una excepción normal visible para el usuario en lugar de abortar el server en builds de debug / sanitizador. #104738 (Groene AI). - Se corrige un segfault debido a un error de use-after-free en
AvroConfluentRowInputFormat. #104751 (Miсhael Stetsyuk). - Las variantes escalares de
numericIndexedVectorPointwiseMultiply,numericIndexedVectorPointwiseDivide,numericIndexedVectorPointwiseEqualynumericIndexedVectorPointwiseNotEqualahora generanINCORRECT_DATAcuando se llaman con un escalarUInt64superior aInt64::max. #104784 (FriendLey). - Se corrige un error por el que sobrescribir manualmente una configuración mediante su nombre de alias (por ejemplo,
SET enable_analyzer = 1en lugar deSET allow_experimental_analyzer = 1) después de aplicar una configuracióncompatibilitypodía hacer que esa sobrescritura se revirtiera tras un cambio posterior de la configuracióncompatibility. #104829 (Raúl Marín). - Se corrige que el logger de AWS quedara deshabilitado después de https://github.com/ClickHouse/ClickHouse/commit/0e8ad4355c9d. #104837 (Konstantin Bogdanov).
- Se corrigen otras tres funciones que devolvían resultados distintos para la misma entrada según si los argumentos llegaban como columnas o como constantes:
transform(ycaseWithExpressiona través de ella) con un valor predeterminado constanteDate/Date32/Enum/FixedString, operadores de comparación entre unStringy unFixedStringconstante, eif/ifNull/nullIfcon una ramaFixedStringbajo una condición constante. #104858 (Raúl Marín). - Se corrige el cierre del server con
Bad cast from type DB::ColumnConst to DB::ColumnNullabledurante la poda de particiones de tablasMergeTreecuando la expresión de partición contiene una cadena de funciones que colapsa en un único valor constante (comofloor(NULL, toRelativeYearNum(...))). #104861 (Groene AI). - Se corrige una carrera de dato detectada por
ThreadSanitizeren el constructor de copia deContextData:table_function_resultsse copiaba desde el objeto fuente sin adquirirtable_function_results_mutex, por lo que un escritor concurrente deContext::executeTableFunctionpodía entrar en carrera con la lectura no sincronizada en el constructor de copia. #104879 (Groene AI). - Se corrigen las comprobaciones de consistencia de data part para tipos con estructura dinámica y se detectan
columns_substreams.txtcorruptos. Reenvío de https://github.com/ClickHouse/ClickHouse/pull/103858 con cambios adicionales. #104888 (Pavel Kruglov). - Corrige una condición de carrera entre DROP y UNDROP en DatabaseCatalog. #104915 (Azat Khuzhin).
- Corrige el redimensionamiento dinámico de la caché del sistema de archivos con segmentos descargados parcialmente, incluida la restauración de la contabilidad tras una expulsión fallida. #104921 (Antonio Andelic).
DETACH TABLEsobre una tabla temporal (sin la palabra claveTEMPORARY) ahora genera correctamenteSYNTAX_ERROR, en línea con el comportamiento deDETACH TEMPORARY TABLE. Antes, establecía silenciosamente una marca internais_detachedy devolvía el control sin error. Para eliminar una tabla temporal, useDROP TEMPORARY TABLEoDROP TABLE(este último resuelve la tabla temporal medianteContext::ResolveExternal). Cierra #103475. #104943 (Groene AI).- Hace que la table function
filesystemrespetemax_memory_usage/max_server_memory_usageal cargar el contenido de los archivos. Antes, las lecturas paralelas de contenido, si eran grandes o numerosas, podían superar el límite sin generarMEMORY_LIMIT_EXCEEDEDy terminar siendo finalizadas por OOM. #104956 (Alexey Milovidov). - Se corrigió un
LOGICAL_ERRORgenerado al filtrarsystem.detached_tablesporuuid(por ejemplo,SELECT count() FROM system.detached_tables WHERE uuid = '...'). La consulta ahora devuelve el resultado esperado en lugar de abortar el servidor. #104979 (Groene AI). flattenTupleya no genera unLOGICAL_ERRORcuando se invoca sobre una tupla cuya estructura anidada contiene solo hojasTuple()vacías (por ejemplo,Tuple(c0 Array(Tuple()))oTuple(c0 Tuple())). Estas entradas ahora producen una excepciónILLEGAL_TYPE_OF_ARGUMENTorientada al usuario, que explica que el resultado del aplanado sería una tupla vacía. #104989 (Groene AI).- Corrige un aborto del servidor y un error silencioso de resultados incorrectos al consultar
loop(remote(...))(o cualquierloop()que envuelva un almacenamiento que pueda diferir la agregación) conGROUP BY. Antes, el planner externo añadíaMergingAggregatedStepbasándose en la etapa de procesamiento informada por el almacenamiento interno, peroLoopSourcesiempre materializa suselectinterno conQueryProcessingStage::Completey emite fragmentos de columnas simples, por lo queMergingAggregatedTransformprovocaba unLOGICAL_ERROR(Chunk info was not set for chunk in MergingAggregatedTransform) conenable_parallel_replicas = 1y, en caso contrario, descartaba silenciosamente la agregación externa. #105001 (Groene AI). clickhouse-benchmark --reconnect(solo, sin valor) dejó de funcionar inadvertidamente en 25.4 debido a un cambio que convirtió--reconnecten una opción entera, exigiendo un valor. La forma sin valor vuelve a funcionar y equivale a--reconnect=1(reconectar en cada consulta). #105006 (Groene AI).- Se corrigió una salida JSON malformada para nombres de columnas terminados en secuencias UTF-8 incompletas. #105012 (Pablo Marcos).
- Corrige la pérdida silenciosa de datos tras
EXCHANGE TABLESoCREATE OR REPLACE TABLEen la tabla de origen de una vista materializada. La arista de dependencia entre laMVy su vista de origen ahora se conserva en el nombre original para que siga activándose en los inserts. La regresión fue introducida por #98779; restaura el comportamiento anterior a la regresión. #105029 (Sema Checherinda). - Se corrige
CANNOT_COMPILE_CODE Could not find symbol __fixunsdftial compilar con JIT expresiones que convierten unFloataUInt128, comotoUInt128(<Float64 expression>). Faltaban en el resolvedor de símbolos del JIT las builtins sin signo de compiler-rt para conversión de float a entero de 128 bits. Cierra #105031. #105048 (Raúl Marín). - Se corrige que
clickhouse-localno imprimiera mensajes de registro de una consulta fallida cuandosend_logs_levelestá configurado. #105067 (Alexey Milovidov). - Se corrigen resultados incorrectos cuando se hace referencia a la misma vista parametrizada más de una vez en la misma consulta con distintos valor del argumento. Antes, el analizador agrupaba las llamadas en una sola, descartando silenciosamente todos los filtros salvo el primero. #105170 (Alexey Milovidov).
- Se corrige que la fila
TOTALSse mostrara dos veces en la parte inferior de la tabla de resultados en la interfaz webplay.html. #103803 (Alexey Milovidov). - Se rechazan vectores no finitos (
NaN,±Inf) durante la búsqueda vectorial (ya sea como vectores de búsqueda o como vectores de referencia); antes provocaban un comportamiento indefinido enusearch. #104079 (Groene AI). - PromQL: se corrige el operador de agregación para vectores vacíos. #104425 (Vitaly Baranov).
- PromQL: se corrige el manejo de errores en la API de consulta de Prometheus. #104741 (Vitaly Baranov).
- Se corrige una condición de carrera en
MergeTreeTransaction::afterCommiten la que, tras una pérdida de connection entre la escritura delCSNde commit en ZooKeeper y la finalización de la transacción, la respuestaCOMMITpodía llegar al client antes de que el nuevocreation_csn/removal_csnse hiciera visible ensystem.parts. #104708 (Tuan Pham Anh). - Se corrige el crecimiento exponencial del uso de memoria en el parser de KQL al convertir la indexación de arrays anidados (
arr[arr[arr[...]]]). #105142 (Alexey Milovidov). - Se corrigen resultados incorrectos para
RIGHT ANY JOINcuando la tabla de la derecha tiene varias filas por clave y el block de salida se divide debido a límites de tamaño. Cierra #99431. #102064 (Vladimir Cherkasov). - Se comprueba si hay desbordamiento de pila en el lector de
Avrodurante la deserialización de tipos anidados. #102417 (Pavel Kruglov). - Se corrigen filas duplicadas en
system.completionspara la configuración deMergeTree: cada nombre de configuración aparecía dos veces porque tantogetMergeTreeSettingscomogetReplicatedMergeTreeSettingsse volcaban pese a tener nombres de configuración idénticos. Cierra #102013. #102015 (Groene AI). - Se corrige que
StorageObjectStorageQueue(S3Queue,AzureQueue) bloqueara el apagado hasta completar la lectura desde el almacenamiento de objetos de archivos procesados parcialmente. Ahora la fuente aborta la lectura inmediatamente al apagarse; la deduplicación garantiza que las filas ya transmitidas a la tabla de destino antes del apagado no se dupliquen cuando se vuelva a intentar procesar el archivo en el siguiente inicio. #103126 (Tuan Pham Anh). - Se corrigen las inserciones de varios bloques en el table engine
Aliasconinsert_deduplication_tokenpara que se conserven todos los bloques. #103246 (Enric Calabuig). - Se corrigen
JSONHasyJSONExtractBoolen columnasJSONnativas, que devolvían el valor extraído (convertido aUInt8) en lugar de0/1. #103313 (zxuhan7). - Se protege el formato de entrada
CustomSeparatedfrente a datos malformados o maliciosos que omitenformat_custom_row_after_delimiter. La detección de encabezados, la inferencia de esquemas y las filas con un número variable de columnas acumulaban antes campos sin límite y podían asignar muchos gigabytes de memoria antes de fallar. Ahora la lectura falla conINCORRECT_DATAen cuanto una sola fila contiene más de 1.000.000 de campos. #103404 (Groene AI). - Se corrige
RESTOREde tablasMergeTreereplicadas para que la asociación de partes restauradas usebackup_restore_keeper_max_retriesen lugar del presupuesto habitual de reintentos de inserción de Keeper. #104610 (Pablo Marcos). - Se corrigen resultados incorrectos de
WHERE p AND <LowCardinality(Nullable(int)) constant>en tablasMergeTree. Antes, esas consultas devolvían cero filas porque la poda de partes derivaba un valorNULLpredeterminado del tipoLowCardinality(Nullable(...))y generaba una condición de guardanotEquals(x, NULL), descartando todas las partes. #104767 (Groene AI). - Se corrige un resultado de agregación incorrecto al agrupar por una función no inyectiva de una columna que también es la clave de partición (por ejemplo,
PARTITION BY aconGROUP BY intDiv(a, 2)oa % 2). Los valores de distintas particiones que se asignaban al mismo grupo no se fusionaban, lo que producía filas de grupo duplicadas conallow_aggregate_partitions_independently = 1. #104869 (Nihal Z. Miaji). - Se corrige una condición de carrera en la transferencia de instantáneas de
Keeperpor la que una instantánea podía eliminarse o moverse mientras se enviaba a un follower en recuperación. #104941 (Antonio Andelic). - Se corrige un error silencioso de resultados incorrectos en
hilbertEncodeymortonEncode, por el que un primer argumentoTupleno constante (máscara de rango) usaba los valores de la fila 0 para determinar el desplazamiento de bits de todas las filas. Ahora las funciones calculan los valores de la máscara para cada fila, por lo que el resultado ya no depende de que la entrada sea constante ni del tamaño del bloque. #104992 (Groene AI). - Se corrige que
clickhouse-localignorara silenciosamente la configuración a nivel de usuario (profiles,users,quotas, ajustes de control de acceso) cuando el archivo de configuración se detectaba automáticamente en./clickhouse-local.xml,~/.clickhouse-local/config.xmlo/etc/clickhouse-local/config.xml. Antes, estos ajustes se aplicaban solo cuando se pasaba--config-fileo existía./config.xmlen el directorio actual; ahora todas las rutas de detección se comportan de forma coherente. #105008 (Groene AI). - Se corrigen las columnas
BFloat16que devolvían silenciosamente cero coincidencias al compararlas con un literal de cadena (p. ej.,WHERE bf16_col = '49.9'). #105042 (Raúl Marín). - Se corrige el manejo de
CLEAR COLUMNy TTL durante los merges enSummingMergeTree,AggregatingMergeTreeyCoalescingMergeTreecuando faltan columnas necesarias para el merge o han expirado. Cierra #101953. #105203 (Antonio Andelic). - Se corrige una condición de carrera entre
DNSCacheUpdater::runyContext::reloadClusterConfigañadiendo una comprobación explícita de null parashared->clusters_configantes de desreferenciarlo. #105220 (Mikhail f. Shiryaev). - Se corrige el parsing
best_effortde fecha y hora paratoDateTime64con precisiónmsyns. #105233 (Kaviraj Kanagaraj). - Se corrige que
OSIOWaitMicrosecondsinformara la espera de E/S durante el ciclo de vida del hilo en lugar de la espera de E/S por consulta. #105246 (Mikhail f. Shiryaev). - El table engine
Hudiahora generaINCORRECT_DATA(una excepción normal a nivel de consulta) en lugar deLOGICAL_ERRORcuando un archivo Parquet del directorio de la tabla no sigue la convención de nombres de Hudi[FileId]_[FileWriteToken]_[Timestamp].[extension]. Anteriormente, esos nombres de archivo provocaban una excepción en las builds de depuración. #105266 (Groene AI). - Se corrige un interbloqueo en
ParallelFormattingOutputFormatante un fallo de planificación: cuandoscheduleFormatterThreadForUnitWithNumberlanza una excepción (p. ej.,CANNOT_SCHEDULE_TASK), la unidad quedaba enREADY_TO_FORMATsin ningún hilo formatter para procesarla, lo que provocaba un bloqueo. La llamada de planificación ahora se encapsula entry/catchy cualquier fallo se canaliza a través deonBackgroundExceptionpara que el collector finalice correctamente. #105275 (Azat Khuzhin). - Se corrige una pérdida silenciosa de datos en
Distributedasync inserts al recuperarse de un apagado anómalo: si el último archivo.binde un batch guardado estaba intacto pero uno intermedio estaba corrupto,DistributedAsyncInsertBatch::recoverBatchsolo validaba el header del último archivo y luegosendBatchmarcaba todo el batch —incluidos los archivos intactos— como dañado, perdiendo sus filas. Ahora se valida individualmente el header de cada archivo, de modo que solo el archivo realmente dañado se mueve abroken/y las filas que sobreviven llegan al segmento remoto. #105281 (Groene AI). - Se corrige una regresión en
clickhouse extract-from-config --try: cuando la configuración usaba attributesfrom_envy no tenía ningún elementoinclude_from(o tenía uno que apuntaba a un archivo inexistente), todas las substitutionsfrom_envse descartaban silenciosamente y devolvían cadenas vacías. Esto rompía la detección de puertos del entrypoint de Docker en la versión 26.2.5. Cierra #101704. #105283 (Groene AI). - Se corrige que
INSERT INTOen una tablaSQLitefallara con un error de sintaxis de SQLite cuando el valor insertado es unEnum,JSONoAggregateFunctioncuya representación textual contiene una comilla simple. El ajusteoutput_format_values_escape_quote_with_quoteahora se respeta en las serializations correspondientes (anteriormente, soloStringyFixedStringlo respetaban). #105285 (Groene AI). - Se corrige
Code: 44. ILLEGAL_COLUMN: Cannot add column ...: column with this name already exists, lanzado por consultas distribuidas conallow_push_predicate_ast_for_distributed_subqueries = 1(valor predeterminado) cuando una tuplaGLOBAL INse compara con una subconsulta cuya proyección contiene nombres de columna duplicados; por ejemplo,(x, y) GLOBAL IN (SELECT number, number FROM numbers(5)). #105290 (Groene AI). - Se corrige el caso en que
reinterpretaArray(LowCardinality(...))devolvía un errorNOT_IMPLEMENTEDconfuso en tiempo de ejecución; ahora devuelveILLEGAL_TYPE_OF_ARGUMENTdurante la verificación de tipos. #105301 (Raúl Marín). minMap/maxMap(forma de array) yminMappedArrays/maxMappedArraysahora tratanNaNde forma coherente conORDER BY:NaNse trata como el último valor (solo se devuelve cuando todos los valores sonNaN). Antes, los resultados dependían de la posición deNaNen los datos debido a la semántica de comparación no ordenada de IEEE 754, y no coincidían con la forma con argumentoMapdeminMap/maxMap, corregida en #100448. #105331 (Raúl Marín).- Se corrige una fuga de memoria en la caché
ColumnsDescriptionpor tabla para tablas de la familiaMergeTreecon columnasNested. Las entradas nunca se desalojaban durante ciclos deALTER ADD COLUMN/DROP COLUMNcuandoshare_nested_offsets = 1(valor predeterminado). #105376 (Groene AI). - Se corrige la excepción
BAD_ARGUMENTS“It’s a bug! Only integer types are supported by__bitWrapperFunc”, lanzada cuando unSELECTcon un skip indexTYPE set(N)tiene un átomoWHEREcuyo tipo de resultado esFloat,BFloat16o cualquier otro tipo no entero (por ejemplo,WHERE c0 + 0.1oWHERE log(c0)). En ese caso, el skip index ahora vuelve a la ruta de filtro normal. #105384 (Groene AI).
Mejora en compilación/pruebas/empaquetado
- Dejar de usar las bibliotecas y encabezados
compiler-rtdel sistema. Cierra #91475. #102857 (Konstantin Bogdanov). - Actualizar la image base distroless de Docker para corregir CVE de OpenSSL en
libssl3t64. #103583 (Rahul Nair). - Recibir de forma fiable la clave GPG durante las releases encadenando varios servidores de claves de Ubuntu, en lugar de agotar el tiempo de espera en
keyserver.ubuntu.com. #103834 (Mikhail f. Shiryaev). - Eliminar y prohibir las comprobaciones de
CMakeen tiempo de compilación (check_*,try_compile,try_run). El compilador y la cadena de herramientas son fijos, por lo que la detección de funcionalidades en tiempo de configuración es innecesaria y ahora está bloqueada en todo el proyecto; cualquier comportamiento específico de una versión debe condicionarse explícitamente aCMAKE_CXX_COMPILER_VERSION. #103980 (Alexey Milovidov). - Actualizar
libarchivede la versión 3.8.6 a la 3.8.7. #104047 (Robert Schulze). - Actualizar
mongo-c-drivera la versión 2.3.0. #104300 (Raúl Marín). - Actualizar las dependencias de LLVM para 22.x. #104381 (Joshua Carp).
- Hacer que las clases de embedded-client y descriptor PTY se compilen en macOS y FreeBSD usando
posix_openpt/grantpt/unlockptde POSIX portable y eliminando las protecciones#ifexclusivas de Linux. #104436 (Alexey Milovidov). - Actualizar
librdkafkaa la versión 2.14.1. #105222 (János Benjamin Antal).
lanzamiento de ClickHouse 26.4, 2026-04-30. Presentación, Vídeo
Cambio incompatible con versiones anteriores
- El operador
INahora usa una semántica de valores exactos para el tipoBool: solo los valores0y1del conjunto coinciden con valoresBool. Antes, los valores numéricos mayores que255en el conjuntoINse truncaban incorrectamente a true al compararse conBool, por lo queSELECT CAST(1, 'Bool') IN (256)devolvía 1. Ahora devuelve correctamente0. Cierra #92980. #93115 (Ashrith Bandla). - La biblioteca H3 se ha actualizado a la v4, lo que mejora la precisión de los cálculos de longitud, área y otras métricas. Este cambio es incompatible con versiones anteriores porque los nuevos resultados difieren de los anteriores. #100348 (Alexey Milovidov).
- Ya no se permite usar
SELECTcomo identificador sin comillas en un elemento de la lista de expresionesWITH. #101059 (Aruj Bansal). - Este parche cambia cómo la tabla Merge manejará las columnas virtuales. Si la tabla subyacente contiene
_tableo_database, estas columnas se leerán desde el almacenamiento; de lo contrario, se rellenarán después del paso de lectura mediante el paso de expresión. #101742 (Mikhail Artemenko). - El operador
INahora también rechaza conversiones deDecimalcon pérdida dentro de tipos compuestos (Tuple,Array,Map), lo que hace que su comportamiento sea coherente con el de las comparaciones escalares de nivel superior. Antes, las comprobaciones de precisión solo se aplicaban a los valores escalares de nivel superior: por ejemplo,CAST('33.3', 'Decimal64(1)') IN (33.33)devolvía correctamente0, peroCAST(['33.3'], 'Array(Decimal64(1))') IN ([33.33])devolvía incorrectamente1porque la conversión con pérdida se producía dentro de unArray. Ahora ambos casos devuelven correctamente0. #101812 (Nihal Z. Miaji). - Se redujo el valor predeterminado de
http_max_fieldsde 1,000,000 a 1,000 y el dehttp_max_field_name_sizede 128 KB a 4 KB para limitar el uso de memoria previo a la autenticación de las conexiones HTTP. Se añadieron los ajusteshttp_max_request_header_sizeyhttp_headers_read_timeout. Los usuarios que dependan de los límites anteriores más altos pueden restaurarlos mediante ajustes. #103285 (Sema Checherinda).
Nueva funcionalidad
- Se añade el volcado automático a disco a los hash join y parallel hash join, convirtiéndolos en grace hash join cuando se alcanza el límite de memoria. Este comportamiento se controla con
max_bytes_before_external_join. #97813 (János Benjamin Antal). - Se añade soporte para Arrow Flight SQL. #91170 (Yakov Olkhovskiy).
- Agregar compatibilidad con lectura incremental para los motores de tabla
Paimon, con seguimiento del progreso de snapshots respaldado por Keeper, incluidas lecturas delta dirigidas de snapshots mediantepaimon_target_snapshot_id, y ampliar la cobertura de pruebas para la correspondencia de tipos, la poda de particiones y los escenarios de lectura incremental. #93655 (XiaoBinMu). - La función
stemha dejado de ser experimental (anteriormente, era necesario habilitar la configuraciónallow_experimental_nlp_functions). #102399 (Jimmy Aguilar Mena). Ahora puede aplicar fácilmente stemming a todas las palabras/tokens de las columnasString,FixedString,Array([Fixed]String),Nullable,LowCardinalityyConstcon la funciónstem. #99137 (Jimmy Aguilar Mena). - Se implementa el nuevo comportamiento de
max_insert_block_size_rows,max_insert_block_size_bytes,min_insert_block_size_rows,min_insert_block_size_bytesen el squashing con la configuración de compatibilidaduse_strict_insert_block_limits. #94207 (Kirill Kopnev). - Se añade la función
arrayAutocorrelation(arr [, max_lag]), que calcula la autocorrelación normalizada de un arreglo numérico para cada valor de retraso. Admite arreglos de tipo entero, Float y Decimal. #94776 (Wenyu Chen). - Una función SQL
obfuscateQuery. Cierra el issue #98010. #98305 (Xuewei Wang). - Se añadió compatibilidad con los tipos Map y JSON/Object como atributos de diccionario. Ahora los diccionarios pueden almacenar y recuperar tipos complejos, incluidos Map(String, String), Map(String, Array(String)), JSON y Nullable(JSON), tanto en los layouts FLAT como HASHED. #98627 (yanglongwei).
- Se añadieron dos nuevos ajustes de MergeTree —
replicated_fetches_min_part_levelyreplicated_fetches_min_part_level_timeout_seconds— que permiten a las réplicas evitar recuperar partes recién insertadas (sin fusionar) de otras réplicas, lo que reduce la sobrecarga de la replicación durante periodos de ingestión intensiva. #98625 (tanner-bruce). - Añade soporte para índices de omisión de MergeTree en columnas JSON mediante JSONAllPaths con los tipos de índice bloom_filter, tokenbf_v1, ngrambf_v1 y text (invertido), lo que permite omitir gránulos según el conjunto de rutas JSON presentes en cada gránulo. #98886 (Pavel Kruglov).
- La función
printfahora admite cadenas de formato no constantes, lo que permite usar distintos formatos por fila según los valores de las columnas. #98991 (Yash ). - Se añade un nuevo índice de proyección,
commit_order, que reorganiza los datos en orden de inserción. #99004 (Mikhail Artemenko). - Se añade la función
highlight, que envuelve las apariciones de términos de búsqueda en una cadena de texto con etiquetas HTML (por defecto,<em>/</em>). Admite coincidencias ASCII sin distinción entre mayúsculas y minúsculas, la fusión automática de coincidencias superpuestas y etiquetas de apertura y cierre personalizadas. #99131 (Peng). - Implementa cuotas basadas en el hash de la consulta normalizada para proteger los servicios públicos de ClickHouse frente a abusos. 1. Añade compatibilidad con
NORMALIZED_QUERY_HASHcomo tipo de clave de cuota: buckets de cuota separados para cada consulta normalizada única, de modo queCREATE QUOTA q KEYED BY normalized_query_hashrealiza un seguimiento independiente de cada consulta distinta. 2. Añade compatibilidad conQUERIES_PER_NORMALIZED_HASHcomo tipo de recurso de cuota — limita el número máximo de ejecuciones de una misma consulta normalizada dentro de un intervalo, de modo queMAX queries_per_normalized_hash = 100evita que un mismo patrón de consulta se ejecute más de 100 veces. #99586 (Alexey Milovidov). - Ahora, los usuarios pueden escribir consultas con la sintaxis
NATURAL JOIN, que hace coincidir automáticamente todas las columnas con el mismo nombre y evita duplicarlas en el resultado. #99840 (Peter Nguyen). - Se admite
SET TIME ZONE 'tz'como alias deSET session_timezone. #99883 (phulv94). - Se añadió soporte para consultas parametrizadas en la interfaz web (
play.html): se detectan parámetros de consulta como{name:Type}y se muestran campos de entrada para introducir sus valores. #100041 (Alexey Milovidov). - Permite usar la cláusula estándar SQL
VALUEScomo expresión de tabla enFROM, p. ej.SELECT * FROM (VALUES (1, 'a'), (2, 'b')) AS t(id, val). #100143 (Desel72). - Se añaden unidades compatibles con PostgreSQL al operador
EXTRACT:EPOCH,DOW,DOY,ISODOW,ISOYEAR,WEEK,CENTURY,DECADE,MILLENNIUM. También se corrigeEXTRACT(WEEK FROM date), que antes generaba un error. #100274 (Alexey Milovidov). - Se añadió compatibilidad con literales compuestos de intervalos según el estándar SQL con calificadores de rango
TO, p. ej.,INTERVAL '1:30' HOUR TO MINUTE. Internamente, se descomponen en sumas de intervalos. #100453 (Desel72). - Añade métricas asíncronas para la memoria de los búferes TCP de recepción y envío del kernel (
sk_rmem_alloc,sk_wmem_alloc) de los sockets del pool de conexiones HTTP, notificadas como percentiles p50/p75/p90/p95 y totales por grupo de conexiones. #100575 (Sema Checherinda). - Se añadió una web UI para el profiling de jemalloc en ClickHouse Keeper, disponible en
/jemallocen el puerto de control HTTP. #100606 (murphy-4o). - Se implementó el comando
SYSTEM FLUSH OBJECT STORAGE QUEUE db.table PATH 'x'para los modos ordered y unordered. #100709 (Bharat Nallan). - Se añadió la función
JSONAllValues, que devuelve todos los valores de una columnaJSONcomoArray(String), con los valores serializados en representación textual y ordenados por sus nombres de ruta. Se añadió compatibilidad con el índice de texto para la expresiónJSONAllValuesen columnasJSON. Cuando se crea un índice de texto enJSONAllValues(json_column), se utiliza automáticamente para filtrar consultas sobre subcolumnasJSON(p. ej.,json_column.key1 = 'value'). #100730 (Anton Popov). - Añade una nueva opción de configuración,
input_format_column_name_matching_mode, que permite distintos modos de distinguir entre mayúsculas y minúsculas en los formatos de entrada. #99346 (manerone). - Se añade el comando
watchaclickhouse-keeper-client, con compatibilidad conwatchen los comandosget,existsyls. #100834 (Den Kalantaevskii). - Se añadió la solicitud
getChildrenRecursive(ListRecursive) a ClickHouse Keeper y el comandolsraclickhouse-keeper-client. Esto cierra #99916. #100998 (Konstantin Vedernikov). - Añade la nueva función
arrayTranspose, que toma un array bidimensional (matriz) y lo transpone:SELECT arrayTranspose([[1, 2, 3], [4, 5, 6]]). #101214 (Vitaly Baranov). - La configuración
auto_statistics_types mergetreetiene como valor predeterminado'minmax, uniq'— las estadísticas minmax y uniq se crean automáticamente para todas las columnas adecuadas de las tablas nuevas -materialize_statistics_on_inserttiene como valor predeterminado false — las estadísticas ahora se generan durante las fusiones en lugar de en el momento de la inserción, lo que reduce la sobrecarga de inserción. useSET materialize_statistics_on_insert = 1para restaurar el comportamiento anterior. #101275 (Han Fei). - Añade la opción de refresh
prefer_dependency_replicapara las cadenas de dependencias de vistas materializadas, a fin de reducir la pérdida de datos causada por el retraso de replicación entre réplicas. #101591 (Seva Potapov). - Añade la función
hasPhrase(aliasmatchPhrase) para la búsqueda de frases (secuencias continuas de tokens). La búsqueda se realiza por fuerza bruta; es decir, el índice de texto aún no la admite. #101997 (Elmi Ahmadov). - Añade las métricas de histograma
s3_read_request_duration_microsecondsys3_read_request_bytespara observar el tiempo de vida de la conexión de las solicitudes GET de S3 y los bytes consumidos, visibles ensystem.histogram_metricsy en el endpoint de Prometheus. #102058 (Sema Checherinda). - Los valores
DateyDate32ahora se pueden sumar a los valoresTimeyTime64mediante el operador+, lo que da como resultado unDateTimeoDateTime64. Por ejemplo,SELECT toDate('2024-01-15') + toTime('14:30:25')devuelve2024-01-15 14:30:25. El resultado se calcula en la zona horaria de la sesión, y los resultados fuera de rango se tratan según la configuracióndate_time_overflow_behavior. Cierra #95914. #102421 (Nihal Z. Miaji). - El índice de texto ahora es GA y permanece habilitado independientemente del ajuste
compatibility, lo que evita que se deshabilite de forma inesperada durante las restauraciones desde copias de seguridad o al ejecutarse en modo de compatibilidad. #101518 (Nikita Fomichev).
funcionalidad experimental
- Se añadió
ALTER TABLE ... EXECUTE remove_orphan_filespara tablas Iceberg, con el fin de identificar y eliminar archivos no referenciados del almacenamiento de objetos. #99127 (murphy-4o). - Se añadió la opción de configuración
query_plan_optimize_join_order_randomize, que aleatoriza las estadísticas usadas para reordenar joins, lo que resulta útil para pruebas. #100643 (Vladimir Cherkasov). - Se añadió compatibilidad con funciones de IA en ClickHouse, lo que permite a los usuarios llamar a endpoints de OpenAI y Anthropic mediante SQL.
aiGeneratese incluye como la primera función de este tipo. #100831 (George Larionov). - Se añadieron funciones de IA:
aiClassify,aiExtractyaiTranslate, para aprovechar las API de LLM en ClickHouse. #100832 (George Larionov). - Se añadió
system.histogram_metric_log, una nueva tabla del sistema que toma periódicamente instantáneas de todas las métricas de histograma (p. ej., latencias de S3/Azure y duraciones de las etapas de procesamiento de solicitudes de Keeper). Además, la columnavaluedesystem.histogram_metricspasa a serFloat64, ya que es más flexible y compatible con el modelo de datos de Prometheus. #103046 (Miсhael Stetsyuk). Es probable que la estructura de la tabla cambie en futuras versiones.
Mejora del rendimiento
- ClickHouse ahora puede descartar partes de datos completas en las consultas SELECT basándose en estadísticas mín./máx. #94140 (zoomxi).
- Reducir la contención por bloqueos durante las operaciones de solo lectura en tablas ReplicatedMergeTree con mutaciones completadas. #95771 (Eduard Karacharov).
- Se respeta
optimize_read_in_orderal leer proyecciones. Cierra #89453. #95885 (Andrey Zvonov). - Pequeñas mejoras en Hash Join y Concurrent Hash Join. #96663 (Yarik Briukhovetskyi).
- Optimiza la transformación
DISTINCTdeshabilitando la optimización de columnasLowCardinalitycuando los datos de entrada son casi todos distintos. #97113 (Nihal Z. Miaji). - Optimización del rendimiento para las consultas con
LIKEde #97723. Ahora estas consultas pueden usar índices de texto. #98149 (Elmi Ahmadov). - Las funciones matemáticas vectorizadas (
exp,log,sigmoid,tanh) ahora están aceleradas en AArch64 (mediante NEON/SVE) y en FreeBSD/Darwin, donde antes usaban un fallback escalar más lento. #98230 (Raúl Marín). - Las consultas que filtran por columnas de la clave primaria de
MergeTreecon alternancias en expresiones regulares sobre cadenas literales, como^(abc-1|abc-2), ahora pueden usar la poda de la clave primaria cuando las alternativas comparten un prefijo común. #98988 (Yash ). - Se generaliza el filtrado dinámico top-k de
ORDER BY ... LIMITpara admitir los tiposNullable,StringyCOLLATE. #99033 (murphy-4o). - Se aceleró el hash join con claves
Int32yInt64de rango pequeño mediante el uso de una tabla hash de índice directo. #99275 (Hechem Selmi). - Consultas discontinuas más rápidas para columnas
LowCardinalitycon un único diccionario. #99285 (Ivan Babrou). - Se aceleran las funciones
var*Stableystddev*Stablepara columnasFloat64al desvirtualizar el bucle interno. Nota: esto permite optimizaciones del compilador (FMA/registros) que alteran los resultados de coma flotante a nivel de ULP. #99460 (Riyane El Qoqui). - Usar la codificación base58 optimizada de Firedancer para entradas de 32/64 bytes (automática para
base58Encode). Permitir la decodificación base58 optimizada si el resultado de la decodificación es de 32/64 bytes (de forma explícita conbase58Decode('...', 32)o similar). #99461 (Joanna Hulboj). - Se habilitan optimizaciones basadas en secciones del enlazador (
-ffunction-sections,-fdata-sections,--icf=all) para reducir el tamaño del binario y mejorar el aprovechamiento de la caché de instrucciones. #99474 (Alexey Milovidov). - Corrige el escalado negativo en consultas cortas con agregación en máquinas con muchos núcleos. Cuando una consulta lee pocas marcas, el pipeline ya no se expande hasta
max_threadsdespués de la agregación, lo que evita la sobrecarga de streams prácticamente vacíos. #99493 (Alexey Milovidov). - Mejora el rendimiento de las consultas con réplicas paralelas seleccionando adecuadamente el tamaño de la tarea de lectura. #99801 (Nikita Taranov).
- Permitir la precarga al leer un archivo remoto mediante la caché de páginas en espacio de usuario. #99919 (Alexey Milovidov).
- Evitar el cálculo innecesario de la subcolumna
.sizede String al enumerar subcolumnas. #99941 (Pavel Kruglov). - Hacer que la barra de progreso de clickhouse-client sea menos inestable al trabajar desde un hotel con clústeres que tienen un número muy elevado de réplicas. #100145 (Alexey Milovidov).
- Iniciar
MemoryWorkerenclickhouse-localcuando la caché de páginas esté habilitada, para que la caché de páginas de espacio de usuario pueda utilizarse realmente. #100306 (Alexey Milovidov). - Optimiza las consultas aplicando la cláusula
LIMITdentro deUNION ALL. #100364 (Alexey Milovidov). - Se añade compatibilidad con compilación JIT para comparaciones de columnas
StringyFixedStringenORDER BY, lo que mejora entre un 6 y un 17 % el rendimiento de la ordenación en la fase de merge para claves de ordenación con predominio de cadenas. En coautoría con @lgbo-ustc. #100577 (Raúl Marín). - Cuando
read_in_order_use_virtual_rowestá habilitado junto con la nueva configuraciónread_in_order_use_virtual_row_per_block, ahora se emite información sobre los límites de las filas virtuales después de cada bloque leído deMergeTree, lo que permite que el proceso de mezcla vuelva a priorizar las fuentes a mitad del flujo para las partes cuyos datos quedan completamente filtrados porWHERE/PREWHERE/JOIN. Cierra #99945. #100603 (Vladimir Cherkasov). - Conversión más rápida de Float a String para valores enteros grandes al extender la vía rápida de
itoacon redondeo compatible con dragonbox. #100649 (Raúl Marín). - Sustituye
dragonboxporzmijpara lograr una conversión de Float a String entre 1.5x y 3x más rápida. #100650 (Raúl Marín). - Conversión más rápida de
Int128/UInt128a cadena mediante la sustitución de la división por software por la reducción de Barrett y el desenrollado del bucle de conversión. #100671 (Raúl Marín). - Evita generar hilos redundantes en la fusión paralela de
uniqExact. #100686 (Jiebin Sun). - Se añade la fusión paralela por lotes para
uniqExact. #100687 (Jiebin Sun). - Mejor paralelización de consultas con vistas simples (con una tabla
MergeTreesubyacente) ejecutadas con réplicas paralelas. #100815 (Igor Nikonov). - Implementa compatibilidad con réplicas paralelas en vistas simples (incluidas las vistas
UNION ALLcompatibles sobre tablasMergeTree) cuandoparallel_replicas_allow_view_over_mergetree=1. Esto permite paralelizar la consulta externa de la vista en lugar de la interna, lo que aumenta la paralelización de consultas entre nodos. #100958 (Igor Nikonov). - Optimizar la lectura en el orden de la clave primaria para
full_sorting_mergecuando hay filtros conINen el plan de consulta. #101261 (Nikita Taranov). - Optimización de las asignaciones/liberaciones mediante el almacenamiento en caché de la configuración de muestreo, en lugar de recorrer toda la jerarquía del rastreador de memoria. #101267 (Azat Khuzhin).
- Corrige una regresión significativa en el rendimiento de INSERT cuando
deduplicate_insert = 'enable'(predeterminado desde la versión 26.2) al posponer el cálculo del hash de los datos del squashing al sink y usar hashing por lotes de columnas medianteupdateHashWithValueRange, lo que reduce la sobrecarga de ~2.5s a ~0.5s para 5M filas con 22 columnas. #101494 (Sema Checherinda). - Reduce la sobrecarga del perfilado de bloqueos usando
try_lockpara evitar medir el tiempo de las adquisiciones sin contención y eliminar la medición del tiempo de retención. #101502 (Antonio Andelic). - Se sustituyeron las intrínsecas AVX-512 escritas a mano en
arrayDotProductpor bucles autovectorizables independientes de la plataforma, añadiendo compatibilidad con AVX2 y ARM NEON. #101571 (Peng). - Mejora el rendimiento de
INSERT VALUESpara las columnasMap,ArrayyTuplecuando los valores se pasan como cadenas escapadas (p. ej.,'{\'key\':1}'), evitando recurrir innecesariamente al analizador de expresiones SQL. #102119 (Joanna Hulboj). - Se corrigió el uso excesivo de CPU del motor de tabla
RabbitMQ. #102711 (Jaap Elst). - El optimizador del orden de JOIN ahora infiere predicados transitivos de equi-join a partir de las condiciones JOIN existentes. Por ejemplo, dado
A.x = B.x AND B.x = C.x, se reconoce la equivalenciaA.x = C.x, lo que permite al optimizador considerar joins directos entre tablas conectadas de forma transitiva. Esto puede mejorar la calidad del plan en esquemas en estrella y en copo de nieve, donde las tablas de dimensiones se conectan a través de una tabla de hechos compartida. Esta funcionalidad se controla mediante la nueva configuraciónenable_join_transitive_predicates(desactivada de forma predeterminada). #98479 (Alexander Gololobov). - Optimiza
TRUNCATE DATABASE TABLES LIKEal cancelar previamente las operaciones de merge en paralelo. #98597 (Shaohua Wang). - Se añade compatibilidad con la monotonicidad en la multiplicación, lo que permite la poda por clave primaria en expresiones
key * constant. #98983 (Amos Bird). - Los diccionarios de caché ya no adquieren un bloqueo exclusivo en
hasKeys; esto reduce la contención de bloqueos al usar un bloqueo compartido para las lecturas de la caché. #100796 (liuguangliang). - Incorporar en línea la subconsulta VIEW en el árbol de consulta para permitir aplicar más optimizaciones a la VIEW. #100830 (Dmitry Novik).
- Optimizar la carga de la caché al arrancar el servidor. #101500 (Kseniia Sumarokova).
- Implementar la materialización diferida de columnas para ReplacingMergeTree con FINAL cuando el predicado sea lo bastante selectivo. #101647 (Nikolai Kochetov).
- Se reactiva la optimización
optimize_rewrite_array_exists_to_has(desactivada de forma predeterminada desde la versión 23.10). ReescribearrayExists(x -> x = elem, arr)como la mucho más rápidahas(arr, elem)y ahora omite correctamente la reescritura cuando el tipo de elemento del array yelemno son compatibles parahas(p. ej.,DateyString), por lo que las consultas que antes fallaban siguen funcionando. Cierra #71431. #100944 (Alexey Milovidov).
Mejora
- Salida mejorada de EXPLAIN PLAN pretty=1: imprime las columnas de salida de la consulta de nivel superior, muestra las etiquetas/símbolos de la relación de join junto con las filas estimadas del resultado y la localidad, e incluye las columnas de salida de cada paso para los pasos de join/source. Los cambios abarcan la parte de Information Deficit de #98117. #99462 (Kirill Kopnev).
- Añade la configuración de tabla MergeTree
share_nested_offsets(valor predeterminado:true). Cuando se establece enfalse, las columnas Array con nombres con puntos (p. ej.,n.a,n.b) se tratan como columnas independientes, en lugar de compartir archivos de desplazamiento y validar que los arrays tengan el mismo tamaño como parte de la semántica heredada deNested. #98416 (Amos Bird). - Ahora, los usuarios pueden especificar varios métodos de autenticación en el archivo de configuración users.xml/yaml (en SQL, esto siempre fue posible). #91998 (Flip-Liquid).
- Recarga automática de las conexiones entre nodos de Raft que usan TLS. #93455 (Evgeny).
- Se amplía
cast_keep_nullablepara que funcione con tipos Dynamic/JSON. Cuando está habilitado, convertir NULL desde tipos que pueden ser Nullable devolverá NULL; de lo contrario, NULL provocará el errorCANNOT_INSERT_NULL_IN_ORDINARY_COLUMN. #96504 (Seva Potapov). - Se redujo la huella de memoria de las estructuras de datos internas (objetos
ISerialization) gracias a la incorporación de un grupo de objetos. #96563 (Nikita Mikhaylov). - Se añade compatibilidad con los campos
passwordeidentityen la configuración XML de keeper-client. #96800 (Grigorii Sokolik). - Mejora de las escrituras de
Icebergpara Unity Catalog. #98162 (Konstantin Vedernikov). - Añade la opción de configuración
finalize_projection_parts_synchronouslypara permitir la finalización síncrona de las partes de proyección durante INSERT, lo que reduce el pico de uso de memoria en tablas con muchas proyecciones, mientras mantiene por defecto el comportamiento asíncrono existente. #98228 (Amos Bird). - Agregar la columna
projections_duration_msasystem.part_log, que registra la duración en milisegundos de la fusión/reconstrucción de cada proyección. #98292 (Amos Bird). - Mejora en la cancelación de consultas mediante ExpressionTransform y NumbersRangedSource con KILL QUERY y «cancel query» (Ctrl+C) en clickhouse-client. #98908 (Roman Vasin).
- Reemplaza la lista
source_table_enginescodificada de forma fija por una consulta en tiempo de ejecución medianteStorageFactory::getAllStorages(). Esto añade comprobaciones de acceso para algunos motores de tabla que faltaban y cierra #71544. #98984 (pufit). - Añade un ajuste para controlar el comportamiento ante incompatibilidades de tipo en Variant y Dynamic (throw o devolver null). #99085 (Bharat Nallan).
- Mejorar la compatibilidad entre
Icebergy Spark: corregir el manejo inconsistente de rutas causado por el uso combinado de rutas de almacenamiento y rutas de metadata; exigir que las tablasIcebergescriban una ubicación de tabla que sea una URL o una ruta absoluta; añadir un fallback para calcular el tamaño de los archivos enAzure, ya que algunos lectores de ClickHouse no admiten el conteo de bytes tras el recorrido; manejarversion-hint.txtde forma compatible con Spark; introducir abstracciones a nivel de tipos que dificulten mezclar tipos de rutas en el futuro; añadir pruebas paraAzureyLocalque verifiquen la interoperabilidad entre motores sin carga ni descarga intermedias; corregir el uso de position deletes, que antes dependía de heurísticas de inferencia de rutas cuando ese enfoque no es adecuado. #99163 (Daniil Ivanik). #100420 (Daniil Ivanik). - Se corrigió una posible condición de carrera en
IPartitionStrategy::cached_resultintroducida en https://github.com/ClickHouse/ClickHouse/pull/92844. #99400 (Arthur Passos). - Los usuarios ahora pueden escribir tipos de datos Interval de ClickHouse en formato Arrow. #99519 (Peter Nguyen).
- Añade compatibilidad nativa para importar y exportar tipos de datos
UUIDen los formatosArrowyParquet. Los usuarios ahora pueden consultar y transferir directamente datos UUID entre ClickHouse y otras herramientas de datos sin necesidad de realizar conversiones manuales a cadenas ni recurrir a soluciones alternativas. Inferencia lógica automatizada para UUID de nivel superior y compatibilidad con una sugerencia de schema explícita para UUID anidados. #99521 (Ivan). - Admite archivos
7zen el almacenamiento de objetos. Cierra #70968. #99600 (Alexey Milovidov). - Se añaden los ProfileEvents
ObjectStorageListedObjects,ObjectStorageGlobFilteredObjects,ObjectStoragePredicateFilteredObjectsyObjectStorageReadObjectspara la introspección del pipeline de listado y lectura de archivos en almacenamiento de objetos (S3,Azure, etc.). #99778 (Sema Checherinda). - Se corrige el fallo de la función de tabla
mergeque provocaba el errorUNKNOWN_IDENTIFIERal consultar columnas que no están presentes en todas las tablas distribuidas/remotas subyacentes. #99833 (Alexey Milovidov). - Ahora incluimos el tiempo de commit en la métrica del tiempo total de ejecución de las mutaciones para ReplicatedMergeTree. Se había omitido después de #96376. #99936 (alesapin).
- Se añade un write-ahead log para los objetos blob pendientes de eliminación en
MetadataStorageFromDisk, lo que mejora la durabilidad y la coherencia entre los metadatos y el almacenamiento remoto de objetos cuando se eliminan objetos. #100019 (Maksim Kita). - Se deshabilitó la generación de SQL con IA (comando
??) en el client embebido (protocolos SSH y WebSocket) para evitar el acceso a las variables de entorno del servidor. #100290 (Alexey Milovidov). - Se cambia la interfaz del catálogo para las inserciones de Iceberg. Quedan obsoletas las configuraciones
storage_catalog_type,storage_aws_access_key_id, etc. #100334 (Konstantin Vedernikov). - Interpretar las tabulaciones como 4 espacios al pegar en clickhouse-client. Cierra #100405. #100416 (Raúl Marín).
- Evita escanear todo el catálogo remoto del lago de datos para mostrar sugerencias de tablas del tipo “Quizá quiso decir…” cuando
show_data_lake_catalogs_in_system_tablesestá deshabilitado. #100452 (Alsu Giliazova). - Aplicar
distributed_index_analysis_min_indexes_bytes_to_activatetras la poda de particiones. #100477 (Azat Khuzhin). - Se corrige un error de aserción en el pushdown del bloom filter de Parquet al usar cláusulas IN/NOT IN vacías. #100543 (zoomxi).
- Las estadísticas de columna MinMax ahora almacenan los valores mínimo y máximo como Field (tipado) en lugar de Float64. El formato serializado incluye el nombre del tipo de la columna junto con los valores. La versión del archivo de estadísticas se actualiza a V2; los archivos escritos por versiones anteriores requieren volver a materializarse (ALTER TABLE … MATERIALIZE STATISTICS ALL). corrección #53140. #100605 (Han Fei).
- Actualizar
cppkafkapara incluir una corrección del interbloqueo al cerrar el consumidor. #100612 (Azat Khuzhin). - La información del objeto que se utiliza para analizar los archivos de datos en Iceberg ahora incluye el número de filas del archivo y su tamaño en bytes, obtenidos del archivo de manifiesto. #100645 (Daniil Ivanik).
- Se añadió el parámetro de configuración
use_separate_cache_arenapara poder controlar la separación de la arena de memoria de la caché. #100664 (Seva Potapov). - Agrega compatibilidad nativa para importar los tipos de datos
StringViewyBinaryViewde Apache Arrow a columnasStringde ClickHouse, lo que mejora la compatibilidad con la ingestión basada en Arrow. #100762 (Ivan). - Algunos ajustes del servidor Keeper ahora se recargan en caliente si el archivo de configuración cambia en tiempo de ejecución: max_requests_batch_size, max_requests_batch_bytes_size, max_request_size, quorum_reads. #100773 (Michael Kolupaev).
- Se incrementan los eventos de perfil
MemoryAllocatedWithoutCheck/MemoryAllocatedWithoutCheckBytesen la compilación release. #100899 (Pavel Kruglov). - El seguimiento de memoria en Cgroupv2 ahora excluye
slab_reclaimablede la memoria del kernel, lo que ofrece una medición más precisa del uso de memoria no recuperable. #100901 (Antonio Andelic). use_partition_pruning = 0ahora también desactiva la poda del índiceMinMaxy la optimización de conteo en las columnas de la clave de partición, además de desactivar la poda basada en claves de partición. #100904 (Nihal Z. Miaji).pretty=1enEXPLAIN [PLAN]ahora muestra las expresiones en un formato legible. #100927 (Kirill Kopnev).accurateCastOrNullyaccurateCastOrDefaultahora admiten tipos de destinoTuple, incluidosTuplesanidados con elementosNullable. Antes, estas funciones rechazaban destinosTupleporqueTupleno podía estar dentro deNullable. Cierra #100820. #100942 (Nihal Z. Miaji).- Corregir la duplicación de gráficos en la interfaz de Play al cambiar entre los temas claro y oscuro. #101058 (Alexey Milovidov).
- Actualización de chdig a v26.3.1 (interfaz de perfetto, minigráficos en el resumen para CPU/Memoria/Fusiones/Consultas, system.warnings, búsqueda con regexp en los logs). #101092 (Azat Khuzhin). Actualización de chdig a v26.4.3 (mejoras en perfetto, correcciones para compartir mediante pastila.nl, diferencias de flamegraph, cambio de configuración en tiempo real). #103145 (Azat Khuzhin).
- Ahora se permite una coma final en la cláusula
WITHantes de una consultaSELECT. #101093 (Aruj Bansal). - Añade el ajuste de MergeTree
compress_per_column_in_compact_partspara controlar cómo se organizan los bloques comprimidos dentro de las partes Compact. Cuando estrue(valor predeterminado, que conserva el comportamiento actual), cada columna inicia un nuevo bloque comprimido, lo que permite la descompresión selectiva. Cuando esfalse, todas las columnas dentro de un gránulo se empaquetan en el mismo bloque comprimido, lo que mejora la relación de compresión y el rendimiento de lectura en cargas de trabajo que siempre leen todas las columnas. #101114 (Amos Bird). - Mostrar el tooltip de información de la tabla en la UI de Play solo al pasar el cursor sobre el nombre de la tabla, no sobre toda la fila. #101118 (Alexey Milovidov).
- Añade iconos específicos para cada motor y mejora la UX de la lista de tablas en la barra lateral de la UI de Play. #101134 (Alexey Milovidov).
- Compatibilidad con
Nullable(Tuple)en los formatosArrow,ArrowStream,ORCyParquetheredado. #101272 (Nihal Z. Miaji). - Mostrar la fila TOTALS como pie de la tabla en la web UI (play.html). #101286 (Alexey Milovidov).
- Compatibilidad con el modo multiconsulta en la interfaz web (
play.html): ejecución de varias consultas a la vez, con ejecución en paralelo de consultas de tipoSELECTy visualización de resultados por consulta. #101290 (Alexey Milovidov). - Se corrige el redimensionamiento de columnas en la interfaz web
play.htmldespués de refactorizar la tabla de resultados como un componente web. #101295 (Alexey Milovidov). - Se añadió la posibilidad de limitar la cantidad de flushes del perfil de jemalloc en MEMORY_LIMIT_EXCEEDED por intervalo de tiempo. #101396 (Azat Khuzhin).
- Se añadieron las configuraciones de Keeper
nuraft_streaming_mode(valor predeterminado:false),nuraft_max_log_gap_in_stream,nuraft_max_bytes_in_flight_in_stream. Cierra #90743. #101427 (Kseniia Sumarokova). - Se añadió la métrica asíncrona
CGroupMemoryUsedWithoutPageCache, que informa del uso de memoria del cgroup excluyendo tanto la caché de páginas del kernel del sistema operativo como la caché de páginas en espacio de usuario de ClickHouse, en consonancia conMemoryResidentWithoutPageCache. También se aclaró la descripción de la métricaCGroupMemoryUsed. #101513 (Francesco Ciocchetti). - Añade azúcar sintáctico a nivel del analizador sintáctico para la sintaxis de la función
OVERLAYdel estándar SQL. La funciónoverlayya existe; esto añade compatibilidad con la forma basada en palabras clave que usaPLACING,FROMyFORcomo separadores. #101681 (Desel72). - Se añadió el alias de columna
INDEX_LENGTHa la tabla del sistemainformation_schema.tables, en consonancia con los alias existentes en mayúsculas de esta tabla. #101705 (Robert Schulze). - La tabla del sistema
information_schema.tablesahora ignora las partes inactivas de la tabla. Esto hace que los valores de tamaño de la tabla que se muestran sean más realistas. #101706 (Robert Schulze). - La función
ngramsahora rechaza longitudes de ngram no válidas. Ejemplo:SELECT ngrams('abc', 0)ahora devuelve un error. #101922 (Robert Schulze). - Como seguimiento de #91820 y #90837: eliminar del mensaje de error los algoritmos no compatibles; ejecutar pruebas específicas de FIPS en compilaciones FIPS. #102067 (Mikhail f. Shiryaev).
- Limita la altura de las celdas a tres líneas en la Web UI (
play.html), con posibilidad de expandirlas al hacer clic. #102154 (Alexey Milovidov). - Se añadió una nueva opción que permite forzar el estilo (virtual/path) para los endpoints de S3. Resuelve #82019; #76007. Da continuidad a https://github.com/ClickHouse/ClickHouse/pull/83168. #102378 (Konstantin Vedernikov).
- La configuración
restore_replace_external_engines_to_nullahora también omite la restauración de bases de datos con motores externos (p. ej.,DataLakeCatalog,MySQL,PostgreSQL,S3) en lugar de producir un error o iniciar conexiones externas. #102400 (Nikita Fomichev). - Se añade soporte para el análisis de índices de texto de la función
hasPhrasemediante el modoHINT. #102438 (Elmi Ahmadov). - Considerar STATISTICS como solo lectura en ColumnDependency para corregir LOGICAL_ERROR durante MATERIALIZE STATISTICS ALL. #102627 (Konstantin Bogdanov).
- Crear y poblar
system.asynchronous_metric_logen modo keeper-as-server. #102664 (Miсhael Stetsyuk). - Se añade la opción de configuración
default_system_log_flush_policy.skip_alias_columnspara permitir omitir las columnas ALIAS de las tablas de logs del sistema, lo que corrige los logs del sistema respaldados por S3 que rechazan columnas ALIAS. #102669 (Miсhael Stetsyuk). - No habilite las estadísticas automáticas para las tablas del sistema. Rara vez pueden aprovecharlas. #102862 (Han Fei).
- Se admite el tokenizer
arraypara la optimización de LIKE. #102880 (Elmi Ahmadov). - Enviar MemoryAllocatedWithoutCheck incluso en compilaciones de producción. #103064 (Azat Khuzhin).
- Exponer untracked_memory de cada hilo en system.stack_trace. #103065 (Azat Khuzhin).
Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)
- Se corrige el error
Block structure mismatch in streamcausado por columnas innecesarias devueltas por la materialización diferida. Soluciona #95191. #96682 (Nikolai Kochetov). - Corrige un error lógico en una consulta de política de enmascaramiento de datos al usar
ON CLUSTER. #97594 (Bharat Nallan). - Se corrige un error al usar Unity Catalog sobre GCS. #98456 (Melvyn Peignon).
DataLakeCatalogahora respeta la configuraciónhttp_forbid_headersdel servidor al validar la opciónauth_header. #98827 (Michael Anastasakis).- Se corrigen las llamadas N+1 a
HeadObjectpara globs con expansión entre llaves de S3. #99219 (Konstantin Bogdanov). - Validar los cambios de configuración en las consultas CREATE cuando el propio motor también admite parámetros de configuración. #99279 (János Benjamin Antal).
- Se corrigió un fallo por el que
ALTER TABLE UPDATE/DELETEfallaba con el errorMissing columnscuando una tabla tiene una columna MATERIALIZED cuya expresión depende de una columna EPHEMERAL. #99281 (Yash ). - Las credenciales en las cadenas de conexión de JDBC, ODBC y NATS ahora se enmascaran en los registros de consultas y en la salida de
SHOW CREATE, lo que evita la exposición accidental de información confidencial. En las cadenas de conexión con formato URI (p. ej.,{scheme}://{user}:{password}@{host}), solo se enmascara la contraseña, mientras que el resto permanece visible para facilitar la depuración. El ajustenats_tokenahora también se enmascara. #99344 (János Benjamin Antal). - Corrige el análisis incorrecto de palabras que comienzan con prefijos de meses en el formato DD-month-YYYY por parte de parseDateTimeBestEffort. Cierra #99345. #99350 (Pavel Kruglov).
- Se corrigió que se ignorara TABLE_UUID_MISMATCH cuando no se usa el analizador. #99380 (Azat Khuzhin).
- Corrige un error por el que los ajustes explícitos enviados junto con
compatibilityen la misma solicitud podían ignorarse de forma silenciosa cuando su valor coincidía con el valor predeterminado del servidor. #99402 (Raufs Dunamalijevs). - Corrige los casos en los que los números con ceros a la izquierda en la ruta de particionado de Hive producían errores. Corrige #98801. #99458 (Yarik Briukhovetskyi).
- Se corrige
heap-use-after-freecuando se elimina una tabla de forma concurrente mientras hay una consulta de lectura en ejecución (19 casos en CI durante los últimos 90 días). #99483 (Alexey Milovidov). - Se corrigió un error en Keeper por el que una solicitud de lectura podía quedarse bloqueada (haciendo que la sesión expirara) si se cerraba una sesión distinta y no relacionada en el mismo servidor justo en un mal momento. #99484 (Michael Kolupaev).
- Validar la estructura de la columna antes de aplicar parches. #99531 (Seva Potapov).
- Corrige el fallo de aserción de
rows_sourcesen la fusión vertical cuandoSYSTEM STOP/START MERGESse activa y desactiva rápidamente durante la fusión de una tabla con columnasDynamic. #99532 (Alexey Milovidov). - Se corrigió la poda incorrecta de particiones en
toWeek(), que provocaba que las consultas conWHERE toWeek(date, mode) = Ndevolvieran resultados vacíos para las semanas 49-52 en tablas particionadas portoYYYYMM(date). #99542 (Takumi Hara). - Se corrige una excepción en funciones que operan con ColumnReplicated con filas no referenciadas producidas por JOIN. #99564 (Hechem Selmi).
- Corrige un problema por el que
CLEAR COLUMNno reconstruía las proyecciones ni reevaluaba las columnas materializadas que dependen de la columna eliminada, lo que podía provocar excepciones o corrupción de datos durante fusiones posteriores. #99565 (Desel72). - Se corrigió una excepción (
Bad get: has Tuple, actual type String) enConditionSelectivityEstimatorcuando una consulta usa IN con un solo parámetro de consulta escalar (p. ej.,WHERE col IN ({p:String})) en una tabla que tiene estadísticas de columna y conuse_statisticshabilitado. #99614 (Ilya Yatsishin). - La parte con proyecciones desconocidas no debe marcarse como perdida para siempre. #99623 (Sema Checherinda).
- Se corrige una excepción poco frecuente de error lógico durante una fusión vertical cuando
SYSTEM STOP MERGESySYSTEM START MERGESse ejecutan de forma concurrente. #99628 (Desel72). - Se corrige una referencia colgante en injectRequiredColumns que provocaba un fallo durante un merge. #99679 (Tuan Pham Anh).
- Corrige el comportamiento indefinido en el lector del formato Avro al leer valores numéricos que exceden la capacidad del tipo de la columna de destino. Ahora las consultas fallan cuando se producen desbordamientos, en lugar de generar silenciosamente valores incorrectos. #99697 (asyablue22).
- Se corrige el procesamiento de las comillas de estilo shell en los argumentos de la función de tabla
executable. #99794 (Nikita Semenov). - Corrige un aborto por falso positivo en
NativeReaderal deserializar un flujo en formato Native con una discrepancia en el recuento de filas: se cambió deLOGICAL_ERRORaINCORRECT_DATApara que el error se trate como un error de datos en lugar de activarabort()en compilaciones con sanitizador/depuración. #99822 (Rahul Nair). - Corregida la interrupción del proceso en la deserialización de la columna
Tuplecuando el tipo de serialización en el flujo binario esDETACHED. #99823 (Rahul Nair). - Se corrigió la falsa excepción
LOGICAL_ERRORdurante el redimensionamiento dinámico de la caché del sistema de archivos debido a una condición de carrera en la promoción de la subcola de SLRU. #99850 (Alexey Milovidov). - Corregidas las consultas de async insert que mostraban
written_rows,read_rowsyresult_rowsen cero enquery_logy en la salida del client. #99879 (Sema Checherinda). - Corrige la excepción “Bad cast from type X to Y” en
KILL QUERYcuando la consulta interna sobre las tablas del sistema devuelve columnas encapsuladas enColumnConst. #99881 (Alexey Milovidov). - Se corrige un error lógico en una subconsulta correlacionada dentro del argumento untuple. #99917 (Vladimir Cherkasov).
- Corrige una excepción al llamar a
right,rightUTF8u otras funciones de subcadena con una longitud de INT64_MIN (-9223372036854775808), lo que antes provocaba un comportamiento indefinido debido a un desbordamiento de enteros. Ahora las funciones devuelven correctamente el error ARGUMENT_OUT_OF_BOUND. #99934 (Jimmy Aguilar Mena). - Ahora ClickHouse debería manejar correctamente las tablas de estilo Spark (donde tenemos la ruta absoluta completa para cada archivo o una ruta relativa a la ruta común de la tabla). Corrige #92348. #99935 (alesapin).
- Se corrige la excepción “formato AST incoherente” en
ALTER TABLE ... MODIFY QUERYcon subconsultas anidadas que contienenSETTINGScuando el propioALTERtambién incluyeSETTINGS. #99938 (Nikita Mikhaylov). - Se revierte #97114 “Mover la estimación de filas en el paso de join antes de la comprobación de que haya 1 hijo” debido a una posible regresión del rendimiento. #99957 (Alexander Gololobov).
- Corrige un error por el que ClickHouse podía omitir archivos si faltaba el encabezado
Content-Lengthen la respuesta a la solicitud HEAD correspondiente (por ejemplo, debido a la transcodificación descompresiva en GCS). #99971 (Yarik Briukhovetskyi). - Corrige un fallo de aserción (excepción en builds de depuración, resultados incorrectos en builds de lanzamiento) al multiplicar estados de agregación de
NumericIndexedVectorpor una constante entera par, provocado por un XOR consigo mismos en bitmaps Roaring con alias enpointwiseAddInplace. #99976 (Desel72). - Evitar la excepción
Unexpected return typeen el pushdown heredado de filtros a través deJOIN USINGencadenados cuando los tipos de las claves cambian después de las conversiones de JOIN. #99999 (Alexey Milovidov). - Corrige la excepción
LOGICAL_ERROR“Tipo de nodo inesperado para la expresión de tabla … se obtuvo IDENTIFIER” cuando se usa una subconsulta escalar dentro de un argumento sin resolver de una función de tabla, p. ej.,SELECT * FROM remote('localhost', view(SELECT 2 AS x), concat(x, (SELECT 1))). #100014 (Alexey Milovidov). - Se corrigió un fallo de
INSERTconVALUEScuando los datos iban seguidos de un comentario SQL al final (--o/* */) en la línea siguiente. Ahora se omite el comentario en lugar de interpretarlo como otra fila. #100016 (Pratima Patel). - Se corrige una excepción en
arrayRemoveal comparar Tuples con componentes NULL. #100017 (Alexey Milovidov). - Se corrige una filtración de datos entre usuarios en
system.asynchronous_inserts: cualquier usuario conSELECTsobre la tabla podía ver entradas pendientes de inserción asíncrona de otros usuarios. Ahora las entradas se filtran según el usuario actual, salvo que el usuario tenga el privilegioSHOW_USERS. #100024 (Shaohua Wang). - Corrige un caso en el que la conversión de Time64 a UInt64 podía restringir los valores a 24 horas. #100025 (Yarik Briukhovetskyi).
- Se corrigió un bloqueo del servidor local cuando CREATE DICTIONARY tiene una definición con un valor de lista que contiene una función inexistente. #100036 (Yakov Olkhovskiy).
- Se corrige un problema que impedía que los formatos
CSVyMsgPackanalizaran correctamenteNullable(Tuple). Cierra #99753. #100038 (Nihal Z. Miaji). - Se corrige el error de
CREATE VIEWconUNKNOWN_IDENTIFIERal usar como lado derecho deINun alias de expresión de función enWITH(por ejemplo,tuple(...)). #100042 (Peng). - Se corrigieron las funciones de agregación de series temporales (p. ej.,
timeSeriesResampleToGridWithStaleness) que fallaban conILLEGAL_TYPE_OF_ARGUMENTcuando se usaban coninitializeAggregationoAggregatingMergeTreeen réplicas paralelas. #100053 (Alexey Milovidov). - Se corrigió el procesamiento de valores negativos en NumericIndexedVectorDataBSI. #100086 (Daniil Ivanik).
- Se corrigieron las funciones
accurateCastOrDefaultyto*OrDefault, que no preservaban el tipo de columna Const para entradas constantes. #100132 (Alexey Milovidov). - Los parámetros de consulta omitidos de tipo
LowCardinality(Nullable(T))ahora toman correctamente NULL como valor predeterminado, igual queNullable(T). #100144 (Denys Melnyk). - Se corrige el uso de un valor sin inicializar en StringSearcher.h. #100225 (Konstantin Bogdanov).
- Permite cancelar subconsultas escalares y otras canalizaciones durante el análisis mediante Ctrl+C. Anteriormente, al pulsar Ctrl+C durante una subconsulta escalar de larga duración no ocurría nada hasta que la subconsulta terminaba. También corrige la barra de progreso y las estadísticas JSON para que informen correctamente de las filas leídas durante la ejecución de subconsultas escalares, tanto en
clickhouse-clientcomo enclickhouse-local. En coautoría con @YjyJeff. #100230 (Raúl Marín). - Se corrigió una excepción
LOGICAL_ERRORen consultas que involucran columnasDynamiccon uniones cruzadas y filtros en tiempo de ejecución, causada porColumnVariant::filter, que compartía punteros a columnas Variant en lugar de clonarlos en la ruta de optimizaciónhasOnlyNulls. Cierra https://github.com/ClickHouse/ClickHouse/pull/100147. #100234 (Pavel Kruglov). - Se corrigió un error en
ArraydeVariantque podía reinterpretar el tipo de dato al llamar a la funciónarrayFirst/arrayLast. Por ejemplo, antesArray(Variant(Date, Bool))se convertía enBoolcuando el tipo de variante subyacente real eraDate. #100255 (timothygk). - Algunos cambios menores en las funciones: las funciones h3 ahora validan mejor los límites; readWKB comprueba los límites de tamaño (una nueva configuración,
max_wkb_geometry_elements); las funciones del generador aleatorio limitan el número máximo de iteraciones en sus cálculos. Como seguimiento de #93543. #100270 (Alexey Milovidov). - Se corrigió un problema por el que cutURLParameter podía omitir parámetros por error cuando aparecían como subcadenas de otros parámetros. #100280 (Nikita Semenov).
- Se corrige una excepción cuando la configuración de la ruta del archivo de metadata de Iceberg contiene un byte nulo. #100283 (Alexey Milovidov).
- Se corrigió el crecimiento cuadrático del número de consultas ejecutadas cuando se usa
distributed_index_analysiscon predicados que contienen subconsultasIN. #100287 (Anton Popov). - Corrige la excepción “Block structure mismatch” al usar
GROUP BY ... WITH TOTALS HAVINGen combinación conUNION DISTINCTy expresiones Nullable. #100293 (Alexey Milovidov). - Se corrige la excepción LOGICAL_ERROR en
estimateCompressionRatiocuando el parámetroblock_size_byteses extremadamente grande. #100298 (Alexey Milovidov). - Se corrige la excepción “Inconsistent AST formatting” en compilaciones de depuración al usar
GROUP BY CUBE(...) WITH ROLLUPo combinaciones similares. #100376 (Alexey Milovidov). - Se corrigió una excepción al crear una vista con alias de columnas y consultas
SELECT *oEXCEPT/INTERSECT. #100386 (Alexey Milovidov). - Soluciona que
DROP TABLEse quede bloqueado indefinidamente en tablas con motor Kafka cuando los consumidores se quedan atascados en un rebalance tras un error de heartbeat. #100388 (Alexey Milovidov). - Se corrige la excepción
ReadBuffer is canceled. Can't read from it.en las operaciones de copia de seguridad y restauración que usan archivos ZIP. #100400 (Alexey Milovidov). - Se corrige la excepción
TOO_MANY_ROWSen consultasSELECT count()conmax_rows_to_read/force_primary_keycuando los datos están repartidos en varias partes con límites de gránulo no alineados. #100408 (Alexey Milovidov). - Se corrige
system.completionspara filtrar correctamente bases de datos, tablas y columnas según los derechos de acceso en todas las combinaciones de permisos: por tabla, por base de datos y con revocación por columna. #100432 (Shaohua Wang). - Se corrige un SEGFAULT en NuRaft debido a una condición de carrera. #100444 (Pablo Marcos).
min/max/argMin/argMaxahora tratan los NaN de forma coherente conORDER BY: los NaN siempre se omiten (solo se devuelven cuando todos los valores son NaN). Antes, los resultados dependían de la posición de los NaN en los datos debido a la semántica de comparación no ordenada de IEEE 754. #100448 (Raúl Marín).- Se corrigió un error de copiar y pegar por el que
delta_lake_snapshot_end_version, cuando se establecía sindelta_lake_snapshot_start_version, se ignoraba silenciosamente en lugar de generar un errorBAD_ARGUMENTS. #100454 (Mohammad Lareb Zafar). StorageRabbitMQ::shutdownno es idempotente (accede incondicionalmente a punteros débiles y luego destruye los punteros compartidos correspondientes), pero ahora se invoca dos veces: una vez enStreamingStorageRegistryy después enDatabaseCatalog. Esta corrección hace que el método sea idempotente y añade comprobaciones defensivas de valores nulos. #100455 (Miсhael Stetsyuk).- Se corrigió la excepción
LOGICAL_ERRORal usaraccurateCastOrNullcon el tipo de destinoQBit. #100470 (Raufs Dunamalijevs). - Se corrigió la excepción LOGICAL_ERROR “Stream … not found” al insertar en una tabla con columnas
Array(JSON)anidadas en partes wide conoptimize_on_insert=0. #100475 (Pavel Kruglov). - Validar las rutas de las entradas de archivo en los metadatos de la copia de seguridad para rechazar secuencias de path traversal, rutas absolutas y nombres vacíos durante
RESTORE. #100483 (Pablo Marcos). - Se corrige un problema por el que la sintaxis
LIMIT m OFFSET n WITH TIESno funcionaba. Esta sintaxis es equivalente aLIMIT n, m WITH TIES, que ya funcionaba. #100491 (Nihal Z. Miaji). - Se corrige la excepción “No set is registered for key” al usar
INcon columnasNullable(Tuple)que tienen campos con nombre y elementosLowCardinality. #100523 (Alexey Milovidov). - Se corrige un desbordamiento de búfer en el montón en usearch
sorted_buffer_gt::insert()que podía provocar un cierre inesperado o corromper silenciosamente la memoria durante la búsqueda por similitud vectorial. #100537 (Dustin Healy). - Se corrigió un problema por el que
EXECUTE ASignoraba las cláusulasFORMATeINTO OUTFILEespecificadas en la consulta. #100538 (pufit). - Corrige la inconsistencia en el formato del AST para SAMPLE con OFFSET a nivel de consulta. Cierra #100576. #100579 (Pavel Kruglov).
- Corrige el catálogo Polaris en Azure. Desde la versión 25.12, este catálogo en Azure empezó a añadir el bucket al principio de la ruta. Por ejemplo,
abfss://polaris-polaris@<some_url>.windows.net/polaris-polaris/<other-path>en lugar deabfss://polaris-polaris@<some_url>.windows.net/<other-path>. Este PR elimina el bucket de la ruta. #100583 (Konstantin Vedernikov). - Corrige la excepción por incompatibilidad de tipos en transform cuando la columna por defecto es const en algunos bloques. Cierra #100574. #100616 (Pavel Kruglov).
- Corrige los casos de NOT_FOUND_COLUMN_IN_BLOCK en los que la parte SELECT de la proyección contiene columnas que no existen en la parte SELECT original de la consulta. Cierra #100194. #100623 (Yarik Briukhovetskyi).
- Validar las dimensiones de la forma del formato Npy frente al tamaño del archivo y los límites de desbordamiento para evitar ataques de denegación de servicio mediante archivos
.npyespecialmente diseñados con dimensiones desmesuradamente grandes. También se rechazan las formas vacías y se limita la memoria por fila a 2 GiB. #100625 (Raúl Marín). - Se corrige un problema por el que se ignoraba
session_timezoneal analizar valoresDateTimedurante las inserciones asíncronas (TCP) y todas las inserciones a través de HTTP. #100647 (Sema Checherinda). - Permitir pasar la clave de segmentación a las funciones de tabla
cluster()yclusterAllReplicas()al usar una función de tabla como fuente (p. ej.,cluster('name', view(...), sharding_key)). #100665 (Sergey Veletskiy). - Se corrige un cierre inesperado del servidor (fallo de aserción) al usar funciones de agregación paramétricas con el combinador Array y argumentos NULL, como
quantileIfArrayArray(0.5)([[NULL]], [[1]]). #100679 (nerve-bot). - Corrige la excepción al calcular el supertipo común para tuplas vacías y no vacías con
use_variant_as_common_typeactivado. #100699 (Antonio Andelic). - El servidor ya no deja de iniciarse cuando se configura un disco de Azure blob storage, pero el endpoint no está accesible temporalmente (p. ej., por un fallo de DNS). #100701 (Raúl Marín).
- Se corrigió el comportamiento indefinido en
positiveModulocuando el divisor sin signo no cabe en el tipo de resultado con signo. #100705 (Raúl Marín). - Se corrige el cierre inesperado del servidor (error lógico “tipo de retorno inesperado de __topKFilter”) cuando
use_top_k_dynamic_filteringestá habilitado y la columna deORDER BYes de tipoDynamicoVariant. #100742 (Groene AI). - Corrige un fallo del servidor al usar la función
has()con PREWHERE/WHERE en una clave Tuple que contiene elementos LowCardinality. #100760 (Groene AI). - Se corrige el error de aserción
file_offset_of_buffer_end <= getFileSize()(excepción en compilaciones de depuración) al leer tablasLogoStripeLogen almacenamiento de objetos S3 con escrituras concurrentes. #100763 (Alexey Milovidov). - Corrige una excepción en el estimador de selectividad de estadísticas cuando una cláusula WHERE incluye una expresión de función (p. ej., toDecimal64(col, 3)) en una tabla con estadísticas activadas. Ahora, el estimador omite esos predicados en lugar de intentar una conversión de tipos no válida. #100764 (Han Fei).
- Corrige un caso poco frecuente en el que un join con reordenación puede dar un resultado incorrecto. #100790 (Yarik Briukhovetskyi).
- Corrige los tipos incorrectos de los argumentos de
AggregateFunctionen el conteo trivial optimizado, lo que provocaba la excepciónNUMBER_OF_ARGUMENTS_DOESNT_MATCHal consultar expresiones comocount(v0 + v1)en tablas distribuidas. #100794 (YjyJeff). - Algunos catálogos pueden mostrar secretos en la sección
SETTINGSdel resultado de la consultaselect * from system.databases. Este PR evita ese comportamiento. #100800 (Konstantin Vedernikov). - Corrige el comportamiento indefinido (desbordamiento de enteros con signo) en
toStartOfIntervalal usar intervalos de Week, Quarter o Year con el argumentooriginy valores extremos del intervalo. #100817 (Raúl Marín). - Se corrigen los combinadores de funciones de agregación
If,Distinct,DistinctIf,IfStatecon tipo de retornoTupley uno o más argumentosNullable, que no podían leer estados serializados antiguos tras la introducción deNullable(Tuple). Cierra #98917. #100826 (Nihal Z. Miaji). - Se corrige un segfault en s3Cluster y en las consultas distribuidas debido a un use-after-free en el pool de conexiones. #100837 (Konstantin Bogdanov).
- Se corrige un segfault por desreferenciación de puntero nulo al cargar diccionarios durante el apagado del servidor.
Context::getUserDefinedSQLObjectsStorage(desreferenciauser_defined_sql_objects_storage) es invocado por los hilos de diccionario de forma concurrente mientras el hilo principal llama aContext::shutdown(estableceuser_defined_sql_objects_storageen null). Debemos asegurarnos de deshabilitar futuras actualizaciones en el cargador de diccionarios, terminar las consultas de diccionario que se estén ejecutando en ese momento y esperar a que finalicen los hilos de carga de diccionarios, todo ello antes de ejecutarContext::shutdown. De forma similar a lo que hacemos con las consultas normales. #100839 (Miсhael Stetsyuk). - Se corrigió el desbordamiento de búfer en
ULIDStringToDateTimecuando la entrada contiene bytes no ASCII. #100843 (Konstantin Bogdanov). - Corregido un cierre inesperado (
LOGICAL_ERROR) al consultar una tablaMerge(o la table functionmerge()) que engloba varias tablas, incluida una tablaDistributed, condistributed_group_by_no_merge=1activado. #100859 (Groene AI). - Cast_keep_nullable, cuando está habilitado, no lanzará una excepción al convertir un NULL de Dynamic a Variant. #100864 (Seva Potapov).
- Se corrige un problema por el que los comandos
clickhouse-keeper-clientget,existsylsimprimían mensajes de error duplicados dewatch_iden stdout en lugar de stderr. #100893 (Mohammad Lareb Zafar). - Corrige una excepción en
intDiv/intDivOrZeroen arrays de tuplas Nullable, p. ej.,SELECT intDiv([divide((1, 2), ... AND NULL)], 2). #100895 (Raúl Marín). - Evaluar los argumentos del motor de
StorageAliasantes de almacenar la definición, para que expresiones comocurrentDatabase()se resuelvan como literales antes de guardarse en la base de datos. #100902 (Nikolay Degterinsky). - Se corrige
processAndOptimizeTextIndexFunctionscuandoquery_plan_merge_expressions = 0, dondeExpressionStepestá directamente sobreReadFromMergeTree. Corrige #100879. #100909 (Jimmy Aguilar Mena). - Se actualizó replxx para incluir la corrección de un acceso fuera de límites en do_complete_line. #100925 (Azat Khuzhin).
- Se corrigen resultados incorrectos cuando un JOIN con la optimización de segmento por PK usa la caché de condiciones de consulta y algunas partes quedan filtradas por condiciones en caché. #100926 (Groene AI).
- Se corrigió que
divideeintDivdevolvieranILLEGAL_DIVISIONen algunos casos al usarse en expresiones de filtro durante el análisis de índices. #100928 (Nihal Z. Miaji). - Se corrigieron los errores “La tabla de destino no existe” en las vistas materializadas con tablas internas durante el arranque asíncrono, causados por un orden incorrecto de las dependencias de inicio. #100946 (Nikolay Degterinsky).
- Corrige el comportamiento indefinido (desbordamiento de enteros con signo) en parseDateTimeBestEffort al parsear cadenas de fecha y hora con más de 18 dígitos fraccionarios de segundo. #100948 (Vasily Chekalkin).
- Se corrigió un fallo al usar un índice de búsqueda de texto con una cláusula
INque contiene una subconsulta de tipo Tuple, por ejemplo,WHERE (id, str) IN (SELECT (id, str) FROM ...), o cuando el número de columnas de la subconsulta no coincide con el de la tupla del lado izquierdo deIN. #100959 (Anton Popov). - Se corrigió un fallo al crear un diccionario de polígonos a partir de una tabla
MergeTreeque utiliza serialización dispersa de columnas. #100964 (Anton Popov). - Se corrige el error lógico “nodo de acción del árbol de consulta no válido” al usar
INTERSECT ALL/UNION ALLcon expresiones reducidas a constantes. #100977 (Alexey Milovidov). - Se corrige un problema que impedía que la función de agregación
sumCountOrDefaultcon uno o más argumentosNullableleyera estados serializados antiguos tras la introducción deNullable(Tuple). Cierra #100882. #101021 (Nihal Z. Miaji). - Se corrige un cierre inesperado (
Logical error: isConst/isSparse/isReplicated assertTypeEquality) en los algoritmos de merge cuando la replicación diferida de columnas (enable_lazy_columns_replication) genera columnasColumnReplicatedque pasan a canalizaciones de merge-sort con entradas que llegan tarde. #101036 (Groene AI). - Se corrige el error incorrecto
UNKNOWN_IDENTIFIERcuando se usa el mismo alias para varias expresiones enSELECT; ahora se muestra el error correctoMULTIPLE_EXPRESSIONS_FOR_ALIAS. #101040 (Alexey Milovidov). - Corrección de las columnas ALIAS con tipos
DateTime/DateTime64que no aplicaban la conversión de zona horaria cuando la zona horaria declarada difiere de la de la expresión. #101043 (Alexey Milovidov). - Se corrige que las políticas de fila no se registraran en
query_logpara vistas, subconsultas eINSERT ... SELECT. Aunque las políticas de fila se aplicaban durante la planificación de la consulta, no se propagaban de los subplanificadores al planificador principal para su registro. Las políticas de fila (solo para el registro) ahora se mantienen enQueryAccessInfopara que tanto los planificadores como los subplanificadores puedan poblarlas. #101044 (Narasimha Pakeer). - Se corrige una excepción en
DirectJoinMergeTreeEntitycuando los bloques del pipeline contienen columnasColumnConstque se combinan con columnas normales. #101046 (Alexey Milovidov). - Se corrige un espacio innecesario en el formato del alias de columna en la CTE (
WITH t (a, b)→WITH t(a, b)). #101049 (Alexey Milovidov). - Se corrigieron las funciones de tabla
remote/clusterque fallaban con funciones de tabla anidadas comomergecuando el analizador está habilitado. #101055 (Alexey Milovidov). - Se corrige un problema por el que
OFFSETse aplicaba dos veces en consultas distribuidas cuandoprefer_localhost_replica=1, lo que producía menos filas de las esperadas. #101071 (Nihal Z. Miaji). - Se corrigió un fallo al usar el formato
Regexpcon una expresión regular no válida en la configuraciónformat_regexp. #101074 (Nihal Z. Miaji). - Corrige el error “Illegal type Decimal64 of start parameter” en las funciones de agregación de series temporales al usar
serialize_query_plan=1con réplicas paralelas. #101083 (Groene AI). - Se corrige una excepción en
optimizeLazyMaterializationcuando se utiliza una proyección con PREWHERE junto conORDER BY ... LIMIT. #101115 (Anton Popov). - Se corrige el fallo del servidor (SIGABRT) al usar funciones de agregación con el combinador
Nullde uso exclusivamente interno (p. ej.,sumNull,avgNull) y con la configuraciónaggregate_functions_null_for_empty = 1habilitada. #101147 (Groene AI). - Corrige un uso de memoria después de liberarla en la ruta de escritura de la caché del sistema de archivos que podía provocar lecturas de memoria ya liberada al registrar segmentos de archivo completados (detectado por MemorySanitizer en BuzzHouse). #101161 (Groene AI).
- Se corrige un cierre inesperado del servidor con “Intento de adjuntar una tabla externa a un Set listo sin elementos explícitos” cuando el análisis distribuido de índices encuentra un predicado GLOBAL IN cuyo Set se creó sin elementos explícitos. #101178 (Groene AI).
- Se corrigen las funciones de agregación
MAX/MINen columnasDecimalque devolvían resultados incorrectos cuando la compilación JIT está activada (tras alcanzar el umbral de compilación). #101203 (Raúl Marín). - Se corrigen las optimizaciones de
minmax_count_projectiony las optimizaciones triviales deCOUNT(*), que quedaban deshabilitadas de forma permanente después de una eliminación ligera, incluso tras haberse fusionado todas las partes con una máscara de eliminación ligera. #101212 (Anton Popov). - Corrige un caso que podía provocar el error lógico
Having zero bytes, ...en la caché cuando se sobrescribía un objeto remoto entrelistyread, lo que antes daba lugar a metadatos de objeto obsoletos. #101219 (Kseniia Sumarokova). - Se corrige un cierre inesperado del servidor (LOGICAL_ERROR: Bad cast from ColumnVector to ColumnLowCardinality) al consultar una tabla MergeTree con
ORDER BY CAST(lc_column, 'Type'), dondelc_columntiene el tipo LowCardinality. #101220 (Groene AI). - Se corrige la limpieza de los nodos de procesamiento obsoletos en
S3Queue. #101230 (Kseniia Sumarokova). - Se corrigió el UB en mergeTreeAnalyzeIndexes() cuando el argumento optimizations no es válido. #101253 (Azat Khuzhin).
- Se corrige la excepción
Logical error: 'partitions_count > 0'al realizar operaciones consecutivas deALTER TABLE UPDATEen una tabla Iceberg particionada. #101278 (Desel72). - Corrige resultados erróneos en consultas cuando se usa una constante entera grande (p. ej., 256, 2147483648) como predicado booleano en una cláusula WHERE con AND sobre tablas MergeTree. Por ejemplo,
SELECT count() FROM t WHERE (2147483648 > b) AND 2147483648devolvía incorrectamente 0 en lugar de coincidir con todas las filas. #101287 (Groene AI). - Se corrige el INSERT SELECT desde un clúster de Delta Lake con ReplicatedMergeTree. #101299 (Konstantin Vedernikov).
- Se corrigió un fallo que provocaba un cierre inesperado con “Error lógico: lectura desde una CTE materializada antes de la materialización” cuando una subconsulta escalar hace referencia a una cadena de CTE materializadas dependientes entre sí. #101305 (Groene AI).
- Se corrige una condición de carrera en los datos de
storage_idenIStorage::getDependentViewsByColumn. #101385 (Nikolay Degterinsky). - Se corrigen el formato y la clonación del AST de BACKUP FROM SNAPSHOT. #101405 (Pablo Marcos).
- Se corrige el cierre inesperado por LOGICAL_ERROR “Current component is empty” al consultar
system.part_moves_between_shardsconenforce_keeper_component_trackinghabilitado. #101462 (Groene AI). - Se corrigió un fallo de segmentación en DataTypeDynamic::create() cuando el fuzzer genera un AST malformado del tipo Dynamic. #101464 (Groene AI).
- Genera un error cuando se usan la configuración
delta_lake_snapshot_versiono la configuración de versión de CDF sin DeltaKernel habilitado, en lugar de devolver datos incorrectos en silencio. #101489 (Desel72). - Se corrige la excepción
NOT_FOUND_COLUMN_IN_BLOCKal usar ARRAY JOIN con JOIN USING y con la configuraciónanalyzer_compatibility_join_using_top_level_identifierhabilitada. Cierra #101240. #101507 (Vladimir Cherkasov). - Se corrigió el fallo en el bucle de reintento de INSERT de Iceberg cuando la tabla se había creado con
iceberg_metadata_file_pathy la versión de metadatos de destino ya existía. #101548 (Groene AI). - Eliminar Nullable de la columna de resultados en arrayIntersect y funciones relacionadas para evitar discrepancias en la serialización/deserialización. #101569 (George Larionov).
- Se corrige un cierre inesperado del servidor (LOGICAL_ERROR) al hacer SELECT desde una vista materializada basada en una tabla con engine IcebergLocal. #101577 (Groene AI).
- Se corrige un mensaje de error incorrecto al llamar a
intExp10con un argumento NaN: mostrabaintExp2en lugar deintExp10. #101582 (Krishna Chaitanya). - Se corrige un problema por el que
allow_statistics=0no bloqueabaALTER TABLE ADD STATISTICSniALTER TABLE DROP STATISTICStras la refactorización en #100288. #101585 (Krishna Chaitanya). - Se corrige el error por el que
KeeperMapCREATE TABLEfallaba con “Cannot create metadata for table” cuando en nodos de ZooKeeper remanentes de undropparcial anterior a la versión 25.1 faltaba el nododrop_lock_version. #101623 (Antonio Andelic). - Corrige un posible error lógico al leer las subcolumnas de Map. Cierra #100769. Cierra #101336. #101641 (Pavel Kruglov).
- Da prioridad a la coincidencia exacta de la subcolumna frente a la coincidencia por prefijo en
getSubcolumnDatapara evitar un posible fallo. Cierra #101271. #101645 (Pavel Kruglov). - Se corrige un fallo (LOGICAL_ERROR: “ColumnUnique can’t contain null values”) al comparar una columna
LowCardinalitycon una constante NULL deVariantmientrasuse_variant_default_implementation_for_comparisonsestá deshabilitado. #101690 (Groene AI). - Qué: Se añadió una comprobación de flujo vacío a Bzip2ReadBuffer para que devuelva EOF en lugar de lanzar UNEXPECTED_END_OF_FILE cuando el flujo interno está vacío. #101691 (ClickGap AI Bot).
- Qué: Se corrigió la descripción invertida de la columna
alterableensystem.s3_queue_settingsysystem.azure_queue_settings: se intercambiaron los significados de0y1para que coincidan con el comportamiento real del código. #101703 (ClickGap AI Bot). - Se corrige un error por el que positiveModulo(tuple, number) se derivaba incorrectamente a la división en lugar de al módulo. #101709 (ClickGap AI Bot).
- Corrige un fallo al configurar
thread_pool_sizeen un disco con caché. Anteriormente,FileCacheSettings::loadFromConfig()rechazabathread_pool_sizecomo una configuración desconocida, lo que impedía que el servidor arrancara. Esta configuración es un parámetro válido deIDiskque controla la cantidad de hilos usados en operaciones de copia de disco a disco durante los movimientos de partes en segundo plano. #101712 (Francisco). - Se corrigió la creación de diccionarios
RANGE_HASHED, que aceptaba silenciosamente un atributo de rangoMAXinexistente y usaba una configuración de tipos incorrecta cuando los atributos de rango mínimo y máximo tenían tipos distintos. El error se debía a un fallo de copiar y pegar enbuildRangeConfiguration, que buscabamin_attr_nameen lugar demax_attr_namepara el atributo máximo. #101732 (Yakov Olkhovskiy). - Se corrige un fallo de acceso a memoria liberada en el planificador de concesión de CPU cuando el temporizador de espera sobrevive al hilo de trabajo cuyos
ProfileEvents::Countersreferencia. #101761 (Antonio Andelic). - Corrige un error en las funciones arrayLevenshteinDistanceWeighted y arraySimilarity. Cierra el issue #101725. #101767 (Mikhail f. Shiryaev).
- Se corrige un problema por el que la API de consulta de Prometheus ignoraba los cuerpos de formulario en POST. #101794 (James Cunningham).
- Se corrigió el escape de excepciones desde el destructor
Client::~Clientde S3 que provocaba el cierre del servidor. #101798 (Gagan Dhakrey). - Corrige un use-after-scope en la deserialización en paralelo de rutas dinámicas del tipo
Object, que podía provocar bloqueos al leer tablas con muchas rutas dinámicas. #101823 (Antonio Andelic). - Se corrigió una salida incorrecta de la función
formatDateTimecon el formateador%Wbajo ciertas configuraciones de formato (no predeterminadas). #101847 (Robert Schulze). - Se corrigió el falso negativo de
shouldPatchFunctionenSYSTEM INSTRUMENT ADDcuando la cadena de búsqueda aparece por primera vez dentro de un argumento de plantilla del nombre de símbolo desdemangleado. #101885 (Pablo Marcos). - Se corrigió la pérdida del registro de UDF cuando la sesión de ZooKeeper expiraba durante una actualización periódica; todas las funciones definidas por el usuario podían quedar no disponibles hasta que una actualización completa se realizara correctamente. #101891 (Nikita Fomichev).
- Se corrigió la descripción de
system.codecsdeAES_256_GCM_SIVpara que indicaraAES-256en lugar deAES-128. #101917 (Jimmy Aguilar Mena). - Se corrige un problema por el que se usaban extremos incorrectos en un índice min-max creado sobre una columna JSON, lo que provocaba un resultado de consulta incorrecto. Cierra #101700. #101918 (Pavel Kruglov).
- El tokenizador
splitByStringahora rechaza las cadenas separadoras vacías. #101928 (Robert Schulze). - Se corrigió un problema por el que
materialize_skip_indexes_on_merge=falseno suprimía los índices de texto (de texto completo) durante la fusión. Anteriormente, solo se suprimían los índices de omisión no textuales (minmax, set, bloom_filter); los índices de texto seguían generándose, lo que desperdiciaba CPU y E/S. #101932 (Groene AI). - El tokenizador
sparseGramsgeneró tokens más largos que la longitud máxima especificada (esto se debía a un+2codificado de forma fija en la implementación). #101934 (Elmi Ahmadov). - Se corrigió SIGSEGV en
MergeTreeDataPartWriterWide::cancelcuando un constructor de flujo lanza una excepción duranteaddStreams, dejando una entrada nula encolumn_streams. #101936 (Antonio Andelic). - Corrige una excepción al consultar tablas Merge o Distributed con un índice de texto completo y condiciones de filtro combinadas que mezclan
has*Tokenscon LIKE cuandoquery_plan_direct_read_from_text_indexestá habilitado. #101939 (Jimmy Aguilar Mena). - Se corrige un comportamiento indefinido al analizar paquetes de consulta del protocolo nativo con valores de
QueryProcessingStageno válidos. #101972 (Raúl Marín). - Cerrar la conexión TCP cuando se produzca una excepción durante el análisis inicial de la consulta para evitar leer datos basura de un flujo desincronizado. #101989 (Raúl Marín).
- Corrige una condición de carrera de SLRU en la caché del sistema de archivos 26.1+, que puede provocar un error lógico en la reserva de espacio. En una compilación de depuración, también puede causar un fallo de aserción:
'Previous state is Evicting, but expected state to be Active while setting Evicting flag for 2c1e3484ecdc6b78a8978fa5b17c5097:0:339 (state: Evicting)'.. #101991 (Kseniia Sumarokova). - Se corrige una excepción al convertir una cadena con datos sobrantes al tipo
Tuple()vacío. #102011 (Alexey Milovidov). - Corrige el orden incorrecto de las filas en las consultas que usan ORDER BY con el algoritmo de join grace_hash. Las consultas afectadas podían devolver resultados en un orden incorrecto, lo que producía una salida incorrecta sin que se advirtiera. #102036 (János Benjamin Antal).
- Corrige un ERROR LÓGICO (Tamaño inesperado del tipo de índice) que podía producirse en consultas RIGHT JOIN y FULL JOIN cuando se había configurado el ajuste
max_bytes_in_join. #102042 (Jimmy Aguilar Mena). - Corrige los casos en los que Time con valores negativos devolvía resultados incorrectos al compararse con DateTime. Cierra #101670. #102056 (Yarik Briukhovetskyi).
- Se corrige un crash en la actualización de UDF causado por
ZooKeeperRetriesControl, que reintentaba sobre una sesión de ZooKeeper obsoleta (caducada) sin renovarla. #102059 (Nikita Fomichev). - Corrige los espacios que faltaban al formatear
unlock snapshot. cierra https://github.com/clickhouse/clickhouse/issues/101723. #102063 (Han Fei). - Se corrige un fallo (SIGSEGV) al consultar una vista con una cláusula WHERE cuando la consulta interna genera columnas con tipos distintos de los metadatos de la vista (p. ej., Nullable de LEFT JOIN con
join_use_nulls). #102085 (Miсhael Stetsyuk). - Se corrigen las entradas de
VectorSimilarityIndexCacheque nunca se desalojaban al eliminar una parte debido a una discrepancia en las claves de la caché. #102152 (Seva Potapov). - Hacer NACK de los mensajes defectuosos al usar almacenamiento de RabbitMQ. #102157 (Seva Potapov).
- Se corrige un error lógico al analizar una cadena incorrecta correspondiente a una tupla vacía. #102289 (Nihal Z. Miaji).
- Corrige resultados de agregación incorrectos (filas duplicadas) al usar
optimize_aggregation_in_order=1con columnas de GROUP BY en un orden distinto al de la clave de ordenación de la tabla. #102299 (Groene AI). - Se corrige un fallo en
IcebergLocalALTER TABLE ... UPDATEal usar el formato Avro, causado porque los tipos envoltorioLowCardinality/Nullableno se desenvolvían antes de la serialización. #102337 (Desel72). - Se corrigió un fallo de segmentación en mutaciones sobre columnas materializadas sin expresión. Resuelve #102185. #102342 (zoomxi).
- Corrección en Coalescing merge tree para el tipo Array. Se cierra #89509. #102384 (Konstantin Vedernikov).
- Se corrige un segfault (o
LOGICAL_ERRORen compilaciones de depuración) al leer archivos Parquet con el push down del filtro bloom habilitado y condiciones de igualdad/desigualdad en la cláusula WHERE. El fallo se producía por un acceso a memoria fuera de límites durante la recuperación de datos del filtro bloom del prefetcher de Parquet, y también podía provocar resultados de consulta incorrectos y no deterministas. #102385 (Groene AI). - Corrige el
LOGICAL_ERRORque abortaba el redimensionamiento dinámico de la caché del sistema de archivos SLRU, causado por estadísticas de desalojo compartidas entre subcolas y una ruta de recuperación incorrecta para candidatos fallidos. #102396 (Antonio Andelic). - Corrige un fallo al inicializar tablas alias sin tabla de destino en una réplica nueva de la base de datos Replicated. Cierra #101320. #102397 (Nikolay Degterinsky).
- Se corrige una lectura fuera de los límites en las funciones de búsqueda en cadenas (
countSubstrings,position, etc.) al buscar una subcadena objetivo compuesta íntegramente por bytes nulos. #102401 (Raúl Marín). - Los ajustes de los índices de texto completo (
enable_full_text_index,allow_experimental_full_text_index,use_skip_indexes_on_data_read) ya no se desactivan cuando la configuracióncompatibilityapunta a una versión anterior a la 26.1. Antes, esto podía impedir queSharedDatabaseCatalogcreara tablas con índices de texto. #102422 (Nikita Fomichev). - Corregida una lectura fuera de límites en
printfcon un%al final. #102472 (Raúl Marín). - Corrige una excepción de chassert
ReadBuffer is canceleden compilaciones de depuración de AsynchronousMetrics, causada porquerewindno restablecía la marca de cancelación del búfer. #102524 (Yuri Fedoseev). - Se corrigió
hasToken/hasTokenOrNullcon cadenas de búsqueda formadas solo por separadores (p. ej.,'()','!!!') en columnas con un índice de texto: anteriormente, el índice omitía silenciosamente todos los gránulos en lugar de generarBAD_ARGUMENTS(parahasToken) o devolverNULL(parahasTokenOrNull). #102544 (Jimmy Aguilar Mena). - Soluciona OOM en solicitudes
multienormes en keeper. Para el tracing de OpenTelemetry, asignamos incondicionalmente >1 KiB a spans de OpenTelemetry en objetosZooKeeperRequest; es decir, en solicitudesmultirealmente enormes, intentamos asignar >10 GiB de memoria adicional. Para solucionarlo, ahora mantenemos los datos compartidos en memoria estática y usamosstd::unique_ptren lugar destd::optionalenZooKeeperOpentelemetrySpans. #102586 (Miсhael Stetsyuk). - Corregido el problema por el que
CurrentMetricdeNamedCollectionse inflaba conCREATE NAMED COLLECTION IF NOT EXISTSen colecciones existentes, y no se inicializaba para las colecciones cargadas desde la configuración o el almacenamiento SQL al inicio. Cierra #102507. #102598 (Pablo Marcos). - Se corrigió una excepción en
getStructureOfRemoteTablecuando el segmento local devuelve columnas vacías debido a DDL concurrente. #102604 (Alexey Milovidov). - Corrige la excepción
LOGICAL_ERRORcuando varias consultas simultáneasCREATE TABLE IF NOT EXISTSse dirigen a la misma tablaS3Queueen una base de datos Shared. #102610 (Nikita Taranov). - Se corrige el fallo LOGICAL_ERROR “Unexpected number of rows in column subchunk” en el lector nativo de Parquet V3 al leer columnas Nullable con un filtro WHERE. #102628 (Groene AI).
- Se corrigió la descripción del evento de perfil
AzureWriteMicroseconds, que indicaba “read” en lugar de “write”. #102639 (Miсhael Stetsyuk). - Error en la política de filas que provoca la excepción ‘Not found column in block’ en algunos casos especiales. #102648 (Yarik Briukhovetskyi).
- Se corrigió una excepción del servidor en ClusterDiscovery cuando un clúster estático (definido en la configuración) se quedaba temporalmente sin nodos activos. #102661 (Kseniia Sumarokova).
- Corrige una inferencia incorrecta del tipo de dato Date en caso de desbordamiento después del ajuste de la zona horaria. Cierra #102601. #102674 (Pavel Kruglov).
- Corrige el bloqueo indefinido de
SYSTEM WAIT VIEWcuando se elimina la vista materializada actualizable mientras la espera está en curso. #102681 (Nikolay Degterinsky). - Se corrige CASE con una expresión Dynamic que devolvía ELSE en todas las filas. Cierra #102511. #102684 (Pavel Kruglov).
- Corrige la serialización del tipo Dynamic aplanado con tipos de datos codificados en formato binario. Cierra #101911. #102692 (Pavel Kruglov).
- Se corrige un problema por el que format_schema_source=‘query’ ignoraba silenciosamente los resultados de varias filas. Cierra #101905. #102698 (Pavel Kruglov).
- Informar del código de salida real a través del client SSH en lugar de asignar todos los errores a
1. Cierra #101741. #102700 (Konstantin Bogdanov). - Se corrige la pérdida de encabezados HTTP en los controladores de consultas dinámicas y predefinidas. Cierra #101846. #102706 (Konstantin Bogdanov).
- Aplicar la corrección por muestreo de Poisson a los perfiles de heap colapsados de jemalloc para ajustarlos a la salida de jeprof. Anteriormente, el formato colapsado subestimaba los tamaños reales de asignación al no tener en cuenta la probabilidad de muestreo. #102759 (Antonio Andelic).
- Se corrige el fallo provocado por un argumento
NULLen la funciónhasPhrase. #102802 (Nikita Taranov). - Se corrige un fallo del servidor (SIGSEGV) al leer archivos Avro con esquemas recursivos que contienen referencias cíclicas a tipos simbólicos. Ahora, esos esquemas se detectan y se rechazan con un mensaje de error claro, en lugar de provocar un fallo. #102853 (Groene AI).
- Corrige un cierre inesperado del servidor (aserción
LOGICAL_ERROR) cuando una función sobre una columnaVariantalcanza el límite de memoria u otra excepción no relacionada con la conversión de tipos durante la conversión del resultado enFunctionVariantAdaptor. Ahora la excepción se propaga correctamente en lugar de clasificarse por error como un error interno. #102855 (Groene AI). - Se corrige un fallo del servidor en compilaciones de depuración/sanitizador cuando se produce
std::length_errordurante la inferencia de esquema (p. ej., por valores extremos deinput_format_msgpack_number_of_columnso datos de entrada malformados). #102859 (Groene AI). - Hacer que la representación de NULL en la serialización de columnas replicadas y dispersas respete la configuración (p. ej., format_tsv_null_representation). #102888 (Hechem Selmi).
- Retroportado en #103499: Se corrigen las solicitudes a S3 que fallaban con
ios_base::clear: unspecified iostream_category erroren lugar de reintentarse, debido a queBufferedStreamBuf::flushBufferde Poco no gestionaba escrituras cortas desde la capa de socket. #102894 (Sema Checherinda). - Se corrige el problema por el que las optimizaciones de
minmax_count_projectiony deCOUNT(*)trivial quedaban deshabilitadas de forma permanente tras una eliminación ligera, incluso después de que se hubieran fusionado todas las partes con una máscara de eliminación ligera. #102900 (Anton Popov). - Se corrigieron cierres inesperados aleatorios en jemalloc debidos a LTO. #102913 (Azat Khuzhin).
- Optimiza las cadenas OR de las políticas de fila convirtiéndolas en IN en el nuevo analizador. #102915 (Azat Khuzhin).
- Corrige la corrupción de metadatos de jemalloc debida a la liberación de la caché de páginas con una alineación incorrecta, que puede provocar bloqueos. #102918 (Azat Khuzhin).
- Los INSERT simples sin vistas materializadas ya no solicitan una cantidad excesiva de slots e hilos de ConcurrencyControl (
max_threadsen lugar demax_insert_threads), lo que evita la inanición de slots de CC y el crecimiento descontrolado del número de hilos en clústeres con alto throughput de INSERT. #102961 (Sema Checherinda). - Reintroducir ArrowMemoryPool para permitir que se lance MEMORY_LIMIT_EXCEEDED y así evitar el OOM del kernel. #102999 (Azat Khuzhin).
- Se corrige el problema por el que se ignoraba
cast_string_to_date_time_modeal hacerCASTaNullable(DateTime). Cierra #101840. #103035 (Pavel Kruglov). - Se añadió compatibilidad con las columnas
ALIASen la optimización de lectura directa del índice de texto. #103037 (Anton Popov). - Retroportado en #103454: se corrige un problema por el que
SELECT DISTINCTdevolvía silenciosamente resultados incompletos cuando una proyección de agregación coincidía con la consulta y algunas partes de la tabla no tenían datos de proyección (p. ej., la proyección se añadió a una tabla que ya contenía datos y no se ejecutóMATERIALIZE PROJECTION). Cierra #102951. #103052 (Nihal Z. Miaji). - Corrige los resultados erróneos devueltos por
WHERE x AND toNullable(N)en tablasMergeTreecuandoNes un entero de mayor tamaño queUInt8(p. ej.,256,65535,2147483648o cualquier entero negativo). El filtro descartaba incorrectamente todas las filas porquesplitFilterNodeForAllowedInputsusaba un ceroNULLal convertir a booleano el remainderNullablede unANDreducido, lo que hacía que la comparación se convirtiera enNULLbajo la lógica ternaria. #103077 (Groene AI). - Se corrigió el tipo de argumento incorrecto que se mostraba en los mensajes de error de las funciones de búsqueda de cadenas (p. ej.,
locate,position) cuando los argumentos se pasan en orden invertido (locate(needle, haystack)confunction_locate_has_mysql_compatible_argument_order = 1). #103102 (Alex Kuleshov). - Se corrige que waitForPause quede bloqueado indefinidamente cuando se llama a disableFailPoint sin ningún hilo pausado en el failpoint. #103119 (Shaohua Wang).
- Limite las cadenas del paquete TCP Hello previo a la autenticación a 64 KB y agregue la configuración del servidor
handshake_timeout_millisecondspara limitar el tiempo total del protocolo de enlace, evitando que los clientes no autenticados consuman memoria en exceso o mantengan hilos ocupados indefinidamente. #103284 (Sema Checherinda). - Corregidas las estadísticas de ColumnIndex de Parquet cuando min_value > max_value en columnas String. #103334 (Saurabh Kumar Ojha).
- Validación de datos Dynamic aplanados malformados en Native format. #103392 (Pavel Kruglov).
- Poblar la columna
_timea partir de la función de tablaurl. #103437 (Nikita Taranov). - Corregida la detección de SVE cuando se utilizan instrucciones SVE no disponibles. #103568 (Raúl Marín).
Mejora en compilación/pruebas/empaquetado
- La dependencia de Libstemmer (Snowball) ahora utiliza la versión más reciente, la v3.0.1. #99256 (Jimmy Aguilar Mena).
- Se aleatorizó la configuración en clickhouse-test:
use_skip_indexes_for_top_k,use_top_k_dynamic_filtering,query_plan_max_limit_for_top_k_optimization. #91782 (Nikita Fomichev). - Implementar una prueba de estrés para las funciones, para comprobar la robustez de sus distintas propiedades. #93543 (Michael Kolupaev).
- Proporcionar una configuración propia de CMake para
llvm-projecten lugar de importar la de upstream. #97453 (Konstantin Bogdanov). - Aleatorizar más configuraciones
optimize_*en la infraestructura de pruebas para mejorar la cobertura de las pasadas de optimización de consultas. #97547 (Alexey Milovidov). - Usa la toolchain de Rust nightly-2026-03-22. #98602 (Konstantin Bogdanov).
- Se usa
wasmtimev42.0.1. #98603 (Konstantin Bogdanov). - Se usa
llvm-project22.1.1. #98882 (Konstantin Bogdanov). - Se reemplazó
SANITIZE_COVERAGE(callbacks personalizados del sanitizador, granularidad a nivel de símbolo) por la cobertura basada en código fuente de LLVM (WITH_COVERAGE,-fprofile-instr-generate -fcoverage-mapping) para el pipeline nocturno de cobertura por prueba. El server ahora lee su propio mapa de cobertura de las secciones ELF durante el arranque y recopila tuplas(file, line_start, line_end)por prueba mediante un nuevo comandoSYSTEM SET COVERAGE TEST 'name'. La selección de pruebas en las comprobaciones de CI específicas usa consultas por rango de líneas sobre una nueva table CIDBchecks_coverage_linesy ordena las pruebas candidatas según cuántas líneas modificadas del diff cubren. #99513 (Nikita Fomichev). - Corrige el error de enlazado de llvm-libc en compilaciones con
-O0. #100023 (Zheguang Zhao). - Se corrigieron dos mensajes de error al arrancar el contenedor cuando la configuración no contenía las opciones
logger.logylogger.errorlog(p. ej., cuando todos los mensajes de registro deben enviarse a STDOUT/STDERR). #100239 (Simon). - Se prefiere
ld64.llden lugar delldde Apple (cctools-port ld64) para las compilaciones de macOS. Esto debería reducir significativamente los tiempos de enlace en Darwin, ya que el ld64 de cctools-port es muy lento con-ffunction-sectionsy-dead_strip. Se vuelve aldsild64.lldno está disponible. #100275 (Alexey Milovidov). - Pruebas para garantizar que los directorios no registren secretos (REST + Glue). #100307 (Konstantin Vedernikov).
- Repetir las pruebas modificadas recientemente con distintas configuraciones aleatorias. #100385 (Alexey Milovidov).
- Registrar las dependencias de archivos
#embeden CMake y habilitar el modo de dependencias de ccache para que las recompilaciones sean correctas. #100411 (Alexey Milovidov). - Se añadieron pruebas de corrección para consultas TPC-H. #100580 (Raufs Dunamalijevs).
- Se usa
aws-sdk-cpp1.11.771. #100582 (Konstantin Bogdanov). - Permitir que los archivos XML de pruebas de rendimiento hagan referencia a archivos externos con consultas SQL y ajustes mediante el atributo
file. #100747 (Raufs Dunamalijevs). - Se corrigió la compilación con
-march=x86-64-v4añadiendo la inclusión faltante deTargetSpecific.henLowerUpperImpl.h. #100932 (Alexey Milovidov). - Se corrige la compilación en Gentoo al añadir —no-default-config a cxxflags. #100973 (Isak Ellmer).
- Se añadió
utils/auto-bisect/— un marco de bisección basado en shell que descarga binarios precompilados de CI y ejecuta un script de prueba proporcionado por el usuario para encontrar el primer commit que introdujo una regresión, sin necesidad de una compilación local. #100989 (Nikita Fomichev). - Se desactiva ThinLTO de forma predeterminada en CMake para que las compilaciones locales de los desarrolladores ya no lo activen implícitamente. Las compilaciones de release de CI no se ven afectadas, ya que pasan explícitamente
-DENABLE_THINLTO=1. #101041 (Alexey Milovidov). - Añade el benchmark TPC-DS SF1 a las pruebas de rendimiento. #101209 (Raufs Dunamalijevs).
- Se añadieron pruebas sin estado para las eliminaciones ligeras de MergeTree que cubren: el ciclo de vida de la marca
has_lightweight_delete, la corrección deCOUNT(*)conoptimize_trivial_count_query, la integridad de las columnasMATERIALIZED/DEFAULT, la recuperación de la marca enReplicatedMergeTree,read_in_ordercon filas eliminadas, múltiples ciclos de eliminación y merge, la ocultación de la columna_row_exists, la variedad de predicados y la aplicación de RBAC enALTER DELETE. #101792 (Nikita Fomichev). - Ahora se publican imágenes distroless de Docker con variantes ubuntu y alpine para las versiones etiquetadas. #101941 (Rahul Nair).
- Los stack traces ahora muestran rutas relativas limpias (p. ej.,
src/Common/Exception.cpp) en lugar de rutas contaminadas con el directorio de compilación (p. ej.,./ci/tmp/fast_build/./src/Common/Exception.cpp). #102000 (Raúl Marín). - Añade una comprobación de estilo de CI que rechace los archivos de más de 5 MB incluidos en commits del repositorio, con una lista blanca para los datos de prueba legítimos ya existentes. Elimina
zookeeper_log.parquet, sin usar, de 14 MB. #102080 (Raúl Marín). - Elimina ~400 directivas
#includesin usar de las cabeceras para reducir los tiempos de compilación. #102585 (Raúl Marín). - Se utiliza
wasmtimev43.0.1. #102603 (Konstantin Bogdanov). - Se utiliza
openssl3.5.6. #102606 (Konstantin Bogdanov). - Use
xz5.8.3. #102607 (Konstantin Bogdanov). - Actualización de la imagen base distroless de Docker de Debian 12 (glibc 2.36, OpenSSL 3.0) a Debian 13 (glibc 2.41, OpenSSL 3.5), lo que reduce la superficie de CVE a cero vulnerabilidades alcanzables. #101678 (Rahul Nair).
Lanzamiento de ClickHouse 26.3 LTS, 2026-03-26. Presentación, Vídeo
Cambio incompatible con versiones anteriores
- Volver a una versión anterior tras actualizar puede provocar pérdida de datos. Las versiones de serialización de los tipos de datos ahora se propagan a los tipos de datos anidados. Por ejemplo, la versión de serialización de String
with_size_streamantes se aplicaba solo a las columnas String de nivel superior y a los elementos de Tuple. Ahora se aplica a cualquier tipo String dentro de cualquier tipo anidado, comoArray/Map/Variant/JSON/etc. Este comportamiento está controlado por la configuración de MergeTreepropagate_types_serialization_versions_to_nested_types, que ahora está activada de forma predeterminada. Después de este cambio, las partes de datos recién creadas no pueden ser leídas por versiones anteriores, pero las partes antiguas pueden leerse en la versión nueva sin problemas. La actualización es segura, pero volver a una versión anterior no lo es: si necesitas revertir después de actualizar a 26.3, ¡los datos escritos por 26.3 en columnas con tipos anidados no podrán leerse! Consulta #101429 para más detalles. #94859 (Pavel Kruglov). - Se elimina el tipo de índice de omisión
hypothesis. Era una función experimental poco conocida y de utilidad práctica limitada. Crear tablas conINDEX ... TYPE hypothesisahora producirá un error. #96874 (Alexey Milovidov). - Se elimina la función experimental
detectProgrammingLanguage. #99567 (Alexey Milovidov). - Se corrige la precedencia del operador
NOTpara ajustarla al estándar SQL:NOTahora tiene menor precedencia queIS NULL,BETWEEN,LIKEy los operadores aritméticos. Por ejemplo,NOT (x) IS NULLahora se interpreta comoNOT (x IS NULL)en lugar de(NOT x) IS NULL. Esto puede cambiar el resultado de las consultas que dependían del comportamiento anterior (no estándar). #97680 (Alexey Milovidov). - Corrige los metadatos de las proyecciones normales para que las proyecciones con claves de ordenación de varias columnas se reconozcan adecuadamente. Se basa en #90429. #91352 (Amos Bird).
- Se corrigió un problema por el que los archivos de índices de omisión no respetaban la configuración replace_long_file_name_to_hash, lo que provocaba errores de “Nombre de archivo demasiado largo” y fallos al leer índices con nombres largos. Ahora, los nombres de archivo de los índices de omisión se convierten en hash cuando superan max_file_name_length, de forma similar a los archivos de columnas. Esto es retrocompatible (los servidores nuevos leen las partes antiguas), pero una degradación de versión (o el uso de servidores antiguos durante una actualización gradual) puede hacer que se ignoren los índices con nombres largos. #97128 (Raúl Marín).
- Se activa async insert de forma predeterminada. Ahora ClickHouse agrupará por lotes todas las inserciones pequeñas de forma predeterminada. Este ajuste se define en compatibility. Si establece
compatibility=<version less than 26.2>, el valor predeterminado será el anterior,false. Puede activar o desactivar async inserts en varios niveles: en la configuración de los perfiles de usuario, para la sesión, para la consulta o para la tabla MergeTree. #97590 (Sema Checherinda). - Se cambió el valor predeterminado de
mysql_datatypes_support_levelde vacío adecimal,datetime64,date2Date32, lo que permite la asignación correcta deDATEde MySQL aDate32, deDECIMAL/NUMERICaDecimaly deDATETIME/TIMESTAMPcon precisión aDateTime64de forma predeterminada. Anteriormente, las columnasDATEde MySQL se asignaban aDate, que no puede representar fechas anteriores a 1970-01-01, lo que provocaba corrupción de datos. #97716 (Alexey Milovidov). - Aceptar un array de nombres de las partes en lugar de una expresión regular para
mergeTreeAnalyzeIndexes{,UUID}, ya que las expresiones regulares son lentas (Funcionalidad experimental). #98474 (Azat Khuzhin). - Cambiar el valor predeterminado de
stderr_reactiondethrowalog_lastpara las UDF ejecutables. Las UDFs que escriben advertencias en stderr ya no provocan errores cuando el código de salida es 0. Las excepciones por código de salida ahora incluyen el contenido de stderr. #99232 (Xu Jia).
Nueva funcionalidad
- Se añadió serialización en buckets para columnas Map en MergeTree (
map_serialization_version = 'with_buckets'). Las claves se dividen en buckets basados en hash, de modo que al leer una sola clave (m['key']) solo se lea un bucket en lugar de toda la columna, lo que proporciona una aceleración de 2 a 49 veces en búsquedas de una sola clave, según el tamaño del mapa. El número de buckets y la estrategia de asignación a buckets pueden controlarse mediante nuevas configuraciones de MergeTree:map_serialization_version,max_buckets_in_map,map_buckets_strategy,map_buckets_coefficientymap_buckets_min_avg_size. #99200 (Pavel Kruglov). - Compatibilidad con CTE materializadas. Permite evaluar las CTE solo una vez durante la ejecución de la consulta y almacenar sus resultados en tablas temporales. Cierra #53449. #94849 (Dmitry Novik).
- Permite usar determinadas funciones estándar de SQL sin paréntesis por compatibilidad, como
NOW. Cierra #52102. #95949 (Aly Kafoury). - Ahora puede usar la función de clave de ordenación natural
naturalSortKey(s). #90322 (Nazarii Piontko). - Ahora puede usar JSON/Object nativo como entrada para las funciones JSONExtract. Cierra #88370. #96711 (Fisnik Kastrati).
- Si un parámetro de consulta es de tipo
Nullabley no se especifica, asumiremos que su valor esNULL. #93869 (Vikash Kumar). - Se admite ZooKeeper auxiliar para la base de datos
Replicated. #95590 (RinChanNOW). - Se añadió compatibilidad con la función
haspara el tipo JSON a fin de comprobar la existencia de una ruta, de forma similar a Map. #96927 (DQ). - Se añadió la función de tabla
mergeTreeTextIndex(database, table, index), que permite leer datos directamente desde un índice de texto. Esta función puede usarse para tareas de introspección o para realizar agregaciones sobre los datos del índice de texto. #97003 (Anton Popov). - Añade la configuración de MergeTree
table_readonlypara marcar las tablas como de solo lectura y evitar inserciones y modificaciones. #97652 (Alexey Milovidov). - Se añade la nueva configuración
use_partition_pruningy el aliasuse_partition_key. Establécela enfalsepara deshabilitar la poda de particiones en función de la clave de partición. #97888 (Nihal Z. Miaji). - Implementa
ALTER TABLE ... EXECUTE expire_snapshots('<timestamp>')en tablas Iceberg. #97904 (murphy-4o). #99130 - Permite que cada entrada
type=httpde<protocols>especifique una clave<handlers>personalizada que apunte a una sección de configuración<http_handlers_*>independiente, lo que permite definir distintas reglas de enrutamiento HTTP para cada puerto. #98414 (Amos Bird). - Se agrega la opción
pretty=1aEXPLAINpara obtener una salida con sangría en forma de árbol, ycompact=1para contraer los pasos deExpression, lo que hace que los planes de consulta sean más legibles. #98500 (Kirill Kopnev). - Se añade la configuración del servidor
restore_access_entities_with_current_grants. Cuando está habilitada, los usuarios/roles restaurados desde copias de seguridad ven sus grants limitados a lo que el usuario que realiza la restauración puede conceder (con la misma semántica queGRANT CURRENT GRANTS), en lugar de fallar conACCESS_DENIED. #98795 (pufit). - Se añaden las funciones
caseFoldUTF8yremoveDiacriticsUTF8para el plegado de mayúsculas y minúsculas de Unicode y la eliminación de marcas diacríticas. #98973 (George Larionov). - Se agregó la función de cadena
normalizeUTF8NFKCCasefoldpara la normalización Unicode NFKC_Casefold, que combina la normalización NFKC con el plegado de mayúsculas y minúsculas. #99276 (George Larionov). - Se añade el
tokenizerunicode_wordpara índices de texto completo y la funcióntokens. Segmenta el texto según las reglas de límites de palabras de Unicode: las palabras ASCII se forman con caracteres conectores (guion bajo, dos puntos, punto y comilla simple), mientras que los caracteres Unicode no ASCII se convierten en tokens de un solo carácter. Nota: 26.3 acepta este tokenizador únicamente con el nombreunicode_word; se renombró aasciiCJKen 26.4. #99357 (Amos Bird). - Se agregaron las configuraciones
max_skip_unavailable_shards_numymax_skip_unavailable_shards_ratiopara limitar cuántos segmentos pueden omitirse sin avisar cuandoskip_unavailable_shardsestá habilitado. Si la cantidad o la proporción de segmentos no disponibles supera el umbral configurado, se genera una excepción en lugar de devolver resultados incompletos sin avisar. #99369 (Alexey Milovidov). - Ahora los usuarios pueden usar la palabra clave
SOMEen expresiones de subconsulta. Se comporta de forma idéntica aANY. #99842 (Artem Kytkin). - Se añade la configuración
output_format_trim_fixed_stringpara eliminar los bytes nulos al final de los valoresFixedStringen los formatos de salida de texto. #97558 (NeedmeFordev). - Se admiten expresiones JOIN de tablas entre paréntesis en la cláusula FROM, p. ej.,
SELECT * FROM (t1 CROSS JOIN t2). #97650 (Alexey Milovidov). - Implementar la función
toDaysInMonth: devuelve el número de días del mes correspondiente a la fecha especificada. #99227 (Vitaly Baranov).
Funcionalidad experimental
- Se añade compatibilidad experimental con funciones definidas por el usuario (UDFs) basadas en WebAssembly, lo que permite implementar lógica de funciones personalizadas en WebAssembly y ejecutarla dentro de ClickHouse. Agradecimientos especiales a Alexey Smirnov por aportar compatibilidad con el backend de Wasmtime. #88747 (Vladimir Cherkasov). Mejoras incrementales en la compatibilidad con UDF de WASM. #99373 (Vasily Chekalkin).
- Se añade compatibilidad con dialectos SQL externos mediante la biblioteca
polyglot. #99496 (Alexey Milovidov). - Se añade el códec de compresión de punto flotante
ALP(sin fallback ALP_rd para valoresdoubleno compresibles). #91362 (Nazarii Piontko). - Se añaden indicaciones de tipo diferidas experimentales para columnas
JSON. Cuando se habilita medianteallow_experimental_json_lazy_type_hints, la instrucciónALTER TABLE ... MODIFY COLUMN json JSON(path TypeName)que solo añade o modifica indicaciones de tipo se completa de forma instantánea como una operación solo de metadatos, sin reescribir datos históricos. Las indicaciones de tipo se aplican en tiempo de consulta a las partes antiguas y se materializan durante las operaciones INSERT y las fusiones en segundo plano. #97412 (tanner-bruce). - Se habilitan lecturas paralelas desde el motor de tabla YTsaurus. #97343 (MikhailBurdukov).
Mejora del rendimiento
- Mejora el rendimiento de los lagos de datos. En versiones anteriores, la lectura desde el almacenamiento de objetos no ajustaba el pipeline al número de hilos de procesamiento. Esto supone mejoras de varios órdenes de magnitud (~40x) en máquinas multinúcleo. #99548 (Alexey Milovidov).
- Ahora, la relación entre
enable_parallel_replicasyautomatic_parallel_replicas_modees la siguiente. Una consulta puede usar réplicas paralelas solo sienable_parallel_replicas > 0. Además, siautomatic_parallel_replicas_mode=1, la decisión de usar réplicas paralelas se toma durante la planificación en función de las estadísticas recopiladas previamente. Siautomatic_parallel_replicas_mode=0, las réplicas paralelas se usarán en todas las consultas compatibles, independientemente de las estadísticas. Una excepción destacada esinsert-selectdistribuido con réplicas paralelas: en este caso, las consultas siempre se ejecutarán como siautomatic_parallel_replicas_mode=0. #97517 (Nikita Taranov). - Permite la poda de particiones cuando el predicado contiene cualquier operador de comparación (
=,<,>,!=) y la clave de partición está incluida en una cadena de funciones deterministas (p. ej.,PARTITION BY xy predicados comocityHash64(x) % 5 > 2,toYYYYMM(x) < 2026,toYYYYMM(x) = 2026otoYYYYMM(x) != 2026usarán la clave de partición para la poda). Cierra #28800. #98432 (Nihal Z. Miaji). - Permite la optimización de lectura en orden y la poda de la primary key cuando el tipo de destino de
CASTesNullabley la conversión es monótona; por ejemplo, conPRIMARY KEY x, ClickHouse puede usar la optimización de lectura en orden paraORDER BY x::Nullable(UInt64)y aplicar la poda de la primary key a predicados comoWHERE x::Nullable(UInt64) > 500000. #98482 (Nihal Z. Miaji). - Se habilitan la poda de índices y el pushdown de filtros cuando una columna de tipo entero se compara con un literal de coma flotante; por ejemplo, predicados como
WHERE x < 10.5ahora pueden usar la clave primaria para la poda, y filtros comoprime < 1e9onumber < 1e5ahora hacen pushdown en las funciones de tablaprimes()ynumbers()en lugar de provocar una ejecución sin límite. Cierra #85167. #98516 (Nihal Z. Miaji). - Se añadió una nueva caché SLRU para los metadatos de Parquet a fin de mejorar el rendimiento de lectura, al eliminar la necesidad de volver a descargar archivos solo para leer esos metadatos. #98140 (Grant Holly).
- Se admite el intercambio de lados en los joins ANTI, SEMI y FULL según las estadísticas del optimizador. #97498 (Hechem Selmi).
- Optimiza el descarte de gránulos para
pointInPolygonen polígonos grandes y corrige que el análisis de índices depointInPolygonarroje excepciones durante la poda de la clave primaria. #91633 (Nihal Z. Miaji). - Mejora del rendimiento de la función
levenshteinDistance. #94543 (Joanna Hulboj). - Optimiza las conversiones por lotes de tipo Decimal al evitar llamadas a funciones para cada elemento. #95923 (Konstantin Bogdanov).
- Las tablas Iceberg ahora admiten la precarga asíncrona de metadatos mediante la configuración de tabla
iceberg_metadata_async_prefetch_period_ms, que precarga periódicamente la caché de metadatos. Además, la configuración de consultaiceberg_metadata_staleness_mspermite que las consultas SELECT usen metadatos en caché si son más recientes que el umbral de obsolescencia especificado, lo que elimina las llamadas al catálogo Iceberg durante el procesamiento de solicitudes. #96191 (Arsen Muk). - El modo ordered de
S3Queueusa S3 ListObjectsV2 StartAfter para evitar volver a listar el historial completo del prefijo, lo que reduce las llamadas a ListObjects. #96370 (Venkata Vineel ). - Menor uso de memoria para la deduplicación de inserciones. En general, el bloque original es necesario para la deduplicación, pero en los insert síncronos se pudo omitir y ahorrar memoria por completo. #96661 (Sema Checherinda).
- Se usa un valor específico de la arquitectura para el tamaño de línea de caché en lugar de un valor fijo de 64. #97357 (Nikita Taranov).
- Se optimizó ligeramente la lectura del diccionario del índice de texto, lo que mejora el rendimiento general del análisis de índices de texto. #97519 (Anton Popov).
- Acelera la descompresión de bloques de 16 bytes con
LZ4en ARM. #97774 (Raúl Marín). - Se ha refactorizado la tokenización con una nueva interfaz de alto rendimiento, sustituyendo la antigua API de tipo iterador para admitir SIMD y tokenizadores con estado. Parte de #90268. #97871 (Amos Bird).
- Se mejoró el rendimiento del análisis de índices de texto para consultas con condiciones combinadas que involucran columnas indexadas y no indexadas. Anteriormente, la optimización de salida temprana durante el análisis de índices se deshabilitaba incorrectamente en estos casos. #98096 (Anton Popov).
- Mejora el rendimiento de las consultas que contienen expresiones constantes que generan arrays o maps muy largos. #98287 (Alexey Milovidov).
- Se corrigió el análisis de las condiciones sobre claves primarias
DateTime64al compararlas con constantes enteras, lo que antes impedía la poda de gránulos. #98410 (Amos Bird). - La configuración
optimize_syntax_fuse_functionsestá activada de forma predeterminada. #98424 (Alexey Milovidov). - Optimiza la función de agregación
avgWeightedmediante acumuladores locales en lugar del almacenamiento y reenvío fila por fila a través del estado de agregación, mejorando el rendimiento hasta en un 27 % para entradas Nullable. #98793 (Antonio Andelic). - Mejora el rendimiento y reduce el uso de memoria de las funciones de ventana paralelas en determinados escenarios, así como de las cargas de trabajo de
arrayFoldcon arrays grandes. Esto también puede reducir la presión de fallos de página y mejorar la estabilidad con límites de memoria ajustados en las consultas afectadas. #98892 (filimonov). - Mejora el rendimiento de las fusiones ordenadas. #99013 (Artem Zuikov).
- Se optimizan
INTERSECT ALLyEXCEPT ALL. #99097 (Raufs Dunamalijevs). - Se añadió soporte para la optimización
read_in_order_use_virtual_rowen lecturas en orden inverso. #99198 (Vladimir Cherkasov). - Reducir la contención de la caché en los
RIGHTyFULLJOINs comprobando si JoinUsedFlags está definido antes de escribir. #99274 (Hechem Selmi). - Optimiza
PrefetchingHelper::calcPrefetchLookAheadsustituyendo la aritmética de coma flotante por aritmética entera pura, mejorando la disposición de la caché de instrucciones y reduciendo la sobrecarga de ciclos en los bucles de agregación. #99327 (Riyane El Qoqui). - Reducir el consumo de memoria de Keeper sustituyendo
absl::flat_hash_setporCompactChildrenSetpara almacenar los hijos de los nodos. El nuevo contenedor almacena de 0 a 1 hijos directamente, sin asignación en el heap, lo que cubre la mayoría de los nodos de Keeper. Esto reduce el tamaño deKeeperMemNodede 144 a 128 bytes. #99860 (Antonio Andelic). - Las proyecciones de agregación ahora funcionan correctamente en las vistas. Corrige #32753. #88798 (Amos Bird).
- Se añadió compatibilidad con la optimización de conversión de OUTER a INNER join con
join_use_nulls. Cierra #90978. #95968 (Vladimir Cherkasov). - Mejora la lectura de subcolumnas mediante el cálculo correcto de los tamaños antes de leerlas. Reduce el uso de memoria y acelera la lectura de subcolumnas. #96251 (Pavel Kruglov).
- Hacer que las cachés de mark, de datos sin comprimir y de páginas utilicen una arena de jemalloc independiente para evitar la fragmentación de memoria cuando las asignaciones de corta duración, es decir, para consultas y solicitudes, se mezclan con asignaciones de mayor duración para las cachés. #96812 (Seva Potapov). #98812. #99021
- Las tablas con reglas
DELETE TTLahora pueden utilizar el algoritmo de fusión vertical. #97332 (murphy-4o). - Aplicar índices de omisión de datos durante el análisis distribuido de índices. #97767 (Azat Khuzhin).
- Las marcas de los índices secundarios ahora se precargan cuando la configuración
prewarm_mark_cacheestá habilitada (se cargan en la caché de marcas de índice durante la obtención de partes de datos y el arranque de la tabla). #97772 (Anton Popov). - Menor bloqueo durante el control de acceso. #97894 (Nikita Taranov).
- Cuando se habilita apply_row_policy_after_final o apply_prewhere_after_final, las condiciones compuestas con AND en las políticas de fila y en PREWHERE ahora se descomponen para extraer átomos de la clave de ordenación y utilizarlos en el análisis del índice de clave primaria. Anteriormente, si un filtro diferido contenía una combinación de predicados de la clave de ordenación y de predicados que no pertenecían a ella (p. ej., x > 1 AND y != ‘foo’), toda la expresión quedaba excluida del análisis del índice. Ahora, los átomos de la clave de ordenación (como x > 1) se extraen y se usan para la poda de gránulos, incluso dentro de expresiones AND anidadas. #98513 (Yarik Briukhovetskyi).
- Reduce la contención por bloqueos en MergeTreeBackgroundExecutor al hacer que los recursos de la tarea se liberen sin adquirir el bloqueo. Cierra #93620. #98604 (Dmitry Novik).
- Corrige el uso excesivo de memoria (~514 MiB) durante la autodetección de formato al leer datos que no son Arrow (p. ej., JSON desde
urlofilesin un formato explícito), debido a que el lector ArrowStream interpretaba erróneamente los primeros bytes como una longitud de metadatos enorme. #98893 (Konstantin Bogdanov).
Mejora
- Permite analizar archivos GeoParquet que contienen distintos tipos Geo en la misma columna. #97851 (Mark Needham).
- Se introduce la función SQL
tokensForLikePattern, que tokeniza patrones LIKE respetando la semántica de los comodines:%y_se consideran comodines, los comodines escapados (\%,\_) se consideran literales y se descartan los tokens adyacentes a comodines no escapados. #97872 (Amos Bird). - Se añade un marcador de posición
{_schema_hash}para el motor de tabla S3, que inserta un hash de las definiciones de las columnas de la tabla en la ruta de S3. #98265 (Miсhael Stetsyuk). SymbolIndex,addressToSymbol,system.symbolsybuildIdahora funcionan en macOS mediante el análisis de las tablas de símbolos Mach-O. #99014 (Alexey Milovidov).- La tabla
system.stack_traceahora funciona en macOS, lo que permite inspeccionar las trazas de pila de todos los hilos del servidor. #98982 (Alexey Milovidov). - Añade la opción de configuración LDAP por servidor
<follow_referrals>(valor predeterminado:false) para controlar si el client LDAP sigue las referencias. Deshabilitar el seguimiento de referencias evita timeouts y bloqueos al buscar desde un base DN raíz de dominio de Active Directory. Los mensajes de registro relacionados con las referencias se han movido dewarnatrace. #96765 (paf91). - Ahora registramos en una nueva columna llamada
skip_indicesde la tablaquery_logtodos los índices de omisión de datos utilizados durante la ejecución de la consulta. Corrige #78676. Autor original @pheepa. #87862 (Grant Holly). - Las sugerencias de ACCESS_DENIED ya no revelan los nombres de las columnas, a menos que el usuario pueda mostrar todas las columnas requeridas; los nombres de la base de datos y de la tabla siguen siendo visibles en la sugerencia. #91067 (filimonov).
- Añade un hilo dedicado a la limpieza para MergeTree, a fin de evitar retrasos en la limpieza cuando la carga de merge es elevada. Esto resuelve #86181. #91574 (Amos Bird).
- Recargar la configuración del clúster si cambian las IP asociadas al hostname del servidor local, en lugar de las IP de cualquier host. Corrige #81215, #70156 y #65268. #93726 (Zhigao Hong).
- Permite que optimize_aggregators_of_group_by_keys optimice correctamente las funciones de agregación en las consultas GROUPING SETS. #93935 (Xiaozhe Yu).
- Keeper-bench: informar de errores en las métricas y generar un archivo JSON de métricas para el modo —input-request-log. #95748 (Mohammad Lareb Zafar).
- Se añade la nueva cláusula ROLE a CREATE USER. #97074 (Vitaly Baranov).
- Ahora puede establecer la configuración de internal_replication para un clúster creado por la base de datos Replicated. #97228 (Pervakov Grigorii).
- Nueva configuración:
allow_nullable_tuple_in_extracted_subcolumnscontrola si las subcolumnasTuple(...)extraídas deTuple,Variant,DynamicyJSONse devuelven comoNullable(Tuple(...))(NULLpara las filas que faltan) o comoTuple(...)(valores de tupla predeterminados para las filas que faltan). Está deshabilitada de forma predeterminada y solo puede cambiarse reiniciando el servidor. #97299 (Nihal Z. Miaji). - Agregar información sobre los filtros diferidos como un elemento independiente en la salida de EXPLAIN (al usar Row Policies/PREWHERE con FINAL). Relacionado: #91065. #97374 (Yarik Briukhovetskyi).
- Habilita
type_json_allow_duplicated_key_with_literal_and_nested_objectde forma predeterminada. Permite evitar errores por claves duplicadas durante el análisis de JSON como{"a" : 42, "a" : {"b" : 42}}, que ClickHouse puede generar a partir de los datos JSON originales{"a" : 42, "a.b" : 42}. #97423 (Pavel Kruglov). - Mejora de Keeper:
find_super_nodeses un comando muy útil para depurar el crecimiento inesperado del número de nodos en Keeper. Desafortunadamente, si hay varios supernodos, es casi imposible encontrar más de uno, porque el comando se queda bloqueado indefinidamente al recorrer los hijos del primer supernodo que encuentra. Este PR impide recorrer los hijos de los supernodos. #97819 (pufit). - Compatibilidad inicial con el autocompletado para
clickhouse-keeper-client. #97828 (Konstantin Bogdanov). - Vaciar los búferes de logging asíncrono en caso de cierre inesperado. #97836 (Azat Khuzhin).
- Se habilita de forma predeterminada la función de suplantación de identidad (consulta EXECUTE AS target_user). #97870 (Vitaly Baranov).
- Mejora en la cancelación de consultas con el motor de tabla SQLite mediante KILL QUERY y la cancelación de consultas (Ctrl+C) en clickhouse-client. #97944 (Roman Vasin).
- Se añadió la configuración del servidor
jemalloc_profiler_sampling_ratepara controlarlg_prof_samplede jemalloc y exponerla como la métrica asíncronajemalloc.prof.lg_sample. #97945 (Antonio Andelic). - Se añade compatibilidad con pesos en la implementación de la cola acotada concurrente. #97962 (Daniil Ivanik).
- Se añade
sslmodea las claves permitidas para los orígenes de diccionario de PostgreSQL. Anteriormente,sslmodeno figuraba en la lista de claves permitidasdictionary_allowed_keysdePostgreSQLDictionarySource.cpp, lo que imposibilitaba configurar el modo SSL para las conexiones de diccionario de PostgreSQL. Esto impedía que los diccionarios se conectaran a servidores PostgreSQL que requieren SSL (por ejemplo, AWS RDS, que exige SSL de forma predeterminada), ya que la conexión fallaba durante la negociación TLS y el servidor rechazaba la alternativa no cifrada. #98014 (mcalfin). - Mostrar un error claro de “archivo no encontrado” al pasar una ruta de archivo inexistente a
clickhouseoclickhouse-local, en lugar de un mensaje genérico confuso. #98048 (Raúl Marín). - Ahora también se pueden crear índices de texto en columnas
Nullable([Fixed]String)yArray(Nullable([Fixed]String)). #98118 (Jimmy Aguilar Mena). - Evite eliminar colecciones con nombre de las que dependan las fuentes de diccionario. #98127 (Pablo Marcos).
- Se habilita el algoritmo de join
grace_hashpara consultas con totales. #98144 (János Benjamin Antal). - Cancelar antes las fusiones en segundo plano en DROP DATABASE para ordinary shared merge tree. #98161 (Shaohua Wang).
- Mejora de la cancelación de consultas con MongoDB y MySQL mediante KILL QUERY y la cancelación de consultas (Ctrl+C) en clickhouse-client. #98187 (Roman Vasin).
- Elimina NetlinkMetricsProvider y usa procfs exclusivamente para recopilar métricas taskstats por hilo. La recopilación basada en Netlink presenta problemas en entornos contenerizados y tiene una latencia en cola peor en situaciones de contención. #98229 (Amos Bird).
- Se refactorizó el manejo de los archivos de manifiesto de Iceberg para corregir problemas con la caché de archivos de manifiesto. #98231 (Daniil Ivanik).
- Ahora también tenemos en cuenta los casos en que la clave de ordenación de la tabla puede ser una expresión como
toDate(time), y podemos decidir no aplazar expresiones de este tipo si forman parte de filtros. #98237 (Yarik Briukhovetskyi). - Añade una nueva métrica
MaxAllocatedEphemeralLockSequentialNumberpara el número secuencial máximo asignado a los znodes de bloqueo efímeros de ZooKeeper. #98243 (Miсhael Stetsyuk). - Actualización de ClickStack a la versión 2.20.0. #98252 (Aaron Knudtson).
- Se agregó un nuevo evento de perfil
KeeperRequestTotalWithSubrequestsque cuenta cada subsolicitud dentro de una solicitud múltiple de forma individual, lo que ofrece una mejor visibilidad de la carga de trabajo real de Keeper. El evento existenteKeeperRequestTotalsigue contando cada solicitud múltiple como una sola solicitud. #98348 (Antonio Andelic). SYSTEM RELOAD DICTIONARIESahora recarga los diccionarios en orden topológico para que los diccionarios que toman datos de otros diccionarios vean datos actualizados tras la recarga. #98356 (Alexey Milovidov).- Reiniciar la caché de estadísticas después de cambiar la configuración de MergeTree. #98520 (Han Fei).
- Solo las réplicas “vivas” (a las que se puede acceder) participan en el análisis distribuido de índices. #98521 (Azat Khuzhin).
- Se añade la configuración
access_control_improvements.disallow_config_defined_profiles_for_sql_defined_users(deshabilitada/permitida de forma predeterminada), que impide usar perfiles de configuración definidos en la configuración (excepto el perfildefault) para usuarios definidos mediante SQL. #98662 (Alexander Tokmakov). - Se limita el número de nodos usados por la heurística automática de réplicas paralelas al número real de nodos del clúster (en lugar de basarse solo en la configuración
max_parallel_replicas). #98668 (Nikita Taranov). - Implementación de solicitudes redundantes y lectura asíncrona para el análisis distribuido de índices. #98724 (Azat Khuzhin).
- La deserialización de estados
AggregateFunctionbinarios ahora requiere consumir toda la entrada. Si hay bytes redundantes adicionales al final, ClickHouse lanza una excepción en lugar de aceptar datos de estado malformados. #98786 (Nihal Z. Miaji). - Hacer que TRUNCATE DATABASE responda a la cancelación de consultas. #98828 (Shaohua Wang).
- Se mejora
keeper-benchcon canalización de solicitudes, período de calentamiento, estadísticas por operación, semillas reproducibles y una mejor gestión de errores. #98906 (Antonio Andelic). - Se admite la cláusula SAMPLE en el análisis distribuido de índices. #98931 (Azat Khuzhin).
- Mostrar el título del gráfico en el dashboard incluso cuando la consulta devuelve un resultado vacío o produce un error. #98975 (Yash ).
- Los mensajes de error del analizador ya no muestran todas las columnas de una tabla (lo que podía generar excepciones de más de 150 KB). Las listas de columnas ahora están limitadas a 10 elementos. #99002 (Yash ).
- Devolver correctamente las estadísticas de las columnas de las subconsultas con joins para que la consulta padre pueda utilizarlas para reordenar los joins. #99096 (Alexander Gololobov).
- Marque la sesión de ZooKeeper como expirada inmediatamente al comenzar la finalización, en lugar de esperar a que termine el hilo de envío. Esto permite que otros hilos establezcan una nueva sesión sin demora. #99102 (Raúl Marín).
- Se usan más funciones matemáticas de LLVM-libc:
exp,exp2,expm1,fabs,fabsl,floor,fmodl,log,log2,logf,pow,scalbn,scalbnl,copysignl,nan,nanf,nanly las constantes compartidasexplogxf. #99118 (Konstantin Bogdanov). - Reducir el uso de memoria y corregir una posible duplicación de la salida en el formato collapsed de
system.jemalloc_profile_text. #99121 (Antonio Andelic). - Se añadió la columna
is_subrequestasystem.aggregated_zookeeper_logpara separar las solicitudes independientes de las subsolicitudes dentro de las solicitudes Multi/MultiRead. Anteriormente, las subsolicitudes se agregaban en las mismas agrupaciones que las solicitudes independientes y, como cada suboperación se registraba con la duración total de la solicitud múltiple, la latencia media resultaba engañosa. Las subsolicitudes ahora tienen latencia cero. #99169 (Miсhael Stetsyuk). - Permite el comando
ALTER TABLE MODIFY COLUMN x TTL ...sin especificar el tipo de columna. #99208 (Nikolay Degterinsky). - Se omiten las solicitudes obsoletas de Keeper para las sesiones que ya se han desconectado, lo que evita recorridos de ida y vuelta innecesarios de Raft. El número de sesiones finalizadas rastreadas está limitado por la configuración de coordinación
max_finished_sessions_cache_size. #99246 (Antonio Andelic). - Compatibilidad con índices de texto construidos sobre
mapValues(map)con el operadorIN. #99286 (Anton Popov). - Soporte de autocompletado similar al de una shell en clickhouse keeper-client (gestiona el autocompletado de argumentos entre comillas, es decir,
'foo ba', gestiona argumentos escapados, es decir,foo\ ba, hace quelsimprima los nodos entre comillas si contienen espacios en blanco). #99312 (Azat Khuzhin). - Se evita que el comando
mntrde Keeper se quede bloqueado por contención de bloqueos. #99472 (Antonio Andelic). - Se reduce la contención de bloqueos en el despachador de Keeper al invocar callbacks y despachar solicitudes de lectura fuera del ámbito del mutex, y se añaden guardas de bloqueo con perfilado para la observabilidad. #99751 (Antonio Andelic).
- Se tolera la ausencia de relleno al final del último bloque de archivos Parquet. #99857 (Seva Potapov).
Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)
- Corrige cómo se guarda el destino de una tabla Alias como dependencia DDL cuando no está totalmente calificado: ahora se guarda con la base de datos de la tabla Alias en lugar de con la base de datos de la sesión. #95175 (Enric Calabuig).
- Se corrigió un resultado incorrecto o una excepción durante la lectura de subcolumnas de columnas ALIAS. #95408 (Pavel Kruglov).
- Corrige la ausencia de una columna al usar un alias de identificador no estándar en JOIN con el analizador antiguo. Soluciona #25594, #47288 y #53263. #95679 (Zhigao Hong).
- Soluciona un fallo en las funciones del dialecto Kusto
bin(),bin_at(),extract()eindexof()cuando se pasan argumentos vacíos. #95736 (NeedmeFordev). - Prohíbe montar local_object_storage (que se utiliza en datalakes sobre el sistema de archivos local y, posiblemente, por LocalDisk) en cualquier lugar distinto de user_files_path en clickhouse-client. #96201 (Daniil Ivanik).
- En el motor de tablas
DeltaLake, se corrige una condición de carrera lógica al cambiar la versión de la instantánea y se eliminan recargas redundantes y costosas de la instantánea. #96226 (Kseniia Sumarokova). - Se corrigió un error lógico al hacer attach de una parte en MergeTree si se habían producido varios cambios de nombre encadenados entre el detach y el attach. #96351 (Alexey Milovidov).
- Se corrige un error por el que los ajustes explícitos enviados junto con
compatibilityen la misma solicitud podían ignorarse de forma silenciosa cuando su valor coincidía con el valor predeterminado del servidor. #97078 (Raufs Dunamalijevs). - Se corrige un problema por el que el client informaba
NETWORK_ERRORen lugar del error de parsing real (con el número de fila correcto) cuando un INSERT con parsing en paralelo encontraba datos no válidos. #97339 (Alexey Milovidov). - Corrige un problema por el que la función de agregación
sumCountno podía leer estados serializados antiguos tras la introducción deNullable(Tuple). Cierra #97370. #97502 (Nihal Z. Miaji). - Se corrigió la excepción en la comparación de tuplas que involucra elementos del tipo
Nothing(p. ej., al comparar con elementos de tuplaNULL) cuando se usa conGROUPING SETSyORDER BY. #97509 (Alexey Milovidov). - Corrige el cálculo no determinista de
uncompressed_hashpara las partes de Compact MergeTree cuando se utilizan varios códecs de compresión, lo que podía provocar un comportamiento incorrecto de deduplicación. #97522 (Alexey Milovidov). - Corrige un error lógico por la falta de stream durante INSERT SELECT con JSON y buckets en shared data. Cierra #97331. #97523 (Pavel Kruglov).
- Se corrigió el problema por el que las excepciones
MEMORY_LIMIT_EXCEEDEDse informaban incorrectamente comoCORRUPTED_DATAdurante las fusiones de SummingMergeTree y CoalescingMergeTree. #97537 (János Benjamin Antal). - Soluciona la excepción “Context has expired” en subconsultas correlacionadas que contienen funciones de tabla como
url(). #97544 (Alexey Milovidov). - Se corrigen excepciones y comportamientos incorrectos en
optimize_syntax_fuse_functionscon proyecciones de agregación, tipos Date y preservación de nombres de columna. #97545 (Alexey Milovidov). - Se elimina la reescritura incorrecta de consultas de
replaceRegexpOneaextract, que producía resultados erróneos cuando la regexp no coincidía; también se corrige una excepción cuandoreplaceRegexpOnese usa conGROUP BY ... WITH CUBEygroup_by_use_nulls=1. #97546 (Alexey Milovidov). - Se corrige el bloqueo indefinido de
DROP DATABASEcondatabase_atomic_wait_for_drop_and_detach_synchronouslycuando se fuerza la finalización de la consulta. #97586 (Alexey Milovidov). - Se corrigió un problema por el que
KILL QUERYno podía finalizar consultas bloqueadas durante la generación deWITH FILL, la carga de diccionarios mediantedictGetoALTER DELETEconmutations_sync=1enReplicatedMergeTree. #97589 (Alexey Milovidov). - La función de tabla
loopllamaba ainner_storage->read()directamente, omitiendo la capa del intérprete, donde se aplican las políticas de fila, los privilegios a nivel de columna y otras comprobaciones de seguridad. Esto permitía que un usuario restringido por políticas de fila leyera todas las filas medianteloop(table), incluso cuando un SELECT directo devolvía cero filas. #97682 (pufit). - Corrige la poda incorrecta de particiones al usar DateTime64 anterior a la época Unix con la función
toDate(). #97746 (Yarik Briukhovetskyi). - Después de este parche,
hasPartitionIddevolveráfalsesi existe otra partición con un ID de partición superior en el conjunto de partes de datos. #97748 (Mikhail Artemenko). - Se corrigen posibles fallos al leer gránulos vacíos en datos compartidos avanzados en JSON. Cierra #97563. #97778 (Pavel Kruglov).
- Se corrige
Cannot schedule a fileLOGICAL_ERRORal hacerINSERTenDistributeddebido a una condición de carrera entreDROPeINSERT. #97822 (Azat Khuzhin). - Se corrigió un cierre inesperado/fallo de aserción del servidor de ClickHouse en la llamada a
mapContainsKey/mapContainsKeyLikecon el índice de omisióntokenbf_v1. #97826 (Shankar Iyer). - Se corrigieron las excepciones
LOGICAL_ERRORcausadas porLowCardinalitydentro de tipos compuestos (Variant,Dynamic,Tuple) enconcatWithSeparator,format, las subconsultasIN,GLOBAL INy los joins con filtros en tiempo de ejecución. #97831 (Raúl Marín). - Se corrige la excepción
LOGICAL_ERRORChunk info was not set for chunk in MergingAggregatedTransformal usarARRAY JOINcon la función de tablamerge()en varias tablas Distributed combinadas conGROUP BY. #97838 (Raúl Marín). - Se corrige un cierre inesperado del servidor (
std::terminate) causado por una excepción no capturada en el destructor del grupo de conexiones HTTP cuando se alcanza el límite estricto del grupo de conexiones en condiciones de alta concurrencia. La excepciónHTTP_CONNECTION_LIMIT_REACHEDpodía propagarse desde~PooledConnectional devolver una conexión al grupo para su reutilización, lo que provocabaSIGABRT. #97850 (Antonio Andelic). - Corrige un resultado incorrecto cuando se usa el algoritmo
grace_hashcon joins no equi y el bloque de la izquierda no puede procesarse por completo debido a las restricciones de tamaño del resultado del join. #97866 (János Benjamin Antal). - Corrige la ineficiencia de rendimiento en el escaneo de metadatos de DeltaLake introducida en #96686. #97880 (Kseniia Sumarokova).
- Se corrigió una condición de carrera de datos en el client de ZooKeeper entre sendThread y receiveThread. #97887 (Pablo Marcos).
- Corrige un error por el que no era posible usar CTE con sentencias insert SELECT distribuidas. Continuación de https://github.com/ClickHouse/ClickHouse/pull/87789. Cierra #95837. #97889 (Yarik Briukhovetskyi).
- Corrige una excepción en
CachedOnDiskReadBufferFromFile::readBigAt. Cierra #97325. #97890 (Kseniia Sumarokova). - Se corrige la excepción
LOGICAL_ERRORen el motorAliascon columnas materializadas debido a un desajuste de columnas. Cierra #97907. #97921 (Kai Zhu). - Se corrige la pérdida de datos de Keeper tras un reinicio al usar Azure Blob Storage con metadatos
s3_plainpara el almacenamiento de registros. #97987 (Antonio Andelic). - Se corrige una compilación errónea del JIT de la función
signpara tipos enteros de mayor tamaño queInt8— los valores fuera del intervalo -128..127 podían producir un signo incorrecto. #98012 (Alexey Milovidov). - Se corrigió la excepción
DUPLICATE_COLUMNy la aparición silenciosa de valores NULL al leer tablas de Delta Lake que usan el modo “name” de asignación de columnas con campos de struct cuyos nombres contienen puntos (p. ej.,STRUCT<`a.foo`: STRING, `b.foo`: STRING>). #98013 (Caio Ishizaka Costa). - Se corrige la mutación tras una actualización ligera y los índices secundarios. #98044 (Raúl Marín).
- Se corrige un resultado incorrecto en las consultas FINAL al mezclar índices de salto de clave primaria y de columnas que no forman parte de la clave primaria. #98097 (Raúl Marín).
- Se aplican comprobaciones de READ ON FILE a file() escalar y a DESCRIBE TABLE file(). #98115 (Nikolay Degterinsky).
- Corrige un fallo por el que, al consultar archivos con un patrón glob (p. ej.,
file('dir/**', 'LineAsString')), se producía una excepción no controlada del sistema de archivos (STD_EXCEPTION) si el directorio contenía un enlace simbólico roto. Ahora los enlaces simbólicos rotos se omiten silenciosamente, y la consulta devuelve resultados de todos los archivos válidos. #98143 (Mark Andreev). - Se corrigió un segfault durante la optimización del plan de consulta al convertir un outer join en un inner join con
arrayJoinen una expresión de filtro. #98147 (Alexey Milovidov). - Se corrigió el problema por el que el formato
ProtobufListno funcionaba con el motor Kafka porque el estado de lectura no se restablecía entre mensajes. #98151 (Alexey Milovidov). - Corrige un fallo lógico con analyzer_compatibility_join_using_top_level_identifier y ARRAY JOIN; cierra #98164. #98179 (Vladimir Cherkasov).
- Configura el componente
Watchpara las respuestas de watch enaggregated_zookeeper_logen lugar de dejarlo vacío. #98202 (Antonio Andelic). - Si las columnas de la clave de partición no están incluidas en la clave de ordenación, la poda de particiones podría omitir por error particiones que contienen filas que deberían “prevalecer” durante la deduplicación FINAL. #98242 (Yarik Briukhovetskyi).
- Se corrige el error lógico “Bad cast from type DB::ColumnConst to DB::ColumnArray” en
kql_array_sort_asc/kql_array_sort_desccuando se llama con argumentos constantes de tipo array. #98251 (Alexey Milovidov). - Se corrigió un acceso fuera de rango en
ColumnConst::getExtremesque podía provocar un bloqueo cuandoextremes = 1está habilitado. #98263 (Alexey Milovidov). - Se corrige un posible interbloqueo cuando dos operaciones concurrentes de
MOVE PARTITIONactúan sobre el mismo par de tablas en direcciones opuestas. #98264 (Alexey Milovidov). - El servidor HTTP ahora devuelve un mensaje de error en el cuerpo de la respuesta en las respuestas 400 Bad Request causadas por cabeceras malformadas, en lugar de devolver un cuerpo vacío. #98268 (Alexey Milovidov).
- Corrige resultados incorrectos en el análisis distribuido de índices (función experimental) y en la caché de condiciones de consulta. #98269 (Azat Khuzhin).
- Se corrigió la excepción LOGICAL_ERROR “Resultado no válido de la búsqueda binaria en
MergeTreeSetIndex”, provocada por la conversióntoDateen columnas clave con datos que cruzan el umbral de 65535. #98276 (Alexey Milovidov). - Se corrige la excepción
LOGICAL_ERRORcuando un RIGHT JOIN contenido dentro de un CROSS JOIN se intercambia mediante la optimizaciónquery_plan_join_swap_tableen la ruta de código heredada del paso de JOIN. #98279 (Alexey Milovidov). - Validar los datos corruptos durante la deserialización de
DDSketchpara evitar segfaults, excepciones, bucles infinitos y OOM al leer estados corruptos de la función de agregaciónquantilesDD. #98284 (Alexey Milovidov). - Corrige LOGICAL_ERROR “Intentando ejecutar la acción PLACEHOLDER” al hacer referencia a columnas correlacionadas de consultas externas dentro de funciones lambda como
arrayMap. #98285 (Alexey Milovidov). - Se corrige una excepción por error lógico en
caseWithExpressioncuando la expresiónCASEincluyematerialize(NULL)u otros argumentosNullable(Nothing). #98290 (Alexey Milovidov). - Corregida una excepción por conversión de tipo incorrecta al filtrar la columna virtual
_tableen la table functionmerge. #98291 (Alexey Milovidov). - Se corrige un fallo esporádico de deduplicación por el que las reinserciones se deduplicaban incorrectamente debido a un orden de limpieza incoherente entre los directorios
blocks/ydeduplication_hashes/de ZooKeeper. #98293 (Alexey Milovidov). - Se corrigió una excepción al usar
ORDER BY ... WITH FILLjunto conLIMIT BY. #98361 (Alexey Milovidov). - Corrige la corrupción silenciosa de datos al insertar una columna
Datede Parquet/Arrow en una columnaEnum: ahora rechaza correctamente la conversión incompatible de tipos en lugar de almacenar valoresEnumno válidos. #98364 (Alexey Milovidov). - Corrige una excepción al leer un archivo Arrow que contiene una columna
Arrayen una tabla con una columnaNested. #98365 (Alexey Milovidov). - Se corrigen las mutaciones
MATERIALIZE INDEXyMATERIALIZE PROJECTIONque se quedaban bloqueadas cuando se eliminaba el índice o la proyección antes de que terminara la mutación. #98369 (Alexey Milovidov). - Se corrigió una excepción al leer desde
Nullable(Tuple(...))cuando el nombre de un elemento de Tuple entra en conflicto con la subcolumnanullde Nullable. #98372 (Alexey Milovidov). - Se corrigió la excepción “Column … query tree node does not have valid source node” al hacer join entre una tabla
Merge(que envuelve una tablaDistributed) y otra tabla. #98376 (Alexey Milovidov). - Corrige la conversión incorrecta de Parquet
BoolaFixedStringen el lector nativo V3, que producía bytes sin procesar en lugar de una representación de cadena. #98378 (Alexey Milovidov). - Corregido
tryGetColumnDescriptionpara filtrar las subcolumnas según el tipo de la columna padre, en consonancia con otros métodos de búsqueda de columnas. #98391 (Alexey Milovidov). - Aceptar credenciales base64 sin relleno en la autenticación HTTP Basic. Algunos clientes HTTP omiten el relleno final
=en el encabezadoAuthorization: Basic, lo que antes provocaba fallos de autenticación. #98392 (Amos Bird). - Corrige resultados incorrectos de la poda de particiones tras fusionar partes con columnas
Nullablede clave de partición, causados por límites incorrectos del índice min-max. #98405 (Amos Bird). - Se corrige una excepción poco frecuente en el ejecutor del pipeline, que podía manifestarse como
Received signal 6(solo en compilaciones de depuración) cuando la expansión del pipeline se solapa con la cancelación de la consulta debido a una condición de carrera. #98428 (Alexey Milovidov). - Se corrige la excepción “Column identifier is already registered” cuando se usa
count_distinct_optimizationcon la cláusulaQUALIFY. #98433 (Alexey Milovidov). - Se corrigió la excepción “cannot be inside Nullable type” al usar
IN/NOT INcon argumentos de columnaLowCardinality(p. ej.,a NOT IN (b)dondeaesLowCardinality(String)). #98443 (Alexey Milovidov). - Se corrigió la excepción “Pipeline stuck” en los JOIN
full_sorting_merge, causada por un interbloqueo enPingPongProcessorcuando la optimizaciónFilterBySetOnTheFlycreó una dependencia circular conMergeJoinTransform. #98454 (Alexey Milovidov). - Se corrige la excepción
LOGICAL_ERROR“Projection cannot increase the number of rows in a block” al fusionar partes con un TTL que elimina todas las filas y una proyección de agregación con una claveGROUP BYconstante. #98458 (Alexey Milovidov). - Se corrige una excepción por error lógico cuando
CROSS JOINse usa junto conINNER JOIN USING. #98459 (Alexey Milovidov). - Se corrige una desreferenciación de puntero nulo en
dictGetOrDefaultcuando el argumento de la clave esNullable. #98460 (Alexey Milovidov). - Corrige una excepción en consultas
DISTINCTal usar proyecciones de agregación cuandomaterializeprovoca diferencias de tipoLowCardinalityentre la consulta y la proyección. #98462 (Alexey Milovidov). - Se corrige la excepción LOGICAL_ERROR cuando se usa
arrayJoinen una expresión de filtro con OUTER JOIN yjoin_use_nullsactivado. #98464 (Alexey Milovidov). - Se corrigió la excepción de error lógico “La réplica decidió leer en modo WithOrder, no en ReverseOrder” al usar réplicas paralelas con
optimize_aggregation_in_order. #98467 (Alexey Milovidov). - Se corrigió un problema por el que ClickHouse Keeper desconectaba a los clientes Java de ZooKeeper después de la solicitud
addWatch. El cliente Java espera un cuerpoErrorResponsede 4 bytes en la respuesta deaddWatch, pero Keeper estaba enviando un cuerpo vacío, lo que provocabaEOFExceptiony la desconexión de la sesión. Esto rompíaCuratorCachede Apache Curator y cualquier aplicación Java que usara watches persistentes. Corrige #98079. #98499 (Antonio Andelic). - Se corrige que las métricas de Keeper
zk_followersyzk_synced_followersno disminuyeran cuando un follower deja de estar disponible. Se añaden las nuevas métricaszk_learnersyzk_synced_non_voting_followersal comando de cuatro letrasmntr. Corrige #54173. #98504 (Antonio Andelic). - Se corrigió una excepción LOGICAL_ERROR en
renameAndCommitEmptyPartsque podía producirse cuandoTRUNCATE TABLEse ejecutaba de manera concurrente conOPTIMIZE TABLEusando transacciones de MergeTree. #98508 (Alexey Milovidov). - Se corrigió un problema por el que el puerto seguro de Raft de Keeper ignoraba
cipherListydhParamsFilede la configuración deopenSSL, y siempre usaba los valores predeterminados en lugar de los especificados por el usuario. Cierra #51188. #98509 (Antonio Andelic). - Se corrigieron mensajes de log de Keeper engañosos, como “Recibir la solicitud de la sesión X tomó 9963 ms”, donde el tiempo informado en realidad se invertía en esperar inactivo en
poll()entre latidos, y no en realizar la operación en sí. Corrige #79026. #98510 (Antonio Andelic). - Corrige un resultado inesperado con read_in_order_use_virtual_row y funciones monótonas; cierra #97837. #98514 (Vladimir Cherkasov).
- Se corrige
LOGICAL_ERROR: Not-ready Set is passed as the second argument for function 'in'al usarPREWHEREcon una subconsultaINen tablas MergeTree. #98522 (Alexey Milovidov). - Se corrigen las conexiones TCP de Keeper que, al no responder a la señal de apagado, impedían el cierre ordenado del servidor. #98525 (Alexey Milovidov).
- Se corrige la excepción “No se encontró la columna de ordenación entre las salidas de ActionsDAG” cuando
query_plan_convert_join_to_inestá habilitado conquery_plan_merge_expressions = 0. #98526 (Alexey Milovidov). - Se corrige un fallo en el origen de diccionario de MongoDB con named collections. Cierra #97840. #98528 (Pablo Marcos).
- Se corrigió LOGICAL_ERROR cuando Identifier queda vacío tras la sustitución de parámetros. #98530 (Pervakov Grigorii).
- Se corrige un bloqueo mutuo en el pipeline al usar
sort_overflow_mode = 'break'junto con funciones de ventana. #98543 (Alexey Milovidov). - Se corrigió la reversión de columnas en el motor Buffer al gestionar una excepción al agregar un bloque nuevo. La lógica anterior podía provocar un estado de las columnas en memoria corrupto. #98551 (Pavel Kruglov).
- Se corrigió la excepción
Bad cast from type ColumnConst to ColumnDynamicen la comparación null-safe (<=>/IS NOT DISTINCT FROM) con columnas constDynamicoVariantyNULL. También se corrigió queIS DISTINCT FROMconDynamic/Variantfrente aNULLdevolvía siempre 0 de forma incorrecta. #98553 (Alexey Milovidov). - Se corrigió el uso del índice de texto con otros índices de omisión. Anteriormente, podían producirse errores lógicos como “Trying to get non-existing mark” cuando un filtro de consulta utilizaba simultáneamente un índice de texto y otros índices de omisión convencionales. #98555 (Anton Popov).
- Se corrige el error lógico “TABLE_FUNCTION is not allowed in expression context” cuando una función de tabla con alias aparece varias veces en el mismo ámbito de la consulta (por ejemplo, en las cláusulas
PREWHEREyQUALIFY). #98557 (Alexey Milovidov). - Corrige el análisis distribuido de índices con expresiones (no solo columnas) en la PK (lo que provoca que no se filtren gránulos redundantes en réplicas remotas). #98561 (Azat Khuzhin).
- Impedir la eliminación de una columna cuando sus subcolumnas se utilicen en expresiones default/alias de otras columnas, y usar el analizador para las expresiones default en alter drop column. #98569 (Nikita Mikhaylov).
- Se corrigió el reintento incorrecto de solicitudes de S3 ante errores no reintentables (incluido
HTTP_CONNECTION_LIMIT_REACHED) en el client HTTP. #98598 (Sema Checherinda). - Se corrige un desbordamiento decimal al aplicar la poda de particiones con DateTime64. #98628 (Yarik Briukhovetskyi).
- Corrige dos errores en la compilación JIT de expresiones: un error de copia y pega en la verificación de tipos de
nativeCastque hacía inalcanzables las ramas de conversión de entero a entero y de float a float, y unTargetMachinenulo (nullptr) incorrecto pasado a LLVMPassBuilder, lo que impedía registrar las pasadas de optimización específicas del destino. #98660 (Alexey Milovidov). - Corrige una elusión de RBAC que permitía a los usuarios ejecutar DESCRIBE sobre cualquier tabla mediante
remote(),remoteSecure(),cluster()oclusterAllReplicas()apuntando a localhost, sin requerir el privilegioSHOW_COLUMNS. #98669 (pufit). - Corrige la excepción
BAD_GETy los resultados de consulta incorrectos cuando se usa una expresión no booleana (p. ej.,sin(col)) tanto en WHERE como en SELECT con un JOIN, debido a que la optimización de push-down de filtros corrompe nodos DAG compartidos. #98681 (Alexey Milovidov). - Corrige LOGICAL_ERROR “La réplica decidió leer en modo Default, no en WithOrder” al usar
read_in_order_through_joincon réplicas paralelas. #98685 (Alexey Milovidov). - Corrige la excepción “Bad cast from type
DB::TableFunctionNodetoDB::QueryNode” al usar la función de tablainputcomo argumento deremote. #98694 (Alexey Milovidov). - Corrige la resurrección de partes de datos obsoletas causada por la limpieza incorrecta de partes vacías que las cubren. #98698 (Shaohua Wang).
- Corrige una excepción en
LogicalExpressionOptimizerPasscuando una función booleana en una comparaciónequalsdevuelve un tipoVariant. #98712 (Alexey Milovidov). - Se corrige que
parseDateTimeBestEffortanalizara incorrectamente palabras que comienzan con prefijos de nombres de meses o días de la semana. Cierra #97965. #98742 (Pavel Kruglov). - Corrige la excepción
UNKNOWN_IDENTIFIERal consultar la table functionmerge()o el engineMergeen tablas con columnas JSON que tienen parámetros distintos (p. ej., diferentes camposSKIP) y columnas ALIAS que hacen referencia a subrutas de JSON, cuando está habilitado el nuevo analizador. Cierra #97812. #98753 (Pavel Kruglov). - Se corrige la optimización
optimize_skip_unused_shardsdel analizador cuando se usa el motorDistributeden unaView. #98754 (Nikolai Kochetov). - Corrige el acceso por nombre a las subcolumnas de tuplas (p. ej.,
SELECT x.aparaTuple(a UUID, b Int32)) en las tablas externas pasadas mediante--externalenclickhouse-client. Cierra #96925. #98755 (Pavel Kruglov). - Se corrigió la excepción de
reverseUTF8con entradas UTF-8 no válidas (truncadas). #98770 (Alexey Milovidov). - Corregida la detección de la utilidad del índice de omisión Set con un predicado OR con false (es decir, or(x, 0)). #98776 (Azat Khuzhin).
- Corrige una excepción
LOGICAL_ERROR(desajuste en la estructura de bloques enremoveUnusedColumns) que podía producirse conFINAL+PREWHERE+ una expresiónWHEREconstante + agregaciones independientes de las columnas, comocount(). #98778 (Alexey Milovidov). - Las entradas de
system.trace_logpara las recargas automáticas de diccionarios de ClickHouse ahora tienen identificadores de consulta no vacíos. #98784 (Miсhael Stetsyuk). - Corrige un fallo en el que podíamos desreferenciar un puntero nulo en tablas del sistema creadas entre el momento en que tomábamos una instantánea de las tablas en la llamada a
IDatabaseTablesIterator::table()y el momento en que esas tablas cambiaban en otro hilo durante una iteración posterior. #98792 (Grant Holly). - Se corrige un problema por el que
SYSTEM START REPLICATED VIEWno activaba la tarea de actualización. #98797 (Pablo Marcos). - Corrige la excepción “Inconsistent table names” al usar la función de tabla
view()con JOINs dentro de otro JOIN (solo con el analizador antiguo). #98809 (Alexey Milovidov). - Se corrige el ajuste de RLIMIT_SIGPENDING (mediante pending_signals). #98829 (Azat Khuzhin).
- Se corrige una excepción al combinar
loopcon funciones de tabla de clúster. #98860 (Konstantin Bogdanov). - LEFT ANTI JOIN con múltiples columnas de clave de JOIN devolvía resultados incorrectos cuando
enable_join_runtime_filters=1(que es el valor predeterminado). #98871 (Alexander Gololobov). - Se corrige
WITH FILL STALENESS, que producía filas adicionales rellenadas al leer los datos en varios fragmentos (p. ej., conindex_granularitypequeño). #98895 (Alexey Milovidov). - Se corrige el error lógico “RPNBuilderFunctionTreeNode has A arguments, attempted to get argument at index B” LOGICAL_ERROR. #98900 (Azat Khuzhin).
- Corrige el desajuste en el seguimiento de memoria causado por asignaciones fallidas que no se revertían, el comportamiento indefinido de
nallocx(0)y un error de una unidad en el seguimiento del pico global. Amplía el seguimiento para abarcar los búferes circulares deio_uring. #98915 (Antonio Andelic). - Prohibir adjuntar tablas locales de lago de datos fuera de las rutas del usuario, no solo crearlas. #98936 (Daniil Ivanik).
- Se corrige una condición de carrera que podía causar la excepción “ReadBuffer is canceled” en consultas que usan
urlClustero funciones de tabla de clúster similares. #98955 (Alexey Milovidov). - Se corrige la excepción
LOGICAL_ERRORen las funciones financieras (financialNetPresentValue,financialInternalRateOfReturn, etc.) al pasar argumentos de tipoBFloat16. #98958 (Alexey Milovidov). - Se corrigen los skip indexes (y las condiciones de la clave primaria) que no se aplicaban a las columnas ALIAS cuando la fusión de expresiones del plan de consulta está deshabilitada (query_plan_merge_expressions = 0 o query_plan_enable_optimizations = 0). #98960 (Peng).
- Incrementa el evento de perfil
InsertQuerypara inserciones asíncronas. Cierra #98626. #98962 (Narasimha Pakeer). - Corrige la excepción “Comportamiento inconsistente de KeyCondition” en compilaciones de depuración cuando la clave primaria contiene valores
NaNde coma flotante, haciendo queaccurateLessyaccurateEqualsmanejenNaNde forma coherente con el orden de ordenación de ClickHouse. Cierra #98075. #98964 (Alexey Milovidov). - SummingMergeTree ya no suma las columnas de tipo Bool (ni las de otros tipos de dominio). Los valores Bool se conservan tal cual, en lugar de sumarse aritméticamente. #98976 (Yash ).
- Corrige la excepción Scalar doesn’t exist que se producía al ejecutar una consulta en un segmento remoto con
optimize_const_name_sizeactivado yenable_scalar_subquery_optimization= 0. Las constantes grandes sustituidas por referencias__getScalaren la consulta remota no se enviaban al segmento, lo que hacía que la consulta fallara. #98979 (andriibeee). - Corrige
NOT_FOUND_COLUMN_IN_BLOCKen algunas consultas conGROUP BYy expresiones que incluyen búsquedas inversas en diccionarios, comparaciones de conversiónDate/DateTimey comparaciones de tuplas. Cierra #98888. #98980 (Nihal Z. Miaji). - Se corrigió un comportamiento indefinido (desreferenciación de un puntero nulo) al cambiar una columna version/sign/is_deleted a
EPHEMERALoALIASen motores MergeTree. Ahora, esos cambios se rechazan correctamente. #98985 (Alexey Milovidov). - Se corrigió un problema por el que
system.grantsomitía, en la columnaaccess_object, los parámetros de expresiones regulares de los privilegiosURLyS3. #98987 (DQ). - Se corrigieron las lecturas de Iceberg BigLake: las credenciales de ADC ahora se reenvían al client S3 de GCS (lo que corrige errores 403), las credenciales de OAuth2 ahora se codifican para URL antes de enviarse (lo que corrige fallos de autenticación en tokens con caracteres especiales) y el recorrido del espacio de nombres ya no se aborta ante respuestas HTTP 400 de BigLake. #98998 (Nikita Fomichev).
- Se corrigió un problema por el que
clickhouse-clientno podía cambiar la zona horaria cuando la variable de entornoTZusa la sintaxis de ruta de archivo de POSIX (por ejemplo,TZ=:/etc/localtime). #99000 (Yash ). - Corrige la poda incorrecta o insuficiente cuando se usan
startsWith,LIKEyNOT LIKEcon una columnaFixedString. Además, la función de conversión de tipo deFixedStringaStringahora puede podar gránulos cuando se aplica sobre la columna clave. Cierra #98940. #99001 (Nihal Z. Miaji). - Se corrigió
windowFunnelconstrict_deduplication, que devolvía un Level incorrecto al encontrar un evento duplicado. #99003 (Yash ). - Corrige un error por el que EXISTS ignoraba las cláusulas LIMIT y OFFSET en las subconsultas, lo que provocaba resultados incorrectos cuando la subconsulta no devolvía ninguna fila debido a un OFFSET o a un límite de cero. Cierra #88722. #99005 (andriibeee).
- Se corrige la excepción “Block structure mismatch” cuando la optimización de push-down de filtros encuentra una expresión AND que se cortocircuita a una constante con
GROUPING SETS. #99010 (Alexey Milovidov). - Se corrige una excepción al leer partes de parche (actualizaciones ligeras) cuando el plan de consulta no incluye la columna
_part_offset. #99023 (Alexey Milovidov). - Una consulta como
SELECT * FROM table WHERE pk_id = '', dondepk_ides la clave primaria y es de tipoString, ahora usará correctamente el índice de clave primaria para filtrar gránulos. #99027 (Shankar Iyer). - Se corrigió la excepción
DEPENDENCIES_NOT_FOUNDen el motor Kafka cuando la vista materializada se desacopla mientras el hilo en segundo plano está transmitiendo datos. #99028 (Alexey Milovidov). - Corregida una excepción al crear una tabla con una columna
EPHEMERALcon el mismo nombre que una columna virtual (p. ej.,_part_offset). #99031 (Alexey Milovidov). - Corrige el confuso “inflate failed: error de búfer” al leer archivos comprimidos inexistentes mediante la función de tabla
url()con patrones glob. Ahora devuelve un resultado vacío, como se esperaba, cuandohttp_skip_not_found_url_for_globsestá habilitado. #99034 (Alexey Milovidov). - Se corrige un fallo del servidor (
std::terminate) al ejecutarALTER TABLE ... DROP PARTen unapatch parttras un cambio de esquema (p. ej.,ADD COLUMN). El fallo se producía por la ausencia de columnas del sistema (_part) en los metadatos de la parte de cobertura vacía, lo que provocaba una excepción no capturada dentro de unNOEXCEPT_SCOPE. #99036 (Peng). - El proceso del servidor ClickHouse podía bloquearse si se producía una excepción por excederse el límite de memoria durante una lectura de disco en caché. Esto ya se ha corregido. #99042 (Shankar Iyer).
- Corrige
LOGICAL_ERRORal consultar una tabla que tiene tanto una ROW POLICY como una columna ALIAS al usardictGet. El problema se debía a un acceso prematuro a la expresión de la tabla durante la resolución de la columna ALIAS en el nuevo analizador. #99065 (Peng). - Corrige un error por acceso fuera de rango cuando el usuario intenta consultar solo columnas virtuales de una tabla Iceberg con los datos en formato Avro. Es un caso extremadamente raro, así que no se marca como crítico. Corrige #88238. #99080 (alesapin).
- Se corrigió un fallo de segmentación en una CTE recursiva con
remote()+view(). #99081 (Konstantin Bogdanov). - Se omite el análisis adicional de índices innecesario cuando se aplica la optimización de lectura en orden. #99084 (Vladimir Cherkasov).
- Se corrigió un fallo causado por una excepción por límite de memoria lanzada durante la aplicación de un patch part. #99086 (Anton Popov).
- Se corrigió una aserción de depuración en
DDLWorkerprovocada por unfirst_failed_task_nameobsoleto después de que se eliminara una entrada de ZooKeeper durante la recuperación tras la reinicialización. #99099 (Antonio Andelic). - Se corrigió la reconstrucción de los índices de texto en las fusiones con TTL. #99107 (Anton Popov).
- Corrige un fallo en la consulta
ALTER TABLE ... REMOVE SETTINGSpara el motor de tabla Iceberg. Corrige #86330. #99108 (alesapin). - Corrige un error en la optimización
query_plan_convert_any_join_to_semi_or_anti_join, que devolvía un resultado incorrecto para las filas sin coincidencia. Relacionado: https://github.com/ClickHouse/ClickHouse/pull/95995. #99112 (Yarik Briukhovetskyi). - Se corrige la excepción LOGICAL_ERROR en
ASTColumnsExceptTransformer::transform. #99119 (Pablo Marcos). - Corrige una evasión de RBAC que permitía a los usuarios obtener la estructura de la tabla mediante
DESCRIBE TABLEoCREATE TABLE ASen funciones de tabla (mysql(),postgresql(),sqlite(),arrowFlight(),jdbc(),odbc(), etc.) sin los privilegios de acceso al origen necesarios. En funciones que infieren el esquema desde servidores remotos, esto también permitía desencadenar conexiones salientes (SSRF) sin autorización. #99122 (pufit). - Se corrigió el fallo de Keeper (segfault en NuRaft) durante la reconfiguración dinámica y la transferencia de liderazgo. #99133 (JIaQi Tang).
- Corrige un fallo al usar una tabla Buffer con SAMPLE cuando el destino no lo admite. #99141 (Kseniia Sumarokova).
- Se corrige el LOGICAL_ERROR causado por una discrepancia en el orden de las columnas de las partes de parche. #99164 (Pablo Marcos).
- Se corrige un cierre inesperado muy poco frecuente cuando una tabla Iceberg contiene archivos en formatos mixtos (ORC y Parquet). Corrige #88126. #99168 (alesapin).
- Se corrigió un problema por el que
max_execution_timeno se aplicaba a las operaciones de copia de seguridad/restauración. #99205 (Kseniia Sumarokova). - Se corrigió un problema por el que
insert_deduplication_tokense ignoraba silenciosamente en las consultasINSERT SELECTsinORDER BY ALL. Anteriormente, la deduplicación estaba completamente deshabilitada para losINSERT SELECTsin ordenar, incluso cuando se proporcionaba un token de usuario explícito. Ahora, proporcionarinsert_deduplication_tokenbasta para habilitar la deduplicación independientemente deORDER BY ALL. #99206 (Desel72). - Se corrigen las comprobaciones de acceso excesivas durante la optimización
InverseDictionaryLookupPassal comprobar el privilegioCREATE_TEMPORARY_TABLEuna sola vez antes de la pasada, en lugar de hacerlo en cada nodo visitado. #99210 (Mikhail Artemenko). - Corrige un problema por el que
clickhouse format --obfuscateproducía SQL no válido al ofuscar tipos de skip index, nombres de códecs de compresión, nombres de motores de base de datos y definiciones de layout/source de diccionarios. #99260 (Raúl Marín). - Se corrigió un error por el que, en algunos casos, la comparación entre los tipos Time[64] y DateTime[64] resultaba confusa; ahora, en casos como este, los valores de Time[64] se convierten en DateTime[64] al añadir
1970-01-01como parte de la fecha. #99267 (Yarik Briukhovetskyi). - Limitar las restricciones de configuración en el worker de DDL para las consultas DDL distribuidas. #99317 (Pablo Marcos).
- Corrige pequeños problemas en la autenticación TOTP: la opción de CLI
--one-time-passwordcon contraseña vacía y la validación de los valores de configuración<digits>y<period>. #99322 (Vladimir Cherkasov). - Se corrige el error lógico
unordered_map::at: key not founden el formato de salida Avro al serializar columnasEnum8/Enum16con valores no presentes en la definición del enum. #99332 (Desel72). - Se corrige CHECK TABLE con serialización dispersa en Tuple con Dynamic. Cierra #96588. #99351 (Pavel Kruglov).
- Se corrigió una validación excesivamente estricta del preprocesador del índice de texto. #99359 (Anton Popov).
- Se corrige un problema de compatibilidad al actualizar tablas replicadas con índices minmax implícitos de la versión 25.10 a versiones más recientes. #99392 (Raúl Marín).
- Se eliminó la compatibilidad con las funciones negadas (
notEquals,notLike,notIn) en el análisis del índice de texto. Estas funciones nunca podían descartar ningún gránulo, por lo que su análisis en el índice solo añadía sobrecarga sin aportar ningún beneficio. #99393 (Anton Popov). - Corrige
optimize_skip_unused_shardscon el nuevo analizador para el caso en que se usaba una tablaDistributeddentro de una subconsulta con IN. #99436 (Nikolai Kochetov). - Se corrige un error de tipo
heap-use-after-freeenINTERSECT/EXCEPTcuando la consulta produce nombres de columna duplicados. #99471 (Alexey Milovidov). - Se corrige un error lógico en
ALTER TABLE ... DROP PARTcuando se utiliza un parámetro de consulta tipado para el nombre de la parte. #99489 (Alexey Milovidov). - Se corrigió la excepción
NOT_FOUND_COLUMN_IN_BLOCKcuando se hacía referencia a un predicado de índice de texto (p. ej.,hasAllTokens) tanto en las cláusulasSELECTcomo enWHEREmediante un alias. #99504 (Anton Popov). - Corrige los resultados incorrectos al usar
hasAllTokenscon OR entre columnas que tienen índices de texto separados. #99505 (Anton Popov). - Inicializar la caché de páginas en
clickhouse-localpara que la opciónpage_cache_max_sizesurta efecto. #99510 (Alexey Milovidov). - Se corrigió un caso poco frecuente en el que una parte de datos se marcaba incorrectamente como dañada y se desasociaba después de la consulta
DETACH/ATTACH TABLE. #99529 (Anton Popov). - Soluciona la excepción
std::length_erroral consultar tablas del sistema vacías con el formato Pretty a través de la interfaz HTTP. #99541 (Alexey Milovidov). - Se corrigió
LOGICAL_ERRORal usarALTER TABLE ADD COLUMNpara crear una columnaEPHEMERALcon el mismo nombre que una columna virtual (p. ej.,_part_offset). #99549 (Alexey Milovidov). - Se corrigió un problema por el que las entradas de
VectorSimilarityIndexCachenunca se expulsaban tras eliminar una parte, debido a claves de caché inconsistentes. #99575 (Seva Potapov). - Se prohíbe la lectura de credenciales de Google desde un archivo local. Esta configuración es insegura porque permite leer otras credenciales si se conoce la ruta del archivo. #99584 (Konstantin Vedernikov).
- Se corrige la degradación del rendimiento en el analizador. Se eliminan de ARRAY JOIN las columnas no utilizadas. #99587 (Dmitry Novik).
- Se corrigió la lectura del índice de texto en tablas con eliminaciones ligeras y políticas de fila ya existentes. #99661 (Anton Popov).
- Se corrige una desreferenciación de nullptr en el lector de Parquet cuando la ruta filter-in-decoder encuentra páginas descartadas por el filtro. Cierra #99676. #99677 (Alexey Milovidov).
- Corrige una operación de seek incorrecta en AsynchronousReadBufferFromFileDescriptor con O_DIRECT. Cierra #99358. #99678 (Pavel Kruglov).
- Se corrigió un heap-buffer-overflow en
CompressionCodecT64y un aborto del proceso enCompressionCodecMultipleal descomprimir datos comprimidos malformados. Ambos problemas fueron detectados por nuevos targets de libFuzzer. Los códecs ahora lanzan una excepción en lugar de bloquearse. #99680 (Rahul). - Retrasar el procesamiento hasta que el servidor termine de cargar todas las tablas. #99700 (Seva Potapov).
- Se corrigió que la fuente de diccionario MySQL omitiera
RemoteHostFilterconparamsde DDL en línea. #99720 (Shaohua Wang). - Se corrige un error lógico al iterar sobre tablas de lago de datos en
system.tables. #99739 (Konstantin Vedernikov). - Se corrigió el análisis de predicados con la función
INen el índice de texto con preprocesador. Se corrigió la colisión entre los tokens buscados en el índice de texto, que podía dar lugar a resultados incorrectos. #99755 (Anton Popov). - Se corrige un bucle infinito al leer archivos en formato
Npycon dimensiones negativas en la forma. #99812 (Desel72). - Corrige un desbordamiento global de búfer en la función
CRC32con argumentosFixedStringal evaluarse con cero filas durante el cálculo de la cabecera del plan de consulta. #99835 (Alexey Milovidov). - Se corrige un bloqueo (desreferenciación de puntero nulo) al ejecutar
ALTER TABLE ... MODIFY COLUMN ... COMMENTen tablas Iceberg. #99838 (Desel72). - Se corrigió la configuración
aggregate_functions_null_for_emptypara que funcione con funciones de agregación que devuelven tipos noNullable, comoArrayoMap(por ejemplo,groupArray,sumMap). #99839 (Alexey Milovidov). - Se corrigió la excepción LOGICAL_ERROR en la función
midpointal llamarla con tipos enteros mixtos con y sin signo. #99867 (Alexey Milovidov). - Se corrige la excepción “Block structure mismatch” en consultas con cláusula HAVING en las que la expresión de filtro contiene tanto una agregación envuelta en una función que devuelve NULL como
materialize(0). #99915 (Alexey Milovidov). - Se corrige un error de aserción en
sipHash128Keyed(y funciones hash con clave similares) cuando el argumento de datos es un Map con claves de Array u otros tipos de Array anidados. #99921 (Alexey Milovidov). - Se corrigió la excepción
LOGICAL_ERROR“Not-ready Set” en la funciónINdurante la optimización del plan de consulta medianteconvertAnyJoinToSemiOrAntiJoin. #99939 (Alexey Milovidov).
mejora en compilación/pruebas/empaquetado
- Reducir el tiempo de compilación eliminando inclusiones pesadas de cabeceras y moviendo las instanciaciones costosas de plantillas fuera de las cabeceras. #97893 (Raúl Marín).
- Reducir el tiempo de compilación de las funciones aritméticas y de las cabeceras relacionadas reduciendo las matrices de despacho de plantillas y eliminando inclusiones pesadas. #98204 (Raúl Marín).
- Usar
mongo-c-driver2.2.2. #98304 (Konstantin Bogdanov). - Usar
postgresREL_18_3. #98306 (Konstantin Bogdanov). - Habilitar el jemalloc allocator para las builds de UBSan para evitar la acumulación de RSS causada por el deficiente comportamiento de recuperación de memoria de
mallocde glibc. #98444 (Alexey Milovidov). - Usar el name mangling v0 de Rust y eliminar los símbolos internos de la biblioteca PRQL para reducir la proliferación de nombres de símbolos procedente de las bibliotecas parser combinator. #98446 (Alexey Milovidov).
- Añadir la suite de benchmark TPC-H y el README de TPC-DS a
tests/benchmarks. #98495 (Raufs Dunamalijevs). - Añadir pruebas de corrección para las 99 consultas de TPC-DS. #99204 (Raufs Dunamalijevs).
- Añadir una prueba de integración que reproduce el error de DDL CREATE TABLE + ALTER con una réplica fuera de línea (#44070), marcada como fallo esperado. #99259 (Raufs Dunamalijevs).
- Integrar jemalloc con el prefijo
je_y eliminar el uso de--wrapdel enlazador. #99342 (Azat Khuzhin).
Lanzamiento de ClickHouse 26.2, 2026-02-26. Presentación, Vídeo
Cambio incompatible con versiones anteriores
- La deduplicación está activada de forma predeterminada para todas las inserciones. Antes estaba desactivada para las inserciones asíncronas y para las MV, pero activada para las inserciones síncronas. El objetivo es tener los mismos valores predeterminados en ambas formas de inserción. Si tiene la deduplicación desactivada explícitamente en su clúster, debe establecer explícitamente
deduplicate_insert='backward_compatible_choice'para mantener el comportamiento anterior. Lo mismo sucede condeduplicate_blocks_in_dependent_materialized_views. #95970 (Sema Checherinda). - Se ha mejorado el formato de almacenamiento de las estadísticas. Ahora, todas las estadísticas se almacenan en un único archivo. #93414 (Anton Popov). Si no habilitaste explícitamente las estadísticas de tablas, puedes ignorar este punto.
- Se limitan los metadatos en memoria de S3(Azure)Queue. Las tablas del sistema cambian de nombre de
azure_queueaazure_queue_metadata_cachey desystem.s3queueas3queue_metadata_cache. #95809 (Kseniia Sumarokova). - Anteriormente, al aplicar una función a una columna
Variant, se devolvía NULL de forma silenciosa cuando un subtipo deVariantera incompatible con la función; ahora se lanza una excepción, lo que puede romper consultas que dependían de ese comportamiento silencioso de NULL. #95811 (Bharat Nallan). - Las columnas
DATEde PostgreSQL ahora se infieren comoDate32en ClickHouse (en versiones anteriores se inferían comoDate, lo que provocaba un desbordamiento de los valores fuera de un rango estrecho). Se permite insertar valoresDate32de nuevo en PostgreSQL. Cierra #73084. #95999 (Alexey Milovidov). - La semántica de la configuración
do_not_merge_across_partitions_select_finalse aclaró. Anteriormente, la funcionalidad podía habilitarse automáticamente cuando la configuración no se establecía explícitamente en la configuración. Esto provocó confusión en repetidas ocasiones y, lamentablemente, dio lugar a algunos problemas en producción. Ahora, las reglas son más simples:do_not_merge_across_partitions_select_final=1habilita la funcionalidad de forma incondicional. Sido_not_merge_across_partitions_select_final=0, el modo automático se usa solo si la nueva configuraciónenable_automatic_decision_for_merging_across_partitions_for_final=1; de lo contrario, no se usa. Para preservar en la medida de lo posible el comportamiento anterior, los valores predeterminados se establecieron endo_not_merge_across_partitions_select_final=0yenable_automatic_decision_for_merging_across_partitions_for_final=1. #96110 (Nikita Taranov). - Al crear una tabla de S3 con columnas especificadas explícitamente, ClickHouse ahora valida que esos nombres de columna realmente existan en el esquema del archivo remoto. Las consultas que antes funcionaban con nombres de columna que no coincidían ahora fallarán en el momento de crear la tabla. Esto cierra #96089. #96194 (Konstantin Vedernikov).
- Se prohíbe el uso de subconsultas en ORDER BY y en otras expresiones de clave de tabla. #96847 (Alexey Milovidov).
- Se habilita
apply_row_policy_after_finalde forma predeterminada. Inicialmente, cuandooptimize_move_to_prewhere_if_final=0, tanto ROW POLICY como PREWHERE respetaban FINAL y se aplicaban después de FINAL. Esto se vio afectado por #87303, que ignorabaoptimize_move_to_prewhere_if_finalpara el filtro de ROW POLICY. Para corregirlo, este PR habilita la configuraciónapply_row_policy_after_final, introducida en #91065. Conapply_row_policy_after_finalhabilitado, ROW POLICY seguirá respetando FINAL de forma predeterminada, como antes. Este PR es un cambio incompatible porque modifica el comportamiento deoptimize_move_to_prewhere_if_final=1. Ahora, para que ROW POLICY se aplique antes de FINAL, debe usarseapply_row_policy_after_finalen lugar deoptimize_move_to_prewhere_if_final. #97279 (Nikolai Kochetov). - El tipo
Dateahora se serializa como el tipodate32nativo de Arrow en los formatos Arrow/ArrowStream, en lugar deuint16. Herramientas como PyArrow ahora reconocerán correctamente la columna como un tipo de fecha. El comportamiento anterior puede restaurarse con la configuraciónoutput_format_arrow_date_as_uint16. Se sigue admitiendo la lectura de archivos Arrow antiguos que usabanuint16para columnasDate. #96860 (Alexey Milovidov).
Nueva funcionalidad
- Ahora los usuarios pueden usar ClickStack (una UI de observabilidad) directamente desde ClickHouse, lo que resulta útil para la depuración y el desarrollo local. #96597 (Aaron Knudtson).
- Se admite la autenticación mediante contraseña de un solo uso basada en el tiempo (TOTP). #71273 (Vladimir Cherkasov).
- Añade la configuración de la base de datos
lazy_load_tables. Cuando está habilitada, las tablas no se cargan durante el arranque de la base de datos; en su lugar, se crea unStorageTableProxyligero y el table engine real se materializa al acceder por primera vez. #96283 (xiaohuanlin). - Se añadió la configuración
input_format_max_block_wait_mspara emitir bloques de datos al agotarse el tiempo de espera y se permitió procesar los datos restantes cuando una conexión HTTP se cierra de forma inesperada. #94509 (Mostafa Mohamed Salah). - Integración del catálogo de Google BigLake. Esto cierra #95339. #97104 (Konstantin Vedernikov).
- Se añadió la tabla del sistema
system.tokenizers, que muestra todos los tokenizadores disponibles. #96753 (Robert Schulze). - Añadir una nueva tabla del sistema
system.user_defined_functionspara supervisar el estado de carga y la configuración de las UDF. #90340 (Xu Jia). - Se añade la tabla
system.jemalloc_stats, que expone estadísticas del allocator de memoria jemalloc (mediantemalloc_stats_print) para diagnosticar el uso de memoria en servidores compilados con jemalloc. También se añade un endpoint HTTP/jemalloc.htmlen la interfaz HTTP de ClickHouse para visualizar interactivamente estas estadísticas. #97077 (Antonio Andelic). - Se añadió la tabla
system.jemalloc_profile_textpara leer y analizar perfiles del heap de jemalloc. El formato de salida se controla con la configuraciónjemalloc_profile_text_output_format(raw, simbolizado o collapsed; el valor predeterminado es collapsed). La resolución de frames inline se controla conjemalloc_profile_text_symbolize_with_inline(cuando está activado, los frames inline se incluyen a costa de una simbolización más lenta; cuando está desactivado, se omiten para obtener una salida más rápida). Para el formato collapsed,jemalloc_profile_text_collapsed_use_countcontrola si las pilas se ponderan por el número de asignaciones activas (true) o por bytes activos (false, valor predeterminado). Esto facilita el perfilado de memoria y la visualización de flame graphs a partir de perfiles del heap de jemalloc. Corrige #93248. #97218 (Antonio Andelic). - Añade la configuración
default_dictionary_database, que permite a ClickHouse resolver los diccionarios externos a los que se hace referencia sin un calificador de base de datos dentro de una base de datos predeterminada especificada. Esto simplifica la migración de diccionarios globales definidos en XML a diccionarios definidos en SQL por base de datos, lo que permite que las consultas de diccionario existentes (p. ej., dictGet(‘name’, …)) sigan funcionando sin cambios. #91412 (Dmitrii Plotnikov). - Soporte para ZooKeeper auxiliar en
DatabaseReplicated. #91683 (RinChanNOW). - Implementa la nueva función de tabla
primesy la nueva tabla del sistemasystem.primes, que contiene números primos en orden ascendente. Cierra #90839. #92776 (Nihal Z. Miaji). - Los async inserts admiten quorum en paralelo. Los datos insertados se replican en el quorum. Si se detectan duplicados, la consulta espera hasta que los datos insertados previamente también se repliquen. #93356 (Sema Checherinda).
- Se añadieron las funciones
colorOKLABToSRGB,colorSRGBToOKLABpara convertir valores de sRGB a OKLAB y viceversa. #93361 (Pranav Tiwari). - Un nuevo ajuste
deduplicate_insertque anulainsert_deduplicateyasync_insert_deduplicate. #94413 (Sema Checherinda). - La configuración del servidor
insert_deduplication_versionpermite realizar la migración a un hash de deduplicación unificado. #95409 (Sema Checherinda). - Se añade la función hash
xxh3_128. #96055 (Raúl Marín). - Se añadió la consulta
OPTIMIZE <table> DRY RUN PARTS <part names>para simular merges sin hacer commit de la parte resultante. Puede ser útil para pruebas: verificar la corrección del merge en la nueva versión, reproducir de forma determinista errores relacionados con merges y hacer benchmark del rendimiento de los merges de forma fiable. #96122 (Anton Popov). - Añade una nueva comprobación habilitada de forma predeterminada mediante la configuración
check_named_collection_dependenciespara evitar eliminar colecciones nombradas utilizadas por tablas. #96181 (Pablo Marcos). - Se agregó
system.fail_pointspara inspeccionar los failpoints existentes en el servidor y verificar si están habilitados o no. Esto ayudará a automatizar las pruebas. #96762 (Pedro Ferreira). - Añade acceso basado en roles al catálogo de Glue. Usa la configuración
aws_role_arny, opcionalmente,aws_role_session_name. #90825 (Antonio Andelic). - Se añadió una configuración,
add_minmax_index_for_temporal_columns, que, al habilitarse, crea automáticamente índices minmax para todas las columnasDate,Date32,Time,Time64,DateTimeyDateTime64. #93355 (Michael Jarrett). - Soporte para alias de tabla extendidos en JOINs (consultas como
SELECT * FROM (SELECT 1) AS t(a) JOIN (SELECT 1) AS u(b) ON a = b). Cierra #95131. #95331 (Yarik Briukhovetskyi). - Se añadió compatibilidad con
ALTER TABLE RENAME COLUMNpara tablas Iceberg. Antes, solo se admitíanADD COLUMN, DROP COLUMN, and MODIFY COLUMN. #97455 (murphy-4o).
Funcionalidad experimental
- El índice de texto ahora es GA. #96794 (Robert Schulze).
- El tipo de dato
QBit, para el almacenamiento vectorial cuantizado y empaquetado en bits (usado para la búsqueda aproximada de vecinos más cercanos), ahora está disponible de forma general y ya no requiere habilitar una configuración experimental. #95358 (Raufs Dunamalijevs). - La búsqueda vectorial en ClickHouse ahora puede usar réplicas en el clúster para distribuir la carga y la búsqueda entre las partes del índice vectorial. Esto permite que ClickHouse admita índices vectoriales grandes que superan la capacidad de memoria de una sola VM. #95876 (Shankar Iyer).
- Se añade un AST fuzzer del servidor controlado por las configuraciones
ast_fuzzer_runsyast_fuzzer_any_query. Cuando está habilitado, el servidor ejecuta mutaciones aleatorias de cada consulta después de su ejecución normal y descarta los resultados. #97568 (Alexey Milovidov). - Se añade la función
iifal dialecto KQL experimental. #94790 (happyso). - La inferencia de esquema ahora tiene en cuenta
allow_experimental_nullable_tuple_type. Cuando está habilitado, permite que los tipos de tupla inferidos seanNullable(Tuple(...)), de modo que los objetos anidados que falten puedan convertirse enNULLen lugar de en una tupla de elementosNULL. #95525 (Nihal Z. Miaji). - La configuración
use_statistics_cacheahora está habilitada de forma predeterminada, por lo que las estadísticas de columnas se almacenan en caché en memoria para acelerar la optimización de consultas sin necesidad de volver a cargarlas desde cada parte. #95950 (Han Fei).
Mejora del rendimiento
- Permite usar cualquier expresión determinista de la clave primaria para la omisión de datos (por ejemplo,
ORDER BY cityHash64(user_id)/ORDER BY length(user_id)). En el caso de las expresiones deterministas, ClickHouse puede aplicar la expresión a las constantes de la consulta y usar el resultado en el índice de la clave primaria para predicados como=,INyhas. Si la expresión también es inyectiva (por ejemplo,ORDER BY hex(p)oORDER BY reverse(tuple(reverse(p), hex(p)))), podemos usar eficazmente el índice para las formas negadas:!=,NOT INyNOT has. Cierra #10685. Cierra #82161. #92952 (Nihal Z. Miaji). - Se ha mejorado el formato de almacenamiento de las estadísticas. Ahora, todas las estadísticas se almacenan en un único archivo. #93414 (Anton Popov).
- Permitir la lectura en paralelo para motores de tabla y funciones remotos en la caché del sistema de archivos. #71781 (Kseniia Sumarokova).
- Se permite usar la caché de páginas en espacio de usuario con archivos locales y con funciones de tabla de almacenamiento de objetos. #77874 (Michael Kolupaev).
- Se evita el uso innecesario de
memcpyen la caché de páginas en espacio de usuario. #77884 (Michael Kolupaev). - El valor predeterminado de
concurrent_threads_schedulerahora esmax_min_fairen lugar defair_round_robin. Esto mejora la equidad cuando la carga es alta al priorizar las consultas con menos slots asignados, de modo que las consultas de corta duración no se vean penalizadas por las de larga duración. #95300 (Sergei Trifonov). - Si una consulta
FINALusaba la condición de la clave primaria para filtrar, seguida de índices de omisión para otras condiciones, el paso de procesamientoPrimaryKeyExpandahora solo comprobará la intersección de los rangos iniciales preseleccionados de la clave primaria. #94903 (Shankar Iyer). - Al usar réplicas paralelas con funciones de tabla como
s3(...), las consultas con una sola subconsulta que envuelve la función de tabla ahora se paralelizan automáticamente entre las réplicas, mientras que antes solo se paralelizaban las referencias directas a funciones de tabla. Cierra #92264. #96332 (phulv94). - Se habilita la división en segmentos separados de los archivos de datos y del sistema de la caché. #87834 (MikhailBurdukov).
- Se aceleran algunas operaciones de hash join al implementar despacho dinámico para
ColumnVector::replicate. #79573 (Raúl Marín). - Mejora del rendimiento para
parallel hash joinen casos de predicados complejos. Anteriormente, procesábamos las filas no emparejadas en un solo hilo, lo que no es óptimo; esta optimización paraleliza el procesamiento de las filas no emparejadas en varios hilos. Se puede activar o desactivar con el ajusteparallel_non_joined_rows_processing. Activado de forma predeterminada. #92068 (Yarik Briukhovetskyi). - Se optimizó ligeramente el análisis del tipo JSON. #93614 (Pavel Kruglov).
- Mejora de la huella de memoria del AST. La optimización tiene sentido, ya que los campos no se utilizan cuando no se usa el resaltado ni se analizan VALUES. #93974 (Ilya Yatsishin).
- Optimiza el consumo de memoria de los objetos AST de Tuple con nombres. Coloca los nombres de columna como cadenas en el objeto Tuple en lugar de mantenerlos en nodos literales AST genéricos. #94704 (Ilya Yatsishin).
- Se mejora la desvirtualización con opciones adicionales del enlazador. #94737 (Nikita Taranov).
- Mejora el rendimiento de la clonación de réplicas para tablas ReplicatedMergeTree con muchas partes agrupando en lotes las solicitudes a ZooKeeper. #94847 (c-end).
- Cuando la etapa de lectura ya tenía filtros PREWHERE, no se podía añadir un filtro nuevo. Este cambio pospone la optimización de PREWHERE hasta después de la optimización de filtros runtime de JOIN, para que los filtros runtime también puedan llevarse a PREWHERE. #95838 (Alexander Gololobov).
- Acelera la compresión del códec
T64usando despacho dinámico en x86. #95881 (Raúl Marín). - Se acelera
uniqpara tipos numéricos agrupando las inserciones en lotes cuando es posible (sin NULL, sin -If, sin GROUP BY y sin IPv6 ni String). #95904 (Raúl Marín). - Optimizaciones de bajo nivel para Keeper: se ha detectado que
ZooKeeper::observeOperationssupone >20% del consumo de CPU del hilo de recepción de ZooKeeper. Este cambio lo corrige de la siguiente manera: 1. ParaAggregatedZooKeeperLog::stats, se usaCityHash64en lugar deSipHash, ya que es >10x más rápido. 2. ParaCoordination::ErrorCounter, se usastd::array<std::atomic<UInt32>, N>en lugar destd::unordered_mapystd::mutex. #95962 (Miсhael Stetsyuk). - Se eliminó la alineación de 64 bytes para ProfileEvents::Counter para ahorrar memoria. #96097 (Azat Khuzhin).
- Optimización de memoria: reducir en 50 veces el tamaño de la estructura
CachedOnDiskReadBufferFromFile. #96098 (Azat Khuzhin). - No copiar los datos antiguos al redimensionar la tabla hash si está vacía. #96180 (Raúl Marín).
- Se admiten filtros de runtime de JOIN para JOINs
RIGHT OUTER. #96183 (Hechem Selmi). - La optimización
enable_join_runtime_filtersahora es la predeterminada. #89314 (Alexey Milovidov). - Anteriormente, la optimización direct read del índice de texto se aplicaba solo cuando todas las partes tenían un índice de texto materializado. Este PR añade compatibilidad parcial: si algunas partes tienen un índice de texto materializado, esas partes lo usarán, mientras que las partes sin un índice de texto materializado recurrirán a la expresión de filtro original. #96411 (Anton Popov).
- Se añadieron índices secundarios
minmaxen las columnas de tiempo e índicesbloom_filteren las columnasquery_id/initial_query_idde las tablas de logs del sistema para agilizar el filtrado. #96712 (Alexey Milovidov). - La optimización de materialización diferida ahora se aplica a todas las ramas de una consulta
UNION ALL, no solo a la primera. Las consultas que combinan varias lecturas ordenadas y limitadas de distintas tablasMergeTreemedianteUNION ALLahora se beneficiarán de la lectura diferida de columnas en cada rama, lo que reduce la E/S. #96832 (Federico Ginosa). - Optimiza el cálculo del skip index minmax durante INSERT eliminando una copia de datos innecesaria y habilitando el cálculo vectorizado de mínimos/máximos en columnas numéricas. #97392 (Raúl Marín).
- El motor
DeltaLakeahora toma el resultado decount()de los metadatos de Delta Lake y muestra las estadísticas correctas de la tabla en system.tables (bytes/filas totales). #96190 (Kseniia Sumarokova). - Las columnas no utilizadas también se eliminan del paso de lectura cuando se lee desde un MergeTree. Esto es especialmente útil cuando se hace pushdown de un filtro a
PREWHERE. #89982 (János Benjamin Antal). - Se mejoró el procesamiento de la consulta
SHOW TABLESal obtener solo los nombres de las tablas, y se mejoró getLightweightTablesIterator para que devuelva una estructura que contenga únicamente los nombres de las tablas. Resuelve #93835. #94467 (Smita Kulkarni). - Mejora
assumeNotNull,coalesceeifNullpara permitir la poda de la clave primaria y delskip indexen predicados de rango cuando las columnas clave se envuelven en estas funciones. Cierra #94689. #94754 (Nihal Z. Miaji). - Se añaden las extensiones with_data & with_stat a la solicitud getChildren de Keeper. Esto permite obtener no solo la lista de hijos, sino también su
staty/odataen una sola operación. #94826 (Nikolay Degterinsky). - El análisis de índices se realiza solo una vez (en la mayoría de los casos), independientemente de si se acaba ejecutando un plan local o uno con réplicas paralelas. #94854 (Nikita Taranov).
- Permite habilitar el análisis distribuido de índices según la cantidad de partes (
distributed_index_analysis_min_parts_to_activate) y el tamaño de los índices (distributed_index_analysis_min_indexes_size_to_activate). #95216 (Azat Khuzhin). - Se habilita la optimización de PREWHERE para tablas Iceberg. #95476 (Konstantin Vedernikov).
- Se reduce el consumo de memoria de algunas clases de AST. #95514 (Raúl Marín).
- Limita el número de flujos del pipeline generados con
split_intersecting_parts_ranges_into_layershabilitado. Ayuda a evitar un consumo excesivo de memoria. #96478 (Nikita Taranov). - Se implementó la optimización de conjuntos equivalentes para múltiples joins. Las consultas con múltiples operaciones consecutivas de
INNER JOINahora se benefician de una mejora en la optimización de pushdown de filtros. Cuando las tablas se unen por columnas equivalentes (p. ej.,t1 JOIN t2 ON t1.id = t2.id JOIN t3 ON t2.id = t3.id WHERE t1.id > 10), los filtros aplicados a cualquier tabla de la cadena se hacen pushdown automáticamente a todas las tablas. Cierra #96550. #96596 (Vladimir Cherkasov). - Optimiza el escaneo de metadata de delta lake. Incorpora cambios de la PR de delta-kernel https://github.com/delta-io/delta-kernel-rs/pull/1827. #96686 (Kseniia Sumarokova).
- En la base de datos Replicated, no actualice el clúster almacenado en caché para cada consulta de prueba. #96897 (Tuan Pham Anh).
- Utiliza el índice de clave primaria al filtrar con
startsWithUTF8si el prefijo contiene únicamente caracteres ASCII. #97055 (vkcku).
Mejora
- Añadir trazas de OpenTelemetry para las peticiones de Keeper. #91332 (Miсhael Stetsyuk).
- Nuevas opciones de configuración:
logger.startup_console_level&logger.shutdown_console_levelpara anular el nivel de registro de la consola durante el inicio y el apagado de ClickHouse, respectivamente. #95919 (Garrett Thomas). - Se respetan las sobrescrituras de la línea de comandos al recargar la configuración. Cierra #80294. #80295 (Alexey Milovidov).
- Permitir sobrescrituras de clave-valor en los parámetros de named collection de la función de tabla
mongodb. #89616 (vanchaklar). - La optimización de lectura en orden para las tablas Iceberg ahora también funciona con funciones de ordenación complejas como
icebergBucketyicebergTruncate, no solo con referencias simples a columnas. #90256 (Konstantin Vedernikov). - Se añade una nueva columna llamada parts_postpone_reasons en system.mutations para mejorar el diagnóstico, que muestra los motivos de aplazamiento de las partes. #92206 (Shaohua Wang).
- Seguimiento de los cambios en el número de filas que se van a leer (debido a inserciones/eliminaciones o al uso de la caché de condiciones de consulta) en
DataflowStatisticsCache. #93636 (Nikita Taranov). - Se admite la consulta SYSTEM RESET DDL WORKER [ON CLUSTER]. Solicita restablecer el estado de DDLWorker en su thread principal. Resulta útil para refrescar la réplica activa cuando se actualizan los ID del host. #93780 (Tuan Pham Anh).
- Se añade compatibilidad con
mutation_idsensystem.part_logpara los tipos de eventoMUTATE_PARTyMUTATE_PART_START. #93811 (Shaohua Wang). - Las operaciones en segundo plano (Mutate, Merge) ahora pueden configurarse de forma independiente a través del perfil ‘background’. Antes, estas operaciones compartían la configuración con las consultas normales mediante el perfil ‘default’. #93905 (Arsen Muk).
- Se añadió más información a
system.crash_log. #94112 #95857 (Miсhael Stetsyuk). - Se añadió la nueva métrica
QueryNonInternalpara realizar un seguimiento del número de consultas no internas en ejecución. Esta métrica se expone comoClickHouseMetrics_QueryNonInternaly ayuda a los operadores a supervisar la concurrencia de consultas con respecto al límitemax_concurrent_queries, que solo se aplica a las consultas no internas. #94284 (Ashwath Singh). - Se añade compatibilidad con la recopilación de estadísticas de bytes de entrada para columnas de partes compactas en
RuntimeDataflowStatisticsCacheUpdater. #94626 (Nikita Taranov). - Añade una comprobación para detectar una configuración incorrecta de Keeper que provoca fallos en la formación del clúster. Cierra #60932. #94682 (Konstantin Bogdanov).
- Mejorar la deserialización de prefijos JSON al cargar partes. #94848 (Pavel Kruglov).
- Refactoriza la escritura para usar el pipeline completo de INSERT, que activa las vistas materializadas en la tabla de destino. #94890 (Kai Zhu).
- Usar optimizaciones del plan de búsqueda por similitud vectorial solo si existe el índice para la columna de búsqueda. #94998 (Eduard Karacharov).
- Comprobar el límite total de memoria antes de la autenticación del usuario y lanzar
(total) memory limit exceededsi el límite total supera lo permitido. #95003 (Nikolai Kochetov). - Se añadió la opción de configuración
throw_on_unmatched_row_policiesque, cuando está habilitada, lanza una excepción si un usuario consulta una tabla que tiene políticas de filas pero ninguna de ellas se le aplica, lo que evita el comportamiento ambiguo de devolver todas las filas debido a una mala configuración del control de acceso. #95014 (Vitaly Baranov). - Actualización dinámica de los tokens de acceso de S3 en consultas largas con Unity Catalog. Esto cierra #93981. #95069 (Konstantin Vedernikov).
- Desactiva la liberación gradual de páginas sucias de jemalloc si ClickHouse está sometido a una presión de memoria sostenida durante
memory_worker_decay_adjustment_period_msmilisegundos. Vuelve a activarla si ClickHouse opera en condiciones normales durante el mismo periodo de tiempo. #95145 (Antonio Andelic). - Compatibilidad con ZooKeeper auxiliar para S3Queue mediante la configuración
keeper_pathde s3Queue. #95203 (Diego Nieto). - Se respeta
max_parts_to_merge_at_onceen las fusiones de partes con eliminación por TTL. #95315 (Kseniia Sumarokova). - Añadir
connection_addressyconnection_porta query_log para reflejar la conexión física (addressyportse reemplazan al conectarse a través de un proxy y auth_use_forwarded_address=1). #95471 (Yakov Olkhovskiy). - Corrige el cálculo incorrecto de memoria para la caché de condiciones de la consulta. El problema principal era que no se tenía en cuenta la clave de la caché, que estaba compuesta por varias cadenas (como part_name, el id de la tabla y la condición SQL completa). #95478 (Nikita Mikhaylov).
- El servidor iniciado con la configuración integrada permitirá gestionar usuarios y permisos, guardándolos en el directorio
access, igual que la configuración habitual. Esto mejora las pruebas. También se habilitaron todas las access_control_improvements en la configuración integrada y en clickhouse-local. #95481 (Alexey Milovidov). - Se mejoraron los mensajes de error de autenticación de S3 para incluir una indicación de revisar las credenciales cuando se deniega el acceso. #95648 (Gerald Latkovic).
- Se habilita la caché de estadísticas y se establece el período de actualización de la caché en 300 s. #95841 (Han Fei).
- Se añadió el nombre del componente a
system.aggregated_zookeeper_log. #95882 (Antonio Andelic). - Omitir las lecturas desde el almacenamiento de objetos al consultar las tablas
DeltaLakedesdesystem.tables. #95899 (Antonio Andelic). - Se habilita
enable_max_bytes_limit_for_min_age_to_force_mergede forma predeterminada si la configuracióncompatibilityes26.2o superior. #95917 (Christoph Wurm). - Delta Lake ya está disponible en macOS. Cierra #95979. #95985 (Alexey Milovidov).
- En versiones anteriores, al combinar expresiones ALTER en conflicto con UPDATE y RENAME COLUMN, se lanzaba un error lógico en lugar de una excepción adecuada. Cierra #70678. #96022 (Alexey Milovidov).
- Mejora la salida de ayuda de todas las aplicaciones de ClickHouse y añade una opción
--no-sudo, junto con algunas correcciones. Da continuidad a #58244 de Ilya Yatsishin. #96025 (Alexey Milovidov). - Se agregó el alias
distanceCosineparacosineDistance, ya que todas las demás funciones de distancia ya tienen un alias de este tipo. #96065 (Raufs Dunamalijevs). - Se añadió compatibilidad con la extensión
with_datade Keeper para mejorar la obtención de tablas en la base de datos Replicated. #96090 (Nikolay Degterinsky). - Se actualiza chdig a v26.2.1 (nuevas funcionalidades y compatibilidad con MacOS). #96113 (Azat Khuzhin).
- Mejora del pushdown de filtros para
numbersyprimes. ClickHouse ahora puede derivar cotas conservadoras de valores a partir de las condicionesWHEREcuando no es posible derivar cotas exactas, y restringir en consecuencia la generación de secuencias (por ejemplo, paraWHERE number % 5 < 2 AND number > 100 AND number < 300, ClickHouse solo generará números entre 100 y 300, y luego aplicará el predicado), evitando escaneos no acotados. Cierra #84853. Cierra #93913. #96115 (Nihal Z. Miaji). - Anteriormente, el formateador ponía SELECT entre paréntesis cuando había una cláusula
COMMENTpara evitar ambigüedades en el análisis sintáctico. En su lugar, ahora colocaCOMMENTantes deAS SELECT, lo que elimina la ambigüedad sin necesidad de paréntesis. #96293 (Alexey Milovidov). - La opción de configuración
allow_impersonate_userahora se encuentra dentro de la secciónaccess_control_improvements, en lugar de ser una opción de configuración del servidor independiente. #96451 (Vitaly Baranov). - Hacer que la opción de configuración
core_dump.size_limitadmita recarga en caliente, para evitar tener que reiniciar los servidores para que los cambios de configuración surtan efecto. #96524 (Miсhael Stetsyuk). - Mejora la interoperabilidad del perfilador de CPU y del perfilador en tiempo real con los tiempos de espera de socket. #96601 (Sergei Trifonov).
- Evita que reaparezcan los datos eliminados si se ejecuta ADD COLUMN poco después de la mutación DROP COLUMN. #96713 (Alexey Milovidov).
- Cambio del tipo de
function_idensystem.instrumentationde LowCardinality(Int32) a Int32. #96726 (Copilot). - La espera síncrona de las mutaciones respetará la cancelación de consultas y los límites de tiempo. #96756 (Alexey Milovidov).
- Se añadió el comando de sistema
SYSTEM RELOAD DELTA KERNEL TRACING <level>para cambiar el logging de delta-kernel, lo que puede resultar útil para la depuración. #96763 (Kseniia Sumarokova). - El filtrado por familia de direcciones IP, es decir, los ajustes
dns_allow_resolve_names_to_ipv4/ipv6, se aplica incluso si la caché de DNS está deshabilitada. #96810 (c-end). - Mejora de la introspección de jemalloc. #96840 (Azat Khuzhin).
- Se corrige la interfaz web de
/play, que arrojabaQUERY_CACHE_USED_WITH_SYSTEM_TABLEal consultar tablas del sistema. #96869 (Alexey Milovidov). - Mejora de la interfaz web: cambiar el favicon para indicar el estado de ejecución de una consulta; mostrar los errores de las consultas auxiliares (carga de bases de datos y tablas) en lugar de ignorarlos silenciosamente. Cierra #85055. #96883 (Alexey Milovidov).
- Se puede hacer clic en el panel izquierdo de la UI de
/playpara mostrar u ocultar la lista de bases de datos. #96884 (Alexey Milovidov). DROP DATABASEahora elimina las tablas en orden inverso de dependencia, lo que mejora la tolerancia a fallos cuando la base de datos contiene tablas con dependencias de carga (por ejemplo, tablasDistributedque usanjoinGet). #97057 (Alexey Milovidov).- Actualizar yaml-cpp para evitar que se omita YAML no válido. #97333 (Azat Khuzhin).
- Mostrar un indicador de carga en la barra lateral de
play.htmlmientras se cargan las tablas. #97531 (Alexey Milovidov). - Añade un botón para copiar al portapapeles los resultados sin procesar de la consulta en la interfaz web integrada (play.html). #97532 (Alexey Milovidov).
- Se corrige el ofuscador de consultas (
clickhouse-format --obfuscate) para que genere SQL que pueda analizarse en más casos. #97584 (Alexey Milovidov).
Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)
- Después de
ALTERque solo afectan a los metadatos, como ampliar los elementos de los Enums, la optimización de la agregación con proyección puede terminar provocando una excepción. #84143 (Alexey Milovidov). - Las vistas materializadas ahora usan como contexto de ejecución la base de datos en la que se crearon, lo que significa que: - es posible omitir la calificación explícita de la base de datos en los nombres a los que se hace referencia en la consulta SELECT de la vista - si no se indica una calificación explícita de la base de datos, se asume la misma base de datos en la que se creó la vista materializada. #88193 (Dmitry Kovalev).
- Corrige la sustitución de parámetros de consulta en los métodos de autenticación de CREATE USER cuando se usa ON CLUSTER. Los parámetros de consulta en los métodos de autenticación (p. ej.,
password) no se sustituían, lo que provocaba errores UNKNOWN_QUERY_PARAMETER en nodos remotos. #92777 (xiaohuanlin). - Se corrigieron inconsistencias en el análisis de índices de texto para las funciones
has,mapContainsKeyymapContainsValue. Anteriormente, las consultas que usaban estas funciones podían devolver resultados distintos dependiendo de si la expresión se evaluaba con o sin un índice de texto. #93578 (Anton Popov). - Se corrige un fallo al adjuntar una tabla a una base de datos
MaterializedPostgreSQLsidropReplicationSlotlanza una excepción durante el desenrollado de la pila. #96871 (Alexey Milovidov). - Las copias de seguridad podían hacer que el servidor fallara si se ejecutaban muchas copias de seguridad concurrentes que competían por los mismos archivos. #93659 (Alexey Milovidov).
- Corrige las consultas con réplicas paralelas y un JOIN con una tabla no MT. Cierra #92056. #93902 (Igor Nikonov).
- Corrige un problema por el cual las columnas de Iceberg con un punto en el nombre devolvían NULL como valor. #94335 (Mikhail Koviazin).
- Se corrigió el manejo de cadenas UTF-8 en
stringJaccardIndexUTF8y se mejoró el rendimiento. #94613 (Joanna Hulboj). - Corrige posibles desbordamientos en
WITH FILL STALENESS(que provocan UB y/o bucles infinitos). Corrige un posible bucle infinito debido a saltos grandes. Añade compatibilidad con el analizador antiguo (principalmente para pruebas de estrés). #94663 (Azat Khuzhin). - Se corrigen posibles consultas distribuidas que pueden quedar bloqueadas cuando los nombres de host se resuelven en varias direcciones y una réplica remota se congela. #94726 (c-end).
- Corrige un resultado no válido al unir varias expresiones de tabla, cuando la expresión de tabla más a la izquierda es una función de tabla
-Cluster. Resuelve #89996. #94748 (Konstantin Bogdanov). - Corrige la poda incorrecta de la clave primaria y del índice de omisión para predicados que involucran
toWeek,toYearWeek,toStartOfWeek,toLastDayOfWeekytoDayOfWeek, y corrige excepciones en algunas de estas funciones para consultas válidas conLowCardinality(String). #94816 (Nihal Z. Miaji). - Se elimina la omisión innecesaria de la comprobación de permisos en las consultas
ATTACHpara una vista con SQL Security. Esto evita una posible escalada de privilegios cuando un usuario adjunta una vista con un definidor sin validar el acceso requerido. #94865 (pufit). - Corrige un fallo al iniciar
ReplicatedMergeTreecausado por la eliminación simultánea de los directoriosdelete_tmp_*. #94892 (myeongjun). - Se corrige un problema por el que
INSERTen tablas Iceberg con vistas materializadas perdía información de deduplicación, lo que provocaba una excepción. #94938 (Daniil Ivanik). - Corrige un error por el que
SYSTEM DROP QUERY CACHE TAG 'TAGNAME' ON CLUSTER <CLUSTERNAME>hacía que se eliminara toda la caché del clúster. #94978 (Rory Crispin). - Mantener la granularidad constante del índice (use_const_adaptive_granularity) tras las fusiones verticales (v2 con una corrección para Nested y en general). #95013 (Azat Khuzhin).
- Corrige una condición de carrera en la caché del sistema de archivos en la versión 26.1 tras [ClickHouse/ClickHouse#82764](https://github.com/ClickHouse/ClickHouse/pull/82764). #95042 (Kseniia Sumarokova).
- Se corrige la cancelación de la table function postgresql() mediante KILL QUERY y la cancelación de consultas (Ctrl+C) en clickhouse-client. #95136 (Roman Vasin).
- Se corrigió la inferencia de tipos para columnas calificadas de tablas de origen cuando se usan varios joins con la cláusula
USING. Anteriormente, los joins posteriores actualizaban incorrectamente los tipos de las columnas subyacentes de las tablas de origen a un supertipo común, incluso cuando la columna no intervenía en ese join (p. ej., enSELECT t2.a FROM t1 LEFT JOIN t2 USING (a) LEFT JOIN t3 USING (a), la columnat2.asolo se usa en el primer join, por lo que su tipo debería ser el supertipo det1.ayt2.a, excluyendot3.a). Esto podía provocar errores lógicos o fallos cuando las funciones esperaban tipos de columna distintos de los que realmente aparecían en el plan de ejecución. #95157 (Vladimir Cherkasov). - Hacer que la transformación de la columna se realice solo una vez al obtener el contenido de la lista y de los archivos
.avrodel manifiesto. #95164 (Daniil Ivanik). - Se corrigió un cálculo incorrecto del tamaño de las columnas JSON que podía provocar un uso excesivo de memoria o estadísticas de columnas erróneas. #95207 (Azat Khuzhin).
- Se corrigió la contabilización inexacta de memoria al aplicar partes de parche grandes después de actualizaciones ligeras. Anteriormente, aplicar parches grandes podía provocar un uso excesivo de memoria y hacer que el proceso del servidor fuera finalizado por el OOM killer. #95231 (Anton Popov).
- Se corrigió un comportamiento indefinido que podía provocar resultados incorrectos o una excepción cuando una consulta distribuida con
max_parallel_replicasvolvía a una réplica local durante el análisis de índices. #95263 (Azat Khuzhin). - Se corrige la agregación de columnas dispersas para
sumy las series temporales cuandogroup_by_overflow_modese establece enany. #95301 (Mikhail Koviazin). - Corrige un problema de fiabilidad en la política de disco
plain_rewritable, donde un error de red a mitad del proceso de desvincular un archivo de metadatos podía dejar el almacenamiento en un estado incoherente. #95302 (Mikhail Artemenko). - Se sustituye Date por Date32 para Iceberg. #95322 (Konstantin Vedernikov).
- El argumento
passwordde la función de tablaredisahora se enmascarará en los logs y las tablas del sistema (p. ej.:query_log). #95325 (János Benjamin Antal). - Se corrigió un error por el que las tablas podían eliminarse o modificarse mientras una consulta distribuida seguía ejecutándose en ellas, lo que podía provocar excepciones o resultados incorrectos. #95356 (Azat Khuzhin).
- Se corrige un error lógico en algunos casos al usar
LIMIT/OFFSETnegativo en consultas distribuidas. #95357 (Nihal Z. Miaji). - Se corrigió un error por el que clickhouse-client pedía la contraseña dos veces al conectarse por ssh. #95372 (Isak Ellmer).
- Se corrige una condición de carrera en el almacenamiento S3(Azure)Queue. #95385 (Kseniia Sumarokova).
- Corrige el error del filtro de prewhere causado por expresiones lambda en prewhere. #95395 (Xiaozhe Yu).
- Se corrige
optimize_syntax_fuse_functionspara que no reescribasum/count/avgcomosumCount()cuando el argumento de agregación esNullable. Cierra #95390. #95441 (Nihal Z. Miaji). - Se evita un posible fallo en las consultas distribuidas en caso de cancelación. #95466 (Aleksandr Musorin).
- Se corrige la deduplicación del streaming desde el motor S3(Azure)Queue. #95467 (Kseniia Sumarokova).
- Se corrigió la actualización de las políticas de filas asignadas al usuario inicial en consultas distribuidas. #95469 (Vitaly Baranov).
- Se corrige la comprobación de discos cifrados sobre plain_rewritable (corrige el posible
It is not possible to register multiple plain-rewritable disks with the same object storage prefix). #95470 (Azat Khuzhin). - A la función de tabla
mergeTreeProjectionle faltaba una comprobación de acceso, lo que permitía a los usuarios sin permiso SELECT sobre una tabla (pero con permisos para funciones de tabla) leer datos de sus proyecciones. Esta corrección añade la misma comprobación de acceso que ya tienenmergeTreeIndexymergeTreeAnalyzeIndexes. #95480 (Alexey Milovidov). - Corrige un posible error lógico al leer la subcolumna de tamaño de las subcolumnas dinámicas de los tipos Dynamic/JSON. #95573 (Pavel Kruglov).
- Se corrige una regresión en la replicación sin copia (experimental) introducida por #94262, por la que las partes compartidas podían eliminarse antes de que otras réplicas terminaran de obtenerlas. #95597 (filimonov).
- Se corrige un cierre inesperado al aplicar
tupleElementa arrays de JSON. Cierra #95581. #95647 (Pavel Kruglov). - Se corrige la excepción por error lógico al usar un comodín (
*) dentro de una función lambda en una cláusula VALUES de un JOIN con USING. Cierra #93675. #95661 (Vladimir Cherkasov). - Se corrigió el error lógico
There was an error: Cannot obtain error messageal esperar un DDL distribuido y eliminar simultáneamente la base de datos Replicated. Corrige el issue #95539. #95664 (Alexander Tokmakov). - Se corrige un problema en la función
INque devolvía resultados incorrectos con valoresNULLcuandotransform_null_inestá habilitada. Cierra #65776. #95674 (Nihal Z. Miaji). - Maneja correctamente los tipos
LowCardinality NullableenCASTcuando la configuracióncast_keep_nullableestá habilitada. Cierra #95670. #95747 (Alexey Milovidov). - Corrige la compactación de datos particionados en Delta Lake. #95773 (Kseniia Sumarokova).
- Se corrige una condición de carrera en la columna Nullable de
joinen los filtros en tiempo de ejecución. #95775 (Hechem Selmi). - Se corrige un posible error lógico en una consulta con comodines (
*,table.*) yanalyzer_compatibility_join_using_top_level_identifiercuando la columnaUSINGtiene tipos distintos en las tablas y en la lista de selección. Cierra #90477. #95808 (Vladimir Cherkasov). - Se corrigieron errores de seguridad de memoria en operaciones del pool de hilos en paralelo (copias de seguridad, agregación, consultas distribuidas) que podían causar excepciones cuando se producía un error durante la programación de tareas. #95818 (Raúl Marín).
- Corrige un fallo en DROP WORKLOAD cuando se ejecuta de forma concurrente con consultas que usan el workload que se está eliminando. #95856 (Alexey Milovidov).
- Corrige la lentitud al consultar las tablas del sistema con un usuario que tiene privilegios limitados en muchas bases de datos. Cierra #89371. #95874 (pufit).
- Se corrigió la ejecución de tupleElement en JSON con rutas anidadas; antes podía dar lugar a resultados de consulta incorrectos. #95907 (Pavel Kruglov).
- Se corrigió un error
NOT_SUPPORTEDque podía producirse al usar el algoritmo de JOINdirectcon una tabla MergeTree vacía. #95935 (Vladimir Cherkasov). - Corrige un problema por el que el client no sugería ni autocompletaba nombres de alias para configuraciones; cierra #92190. #95945 (phulv94).
- Se ha corregido event_date en system.asynchronous_metric_log. #95947 (Raúl Marín).
- Se corrige el manejo de las skipping paths en el tipo de datos JSON. Anteriormente, con
JSON(SKIP path)se omitían todas las claves JSON con el prefijopath, incluso claves como"pathpath", por lo que esto podía provocar pérdida de datos en esas rutas durante elinsert. Ahora ya está corregido y solo se omite la clave"path". #95948 (Pavel Kruglov). - Una parte con proyecciones desconocidas no debe marcarse como perdida definitivamente. #95952 (Mikhail Artemenko).
- Corrige un problema por el que la cadena vacía pasaba a ser
NULLen la tablaJoincon claveNullable(String). Cierra #71414. #96002 (Alexey Milovidov). - Ahora, el motor de PostgreSQL puede leer correctamente
BOOLEAN[]. Cierra #72754. #96006 (Alexey Milovidov). - Corrige el formato
ProtobufListen el caso de lectura desde un archivo vacío. Cierra #70059. #96007 (Alexey Milovidov). - Se corrige un problema en el formato
ProtobufList, que generaba un registro fantasma en tablas vacías. Cierra #72596. #96010 (Alexey Milovidov). - Corrige la incompatibilidad de tipos en la función
ifentreUInt64eInt32en un caso inusual de consultas distribuidas y PREWHERE, con inferencia de tipos. Cierra #70017. #96012 (Alexey Milovidov). - Se corrigen las consultas compiladas con
JITque usan tiposBool. #96013 (Alexey Milovidov). - Se corrige un error lógico al leer una columna UUID de una columna TEXT de SQLite. Cierra #71263. #96016 (Alexey Milovidov).
- Corrige la conversión de tipos del motor SQLite para
DateTime,Date,UUIDy otros tipos. Cierra #73481. #96017 (Alexey Milovidov). - Los valores
FixedStringse escapaban incorrectamente en consultas a bases de datos externas como SQLite y PostgreSQL. Cierra #73519. En coautoría con @jh0x. #96019 (Alexey Milovidov). - Corrige un error de aserción en WindowTransform con un desplazamiento PRECEDING grande. Cierra #75852. #96026 (Alexey Milovidov).
- Se corrige un error que podía provocar corrupción de datos cuando las inserciones asíncronas concurrentes usan los mismos nombres de parámetro, pero contienen valores diferentes. #96035 (Seva Potapov).
- Se corrigió el período de los profilers globales (controlado por
global_profiler_real_time_period_nsyglobal_profiler_cpu_time_period_ns). En lugar del valor configurado, se usaba un valor truncado, lo que hacía que el profiler se activara con más frecuencia de la prevista. #96048 (Antonio Andelic). - Antes, si en una entrada estaba presente el archivo de datos de referencia dentro del archivo de manifiesto de Iceberg para
position delete, pero su valor era NULL, no obteníamos los límites correctos para los archivos de datos correspondientes. Este PR corrige este error. #96061 (Daniil Ivanik). - Se corrige la revocación de roles predeterminados. #96103 (Vitaly Baranov).
- Se corrige un error de uso tras liberar memoria en el análisis de índices, en una combinación poco frecuente de
use_primary_keydeshabilitado y un número muy elevado de disyunciones de condiciones que utilizan el índice. #96112 (Alexey Milovidov). - Corrige una regresión del códec
Gorillacuando un tamaño especificado explícitamente no se corresponde con el tamaño del tipo de dato y el tamaño del búfer es demasiado pequeño. En versiones anteriores, se producía una excepción durante la descompresión. Cierra #78253. #96118 (Alexey Milovidov). - Evita un interbloqueo al cargar diccionarios cuando un diccionario hace referencia a una tabla Merge que, a su vez, lo referencia de forma recursiva. Cierra #78360. #96120 (Alexey Milovidov).
- Corrección del uso de un valor no inicializado en
formatDateTimecon especificadores de formato de ancho no fijo, como los de estilo MySQL y JODA. #96133 (Alexey Milovidov). - La combinación de las opciones
use_const_adaptive_granularityeindex_granularity_bytes(que significa “granularidad no adaptativa”) provocó un cálculo erróneo del número de filas que se debían leer y una excepción. #96143 (Alexey Milovidov). - La ejecución de una mutación ALTER UPDATE no válida en tablas de almacenamiento de objetos de tipo archivo, como S3 y Azure, podía provocar una desreferenciación de nullptr. Cierra #92994. #96162 (Alexey Milovidov).
- Se corrigió un problema por el que
AccessRights::containsdevolvía resultados incorrectos con revocaciones parciales. #96170 (pufit). - Se corrigió la colisión de hash en la caché de condiciones de consulta para constantes plegadas de CTE, lo que podía provocar un resultado de consulta incorrecto. Cierra #96060. #96172 (Alexey Milovidov).
- Se corrige un posible interbloqueo en ProcessList. Puede ocurrir por una posible inversión en el orden de los bloqueos si el overcommit tracker de memoria se activa mientras añadimos una tarea al verificador de cancelación. #96182 (Antonio Andelic).
- Se corrigió un error por el que las consultas con joins externos (LEFT, RIGHT o FULL) combinados con varios INNER JOINs podían devolver resultados incorrectos debido a una reordenación no válida de joins. Cuando la condición ON de un join externo hacía referencia a columnas de varias tablas unidas previamente, el optimizador no tenía en cuenta todas las dependencias entre tablas y podía reordenar los joins de forma incorrecta, lo que provocaba la ausencia de filas. Cierra #95972. #96193 (Vladimir Cherkasov).
- Cuando una tabla no tiene estadísticas definidas, ClickHouse no debería intentar cargarlas. Esto evita cierta sobrecarga (más de 100 ms) al comprobar si existen los archivos de estadísticas. (issue #96068). #96233 (Han Fei).
- Corrige
optimize_syntax_fuse_functionspara que no reescribasum/count/avgcomosumCount()cuando el argumento de agregación esLowCardinality(Nullable). Cierra #95390. #96239 (Nihal Z. Miaji). - Se corrige la poda incorrecta de particiones con
not INynot hasen algunos casos. #96241 (Nihal Z. Miaji). - Se corrige
stack-use-after-scopeen el índice de similitud vectorial. #96259 (Alexey Milovidov). - Se corrige un problema por el que el ejecutor de pruebas no reconocía los comentarios de sugerencia de error cuando una consulta estaba precedida por un comentario SQL. #96336 (Yakov Olkhovskiy).
- Se corrige un error lógico en KeyCondition cuando una tabla tiene una clave primaria Nullable y la consulta usa la función
coalesce, cuyo primer argumento es constante. #96340 (Alexey Milovidov). - La interacción entre
GROUPING SETS,group_by_use_nullsy el tipo de datoTupleconLowCardinalityen su interior podía producir una estructura de bloques inesperada en el pipeline de consulta, lo que provocaba un error lógico. Esto surgió tras la introducción deTuplesNullable. #96358 (Alexey Milovidov). - Era posible crear una tabla con una expresión vacía
()como índice, lo que provocaba un acceso no válido a la memoria. #96363 (Alexey Milovidov). - Se corrigió un fallo del analizador antiguo cuando había JOIN y alias duplicados. #96405 (Ilya Golshtein).
- Se corrigió el error
Nested columns sizes are inconsistent with local_discriminatorsdebido a una optimización errónea del filtrado in-place para columnas Variant. #96410 (Alexey Milovidov). - Se corrige un problema por el que
CREATE TABLE ... CLONE AS ...ignoraba el calificador completo de la tabla de origen. #96415 (Hasyimi Bahrudin). - Corrige la cancelación de la función de tabla
mysqlcon KILL QUERY y al cancelar la consulta (Ctrl+C) en clickhouse-client. #96437 (Roman Vasin). - Corrige un bloqueo activo en el hilo de comprobación de cancelación de consultas con valores altos de
max_execution_time. #96450 (Sergei Trifonov). - Se corrige un error lógico en algunos casos al utilizar valores fraccionarios de
LIMIT/OFFSETen consultas distribuidas. #96475 (Nihal Z. Miaji). - Se corrige una desreferenciación de puntero nulo en ciertas expresiones con funciones lambda. #96479 (Alexey Milovidov).
- Corrige resultados erróneos cuando las columnas
LowCardinalityse convierten enNullable. #96483 (Nihal Z. Miaji). - Corrige un fallo al crear una tabla Iceberg con una cláusula
ORDER BYque hace referencia a una columna inexistente o usa un argumento posicional. Cierra #93280. #96484 (Konstantin Vedernikov). - Se corrige la excepción del filtro en tiempo de ejecución para columnas Tuple con subcampos Nullable. #96509 (Alexey Milovidov).
- Se corrige la excepción
LOGICAL_ERRORen el lector nativo de Parquet V3 cuando la columna de filtro dePREWHEREcontiene valores UInt8 no booleanos. #96594 (Alexey Milovidov). - Se corrige la regeneración implícita de índices en las tablas replicadas durante los cambios de metadatos. #96600 (Raúl Marín).
- Corrige una condición de carrera en DROP WORKLOAD. #96614 (Sergei Trifonov).
- Se corrige un error en las escrituras en tablas Iceberg por el que las inserciones en particiones podían provocar una distribución incorrecta de los datos entre los archivos de partición. #96620 (Konstantin Vedernikov).
- Se corrigió
heap-use-after-freeenCREATE TABLEcon restricciones. #96669 (Nikita Taranov). - Validar la versión witness en bech32 para evitar el desbordamiento de búfer. #96671 (Raúl Marín).
- Se corrige un error por el que
system.tablesproducía errores cuando se creaba un catálogo REST de lago de datos con una configuraciónauth_headerno válida. #96680 (Han Fei). - Se corrigió
min(timestamp), que devolvía epoch (1970-01-01) mediante_minmax_count_projectiontras una fusión de TTL cuando se filtran todas las filas de un bloque. #96703 (Raquel Barbadillo). - Se mejora la validación de la configuración
iceberg_metadata_file_pathpara evitar el path traversal y garantizar que el archivo de metadata especificado esté dentro del directorio de la tabla. #96754 (Daniil Ivanik). - Se corrige un fallo en
ifNullcon el argumentoVariantutilizado enGROUP BY. #96790 (Alexey Milovidov). - Se corrigieron las colisiones de claves de caché entre tablas con la opción
table_disk=1. #96818 (Raufs Dunamalijevs). - Se corrige que el hilo de purga de MemoryWorker se quedara bloqueado debido a una condición de carrera. #96819 (Antonio Andelic).
- No registrar en los logs datos con credenciales en catálogos Iceberg. #96831 (Konstantin Vedernikov).
- Se corrigió el código de salida de clickhouse-client tras un error del servidor. #96841 (Vitaly Baranov).
- Las consultas con CROSS JOIN y réplicas paralelas habilitadas podían devolver resultados incorrectos. Soluciona #74337. #96848 (Igor Nikonov).
- Se corrigió el error por el que fallaban las consultas
ALTER TABLE DROP COLUMNtras haberse realizado previamente una actualización ligera en la misma columna. #96861 (Anton Popov). - Corregido el desbordamiento de pila (fallo) al crear copias de seguridad en formato de archivo (
.zip,.tzst) en un discoplain_rewritablede almacenamiento de objetos. #96872 (Alexey Milovidov). - Se corrige el fallo del servidor cuando una copia de seguridad falla por falta de espacio en el disco u otros errores de E/S en el sistema de archivos de destino. #96873 (Alexey Milovidov).
- Corrección de
EXCEPT ALLyINTERSECT ALL, que no tenían en cuenta la multiplicidad de las filas y se comportaban como sus equivalentesDISTINCT. #96876 (Alexey Milovidov). - Se corrige la excepción
std::terminateenindexOfAssumeSortedal llamarse con tipos incompatibles (p. ej., un arrayIPv4con un valor de búsqueda entero). #96877 (Alexey Milovidov). - Se corrigió la excepción
Bad cast from type DB::ColumnNullable to DB::ColumnStringal usar funciones de ventana congroup_by_use_nulls = 1y CUBE/ROLLUP/GROUPING SETS. #96878 (Alexey Milovidov). - Corrige resultados incorrectos cuando las expresiones compiladas con JIT convierten
DateTimeaDateTime64(p. ej., enCASE/if/multiIfcon tiposDateTimemixtos). El valor se reinterpretaba en lugar de escalarse correctamente, lo que producía marcas de tiempo incorrectas una vez activada la compilación de expresiones. #96879 (Alexey Milovidov). - Se corrige la excepción por error lógico en
CoalescingMergeTreecuando una expresión de índice de omisión produce una columna constante (p. ej.,bloom_filtersobreifNotFinite(1, c0)para una columna entera). #96880 (Alexey Milovidov). - Se corrige el número de puerto incorrecto en el mensaje de error al conectarse accidentalmente por HTTP al puerto del protocolo nativo con TLS habilitado. #96881 (Alexey Milovidov).
- Corrección para que los
SETTINGSpor subconsulta se apliquen a las funciones de tabla comofileen CTE y subconsultas. #96882 (Alexey Milovidov). - Se corrigió una fuga de memoria en objetos BIO al leer certificados X509. #96885 (Alexey Milovidov).
- Se corrige la excepción
LOGICAL_ERRORen el analizador de consultas cuando se pasa una expresión lambda donde se espera un valor concreto (p. ej., como argumento acumulador dearrayFold). #96892 (Alexey Milovidov). - Se corrige la excepción
ColumnNullable is not compatible with originalal convertir tipos anidados complejos (Array de Tuple Nullable que contiene Map con valores Enum Nullable). #96924 (Alexey Milovidov). - Se corrige una condición de carrera en la carga paralela del diccionario
HASHEDsegmentado que, en ocasiones, podía hacer que algunas filas no se cargaran. #96953 (Alexey Milovidov). - Se corrigió una condición de carrera entre
REPLACE PARTITIONy las mutaciones en segundo plano que podía hacer que tanto los datos antiguos como los nuevos se vieran después del reemplazo. #96955 (Alexey Milovidov). - Se corrigió un problema en la función
arrayJoinque producía filas duplicadas cuando se usaba con INNER JOIN y la cláusula WHERE, debido a que la optimización parcial de push-down de predicados enviaba incorrectamente por debajo de un JOIN los filtros que conteníanarrayJoin. #96989 (Alexey Milovidov). - Corrige un fallo (SEGFAULT) en
clearCachescausado por queBlockIO::operator=no movíaquery_metadata_cache, lo que provocaba la destrucción prematura de instantáneas de almacenamiento en caché y un acceso a memoria ya liberada en el almacenamientoMergeTreeData. #96995 (Alexey Milovidov). - Se corrige un fallo de aserción en
IfTransformStringsToEnumPasscuando la funciónifotransformdevuelveNullable(String)(p. ej., conGROUP BY ... WITH CUBEygroup_by_use_nulls = true). #97002 (Alexey Milovidov). - Se corrigen los datos incorrectos escritos durante
INSERT ... SELECTconUNION ALLyJOIN, donde las columnas de texto constantes podían recibir valores erróneos tras la compactación de bloques. #97019 (Hasyimi Bahrudin). - Se corrige la excepción de
assert_cast(o la corrupción silenciosa de datos en compilaciones release) al generar estadísticas de columnas después de queALTER TABLE MODIFY COLUMNcambie el tipo de la columna. #97027 (Alexey Milovidov). - Se corrigen lecturas de memoria sin inicializar en Azure Blob Storage, el protocolo SSH y las interfaces de Arrow Flight. #97053 (Alexey Milovidov).
- Se corrigen los casos en los que los índices afectaban al resultado de las consultas con row policy/PREWHERE y FINAL. #97076 (Yarik Briukhovetskyi).
- Corrige la condición de carrera restante entre
REPLACE PARTITIONy las mutaciones en segundo plano en tablasMergeTree, que podía provocar la reaparición de datos antiguos. #97105 (Alexey Milovidov). - Corregir los índices implícitos con columnas con alias y realizar una validación completa antes de crearlos. #97115 (Raúl Marín).
- Se corrige un error lógico en
FunctionVariantAdaptorcon funciones que requieren argumentos const, comoarrayROCAUC. #97116 (Bharat Nallan). - Corregir las mutaciones atascadas cuando
PartCheckThreadvuelve a encolar unGET_PARTpara una parte ya mutada, lo que deja entradas fantasma enparts_to_do. #97162 (Alexey Milovidov). - Se corrige la estimación del número de filas del plan de consulta para subconsultas con
ORDER BY ... LIMIT, que podía hacer que el optimizador eligiera un orden de join subóptimo. #97193 (Alexander Gololobov). - Se corrige la excepción
LOGICAL_ERRORenFunctionVariantAdaptorcuando una función que opera sobre columnas Variant devuelve el tipoNothing, lo que puede ocurrir con Arrays vacíos en consultasUNION ALL. #97213 (Alexey Milovidov). - Se corrige una condición de carrera durante las operaciones de copia multiparte en S3 (por ejemplo, durante
BACKUP/RESTOREen S3) que podía provocar excepciones en caso de acceso concurrente. #97227 (Azat Khuzhin). - Se corrige la excepción
LOGICAL_ERRORcuandoarrayJoinen la cláusulaWHEREhace referencia a columnas de ambos lados de unJOIN. #97239 (Alexey Milovidov). - Se corrigió la excepción
LOGICAL_ERRORal leer la subcolumna.sizede unNullable(String)disperso en una Tuple con PREWHERE. #97264 (Alexey Milovidov). - Se corrige la excepción “El número de filas en el fragmento diferido no coincide con el número de desplazamientos” en
LazyMaterializingTransformal leer tablas con granularidad de índice no adaptativa (index_granularity_bytes = 0) usandoORDER BY ... LIMIT. #97270 (Alexey Milovidov). - Corrige que
SYSTEM RESTART REPLICApierda una tabla de la base de datos cuando falla la recreación de la tabla con una excepción no relacionada con ZooKeeper (p. ej., límite de memoria), lo que provoca desajustes en el hash de metadatos enDatabaseReplicated. #97276 (Alexey Milovidov). - El campo
readonlydesystem.merge_tree_settingsahora refleja correctamente que ciertas configuraciones de MergeTree (por ejemplo,index_granularity) son incondicionalmente de solo lectura. #97277 (Robert Schulze). - Se corrigió un cierre inesperado durante la optimización de
count()en tablasMergeTreecuando el snapshot de almacenamiento se creó sin datos. #97281 (Pablo Marcos). - Corrige un posible fallo al resolver los nombres de las funciones a partir de la información de depuración de las trazas de pila. #97294 (Azat Khuzhin).
- Soluciona un error lógico con analyzer_compatibility_join_using_top_level_identifier y las columnas ALIAS. Cierra #96228. #97297 (Vladimir Cherkasov).
- Se corrigió la excepción
LOGICAL_ERRORenapplyOrderal usar columnas con índice de texto con la cláusulaQUALIFY. #97313 (Alexey Milovidov). - La tabla del sistema
system.functionsahora muestracategories = 'Internal'para las funciones internas, en lugar decategories = ''. #97315 (Robert Schulze). - La consulta con una secuencia de RIGHT JOIN y réplicas paralelas habilitadas puede producir un resultado incorrecto. Corrige #74341. #97316 (Igor Nikonov).
- Se corrigen errores
TABLE_UUID_MISMATCHespurios que podían producirse con vistas materializadas actualizables y en otros casos en los que se cambia el nombre de las tablas. #97323 (Azat Khuzhin). - Se corrige un segfault en la copia de seguridad de
StorageKeeperMapdebido al uso de un puntero de almacenamiento colgante tras liberarlo en el lote de copia de seguridad diferido. #97336 (Alexey Milovidov). - Se corrige la función
existscon una subconsulta escalar dentro de unALTER UPDATE/DELETEcuandomutations_execute_subqueries_on_initiatorestá habilitado. La subconsulta escalar se evaluaba de forma incorrecta, lo que podía provocar un error o un comando de mutación corrupto que hiciera que la tabla no pudiera cargarse en el siguiente reinicio del servidor. #97347 (Kirill Kopnev). - Se corrige la excepción lógica
Unexpected return type from equals. Expected Nullable(UInt8). Got Const(LowCardinality(Nullable(UInt8)))al comparar NULL con una columna Variant que contiene tipos de LowCardinality. #97379 (Alexey Milovidov). - Se corrige una posible condición de carrera cuando
EXCHANGE TABLESse ejecuta en paralelo con la caché de consultas por segmentos habilitada. #97411 (Konstantin Vedernikov). - Corrige la excepción
LOGICAL_ERRORen la conversión de Array aQBitcuandonullable_sourcede un envoltorioTupleexterno reemplaza la columna de array convertida por una columna de tipo incompatible. Cierra #97389. #97413 (Alexey Milovidov). - Corrige una inconsistencia en el formateo del AST al reconstruir literales de tupla con alias entre paréntesis; por ejemplo,
(('a', 'b') AS x)se reformateaba incorrectamente comotuple(('a', 'b') AS x). #97418 (Alexey Milovidov). - Corrige una excepción durante las inserciones asíncronas con deduplicación cuando un error de análisis producía un bloque vacío con cero filas. #97460 (Sema Checherinda).
- Se corrige la excepción “El número de filas en el fragmento diferido no coincide con el número de desplazamientos” en
LazyMaterializingTransformal leer tablas con granularidad de índice no adaptativa (index_granularity_bytes = 0) medianteORDER BY ... LIMIT. #97482 (Alexey Milovidov). - Corrige la configuración de inserción en Iceberg. Añade un alias para la opción
allow_experimental_insert_into_iceberg. #97483 (Konstantin Vedernikov). - Se corrige
ACCESS_DENIEDpara los usuarios sin el permisoCREATE TEMPORARY TABLEcuando la optimizaciónoptimize_inverse_dictionary_lookupreescribe los predicadosdictGet(...). ClickHouse ahora omite esa reescritura y ejecuta la expresión original. Cierra #97269. #97484 (Nihal Z. Miaji). - Corrige un error de aserción (excepción en compilaciones de depuración o con sanitizador) en
SetyMergeTreeIndexSetal procesar columnas con subcolumnas dispersas internas (p. ej., columnasTuplede partes de MergeTree con distintos perfiles de serialización dispersa). #97493 (Alexey Milovidov). - Corrige un posible uso de memoria después de liberarla en StorageKafka2. #97520 (Bharat Nallan).
- Se corrige el uso de
INTO OUTFILEconTRUNCATEy la opcióninto_outfile_create_parent_directoriescuando la ruta de salida contiene directorios. #97549 (Alexey Milovidov). - Se corrigió el error
BAD_ARGUMENTSal consultar tablas con expresiones lambda dentro de columnas ALIAS mediante la table functionmerge()con el analizador habilitado. #97551 (Alexey Milovidov). - Se corrige la excepción de
system.zookeeper_infocuando el zxid de Keeper es 0. #97553 (Alexey Milovidov). - Corrige un posible error lógico en el diccionario
ip_triecuando el tipo de clave no es String. #97555 (Bharat Nallan). - Se corrigió un problema por el que la autenticación OAuth del catálogo REST no funcionaba para el
RestCatalogbase (solo funcionaba para catálogos derivados comoOneLakeCatalog). Esto rompió el catálogo REST predeterminado tras la introducción del catálogo BigLake. #97561 (Konstantin Vedernikov). - Las funciones de Geometry (
perimeterSpherical,areaSpherical, etc.) ahora aceptan subtipos geométricos individuales (Polygon,Ring,Point, etc.), además del tipo VariantGeometry. #97571 (Alexey Milovidov). - Se corrige la excepción
LOGICAL_ERRORal usarisNull/isNotNullsobre subcolumnas de tiposNullable(Tuple(... Nullable(T) ...)). Cierra #97224. #97582 (Alexey Milovidov). - Corrige la desreferenciación de un puntero nulo al aplicar partes de parche durante las actualizaciones ligeras. #97583 (Alexey Milovidov).
BaseSettings::readBinarypasa el índice deaccessor.findafield_infos[]sin comprobar el valor centinela que indica que no se encontró (es decir,-1), lo que puede provocar un acceso fuera de los límites destd::vector. El problema se detectó gracias al endurecimiento de libcxx. Esto probablemente ocurrió durante la deserialización del plan de consulta, cuando un servidor más reciente envía un ajuste que un servidor más antiguo no reconoce. El método de lectura basado en cadenas ya gestiona esto correctamente; areadBinaryle faltaba esa misma comprobación. #97585 (Miсhael Stetsyuk).- Corrige resultados incorrectos en consultas
UNION ALLen las que una rama tenía un predicado siempre falso: la rama leía datos indebidamente en lugar de no devolver nada. #97620 (Bharat Nallan). - Se corrigió el fallo de
IN (col)con una referencia de una sola columna que provocaba el errorUNSUPPORTED_METHOD. #97646 (Alexey Milovidov). - Se corrigió la excepción por error lógico durante
GROUP BY ... WITH ROLLUP/CUBEcuando las claves incluyenLowCardinality(Nullable(...))dentro deNullable(Tuple(...)). #97647 (Alexey Milovidov). - Se corrigió una inconsistencia en el formato del AST para
NOT (1, 1, 1)que podía provocarLOGICAL_ERRORen builds de depuración. #97653 (Alexey Milovidov). - Corrige la excepción de
keeper-converteral encontrarse con archivos de registro de transacciones de ZooKeeper vacíos. #97673 (Alexey Milovidov).
Mejora en compilación/pruebas/empaquetado
- ClickHouse puede compilarse con clang-23 (master). #95578 (Alexey Milovidov).
- Se corrige
is_localpara forzarlo a false cuandobind_hostestá configurado, y se sustituye por una prueba de integración. Seguimiento de #74741. #93109 #96018 (Zhigao Hong). - Pruebas de estrés: se corrigen las pruebas de estrés y de actualización en CI. se ignoran las etiquetas
no-{build}. se añade aleatorización de compatibilidad. #94693 (Nikita Fomichev). - Publicar el binario parser_memory_profiler de la compilación. La herramienta puede usarse para analizar el consumo de memoria del AST. #95826 (Ilya Yatsishin).
- Se agregó la marca
--symbolizepara la herramientaparser_memory_profiler, que genera archivos.heap.symcon los símbolos resueltos en la salida. #96477 (Ilya Yatsishin). - Se fijan las imágenes de Docker de terceros en versiones específicas para las pruebas de integración. #96500 (Alexey Milovidov).
- Se vuelve a habilitar la posibilidad de enlazar
OpenSSLdinámicamente. No se recomienda y no se utiliza en ninguna compilación de producción, pero la opción sigue existiendo para los entusiastas de internet. #96506 (Govind R Nair). - Reduce el rango de
magic_enumde [-100, 1000] al valor predeterminado [-128, 127] mediante una especialización por tipo paraCoordination::OpNum, lo que mejora el tiempo de compilación. #96632 (Alexey Milovidov). - Se eliminaron los templates de C++ innecesarios de las clases Function para reducir los tiempos de compilación. #96646 (Alexey Milovidov).
- Se traslada la generación de
StorageSystemLicensesa la fase de configuración para mejorar el paralelismo de la compilación. #96697 (Alexey Milovidov). - Se paraleliza el escaneo de licencias. #96727 (Raúl Marín).
- Añadida una prueba funcional sin estado para el soporte del protocolo SSH. #96996 (Alexey Milovidov).
- Se añadió Kafka 3.9.0 a la infraestructura de pruebas funcionales sin estado, lo que permite probar directamente los motores de tabla Kafka y Kafka2 usando ClickHouse Keeper como ZooKeeper. Seis nuevas pruebas sin estado cubren las operaciones básicas de producción y consumo, las columnas virtuales, INSERT, varios formatos, la gestión de mensajes corruptos y el almacenamiento de offsets basado en Keeper. #96997 (Alexey Milovidov).
- Se añade un flujo de trabajo de CI para compilar una toolchain de clang optimizada con PGO+BOLT. #96991 (Alexey Milovidov).
- Usar la compilación de LLVM/Clang optimizada con PGO en CI, lo que debería mejorar la velocidad de compilación entre un 20 y un 30 %. #97031 (Alexey Milovidov).
- Se reemplazan las funciones matemáticas de glibc por implementaciones de llvm-libc. #90151 (Konstantin Bogdanov).
- Se actualiza Boost de 1.83 a 1.90 y se corrige un fallo de aserción de
devectoren compilaciones de depuración. #97037 (Alexey Milovidov). - Se actualizó
postgresa REL_18_1. #95189 (Konstantin Bogdanov). - Se usa
libexpat2.7.3. #95218 (Konstantin Bogdanov). - Usar
OpenSSL3.5.5. #95345 (Konstantin Bogdanov). - Se usa
simdjsonv4.2.4. #97129 (Konstantin Bogdanov). - Se usa
libarchive3.8.5. #97131 (Konstantin Bogdanov). - Se usa
fast_floatv8.2.3. #97133 (Konstantin Bogdanov). - Usar
abseil-cpp20260107.1 y actualizars2geometrya la versión v0.13.1. #97134 (Konstantin Bogdanov). - Aumenta
libxml2a 2.15.1. #95574 (Robert Schulze). - Se actualizaron 7 imágenes de Docker para pruebas de integración de Tier-3, sustituyendo imágenes base obsoletas (EOL) o retiradas por versiones compatibles actuales. #97314 (Rahul).
- Se añaden consultas del benchmark TPC-DS. #97349 (Raufs Dunamalijevs).
- Sustituye las opciones individuales de CMake para el conjunto de instrucciones x86 (
ENABLE_SSSE3,ENABLE_AVX2,NO_SSE3_OR_HIGHER,ARCH_NATIVE, etc.) por una única opción numéricaX86_ARCH_LEVEL(1/2/3/4), en línea con los niveles estándar de microarquitectura x86-64 ya utilizados por el sistema de despacho en runtime. #97354 (Raúl Marín). - Se evita instanciar variantes de plantilla de
division_by_nullable=truepara operaciones que no son de división enFunctionBinaryArithmetic, lo que reduce el tiempo de compilación y el tamaño del binario. #97496 (Raúl Marín). - Reduce la huella de inclusión de
Exception.heliminándolo de archivos de cabecera muy referenciados, comotypeid_cast.h,assert_cast.h,Context_fwd.h,IDataType.hy varios archivos de cabecera de Column. #97497 (Raúl Marín). - Use siempre las cabeceras integradas de
compiler-rt(sanitizadory las interfaces de XRay) en lugar de las cabeceras del compilador del sistema, y compile de forma predeterminada las bibliotecascompiler-rta partir del código fuente. #97499 (Raúl Marín). - Se evita incluir las cabeceras de boost/multiprecision en
wide_integer_impl.hen plataformas con unlong doubleadecuado, lo que mejora el tiempo de compilación. #96633 (Alexey Milovidov). - Implementar el job de cobertura de código con LLVM y habilitarlo inicialmente para la rama master. #90952 (Alexey Bakharew).
- Se habilita el hardening rápido de libcxx para las compilaciones de release. Esto es necesario principalmente para las comprobaciones de acceso fuera de límites. Dados los resultados de las pruebas de rendimiento, no se espera ningún impacto perceptible en el rendimiento. #94757 (Miсhael Stetsyuk).
Lanzamiento de ClickHouse 26.1, 2026-01-29. Presentación, Vídeo
Cambio incompatible con versiones anteriores
- Corrige el formato inconsistente causado por una sustitución incorrecta de alias en el formateador. Esto cierra #82833. Esto cierra #82832. Esto cierra #68296. Este cambio podría no ser compatible con versiones anteriores: cuando el analizador está deshabilitado, ciertas consultas CREATE VIEW con IN que hacen referencia a un alias no pueden procesarse. Para evitar esta incompatibilidad, habilite el analizador (está habilitado de forma predeterminada desde la versión 24.3). #82838 (Alexey Milovidov).
- Los códecs
DEFLATE_QPLyZSTD_QATse eliminaron. Se recomienda a los usuarios convertir los datos existentes comprimidos conDEFLATE_QPLoZSTD_QATa otro códec antes de actualizar. Tenga en cuenta que, para usar estos códecs, era necesario habilitar los ajustesenable_deflate_qpl_codecyenable_zstd_qat_codec. #92150 (Robert Schulze). - Mejora la depuración de UDF al habilitar la captura de stderr en
system.query_log.exception. Anteriormente, el stderr de las UDF solo se registraba en archivos y no se exponía en los registros de consultas, lo que hacía imposible la depuración. Ahora, stderr genera excepciones de forma predeterminada y se acumula por completo (hasta 1 MB) antes de lanzarse, por lo que las trazas completas de Python y los mensajes de error aparecen ensystem.query_log.exception, lo que facilita una solución eficaz de problemas. #92209 (Xu Jia). - La lista vacía de columnas en la cláusula
JOIN USING ()ahora se considera un error de sintaxis. Anteriormente, debía producirINVALID_JOIN_ON_EXPRESSIONdurante la ejecución de la consulta. En algunos casos, como al realizar un join con el motor de almacenamientoJoin, esto provocabaLOGICAL_ERROR; cierra el issue #82502. #92371 (Vladimir Cherkasov). - Utiliza la coincidencia parcial para SKIP REGEXP en el tipo JSON de forma predeterminada. Cierra #79250. #92847 (Pavel Kruglov).
- Se revierte “Allow INSERT into simple ALIAS columns” (revierte ClickHouse/ClickHouse#84154). No funciona con formatos personalizados y no está protegido por ninguna configuración. #92849 (Azat Khuzhin).
- Configuración para devolver un error si un catálogo de lago de datos no tiene acceso al almacenamiento de objetos. #93606 (Konstantin Vedernikov).
- Se ha eliminado el motor de base de datos
Lazyy ya no está disponible. Cierra #91231. #93627 (Alexey Milovidov). - Se elimina el modo
transposed_with_wide_viewdemetric_log, ya que no se puede usar debido a un error. Ya no es posible definirsystem.metric_logcon este modo. Esto revierte parcialmente #78412. #93867 (Alexey Milovidov). - La planificación de CPU para las cargas de trabajo ahora es preventiva de forma predeterminada. Consulte la configuración del servidor
cpu_slot_preemption. #94060 (Sergei Trifonov). - Se escapan los nombres de archivo de los índices para evitar partes dañadas. Con este cambio, ClickHouse no podrá cargar índices con caracteres no ASCII en su nombre creados por versiones anteriores. Para resolverlo, puede usar la configuración de MergeTree
escape_index_filenames. #94079 (Raúl Marín). - Las configuraciones de formato
exact_rows_before_limit,rows_before_aggregation,cross_to_inner_join_rewrite,regexp_dict_allow_hyperscan,regexp_dict_flag_case_insensitive,regexp_dict_flag_dotallydictionary_use_async_executorpasaron a ser configuraciones normales (no de formato). Se trata de un cambio puramente interno, sin efectos visibles para el usuario, salvo en el caso (poco probable) de que haya especificado alguna de estas configuraciones en definiciones de table engine de Iceberg o DeltaLake o Kafka o S3 o S3Queue o Azure o Hive o RabbitMQ o Set o FileLog o NATS. En esos casos, estas configuraciones antes se ignoraban; ahora, esas definiciones generan un error. #94106 (Robert Schulze). - Las funciones
joinGet/joinGetOrNullahora exigen privilegiosSELECTsobre la tabla Join subyacente. Después de este cambio, ejecutarjoinGet('db.table', 'column', key)requiere que el usuario tenga el privilegioSELECTtanto sobre las columnas clave definidas en la tabla Join como sobre la columna de atributo recuperada. Las consultas que no cuenten con estos privilegios fallarán conACCESS_DENIED. Para migrar, otorgue los permisos necesarios medianteGRANT SELECT ON db.join_table TO userpara acceso completo a la tabla, oGRANT SELECT(key_col, attr_col) ON db.join_table TO userpara acceso a nivel de columna. Este cambio afecta a todos los usuarios y aplicaciones que dependen dejoinGet/joinGetOrNullen los casos en que antes no se hubieran configurado privilegiosSELECTexplícitos. #94307 (Vladimir Cherkasov). - Se comprueba
SHOW COLUMNSpara las consultasCREATE TABLE ... AS .... Anteriormente, se comprobabaSHOW TABLES, lo que supone un privilegio incorrecto para este tipo de comprobación de permisos. #94556 (pufit). - Hacer que el formato de salida
Hashsea independiente del tamaño de los bloques. #94503 (Alexey Milovidov). Tenga en cuenta que esto cambia los valores hash de salida con respecto a las versiones anteriores.
Nueva funcionalidad
- API HTTP y Web UI integrada para ClickHouse Keeper. #78181 (pufit y speeedmaster).
- La deduplicación de async insert ahora funciona con vistas materializadas dependientes. Cuando se produce una colisión por block_id, el bloque original se filtra para eliminar las filas asociadas a ese block_id, y las filas restantes se transforman con todas las consultas SELECT de las vistas materializadas pertinentes; esto reconstruye el bloque original sin las filas en conflicto. #89140 (Sema Checherinda). Se permite usar deduplicación con async inserts cuando intervienen vistas materializadas. #93957 (Sema Checherinda).
- Se introdujeron una nueva sintaxis y un nuevo framework para simplificar y ampliar la funcionalidad de los índices de proyección. Esto da continuidad a https://github.com/ClickHouse/ClickHouse/pull/81021. #91844 (Amos Bird).
- Se añade soporte para índices de texto en columnas
Array. #89895 (Jimmy Aguilar Mena). - Se habilita
use_variant_as_common_typede forma predeterminada, lo que permite usar tipos incompatibles dentro de unArray, en consultasUNIONy en las ramas deif/multiIf/case. #90677 (Alexey Milovidov). - Nueva tabla del sistema
zookeeper_info. Implementa #88014. #90809 (Smita Kulkarni). - Se admite el tipo
Varianten todas las funciones. #90900 (Bharat Nallan). - Agrega una métrica
ClickHouse_Infoal endpoint/metricsde Prometheus que contiene principalmente información sobre la versión, lo que permite crear gráficos para seguir información detallada de la versión a lo largo del tiempo. #91125 (Christoph Wurm). - Se introduce un nuevo comando
rcfgde cuatro letras para Keeper que permite cambiar la configuración del clúster. Este comando ofrece más posibilidades para modificar la configuración que la solicitud estándarreconfigure. El comando recibe una cadenajsoncomo argumento. El conjunto completo de bytes enviados a la interfaz TCP debe tener este aspecto:rcfg{json_string_length_big_endian}{json_string}. Algunos ejemplos del comando podrían ser así:{"preconditions": {"leaders": [1, 2], "members": [1, 2, 3, 4, 5]}, "actions": [{"transfer_leadership": [3]}, {"remove_members": [1, 2]}, {"set_priority": [{"id": 4, "priority": 100}, {"id": 5, "priority": 100}]}, {"transfer_leadership": [4, 5]}, {"set_priority": [{"id": 3, "priority": 0}]}]}. #91354 (alesapin). - Se agrega la función
reverseBySeparator, que invierte el orden de las subcadenas de una cadena delimitadas por un separador especificado. Cierra #91463. #91780 (Xuewei Wang). - Añade la nueva configuración
max_insert_block_size_bytes, que permite un control más preciso de la formación de los bloques insertados. #92833 (Kirill Kopnev). - Es posible ejecutar consultas DDL con la cláusula
ON CLUSTERen una base de datos Replicated si está habilitada la configuraciónignore_on_cluster_for_replicated_database. En este caso, se ignorará el nombre del clúster. #92872 (Kirill). - Se implementó la función
mergeTreeAnalyzeIndexes. #92954 (Azat Khuzhin). - Se agregó la nueva configuración
use_primary_key. Establézcala enfalsepara desactivar la poda de gránulos según la clave primaria. #93319 (Nihal Z. Miaji). - Se añadió la función de tabla
icebergLocalCluster. #93323 (Anton Ivashkin). - Se añadió la función
cosineDistanceTransposed, que aproxima la distancia de coseno entre dos puntos. #93621 (Raufs Dunamalijevs). - Se añade la columna
filesa la tabla system.parts, que muestra el número de archivos en cada parte de datos. #94337 (Match). - Añade un scheduler max-min fair para el control de la concurrencia. Proporciona una mayor equidad en situaciones de sobreasignación elevada, cuando muchas consultas compiten por slots de CPU limitados. Las consultas de corta duración no se ven penalizadas por las de larga duración, que han acumulado más slots con el tiempo. Se habilita con el valor
max_min_fairde la configuración de servidorconcurrent_threads_scheduler. #94732 (Sergei Trifonov). - Se añadió la posibilidad de que ClickHouse client sobrescriba el SNI de TLS al conectarse al servidor. #89761 (Matt Klein).
- Admite tablas temporales en las llamadas a la función
joinGet. #92973 (Eduard Karacharov). - Admite vectores de eliminación en el motor de tabla
DeltaLake. #93852 (Kseniia Sumarokova). - Se admiten vectores de eliminación en
deltaLakeCluster. #94365 (Kseniia Sumarokova). - Compatibilidad con Google Cloud Storage para lagos de datos. #93866 (Konstantin Vedernikov).
Funcionalidad experimental
QBitpasa de Experimental a Beta. #93816 (Raufs Dunamalijevs).- Se añade compatibilidad con
Nullable(Tuple). Estableceallow_experimental_nullable_tuple_type = 1para habilitarlo. #89643 (Nihal Z. Miaji). - Compatibilidad con el catálogo REST de Paimon, como continuación de https://github.com/ClickHouse/ClickHouse/pull/84423. #92011 (JIaQi Tang).
Mejora del rendimiento
- La configuración
use_skip_indexes_on_data_readahora está habilitada de forma predeterminada. Esta configuración permite filtrar de forma continua al mismo tiempo que se leen los datos, lo que mejora el rendimiento de las consultas y el tiempo de arranque. #93407 (Shankar Iyer). - Mejora el rendimiento de
DISTINCTen las columnasLowCardinality. Cierra #5917. #91639 (Nihal Z. Miaji). - Optimizar la función de agregación
distinctJSONPathspara que lea únicamente las rutas JSON de las partes de datos, en lugar de toda la columna JSON. #92196 (Pavel Kruglov). - Más filtros aplicados con pushdown en JOINs. #85556 (Nikita Taranov).
- Se amplía la compatibilidad con más casos de push down desde la condición ON del join cuando el filtro usa entradas de un solo lado. Se admiten joins
ANY,SEMIyANTI. #92584 (Dmitry Novik). - Permite usar conjuntos equivalentes para hacer push down de filtros en
SEMI JOIN. Cierra #85239. #92837 (Dmitry Novik). - Omitir la lectura del lado izquierdo del hash join cuando el lado derecho está vacío. Antes leíamos el lado izquierdo hasta el primer bloque no vacío, lo que podía implicar mucho trabajo en casos con mucho filtrado o agregación. #94062 (Alexander Gololobov).
- Uso del método “fastrange” (Daniel Lemire) para particionar datos dentro de la canalización de consultas. Esto podría mejorar la ordenación paralela y los JOINs. #93080 (Alexey Milovidov).
- Mejora el rendimiento de las funciones de ventana cuando
PARTITION BYcoincide con la clave de ordenación o es un prefijo de ella. #87299 (Nikita Taranov). - Se hace pushdown del filtro externo en las vistas, lo que permite aplicar PREWHERE en nodos locales y remotos. Resuelve #88189. #88316 (Igor Nikonov).
- Se implementan compilaciones JIT para más funciones. Cierra #73509. #88770 (Alexey Milovidov con Taiyang Li).
- Si un índice de salto utilizado en una consulta
FINALestá en una columna que forma parte de la clave primaria, el paso adicional para comprobar la intersección con la clave primaria en otras partes es innecesario y ya no se realiza. Resuelve #85897. #93899 (Shankar Iyer). - Optimiza el rendimiento y el uso de memoria de
LIMITyOFFSETfraccionarios. #91167 (Ahmed Gouda). - Se corrige el uso de una lógica de lectura aleatoria más rápida en el prefetcher de Parquet Reader V3. Cierra #90890. #91435 (Arsen Muk).
- Mejora el rendimiento de
icebergCluster. Cierra #91462. #91537 (Yang Jiang). - No filtrar por columnas virtuales con filtros constantes. #91588 (c-end).
- Reduce el uso de memoria de INSERT/merges con wide parts en tablas muy anchas al habilitar búferes de escritura adaptativos. Añade compatibilidad con búferes de escritura adaptativos para discos cifrados. #92250 (Azat Khuzhin).
- Se mejoró el rendimiento de la búsqueda de texto completo con índice de texto y el tokenizador
sparseGramsal reducir el número de tokens buscados en el índice. #93078 (Anton Popov). - La función
isValidASCIIse optimizó para casos positivos, es decir, valores de entrada compuestos únicamente por caracteres ASCII. #93347 (Robert Schulze). - La optimización de lectura en orden ahora detecta cuándo las columnas de ORDER BY son constantes debido a las condiciones de WHERE, lo que permite realizar lecturas eficientes en orden inverso. Esto beneficia a consultas multi-tenant como
WHERE tenant='42' ORDER BY tenant, event_time DESC, que ahora pueden usar InReverseOrder en lugar de requerir una ordenación completa.”. #94103 (matanper). - Se introduce una clase especializada del AST de enum para almacenar parámetros de valor como pares (cadena, entero) en lugar de nodos ASTLiteral, con el fin de optimizar el consumo de memoria. #94178 (Ilya Yatsishin).
- Análisis distribuido de índices en varias réplicas. Resulta beneficioso para el almacenamiento compartido y para grandes volúmenes de datos en un clúster. Esto se aplica a SharedMergeTree (ClickHouse Cloud) y podría aplicarse a otros tipos de tablas MergeTree sobre almacenamiento compartido. #86786 (Azat Khuzhin).
- Reducir la sobrecarga de los filtros de runtime de join deshabilitándolos en los siguientes casos: - hay demasiados bits activados en el filtro bloom - se filtran muy pocas filas en runtime. #91578 (Alexander Gololobov).
- Se usa un búfer en memoria para la entrada de subconsultas correlacionadas para evitar evaluarla varias veces. Parte de #79890. #91205 (Dmitry Novik).
- Permite que todas las réplicas tomen rangos huérfanos durante la lectura con réplicas en paralelo. Esto mejora el equilibrio de carga y reduce la latencia en la cola larga. #91374 (zoomxi).
- Las operaciones externas de agregación, ordenación y join ahora respetan la configuración de consulta
temporary_files_codecen todos los contextos. Se corrigieron los eventos de perfil ausentes para grace hash join. #92388 (Vladimir Cherkasov). - Mejorar la robustez de la detección del uso de memoria de las consultas para el volcado a disco durante la agregación/ordenación. #92500 (Azat Khuzhin).
- Estimar el recuento total de filas y las estadísticas de NDV (número de valores distintos) de las columnas de la clave de agregación. #92812 (Alexander Gololobov).
- Optimiza la compresión de las listas de postings con simdcomp. #92871 (Peng Jian).
- Se refactorizó el procesamiento del modo Ordered de S3Queue con buckets. Esto también debería mejorar el rendimiento al reducir el número de solicitudes a Keeper. #92889 (Kseniia Sumarokova).
- Las funciones
mapContainsKeyLikeymapContainsValueLikeahora pueden usar un índice de texto enmapKeys()omapValues(), respectivamente. #93049 (Michael Jarrett). - Reduce el uso de memoria en sistemas no Linux (habilita la purga inmediata de las páginas sucias de jemalloc). #93360 (Eduard Karacharov).
- Forzar el purgado de las arenas de jemalloc en caso de que la proporción entre el tamaño de las páginas sucias y
max_server_memory_usagesuperememory_worker_purge_dirty_pages_threshold_ratio. #93500 (Eduard Karacharov). - Reduce el uso de memoria para AST. #93601 (Nikolai Kochetov).
- En algunos casos, hemos visto que ClickHouse no respeta el límite de memoria al leer desde una tabla. Se ha corregido este comportamiento. #93715 (Nikita Mikhaylov).
- Se habilitan de forma predeterminada las extensiones
CHECK_STATyTRY_REMOVEde Keeper. #93886 (Mikhail Artemenko). - Analizar los límites inferior y superior de los nombres de archivo correspondientes a los borrados posicionales en las entradas del archivo de manifiesto de Iceberg para seleccionar mejor los archivos de datos correspondientes. #93980 (Daniil Ivanik).
- Agrega dos ajustes más para controlar el número máximo de subcolumnas dinámicas en una columna JSON. El primero es el ajuste de MergeTree
merge_max_dynamic_subcolumns_in_compact_part(similar al ya añadidomerge_max_dynamic_subcolumns_in_wide_part) que limita el número de subcolumnas dinámicas creadas durante la fusión en una parte Compact. El segundo es el ajuste a nivel de consultamax_dynamic_subcolumns_in_json_type_parsing, que limita el número de subcolumnas dinámicas creadas durante el análisis de datos JSON; permitirá especificar el límite en la inserción. #94184 (Pavel Kruglov). - Se optimiza ligeramente la compactación de columnas de tipo JSON en algunos casos. #94247 (Pavel Kruglov).
- Reduzca el tamaño de las colas del pool de hilos en función de la experiencia en producción. Añada una comprobación explícita del consumo de memoria antes de leer cualquier dato de MergeTree. #94692 (Nikita Mikhaylov).
- Asegúrese de que el planificador dé prioridad al hilo MemoryWorker cuando haya escasez de CPU, ya que protege el proceso de ClickHouse frente a una amenaza existencial. #94864 (Nikita Mikhaylov).
- Ejecutar la purga de páginas sucias de jemalloc en un hilo distinto del hilo principal de
MemoryWorker. Si la purga es lenta, podría retrasar la actualización del uso de RSS, lo que podría hacer que el proceso se finalice por falta de memoria. Se introduce una nueva configuraciónmemory_worker_purge_total_memory_threshold_ratiopara iniciar la purga de páginas sucias según la proporción del uso total de memoria. #94902 (Antonio Andelic).
Mejora
system.blob_storage_logahora está disponible para Azure Blob Storage. #93105 (Alexey Milovidov).- Implementar
blob_storage_logpara Local y HDFS. Corregir un error cuandoS3Queueutilizaba algo distinto del nombre del disco para registrar enblob_storage_log. Añadir la columnaerror_codeablob_storage_log. Dividir el archivo de configuración de pruebas para simplificar las pruebas en local. #93106 (Alexey Milovidov). clickhouse-clientyclickhouse-localresaltarán grupos de dígitos (miles, millones, etc.) dentro de los literales numéricos al escribir. Esto cierra #93100. #93108 (Alexey Milovidov).- Añade compatibilidad en
clickhouse-clientcon argumentos de línea de comandos que tienen espacios alrededor del signo igual. Cierra #93077. #93174 (Cole Smith). - Con
<interactive_history_legacy_keymap>true</interactive_history_legacy_keymap>, el cliente de la CLI ahora puede volver a usar Ctrl-R para la búsqueda normal, como antes, mientras que Ctrl-T realiza una búsqueda difusa. #87785 (Larry Snizek). - La sentencia para limpiar cachés
SYSTEM DROP [...] CACHEdaba la falsa impresión de que desactivaba la caché. ClickHouse ahora admite la sentenciaSYSTEM CLEAR [...] CACHE, que resulta más clara. La sintaxis anterior sigue estando disponible. #93727 (Pranav Tiwari). - Permite usar varias columnas como clave primaria en
EmbeddedRocksDB. Cierra #32819. #33917 (usurai). - Ahora ya es posible usar IN no constante con escalares (consultas como
val1 NOT IN if(cond, val2, val3)). #93495 (Yarik Briukhovetskyi). - Evita que los encabezados
x-amz-server-side-encryptionse propaguen en las solicitudes S3HeadObject,UploadPartyCompleteMultipartUpload, ya que no son compatibles. #64577 (Francisco J. Jurado Moreno). - Seguimiento del particionamiento de Hive en el modo ordered de S3Queue. Resuelve #71161. #81040 (Anton Ivashkin).
- Optimiza la reserva de espacio en la caché del sistema de archivos.
FileCache::collectCandidatesForEvictionse ejecutará sin un bloqueo exclusivo. #82764 (Kseniia Sumarokova). - Permite una estrategia de rotación compuesta (tamaño + tiempo) para el log del servidor. #87620 (Jianmei Zhang).
- El client de la CLI ahora puede especificar
<warnings>false</warnings>en lugar de la opción de línea de comandos--no-warnings. #87783 (Larry Snizek). - Se añade compatibilidad para la función de agregación
avgcon valores Date, DateTime y Time como argumentos. Cierra #82267. #87845 (Yarik Briukhovetskyi). - La optimización
use_join_disjunctions_push_downestá habilitada de forma predeterminada. #89313 (Alexey Milovidov). - Se admiten más motores de tabla y tipos de fuentes de datos en las subconsultas correlacionadas. Cierra #80775. #90175 (Dmitry Novik).
- Si el esquema de la vista parametrizada se especifica explícitamente, se muestra. Cierra #88875, #81385. #90220 (Grigorii Sokolik).
- Gestiona correctamente la laguna en las entradas del log de Keeper si los logs son anteriores al último índice confirmado. #90403 (Antonio Andelic).
- Se mejoró la configuración
min_free_disk_bytes_to_perform_insertpara que funcione correctamente con volúmenes JBOD. #90878 (Aleksandr Musorin). - Ahora se puede especificar la opción
storage_class_nameen las colecciones con nombre para el motor de tablaS3y la función de tablas3. #91926 (János Benjamin Antal). - Se admite la inserción en ZooKeeper auxiliar mediante
system.zookeeper. #92092 (RinChanNOW). - Se agregan nuevas métricas para Keeper: los profile events
KeeperChangelogWrittenBytes,KeeperChangelogFileSyncMicroseconds,KeeperSnapshotWrittenBytesyKeeperSnapshotFileSyncMicroseconds, así como las histogram metricsKeeperBatchSizeElementsyKeeperBatchSizeBytes. #92149 (Miсhael Stetsyuk). - Se ha añadido una nueva configuración,
trace_profile_events_list, que limita el trazado contrace_profile_eventa la lista especificada de nombres de eventos. Esto permite una recopilación de datos más precisa en cargas de trabajo de gran tamaño. #92298 (Alexey Milovidov). - Compatibilidad con SYSTEM NOTIFY FAILPOINT para failpoints pausables. - Compatibilidad con SYSTEM WAIT FAILPOINT fp PAUSE/RESUME. #92368 (Shaohua Wang).
- Agregar la columna
creation(implícita/explícita) asystem.data_skipping_indices. #92378 (Raúl Marín). - Permitir pasar la descripción de las columnas de las tablas dinámicas de YTsaurus a la fuente del diccionario. #92391 (MikhailBurdukov).
- En #63985, hicimos posible especificar todos los parámetros necesarios para la configuración de TLS por puerto (consulte protocolos componibles), de modo que ya no dependemos de una configuración global de TLS. Sin embargo, la implementación sigue requiriendo implícitamente que exista una sección de configuración global
openSSL.server, lo que entra en conflicto con entornos en los que se necesitan configuraciones de TLS distintas para diferentes puertos. Por ejemplo, en despliegues keeper-in-server, necesitamos configuraciones de TLS independientes para la comunicación entre instancias de Keeper y las conexiones del clickhouse client. #92457 (Miсhael Stetsyuk). - Se incorpora un nuevo ajuste
input_format_binary_max_type_complexityque limita el número total de nodos de tipo que pueden decodificarse en formato binario para evitar payloads maliciosos. #92519 (Raufs Dunamalijevs). - Mostrar las tareas en ejecución en
system.background_schedule_pool{,_log}. Añadir documentación. #92587 (Azat Khuzhin). - Ejecuta la consulta actual en la búsqueda con Ctrl+R en client si no se encuentra ninguna coincidencia en el historial. #92749 (Azat Khuzhin).
- Se admite
EXPLAIN indices = 1como alias deEXPLAIN indexes = 1. Resuelve #92483. #92774 (Pranav Tiwari). - El lector de Parquet ahora permite leer columnas de tipo Tuple o Map como JSON:
select x from file(f.parquet, auto, 'x JSON')funciona incluso si el tipo de la columnaxenf.parquetes tuple o map. #92864 (Michael Kolupaev). - Se admiten tuplas vacías en el lector de Parquet. #92868 (Michael Kolupaev).
- Se recurre a la copia en modo lectura y escritura para Azure Blob Storage cuando la copia nativa falla con BadRequest (p. ej., lista de bloques no válida). Anteriormente, esto solo se hacía para el error Unauthorized, que se observaba al copiar un blob entre distintas cuentas de almacenamiento. Pero a veces también vemos el error “The specified block list is invalid”. Así que ahora se ha actualizado la condición para recurrir a lectura y escritura en todos los fallos de la copia nativa. #92888 (Smita Kulkarni).
- Se corrige el throttling del endpoint de metadatos de EC2 al ejecutar muchas consultas concurrentes de S3 con credenciales de perfil de instancia de EC2. Anteriormente, cada consulta creaba su propio
AWSInstanceProfileCredentialsProvider, lo que provocaba solicitudes concurrentes al servicio de metadatos de EC2 y podía dar lugar a timeouts y erroresHTTP response code: 403. Ahora, el proveedor de credenciales se almacena en caché y se comparte entre todas las consultas. #92891 (Sav). - Se ha rediseñado la configuración
insert_select_deduplicatepara permitir mantener la compatibilidad con versiones anteriores. #92951 (Sema Checherinda). - Registrar las tareas en segundo plano más lentas que la media (
background_schedule_pool_log.duration_threshold_milliseconds=30) para evitar un registro excesivo de tareas. #92965 (Azat Khuzhin). - En versiones anteriores, algunos nombres de funciones de C++ se mostraban de forma incorrecta (“mangled”) en
system.trace_logysystem.symbols, y la funcióndemangleno los procesaba correctamente. Cierra #93074. #93075 (Alexey Milovidov). - Se introdujo la opción de copia de seguridad
backup_data_from_refreshable_materialized_view_targetspara omitir la copia de seguridad de las vistas materializadas actualizables. Las RMV con estrategia de actualización APPEND siempre se respaldan. #93076 (Julia Kartseva). #93658 (Julia Kartseva) - Usar información de depuración mínima en lugar de no incluir información de depuración para unidades de traducción grandes, como las funciones. #93079 (Alexey Milovidov).
- Se añadió compatibilidad con MinIO en el SDK de AWS S3 para C++ mediante la implementación de un mapeo de códigos de error para errores específicos de MinIO. Este cambio permite que ClickHouse gestione correctamente y reintente los errores del servidor de MinIO cuando se utilizan implementaciones de MinIO en lugar de AWS S3, lo que mejora la fiabilidad para los usuarios que ejecutan almacenamiento de objetos en clústeres de MinIO autogestionados. #93082 (XiaoBinMu).
- Escribir perfiles simbolizados de jemalloc (lo que elimina la necesidad de un binario durante la generación de perfiles de heap). #93099 (Azat Khuzhin).
- Se restauró la herramienta
clickhouse git-import: fallaba con commits grandes y no válidos. Véase https://presentations.clickhouse.com/2020-matemarketing/. #93202 (Alexey Milovidov). - No mostrar las contraseñas del almacenamiento URL en el registro de consultas. #93245 (Konstantin Vedernikov).
- Se añadió compatibilidad con el tipo
GeometryenflipCoordinates. #93303 (Bharat Nallan). - Mejora la UX de SYSTEM INSTRUMENT ADD/REMOVE: usa literales String para los nombres de las funciones, parchea todas las funciones que coincidan y permite usar function_name en
REMOVE. #93345 (Pablo Marcos). - Se añade una nueva configuración
materialize_statistics_on_mergeque permite activar o desactivar la materialización de estadísticas durante la fusión. El valor predeterminado es1. #93379 (Han Fei). - ClickHouse ahora puede interpretar
SELECTsin paréntesis alrededor de las consultasDESCRIBE SELECT. Cierra #58382. #93429 (Yarik Briukhovetskyi). - Añade aleatoriedad a las comprobaciones de corrección de la caché con una probabilidad determinada. #93439 (Kseniia Sumarokova).
- Añadir la configuración
type_json_allow_duplicated_key_with_literal_and_nested_objectpara permitir paths duplicados en JSON cuando uno es un literal y otro es un objeto anidado, por ejemplo{"a" : 42, "a" : {"b" : 42}}. Es posible que algunos datos se hayan creado antes de que se añadiera esta restricción sobre paths duplicados en https://github.com/ClickHouse/ClickHouse/pull/79317, y que ahora una manipulación posterior de esos datos provoque errores. Con esta configuración, esos datos antiguos aún pueden usarse sin errores. #93604 (Pavel Kruglov). - No se imprimen los valores de tipos simples en líneas separadas en Pretty JSON. #93836 (Pavel Kruglov).
- Cuando hay muchas sentencias
alter table ... modify setting ..., puede que no se adquiera el bloqueo en 5 segundos. Es mejor devolvertimeoutqueerror lógico. #93856 (Han Fei). - Se evita una salida excesiva ante un error de sintaxis. Antes de este cambio, se mostraba el script SQL completo, que podía contener muchas consultas. #93876 (Alexey Milovidov).
- Cálculo correcto del tamaño en bytes de la solicitud
checkcon estadísticas en Keeper. #93907 (Mikhail Artemenko). - Se añadió la configuración
use_hash_table_stats_for_join_reorderingpara controlar si se utilizan estadísticas del tamaño de la tabla hash en tiempo de ejecución para reordenar joins. Esta configuración está habilitada de forma predeterminada, lo que conserva el comportamiento existente decollect_hash_table_stats_during_joins. #93912 (Vladimir Cherkasov). - Ahora los usuarios pueden ver parcialmente las opciones de configuración globales anidadas del servidor en la tabla
system.server_settings(p. ej.,logger.level). Esto solo cubre las opciones de configuración con una estructura fija (sin listas, enumeraciones, repeticiones, etc.). #94001 (Hechem Selmi). QBitahora se puede comparar por igualdad. #94078 (Raufs Dunamalijevs).- Cuando Keeper detecte un snapshot dañado o changelogs inconsistentes, que lance una excepción en lugar de abortar manualmente o limpiar los archivos automáticamente. Esto debería dar lugar a un comportamiento más seguro de Keeper, al depender de la intervención manual. #94168 (Antonio Andelic).
- Se corrigió la posible presencia de restos en caso de que falle
CREATE TABLE. #94174 (Azat Khuzhin). - Corrige el acceso a memoria no inicializada (un fallo en OpenSSL) cuando se usa una clave TLS protegida con contraseña. #94182 (Konstantin Bogdanov).
- Actualiza chdig a la versión v26.1.1. #94290 (Azat Khuzhin).
- Añade compatibilidad con un particionamiento más genérico para el modo ordered de S3Queue. #94321 (Bharat Nallan).
- Se añadió el alias
use_statisticspara el ajusteallow_statistics_optimize. Esto es más coherente con los ajustes existentesuse_primary_keyyuse_skip_indexes. #94366 (Robert Schulze). - Se habilitó la configuración
input_format_numbers_enum_on_conversion_errorpara que, en la conversión de números a enums, se compruebe si el elemento existe. #94384 (Elmi Ahmadov). - En el modo ordered de S3(Azure)Queue, se limpian los nodos failed según los límites de seguimiento (antes esto solo se hacía en el modo Unordered, tanto para failed como para processed; ahora también se hará en Ordered, pero solo para los nodos failed). #94412 (Kseniia Sumarokova).
- Se habilitó la gestión de acceso para el usuario
defaulten clickhouse-local. El usuariodefaultdeclickhouse-localno tenía el privilegioaccess_management, lo que hacía que operaciones comoDROP ROW POLICY IF EXISTSfallaran con el errorACCESS_DENIED, aunque ese usuario no debería tener restricciones. #94501 (Alexey Milovidov). - Se habilita named collection para diccionarios y tablas de YTsaurus. #94582 (MikhailBurdukov).
- Se añade compatibilidad con colecciones con nombre definidas mediante SQL en BACKUP/RESTORE para S3 y Azure Blob Storage. Cierra #94604. #94605 (Pablo Marcos).
- Compatibilidad con la agrupación en buckets basada en la clave de partición para S3Queue en modo ordenado. #94698 (Bharat Nallan).
- Añade una métrica asíncrona con el tiempo transcurrido del merge en ejecución más largo. #94825 (Raúl Marín).
- Añadir una comprobación del archivo asociado antes de aplicar la eliminación por posición con IcebergBitmapPositionDeleteTransform. #94897 (Yang Jiang).
- Ahora
view_duration_msmuestra el tiempo durante el cual el grupo estuvo activo, no la suma de las duraciones de los hilos que contiene. #94966 (Sema Checherinda). - Se elimina el límite máximo del número de tokens de búsqueda en las funciones
hasAnyTokensyhasAllTokens, que estaba fijado en 64. Ejemplo:SELECT count() FROM table WHERE hasAllTokens(text, ['token_1', 'token_2', [...], 'token_65']]);La consulta daría como resultado un errorBAD_ARGUMENTSporque hay 65 tokens de búsqueda. Con este PR, el límite se ha eliminado por completo y la misma consulta se ejecutaría sin errores. #95152 (Elmi Ahmadov). - Se añade la configuración
input_format_numbers_enum_on_conversion_errorpara que, en la conversión de números a Enums, se compruebe si el elemento existe. Cierra: #56144. #56240 (Nikolay Degterinsky). - Compartir recursos del analizador de formato entre la lectura del archivo de datos y del archivo de eliminación por posición en tablas Iceberg para reducir las asignaciones de memoria. #94701 (Yang Jiang).
Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)
- Corrige un error por el que los manejadores de consultas predefinidas interpretaban los espacios en blanco finales como datos durante las operaciones de inserción. #83604 (Fabian Ponce).
- Se corrige el error INCOMPATIBLE_TYPE_OF_JOIN para el almacenamiento Join cuando se aplica la optimización de outer join a inner join. Resuelve #80794. #84292 (Vladimir Cherkasov).
- Se corrige la excepción “Invalid number of rows in Chunk” al usar hash join con
allow_experimental_join_right_table_sortingactivado. #86440 (yanglongwei). - Los nombres de archivo siempre se reemplazan por un hash en MergeTree si el sistema de archivos no distingue entre mayúsculas y minúsculas. Anteriormente, en sistemas de archivos que no distinguen entre mayúsculas y minúsculas (como MacOS), esto podía provocar corrupción de datos cuando varios nombres de columna/subcolumna diferían solo por el uso de mayúsculas y minúsculas. #86559 (Pavel Kruglov).
- Añadir una comprobación completa de permisos durante la fase de creación de la consulta subyacente en una vista materializada. #89180 (pufit).
- Se corrigió un fallo en la función
icebergHashal usar un argumento constante. #90335 (Michael Kolupaev). - Corrige un error lógico cuando una mutación sin transacción modifica partes dentro de una transacción activa que finalmente se revierte. #90469 (Shaohua Wang).
- Actualiza correctamente
system.warningsdespués de convertir una base de datos ordinaria en una base de datos Atomic. #90473 (sdk2). - Corrige un error de aserción al leer un archivo Parquet, cuando una parte de una expresión prewhere se usa en otra parte de la consulta. #90635 (Max Kainov).
- Se corrige un fallo en un clúster de un solo nodo al leer desde Iceberg en modo split-by-buckets. Cierra la issue #90913. #91553 (Konstantin Vedernikov).
- Corrige un posible error lógico en el motor Log durante la lectura de subcolumnas. Cierra #91710. #91711 (Pavel Kruglov).
- Se corrigió el error lógico: ‘Storage no admite transacción’ durante ATTACH AS REPLICATED. #91772 (Shaohua Wang).
- Corrección de un problema por el que los filtros en tiempo de ejecución funcionaban incorrectamente cuando LEFT ANTI JOIN tenía una poscondición adicional. #91824 (Alexander Gololobov).
- Corrige un error en una comparación null-safe que involucra el tipo Nothing. Cierra #91834. Cierra #84870. Cierra #91821. #91884 (Yarik Briukhovetskyi).
- Corrige errores en la decodificación de DELTA_BYTE_ARRAY en el lector nativo de Parquet que afectaban a datos de tipo cadena muy repetitivos. #91929 (Daniel Muino).
- Almacena en caché el esquema solo para el archivo a partir del cual se infirió en los globs, en lugar de para todos los archivos durante la inferencia del esquema. Cierra #91745. #92006 (Pavel Kruglov).
- Corrige el error
Couldn't pack tar archive: Failed to write all bytescausado por un encabezado incorrecto con el tamaño de la entrada del archivo. Soluciona #89075. #92122 (Julia Kartseva). - Liberar el flujo de solicitudes en insert select para evitar el cierre de la conexión HTTP. #92175 (Sema Checherinda).
- Se corrige un error lógico en consultas con múltiples JOIN con la cláusula
USINGyjoin_use_nulls. #92251 (Vladimir Cherkasov). - Corrige un error lógico al reordenar join con join_use_nulls, cierra https://github.com/clickhouse/clickhouse/issues/90795. #92289 (Vladimir Cherkasov).
- Corrige el formato inconsistente del AST de arrayElement con un literal negado. Cierra #92288 Cierra #92212 Cierra #91832 Cierra #91789 Cierra #91735 Cierra #88495 Cierra #92386. #92293 (Pavel Kruglov).
- Se corrige un posible fallo con la configuración
join_on_disk_max_files_to_merge. #92335 (Bharat Nallan). - issue relacionado con #https://github.com/ClickHouse/support-escalation/issues/6365. #92339 (Tuan Pham Anh).
- Se corrige la falta de comprobación de acceso en
SYSTEM SYNC FILE CACHE. Cierra #92101. #92372 (Kseniia Sumarokova). - Se corrigió el paso
count_distinct_optimizationsobre funciones de ventana y múltiples argumentos. #92376 (Raúl Marín). - Corrige el error “No se puede escribir en el búfer finalizado” al usar determinadas funciones de agregación con funciones de ventana. Cierra #91415. #92395 (Jimmy Aguilar Mena).
- Corrige un error lógico al usar
CREATE TABLE ... AS urlCluster()y el motor de base de datosReplicated. Cierra #92216. #92418 (Kseniia Sumarokova). - Hereda la configuración de la información de serialización de la parte de origen durante una mutación en MergeTree. Esto corrige un posible resultado incorrecto de la consulta sobre una parte mutada tras cambios en la serialización de los tipos de datos. #92419 (Pavel Kruglov).
- Se corrige un posible conflicto entre una columna y una subcolumna con el mismo nombre que podía provocar el uso de una serialización incorrecta y fallos en las consultas. Cierra #90219. Cierra #85161. #92453 (Pavel Kruglov).
- Se corrige un
LOGICAL_ERRORcausado por una modificación no deseada del plan de consulta al convertir un outer join en un inner join. También se flexibilizan los requisitos de la optimización para poder aplicarla en casos en los que se aplican funciones inyectivas a las claves de agregación en los joins. #92503 (János Benjamin Antal). - Corrige un posible error
SIZES_OF_COLUMNS_DOESNT_MATCHal ordenar una columna Tuple vacía. Cierra #92422. #92520 (Pavel Kruglov). - Verificación de rutas tipadas incompatibles en el tipo JSON. Cierra #91577. #92539 (Pavel Kruglov).
- Se corrigió el interbloqueo en SHOW CREATE DATABASE para la base de datos Backup. #92541 (Azat Khuzhin).
- Usar el código de error correcto al validar el índice hypothesis. #92559 (Raúl Marín).
- Se corrige la resolución de subcolumnas Dynamic en alias de columnas en el analizador. Anteriormente, la subcolumna Dynamic en un alias de columna se envolvía en
getSubcolumny, en algunos casos, ni siquiera podía resolverse. Cierra #91434. #92583 (Pavel Kruglov). - Se evita un fallo en tokens() con un segundo argumento NULL. #92586 (Raúl Marín).
- Corrige un posible cierre inesperado provocado por una mutación in situ de las columnas const PREWHERE subyacentes. Esto podría haber ocurrido durante la reducción del tamaño de columnas (
IColumn::shrinkToFit) o el filtrado (IColumn::filter), que podían activarse de forma concurrente en varios hilos. #92588 (Arsen Muk). - La creación y materialización de índices de texto en tablas que contienen partes de gran tamaño (más de 4.294.967.295 filas) está temporalmente deshabilitada. Esta limitación evita resultados incorrectos en las consultas, ya que la implementación actual del índice aún no admite partes tan grandes. #92644 (Anton Popov).
- Corrige un error lógico
Too large size (A) passed to allocatoral ejecutar JOINs. Cierra #92043. #92667 (Yarik Briukhovetskyi). - Se corrige un error por el que los índices
ngrambf_v1con longitud de ngram (1.er parámetro) > 8 lanzaban una excepción. #92672 (Robert Schulze). - Se corrige una excepción no controlada durante la recarga en segundo plano de las colecciones con nombre cuando se usa almacenamiento de ZooKeeper. Cierra https://github.com/ClickHouse/clickhouse-private/issues/44180. #92717 (Kseniia Sumarokova).
- Corrige la lógica incorrecta en las comprobaciones de grants de acceso con comodines. El intento anterior https://github.com/ClickHouse/ClickHouse/pull/90928 abordó una vulnerabilidad crítica, pero acabó siendo demasiado restrictivo, lo que hizo que algunas sentencias
GRANTcon comodines fallaran debido a revocaciones no relacionadas. #92725 (pufit). - Corrige un error en la lógica de omisión de datos al usar
not match(...)enWHERE, que provocaba resultados incorrectos. Cierra #92492. #92726 (Nihal Z. Miaji). - No intente eliminar los directorios temporales al iniciar si se crea una tabla MergeTree en un disco de solo lectura. #92748 (Alexey Milovidov).
- Se corrigió “Cannot add action to empty ExpressionActionsChain” para ALTER TABLE REWRITE PARTS (v2). #92754 (Azat Khuzhin).
- Evita un fallo al leer desde una
Connectiondesconectada. #92807 (Raufs Dunamalijevs). - Corrige el error lógico
Failed to set file processing within 100 retriesen el almacenamientoS3Queueen modoOrdered. Ahora se ha sustituido por una advertencia. Este error podía producirse antes de la versión 25.10 si la sesión de Keeper había expirado; sin embargo, seguirá siendo una advertencia en las versiones 25.10+, ya que aún es teóricamente posible que se produzca este error en caso de una alta concurrencia de procesamiento en modoOrdered. #92814 (Kseniia Sumarokova). - Antes, algunas consultas que usaban sharding por PK con una condición falsa fallaban. Ahora ya no fallan. Necesario para https://github.com/ClickHouse/ClickHouse/pull/89313. #92815 (Yarik Briukhovetskyi).
- Se corrigió el cálculo de los tamaños sin comprimir de los índices de texto en la tabla
system.parts. #92832 (Anton Popov). - Se corrigió el uso del índice primario en las actualizaciones ligeras que tienen una cláusula
INcon subconsultas en el predicado de la cláusulaWHERE. #92838 (Anton Popov). - Se corrigió la creación de la indicación de tipo para la ruta ‘skip’ en JSON. Cierra #92731. #92842 (Pavel Kruglov).
- En el motor de tabla S3, debemos evitar almacenar en caché la clave de partición si hay funciones no deterministas. #92844 (Miсhael Stetsyuk).
- Corrige un posible error
FILE_DOESNT_EXISTtras la mutación de una columna dispersa conratio_of_defaults_for_sparse_serialization=0.0. Cierra #92633. #92860 (Pavel Kruglov). - Corrige la inferencia del esquema de Parquet en el antiguo lector de Parquet (no se usa de forma predeterminada) cuando una columna JSON va después de una columna Tupe. Corrige el fallo del antiguo lector de Parquet (no se usa de forma predeterminada) con tuplas vacías. #92867 (Michael Kolupaev).
- Corrige un error lógico con múltiples joins con una condición constante y
join_use_nulls; cierra #92640. #92892 (Vladimir Cherkasov). - Corrige un posible error
NOT_FOUND_COLUMN_IN_BLOCKdurante la inserción en una tabla con una subcolumna en la expresión de partición. Cierra #93210. Cierra #83406. #92905 (Pavel Kruglov). - Corrige el error
NO_SUCH_COLUMN_IN_TABLEen el motor Merge con tablas con alias. Cierra #88665. #92910 (Pavel Kruglov). - Se corrige el caso NULL != NULL para full_sorting_join en una columna LowCardinality(Nullable(T)). #92924 (Vladimir Cherkasov).
- Se corrigieron varios cierres inesperados durante las fusiones de índices de texto en tablas
MergeTree. #92925 (Anton Popov). - Se restauran las envolturas LowCardinality en los resultados de expresiones SET, cuando es necesario, durante la agregación con TTL para evitar excepciones durante la optimización de la tabla. #92971 (Seva Potapov).
- Corrige un error lógico durante el análisis de índices cuando se usa un array vacío en la función
has. Cierra #92906. #92995 (Nihal Z. Miaji). - Se corrige un posible bloqueo al finalizar el pool de programación en segundo plano (puede provocar bloqueos del servidor durante el apagado). #93008 (Azat Khuzhin).
- Se corrige un posible error FILE_DOESNT_EXIST después de una mutación de una columna dispersa cuando la configuración
ratio_of_defaults_for_sparse_serializationse cambiaba a1.0mediante alter. #93016 (Pavel Kruglov). - Se corrige un error en la lógica de omisión de datos al usar
not materialize(...)onot CAST(...)enWHERE, que provocaba resultados incorrectos. Cierra #88536. #93017 (Nihal Z. Miaji). - Se corrige el posible uso de partes obsoletas debido a una race condition TOCTOU en las partes compartidas. #93022 (Azat Khuzhin).
- Se corrige un bloqueo al deserializar un estado de agregación
groupConcatmalformado con desplazamientos fuera de rango. #93028 (Raufs Dunamalijevs). - Se corrige un problema que dejaba la conexión en un estado incorrecto tras la cancelación preliminar de consultas distribuidas. #93029 (Azat Khuzhin).
- Corrige los resultados del join cuando la clave de join del lado derecho es una columna dispersa. Esto cierra #92920. Solo puedo reproducir el error con
set compatibility='23.3'. No estoy seguro de si debería retroportarse. #93038 (Amos Bird). - Se soluciona un posible
Cannot finalize buffer after cancellationenestimateCompressionRatio(). Soluciona: #87380. #93068 (Azat Khuzhin). - Se corrigieron las fusiones de índices de texto basados en expresiones complejas (como
concat(col1, col2)). #93073 (Anton Popov). - Se corrige la aplicación de la proyección cuando el filtro contiene subcolumnas. Cierra #92882. #93141 (Pavel Kruglov).
- Se corrigió un error lógico que se producía en algunos casos al añadir filtros en tiempo de ejecución de join al plan de consulta. Se debía a que se devolvían incorrectamente columnas const duplicadas desde uno de los lados del join. #93144 (Alexander Gololobov).
- La función especial
__applyFilterutilizada por los filtros de tiempo de ejecución de JOIN devolvía ILLEGAL_TYPE_OF_ARGUMENT en algunos casos válidos. #93187 (Alexander Gololobov). - Evita que distintas columnas interpoladas se fusionen en la misma columna dentro de un bloque cuando las columnas interpoladas son, en la práctica, alias de la misma columna. #93197 (Yakov Olkhovskiy).
- No añadir un filtro en tiempo de ejecución al hacer join con la tabla del lado derecho ya rellenada. #93211 (Alexander Gololobov).
- Se corrige la limpieza de los watches persistentes de Keeper tras una sesión finalizada. Cierra #92480. #93213 (Konstantin Vedernikov).
- Se corrige el uso de ORDER BY con tuplas en Iceberg. Esto cierra #92977. #93225 (Konstantin Vedernikov).
- Se corrige un fallo en la configuración
s3queue_migrate_old_metadata_to_bucketsde S3Queue. Cierra #93392, #93196, #81739. #93232 (Kseniia Sumarokova). - Se eliminan las columnas no utilizadas cuando la proyección se reconstruye durante la fusión. Esto reduce el uso de memoria y crea menos partes temporales. #93233 (Nikolai Kochetov).
- Se corrige la eliminación de columnas no utilizadas de subconsultas cuando hay una subconsulta escalar correlacionada. Antes de esta corrección, una columna podía eliminarse si solo se usaba en la subconsulta correlacionada, y la consulta fallaba con el error
NOT_FOUND_COLUMN_IN_BLOCK. #93273 (Dmitry Novik). - Corrige la posible falta de una subcolumna en una MV durante un ALTER de la tabla de origen. Cierra #93231. #93276 (Pavel Kruglov).
- Corrige en el analizador la planificación de consultas del motor de tabla
Merge, que podía lanzar ILLEGAL_COLUMN parahostName()al fusionar tablas locales y remotas/Distributed. Cierra #92059. #93286 (Jinlin). - Corrige un caso en el que
NOT INcon argumentos de Array no constantes devolvía un valor incorrecto, y añade compatibilidad con funciones de Array no constantes. Cierra #14980. #93314 (Yarik Briukhovetskyi). - Se corrige el error
Not found columnen la optimizaciónuse_top_k_dynamic_filtering. Corrige #93186. #93316 (Nikolai Kochetov). - Se corrigió la reconstrucción de los índices de texto creados sobre subcolumnas. #93326 (Anton Popov).
- Se corrigió el manejo de un array vacío como segundo argumento de las funciones
hasAllTokensyhasAnyTokens. #93328 (Anton Popov). - Se corrigió un error lógico al usar filtros de tiempo de ejecución en una consulta con totales para la tabla del lado derecho. #93330 (Alexander Gololobov).
- El servidor ya no falla si se llama a la función
tokenscon parámetros del tokenizer no constantes (el 2.º, 3.º y 4.º parámetro), p. ej.,SELECT tokens(NULL, 1, materialize(1)). #93383 (Robert Schulze). - Se corrigió una vulnerabilidad por desbordamiento de enteros en la deserialización del estado de
groupConcatque podía provocar problemas de seguridad de la memoria con estados de agregación manipulados. #93426 (Raufs Dunamalijevs). - Se corrigió el análisis del índice de texto en columnas de tipo array cuando el índice no contiene tokens (todos los arrays están vacíos o el tokenizador omite todos los tokens). #93457 (Anton Popov).
- Evita el inicio de sesión mediante OAuth en ClickHouse Client cuando el nombre de usuario y la contraseña están en la cadena de conexión. #93459 (Krishna Mannem).
- Corregir la compatibilidad con las credenciales proporcionadas de Azure ADLS Gen2 en DataLakeCatalog: interpretar las claves
adls.sas-token.*de los catálogos REST de Iceberg y corregir el análisis de las URL ABFSS. #93477 (Karun Anantharaman). - Se corrigió la compatibilidad con GLOBAL IN en el analizador (antes, el Set se volvía a crear en el nodo remoto). #93507 (Azat Khuzhin).
- Se corrigió la extracción de la subcolumna durante la deserialización directamente en columnas dispersas. #93512 (Pavel Kruglov).
- Se corrigió la lectura directa desde el índice de texto en consultas de búsqueda duplicadas. #93516 (Anton Popov).
- Corrección del error NOT_FOUND_COLUMN_IN_BLOCK cuando el runtime filter está habilitado y las tablas unidas devuelven la misma columna varias veces (p. ej., SELECT a, a, a FROM t). #93526 (Alexander Gololobov).
- Se corrigió un error por el que clickhouse-client pedía la contraseña dos veces al conectarse mediante ssh. #93547 (Isak Ellmer).
- Asegúrese de que ZooKeeper finalice correctamente al apagarse (corrige un posible bloqueo durante el apagado en casos muy poco probables). #93602 (Azat Khuzhin).
- Se corrigió LOGICAL_ERROR al restaurar ReplicatedMergeTree con una condición de carrera en la deduplicación. #93612 (Pablo Marcos).
- Se corrige el uso de columnas dispersas en la actualización de TTL durante la deserialización directa en columnas dispersas en algunos formatos de entrada. Esto corrige el posible error lógico
Unexpected type of result TTL column. #93619 (Pavel Kruglov). - Se corrigieron las funciones de índice H3 que a veces fallaban o se quedaban bloqueadas al llamarse con valores de entrada no válidos. #93657 (Michael Kolupaev).
- El uso del índice
ngram_bfen datos no UTF-8 provocó una lectura de memoria no inicializada, con valores que podían quedar en la estructura del índice resultante. Cierra #92576. #93663 (Alexey Milovidov). - Comprobar que el tamaño del búfer descomprimido sea el esperado. #93690 (Raúl Marín).
- Impedir que los usuarios obtengan la lista de columnas de una tabla sin verificar el permiso
SHOW COLUMNSmediante el motor de tablamerge. #93695 (János Benjamin Antal). - Se corrigió la materialización de los índices de omisión creados a partir de subcolumnas. #93708 (Anton Popov).
- Guardamos los punteros compartidos a los almacenamientos en
QueryPipeline::resources::storage_holderspara garantizar que los objetosIStorageno se destruyan mientrasPipelineExecutorsiga activo. #93746 (Miсhael Stetsyuk). - Se corrige el problema al adjuntar BD Replicated cuando el host entre servidores cambiaba tras reiniciar. #93779 (Tuan Pham Anh).
- Se corrige la aserción
!read_until_positionenReadBufferFromS3, que se producía cuando la caché estaba habilitada. #93809 (Kseniia Sumarokova). - Corrige un error lógico en un caso poco frecuente en el que se usa una tupla vacía con una columna
Map. Cierra #93784. #93814 (Nihal Z. Miaji). - Se corrigió la corrupción de
_part_offsetal reconstruir las proyecciones durante las fusiones, y se optimizó el procesamiento de proyecciones al evitar lecturas innecesarias de la columna_part_offsety omitir columnas no necesarias en los cálculos de proyecciones. Esto da continuidad a las optimizaciones introducidas en #93233. #93827 (Amos Bird). - Se elimina el manejo de ‘Bad version’. #93843 (Anton Ivashkin).
- Se corrige que
optimize_inverse_dictionary_lookupno funcionara con una consulta distribuida cuando la clave es de tipo entero con signo. Cierra #93259. #93848 (Nihal Z. Miaji). - Se corrigió que
lag/leadno funcionaran con la consulta distribuidaremote(). Cierra #90014. #93858 (Nihal Z. Miaji). - Se corrigió un error en el envío de instrumentación del sistema. #93937 (Pablo Marcos).
- En https://github.com/ClickHouse/ClickHouse/pull/89173, añadimos un campo adicional a la estructura que
TraceSenderenvía a través de una tubería interna. Sin embargo, no se actualizó el tamaño del búfer (aquí), por lo que estamos escribiendo más datos en el búfer de los que permitebuffer_size, lo que provoca múltiples flushes. Además, comoTraceSender::sendse llama desde distintos hilos, los flushes de esos hilos pueden intercalarse, lo que rompe el invariante del que depende el extremo receptor (TraceCollector). #93966 (Miсhael Stetsyuk). - Se corrige la conversión de tipos al supertipo durante la operación JOIN del motor de almacenamiento
Joincon la cláusulaUSING. Corrige #91672. Corrige #78572. #94000 (Dmitry Novik). - Corrección de un problema por el que FilterStep no se añadía correctamente cuando se aplicaba un runtime filter de join sobre una tabla Merge. #94021 (Alexander Gololobov).
- Una consulta
SELECTque incluía un predicado sobre varias columnas con índices de omisión de bloom filter, y en la que había condicionesORyNOT, podía devolver resultados incoherentes. Esto ya se ha corregido. #94026 (Shankar Iyer). - Se corrige
CLEARen una columna con índices dependientes. #94057 (Raúl Marín). - Se corrigió el uso de un valor sin inicializar en
ReadWriteBufferFromHTTP. #94058 (Alexey Milovidov). - Corrige una comprobación errónea de las rutas tipadas en JSON. La comprobación se introdujo en https://github.com/ClickHouse/ClickHouse/pull/92842 y puede provocar un error al iniciar tablas existentes. #94070 (Pavel Kruglov).
- Se corrige el cierre inesperado durante el análisis del filtro cuando hay un OUTER JOIN. Corrige #90979. #94080 (Dmitry Novik).
- Se corrigió la precisión de
uniqThetaal usar claves de agregación UInt8 en paralelo (max_threads> 1, valor predeterminado). #94095 (Azat Khuzhin). - Se corrige un fallo provocado por una excepción lanzada desde una llamada a
socket.setBlocking(true)dentro deSCOPE_EXIT. #94100 (Miсhael Stetsyuk). - Se corrige la pérdida de datos cuando
DROP PARTITIONelimina partes creadas por entradas de log posteriores en ReplicatedMergeTree. #94123 (Tuan Pham Anh). - Se corrigió un problema en el lector de Parquet v3, que manejaba incorrectamente los arrays que cruzan los límites de página. Esto ocurre, por ejemplo, con archivos escritos por Arrow sin habilitar las estadísticas de página ni el índice de página. Afecta solo a las columnas del tipo de dato Array. El síntoma más probable es que un array cada ~1 MB de datos quede truncado. Antes de esta corrección, use esta configuración como solución alternativa:
input_format_parquet_use_native_reader_v3 = 0. #94125 (Michael Kolupaev). - Se corrige el exceso de watches en ReplicatedMergeTree mientras se espera una entrada del log. #94133 (Azat Khuzhin).
- Funciones
arrayShuffle,arrayPartialShuffleyarrayRandomSamplepara materializar columnas constantes, de modo que distintas filas obtengan resultados diferentes. #94134 (Joanna Hulboj). - Se corrige una condición de carrera en la evaluación de funciones de tabla en vistas materializadas. #94171 (Alexey Milovidov).
- Corrige una desreferenciación de nullptr en los motores de base de datos
PostgreSQL(cuando la consulta es incorrecta). Cierra #92887. #94180 (Alexey Milovidov). - Corrige una fuga de memoria en vistas materializadas actualizables que utilizan consultas
SELECTcon múltiples subconsultas. #94200 (Antonio Andelic). - Soluciona una condición de carrera entre
DataPartStorageOnDiskBase::removeysystem.parts. Cierra #49076. #94262 (Alexey Milovidov). - Se elimina el especificador
noexceptincorrecto en la asignación por copia de HashTable, que puede provocar un crash (std::terminate) en caso de excepciones de memoria. #94275 (Nikita Taranov). - Anteriormente, al crear una proyección con columnas duplicadas en GROUP BY (p. ej.,
GROUP BY c0, c0) e insertar datos, se producía unstd::length_errorsioptimize_row_orderestá habilitado. Cierra #94065. #94277 (Alexey Milovidov). - Se corrige un error poco frecuente en el client de ZooKeeper durante la conexión que provoca cuelgues y fallos. #94320 (Azat Khuzhin).
- Se corrige un problema por el que la optimización de función a subcolumnas no se aplicaba a las subcolumnas. #94323 (Pavel Kruglov).
- Se corrige un posible resultado incorrecto en
RIGHT JOINanidados cuandoenable_lazy_columns_replicationestá habilitado. El error provocaba que todas las filas de las columnas replicadas devolvieran incorrectamente el mismo valor en lugar de sus valores correspondientes. Cierra #93891. #94339 (Vladimir Cherkasov). - Se corrige el pushdown de filtros en SEMI JOIN mediante conjuntos de equivalencia. No se aplica el pushdown del filtro si han cambiado los tipos de los argumentos. Corrige #93264. #94340 (Dmitry Novik).
- Corrige el uso de DeltaLake CDF con el motor de base de datos DataLake (integración de catálogos de delta lake). Cierra #94122. #94342 (Kseniia Sumarokova).
- Se corrigió el valor incorrecto de la métrica
FilesystemCacheSizeLimitcuando se usaba la política de cachéSLRU. #94363 (Kseniia Sumarokova). - Crear un motor de base de datos Backup con menos de dos argumentos ahora devuelve un mensaje de error más descriptivo (
Wrong number of argumentsen lugar destd::out_of_range: InlinedVector::at(size_type) const failed bounds check.). #94374 (Robert Schulze). - Ignora las revocaciones imposibles de privilegios globales a nivel de base de datos para privilegios con opción de otorgamiento. #94386 (pufit).
- Se corrigió la lectura de desplazamientos dispersos en partes compactas. Cierra #94385. #94399 (Pavel Kruglov).
- No impedir ALTER de columnas con índices implícitos, incluso si se usa el modo
throwdealter_column_secondary_index_mode. #94425 (Raúl Marín). - Se corrige un crash en
TCPHandlercuando varias llamadas areceivePacketsExpectQueryleenProtocol::Client::IgnoredPartUUIDs. #94434 (Miсhael Stetsyuk). - Se corrige el enmascaramiento de datos sensibles en
system.functions. #94436 (Vitaly Baranov). - Corrige la desreferenciación de nullptr con
send_profile_eventsdeshabilitado. Esta funcionalidad se introdujo recientemente en el driver de Python de ClickHouse. Cierra #92488. #94466 (Alexey Milovidov). - Corrige la incompatibilidad de .mrk del índice de texto durante las operaciones de merge. #94494 (Peng Jian).
- Cuando
read_in_order_use_virtual_rowestá habilitado, el código accedía a las columnas del índice basándose en el tamaño completo de la clave primaria sin comprobar si el índice se había truncado, lo que provocaba acceso a memoria ya liberada / memoria sin inicializar. Cierra #85596. #94500 (Alexey Milovidov). - Corrige un error causado por una incompatibilidad de tipos al enviar tablas externas para subconsultas con GLOBAL IN cuando los tipos son Nullable. Cierra #94097. #94511 (Alexey Milovidov).
- En versiones anteriores, las consultas con múltiples condiciones de índice sobre la misma expresión podían lanzar por error la excepción
Not found column. Cierra #60660. #94515 (Alexey Milovidov). - Se corrige el manejo incorrecto de la columna Nullable del join en los filtros en tiempo de ejecución. #94555 (Alexander Gololobov).
- La creación de una carga de trabajo dentro de otra que está actualmente en uso ya no provoca un fallo. #94599 (Sergei Trifonov).
- Se corrige un fallo en la optimización de ANY LEFT JOIN cuando se evalúa
isNotNullsobre una columna ausente. #94600 (Molly). - Corregida la evaluación de expresiones por defecto al hacer referencia a otras columnas con valores por defecto calculados. #94615 (Alexey Milovidov).
- Corrige problemas de permisos en las operaciones de BACKUP/RESTORE. #94617 (Pablo Marcos).
- Se corrige un cierre inesperado debido a una conversión de tipo incorrecta cuando el tipo de dato es
Nullable(DateTime64). #94627 (Miсhael Stetsyuk). - Corrige un error por el que ciertas consultas distribuidas con
ORDER BYpodían devolver columnasALIAScon los valores intercambiados (es decir, la columnaamostraba los datos de la columnaby viceversa). #94644 (filimonov). - Se corrigió el guardado de los resultados de keeper-bench en un archivo. #94654 (Antonio Andelic).
- Corrige estimaciones incorrectas con estadísticas de tipo MinMax cuando la columna contiene valores de coma flotante negativos. #94665 (zoomxi).
- Se corrige la lectura de archivos Parquet cuando la clave de un map es un struct. #94670 (Konstantin Vedernikov).
- Corrige un posible resultado incorrecto de RIGHT join al usar condiciones ON complejas. Cierra #92913. #94680 (Vladimir Cherkasov).
- Preservar la granularidad constante del índice (use_const_adaptive_granularity) después de las fusiones verticales. #94725 (Azat Khuzhin).
- Corrige un error en mutaciones con subconsultas escalares y dependencias de una tabla. Si una tabla tenía dependencias (índice o proyecciones) sobre una columna, las subconsultas escalares podían evaluarse y almacenarse en caché sin ningún dato, lo que podía provocar cambios incorrectos. #94731 (Raúl Marín).
- Se corrigió el fallback de cpu_pressure de AsynchronousMetrics en caso de error. #94827 (Raúl Marín).
- A la función
getURLHostRFCle faltaban comprobaciones de límites antes de desreferenciar punteros. Cuando se pasaba una cadena vacía adomainRFC, se leía memoria sin inicializar, lo que desencadenaba errores de MSan. #94851 (Alexey Milovidov). - Corregir el modo de solo lectura de los discos cifrados. #94852 (Azat Khuzhin).
- Corrige un error lógico en
LIMIT/OFFSETcon valores fraccionarios al usar el analizador antiguo con tablas Distributed. Cierra #94712. #94999 (Ahmed Gouda). - Se corrige un fallo que se producía en determinadas condiciones cuando los filtros de ejecución de JOIN están habilitados de forma predeterminada. #95000 (Alexander Gololobov).
- Mejora del enmascaramiento de contraseñas en la URL utilizada en el motor de tabla
URL()y la función de tablaurl(). #95006 (Vitaly Baranov). - La función
toStartOfIntervalahora funciona igual quetoStartOfX, dondeXesDay, Week, Month, Quarter, Year, cuandoenable_extended_results_for_datetime_functionsestá activado. #95011 (Kirill Kopnev). - Corrige las comparaciones de cadenas constantes que no tenían en cuenta las opciones
cast_string_to_date_time_mode,bool_true_representation,bool_false_representationeinput_format_null_as_default. Cierra #91681. #95040 (Nihal Z. Miaji). - Se corrige una condición de carrera en la caché del sistema de archivos. #95064 (Alexey Milovidov).
- Se corrige una condición de carrera poco frecuente en el lector de Parquet. #95068 (Alexey Milovidov).
- Se corrige un fallo en la optimización top K cuando
LIMITes cero. Cierra #93893. #95072 (Alexey Milovidov). - Al convertir DateTime/enteros a Time64, se extrae el componente de hora del día mediante
toTime, que no es monótono. La plantillaToDateTimeMonotonicityafirmaba erróneamente que esta conversión era monótona, lo que provocaba la excepción “Invalid binary search result in MergeTreeSetIndex” en las compilaciones de depuración. #95125 (Alexey Milovidov). - La lista de entradas del archivo manifest se volvió a crear solo cuando fue necesario (anteriormente se hacía en cada iteración). #95162 (Daniil Ivanik).
Mejora en compilación/pruebas/empaquetado
- Se añade un conjunto de herramientas para el perfilado de asignaciones de memoria en el parser de ClickHouse SQL mediante las capacidades de perfilado de heap de jemalloc. #94072 (Ilya Yatsishin).
- Se añadió una herramienta que simplifica la depuración de asignaciones de memoria en el parser. Utiliza la métrica
stats.allocatedde jemalloc antes y después de analizar la consulta hasta su representación AST para mostrar qué se ha asignado. También admite un modo de perfilado de memoria que vuelca el perfil antes y después para generar informes sobre dónde se produjeron las asignaciones. #93523 (Ilya Yatsishin). - Se eliminan inclusiones transitivas de libc++. #92523 (Raúl Marín).
- Algunas pruebas secuenciales pasan a ejecutarse en paralelo: https://github.com/ClickHouse/ClickHouse/pull/93030/changes#diff-c3a73510dae653c9bbfa24300b32f5d6ec663fd4e72cc4a3d5daa6e4342915df. #93030 (Nikita Fomichev).
- Se limpian algunas banderas de compilación. #93679 (Raúl Marín).
- Se actualiza c-ares de v1.34.5 a v1.34.6. Esto corrige
CVE-2025-62408de c-ares, que no es relevante para ClickHouse. #94129 (Govind R Nair). - Se usa
curl8.18.0. #94742 (Konstantin Bogdanov).