Skip to main content

Lanzamiento de ClickHouse 26.7, 2026-07-22. Presentación, Vídeo

Cambio incompatible con versiones anteriores

  • El acceso a S3 originado desde SQL de usuario ya no resuelve de forma predeterminada las credenciales en la nube del propio servidor (entorno, IMDS/IRSA, perfil de instancia, archivos de configuración de AWS, STS basado en role_arn, metadatos OAuth de GCP); esa solicitud debe usar credenciales explícitas o NOSIGN. Las colecciones con nombre ahora establecen use_environment_credentials en 0 de forma predeterminada. El comportamiento anterior puede restaurarse por solicitud con use_environment_credentials = 1 (o globalmente mediante la configuración <s3>) junto con el nuevo ajuste s3_allow_server_credentials_in_user_queries (deshabilitado de forma predeterminada). Las credenciales proporcionadas explícitamente y las credenciales de configuración aprovisionadas por el operador no se ven afectadas. Al iniciar el servidor o en RESTORE, una tabla persistente S3/S3Queue, un disco S3 dinámico o un DataLakeCatalog cuya definición resuelva dichas credenciales se carga de forma anónima (inaccesible hasta volver a proporcionar credenciales) en lugar de abortar el inicio, controlado por el nuevo ajuste del servidor s3_load_table_anonymously_if_credentials_restricted (habilitado de forma predeterminada). #106855 (Raúl Marín).
  • El glob **/ (cualquier número de directorios) ahora también coincide con el mismo directorio. Antes, **/ en los patrones glob no se trataba como un caso especial, por lo que data/**/file.txt no coincidía con data/file.txt (cero niveles de directorio). #97676 (Alexey Milovidov).
  • Se rechaza el formato de archivo de copia de seguridad zip/zipx para copias de seguridad almacenadas en almacenamiento de objetos — destinos directos S3(...)/AzureBlobStorage(...) y destinos Disk(...) respaldados por S3 o Azure — tanto para BACKUP como para RESTORE. Zip requiere posicionamiento para leer su directorio central, lo que es muy lento sobre almacenamiento de objetos. Use en su lugar un formato basado en tar, como tar.gz. #101770 (Yash ).
  • Se amplió el rango admitido de DateTime64 de [1900-01-01, 2299-12-31] a [0000-01-01, 9999-12-31]. Los valores fuera del rango anterior ahora se calculan correctamente (mediante cctz) en lugar de saturarse en el límite. Con precisión 8 o 9, el rango sigue siendo más estrecho porque los ticks se almacenan como Int64 (con precisión de nanosegundos, el máximo sigue siendo 2262-04-11). Compatibilidad con versiones anteriores: si antes usaba fechas y horas fuera de rango, pero dependía de las reglas de saturación muy específicas dentro del rango antiguo, tenga en cuenta que ahora los resultados cambian para ser más correctos. #107907 (Alexey Milovidov).
  • AggregatingMergeTree ahora rechaza, en el momento de crear la tabla, esquemas en los que una columna no forma parte de la clave de ordenación ni es una medida de estado de agregación (AggregateFunction/SimpleAggregateFunction). Esas columnas se reducen silenciosamente a un valor arbitrario durante las fusiones en segundo plano, lo que produce resultados incorrectos para las consultas que usan GROUP BY o filtran sobre ellas. Establezca allow_dimensions_outside_sorting_key = 1 para restaurar el comportamiento anterior. Cierra #751. #108087 (Alexey Milovidov).
  • Se eliminó la configuración de planificación de cargas de trabajo basada en configuración (las secciones de configuración del servidor resources y workload_classifiers). Use en su lugar las consultas CREATE RESOURCE y CREATE WORKLOAD. Las secciones de configuración obsoletas se ignoran con una advertencia. #108286 (Sergei Trifonov).
  • ClickHouse ahora usa siempre el hash unificado de deduplicación de inserciones tanto para las inserciones síncronas como para las asíncronas; se han eliminado los comportamientos heredados de deduplicación por inserción. La configuración del servidor insert_deduplication_version se mantiene como salvaguarda de migración: el servidor se niega a iniciarse si está establecida en un valor heredado (old_separate_hashes o compatible_double_hashes). Para actualizar desde una versión que usaba un valor heredado, primero ejecute una versión que admita compatible_double_hashes (que escribe tanto los hashes heredados como los unificados). En el caso de las tablas replicadas, ejecútela durante al menos replicated_deduplication_window_seconds (una hora de forma predeterminada; las ventanas predeterminadas conservan los hashes unificados de todas las inserciones durante esa ventana, lo que se considera suficiente para un bucle de reintento de inserciones). En el caso de las tablas no replicadas con non_replicated_deduplication_window > 0, esa ventana se basa en el número de inserciones y no en el tiempo, así que ejecute compatible_double_hashes durante al menos esa cantidad de inserciones. Después, elimine la configuración (o establézcala en new_unified_hash) antes de actualizar a esta versión. #108361 (Sema Checherinda). Si nunca configuró insert_deduplication_version, puede ignorar este punto.
  • Se eliminaron las funciones obsoletas desde hace tiempo snowflakeToDateTime, snowflakeToDateTime64, dateTimeToSnowflake y dateTime64ToSnowflake. Ya habían quedado obsoletas en la v24.6 en favor de snowflakeIDToDateTime, snowflakeIDToDateTime64, dateTimeToSnowflakeID y dateTime64ToSnowflakeID, que son las que deben usarse ahora. La configuración allow_deprecated_snowflake_conversion_functions (que antes permitía volver a habilitarlas) ahora también está obsoleta y no tiene ningún efecto. #108711 (Alexey Milovidov).
  • La configuración use_legacy_to_time ahora tiene 0 como valor predeterminado, por lo que toTime convierte los valores al tipo de dato Time en lugar de convertir una fecha con hora en una fecha fija. El comportamiento heredado sigue disponible mediante la función toTimeWithFixedDate o estableciendo use_legacy_to_time = 1. #108729 (Alexey Milovidov).
  • Los modelos de Naive Bayes (utilizados por naiveBayesClassifier) ahora se configuran como un diccionario con el layout NAIVE_BAYES, construido en el momento de la carga a partir de una tabla de recuentos de n-gramas preagregados por clase, en lugar de la configuración anterior del lado del servidor (un archivo de configuración XML que hacía referencia a archivos de modelo .bin serializados), que ya no es compatible; los modelos existentes deben recrearse como diccionarios. Además de naiveBayesClassifier, se añaden tres funciones nuevas: naiveBayesClassifierWithProb devuelve la clase predicha junto con su probabilidad, naiveBayesClassifierWithAllProbs devuelve todas las clases con su probabilidad, y naiveBayesNgrams tokeniza el texto en n-gramas de la misma manera que lo hace el diccionario, para construir los datos de entrenamiento a partir de texto etiquetado sin procesar. Además, se han aplicado varias optimizaciones de rendimiento: en un modelo de lenguaje de trigramas de puntos de código de 9.7 MiB, usa ~49× menos memoria (de 1.84 GiB a 38 MiB), carga ~11× más rápido y clasifica ~11× más rápido. #108773 (Nihal Z. Miaji).
  • La función hasColumnInTable ya no acepta los argumentos opcionales hostname, username y password para comprobar una columna en un servidor remoto arbitrario; solo se mantiene la forma hasColumnInTable(database, table, column). El modo remoto eliminado suponía un problema de seguridad: permitía a cualquier usuario iniciar conexiones salientes a hosts arbitrarios y filtraba credenciales en los registros de consultas, y no estaba protegido por ningún privilegio. #110881 (Alexey Milovidov).

Nueva funcionalidad

  • Se añadió EXPLAIN ANALYZE para analizar el rendimiento de las consultas: la consulta se ejecuta y las métricas reales de ejecución se muestran en el formato habitual del plan de consulta. #106586 (Kirill Kopnev). #110668 (Kirill Kopnev).
  • Se añadió compatibilidad con cláusulas WHERE en las definiciones de proyecciones. Las proyecciones con WHERE solo materializan las filas que cumplen el predicado, y el optimizador puede utilizarlas (basándose en costes) cuando el WHERE de la consulta implica el WHERE de la proyección. #102347 (S Bala Vignesh).
  • Se añadió la configuración skip_unavailable_shards_mode (también disponible como configuración del motor Distributed) para controlar qué excepciones de un segmento remoto se ignoran silenciosamente cuando skip_unavailable_shards está habilitado. #79091 (cjw).
  • Se añadió la función de agregación groupFormat, que da formato a las filas de cada grupo usando un formato de salida especificado y devuelve el resultado como una cadena. #93201 (Yang Hu).
  • Se añadió AWS_MSK_IAM como valor admitido para kafka_sasl_mechanism, lo que permite a ClickHouse autenticarse con Amazon MSK mediante roles de IAM sin tener que gestionar credenciales SASL/SCRAM. #96100 (kalavt).
  • Se añadió el combinador de funciones de agregación -Tuple, que aplica la función de agregación subyacente a cada elemento de una columna Tuple de forma independiente y devuelve un Tuple con los resultados, preservando los nombres de los elementos: sumTuple(t) para t = (a, b) devuelve (sum(a), sum(b)). Las funciones de agregación con varios argumentos toman una tupla por argumento, emparejada por posición: corrTuple((a1, a2), (b1, b2)) devuelve (corr(a1, b1), corr(a2, b2)). A diferencia de -ForEach sobre arrays, los elementos pueden tener tipos diferentes, y se conservan los tipos y nombres de los resultados de cada elemento. #98190 (RinChanNOW).
  • Los índices de texto ahora admiten un argumento postprocessor: una expresión arbitraria que transforma cada token después de la tokenización (por ejemplo, lower). #98939 (Jimmy Aguilar Mena). #108606 (Jimmy Aguilar Mena).
  • Se añadió la tabla del sistema system.stemmers, que enumera todos los idiomas que pueden especificarse para la función stem. #100611 (Jimmy Aguilar Mena).
  • Se añadió compatibilidad con WITH TIES para LIMIT negativo. #100930 (Nihal Z. Miaji).
  • Se añadió compatibilidad con los operadores postfijos AT TIME ZONE y AT LOCAL de SQL estándar como azúcar sintáctico de toTimeZone. La expresión expr AT TIME ZONE zone ahora equivale a toTimeZone(expr, zone), y expr AT LOCAL equivale a toTimeZone(expr, timeZone()). #106092 (lizepeng).
  • El motor de tabla URL y la función de tabla url ahora redirigen al backend adecuado según el esquema de la URL: file:// lo atiende el motor File, s3:///gs:///gcs:///oss:// S3, az:///azure:///abfss:///abfs:// AzureBlobStorage, hdfs:// HDFS y http(s):// el motor URL, como antes. La configuración url_base se aplica antes de la redirección por esquema. Solo se redirigen los esquemas de S3 resueltos por los url_scheme_mappers predeterminados; otros esquemas de proveedores compatibles con S3 (cos, obs, …) no se redirigen y requieren usar directamente el motor o la función s3. #106093 (Alexey Milovidov).
  • Se añadieron los motores de tabla Remote y RemoteSecure, las contrapartes persistentes de las funciones de tabla remote y remoteSecure. CREATE TABLE ... ENGINE = Remote('addresses', db, table, ...) ahora funciona además de CREATE TABLE ... AS remote(...). #106189 (Alexey Milovidov).
  • Se añadieron los comandos independientes del motor SYSTEM STOP, SYSTEM START, SYSTEM PAUSE, SYSTEM CANCEL y SYSTEM REFRESH, junto con sus variantes para todo el servidor ... ALL BACKGROUND, para controlar la actividad en segundo plano de las tablas Kafka, RabbitMQ, NATS, S3Queue/AzureQueue y de las vistas materializadas actualizables mediante una interfaz unificada. En el caso de las vistas materializadas actualizables, actúan como alias de los comandos existentes SYSTEM ... VIEW. Como parte del soporte de estos controles en NATS, las tablas JetStream ahora confirman los mensajes solo después de un insert correcto (al menos una vez; antes los mensajes se confirmaban automáticamente al entregarse y podían perderse si fallaba el insert). Una nueva configuración nats_wait_for_flush_interval (valor predeterminado false, para preservar el comportamiento anterior de baja latencia) permite mantener abierto un ciclo de consumo durante todo el intervalo de flush, en lugar de hacer flush en cuanto se vacía la cola. Una nueva configuración nats_commit_on_select hace que un SELECT directo sobre una tabla JetStream consuma (confirme) los mensajes que lee. #107476 (Samuel Krempaský).
  • Se añadió soporte para que las funciones de tabla y los motores de tabla mysql, postgresql y sqlite acepten una consulta del usuario (en lugar de un nombre de tabla) y la pasen tal cual a la base de datos externa, ya sea escrita como una subconsulta (SELECT ...) o como query('SELECT ...'). La estructura de la tabla resultante se infiere a partir del resultado de la consulta, y dicha tabla es de solo lectura. Cierra #46758. Basado en la implementación inicial de Denis Vidiaev (#79652). #107740 (Alexey Milovidov).
  • Se añadieron pestañas a la UI web de ClickHouse (Play) para trabajar con varias consultas a la vez. Las pestañas, sus títulos, parámetros, estado activo y pequeñas instantáneas de resultados se conservan entre recargas (los resultados grandes y las imágenes no se restauran), se integran con el historial del navegador y la URL, y se puede cambiar entre ellas con la rueda del ratón. #107826 (Alexey Milovidov).
  • Se introduce el motor de tabla QueryRunner. Los registros insertados en una tabla QueryRunner representan consultas que ejecuta el motor. El motor puede usarse para la ejecución asíncrona de consultas, la ejecución por lotes de consultas generadas, el envío de consultas a clusters remotos, benchmarks, fuzzing y pruebas con tráfico en sombra. #107888 (Miсhael Stetsyuk).
  • Se añade el formato de salida GeoJSON para escribir documentos FeatureCollection de GeoJSON, generando una feature por fila. La única columna de tipo geo (Point, LineString, MultiLineString, Polygon, MultiPolygon, Ring o Geometry) pasa a ser la geometry de cada feature; una columna llamada id pasa a ser el id de la feature; y todas las columnas restantes pasan a ser las properties de la feature, donde una única columna de tipo objeto llamada properties (un JSON, Map o Tuple con nombre) se escribe directamente como el objeto properties. Un Ring se escribe como un Polygon de un solo anillo. El nuevo ajuste format_geojson_validate_geometry (habilitado de forma predeterminada) controla si las geometrías que no son formas GeoJSON válidas —como un Polygon con menos de cuatro puntos o un anillo de Polygon no cerrado— se rechazan al leer y escribir. Además, el formato de entrada GeoJSON ahora infiere la columna id como Nullable(String) en lugar de String, de modo que una feature con un miembro "id": null ausente o explícito se lea como NULL y se mantenga diferenciada de una cadena vacía "". Basado en la implementación inicial de Mark Needham (#98124). #108065 (Nihal Z. Miaji).
  • Se añadió la función dotProductTransposed (alias scalarProductTransposed), que calcula el producto interno aproximado entre una columna QBit y un vector de referencia, complementando las funciones existentes L2DistanceTransposed y cosineDistanceTransposed. #108100 (Alexey Milovidov). También se añadieron las funciones de distancia transpuesta cuantizada cosineDistanceTransposedQuantized, L2DistanceTransposedQuantized y dotProductTransposedQuantized, que operan sobre un QBit(Int8) de códigos Lloyd-Max de quantizeBFloat16ToInt8, descuantizando los códigos almacenados sobre la marcha. Un vector de referencia de coma flotante es la consulta de precisión completa, comparada con precisión Float32 (una consulta Float64 se reduce); una referencia Array(Int8) también se descuantiza, para una distancia simétrica entre cuantizado y cuantizado. #109405 (Alexey Milovidov).
  • Se añadió un parámetro stride opcional al tipo de dato QBit (QBit(T, dimension, stride)) que almacena grupos de dimensiones en flujos separados, de modo que una búsqueda vectorial pueda leer eficientemente solo las primeras dimensiones (por ejemplo, para Matryoshka embeddings). Las funciones de distancia transpuesta aceptan un cuarto argumento opcional, used_dims, para leer un número reducido de dimensiones. #108103 (Alexey Milovidov).
  • Se añadió soporte para el tipo de elemento Int8 en el tipo de dato QBit, lo que permite el almacenamiento y la búsqueda vectorial por distancia transpuesta (L2DistanceTransposed, cosineDistanceTransposed) sobre vectores enteros cuantizados de 8 bits. #108105 (Alexey Milovidov).
  • Nueva función randomHadamardTransform(vector[, seed[, output_dims]]): una transformada Hadamard aleatorizada determinista de un vector de coma flotante —una rotación ortogonal que preserva la norma, útil para el preprocesamiento de embeddings antes de la cuantización y, cuando se trunca, como proyección aleatoria de Johnson–Lindenstrauss / Hadamard aleatorizada con submuestreo. #108227 (Alexey Milovidov).
  • Soporte para configurar la carga diferida de diccionarios de forma individual con el ajuste dictionary_lazy_load en la definición del diccionario, anulando el ajuste global de servidor dictionaries_lazy_load, de modo que algunos diccionarios puedan cargarse de forma diferida mientras que otros se cargan inmediatamente. #108314 (Miсhael Stetsyuk).
  • Se añadió una página integrada de búsqueda de documentación, disponible en la ruta /docs de la interfaz HTTP, que ofrece búsqueda instantánea en la tabla system.documentation y muestra la documentación de referencia (con resaltado de sintaxis, fórmulas matemáticas y enlaces cruzados). #108345 (Alexey Milovidov).
  • Se añadió la función xxHash64Spark, que calcula valores xxHash64 compatibles con Spark para entradas String y NULL usando la semilla 42 y devuelve Int64. #108436 (Lalit Yadav).
  • ALTER USER, ALTER ROLE y ALTER SETTINGS PROFILE ahora aceptan SET name = value como alias de MODIFY SETTING name = value. Esto modifica configuraciones individuales in situ sin afectar al resto, a diferencia de la cláusula SETTINGS simple, que reemplaza toda la lista de configuraciones. Así es menos probable borrar accidentalmente otras configuraciones de un usuario. #108722 (Groene AI).
  • Se admite ALTER TABLE ... MODIFY CONSTRAINT [IF EXISTS] name CHECK expr para cambiar in situ la expresión de una restricción existente. #108768 (Alexey Milovidov).
  • Web UI: se añadió un selector de codificación por colores por columna (el icono 🌈 en el encabezado de una columna) para alternar entre barras, heatmap, categórico y sin visualización. Los modos seleccionados se conservan en la URL y en el historial del navegador. #108873 (Alexey Milovidov).
  • Keeper ahora maneja correctamente el opcode CreateContainer (19) de ZooKeeper, controlado mediante un nuevo indicador de feature opcional create_container (deshabilitado de forma predeterminada, igual que create_ttl). Una vez habilitado tras una upgrade completa del ensemble, los client externos de ZooKeeper (p. ej., Java ZooKeeper 3.9+) pueden crear nodos contenedor en Keeper en lugar de recibir ConnectionLoss; los nodos contenedor informan el valor centinela ephemeralOwner esperado, y un hilo de GC en segundo plano en el líder elimina automáticamente los contenedores sin hijos. Una solicitud Create normal que incluya el indicador de modo de creación CONTAINER sin el opcode 19 sigue siendo rechazada (ZBADARGUMENTS): no se conoce ningún client de ZooKeeper que emita esa combinación. Esto es solo compatibilidad de protocolo del lado del servidor: el propio client ZooKeeper de ClickHouse (zkutil) no cambia y no tiene API para crear nodos contenedor por sí mismo. #108908 (unintended).
  • Se añadieron las funciones geoToUTM, UTMToGeo, geoToMGRS y MGRSToGeo para convertir entre coordenadas geográficas WGS84 y los sistemas de coordenadas UTM y MGRS. #108939 (Alexey Milovidov).
  • Se añadió la función digits(n, offset[, length]), que devuelve los dígitos de n a partir del offset de base 1 y con una longitud de length dígitos, o hasta el final del número si se omite length. #109012 (Umang Agrawal).
  • Se añadió la función aritmética sqr para calcular el cuadrado de un número. #109061 (Lalit Yadav).
  • Se añadió una nueva función dictGetRoot que devuelve el ancestro más alto (la raíz) de una clave en un diccionario jerárquico. Es un equivalente práctico de dictGetHierarchy(dict_name, key)[-1]. #109459 (Alexey Milovidov).
  • Se añaden los comandos SYSTEM UNLOAD DICTIONARY y SYSTEM UNLOAD DICTIONARIES para liberar la memoria del diccionario sin eliminar su definición. Los diccionarios se volverán a cargar de forma diferida en el siguiente acceso. #109639 (Matheus Nerone).
  • Se añaden las funciones geometryIntersectCartesian y geometryIntersectSpherical, que devuelven si dos geometrías se intersecan. A diferencia de polygonsIntersectCartesian/polygonsIntersectSpherical, aceptan cualquier tipo de datos geométrico (Point, LineString, MultiLineString, Ring, Polygon, MultiPolygon), incluido el tipo común Geometry, y los dos argumentos pueden ser de tipos distintos. #110062 (Alexey Milovidov).
  • Los parámetros de consulta (sustituciones {name:Type}) ahora pueden usarse como valores de configuración, tanto en la cláusula SETTINGS de una consulta (como SELECT o INSERT) como en consultas SET independientes; por ejemplo, SELECT ... SETTINGS max_threads = {threads:UInt64} y SET max_threads = {threads:UInt64}. #108760 (Alexey Milovidov).

Funcionalidad experimental

  • Expansión de comodines para la table function url y el table engine URL: los comodines en la ruta de la URL se expanden enumerando páginas índice HTTP (listados de directorios en HTML o plaintext) y extrayendo las URL coincidentes, con límites tanto en el tamaño de la página índice como en el número de directorios leídos. Se habilita mediante la configuración allow_experimental_url_wildcard_from_index_pages. #95181 (Yue Ni).
  • Los índices de texto ahora pueden almacenar posiciones de tokens (el argumento de índice support_phrase_search) para permitir la coincidencia exacta de frases con lecturas directas para la función hasPhrase. Requiere habilitar la configuración de MergeTree allow_experimental_text_index_phrase_search. #103172 (Elmi Ahmadov). El argumento se introdujo inicialmente con el nombre positions. #109900 (Elmi Ahmadov).
  • Se añade compatibilidad con la compactación de manifest files para tablas Iceberg mediante OPTIMIZE TABLE ... MANIFEST (protegido por la configuración allow_experimental_iceberg_compaction). Cierra #95174. #98178 (Smita Kulkarni). Se corrige OPTIMIZE TABLE ... MANIFEST para tablas Iceberg cuando las tuplas de partición del manifiesto no coinciden con su especificación de partición. #111368 (Smita Kulkarni).
  • Se añade una variante Real Doubles (RD) y un argumento opcional ALP(AUTO|STD|RD) al códec experimental ALP. ALP sin argumentos ahora selecciona automáticamente entre el esquema STD existente y RD en lugar de usar siempre STD. #99654 (Nazarii Piontko).
  • Se añade una caché SLRU en memoria para metadata files deserializados de Paimon (manifest lists y manifests). Cuando se habilita mediante la configuración use_paimon_metadata_files_cache, las consultas repetidas sobre la misma tabla Paimon evitan volver a descargar y analizar los metadatos desde object storage. #104657 (XiaoBinMu).
  • Se añadieron “drivers” para funciones definidas por el usuario ejecutables. Un driver declarado en <user_defined_executable_function_drivers_config> puede usarse en CREATE FUNCTION name ARGUMENTS (...) RETURNS T ENGINE = DriverName(...) AS '...code...' para compilar o procesar de otro modo un fragmento de code de usuario en el momento de crear la función y producir una executable UDF utilizable. La configuración resultante se almacena en <dynamic_user_defined_executable_functions_path>, y la consulta original se conserva como ATTACH FUNCTION para que la función sobreviva a los reinicios del servidor. Un driver c_function_body de prueba de concepto compila y ejecuta cuerpos de funciones C dentro de contenedores Docker aislados en modo executable_pool. Basado en la implementación inicial de Daniil Timižev (#77128). #105131 (Alexey Milovidov).
  • Atiende SELECT count(*) FROM t WHERE col <op> default(col) a partir de estadísticas de dispersión por columna en serialization.json, sin escanear datos, cuando el predicado divide exactamente la columna entre valores predeterminados y no predeterminados (bajo la nueva configuración experimental optimize_trivial_count_with_sparsity_filter, desactivada de forma predeterminada). #105890 (Raúl Marín).
  • Las API request de Prometheus Query API a /api/v1/query y /api/v1/query_range ahora se registran en system.query_log con las métricas read_rows y read_bytes. #106611 (James Cunningham).
  • La ruta de lectura experimental de ReaderExecutor (use_reader_executor, desactivada de forma predeterminada) ahora puede mantener abierta una conexión remota al origen y reutilizarla en lecturas secuenciales, lo que reduce la cantidad de solicitudes al almacenamiento de objetos durante los escaneos. #107735 (Sema Checherinda). Ahora también admite la lectura de archivos cifrados, con una caché global de encabezados de cifrado configurada mediante la configuración del servidor encryption_header_cache_size y vaciada con SYSTEM DROP ENCRYPTION HEADERS CACHE. #109702 (Sema Checherinda).
  • Se admiten lecturas del plan de consultas distribuidas para SELECT ... FINAL en tablas de la familia MergeTree cuando make_distributed_plan está habilitado. #108148 (Alexander Gololobov).
  • Se añade la ejecución experimental de réplicas paralelas basada en planes para consultas de MergeTree. #108504 (Igor Nikonov).
  • Se añadió la familia experimental de códecs vectoriales Quantize y una reescritura opcional de búsqueda vectorial aproximada en dos etapas sobre flujos complementarios cuantizados. #108565 (Shankar Iyer).
  • Se recupera el códec de compresión con pérdidas experimental SZ3, con error acotado, para columnas Float32/Float64 (y sus arrays), implementado originalmente por Konstantin Vedernikov (#83088). Requiere allow_experimental_codecs. #108788 (Alexey Milovidov). Se corrigió la lectura de datos comprimidos con SZ3('ALGO_LORENZO_REG', ...), que antes fallaba con CORRUPTED_DATA, y se evitó un comportamiento indefinido al comprimir valores de coma flotante no finitos (NaN e infinitos). #110762 (Alexey Milovidov).
  • Se añadió el códec experimental ZXC —un códec LZ asimétrico con compresión lenta y descompresión muy rápida, con una relación de compresión entre LZ4 y ZSTD. Requiere allow_experimental_codecs = 1, y system.compression_codecs lo informa como experimental. #110620 (Alexey Milovidov). #111007 (Alexey Milovidov).
  • Ahora puede autenticarse en OneLake usando un token Bearer obtenido previamente mediante la configuración onelake_bearer_token, en lugar de onelake_client_id y onelake_client_secret. Esto evita compartir un secreto de client de larga duración. El token no se renueva, por lo que la base de datos debe recrearse una vez que expire. #109104 (Asya Shneerson).
  • Las funciones de IA ya no toman la colección con nombre como primer argumento posicional. Las credenciales provienen de las configuraciones ai_function_text_default_credentials / ai_function_embedding_default_credentials o de una clave credentials en un argumento final opcional Map(String, String), que también incluye parámetros ajustables (model, max_tokens, temperature, system_prompt, instructions, dimensions). #109232 (George Larionov). La función aiEmbed ahora toma model como argumento posicional obligatorio (aiEmbed(text, model[, params])) en lugar de leerlo de la colección con nombre, lo que garantiza la reproducibilidad de los embeddings. #110619 (George Larionov).
  • Se corrigió data_uncompressed_bytes para los índices de omisión empaquetados en skp_idx.packed (mediante packed_skip_index_max_bytes): el tamaño sin comprimir informado era en realidad el tamaño comprimido, lo que también podía impedir la activación de distributed_index_analysis. #109272 (Raúl Marín).
  • Se añadió almacenamiento experimental de partes de datos empaquetadas para tablas MergeTree, que guarda la mayoría de los archivos de una parte en un único archivo data.packed en lugar de un archivo por flujo (las proyecciones y unos pocos archivos de servicio, como txn_version.txt, todavía se escriben por separado). Se controla mediante los ajustes min_bytes_for_full_part_storage, min_rows_for_full_part_storage y min_level_for_full_part_storage, y está deshabilitado de forma predeterminada. Una vez que una tabla escribe partes empaquetadas, las versiones anteriores del servidor ya no pueden leerlas, por lo que habilitar este formato impide volver a una versión anterior del servidor. #108118 (Raúl Marín).
  • Se añadió la función de tabla experimental eval, que evalúa una expresión constante como una cadena de consulta y ejecuta la única consulta SELECT resultante. La funcionalidad está deshabilitada de forma predeterminada y puede habilitarse con el ajuste allow_experimental_eval_table_function. Autor: Yue Ni. #110132 (Alexey Milovidov).
  • Se añadió compatibilidad con compresión zstd al handler HTTP v1 experimental de remote-write de Prometheus. #110907 (James Cunningham).
  • La escritura en tablas DeltaLake (el ajuste allow_experimental_delta_lake_writes) pasó a Beta. #107034 (Kseniia Sumarokova).
  • Se añadieron los ProfileEvents DistributedPlanRemoteTasks, DistributedPlanLocalExecution y DistributedPlanHostsUsed para observar la ejecución de planes de consulta distribuidos experimentales (make_distributed_plan). #107985 (Shankar Iyer).
  • Se eliminó el almacenamiento experimental basado en RocksDB en Keeper (experimental_use_rocksdb). Pronto llegará un nuevo almacenamiento en disco mejorado. #108000 (Michael Kolupaev).
  • El análisis de índices distribuido (una funcionalidad experimental controlada por el ajuste distributed_index_analysis) ahora envía listas grandes de nombres de partes de datos a servidores remotos como escalares, en lugar de incrustarlas en el texto de la consulta. Esto evita posibles fallos debidos a los límites de max_ast_elements / max_query_size y elimina la sobrecarga del análisis del AST. #110419 (Azat Khuzhin).
  • Se optimizaron las funciones experimentales de agregación timeSeries*ToGrid: los buckets ahora se alinean tanto con el paso como con la ventana, y la agregación final es mucho más rápida cuando la ventana es mucho mayor que el paso. El formato de serialización del estado de agregación se cambió de forma incompatible (estas funciones son experimentales). #106724 (Vitaly Baranov).
  • Las tablas de destino externas de una tabla TimeSeries ahora se registran como dependencias referenciales: al igual que con las vistas materializadas, esto impide eliminar una tabla de destino externa antes de eliminar la tabla TimeSeries que la referencia (si check_referential_table_dependencies está habilitado). #108388 (Vitaly Baranov).
  • Se añadió la función de PromQL increase. #111023 (Vitaly Baranov).

Mejora del rendimiento

  • Los JOIN ahora pueden usar el índice de la primary key o los skip indexes de la tabla del lado izquierdo para podar gránulos. Esto se controla con la configuración enable_join_runtime_filters_index_analysis. #109085 (Shankar Iyer).
  • La serialización y deserialización de vectores de tipos trivialmente serializables ahora usan una única llamada de E/S del búfer en lugar de procesar los elementos individualmente. #89842 (Jimmy Aguilar Mena).
  • Optimiza las búsquedas inversas en diccionarios: un predicado de igualdad constante como WHERE dictGet(dict, attr, key_expr) = value ahora se pliega directamente en un filtro por clave constante (key_expr = const, key_expr IN [...] o WHERE 0) en lugar de reescribirse como una subconsulta IN (SELECT ... FROM dictionary(...)), y la ruta constante de dictGetKeys ahora se ejecuta en paralelo. #91164 (Nihal Z. Miaji).
  • Añade una nueva configuración merge_tree_generic_exclusion_search_max_steps que limita el número de pasos que el algoritmo de búsqueda de exclusión genérica dedica a analizar el índice de la primary key de cada parte de datos. El presupuesto se consume primero en los rangos de clave restantes más grandes, por lo que incluso un presupuesto pequeño poda la mayor parte de los datos; los rangos que no se hayan analizado por completo se leen enteros, por lo que los resultados de la consulta siguen siendo correctos, aunque pueden leerse más gránulos. El límite se aplica de forma flexible: puede superarse como máximo en merge_tree_coarse_index_granularity pasos, más un paso por cada rango en el que la parte ya esté dividida (por ejemplo, por la caché de condiciones de consulta). El valor predeterminado 0 significa pasos ilimitados. #92779 (Michael Jarrett).
  • Las consultas con ORDER BY y LIMIT en vistas sobre tablas Distributed ahora usan la optimización de flujos ordenados por fusión: el ORDER BY/LIMIT externo se inserta en la consulta interna de una vista simple, de modo que cada shard ordena sus datos localmente y el coordinator fusiona flujos previamente ordenados en lugar de realizar una ordenación completa. #94102 (matanper).
  • Habilita optimize_or_like_chain de forma predeterminada. Cierra #87779. #94517 (Alexey Milovidov).
  • Marca las tablas de log del sistema MergeTree rotadas no replicadas sin TTL como table_readonly para evitar operaciones en segundo plano innecesarias. La configuración table_readonly de MergeTree ahora también suprime todo el trabajo en segundo plano en una tabla MergeTree normal — merges normales, de TTL (DELETE/MOVE/recompresión) y de recompresión, mutations en segundo plano y movimientos de partes en segundo plano — y rechaza los comandos de partición mutantes (ATTACH/MOVE/DROP/DROP DETACHED/FETCH/REPLACE PARTITION y MOVE PARTITION ... TO TABLE hacia la tabla), además de los inserts, mutations y OPTIMIZE que ya rechazaba. Como resultado, una tabla table_readonly con TTL ya no elimina sus datos expirados mientras esta configuración esté habilitada. #95079 (Mathuranath Metivier).
  • Mejora el rendimiento al recuperar un único registro de usuario de system.users cuando el servidor tiene muchos usuarios. #96699 (Alistair Evans).
  • La lectura en orden con réplicas paralelas ahora usa la misma lógica que la lectura local para dividir la tabla en max_threads partes, con el fin de mejorar el paralelismo. #101434 (Nikita Taranov).
  • Usa los límites del índice minmax de la partición para descartar más gránulos durante el análisis de la clave primaria en tablas MergeTree, cuando una columna de la clave primaria también es una columna de entrada de la clave de partición. Por ejemplo, en una tabla MergeTree con ORDER BY (id, event_time) y PARTITION BY toYYYYMM(event_time), ClickHouse usará el índice minmax de la partición sobre event_time durante el análisis del índice de la clave primaria para tomar decisiones más precisas al descartar gránulos. Controlado por la nueva configuración use_partition_minmax_for_primary_key_pruning (habilitada de forma predeterminada). #103480 (UnamedRus).
  • Habilita la caché de condiciones de consulta para las consultas que usan filtrado dinámico Top-K (ORDER BY ... LIMIT n). La entrada de caché se divide según los parámetros del plan Top-K, de modo que la misma consulta reutiliza los resultados en caché del filtro WHERE, mientras que un LIMIT, una columna de ordenación o una dirección de ordenación distintos generan una entrada nueva. #104478 (Alexey Milovidov).
  • Se añadió la configuración use_constant_folding_in_index_analysis (deshabilitada de forma predeterminada). Cuando está habilitada, el análisis de la clave primaria, MinMax y los índices de omisión de MergeTree aplica por separado a cada parte el plegado de constantes a nivel de partición en el predicado de filtro, lo que mejora el descarte en filtros cuyas ramas dependen de valores de partición; por ejemplo, (a = 1 AND b >= 1) OR (a = 2 AND b > 10) con PARTITION BY a. #104582 (Mikhail Artemenko).
  • Inserta LIMIT en la agregación en orden para permitir la finalización anticipada cuando la clave de GROUP BY coincide con la clave de ORDER BY y con la clave de ordenación de la tabla, lo que reduce significativamente el número de filas leídas. #104859 (Konstantin Bogdanov).
  • Actualizar los eventos de perfil ahora es hasta 30 veces más rápido gracias al uso de operaciones atómicas por CPU para contadores globales del servidor y por usuario. Controlado por la configuración de servidor user_profile_events_per_cpu (usa alrededor de 640 KiB por usuario en 64 núcleos, así que con un número muy grande de usuarios puede tener sentido mantenerla deshabilitada). #105056 (Azat Khuzhin).
  • Habilita allow_aggregate_partitions_independently de forma predeterminada. Cuando una clave de GROUP BY encaja con la clave de partición, ClickHouse puede agregar cada partición de forma independiente y omitir el paso de fusión global. Las heurísticas en tiempo de ejecución omiten automáticamente la optimización cuando la distribución de las particiones la hace desfavorable (muy pocas particiones, demasiadas particiones o tamaños de partición muy desiguales). #105128 (Alexey Milovidov).
  • Las consultas de búsqueda vectorial con rescoring (vector_search_with_rescoring = 1) ahora calculan la distancia exacta solo para las filas devueltas por el índice vectorial, aplicando un filtro exacto por posición de fila en lugar de hacer rescoring por fuerza bruta de filas vecinas del mismo gránulo de MergeTree. #105591 (Sergey Kuznetsov). #108846 (Sergey Kuznetsov).
  • Mejora el rendimiento del algoritmo de join partial_merge con claves FixedString al comparar secuencias de valores de una sola vez, en lugar de hacer una llamada de comparación por cada valor. #105737 (Artem Zuikov).
  • SHOW TABLES y system.tables en catálogos de lago de datos (Iceberg REST, Glue, Unity, Hive, Paimon) ahora trasladan al catálogo los predicados acotados por el espacio de nombres, evitando un escaneo completo del catálogo. Cierra #105022. #106029 (Smita Kulkarni).
  • Se limitó la memoria no rastreada por CPU para evitar overcommit y errores por falta de memoria (los límites se configuran con la configuración del servidor max_per_cpu_untracked_memory y per_cpu_untracked_memory_thread_buffer). #106055 (Azat Khuzhin).
  • Se aceleraron los operadores que escanean un stream ordenado en busca de secuencias de valores de clave iguales: DISTINCT in order, LIMIT BY in order, LIMIT BY negativo in order, y los joins full_sorting_merge y partial_merge. #106502 (Nihal Z. Miaji).
  • Se implementaron un reader y un writer nativos para los formatos Arrow y ArrowStream que no usan la biblioteca Apache Arrow, lo que evita copias y conversiones de datos adicionales. Ahora es la opción predeterminada (settings input_format_arrow_use_native_reader y output_format_arrow_use_native_writer) y es más rápida tanto para lectura como para escritura. #106522 (Alexey Milovidov).
  • Se volvió a habilitar LTO para jemalloc tras corregir una corrupción de la caché de hilos que aparecía con LTO, lo que mejora el rendimiento. #106898 (Azat Khuzhin).
  • Se redujo el uso de memoria y se mejoró el rendimiento de los JOIN. El lado derecho de un hash join ahora usa una referencia compacta a filas de 8 bytes basada en índices, por lo que las entradas de la tabla hash de los joins ALL son tan pequeñas como las de los joins ANY para cualquier tipo de clave. Se hicieron benchmarks sobre consultas grandes de join parallel_hash: joins INNER y ANY de tablas de entre 100 y 300 millones de filas con claves UInt64 y String, tanto únicas como duplicadas; la consulta mediana pasó a ser aproximadamente un 12% más rápida y usó alrededor de un 15% menos de memoria máxima, sin que ninguna consulta se volviera más lenta. Los joins INNER sobre claves UInt64 obtuvieron la mayor mejora (mediana de aproximadamente un 21% más rápida con un 38% menos de memoria). #107189 (Harikrishnan Prabakaran).
  • Las join keys de una sola columna LowCardinality(String) no Nullable ahora son compatibles de forma nativa en el hash join. #107264 (Nikita Taranov).
  • Se añadió el algoritmo dpsub para enumerar el orden de los joins (programación dinámica sobre subconjuntos), que proporciona planes de join óptimos con menor sobrecarga de optimización que dpsize y compatibilidad con joins no internos. #107351 (Fisnik Kastrati).
  • Se aceleró la carga de la filesystem cache al iniciar, codificando el tamaño de cada archivo de caché en su nombre (<offset>_<size>), lo que evita un stat por archivo. La carga de archivos de caché escritos por versiones anteriores sigue siendo compatible. #107415 (Alexey Milovidov).
  • Se mejoró el rendimiento de arrayElement en Array(LowCardinality(String)) y de las funciones LIKE de map en Map con claves o valores LowCardinality(String), evitando la materialización innecesaria de cadenas. #107450 (Michael Jarrett).
  • Se evita convertir una agregación de un solo nivel en una agregación de dos niveles cuando el uso de memoria es bajo, mediante el seguimiento de la memoria del propio estado de agregación en lugar de la memoria de toda la consulta. #107490 (Hechem Selmi).
  • Se aceleró el análisis de las consultas de agregación: la clave de caché para las estadísticas del tamaño de la tabla hash de agregación ahora se calcula a partir del plan de consulta en lugar de construir el AST completo de la consulta. #107643 (Dmitry Novik).
  • Mejora varias veces el rendimiento de INTERSECT ALL y EXCEPT ALL (el modo predeterminado de INTERSECT y EXCEPT) usando el valor de la fila como clave del multiconjunto, en lugar de aplicar SipHash a cada fila. #107649 (Raúl Marín).
  • Reconstruye los filtros de ROW POLICY sin mantener bloqueada la caché, lo que mejora la escalabilidad de las consultas durante CREATE ROW POLICY y DROP ROW POLICY concurrentes. #107917 (Azat Khuzhin).
  • Acelera las funciones match, extract, extractAll, replaceRegexpOne y replaceRegexpAll para expresiones regulares simples compilándolas a código nativo con LLVM. Se controla con la nueva configuración compile_regular_expressions (habilitada de forma predeterminada); los patrones que quedan fuera del subconjunto admitido recurren de forma transparente al motor RE2. #108004 (Alexey Milovidov).
  • Se aceleró la descompresión de ZSTD en AArch64 (ARM) para columnas con pequeños desplazamientos de coincidencia, como las columnas de enteros de ancho fijo, mediante la vectorización con NEON de copias solapadas con desplazamientos cortos. Por ejemplo, la descompresión de una columna UInt64 es hasta ~2.3x más rápida en AWS Graviton 4. #108049 (Alexey Milovidov).
  • Usa la biblioteca libdeflate para la compresión y descompresión gzip/zlib/deflate, haciéndolas más rápidas (compresión ~1.15× con una mejor relación, descompresión ~1.4–1.5×) para datos .gz/HTTP/url/s3 y el codec GZIP de Parquet. #108074 (Alexey Milovidov).
  • Se mejoró el rendimiento de las consultas de búsqueda de texto combinadas con un filtro de clave primaria. #108114 (Anton Popov).
  • Usa estadísticas en tiempo de ejecución recopiladas durante la primera ejecución de una consulta para optimizar las siguientes: el algoritmo de join hash puede cambiar automáticamente a parallel_hash en función de las estadísticas recopiladas. #108125 (Hechem Selmi). El tamaño de los filtros en tiempo de ejecución de join se optimiza usando el tamaño de la tabla hash obtenido de las estadísticas en tiempo de ejecución del join, controlado por la nueva configuración join_runtime_filter_size_from_hash_table_stats. #108313 (Hechem Selmi).
  • Se mejoró la velocidad de descompresión de LZ4 para columnas de tamaño fijo y baja cardinalidad. #108175 (Nikita Taranov).
  • Acelera las funciones trimLeft/trimRight/trimBoth para espacios en blanco predeterminados (y sus alias ltrim/rtrim/trim): las filas consecutivas que no necesitan recorte se copian en un solo lote, y el escaneo de espacios por fila solo se ejecuta en las filas que realmente tienen un espacio inicial o final. #108177 (Groene AI).
  • Mejora el rendimiento de replaceAll y replaceRegexpAll cuando el patrón es un único carácter y el reemplazo es un único carácter (por ejemplo, replaceRegexpAll(s, ' ', '_')). Estos reemplazos ya no cambian la disposición de la cadena, por lo que ahora la columna se copia una sola vez y los bytes coincidentes se reescriben in situ, en lugar de ejecutar un bucle de búsqueda por coincidencia. #108178 (Groene AI).
  • Mejora el rendimiento de la función pointInPolygon con un polígono constante. La caché de polígonos preprocesados ahora se indexa por los argumentos constantes en bruto, por lo que un polígono constante se analiza solo una vez (en un fallo de caché) en lugar de volver a analizarse en cada bloque de entrada. #108184 (Groene AI).
  • Acelera el análisis de la representación canónica de fecha y hora YYYY-MM-DD hh:mm:ss en modo best-effort (date_time_input_format = 'best_effort', cast_string_to_date_time_mode = 'best_effort'), que es el valor predeterminado. Esto corrige una regresión de rendimiento en el parsing introducida cuando esos valores predeterminados cambiaron de basic a best_effort. #108187 (Groene AI).
  • Evita mantener los contadores de selectividad de system.predicate_statistics_log en la ruta de lectura de MergeTree cuando la funcionalidad está deshabilitada (predicate_statistics_sample_rate = 0, el valor predeterminado). Esto elimina una actualización atómica por gránulo y un popcount de filtro O(rows) en cada lectura, corrigiendo una regresión de rendimiento que se apreciaba sobre todo en AArch64. #108190 (Groene AI).
  • Acelera el análisis de números de coma flotante a partir de texto con precise_float_parsing = 1, de modo que sea tan rápido como, o más rápido que, el parser predeterminado en casi todas las entradas. También actualiza la biblioteca fast_float incluida a la versión 8.2.10. #108205 (Raúl Marín).
  • Usa la biblioteca simdutf para las funciones de codificación y decodificación base64, mejorando su rendimiento. #108333 (Konstantin Bogdanov).
  • Optimiza DISTINCT para claves costosas de alta cardinalidad. #108366 (Nihal Z. Miaji).
  • En compilaciones que no son de Linux (macOS y FreeBSD), jemalloc ya no purga las páginas sucias de forma agresiva (una syscall madvise por cada free); ahora usa un hilo de purga en segundo plano con un dirty_decay_ms finito, igual que en Linux. Esto acelera significativamente los workloads con alta rotación de asignaciones, como los CTE recursivos (~2x en un benchmark de CTE recursivo en macOS), con un impacto despreciable en RSS. #108430 (Alexey Milovidov).
  • Acelera la planificación de consultas en el analyzer para expresiones que hacen referencia al mismo alias WITH o repiten la misma subexpresión muchas veces (por ejemplo, cadenas if/multiIf profundamente anidadas), al no reconstruir las subexpresiones compartidas al construir el DAG de acciones. #108523 (Dmitry Novik).
  • Los Runtime Filters ahora se construyen sobre claves de igualdad incluso cuando la cláusula ON también contiene predicados de no igualdad, lo que reduce el número de filas que entran en el hash join en joins que combinan condiciones de igualdad y no igualdad. LEFT ANTI JOIN no se ve afectado. #108579 (Antonio Álvarez Caballero).
  • Habilita -fno-math-errno globalmente en toda la base de código, lo que permite al compilador optimizar mejor las funciones matemáticas. #108628 (Nikita Taranov).
  • Reduce el umbral de precarga por software para las tablas hash de agregación y join de 4 * L2 cache size a L2 cache size, de modo que la precarga se habilite una vez que la tabla hash ya no quepa en L2. Esto corrige una regresión en GROUP BY y JOIN sobre tablas hash de tamaño mediano (~1-8 MiB) en plataformas cuyo L2 reportado es grande (p. ej., AArch64 con un L2 de 2 MiB). #108655 (Groene AI).
  • Mejora el rendimiento de las funciones de ventana. Las consultas de ventana sobre tablas anchas que incluyen SELECT * ahora usan mucha menos memoria y se ejecutan más rápido. Las agregaciones de ventana, incluidas quantile*, uniq* y groupArray, son más rápidas con OVER () y OVER (ORDER BY ... RANGE ...). La función cume_dist también es más rápida, y las ventanas que usan PARTITION BY u ORDER BY ahora rinden mejor en columnas con muchos valores repetidos. #108688 (Nihal Z. Miaji).
  • Se aceleró el análisis de consultas para consultas con muchas cadenas AND de comparaciones, o con cadenas AND muy grandes: la optimización optimize_and_compare_chain ahora está limitada por un presupuesto de trabajo (nuevo ajuste optimize_and_compare_chain_max_hash_work) en lugar de aplicar hash a una gran parte del árbol de consultas, y la resolución de lambda ya no vuelve a calcular los hashes del cuerpo de la lambda para su protección contra recursión. #108757 (Alexey Milovidov).
  • Se corrigió una regresión de rendimiento al leer columnas JSON/Dynamic con varios hilos: una búsqueda por valor del ajuste input_format_binary_max_type_complexity provocaba contención en el recuento de referencias del contexto de consulta compartido, lo que serializaba las lecturas en paralelo; ahora el valor del ajuste se almacena en caché por hilo. #108797 (Seva Potapov).
  • Se corrigió una regresión de rendimiento (introducida en #71781) por la que la lectura de muchos archivos pequeños desde almacenamiento de objetos mediante s3 y otras funciones de tabla dejó de hacer prefetch y pasó a lecturas síncronas, lo que ralentizaba considerablemente las lecturas monohilo y de baja concurrencia de gran cantidad de archivos diminutos. #108872 (Nikita Fomichev). El prefetch inicial de objetos pequeños ahora también se lanza cuando las lecturas desde almacenamiento de objetos pasan por la caché del sistema de archivos (filesystem_cache_name), por lo que las lecturas de muchos archivos pequeños (por ejemplo, la ingestión de S3Queue) con la caché habilitada ya no son síncronas ni están limitadas por la latencia. #109478 (Nikita Fomichev).
  • Analiza literales de arrays y tuplas profundamente anidados en tiempo lineal en lugar de cuadrático. #108892 (Alexey Milovidov).
  • Reduce la sobrecarga derivada de la contención de bloqueos en el algoritmo de join parallel_hash. #108938 (Hechem Selmi).
  • Acelera estimateCompressionRatio para columnas codificadas con T64 al calcular analíticamente el tamaño comprimido en lugar de comprimir. #109054 (Raufs Dunamalijevs).
  • Elimina un cuello de botella monohilo en la fase de shuffle de los planes de consultas distribuidas: ahora cada stream ascendente distribuye sus filas de forma independiente por bucket de destino, en lugar de hacer pasar todo el flujo de datos por una única transformación. #109206 (Alexander Gololobov).
  • Se redujo el uso de CPU en inactividad del Keeper server. #109255 (Michael Kolupaev).
  • Acelera la serialización y las fusiones de columnas JSON cuyos datos compartidos contienen muchas rutas dispersas: al aplanar los datos compartidos en columnas por ruta, se elimina el escaneo por fila de todas las columnas de ruta acumuladas, y los huecos se rellenan en bloque en lugar de insertar valores predeterminados celda por celda. #109341 (Groene AI).
  • Reduce la sobrecarga de CPU de la evaluación de expresiones en consultas con un gran número de columnas (p. ej., vector search sobre una columna QBit con un stride pequeño, donde cada vector se expande en cientos de sub-columnas de planos de bits que se pasan todas a una sola llamada *DistanceTransposed). #109380 (Alexey Milovidov).
  • Mejora el rendimiento de las funciones Geo de H3 (h3ToGeoBoundary, h3ToGeo, h3CellAreaM2/h3CellAreaRads2, geoToH3) al calcular conjuntamente pares seno/coseno y eliminar llamadas trigonométricas redundantes en las transformadas de coordenadas. Los resultados no cambian (idénticos bit a bit). #109399 (Alexey Milovidov).
  • Mejora el rendimiento de las comparaciones (<, >, <=, >=) de tipos enteros de gran tamaño (Int128, UInt128, Int256, UInt256 y tipos basados en ellos, como Decimal128) hasta 7 veces, así como de la conversión de enteros con signo a Int256 (hasta 7 veces en datos con signos mixtos), al hacer que el código de comparación y extensión de signo no use ramas. #109474 (Manuel).
  • Se optimizó uniqCombined (incluido el caso de aggregation sin claves) y uniqHLL12. #109794 (Anton Popov). #109831 (Anton Popov).
  • Las funciones arraySort y arrayReverseSort son varias veces más rápidas con arrays numéricos (incluidos Decimal y DateTime64) cuando se llaman sin una lambda. #109832 (Manuel).
  • Acelera addDays, addWeeks, subtractDays y subtractWeeks para valores DateTime y DateTime64 en zonas horarias con desplazamiento fijo (como UTC) utilizando una ruta rápida aritmética. #109836 (Manuel).
  • Se optimizó el análisis del índice de texto. #109886 (Anton Popov).
  • Paraleliza el procesamiento de filas no emparejadas en el join algorithm parallel_hash en dos casos más: cuando hay un filtro residual y cuando las join keys son pequeñas (mapa hash de un solo nivel). #110008 (Hechem Selmi).
  • Las respuestas de la interfaz web integrada (la UI de Play, dashboards y handlers de archivos estáticos) ahora se comprimen según el header Accept-Encoding del client, usando zstd, gzip, deflate, brotli, lz4, xz, snappy o bzip2. Por ejemplo, la página /play pasa de ~350 KB sin comprimir a menos de 120 KB con zstd, lo que reduce los tiempos de carga en connections lentas. Las respuestas ya comprimidas se dejan intactas y se emite Vary: Accept-Encoding para una partición correcta de la CDN y la caché. #110108 (Sayantanu Dey).
  • Inserta un filtro por debajo de una función de ventana o de LIMIT BY cuando sea seguro: un predicado escrito por encima de ellos (un WHERE externo alrededor de la subconsulta, o una conjunción en QUALIFY) que haga referencia solo a las columnas de PARTITION BY de la ventana, o solo a las columnas clave de LIMIT BY (para LIMIT n BY con n >= 1 y sin OFFSET), ahora llega hasta el almacenamiento y permite la poda por clave primaria y por partición, los skip indexes y las proyecciones. Por ejemplo, SELECT ... row_number() OVER (PARTITION BY key ORDER BY ts) AS rn ... QUALIFY rn = 1 AND key = 'x' ya no lee ni aplica funciones de ventana a toda la tabla. #110114 (Groene AI). #110116 (Groene AI).
  • Con join_use_nulls = 1, un WHERE que rechaza NULL y hace referencia a columnas de ambos lados de un join externo (p. ej., WHERE l.k = 42 AND r.k = 42) ahora convierte el join en INNER (o LEFT/RIGHT) y aplica poda por clave primaria, igual que con join_use_nulls = 0. Anteriormente, esta conversión se omitía en este caso y ambas tablas se leían por completo. #110121 (Groene AI).
  • Las funciones con un único argumento Nullable no constante ahora comparten el mapa de NULL del argumento con el resultado, en lugar de asignar y fusionar uno nuevo. #110151 (Manuel).
  • Evita una asignación en el heap por cada comprobación de hiperrectángulo en el análisis del índice de clave primaria, lo que acelera el filtrado de marcas entre un 5 y un 26 % según la forma de la consulta. #110153 (Manuel).
  • Mejora el rendimiento de las funciones arrayMin y arrayMax sobre arrays numéricos en ~1,3-1,5x mediante una reducción vectorizada en lugar de un bucle de comparación elemento por elemento. #110163 (Manuel).
  • Vectoriza la descompresión del códec Delta. La decodificación ahora es entre 1,5 y 5 veces más rápida para tipos de datos de 8/16/32 bits, lo que hace que los escaneos de columnas comprimidas con Delta sean hasta un 20 % más rápidos. #110189 (Manuel).
  • Acelera las funciones de búsqueda de cadenas (like, position, match, countSubstrings, hasToken, etc.) sobre columnas Enum con una aguja constante buscando solo los nombres de enum distintos y reasignando los resultados a cada fila, en lugar de buscar en todas las filas. #110325 (Alexey Milovidov).
  • Acelera las funciones de agregación groupBitOr/groupBitAnd/groupBitXor y la familia de varianza (varPop, varSamp, stddevPop, stddevSamp, skewPop, skewSamp, kurtPop, kurtSamp, covarPop, covarSamp, corr) con procesamiento por lotes vectorizado: hasta 4x más rápido con el combinador -If en condiciones impredecibles, y hasta 3x más rápido para la familia de varianza sin él. #110461 (Manuel).
  • Acelera el análisis del índice de texto (la etapa que selecciona qué gránulos leer): usa búsqueda por exclusión en lugar de iterar sobre todos los gránulos y evita crear un bitmap temporal para cada comprobación de rango. #110530 (Anton Popov).
  • Tener en cuenta el tamaño en disco de las subcolumnas de Map en la optimización automática de PREWHERE. Esto corrige una regresión de rendimiento en PREWHERE introducida en #99200. Parte de #110462. #110623 (Pavel Kruglov).
  • Acelerar el análisis de valores UUID a partir de texto (p. ej., JSONExtract a LowCardinality(UUID), toUUID, CAST AS UUID) validando y convirtiendo dígitos hexadecimales en una sola pasada en lugar de dos. #110625 (Groene AI).
  • Mejorar significativamente el rendimiento de las funciones de agregación timeSeries*ToGrid mediante implementaciones más rápidas de ordenación y tablas hash. #110875 (Nikita Mikhaylov).
  • Las consultas como SELECT * FROM t WHERE id ahora usan omisión de índices en la columna id. Cierra #89222. #89603 (Aditya Chopra).
  • Se añadió la configuración query_plan_merge_expression_into_join (habilitada de forma predeterminada) para permitir la fusión de pasos de expresiones en pasos de JOIN durante la optimización de reordenamiento de joins. Esto permite reordenar joins entre subconsultas que encapsulan joins (p. ej., cuando un JOIN está dentro de una subconsulta con columnas calculadas), lo que da lugar a una mejor optimización de árboles de joins complejos. #98533 (Vladimir Cherkasov).
  • Optimizar cadenas de AND con múltiples condiciones de comparación sobre la misma expresión: detectar contradicciones (p. ej., a < 3 AND a > 5false) y eliminar condiciones redundantes (p. ej., a = 3 AND a < 5a = 3). #99736 (Xiaozhe Yu).
  • Los Materialized CTEs referenciados desde múltiples ramas de una consulta UNION ahora se materializan una sola vez y se comparten entre todas las ramas. Antes, cada rama recibía su propia copia del CTE, que se insertaba en línea y se evaluaba por separado. #102107 (Dmitry Novik).
  • Los hilos de BackgroundSchedulePool ahora se crean de forma diferida y bajo demanda, en lugar de todos a la vez al iniciar el servidor. Una nueva configuración del servidor, background_schedule_pool_initial_size (valor predeterminado: 16), controla cuántos workers se generan previamente; el grupo crece hasta background_schedule_pool_size cuando es necesario. Esto reduce el número de hilos inactivos en servidores con poca carga. Cierra #85265. #105066 (Alexey Milovidov).
  • Omitir cargas innecesarias de archivos de marcas para la serialización avanzada de datos compartidos del tipo JSON. #107051 (Pavel Kruglov).
  • La caché de polígonos constantes preprocesados para la función pointInPolygon ahora se comparte entre consultas e hilos, y está limitada por la nueva configuración del servidor point_in_polygon_cache_size (valor predeterminado: 256 MiB; 0 desactiva la caché; puede cambiarse en tiempo de ejecución). Antes, la caché mantenía hasta max_threads copias de cada polígono preprocesado, crecía sin límite con polígonos distintos y no se liberaba hasta reiniciar el servidor. Puede vaciarse con SYSTEM DROP POINT IN POLYGON CACHE, y el uso actual se informa en system.metrics como PointInPolygonCacheBytes, PointInPolygonCacheCells y PointInPolygonCacheSizeLimit. Cierra #106393. #107247 (Nihal Z. Miaji).
  • Keeper ya no mantiene el bloqueo interno de snapshots mientras serializa y escribe un snapshot en disco o mueve snapshots entre discos, por lo que las transferencias de snapshots a otros nodos y el procesamiento de Raft ya no se ven bloqueados por la creación local de snapshots. #107595 (Antonio Andelic).
  • Paraleliza la expulsión en segundo plano de la caché del sistema de archivos (controlada por la configuración keep_free_space_ratio). Se añadió una nueva configuración, keep_free_space_eviction_threads, para controlar el paralelismo, y se aumentó el valor predeterminado de keep_free_space_remove_batch de 100 a 250. #108147 (Kseniia Sumarokova).
  • Limita el número de partes preparadas simultáneamente en la copia de Azure blob storage de lectura y posterior escritura (usada por las copias de seguridad cuando la copia nativa no está disponible) a max_inflight_parts_for_one_file, lo que evita un uso excesivo de memoria cuando se copian muchos archivos grandes en paralelo. #108232 (Smita Kulkarni).
  • Se habilitaron globalmente las tres cachés del índice de texto; antes, solo estaban habilitadas dentro de las consultas. Además, el tamaño de la caché de las posting lists ahora es cero, lo que en la práctica vuelve a desactivarla, porque las posting lists son grandes y almacenarlas en caché resulta demasiado costoso. #108274 (Robert Schulze).
  • Añade compresión en memoria de marks en streaming durante la carga de marks para reducir el pico de uso de memoria. Cierra #108285. #108325 (Pavel Kruglov).
  • La nueva configuración de la caché del sistema de archivos reserve_granularity (valor predeterminado: 4 MiB) reserva espacio por adelantado en gránulos más grandes, lo que reduce la contención de bloqueos en la ruta crítica de reserva de espacio de la caché del sistema de archivos. #108369 (Kseniia Sumarokova).
  • Reduce la cantidad de memoria utilizada por los metadatos de la caché del sistema de archivos (por file segment y por clave). #108477 (Kseniia Sumarokova).
  • Las consultas a system.iceberg_history con filtros WHERE sobre las columnas database y table ahora acceden solo a las bases de datos coincidentes, lo que puede ahorrar tiempo si tienes muchas bases de datos remotas no relacionadas en el servidor. #108492 (Den Kalantaevskii).
  • Se eliminó el bloqueo innecesario en la caché del sistema de archivos para reducir la contención de bloqueos. #108932 (Kseniia Sumarokova).
  • Se redujo el uso de memoria en el manejo de metadatos de BACKUP y RESTORE. Al abrir una copia de seguridad (para RESTORE o como base de un BACKUP incremental), ahora se analizan los metadatos .backup como un flujo en lugar de cargarlos en un árbol de documentos XML en memoria, lo que en copias de seguridad grandes (especialmente incrementales) evita asignar un árbol DOM de varios gigabytes. #109107 (Julia Kartseva). Al finalizar un BACKUP, ya no se copia la información de todos los archivos a un vector temporal, lo que en copias de seguridad con millones de archivos podía costar transitoriamente varios gigabytes. #109861 (Julia Kartseva). Al escribir entrada de copia de seguridad, tampoco se vuelve a copiar la lista de metadatos de archivos del host actual. #111162 (Julia Kartseva).
  • Se redujo el consumo de memoria en el agregador. #109224 (Konstantin Vedernikov).
  • Se añadió compatibilidad con la caché de condiciones de consulta para archivos Parquet locales leídos mediante el motor de tabla File (antes compatible solo con almacenamiento de objetos y lagos de datos). #109247 (Alexey Milovidov).
  • Se redujo entre 2 y 2,5 veces el uso de memoria de la caché de cabeceras del índice de texto. En la caché caben más cabeceras de partes de datos (configuración text_index_header_cache_size), lo que reduce las lecturas de disco en las consultas de búsqueda de texto. #109332 (Anton Popov).
  • Las funciones de distancia vectorial transpuestas L2DistanceTransposed, cosineDistanceTransposed y dotProductTransposed ahora aplican la optimización de lectura parcial por plano de bits a columnas Nullable(QBit), leyendo solo los planos de bits solicitados en lugar de la columna completa. #109358 (Alexey Milovidov).
  • IS NOT DISTINCT FROM y IS TRUE ahora usan índices de clave primaria y MinMax para podar gránulos, igual que =. Antes, k IS NOT DISTINCT FROM 42 y (k = 42) IS TRUE escaneaban todos los gránulos. #110006 (Groene AI).
  • Las conexiones agrupadas ya no reciben ping antes de cada uso. Esto elimina un viaje de ida y vuelta Ping-Pong que se añadía a cada conexión reutilizada, lo que reduce la latencia de las consultas distribuidas y de clickhouse-benchmark. Una conexión agrupada obsoleta se detecta con un poll de tiempo de espera cero (una comprobación sin bloqueo que no añade ningún viaje de ida y vuelta) y se recupera reconectando. #110068 (Alexey Milovidov).
  • Se corrigieron reconexiones espurias de conexiones HTTP keep-alive agrupadas sobre TLS (HTTPS, S3). La comprobación de conexiones obsoletas usaba poll sobre el socket, lo que informaba erróneamente de que una conexión segura activa que transportaba un registro TLS posterior al handshake aún no leído (un ticket de sesión o KeyUpdate) estaba cerrada; ahora usa MSG_PEEK sin bloqueo en sockets sin TLS y SSL_peek/SSL_has_pending en sockets TLS, lo que también detecta correctamente un cierre ordenado de TLS y un registro TLS que solo ha llegado de forma parcial. #110402 (Alexey Milovidov).
  • Las consultas aceleradas mediante filtrado dinámico TopK (ORDER BY ... LIMIT k) ahora aprovechan mejor la caché de condiciones de consulta: la caché se rellena incluso cuando se aplica lazy materialization a la consulta, y esas consultas pueden reutilizar entradas escritas previamente por una consulta normal que tuviera el mismo predicado WHERE. #110507 (Shankar Iyer).
  • Un patrón LIKE/NOT LIKE sin comodines (%, _) ahora usa un rango exacto de clave primaria, por lo que lee el mismo número de gránulos que el predicado equivalente =/!= en lugar de un rango de prefijo más amplio. #107077 (Groene AI).
  • Se corrigió la contención redundante del bloqueo de file segment (una regresión de rendimiento introducida en la versión 26.1) al leer datos a través de la caché del sistema de archivos. #109577 (Kseniia Sumarokova).
  • Se corrigió que los skip indexes definidos en subcolumnas de Tuple no se utilizaran cuando se accede al campo mediante tupleElement(t, 'name'), tupleElement(t, N) o t.N, mientras que la tupla completa también se lee en la misma consulta (p. ej., SELECT *). Todas estas formas ahora descartan gránulos de la misma manera que el acceso a la subcolumna con nombre t.name. #110056 (Groene AI).
  • Se corrigieron las consultas lentas con ORDER BY ... LIMIT en tablas Distributed cuando prefer_localhost_replica selecciona una réplica local: se eliminó el límite preliminar del plan de la partición local, lo que impedía la materialización diferida y el filtrado dinámico top-K. #110136 (Michael Jarrett).
  • Se corrigió que el índice de texto no se usara para el operador ILIKE cuando el índice se define sobre una expresión en lugar de una columna simple (por ejemplo, assumeNotNull(col) con un preprocessor lower(...)): esas consultas leían todos los gránulos en lugar de usar el índice. Esto cierra #110350. #110595 (Elmi Ahmadov).
  • Se redujo la contención de bloqueos en la caché del sistema de archivos: las consultas que leen desde la caché ya no se bloquean en el bloqueo de la cola de prioridad al actualizar la prioridad LRU de una entrada. #109065 (Antonio Andelic).
  • Las consulta sobre índice de texto que usan una expresión de postprocessor solo para filtrado (por ejemplo, if(..., '', token)) ahora descartan por adelantado los tokens vacíos en lugar de materializarlos fila por fila, lo que mejora el rendimiento. #109049 (Elmi Ahmadov).
  • Se redujo la contención de bloqueos en las colas del registro del sistema, lo que reduce la latencia de cola de las consultas en clusters con mucha carga. #110539 (Sean Haynes).
  • Se mejoró hasta 1,5 veces el rendimiento de las funciones de búsqueda de subcadenas (position, countSubstrings, multiSearch*, replaceAll, replaceOne y sus variantes que no distinguen entre mayúsculas y minúsculas y UTF-8) con una aguja no constante, mediante el uso de buscadores de cadenas basados en SIMD en la ruta por fila en lugar de una implementación ingenua. #110580 (Raúl Marín).
  • La materialización diferida ahora se aplica a consultas ReplacingMergeTree con FINAL, un filtro y un LIMIT pequeño incluso sin ORDER BY. Las columnas que no son necesarias para el filtro ni para el merge FINAL se obtienen solo para las filas que permanecen después del límite, lo que hace que estas consultas sean mucho más rápidas cuando seleccionan columnas anchas con un filtro selectivo. Controlado por query_plan_optimize_lazy_materialization y query_plan_max_limit_for_lazy_materialization. #110722 (Nikolai Kochetov).
  • Se mejoró el rendimiento de async insert cuando la deduplicación está habilitada y un vaciado se divide entre múltiples particiones: ClickHouse ahora reutiliza los hashes de deduplicación calculados entre particiones en lugar de recalcularlos para cada una. #111150 (Valery Petrov).

Mejora

  • Se añadió la configuración input_format_csv_missing_nullable_as_empty_string (deshabilitada de forma predeterminada). Cuando está habilitada, un valor ausente de una columna Nullable(String) en la entrada CSV se interpreta como un String vacío en lugar de NULL, independientemente de input_format_csv_empty_as_default. #58225 (kevinyhzou). #107577 (Alexey Milovidov).
  • Las funciones toDateOrNull, toDateTimeOrNull y toDateTime64OrNull ahora aceptan argumentos enteros de todos los tipos enteros nativos (interpretados igual que en toDate, toDateTime y toDateTime64, con un argumento opcional de timezone) y devuelven NULL para los valores que quedan fuera del rango del tipo de resultado. Por ejemplo, toDateTimeOrNull(1583851242, 'Asia/Shanghai') devuelve 2020-03-10 22:40:42 y toDateTimeOrNull(4294967296) devuelve NULL. #79791 (Jitendra).
  • Se añadió una columna is_wildcard a la tabla system.grants que indica si un grant usa coincidencia de prefijo con comodín (por ejemplo, GRANT SELECT ON db*.*). Antes, los grants con comodín y los exactos sobre el mismo nombre no se podían distinguir en system.grants. Cierra #92835. #98577 (DQ).
  • Se permite la compresión Snappy en la interfaz HTTP (Accept-Encoding: snappy) y se añade la configuración snappy_mode para elegir entre el formato de bloques de Hadoop Snappy y el formato de framing de Snappy para I/O genérico con Snappy de file/url. #100752 (Alexey Milovidov).
  • Se admite compatibilidad con el analyzer anterior mediante la configuración analyzer_compatibility_allow_non_aggregate_in_having. Si está habilitada, las conjunciones no agregadas se mueven de HAVING a WHERE. #104232 (Dmitry Novik).
  • Se añadió una nueva configuración del servidor memory_worker_rss_speculative_reserve_ratio (valor predeterminado: 1.0) que hace que el memory tracker global reserve memoria de forma especulativa por encima del RSS observado cuando el crecimiento del RSS supera el seguimiento contable del tracker entre muestras. Con esto, las allocations reciben MEMORY_LIMIT_EXCEEDED antes y es menos probable que el OOM-killer del kernel se active primero. Establezca la proporción en 0 para deshabilitar esta especulación. #104976 (Alexey Milovidov).
  • Se añadieron métricas de Prometheus opcionales para la actividad de eviction de la filesystem cache (filesystem_cache_evictions_total, filesystem_cache_evicted_bytes_total, filesystem_cache_evicted_segment_hits, filesystem_cache_evicted_segment_size_bytes y sus variantes por usuario etiquetadas con user_id), expuestas por caché a través de system.dimensional_metrics, system.histogram_metrics y el Prometheus endpoint. Están controladas por las configuraciones del cache disk expose_prometheus_eviction_metrics y expose_prometheus_eviction_metrics_per_user (ambas desactivadas de forma predeterminada), que pueden activarse o desactivarse en runtime mediante SYSTEM RELOAD CONFIG. #105020 (Sacheendra Talluri).
  • EXPLAIN [PLAN] actions=1, compact=1, pretty=1 pasa a ser el valor predeterminado. #105036 (Kirill Kopnev).
  • Se actualizó delta-kernel-rs (la biblioteca detrás de la integración DeltaLake) a la versión 0.23.0. #105861 (Smita Kulkarni).
  • Añade los comandos du y wc a clickhouse-disks. Imprimen, respectivamente, el tamaño total en bytes de un archivo o directorio determinado, y muestran la cantidad de bytes, líneas y palabras de un archivo. #106268 (Asya Shneerson).
  • Se añadió una nueva métrica asíncrona, UntrackedMemory (visible en system.asynchronous_metrics), que informa de la memoria ya asignada por los hilos pero aún no contabilizada en el contador global de seguimiento de memoria: cada hilo acumula pequeñas asignaciones localmente y las reporta en bloque. Esto ayuda a explicar las discrepancias entre MemoryTracking y el uso real de memoria del proceso. Los mensajes de error MEMORY_LIMIT_EXCEEDED ahora también incluyen la cantidad de memoria no rastreada, lo que facilita entender por qué una consulta o el servidor alcanzó su límite de memoria. #106386 (Miсhael Stetsyuk).
  • Actualiza ClickStack (la interfaz de observabilidad) a la versión 2.28.0. #106406 (Aaron Knudtson).
  • Se añadió compatibilidad con BFloat16 en dotProduct y se mejoró su rendimiento agrupando en lotes la ruta SIMD. #106569 (Nikita Taranov).
  • Los ajustes max_named_collection_num_to_throw, max_table_num_to_throw, max_replicated_table_num_to_throw, max_view_num_to_throw, max_dictionary_num_to_throw y max_database_num_to_throw ahora pueden modificarse sin reiniciar el servidor. #106821 (Maxim Orlovsky).
  • Se admiten los valores REDUCED_REDUNDANCY, STANDARD_IA, ONEZONE_IA, GLACIER_IR y EXPRESS_ONEZONE (además de STANDARD e INTELLIGENT_TIERING) para el ajuste s3_storage_class_name. #107251 (Aditya Kumar).
  • Se añadió el ajuste de creación materialized_postgresql_use_extended_date_and_time_types para el database engine MaterializedPostgreSQL. De forma predeterminada (habilitado), las columnas date/timestamp de PostgreSQL se infieren como Date32/DateTime64; si se establece en 0 al ejecutar CREATE DATABASE, se infieren los tipos más restringidos Date/DateTime. El ajuste no se aplica al table engine MaterializedPostgreSQL. #107428 (Alexey Milovidov).
  • El cuantificador SOME / ALL de Array (expr OP SOME(array) / expr OP ALL(array)) ahora también admite los predicates de comparación por palabra clave IS DISTINCT FROM y IS NOT DISTINCT FROM, así como los predicates de búsqueda en cadenas LIKE, ILIKE, NOT LIKE, NOT ILIKE y REGEXP, reescritos como arrayExists / arrayAll. #107454 (Alexey Milovidov).
  • Se corrigió una fuga de memoria que se producía cuando fallaba la apertura de una base de datos SQLite (por ejemplo, cuando se proporciona a la función de tabla sqlite o al database engine SQLite una ruta que no puede abrirse). #107807 (Alexey Milovidov).
  • En la interfaz web (play.html), la indicación del atajo de ejecución ahora muestra Cmd+Enter en Mac y Ctrl+Enter en otras plataformas, en lugar de mostrar siempre Ctrl/Cmd+Enter; además, la parte , +Shift to run all de la indicación solo se muestra cuando hay varias consultas. #107817 (Alexey Milovidov). #108957 (Alexey Milovidov).
  • El motor de tabla Alias ahora admite lecturas con réplicas paralelas cuando la tabla de destino es de la familia MergeTree. #107830 (Kai Zhu).
  • Se añadió el tipo de estadísticas de columna uniq_v2, una alternativa ligera a las estadísticas uniq, basada en el sketch uniqCombined64. #107863 (Han Fei). Además, se marcó como obsoleto el tipo de estadísticas de columna minmax y se cambió el valor predeterminado de auto_statistics_types a basic, uniq_v2. #108680 (Han Fei).
  • Las funciones de IA (aiGenerate, aiEmbed, aiClassify, aiExtract, aiTranslate) ahora reintentan fallos transitorios de red (restablecimientos de conexión, fallos de conexión TLS, timeouts y direcciones inaccesibles) cuando se establece ai_function_max_retries, igualando el comportamiento de reintento de la table function url. Antes, solo se reintentaban las respuestas de error HTTP del lado del proveedor. #107927 (Alexey Milovidov).
  • INSERT en una tabla MergeTree ahora respeta la cancelación de consultas y max_execution_time al escribir muchas partes, en lugar de poder seguir ejecutándose durante mucho tiempo después de haber sido cancelada. #107929 (Michael Kolupaev).
  • En la interfaz web (play.html), el icono del Terminal web ahora puede abrirse en una nueva pestaña del navegador con un clic del botón central o con Ctrl/Cmd/Shift+clic. #108006 (Alexey Milovidov).
  • La generación de SQL con IA en el cliente ya no envía el parámetro temperature, a menos que se establezca explícitamente mediante ai.temperature en la configuración. Esto corrige la generación de SQL con IA para modelos que rechazan el parámetro temperature. #108014 (Alexey Milovidov).
  • Se añadieron la tabla system.masking_policies y la introspección SHOW MASKING POLICIES a las compilaciones open-source. Las políticas de enmascaramiento en sí siguen siendo una funcionalidad de ClickHouse Cloud, por lo que la tabla está vacía en las compilaciones open-source, pero las consultas de introspección ya no fallan con un error. #108030 (Alexey Milovidov).
  • El consumer de Kafka basado en Keeper ahora aleatoriza el orden en que adquiere bloqueos temporales de partición entre réplicas, lo que mejora el reparto equitativo de las particiones y reduce la contención de bloqueos. Antes, la aleatorización prevista no tenía ningún efecto. #108033 (Alexey Milovidov).
  • Se añadió autocompletado a la interfaz web (play.html), basado en system.completions y en el analizador léxico SQL basado en WASM. #108059 (Alexey Milovidov).
  • clickhouse-client y clickhouse-local ahora muestran sugerencias de autocompletado a medida que escribes (texto “fantasma” en línea) con la mejor coincidencia cuando el cursor está al final de la entrada. Las sugerencias más relevantes (las usadas recientemente y los identificadores ya presentes en la consulta) aparecen primero. Navega con Arriba/Abajo (o Ctrl-Arriba/Ctrl-Abajo); acepta una sugerencia única o la seleccionada con Tab o Flecha derecha, y acepta la sugerencia seleccionada con Enter; Tab también abre la lista clásica de autocompletado. Se controla con la nueva opción --hints (activada de forma predeterminada; requiere --highlight). #108070 (Alexey Milovidov).
  • Se admite la función length para el tipo de dato QBit: devuelve la dimensión del vector como una constante. #108071 (Alexey Milovidov). También se admite CAST de QBit a Array, reconstruyendo el vector original: la inversa de la conversión existente de Array a QBit. #108072 (Alexey Milovidov).
  • Las solicitudes a catálogos REST de lago de datos (como OneLake) ahora incluyen un encabezado User-Agent de ClickHouse. #108117 (Konstantin Vedernikov).
  • arrayFold ahora respeta la cancelación de consultas y max_execution_time. Antes, un fold sobre un array muy largo se ejecutaba por completo dentro de una sola llamada a función y no podía interrumpirse, por lo que KILL QUERY y los límites de tiempo se ignoraban hasta que terminaba. #108192 (Groene AI).
  • MVTEncodeGeom ahora ajusta la geometría a la cuadrícula de píxeles enteros antes de recortarla y recorta polígonos con la biblioteca wagyu, de modo que la salida recortada sea válida (se reparan los anillos autointersecados) y quede alineada con los bordes, igual que en PostGIS ST_AsMVTGeom. #108248 (Saarthak Gupta).
  • Se añadieron ProfileEvents de preejecución de consultas por fase: QueryParseMicroseconds, QueryAnalysisMicroseconds, QueryPlanBuildMicroseconds y QueryPipelineBuildMicroseconds. Muestran dónde se invierte el tiempo antes de la ejecución de la consulta (análisis sintáctico, análisis, creación del plan de consulta y creación del pipeline) y están disponibles en system.query_log y system.events. #108282 (Jordi Villar).
  • Las operaciones ALTER TABLE que producirían metadatos de tabla que superaran max_query_size ahora se rechazan de antemano, lo que evita que las tablas queden imposibles de cargar para componentes como la distribución DDL y la recuperación de réplicas. #108283 (Andrew Kravchuk).
  • Se añadieron las columnas settings y engine_settings a system.backups y system.backup_log. settings expone los ajustes específicos de backup/restore solicitados para una operación (p. ej., allow_s3_native_copy, deduplicate_files, structure_only), y engine_settings expone los ajustes efectivamente usados por el lector y el escritor del engine de backup (p. ej., los ajustes de solicitudes a S3, como allow_native_copy, que pueden diferir de lo solicitado tras fusionar la configuración del endpoint). Esto permite ver con qué ajustes se ejecutó realmente una operación BACKUP/RESTORE. #108334 (Julia Kartseva).
  • Se añadió una columna source a system.documentation que contiene la ruta del archivo fuente en el que se define la documentación de cada entidad. La tabla ahora también documenta códecs de compresión, eventos de perfil, métricas actuales, métricas asíncronas y las propias tablas del sistema (con sus columnas), y la documentación de los ajustes ahora incluye su tipo y valor predeterminado. #108346 (Alexey Milovidov). Un valor predeterminado vacío para un ajuste ahora se representa como cadena vacía en lugar de backticks vacíos. #108708 (Alexey Milovidov).
  • Se añadieron lecturas asíncronas desde réplicas remotas (async_socket_for_remote) en macOS mediante la implementación, sobre kqueue, de primitivas de sondeo basadas en epoll. Esto permite que las consultas distribuidas lean shards en paralelo en macOS en lugar de hacerlo en serie. #108403 (Raúl Marín).
  • Se añadió compatibilidad con BFloat16 en funciones matemáticas binarias. #108442 (Zhang Yifan).
  • MergeTree ahora puede leer un flujo comprimido cuyos bloques usan distintos códecs. Este es el requisito previo del lado de la lectura para la selección adaptativa de códecs (#105404). #108592 (Raufs Dunamalijevs).
  • El valor automático de max_threads y ajustes similares ahora se muestra en system.settings como auto(8) en lugar de 'auto(8)'; las comillas simples que lo rodeaban eran un artefacto heredado incrustado en el valor. Se conserva la compatibilidad entre versiones: la forma heredada entrecomillada sigue aceptándose al interpretar ajustes recibidos de servidores más antiguos. #108657 (Alexey Milovidov).
  • Varias mejoras de usabilidad para la interfaz web de /schema: cargar el esquema al pulsar Enter, barras de desplazamiento adaptadas al tema, nombres de tabla legibles, agrupación coherente por base de datos de tablas independientes, sin selección de texto al arrastrar y un formulario de autenticación estilo play (Credential Management API, credenciales proporcionadas por URL con eliminación de contraseñas y validación de credenciales en tiempo real). #108724 (Alexey Milovidov).
  • El modo diferido de aplicación de posting lists del índice de texto ya no es experimental y puede seleccionarse con text_index_posting_list_apply_mode = 'lazy' sin allow_experimental_text_index_lazy_apply. El ajuste de umbral de densidad pasó a llamarse de text_index_density_threshold a text_index_lazy_intersection_density_threshold. #108814 (Anton Popov).
  • Se añadió un nuevo tipo de catálogo delta_sharing a DataLakeCatalog para el endpoint REST de Iceberg de Databricks Delta Sharing, cuyos espacios de nombres son planos y que ignora el filtro de listado parent. Úselo en lugar de catalog_type = 'rest' para esos endpoints, donde de otro modo SHOW TABLES se quedaría bloqueado. #108865 (Seva Potapov).
  • Se añadió una nueva opción de clickhouse-client/clickhouse-local, --echo-query-separator, que imprime un separador personalizado antes de la consulta reformateada que se muestra como eco, lo que facilita distinguir la consulta escrita de su eco reformateado. Deshabilitada de forma predeterminada. #108888 (David Meng).
  • Mejoras en el panel de bases de datos de la Web UI: el número de tablas se muestra entre paréntesis junto al nombre de la base de datos cuando está expandida. #108891 (Alexey Milovidov). Un botón de actualización junto a una base de datos expandida recarga su lista de tablas. #108958 (Alexey Milovidov). Al volver a abrir el panel, se restauran las bases de datos que estaban expandidas anteriormente. #108964 (Alexey Milovidov).
  • Permite calcular el beneficio combinado de los skip indexes en EXPLAIN WHATIF: muestra la proporción de datos correspondiente a la intersección de todos los índices hipotéticos adecuados existentes. #108934 (Yarik Briukhovetskyi).
  • Se corrigió el restablecimiento de la posición de desplazamiento horizontal de la tabla de resultados en la Web UI al hacer clic en un enlace dentro de una celda y volver a la página. #108941 (Alexey Milovidov).
  • El database engine, el table engine y la table function de MySQL ahora asignan los tipos de columna espaciales de MySQL (LINESTRING, POLYGON, MULTILINESTRING, MULTIPOLYGON y el tipo genérico GEOMETRY) a los tipos geométricos correspondientes de ClickHouse en lugar de String. Esto se controla mediante la nueva opción geometry de la configuración mysql_datatypes_support_level, habilitada de forma predeterminada. POINT se sigue convirtiendo siempre a Point. La columna genérica GEOMETRY se asigna al tipo genérico Geometry; leer un valor cuyo subtipo no tiene equivalente en ClickHouse (MULTIPOINT, GEOMETRYCOLLECTION) lanza una excepción en tiempo de lectura. #108944 (Alexey Milovidov).
  • Web UI (play.html): navegación completa por teclado — navegación con las teclas de flecha en el panel de bases de datos y la tabla de resultados, acceso por teclado a los botones de la barra de herramientas, al selector de tema y al menú de descarga, y contornos de enfoque visibles. #108972 (Alexey Milovidov).
  • HTTP interface: cuando se proporcionan credenciales tanto mediante URL parameters (user/password) como mediante una cabecera Authorization, los URL parameters ahora tienen prioridad en lugar de que se rechace la solicitud. Esto corrige el fallo al descargar resultados desde la Web UI (play.html) con AUTHENTICATION_FAILED (error 516) cuando el navegador ha recordado credenciales Basic. #108980 (Alexey Milovidov).
  • Se restaura show_data_lake_catalogs_in_system_tables como la configuración que controla únicamente la visibilidad de DataLakeCatalog en system.tables, system.columns y system.completions. Se añadió show_remote_databases_in_system_tables, habilitada de forma predeterminada, para permitir a los usuarios ocultar por separado las bases de datos MySQL y PostgreSQL de esas system tables. #109082 (Pablo Marcos).
  • Se usa de forma predeterminada el algoritmo preciso de parsing de Float (el valor representable más cercano) y se aplica la configuración precise_float_parsing a los input formats (CSV, TSV, JSON, VALUES, …) y a los literals numéricos, no solo a toFloat*/CAST. Establezca precise_float_parsing = 0 para recuperar el comportamiento anterior, más rápido en algunos casos pero menos preciso. Cierra #60146. Cierra #74647. Cierra #68914. #109086 (Raúl Marín).
  • Una consulta con un solo CTE ahora se formatea con el mismo salto de línea y la misma sangría que una consulta con varios CTE. Antes, WITH a AS (...) mantenía el CTE en la misma línea que WITH, mientras que con dos o más CTE, WITH iba en su propia línea y cada CTE aparecía con sangría. #109092 (Groene AI).
  • Web UI: cuando la finalización resaltada coincide con la palabra ya escrita, o con la misma palabra pero con distinto uso de mayúsculas/minúsculas (p. ej., HASH sugerido para un hash ya escrito), al pulsar Right/Tab/Enter la palabra ya no se reescribe ni la autocompletación intercepta la tecla; la tecla mueve el cursor o inserta un salto de línea, como se espera. #109106 (Alexey Milovidov). #109384 (Alexey Milovidov).
  • Se añadió a la Web UI (play.html) el resaltado arcoíris de paréntesis, el resaltado de corchetes coincidentes, el resaltado de identificadores coincidentes y el resaltado de grupos de dígitos, en consonancia con clickhouse-client. #109108 (Alexey Milovidov).
  • En la Web UI, Tab y Shift+Tab ahora aplican y quitan una sangría de 4 espacios a las líneas seleccionadas. #109110 (Alexey Milovidov).
  • Web UI: resalta la posición de un error de sintaxis en el editor de consultas con un fondo rojo. El resaltado se borra en cuanto el usuario vuelve a poner el foco en el editor. #109112 (Alexey Milovidov).
  • clickhouse-compressor --stat y la detección del códec predeterminado para partes antiguas ahora informan los encabezados de bloque corruptos como corrupción, en lugar de como un engañoso error de fin de archivo. #109157 (Raufs Dunamalijevs).
  • ClickHouse Keeper ahora respeta la configuración os_collect_psi_metrics y omite la recopilación de métricas PSI cuando está deshabilitada. #109179 (Maxim Orlovsky).
  • En la Web UI, cuando se muestran pestañas de consultas, los parámetros de conexión (host, user, password) se ocultan tras un icono de llave en la esquina superior derecha y se muestran en un menú desplegable a demanda. #109243 (Alexey Milovidov).
  • Web UI: muestra un resultado de un solo valor (una fila, una columna, p. ej., SHOW CREATE TABLE) con altura completa en lugar de limitarlo a tres líneas. #109245 (Alexey Milovidov).
  • En la Web UI, al hacer clic en una tabla del panel de bases de datos con el botón central del ratón, con Shift o con el modificador de nueva pestaña de la plataforma (Cmd en macOS, Ctrl en otros sistemas), ahora se abre su consulta en una nueva pestaña de la Web UI. #109246 (Alexey Milovidov).
  • La caché de condiciones de consulta para archivos Parquet remotos (almacenamiento de objetos) ahora usa también el ETag, además de la ruta, como clave, para que sobrescribir un objeto en el mismo lugar ya no sirva resultados obsoletos en caché. #109310 (Alexey Milovidov).
  • En la Web UI, las cadenas vacías y los NULL ya no se colorean en el modo de coloreado categórico. #109342 (Alexey Milovidov).
  • Web UI: al hacer clic en el icono de una tabla en el panel de la base de datos, ahora se muestra la lista de sus columnas, con iconos de tipo, una barra de tamaño proporcional al tamaño comprimido y un tooltip con el tamaño comprimido/sin comprimir y la relación de compresión. #109346 (Alexey Milovidov).
  • Web UI: mostrar el título completo de la pestaña en un tooltip al pasar el cursor cuando esté truncado. #109354 (Alexey Milovidov).
  • En la Web UI, al hacer clic con el botón central en el título de una pestaña (o Ctrl/Shift/Cmd+clic sobre él), ahora se duplica la pestaña. #109357 (Alexey Milovidov).
  • Web UI: redimensionar uniformemente las áreas de progreso final y estadísticas de la consulta para que no se partan de forma extraña cuando la ventana del navegador sea estrecha. #109363 (Alexey Milovidov).
  • Web UI: al seleccionar una base de datos en el panel de bases de datos, ahora se usa como base de datos predeterminada para las consultas ejecutadas desde el editor. #109372 (Alexey Milovidov).
  • Compatibilidad con reinterpret de un Array de elementos de tamaño fijo como un String, el inverso del reinterpret existente de un String/FixedString como un Array. #109383 (Alexey Milovidov).
  • En la Web UI, no mostrar los controles de alternancia de codificación por colores por columna cuando el resultado no tenga más de una sola fila. #109385 (Alexey Milovidov).
  • Permitir CAST entre tipos QBit que difieran en el tipo de elemento y/o el stride, siempre que la dimensión siga siendo la misma (por ejemplo, CAST(x AS QBit(Float64, N)) desde un QBit(Float32, N)). Los cambios solo de stride no tienen pérdida; los cambios de tipo de elemento siguen la semántica de conversión correspondiente de Array (por ejemplo, de Float32 a BFloat16 puede haber pérdida de precisión, y accurateCast / accurateCastOrNull rechazan las filas que no pueden representarse exactamente). #109387 (Alexey Milovidov).
  • Las funciones quantizeBFloat16ToInt8 y dequantizeInt8ToBFloat16 ahora también aceptan argumentos Array y QBit, aplicando el codec Lloyd-Max a todo el vector (devolviendo Array/QBit del tipo de elemento correspondiente), además de las sobrecargas escalares existentes. #109398 (Alexey Milovidov).
  • Web UI: el enlace a la documentación ahora incluye el nombre del usuario actual en la URL. #109419 (Alexey Milovidov).
  • Compatibilidad con arraySum, arrayAvg y arrayProduct para arrays de BFloat16. #109420 (Alexey Milovidov).
  • El especificador de formato de estilo MySQL %f en parseDateTime / parseDateTime64 (y sus variantes OrZero / OrNull) ahora acepta entre 1 y 6 dígitos fraccionarios, interpretados como microsegundos alineados a la izquierda, como en STR_TO_DATE de MySQL, en lugar de exigir exactamente 6. También se corrigieron tablas PrettyCompact desalineadas en los ejemplos de la documentación de funciones integradas. #109421 (Alexey Milovidov).
  • Web UI: las pestañas de consulta ahora son persistentes — cada pestaña conserva su resultado renderizado (incluidas imágenes y gráficos) y su consulta en ejecución cuando cambias a otra y vuelves, y las consultas largas siguen ejecutándose en segundo plano. Los títulos de las pestañas muestran un spinner, una barra de progreso y una marca de verificación de finalización para su consulta. #109425 (Alexey Milovidov).
  • Web UI: ahora se muestra correctamente un error cuando una consulta falla después de que parte de su resultado ya se haya transmitido, en lugar de mostrar un SyntaxError: Unexpected end of JSON input del lado del client (o, con http_write_exception_in_output_format, marcar la consulta fallida como exitosa). #109430 (Alexey Milovidov).
  • Se añadieron columnas fijadas a la Web UI: una columna puede fijarse desde su encabezado para que permanezca visible (pegada al borde) mientras la tabla de resultados se desplaza horizontalmente. #109439 (Alexey Milovidov).
  • En el Advanced dashboard (/dashboard), ahora se pueden añadir directamente charts para métricas específicas por el metric name tal como aparece en el Source Code o en la documentación, lo que facilita añadir varias métricas durante las sesiones de debugging. #109449 (Mikhail Artemenko).
  • Web UI: se corrigió el cierre del menú desplegable de configuración de la connection al seleccionar texto con el ratón y arrastrar más allá de su borde. #109451 (Alexey Milovidov).
  • Web UI: al pasar el cursor sobre el encabezado de una columna de la tabla de resultados, ahora se muestra el column name completo y el Type en una información sobre herramientas, para que los encabezados truncados puedan leerse completos. #109463 (Alexey Milovidov). Se corrigió que los títulos de los encabezados de columna se recortaran con puntos suspensivos incluso cuando la columna era lo bastante ancha para mostrar el título completo. #110397 (Alexey Milovidov).
  • Compatibilidad con diccionarios SSD cache (layout SSD_CACHE) y el table engine FileLog en builds de MacOS. #109493 (Raúl Marín).
  • Web UI: no restaurar pestañas con consultas vacías al abrir la página. #109529 (Alexey Milovidov).
  • Se corrigieron las sugerencias de autocompletado ilegibles mientras se escribe y los colores brillantes en el client interactivo en terminales cuyo TERM no contiene 256 (p. ej., Ghostty, kitty, Alacritty, foot): ahora los colores brillantes se emiten incondicionalmente como códigos de color brillante aixterm en lugar de recurrir a negrita + color oscuro, que los terminales modernos renderizan como un color oscuro y difícil de leer sobre fondos oscuros. #109622 (Alasdair Brown).
  • Se habilitan las arenas por CPU de jemalloc y el perfilado de asignaciones en builds de MacOS. #109684 (Raúl Marín).
  • Permitir modificar algunos ajustes de authentication de una database de Data Lake Catalog OneLake con ALTER DATABASE ... MODIFY SETTING. #110019 (alesapin).
  • El engine Hive ahora lee los metadata de archivos ORC (índices mín./máx., recuentos de filas) con el lector ORC nativo de ClickHouse en lugar del adapter ORC de Apache Arrow. #110086 (Alexey Milovidov).
  • Se redujo el tamaño del binario en ~10.5 MB al ejecutar operaciones aritméticas y de comparación sobre pares de tipos mixtos poco usados (Decimal frente a enteros de distinto ancho, y pares que involucran Int128/UInt128/Int256/UInt256) mediante la conversión a un tipo común, en lugar de usar un kernel compilado dedicado para cada combinación de tipos. Los pares del mismo tipo, los pares de uso habitual y las operaciones plus/minus/multiply limitadas por memoria conservan sus kernels dedicados; los resultados, los tipos de resultado y los casos excepcionales no cambian. #110131 (Alexey Milovidov).
  • Una subquery en el lado derecho de IN cuya única columna es un array con una dimensión más que el argumento de la izquierda ahora se interpreta como el conjunto de elementos del array (como un literal de array o una función que devuelve un array), en lugar de fallar con un confuso error de incompatibilidad de tipos. Por ejemplo, x IN (SELECT groupArray(x) FROM ...) ahora funciona. #110169 (Alexey Milovidov).
  • La lectura desde un table engine SQLite o una table function sqlite ya no consume activamente un CPU core completo cuando la base de datos SQLite está bloqueada por otra conexión. Ahora la lectura queda inactiva mientras espera el bloqueo y sigue pudiéndose cancelar. #110248 (Groene AI).
  • Redondea a tres dígitos los valores de tiempo transcurrido, tasa y ratio en los mensajes de log y excepción, para que números como 1.345844286 sec. ya no se impriman con toda su precisión. #110277 (Alexey Milovidov).
  • En la web UI (Play), BFloat16 ahora se reconoce como un número de coma flotante y sus columnas se alinean a la derecha y se colorean en consecuencia. #110433 (Alexey Milovidov).
  • Se admite la cláusula SETTINGS para el table engine PostgreSQL y la table function postgresql (por ejemplo, SETTINGS postgresql_connection_pool_size = 50), lo que aporta paridad funcional con el engine MySQL. #110614 (Alexey Milovidov).
  • SHOW CREATE TABLE (y SHOW CREATE VIEW / SHOW CREATE DICTIONARY) ahora sugiere en el mensaje de error una tabla con un nombre parecido cuando la tabla solicitada no existe, igual que hacen las consultas SELECT. #110633 (Alexey Milovidov).
  • Se habilita de forma predeterminada la setting merge_selector_enable_heuristic_to_lower_max_parts_to_merge_at_once: el merge selector ahora reduce automáticamente el número máximo de partes que se pueden fusionar a la vez según lo llena que esté la partición. Consulte #91163. #110726 (Mikhail Artemenko).
  • Se aceptan los comandos de limpieza de PostgreSQL RESET, UNLISTEN y DISCARD como operaciones sin efecto en el PostgreSQL wire protocol, en lugar de hacer que fallen con un error de sintaxis. Esto mejora la compatibilidad con drivers como Skunk, que envían RESET ALL y UNLISTEN * durante la configuración y la limpieza de la conexión. #110780 (Alexey Milovidov).
  • Cambia el valor predeterminado de la setting auto_statistics_types de basic, uniq a basic, uniq_v2. #110878 (Han Fei).
  • randomHadamardTransform ahora calcula una transformada exacta que preserva la longitud para cualquier longitud de vector cuyo mayor factor impar sea como máximo 64 (por ejemplo, 3584 = 512 * 7, habitual en modelos de embedding), ampliando las familias anteriores 2^N, 2^k * {12, 20} y 2^k * 9. Una transformada completa de una longitud que no puede representarse exactamente ahora genera una excepción en lugar de rellenar silenciosamente con ceros hasta un vector más largo; pase output_dims para calcular una proyección truncada de longitud arbitraria. #111006 (Alexey Milovidov).
  • Se corrigió una excepción LOGICAL_ERROR durante la copia de seguridad de una base de datos Replicated que se está eliminando y recreando de forma concurrente; esas copias de seguridad ahora fallan limpiamente con CANNOT_GET_REPLICATED_DATABASE_SNAPSHOT. #100651 (Alexey Milovidov).
  • Ahora se muestra el error subyacente real cuando un archivo ZIP no puede descomprimirse (por ejemplo, cuando el archivo se lee desde S3 y el búfer de lectura rechaza un seek). Antes, el error real quedaba oculto tras el mensaje genérico Couldn't unpack zip archive: Code = -100 / Couldn't open zip archive. #105103 (Groene AI).
  • Se corrigió la confusa sugerencia “Maybe you meant X?” después de reiniciar el servidor (o tras DETACH DATABASE/ATTACH DATABASE): al eliminar una tabla ya eliminada, podía sugerirse como alternativa el nombre recién eliminado. #106238 (Groene AI).
  • Se corrigió un error lógico (Logical error: 'removed', que abortaba el servidor en compilaciones de depuración) en la cola en segundo plano de eliminación de tablas, que se activaba cuando el mismo UUID explícito se reutilizaba en varias consultas CREATE OR REPLACE TABLE, lo que encolaba más de una tabla eliminada con ese UUID compartido. #107031 (Groene AI).
  • Se corrigió un error lógico Inconsistent AST formatting que podía abortar el servidor en compilaciones de depuración y con sanitizador cuando se usaba una lambda con alias como operando de un operador de acceso (elemento de tupla .N o elemento de array []) en una posición que no fuera la primera dentro de una lista de expresiones; por ejemplo, SELECT 1, ((p0, p1) -> p0 AS a7).4[3] FROM t. #107092 (Groene AI).
  • Una table function de clúster (urlCluster, fileCluster, s3Cluster, …) anidada dentro de otra consulta distribuida, como clusterAllReplicas(..., urlCluster(...)), ahora se rechaza con un error BAD_ARGUMENTS en lugar de fallar con un error lógico (Distributed task iterator is not initialized). #107107 (Groene AI).
  • OPTIMIZE ... DRY RUN interrumpido por un timeout de consulta (max_execution_time con timeout_overflow_mode = 'break') ahora devuelve TIMEOUT_EXCEEDED en lugar de un error lógico relacionado con rows_sources (que abortaba el servidor en compilaciones de depuración/con sanitizador). #107114 (Groene AI).
  • Se dejó de registrar el error benigno Net Exception: Socket is not connected durante la finalización de la sesión de ZooKeeper en macOS. clickhouse keeper-client ya no imprime este error espurio en stderr al salir. #107438 (Groene AI).
  • Se corrigió un overflow de enteros con signo cuando una vista materializada actualizable reintenta una actualización fallida con refresh_retries configurado con un valor muy grande (cerca del máximo de Int64). El overflow podía abortar el servidor en compilaciones con el sanitizador de comportamiento indefinido. #108005 (Groene AI).
  • Corrige un LOGICAL_ERROR (aborto del servidor en compilaciones de depuración/sanitizador) cuando un JOIN usa el operador de comparación null-safe (<=> / IS NOT DISTINCT FROM) y una de las claves es una subconsulta escalar, p. ej. ... JOIN t2 ON (SELECT x FROM t1) <=> t2.k, con el analizador antiguo (enable_analyzer = 0). Ahora, esa consulta devuelve un error NOT_FOUND_COLUMN_IN_BLOCK normal en lugar de un error lógico. #108123 (Groene AI).
  • Las consultas de búsqueda vectorial que seleccionan la columna _distance ahora devuelven un error adecuado en lugar de fallar con un error lógico. #108423 (Robert Schulze).
  • Corrige un std::future_error (The associated promise has been destructed prior to the associated state becoming ready) que podía aparecer y abortar el servidor en compilaciones de depuración y sanitizador cuando fallaba la planificación de la tarea asíncrona final que completa la carga multiparte en S3/Azure (por ejemplo, por agotamiento del pool de hilos). Ahora, en su lugar, se informa del error real de planificación. #108730 (Groene AI).
  • Evita una salida excesiva del log del servidor y un mensaje de error desmesurado al compilar una expresión regular muy grande (por ejemplo, un patrón LIKE o match con cientos de miles de comodines); ahora esos patrones fallan con un error CANNOT_COMPILE_REGEXP claro. #108821 (Raúl Marín).
  • Corrige un comportamiento indefinido al convertir en cadena un tipo de paquete de protocolo fuera de rango (p. ej., en los mensajes de error Unexpected packet from server / Received ... packet) en una conexión desincronizada o sometida a fuzzing. #108885 (Groene AI).
  • Corrige un error interno confuso (Method getResultType is not supported for TABLE query tree node) cuando se usaba una expresión de tabla como argumento izquierdo del operador IN; ahora esas consultas producen un mensaje de error claro. #109412 (Alexey Milovidov).
  • Corrige la lectura de una tabla Iceberg con un archivo de metadatos cuyo número de versión contiene solo dígitos, pero excede el rango de enteros de 32 bits (por ejemplo, v99999999999999999999.metadata.json). Antes, ese nombre producía un std::out_of_range opaco (STD_EXCEPTION) en lugar de un error BAD_ARGUMENTS claro. #109619 (Groene AI).
  • Corrige un posible Logical error: 'ReadBuffer is canceled. Can't read from it.' cuando un formato de entrada basado en filas (p. ej. TSV/CSV) no podía analizar la entrada y la lectura subyacente ya había sido cancelada (por ejemplo, un fragmento HTTP malformado o un cuerpo truncado). La generación de diagnósticos detallados del análisis ya no lee desde un búfer cancelado. #109708 (Groene AI).
  • Las expresiones de filtro de las políticas de fila que usan arrayJoin (o su alias unnest) ahora se rechazan con un error claro; antes, esas políticas provocaban un error lógico column->size() == num_rows en tiempo de consulta. #109753 (Raúl Marín). #109973 (Raúl Marín).
  • La lectura de una tabla Paimon cuyo esquema contiene un tipo anidado no compatible (por ejemplo, un campo ROW) ahora informa de un error BAD_ARGUMENTS claro que indica el tipo no compatible, en lugar de un simple DB::Exception. (OK) con código de error 0 y sin mensaje. #109762 (Groene AI).
  • Se corrigió un LOGICAL_ERROR (std::length_error) cuando una consulta con la configuración experimental make_distributed_plan = 1 usaba un valor muy grande para distributed_plan_default_reader_bucket_count o distributed_plan_default_shuffle_join_bucket_count. Estos valores ahora se rechazan con INVALID_SETTING_VALUE. #109770 (Groene AI).
  • Se corrigió un LOGICAL_ERROR (query tree node does not have valid source node) cuando un CTE recursivo resolvía un identificador de un ámbito externo como una columna correlacionada (con allow_experimental_correlated_subqueries = 1). Estas consultas ahora devuelven un error UNSUPPORTED_METHOD claro. #109863 (Groene AI).
  • Se corrigió un desbordamiento de enteros con signo cuando ORDER BY ... WITH FILL omite un hueco muy grande en una columna Int64/UInt64 (por ejemplo, un paso de 2 sobre un hueco cercano a 2^63). El desbordamiento era un comportamiento indefinido en compilaciones con sanitizadores y se ajustaba silenciosamente por desbordamiento en compilaciones de lanzamiento. #109937 (Groene AI).
  • Se corrigió un error lógico Bad cast from type DB::FunctionNode to DB::ConstantNode (aborto del servidor en compilaciones de depuración/con sanitizador) al ejecutar SELECT ... ORDER BY ... WITH FILL sobre una tabla Distributed con un valor bajo de optimize_const_name_size. #109938 (Groene AI).
  • Se corrigió un error lógico Invalid number of rows in Chunk cuando un destino INTERPOLATE es un alias de una columna WITH FILL con el analyzer antiguo (enable_analyzer = 0). Estas consultas ahora se rechazan con un error INVALID_WITH_FILL_EXPRESSION claro. #110103 (Groene AI).
  • Se corrigió un error lógico (aborto del servidor en compilaciones de depuración/con sanitizador) cuando las funciones indexHint/ignore/isZeroOrNull reciben un argumento cuyo tipo se resuelve como Nothing, por ejemplo, dentro de expresiones como indexHint(assumeNotNull(materialize(NULL))). #110192 (Groene AI).
  • Se corrigió un error lógico Too large size (...) passed to allocator que podía producirse cuando se establecía un valor fuera de rango para una configuración de tamaño del búfer de lectura, como max_read_buffer_size o max_read_buffer_size_local_fs. Estos valores ahora se limitan a 256 MiB mediante la comprobación de coherencia de la configuración y, además, en el punto de consumo para INSERT ... FROM INFILE, que lee archivos dentro de clickhouse-client, donde esa comprobación no se aplica. #110207 (Alexey Milovidov).
  • CHECK TABLE ahora informa de la corrupción real de una projection part que no pudo cargar sus metadatos, en lugar del engañoso error Columns doesn't match ... Expected: 0 columns. #110262 (Raúl Marín).
  • Una incompatibilidad de tipos cuando un valor leído de una fuente PostgreSQL (por ejemplo, la table function postgresql o el table engine PostgreSQL) no puede convertirse al tipo de columna declarado (por ejemplo, una columna text declarada como Int32) ahora se informa como un error de consulta adecuado; anteriormente provocaba el aborto del servidor en compilaciones de depuración y con sanitizador. #110264 (Groene AI).
  • Se añade compatibilidad en macOS para el query profiler, los profilers de memoria y de trace, y la simbolización de system.trace_log. #109825 (Raúl Marín).
  • Actualiza chdig a v26.7.1: trazas de pila comprimidas para compartir, patrones de consulta, compatibilidad con memoria de arena separada, mejoras en Perfetto y correcciones de compatibilidad. #110938 (Azat Khuzhin).
  • Corrige una inferencia incorrecta de monotonicidad para intDiv en una clave sin signo dividida por una constante con signo, lo que podía desactivar la poda del índice de clave primaria para predicados IN/NOT IN que cruzan el límite de signo del tipo de resultado; los builds de depuración también provocaban un LOGICAL_ERROR Invalid binary search result in MergeTreeSetIndex. #107586 (Groene AI).
  • Se añadió la configuración allow_lossy_numeric_supertype (deshabilitada de forma predeterminada). Cuando se habilita, if, multiIf, coalesce, ifNull, array y map sobre argumentos numéricos que no tienen un tipo común sin pérdida (por ejemplo, Decimal y Float64, o Int64 y Float64) se resuelven como Float64 en lugar de Variant, de modo que el resultado pueda usarse con funciones de agregación como sum, avg, min y max. Los mensajes de error relevantes de las funciones de agregación ahora mencionan la configuración por su nombre. Cierra #106707. #107236 (Groene AI).
  • Inicia el endpoint de Prometheus (para configuraciones solo de métricas) y la recopilación asíncrona de métricas antes de que se carguen las tablas, para que las métricas estén visibles durante la fase de carga de metadatos, que puede ser larga. #108402 (Christoph Wurm).

Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)

  • Corrige el fallo de TRUNCATE TABLE y DROP PARTITION en tablas con muchos bloques de deduplicación, donde eliminarlos en una sola solicitud a ZooKeeper podía superar el límite predeterminado de 1 MB de jute.maxbuffer. #105991 (Clayton McClure). Esto solo le afecta si usa Apache ZooKeeper (no recomendado) en lugar de ClickHouse Keeper.
  • Corrige el uso de nombres de columna completos (database.table.column) en la cláusula WHERE de las mutaciones, como DELETE FROM y ALTER TABLE ... UPDATE/DELETE, en tablas de la familia MergeTree; anteriormente, estas consultas fallaban con un error de columnas ausentes. Cierra #71760. #109491 (Mikhail Artemenko).
  • Corrige la caché de resultados de consultas para consultas PromQL. El dialecto promql omitía la comprobación de funciones no deterministas y podía servir resultados obsoletos anclados en now(); la API HTTP de Prometheus (/api/v1/query, /api/v1/query_range) nunca almacenaba entradas de caché. #110887 (Nikita Mikhaylov).
  • Corrige el fallo del servidor al arrancar cuando la variable de entorno TZ está vacía. Cierra #68920. #68921 (Ardenwick).
  • Se corrigió el fallo del servidor al arrancar cuando un motor de base de datos Backup hace referencia a una copia de seguridad que ha dejado de estar disponible (por ejemplo, cuando se eliminaron sus archivos o el almacenamiento subyacente no es accesible). La base de datos ahora se carga sin tablas en lugar de impedir el arranque de todo el servidor. #83188 (Vitaly Orlov).
  • Al usar inserciones en segundo plano en tablas con el motor Distributed, los retrasos provocados por errores repetidos al enviar datos a shards remotos ahora disminuyen una vez resueltos esos errores. Anteriormente, el retraso solo aumentaba y nunca se restablecía. #87378 (Andrei Kochemirovskii).
  • Corrige que broken_data_files en system.distribution_queue y la métrica BrokenDistributedFilesToInsert siempre informaran 0 para los archivos dañados detectados al escanear la cola de inserción asíncrona de Distributed durante el arranque. #92124 (KG.Xu).
  • Corrige la recuperación del logging tras un error por disco lleno. Anteriormente, cuando el disco del log se llenaba, ClickHouse entraba en un estado fallido y saturaba syslog de forma continua con mensajes de error (potencialmente escribiendo más de 100 GB/hora), sin recuperarse nunca incluso después de liberar espacio en disco. Ahora el sistema de logging se recupera automáticamente en cuanto vuelve a haber espacio en disco disponible, sin necesidad de reiniciar el servidor. #93127 (jaehanbyun).
  • Reenvía las credenciales estáticas de S3 a las lecturas de tablas DataLakeCatalog de Unity cuando vended_credentials está deshabilitado, evitando fallos de acceso anónimo al almacenamiento de objetos. #96910 (kgeg401).
  • Corrige un fallo en el código de análisis de esquemas del motor de tablas DeltaLake. #97112 (Kseniia Sumarokova).
  • Corrige un problema de seguridad por el que un cliente TCP no autenticado podía comprobar la existencia de tablas y el estado de la replicación a través del puerto interserver. #99854 (Shaohua Wang).
  • Se corrigió un error de sintaxis cuando un alias sigue a una subconsulta en DESCRIBE TABLE. Soluciona #100031. #100205 (Yarik Briukhovetskyi).
  • Se corrigió una excepción en subconsultas correlacionadas cuando las columnas externas pasan a ser Nullable con group_by_use_nulls y ROLLUP/CUBE. #100365 (Alexey Milovidov).
  • Se corrigió una terminación abrupta del servidor (en compilaciones con sanitizador) y una pérdida silenciosa de datos durante el arranque de la tabla cuando una parte MergeTree transaccional revertida se intersecta con una parte confirmada. #100992 (Tuan Pham Anh).
  • Se corrigió que indexOfAssumeSorted devolviera resultados incorrectos para columnas Array(LowCardinality(String)) en tablas MergeTree. #101771 (Yash ).
  • Se corrigió una poda incorrecta de la clave primaria cuando la sorting key de una tabla envuelve una columna Date en toDateTime (por ejemplo, ORDER BY toDateTime(date_column)) y una consulta filtra por la columna original con una comparación como WHERE date_column >= '...'. toDateTime(Date) produce overflow para valores Date fuera del rango de DateTime (después de 2106-02-07), por lo que la clave almacenada no es monotónica; ClickHouse ya no usa la poda de clave primaria para esta combinación de clave/predicado porque hacerlo podría descartar gránulos que contienen filas coincidentes. Cierra #101744. #101814 (Nihal Z. Miaji).
  • Se corrigió que intDivOrNull, moduloOrNull y positiveModuloOrNull devolvieran 0 en lugar de NULL, y que intDivOrNull e intDivOrZero lanzaran una excepción en lugar de devolver NULL / 0, cuando la división provoca una excepción de coma flotante (división por cero o INT_MIN / -1), incluso con argumentos mixtos con y sin signo. #101976 (Yarik Briukhovetskyi).
  • Se corrigieron excepciones LOGICAL_ERROR al leer tablas Iceberg o DeltaLake en casos límite, como actualizaciones concurrentes de metadata de Iceberg o lecturas mediante la table function merge sobre tablas DeltaLake. #102033 (Groene AI).
  • Se corrigieron fallos en requests HTTP salientes (p. ej., la función aiGenerate, la table function url, S3) con No route to host en hosts que anuncian direcciones IPv4 e IPv6 cuando solo una familia de direcciones es enrutable. El HTTP connection pool ahora recurre a la siguiente dirección resuelta cuando la primera falla con un error de red, en lugar de propagar el error en la primera request. #103786 (Alexey Milovidov).
  • Se corrigió una terminación abrupta del servidor durante RESTORE de copias de seguridad que contienen tablas con dependencias cíclicas. #103824 (Konstantin Bogdanov).
  • La inferencia de esquema para columnas Arrow time32/time64 (p. ej., SELECT * FROM file(..., 'Arrow')) ahora infiere Time64 en lugar de DateTime64; cualquier elemento posterior que dependa del tipo inferido anterior observará el nuevo tipo tras una actualización. Además, los valores Time/Time64 ahora pueden exportarse a Arrow con el tipo temporal de Apache Arrow adecuado, seleccionado según la precisión. Soluciona #104038. #104316 (/bin/cat).
  • Se corrigió una condición de carrera entre ALTER TABLE ... RENAME COLUMN y un OPTIMIZE TABLE ... FINAL concurrente (o cualquier merge en segundo plano) en MergeTree que podía reemplazar silenciosamente los datos de la columna renombrada por valores predeterminados. #104822 (Groene AI).
  • Se corrigió un error lógico Block structure mismatch durante un INSERT concurrente mientras un ALTER TABLE ... RENAME COLUMN estaba en curso, en una base de datos Atomic con lazy_load_tables = 1 después de DETACH DATABASE/ATTACH DATABASE. #104852 (Groene AI).
  • Se corrigió groupConcat cuando se mezclan las formas paramétrica y de dos argumentos, por ejemplo groupConcat(',', 2)(x, '/'): el parámetro de límite de filas se ignoraba silenciosamente, por lo que se devolvían todas las filas en lugar del número solicitado; el delimitador del segundo argumento ahora prevalece correctamente sobre el parámetro. #104882 (Yarik Briukhovetskyi).
  • Se corrigió un LOGICAL_ERROR (Expected one block from input stream) lanzado por KILL QUERY/KILL MUTATION/KILL PART_MOVE_TO_SHARD/KILL TRANSACTION cuando su cláusula WHERE contiene una subconsulta por fila, o cuando max_block_size es lo bastante pequeño como para que el SELECT interno sobre la tabla system.* correspondiente emita más de un bloque. #104927 (Groene AI).
  • Se corrigió CAST de unidades de interval más pequeñas a unidades más grandes que devolvía resultados incorrectos (por ejemplo, CAST(toIntervalSecond(60) AS IntervalMinute) devolvía 0 en lugar de 1). Cierra #104986. #105058 (Yarik Briukhovetskyi).
  • Se corrigió un error lógico (Assertion 'row < chunk.getNumRows()' failed) en consultas LIMIT ... WITH TIES ejecutadas con la canalización de lectura en orden (optimize_read_in_order = 1 y read_in_order_use_virtual_row_per_block = 1). #105102 (Groene AI).
  • Se corrigió una fuga en las vistas materializadas actualizables (MATERIALIZED VIEW ... REFRESH ...): la tabla interna temporal que una actualización intercambiaba mediante EXCHANGE TABLES no podía eliminarse si era mayor que max_table_size_to_drop, por lo que cada actualización posterior creaba otra tabla interna temporal más, haciendo crecer el directorio de datos de la vista hasta agotar el disco. La operación interna de eliminación de la tarea de actualización ahora omite max_table_size_to_drop y max_partition_size_to_drop; estas salvaguardas siguen aplicándose al DROP TABLE de la propia vista emitido por el usuario. Cierra #104900. #105106 (Groene AI).
  • Se corrigió un error inesperado DATA_TYPE_CANNOT_BE_USED_IN_KEY en consultas ALTER que no cambian la clave de ordenación (cambiar settings, comments, codecs, añadir una columna que no forma parte de la clave, etc.) en tablas MergeTree que tienen una SimpleAggregateFunction (u otro tipo permitido solo con allow_suspicious_primary_key = 1) en la clave de ordenación. #105111 (Groene AI).
  • Se corrigió un error de uso de memoria después de su liberación al consultar las columnas de estado de las réplicas de system.clusters (como is_active, unsynced_after_recovery, recovery_time) mientras se elimina o se desacopla una base de datos Replicated. Además, las excepciones benignas de Keeper que se ignoraban en esta ruta de código (la base de datos afectada se trata como temporalmente no disponible y se omite) ahora se registran en el nivel Information en lugar de Error, por lo que ya no llegan a los clientes con el valor predeterminado send_logs_level = 'warning'. #105149 (Groene AI).
  • Se corrigió un problema por el que, al ejecutar varias sentencias en clickhouse-local --ignore-error, se mostraban todas las sentencias posteriores dentro del mensaje de error para cada error léxico o de paréntesis no emparejados. #105480 (Groene AI).
  • Se corrigió un fallo poco frecuente del servidor cuando las vistas materializadas actualizables se eliminan o sustituyen al mismo tiempo que se planifica su actualización. #105588 (Groene AI).
  • Ahora se rechazan ALTER TABLE ... DELETE y ALTER TABLE ... UPDATE en tablas Iceberg cuyo formato de archivo de datos no sea Parquet, con un error NOT_IMPLEMENTED claro, en lugar de provocar un fallo del servidor o corromper silenciosamente la tabla. #105893 (Groene AI).
  • Se corrigieron resultados incorrectos en una vista definida con EXCEPT o INTERSECT cuyo operando es una cadena UNION, después de DETACH/ATTACH o de reiniciar el servidor. Al formateador le faltaban paréntesis alrededor de los elementos UNION hijos de INTERSECT/EXCEPT, por lo que el SQL almacenado se volvía a analizar con la precedencia invertida. #105935 (Groene AI).
  • Se corrigió la detección errónea de datos JSON como TSKV durante la autodetección de formato. Cierra #100797. #106009 (Pavel Kruglov).
  • Ahora se prohíbe crear un índice de omisión minmax directamente sobre columnas JSON: más adelante podía hacer fallar las inserciones con una excepción NO_COMMON_TYPE cuando se insertaban matrices de tipos mixtos. En su lugar, cree el índice sobre subcolumnas tipadas (por ejemplo, INDEX idx json.field TYPE minmax). #106094 (linhaojie).
  • Se corrigió un error lógico (Parsed partition value ... doesn't match partition value for an existing part with the same partition ID) producido por OPTIMIZE TABLE ... PARTITION ... y otras consultas que resuelven un valor de partición, en tablas con una clave de partición de tipo Time. #106202 (Groene AI).
  • Se corrigió un caso en el que una data part se marcaba incorrectamente como si tuviera una proyección dañada después de que una eliminación ligera no dejara ninguna projection part: ya fuera porque la proyección se reconstruía con cero filas de salida o porque se eliminaba (lightweight_mutation_projection_mode = 'rebuild'/'drop'). Antes, este estado deshabilitaba la optimización de proyecciones para las consultas sobre esa parte. #106273 (Shaohua Wang).
  • Se corrigió que removeDirectory en discos plain de object storage (como s3_plain) eliminara todos los archivos dentro de un directorio no vacío como si la eliminación fuera recursiva; ahora, eliminar un directorio no vacío falla con CANNOT_RMDIR, y la eliminación recursiva gestiona el contenido explícitamente. #106281 (RinChanNOW).
  • Se corrigió un error lógico (Part ... doesn't exist) que podía abortar el servidor durante la recuperación de un INSERT con quorum tras un error de hardware de Keeper cuando el quorum se marcaba simultáneamente como fallido. #106424 (Alexey Milovidov).
  • Corrige una excepción LOGICAL_ERROR por nombres de columna duplicados al aplicar políticas de fila. #106438 (János Benjamin Antal).
  • Corrige que CREATE OR REPLACE TABLE y REPLACE TABLE dejaran una tabla _tmp_replace_* huérfana en disco y sustituyeran la tabla original por una vacía cuando el destino existente superaba max_table_size_to_drop. La comprobación de tamaño ahora se realiza antes del intercambio, de modo que la infracción se aborta limpiamente con el nombre de la tabla visible para el usuario en el error. #106782 (Groene AI).
  • Corrige que JSON_QUERY/JSON_VALUE/JSON_EXISTS devolvieran Dynamic en lugar de String/UInt8 con argumentos Dynamic. Cierra #106461. #106877 (Pavel Kruglov).
  • Corrige resultados incorrectos al consultar una tabla ReplacingMergeTree con FINAL y un filtro sobre un text index cuando query_plan_optimize_lazy_final estaba habilitado. La optimización de FINAL diferido construía pasos de lectura que no reproducían la lectura directa desde el text index, por lo que el filtro descartaba todas las filas coincidentes. #106894 (Jimmy Aguilar Mena).
  • Aplica query_masking_rules a los mensajes añadidos a las excepciones, para que las credenciales codificadas en URL en los sufijos (in file/uri ...) de los errores de las table functions jdbc/odbc no se filtren cuando haya masking rules configuradas. #106916 (Gaurav Dubey).
  • Corrige que las partes se marcaran como dañadas y se desacoplaran en cualquier recarga de parte (reinicio del server, DETACH/ATTACH) en tablas con una columna LowCardinality(Nullable(...)) en la partition key. Desde la versión 26.5, el archivo de índice minmax por parte no se escribía cuando el valor mínimo y máximo de esa columna eran NULL, mientras que la comprobación de consistencia de la parte seguía exigiendo ese archivo. Las partes escritas por las versiones afectadas no tienen el archivo de índice minmax y aún deben volver a adjuntarse manualmente. Cierra #106837. #106945 (Pedro Ferreira).
  • Corrige un LOGICAL_ERROR (Unexpected expression in JOIN ON section. Expected boolean (UInt8), got 'Nothing') cuando un predicado no equi de JOIN ... ON hace referencia a una columna de tipo Nothing, como una generada por ARRAY JOIN []. #106981 (Groene AI).
  • Corrige un LOGICAL_ERROR poco frecuente (Attempt to release query context that does not exist) y el cierre inesperado del server asociado al leer tablas MergeTree a través de un cache disk del filesystem creado con enable_filesystem_query_cache_limit = 1. #107028 (Groene AI).
  • Corrige un cierre inesperado del server al mover una parte vacía a un disco plain_rewritable (por ejemplo, con ALTER TABLE ... MOVE PARTITION ... TO DISK para una parte vacía conservada por remove_empty_parts = 0). #107040 (Groene AI).
  • Corrige el orden incorrecto de las filas en consultas ORDER BY sobre UNION ALL con optimize_read_in_order y read_in_order_use_virtual_row habilitados. Cierra #106879. #107053 (Vladimir Cherkasov).
  • Se corrigió un LOGICAL_ERROR (Unsupported argument types) en la función geohashesInBox cuando sus argumentos de coordenadas mezclaban valores constantes y no constantes, o cuando una coordenada era BFloat16. Los argumentos Float32 mixtos const/no-const ahora funcionan, y los argumentos BFloat16 se rechazan con un error claro. #107063 (Groene AI).
  • Se corrigieron resultados incorrectos (filas duplicadas) para SELECT DISTINCT sobre un GROUP BY con WITH CUBE, WITH ROLLUP o GROUPING SETS en las mismas claves. La optimización query_plan_remove_redundant_distinct ya no elimina DISTINCT en estos casos, porque los modificadores de agrupación generan filas adicionales con las columnas clave en sus valores predeterminados, que pueden colisionar con valores reales de grupo. #107072 (Groene AI).
  • Se corrigió un resultado incorrecto en un OUTER JOIN cuando el filtro WHERE es una conjunción que contiene un término constante (por ejemplo, p AND 1, o WHERE p QUALIFY NULL, donde QUALIFY NULL se fusiona en WHERE). El término constante de la conjunción podía propagarse al lado no conservado del join y eliminarse del filtro posterior al join, de modo que el join producía filas sin coincidencia con las columnas de ese lado en sus valores predeterminados, y esas filas pasaban incorrectamente el filtro. #107084 (Groene AI).
  • Se corrigió que las user-defined functions executable_pool configuradas con <lifetime> no detectaran cambios en el script subyacente. Anteriormente, solo SYSTEM RELOAD FUNCTIONS volvía a leer un script editado; las recargas periódicas de <lifetime> seguían ejecutando la versión anterior. #107087 (Groene AI).
  • Se corrigió una excepción LOGICAL_ERROR (Cannot find input column ... on its position in inputs of expression actions DAG) en una scalar subquery correlacionada sobre un origen que proyecta dos veces el mismo identificador de columna (p. ej., SELECT number, *) cuando correlated_subqueries_default_join_kind = 'left'. #107112 (Groene AI).
  • Se corrigió una condición de carrera en el recopilador global de trazas del server entre el inicio del perfilador de un worker thread y el apagado del server. #107307 (Groene AI).
  • Los incremental backups ya no almacenan credenciales de S3 en el localizador <base_backup> del archivo de metadata .backup. Los backups creados con use_same_s3_credentials_for_base_backup = 1, o con credenciales explícitas del backup base que coinciden con este localizador de backup, almacenan un marcador no secreto y se restauran sin settings adicionales en el momento de la restauración; en el caso de backups creados con credenciales explícitas distintas para el backup base o con argumentos adicionales de authentication base, páselos a RESTORE con el setting base_backup. Los backups creados por versiones anteriores con embedded credentials siguen siendo restaurables. #107357 (Pablo Marcos).
  • Se corrigió que el encabezado de CSVWithNames y CSVWithNamesAndTypes tuviera menos columnas que los datos cuando output_format_csv_serialize_tuple_into_separate_columns está habilitado (valor predeterminado). El encabezado (y la fila de tipos) ahora aplana las columnas Tuple en sus fields hoja con nombres separados por puntos (p. ej., t.a, t.b), de modo que el número de columnas del encabezado coincida con los datos. Un nuevo setting output_format_csv_header_serialize_tuple_into_separate_columns (predeterminado 1) controla este comportamiento y puede establecerse en 0 para restaurar el encabezado anterior de nombre único. #107371 (Groene AI).
  • Se corrigió la lectura de tablas Iceberg v3 cuyos data files Parquet contienen columnas reservadas de linaje de filas (como _row_id); el lector nativo de Parquet ya no genera ICEBERG_SPECIFICATION_VIOLATION para ID de field reservados que no forman parte del table schema. #107377 (Greg Maher).
  • Se corrigió un raro cierre inesperado del servidor durante el apagado (std::future_error: The associated promise has been destructed prior to the associated state becoming ready) causado porque una tarea programada se eliminaba de la cola del thread pool antes de ejecutarse. #107383 (Groene AI).
  • Se corrigieron los motores de tabla y base de datos MaterializedPostgreSQL para que una sola tabla o base de datos pueda replicarse desde un esquema no predeterminado de PostgreSQL (materialized_postgresql_schema), incluido el caso en que existan tablas con el mismo nombre en varios esquemas de la misma base de datos (antes compartían una publication y un replication slot, y se interferían entre sí). #107425 (Alexey Milovidov).
  • Se corrigió que MaterializedPostgreSQL dejara de replicar una base de datos completa (con LOGICAL_ERROR: Columns number mismatch) cuando cambiaba la estructura de una sola tabla replicada mientras el servidor estaba caído. Ahora solo se omite la tabla afectada y puede recuperarse con DETACH/ATTACH. #107427 (Alexey Milovidov).
  • BACKUP de una base de datos MaterializedPostgreSQL ya no se queda bloqueado indefinidamente con Table ... were created or changed its definition during scanning, y ahora sí respalda los datos de la tabla (delegado al ReplacingMergeTree subyacente), que puede restaurarse como un ReplacingMergeTree standalone. #107433 (Alexey Milovidov).
  • Se corrigió una regresión por la que establecer compatibility = '26.6' (que habilita implícitamente la estrategia de partición hive) aceptaba silenciosamente {_partition_id} en rutas de tablas S3/object storage en lugar de generar BAD_ARGUMENTS. #107437 (Lefteris).
  • Se corrigió una fuga de memoria en el mongo-c-driver incluido que podía producirse al leer desde MongoDB (por ejemplo, mediante un Diccionario de MongoDB o la table function mongodb) si un error de lectura retryable iba seguido de un fallo en la selección del servidor durante el reintento. #107448 (Groene AI).
  • Se corrigió una excepción al insertar en una tabla Iceberg cuyos metadatos fueron creados por un external engine y omiten los arrays opcionales snapshots, metadata-log o snapshot-log. Estas inserciones ahora se completan correctamente en lugar de fallar. #107473 (Shaohua Wang).
  • Se corrigió que DELETE FROM (eliminación ligera) requiriera el privilege ALTER UPDATE además de ALTER DELETE. Un usuario al que solo se le concedió ALTER DELETE ahora puede ejecutar DELETE FROM, como se documenta. #107491 (Shaohua Wang).
  • Se corrigió NOT_FOUND_COLUMN_IN_BLOCK al leer archivos particionados por Hive con use_hive_partitioning = 1 y una cláusula WHERE/PREWHERE que filtra una columna real (no virtual) mientras también se selecciona una columna de partición de Hive. #107505 (Groene AI).
  • Se corrigió un LOGICAL_ERROR (Different order of columns in UNION subquery) cuando el analyzer antiguo (enable_analyzer = 0) lee un subconjunto de columnas de una subquery cuyos hijos de UNION son operaciones de conjuntos INTERSECT/EXCEPT. #107511 (Groene AI).
  • Se corrigió que los valores NULL se convirtieran silenciosamente en cadenas vacías al insertar datos Arrow/ORC en una columna LowCardinality(Nullable(...)). Fue una regresión introducida en la versión 26.5. #107532 (Jimmy Aguilar Mena).
  • Se corrigió un error lógico (Stream ... variant_discr ... is not found) que podía producirse al fusionar o leer una parte de MergeTree generada por una mutación de una tabla con una columna Dynamic. #107562 (Alexey Milovidov).
  • Se corrigió un error lógico (WhichDataType(const_type).isArray()) durante el análisis de la clave primaria cuando se llama a pointInPolygon con un argumento de polígono constante de un tipo contenedor, como Variant o Dynamic (por ejemplo, pointInPolygon((x, y), if(c, [(0, 0), ...], NULL))). #107589 (Groene AI).
  • Se corrigió un error lógico (Last stored last_written_position in meta file ... is bigger than current last_written_pos) en el motor FileLog que podía producirse cuando se eliminaba un archivo supervisado y se volvía a crear reutilizando el mismo inode. #107617 (Groene AI).
  • Se corrigió una rara interrupción del servidor (std::future_error: The associated promise has been destructed prior to the associated state becoming ready) durante el procesamiento de solicitudes del cliente ZooKeeper, cuando una solicitud asíncrona a Keeper se descartaba mientras se enviaba, por ejemplo, bajo presión de memoria. #107647 (Groene AI).
  • Se corrigió RESTORE para las tablas ReplicatedMergeTree, de modo que las partes con contenido duplicado de una copia de seguridad se conserven en lugar de deduplicarse silenciosamente. #107652 (Pablo Marcos).
  • Se corrigió el filtro de join en tiempo de ejecución que producía resultados incorrectos para columnas JSON. Cierra #107646. #107663 (Pavel Kruglov).
  • Se corrigieron resultados incorrectos en consultas distribuidas que seleccionaban columnas ALIAS que comparten una subexpresión común: las columnas podían desalinearse y devolver valores bajo la columna equivocada. #107675 (Vladimir Cherkasov).
  • Las cuotas indexadas por normalized_query_hash ahora contabilizan todos los recursos (read_rows, read_bytes, result_rows, result_bytes, execution_time, written_bytes, errors) por patrón de consulta, igual que los contadores de número de consultas, en lugar de contabilizarlos en un único bucket compartido por usuario. #107681 (Alexey Milovidov).
  • Se corrigió un error lógico Block structure mismatch in UnionStep stream (interrupción del servidor en compilaciones de debug/sanitizador, Code: 49 en compilaciones de lanzamiento) que se producía cuando ramas hermanas de un UNION/INTERSECT/EXCEPT diferían solo en su predicado WHERE y el predicado de una de las ramas se plegaba como constante a una columna Const. #107719 (Groene AI).
  • Se corrigieron errores lógicos (Bad cast) causados por la eliminación inconsistente de LowCardinality anidado dentro de columnas Variant y Dynamic, por ejemplo, en concat, format y el análisis de la clave primaria. Cierra #107598. #107773 (Pavel Kruglov).
  • Se corrigió un grave desequilibrio en la distribución del trabajo con réplicas paralelas cuando el clúster contiene réplicas inactivas (por ejemplo, entradas obsoletas dejadas tras el escalado automático). El coordinador de lectura ya no cuenta esas réplicas, por lo que el trabajo se equilibra entre las réplicas en línea en lugar de acumularse en una sola. #107805 (Alexey Milovidov).
  • Se corrige la excepción Not-ready Set is passed as the second argument, que podía producirse cuando la construcción de un conjunto para una subconsulta IN durante el análisis de la clave primaria fallaba silenciosamente (por ejemplo, por un timeout de subconsulta con overflow_mode = 'break'), dejando el conjunto permanentemente sin construir en la canalización de consultas. #107924 (Alexey Milovidov).
  • Se corrige un fallo del servidor en el pushdown de predicados (enable_optimize_predicate_expression, analyzer heredado) cuando una subconsulta UNION aparece dentro de una condición JOIN ... ON. #107930 (Groene AI).
  • Se corrigen errores espurios de CHECKSUM_DOESNT_MATCH y de lectura de Parquet (y, en algunos formatos, resultados silenciosamente incorrectos) cuando un objeto de S3 o compatible con S3 (p. ej., GCS) se sobrescribe en el mismo lugar mientras se está leyendo. Ahora estas lecturas fallan con un error claro y reintentable, en lugar de devolver datos ensamblados a partir de dos versiones del objeto; esto se controla mediante el nuevo ajuste s3_validate_etag_on_read (activado de forma predeterminada). #107934 (Shaohua Wang).
  • Se corrige un SELECT que fallaba con NOT_FOUND_COLUMN_IN_BLOCK en una tabla que tiene un índice de omisión de datos set cuando una política de filas la filtra usando una condición siempre verdadera combinada con una comprobación sobre una columna no indexada. #107971 (Shaohua Wang).
  • Se corrige el análisis de los parámetros de comando de las funciones definidas por el usuario ejecutables para que no se acepten como parámetros placeholders con nombres vacíos o no válidos. #107983 (Goutam Adwant).
  • Se corrige una regresión de rendimiento en las subcolumnas de Map con PREWHERE. Cierra #107912. Provocada por #99200. #107988 (Pavel Kruglov).
  • Se corrige una escritura fuera de los límites al leer una columna Variant desde un bloque Native mal formado cuyos discriminadores hacen referencia a un índice de variante que no existe. #107991 (uwezkhan).
  • Se corrigen resultados de consulta incorrectos debidos a una poda incorrecta de la clave primaria y de particiones cuando toStartOfDay, toStartOfISOYear, toDaysSinceYearZero, toRelativeSecondNum, toRelativeMinuteNum, toRelativeHourNum, toRelativeWeekNum, toRelativeDayNum, toMonthNumSinceEpoch o toYearNumSinceEpoch se aplican a una columna clave Date32 que contiene fechas fuera del rango que la función puede representar (en particular, fechas anteriores a 1970-01-01). Estas funciones se presentaban como monotónicas para el índice primario, pero antes hacían wraparound con esos argumentos, por lo que el índice podía podar gránulos que en realidad contenían filas coincidentes; ahora se saturan en los límites de su tipo de resultado y siguen siendo monotónicas en todo el rango de Date32. #108018 (Nihal Z. Miaji).
  • Se corrige accurateCastOrNull de un Tuple cuyo elemento es Dynamic/Variant: un NULL genuino del origen se trataba como un fallo de conversión. Para un elemento de destino Nullable, un NULL del origen ahora sigue siendo un elemento NULL (como ocurre con un origen Tuple(Nullable(...)) simple); para un elemento de destino no Nullable, un NULL del origen ahora hace que toda la tupla sea NULL en lugar de producir el valor predeterminado del elemento; los fallos de análisis o desbordamiento siguen haciendo que toda la tupla sea NULL. #108023 (Groene AI). También se corrige un error lógico al convertir una columna Dynamic o Variant anidada dentro de un Tuple a un tipo de elemento no Nullable con accurateCastOrNull o accurateCastOrDefault. #108061 (Alexey Milovidov).
  • Se corrigió que numericIndexedVectorPointwiseMultiply devolviera un resultado vacío al multiplicar por un vector de solo unos con una configuración BSI (bit-sliced index) diferente. #108027 (Alexey Milovidov).
  • Se corrigió que toTime64 y CAST(... AS Time64) no limitaran los valores fuera de rango al intervalo de Time64 en los modos de desbordamiento saturate e ignore, lo que podía producir valores que se muestran de forma idéntica pero se comparan como distintos. #108028 (Alexey Milovidov).
  • getClientHTTPHeader ahora se trata correctamente como no determinista, por lo que su resultado ya no se reutiliza incorrectamente en la caché de resultados de consultas. #108029 (Alexey Milovidov).
  • clickhouse-client --port 9440 vuelve a habilitar automáticamente una conexión segura (TLS); esto se había roto por una refactorización que dejó de pasar el puerto a la comprobación de conexión segura. #108032 (Alexey Milovidov).
  • Un error transitorio al actualizar data parts de una tabla de solo lectura ya no detiene permanentemente la tarea de actualización en segundo plano. #108034 (Alexey Milovidov).
  • Se corrigió que las advertencias de sobrecarga de memoria/CPU/mutation en system.warnings fueran con un ciclo de métricas asíncronas de retraso (y que estuvieran ausentes en el primer ciclo). #108035 (Alexey Milovidov).
  • La función de tabla mongodb ahora acepta oid_columns pasado como argumento con nombre (por ejemplo, oid_columns='_id'), en lugar de rechazarlo con BAD_ARGUMENTS. #108039 (Alexey Milovidov).
  • Se corrige una excepción Bad cast from type DB::ColumnNullable to DB::ColumnVector<...> (error lógico) cuando un asterisco calificado (t.*) selecciona una clave JOIN USING y ese join está anidado debajo de un join PASTE/CROSS/por coma o de un join ON externo, con join_use_nulls = 0. #108043 (Groene AI).
  • Se corrigió el manejo incorrecto de las aserciones de anchura cero (\b, ^, $) en las funciones regexp de “match all” extractAll, extractAllGroupsVertical, extractAllGroupsHorizontal, countMatches y splitByRegexp. Por ejemplo, extractAll('new york is the greatest', '\b(\w)') ahora devuelve correctamente la primera letra de cada palabra en lugar de cada letra. #108047 (Alexey Milovidov).
  • Se corrigió CREATE TABLE ... AS SELECT en bases de datos Atomic, que dejaba una tabla vacía cuando fallaba la consulta; por ejemplo, cuando el usuario no tiene acceso a una tabla referenciada desde una subconsulta. Antes, al reintentar se informaba de que la tabla ya existía en lugar de mostrar el error original. Ahora la tabla se crea mediante una tabla temporal y solo pasa a ser visible una vez que se ha poblado por completo. #108048 (Alexey Milovidov).
  • Ahora se permite consultar un diccionario range_hashed o complex_key_range_hashed que use un rango DateTime64, Decimal o de coma flotante con un argumento correspondiente para dictGet/dictHas. Antes, esas consultas fallaban con must be convertible to Int64, y los intervalos abiertos de rangos Decimal/DateTime64 devolvían incorrectamente el valor predeterminado. #108052 (Alexey Milovidov).
  • Se corrigió una excepción (CANNOT_PARSE_TEXT) al cargar un diccionario con una clave compuesta cuyas columnas clave no eran las primeras de la definición del diccionario, con una fuente local de ClickHouse que usaba una consulta explícita. Ahora las columnas de origen se hacen coincidir con la estructura del diccionario por nombre en lugar de por posición. #108053 (Alexey Milovidov).
  • Se corrigió un fallo de la función de tabla values con ARGUMENT_OUT_OF_BOUND cuando se usa un literal decimal que no puede representarse exactamente en una columna estrecha de coma flotante (como 0.1 para una columna Float32); por ejemplo, SELECT * FROM values('x Float32', 0.1). Ahora esos valores se aceptan y se convierten al valor representable más cercano, de forma coherente con CAST e INSERT ... VALUES. #108055 (Alexey Milovidov).
  • Se corrigió un LOGICAL_ERROR (No available columns) al ejecutar SELECT count() (u otras consultas triviales) sobre una tabla en la que al usuario solo se le había concedido acceso SELECT a una columna ALIAS. #108056 (Alexey Milovidov).
  • Se corrigió que mapFilter, mapSort (y sus variantes) y mapConcat eliminaran LowCardinality de los tipos de clave y valor de un Map. Antes, mapFilter sobre una columna Map(LowCardinality(String), String) devolvía Map(String, String), lo que podía corromper los metadatos de una tabla creada mediante CREATE TABLE ... AS SELECT y hacer que CHECK TABLE fallara. #108057 (Alexey Milovidov).
  • Se corrigieron resultados incorrectos al usar hasToken en índices de texto con un tokenizador distinto de splitByNonAlpha. #108066 (Robert Schulze).
  • Se corrigió un bloqueo de SYSTEM RELOAD DICTIONARIES (y RELOAD DICTIONARY) cuando muchos diccionarios MySQL definidos en XML compartían un único grupo de conexiones mediante share_connection. Ahora esos grupos respetan los valores de connection_pool_size y connection_wait_timeout (5 segundos de forma predeterminada) de la configuración, igual que los diccionarios definidos mediante colecciones con nombre. #108083 (Alexey Milovidov).
  • Ahora se permite EXISTS <dictionary> para un usuario que solo tiene el privilegio SHOW DICTIONARIES sobre el diccionario (antes requería SHOW TABLES). #108084 (Alexey Milovidov).
  • Se corrigió que CREATE TABLE dst AS src SETTINGS ... (y variantes similares con ORDER BY/PARTITION BY, pero sin un ENGINE explícito) descartara silenciosamente el engine de la tabla de origen, las cláusulas de almacenamiento (como el TTL de la tabla y las claves) y la configuración. Ahora, el engine y las cláusulas de almacenamiento no sobrescritas se heredan de la tabla de origen, y la configuración especificada se aplica sobre la configuración de la tabla de origen. #108085 (Alexey Milovidov).
  • Se corrigió que INSERT en tablas MergeTree fallara con filesystem error: in rename: Permission denied en sistemas de archivos basados en Windows (WSL, CIFS/SMB, montajes bind de Docker Desktop), debido a que el escritor de partes dejaba descriptores de archivo abiertos durante el cambio de nombre del directorio de la parte. #108089 (Alexey Milovidov).
  • Se corrigió un fallo (desreferenciación de puntero nulo) al consultar una tabla Hive sin una cláusula WHERE, por ejemplo, SELECT * FROM hive_table. #108094 (Alexey Milovidov).
  • Se corrigió un LOGICAL_ERROR (“Unexpected return type from if”) al leer una columna con apply_mutations_on_fly = 1 después de un ALTER UPDATE col = ... WHERE <cond> con una condición no constante o falsa, seguido de ALTER MODIFY COLUMN col <new type>. #108128 (Groene AI).
  • Se corrigió que toStartOfInterval y dateTrunc devolvieran un valor redondeado en lugar del inicio del intervalo correspondiente cuando la entrada tiene una precisión más fina que la unidad del intervalo; por ejemplo, toStartOfInterval(toDateTime64('2023-10-09 10:11:12.000999', 6), INTERVAL 1 millisecond) devolvía 10:11:12.001 en lugar de 10:11:12.000. La sobrecarga con un origen explícito también se veía afectada. Cierra #103535. #108186 (Yarik Briukhovetskyi).
  • Se oculta la información sensible en la columna view_query de system.query_views_log. #108214 (Valerii Mordovskii).
  • Se corrigió un bloqueo en una tabla MergeTree adjunta con un skip index heredado hypothesis (un tipo de índice eliminado que se conserva solo por compatibilidad con ATTACH). Antes, una eliminación ligera DELETE, OPTIMIZE, un INSERT simple o un SELECT filtrado sobre una tabla de este tipo fallaban con ILLEGAL_INDEX (“Index of type ‘hypothesis’ is no longer supported”), y la mutación DELETE se reintentaba indefinidamente. Ahora, el índice obsoleto se trata como inerte: se conserva intacto durante merge/mutation, se omite en insert y en la planificación de consultas, y aún puede eliminarse con ALTER TABLE ... DROP INDEX. #108217 (Groene AI).
  • Se corrigió que la configuración type_json_allow_duplicated_key_with_literal_and_nested_object no funcionara con rutas tipadas en JSON. #108218 (Pavel Kruglov).
  • Se corrigió un LOGICAL_ERROR (Different list of shards in child plans) al ejecutar una consulta con make_distributed_plan = 1 sobre una tabla MergeTree que tiene una proyección normal/de agregación. #108256 (Groene AI).
  • Se corrigió replaceRegexpOne y replaceRegexpAll para que . coincida con caracteres de nueva línea de forma predeterminada, de manera coherente con otras funciones de expresiones regulares. #108265 (linjiayu1025-collab).
  • Corrige un error lógico al convertir un Array(Dynamic) o Array(Variant) a QBit con accurateCastOrNull, p. ej. accurateCastOrNull(CAST(range(114), 'Array(Dynamic)'), 'QBit(Float32, 114)'). #108288 (Groene AI).
  • index_granularity_bytes ahora se respeta para las columnas de estado de AggregateFunction. Anteriormente, el límite de bytes del gránulo se ignoraba para esas columnas (por ejemplo, estados uniqExact en tablas AggregatingMergeTree y proyecciones de agregación), lo que producía gránulos mucho más grandes que el límite configurado y aumentaba la amplificación de lectura y la memoria en tiempo de consulta. #108297 (Groene AI).
  • Corrige que las condiciones de UPDATE/DELETE ligeros se evaluaran dos veces, lo que podía provocar un comportamiento incorrecto en condiciones no deterministas y trabajo adicional en las deterministas. Cierra #86032. #108323 (ofeliacode).
  • Corrige una excepción en un controlador HTTP predefinido cuando falta en la solicitud un header cuya expresión regular headers_regexp permite un valor vacío. #108324 (Vitaly Baranov).
  • Corrige arrayPartialSort con un argumento de límite no constante. #108327 (Vitaly Baranov).
  • Se corrigió que un INSERT cancelado o terminado con KILL siguiera ejecutándose durante mucho tiempo mientras construía un skip index (por ejemplo, un índice set(0) sin límite en una columna de alta cardinalidad). La construcción del índice ahora se detiene rápidamente cuando se cancela la consulta. #108351 (Shaohua Wang).
  • Se corrigió que un SELECT desde la función de tabla primes no respondiera a la cancelación: con un step (o limit) grande, la consulta podía seguir ejecutándose durante mucho tiempo después de KILL QUERY o de un tiempo de espera. Ahora se detiene rápidamente. #108353 (Shaohua Wang).
  • Se corrigió el análisis de nombres de tipos de datos cuyo nombre contiene la subcadena INT (por ejemplo, un nombre similar a una función como quantileInterpolatedWeighted usado en una posición de tipo de dato). Esos nombres se confundían con tipos enteros de MySQL y su primer grupo de argumentos (...) se consumía silenciosamente como modificador de ancho de visualización, lo que podía romper el round-trip del formato de la consulta. #108354 (Groene AI).
  • Se corrigió una inconsistencia por la que un ARRAY JOIN mal formado seguido de una coma y una lista de tablas entre paréntesis se interpretaba incorrectamente como un cross join en lugar de ser rechazado. #108365 (Raúl Marín).
  • Oculta los argumentos secretos de funciones como encrypt, decrypt y HMAC en la salida de EXPLAIN actions, EXPLAIN header y EXPLAIN PIPELINE cuando format_display_secrets_in_show_and_select está deshabilitado (valor predeterminado). #108386 (Raúl Marín).
  • Corrige CREATE OR REPLACE de una vista materializada actualizable con un destino TO: se rechazaba incorrectamente porque la tabla de destino ya pertenece a la vista que se está reemplazando. #108392 (Nikolay Degterinsky).
  • Se corrigió un fallo del servidor (Received signal 4, illegal instruction) que podía desencadenarse por un flujo malformado o desincronizado del protocolo TCP nativo. Ahora se valida que la dirección inicial proporcionada por el cliente sea un host:port numérico antes de analizarla, en lugar de permitir que un puerto no numérico llegue a la función de libc getservbyname, que provocaba la trampa. #108410 (Groene AI).
  • Se corrigió un fallo del servidor durante el apagado cuando al cerrar una base de datos se produce una excepción (por ejemplo, cuando el flush de una tabla agota el tiempo de espera de ZooKeeper). El resto de la secuencia de apagado ya no se omite, por lo que los registros del sistema se vacían y se espera a que finalicen sus hilos antes de que el servidor se cierre. #108417 (Groene AI).
  • Se corrigió que las funciones de expresiones regulares (match, extract, extractAll, replaceRegexpOne, replaceRegexpAll, etc.) devolvieran silenciosamente resultados incorrectos cuando el patrón contenía un byte NUL (\0). Ahora el NUL se trata como un byte literal normal, en consonancia con RE2. #108427 (Alexey Milovidov).
  • Se corrigió que clickhouse-local devolviera una respuesta vacía a las solicitudes HTTP OPTIONS cuando no hay ningún http_options_response configurado, lo que hacía que la interfaz web (/play) mostrara la conexión como interrumpida aunque las consultas funcionaran. #108428 (Alexey Milovidov).
  • Se corrigió una excepción LOGICAL_ERROR (“Invalid action query tree node …”) cuando una consulta distribuida desduplicaba columnas ALIAS duplicadas y estructuralmente idénticas, y además hacía referencia a una table function con un argumento de colección con nombre key = value (por ejemplo, oss(s3_conn, filename = '...')). #108435 (Groene AI).
  • Se corrigió un fallo del servidor (LOGICAL_ERROR: 'Unexpected exception in refresh scheduling') que podía ocurrir durante el arranque cuando se adjuntaba una vista materializada actualizable coordinada en una base de datos Replicated a un Keeper que no admite la marca de funcionalidad MULTI_READ (por ejemplo, tras una degradación de Keeper). Ahora la vista se detiene correctamente en lugar de abortar el servidor. #108441 (Groene AI).
  • Se corrigió el error NOT_FOUND_COLUMN_IN_BLOCK (p. ej., Column _part not found) al seleccionar columnas virtuales de una tabla MergeTree con réplicas paralelas, incluso mediante SELECT * con asterisk_include_virtual_columns = 1. #108451 (Groene AI).
  • SYSTEM RESET DDL WORKER ahora requiere el nuevo privilegio SYSTEM RESET DDL WORKER. Antes, cualquier usuario autenticado (incluidos los readonly) podía ejecutarlo y restablecer repetidamente el estado del worker de DDL, bloqueando el DDL ON CLUSTER. #108460 (Groene AI).
  • Se restringió la ruta del modelo de catboostEvaluate al directorio user_files, igual que la table function file y las fuentes de diccionario. Antes, la función aceptaba una ruta arbitraria del sistema de archivos sin ninguna comprobación de contención, lo que permitía comprobar la existencia de archivos fuera de user_files y activar lecturas de ellos. Ahora los modelos deben estar ubicados dentro de user_files. #108463 (Groene AI).
  • La función hasColumnInTable ahora requiere el privilegio SHOW COLUMNS sobre la tabla de destino, el mismo permiso que exigen DESCRIBE y SHOW CREATE TABLE. Antes, cualquier usuario podía llamar a hasColumnInTable para comprobar nombres de columnas y verificar la existencia de tablas y bases de datos sin ninguna comprobación de acceso. #108464 (Groene AI).
  • Se corrigió la asignación excesiva de memoria al deserializar estados manipulados de funciones de agregación para mannWhitneyUTest, rankCorr, largestTriangleThreeBuckets, quantileGK, sequenceMatch/sequenceCount y groupArrayIntersect. Un estado malformado podía declarar un número enorme de elementos y hacer que el servidor intentara reservar decenas de gigabytes a partir de unos pocos bytes de entrada; ahora esos estados se rechazan con TOO_LARGE_ARRAY_SIZE. #108465 (Groene AI).
  • Se valida el destino de redirección de una respuesta 301 Moved Permanently de S3 frente a remote_url_allow_hosts (RemoteHostFilter). Anteriormente, el manejo de 301 del SDK de AWS seguía el endpoint proporcionado por el atacante en la respuesta (cabecera Location o elemento <Endpoint>) sin comprobar el host, por lo que un servidor S3-compatible malicioso o comprometido podía redirigir ClickHouse a un host arbitrario (SSRF). La ruta de redirección 307 ya realizaba esta comprobación; ahora ambas rutas son coherentes. #108466 (Groene AI).
  • Se corrigió una filtración de credenciales por la que los ajustes heredados storage_aws_access_key_id, storage_aws_secret_access_key, storage_catalog_credential y storage_auth_header del motor de base de datos DataLakeCatalog se mostraban en texto plano en system.databases.engine_full y SHOW CREATE DATABASE. Ahora se ocultan como [HIDDEN]. #108470 (Groene AI).
  • Se corrigió la identificación de usuarios mediante ssl_certificate para que un comodín * coincida exactamente con un solo componente del nombre (RFC 6125 6.4.3). Anteriormente, un comodín en un sujeto SAN CN o DNS: (por ejemplo, *.corp.example.com) también coincidía con nombres de varias etiquetas como evil.deep.corp.example.com, lo que permitía que el titular de un certificado para un subdominio más profundo se autenticara como el usuario comodín. La coincidencia de SAN URI: no cambia. #108472 (Groene AI).
  • Se corrigió una inyección SQL en el protocolo MySQL wire protocol: el argumento de SHOW TABLE STATUS LIKE y el valor de SET <mysql_setting> enviado a través de la MySQL interface (puerto 9004) ahora se analizan y se vuelven a entrecomillar en lugar de concatenarse literalmente en la consulta reescrita. También se corrigió que KILL QUERY <id> a través de la MySQL interface ignorara silenciosamente los ID de conexión de varios dígitos. #108474 (Groene AI).
  • Los valores sensibles pasados como parámetros de cadena de consulta HTTP (por ejemplo, el enlace de parámetros de consulta param_*, como param_secret_key/param_aws_secret_access_key, el parámetro password o parámetros signature al estilo de S3) ya no se escriben literalmente en system.text_log ni en spans de OpenTelemetry. La línea de Log Request URI ahora oculta los valores de los parámetros cuyos nombres parecen sensibles, sustituyéndolos por [HIDDEN]. #108475 (Groene AI).
  • Se aplica la configuración http_forbid_headers durante la inferencia de esquema para la table function url y el motor de almacenamiento URL. Anteriormente, una cabecera prohibida seguía enviándose por la red durante la inferencia del esquema (por ejemplo, con el formato Regexp o DESCRIBE), y su response body podía reflejarse en un error de análisis, filtrando secretos. Ahora el filtro de cabeceras se comprueba antes de cualquier acceso a la red en la ruta de inferencia, en consonancia con el comportamiento existente de urlCluster. #108476 (Groene AI).
  • Se corrigieron resultados incorrectos al usar SELECT ... SAMPLE ... junto con la query condition cache (ajuste use_query_condition_cache, habilitado de forma predeterminada). #108488 (Groene AI).
  • Se corrigió un fallo del servidor (stack overflow) provocado por expresiones profundamente anidadas como [[[ ... ]]] o array(array( ... )) cuando max_parser_depth se establece en un valor alto. #108493 (Raúl Marín).
  • Se corrigió un problema por el que el engine de tabla RabbitMQ podía quedar bloqueado indefinidamente en DROP TABLE o durante el apagado del servidor cuando el broker cerraba la conexión AMQP debido a heartbeats perdidos sin enviar un TCP RST. Todas las llamadas bloqueantes del bucle de eventos ahora tienen un tiempo de espera de 30 segundos, por lo que el apagado siempre se completa. #108497 (Aly Ayman).
  • Las consultas secundarias ejecutadas como parte de consultas internas ahora se registrarán como consultas internas. #108506 (Miсhael Stetsyuk).
  • El engine de tabla ArrowFlight y la función de tabla arrowFlight ahora respetan la lista de permitidos de <remote_url_allow_hosts>. Antes, no se validaban el host ni el puerto de la conexión, por lo que una consulta podía llegar a hosts no incluidos en la lista de permitidos. #108507 (Groene AI).
  • Los comandos del protocolo MySQL COM_FIELD_LIST (mysql_list_fields) y COM_INIT_DB (USE database) ahora aplican el mismo control de acceso que sus equivalentes en SQL (SHOW COLUMNS/DESCRIBE y USE). Antes, podían revelar nombres de columna de tablas sobre las que el usuario solo tenía permisos parciales a nivel de columna, y cambiar la base de datos actual sin el privilegio SHOW DATABASES. #108508 (Groene AI).
  • http_forbid_headers ahora distingue mayúsculas y minúsculas de forma insensible. Los nombres de los encabezados HTTP no distinguen entre mayúsculas y minúsculas, por lo que prohibir Authorization ahora también bloquea authorization, AUTHORIZATION y otras variantes. Los patrones header_regexp configurados ahora también se comparan sin distinguir entre mayúsculas y minúsculas, sin necesidad de indicar explícitamente la marca (?i). #108509 (Groene AI).
  • Se corrigió un fallo del servidor (segmentation fault) que podía producirse cuando una consulta distribuida hacía referencia a un CTE MATERIALIZED aún no materializado como tabla externa y el origen remoto se creaba de forma diferida. #108547 (Groene AI).
  • Se corrigieron resultados incorrectos cuando la caché de condiciones de consulta (use_query_condition_cache = 1) reutilizaba una exclusión de marcas derivada de un skip index para una consulta que ejecutaba un conjunto distinto de skip indexes, por ejemplo con use_skip_indexes = 0, ignore_data_skipping_indices o un modo diferente de use_skip_indexes_for_disjunctions. Las entradas de caché derivadas de skip indexes ahora se indexan según el conjunto efectivo de skip indexes que se ejecutó. #108548 (Groene AI).
  • Se corrigieron varios errores en changeYear, changeMonth, changeDay, changeHour, changeMinute y changeSecond con argumentos DateTime64: la columna de resultado se creaba con la escala predeterminada 3 codificada de forma fija en lugar de la escala del argumento, lo que provocaba un LOGICAL_ERROR (writeSlice expects same column types) cuando el resultado se pasaba a arrayPushBack/arrayPushFront/arrayConcat; las entradas con precisión de nanosegundos (escala 9) generaban DECIMAL_OVERFLOW; y las entradas con fracciones de segundo anteriores al epoch devolvían un segundo de calendario incorrecto. También se corrigió que timeSlots sobre DateTime64 ignorara la escala del argumento opcional Size en su tipo de retorno declarado y devolviera timestamps incorrectos para la escala más alta en Size. #108551 (Groene AI). #108681 (Takumi Hara). #108994 (Groene AI).
  • Corrige el error NOT_FOUND_COLUMN_IN_BLOCK cuando se asigna un alias a un predicado compuesto en GROUP BY y luego se vuelve a hacer referencia a él, con enable_identifier_resolve_cache habilitado (valor predeterminado). #108553 (Groene AI).
  • Corrige un error lógico (Equal values are not contiguous within the range assumed to be sorted) al ejecutar DISTINCT sobre una lectura STREAM (SELECT DISTINCT ... FROM table STREAM). Las optimizaciones de lectura en orden ya no se aplican a las lecturas STREAM, que producen filas en orden de commit en lugar de en el orden de la clave de ordenación. #108568 (Groene AI).
  • Se corrigieron las proyecciones que devolvían el valor predeterminado del tipo de una columna (por ejemplo, 0) en lugar de su valor DEFAULT declarado (por ejemplo, -1) en dos casos: al leer una columna añadida con ALTER TABLE ... ADD COLUMN ... DEFAULT después de crear la proyección (las lecturas desde la tabla base ya eran correctas), y después de que expirara el TTL de la columna en una wide part. #108569 (Shaohua Wang). #109013 (Shaohua Wang).
  • Se corrigió un error ReadBuffer is canceled. Can't read from it. que podía producirse al reintentar una carga a S3 (por ejemplo, una copia de seguridad) después de un error transitorio de lectura. #108573 (Groene AI).
  • Corrige que ATTACH PARTITION ... FROM rechazara tablas cuyas claves primarias son equivalentes pero están declaradas de forma distinta (una con PRIMARY KEY explícita y la otra implícita a partir de ORDER BY). #108590 (Jordi Orihuela).
  • Se corrigió el fallo de direct read desde el text index cuando varios text indexes están materializados parcialmente. Corrige #108530. #108607 (Anton Popov).
  • Corrige una divulgación de metadata por la que DESCRIBE loop('db', 'table') y DESCRIBE loop(<inner table function>) omitían la comprobación de acceso a SHOW COLUMNS o al origen, lo que permitía a un usuario sin privilegios leer el esquema de columnas de una tabla. #108624 (Groene AI).
  • Se corrigió la columna virtual _etag para los table engines S3Queue y AzureQueue: estaba declarada, pero nunca se poblaba, por lo que SELECT _etag siempre devolvía una cadena vacía. Ahora devuelve el ETag del objeto, igual que el engine S3 y la table function s3. #108625 (Groene AI).
  • Se corrigió la lectura de archivos Arrow, ArrowStream y ORC basados en Arrow cuya columna timestamp tiene un desplazamiento UTC numérico fijo (por ejemplo, +05:30, -08:00, 00:00) o el marcador no IANA fixed como timezone, lo que antes fallaba con Cannot load time zone ... (BAD_ARGUMENTS). #108633 (Groene AI).
  • Se corrigió una excepción (LOGICAL_ERROR: Join is supported only for pipelines with one output port o NOT_IMPLEMENTED: MergeJoinAlgorithm is not implemented for strictness Semi) cuando se usaba join_algorithm = 'full_sorting_merge' para un join SEMI/ANTI, incluidos los joins generados al descorrelacionar una subquery correlacionada EXISTS. full_sorting_merge ahora descarta las combinaciones de strictness/tipo que no puede ejecutar, de modo que el planificador recurre a otro algoritmo habilitado o informa de que el join no puede ejecutarse. #108658 (Groene AI).
  • Se corrigió un desbordamiento de búfer en el montón al construir un text index con positions = 1 sobre muchos tokens cortos distintos. #108659 (Groene AI).
  • Una consulta que lee de S3 o escribe en S3 y se cancela (p. ej., con KILL QUERY) mientras hay una s3 request en curso ahora se informa como cancelada, en lugar de mostrar un error de red/S3 engañoso. En particular, un backup o restore cancelado en S3 ahora informa BACKUP_CANCELLED/RESTORE_CANCELLED en system.backups. #108673 (Julia Kartseva).
  • Se corrigió un fallo de inicio en el que una database DataLakeCatalog creada por una versión anterior (25.12 o anterior) con un auth_header malformado no podía adjuntarse después de actualizar a la versión 26.2 o posterior, lo que impedía que el server arrancara. Ahora, auth_header se valida solo en CREATE, y en ATTACH el catalog se construye de forma diferida en el primer uso en lugar de durante el arranque, de modo que una sola database de catálogo mal configurada o inaccesible ya no bloquea el inicio del server. #108674 (Groene AI).
  • Se corrigió un logical error (Sort order of blocks violated) durante una fusión, así como lecturas incorrectas, cuando un elemento LowCardinality no anulable de una columna Nullable(Tuple(...)) se usa como subcolumn (por ejemplo, como clave de ordenación). #108679 (Groene AI).
  • Se corrige un posible crash (use-after-free) cuando SYSTEM FLUSH DISTRIBUTED se ejecuta de forma concurrente con DROP TABLE de la misma tabla Distributed. #108684 (Groene AI).
  • Se corrige un crash en la decodificación Base64 de la key de la cuenta de Azure, alcanzable mediante azureBlobStorage (y las table functions y storages relacionadas de Azure) cuando la key no es un Base64 válido: un byte >= 0x80 provocaba una lectura fuera de límites, y cualquier byte no válido provocaba comportamiento undefined. Las keys no válidas ahora se rechazan correctamente. #108716 (Groene AI).
  • Se corrige el error NUMBER_OF_COLUMNS_DOESNT_MATCH cuando una subquery sobre una tabla Distributed lee dos o más columnas ALIAS que se expanden a la misma expression (por ejemplo, a1 String ALIAS toString(x), a2 String ALIAS toString(x)) y la subquery alimenta una consulta externa, p. ej. SELECT count() FROM (SELECT a1, a2 FROM dist GROUP BY a1, a2). #108725 (Groene AI).
  • Se corrigió que CREATE OR REPLACE MATERIALIZED VIEW ... POPULATE dejara la nueva vista materializada sin suscribirse a su source table, lo que descartaba silenciosamente cada fila insertada después del reemplazo. #108728 (Alexey Milovidov).
  • Se corrige una excepción (Cannot find sharding key column, y en builds de depuración y con sanitizador un aborto del server) cuando la sharding key de una tabla Distributed es una expression que el analyzer pliega como constante, por ejemplo if(1, toInt32(id), toInt32(id) + 1), con optimize_skip_unused_shards = 1. #108737 (Groene AI).
  • Se corrigió un logical error (Bad cast from type DB::ColumnNullable to DB::ColumnString) y posibles resultados incorrectos al usar group_by_use_nulls con una grouping key constante LowCardinality en GROUPING SETS/ROLLUP/CUBE. #108771 (Alexey Milovidov).
  • Se corrigió que la poda de particiones y de la clave primaria se desactivara silenciosamente cuando una columna clave LowCardinality(FixedString) (o LowCardinality(Nullable(FixedString))) se envolvía en una función dentro de la clave, por ejemplo PARTITION BY sipHash64(k) % N con WHERE k = 'literal'. Estas consultas escaneaban todas las particiones en lugar de descartarlas mediante poda. #108777 (Groene AI).
  • Se corrigió un error lógico (una terminación del servidor en compilaciones de debug y con sanitizador) cuando un INSERT ... SELECT a través de una tabla Alias, o en una tabla TimeSeries, se cancela sin una excepción, por ejemplo con timeout_overflow_mode = 'break'. #108783 (Groene AI). #108796 (Shaohua Wang).
  • Se corrigió el error lógico Bad cast from type DB::ColumnSparse to DB::ColumnString (una terminación del servidor en compilaciones de debug y con sanitizador) cuando groupConcat se aplica a una Tuple cuyo elemento String se almacena de forma dispersa. #108790 (Groene AI).
  • Se corrigió TYPE_MISMATCH en mapFilter, mapSort, mapReverseSort, mapPartialSort y mapConcat cuando un valor Map contiene un Map anidado con LowCardinality, p. ej., mapFilter((k, v) -> 1, map('a'::LowCardinality(String), map('x'::LowCardinality(String), 'y'))). #108798 (Groene AI).
  • Se corrigió que insert_quorum = 'auto' no rechazara las inserciones de inmediato cuando había menos de la mayoría de las réplicas activas. Ahora esas inserciones fallan inmediatamente con TOO_FEW_LIVE_REPLICAS en lugar de escribir una parte local y más tarde agotar el tiempo de espera con UNKNOWN_STATUS_OF_INSERT. #108800 (Gagan Dhakrey).
  • Se corrigió un bug por el que la fila WITH TOTALS de un JOIN podía contener valores predeterminados (como 0) en lugar de los valores constantes procedentes de una subconsulta constante en uno de los lados del join. El resultado incorrecto aparecía solo con determinados órdenes de join o con la configuración query_plan_join_swap_table. #108807 (Vladimir Cherkasov).
  • Se corrigió un fallo de segmentación (desreferenciación de puntero nulo) que podía producirse cuando el apagado del servidor coincidía con el apagado de una tabla S3Queue/AzureQueue. #108810 (Miсhael Stetsyuk).
  • Se corrigió una interrupción durante el arranque (Cannot allocate ThreadStack, EINVAL) en compilaciones con glibc que se ejecutaban en CPU con un tamaño grande de pila de señales (por ejemplo, Intel Sapphire Rapids / Granite Rapids con un kernel compatible con AMX), donde el tamaño de la pila alternativa de señales no se redondeaba a un múltiplo del tamaño de página. #108813 (Groene AI).
  • Se corrigió que las consultas distribuidas fallaran ocasionalmente con UNEXPECTED_PACKET_FROM_SERVER (expected TablesStatusResponse, got ProfileInfo) cuando se reutilizaba del pool una conexión que una consulta cancelada anterior había dejado desincronizada. #108854 (Alexey Milovidov).
  • Se corrigió un error lógico (una excepción en builds de release y un aborto del server en builds de debug y con sanitizador) que podía producirse en una llamada a función con más de un argumento LowCardinality sobre una tabla distribuida; por ejemplo, concatAssumeInjective((SELECT toLowCardinality('p')), s) usada como clave de GROUP BY con la table function remote. Los mensajes eran Default functions implementation for LowCardinality is supported only with a single LowCardinality argument o Expected the argument ... to have N rows, but it has M. #108871 (Groene AI).
  • Se corrigió reinterpret(x, 'Decimal128(scale)') (y los destinos Decimal32/Decimal64/Decimal256/DateTime64), que producía una columna de resultado cuya scale interna era la scale de origen en lugar de la scale de destino solicitada cuando el origen y el destino tenían el mismo tipo físico. Los valores eran correctos, pero el objeto columna era estructuralmente inconsistente con su tipo declarado. #108878 (Groene AI).
  • Se corrigió un LOGICAL_ERROR (New empty part is about to materialize but the directory already exist) que podía abortar el server en builds de debug y con sanitizador cuando una operación DROP/DETACH/MOVE/REPLACE PARTITION sobre una tabla MergeTree se ejecutaba después de que una operación previa de ese tipo se interrumpiera (por ejemplo, por una transaction revertida o un fallo) y dejara un directory tmp_empty_<part> obsoleto. Ahora ese directory obsoleto se recupera en lugar de provocar un fallo. #108879 (Groene AI).
  • Se corrigió que ClickHouse Keeper devolviera un dataLength = 0 incorrecto en el Stat de las respuestas Create2, y que el cliente ZooKeeper de ClickHouse no deserializara el Stat de las respuestas Create2. #108909 (unintended).
  • Se corrigió que clickhouse-local rechazara un valor de opción vacío escrito junto a = (por ejemplo, --format_csv_null_representation=''); ahora se comporta igual que --format_csv_null_representation "" y SET format_csv_null_representation = ''. #108910 (Vismay).
  • Se corrigió un LOGICAL_ERROR (Inconsistent AST formatting) que abortaba el server en builds de debug y con sanitizador al dar formato a un tipo de dato Tuple que mezcla elementos con nombre y sin nombre (por ejemplo, Tuple(a UInt8, UInt16)). #108915 (Groene AI).
  • Se corrigió una falla de segmentación al fusionar estados de agregación de uniqExact con GROUPING SETS, ROLLUP o CUBE y max_threads > 1. #108928 (Raúl Marín).
  • Se corrigieron posibles resultados incorrectos o lecturas fuera de límites cuando se revierte un INSERT tras un error a mitad del lote (por ejemplo, en tablas Buffer, inserciones asíncronas o los engines Kafka/RabbitMQ/FileLog) mientras está habilitada la replicación diferida de columnas (enable_lazy_columns_replication). #108935 (Groene AI).
  • Ahora join_any_take_last_row se respeta en todas las rutas compatibles de join basadas en hash, incluidas las joins que usan spilling to disk automático. #108936 (János Benjamin Antal).
  • Se corrigió un bug en el analyzer por el que FINAL en una tabla de un JOIN (p. ej., FROM t1 FINAL JOIN t2) también se aplicaba incorrectamente a las demás tablas unidas, lo que podía ralentizar esas consultas. #108979 (Vladimir Cherkasov).
  • Corrige un LOGICAL_ERROR (“Cannot find __grouping_set column in header of MergingAggregatedTransform with grouping sets”, o “Chunk info was not set for chunk in MergingAggregatedTransform”) que podía producirse, con el analizador deshabilitado, en un UNION ALL/INTERSECT/EXCEPT donde una rama usa GROUP BY GROUPING SETS con réplicas en paralelo y otra rama usa FINAL. #109003 (Groene AI).
  • Corrige un LOGICAL_ERROR en el planificador automático de réplicas en paralelo que podía producirse cuando automatic_parallel_replicas_mode está habilitado junto con parallel_replicas_min_number_of_rows_per_replica mayor que 0. #109011 (Groene AI).
  • Corrige una asignación excesiva de memoria durante la inferencia de esquemas del formato MsgPack: una entrada corrupta cuyo encabezado de array/map/string/binary declara un número enorme de elementos ya no provoca una única asignación de varios gigabytes y se rechaza como entrada malformada. Esto corrige una condición de falta de memoria en compilaciones de lanzamiento (y un aborto allocation-size-too-big con sanitizadores). #109019 (Groene AI).
  • Corrige que use_client_time_zone se ignorara para literales de cadena DateTime/DateTime64 interpretados en el servidor (INSERT asíncrono, literales SELECT). El client ahora propaga su zona horaria local como session_timezone cuando use_client_time_zone está habilitado, de modo que el análisis del lado del servidor coincida con la ruta de INSERT síncrona. #109051 (Groene AI).
  • Corrige el error NOT_FOUND_COLUMN_IN_BLOCK cuando query_plan_optimize_lazy_final está habilitado junto con un filtro WHERE transferido parcialmente a PREWHERE (mediante optimize_move_to_prewhere_if_final). #109073 (Groene AI).
  • Corrige un error al usar un asterisco calificado como b.* en una consulta donde b es un alias de tabla (o subconsulta/CTE) que comparte nombre con una columna no compuesta de otra tabla. Estas consultas ya no fallan y seleccionan correctamente todas las columnas de b. #109078 (Vladimir Cherkasov).
  • Corrige un error lógico Block structure mismatch in JoinStep (un aborto del servidor en compilaciones de depuración y con sanitizadores) cuando una subconsulta correlacionada se decorrelaciona en un join y la relación de origen lleva el mismo nombre de columna más de una vez, por ejemplo WITH t AS (SELECT number, * FROM numbers(3)) SELECT *, (SELECT t.number WHERE t.number >= 0) FROM t con correlated_subqueries_default_join_kind = 'right'. #109114 (Groene AI).
  • Corrige un bloqueo por el que una consulta que leía a través de la filesystem cache podía seguir esperando una descarga en curso después de cancelarse con KILL QUERY, y por el que eliminar o aplicar SYSTEM STOP VIEW a una vista materializada actualizable cuya actualización se hubiera quedado atascada en esa espera podía bloquearse. #109116 (Murphy).
  • Corrige que la configuración parallel_view_processing se ignorara al insertar en una tabla con vistas materializadas: desde la versión 25.10, las vistas siempre se ejecutaban en paralelo independientemente de esta configuración. #109170 (Antonio Andelic).
  • Corrige una inconsistencia del analizador por la que una lista de columnas de INSERT aceptaba un selector de columnas calificado escrito como t.* LIKE '<pattern>' / t.* ILIKE '<pattern>', pero rechazaba su forma canónica t.COLUMNS('<regexp>'), rompiendo el recorrido de ida y vuelta del formato de consulta (y provocando el aborto del servidor en compilaciones de depuración y con sanitizadores). #109176 (Groene AI).
  • Se corrigieron los incrementos no monotónicos de ProfileEvents: los contadores NetworkReceiveBytes y AIOWriteBytes podían incrementarse en una cantidad negativa (desbordándose hasta un valor enorme) en caso de timeout de socket o fallo de AIO, y MemoryOvercommitWaitTimeMicroseconds se medía con un reloj no monotónico. #109180 (Azat Khuzhin).
  • Se corrigió la inferencia de esquema para los formatos Arrow, ArrowStream, Avro y los lectores heredados de ORC y Parquet, que devolvían Nullable(Tuple) para columnas struct anulables cuando el tipo Nullable(Tuple) no está permitido (allow_experimental_nullable_tuple_type está deshabilitado). DESCRIBE devolvía un tipo que CREATE TABLE rechaza, por lo que al crear una tabla o insertar datos usando el esquema inferido se producía el error Nullable Tuple type is not allowed. #109185 (Nihal Z. Miaji).
  • Se corrigió un resultado incorrecto de EXISTS correlacionado y de subconsultas escalares cuando la correlación aparece solo en la proyección de la subconsulta junto con una cláusula WHERE no correlacionada (la subconsulta podía evaluarse como false / NULL para cada fila). Corrige #105760. #109186 (Dmitry Novik).
  • Se corrigió que CREATE USER ... HOST LIKE 'a', 'b' (y el ALTER USER equivalente) conservara silenciosamente solo el primer patrón. Ahora todos los patrones HOST LIKE especificados se almacenan en la lista de hosts permitidos del usuario. #109187 (Groene AI).
  • Se corrigió que un índice de texto definido sobre mapValues(map) o mapKeys(map) no se utilizara silenciosamente cuando se consultaba una tabla a través de una tabla con motor Distributed usando el analizador. El índice se usaba para la tabla local y mediante las table functions cluster/remote, pero una consulta a través de una tabla con motor Distributed lo omitía (y fallaba con INDEX_NOT_USED bajo force_data_skipping_indices). #109188 (Groene AI).
  • Se corrigió un LOGICAL_ERROR falso (There was an error on <host>: Cannot obtain error message (probably it's a bug)) que podía abortar el servidor en compilaciones de depuración y con sanitizador al ejecutar una consulta DDL sobre una base de datos Replicated cuando su nodo de estado finished por host en Keeper ya se había limpiado. #109192 (Groene AI).
  • Se corrigió que las proporciones de SAMPLE con un exponente cuya magnitud desborda Int32 (por ejemplo, SAMPLE 1e-3000000000) se trataran silenciosamente como SAMPLE 1. #109197 (Raúl Marín).
  • Se corrigió la comprobación de acceso para SYSTEM PREWARM PRIMARY INDEX CACHE ... ON CLUSTER, que incorrectamente requería el privilegio SYSTEM PREWARM MARK CACHE en lugar de SYSTEM PREWARM PRIMARY INDEX CACHE. #109198 (Raúl Marín).
  • Se corrigió que las consultas ALTER fallaran para tablas MergeTree creadas con una configuración personalizada de disk (SETTINGS disk = disk(...)). Corrige #63019. #109199 (Mikhail Artemenko).
  • Se corrigió un fallo del servidor al combinar estados de las funciones de agregación cramersV, cramersVBiasCorrected, contingency o theilsU procedentes de un contexto de ventana (OVER ()) y de una agregación simple mediante operaciones de conjuntos encadenadas (EXCEPT, INTERSECT) o UNION ALL anidados, y leerlos después, por ejemplo, mediante el combinador -Merge. #109200 (Groene AI).
  • Se corrigió un resultado incorrecto en ANY JOIN con una condición ON constante (p. ej., t1 ANY INNER JOIN t2 ON 1): la consulta devolvía el producto cartesiano completo en lugar del resultado de ANY JOIN. #109207 (Vladimir Cherkasov).
  • Se corrigió un fallo del servidor en inserciones asíncronas con deduplicación cuando optimize_on_insert deja vacío el bloque insertado (por ejemplo, filas cuya suma es cero en SummingMergeTree). #109229 (Den Kalantaevskii).
  • Se corrigió SYSTEM DROP REPLICA y SYSTEM DROP DATABASE REPLICA ... FROM ZKPATH para que rechacen rutas de ZooKeeper vacías o que solo contengan la raíz en tiempo de análisis con BAD_ARGUMENTS, enruten las rutas auxiliares de Keeper al Keeper especificado y normalicen las rutas de Keeper para que las comprobaciones locales de autoprotección no apunten a la réplica equivocada ni eludan la réplica prevista. #109230 (Groene AI).
  • Se corrigió la prioridad de la configuración de S3 para que un bloque de endpoint <s3> con ámbito de URL tenga prioridad sobre los valores predeterminados de <s3> de nivel superior. #109251 (Bharat Nallan).
  • Se corrigió un error por el que los valores DEFAULT de una columna no se aplicaban en INSERT INTO TABLE FUNCTION (por ejemplo, remote o file) con datos VALUES inline cuando el servidor analiza por sí mismo esos datos inline (send_table_structure_on_insert_with_inline_data = 0). Un NULL explícito insertado en una columna no Nullable con DEFAULT pasaba a ser 0 en lugar del valor predeterminado declarado. Ahora se comporta igual que un INSERT en una tabla normal y que el protocolo HTTP. #109258 (Groene AI).
  • Se corrigió el fallo de CREATE TABLE ... AS SELECT desde s3Cluster (y otras cluster table functions como fileCluster/urlCluster) con error NOT_FOUND_COLUMN_IN_BLOCK dentro de una base de datos Replicated. #109266 (Groene AI).
  • Se corrigió que SHOW TABLES y SELECT ... FROM system.tables devolvieran resultados distintos en bases de datos de Data Lake Catalog: las tablas que ClickHouse no puede leer ahora se ocultan de forma coherente en ambos casos. #109273 (Smita Kulkarni).
  • Se corrigió un error por el que, al fusionar una tabla MergeTree con proyecciones mientras está habilitada la configuración enable_block_number_column o enable_block_offset_column, se generaban projection parts que contenían una columna _block_number/_block_offset espuria. La projection part fusionada dejaba entonces de coincidir con la definición de la proyección y con las projection parts generadas por insert, por lo que CHECK TABLE y OPTIMIZE ... DRY RUN la marcaban como corrupta (CORRUPTED_DATA). #109284 (Groene AI).
  • Ahora se permite leer un array de Avro de registros {key, value} de dos campos en una columna Map de ClickHouse. Esta es la codificación que Iceberg y Spark generan para un MAP<K, V> con una clave que no es de tipo string (los maps nativos de Avro solo admiten claves string). Antes, ese archivo podía leerse como Array(Tuple(key, value)), pero no como Map(K, V), y fallaba con Type Map(...) is not compatible with Avro array. #109289 (Groene AI).
  • Se corrigió un fallo del servidor en CREATE HYPOTHETICAL INDEX ... TYPE set (y ngrambf_v1/tokenbf_v1) cuando se omite el argumento de índice requerido. Estas sentencias ahora se rechazan con un error claro. #109294 (Groene AI).
  • Se corrigió un LOGICAL_ERROR (Current component is empty) que podían provocar operaciones de mutation como KILL MUTATION en una tabla MergeTree que almacena sus metadatos en Keeper, cuando la configuración del servidor enforce_keeper_component_tracking está habilitada. #109297 (Groene AI).
  • Se corrigió la lectura de timestamps ORC posteriores aproximadamente al año 2262 en una columna DateTime64 con una scale inferior a 9. El lector nativo de ORC solía convertir cada timestamp mediante un valor intermedio fijo DateTime64(9), lo que provoca un overflow de Int64 a escala de nanosegundos y rechazaba esos valores con VALUE_IS_OUT_OF_RANGE_OF_DATA_TYPE, incluso cuando la scale DateTime64 solicitada (por ejemplo, DateTime64(6), como produce Iceberg) puede representar el valor. Ahora los timestamps se leen directamente con la scale solicitada, y date_time_overflow_behavior se respeta incluso cuando ni siquiera la scale de destino puede contener el valor. #109302 (Groene AI).
  • clickhouse-local, al actuar como servidor (después de SYSTEM START LISTEN HTTP), ahora sirve conexiones HTTP usando el formato de salida predeterminado TabSeparated, igual que clickhouse-server, en lugar del predeterminado interactivo PrettyCompact. Esto corrige la conexión a clickhouse-local mediante HTTP con drivers como clickhouse-connect. La sesión interactiva de terminal sigue mostrando los resultados como PrettyCompact. #109362 (Alexey Milovidov).
  • Se corrigió un fallo transitorio Code: 499 ... InvalidPart (S3_ERROR) en cargas multiparte de S3. MinIO puede informar brevemente de que una part recién subida no está presente en CompleteMultipartUpload; ahora este error se reintenta igual que el NoSuchKey ya manejado, dentro del límite de s3_max_unexpected_write_error_retries. #109364 (Groene AI).
  • Se corrigió el error UNKNOWN_IDENTIFIER en ALTER TABLE ... DROP COLUMN cuando otra columna tiene una expresión DEFAULT o MATERIALIZED que define y hace referencia a un alias en línea. #109374 (Alexey Milovidov).
  • Se corrigió una carrera de dato (y el consiguiente fallo poco frecuente) en la merge paralela de estados de agregación uniqExact con sets de dos niveles, que podía ocurrir con GROUPING SETS, ROLLUP y CUBE. #109389 (Groene AI).
  • Se corrigió un error (NOT_FOUND_COLUMN_IN_BLOCK, o std::bad_function_call en versiones anteriores) al ejecutar CREATE TABLE ... ON CLUSTER ... AS SELECT leyendo una tabla Distributed en un cluster con dos o más shards. #109407 (Alexey Milovidov).
  • Se corrigieron las merges para tablas con TTL ... GROUP BY (rollup): las parts que ya estaban completamente agregadas podían volver a programarse para fusionarse una y otra vez indefinidamente, y las tablas con columnas MATERIALIZED o con columnas virtuales persistentes habilitadas se manejaban incorrectamente; ahora esas columnas se agregan con any. Cierra #105647. #109410 (Mikhail Artemenko). #109532 (Mikhail Artemenko).
  • Se corrigió el caso de IN con una array column simple en el argumento derecho, que devolvía silenciosamente un resultado incorrecto (siempre falso) o lanzaba una excepción, de modo que x IN arr ahora se comporta como has(arr, x). #109416 (Alexey Milovidov).
  • Se corrigieron errores UNKNOWN_IDENTIFIER en operaciones ALTER TABLE (RENAME/ADD/MODIFY COLUMN y MATERIALIZE INDEX en una tabla con partes recién insertadas) en tablas MergeTree con un índice min-max implícito sobre las columnas virtuales persistentes _block_number/_block_offset (habilitado por add_minmax_index_for_block_number_column/add_minmax_index_for_block_offset_column). #109428 (Groene AI). #110236 (Groene AI).
  • Se corrigió un LOGICAL_ERROR en arrayFold sobre un argumento Array(LowCardinality(T)) no constante (por ejemplo, arrayFold((acc, x) -> acc + x, materialize([1, 2, 3]::Array(LowCardinality(Int64))), toInt64(0))), que fallaba con Arguments of 'plus' have incorrect data types (provocando un aborto del server en compilaciones de depuración y con sanitizadores). #109462 (Groene AI).
  • Se corrigió CHECK TABLE en una tabla ReplicatedMergeTree, que informaba una parte en buen estado como dañada cuando se producía un error transitorio y reintentable de ZooKeeper (por ejemplo, pérdida de conexión) durante la comprobación; ahora esos errores aparecen como un error de consulta reintentable. #109465 (Alexey Milovidov).
  • Se corrigieron fallos de segmentación en groupArrayLastMerge y en la función de agregación largestTriangleThreeBuckets: ahora se valida la deserialización de estados de funciones de agregación, para que un estado dañado no provoque un acceso a memoria fuera de los límites. #109485 (Miсhael Stetsyuk). #109492 (Miсhael Stetsyuk).
  • Se corrigió que no se aplicara el límite global max_rows_in_join / max_bytes_in_join al join algorithm parallel_hash, donde una consulta con join_overflow_mode = 'throw' podía completarse silenciosamente en lugar de generar SET_SIZE_LIMIT_EXCEEDED. #109488 (Hechem Selmi).
  • Se corrigió la lectura de tablas Paimon particionadas por una columna BIGINT cuyo valor no cabe en Int32. Esos valores de partición se truncaban (por ejemplo, 9223372036854775807 pasaba a -1), lo que producía una ruta de partición incorrecta y provocaba un error del sistema de archivos. #109510 (Groene AI).
  • Se corrigió un crash al leer tablas Iceberg con archivos de eliminación por igualdad. Si una columna era Nullable en el archivo de eliminación por igualdad pero no anulable en el esquema de la tabla (o viceversa), los valores leídos del archivo de eliminación se insertaban en una columna de otro tipo mediante un cast no verificado (una confusión de tipos de columna), lo que corrompía la columna y hacía fallar el server. #109551 (Miсhael Stetsyuk).
  • Se corrigió que connect_timeout y los timeouts de lectura y escritura de MySQL no surtieran efecto: un intento de conexión a un MySQL server que no respondía podía quedarse bloqueado durante más de dos minutos incluso con connect_timeout = 1, porque las señales periódicas del sampling query profiler seguían restableciendo el plazo interno de sondeo del cliente MySQL. #109592 (Shaohua Wang).
  • Se corrigió un LOGICAL_ERROR (creation_csn is not set while removal_csn is set to 1) que podía producirse cuando un TRUNCATE no transaccional se ejecutaba de forma concurrente con una transacción no confirmada que había insertado en la misma tabla. Ese TRUNCATE ya no elimina partes creadas por transacciones que aún no se han confirmado. #109598 (Tuan Pham Anh).
  • Se corrigieron errores TYPE_MISMATCH al leer columnas struct de Parquet cuya nulabilidad física difiere del tipo de ClickHouse solicitado: ahora un grupo Parquet no nullable puede leerse como Nullable(Tuple(...)), y el lector nativo de Parquet puede leer un struct físicamente nullable (un grupo OPTIONAL de Parquet) como Nullable(Tuple(...)). #109615 (Groene AI). #109898 (Groene AI).
  • Se corrigió una pérdida silenciosa de datos cuando un INSERT ... VALUES en un flujo de múltiples consultas va seguido de un comentario SQL al final (por ejemplo, VALUES (1) -- comment) en la ruta de análisis del insert inline en el servidor (send_table_structure_on_insert_with_inline_data = 0). El comentario final se analizaba como datos de fila más allá del ; de terminación, lo que hacía que las consultas siguientes del flujo se omitieran silenciosamente. #109643 (Groene AI).
  • Se corrigió un segfault cuando una consulta llega en una ventana estrecha durante el apagado del servidor tras un error en el arranque. #109675 (Miсhael Stetsyuk).
  • Se corrigieron índices de omisión obsoletos (text, bloom_filter, etc.) y proyecciones tras materializar actualizaciones ligeras con ALTER TABLE ... APPLY PATCHES. Antes, los archivos de índice y proyección que dependen de una columna actualizada mediante patch quedaban sin cambios, por lo que las consultas que los usaban podían devolver resultados incorrectos (por ejemplo, hasToken omitiendo una fila actualizada, o una proyección devolviendo agregados obsoletos una vez eliminada la patch part ya consumida). #109709 (Groene AI).
  • Se corrigió que system.tables omitiera silenciosamente bases de datos para usuarios con permisos por base de datos cuando la consulta leía solo las columnas name/database. Introducido en 26.2. #109723 (Samay Sharma).
  • Se corrigió un LOGICAL_ERROR al escribir una columna LowCardinality(Time) en el formato Arrow con output_format_arrow_low_cardinality_as_dictionary = 1. #109730 (Groene AI).
  • Se corrigió que ObjectStorageQueue/AzureQueue (y la función de tabla azureBlobStorage) omitieran silenciosamente objetos cuando el almacenamiento de objetos devuelve una página de listado vacía junto con un token de continuación. Azure Blob Storage hace esto (por ejemplo, cuando un listado cruza un límite interno de partición), y el iterador asíncrono de listados trataba la página vacía como el final del listado y descartaba el token. Ahora sigue el token de continuación. #109761 (Gal Ben Moshe).
  • Se corrigió que la poda de particiones no devolviera ninguna fila para tablas Iceberg particionadas por una columna de marca temporal (DateTime64). #109764 (Den Kalantaevskii).
  • Se corrigió una excepción ILLEGAL_COLUMN en la función conv para argumentos FixedString; ahora se convierten correctamente a String. Cierra #109670. #109771 (hp).
  • La función getClientHTTPHeader ahora trata los nombres de los encabezados sin distinguir entre mayúsculas y minúsculas, de acuerdo con RFC 9110; en particular, el encabezado authorization ahora se filtra independientemente de cómo se escriba. Cierra #103957. #109791 (Mikhail f. Shiryaev).
  • Se corrige un problema por el que max_execution_time (con timeout_overflow_mode = 'throw') a veces no cancelaba nunca una consulta: cuando el supervisor interno de timeout ya estaba esperando una consulta con una deadline posterior, una consulta con una deadline anterior registrada después podía pasar completamente desapercibida, lo que le permitía seguir ejecutándose mucho más allá de su límite de tiempo. #109792 (Shaohua Wang).
  • Se corrigió el nombre de archivo de los archivos de metadatos de Iceberg comprimidos con gzip. ClickHouse los escribía como v{N}.gzip.metadata.json (el token HTTP Content-Encoding), mientras que la especificación de Iceberg espera la extensión gz, es decir, v{N}.gz.metadata.json. Como resultado, Spark y otros lectores de catálogos de Hadoop no podían encontrar los metadatos escritos por ClickHouse. ClickHouse ahora escribe v{N}.gz.metadata.json y sigue leyendo el nombre heredado gzip por compatibilidad con versiones anteriores. #109812 (Groene AI).
  • Se corrigió el error NOT_IMPLEMENTED (“Method getDataAt is not supported for Nullable(String)”) que podía producirse en un join con enable_join_runtime_filters = 1 (activado por defecto desde la versión 26.2) cuando la clave de join del lado de construcción era LowCardinality(Nullable(...)) con valores NULL y el runtime filter recurría a su bloom filter. #109824 (Groene AI).
  • Los engine de base de datos externos (por ejemplo, PostgreSQL) ya no aplican pushdown de comparaciones de rango (>=, >, <=, <) sobre columnas UUID. ClickHouse y las bases de datos externas ordenan los UUID de forma distinta, por lo que aplicar este pushdown descartaba filas del resultado de forma silenciosa; ahora ClickHouse evalúa esos predicados en su lugar. #109833 (Vismay).
  • Se corrigió un fallo del servidor cuando se pasaba una expresión lambda donde una higher-order function espera un valor concreto (por ejemplo, el acumulador de arrayFold, como en arrayFold(lambda, arr, another_lambda)). Estas consultas ahora se rechazan con ILLEGAL_TYPE_OF_ARGUMENT en lugar de provocar un fallo cuando enable_analyzer = 0. #109840 (Groene AI).
  • Se corrigió que la table function icebergLocal y el engine IcebergLocal declararan azure en lugar de local como su tipo de object storage, lo que hacía que no superaran la comprobación del tipo de disco (Disk type doesn't match) cuando se usaban con un disco local mediante SETTINGS disk = '...'. #109872 (Pedro Ferreira).
  • Se corrige la lectura de tablas Iceberg particionadas por la misma columna de origen más de una vez (por ejemplo, PARTITIONED BY (hours(ts), ts)). Anteriormente, estas tablas fallaban con Cannot add column ...: column with this name already exists (ILLEGAL_COLUMN). #109895 (Groene AI).
  • Se corrigen resultados de consulta incorrectos causados por que el índice de clave primaria descartaba incorrectamente gránulos en tablas con una columna clave invertida (DESC) cuando las partes no tienen marca final (granularidad no adaptativa, index_granularity_bytes = 0). #109901 (Nihal Z. Miaji).
  • Se corrigió un caso en el que generateRandomStructure producía ocasionalmente una cadena de estructura no válida con dos tipos de datos concatenados (por ejemplo, Decimal32(7)IPv4) cuando el anidamiento de tipos superaba el límite interno de profundidad, lo que hacía que el resultado no se pudiera interpretar. #109928 (Groene AI).
  • Se corrigió el error NOT_IMPLEMENTED (Method getDataAt is not supported for Nullable(String) in case if value is NULL) al construir un índice text sobre Array(LowCardinality(Nullable(String))) (incluidos los campos Nested almacenados de esa forma) cuando un array indexado contiene un elemento NULL. Ahora, los elementos NULL del array se omiten durante la construcción del índice, en consonancia con Array(Nullable(String)). #110055 (Groene AI).
  • Se corrigieron resultados incorrectos al construir un skip index minmax sobre una columna LowCardinality(Nullable(...)): antes, los predicados WHERE/PREWHERE/HAVING ... IS NULL enviados al almacenamiento descartaban todos los gránulos y devolvían 0 filas aunque la columna contenía valores NULL. #110061 (Groene AI).
  • Se corrigió distinct_overflow_mode = 'break': DISTINCT ahora devuelve el resultado parcial acumulado hasta el límite y deja de leer el origen, tal como se documenta. Antes, el fragmento que superaba max_rows_in_distinct / max_bytes_in_distinct se descartaba (produciendo resultados truncados o vacíos) y la consulta seguía leyendo e insertando en el conjunto hash hasta el final de la entrada, lo que podía acabar en MEMORY_LIMIT_EXCEEDED. #110075 (Sergey Kuznetsov).
  • Se corrigió un error lógico ChunkInfoRowNumbers does not exist en OPTIMIZE TABLE de una tabla Iceberg que contenía un archivo de datos en un formato distinto de Parquet (por ejemplo, ORC) más reciente que todos los archivos de borrado por posición. #110107 (Alexey Milovidov).
  • Se corrigieron max_bytes_in_distinct y max_bytes_in_set: las claves de cadena se almacenan en un arena que no se contabilizaba en las comprobaciones de límites, por lo que DISTINCT / IN sobre claves de cadena podían retener más memoria que el límite de bytes por el tamaño completo del payload de la clave (sin límite en la longitud de la clave). Ahora los límites tienen en cuenta el arena, en consonancia con la documentación; las consultas con claves de cadena cercanas a un límite de bytes pueden alcanzarlo antes (correctamente). #110120 (Sergey Kuznetsov).
  • Se corrigió un LOGICAL_ERROR (Bad cast from type ColumnLowCardinality to ColumnString) cuando identity (o el resultado de una subconsulta escalar) envuelve un valor que contiene un LowCardinality anidado y la consulta usa WITH TOTALS/WITH ROLLUP. #110138 (Groene AI).
  • Se corrigió la lectura de archivos Npy con dimensiones internas de tamaño cero: ahora coinciden el número de filas materializadas y los resultados de count optimizados y no optimizados. #110146 (Yanjun Qiu).
  • Se corrigió un aumento de tiempo cuadrático (y la falta de respuesta a max_execution_time) en aggregation in order al agrupar por varias claves cuyo orden de clasificación es solo un prefijo de la clave de agrupación. #110159 (Alexey Milovidov).
  • Se corrigió un error lógico (Unexpected number of columns in result sample block) cuando un filtro que contiene una subconsulta correlacionada (por ejemplo, exists((SELECT ...))) se optimiza con convert_query_to_cnf o optimize_and_compare_chain. #110187 (Alexey Milovidov).
  • Se corrigió una excepción (UNION mode UNION_DEFAULT must be normalized) cuando una mutación DELETE o ALTER UPDATE usaba una operación de conjuntos (UNION/UNION ALL/UNION DISTINCT/EXCEPT/INTERSECT) dentro de una subconsulta en la condición WHERE o en una asignación de UPDATE. #110196 (Alexey Milovidov).
  • Se corrigió un logical error ReadBuffer is canceled. Can't read from it. (aborto del servidor en builds de depuración/sanitizador) que podía producirse al leer un archivo zip (por ejemplo, durante RESTORE desde una copia de seguridad en zip) después de que una lectura previa del mismo archivo fallara a mitad del flujo. #110197 (Groene AI).
  • Se corrigieron el apagado lento del servidor y la falta de respuesta de KILL MUTATION cuando una mutación con x IN (subquery) estaba construyendo el conjunto de la subconsulta durante el análisis de la clave primaria; ahora la construcción del conjunto se cancela de inmediato. #110198 (Alexey Milovidov).
  • Keeper ahora rechaza que los ajustes de coordination max_requests_batch_size y max_requests_append_size se establezcan en 0, en lugar de quedarse atascado en un bucle infinito de append-entries en una configuración multinodo. #110200 (Alexey Milovidov).
  • Se corrigió un error NOT_FOUND_COLUMN_IN_BLOCK al usar GROUP BY ALL sobre una expresión de tupla junto con ORDER BY. #110206 (Alexey Milovidov).
  • Se corrigió un error NOT_FOUND_COLUMN_IN_BLOCK en INSERT sobre una tabla que tiene una restricción CHECK que hace referencia a una subcolumna (como x.null de una columna Nullable o arr.size0 de un Array). #110208 (Alexey Milovidov).
  • Se corrigió la lectura de tablas Iceberg cuyo orden de clasificación predeterminado hace referencia a una columna que requiere comillas (por ejemplo, @timestamp). Esas tablas no se podían leer porque el ORDER BY de almacenamiento sintetizado se construía a partir del nombre de la columna sin comillas y fallaba al analizarse con SYNTAX_ERROR. #110233 (Groene AI).
  • Se corrigió que system.tables para una base de datos DataLakeCatalog (Iceberg/Glue) abortara toda la consulta o descartara tablas silenciosamente cuando no se podían resolver los metadatos de una sola tabla. Esa tabla ahora sigue apareciendo por nombre con valores predeterminados/NULL para las columnas que necesitan el objeto de almacenamiento abierto (engine, total_rows, etc.), independientemente de database_datalake_require_metadata_access. El acceso directo a la tabla dañada sigue informando el error. #110242 (Groene AI).
  • Se corrigió un posible fallo (heap-buffer-overflow) cuando una columna de estado de función de agregación de la familia quantileTDigest se usaba como clave de GROUP BY y era serializada de forma concurrente por varios hilos. #110263 (Groene AI).
  • Se corrigió que INSERT en una tabla DataLakeCatalog de Microsoft Fabric / OneLake fallara con IncorrectEndpointError (HTTP 400) al dirigir las escrituras de ADLS Gen2 (DFS) al host del endpoint .dfs en lugar del host .blob. Nota: con remote_url_allow_hosts, ambos hosts de Fabric, .blob (lectura) y .dfs (escritura), deben incluirse en la lista de permitidos para INSERT. #110290 (Mohammad Lareb Zafar).
  • Se corrigió un cierre abrupto del server al analizar ciertas consultas PRQL (SET dialect = 'prql'). Un panic dentro del compilador prqlc hacía que el proceso abortara en lugar de notificarse como un error de consulta. #110316 (Groene AI).
  • Se corrigieron resultados de consulta incorrectos que se producían silenciosamente cuando una projection part escrita antes de que cambiara el conjunto de columnas de la projection (por ejemplo, tras actualizar entre versiones que materializan de forma distinta el origen de una columna ALIAS, o después de que ALTER TABLE ... MODIFY COLUMN reasigne una columna ALIAS usada por una projection) se leía a través de la projection o se fusionaba: la columna faltante se rellenaba con valores predeterminados en lugar de con los datos reales. Ahora esas parts se leen desde la base table, y las fusiones reconstruyen la projection a partir de los datos base. #110328 (Shaohua Wang).
  • Se corrigió que ORDER BY ... WITH FILL no respetara max_execution_time y tardara en cancelarse al generar un rango de relleno grande (especialmente con INTERPOLATE). #110332 (Alexey Milovidov).
  • Se corrigió un logical error (un cierre abrupto del server en builds de depuración/sanitizador) cuando se ejecutaba un ALTER con varios comandos, como UPDATE ..., DELETE ..., sobre una tabla Iceberg. Ahora esas mutations se rechazan con un error NOT_IMPLEMENTED claro. #110347 (Groene AI).
  • Se corrigió un bug del parser por el que COMMENT se interpretaba incorrectamente como un alias implícito cuando una consulta SELECT terminaba justo después de un identificador de tabla simple (p. ej., ... FROM t COMMENT 'x'), lo que provocaba un error de sintaxis engañoso en lugar de aplicar el comentario a la vista/tabla. #110372 (Aditya Kumar).
  • Se corrigió un fallo del server (desbordamiento nativo de pila) al copiar o destruir un literal Array/Tuple/Map/Object profundamente anidado, por ejemplo, una consulta con un literal muy profundamente anidado con un max_parser_depth elevado. #110393 (Raúl Marín).
  • Se corrigieron dos casos en los que vector search podía devolver menos filas de las esperadas: los valores de vector_search_index_fetch_multiplier inferiores a 1.0 podían truncar a cero el recuento de fetch calculado y producir un resultado vacío (ahora esos valores se rechazan), y ahora la optimization de vector search se omite para consultas LIMIT ... WITH TIES, porque la optimization limitaba la búsqueda a exactamente N candidatos y descartaba filas empatadas con la N.ª fila. #110452 (Tamish Mhatre). #110453 (Tamish Mhatre).
  • Se corrigieron el logical error Expected CommonSubplanReferenceStep to reference CommonSubplanStep, el error Subplan cannot be used to build pipeline y el logical error Trying to extract chunk from ChunkBuffer before all inputs are finished para IN (subquery) cuando la subquery contiene una subquery correlacionada y el set se construye durante el análisis de índices. #110491 (Alexey Milovidov).
  • Se corrigió la sustitución de query parameters dentro de las definiciones de una cláusula WINDOW con nombre. Anteriormente, los parameters allí permanecían sin sustituirse de forma silenciosa, y un parámetro Identifier no establecido podía provocar la excepción Logical error: '!part.empty()' durante EXPLAIN SYNTAX. #110506 (Alexey Milovidov).
  • Se corrigió un fallo al iniciar el server para tablas MergeTree en object storage disks cuando un archivo residual txn_version.txt.tmp deja corruptos los metadata a nivel de disco. #110519 (Alexey Milovidov).
  • Se corrige un error lógico en la filesystem cache (Expected file ... not to exist) que podía producirse cuando una descarga de caché en segundo plano fallaba con un error no relacionado con el sistema de archivos (por ejemplo, al ejecutar OPTIMIZE en una tabla Iceberg), y dejaba un archivo de caché huérfano y vacío. #110549 (Groene AI).
  • Se corrige la lectura de un stream en formato Native corrupto cuyo recuento de tipos Dynamic o de rutas JSON/Object se acerca a SIZE_MAX: ahora esa entrada malformada se rechaza con un error INCORRECT_DATA claro en lugar de un std::length_error no controlado. #110590 (Alexey Milovidov).
  • Se corrige un fallo del servidor en el database engine MaterializedPostgreSQL que podía producirse cuando una tabla se detached (o cambiaba su estructura) mientras todavía estaba en cola para sincronizarse. #110596 (Alexey Milovidov).
  • Se corrige el comportamiento incorrecto de SET param_<name> en el cliente (y de las opciones --param_<name>) cuando el nombre del parámetro coincide con el setting name de una configuración integrada, como limit, offset, max_threads o log_comment. Según el ajuste en conflicto, la consulta fallaba con CANNOT_PARSE_QUOTED_STRING, el valor se normalizaba silenciosamente (p. ej., max_threads=0 pasaba a auto(N)), o se perdía un nombre de alias del ajuste. Ese parámetro también rompía todos los SET param_* posteriores en la misma sesión. #110597 (Raúl Marín).
  • Se corrige la lectura de subcolumns de una columna que tiene una expresión DEFAULT y no está materializada en una part (p. ej., después de ALTER TABLE ADD COLUMN o durante ALTER TABLE MATERIALIZE COLUMN): la subcolumna se rellenaba con los valores predeterminados del tipo en lugar de con la expresión DEFAULT evaluada, y las funciones transpuestas de distancia vectorial (cosineDistanceTransposed y otras) sobre esas columnas QBit fallaban con el error SIZES_OF_ARRAYS_DONT_MATCH. Esto cierra #110634. #110636 (Alexey Milovidov).
  • Se corrige un LOGICAL_ERROR Invalid partition key size: 0 que podía hacer fallar un INSERT en una tabla MergeTree particionada con non_replicated_deduplication_window habilitado, cuando un lote de async insert solo se deduplicaba parcialmente (algunos valores de insert_deduplication_token eran duplicados y otros eran nuevos). #110651 (Groene AI).
  • Un flush en segundo plano de una inserción asíncrona ahora se detiene rápidamente cuando se cancela con KILL QUERY; antes, el vaciado de una carga grande almacenada en búfer seguía analizándose hasta el final e ignoraba la cancelación. #110652 (Shaohua Wang).
  • Se corrigen resultados incorrectos de GROUP BY con optimize_aggregation_in_order y de DISTINCT con optimize_distinct_in_order aplicados sobre un JOIN partial_merge. La optimización de lectura en orden se propagaba a través del join partial-merge, que vuelve a ordenar su entrada izquierda por la clave de join y, por tanto, no conserva el orden original del stream izquierdo, por lo que las filas se agrupaban de forma incorrecta. #110671 (Groene AI).
  • Se corrige un overflow de entero con signo en toStartOfInterval con un recuento extremo de intervalos MONTH, WEEK o DAY sobre valores Date/Date32/DateTime64. #110688 (Groene AI).
  • Se corrige el error NOT_FOUND_COLUMN_IN_BLOCK en consultas con una subconsulta en FROM cuando las réplicas paralelas se ejecutan en modo custom_key_sampling / custom_key_range. Estas consultas (p. ej., SELECT * FROM (SELECT id, k, v FROM t WHERE id < 20) ORDER BY k) antes fallaban con Not found column __table2.id in block .... #110690 (Groene AI).
  • Se corrigió que readWKT rechazara cadenas WKT con espacios iniciales (p. ej., readWKT(' POINT(1 2)')), que sí aceptan los lectores tipados readWKTPoint/readWKTPolygon/… y la gramática WKT. #110706 (Groene AI).
  • Se corrige un error lógico (Column ... already added for reading, una interrupción del servidor en compilaciones de debug/sanitizador) cuando el mismo predicado de índice de texto se usa tanto en PREWHERE como en WHERE de una consulta sobre una tabla Merge encima de una tabla Distributed. #110710 (Groene AI).
  • Se corrige el error NOT_FOUND_COLUMN_IN_BLOCK en las funciones de distancia transpuestas sobre columnas QBit (como cosineDistanceTransposed) llamadas con una subconsulta escalar o un vector de referencia constante cuando las réplicas paralelas están habilitadas. Esto cierra #110719. #110729 (Alexey Milovidov).
  • Se corrige un raro LOGICAL_ERROR (Unexpected number of parts to remove from parts_queue; una interrupción del servidor en compilaciones de debug/sanitizador) en ReplicatedMergeTree cuando dos operaciones de partición (por ejemplo, dos consultas MOVE PARTITION/REPLACE PARTITION, o una en carrera con un DROP_RANGE en segundo plano) cancelaban al mismo tiempo la comprobación en segundo plano de partes sobre rangos superpuestos. #110738 (Groene AI).
  • Se corrigió un error lógico Hash is not set for serialization que podía producirse cuando una columna con un códec Quantized(...) estaba envuelta dentro de otra serialización, por ejemplo en una tabla Merge sobre fuentes cuya columna del mismo nombre tiene tipos distintos (fusionados en un Variant). #110776 (Groene AI).
  • Se corrige un bloqueo del servidor al multiplicar un estado de función de agregación median/quantile por una constante entera enorme (p. ej., medianState(x) * 18446744073709551615). La consulta dejaba de responder a la cancelación y podía ejecutarse indefinidamente. #110779 (Groene AI).
  • Se corrige una caída del servidor (división entera por cero) cuando se consumía una cuota con un intervalo de longitud cero (por ejemplo, CREATE QUOTA q FOR INTERVAL 0 SECOND MAX queries = 1000). Ahora se rechaza al crearla cualquier duración de intervalo de cuota no positiva. #110846 (Pedro Ferreira).
  • Se corrigió que throwIf(notLike(col, pattern)) (y otros throwIf aplicados sobre una función) lanzara una excepción incondicionalmente cuando col es LowCardinality. La implementación predeterminada de LowCardinality ejecutaba throwIf sobre todo el diccionario, que siempre contiene el valor predeterminado reservado incluso cuando ninguna fila lo referencia, por lo que un valor distinto de cero en esa posición no utilizada hacía que throwIf lanzara una excepción para datos que no cumplen la condición. #110864 (Groene AI).
  • Propaga los roles activos de una consulta (SET ROLE o el parámetro role) a los nodos remotos en lecturas con réplica paralela y Distributed sobre un clúster protegido con un secreto interserver; anteriormente, los nodos remotos recurrían a los roles predeterminados del usuario y evaluaban las políticas de fila de forma distinta al iniciador. #110867 (Nikolay Degterinsky).
  • Se corrigió que las tablas Iceberg produjeran ID de campo duplicados después de ALTER TABLE ... ADD COLUMN cuando el esquema inicial contiene campos anidados (Tuple/Array/Map). last-column-id ahora registra el ID de campo máximo asignado, incluidos los hijos anidados, por lo que una columna añadida posteriormente ya no reutiliza un ID de campo anidado y las lecturas ya no fallan con ICEBERG_SPECIFICATION_VIOLATION (Duplicate field id). #110884 (Groene AI).
  • Se corrigió un fallo en compilaciones FIPS al usar una clave SSH Ed25519 (CREATE USER ... IDENTIFIED WITH ssh_key ... TYPE 'ssh-ed25519', o una clave de ese tipo en users.xml). Ed25519 no está aprobado por FIPS; esas claves ahora se rechazan con un error LIBSSH_ERROR claro. #110891 (Konstantin Bogdanov).
  • Se corrigieron los resultados de precisión reducida de las funciones de distancia transpuestas sobre columnas QBit (cosineDistanceTransposed, L2DistanceTransposed, dotProductTransposed). Los valores truncados a precision planos de bits se reconstruían rellenando con ceros los bits descartados, lo que sesgaba todos los valores reconstruidos hacia cero y producía un caso degenerado con baja precisión: para QBit(BFloat16) con precisión 1, solo sobrevive el bit de signo, por lo que todos los valores se reconstruían como ±0.0 y la distancia era la misma constante para cada fila, sin aportar información de ranking. Los valores truncados ahora se reconstruyen al punto medio acotado de la celda de precisión restante (los códigos Int8 sin procesar a su centro de celda; se conservan los ceros exactos y los infinitos), de modo que una precision menor intercambia exactitud por velocidad sin producir resultados excesivamente sesgados. Los resultados de precisión completa no cambian. Esto cierra #110898. #110911 (Alexey Milovidov).
  • Se corrigió un fallo del servidor (use-after-free) durante un apagado ordenado después de consultar tablas Iceberg desde sesiones que también usaban tablas temporales. #110914 (Miсhael Stetsyuk).
  • Se corrigió un LOGICAL_ERROR: Cannot sum Bools (un abort del servidor en compilaciones de depuración/sanitizador) al fusionar estados de agregación sumMap/sumMapWithOverflow/sumMapFiltered con valores Bool que se habían serializado en el formato de estado antiguo (versión 0). La misma corrección también arregla dos casos silenciosos de resultados incorrectos con estados Bool de versión 0: las claves de mapa de tipo Bool no se deduplicaban entre estados, y la compactación de valores cero eliminaba las entradas incorrectas. #110922 (Groene AI).
  • Se corrigió un fallo cuando una función de agregación con el combinador -Tuple se usaba con RESPECT NULLS y producía un estado intermedio (-State, agregación distribuida, WITH ROLLUP/WITH CUBE). La función combinada tomaba el nombre de la variante de estado incorrecta, por lo que su tipo AggregateFunction serializado volvía a resolverse a una disposición en memoria incompatible al hacer un round-trip. #110930 (Groene AI).
  • Se corrigió que PREWHERE (y las policies a nivel de fila) sobre una columna Iceberg renombrada por schema evolution devolviera silenciosamente 0 filas para data files antiguos. Esas consultas ahora devuelven las filas correctas, igual que WHERE. #110941 (Groene AI).
  • Corrige un LOGICAL_ERROR (LazyMaterializingTransform: Number of rows in lazy chunk N does not match number of offsets M) que podía producirse en consultas de vector search con vector_search_with_rescoring = 1 combinadas con materialización diferida cuando varias distancias empataban. #111003 (Groene AI).
  • Se corrigió la lectura de datos Arrow/ArrowStream con columnas anidadas Array/Map vacías generadas por Apache Arrow Java < 19.0.0 (incluido con Apache Spark), que antes se rechazaban con un error INCORRECT_DATA porque el búfer de desplazamiento era demasiado pequeño. #111101 (Raúl Marín).
  • Corrige lecturas obsoletas en discos plain_rewritable con la page cache habilitada. #111105 (Mikhail Artemenko).
  • Corrige el error CANNOT_CONVERT_TYPE para constantes de tipo Variant (incluido Geometry) en consultas distribuidas y consultas con réplicas paralelas. #111136 (Nikita Fomichev).
  • Corrige un error por el que la lectura de archivos grandes desde HDFS podía fallar o devolver datos incorrectos cuando una única solicitud de lectura superaba el límite de tamaño de 32 bits de hdfsPread (INT_MAX). #98470 (Arup Chauhan).
  • Corrige el uso incorrecto del text index en comparaciones de igualdad con una cadena de búsqueda vacía. #108340 (Robert Schulze).
  • Se corrigió un bloqueo en SYSTEM SYNC MERGES con el merge selector Manual cuando no se podía colocar una merge programada en un background pool lleno. #108770 (Alexey Milovidov).
  • Corrige que ATTACH TABLE ... AS REPLICATED descartara datos committed y resucitara filas anteriores a la mutation cuando quedaba un archivo txn_version.txt.tmp obsoleto en una data part. #108772 (Alexey Milovidov).
  • Corrige una posible race condition en ALTER TABLE ... MOVE PARTITION TO TABLE con tablas MergeTree no replicadas que podía producir data parts intersectadas, porque el commit de las partes movidas y la asignación del número de bloque no estaban bajo el mismo lock. #108922 (Mikhail Artemenko).
  • Corrige la lectura de tablas Iceberg escritas por Databricks UniForm, que escribe un esquema placeholder degenerado (con una lista de campos vacía) en los manifest files. #108945 (Konstantin Vedernikov).
  • Corrige un use-after-free al leer una tabla Hive sin partición con varios hilos. #109164 (Alexey Milovidov).
  • Corrige que el log level de la consola no volviera a su valor original tras el inicio del server cuando se establece logger.startup_console_log_level: el nivel se tomaba de la clave de configuration incorrecta, por lo que la consola permanecía en el Startup level elevado durante toda la lifetime del server. Cierra #103472. #109858 (Garrett Thomas).
  • Corrige anomalías de aislamiento de snapshot en transacciones de metadata del disco plain_rewritable. Corrige #92055. #110948 (Mikhail Artemenko).
  • Corrige un abort (front() called on an empty vector) en clickhouse-client --login cuando el host no se pasaba como argumento --host explícito, por ejemplo, cuando provenía de --connection, del archivo de configuración o de la variable de entorno CLICKHOUSE_HOST. Cierra #103603. #110279 (Christoph Wurm).
  • Corrige un error lógico (!part.empty()) cuando un argumento lambda es un identificador entre acentos graves cuyo nombre contiene un punto (por ejemplo, __table1.). Antes, esa consulta producía una excepción controlada en compilaciones release y abortaba el servidor en compilaciones de depuración y con sanitizador al formatear un mensaje de error. #108735 (Groene AI).
  • Corrige un LOGICAL_ERROR (No set is registered for key) en mutaciones ALTER TABLE ... DROP COLUMN, ALTER TABLE ... DELETE/UPDATE y DELETE FROM lightweight, en tablas que tienen una columna ALIAS cuya expresión usa un operador IN (incluso a través de otra columna ALIAS). #111039 (Pedro Ferreira).
  • Corrige una pérdida silenciosa de datos con async inserts y deduplicación (async_insert=1, async_insert_deduplicate=1). Cuando varias entradas de inserción asíncrona con valores insert_deduplication_token distintos se consolidaban en un único flush que escribía en particiones disjuntas, cada token se registraba en el log de deduplicación de cada partición afectada por el flush, y no solo en la partición en la que acababan sus propias filas. Después, una inserción posterior que reutilizaba uno de esos tokens en una partición en la que nunca había escrito se deduplicaba silenciosamente. Ahora los tokens se registran solo en la partición en la que realmente acaban sus filas. Cierra #111031. #111049 (Groene AI).
  • Corrige una excepción LOGICAL_ERROR (ScatterExchangeStep should have one source shard, got 8) y filas duplicadas al consultar una tabla Merge sobre tablas o vistas Distributed con la configuración experimental make_distributed_plan = 1. Cierra #107946. #108401 (Groene AI).
  • Serializa una columna Nullable(Tuple(...)) como un único campo CSV en lugar de aplanarla en columnas separadas. Antes, un valor no nulo se escribía como varios campos CSV, mientras que NULL era un único \N, lo que daba un recuento de columnas dependiente de la fila y rompía los encabezados CSVWithNames/CSVWithNamesAndTypes y las operaciones de ida y vuelta. #108959 (Groene AI).
  • Corrige un error lógico (KeyCondition uses PREWHERE output) en el lector Parquet v3 cuando una condición de clave a nivel de formato hace referencia a una columna que no se lee del archivo Parquet. #109267 (Groene AI).
  • Corrige resultados incorrectos en lecturas de funciones de tabla con FINAL o SAMPLE bajo serialize_query_plan = 1. También corrige la clave de caché de las estadísticas de la tabla hash de agregación para funciones de tabla, de modo que distintas funciones de tabla ya no compartan la misma entrada de preasignación. #109847 (Azat Khuzhin).
  • Corrige la limpieza de un BACKUP ... TO Memory(...) que falla antes de finalizar: la copia de seguridad fallida quedaba registrada, por lo que su nombre no podía reutilizarse. #109947 (Julia Kartseva).
  • Se corrige la aritmética de intervalos extrema para WITH FILL STEP y las funciones de intervalo de fecha/hora add* / subtract*: los deltas fuera de rango ya no dependen del desbordamiento con signo, y WITH FILL con un paso YEAR enorme ya no se queda bloqueado al hacer retroceder el calendario. #110158 (Groene AI).
  • Se corrigen los errores 411 Length Required de los servicios de Azure: el transporte HTTP de Azure basado en Poco ahora establece Content-Length a partir del cuerpo de la solicitud para los SDK client que no lo establecen por sí mismos, como Azure Key Vault. #110299 (Konstantin Bogdanov).
  • La optimización diferida de FINAL (query_plan_optimize_lazy_final, deshabilitada de forma predeterminada) ya no se aplica cuando la consulta lee en el orden de la clave de ordenación, porque su plan de reemplazo no preserva ese orden y podía devolver resultados en un orden incorrecto. Tampoco se aplica ya cuando un LIMIT menor que el número de filas que se van a leer se aplica directamente al paso de lectura, donde la pasada obligatoria de construcción del conjunto impide la finalización anticipada. #110576 (Nikolai Kochetov).
  • Se corrigió que readWKT y readWKTPoint devolvieran coordenadas sin inicializar (escalares) o heredadas de la fila anterior (vectorizadas) para POINT EMPTY. POINT EMPTY ahora se rechaza con CANNOT_PARSE_TEXT, ya que Point de ClickHouse es una Tuple(Float64, Float64) fija sin representación vacía. #110692 (Groene AI).
  • Se corrige el manejo incorrecto de la zona horaria al materializar columnas del lado derecho en hash joins. Cierra #111033. #111074 (Yarik Briukhovetskyi).
  • Se corrigieron resultados incorrectos de count() y la omisión de filas cuando una clave String (o una FixedString más estrecha) o un skip index minmax se filtra mediante una comparación con una constante FixedString más ancha, por ejemplo toFixedString('abc', 257) = string_col. La poda por clave primaria y minmax construía el rango a partir de la constante rellenada con NUL y omitía incorrectamente los gránulos coincidentes. #111106 (Groene AI).
  • Se corrigieron las inserciones asíncronas en formato Native para que una entrada en búfer que se vuelva incompatible después de ALTER ... MODIFY COLUMN ya no haga fallar todo el lote. Cierra #111064. #111108 (Mikhail f. Shiryaev).
  • Se corrige CREATE OR REPLACE de un Diccionario con un objeto de otro tipo: fallaba con CANNOT_DETACH_DICTIONARY_AS_TABLE después de que el reemplazo ya se hubiera confirmado, dejando una tabla huérfana _tmp_replace_*. #111142 (Nikolay Degterinsky).
  • Se corrigió INCOMPATIBLE_TYPE_OF_JOIN para un join ANY en una tabla del engine Join cuando un filtro WHERE sobre una columna del lado derecho permitía al planner de consultas reescribir el join a SEMI o ANTI. Una tabla del engine Join tiene una strictness declarada fija que no puede cambiarse, por lo que ahora se rechaza esa conversión para dichas tablas. #111362 (Groene AI).
  • Se corrige que la table function format no devolviera columnas cuando los datos de entrada se interpretan como cero filas (por ejemplo, un documento JSON vacío o una FeatureCollection de GeoJSON sin features). Ahora devuelve un resultado vacío con las columnas correctas en lugar de lanzar NOT_FOUND_COLUMN_IN_BLOCK. Cierra #111390. #111428 (Groene AI).

Mejora en compilación/pruebas/empaquetado

  • Las compilaciones con sanitizador ahora capturan el informe del sanitizador en el búfer global sanitizer_report, para que el analyzer de core dumps pueda leerlo desde el core dump. #109333 (Miсhael Stetsyuk).
  • Compilar musl desde el código fuente en lugar de usar binarios integrados. #97452 (Konstantin Bogdanov).
  • Usar implementaciones SIMD de memcmp/memcpy/memmove/memset/bcmp/memmem de LLVM-libc. #107566 (Konstantin Bogdanov). Se corrige una corrupción silenciosa de memmove en compilaciones de Debug con -O0 (-DDEBUG_O_LEVEL=0) en máquinas con AVX-512. #110904 (Konstantin Bogdanov).
  • Eliminar los usos de la biblioteca curl en toda la base de código y en las bibliotecas de terceros incluidas. #108296 (Konstantin Bogdanov).
  • Se actualizó mariadb-connector-c a 3.4.9. #108328 (Konstantin Bogdanov).
  • Actualizar libssh a 0.12.0. #108329 (Konstantin Bogdanov).
  • Se corrige un bloqueo durante el COMMIT de una transacción en macOS. #108375 (Raúl Marín).
  • Se añadió una opción de CMake COMPRESS_DEBUG_SECTIONS que comprime las secciones de depuración DWARF en archivos objeto (-gz), habilitada automáticamente cuando el compilador lo admite, para reducir el tamaño de los directorios de compilación de Debug; los binarios finales se dejan sin comprimir, por lo que la simbolización de stack traces en runtime no se ve afectada. #109306 (Murphy). La toolchain de LLVM incluida ahora se compila con zlib, por lo que su clang admite -gz=zlib, y se añadió el enlace simbólico clang++-21 que faltaba. #109596 (Murphy).
  • Las compilaciones de Debug ahora compilan los crates de Rust integrados con información de depuración reducida (debug = 1, nivel limited de cargo) y sin caché incremental (REDUCE_RUST_DEBUG_INFO, activado de forma predeterminada), lo que reduce el tamaño de los artifacts de compilación de Rust (~12 → ~7 GB desde cero) y evita el crecimiento ilimitado de la caché de cargo entre recompilaciones. Establezca -DREDUCE_RUST_DEBUG_INFO=OFF para restaurar DWARF completo y la compilación incremental. #109471 (Murphy).
  • Se admite el exchange de consultas distribuidas en streaming y las lecturas STREAM en macOS. #109769 (Raúl Marín).
  • Actualizar libarchive de 3.8.7 a 3.8.8. #109874 (Robert Schulze).
  • Actualizar c-ares de 1.34.6 a 1.34.8. #109905 (Robert Schulze).
  • Actualizar krb5 para corregir CVE-2026-40355 y CVE-2026-40356. #109910 (Robert Schulze).
  • Se eliminó la dependencia de terceros libpng. FORMAT PNG ahora usa en su lugar un pequeño codificador PNG integrado (basado en la zlib incluida). #110051 (Alexey Milovidov).
  • Se registran en el memory tracker de macOS las asignaciones sin procesar de C (que no pasan por operator new) al envolver la zona malloc de jemalloc, de modo que se les apliquen los límites de memoria. #110370 (Raúl Marín).
  • Las imágenes de Docker -distroless para clickhouse-server y clickhouse-keeper ahora se construyen a partir de la etapa de producción sin shell; antes se construían a partir de la etapa de depuración e incluían /busybox/sh. Cierra #105677. #105678 (ashishch432).
  • Se actualizó abseil-cpp a la versión LTS 20260526.0. #108991 (Konstantin Bogdanov).

Lanzamiento de ClickHouse 26.6, 2026-06-25. Presentación, Video

Cambio incompatible con versiones anteriores

  • Este cambio elimina la funcionalidad allow_experimental_query_deduplication. Esta funcionalidad llevaba mucho tiempo en estado experimental, no tiene pruebas y no se va a seguir soportando (las pruebas iniciales eran inestables y se eliminaron en #49579). #99398 (Igor Nikonov).
  • La funcionalidad SYSTEM INSTRUMENT basada en XRay ahora usa arguments en lugar de parameters: la columna system.instrumentation.parameters se renombró a arguments, y la sintaxis SYSTEM INSTRUMENT ADD ... HANDLER PARAMETERS ... se cambió por SYSTEM INSTRUMENT ADD ... HANDLER ARGUMENTS .... Las consultas o automatizaciones que usen la columna o la sintaxis antiguas deben actualizarse para usar los nombres nuevos; los nombres antiguos ya no son compatibles. #103854 (Pablo Marcos).
  • La configuración show_data_lake_catalogs_in_system_tables se renombró a show_remote_databases_in_system_tables y se amplió: cuando su valor es 0 (el valor predeterminado), las bases de datos MySQL y PostgreSQL también se ocultan de system.tables, system.columns y system.completions, además de los catálogos del lago de datos. El nombre antiguo de la configuración se mantiene como alias. #104416 (Pablo Marcos).
  • La build x86 predeterminada ahora apunta a x86-64-v3 (AVX2) en lugar de x86-64-v2 (SSE4.2). Esto requiere una CPU con soporte para AVX2 (Intel Haswell o posterior, AMD Excavator o posterior). Si tu CPU no admite AVX2, usa la build amd64compat, que apunta a x86-64 básico. #105019 (Raúl Marín).
  • Se rechazan Dynamic/Variant anidados en agregaciones min/max e índices minmax. Antes solo se comprobaban los Dynamic/Variant de nivel superior. Cierra #104747. #105468 (Pavel Kruglov).
  • icebergHash y icebergBucket ahora rechazan argumentos Int128, UInt128, Int256, UInt256 y Decimal256 con un error explícito. Antes truncaban silenciosamente los valores más grandes y producían hash con colisiones. La spec de Iceberg solo define el hashing para enteros de 32/64 bits y decimales con una precisión de hasta 38; convierte a Int64 o Decimal128 para mantener el comportamiento anterior en los valores que quepan. #105866 (Raúl Marín).
  • Se añadió control granular sobre el eco de consultas en la CLI. La opción --echo ahora acepta un valor booleano opcional y funciona tanto en modo interactivo como en batch mode. Las nuevas opciones --echo-formatted y --echo-query-id controlan, respectivamente, si las consultas reproducidas con eco se formatean y si se imprime query_id. La opción --hilite/--highlight ahora también controla el resaltado de las consultas reproducidas con eco. Como efecto secundario, --echo ahora es una opción con valor booleano, por lo que una consulta posicional colocada justo después de un --echo sin valor se interpreta como su valor; usa --echo --query "..." o --echo=false en su lugar. #106191 (Alexey Milovidov).
  • Se eliminaron las funciones experimentales de KQL (Kusto) array_sort_asc y array_sort_desc, junto con sus backends SQL kql_array_sort_asc y kql_array_sort_desc. Estas funciones eran experimentales, estaban implementadas con baja calidad y eran el origen de errores de corrección y del parser. Las consultas que usan estos nombres ahora devuelven UNKNOWN_FUNCTION. #108101 (Groene AI).
  • ALTER TABLE ... REPLACE PARTITION ... FROM ... ya no elimina silenciosamente los datos de la partición de destino cuando la tabla de origen no tiene partes en la partición solicitada. Antes, una solicitud de este tipo eliminaba la partición de destino y no escribía nada en su lugar: una trampa que podía provocar pérdida de datos. Ahora, de forma predeterminada, se rechaza con BAD_ARGUMENTS. Para restaurar el comportamiento anterior de vaciado silencioso, establezca la nueva configuración allow_replace_partition_from_empty_source = 1, o bien establezca compatibility en 26.5 o una versión anterior; para eliminar explícitamente los datos de destino, use ALTER TABLE ... DROP PARTITION. #104939 (Groene AI).
  • El valor predeterminado de la configuración del servidor insert_deduplication_version cambia de compatible_double_hashes a new_unified_hash. La deduplicación de inserciones ahora funciona sobre todo el bloque insertado (por inserción) en lugar de hacerlo por parte/partición: un reintento de la misma inserción sigue deduplicándose, pero dos inserciones distintas que producen una parte idéntica ya no se deduplican entre sí, y las inserciones de las mismas filas en distinto orden ya no se deduplican. Establezca insert_deduplication_version = compatible_double_hashes para restaurar el comportamiento anterior. Las instancias que se actualicen directamente desde una release cuyo valor predeterminado era old_separate_hashes primero deben ejecutarse con compatible_double_hashes hasta que haya transcurrido la ventana de deduplicación relevante más larga antes de pasar a depender de new_unified_hash. #107886 (Sema Checherinda).

Nueva funcionalidad

  • Se agregó compatibilidad con consultas continuas sobre tablas MergeTree, implementadas mediante una serie de lecturas de instantáneas. Este es un primer paso hacia la compatibilidad general con consultas en streaming. #105114 (Mikhail Artemenko).
  • Se agregaron índices de omisión hipotéticos (what-if). Use CREATE HYPOTHETICAL INDEX ... ON t (expr) TYPE ... para definir un índice de omisión virtual con alcance de sesión y luego EXPLAIN WHATIF SELECT ... para estimar su tasa de omisión y su costo sin materializarlo. Los índices definidos son visibles en la nueva tabla system.hypothetical_indexes. #104608 (Yarik Briukhovetskyi).
  • Se agregó una interfaz web integrada en /schema a clickhouse-server que visualiza el grafo de dependencias entre tablas, vistas materializadas, vistas materializadas actualizables, diccionarios, tablas distribuidas y vistas. #105276 (Nikita Mikhaylov).
  • Se agregó compatibilidad con el formato de salida PNG, lo que permite renderizar directamente los resultados de las consultas como imágenes PNG. #74691 (Maksim Dergousov).
  • Se agregó la detección del agente de codificación con IA (Claude Code, Cursor, Codex, Gemini CLI, Goose, etc.) que invocó clickhouse-client o clickhouse-local, en función de las variables de entorno. El agente detectado se informa en la nueva columna client_agent de system.query_log, system.query_thread_log y system.processes. #106619 (Alexey Milovidov).
  • Se agregó una nueva tabla del sistema, system.documentation, que recopila en una sola tabla la documentación de referencia integrada de los componentes uniformes del sistema (funciones, motores de tabla, tipos de datos, ajustes, formatos y otros), con la documentación renderizada en Markdown. #107463 (Alexey Milovidov).
  • Se agregó el formato de entrada GeoJSON para leer documentos FeatureCollection de GeoJSON, produciendo una fila por feature con columnas id (String), geometry (Geometry) y properties (Nullable(JSON)). Las geometrías Point, LineString, MultiLineString, Polygon y MultiPolygon se leen en el tipo nativo Geometry de ClickHouse. GeometryCollection y MultiPoint, que el tipo Geometry no puede representar, generan una excepción de forma predeterminada, o pueden almacenarse como NULL mediante el ajuste input_format_geojson_unsupported_geometry_handling. Contribuye a #91533. #98124 (Mark Needham).
  • Se agregaron funciones para servir Mapbox Vector Tiles directamente desde SQL: MVTEncodeGeom proyecta una geometría en el espacio de píxeles de un tile slippy-map y la recorta, MVTEncode agrega las geometrías proyectadas de un grupo en los bytes binarios de un tile de una sola capa, y MVTBoundingBox / MVTBoundingBoxMercator devuelven el cuadro delimitador de un tile para restringir las filas a él. Se admite geometría de punto, línea y polígono. También están disponibles con los alias de PostGIS ST_AsMVTGeom y ST_AsMVT. #106107 (Saarthak Gupta).
  • clickhouse-local ahora admite las consultas SYSTEM START LISTEN y SYSTEM STOP LISTEN, lo que permite transformarlo en un servidor que acepta conexiones TCP y HTTP. #101143 (Alexey Milovidov).
  • Se añadió un comando interactivo help a clickhouse-client y clickhouse-local. Al escribir help <name> (también /help, man o /man) se muestra la documentación de una función, table engine, tipo de dato, formato, setting u otro componente, renderizada a partir de Markdown en la terminal con resaltado de sintaxis SQL. Cuando la palabra es ambigua, se muestran todas las coincidencias; si no se encuentra, se sugieren nombres similares. #108042 (Alexey Milovidov).
  • Se admite la escritura en Azure Data Lake Storage Gen2. #105406 (Konstantin Vedernikov).
  • Se añade el formato RowBinaryWithNamesAndTypesAndDefaults para ofrecer mejor compatibilidad con schema evolution. #105736 (Mark Zitnik).
  • Se implementa ADD ENUM VALUES en consultas ALTER TABLE para simplificar la adición de nuevos valores a un tipo Enum existente sin tener que volver a especificar todos los valores actuales de Enum. #93830 (Ilya Golshtein).
  • La vista materializada actualizable ahora admite REFRESH DEPENDS ON para desencadenar actualizaciones en función de las actualizaciones de otra RMV, en lugar de hacerlo según una programación basada en tiempo. (REFRESH EVERY ... DEPENDS ON ya existía, pero no podía usarse de forma fiable para este caso de uso). Consulte la documentación de CREATE MATERIALIZED VIEW. #104440 (Michael Kolupaev).
  • Se añade soporte para seleccionar columnas por patrón de nombre con * LIKE '<pattern>' y * ILIKE '<pattern>', incluidas formas calificadas como table.* LIKE '<pattern>' y table.* ILIKE '<pattern>'. LIKE hace coincidir los nombres de columna de forma sensible a mayúsculas y minúsculas, mientras que ILIKE lo hace de forma no sensible a mayúsculas y minúsculas. #104569 (Yue Ni).
  • Se añadió la sintaxis ESCAPE, que define un carácter de escape personalizado en un patrón LIKE, lo que permite tratar % y _ como caracteres literales en lugar de wildcards. #99774 (Ilya Yatsishin).
  • Se añaden los table settings de MergeTree materialize_projections_on_insert y materialize_projections_on_merge. Cuando materialize_projections_on_insert = 0, las operaciones INSERT omiten la creación de projection parts, lo que mejora el throughput de inserción en tablas con muchas projections. Cuando materialize_projections_on_merge = 1, una merge vuelve a crear una projection que falta en todas sus partes de origen, de modo que las projections pueden generarse durante las merges en lugar de on insert. Las merges siguen combinando solo partes que comparten el mismo conjunto de projections. #100993 (Christoph Wurm).
  • Se añade un nuevo setting inmutable de MergeTree, allow_tuple_element_aggregation, desactivado de forma predeterminada. Cuando está habilitado, SummingMergeTree, AggregatingMergeTree y CoalescingMergeTree aplanan recursivamente las columnas Tuple y realizan la agregación de cada elemento hoja de forma independiente durante las merges, exactamente igual que si fuera una columna de nivel superior: SummingMergeTree lo suma, AggregatingMergeTree fusiona su estado de función de agregación y CoalescingMergeTree conserva su último valor no NULL. El setting debe especificarse al crear la tabla y los engines que no lo admiten lo ignoran silenciosamente. #98039 (johnjing).
  • Nuevas funciones quantizeBFloat16ToInt8 y dequantizeInt8ToBFloat16: un códec escalar que comprime componentes de embeddings a 8 bits mediante un cuantizador gaussiano Lloyd-Max de 256 niveles, del que pueden extraerse códigos Int4/Int2/binarios mediante truncamiento de bits. #108102 (Alexey Milovidov).
  • Se agregan las funciones arrayTopK y arrayBottomK: - arrayTopK(k, array) devuelve los K elementos más grandes en orden descendente - arrayBottomK(k, array) devuelve los K elementos más pequeños en orden ascendente. #104563 (Vitaly Baranov).
  • Se agregó una nueva tabla del sistema system.iceberg_files que expone metadatos por archivo para las tablas Iceberg, con una fila por cada archivo de datos o de eliminación en la instantánea actual de cada tabla. Esto cierra #98777. #104415 (Asya Shneerson).
  • Se agregó la tabla system.constraints, que proporciona información sobre todas las restricciones CHECK y ASSUME de todas las tablas, incluido el nombre de la restricción, el tipo y la expresión. #105337 (Pedro Ferreira).
  • Se agregó una nueva tabla system.dictionary_layouts que enumera las estructuras de diccionario disponibles junto con documentación integrada (description, syntax, examples, introduced_in, related). #106182 (Alexey Milovidov).
  • Se agregó una nueva tabla system.dictionary_sources que enumera los orígenes de diccionario disponibles junto con documentación integrada (description, syntax, examples, introduced_in, related). #106184 (Alexey Milovidov).
  • Se agregó una nueva tabla system.data_skipping_index_types que enumera los tipos de índices de omisión de datos disponibles junto con documentación integrada (description, syntax, examples, introduced_in, related). #106186 (Alexey Milovidov).
  • Se agregó una nueva tabla system.disk_types que enumera los tipos de disco disponibles junto con documentación integrada (description, syntax, examples, introduced_in, related). #106187 (Alexey Milovidov).
  • Se implementó SYSTEM RESTART DISK <name>: ahora vuelve a cargar los metadatos en memoria de un disco y vuelve a escanear las partes de datos de las tablas con réplica de solo lectura ubicadas en él. Esto permite que una réplica de solo lectura de una tabla en almacenamiento compartido plain_rewritable vea bajo demanda los datos escritos por otro servidor, sin esperar a refresh_parts_interval ni reiniciar el servidor. #106645 (Jordi Villar).
  • Ahora se admite la sintaxis de estilo PostgreSQL expr OP SOME(array) / expr OP ALL(array) (con un lado derecho que no es una subconsulta), y se reescribe como has / NOT has para =/<>, o como lambdas arrayExists / arrayAll para otros operadores de comparación. No se acepta ANY para la forma de array porque any también es una función de agregación; use SOME en su lugar. La forma con subconsulta de ANY/SOME/ALL se sigue reduciendo a IN / NOT IN. #105129 (Alexey Milovidov).
  • Se agregaron dos nuevas estrategias de load_balancing, hostname_longest_common_prefix y hostname_longest_common_suffix, que prefieren la réplica cuyo hostname comparte el prefijo común más largo (respectivamente, sufijo) con el hostname del iniciador. Son útiles cuando el centro de datos está codificado como prefijo o sufijo de hostnames cuyos segmentos numéricos tienen longitud variable, donde las estrategias existentes nearest_hostname y hostname_levenshtein_distance eligen la réplica incorrecta. #107360 (Denny [DBA at Innervate]).
  • Se agregó información del certificado de cliente TLS (subjects, número de serie, emisor y período de validez) a la tabla system.session_log para mejorar la observabilidad de la autenticación basada en certificados. #107679 (Alexey Milovidov).
  • Se agregó una credencial opcional external_id para el acceso a S3 basado en roles. #106941 (Elian Gidoni).
  • Se agregó una nueva configuración de S3Queue, after_processing_move_preserve_path. Cuando se habilita junto con after_processing='move' y after_processing_move_prefix, los objetos procesados se mueven conservando su ruta de origen completa bajo el prefijo de destino, en lugar de aplanarse y dejar solo el nombre del archivo. #105354 (Asya Shneerson).
  • Se agregó la configuración del servidor message_queue_disable_insertion para deshabilitar la inserción desde motores de cola de mensajes (Kafka, RabbitMQ, NATS) en vistas materializadas adjuntas. Es útil para escenarios de réplicas de solo lectura. #104911 (JIaQi Tang).
  • Se agregaron LOCALTIME y LOCALTIMESTAMP (sintaxis estándar de SQL / PostgreSQL). LOCALTIMESTAMP es un alias de now() (devuelve DateTime); LOCALTIME devuelve la hora actual del día como un valor Time. #106139 (Thomas Cabral).
  • Se agregó date_part('unit', expr) como azúcar sintáctico para EXTRACT(unit FROM expr). Se admiten todos los tipos de interval estándar y los extras de PostgreSQL (epoch, dow, doy, isodow, isoyear, century, decade, millennium). #105127 (Alexey Milovidov).
  • EXTRACT(TIMEZONE_HOUR FROM dt) y EXTRACT(TIMEZONE_MINUTE FROM dt) compatibles con PostgreSQL para las partes de hora y minuto de un desfase de zona horaria, y EXTRACT(<unit> FROM INTERVAL n <unit>) / date_part('<unit>', INTERVAL n <unit>) para extraer el valor de un intervalo. #106227 (Vinayak Joshi).
  • Se agregaron alias de agregación min_by y max_by para argMin y argMax. #105712 (Joey Yu). Estos alias son estúpidos; los ingenieros de verdad usan los nombres originales de ClickHouse.
  • Se agregó REGEXP_SUBSTR como alias que no distingue entre mayúsculas y minúsculas de regexpExtract para compatibilidad con Oracle/MySQL/Snowflake. #105122 (Alexey Milovidov).
  • Se agregó SESSION_USER como alias que no distingue entre mayúsculas y minúsculas de currentUser() para compatibilidad con PostgreSQL / SQL estándar. #106081 (Takumi Hara).
  • Ahora se admite un modificador final NULL / NOT NULL en ALTER TABLE ... ADD/MODIFY COLUMN, en consonancia con CREATE TABLE. #106150 (Takumi Hara).
  • Ahora puede usar la función h3PolygonToCellsWithContainment de h3 para aprovechar su nuevo algoritmo, que admite modos de contención basados en centro, totalmente contenidos y superpuestos. #104455 (Youssef Kadry).
  • Añade los indicadores IPV4_PREFIX_BITS and IPV6_PREFIX_BITS cuando la generación de claves se realiza mediante IP_ADDRESS o FORWARDED_IP_ADDRESS. #89270 (Aditya Chopra).
  • formatReadableTimeDelta ahora acepta como entrada una expresión INTERVAL de un tipo distinto de Month y Year. #64315 (Francisco J. Jurado Moreno).
  • El usuario ahora puede especificar un argumento de precisión opcional para las funciones formatReadableSize, formatReadableDecimalSize y formatReadableQuantity, que controla la cantidad de dígitos después del punto decimal. El valor predeterminado es 2, lo que conserva el comportamiento anterior. #104648 (Antonio Filipovic).
  • Añade la configuración output_format_float_precision para controlar la cantidad de dígitos decimales en la salida de texto de números de coma flotante. #99721 (phulv94).
  • Se añadió la configuración output_format_always_write_decimal_point_in_float_and_decimal para imprimir siempre un punto decimal en números de coma flotante y Decimal en formatos de texto, incluso cuando el valor es un número entero. Por ejemplo, genera 1. en lugar de 1. Está desactivada de forma predeterminada. #62614 (Ilya Yatsishin).
  • Añade compatibilidad con los nuevos elementos de configuración de handler HTTP <url_prefix> y <full_url_prefix> (coinciden con todas las rutas bajo una ruta base; son útiles, por ejemplo, para handlers de Prometheus), así como con <url_regexp>, <full_url_regexp> y <headers_regexp>. La forma antigua <url>regex:...</url> ahora está obsoleta. #107492 (Vitaly Baranov).
  • Añade compatibilidad con las estadísticas basic, una estadística compacta por columna que almacena mínimos y máximos numéricos, la longitud media de las cadenas y el recuento de NULL cuando corresponde. #106048 (Han Fei).
  • Añade compatibilidad con nodos TTL en ClickHouse Keeper, con activación explícita mediante el indicador de feature create_ttl. #100397 (Konstantin Vedernikov).
  • Introduce una función de reserva de memoria para cargas de trabajo. Consulte la documentación sobre planificación de cargas de trabajo. #82414 (Sergei Trifonov).

Funcionalidad experimental

  • Ejecución distribuida de consultas en varias etapas: el planificador divide el plan de consulta en etapas conectadas mediante intercambios scatter / broadcast / gather / shuffle y distribuye los fragmentos del plan entre los nodos worker. Los datos entre etapas se transmiten por TCP o se pasan mediante archivos temporales en object storage compartido; esta ruta admite shuffle distribuido y broadcast hash joins, agregación por shuffle y ordenación distribuida. La funcionalidad es experimental y está deshabilitada de forma predeterminada. #106020 (Alexander Gololobov). El motor experimental de planes de consulta distribuidos (make_distributed_plan) ahora puede usar, para cada worker, un puerto distinto para el envío de tareas y otro para el intercambio de streaming, configurados por réplica en <remote_servers> con stateless_worker_port y streaming_exchange_port. Si no se establecen, se usan los puertos anteriores a nivel de server (stateless_worker_client.port y distributed_query.streaming_exchange_port). Esto permite ejecutar varios workers en un mismo host. #107885 (Alexander Gololobov).
  • Se añadió el algoritmo experimental de reordenación de join dphyp para inner joins como opción de la configuración query_plan_optimize_join_order_algorithm, así como la configuración query_plan_optimize_join_order_max_searched_plans, que limita la búsqueda del orden de join y recurre al siguiente algoritmo de la cadena cuando se supera ese límite; establézcala en 0 para mantener el comportamiento anterior de búsqueda sin límite. #98798 (Alexander Gololobov).
  • Se añadió la función aiEmbed para usar API de LLM y generar embeddings desde ClickHouse. #102922 (George Larionov).
  • Se añadió un canario experimental de Linux OOM: un proceso hijo de sacrificio al que el Linux OOM killer apunta antes que al proceso principal del server. Cuando se habilita con oom_canary_enable, alivia la presión de memoria purgando las cachés del asignador, cancelando consultas, cancelando merges y registrando un evento en system.crash_log. La respuesta al OOM requiere evidencia de OOM-kill en memory.events de cgroup v2. #101942 (Peng).
  • La interfaz de terminal web en /webterminal ahora es una funcionalidad lista para producción y está habilitada de forma predeterminada. Está controlada por la nueva configuración de server enable_webterminal; la antigua configuración allow_experimental_webterminal está obsoleta, pero sigue respetándose por compatibilidad con versiones anteriores. Para deshabilitar el endpoint, establezca enable_webterminal en false. #106255 (Alexey Milovidov).
  • Los endpoints HTTP de PromQL ahora permiten especificar la base de datos y la tabla mediante query parameters de la URL (database=, table=, o table=db.table). Se eliminó el fallback implícito anterior a la tabla default.prometheus: si ni la configuración del handler ni la URL especifican una tabla, el handler ahora devuelve The time series table name is not set. Para mantener el comportamiento anterior, configure <table>default.prometheus</table> o pase table=... en la URL. #107553 (Vitaly Baranov).
  • Se añadió soporte para la función histogram_quantile de PromQL en las Table functions prometheusQuery y prometheusQueryRange. Esto permite calcular cuantiles sobre buckets de histogramas clásicos de Prometheus identificados por la etiqueta le. #103477 (Joe Smith).
  • Se añadió el modo diferido de aplicación de posting list para el índice de texto. Cuando se habilita mediante SET allow_experimental_text_index_lazy_apply = 1 y SET text_index_posting_list_apply_mode = 'lazy', las posting lists se decodifican bajo demanda con granularidad de bloque empaquetado mediante un enfoque basado en cursores, en lugar de materializarse por completo en Roaring Bitmaps, lo que reduce el uso de memoria y el tiempo de CPU en las consultas sobre índice de texto selectivas. #100035 (Peng).
  • Se agregó compatibilidad con la ABI de AssemblyScript para UDFs de WebAssembly. Puede probar la ABI de AssemblyScript sin instalar la cadena de herramientas localmente usando el playground en el navegador, que compila código de AssemblyScript y carga el módulo de WebAssembly resultante en ClickHouse local. #104606 (Vladimir Cherkasov).
  • Ahora se pueden adjuntar handler de Prometheus en el puerto HTTP principal con un prefijo opcional. #104975 (James Cunningham).
  • Se agregó una configuración experimental de MergeTree, packed_skip_index_max_bytes, que agrupa substreams pequeños de índices de omisión en un único archivo skp_idx.packed por parte, lo que reduce la presión sobre los inodos cuando se definen muchos índices de omisión en una tabla. La decisión se toma por substream en el momento de la escritura: los substreams cuyo tamaño serializado se mantiene por debajo del umbral se incluyen en el archivo; los de mayor tamaño conservan el layout independiente skp_idx_<name>.idx2 / .mrk2. Una misma parte puede mezclar layouts. Los índices de texto completo no son compatibles y siempre se almacenan por archivo. El valor predeterminado es 0 (empaquetado deshabilitado). #105321 (Raúl Marín).
  • Se admite la serialización Buffers para UDFs de WebAssembly con ABI BUFFERED_V1, y se agrega webassembly_udf_enable_fuel como una configuración persistente para funciones UDF de WASM. #105574 (Antonio Andelic).
  • Se agrega una configuración experimental use_reader_executor (desactivada de forma predeterminada) que dirige las lecturas a un nuevo ReaderExecutor basado en pipeline en lugar de la cadena heredada de read buffers. #106570 (Sema Checherinda). Se agregaron métricas de observabilidad para la ruta de lectura experimental use_reader_executor, incluido un KPI modelado de costo de lectura (ReaderExecutorModeledCostMsPerRequestedMiB). #106968 (Sema Checherinda). Se introdujo el búfer ChainedBuffers detrás de la ruta de lectura experimental use_reader_executor, con la métrica ReaderExecutorChainedBufferBytes. #107210 (Sema Checherinda).
  • El orden descendente en las sorting keys de MergeTree (por ejemplo, ORDER BY (time DESC, key)) ahora siempre es compatible y ya no requiere la configuración experimental allow_experimental_reverse_key, que quedó obsoleta. #106440 (Nikita Mikhaylov).
  • Nullable(Tuple(...)) ahora es Beta. Está deshabilitado de forma predeterminada; establezca enable_nullable_tuple_type = 1 para usarlo. #107754 (Nihal Z. Miaji).

Mejora del rendimiento

  • Varios cambios en Keeper lo hacen, en conjunto, aproximadamente 2 veces más rápido (mejor procesamiento por lotes, canalización de mensajes al líder y canalización de escrituras en el log). #101757 (Michael Kolupaev).
  • Reduce la sobrecarga por consulta en consultas SELECT simples (análisis sintáctico, análisis y planificación). Por ejemplo, SELECT count() FROM hits desde una sola conexión es aproximadamente un 50 % más rápido. #104513 (Raúl Marín).
  • Optimiza el análisis del índice de clave primaria para claves primarias largas y de alta cardinalidad. En una clave primaria larga, el tiempo de ejecución del análisis del índice ahora depende principalmente de la complejidad del filtro de la consulta (las columnas clave que realmente utiliza), no de la longitud de la clave primaria; por tanto, ampliar la clave de ordenación añade una sobrecarga prácticamente insignificante al análisis del índice en consultas que filtran solo por unas pocas de sus columnas. En una clave primaria de alta cardinalidad, donde ClickHouse mantiene en memoria solo un prefijo selectivo de las columnas clave y no carga las columnas finales, el análisis del índice ahora trabaja únicamente con ese prefijo en memoria en lugar de con la clave completa. La optimización está habilitada de forma predeterminada y puede desactivarse con la nueva configuración use_lightweight_primary_key_index_analysis. Cierra #65103. #91836 (Nihal Z. Miaji).
  • La build x86 predeterminada ahora tiene como objetivo x86-64-v3 (AVX2) en lugar de x86-64-v2 (SSE4.2). Esto requiere una CPU compatible con AVX2 (Intel Haswell o posterior, AMD Excavator o posterior). Si tu CPU no es compatible con AVX2, usa la build amd64compat, que apunta a x86-64 básico. #105019 (Raúl Marín).
  • Usa ipnsort y driftsort (ordenación estable), versiones portadas a C++ de las implementaciones de ordenación de la biblioteca estándar de Rust, para las ordenaciones de propósito general basadas en comparación. Acelera ORDER BY en columnas no numéricas y las ordenaciones estables, y elimina un caso desfavorable con entradas ordenadas en orden inverso. #106650 (Alexey Milovidov).
  • Nueva optimización de GROUP BY para claves de alta cardinalidad distribuidas uniformemente, que reparte las filas entre hilos aplicando hash a la clave de agrupación, de modo que cada hilo agrega un subconjunto disjunto de claves sin fase de merge. Establece enable_sharding_aggregator = 1 para habilitarla. #104233 (Nihal Z. Miaji).
  • Habilita el prefetching de tablas hash para consultas GROUP BY con claves de tipo cadena, lo que mejora en ~8 % el rendimiento de la agregación de cadenas de alta cardinalidad. #101007 (Le Zhang).
  • Se redujo el uso máximo de memoria al fusionar resultados parciales de agregación de dos niveles con estados de agregación grandes (por ejemplo, groupArray), liberando de forma incremental los estados de origen de cada bucket durante el merge en lugar de mantenerlos todos activos hasta completarlo. #102330 (Yuri Fedoseev).
  • Se optimizó la representación en memoria de Enum DataType. La huella de memoria de las tablas que incluyen el tipo Enum puede mejorar hasta 10 veces para el componente Enum. El tiempo necesario para recuperar el nombre a partir del valor (número) es similar o menor. La búsqueda por nombre es ligeramente más lenta, pero este patrón de acceso es menos habitual. #95668 (Ilya Yatsishin).
  • Agrega almacenamiento en caché para la resolución de identificadores, evitando resoluciones duplicadas durante el análisis de consultas. #88043 (Max Justus Spransy).
  • Mejora el rendimiento del análisis de consultas sobre tablas con muchas columnas: evita calcular los hashes de los nodos de columna (que incluyen toda la expresión de la tabla de origen) cuando no es necesario. El análisis de subconsultas SELECT * anidadas sobre una tabla con ~1200 columnas ahora es unas 50 veces más rápido. #106957 (Dmitry Novik).
  • Se aceleró el análisis de consultas con muchas llamadas a funciones o con llamadas a funciones profundamente anidadas al eliminar un hash redundante del árbol de consultas de la caché de resolución de funciones. #107516 (Dmitry Novik).
  • Se corrigieron las largas pausas al iniciar sesión y al arrancar consultas con almacenamiento de acceso replicado cuando muchas entidades de acceso (políticas de fila, roles, cuotas y perfiles de configuración) cambian a la vez. Ahora, cada caché por entidad se vuelve a calcular una vez por batch de notificaciones en lugar de una vez por cada entidad modificada, lo que elimina el trabajo cuadrático que podía mantener bloqueado el acceso durante minutos. #107672 (Azat Khuzhin).
  • Comparte el FixedHashMap del hash join como filtro en tiempo de ejecución de JOIN en el lado de sondeo. Cuando la tabla hash del lado de construcción es (o puede convertirse en) un FixedHashMap, se publica como filtro en tiempo de ejecución y sustituye al Set/BloomFilter que BuildRuntimeFilterStep instalaría de otro modo. Se controla con el nuevo setting join_runtime_filter_from_fixed_hash_table (valor predeterminado: true). #105640 (Xiaozhe Yu).
  • Aplicación diferida de los índices de selector y replicación en caso de JOIN seguido de un LIMIT selectivo, TopN u otro JOIN. Para controlar el número de columnas de carga útil necesario para habilitar los índices de selector diferidos, use el setting query_plan_min_columns_for_join_lazy_indexing (0 significa que la optimización está deshabilitada). Para controlar el LIMIT a partir del cual se aplica la optimización, use el setting query_plan_max_limit_for_join_lazy_indexing. #106566 (Hechem Selmi).
  • La reordenación de JOIN mediante DP (programación dinámica) ahora está permitida con réplicas paralelas. #105889 (Nikita Taranov).
  • Se mejoró el plan de consulta cuando JOIN usa Runtime Filters (enable_join_runtime_filters, activado de forma predeterminada): el modelo de costes de reordenación de join ahora atraviesa WindowTransform (y otros pasos del plan que preservan filas) en el subárbol derecho y usa el recuento de filas subyacente y el NDV por columna en lugar de asumir que no hay estadísticas. #107229 (UnamedRus).
  • Desvirtualiza la emisión de filas no emparejadas en RIGHT y FULL join agrupándolas en batch. #105679 (Hechem Selmi).
  • Admite métodos keys32 y keys64 packed en HashJoin. #107202 (Nikita Taranov).
  • Admite métodos keys32 y keys64 packed en Set. #107564 (Nikita Taranov).
  • Manejo más eficiente de columnas Nullable en aggregation. #106015 (Nikita Taranov).
  • Mejora el rendimiento de las consultas LIMIT BY. #103349 (Nihal Z. Miaji).
  • Acelera las consultas ORDER BY ... LIMIT BY ejecutando LIMIT BY dentro de cada flujo ordenado en paralelo durante Sort cuando las columnas de LIMIT BY son un prefijo de ORDER BY. Esto reduce el número de filas que pasan por la fusión de ordenación final y por cualquier etapa posterior del pipeline. Esta optimización está controlada por la nueva configuración query_plan_push_limit_by_into_sort (habilitada de forma predeterminada). #104000 (Nihal Z. Miaji).
  • Acelera las consultas SELECT ... LIMIT N BY <cols> cuando <cols> son un prefijo de la clave de ordenación de la tabla, o pasan a serlo después de que WHERE col = const fije las columnas iniciales. Con esta opción habilitada, MergeTree lee los datos en orden de clave primaria y LIMIT BY primero filtra en modo streaming con memoria O(1) por flujo ordenado, lo que descarta la mayor parte de los datos; después, ejecuta LIMIT BY normal sobre los datos reducidos para obtener el resultado final. Está controlado por la nueva configuración optimize_limit_by_in_order (habilitada de forma predeterminada). #105135 (Nihal Z. Miaji).
  • Acelera las consultas LIMIT BY en tablas MergeTree particionadas ejecutando LIMIT BY dentro del flujo de cada partición en paralelo, en lugar de fusionar todos los flujos en uno antes de aplicar el límite. Esto se aplica cuando la expresión de partición es una función determinista de las columnas de LIMIT BY, de modo que ningún grupo de LIMIT BY pueda abarcar dos particiones. Está controlado por la nueva configuración allow_limit_by_partitions_independently (habilitada de forma predeterminada). #105126 (Nihal Z. Miaji).
  • Acelera las consultas LIMIT BY eliminando expresiones de clave redundantes: se descarta una clave que sea una función determinista de las demás claves (p. ej., LIMIT 5 BY x, f(x) pasa a ser LIMIT 5 BY x) y una función inyectiva de una clave se sustituye por su argumento (p. ej., LIMIT 5 BY toString(x) pasa a ser LIMIT 5 BY x). Esto hace que se evalúen menos expresiones, y más baratas, por fila. Está controlado por las nuevas configuraciones optimize_limit_by_function_keys y optimize_injective_functions_in_limit_by, ambas habilitadas de forma predeterminada. #106818 (Nihal Z. Miaji).
  • Acelera la agregación por segmentos, la distribución en buckets de joins grace_hash y la partición de ventanas en paralelo reemplazando el hash por columna y por fragmento con un kernel que usa CRC32C por hardware. #106538 (Harikrishnan Prabakaran).
  • Optimiza L1Distance, L2Distance, L2SquaredDistance, LinfDistance y cosineDistance para argumentos de tipo Array con vectorización automática multidestino en x86-64-v4/v3. Para argumentos Array no constantes, ahora todos ellos excepto LpDistance, que usa std::pow con un exponente en tiempo de ejecución, pueden usar kernels vectorizados por el compilador. Se conservan las rutas rápidas existentes para argumentos constantes con AVX-512 y BFloat16 de Sapphire Rapids en L2Distance y cosineDistance. #101310 (Peng).
  • Se mejoró el rendimiento de las funciones {Norm}Distance y dotProduct. #106007 (Nikita Taranov).
  • Se mejoró el rendimiento de la función arrayNorm. #106211 (Nikita Taranov).
  • El rendimiento de dotProduct mejoró en algunos casos. #106210 (Nikita Taranov).
  • Se mejoró el rendimiento de las rutas const-left de AVX-512 para L2Distance y cosineDistance en Array(Float32), Array(Float64) y Array(BFloat16) cuando la longitud del array es divisible exactamente por el ancho del procesamiento vectorizado. #104625 (Sergey Kuznetsov).
  • Se habilitó la generación de código AVX-512 para AMD y se mejoró la generación de código para arrayDistance. #106505 (Nikita Taranov).
  • Se mejoró el rendimiento de las funciones L2DistanceTransposed y cosineDistanceTransposed para el tipo de dato QBit. #106701 (Raufs Dunamalijevs).
  • Se mejoró el rendimiento de las funciones encrypt, decrypt, tryDecrypt, aes_encrypt_mysql y aes_decrypt_mysql hasta en un orden de magnitud, recuperando el rendimiento perdido en la migración de BoringSSL a OpenSSL 3.x (24.4). #107339 (Konstantin Bogdanov).
  • Se mejoró el rendimiento de las funciones encrypt, decrypt y halfMD5 al evitar búsquedas implícitas del proveedor de OpenSSL por fila en OpenSSL 3.x. #99105 (Konstantin Bogdanov).
  • Se añadió una implementación SIMD de SHA1 que calcula el hash de múltiples entradas en paralelo con AVX-512, lo que mejora el rendimiento. #105459 (Joanna Hulboj).
  • Se añadió un backend AArch64 ASIMD/NEON para la implementación de MD5 con múltiples búferes. #105563 (Venkata Vineel ).
  • Se compactan los bloques de origen antes de calcular la proyección durante MATERIALIZE PROJECTION para reducir el número de partes de proyección temporales y la sobrecarga de las fusiones. ~3,4x más rápido en una tabla de 50 millones de filas. #100047 (Amos Bird).
  • Se redujo la latencia de INSERT para las tablas MergeTree con índices de omisión en columnas ORDER BY al evitar permutaciones redundantes de columnas durante la escritura de partes (~17 % en cargas de trabajo de tipo trazas). #101101 (Amos Bird).
  • Se habilitaron las rutas de código SIMD de Arrow’s (NEON en ARM, SSE4.2/AVX2/AVX512 en x86) y se utilizaron para acelerar la decodificación de columnas Parquet FLOAT/DOUBLE codificadas con BYTE_STREAM_SPLIT. #106376 (Raúl Marín).
  • Se mejoró el rendimiento de inserción para columnas LowCardinality con índices bloom_filter. #106410 (Michael Jarrett).
  • Se paralelizaron las copias de blobs en DiskObjectStorageTransaction::copyFile mediante un pool de hilos por disco. #105089 (Asya Shneerson).
  • Se evitó leer el contenido de los archivos al usar el formato de entrada One con funciones de tabla de tipo archivo como file y s3. #105157 (Yue Ni).
  • Se aceleró el arranque de clickhouse en macOS aproximadamente 3x al no exportar símbolos dinámicos, que de otro modo el enlazador dinámico procesaría en cada inicio. #107768 (Raúl Marín).
  • Se acelera la carga de la filesystem cache al iniciar al evitar una apertura redundante del directorio por cada clave de caché. #107414 (Alexey Milovidov).
  • Se acelera la carga de la filesystem cache al iniciar permitiendo que los hilos que listan directorios ayuden a cargar los metadatos de la caché una vez finalizado el listado, en lugar de dejar inactiva a la mitad de los hilos. #107416 (Alexey Milovidov).
  • Se redujo la sobrecarga de inicio del proceso clickhouse al actualizar la library WasmEdge incluida, que ya no genera un hash secreto aleatorio en un inicializador global en cada arranque. #107869 (Raúl Marín).
  • La primary key de MergeTree y los skip indexes ahora pueden descartar granules para filters en los que ifNull o coalesce envuelven una condición, como ifNull(key = 0, 0) o coalesce(key = 0, 0). Estos predicates —a menudo generados por generadores de consultas para convertir una comparación posiblemente NULL en un valor booleano definido— antes eran opacos para el análisis de índices y no podían omitir granules. Esto amplía la configuración existente allow_key_condition_coalesce_rewrite (habilitada de forma predeterminada). Cierra #106264. #106272 (Andy Zhao).
  • La evaluación de skip index sobre tipos DateTime64 debería consumir menos CPU en la versión 26.6. #107707 (Shankar Iyer).
  • Se mejoró el rendimiento del análisis de text index en búsquedas de varios tokens optimizando el manejo de tokens poco frecuentes. #98226 (Anton Popov).
  • Se usa una caché para los segments comprimidos de las listas de postings del text index. #106299 (Anton Popov).
  • Se mejoró el rendimiento de la búsqueda de exclusión genérica para consultas que seleccionan grandes rangos consecutivos de la tabla. #93813 (Michael Jarrett).
  • Los client S3 con el mismo endpoint y bucket comparten una caché, lo que evita el descubrimiento duplicado de regiones. Cierra #92482. #96802 (Andrey Zvonov).
  • Si una consulta contiene has(<constant array>, <expr>), el analyzer transformará el nodo para usar una implementación de in más rápida si es viable hacerlo. #97341 (Shankar Iyer).
  • Cuando se programa un nuevo job en ThreadPool, se activa el worker thread inactivo más reciente (LIFO) en lugar de uno arbitrario. Esto reduce la fragmentación de memoria causada por las cachés de allocator por hilo. El orden en que se procesan los jobs no cambia. #100177 (Alexey Milovidov).
  • Se mejoró el rendimiento de los Runtime Filters aproximados y de los Bloom filter indexes. #100201 (Christoph Viebig).
  • Se permite que ASOF JOIN use el join algorithm parallel_hash, paralelizando la construcción entre distintos valores de clave de igualdad. Antes, ASOF quedaba excluido incondicionalmente de parallel_hash. #105375 (Greg Maher).
  • Se evita leer entradas no acotadas para consultas INTERSECT y EXCEPT cuando una entrada vacía permite saber de antemano que el resultado estará vacío. #105393 (Yue Ni).
  • Se añadió constinit para varios bloqueadores de MemoryTracker. #105490 (Azat Khuzhin).
  • Se mejoró el rendimiento de bitmapContains para estados groupBitmap que no son UInt64, evitando llamadas repetidas a rb_max durante las comprobaciones de rango. #105960 (Yue Ni).
  • Consultas discontinuas más rápidas para columnas LowCardinality respaldadas por un único diccionario. #103662 (Ivan Babrou).
  • Se añadió una ruta rápida para la fase de probe de HashJoin cuando el bloque tiene una sola fila. #106008 (Nikita Taranov).
  • Los predicados de consultas como SELECT ... FROM view(SELECT ... FROM remote(...)) WHERE ... ahora se insertan en la consulta enviada al shard remoto. A la optimización allow_push_predicate_ast_for_distributed_subqueries le faltaba un caso para las funciones de tabla. #105986 (Nikolai Kochetov).
  • enable_join_transitive_predicates ahora está activado de forma predeterminada. #103724 (Alexander Gololobov).
  • Se añadió compatibilidad con las funciones multiSearchAny, multiSearchAnyUTF8 y multiMatchAny en índices de texto. También se mejoró el análisis de índices de texto para la función match: ahora los patrones con grupos alternativos pueden omitir más gránulos. #106279 (Anton Popov).
  • Se permite que los filtros introducidos después de la selección PREWHERE inicial (predicate pushdown, runtime filters o un PREWHERE explícito más un WHERE establecido por el planificador) se fusionen con el PREWHERE existente en una segunda pasada del optimizador, en lugar de permanecer como un paso Filter independiente sobre la lectura de MergeTree. #105445 (Yarik Briukhovetskyi).
  • QueryConditionCache ahora registra individualmente los gránulos descartados por filtrado, incluso dentro de lotes de lectura que solo pasan PREWHERE de forma parcial, lo que reduce el número de marcas releídas por consultas posteriores con la misma condición. #105335 (Han Fei).
  • Se añadió la configuración de Keeper nuraft_use_bg_thread_for_snapshot_io, activada de forma predeterminada, para que NuRaft lea objetos de snapshot desde un hilo en segundo plano en lugar de desde los hilos de trabajo de Raft. #106285 (Antonio Andelic).
  • Se reduce el uso máximo de memoria al aplicar snapshots recibidos en ClickHouse Keeper con KeeperMemoryStorage. #105851 (Antonio Andelic).
  • Las allocations de LLVM/JIT ahora se enrutan a una arena dedicada de jemalloc. Esto reduce la fragmentación de RSS causada por intercalar la contabilidad de JIT de larga duración con allocations de consultas de corta duración. Añade nuevas métricas asíncronas jemalloc.jit_arena.active_bytes, jemalloc.jit_arena.dirty_bytes, CompiledExpressionCacheBytesMax y CompiledExpressionCacheCountMax para la observabilidad. SYSTEM DROP COMPILED EXPRESSION CACHE ahora también elimina las instancias subyacentes de CHJIT y purga la arena de JIT. #104113 (Raúl Marín).
  • Se corrige la reserva excesiva de memoria al leer columnas Nullable(String) dispersas y codificadas con diccionario desde Parquet con el lector nativo V3. #102805 (Francisco).
  • Se corrigió que CREATE TABLE ... CLONE AS (and REPLACE / ATTACH PARTITION ... FROM) en discos cifrados copiara los datos en lugar de crear hardlinks. #106731 (Nikita Mikhaylov).
  • Se mejoró la estimación de cardinalidad en el optimizador del plan de consulta: una columna producida por una función determinista de un solo argumento (p. ej., toYear(date)) ahora hereda, como límite superior, el número de valores distintos de su argumento en lugar de quedar sin estadísticas, lo que permite una reordenación de join más precisa. #107757 (Alexander Gololobov).
  • Se redujo la sobrecarga de CPU del registro asíncrono con altas tasas de logs al notificar al consumidor de logs solo en la transición de cola vacía a cola no vacía, en lugar de hacerlo en cada mensaje. #107352 (Nikita Mikhaylov).
  • Se eliminaron cálculos duplicados durante la ejecución de consultas en más casos. #106113 (Yarik Briukhovetskyi).
  • Se paralelizó el procesamiento del resultado de una CTE recursiva: una operación GROUP BY u otra operación sobre un resultado grande de WITH RECURSIVE ya no está limitada a un solo hilo. #107694 (Alexey Milovidov).
  • Se mejoró el rendimiento de la búsqueda de subcadenas sin distinguir entre mayúsculas y minúsculas (positionCaseInsensitiveUTF8, ILIKE, multiSearchAnyCaseInsensitiveUTF8 y funciones relacionadas) al añadir una ruta SIMD NEON en ARM y un kernel AVX2 más amplio en x86. #107882 (Raúl Marín).
  • Se corrigió una regresión de ~16 % en el rendimiento del códec FPC de coma flotante en ARM que se introdujo cuando sus tablas predictoras empezaron a usar VectorWithMemoryTracking. #108182 (Groene AI).

Mejora

  • El MemoryWorker en segundo plano ahora actualiza periódicamente el límite estricto de memoria del server en función del uso actual de memoria y de la cantidad de memoria que el kernel informa como disponible, para que ClickHouse deje margen para otros procesos que se ejecutan en el mismo host. La fórmula es (resident memory + system MemAvailable) * max_server_memory_usage_to_ram_ratio. El mismo server setting max_server_memory_usage_to_ram_ratio controla tanto el límite al inicio como el ajuste dinámico; establézcalo en 0 para desactivar ambos. Para mantener solo el límite estático al inicio/recarga (el comportamiento de las versiones anteriores), establezca el nuevo server setting memory_worker_dynamic_hard_limit en 0. #104964 (Alexey Milovidov).
  • Compatibilidad con PostgreSQL client para C# en el protocolo PostgreSQL. Esto cierra #18611. #80785 (Konstantin Vedernikov).
  • Las mutations ahora usan el analyzer. #98884 (Nikolai Kochetov).
  • Se añadió un control granular sobre la repetición de consultas en la CLI. La opción --echo ahora acepta un valor booleano opcional y funciona tanto en modo interactivo como en batch mode. Las nuevas opciones --echo-formatted y --echo-query-id controlan si las consultas repetidas se formatean y si se imprime query_id, respectivamente. La opción --hilite/--highlight ahora también controla el resaltado de las consultas repetidas. Como efecto secundario, --echo ahora es una opción con valor booleano, por lo que una consulta posicional situada justo después de un --echo sin valor se interpreta como su valor; use --echo --query "..." o --echo=false en su lugar. #106191 (Alexey Milovidov).
  • Compatibilidad con schema evolution junto con comprobaciones de consistencia concurrentes para catálogos de lago de datos. #106102 (Konstantin Vedernikov).
  • Se permite cache disk para los table engines de datalake. #102017 (RinChanNOW).
  • Se corrigió la lectura de datos de table en databases de DataLakeCatalog con catalog_type = 'onelake' usando de forma predeterminada el endpoint Blob de OneLake (.blob.fabric.microsoft.com). Establezca onelake_use_blob_endpoint = false para mantener el comportamiento anterior del endpoint DFS (.dfs.fabric.microsoft.com). #106843 (Konstantin Vedernikov).
  • Se actualizó el valor predeterminado del setting persistent_processing_node_ttl_seconds de S3(Azure)Queue de 1 hour a 6 hours (que representa el tiempo de limpieza debido a reinicios no limpios del service, etc.). El valor predeterminado anterior era adecuado para el ttl de los processing nodes, pero también se usa para el ttl del bloqueo del bucket, que puede mantenerse durante más tiempo; por lo tanto, 1 hora no era suficiente. #106838 (Kseniia Sumarokova).
  • Se redujo el tamaño predeterminado de la metadata cache de Iceberg de 1 GB a 128 MB. #106492 (Konstantin Vedernikov).
  • Se propaga el query_id de la tarea de streaming de S3Queue a los inserts de table dependientes. #106494 (Christoph Wurm).
  • Se puebla used_storages en system.query_log con el nombre del storage engine al consultar tables mediante DataLakeCatalog. #100706 (Melvyn Peignon).
  • Puede comprobar qué ‘operation’ y qué ‘summary’ tienen los snapshots de Iceberg. Es útil para pruebas y depuración. #106246 (Den Kalantaevskii).
  • Completa de forma asíncrona la solicitud final de multipart upload de S3 mediante el rastreador de tareas, para que pueda solaparse con la carga de la última parte en lugar de ejecutarse en serie durante la finalización. #105487 (Asya Shneerson).
  • Se añadieron cuatro nuevas configuraciones de tabla de MergeTree para controlar los parámetros predeterminados de los índices de texto: text_index_dictionary_block_size, text_index_dictionary_block_frontcoding_compression, text_index_posting_list_block_size y text_index_posting_list_codec. Estas configuraciones permiten ajustar el comportamiento de los índices de texto a nivel de tabla sin tener que especificar parámetros en cada definición de índice. Los argumentos explícitos por índice siguen teniendo prioridad. #100626 (Anton Popov).
  • Permite que las projections sobrescriban configuraciones adicionales de MergeTree (compresión, formato de part, serialización), además de index_granularity, con una lista de configuraciones permitidas y su correspondiente validación. #101170 (Amos Bird).
  • Añade las columnas current_projection, current_projection_progress, projections_completed y projections_remaining a system.merges para exponer el progreso de merge de las projections. #102611 (Amos Bird).
  • Se corrigió PREWHERE con una subconsulta IN sobre columnas de la primary key que no usaba el primary key index para la poda de gránulos, lo que provocaba full table scans en lugar de leer solo los gránulos relevantes. #102570 (Nikita Mikhaylov).
  • La función h3PolygonToCells ahora aplica el tamaño máximo de array a todos los polígonos de un MultiPolygon, valida los códigos de retorno de la biblioteca H3 subyacente y rechaza argumentos MultiLineString en lugar de devolver silenciosamente un resultado vacío. #106399 (Raúl Marín).
  • Añade una nueva tabla system.keeper_snapshots, solo para keeper, con información sobre snapshots locales de ClickHouse Keeper. #105571 (Miсhael Stetsyuk).
  • Añade una nueva tabla system.keeper_changelogs, solo para keeper, con información sobre archivos changelog locales de ClickHouse Keeper (log de Raft). #105617 (Miсhael Stetsyuk).
  • Añade una tabla system.keeper_cluster, solo para keeper. Contiene una fila por cada miembro del cluster de Raft, tal como lo ve el Keeper actual. #105646 (Miсhael Stetsyuk).
  • Añade más eventos de perfil de Keeper (server-side + client-side) para watches. Cierra #97703. #105336 (Konstantin Vedernikov).
  • Se añadieron coordination_settings de Keeper para limitar la admisión de log entries no confirmadas de NuRaft y para el throttling del sondeo hacia atrás de append-entries. #106108 (Antonio Andelic).
  • Añade la configuración enable_compression para la table function mysql, el table engine MySQL, el database engine MySQL, el Diccionario SOURCE(MYSQL) y las named collections. Cuando está habilitada, ClickHouse negocia la compresión a nivel del protocolo MySQL para todos los datos transferidos a través de la conexión. #103229 (Bernard Lim).
  • Se redujo la latencia de cancelación de las consultas que se ejecutan a través del PostgreSQL wire protocol: KILL QUERY ahora interrumpe la serialización de salida dentro de un solo fragmento en lugar de esperar a que se envíe el fragmento completo al client. #106535 (Roman Vasin).
  • Se redujo la latencia de cancelación de las consultas que se ejecutan a través del MySQL wire protocol: KILL QUERY ahora interrumpe la serialización de salida dentro de un solo fragmento en lugar de esperar a que se envíe el fragmento completo al client. #107228 (Roman Vasin).
  • Se corrigió la lectura de la longitud de auth_response en el handshake de MySQL, donde un byte de longitud >= 128 se interpretaba como un valor de varios gigabytes porque se leía como un char con signo. #107384 (uwezkhan).
  • MaterializedPostgreSQL ahora asigna las columnas PostgreSQL numeric(p, 0) con precisión superior a 76 (p. ej., numeric(78, 0) usado para enteros de 256 bits) a Int256 de ClickHouse en lugar de fallar con “Precision too big”. Los valores que no caben en Int256 se rechazan con un error claro. #107431 (Alexey Milovidov).
  • Envía una excepción al client cuando falla el establecimiento de la TCP connection. #107317 (Nikolai Kochetov).
  • Los usuarios ahora pueden insertar campos Fixed de Avro para variantes de enteros de 8, 16, 32 y 64 bits. #98139 (Patrick Pichler).
  • El format AvroConfluent ahora reintenta el Confluent Schema Registry HTTP client ante fallos transitorios (timeouts de transporte, conexión rechazada, errores de DNS, HTTP 5xx/408/429) con backoff exponencial, en lugar de abortar el INSERT ante el primer fallo de red. Los nuevos Settings format_avro_schema_registry_max_retries (valor predeterminado 5) y format_avro_schema_registry_retry_initial_backoff_ms (valor predeterminado 100) controlan esta política. Los errores de validación del schema (HTTP 409, JSON de Avro malformado) siguen siendo fatales. #106661 (Groene AI).
  • Registra los privileges en system.query_log.used_privileges para todas las comprobaciones de acceso concedidas, incluidas las que pasan por la ruta isGranted que no lanza excepciones (checkAccessWithFilter). Antes, solo se registraban los privileges comprobados mediante entry points que sí lanzan excepciones (checkAccess / checkGrantOption), lo que hacía que READ ON FILE / READ ON S3 / READ ON AZURE / READ ON URL fueran invisibles en el registro de auditoría para DESCRIBE, CREATE TABLE AS y consultas similares que usan table functions file / s3 / azure / url. La aplicación del control de acceso no cambia. #104693 (Alexey Bakharew).
  • Se añadieron las métricas asíncronas TotalUncompressedBytesOfMergeTreeTables y TotalUncompressedBytesOfMergeTreeTablesSystem, que informan del tamaño total sin comprimir de los datos almacenados en tablas de la familia MergeTree. #106364 (Alexey Milovidov).
  • Añade el evento de perfil GlobalMemoryLimitExceeded para que los operadores puedan supervisar cuándo se alcanza el límite de memoria global del servidor. #106466 (Sacheendra Talluri).
  • Se rellenan los contadores ExecutableUserDefinedFunction* de ProfileEvents para las UDF executable_pool. El número de invocaciones por llamada, el tiempo total y el tiempo de espera en el grupo, la CPU y la memoria pico de los procesos hijo, y los bytes de stdin/stdout ahora son visibles en system.query_log.ProfileEvents. #105010 (Xu Jia) #105618 (Ilya Andreev).
  • Se añadieron las métricas asíncronas ExecutableUserDefinedFunctionMemoryResidentBytes y ExecutableUserDefinedFunctionProcesses, que informan de la memoria residente (VmRSS) y del número de procesos activos de las user-defined functions executable y executable_pool, incluidos los procesos descendientes y los workers inactivos del grupo. #107300 (Hanzi Jiang).
  • Se añadieron tres métricas async solo para Linux — MemoryThreadStacksCount, MemoryThreadStacksVirtual y MemoryThreadStacksResident — que informan por separado de la memoria de pila de pthread con respecto al resto de la memoria anónima. Se habilitan mediante asynchronous_metrics_enable_heavy_metrics. Requiere Linux 5.17+ (prctl(PR_SET_VMA_ANON_NAME)) y que /proc/self/smaps sea legible; de lo contrario, las métricas no estarán disponibles y la limitación se notificará en system.warnings. #106230 (Raúl Marín).
  • Se exponen en macOS las métricas asíncronas MemoryThreadStacks* (tamaño residente/virtual y número de pilas de threads). #107752 (Raúl Marín).
  • Los motores de tabla ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas description, syntax, examples, introduced_in y related de la tabla system.table_engines. #106177 (Alexey Milovidov).
  • Los motores de base de datos ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas description, syntax, examples, introduced_in y related de la tabla system.database_engines. #106178 (Alexey Milovidov).
  • Los tipos de datos ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas description, syntax, examples, introduced_in y related de la tabla system.data_type_families. #106180 (Alexey Milovidov).
  • Los formatos de entrada/salida ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas description, examples, introduced_in y related de la tabla system.formats. #106181 (Alexey Milovidov).
  • Los combinadores de funciones de agregación ahora incluyen documentación integrada, que se puede inspeccionar mediante las nuevas columnas description, syntax, examples, introduced_in y related de la tabla system.aggregate_function_combinators. #106185 (Alexey Milovidov).
  • Se añadió la opción de línea de comandos --chime a clickhouse-client, clickhouse-local y al client integrado. Cuando una consulta finaliza (con éxito o con error) tras ejecutarse durante al menos N segundos, el client escribe el carácter de control ASCII BEL (\x07) en stderr. Los terminales deciden si emiten un sonido o un destello visual según las preferencias del usuario. Está habilitada de forma predeterminada con un umbral de 5 segundos; pase --chime N para usar un umbral personalizado o --chime 0 para deshabilitarla. Cierra #92718. #104545 (Groene AI).
  • En clickhouse-client, cuando el terminal no admite el pegado entre corchetes, los saltos de línea incrustados de una consulta multilínea pegada ahora se integran en el mismo búfer de edición en lugar de pasar al prompt de continuación en cada línea. La consulta pegada permanece bajo un único prompt y las teclas de flecha permiten desplazarse entre sus líneas. Se trata de una mejora aplicada en la medida de lo posible, que depende del comportamiento típico del pegado con búfer TTY. #104299 (Alexey Milovidov). Ahora también funciona con el resaltado de sintaxis desactivado (--highlight 0). #106665 (Alexey Milovidov).
  • Se añade control del paginador en runtime al estilo de MySQL para clickhouse-client/clickhouse-local. #105706 (Azat Khuzhin).
  • clickhouse-client ahora respeta los terminales no UTF-8: cuando la codificación de caracteres del terminal no es UTF-8 (por ejemplo, con LANG=C), los formatos Pretty usan bordes de cuadrícula ASCII en lugar de imprimir caracteres Unicode de dibujo de cuadros que corromperían el terminal. #106213 (Alexey Milovidov).
  • Se sanean las cadenas de visualización proporcionadas por el server en el manejo del paquete Hello de clickhouse-client (nombre del server, zona horaria, nombre para mostrar, patterns y mensajes de las reglas de contraseña) para que un server malicioso no pueda inyectar bytes que el client renderice literalmente, y se limita su tamaño para evitar una allocation sin límites. #105243 (Raúl Marín).
  • La web UI ahora muestra el resultado como una image cuando una consulta usa un output format de image como FORMAT PNG, en lugar de mostrar los bytes sin procesar como una table. #107638 (Alexey Milovidov).
  • Se añade la configuración output_format_pretty_use_nbsp_for_padding para renderizar el padding del diseño de tabla en los formatos Pretty de estilo tabla como U+00A0 NO-BREAK SPACE cuando output_format_pretty_grid_charset es UTF-8. Esto ayuda a que la Output de Pretty copiada conserve la alineación de la table en herramientas que contraen los espacios normales. La configuración está desactivada de forma predeterminada, y la Output con juego de caracteres ASCII conserva los espacios normales. #103559 (Ashrith Bandla).
  • El script de instalación universal ahora también instala clickhousectl en ~/.local/bin en Linux y macOS, con un enlace simbólico chctl. Establezca CLICKHOUSE_ONLY=1 para omitirlo. #105399 (Alasdair Brown).
  • Se corrigió un Syntax error: Unterminated quoted string espurio que podía producirse de forma intermitente al instalar ClickHouse mediante curl https://clickhouse.com/ | sh cuando ya existía un binario clickhouse en el directorio actual. #106417 (Alexey Milovidov).
  • Se corrige la altura del panel izquierdo en la página play.html cuando el terminal web está abierto, para que el botón de alternancia del terminal en la parte inferior siga siendo visible. #105087 (Alexey Milovidov).
  • Se evita seleccionar la única consulta en la web UI después de ejecutarla. #105711 (Joey Yu).
  • La web SQL UI ahora expande el editor de consultas cuando una consulta tiene como máximo un 30 % más de altura que la altura actual del editor. #105713 (Joey Yu).
  • En la interfaz web, dispone los iconos del menú inferior (Terminal web y GitHub) horizontalmente cuando el panel izquierdo está expandido, dando más espacio vertical a la lista de bases de datos y tablas. #106427 (Alexey Milovidov).
  • En la interfaz web (play.html), al pulsar Escape ahora se desactiva la celda seleccionada de la tabla de resultados. #107777 (Alexey Milovidov).
  • Mejoras en el panel de bases de datos de la interfaz web SQL (Play): un tooltip en el icono de la base de datos, un botón para ocultar el panel, nombres de bases de datos y tablas clicables en todo el ancho, y una corrección del cambio de ancho del panel cuando aparece la barra de desplazamiento. #108013 (Alexey Milovidov).
  • Añade una configuración del servidor (min_allocation_size_to_throw_on_memory_limit) para permitir que cualquier asignación lance MEMORY_LIMIT_EXCEEDED; esto debería ayudar a evitar OOM. #105265 (Azat Khuzhin).
  • Permite la autenticación NONE para SSH (evita pedir contraseña a los usuarios no_password). #105476 (Azat Khuzhin).
  • Restablece la lista de grupos suplementarios en clickhouse su antes de descartar privilegios, igualando el comportamiento de /bin/su y sudo. Antes, el proceso con privilegios descartados heredaba los grupos suplementarios del invocador. #105247 (Raúl Marín).
  • Añade compatibilidad con BFloat16 para las funciones de predicado numérico (isFinite, isNaN). #105391 (Mohamed Hussain S).
  • Reduce el uso de memoria de los diccionarios de polígonos (polygon_index_cell, polygon_index_each) y hace que system.dictionaries.bytes_allocated refleje correctamente el índice de búsqueda que construyen. #105431 (Raúl Marín).
  • Corrige los consumers del motor de tabla Kafka que seguían usando un intervalo de sondeo corto después de la asignación de particiones, para que vuelvan al kafka_poll_timeout_ms configurado y eviten sondeos vacíos excesivos, partes insertadas más pequeñas y sobrecarga adicional de merge tras los reequilibrios. #100431 (sugaf1204).
  • Identifica las columnas por posición (en lugar de por nombre) al eliminar columnas no utilizadas en el query plan. Esto permite eliminar columnas no utilizadas cuando hay nombres de columna duplicados. #100586 (János Benjamin Antal).
  • ClickHouse lanza una excepción adecuada cuando se intenta usar table_readonly con motores replicados, con un mejor manejo de excepciones para las consultas DDL (y DatabaseReplicated) relacionadas con esta configuración. #100950 (alesapin). OPTIMIZE TABLE ... ON CLUSTER y otras DDL ya no se bloquean cuando la tabla de destino tiene table_readonly = 1. La configuración ahora lanza un nuevo código de error específico, TABLE_IS_PERMANENTLY_READ_ONLY, que DDLWorker trata como no reintentable (distinto de TABLE_IS_READ_ONLY, transitorio, que surge durante desconexiones temporales de ZooKeeper en ReplicatedMergeTree). La configuración table_readonly ahora también se rechaza explícitamente para ReplicatedMergeTree, tanto durante la creación como mediante ALTER MODIFY SETTING. Seguimiento de #97652. #105109 (Alexey Milovidov).
  • Se corrigieron las actualizaciones de la vista materializada actualizable que podían fallar con UNKNOWN_TABLE después de reemplazar la tabla de destino (por ejemplo, mediante EXCHANGE TABLES o eliminándola y volviéndola a crear): ahora la actualización resuelve la tabla de destino por nombre en lugar de depender de un UUID obsoleto. #102724 (Seva Potapov).
  • Se añadió una configuración wait_for_part_commit_in_dependent_materialized_views (valor predeterminado: false). Cuando el SELECT de una vista materializada vuelve a leer de su propia tabla de origen (por ejemplo, mediante un INNER JOIN con el origen), la cascada podía omitir la fila que se estaba insertando en ese momento, porque la parte insertada solo se confirma después de que se ejecutan las vistas dependientes. Al habilitar esta configuración, la parte se confirma antes de que se activen las vistas dependientes, para que puedan ver la fila en tránsito, a costa de un menor paralelismo de inserción. #105943 (Elmi Ahmadov).
  • No ocultar errores fatales (p. ej., MEMORY_LIMIT_EXCEEDED) en tryDeserialize. #106808 (Azat Khuzhin).
  • Comprobar de forma diferida el permiso CREATE TEMPORARY TABLE en InverseDictionaryLookupPass. #107098 (Azat Khuzhin).
  • Se corrige un error ILLEGAL_TYPE_OF_ARGUMENT en consultas distribuidas con serialize_query_plan = 1 que contienen una lambda con un argumento constante (p. ej., arrayMap(t -> t.2, ...)). Las columnas constantes de los nodos INPUT de ActionsDAG ahora se conservan durante la serialización del plan de consulta. #107124 (Alexey Milovidov).
  • La deserialización de los estados de las funciones de agregación contingency, cramersV, cramersVBiasCorrected y theilsU ahora valida que los recuentos almacenados formen una tabla de contingencia coherente y, de lo contrario, lanza una excepción CORRUPTED_DATA. Cierra #106899. #107185 (Nihal Z. Miaji).
  • Se conservan los códigos de error originales de las excepciones encapsuladas en arrow::Status. #107267 (Azat Khuzhin).
  • Se admite keyed_by_normalized_query_hash para las cuotas definidas en la configuración estática del servidor (users.xml), en consonancia con la sintaxis DDL existente CREATE QUOTA ... KEYED BY normalized_query_hash. #107654 (Alexey Milovidov).
  • La configuración de compatibilidad ya no aplica configuraciones obsoletas, por lo que no las marca como modificadas ni genera advertencias de configuración obsoleta. #107737 (Maxim Orlovsky).
  • Las inserciones asíncronas ya no registran la lista completa de query_id en el nivel trace/debug, lo que desde la versión 26.2 podía hacer que text_log creciera en exceso en servicios con mucho tráfico de inserciones asíncronas. Las líneas detalladas ahora están en el nivel test. #107852 (Sema Checherinda).
  • Mejora de la caché del sistema de archivos: se evita que las entradas de prioridad invalidadas mantengan fijado KeyMetadata. Seguimiento de #106387. #107903 (Kseniia Sumarokova).
  • Mejora de las métricas de FileCache. #106116 (Kseniia Sumarokova).
  • No se imprime el preámbulo “Seguimiento de pila (al copiar este mensaje, incluya siempre las líneas siguientes):” en los mensajes de excepción cuando el seguimiento de pila está realmente vacío. #106524 (Alexey Milovidov).
  • Corrige un posible desbordamiento en roundUpToMultiple al calcular la alineación de límites de la filesystem cache para desplazamientos muy grandes. #92579 (Bharat Nallan).
  • EXPLAIN SYNTAX ahora formatea los operadores como llamadas a función de forma coherente en la salida de explicación (por ejemplo, plus(1, 2) en lugar de 1 + 2). #94681 (Mohamed Abdelhalim ).
  • Se mejoraron las sugerencias de nombres de tablas en los mensajes de error: ya no se sugiere exactamente el mismo nombre y ahora se incluye el nombre de la base de datos en la sugerencia (p. ej., “¿Quizá quiso decir other_db.my_table?”). #95116 (Mathuranath Metivier).
  • Se mejoró el mensaje de error para identificadores no resueltos en consultas sin cláusula FROM, sugiriendo añadir una. #101769 (Yash ).
  • Añade la opción EXPLAIN PIPELINE para compactar chains de processors repetidas. #104662 (Yue Ni).
  • Corrige una lectura con desbordamiento de búfer en el heap al construir el mensaje de error de sintaxis (UTF8::computeWidthImpl a través de parseQuery.cpp), que se producía cuando el parser había retrocedido más allá del primer token de punto y coma / fin de flujo; las builds release insertaban bytes de memoria vecina del heap en el error mostrado, mientras que las builds con ASan abortaban. #105086 (Groene AI).
  • Hace que la estrategia de partición de Hive sea la predeterminada en la compatibility setting file_like_engine_default_partition_strategy. #86746 (Kseniia Sumarokova).
  • Usa una pila de thread más grande (8 MiB) en macOS para igualar el valor predeterminado de Linux, corrigiendo bloqueos poco frecuentes del server por desbordamiento de pila durante la compilación JIT. #107033 (Raúl Marín).
  • El límite de tamaño del almacenamiento temporal de clickhouse-local ya no está fijado de forma rígida en 1 GiB. El valor predeterminado aumenta a 1 TiB y puede configurarse con la server setting max_temporary_data_on_disk_size. #106689 (Alexey Milovidov).
  • Añade el comando read-checksums a clickhouse-disks. Lee el archivo checksums.txt de un MergeTreeDataPart y lo imprime como una tabla legible para humanos, separada por tabulaciones. #106901 (Asya Shneerson).
  • Se añadió un comando read-bitmap a clickhouse-disks. #107834 (murphy-4o).
  • Chdig: habilita TLS para secure connections (antes esto provocaba “unknown setting skip_verify” o “connection reset by peer”). #105864 (Azat Khuzhin).
  • chdig v26.5.1. #105918 (Azat Khuzhin).
  • chdig v26.6.1 - {asynchronous_,}metric_log, patrones de consulta, mapas de calor, logs/trazas almacenados en disco (anteriormente podía usar >40GiB para 1 hora de trazas). #107678 (Azat Khuzhin).
  • La configuración del servidor (programs/server/config.xml) ahora establece keep_alive_timeout en 30 (antes 10), en consonancia con el valor predeterminado real documentado e implementado. #107779 (Dan Checkoway).
  • El valor predeterminado de la configuración del servidor disk_connections_rcvbuf cambió de 0 (autotuning TCP del kernel) a 204800 (200 KB), lo que limita el búfer de recepción TCP por socket para las conexiones a discos de almacenamiento de objetos (S3/Azure/GCS). #107859 (Sema Checherinda).
  • El optimizador PREWHERE ahora agrupa los conjuncts que hacen referencia al mismo conjunto de columnas antes de estimar la selectividad, de modo que condiciones como a > 2500 AND a < 2502 se evalúan juntas como un rango combinado en lugar de como dos predicados independientes, lo que produce una estimación de selectividad más precisa. #106337 (Han Fei).
  • Se añadieron implementaciones de sockets seguras y sin cifrar compatibles con silk fiber. #107680 (Miсhael Stetsyuk).
  • Se corrigieron un mensaje de error confuso (argumentos intercambiados) y un error tipográfico en la función nested. #108031 (Alexey Milovidov).
  • Se añadió un comando sed a clickhouse-disks que aplica una expresión de sed directamente sobre una ruta dada. #107131 (Asya Shneerson).
  • Se añadió la configuración materialized_postgresql_use_extended_date_and_time_types para el motor de base de datos MaterializedPostgreSQL, que se aplica en el momento de la creación. De forma predeterminada (habilitada), las columnas date/timestamp de PostgreSQL se infieren como Date32/DateTime64; si se establece en 0 al ejecutar CREATE DATABASE, se infieren los tipos más estrechos Date/DateTime. #107428 (Alexey Milovidov).

Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)

  • Hacer posible eliminar detached parts con el sufijo tryN. #58957 (János Benjamin Antal).
  • Corregir una excepción MULTIPLE_EXPRESSIONS_FOR_ALIAS en consultas con alias de proyección duplicados (por ejemplo, SELECT *, day + 365 AS day) dentro de subconsultas anidadas al ejecutarse con réplicas paralelas. #80310 (Alexey Milovidov).
  • Corregir un error por el que splitMultipartQuery lanzaba un error “Empty query” en consultas que terminan con un comentario después del punto y coma. #85491 (Yarik Briukhovetskyi).
  • Corregir una excepción con ARRAY JOIN: Function writeSlice expects same column types for GenericArraySlice and GenericArraySink, que se produce cuando se usan tipos numéricos LowCardinality (issue #57243). #91784 (Jimmy Aguilar Mena).
  • Corregir la excepción NOT_FOUND_COLUMN_IN_BLOCK al usar LIMIT BY con columnas constantes junto con DISTINCT y ORDER BY con el nuevo analizador. #93195 (Ashrith Bandla).
  • Corregir que las columnas NOT NULL se creen silenciosamente como Nullable cuando data_type_default_nullable = 1 y la tabla se crea en una base de datos Replicated o mediante ON CLUSTER. #97572 (xiaohuanlin).
  • Se corrigió la estabilidad de la conexión de HiveCatalog añadiendo un mecanismo de reintento automático y lógica de reconexión para manejar errores TTransportException al comunicarse con Hive Metastore. #98471 (Dmitriy Borisenko).
  • Se corrigió que la función nested (usada internamente por ARRAY JOIN) eliminara LowCardinality de los tipos de columna, haciendo que Array(LowCardinality(String)) pasara a ser Array(String) en la salida. Cierra #95582. #98974 (Yash ).
  • Corregir la excepción “Distributed task iterator is not initialized” al usar url, s3 u otras funciones de tabla similares en consultas con réplicas paralelas habilitadas. #100146 (Alexey Milovidov).
  • Corregir una excepción de error lógico al leer tablas Iceberg cuya versión de formato fue actualizada por una herramienta externa (p. ej., Spark). #100407 (Alexey Milovidov).
  • Las funciones like, ilike, notLike, notILike y match ahora admiten una cadena de búsqueda constante con un patrón no constante (p. ej., 'foo' LIKE pattern_column), lo que antes lanzaba ILLEGAL_COLUMN. #100479 (Yash ).
  • Se corrigió el recuento incorrecto de filas devuelto por una consulta MaterializedView con query_plan_enable_optimizations = 0 cuando la vista asigna una columna entera a una columna Bool. #100692 (Maksim Moisiuk).
  • Corregir una excepción (LOGICAL_ERROR: 'PREWHERE passed to format that doesn't support it') al leer tablas Iceberg que contienen archivos de datos ORC con la optimización de PREWHERE habilitada. #101206 (Groene AI).
  • Corrige una condición de carrera en RestCatalog. #101216 (Smita Kulkarni).
  • Corrige el error NOT_FOUND_COLUMN_IN_BLOCK al seleccionar desde una VIEW sobre una tabla con una proyección normal. #101218 (Amos Bird).
  • Corrige metadatos obsoletos en FileLog cuando se elimina y se vuelve a crear un archivo. #101408 (Azat Khuzhin).
  • Corrige una reordenación de join que descartaba silenciosamente filas no emparejadas de un RIGHT/LEFT JOIN cuando se combinaba mediante comas (cross) con otra tabla, p. ej., t1 RIGHT JOIN t2 ON t1.c = t2.c, t3. Antes, la consulta devolvía el resultado de un inner join en lugar del de un outer join. #101684 (Groene AI).
  • Corrige que la cláusula FORMAT fuera consumida por INSERT en lugar de aplicarse a la salida de EXPLAIN en EXPLAIN INSERT INTO ... SELECT ... FORMAT .... #101772 (Yash ).
  • Corrige la selección incorrecta del códec de compresión para las partes de MergeTree cuando la configuración default_compression_codec a nivel de tabla se establecía explícitamente. Las partes escritas on insert, durante merges y para proyecciones usaban el códec predeterminado global del servidor en lugar de la configuración de la tabla (ahora también se cubre la parte vacía producida por una mutation que elimina todo el contenido). #101784 (Yash ).
  • Rechaza valores negativos de Float64 (p. ej., -100.5) en workload settings como max_bytes_per_second, max_cpus, etc. Antes solo se validaban enteros negativos, lo que permitía que valores float negativos crearan silenciosamente nodos defectuosos en el scheduler. Cierra #101825. #101842 (Groene AI).
  • Corrige un LOGICAL_ERROR (“Port is not connected”, código 49) que podía producirse al ejecutar consultas que involucraban una VIEW con aggregation dentro de un JOIN. #102574 (Jimmy Aguilar Mena).
  • Corrige metadatos inconsistentes de partes tras mutations de columnas con serializaciones no predeterminadas. #102817 (Eduard Karacharov).
  • Corrige que actualizar los metadatos antes de ejecutar la mutation resuelve #96806. #102882 (Smita Kulkarni).
  • Corrige que las consultas SELECT fueran significativamente más lentas cuando se ejecutaban INSERT concurrentes. Antes, un pipeline de INSERT reservaba CPU slots hasta max_threads al inicio de la consulta, incluso cuando la mayoría de los slots nunca llegaban a usarse, dejando sin recursos a los SELECT concurrentes. La asignación de CPU slots ahora se hace según la demanda: el pipeline solo solicita slots a medida que realmente envía trabajo paralelizable. Esto se aplica tanto al control de concurrencia como al scheduler preventivo de CPU para workloads. La nueva server setting concurrent_threads_lazy_allocation (predeterminada true) actúa como mecanismo de rollback. #102928 (Seva Potapov).
  • Corrige la propagación de NULL al leer subcolumnas extraídas de columnas Nullable(Tuple(...)). Por ejemplo, para tup Nullable(Tuple(s Nullable(String))), SELECT tup.s ahora devuelve correctamente NULL en las filas en las que la tupla externa es NULL, en lugar de valores basura. Esto cubre todos los tipos de elemento que pueden representar NULL: Nullable, Dynamic, Variant y LowCardinality(Nullable(...)). Cierra #105356. #102942 (Nihal Z. Miaji).
  • Lanza INCORRECT_DATA en lugar de LOGICAL_ERROR cuando los datos proporcionados por el client en Native format están truncados o malformados. #102975 (János Benjamin Antal).
  • Se agregó una comprobación de cancelación a la operación de lectura de ObjectStorage. Cierra #98165. #103016 (Smita Kulkarni).
  • Respeta input_format_binary_max_type_complexity al decodificar parámetros de funciones de agregación. Cierra #102903. #103026 (Pavel Kruglov).
  • Corrige la inferencia de nulabilidad de las columnas Geo en el lector de Parquet basado en Arrow. Cierra #101845. #103032 (Pavel Kruglov).
  • Se corrigió que recursiveRemoveLowCardinality eliminara nombres personalizados de tipos de geometría (p. ej., LineString frente a Ring, MultiLineString frente a Polygon), lo que provocaba una interpretación errónea del tipo de geometría. Cierra #103207. #103041 (Joanna Hulboj).
  • Se corrigió que input_format_max_block_size_bytes se ignorara silenciosamente durante el análisis de INSERT cuando max_insert_block_size_bytes es 0 (el valor predeterminado). La configuración ahora limita correctamente el tamaño de los bloques producidos por los formatos de entrada basados en filas. #103068 (Kirill Kopnev).
  • Se corrigió que ClickHouse produjera ocasionalmente tokens GSSAPI no válidos debido a una eliminación incorrecta de bytes nulos finales. #103114 (Michael Jarrett).
  • Corrige el plegado de constantes en tiempo de analyzer para funciones de short-circuit (if, multiIf, and, or, etc.), de modo que las ramas estáticamente inalcanzables ya no generen excepciones en tiempo de análisis. Por ejemplo, WITH 0 AS n SELECT multiIf(n = 0, 0, intDiv(100, n)) ahora devuelve correctamente 0 en lugar de fallar con un error de división por cero. #103157 (Peng).
  • EXPLAIN SYNTAX expande vistas parametrizadas. #103263 (Jordi Villar).
  • Corrige la corrupción de datos al escribir archivos Parquet (y otros formatos con tráiler, como ORC y Arrow) en HDFS mediante INSERT INTO FUNCTION hdfs(...). Desde la versión 26.1, WriteBufferFromHDFS no vaciaba su búfer de trabajo en finalize(), por lo que se perdían silenciosamente los últimos hasta DBMS_DEFAULT_BUFFER_SIZE bytes de cada archivo, incluido el footer PAR1 de Parquet. Al leer esos archivos, se devolvía Not a Parquet file (wrong magic bytes at the end of file). #103268 (Groene AI).
  • Corrige resultados incorrectos y un posible error lógico en subconsultas correlacionadas cuando se establece un límite de tamaño de join (max_rows_in_join / max_bytes_in_join) junto con join_overflow_mode = 'break'. El join creado internamente para evaluar una subconsulta correlacionada ahora ignora esos límites del usuario, por lo que ya no puede detenerse antes de tiempo ni descartar filas. #103322 (Groene AI).
  • Corrige un bug por el que ALTER TABLE ... MODIFY SETTING en una tabla EmbeddedRocksDB podía conservar un valor de configuración no válido en el archivo de metadatos de la tabla incluso cuando el servidor rechazaba la consulta. En el siguiente reinicio del servidor, la tabla no podría adjuntarse con CANNOT_PARSE_BOOL (o un error de parsing similar), y en bases de datos donde los fallos de carga son fatales, el servidor se negaría a iniciarse. Los valores de configuración no válidos ahora se rechazan antes de que se escriba cualquier metadato. #103417 (Groene AI).
  • Se corrigió una interrupción del servidor al crear una tabla con un motor de almacenamiento de objetos (AzureBlobStorage, DeltaLakeAzure, S3, HDFS) usando un número no compatible de argumentos. El servidor ahora devuelve un error NUMBER_OF_ARGUMENTS_DOESNT_MATCH claro en lugar de abortar en compilaciones de depuración/sanitizador. #103544 (Groene AI).
  • Corrige un fallo del servidor en el parsing de parámetros de los tipos de datos JSON y Dynamic cuando el árbol de sintaxis abstracta (AST) estaba malformado estructuralmente (por ejemplo, generado por el AST fuzzer): la expresión de parámetro equals(name, value) podía quedarse con menos de dos hijos, que DataTypeObject y DataTypeDynamic luego desreferenciaban sin comprobación de límites. #103545 (Groene AI).
  • Corrige errores lógicos en el analyzer con colisión de nombres de columna en una lambda usada en prewhere. Cierra #103584. #103627 (Pavel Kruglov).
  • Corrige errores esporádicos Logical error: 'Database <name> not found' de DataLakeConfiguration::getCatalog cuando una tabla del engine Iceberg se carga dentro de una base de datos normal durante la carga asíncrona de metadatos. #103775 (Groene AI).
  • Corrige errores MULTIPLE_EXPRESSIONS_FOR_ALIAS lanzados por réplicas remotas al ejecutar consultas que hacen referencia a alias de proyección dentro de PREWHERE / WHERE / HAVING / QUALIFY (p. ej., SELECT x AS a, y AS b, (a AND b) AS c FROM t PREWHERE c) o SELECT * sobre autouniones con nombres de columna superpuestos, con réplicas paralelas y parallel_replicas_local_plan = 0. Cierra #74324. #103806 (Groene AI).
  • Corrige la interrupción del servidor cuando una consulta usa comparaciones anidadas coalesce/ifNull (p. ej., WHERE coalesce(a, b, coalesce(c, d), e) = const) en una tabla MergeTree con múltiples índices de salto minmax y use_skip_indexes_for_disjunctions = 1. La reescritura del índice de salto de <op>(coalesce(...), const) ahora se aplica recursivamente a los argumentos internos de coalesce, de modo que la RPN de KeyCondition por índice coincida con la RPN de la plantilla, como ya asume el código de seguimiento de disyunciones. #103929 (Groene AI).
  • Se corrige que max_rows_to_transfer y max_bytes_to_transfer se ignoraran silenciosamente en las consultas GLOBAL IN y GLOBAL JOIN con el nuevo analizador. Ahora estos ajustes generan SET_SIZE_LIMIT_EXCEEDED (o interrumpen la ejecución, según transfer_overflow_mode) cuando la tabla externa materializada supera el límite configurado, igualando el comportamiento del analizador anterior. Cierra #103333. #104119 (Groene AI).
  • Se corrige la lectura excesiva de metadatos del catálogo/S3 cuando una sentencia INSERT o una sentencia DDL hace referencia a una tabla inexistente en una base de datos de catálogo DataLake con show_data_lake_catalogs_in_system_tables habilitado. La ruta de sugerencia para corregir errores tipográficos cargaba los metadatos completos de Iceberg de cada tabla para todo el catálogo, lo que podía agotar la memoria en catálogos grandes. #104124 (DQ).
  • Se corrige un fallo (LOGICAL_ERROR “Columns are assumed to be of identical types, but they are different in Nullable” en compilaciones de depuración, un SIGSEGV por puntero nulo en ColumnString::compareAt en compilaciones release) y un resultado incorrecto que podía producirse en consultas que usan direct join_algorithm con una tabla MergeTree en el lado derecho cuando el plan de consulta reordenaba columnas durante la optimización. Las columnas del lado derecho podían acabar en posiciones con nombres incorrectos, por lo que un filtro o una comparación sobre la clave de join veía una columna del tipo incorrecto. Detectado por AST fuzzer como STID 2139-5111 y reportado en #107272. #104174 (Groene AI).
  • Se rechaza un ID de partición entero fuera de rango para Date en lugar de producir un overflow silencioso o un LOGICAL_ERROR en ALTER. #104250 (Azat Khuzhin).
  • Se deshabilita additional_table_filters con réplicas paralelas y el analizador sin serialización del plan de consulta. Antes, esto podía dar lugar a resultados incorrectos. #104296 (Azat Khuzhin).
  • Se corrige que dictGetOrNull sobrescribiera silenciosamente otras columnas de la proyección SELECT con NULL cuando se llamaba con una columna clave Nullable cuyos valores faltaban en el diccionario. La función estaba mutando in situ un mapa de nulos con alias de entrada; ahora clona en profundidad la columna de resultado antes de la mutación. Cierra #73633. #104327 (Groene AI).
  • Se corrige una patch part dañada después de ALTER TABLE ... DROP PARTITION ID 'patch-...' seguido de DETACH/ATTACH TABLE. Antes, la parte de cobertura vacía se escribía sin partition.dat ni source_parts.dat, lo que provocaba una entrada broken-on-start_patch-... en system.detached_parts tras el siguiente attach o reinicio del servidor. Cierra #93132. Cierra #102103. #104353 (Groene AI).
  • Se corrigió el INSERT en streaming con input_format_max_block_wait_ms para la interfaz HTTP y para INSERT SELECT FROM input, de modo que los bloques de entrada parciales se vacíen antes de que finalice la solicitud. #104534 (Alexey Milovidov).
  • Se corrigió un error por el que las consultas que combinaban arrayJoin con ORDER BY ... LIMIT después de un JOIN podían devolver cero filas sin advertencia. La optimización del plan de consulta que eleva la evaluación de funciones por encima de SortingStep ya no se aplica cuando la expresión elevada contiene arrayJoin, ya que arrayJoin puede cambiar el número de filas. Cierra #82279. #104558 (Groene AI).
  • Se corrige una abortación poco frecuente del servidor durante la destrucción de tablas de la familia MergeTree. La abortación podía producirse cuando shutdown lanzaba una excepción antes de que el scheduler de trabajos en segundo plano se detuviera por completo: si una background task se activaba en esa breve ventana, despachaba una llamada virtual a través de un objeto de almacenamiento parcialmente destruido y alcanzaba __cxa_pure_virtual. #104561 (Groene AI).
  • Se corrige un resultado inconsistente en una subcolumna combinada JSON con una indicación de tipo que contiene un valor NULL. #104584 (Pavel Kruglov).
  • Se corrigen resultados incorrectos o una proyección omitida cuando una proyección de agregación contiene varias agregaciones sumIf con distintas condiciones IN (...). #104765 (Jimmy Aguilar Mena).
  • Se corrige un recuento incorrecto de filas de arrayJoin() usado dentro de JOIN ON: el resultado se multiplicaba una vez más por la longitud del array. #104785 (Shaohua Wang).
  • Se corrige que deltaSumTimestamp devolviera resultados incorrectos para tipos enteros con signo al cruzar cero. Resuelve #104750. #104830 (Konstantin Bogdanov).
  • Se corrige una discrepancia en la estructura de bloques en UnionStep tras el pushdown de filtros con constantes NULL. Cierra #104821. #104853 (Pavel Kruglov).
  • Se corrige Logical error: 'Metadata is not initialized' generado por DELETE FROM en una tabla Iceberg, DeltaLake o Hudi recién adjunta cuyo archivo de metadata está corrupto o no se puede cargar. En su lugar, ahora se informa una excepción normal de cara al usuario, y el servidor sigue en ejecución. Cierra #104891. #104917 (Groene AI).
  • Se corrigió que max_memory_usage_soft_limit no se actualizara sobre la marcha cuando cambiaba la configuración. El soft memory limit se calculaba una sola vez al inicio y se almacenaba en caché, por lo que las recargas posteriores de la configuración no tenían efecto. Tras esta corrección, el límite se recalcula y se aplica de inmediato en cada recarga de configuración, sin necesidad de reiniciar Keeper. #104940 (Kai Zhu).
  • Se corrige la resolución de símbolos JIT en macOS para que la compilación JIT de sort, expression y agregación ya no falle con CANNOT_COMPILE_CODE: Could not find symbol _<name>. #104946 (Alexei Fedotov).
  • Se corrige una excepción (Received signal 6 (abort) en el endurecimiento de vectores, observable como Tuple::back() en un vector vacío) al ejecutar una consulta de la forma SELECT ... FROM <Distributed table> WHERE/HAVING/GROUP BY ... (sharding_key_column IN tuple()) con optimize_skip_unused_shards_rewrite_in habilitado en el nuevo analyzer. #104966 (Alexey Milovidov).
  • Se corrige un aborto del servidor por Logical error: 'Inconsistent AST formatting' (STID 1941-1bfa) en consultas como CREATE TABLE t (c0 Int CODEC(not((not(materialize(1), materialize(2)))), ZSTD)) ENGINE = Memory en compilaciones de depuración / con sanitizers. El formateador ya no emite paréntesis externos redundantes alrededor de una llamada a la función tuple(...) con varios argumentos que aparece dentro de listas de argumentos de CODEC / STATISTICS / BACKUP_NAME (donde la forma de operador (a, b) está deshabilitada), lo que mantiene estable el round-trip de formatear-analizar-formatear. #104991 (Groene AI).
  • Se corrige NOT_FOUND_COLUMN_IN_BLOCK lanzado por ALTER TABLE ... MATERIALIZE INDEX en parts creados en 25.8 que contienen un skip index sobre una columna añadida mediante un ALTER TABLE ... ADD COLUMN independiente. La mutation ahora lee correctamente cada columna requerida por cada skip index y projection preexistentes en el part durante el recálculo forzado. Cierra #104872. #105039 (Groene AI).
  • Se corrigieron dos casos de LOGICAL_ERROR: Reading from materialized CTE 'X' before it has been materialized lanzados por consultas con enable_materialized_cte: (1) una materialized CTE reutilizada filtrada por IN (subquery) sobre otra materialized CTE, y (2) una materialized CTE referenciada tanto directamente como dentro de un filtro WHERE ... IN (...) que alcanza una clave primaria de MergeTree mediante una subquery IN anidada. EXPLAIN sobre esas mismas consultas también se veía afectado porque los errores se activaban durante la optimización del plan. Cierra #101940, cierra #102320. #105041 (Dmitry Novik).
  • Se corrige la estimación de selectividad de PREWHERE para estadísticas countmin en columnas Float32. Dos errores hacían que las estadísticas countmin produjeran silenciosamente estimaciones incorrectas para columnas Float32: ConditionSelectivityEstimator omitía por completo las estadísticas cuando el tipo de la columna (Float32) era más estrecho que el tipo del literal (Float64), recurriendo a la selectividad predeterminada e ignorando el sketch; y StatisticsCountMinSketch::estimateEqual calculaba el hash de los primeros N bytes de un objeto Field, pero Field almacena Float32 como Float64 (NearestFieldType<Float32> = Float64), por lo que el patrón de bytes usado en tiempo de consulta difería de los bytes reales de Float32 almacenados durante la build. #105047 (Han Fei).
  • Las consultas ATTACH TABLE name <clauses>; que proporcionan cláusulas de almacenamiento (ORDER BY, PARTITION BY, PRIMARY KEY, SAMPLE BY, TTL, UNIQUE KEY o SETTINGS del engine) sin un ENGINE ahora lanzan BAD_ARGUMENTS en lugar de volver a adjuntar silenciosamente la tabla con su definición almacenada y descartar las cláusulas proporcionadas por el usuario. Los SETTINGS de sesión a nivel de consulta (como log_comment) se siguen aplicando. Use ATTACH TABLE t; para volver a adjuntarla con los metadatos almacenados, o ALTER TABLE t MODIFY SETTING ... después de ATTACH para cambiar la configuración. #105068 (Groene AI).
  • Se corrige un use-after-free en runningAccumulate cuando se llama sobre una columna cuya función de agregación devuelve su propio state (por ejemplo, uniqStateOrDefaultState, sumStateOrDefaultState, uniqStateForEachState). #105085 (János Benjamin Antal).
  • Se corrigió un error en la UI web (play.html): al ejecutar una consulta mientras el cursor estaba después del único ; final, se mostraba “empty query” en lugar de ejecutar la consulta. #105107 (Alexey Milovidov).
  • Se corrige LOGICAL_ERROR: 'No user in current context, it's a bug' cuando un CREATE TABLE ... AS SELECT dentro de una base de datos Replicated lee de system.current_roles o system.enabled_roles. La consulta ahora se ejecuta correctamente y devuelve un conjunto de resultados vacío en este contexto interno del worker de DDL. #105150 (Groene AI).
  • Se corrigió ILLEGAL_TYPE_OF_ARGUMENT al fusionar estados de agregación de quantileExactWeightedInterpolated, quantileDD o quantilePrometheusHistogram con sus equivalentes plurales quantilesXxxMerge (y viceversa). Las variantes singulares y plurales de estas tres familias de quantile comparten el mismo estado de agregación interno, pero no estaban incluidas en la tabla interna de asignación de nombres, por lo que se rechazaban tanto la fusión de estados entre funciones como la optimización de fusión de funciones para estas familias. #105189 (Groene AI).
  • Se corrigen los resultados incorrectos de toStartOfWeek, toLastDayOfWeek, toMonday, toStartOfMonth, toLastDayOfMonth, toStartOfQuarter y toStartOfYear para argumentos Date32 y DateTime64 cuyo resultado queda fuera del rango de Date: en lugar de desbordarse a fechas arbitrarias, los resultados anteriores a 1970-01-01 ahora se limitan a 1970-01-01 y los posteriores a 2149-06-06 se limitan a 2149-06-06. Esto también corrige resultados de consulta erróneos (partes y gránulos podados incorrectamente) cuando estas funciones se usaban en WHERE sobre una clave Date32 o DateTime64 que contenía valores fuera de rango. #105244 (Yarik Briukhovetskyi).
  • Se corrige un error lógico en arrayRemove cuando el primer argumento es un Array de Variant cuyas alternativas son todas incompatibles con el tipo del segundo argumento y variant_throw_on_type_mismatch está deshabilitado. La función ahora trata la comparación como “nunca igual” y devuelve el Array sin cambios, en lugar de provocar un fallo de assertTypeEquality del lado del servidor. #105248 (Groene AI).
  • La consulta puede ejecutarse correctamente incluso si FileCache no logra crear algún directorio en disco para el almacenamiento en caché. #105250 (Den Kalantaevskii).
  • Se corrige el cierre abrupto del servidor con Assertion 'px != 0' failed en ExtremesTransform cuando una consulta con extremes = 1 encuentra una excepción (por ejemplo, MEMORY_LIMIT_EXCEEDED) mientras la transformada construye sus columnas de extremos a partir del primer chunk. El cliente ahora recibe la excepción original en lugar de que se cierre el servidor. #105264 (Groene AI).
  • LEFT ANTI JOIN ahora devuelve correctamente la columna de clave de join del lado derecho con valores predeterminados para las filas sin coincidencia, en lugar de duplicar el valor de la clave izquierda. Antes, SELECT a.x AS l, b.x AS r FROM a LEFT ANTI JOIN b ON a.x = b.x podía devolver r = a.x para las filas sin coincidencia cuando debería devolver el valor predeterminado (0 para Int32, '' para String, NULL para Nullable). Solo se veía afectada la columna de clave de join; las columnas derechas que no eran clave ya recibían correctamente sus valores predeterminados. El mismo bug aparecía en RIGHT ANTI JOIN siempre que el optimizador intercambiaba los lados. Cierra #99959. #105278 (Groene AI).
  • Se corrige la pérdida de datos en clickhouse-local cuando se inicia repetidamente con un --default_database distinto de default (por ejemplo, clickhouse-local --path X -- --default_database=mydb): la búsqueda del UUID de la base de datos persistida estaba fijada en metadata/default, por lo que cada reinicio generaba un UUID nuevo y las tablas de la ejecución anterior quedaban invisibles. Cierra #101831. #105284 (Groene AI).
  • Se corrige un logical error Mutation of Memory table produced incomplete output que se producía al ejecutar ALTER TABLE <memory_table> APPLY PATCHES o ALTER TABLE <memory_table> APPLY DELETED MASK. Las tablas Memory no tienen patch parts ni máscaras de eliminación, por lo que ahora ambos comandos se tratan correctamente como operaciones sin efecto. #105286 (Groene AI).
  • Se corrigen las consultas de larga duración con Unity Catalog pasando un parámetro table_id en la solicitud de la consulta. #105303 (Konstantin Vedernikov).
  • Se corrige CANNOT_CONVERT_TYPE para Merge sobre Merge sobre Distributed con distributed_group_by_no_merge=1. #105330 (Azat Khuzhin).
  • Se corrige que clickhouse local y clickhouse client ignoraran silenciosamente --query/-q cuando también se proporcionaba un argumento posicional de archivo. Ahora ambas variantes producen BAD_ARGUMENTS de forma consistente. #105334 (Raúl Marín).
  • Se corrige que REPLACE TEMPORARY TABLE creara silenciosamente una tabla nueva cuando el destino no existía. Ahora lanza UNKNOWN_TABLE, en consonancia con la semántica de REPLACE TABLE. Use CREATE OR REPLACE TEMPORARY TABLE para mantener el comportamiento de crear o reemplazar. #105373 (Groene AI).
  • Se corrige que las lecturas de larga duración (p. ej., INSERT ... SELECT) desde una base de datos DataLakeCatalog con catalog_type = 'glue' fallaran con un error ExpiredToken una vez que las credenciales de sesión de STS capturadas en el momento de cargar los metadatos de la tabla superaban su vencimiento. Ahora las credenciales de AWS STS se actualizan durante la consulta, por lo que estas lecturas continúan después del vencimiento del token. #105381 (Pratima Patel).
  • Se corrige un logical error en LIMIT BY negativo en algunos casos cuando se usa con ARRAY JOIN. #105403 (Nihal Z. Miaji).
  • Se corrige la inflación de read_bytes (y de los bytes/s derivados que se muestran en system.query_log, la barra de progreso, etc.) al leer archivos Parquet. La implementación anterior informaba el compressed size total del row group en cada fragmento, por lo que leer K de N columnas sobrecontaba en N / K. Ahora solo se suma en las columnas seleccionadas. También corrige el seguimiento del progreso a nivel de archivo para las tablas Iceberg, que antes nunca informaban el tamaño del archivo de datos. #105413 (Groene AI).
  • Se corrige un posible segfault del servidor en las cluster table functions (s3Cluster, urlCluster, fileCluster, …) cuando el planificador produce un SELECT con la marca recursive_with activada pero sin una expresión WITH. Cierra #105370. #105433 (Groene AI).
  • Se corrige un resultado incorrecto de countDistinct / uniqExact en columnas Nullable cuando count_distinct_optimization = 1 (el grupo NULL se contaba incorrectamente). #105439 (Raúl Marín).
  • Se corrigió un heap-buffer-overflow al leer archivos Arrow o ArrowStream con desplazamientos intermedios corruptos en una columna binaria o de cadena, así como una desreferenciación de puntero nulo al leer columnas Arrow con etiquetas geográficas. #105449 (Raúl Marín).
  • Se validaron los tipos Dynamic/Variant en la cláusula de ventana PARTITION BY; antes no se comprobaban cuando allow_suspicious_types_in_group_by está deshabilitado. Cierra #105028. #105450 (Pavel Kruglov).
  • Se corrigió que input_format_json_empty_as_default no funcionara en los formatos JSONStrings*. Cierra #104913. #105453 (Pavel Kruglov).
  • Se corrigió la inserción de NULL en una columna Variant mediante el formato VALUES durante el análisis de expresiones. Cierra #104909. #105455 (Pavel Kruglov).
  • Se corrigió que dictGetOrDefault lanzara CANNOT_INSERT_NULL_IN_ORDINARY_COLUMN cuando el argumento predeterminado es una expresión Nullable y short_circuit_function_evaluation está habilitado con una mezcla de claves de diccionario encontradas y no encontradas. #105461 (Raúl Marín).
  • Se corrigió el truncamiento silencioso de valores en columnas Dynamic cuando el lector de texto Quoted (Values) recurría a String para tipos inferidos incompletos como Map(Array(Nothing), ...). Antes, el mecanismo alternativo envolvía el campo sin procesar con una concatenación ingenua de '...', por lo que una comilla simple interna (siempre presente en estos casos) cerraba prematuramente la cadena entrecomillada y se perdía el resto del valor. #105463 (Groene AI).
  • Se corrigió un SIGSEGV al leer subcolumnas Dynamic de una tabla Memory comprimida después de ALTER. Cierra #104901. #105464 (Pavel Kruglov).
  • Se corrigió que toFloat64/toUInt32/toString/etc. en Dynamic ignorara cast_keep_nullable. Cierra #104789. #105467 (Pavel Kruglov).
  • Se incluyó skip_first_lines en la clave de caché del esquema para los formatos WithNames. Cierra #104527. #105469 (Pavel Kruglov).
  • Se corrigió un fallo de segmentación del servidor en uniqStateOrNull / uniqStateOrDefault / uniqOrNullState (y cadenas de combinadores similares sobre uniq) cuando se usan con GROUP BY ... WITH ROLLUP, WITH CUBE o WITH TOTALS y un argumento Nullable. #105470 (Groene AI).
  • Se corrigió la excepción NOT_FOUND_COLUMN_IN_BLOCK al combinar ORDER BY ... WITH FILL INTERPOLATE y LIMIT N BY con el analizador habilitado. Cierra #103474. #105481 (Yakov Olkhovskiy).
  • Se corrigió toStartOfMillisecond y toStartOfMicrosecond, que devolvían un resultado desfasado por casi un segundo para valores DateTime64 negativos (anteriores al epoch), y se corrigió el signed-integer-overflow de UndefinedBehaviorSanitizer en toStartOfSecond, toStartOfMillisecond y toStartOfMicrosecond para entradas DateTime64 cercanas a INT64_MIN. #105482 (Groene AI).
  • Se añadió una nueva compatibility setting analyzer_compatibility_prefer_alias_over_subcolumn (deshabilitada de forma predeterminada). Cuando está habilitada, el nuevo analizador prioriza la interpretación con prefijo de alias frente a las coincidencias con subcolumnas de Tuple o columnas con puntos en identificadores de varias partes, restaurando el comportamiento del intérprete anterior. Esto evita errores AMBIGUOUS_IDENTIFIER (y relacionados) cuando una consulta hace join con una tabla cuyo nombre coincide con una tabla interna de una CTE/subquery que usa SELECT * sobre un join, donde las columnas renombradas por asterisco (por ejemplo, b.id) podrían, de otro modo, filtrar los identificadores de la tabla interna al ámbito externo. #105491 (Vladimir Cherkasov).
  • Una consulta de vector search ejecutada con la optimization de solo índice ahora devuelve el valor correcto de L2Distance() si aparece en la lista SELECT. La función devolvía incorrectamente el valor de la distancia L2 al cuadrado. Tenga en cuenta que la consulta de vector search devolvía los resultados correctamente ordenados; solo las aplicaciones que recuperaban e interpretaban explícitamente el valor de L2Distance() habrían visto el valor al cuadrado. #105495 (Shankar Iyer).
  • Se corrigió un problema poco frecuente en el nuevo Kafka table engine por el que los mensajes podían procesarse incorrectamente durante la reasignación de particiones de topic, lo que podía provocar que se omitieran mensajes tras un rollback de offset. #105500 (János Benjamin Antal).
  • Se corrigió una excepción (Trying to execute PLACEHOLDER action logical error) cuando una CTE MATERIALIZED cuyo cuerpo es una subquery correlacionada se usa como lado derecho de IN. Ahora esa CTE se rechaza en tiempo de análisis, en consonancia con cómo ese mismo patrón ya se rechaza cuando se hace referencia directamente a la CTE en FROM. #105518 (Groene AI).
  • Se corrigió que la compresión de stdout/stdin no se aplicara cuando el format se especificaba explícitamente. Cierra #104441. #105528 (Pavel Kruglov).
  • Se corrigió un SEGFAULT en la deserialization de singleValueOrNull para el tipo JSON. Cierra #103630. #105535 (Pavel Kruglov).
  • Se corrigió que clickhouse-format --backslash descartara silenciosamente los datos de INSERT VALUES. Cierra #103533. #105536 (Pavel Kruglov).
  • Se corrigió que variant_throw_on_type_mismatch/dynamic_throw_on_type_mismatch=false no capturara excepciones durante la ejecución de funciones. Cierra #103484. #105543 (Pavel Kruglov).
  • Se corrigió que se ignorara input_format_try_infer_datetimes durante la inserción en shared data en JSON. Cierra #103221. #105544 (Pavel Kruglov).
  • Corrige histogram, que producía resultados incorrectos con entradas pequeñas sin ordenar. Cierra #103109. #105548 (Pavel Kruglov).
  • Corrige el desbordamiento circular de DateTime con valores fuera de rango en JSONExtract y en deserializaciones de texto. Cierra #103094. #105551 (Pavel Kruglov).
  • Corrige el uso de la insertion table en las table functions cuando optimize_trivial_insert_select está habilitado. Cierra #103083. #105555 (Pavel Kruglov).
  • Corrige que la expression CASE devolviera la rama ELSE en lugar de la rama THEN correspondiente cuando tanto la expresión como un valor WHEN eran NULL. #105556 (Raúl Marín).
  • Corrige un fallo en replxx causado por alcanzar la limitación FD_SETSIZE de select (ahora sustituido por poll). Anteriormente, con SSH o el terminal web habilitados, esto podía hacer fallar el server. #105559 (Azat Khuzhin).
  • Materializa las subcolumns en executePartitionByExpression antes de ejecutar la expresión. Cierra #103057. #105573 (Pavel Kruglov).
  • Corrige la excepción NOT_FOUND_COLUMN_IN_BLOCK cuando la expresión TTL hace referencia a una subcolumn. #105578 (Pavel Kruglov).
  • Corrige un fallo del server (SIGSEGV) al que podía llegar cualquier usuario con permisos de CREATE TABLE al enviar CREATE TABLE ... TO INNER UUID '...' sin una clause ENGINE por HTTP o el native protocol. El mismo error también hacía fallar al client. Ahora el parser informa correctamente de un error BAD_ARGUMENTS en lugar de desreferenciar un puntero nulo. #105579 (Groene AI).
  • Corrige que la window function estimateCompressionRatio perdiera los datos acumulados entre filas. Cierra #101738. #105581 (Pavel Kruglov).
  • Corrige un fallo al insertar tuples de distintos tamaños en la misma cláusula VALUES en una columna String. Cierra #101727. #105582 (Pavel Kruglov).
  • La extracción del valor de partición de Hive ahora respeta la configuración cast_string_to_date_time_mode y acepta de forma predeterminada timestamps ISO 8601 con suffixes de zona horaria (p. ej., +0000, +00:00, Z) en las claves de partición. #105584 (Alexey Milovidov).
  • Corrige el error NOT_IMPLEMENTED en toString desde DateTime con Timezone que contiene un valor NULL. Cierra #103712. #105587 (Yarik Briukhovetskyi).
  • Corrige una lectura OOB en la deserialización Native de la columna Dynamic aplanada. #105666 (Pavel Kruglov).
  • Corrige un LOGICAL_ERROR (Unexpected return type from if) que se producía durante la planificación de consultas para expresiones if cuyo tipo de resultado es Variant y cuya segunda o tercera rama es un if de condición constante sobre un literal UInt64 que cabe en Int64. Cierra #105649. #105680 (Groene AI).
  • Corrige resultados incorrectos al leer una tabla Iceberg con iceberg_use_version_hint = 1 después de que otro writer (como la table function icebergLocal/icebergS3), sin este ajuste, haga avanzar la tabla. version-hint.text ahora se mantiene sincronizado por cada writer una vez que el archivo existe, de modo que los lectores posteriores que usan la pista vean el snapshot más reciente. #105682 (Groene AI).
  • Corrige un recuento inferior al real que se producía silenciosamente en consultas SELECT cuando use_query_condition_cache = 1 (valor predeterminado). Una consulta con la forma PREWHERE pk_prefix = X WHERE non_pk IN (...) sobre una columna con un skip index de filtro Bloom contaminaba la QueryConditionCache para el predicado pk_prefix = X, por lo que un SELECT count() ... WHERE pk_prefix = X benigno posterior devolvía un resultado incorrecto, por debajo del real. Afectaba a todas las releases 26.x. #104781. #105686 (Groene AI).
  • Corrige que singleValueOrNullMerge devolviera un valor concreto en lugar de NULL al fusionar un estado que ya había observado varios valores distintos. #105734 (Minh Vu).
  • Corrige la recuperación ante errores del input format Template después de filas malformadas. #105735 (Yue Ni).
  • Corrige un fallo en la table function mongodb, el almacenamiento de MongoDB y el origen de diccionario de MongoDB cuando el nombre de la collection está vacío o contiene bytes NUL. #105776 (Raúl Marín).
  • Corrige la limpieza de snapshots de Keeper tras writes fallidos para que los snapshots parciales se eliminen de forma segura y los writes fallidos puedan reintentarse sin avanzar latest_snapshot_meta. #105779 (Antonio Andelic).
  • Corrige que ALTER TABLE ... CLEAR COLUMN se rechazara para columnas columns_to_sum explícitas de SummingMergeTree y CoalescingMergeTree. #105785 (Antonio Andelic).
  • Corrige una aserción en DatabaseCatalog::tryGetDatabase (y el error UNKNOWN_DATABASE resultante en compilaciones de release) al crear una parameterized view cuyo nombre de base de datos se proporciona mediante un query parameter, por ejemplo CREATE VIEW {db:Identifier}.v AS SELECT {p:UInt64}. Los parámetros en las partes DDL de la sentencia CREATE ahora se sustituyen en el momento de la creación, mientras que los parámetros del cuerpo de SELECT siguen disponibles para su sustitución al invocar la vista. #105799 (Groene AI).
  • Corrige Bad get: has Decimal32, requested Decimal128 en sumMap y sumMapWithOverflow sobre una columna Nested(... Nullable(Decimal(P, S))) cuando el estado de agregación se serializa (p. ej., parallel replicas, sumMapState mediante un formatter de estado binario, agregación externa). #105816 (Groene AI).
  • Se corrigen los errores Expected ColumnLowCardinality, got String / Bad cast from type DB::ColumnString to DB::ColumnLowCardinality cuando se usa apply_mutations_on_fly = 1 en una tabla con mutaciones UPDATE/DELETE pendientes aplicadas sobre la marcha y en cola antes de una mutación ALTER MODIFY COLUMN ... LowCardinality(...). #105847 (Raúl Marín).
  • Las escrituras de Iceberg ahora conservan los valores NULL en las columnas de partición Nullable(T). Antes, un NULL escrito por ClickHouse aparecía como el valor predeterminado del tipo interno (0 para int) al volver a leerse con Spark u otros lectores de Iceberg. Cierra #105852. #105862 (Groene AI).
  • Se corrigió el pushdown de filtros de Parquet y ORC para predicados IN (subquery), lo que permite que la poda de grupos de filas/páginas/filtros bloom funcione en lecturas de file, url, s3 y almacenamiento de objetos. #105863 (Arsen Muk).
  • Se corrige la lectura en orden para tablas Merge (con un nuevo analizador). #105867 (Nikolai Kochetov).
  • Se corrigió que las eliminaciones posicionales merge-on-read de Iceberg v2 devolvieran filas incorrectas cuando un único archivo de eliminación hace referencia a varios archivos de datos y varios de esos archivos de eliminación se aplican al mismo archivo de datos. El lector de streaming (use_roaring_bitmap_iceberg_positional_deletes = 0) ahora filtra las filas del archivo de eliminación por file_path en C++ en lugar de depender de la poda de grupos de filas de Parquet, restaurando el invariante de posiciones ascendentes. #105888 (Groene AI).
  • Se corrige el error Cannot find column en consultas distribuidas con filtro IN Array(...) para el nuevo analizador. #105894 (Nikolai Kochetov).
  • Se corrige un SIGSEGV en ALTER TABLE ... MODIFY COLUMN ... Nullable(...) en tablas MergeTree cuando otra instrucción ALTER elimina concurrentemente una columna con STATISTICS. Cierra #105912. #105917 (Groene AI).
  • Se corrigió un fallo del servidor que podía producirse cuando se cancelaba una consulta que leía desde PostgreSQL —mediante la table function postgresql, el PostgreSQL table engine o un diccionario con un origen PostgreSQL— (por ejemplo, con KILL QUERY) y fallaba la cancelación de la consulta remota en PostgreSQL. #105949 (Rory Shanks).
  • Se corrige el formatting de SYSTEM INSTRUMENT ADD para que los argumentos del controlador estén separados por un solo espacio, y se rechazan listas no válidas de argumentos de instrumentación SLEEP con más de dos valores o con un rango en el que el mínimo es mayor que el máximo. #105984 (Pablo Marcos).
  • Se corrigen posibles resultados incorrectos en consultas que combinan un outer join con un inner join posterior que hace referencia al lado del outer join que aporta los valores nulos. La reordenación de joins podía elegir un plan que llevaba las condiciones del inner join a la cláusula ON del outer join. #105992 (Vladimir Cherkasov).
  • Se corrigió un posible fallo debido a un literal de cadena demasiado grande enviado dentro de la consulta. #105996 (Nikita Taranov).
  • Se corrige la excepción INVALID_WITH_FILL_EXPRESSION al usar INTERPOLATE () (vacío) con un prefijo de ordenación en ORDER BY y use_with_fill_by_sorting_prefix habilitado. Las columnas del prefijo de ordenación ahora se excluyen correctamente del conjunto de interpolación implícita, en línea con el comportamiento de INTERPOLATE (col) cuando se nombra explícitamente. #106001 (Yakov Olkhovskiy).
  • Se corrigen las operaciones de partición de ALTER TABLE que fallaban silenciosamente con claves de partición Bool. Cierra #101722. #106004 (Pavel Kruglov).
  • Se corrigen JSONExtractRaw y JSONHas para rutas JSON tipadas con valores predeterminados. Cierra #101721. #106005 (Pavel Kruglov).
  • Se corrige la adición incorrecta del prefijo ’/’ en rutas base vacías en configuraciones de lago de datos. Cierra #105989. #106013 (thewisenerd).
  • Se corrige que el motor de tabla IcebergLocal pasara a modo de solo lectura después de un ciclo DETACH + ATTACH o de reiniciar el servidor, lo que hacía que cualquier INSERT posterior fallara con Local object storage Local is readonly. (READONLY). #106016 (Groene AI).
  • Se corrigen fallos de Keeper durante la sincronización del follower cuando la nueva cola de respuestas del despachador de solicitudes podía llenarse antes de que se iniciara el hilo de respuestas. #106049 (Antonio Andelic).
  • Mejor compatibilidad con el analyzer antiguo. Si la tabla tiene columnas como x.a Array, x.b Array, x String, se da prioridad a los arrays para ARRAY JOIN x. #106069 (Nikolai Kochetov).
  • Se corrige que la caché del sistema de archivos se deshabilitara silenciosamente para Azure Blob Storage (por ejemplo, tablas de Delta Lake sobre Azure) porque los metadatos del objeto no incluían el ETag del blob. #106091 (thewisenerd).
  • Se corrige que system.dictionaries devolviera 0 filas con una revocación parcial de SHOW DICTIONARIES. #106105 (Pavel Kruglov).
  • Se corrige un fallo del servidor al consultar tablas de DeltaLake con allow_experimental_delta_kernel_rs habilitado y una credencial u opción que contenía bytes no válidos (la FFI de Rust entraba en pánico al cruzar el límite extern "C"). #106109 (Raúl Marín).
  • Se corrigen resultados incorrectos en consultas contra tablas cuyo ORDER BY contiene una función monótonamente decreciente, como (c0 / -42) o intDiv(c0, -42). Los predicados sobre la columna subyacente (por ejemplo, c0 < 0) podían podar erróneamente gránulos que contenían filas coincidentes, lo que provocaba resultados ausentes. Cierra #106084. Cierra #106124. Cierra #106080. #106136 (Nihal Z. Miaji).
  • Se corrige el soporte para usar UDF SQL de WASM en definiciones de MATERIALIZED VIEW. #106161 (Yue Ni).
  • La poda de particiones de Iceberg ahora maneja correctamente los filtros WHERE partition_col = (SELECT ... FROM ...) en los que el analyzer envuelve el resultado de la subquery escalar en un _CAST(Const, 'TargetType') interno con tipos de origen y destino coincidentes. Antes, estos filtros desactivaban la poda de particiones y provocaban un escaneo completo de la tabla. #106204 (Groene AI).
  • Se corrigió el parámetro --query_id de clickhouse local para que permita especificar un Query id personalizado. #106205 (Yue Ni).
  • Se corrigió que la clase de almacenamiento S3 (s3_storage_class / s3_storage_class_name) se ignorara en los objetos escritos mediante multipart upload en discos S3 y object storage, lo que hacía que los objetos grandes se crearan con la clase STANDARD predeterminada. El nombre de la opción ahora se acepta tanto como s3_storage_class como s3_storage_class_name para discos, object storage y backups. #106214 (Alexey Milovidov).
  • Se corrigió un problema por el que Keeper a veces se quedaba bloqueado al iniciar cuando la configuración nuraft_max_log_gap_in_stream se establecía en un valor no predeterminado (el valor predeterminado es 0; es decir, desactiva el pipelining de las requests append_entries). #106220 (Michael Kolupaev).
  • Ahora se valida en la inserción el estado corrupto de la función de agregación DDSketch (claves de bin) en lugar de aceptar datos malformados. #106236 (Yarik Briukhovetskyi).
  • Se corrigió un desajuste en el modo coordinator cuando las subqueries aplican una sobrescritura de la configuración de orden. #106243 (Nikita Taranov).
  • Se corrigió un problema por el que optimize_skip_unused_shards no se aplicaba (y force_optimize_skip_unused_shards fallaba erróneamente) cuando se consultaba una tabla Distributed a través de una tabla Merge o de la table function merge, con el predicado aplicado por encima. #106250 (Nikolai Kochetov).
  • Se corrigió que INTERPOLATE () arrojara INVALID_WITH_FILL_EXPRESSION cuando se asignaban alias a columnas ORDER BY en la lista SELECT con el analyzer antiguo. Cierra #106248. #106252 (Yakov Olkhovskiy).
  • Se corrigió un abort al deserializar un estado malformado de AggregateFunction(uniqTheta, ...) desde una entrada RowBinary o un query parameter. La entrada no válida ahora se rechaza con CORRUPTED_DATA en lugar de escapar como una std::exception y abortar el proceso mediante abortOnFailedAssertion. #106260 (Groene AI).
  • Ahora se rechazan los bytes IntervalKind fuera de rango durante la decodificación de tipos de RowBinaryWithNamesAndTypes (input_format_binary_decode_types_in_binary_format = 1) con un error INCORRECT_DATA claro, en lugar de construir un DataTypeInterval con un tipo no válido que posteriormente podría desencadenar un comportamiento indefinido en rutas hash. #106261 (Groene AI).
  • Se corrigió un issue de rollback por fallo de downgrade de SLRU en 26.1+. Se corrigió la prioridad de la división de caché System/Data con la feature keep_free_space_ratio. #106286 (Kseniia Sumarokova).
  • Se corrigió la lectura de la subcolumna null como una ruta JSON en Nullable(JSON) en lugar de hacerlo como mapa de nulos. Cierra #106085. #106295 (Pavel Kruglov).
  • Se corrigió que RestCatalog::empty devolviera un resultado incorrecto cuando un catálogo REST de Iceberg contiene tablas. #106301 (Lefteris).
  • Se corrigió una excepción en consultas INNER JOIN con una tabla MergeTree izquierda vacía cuando enable_parallel_replicas, query_plan_use_new_logical_join_step y query_plan_optimize_join_order_algorithm = 'greedy' están habilitados. #106338 (Nikolai Kochetov).
  • Se corrigió una conversión incorrecta de valores subnormales Float16 a Float32 (por ejemplo, al leerlos desde archivos .npy de Numpy), causada por un desplazamiento de la mantisa desfasado en una unidad. #106343 (Joanna Hulboj).
  • Se corrigió un fallo y un posible error NOT_FOUND_COLUMN_IN_BLOCK cuando la optimización basada en restricciones (optimize_using_constraints) se usa con subconsultas correlacionadas. #106349 (Raúl Marín).
  • Se corrigió una lectura fuera de los límites en sipHash64Keyed, sipHash128Keyed y sipHash128ReferenceKeyed al calcular el hash de una columna cuyas matrices están todas vacías y cuya clave no es constante. #106355 (Raúl Marín).
  • Se corrigió que SYSTEM RELOAD CONFIG descartara la configuración de Azure Blob Storage por endpoint (como use_native_copy), lo que provocaba que la configuración del disco se ignorara para BACKUP/RESTORE hasta que se reiniciara el servidor. #106357 (Julia Kartseva).
  • Se corrigió regexpExtract(haystack, pattern) para que los patrones sin grupo de captura devuelvan la coincidencia completa en lugar de lanzar INDEX_OF_POSITIONAL_ARGUMENT_IS_OUT_OF_RANGE. #106374 (Groene AI).
  • Se corrigió la excepción LOGICAL_ERROR durante la predescarga de caché cuando un objeto remoto de S3 se sobrescribe con contenido más corto entre el listado y la lectura. #106375 (Nikita Fomichev).
  • Se corrigió el aumento del uso de memoria en la caché del sistema de archivos. #106387 (Kseniia Sumarokova).
  • Se corrigieron múltiples lecturas fuera de los límites del montón en el lector del formato Arrow IPC (ArrowColumnToCHColumn). Un archivo Arrow malformado podía declarar más filas de las que contienen sus búferes, declarar longitudes de elementos hijo de list/struct/map incompatibles con su elemento padre, proporcionar desplazamientos de lista no monótonos o truncar un bitmap de validez hijo, lo que causaba lecturas más allá del final de las asignaciones del montón. Esto puede ser explotado por cualquier usuario con privilegio SELECT mediante file(), format(), funciones de tabla o entradas ArrowFlight. Ahora se validan todos los búferes de datos, desplazamientos, view-struct y bitmap de validez antes de cualquier acceso a punteros sin procesar, y se comprueba la consistencia de las formas y los desplazamientos de list/struct/map. #106395 (Raúl Marín).
  • Se corrigió que las copias de seguridad fallaran con FILE_DOESNT_EXIST cuando el destino REPLACE de una vista materializada actualizable se recopila en una base de datos Replicated o Shared cuya vista materializada aún no está instanciada en la réplica que inicia la copia de seguridad. #106411 (Julia Kartseva).
  • Corrige un error lógico Column identifier ... is already registered cuando un predicado de mutation (DELETE/UPDATE) contiene una subconsulta IN/EXISTS que lee de una expresión de tabla predeterminada anidada dentro de otra subconsulta. #106414 (Alexey Milovidov).
  • Corrige un error lógico (Left and right columns have same names) en el optimizador del orden de join que podía producirse en joins ejecutados con réplicas paralelas cuando dos relaciones del grafo de join comparten nombres de columna. #106418 (Alexey Milovidov).
  • Corrige un error lógico al construir un diccionario de polígonos a partir de datos de origen que contienen coordenadas de punto NaN o infinitas. Ahora, esas coordenadas se rechazan con un mensaje de error claro. #106423 (Alexey Milovidov).
  • Se corrigió un error por el que las columnas used_privileges y missing_privileges de system.query_log podían contener cadenas de privilegios filtradas de consultas anteriores no relacionadas, de otro usuario, base de datos o sesión. #106425 (Alexey Milovidov).
  • Las funciones base58Encode, base58Decode y tryBase58Decode ahora respetan max_execution_time y la cancelación de consultas con entradas grandes, y rechazan entradas de más de 10 KB en lugar de ejecutarse durante demasiado tiempo. El límite se puede configurar mediante el nuevo ajuste function_base58_max_input_size (0 lo desactiva). #106428 (Alexey Milovidov).
  • Corrige resultados incorrectos esporádicos en consultas ORDER BY ... DESC al leer wide parts en orden inverso con read_in_order_use_virtual_row_per_block = 1 y un max_block_size pequeño. #106429 (Vladimir Cherkasov).
  • Se corrigió una excepción NOT_FOUND_COLUMN_IN_BLOCK al consultar una tabla Iceberg o una tabla S3 con un WHERE compuesto que contiene IS NOT NULL sobre una columna que no está en la lista SELECT, usando el Native reader de Parquet V3. #106443 (Shaohua Wang).
  • Permite al usuario especificar encabezados para HTTPDictionary mediante named collections. #106459 (Jan Rada).
  • Corrige un caso en el que un worker thread podía quedar asociado a un grupo de hilos obsoleto después de que CurrentThread::attachToGroup fallara a mitad del proceso, provocando que tareas posteriores en el mismo hilo fallaran con Thread is already attached to a group. #106462 (Mikhail f. Shiryaev).
  • Se corrigió una excepción cuando una consulta de vector search usa un vector index y también otro skip index como minmax, con use_skip_indexes_on_data_read = 1. #106473 (Shankar Iyer).
  • Los valores de enum Avro mal formados ahora se validan y se rechazan con un error, en lugar de provocar una lectura fuera de límites y un aborto al deserializar datos Avro corruptos. #106476 (Miсhael Stetsyuk).
  • Corrige informes de progreso inflados al leer tablas Iceberg con filtros _file o _path. Antes, el progreso de total_bytes_to_read incluía todos los archivos del manifest independientemente del filtrado. #106491 (Pedro Ferreira).
  • Se corrigió una Bad cast exception en diccionarios de Redis que usan STORAGE_TYPE 'simple' con layout cache/direct y una única clave de cadena (compleja); ahora estos diccionarios funcionan, y las claves compuestas sobre almacenamiento simple muestran un error claro. #106501 (Vladimir Cherkasov).
  • Se corrigió un error de resultados incorrectos por el que WHERE c0 = const no devolvía filas en tablas con ORDER BY f(c0) cuando f(const) se evalúa como NaN; por ejemplo, ORDER BY sqrt(c0) con una constante negativa. El análisis de la clave primaria descartaba incorrectamente todos los gránulos y contaminaba la caché de condiciones de consulta para consultas posteriores. #106507 (Groene AI).
  • Se corrigió que LIMIT WITH TIES y LIMIT WITH TIES fraccional no respetaran la colación de ORDER BY ... COLLATE al determinar los empates. Las filas que eran iguales según la colación (por ejemplo, '1' y '01' con colación numérica) se comparaban byte a byte, por lo que algunas filas empatadas se omitían incorrectamente del resultado. #106539 (Nihal Z. Miaji).
  • Se corrigieron las optimizaciones DISTINCT in order y LIMIT BY in order (incluido LIMIT BY negativo), que devolvían resultados incorrectos cuando la entrada estaba ordenada con una colación (ORDER BY ... COLLATE). Las filas que son iguales según la colación (por ejemplo, 'a' y 'A' con una colación insensible a mayúsculas y minúsculas) se ordenan por clave de colación y no quedan adyacentes por valor, por lo que ahora la optimización in order se omite cuando se usa un comparador de colación. #106564 (Nihal Z. Miaji).
  • Se corrigieron resultados incorrectos para SELECT c, count() FROM t WHERE c GROUP BY c en tablas con _minmax_count_projection implícita, una proyección de agregación explícita o una proyección normal: antes, todos los grupos colapsaban en una sola fila con una clave constante y el recuento total de filas. #106590 (Groene AI).
  • Se corrige un error por el que los usuarios no podían usar subconsultas escalares en el primer argumento de IN cuando el segundo argumento es una tupla no constante. #106610 (Yarik Briukhovetskyi).
  • Se corrigió la excepción Mutation of Memory table produced incomplete output que se producía al ejecutar comandos ALTER TABLE <memory_table> sin efecto por fila sobre datos en un motor Memory, concretamente APPLY PATCHES, APPLY DELETED MASK, MATERIALIZE STATISTICS, MATERIALIZE INDEX, MATERIALIZE PROJECTION y REWRITE PARTS. Las tablas Memory no poseen esas estructuras, por lo que esos comandos ahora se tratan como no-ops. #106621 (Groene AI).
  • Se corrigió que session_timezone se ignorara al serializar columnas LowCardinality(DateTime) a formatos de texto (CSV, TSV, JSONEachRow, etc.). Antes, tras la primera escritura de una columna LowCardinality(DateTime) en un servidor, cualquier consulta posterior que escribiera una columna de ese tipo mostraba la cadena de hora local en la primera zona horaria observada, independientemente de session_timezone. #106634 (Groene AI).
  • Se corrigió un LOGICAL_ERROR “Trying to get name of not a column: ExpressionList” generado por consultas que pasan un asterisco dentro de multiIf a un argumento de función de tabla; por ejemplo, numbers(multiIf(*, ...), 2). La consulta ahora rechaza el matcher no resoluble con UNSUPPORTED_METHOD. #106647 (Groene AI).
  • Se corrige el fallo del servidor al iniciar con Too many marks in file ...skp_idx_idx.cmrk4, marks expected 0 (bytes size 0) cuando una tabla MergeTree tiene una parte de índice de omisión con cero granules y un archivo de marks no vacío en disco. #106675 (Groene AI).
  • Se rechazan los glob patterns patológicos de file que provocarían una recursión no acotada en el listado de directorios. Ahora se aplica una profundidad máxima de recursión de 1000; las consultas que la superen generan TOO_DEEP_RECURSION en lugar de hacer que el servidor falle por stack overflow. #106676 (Groene AI).
  • Se corrige el aborto del servidor Bad cast from type DB::ColumnNothing to DB::ColumnVector<char8_t> en FunctionIf::executeForConstAndNullableCondition cuando la condición if/multiIf se pliega como constante a Const(Nullable(Nothing)) (por ejemplo, un subíndice fuera de rango sobre un array vacío, como arraySort(x -> x, [])[toNullable(1)]). #106678 (Groene AI).
  • Se corrige la Exception 'Trying to read from input() twice.' que se producía cuando la función de tabla input estaba envuelta en una CTE no MATERIALIZED a la que se hacía referencia desde más de un lugar de la consulta. Ahora la consulta se rechaza con un error claro INVALID_USAGE_OF_INPUT en tiempo de planificación. input es un flujo de client de un solo uso y solo puede ser consumido por un único origen en el plan de consulta. #106682 (Groene AI).
  • Hace que FORMAT se aplique también a la salida de EXPLAIN de EXPLAIN ... INSERT ... SELECT ... FORMAT ... cuando SETTINGS precede a FORMAT o cuando el output format es Values. Seguimiento de #101772. #106686 (Alexey Milovidov).
  • Se corrigió un error RESOURCE_ACCESS_DENIED espurio y poco frecuente (“Scheduler queue with resource request is about to be destructed”) para una consulta a la que en realidad se le había concedido acceso a un recurso de carga de trabajo, causado por la reutilización de un objeto request local al hilo que retenía el fallo de una request anterior. #106690 (Alexey Milovidov).
  • Se corrige una condición de carrera entre la destrucción de objetos INATSConsumer y las llamadas a INATSConsumer::onMsg sobre ellos mediante callbacks en la biblioteca NATS. #106692 (Miсhael Stetsyuk).
  • Se corrigió que match, extract, extractAll y countMatches devolvieran resultados incorrectos para expresiones regulares que contienen secuencias de escape hexadecimales u octales. #106709 (ofeliacode).
  • El TLS interno de Raft de Keeper ahora respeta la configuración openSSL.client.verificationMode. Antes, la verificación de certificados de los pares siempre estaba habilitada para la comunicación Raft entre nodos de Keeper, independientemente de esta configuración, por lo que none se ignoraba silenciosamente. Ahora none deshabilita explícitamente la verificación de certificados de pares de Raft, mientras que la ausencia de esta configuración mantiene el comportamiento anterior, seguro por defecto. Las configuraciones que establezcan explícitamente none dejarán de verificar los certificados de pares de Raft después de la actualización, en consonancia con la intención configurada. #106726 (Antonio Andelic).
  • Se corrige un error lógico en los scripts de inicio en SYSTEM RELOAD CONFIG. Además, se cargan los scripts de inicio en SYSTEM RELOAD CONFIG (funcionalidad actualmente disponible solo de forma privada). #106727 (Miсhael Stetsyuk).
  • Revierte un cambio que hacía que sumMap / el combinador -Map rechazaran tipos numéricos de valor con nombres personalizados (como SimpleAggregateFunction(sum, T) y Bool) con ILLEGAL_TYPE_OF_ARGUMENT: Values for -Map cannot be summed, lo que rompía agregaciones que antes funcionaban. #106729 (Nikita Fomichev).
  • Se corrigieron varios problemas de seguridad de memoria y agotamiento de recursos en lectores de formato accesibles desde entradas no confiables: una lectura fuera de los límites del montón en el manejo de la longitud de los niveles de definición/repetición de DataPageV2 del lector nativo de Parquet, un desbordamiento de pila en archivos Parquet con esquemas profundamente anidados y asignaciones de memoria que ignoraban max_memory_usage al analizar geometrías WKB/WKT de GeoParquet y cadenas/bytes de Avro. #106739 (Raúl Marín).
  • Se corrigió un heap buffer overflow (fallo del servidor) en decodeHTMLComponent al decodificar cadenas que contienen las entidades HTML expansivas &nGt; o &nLt;, explotable por cualquier usuario con un solo SELECT. #106741 (Raúl Marín).
  • Rechaza CREATE TABLE, ALTER TABLE ADD INDEX y CREATE INDEX con GRANULARITY 0 para skipping indexes con un error BAD_ARGUMENTS claro. Antes, esto provocaba una excepción Inconsistent AST formatting en compilaciones de depuración. #106783 (Groene AI).
  • Se corrigió que Azure BACKUP/RESTORE ignorara la configuración del endpoint para discos azure_blob_storage con formato heredado. #106784 (Julia Kartseva).
  • Se corrigió una excepción Bad cast al podar partes mediante estadísticas MinMax cuando una columna clave es LowCardinality y la constante del predicado es LowCardinality(Nullable(...)). #106793 (Groene AI).
  • Corrige columnas incoherentes (que más tarde provocan LOGICAL_ERROR) en caso de excepción (es decir, MEMORY_LIMIT_EXCEEDED) durante el análisis sintáctico. #106802 (Azat Khuzhin).
  • Corrige que, después de configurar keeper_server.http_control.secure_port, el servidor devolviera una respuesta HTTP al realizar solicitudes desde clientes HTTPS. #106822 (linjiayu1025-collab).
  • Corrige un error lógico en parseDateTime con bytes de entrada no ASCII. #106856 (Pavel Kruglov).
  • Corrige que SHOW CREATE ROW POLICY emitiera restrictive/permissive en minúsculas en lugar de mayúsculas, de forma inconsistente con otras palabras clave. #106865 (Valery Petrov).
  • Corrige el caso en que parallel replicas no se aplicaba a una vista con UNION debido a una tabla vacía en el UNION. #106900 (Igor Nikonov).
  • Corrige un fallo del servidor (SIGSEGV) al leer datos Protobuf truncados con input_format_allow_errors_num > 0. #106905 (Andrey Tsarevskiy | Андрей Царевский ).
  • Corrige la excepción THERE_IS_NO_COLUMN en consultas distribuidas que involucran la optimización optimize_rewrite_aggregate_function_with_if cuando el argumento de la función de agregación requiere un cast al tipo Nullable. #106908 (Yakov Olkhovskiy).
  • Corrige una excepción (LOGICAL_ERROR) en el filtro en tiempo de ejecución de JOIN cuando la clave de join contiene un tipo Variant o Dynamic anidado dentro de un Tuple, Array o Map, y el lado derecho del join tiene un único valor distinto. #106931 (Groene AI).
  • Se corrigió un desbordamiento de enteros con signo (comportamiento indefinido) en arrayLevenshteinDistanceWeighted y arraySimilarity cuando los arrays de pesos contienen valores enteros grandes. La distancia ponderada ahora se acumula en un entero de mayor tamaño para pesos integrales, por lo que los pesos enteros grandes ya no se desbordan y siguen siendo exactos. #106934 (Groene AI).
  • Corrige un fallo del servidor (desreferenciación de puntero nulo) al ejecutar TRUNCATE o DROP en una tabla EmbeddedRocksDB cuyo identificador de RocksDB se había liberado; por ejemplo, una tabla read_only cuyo directorio de datos había sido vaciado por un TRUNCATE anterior. #106940 (Groene AI).
  • Corrige una excepción (std::length_error reportada como LOGICAL_ERROR) al leer desde una table function *Cluster como urlCluster con una configuración max_streams_for_files_processing_in_cluster_functions muy alta. El número de streams ahora se limita a un valor razonable. #106946 (Groene AI).
  • Corrige un fallo del servidor (desreferenciación de puntero nulo de DB::IConnections) en RemoteQueryExecutor cuando una consulta distribuida se cancela justo antes de enviarse a un shard. #106950 (Groene AI).
  • Se corrigió que elapsed_us fuera siempre cero y que read_rows/read_bytes se contabilizaran por debajo de su valor real en system.processors_profile_log y system.query_log para consultas de flush de inserción asíncrona (AsyncInsertFlush). #106982 (Christoph Wurm).
  • Corrige un fallo (Source column is not Map / SIGSEGV) al fusionar bloques ordenados que contienen una columna Variant con una variante Map cuyo orden de almacenamiento local difiere de su orden global. #107011 (Groene AI).
  • Corrige un error lógico conflicted_part_name.has_value() generado durante una inserción síncrona en una tabla ReplicatedMergeTree cuando el bloque insertado se deduplicó por completo y el nodo de deduplicación de la parte en conflicto ya había sido eliminado (por ejemplo, mediante un DROP PARTITION concurrente). #107026 (Groene AI).
  • Se corrigió una excepción (error lógico this->visited_views == right->visited_views) en INSERT cuando dos vistas materializadas sobre la misma source table escriben en la misma target table y una vista dependiente lee esa target table, con materialized_views_squash_parallel_inserts habilitado. #107027 (Groene AI).
  • Se corrigió un error lógico Block structure mismatch in UnionStep stream (aborto del servidor en builds de depuración/sanitizer, Code: 49 en builds de release) que se producía cuando una rama de un UNION/INTERSECT/EXCEPT leía una columna serializada como Sparse mientras que la rama hermana leía esa misma columna como Full (por ejemplo, al enviarla a una vista materializada). #107041 (Groene AI).
  • Se corrigió una excepción LOGICAL_ERROR al insertar en una tabla DeltaLake con columnas que no coinciden con su esquema de escritura (por ejemplo, una columna Nested que se descompone en subcolumns, o una table function con un subconjunto explícito de columnas). Ahora, esas inserciones fallan con un error INCOMPATIBLE_COLUMNS visible para el usuario. Cierra #87402. #107058 (Groene AI).
  • Se corrige el error TYPE_MISMATCH (“No se puede convertir la cadena … al tipo …”) en consultas ORDER BY <numeric column> ... LIMIT n cuando la materialización diferida colocaba otra columna antes de la columna de ordenación. Ahora, el umbral top-K se lee de la columna de ordenación correcta. #107060 (Groene AI).
  • Se corrigió un error de sintaxis cuando una cláusula FORMAT, SETTINGS o INTO OUTFILE sigue a SHOW ROW POLICIES o SHOW MASKING POLICIES (p. ej., SHOW ROW POLICIES FORMAT TabSeparated). #107061 (Groene AI).
  • Se corrige un ALTER TABLE ... RENAME COLUMN a TO b, RENAME COLUMN c TO a compuesto que reutiliza un nombre de columna liberado (un “intercambio”) entre columnas de distintos tipos. La part materializada registraba el tipo de columna incorrecto, por lo que un SELECT posterior fallaba con Conversion between numeric types and IPv6 is not supported (o se abortaba al cargar la part en builds de depuración). #107064 (Groene AI).
  • Se corrigieron los resultados no deterministas de la función roundDown cuando el array de boundaries contiene NaN. El mismo valor de entrada podía devolver un boundary finito o NaN según las filas circundantes del lote. Ahora, los boundaries NaN se ignoran, por lo que el resultado depende solo de los boundaries finitos. #107065 (Groene AI).
  • Se corrigió que quantileTDigest y quantileTDigestWeighted lanzaran DECIMAL_OVERFLOW para argumentos Date y DateTime cuando el quantile interpolado es fraccionario pero está dentro del rango (por ejemplo, quantileTDigestWeighted(date, weight) sobre valores que todos caben en el tipo). Ahora, el resultado fraccionario se trunca al tipo de resultado, en consonancia con quantilesTDigestWeighted; los valores realmente fuera de rango siguen generando un error. Cierra: #106722. #107066 (Groene AI).
  • Se corrige que trimLeft, trimRight y trimBoth (y los aliases ltrim, rtrim, trim) lanzaran TOO_LARGE_STRING_SIZE cuando el character set de recorte personalizado tiene más de 16 caracteres. Los conjuntos de recorte de cualquier longitud vuelven a estar admitidos. #107071 (Nikita Fomichev).
  • Se corrigió el truncamiento silencioso de valores enteros fuera de rango en definiciones de tipo Enum8/Enum16. Ahora, Enum8('a' = 200) lanza ARGUMENT_OUT_OF_BOUND en lugar de crear silenciosamente Enum8('a' = -56). #107081 (Groene AI).
  • Se corrige el orden incorrecto de las filas (y un LOGICAL_ERROR “Rows are not sorted with permutation” en builds de depuración) en consultas ORDER BY ... LIMIT de varias columnas que ordenan por columnas Nullable cuando varias filas empatan en las columnas principales. #107094 (Groene AI).
  • Se corrige un LOGICAL_ERROR (Expected the argument N to have X rows, but it has Y) al ejecutar una función sobre una columna Dynamic generada por un JOIN sobre Dynamic (por ejemplo, las filas no emparejadas de un RIGHT/FULL JOIN, o una subconsulta EXISTS correlacionada y descorelacionada en un JOIN). #107095 (Groene AI).
  • Se corrige la recreación espuria de la sesión de ZooKeeper al recargar la configuración. #107096 (Azat Khuzhin).
  • Se evita mantener el mutex durante las lecturas de ZooKeeper al actualizar las entidades de acceso. #107097 (Azat Khuzhin).
  • Se corrige una excepción Logical error: Too large size passed to allocator al hacer INSERT en una tabla MergeTree cuando adaptive_write_buffer_initial_size se establece en un valor extremadamente grande. El tamaño inicial del búfer de escritura adaptativo ahora se limita al máximo del búfer. #107104 (Groene AI).
  • Se corrige LOGICAL ERROR (Bad cast from type DB::ColumnString to DB::ColumnLowCardinality) cuando se compara una constante Variant que contiene un miembro LowCardinality con una columna clave cuya expresión clave es una función determinista no monótona (por ejemplo, un skip index minmax sobre sipHash64(col)). #107111 (Groene AI).
  • Se corrige un error lógico Bad cast from type DB::IColumn const* to DB::ColumnNullable const* cuando se pasa un asterisco calificado (t.*) sobre una clave JOIN ... USING a una función de agregación y el otro lado de un OUTER JOIN tiene una clave Nullable (con join_use_nulls = 0). #107129 (Groene AI).
  • Se corrigen lotes de ALTER TABLE ... ON CLUSTER que mezclan MODIFY SETTING/RESET SETTING con un cambio de comentario (por ejemplo, MODIFY COMMENT 'x', MODIFY SETTING old_parts_lifetime = 123) y que se aplicaban solo en la réplica líder, dejando desincronizadas las demás réplicas. También se corrige que un MODIFY COLUMN ... COMMENT posicional o con SETTINGS por columna se clasificara erróneamente como un cambio local de metadatos solo de comentario, lo que dejaba el reordenamiento de columnas fuera de los metadatos replicados y podía causar INCOMPATIBLE_COLUMNS al reiniciar la réplica. #107142 (Groene AI).
  • Se corrige un LOGICAL_ERROR (“Table expression … data must be initialized”) que se producía cuando un selector de asterisco calificado (por ejemplo, x.*) hacía referencia por nombre a una CTE recursiva dentro de su propio término recursivo. Estos selectores ahora expanden las columnas de la tabla recursiva, igual que ya lo hacen en esa posición una columna calificada (x.a) o un selector no calificado (*). #107144 (Groene AI).
  • Se corrigieron resultados de consulta incorrectos causados por la caché de condiciones de consulta cuando las mutations sobre la marcha (apply_mutations_on_fly) o las patch parts filtraban filas antes de PREWHERE. Una consulta leída con apply_mutations_on_fly = 1 podía contaminar la caché, de modo que una consulta posterior con apply_mutations_on_fly = 0 y el mismo predicado omitiera marcas que debería haber leído y devolviera muy pocas filas. La misma corrección también cubre las políticas de seguridad a nivel de fila, que se anteponen como un filtro antes de PREWHERE: una consulta ejecutada bajo una política de fila restrictiva podía contaminar la caché para una consulta posterior que usa el mismo predicado sin esa política. #107145 (Groene AI).
  • Se corrigió BACKUP en AzureBlobStorage: al copiar un archivo de datos dentro de una copia de seguridad, el objeto de destino se escribía fuera del directorio de la copia. Las comprobaciones de existencia de objetos de Backup en destinos S3 ahora usan solicitudes HeadObject exactas en lugar de listar por prefijo, lo que evita coincidencias falsas con claves de prefijos similares. #107153 (Pablo Marcos).
  • Se corrigió un desbordamiento de enteros con signo en quantileExactExclusive, quantilesExactExclusive, quantileExactInclusive y quantilesExactInclusive que podía producir resultados incorrectos para entradas Int64 que abarcan un rango amplio. #107154 (Groene AI).
  • Se corrigió un LOGICAL_ERROR (“Unexpected exception in refresh scheduling”) que podía hacer que el servidor entrara en un bucle de fallos al reiniciarse cuando una vista materializada actualizable tiene una dependencia REFRESH ... DEPENDS ON <name> cuyo nombre no calificado coincide con una tabla temporal o con el nombre de una CTE. #107156 (Groene AI).
  • Se asegura que no se ejecuten scripts de inicio al recargar la configuración, ya que eso es semánticamente incorrecto, inesperado para los usuarios y, además, propenso a errores. #107187 (Miсhael Stetsyuk).
  • Se limita el valor máximo de queue_size para la prerreserva. #107205 (Elian Gidoni).
  • Se corrige el error Argument ... of GROUPING function is not a part of GROUP BY clause en consultas que usan la función grouping con la configuración group_by_use_nulls habilitada. #107206 (Nikolai Kochetov).
  • Se corrige el orden incorrecto de los resultados para ORDER BY sobre UNION ALL con optimize_read_in_order habilitado cuando la canalización de UNION se estrechaba debido a la configuración max_streams_for_union_step; ahora ese estrechamiento se omite cuando el plan depende de streams de salida de UNION ordenados. Cierra #106880. #107208 (Vladimir Cherkasov).
  • Se corrigió una posible desreferenciación de puntero nulo al resolver la configuración del proxy durante la fase final del apagado del servidor. #107231 (Pedro Ferreira).
  • Se corrigen las consultas de actualización ligera UPDATE con réplicas paralelas heredadas habilitadas para tablas MergeTree no replicadas. #107246 (Groene AI).
  • Se corrigió una abortación del servidor (error lógico std::out_of_range) al insertar en una tabla Iceberg cuyos nombres de columna del bloque de escritura no coinciden con los ID de campo del esquema más reciente (por ejemplo, después de que un escritor concurrente cambie el nombre de una columna dentro de la ventana iceberg_metadata_staleness_ms). Ahora la inserción falla con un error de consulta claro en lugar de provocar el cierre del servidor. #107279 (Groene AI).
  • Se corrige el bloqueo durante el apagado en server y local debido a que los pool de hilos estáticos mantenían hilos inactivos indefinidamente si max_*_thread_pool_free_size > 0. #107291 (Miсhael Stetsyuk).
  • Se corrige que la función de tabla s3 ignorara silenciosamente un partition_strategy posicional en minúsculas (por ejemplo, hive). #107297 (Julia Kartseva).
  • Se corrige el manejo de low_cardinality_allow_in_native_format=0 en la serialización de bloques en paralelo. #107319 (Azat Khuzhin).
  • Corrige resultados incorrectos (a menudo vacíos) de ORDER BY <col> LIMIT n cuando la optimización use_skip_indexes_for_top_k está activa y una parte con un índice de omisión minmax en la columna de ordenación tiene filas eliminadas mediante una eliminación ligera DELETE. La optimización ya no prioriza el minmax obsoleto de las partes afectadas por una eliminación ligera frente a las partes que contienen las filas superiores activas. #107320 (Groene AI).
  • Se corrigió un error en ClickHouse Keeper por el que los metadatos de la instantánea informados mediante last_snapshot (y zk_latest_snapshot_size en mntr) podían retroceder tras instalar una instantánea obsoleta o duplicada. Esto también podía permitir que una instantánea local con el mismo índice sobrescribiera en su lugar un archivo de instantánea registrado mientras todavía se estaba transmitiendo a un par o subiendo a S3. #107321 (Antonio Andelic).
  • Se corrigió un posible desbordamiento de pila del servidor (crash) al leer un esquema o valor profundamente anidado en los formatos MsgPack, BSON, ORC, Parquet, JSON, DeltaLake, Iceberg y Paimon. Este tipo de entrada profundamente anidada ahora se rechaza con una excepción. #107341 (Raúl Marín).
  • Corrige un posible logical error en SYSTEM SYNC DATABASE REPLICA ... STRICT y hace que el modificador STRICT surta efecto realmente en las réplicas de base de datos. #107344 (Pedro Ferreira).
  • Corrige una finalización abrupta del servidor en builds de depuración/sanitizador al leer una tabla DeltaLake cuyo esquema de ClickHouse nombra una columna que no está presente en el mapeo de columnas de Delta, por ejemplo, después de que una columna se haya renombrado o eliminado en el log de Delta. Ahora la consulta falla con un error INCORRECT_DATA capturable. #107347 (Groene AI).
  • Corrige que ORDER BY ... WITH FILL produjera filas adicionales cuando una columna de ORDER BY anterior a la columna de relleno usa una intercalación COLLATE. Ahora las filas se agrupan por el prefijo de ordenación usando esa intercalación, en consonancia con el orden de clasificación. #107365 (Groene AI).
  • Se corrigió un crash (LOGICAL_ERROR en builds de depuración) y un error silencioso de resultados incorrectos (en builds de lanzamiento) al leer una tabla Iceberg cuyos metadatos vuelven a asociar un schema-id existente con un esquema distinto entre versiones de metadatos. Esos metadatos ahora se rechazan con ICEBERG_SPECIFICATION_VIOLATION. #107370 (Groene AI).
  • Corrige un LOGICAL_ERROR (Variant N (T) has size X, but expected Y) cuando una función como toString o concat se aplica a una columna Variant o Dynamic que contiene una única variante no vacía junto con valores NULL, y la función devuelve su columna de entrada sin cambios. #107374 (Groene AI).
  • Corrige Logical error: 'Duplicate announcement received for replica number N', que podía producirse con réplicas paralelas cuando una subconsulta escalar contenía subconsultas anidadas que leían la misma tabla. #107381 (Groene AI).
  • Corrige getServerSetting para que devuelva el valor efectivo en uso de los ajustes del servidor que pueden cambiarse en tiempo de ejecución (como max_server_memory_usage, mark_cache_size, max_concurrent_queries, los tamaños de los thread pool, etc.), en línea con lo que informa system.server_settings. #107388 (Alexey Milovidov).
  • Se corrige arrayResize con un argumento de tamaño Decimal: ahora el tamaño se interpreta según su valor real (p. ej., arrayResize([1, 2, 3], 1.5::Decimal(2, 1)) devuelve un elemento) en lugar de según la representación bruta sin escala. #107389 (Alexey Milovidov).
  • Se corrige un LOGICAL_ERROR (block.rows() == getRows()) que se producía en un INSERT asíncrono en una tabla Alias cuando use_strict_insert_block_limits estaba habilitado. #107400 (Groene AI).
  • Se corrige un error lógico (Unexpected return type from equals. Expected Nullable(UInt8). Got UInt8) cuando la optimización de push-down de disyunciones (predicado parcial) empuja una condición sobre una clave USING cuyo tipo el JOIN amplía. También se corrige un cierre inesperado del servidor (fallo de segmentación) en el analizador al resolver identificadores en consultas JOIN ... USING que contienen ramas if/multiIf reducibles a constantes que hacen referencia a identificadores desconocidos. #107407 (Groene AI).
  • Se corrige un heap buffer overflow (cierre inesperado del servidor) en windowFunnel al finalizar un estado de función de agregación manipulado con un tipo de evento fuera de rango, explotable por cualquier usuario con una sola SELECT. #107412 (uwezkhan).
  • Se corrige el comportamiento indefinido cuando se pasa un valor de coma flotante no finito (como nan o inf) como argumento de timestamp/duración de las Table functions prometheusQuery / prometheusQueryRange. Ese argumento ahora genera BAD_ARGUMENTS en lugar de producir un timestamp inválido. #107417 (Groene AI).
  • Se corrige que MaterializedPostgreSQL dejara de replicar cambios silenciosamente cuando el nombre de la base de datos o de la tabla de PostgreSQL contenía letras mayúsculas (el consumidor pgoutput solicitaba un nombre de publication sin comillas y en minúsculas que no coincidía con la publication que preservaba mayúsculas y minúsculas). #107423 (Alexey Milovidov).
  • Se corrige una excepción (Logical error: Not-ready Set is passed as the second argument for function 'in') cuando una key expression (ORDER BY, PRIMARY KEY, PARTITION BY o un INDEX de omisión) contenía un operador IN con una tabla en el lado derecho; por ejemplo, ORDER BY (x IN some_table). Estas key expressions ahora se rechazan al crear la tabla. #107424 (Groene AI).
  • Se corrigen resultados incorrectos de la optimización optimize_rewrite_aggregate_function_with_if para aggregate functions que preservan valores de carga útil NULL (la familia *_respect_nulls: anyRespectNulls, first_value_respect_nulls, anyLast_respect_nulls, last_value_respect_nulls). La optimización ya no reescribe f(if(cond, x, NULL)) a la forma -If para esas funciones. #107430 (Groene AI).
  • Se corrige una excepción espuria filesystem error: in last_write_time: No such file or directory al listar un directorio de object storage en disco local (por ejemplo, una tabla Iceberg en un disco local) mientras los archivos se reemplazan de forma concurrente. Una entrada eliminada de forma concurrente ahora se omite de la lista en lugar de abortarla. #107432 (Groene AI).
  • Se corrige el error THERE_IS_NO_COLUMN cuando optimize_if_transform_strings_to_enum = 1 y la expresión optimizada if/transform sobre literales de cadena es una clave GROUP BY u ORDER BY sobre una tabla Distributed o réplicas paralelas. #107455 (Groene AI).
  • Se corrigió un fallo raro del servidor en el procesamiento de DISTINCT que podía producirse cuando fallaba una asignación de memoria (por ejemplo, al alcanzar un límite de memoria) mientras se inicializaba el conjunto de claves distintas. #107467 (Groene AI).
  • Se corrigió LOGICAL_ERROR: Unexpected return type from materialize (y errores similares de incompatibilidad de tipos) cuando apply_mutations_on_fly = 1 se usa en una tabla con un UPDATE on-fly pendiente cuya columna de destino también se lee como entrada de una función mediante un UPDATE on-fly anterior, antes de una mutación ALTER MODIFY COLUMN ... LowCardinality(...). #107475 (Groene AI).
  • Se corrigieron credenciales obsoletas de AWS STS al leer tablas DeltaLake sobre S3: el motor ahora conserva el cliente S3 con credenciales actualizadas al refrescar su instantánea, por lo que las lecturas de larga duración ya no fallan después de que expire el TTL del token de STS. El proveedor de credenciales STS assume-role ahora también respeta la actualización de credenciales para cualquier acceso a S3 que use STS. #107480 (Elmi Ahmadov).
  • Se corrigió que SELECT ... FINAL y OPTIMIZE TABLE ... FINAL devolvieran filas duplicadas después de que CREATE TABLE ... CLONE AS, ATTACH PARTITION ... FROM o MOVE PARTITION ... TO TABLE adoptaran partes de un MergeTree simple en un ReplacingMergeTree, SummingMergeTree o AggregatingMergeTree. El nivel de fusión de la parte adoptada ahora se restablece a 0 cuando los motores de origen y destino difieren, para que el destino la deduplique en la siguiente fusión. #107481 (Groene AI).
  • Se corrigió un underflow de enteros en el parser del PostgreSQL wire protocol, donde un mensaje con un campo de longitud menor que 4 provocaba un wraparound en size - 4 y un resize/ignore sobredimensionado. #107485 (uwezkhan).
  • La cancelación de consultas ahora se rastrea mejor mientras se espera el quórum en ReplicatedMergeTree. #107513 (Nikita Taranov).
  • Se corrigió Not-ready Set is passed as the second argument for function 'in' (LOGICAL_ERROR) al consultar una tabla con una clave PARTITION BY y una subconsulta IN/NOT IN envuelta dentro de una expresión más grande, por ejemplo WHERE (c0 IN (SELECT ...)) != 0. #107515 (Groene AI).
  • Se corrigió que currentUser(), user(), SESSION_USER y authenticatedUser() se evaluaran como una cadena vacía en la ruta de vaciado de inserción asíncrona (con async_insert = 1). Esto afectaba a las expresiones de columna DEFAULT/MATERIALIZED y a las vistas materializadas que hacen referencia a estas funciones, que almacenaban silenciosamente una cadena vacía en lugar del usuario que realizaba la inserción. #107541 (Groene AI).
  • Con enable_analyzer = 1 (el valor predeterminado), al consultar una tabla por su nombre simple cuando solo existe en otra base de datos, ahora se sugiere la tabla correcta; por ejemplo, SELECT * FROM functions informa Maybe you meant system.functions?. Antes, el nuevo analizador devolvía un error Unknown table expression identifier sin sugerencias, mientras que el analizador antiguo ya ofrecía esa sugerencia útil. #107550 (Groene AI).
  • La memoria utilizada por la biblioteca rapidjson (en prettyPrintJSON, JSONMergePatch y el parser JSON de rapidjson) ahora se contabiliza en el memory tracker, para que las entradas patológicas se rechacen con MEMORY_LIMIT_EXCEEDED en lugar de asignar memoria sin límite. #107555 (Raúl Marín).
  • Corrige un LOGICAL_ERROR (updateFormatPrewhereInfo called more than once) que podía producirse al ejecutar una consulta sobre una fuente file(), url() o de almacenamiento de objetos con un PREWHERE explícito y un WHERE cuando optimize_prewhere_after_pushdown estaba habilitado. #107568 (Groene AI).
  • Corrige un fallo (desreferenciación de puntero nulo) que podía producirse cuando un plan de consulta distribuida se ejecutaba localmente (make_distributed_plan + distributed_plan_execute_locally) con log_formatted_queries = 1. #107570 (Groene AI).
  • Se corrigió un abortado del servidor (std::terminate, señal 6) durante el desmontaje de una consulta con plan distribuido (make_distributed_plan = 1) cuando una comprobación de estado del worker no lograba reprogramar la siguiente comprobación (por ejemplo, CANNOT_SCHEDULE_TASK durante el apagado o MEMORY_LIMIT_EXCEEDED). Ahora la consulta falla limpiamente y el servidor sigue en ejecución. #107575 (Groene AI).
  • Se añadieron las comprobaciones de límites que faltaban en el análisis de Elf y DWARF. #107579 (Michael Kolupaev).
  • Se añadieron las comprobaciones de límites que faltaban en el lector ORC. #107580 (Michael Kolupaev).
  • Se corrigió una excepción (error lógico Digest does not match) que podía producirse en RENAME TABLE, RENAME DATABASE o CREATE OR REPLACE TABLE al trabajar con una tabla TimeSeries dentro de una base de datos Replicated. Ahora ya se admite cambiar el nombre de una tabla TimeSeries. #107583 (Groene AI).
  • Corrige una denegación de servicio no autenticada por agotamiento de memoria en el puerto del protocolo MySQL. #107599 (Shaohua Wang).
  • Corrige DROP TABLE de una tabla TimeSeries en una base de datos Replicated, que antes dejaba huérfanas las tablas internas y hacía que la tarea de eliminación en segundo plano reintentara indefinidamente (DROP TABLE ... SYNC se quedaba bloqueado). #107604 (Groene AI).
  • Se corrigieron dos problemas de path traversal en el protocolo de obtención de partes replicadas que podían permitir que una réplica maliciosa escribiera archivos fuera del directorio de la parte. #107606 (Antonio Andelic).
  • Se corrigió el error ‘Account must be specified error’ al leer una tabla de Delta Lake a través de Azure. #107620 (Smita Kulkarni).
  • Se corrigió que ALTER TABLE ... REPLACE PARTITION en una tabla MergeTree simple resucitara las partes sustituidas tras reiniciar el servidor, lo que hacía que la tabla devolviera tanto las filas de reemplazo como las filas sustituidas obsoletas. #107623 (Groene AI).
  • Corrige un fallo del servidor al leer una vista materializada cuyo destino es una tabla Distributed mientras la consulta se ejecuta con enable_analyzer = 0. #107653 (Groene AI).
  • Cuando se asignan varias cuotas al mismo usuario o rol, ahora se aplican todas conjuntamente (una consulta se rechaza si se supera cualquiera de ellas), en lugar de aplicarse solo una cuota elegida de forma no determinista. SHOW QUOTA y system.quota_usage ahora muestran todas las cuotas aplicadas al usuario actual. #107664 (Alexey Milovidov).
  • Se corrigió que s3 y otras table functions de object storage lanzaran LOGICAL_ERROR en lugar de BAD_ARGUMENTS cuando se duplica un argumento de tipo key-value, por ejemplo s3('http://...', format = 'CSV', format = 'TSV'). #107670 (Groene AI).
  • Se corrigió que la interfaz MySQL fuera incompatible con MySQL Connector/J 8.2.0 y versiones posteriores (incluida la rama 9.x). El campo info del paquete OK ahora usa codificación con longitud, igual que en el servidor MySQL, para que el JDBC driver pueda conectarse. #107693 (Alexey Milovidov).
  • Se corrigió un LOGICAL_ERROR (“Input nodes size mismatch in dag”) cuando una consulta con make_distributed_plan = 1 hace un join sobre una clave envuelta en una función cuyos dos lados no tienen ningún tipo en común (por ejemplo, ON intDiv(-1, t1.key) = t2.key con una clave derecha UInt64). #107701 (Groene AI).
  • Leer datos Arrow/ArrowStream con columnas String/Binary vacías generadas por Apache Arrow Java < 19.0.0 (incluido Apache Spark) ya no lanza INCORRECT_DATA. #107764 (Raúl Marín).
  • Se corrigió una excepción BAD_GET (“Bad get: has String, requested UInt64”) en la estimación de column statistics countmin cuando una consulta compara una columna con un literal de otro tipo que no se convierte previamente, como numeric_col IN (SELECT '5') o string_col IN (SELECT 5). #107793 (Groene AI).
  • Se corrigió que las table functions odbc y jdbc se quedaran bloqueadas durante minutos e ignoraran la cancelación de consultas (KILL QUERY, max_execution_time) cuando el bridge deja de responder mientras infiere la estructura de la tabla remota. #107809 (Alexey Milovidov).
  • Se corrigió una excepción (Logical error: 'index >= result.start') al dar formato a una consulta malformada que mezcla las formas posicional y con nombre del argumento secret de las table functions s3/gcs, por ejemplo s3('url', 'a', 'b', secret_access_key = 'c'). #107818 (Groene AI).
  • Se corrige que el skip index de tipo Set no haga pruning de granules en columnas LowCardinality. #107868 (Konstantin Bogdanov).
  • Se corrigió que la insert deduplication calculara hashes incorrectos para columnas String y Array con la server setting insert_deduplication_version = new_unified_hash: inserts idénticos podían no deduplicarse porque el hash de deduplicación dependía de la posición de la fila dentro del inserted block. #107915 (Sema Checherinda).
  • Se corrigen resultados incorrectos de ORDER BY en columnas Nullable con varias claves de ordenación en macOS (Apple Silicon), causados por la falta de extensión de signo en el comparador de ordenación JIT-compiled. #107973 (Raúl Marín).
  • Se corrige una regresión de rendimiento al leer columnas Dynamic con varios threads. Causada por #100730. Cierra #107942. #107997 (Pavel Kruglov).
  • La configuración obsoleta del lago de datos storage_catalog_url ahora es rechazada correctamente por el mecanismo de protección del catálogo (antes solo se comprobaban storage_catalog_type y storage_aws_access_key_id), y el mensaje de error enumera todas las configuraciones obsoletas. #108040 (Alexey Milovidov).
  • Se corrigió un error lógico Bad cast from type DB::ColumnSparse to DB::ColumnVector<char8_t> cuando una consulta LIKE lee desde un índice text a través de la ruta de fallback de lectura directa sobre una columna almacenada de forma dispersa. #108068 (Groene AI).
  • Ahora siempre se ejecutan los handler de finalización de lote de la caché de acceso, incluso cuando el lote está vacío. #108124 (Azat Khuzhin).
  • Se corrigió un LOGICAL_ERROR (Column identifier is already registered) en algunas consultas con UNION ALL. #100770 (Shaohua Wang).
  • Se corrigió un uso después de liberar el mutex del almacenamiento de workload durante el apagado del servidor. #101447 (Tuan Pham Anh).
  • Se corrigió un interbloqueo en ALTER DATABASE MODIFY COMMENT con el catálogo Shared. #103683 (Nikolay Degterinsky).
  • Un identificador Unicode entrecomillado vacío ahora genera SYNTAX_ERROR en lugar de CANNOT_PARSE_QUOTED_STRING. #104173 (leonard9893).
  • Se preservan los tipos de parámetro originales de las funciones de agregación timeSeries* para que los tipos AggregateFunction hagan correctamente el round-trip al volver a adjuntar tablas y con réplicas paralelas. #104812 (Vitaly Baranov).
  • Se corrigió un LOGICAL_ERROR para un CTE materializado con serialize_query_plan y réplicas paralelas. #104896 (Igor Nikonov).
  • Se corrigió un desbordamiento de enteros con signo en las funciones timeSeries*ToGrid cuando el parámetro de staleness (window) está cerca de INT64_MAX. #105319 (Groene AI).
  • Un valor de la configuración compatibility ya no revierte apply_row_policy_after_final a false, por lo que las políticas de fila siempre se aplican correctamente con FINAL. #105637 (Yarik Briukhovetskyi).
  • Se corrigió clickhouse chdig client respetando SETPGROUP/RESETIDS/SETSIGDEF en el stub de posix_spawn. #105858 (Azat Khuzhin).
  • Se corrigió una excepción durante las comprobaciones de integridad de merge-tree en projections cuando el executor de merge/mutate no estaba inicializado. #105919 (Mikhail Artemenko).
  • Durante el análisis de índices en projections, el índice minmax ahora se carga desde la propia projection en lugar de desde la parte padre, lo que produce resultados correctos. #105940 (Mikhail Artemenko).
  • Se corrigió una excepción en addMonotonicChain para materialize(monotonic_chain(...)). #106050 (Nikolai Kochetov).
  • Se corrigió el fallo de RESTORE en backups que incluyen objetos dependientes de MASKING POLICY. #106086 (Julia Kartseva).
  • Se corrigió una posible corrupción de memoria al expandir funciones SQL definidas por el usuario con prefer_column_name_to_alias habilitado. #106121 (Nikolai Kochetov).
  • Un Diccionario que usa la conexión del bridge ahora se recarga después de reiniciar el servidor, restableciendo la conexión. Cierra #106151. #106152 (Pedro Ferreira).
  • Se corrigió la caché del sistema de archivos para LocalObjectStorage. #106239 (Kseniia Sumarokova).
  • Se corrigió el source remoto diferido para funciones de tabla con use_delayed_remote_source. #106470 (Nikolay Degterinsky).
  • Se corrigió timeSeriesLastToGrid para timestamps anteriores al inicio de la cuadrícula y timestamps fuera de la ventana. #106504 (Vitaly Baranov). #106577 (Vitaly Baranov).
  • Se corrigió un LOGICAL_ERROR (Inconsistent AST formatting) en un nombre de función que contenía parámetros de consulta. #106635 (Vitaly Baranov).
  • Se corrigió un error lógico cuando una tabla se elimina antes de la deserialización de tareas del plan distribuido. #106944 (Alexander Gololobov).
  • Se usa una comparación exacta para las claves Nullable de GROUP BY. #107050 (Nikolai Kochetov).
  • Se corrigió un LOGICAL_ERROR (Trying to get name of not a column) que se producía cuando un argumento de función de una función de tabla no era una expresión de columna (por ejemplo, un matcher * sin resolver de multiIf/CASE). #107411 (Alexey Milovidov).
  • Se corrigió el crecimiento sin límites de la caché de zona horaria (DateLUT) cuando se procesan muchos nombres de zona horaria no válidos distintos. #107464 (Alexey Milovidov).
  • Ahora se escribe la entrada de part_log antes de informar que una mutation simple de MergeTree ha finalizado. #107741 (Azat Khuzhin).
  • arrayFold ahora valida su argumento de array frente a entradas malformadas. #107932 (Michael Kolupaev).
  • Se corrigió una rara carrera de dato y un posible uso de memoria ya liberada en el lector en caché del archivo de índices de omisión de una part de MergeTree, que podía ocurrir cuando una consulta leía índices de omisión mientras la part se movía o se renombraba. #107995 (Raúl Marín).
  • Se corrigió la regresión de rendimiento de las subcolumnas de Map con PREWHERE. #107988 (Pavel Kruglov).
  • Se corrige parseDateTimeBestEffort con una zona horaria que lanzaba CANNOT_PARSE_DATETIME en filas NULL de toString(Nullable(DateTime64)). #108310 (Yarik Briukhovetskyi).
  • Se corrigieron la función de tabla y el engine ArrowFlight, que rechazaban una colección con nombre que omitía la clave opcional dataset con el error No such key 'dataset'. #108041 (Alexey Milovidov).
  • Se corrigió un error lógico Inconsistent AST formatting en una función de ventana sin argumentos dentro de una declaración CODEC o de engine (por ejemplo, CODEC(cume_dist() OVER (...))); esa función ahora conserva sus paréntesis para que la consulta supere correctamente un ciclo de formato y análisis. #107806 (Alexey Milovidov).
  • Se corrige hasToken con una needle que contiene separadores y que devolvía resultados silenciosamente mediante un text index en lugar de generar BAD_ARGUMENTS. #108189 (Jimmy Aguilar Mena).
  • La configuración use_skip_indexes_on_data_read ahora puede revertirse a su valor predeterminado anterior a la 26.1 (false) mediante la configuración compatibility, lo que proporciona una vía de escape para una regresión de rendimiento en la que la ruta de lectura sobre datos impide la poda de rangos de marcas de índices de omisión minmax/set/bloom_filter. #108330 (egor romanov).
  • Se corrigió un posible fallo (desreferencia de puntero nulo) cuando la sobrescritura database/db de una colección con nombre pasada a remote/remoteSecure no es un nombre de base de datos constante, por ejemplo remote(nc, database = (SELECT 1)). La consulta ahora falla con un error claro en lugar de provocar un fallo. #108271 (Groene AI).
  • Se corrigió que una vista materializada actualizable se quedara bloqueada si la conexión con ZooKeeper se perdía en un mal momento. #108234 (Michael Kolupaev).
  • Se corrige Bad cast from type DB::ColumnVector<...> to DB::ColumnTuple al leer una columna Array(Tuple(...)) cuyo valor se rellena con valores predeterminados, por ejemplo después de ALTER TABLE ... ADD COLUMN o tras una mutación ALTER TABLE ... CLEAR COLUMN sin finalizar aplicada sobre la marcha. #107232 (Groene AI).
  • Se corrige un error lógico Bad cast from type DB::ColumnDynamic to DB::ColumnNullable cuando una referencia explícita a una clave JOIN ... USING cuyo common supertype es Dynamic se pasa a una función de agregado, por ejemplo count(t.key) IGNORE NULLS. #107289 (Groene AI).
  • Se corrige la pérdida silenciosa de datos en MergeTree simple (no replicado) cuando REPLACE PARTITION, MOVE PARTITION, DETACH PARTITION o DETACH PART se ejecuta sobre una partición que todavía tiene parches de actualización ligera sin aplicar. Estas operaciones ahora rechazan el comando, tal como ya hace ReplicatedMergeTree. #107386 (Groene AI).
  • Se corrige un fallo (SIGSEGV en compilaciones release, aserción de incompatibilidad de tipos en compilaciones debug) en has sobre un Map con una clave Dynamic cuando el argumento de búsqueda es LowCardinality, por ejemplo has(map('a'::Dynamic, ...), toLowCardinality('b')). #107956 (Groene AI).
  • Se corrigió un LOGICAL_ERROR (“Block structure mismatch … between ConvertingTransform and RemovingReplicatedColumnsTransform”) al insertar en una vista materializada cuya tabla de destino TO declara una columna con un Enum más amplio que el que produce el SELECT de la vista. Ahora se aplica correctamente la ampliación válida de Enum. #107648 (Groene AI).
  • Se corrigió el error NUMBER_OF_COLUMNS_DOESNT_MATCH al consultar una tabla Distributed (o al usar réplicas paralelas) que tiene varias columnas ALIAS que se expanden a la misma expresión y que se referencian junto con ORDER BY/GROUP BY/HAVING. #107913 (Yakov Olkhovskiy).
  • Se corrigió un comportamiento no definido (se pasó un puntero nulo a memcpy) en las funciones detectCharset y detectLanguageUnknown cuando la cadena de entrada supera los 32768 bytes y no se puede detectar ningún conjunto de caracteres. #108250 (Groene AI).
  • Se corrigió un signed integer overflow (comportamiento no definido) en dateDiff con las unidades hour y minute en valores extremos de DateTime64, cercanos a los límites del rango de Int64. #108229 (Groene AI).
  • Se corrigió Too many marks en un índice de texto sobre una parte fusionada vacía. #106867 (Azat Khuzhin).
  • Se corrigió un LOGICAL_ERROR (“Unexpected return type from if”) al leer una columna con apply_mutations_on_fly = 1 después de un ALTER UPDATE col = ... WHERE <cond> con una condición no constante o falsa, seguido de ALTER MODIFY COLUMN col <new type>. #108128 (Groene AI).
  • Se corrigió una interrupción del server (Logical error en IColumn::insertFrom) al convertir un Array(Dynamic) o Array(Variant) a QBit con accurateCastOrNull, por ejemplo accurateCastOrNull(CAST(range(114), 'Array(Dynamic)'), 'QBit(Float32, 114)'). #108288 (Groene AI).
  • Se corrigió un error de sintaxis cuando un alias sigue a una subconsulta en DESCRIBE TABLE (...) AS .... #100205 (Yarik Briukhovetskyi).
  • getClientHTTPHeader ahora se trata correctamente como no determinista, por lo que su resultado ya no se reutiliza incorrectamente en la caché de resultados de consultas. #108029 (Alexey Milovidov).

Mejora en compilación/pruebas/empaquetado

  • Compilar delta-kernel-rs con la feature default-engine-native-tls para que su propio HTTP client (reqwest) pueda reutilizar el OpenSSL que ClickHouse ya tiene enlazado. Esta es solo una habilitación parcial de native-tls: object_store sigue forzando reqwest/rustls-tls-native-roots, por lo que reqwest acaba con los backends native-tls y rustls. Por ahora, delta-kernel-rs sigue deshabilitado en MSan porque ring todavía se compila a través de object_store (tanto de forma transitiva mediante rustls como directamente para la firma HMAC de solicitudes de AWS), y su ensamblador escrito a mano no genera los símbolos que requiere MSan (registrado en el proyecto upstream en arrow-rs-object-store#585). #96856 (Austin Bonander).
  • Añadir optimización posenlazado con PGO (Profile-Guided Optimization) y BOLT (Binary Optimization and Layout Tool) para el binario clickhouse. Los profiles se recopilan a partir de workloads de CI y se aplican como una medida de mejor esfuerzo durante los builds de release; ambas etapas recurren a una salida no optimizada si un profile está desactualizado o es incompatible. A día de hoy, PGO no aporta beneficios. #100938 (Alexey Milovidov).
  • Añadir el modo --storage a clickhouse keeper-bench para ejecutar benchmarks de KeeperStorage en el mismo proceso (sin red, sin raft, sin máquina de estados), usando las mismas secciones de configuración setup/generator que el modo de red. #103081 (Michael Kolupaev).
  • Corregir la compilación con ENABLE_AWS_S3=OFF. #105390 (Yue Ni).
  • Actualizar mongo-cxx-driver a r4.3.0. #105522 (Konstantin Bogdanov).
  • Corregir la compilación con RapidJSON. #105674 (Ilya Golshtein).
  • Acelerar la compilación eliminando includes transitivos de las cabeceras base/ de uso extendido y quitando código no utilizado de Poco/Logger.h, incluido como dependencia vendorizada. #105702 (Raúl Marín).
  • Actualizar libxml2 de 2.15.1 a 2.15.3. #105985 (Konstantin Bogdanov).
  • Usar expat 2.8.1 dentro de Poco. #105988 (Konstantin Bogdanov).
  • Actualizar thrift a v0.23.0. #105993 (Konstantin Bogdanov).
  • Usar la etiqueta REL_18_4 de postgres. #105994 (Konstantin Bogdanov).
  • Actualizar krb5 a 1.22.2. #106076 (Konstantin Bogdanov).
  • Actualizar curl integrado a 8.20.0. #106077 (Konstantin Bogdanov).
  • Se actualizó mariadb-connector-c a la versión 3.1.29. Se conservaron todos los parches relevantes para ClickHouse. #106287 (Nikita Mikhaylov).
  • Se actualizaron los digests de la base image distroless para corregir CVE en libssl3t64. #106360 (Rahul Nair).
  • Se utiliza wasmtime v45.0.1. #106836 (Konstantin Bogdanov).
  • Se actualizó openssl a la versión 3.5.7. #106844 (Konstantin Bogdanov).
  • La build distroless de Docker ahora también actualiza las tags flotantes :X.Y-distroless y :X.Y.Z-distroless, no solo la tag de la versión completa. #106932 (Rahul Nair).
  • Se deshabilitaron features de curl que no se usan, como la autenticación NTLM, cookies, alt-svc, HSTS, DNS-over-HTTPS, netrc, MIME y AWS SigV4. #107226 (Konstantin Bogdanov).
  • Se actualizó NuRaft con una corrección para un livelock durante la instalación de snapshots que se producía cuando el snapshot IO se ejecutaba en un background thread. La configuración de Keeper nuraft_use_bg_thread_for_snapshot_io sigue deshabilitada de forma predeterminada; ahora CI la aleatoriza para cubrir ambos modos. #107338 (Antonio Andelic).
  • Se corrigió la compilación de abseil cuando la ruta de checkout de ClickHouse contiene una substring que coincide con una extension de header. #107349 (zhiqiang).
  • El cache size de L2 ahora se determina a partir de CPUID en x86_64 en lugar de sysconf(_SC_LEVEL2_CACHE_SIZE), específico de glibc, que no está disponible en musl libc. #107469 (Konstantin Bogdanov).
  • Se aumentó el stack size de las builds con musl a 8 MiB para admitir queries con anidamiento profundo. #107470 (Konstantin Bogdanov).
  • El conjunto de símbolos de la biblioteca C localizados en bibliotecas estáticas de Rust ahora se deriva de las bibliotecas de referencia reales en lugar de una allowlist mantenida manualmente, para cubrir todos los builtins de compiler-rt y las funciones de libm de la plataforma. #107571 (Raúl Marín).
  • Se cambiaron las image distroless de server y Keeper a gcr.io/distroless/base-nossl-debian13 para que solo incluyan las bibliotecas con las que ClickHouse realmente enlaza y dejen de incorporar las que ya enlazamos estáticamente. #107837 (Rahul Nair).
  • Se reactivaron 50 stateless tests en macOS (arm_darwin) que se omitían por estar stale, y se usa fsync en lugar de F_FULLFSYNC para la sincronización de directory en macOS. #107887 (Raúl Marín).

Lanzamiento de ClickHouse 26.5, 2026-05-21. Presentación, Vídeo

Cambio incompatible con versiones anteriores

  • Se cambiaron los valores predeterminados de date_time_input_format y cast_string_to_date_time_mode de basic a best_effort. Las consultas que antes no podían interpretar cadenas de fecha y hora no básicas (por ejemplo, 2024 April 4, Apr 15, 2020 10:30:00) ahora pueden ejecutarse correctamente de forma predeterminada. Para mantener el comportamiento estricto anterior de análisis, configure estos ajustes en basic (o use compatibility). #89334 (Alexey Milovidov).
  • El nombre de elemento de Tuple null ahora está prohibido porque entra en conflicto con el nombre de subcolumna usado para los mapas nulos de Nullable, lo que provoca una resolución ambigua de subcolumnas. #98377 (Alexey Milovidov).
  • Se añadieron los ajustes dynamic_disk_allow_from_env, dynamic_disk_allow_from_zk, dynamic_disk_allow_include para impedir el uso de from_env, from_zk e include en discos dinámicos. Es un cambio incompatible con versiones anteriores porque prohíbe de forma predeterminada un comportamiento que antes estaba permitido de forma predeterminada. #99138 (Kseniia Sumarokova).
  • Ya no se puede usar el lector y escritor de Parquet obsoleto basado en Arrow. En su lugar, se usará la implementación nativa. #100949 (Alexey Milovidov).
  • SHOW CREATE TABLE t ahora da preferencia a la tabla temporal cuando existen tanto una tabla permanente como una tabla temporal llamadas t y no se especifica ninguna base de datos, en consonancia con el comportamiento existente de DESCRIBE TABLE. Además, ahora se admite la sintaxis DESCRIBE TEMPORARY TABLE. #100966 (Alexey Milovidov).
  • Se redujo el valor predeterminado de http_max_fields de 1,000,000 a 1,000 y el de http_max_field_name_size de 128 KB a 4 KB para limitar el uso de memoria antes de la autenticación por parte de las conexiones HTTP. Se añadieron los ajustes http_max_request_header_size y http_headers_read_timeout. Los usuarios que dependan de los límites superiores anteriores pueden restaurarlos mediante ajustes. #103285 (Sema Checherinda).
  • Se añadió una columna anidada histograms a system.metric_log que toma una instantánea de cada métrica de histograma registrada por fila, con un nuevo ajuste system_metric_log_show_zero_values_in_histograms para controlar la emisión de valores cero. Deja obsoleta la tabla system.histogram_metric_log. #103770 (Miсhael Stetsyuk).
  • CAST a DateTime o DateTime64 sin una zona horaria explícita ahora conserva la zona horaria de su argumento de origen (cuando el origen es un DateTime/DateTime64 con una zona horaria explícita), en consonancia con el comportamiento de las funciones toDateTime/toDateTime64. Cierra #55072. #104433 (Alexey Milovidov).
  • Se eliminó la table function kql. Use SET dialect = 'kusto' para ejecutar consultas en el dialecto KQL. #105101 (Alexey Milovidov).
  • Las window functions RANK y DENSE_RANK ahora rechazan argumentos y lanzan NUMBER_OF_ARGUMENTS_DOESNT_MATCH, en línea con el estándar SQL. Antes, consultas como RANK(x) OVER (ORDER BY id) se aceptaban silenciosamente, ignorando el argumento. Para restaurar el comportamiento permisivo anterior, configure allow_rank_dense_rank_arguments = 1. Cierra #49526. #104324 (Groene AI).

Nueva funcionalidad

  • Se agregó una nueva configuración max_bytes_ratio_before_external_join, que refleja max_bytes_ratio_before_external_group_by y max_bytes_ratio_before_external_sort. Expresa el umbral de spill a disco para hash joins como una fracción de la memoria disponible; combinada con el valor absoluto max_bytes_before_external_join, se aplica el umbral resultante más bajo. #103862 (Alexey Milovidov). La nueva configuración max_bytes_ratio_before_external_join ahora está habilitada de forma predeterminada con un valor de 0.5, reflejando max_bytes_ratio_before_external_group_by y max_bytes_ratio_before_external_sort. Los hash joins pasan automáticamente a grace hash join una vez que los datos del lado derecho superan la mitad de la memoria disponible del sistema (cuando hay límites de memoria configurados). #104285 (Alexey Milovidov).
  • Se agregó la table function filesystem. Permite representar la estructura de directorios como una tabla y consultar con SQL los metadatos y el contenido de los archivos. Originalmente #42039 por @perst20. Consulte #42039. Consulte #50208. #53610 (Alexey Milovidov).
  • Permite pasar nombres de funciones sin envoltura a funciones de orden superior como arrayMap, arrayFilter, etc. Por ejemplo, arrayMap(negate, [1, 2, 3]) ahora es equivalente a arrayMap(x -> negate(x), [1, 2, 3]). #101033 (Alexey Milovidov).
  • Se agregan la configuración send_table_structure_on_insert_with_inline_data y la opción --inline-insert-data del client para permitir que el server analice por sí mismo los datos de INSERT en línea a través del native protocol, evitando el viaje de ida y vuelta para recibir la estructura de la tabla y mejorando el rendimiento en muchas inserciones pequeñas. #101034 (Alexey Milovidov).
  • Se agregan las funciones tokenizeQuery y highlightQuery para la tokenización de consultas SQL y el resaltado de sintaxis. tokenizeQuery devuelve tokens del lexer con desplazamientos de bytes y tipos de token; highlightQuery devuelve rangos de resaltado de sintaxis basados en el parser con categorías de resaltado (keyword, identificador, función, número, cadena, etc.). #101054 (Alexey Milovidov).
  • Se agrega la configuración url_base para resolver URL relativas en la table function url y el table engine URL, siguiendo la semántica de RFC 3986. #101113 (Alexey Milovidov).
  • Se admiten valores negativos en la cláusula LIMIT BY para seleccionar filas desde el final de cada grupo en lugar del inicio. Por ejemplo, LIMIT -2 BY id devuelve las dos últimas filas por id. También se admiten desplazamientos negativos (LIMIT -1 OFFSET -1 BY id) y signos mixtos (LIMIT -2 OFFSET 1 BY id). #103222 (Nihal Z. Miaji).
  • Se admite la función json_value para generar salida con tuple y array, lo que mejora el rendimiento de múltiples consultas JSON. #78362 (kevinyhzou). Se admite el argumento JSONPath de múltiples rutas Tuple/Array en JSON_VALUE, JSON_EXISTS y JSON_QUERY, por @KevinyhZou. #101102 (Alexey Milovidov).
  • Se introduce un nuevo parámetro kafka_autodetect_client_rack. Si se configura, detecta la zona de disponibilidad mediante las capacidades de la nube y la propaga como parámetro client.rack de librdkafka para evitar comunicaciones entre zonas. #81323 (Ilya Golshtein).
  • Se añade el tipo de evento Read a system.blob_storage_log para hacer seguimiento de las operaciones de lectura en el almacenamiento de objetos, controlado por la nueva configuración enable_blob_storage_log_for_read_operations. #96867 (Alexey Milovidov).
  • Los usuarios ahora pueden ver los watches de ZooKeeper emitidos por clickhouse-server mediante la nueva tabla system.zookeeper_watches. #99277 (Den Kalantaevskii).
  • Se añadió el evento de perfil Shards, que cuenta el número de segmentos implicados en las consultas distribuidas, sumado en todas las tablas. #99470 (Alexey Milovidov).
  • Las UDF de WASM pueden declararse como DETERMINISTIC y pasar a estar sujetas al plegado de constantes. #100005 (Vasily Chekalkin).
  • Se añade la configuración parallel_replicas_prefer_local_replica: cuando está deshabilitada, las réplicas paralelas se seleccionan únicamente mediante el algoritmo de equilibrio de carga, lo que permite que incluso las consultas con max_parallel_replicas = 1 se dirijan a otro host. #100139 (Alexey Milovidov).
  • Se añaden las configuraciones de servidor {disk,storage,http}_connections_rcvbuf y {disk,storage,http}_connections_sndbuf para controlar el tamaño de los búferes de socket TCP en las conexiones HTTP salientes, lo que permite a los operadores anular el autotuning del kernel y limitar el uso de memoria por conexión. #100478 (Sema Checherinda).
  • Se admite CREATE OR REPLACE MATERIALIZED VIEW con la misma semántica de intercambio atómico que CREATE OR REPLACE TABLE. Funciona con tablas internas, tablas TO, POPULATE, REFRESH y ON CLUSTER. #100539 (DQ).
  • Se añaden las métricas de histograma s3_read_request_duration_microseconds y s3_read_request_bytes para observar la duración de la conexión de las solicitudes GET a S3 y los bytes consumidos, visibles en system.histogram_metrics y en el endpoint de Prometheus. #102058 (Sema Checherinda).
  • Se añaden los motores de tabla Paimon, PaimonS3, PaimonAzure, PaimonHDFS y PaimonLocal, con compatibilidad con lectura incremental respaldada por el seguimiento del progreso de snapshots de Keeper. El modo incremental devuelve solo las filas nuevas desde el último snapshot confirmado. Las lecturas delta de snapshots específicos están disponibles mediante paimon_target_snapshot_id, y los límites de snapshots por consulta, mediante max_consume_snapshots. La actualización de metadatos en segundo plano se puede configurar con paimon_metadata_refresh_interval_sec. Controlado por allow_experimental_paimon_storage_engine. #102343 (XiaoBinMu).
  • Se añadió una nueva configuración de tabla de Kafka, kafka_map_virtual_columns_on_write. Cuando está habilitada, las columnas llamadas _key, _timestamp, _headers.name y _headers.value en el esquema de la tabla de Kafka se emiten como la clave, la marca temporal y los encabezados correspondientes del mensaje de Kafka en INSERT, y se excluyen de la carga útil del mensaje. #103243 (Alexey Milovidov).
  • Se añadieron las consultas SYSTEM PAUSE VIEW [db.]name y SYSTEM PAUSE VIEWS para vistas materializadas actualizables. A diferencia de SYSTEM STOP VIEW, SYSTEM PAUSE VIEW no interrumpe la actualización que se esté ejecutando en ese momento: deja que la actualización en curso termine y solo impide las actualizaciones posteriores. Esto se deshace con SYSTEM START VIEW o SYSTEM START VIEWS, que ahora eliminan de forma uniforme tanto el estado detenido como el pausado. #103252 (Nikita Mikhaylov).
  • Se añadió la función regexpPosition (con los alias compatibles con PostgreSQL regexpInstr y regexp_instr) que devuelve la posición en bytes de la coincidencia número N de una expresión regular en una cadena. Admite desplazamiento inicial, modo de devolución tras la coincidencia, indicadores de regex y selección de grupo de captura. #104172 (Abhinav Agarwal).
  • Nuevas funciones isPrime e isProbablePrime para comprobaciones de primalidad. isPrime devuelve un resultado exacto para enteros sin signo de hasta UInt64. isProbablePrime también admite UInt128 y UInt256; para esos tipos más amplios, 0 significa definitivamente compuesto y 1 significa probablemente primo. El segundo argumento opcional de isProbablePrime, rounds, controla la confianza (con un máximo de 256); el valor predeterminado de 25 rondas limita la tasa de falsos positivos para un compuesto aleatorio a menos de 10^-15, y isProbablePrime puede cancelarse. #104234 (Nihal Z. Miaji). #104639 (Alexey Milovidov). #104806 (Nihal Z. Miaji).
  • clear y /clear ahora limpian la terminal en las herramientas de línea de comandos de ClickHouse en lugar de ejecutarse como una consulta por error. #104318 (Tyler Hannan).
  • Se permite que la table function file acepte un Array(String) de paths en consultas SELECT. #104442 (Yue).
  • Se añaden las columnas deterministic y higher_order a la tabla system.functions. #104479 (Pedro Ferreira).
  • Se añade un parámetro opcional de variante de codificación a bech32Encode (bech32 / bech32m) y un modo de decodificación en bruto a bech32Decode para la codificación de direcciones no SegWit (p. ej., Cosmos SDK, Injective, Osmosis). #98986 (Yash ).
  • Ahora puede write data en formato AvroConfluent, que antes era solo de entrada. Esto permite generar mensajes Avro con el framing de Confluent Schema Registry directamente desde ClickHouse, por ejemplo, al escribir en Kafka. El schema se registra automáticamente en el registry. Use la nueva configuración output_format_avro_confluent_subject para especificar el nombre del subject. #101935 (János Benjamin Antal).
  • Se añadió la función prettyPrintJSON para dar formato a una cadena JSON de forma legible para humanos. Resulta útil para dashboards o informes en los que antes embellecerlo requería un paso adicional del lado del client. Cierra #62523. #102594 (Dmitry Prokofyev).
  • Se añadió STRING_AGG como alias que no distingue entre mayúsculas y minúsculas de groupConcat para ofrecer compatibilidad con PostgreSQL y el estándar SQL. #105125 (Alexey Milovidov).
  • Los resultados de subconsultas individuales ahora pueden almacenarse en caché de forma independiente mediante SETTINGS use_query_cache = true en subconsultas específicas, sin almacenar en caché toda la consulta externa. Un nuevo ajuste, query_cache_for_subqueries = true, permite propagar use_query_cache de forma masiva a todas las subconsultas. Nota: use_query_cache en la consulta externa ya no se propaga automáticamente a las subconsultas. #99804 (Vincent Voyer).
  • Se añadió resaltado de sintaxis basado en lexer al editor de consultas de la Web UI (play.html), siguiendo los colores de clickhouse-client. #105105 (Alexey Milovidov).

Funcionalidad experimental

  • Se añadió una interfaz experimental de terminal web en /webterminal que ofrece una sesión interactiva de clickhouse-client en el navegador a través de WebSocket. Está deshabilitada de forma predeterminada; actívela con la configuración del servidor allow_experimental_webterminal. Véala aquí. #100277 (Alexey Milovidov). #105191 (Alexey Milovidov). #105059 (Alexey Milovidov).
  • El motor Kafka2 (experimental, con almacenamiento de offset basado en Keeper) ahora admite consultas SELECT directas y la configuración kafka_commit_on_select. #100276 (Alexey Milovidov).
  • Las UDFs de WASM ahora pueden convertir más tipos numéricos: enteros más pequeños a enteros más amplios (p. ej., de Int8 a UInt64) y cualquier entero a punto flotante (p. ej., de Int32 a Float32). #100435 (Vasily Chekalkin).
  • Se admite la función LIKE en la consulta DELETE FROM system.webassembly_modules. #104397 (Vladimir Cherkasov).
  • Compatibilidad con tipos geo para Iceberg. #103113 (Konstantin Vedernikov).
  • Se añadió la funcionalidad de sentencias preparadas al servidor ArrowFlight SQL. #103047 (Yakov Olkhovskiy).
  • Se mejoró la robustez del parser de KQL (para la compatibilidad con el lenguaje Kusto) al preservar la profundidad del parser y los contadores de retroceso entre las distintas etapas del parser de KQL, de modo que los límites del parser se apliquen de forma coherente en consultas KQL complejas. #103528 (Yakov Olkhovskiy).

Mejora del rendimiento

  • Reutiliza la caché de metadatos del pie de página de Parquet al leer archivos Parquet locales mediante la table function file o el table engine File. Anteriormente, la caché solo se consultaba para backends de almacenamiento de objetos. #104260 (Alexey Milovidov).
  • Propaga ORDER BY ... LIMIT n a través de joins LEFT/RIGHT cuando la clave de ordenación solo hace referencia a columnas del lado conservado por el join, lo que restringe cuántas filas debe producir la entrada de ese lado antes de realizar el join. Esto se controla con la nueva configuración query_plan_top_k_through_join (habilitada de forma predeterminada). #104268 (Alexey Milovidov).
  • Habilita de forma predeterminada las configuraciones use_top_k_dynamic_filtering y use_skip_indexes_for_top_k para mejorar el rendimiento de las consultas ORDER BY ... LIMIT N. #99537 (Alexey Milovidov). Restringe use_top_k_dynamic_filtering de forma predeterminada a columnas de ordenación de longitud fija, evitando regresiones en consultas ORDER BY <var-length-column> LIMIT N en las que el coste de comparar el umbral por fila supera el ahorro de E/S. El comportamiento anterior sigue disponible mediante la nueva configuración use_top_k_dynamic_filtering_for_variable_length_types. #104216 (Alexey Milovidov).
  • Usa la funcionalidad de arena sobredimensionada de jemalloc para reducir los fallos de página. #103958 (Nikita Taranov).
  • Limita los streams activos simultáneamente en UNION ALL para reducir el uso máximo de memoria. #100176 (Alexey Milovidov).
  • Optimiza ligeramente la caché de páginas en espacio de usuario. #100300 (Alexey Milovidov). Ahora la caché de páginas en espacio de usuario siempre es mejor que la caché de páginas del SO.
  • Las lecturas en frío de almacenamiento de objetos a través de la caché de páginas en espacio de usuario (use_page_cache_for_object_storage = 1) ahora son significativamente más rápidas, porque los fallos consecutivos de caché se consolidan en una sola solicitud HTTP en lugar de una solicitud por bloque page_cache_block_size. #104230 (Alexey Milovidov).
  • Acelera el análisis de índices que implica conversión de tipos y aplicación de funciones. Cierra #55653. #100366 (Alexey Milovidov).
  • Acelera las consultas muy grandes en tablas Merge sobre un gran número de tablas subyacentes. Cierra #32465. #100369 (Alexey Milovidov).
  • Elimina la vtable de los tipos de campo de configuración, reduciendo el tamaño de copia de Settings en ~28x y mejorando la localidad de caché mediante una disposición en arrays tipados para todos los tipos de configuración. #102269 (Raúl Marín).
  • Añade las configuraciones max_threads_min_free_memory_per_thread y max_insert_threads_min_free_memory_per_thread para reducir automáticamente el paralelismo de las consultas cuando el servidor tiene poca memoria libre. #100383 (Alexey Milovidov).
  • Reduce el uso de memoria en sistemas con poca memoria (< 4 GiB). #100389 (Alexey Milovidov).
  • Se añadió OptimizeTrivialGroupByLimitPass. Para consultas triviales SELECT ... FROM t GROUP BY k LIMIT n (sin HAVING, ORDER BY ni funciones de ventana), el analizador ahora establece max_rows_to_group_by = n + offset con group_by_overflow_mode = 'any', de modo que la agregación se detiene en cuanto se han generado n claves distintas, en lugar de agrupar todo el conjunto de entrada. Controlado por la nueva opción optimize_trivial_group_by_limit_query (habilitada de forma predeterminada). #104473 (Amos Bird) (Alexey Milovidov).
  • Índice min-max implícito a nivel de gránulo para las columnas virtuales _part_offset y _block_number, también para proyecciones. Permite una poda rápida de gránulos basada en predicados sobre columnas virtuales. #103952 (Mikhail Artemenko). #104746 (Mikhail Artemenko). #105137 (Mikhail Artemenko).
  • Para la familia de métodos de agregación prealloc_serialized, se precalculan los hash por fila durante la pasada de serialización por lotes y se usan para (a) evitar volver a calcular el hash en emplaceKey/findKey y (b) realizar prefetch por software del bucket de la siguiente fila. Esto acelera la agregación serializada o de cadenas con múltiples claves al ocultar la latencia de los fallos de caché de la tabla hash. #104475 (Amos Bird) (Alexey Milovidov).
  • Caché de condiciones de consulta para tablas Iceberg. #102115 (Konstantin Vedernikov).
  • Se optimizaron cramersV, cramersVBiasCorrected, theilsU y contingency cuando se usan con funciones de ventana. Cierra #83521. #93384 (Nihal Z. Miaji).
  • Se añadió una optimización de consultas que reescribe tupleElement(dictGet('dict', ('a', 'b', 'c'), key), N) como dictGet('dict', 'a', key), evitando recuperar atributos de diccionario innecesarios. Controlado por la opción optimize_dictget_tuple_element (habilitada de forma predeterminada). #100186 (Alexey Milovidov).
  • Se habilitó el almacenamiento en búfer para los pasos de ordenación en el iniciador de consultas distribuidas con ordenación. #100661 (Nikita Taranov).
  • Mejora del rendimiento de partial_merge JOIN. #100945 (Artem Zuikov).
  • Se redujo ligeramente la sobreasignación de memoria en partial_merge JOIN. #100963 (Artem Zuikov).
  • Se optimizaron las asignaciones/liberaciones de memoria almacenando en caché la configuración de muestreo en lugar de recorrer toda la jerarquía del rastreador de memoria. #101267 (Azat Khuzhin).
  • Se redujo la sobrecarga de asignación de memoria durante las cargas multiparte a S3 preasignando contenedores internos de seguimiento. #101799 (Gagan Dhakrey).
  • Se añadió prefetch por software en la fase de sondeo de hash join para reducir la latencia de acceso a memoria en tablas hash grandes, controlado por la opción enable_software_prefetch_in_join. #102444 (Xiaozhe Yu).
  • Optimiza la estructura de MemoryTracker, mejorando su rendimiento en ~25%. #103464 (Azat Khuzhin).
  • Reescribe los predicados coalesce(a, b, ...) <op> const y ifNull(a, b) <op> const antes del análisis de índices para que la primary key por columna y los skip indexes de cada argumento puedan descartar gránulos. Se controla con la nueva configuración allow_key_condition_coalesce_rewrite (activada de forma predeterminada). #103468 (Manuel).
  • Se mejoró significativamente el rendimiento de las consultas al leer catálogos Iceberg con archivos JSON de metadatos grandes al optimizar el procesamiento de barras escapadas. #103998 (Mohaidoss).
  • Evita la sobrecarga de la caché sin comprimir de índices cuando la caché está deshabilitada (configuración del servidor index_uncompressed_cache_size = 0, que es el valor predeterminado). #104063 (Michael Kolupaev).
  • Corrige consultas ORDER BY ... LIMIT con límites pequeños que leían demasiados gránulos al combinarse con un filtro WHERE no selectivo. Antes, cualquier filtro por encima de una lectura en orden deshabilitaba la división de tareas por rango de marcas, por lo que el pipeline no podía cancelarse entre gránulos y leía toda la parte para cada flujo. #104112 (Vladimir Cherkasov).
  • Se corrigió la falta de reutilización de la caché de tamaños de hash table tras reordenar los lados del JOIN. #104131 (Nikita Taranov).
  • Cuando fsync_after_insert está habilitada, ahora el fsync de los archivos de la parte se realiza en paralelo usando el IO thread pool, lo que acelera la finalización de inserciones en wide tables. La carga completa de ClickBench hits es aproximadamente un 22% más rápida. #104137 (Alexey Milovidov).
  • Vectoriza find_first_symbols, find_first_not_symbols, find_last_symbols_or_null, find_last_not_symbols_or_null y splitInto en AArch64 usando NEON. Antes, estas funciones auxiliares solo tenían una ruta SIMD en x86 (SSE2 / SSE4.2) y en ARM recurrían a un bucle escalar. Acelera el parsing de TSV en ~2x, las funciones de URL y splitByChar en ~1.3x en el dataset hits de ClickBench; el parsing de JSON muy denso (cadencia de campos de menos de 16 bytes) empeora ligeramente, en línea con la compensación ya existente en SSE2. #104228 (Alexey Milovidov).
  • La lectura de datos a través de una columna ALIAS trivial (p. ej., some_alias['key'] donde some_alias ALIAS m) ahora sigue la misma ruta de lectura por subcolumna que al referenciar directamente la columna subyacente, restaurando un importante ahorro de E/S para columnas con alias Map, Array, Tuple y Nullable. #104245 (Raúl Marín).
  • Reduce la contención de bloqueos en la ruta de lectura asíncrona de sistemas de archivos remotos al hacer que AsyncReadCounters por consulta no use bloqueos. #104374 (Nikita Mikhaylov).
  • Plan de consulta ligeramente mejor para el escaneo en orden de projections. #103723 (Mikhail Artemenko).
  • Amplía optimizeUseNormalProjections para que también maneje un caso específico en el que no se filtró nada, pero la sorting key de la projection puede eliminar el paso de ordenación del plan de consulta. #104680 (Mikhail Artemenko).
  • Permitir que el azúcar sintáctico json.path[] y las indicaciones de tipo explícitas funcionen correctamente en rutas JSON tipadas. #99179 (Pavel Kruglov).
  • Optimizar json.path[N].nested.path (que se expande a tupleElement(tupleElement(json.path[N], 'nested'), 'path')) a json.path[].nested.path[N], que lee muchos menos datos. #99802 (Pavel Kruglov).
  • Optimizar las comprobaciones de acceso de SHOW TABLES en system.parts sacando del bucle por tabla las comprobaciones de permisos a nivel de base de datos. #100860 (Shaohua Wang).
  • Eliminar una comprobación redundante de acceso por tabla para SHOW TABLES en la ruta rápida de SELECT name / SELECT database, name de system.tables. #100881 (Shaohua Wang).
  • Habilitar la compilación JIT en macOS. #100947 (Alexey Milovidov).
  • Omitir el aplazamiento de la política de filas después de FINAL cuando depende solo de las columnas de la clave de ordenación y es determinista, y omitir el aplazamiento correspondiente de PREWHERE que la política de filas estaba forzando en ese caso. #102884 (Yarik Briukhovetskyi).
  • Se añadió soporte para hasAny y hasAll como predicados de filtro en índices de texto. #103266 (Anton Popov).
  • Dirigir el estado de heap persistente de MergeTree (metadatos por parte y por tabla) a una arena dedicada de jemalloc, expuesta mediante las métricas asíncronas jemalloc.mergetree_arena.*. Reduce la fragmentación de la arena predeterminada en estado estable y evita que los supervivientes por parte retengan páginas que, de otro modo, podrían liberarse por decaimiento. #104136 (Raúl Marín).
  • Mejorar el manejo del tiempo de espera del client de ZooKeeper bajo carga elevada cuando muchas solicitudes se canalizan por una sola sesión. El client de ZooKeeper ahora usa un tiempo de espera basado en el progreso: mientras se reciba cualquier dato del servidor dentro de session_timeout_ms, la espera se amplía. Un límite estricto de 3 * session_timeout_ms por solicitud sigue acotando la latencia del llamador. Cierra #100466. #104351 (Antonio Andelic).
  • Mover los indicadores de trace por evento a un array separado y asignarlos de forma diferida, reduciendo la sobrecarga del tracing de ProfileEvents. #105030 (Azat Khuzhin).
  • Añadir compareTrackAt para ColumnDecimal, mejorando el rendimiento de las comparaciones en columnas Decimal. #105110 (Artem Zuikov).
  • Se añadió una implementación SIMD de MD5 (AVX2 / AVX512) que calcula hashes de múltiples entradas en paralelo, mejorando el rendimiento. #105161 (Joanna Hulboj).

Mejora

  • Mejora la salida de ayuda de todas las aplicaciones de ClickHouse: --help ahora devuelve siempre el código de salida 0, escribe en stdout y clickhouse --help en el nivel superior muestra todos los subcomandos. Añade una opción --no-sudo para clickhouse start / restart (útil en Docker) y un subcomando clickhouse help. Continuación de #58244 de @qoega. #98148 (Alexey Milovidov).
  • El valor predeterminado de input_format_column_name_matching_mode cambia de match_case a auto. Los formatos de entrada que comparan los nombres de las columnas de entrada con el esquema de la tabla (JSONEachRow, CSVWithNames, JSONColumns, BSONEachRow, RowBinaryWithNames, etc.) ahora primero intentan una coincidencia sensible a mayúsculas y minúsculas y, si falla, recurren a una coincidencia no sensible a mayúsculas y minúsculas. El comportamiento estricto anterior se conserva con compatibility. #104320 (Alexey Milovidov).
  • Se añadió STDDEV como alias no sensible a mayúsculas y minúsculas de stddevSamp para compatibilidad con PostgreSQL/el estándar SQL. #105120 (Alexey Milovidov).
  • Se añadió array_to_string como alias no sensible a mayúsculas y minúsculas de arrayStringConcat para compatibilidad con PostgreSQL. #105121 (Alexey Milovidov).
  • Se añadió unnest como alias no sensible a mayúsculas y minúsculas de arrayJoin para compatibilidad con PostgreSQL (en forma de llamada de función). #105124 (Alexey Milovidov).
  • La barra de progreso de clickhouse-client ahora muestra el uso de disco de los datos temporales (p. ej., para ordenación externa, aggregation o JOIN) junto a la RAM, incluido un desglose por host para las consultas distribuidas. #105190 (Alexey Milovidov).
  • Se añadió system.predicate_statistics_log, un nuevo log muestreado de la selectividad de los filtros de predicado y de la poda de gránulos de índice de MergeTree por consulta. Está deshabilitado de forma predeterminada; actívelo mediante la configuración del servidor predicate_statistics_sample_rate. Es necesario para las recomendaciones automáticas de índices y proyecciones. #98727 (Yarik Briukhovetskyi).
  • Permite omitir el segmento local con una tabla ausente cuando skip_unavailable_shards está habilitado. #100141 (Alexey Milovidov).
  • Añade advertencias al iniciar (visibles en system.warnings) cuando se está resincronizando un arreglo mdraid de Linux o este se encuentra en estado degradado, ya que ambas situaciones pueden afectar al rendimiento de E/S del disco o indicar fallos de disco. #100941 (Alexey Milovidov).
  • Las UDFs de WASM ahora aparecen en system.functions con las columnas origin (WasmUserDefined), syntax, arguments y returned_value correctas, rellenadas a partir de sus metadatos de tipos de ClickHouse. Antes faltaban o aparecían duplicadas con un origen incorrecto. #101053 (Vasily Chekalkin).
  • La table function generate_series ahora admite valores negativos de step para generar secuencias descendentes; por ejemplo, SELECT * FROM generate_series(99, 0, -1). #101056 (Alexey Milovidov).
  • Corrige las excepciones Context has expired que generaban algunas funciones (dotProduct, formatRow, structureToCapnProtoSchema/structureToProtobufSchema, funciones definidas por el usuario) al usarse en rutas de ejecución diferida, como expresiones DEFAULT/MATERIALIZED y configuraciones del motor de tabla, asegurando que esas funciones conserven una referencia fuerte al contexto cuando sea necesario. #101109 (Alexey Milovidov).
  • Corrige errores lógicos espurios Cache limits violated en prioridades creadas con límites cero (como la prioridad de filesystem cache por consulta que se usa cuando enable_filesystem_query_cache_limit está activado). #101428 (Alexey Milovidov).
  • Detecta automáticamente la región de los endpoints s3express. #101520 (Pradeep Chhetri).
  • Añade soporte para IDs de campo en archivos de datos al escribir en Iceberg. Cierra #102322. #102362 (Konstantin Vedernikov).
  • El panel izquierdo de la interfaz web (play.html) ahora se desplaza de forma independiente, permanece visible al desplazarse por la página y, al hacer clic en una tabla, lleva al área de consulta. #102498 (Alexey Milovidov).
  • Permite abrir la interfaz de Play en una pestaña nueva mediante Ctrl/Cmd/Shift+clic o clic central sobre el logotipo de ClickHouse en el panel izquierdo. #102501 (Alexey Milovidov).
  • Nuevas métricas para rastrear la memoria utilizada por las claves primarias de las proyecciones y la granularidad del índice de las proyecciones en todas las tablas. #102587 (Narasimha Pakeer).
  • Aplica max_network_bandwidth_for_user y max_network_bandwidth_for_all_users a las lecturas y escrituras en sistemas de archivos remotos. #103080 (Azat Khuzhin).
  • Mejora la resiliencia de las copias de seguridad cuando las vistas materializadas actualizables se refrescan constantemente, tomando decisiones basadas en el estado de las tablas de la instantánea en lugar de en un estado global. #103384 (Nikita Mikhaylov).
  • SELECT * FROM system.databases ahora siempre muestra las bases de datos de los catálogos de lago de datos, independientemente de la configuración show_data_lake_catalogs_in_system_tables. Antes estaban ocultas de forma predeterminada, lo que no era coherente con SHOW DATABASES, que siempre las mostraba. #103444 (Alsu Giliazova).
  • Alinea en el código el valor predeterminado de la configuración del servidor concurrent_threads_soft_limit_ratio_to_cores con el valor incluido en config.xml (2), para que el scheduler predeterminado de hilos concurrentes max_min_fair limite los hilos de procesamiento de consultas a 2x núcleos desde el inicio, incluso cuando no se use el config.xml distribuido. #103446 (Alexey Milovidov).
  • Mejora la robustez del sanitizador en casos límite del parser y de funciones de cadenas: maneja entradas vacías en getURLScheme, evita la aritmética con punteros nulos en las comprobaciones de max_query_size de Lexer::nextToken y corta la evaluación de subsecuencias UTF-8 en haystacks vacíos antes de decodificar. #103489 (Yakov Olkhovskiy).
  • Se mejoró la corrección de la inferencia de monotonicidad para divide(0, x) e intDiv(0, x): antes, las funciones se marcaban incondicionalmente como monotónicas, pero 0 / x no es monotónica en ningún rango que incluya 0 porque 0 / 0 no está definido (NaN/Inf para divide, excepción de división por cero para intDiv). Esta suposición incorrecta hacía que KeyCondition::applyMonotonicFunctionsChainToRange produjera rangos con left > right, lo que provocaba un LOGICAL_ERROR Invalid binary search result in MergeTreeSetIndex en compilaciones de depuración cuando una expresión IN / NOT IN sobre la primary key envolvía la clave en divide(0, key) o intDiv(0, key). Las compilaciones de release no se vieron afectadas: la aserción está condicionada por #ifndef NDEBUG. #103621 (Groene AI).
  • Se reemplazaron las métricas asíncronas HTTPConnectionPool*TCP{Rcv,Snd}BufBytes_{p50,p75,p90,p95} por un histograma basado en buckets http_pool_tcp_buf_bytes (labels group, direction) en system.histogram_metrics. Se conservan las métricas asíncronas totales por grupo. #103704 (Sema Checherinda).
  • Los server settings {disk,storage,http}_connections_{rcvbuf,sndbuf} ahora se muestran como modificables sin reinicio en system.server_settings. Sus values pueden actualizarse mediante SYSTEM RELOAD CONFIG; la ruta de aplicación en runtime ya existía desde #100478. #103772 (Sema Checherinda).
  • Se añadió soporte para símbolos resueltos (Array(String)) en flameGraph. #103816 (Azat Khuzhin).
  • El client de la CLI ahora puede especificar <rainbow_parentheses>false</rainbow_parentheses> en su configuración en entornos donde los colores del terminal interfieren con los paréntesis (de forma similar, clickhouse format ahora tiene --no_rainbow_parentheses). #103851 (Larry Snizek).
  • Se corrigió la búsqueda UTF-8 sin distinción entre mayúsculas y minúsculas de MultiVolnitsky revirtiendo inserciones parciales de putNGram en caso de fallo y cambiando los needles fallidos a buscadores de fallback, para evitar estados inconsistentes. #103864 (Yakov Olkhovskiy).
  • Se implementó sched_getcpu mediante rseq TLS en musl con compatibilidad con glibc. #104016 (Azat Khuzhin).
  • Una vista materializada actualizable replicada en modo APPEND ya no se actualizará dos veces si la connection con ZooKeeper se pierde brevemente durante la actualización. #104051 (Michael Kolupaev).
  • Se permite que las tablas Distributed sin una lista explícita de columnas validen las claves de sharding con respecto a la structure inferida de la tabla remota. #104111 (Yue).
  • Se corrigió REST catalog con la path Azure abfss. #104120 (Konstantin Vedernikov).
  • Se respetan los ajustes de authentication role_arn y role_session_name en el client de snapshots S3 de Keeper, lo que permite que las cargas de snapshots usen autenticación basada en STS AssumeRole. #104140 (Alexey Milovidov).
  • Corrige una fuga de memoria al ejecutar consultas con CTE MATERIALIZED. #104153 (Alexey Milovidov).
  • Corrige la excepción de lowerUTF8 / upperUTF8 al procesar grandes conjuntos de datos no ASCII (p. ej., durante la creación de índices de texto) en los que el búfer de salida acumulado superaría los 2 GiB; rechaza las filas individuales excesivamente largas con un error claro. #104229 (Shaohua Wang).
  • Refuerza la carga de estadísticas de columnas de MergeTree frente a fallos transitorios de E/S para evitar que se desactiven permanentemente las optimizaciones basadas en estadísticas para las partes afectadas. #104372 (zoomxi).
  • INSERT INTO ... SELECT FROM input(...) ya no requiere el privilegio CREATE TEMPORARY TABLE. #104470 (Alexey Milovidov).
  • Se añadió una nueva configuración de MergeTree, concurrent_part_removal_threshold_for_remote_disk (valor predeterminado: 16), que se usa en lugar de concurrent_part_removal_threshold cuando al menos una de las partes que se va a eliminar está almacenada en un disco remoto. El umbral anterior de 100 podía hacer que DROP TABLE y otras operaciones de eliminación de partes en backends de object storage se quedaran bloqueadas durante decenas de segundos porque las eliminaciones se realizaban en serie, aunque cada una implicaba una ida y vuelta de red independiente. La nueva configuración hace que la ruta de eliminación en paralelo se active mucho antes en el almacenamiento remoto, sin cambiar el comportamiento en disco local. #104676 (Groene AI).
  • La nueva configuración defer_partition_pruning_after_final (valor predeterminado: 1) hace que el comportamiento introducido en la versión 26.3 de omitir la partition pruning bajo FINAL pase a ser opcional. Establécela en 0 para restaurar la partition pruning anterior a la 26.3, sustancialmente más rápida en cargas de trabajo de registros de eventos donde las filas con la misma PK no pueden abarcar particiones. compatibility = '26.2' la cambia a 0 automáticamente. #104705 (Nikita Fomichev).
  • Corrige que intExp2 devolviera resultados incorrectos para entradas fuera de rango (desplazamientos >= 64 bajo JIT, y enteros con magnitud superior a INT_MAX en ambas rutas de código). #105054 (Raúl Marín).
  • Pone entre comillas los argumentos del shell construidos a partir de opciones de CLI y de la entrada analizada en clickhouse install y clickhouse git-import para que las rutas, los nombres de usuario/grupo y los hash de commit que contienen espacios en blanco o metacaracteres del shell se manejen correctamente. #105232 (Raúl Marín).
  • El table engine Alias ya no es experimental y está disponible sin la configuración allow_experimental_alias_table_engine. #103488 (Alexey Milovidov).
  • Se añadió la opción --queries-format a clickhouse-benchmark para elegir entre el formato de entrada predeterminado, con una consulta por línea y tabulaciones escapadas (tsv), y el análisis de la entrada estándar como un script con varias consultas separadas por ; (script). #99972 (Aleksandr Musorin).
  • Los operadores de tuplas por elemento tuplePlus, tupleMinus, tupleMultiply, tupleDivide, tupleModulo, tupleIntDiv y tupleIntDivOrZero ahora son variádicos y aceptan dos o más tuplas del mismo tamaño, aplicándose elemento por elemento como un left fold. Antes aceptaban exactamente dos argumentos. #104659 (Aruj Bansal).
  • Se añadió una nueva interfaz web integrada en /processors-profile que visualiza el pipeline de cualquier consulta SELECT anterior como un mapa de calor, a partir de system.query_log y system.processors_profile_log. Cada procesador se colorea según su elapsed_us y muestra estadísticas por procesador (filas, bytes, tiempos de espera) al pasar el cursor. #104614 (Nikita Mikhaylov).
  • La configuración query_plan_use_logical_join_step (y su alias query_plan_use_new_logical_join_step) ahora está obsoleta y no tiene ningún efecto; el paso lógico de JOIN se usa siempre. #104017 (Vladimir Cherkasov).
  • El campo user en play.html y en las demás páginas web integradas (dashboard.html, jemalloc.html, merges.html, binary.html, webterminal.html) ya no se rellena previamente con el texto literal default. Ahora muestra una sugerencia de marcador de posición user y está vacío de forma predeterminada. Cuando se deja vacío, la página no envía un parámetro de URL user= (y el JSON de autenticación de WebTerminal omite el campo user), por lo que el servidor aplica su comportamiento habitual y recurre al usuario default; además, las credenciales HTTP proporcionadas a través de otros canales (X-ClickHouse-User, HTTP Basic, configuración <handler><user> por handler) ya no se sobrescriben. #105254 (Alexey Milovidov).
  • Lector ORC: se desacopla la lectura basada en offsets (readBigAt) de use_prefetch, para que los datos codificados con EC en HDFS puedan leerse correctamente incluso cuando use_prefetch = false (por ejemplo, con Gluten). #103348 (zhanglistar).
  • Los archivos descargados desde play.html con el formato CSVWithNames ahora usan la extensión de archivo .csv. #103737 (JackFielding).
  • Se añadió más validación de entrada para el catálogo BigLake. #105117 (Konstantin Vedernikov).

Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)

  • Corrige el formato inconsistente al recordar si una expresión estaba entre paréntesis. #92340 (Alexey Milovidov).
  • Corrige la comparación correcta entre los tipos Decimal y Float. #94293 (zoomxi).
  • Permite argumentos posicionales en consultas distribuidas. #94359 (simonmichal).
  • Corrige un fallo de aserción en DatabaseCatalog::updateDependencies al eliminar y volver a crear una vista materializada con el mismo nombre; también corrige la pérdida silenciosa de dependencias de vistas durante RENAME TABLE o EXCHANGE TABLES cuando las dependencias referenciales estaban vacías. #98779 (Alexey Milovidov).
  • Se corrigió una interrupción del servidor (fallo de aserción en DatabaseCatalog::getTableImpl) que se producía al crear una tabla mediante ON CLUSTER con un UUID idéntico al de una base de datos existente. #98861 (xiaohuanlin).
  • Se corrigió el uso de índices de omisión en lecturas de datos (con la configuración use_skip_indexes_on_data_read habilitada) y en patch parts existentes creados por actualizaciones ligeras. #99543 (Alexey Milovidov).
  • Corrige la excepción “Not-ready Set” cuando un filtro con IN (subquery) es movido a PREWHERE por el optimizador de consultas. #100375 (Alexey Milovidov).
  • Corrige el error “Cannot find column” al combinar ADD COLUMN con RENAME COLUMN en una sola instrucción ALTER TABLE. #100387 (Alexey Milovidov).
  • Corrige las vistas con operadores UNION y INTERSECT/EXCEPT mixtos que devolvían resultados incorrectos después de DETACH/ATTACH o de reiniciar el servidor. #100390 (Alexey Milovidov).
  • Corrige la excepción “Trying to execute PLACEHOLDER action” que podía producirse durante pruebas de estrés con el AST fuzzer cuando aparecía una subconsulta correlacionada en una cláusula IN. #100398 (Alexey Milovidov).
  • Corrige una excepción de error lógico al insertar en una tabla Iceberg con una columna Date particionada por transformaciones year, month o day. #100404 (Alexey Milovidov).
  • Corrige el uso de un índice de omisión con datos incompatibles después de que ALTER TABLE MODIFY COLUMN cambie el tipo de la columna, lo que podía provocar fallos del servidor en compilaciones con sanitizador o resultados de consulta incorrectos. #100526 (Alexey Milovidov).
  • Corrige la filtración de credenciales en query_log para las funciones de tabla paimonCluster, paimonS3Cluster, paimonAzureCluster y deltaLakeS3. #100529 (JIaQi Tang).
  • Corrige que DROP TABLE en tablas con motor Kafka pudiera quedar bloqueado indefinidamente debido a un interbloqueo en rd_kafka_consumer_close. #100604 (Alexey Milovidov).
  • Sustituye la lista source_table_engines codificada de forma fija por una búsqueda en tiempo de ejecución mediante StorageFactory y DatabaseFactory. Añade source_access_type a DatabaseFactory::EngineFeatures para que CREATE DATABASE con motores de origen (PostgreSQL, MySQL, S3, etc.) requiera los mismos permisos de origen que CREATE TABLE. Corrige el fallo de GRANT TABLE ENGINE ON * con table_engines_require_grant=false. Cierra #71544. #100746 (pufit).
  • Corrige un fallo del servidor al leer desde una tabla cuya columna ALIAS contenía una subconsulta correlacionada anidada dentro de una llamada a función (p. ej., ALIAS toString(intDivOrZero(x, (SELECT ...)))). CREATE TABLE y ALTER TABLE ahora rechazan cualquier subconsulta, a cualquier profundidad, en expresiones de columna DEFAULT / ALIAS / MATERIALIZED con THERE_IS_NO_DEFAULT_VALUE. Antes, la validación superficial aceptaba subconsultas anidadas, por lo que el caso correlacionado provocaba un fallo en tiempo de lectura y el caso anidado no correlacionado parecía funcionar, pero podía dar lugar a comportamientos inesperados; ahora ambos se rechazan en tiempo de DDL. #100753 (Groene AI).
  • Se corrigió un fallo del servidor (Logical error: Bad cast from type DB::FunctionNode to DB::ColumnNode) que podía producirse al usar consultas con subconsultas correlacionadas en tablas que tienen definiciones CONSTRAINT ... ASSUME, cuando están habilitadas las settings optimize_substitute_columns y convert_query_to_cnf. #100756 (Groene AI).
  • Corrige una excepción que podía producirse al insertar una fila en una columna JSON cuando la fila introducía un nuevo campo dinámico junto con un campo tipado con un valor incompatible, y la columna se usaba posteriormente como clave de GROUP BY. #100758 (Jimmy Aguilar Mena).
  • Corrige que la planificación de IO de la carga de trabajo se omitiera silenciosamente para escrituras en S3 o almacenamiento de objetos que pasan por la ruta DiskObjectStorageTransaction (usada por los discos s3_with_keeper y explícitamente cuando use_fake_transaction=false). Antes, las escrituras de INSERT en tablas MergeTree sobre esos discos ignoraban la limitación de CREATE RESOURCE / CREATE WORKLOAD porque el enlace del recurso nunca se inyectaba en WriteSettings para la ruta de escritura transaccional. #100777 (JIaQi Tang).
  • Corrige una colisión de caché de esquema compartida entre Protobuf y ProtobufList: leer primero un mensaje como FORMAT Protobuf y luego como FORMAT ProtobufList podía fallar porque ProtobufList forzaba el esquema en caché a su forma de sobre. ProtobufList ahora recurre al tipo de mensaje almacenado en caché cuando no hay ningún esquema de sobre disponible. #100849 (Callum Cooper).
  • Corrige un desbordamiento de búfer en el montón en el puente Rust CXX debido a una incompatibilidad de ABI de std::exception. #100931 (Azat Khuzhin).
  • FunctionVariantAdaptor ahora lanza ILLEGAL_TYPE_OF_ARGUMENT cuando todas las alternativas de Variant son incompatibles con una función, en lugar de devolver silenciosamente Nullable(Nothing). Antes, un predicado WHERE function(variant_col) en el que ningún tipo alternativo era compatible devolvía 0 filas sin error, mientras que el contexto equivalente de SELECT ya lanzaba correctamente la excepción. #100939 (Vasily Chekalkin).
  • TRUNCATE ALL TABLES ya no falla cuando la base de datos contiene vistas. #100943 (Alexey Milovidov).
  • Se corrigió la optimización optimize_rewrite_array_exists_to_has para que maneje correctamente los casos con tipos incompatibles (p. ej., Date frente a String) y se volvió a habilitar de forma predeterminada. #100944 (Alexey Milovidov).
  • Se corrigió la prioridad de la configuración de S3 para que la configuración de disco de storage_configuration prevalezca sobre la sección global <s3>, y la configuración a nivel de usuario/perfil/consulta prevalezca sobre ambas. #100975 (Alexey Milovidov).
  • Se corrigió la serialización dispersa, que perdía el signo del cero negativo (-0.0) en columnas BFloat16, Float32 y Float64. #100983 (Takumi Hara).
  • Se corrigieron dos errores en el parser de geometría WKT usado al leer archivos GeoParquet y Arrow codificados en WKT: las geometrías MULTILINESTRING se analizaban incorrectamente como Polygon (lo que provocaba una excepción en las columnas tipadas y corrupción silenciosa de datos en columnas Geometry mixtas), y una cadena WKT malformada sin palabra clave de tipo desencadenaba un comportamiento indefinido en lugar de un error claro. #100997 (Vasily Chekalkin).
  • Se corrigieron las consultas grouping/GROUPING SETS en tablas distribuidas con un solo segmento que fallaban con “Method executeImpl is not supported for ‘grouping’ function”. #101030 (Alexey Milovidov).
  • Se corrigió LOGICAL_ERROR “Column identifier is already registered” en el planificador, que podía producirse cuando la misma expresión de tabla se procesaba varias veces. #101048 (Alexey Milovidov).
  • Se corrigió la excepción LOGICAL_ERROR “Column identifier is already registered” cuando se usa la configuración additional_result_filter con consultas UNION o EXCEPT. #101051 (Alexey Milovidov).
  • Se corrigió un fallo del servidor (Logical error: Bad cast from ColumnVector to ColumnNullable) al usar * APPLY con funciones de agregación y group_by_use_nulls=1 con GROUPING SETS, ROLLUP o CUBE. #101062 (Groene AI).
  • Se corrigió un bucle infinito cuando input_format_csv_skip_first_lines o input_format_tsv_skip_first_lines supera el número de líneas del archivo. #101111 (Alexey Milovidov).
  • Se corrigió un acceso fuera de límites en la optimización de materialización diferida que podía provocar una excepción en builds de depuración. #101144 (Alexey Milovidov).
  • Se corrigió la inferencia de tipos en CTE recursivas: los tipos de columna ahora se amplían iterativamente mediante getLeastSupertype entre las partes no recursiva y recursiva del UNION ALL hasta converger, lo que evita el desbordamiento de enteros en expresiones como x + 1. #101155 (Alexey Milovidov).
  • Se limitó la configuración del tamaño de bloque de compresión de MergeTree (max_compress_block_size, min_compress_block_size, marks_compress_block_size, primary_key_compress_block_size) a 256 MiB para evitar fallos del servidor cuando se establecen valores extremos mediante CREATE TABLE SETTINGS. #101159 (Groene AI).
  • Corrige un fallo LOGICAL_ERROR en QueryAnalyzer::resolve() cuando una ROW POLICY usa una subconsulta escalar en su cláusula USING (p. ej., USING (SELECT 1)). Cierra #100695. #101263 (Groene AI).
  • Corrige un comportamiento indefinido en MergeTreeDataPartWriterCompact::cancel cuando falla la asignación de un stream. #101292 (Alexey Milovidov).
  • Corrige un caso en el que no se incluía la timezone durante la asignación en la sentencia ALTER. Cierra #101328. Relacionado: https://github.com/ClickHouse/ClickHouse/pull/100647. #101403 (Yarik Briukhovetskyi).
  • Corrige un fallo del server (LOGICAL_ERROR) en consultas INSERT SELECT con ORDER BY ALL cuando el pipeline de SELECT produce múltiples streams. #101443 (Groene AI).
  • Corrige resultados incorrectos de consultas causados por el reordenamiento de join al mover un filtro de INNER JOIN (que solo hace referencia al lado preservado de un outer join) a la cláusula ON del outer join. #101504 (Vladimir Cherkasov).
  • Omite aplicar materialización diferida a planes con arrayJoin, ya que esto podía hacer que no se respetara el límite. Cierra #101608. #101644 (Vladimir Cherkasov).
  • Corrige resultados incorrectos en consultas JOIN cuando la optimización mergeFilterIntoJoinCondition descartaba silenciosamente una condición de igualdad en WHERE con tipos incompatibles. #101652 (Xiaozhe Yu).
  • Corrige que la pista de prueba error no funcionara para errores de sintaxis/análisis: antes, -- { error SYNTAX_ERROR } en una consulta malformada fallaba con “Expected server error” en lugar de coincidir con el error de análisis del lado del client. #101675 (Groene AI).
  • Corrige que INTO OUTFILE ... TRUNCATE no usara realmente el renombrado atómico: la escritura se hacía directamente en el archivo original en lugar de en un archivo temporal, por lo que, si la consulta fallaba, se destruía el contenido original. Ahora los datos se escriben en un archivo temporal y solo se renombran si la operación finaliza correctamente. #101884 (Pablo Marcos).
  • Corrige una excepción Unsupported DeltaLake type: varchar(n) al leer tablas Delta Lake cuyo schema contiene tipos de columna varchar(n) o char(n). Estos tipos ahora se asignan a String, en consonancia con cómo el protocolo Delta Lake los almacena como matrices de bytes simples en Parquet. #101973 (Flavio Malavazi).
  • Corrige una pérdida silenciosa de datos al leer archivos tar desde S3 con schema_inference_mode=union y schemas de Parquet heterogéneos: la caché de metadatos de Parquet reutilizaba incorrectamente los metadatos del primer archivo para todos los archivos posteriores del archivo tar. #101990 (Ahaan Limaye).
  • Corrige un fallo del server (LOGICAL_ERROR) al ejecutar ALTER TABLE UPDATE/DELETE en tablas Iceberg cuando no se había hecho ningún SELECT o INSERT previo en la tabla durante el mismo lifetime del server. #102113 (Alexey Milovidov).
  • Se corrige un posible crash cuando se ejecuta una consulta ALTER en tablas de una base de datos en memoria (p. ej., tablas temporales). #102360 (Den Kalantaevskii).
  • Se corrigió que formatQuery produjera grants duplicados como GRANT FILE ON *.*, FILE ON *.* TO x en lugar de GRANT FILE ON *.* TO x al dar formato a grants READ/WRITE retrocompatibles sobre la misma source. #102411 (Groene AI).
  • Se corrige la pérdida de paralelismo en la agregación después de consultas read-in-order cuando max_streams_to_max_threads_ratio es mayor que 1. #102467 (Alexey Milovidov).
  • Se corrigió un crash (LOGICAL_ERROR: Unknown virtual column) al seleccionar subcolumns (como .null para Nullable, .size0 para Array, elementos de Tuple o keys/values de Map) desde una tabla con el engine Buffer. #102470 (Groene AI).
  • Se corrige la excepción “Cannot fold actions for projection” en la optimización de reordenación de join cuando un LEFT/RIGHT JOIN con join_use_nulls se combina con otros joins que involucran más de dos tablas. #102516 (Alexey Milovidov).
  • Se corrigió un overflow silencioso en operaciones escalares pointwise sobre numericIndexedVector (p. ej., numericIndexedVectorPointwiseAdd) cuando el escalar está fuera de rango. Estas entradas ahora generan INCORRECT_DATA en lugar de devolver valores corruptos. #102546 (FriendLey).
  • Se corrige el formato inconsistente del AST para INSERT con SAMPLE y OFFSET a nivel de consulta. Cierra #102523. #102547 (zoomxi).
  • Se corrige la excepción LOGICAL_ERROR en groupConcat al deserializar un estado malformado de aggregate function. #102558 (Christoph Wurm).
  • Ya no se acepta contenido no válido al final de los valores CSV de Time64 con input_format_csv_use_default_on_bad_values=0. Cierra #102490. #102596 (Yarik Briukhovetskyi).
  • Se corrige la excepción UNKNOWN_ELEMENT_OF_ENUM al insertar el valor predeterminado en una JSON column con paths tipados como Enum. Cierra #102359. #102687 (Pavel Kruglov).
  • Se corrige la corrupción de columns_substreams.txt al renombrar columnas en algunos casos. Cierra #102259. #102689 (Pavel Kruglov).
  • Se corrige la inserción en el tipo de dato Time durante el parsing de JSON. Cierra #102016. #102690 (Pavel Kruglov).
  • Se corrige la codificación hexadecimal de la muestra de contenido en nombres de archivo de schema en caché. Cierra #101904. #102703 (Pavel Kruglov).
  • Se corrigió una infracción del orden de clasificación (crash en debug, corrupción silenciosa de datos en release) durante la operación de merge de SummingMergeTree cuando la clave ORDER BY es una expresión hash sobre una columna Float32 que contiene valores NaN de señalización. #102791 (Groene AI).
  • Se hicieron cancelables mediante KILL QUERY DETACH DATABASE ... SYNC y otras operaciones que llaman a waitDetachedTableNotInUse, y se hizo que respondieran al apagado del server, evitando bloqueos indefinidos cuando una consulta concurrente mantiene una referencia a una tabla. #102804 (Antonio Andelic).
  • Se corrigió un posible resultado incorrecto de ANY RIGHT JOIN. #102893 (Nikita Taranov).
  • Se corrigió un problema por el que las solicitudes a S3 fallaban con ios_base::clear: unspecified iostream_category error en lugar de reintentarse, debido a que BufferedStreamBuf::flushBuffer de Poco no manejaba escrituras cortas desde la capa de socket. #102894 (Sema Checherinda).
  • Se corrigió el fallo de la función de tabla input('auto') a través de la interfaz HTTP en consultas INSERT SELECT. #102902 (Miсhael Stetsyuk).
  • Se deshabilitó la optimización trivial de LIMIT con row policies/additional_table_filters (para permitir el análisis paralelo de índices). #102921 (Azat Khuzhin).
  • Se ocultó la clave secreta en la función SQL HMAC. Corrige #102927. #102997 (Mikhail f. Shiryaev).
  • Se corrigió la excepción MULTIPLE_EXPRESSIONS_FOR_ALIAS generada en consultas distribuidas que hacen referencia varias veces a la misma llamada a quantile (por ejemplo, en SELECT, HAVING y ORDER BY) con optimize_syntax_fuse_functions habilitado. #103014 (tanner-bruce).
  • Se corrige un caso detectado por CI en el que se pasaba un set no preparado cuando el filtro depende de la columna del lado izquierdo. Cierra #102966. #103029 (Yarik Briukhovetskyi).
  • Se corrige castOrNull a JSON en algunos casos. Cierra #101818. #103036 (Pavel Kruglov).
  • Se corrigió un problema por el que SELECT DISTINCT devolvía silenciosamente resultados incompletos cuando una proyección de agregación coincidía con la consulta y algunas partes de la tabla no tenían datos de proyección (por ejemplo, la proyección se añadió a una tabla que ya contenía datos y no se ejecutó MATERIALIZE PROJECTION). Cierra #102951. #103052 (Nihal Z. Miaji).
  • Se corrigió la excepción TOO_FEW_ARGUMENTS_FOR_FUNCTION cuando un predicado WHERE como AND(OR(A, A), A) se reduce a un único argumento de nivel superior durante la extracción de expresiones comunes en el analizador. #103072 (Peng).
  • Corrige un error lógico Function writeSlice expects same column types for GenericArraySlice and GenericArraySink que se producía al evaluar if/ifNull sobre tuplas, mapas o arrays que contenían un elemento QBit. ColumnQBit::structureEquals comparaba incorrectamente la tupla interna de una columna QBit con el envoltorio externo de la otra, por lo que columnas QBit estructuralmente idénticas se reportaban como diferentes. #103084 (Groene AI).
  • Hace que DETACH DATABASE con database_atomic_wait_for_drop_and_detach_synchronously respete KILL QUERY en lugar de quedar bloqueado indefinidamente cuando se mantiene una referencia a una tabla. #103095 (Alexey Milovidov).
  • Corrige un segfault al eliminar un módulo WASM usando un predicado que no es un identificador (por ejemplo, WHERE 1=1). #103101 (Joe Redfern).
  • Corrige una ruptura de compatibilidad con versiones anteriores por la que clientes antiguos fallaban con UNEXPECTED_PACKET_FROM_SERVER al insertar en un servidor más reciente mediante remote() o tablas distribuidas, causada por una llamada incondicional a sendProgress al final de processInsertQuery. #103148 (Sema Checherinda).
  • IN con un segundo argumento de tipo tuple no constante no debe aplicar CAST a los elementos de la tuple reduciéndolos al tipo del lado izquierdo, ya que esto puede provocar overflow. Cierra #103055. #103169 (Yarik Briukhovetskyi).
  • Corrige el uso de un valor no inicializado en una función del protocolo. #103187 (Pavel Kruglov).
  • Corrige LOGICAL_ERROR (Bad cast … to ColumnLowCardinality) durante el análisis de índices de MergeTree cuando una cláusula WHERE compara una columna clave LowCardinality con una constante convertida a un tipo que contiene LowCardinality anidado (por ejemplo, Variant(LowCardinality(Date), String)). #103211 (Groene AI).
  • Corrige Logical error: 'index < bucket_count' en la familia de funciones de agregación timeSeries*ToGrid (por ejemplo, timeSeriesResampleToGridWithStaleness, timeSeriesChangesToGrid, timeSeriesResetsToGrid, timeSeriesRateToGrid) cuando se llamaba con parámetros de timestamp extremos que provocarían overflow en la aritmética con signo de 64 bits durante el cálculo del número de buckets. También limita el número total de buckets de la cuadrícula a 16 millones para evitar asignaciones accidentales de grandes cantidades de memoria a partir de entradas maliciosas. #103223 (Groene AI).
  • Corrige la excepción Logical error: 'Port is already connected' durante la expansión de la pipeline en la ruta FINAL diferida para ReplacingMergeTree. El error afectaba a las consultas con query_plan_optimize_lazy_final = 1 cuando ReadFromMergeTree::initializePipeline insertaba transformaciones internas (por ejemplo, un Resize) que conectaban entre sí los procesadores de la sub-pipeline, lo que hacía que LazyUnorderedReadFromMergeTreeSource::expandPipeline intentara conectar puertos de salida que ya estaban conectados. #103230 (Groene AI).
  • Corrige resultados incorrectos de LIMIT BY y DISTINCT cuando la entrada es un UNION ALL de subconsultas ordenadas. El optimizador del plan de consulta trataba incorrectamente esa unión como si estuviera ordenada globalmente, lo que provocaba que se devolvieran filas adicionales. #103231 (Nihal Z. Miaji).
  • Corrige un posible fallo durante el cálculo de estadísticas en el tipo Map con replicación diferida. Cierra #102390. #103273 (Pavel Kruglov).
  • Corrige una carrera de dato en las fuentes de diccionario de ClickHouse, MySQL, PostgreSQL y XDBC, donde clone() const lee de la misma cadena invalidate_query_response en la que isModified() const escribe. #103277 (Miсhael Stetsyuk).
  • Corrige la detección incorrecta de monotonicidad para Date32. Cierra #101265. #103283 (Yarik Briukhovetskyi).
  • Limita a 64 KB las cadenas del paquete TCP Hello previas a la autenticación y añade la configuración de servidor handshake_timeout_milliseconds para limitar el tiempo total de handshake, evitando que clientes no autenticados consuman memoria en exceso o mantengan hilos ocupados indefinidamente. #103284 (Sema Checherinda).
  • Corrige min_value &gt; max_value en las estadísticas de Parquet ColumnIndex para columnas String. #103334 (Saurabh Kumar Ojha).
  • Corrige el manejo incorrecto de filas NULL para entradas Nullable(Tuple(...)) en flattenTuple y tupleToNameValuePairs. flattenTuple ahora conserva el mapa nulo externo para que las filas NULL sigan siendo NULL. tupleToNameValuePairs ahora cambia el tipo de valor del resultado a Nullable(T) cuando es posible si la entrada es Nullable(Tuple(...)), de modo que las filas NULL produzcan [('a', NULL), ('b', NULL)] en lugar de [('a', 0), ('b', 0)]. Cuando el tipo de elemento no puede envolverse en Nullable (por ejemplo, Array), se usan valores predeterminados en lugar de NULL. Cierra #103312. #103383 (Nihal Z. Miaji).
  • Comprueba si hay datos Dynamic aplanados malformados en Native format. #103392 (Pavel Kruglov).
  • Corrige una RPC obsoleta que provocaba que la replicación se quedara bloqueada tras la sincronización del snapshot. #103406 (Seva Potapov).
  • Corrige un fallo del servidor por LOGICAL_ERROR “Cannot pop N rows from X” (en builds de depuración / con sanitizador) al leer un documento BSON malformado que contenía un valor cuyo tipo BSON es incompatible con el tipo de la columna de destino dentro de una columna Nullable(T) o Array(Nullable(T)). La fila malformada ahora produce una excepción ILLEGAL_COLUMN limpia, como estaba previsto. #103418 (Groene AI).
  • Corrige un fallo del servidor en arrayFill y arrayReverseFill cuando se aplican a una columna Array(String) cuya primera fila está vacía junto con una lambda constantemente falsa. El índice size_t del bucle de agregación / subarreglo sufría un underflow hasta SIZE_MAX, lo que luego provocaba una lectura fuera de límites dentro de ColumnString::doInsertManyFrom. Misma familia de errores que #12263. #103424 (Groene AI).
  • Corrige ACCESS_DENIED / UNKNOWN_TABLE en RMV APPEND descendentes con SQL SECURITY DEFINER cuando el EXCHANGE de un RMV REPLACE ascendente cambia la identidad del almacenamiento de destino a mitad de la resolución. #103427 (Alexander Gololobov).
  • Pobla la columna _time a partir de la table function url. #103437 (Nikita Taranov).
  • Corrige una posible lectura fuera de los límites en la ruta de descompresión del codec ALP al procesar una entrada malformada con un ancho de bits no válido. #103457 (Raufs Dunamalijevs).
  • Corrige un error por el que SYSTEM SYNC FILESYSTEM CACHE '<name>' ON CLUSTER ... podía perder el nombre de la caché al dar formato a la consulta, lo que provocaba que los nodos remotos sincronizaran todas las cachés del filesystem en lugar de solo la caché solicitada. #103469 (Asish Kumar).
  • Corrige el procesamiento de la ruta codificada en URL en deltaLakeAzure. Cierra #103509. #103525 (Smita Kulkarni).
  • Corrige un uso de memoria después de su liberación en el heap al multiplicar un estado de AggregateFunction por un entero (por ejemplo, quantilesExactState(...) * N). El bucle de exponenciación por cuadrados fusionaba el estado consigo mismo, lo que no está definido cuando la merge de la función de agregación reasigna su almacenamiento interno. Cierra STID 0988-40af. #103536 (Groene AI).
  • Corrige un raro LOGICAL_ERROR “Part X intersects previous part Y” que se producía durante el arranque de una tabla ReplicatedMergeTree cuando dos partes vacías inesperadas en disco tenían rangos de bloques superpuestos, pero sin que una contuviera a la otra. La excepción abortaba el hilo de asociación de la tabla e impedía que la tabla se iniciara. #103537 (Groene AI).
  • Corrige Logical error: Incorrect mark rows for part ... (aserción solo de depuración) que se activaba por mutaciones en tablas MergeTree con granularidad de índice no adaptativa (index_granularity_bytes = 0) cuya última marca de datos estaba incompleta (se reproduce de forma más fiable con DETACH/ATTACH seguido de una eliminación ligera DELETE). #103538 (Groene AI).
  • Corrige que clickhouse-local devolviera silenciosamente 0 filas al leer desde los pseudoficheros /proc y /sys mediante la table function file() (por ejemplo, SELECT * FROM file('/proc/cpuinfo', 'RawBLOB')). #103548 (Ashrith Bandla).
  • Corrige el manejo del argumento max_string_length para el table engine GenerateRandom. #103550 (Alex Kuleshov).
  • Corrige el enmascaramiento de credenciales anidadas en los logs. #103552 (Vitaly Baranov).
  • Corrige la detección de SVE que usaba instrucciones SVE cuando no estaban disponibles. #103568 (Raúl Marín).
  • Corrige el análisis de los argumentos de almacenamiento de GenerateRandom. #103574 (Konstantin Bogdanov).
  • Corrige un bucle infinito en WITH FILL para datos que empiezan con ±inf. #103580 (Konstantin Bogdanov).
  • Se corrige que JSONExtract en un tipo Variant truncara silenciosamente los números JSON fraccionarios. Antes, JSONExtract('{"x": 3.14}', 'x', 'Variant(Int64, Float64)') devolvía Int64=3 y JSONExtract('{"x": 3.14}', 'x', 'Variant(String, Int64)') devolvía Int64=3, perdiendo la parte fraccionaria. Ahora el valor fraccionario se conserva sin pérdida: un miembro Float64/Decimal lo toma cuando está presente; de lo contrario, un miembro String captura el JSON original. Los tipos Variant que contienen solo miembros enteros (p. ej., Variant(Int64, Int32)) y la extracción directa como entero (JSONExtract(json, 'Int64'), JSONExtractInt, etc.) no cambian. #103620 (Groene AI).
  • Se corrige que SYSTEM INSTRUMENT REMOVE sin argumentos produjera std::bad_optional_access (código de error 1001) en lugar de SYNTAX_ERROR (código de error 62). #103622 (Pablo Marcos).
  • Se corrige un error lógico/comportamiento indefinido en la window view windowID y tumble cuando se llamaban con una cadena de zona horaria como tercer argumento. #103641 (Alexey Milovidov).
  • El logging del client de S3 ahora trata las respuestas HTTP 400 que incluyen un encabezado x-amz-bucket-region no vacío (región de firma SigV4 incorrecta) como un caso informativo de región incorrecta, con una línea de log más clara en lugar de la ruta genérica de error. El proveedor de credenciales de identidad web de STS se añade a la cadena de credenciales de S3 solo cuando la identidad web está configurada, lo que reduce las advertencias espurias en implementaciones que no la usan. Cierra #99140. #103673 (MeltonSmith).
  • Se corrige SYSTEM SYNC REPLICA <db>.<tbl> IF EXISTS para que finalice correctamente y sin errores cuando la base de datos no exista, en consonancia con el comportamiento actual para una table inexistente y con el precedente establecido por DROP TABLE IF EXISTS. Antes, la consulta lanzaba UNKNOWN_DATABASE pese a IF EXISTS. Cierra #103629. #103689 (Groene AI).
  • Se corrige el error lógico Arguments of 'plus' have incorrect data types lanzado por FunctionBinaryArithmetic::executeImpl2 cuando una table MergeTree tenía Array(LowCardinality(...)) en su clave de ordenación y una cláusula WHERE usaba plus / minus entre esa columna y una constante Array de un tipo de elemento distinto. KeyCondition::getMonotonicityForRange ahora elimina LowCardinality de forma recursiva antes de invocar el despacho numérico interno. #103701 (Groene AI).
  • Se corrige una condición de carrera al redimensionar dinámicamente la cache en 26.1+. #103702 (Kseniia Sumarokova).
  • Se corrige un problema por el que los índices de omisión text y bloom_filter en columnas ALIAS cuya expresión contenía una lambda con constantes capturadas (p. ej., arrayMap((k, v) -> concat(k, '=', v), mapKeys(m), mapValues(m))) se ignoraban silenciosamente. #103708 (Anton Popov).
  • Se corrige que position y positionCaseInsensitive con un start_pos cercano a UINT64_MAX se quedaran bloqueados o provocaran un fallo de segmentación debido a un desbordamiento en la aritmética de punteros. #103766 (Raúl Marín).
  • Se corrige un comportamiento indefinido al analizar DateTime con una parte fraccionaria doble. #103773 (Yarik Briukhovetskyi).
  • Se corrigió una regresión de corrección de datos en 26.x por la que if y multiIf compilados con JIT, con un tipo de resultado Decimal y un literal no Decimal (entero o de coma flotante) en una rama, devolvían silenciosamente un valor 10^scale demasiado pequeño. La ruta lenta (sin JIT) no se veía afectada. Solución temporal en las versiones afectadas: SET compile_expressions = 0. #103809 (Groene AI).
  • Corrige el reenvío del tokenizer desde el text index a las funciones compatibles. #103826 (Elmi Ahmadov).
  • Corrige resultados incorrectos de numbers, generate_series y fuentes similares que respetan rangos cuando la cláusula WHERE usa IN o NOT IN sobre una tupla cuyos elementos se deduplican en una única columna clave (por ejemplo, WHERE tuple(number, number) NOT IN (tuple(1, 2))). Cierra #103660. #103835 (Groene AI).
  • Mantiene el pico real de memoria del hash join con spilling automático por debajo de max_bytes_before_external_join. Antes, la preasignación basada en estadísticas, el redimensionamiento in situ de la hash table y los buckets en memoria sin límite de GraceHashJoin podían hacer que la consulta superara el límite configurado y provocara MEMORY_LIMIT_EXCEEDED. #103838 (Alexey Milovidov).
  • Corrige un bloqueo durante el cierre de clickhouse-local cuando hay logs del sistema configurados (como text_log o filesystem_cache_log). SystemLogs::flushImpl llamaba a BaseDaemon::instance().flushTextLogs(), que lanza std::bad_cast fuera de clickhouse-server, y dejaba los hilos de guardado en ejecución hasta que pthread_cond_destroy bloqueaba la destrucción de las colas de logs del sistema. #103874 (Alexey Milovidov).
  • Rechaza las consultas CTE MATERIALIZED cuyo body se resuelve en distintos tipos de columna inferidos según la referencia, con un error claro TYPE_MISMATCH en lugar de hacer que el server falle con un Bad cast LOGICAL_ERROR. Esto ocurría cuando el body del CTE hacía referencia a identificadores de un ámbito externo (por ejemplo, un alias de la proyección de la subconsulta llamante) que se expandían en línea como constantes distintas para cada referencia. #103879 (Groene AI).
  • Corrige un uso de valor no inicializado en los optimizadores del query plan de conversión de JOIN (tryConvertAnyOuterJoinToInnerJoin, tryConvertAnyJoinToSemiOrAntiJoin) cuando el filtro sobre un ANY OUTER JOIN contiene una función no determinista como rand, now o rowNumberInAllBlocks. El optimizador ya no intenta plegar constantes en esos filtros y deja el JOIN sin cambios, lo que también evita conversiones incorrectas a INNER/SEMI/ANTI JOIN que podían descartar filas silenciosamente. #103880 (Groene AI).
  • Corrige un uso de memoria tras su liberación en StorageKafka2 que podía hacer que el server fallara cuando se sustituye una session de Keeper mientras el consumer mantiene bloqueos efímeros de partición de tópico. #103890 (Groene AI).
  • Se corrigió un LOGICAL_ERROR “Primary key type mismatch” lanzado al hacer JOIN de una tabla EmbeddedRocksDB mediante JOIN ... USING (key) con una subconsulta cuya columna clave tiene un tipo distinto (por ejemplo, Nullable(UInt64), Int64, Decimal) al de la primary key del almacenamiento. El planner ahora descarta DirectKeyValueJoin cuando hay incompatibilidad de tipos y recurre a HashJoin, que gestiona la conversión de tipos. #103928 (Groene AI).
  • SET max_threads = DEFAULT (y lo mismo para max_final_threads y max_parsing_threads) ya no pierde el estado auto. Anteriormente, después de restablecer una de estas configuraciones, system.settings mostraba el recuento de núcleos resuelto (p. ej., 32) en lugar de 'auto(32)', y el servidor se comportaba como si el valor se hubiera fijado explícitamente. #103991 (Groene AI).
  • Corrige SIZES_OF_ARRAYS_DONT_MATCH al leer columnas AggregateFunction(topK(N), String) cuyo alpha_size persistido había aumentado debido a un ciclo de deserialize+serialize anterior a la versión 25.12. #104002 (Raúl Marín).
  • Se corrigió una vulnerabilidad de inyección SQL en dictionary sources de PostgreSQL, Cassandra y XDBC: las claves de tipo cadena que contenían comillas simples se escapaban con \' (barra invertida), que estos backends interpretan como una barra invertida literal en lugar de una secuencia de escape, lo que permitía inyectar SQL arbitrario en las consultas de lookup del diccionario. ExternalQueryBuilder ahora emite el escape estándar de SQL '' para esos backends; los dictionary sources de ClickHouse y MySQL siguen usando escape con barra invertida. #104009 (Shaohua Wang).
  • Se corrigió una posible incompatibilidad de tipos en la agregación cuando el tipo de una columna se cambiaba a o desde LowCardinality y no se reconstruía la proyección min-max. #104013 (Nikita Taranov).
  • Corrige un bucle infinito de optimizaciones de consultas provocado por no propagar la prevención de eliminar columnas no usadas al fusionar expresiones. #104083 (János Benjamin Antal).
  • Corrige LOGICAL_ERROR en StreamingStorageRegistry::renameTable al renombrar por lotes tablas de streaming (S3Queue, Kafka, RabbitMQ) mediante seguimiento de identidad basado en UUID en lugar de nombres. #104101 (Nikita Taranov).
  • Se corrigieron resultados incorrectos cuando un CTE construido con UNION ALL contenía una rama SELECT DISTINCT y la consulta externa proyectaba solo un subconjunto de las columnas del CTE. El nuevo analyzer RemoveUnusedProjectionColumnsPass eliminaba incorrectamente la columna no referenciada de la proyección DISTINCT interna, lo que hacía que filas que debían seguir siendo distintas (mismo valor en la columna proyectada, pero distinto valor en la columna eliminada) colapsaran en una sola. #104114 (Groene AI).
  • Corrige varios problemas de exactitud en casos límite en la configuración optimize_inverse_dictionary_lookup, donde la optimización podía descartar filas silenciosamente o suprimir excepciones. Cierra #103270. Cierra #103085. #104133 (Nihal Z. Miaji).
  • Corrige una escritura fuera de límites al deserializar el estado quantileTiming. #104141 (Alexey Milovidov).
  • Corrige un comportamiento indefinido cuando un valor Float64 fuera de rango se convierte a un tipo entero wide (UInt64, Int64, Int128, UInt128, Int256, UInt256). Anteriormente, valores iguales a Float64(numeric_limits<T>::max()) (que se redondea hacia arriba a un valor por encima del máximo real) eludían la comprobación de límites y producían UB en el cast posterior. Esto afectaba al parsing de parámetros de funciones de agregación (topK, histogram, uniqUpTo, groupArrayInsertAt, etc.) y a configuraciones de tipo entero mediante SET <setting> = <Float64>. Cierra #103817. #104154 (Groene AI).
  • Se corrige la excepción LOGICAL_ERROR “Unexpected return type from comparison. Expected UInt8. Got Const(Nullable(UInt8))” al comparar un Tuple(Tuple(Nullable(...))) anidado (o con un nivel de anidamiento mayor) con un literal String. El tipo de retorno de la comparación ahora se infiere correctamente como Nullable(UInt8), en consonancia con el comportamiento en tiempo de ejecución. #104171 (Groene AI).
  • Se corrigió un aborto del servidor (UndefinedBehaviorSanitizer: reference binding to null pointer, segfault en versiones release) en SELECT ... FROM <ReplacingMergeTree(version, is_deleted)> FINAL PREWHERE is_deleted = <expr> AND <other column expr> cuando query_plan_optimize_lazy_final = 1. El paso de lectura lazy-FINAL sin intersección perdió la columna is_deleted de su encabezado de salida porque PREWHERE la consumió como entrada sin volver a exponerla como salida. El paso posterior addIsDeletedFilter acabó desreferenciando un puntero nulo ActionsDAG::Node. #104177 (Groene AI).
  • Al llamar a la tabla system.failpoints, se usaba un failpoint, por lo que podía quedar deshabilitado. #104237 (Pedro Ferreira).
  • Se corrige MemorySanitizer: use-of-uninitialized-value en las funciones detectLanguage* cuando la entrada contiene un carácter UTF-8 que termina exactamente en el límite del búfer. #104257 (Raúl Marín).
  • Se corrige un error lógico (Bad cast from type DB::CachedObjectStorage to DB::S3ObjectStorage) que abortaba el análisis de argumentos de los motores y las table functions de data lake (icebergS3, deltaLakeS3, etc.) cuando se invocaban con SETTINGS disk = '...' sobre un disco cuyo object storage subyacente está envuelto por un decorador, como una filesystem cache. Cierra #89300. #104258 (Groene AI).
  • Se corrige el análisis de expresiones de subíndice entre paréntesis en columnas llamadas values, por ejemplo (values['a']), para que ya no se interpreten como expresiones de tabla VALUES estándar de SQL. #104312 (Desel72).
  • Se corrige un aborto del servidor/LOGICAL_ERROR en el hilo de eviction en segundo plano de la filesystem cache (SLRUFileCachePriority::collectEvictionInfo) que podía producirse cuando keep_free_space_size_ratio o keep_free_space_elements_ratio eran lo bastante altos como para activar la eviction mientras todas las cache entries ya habían sido promovidas a la protected queue de SLRU (con la probationary vacía). #104313 (Groene AI).
  • Se corrigen excepciones (NOT_FOUND_COLUMN_IN_BLOCK, LOGICAL_ERROR, AMBIGUOUS_COLUMN_NAME) al usar projections con vistas UNION ALL, window functions o colisiones de nombres entre alias y columnas. Regresión de #88798. #104317 (Amos Bird).
  • Se corrige un posible underflow en el análisis de arrays de Postgres. #104322 (Grant Holly).
  • Las funciones que devuelven un tipo no Nullable (como Array, Tuple o Map) ahora aceptan argumentos Nullable. Las funciones afectadas incluyen extractAll, extractAllGroups, extractAllGroupsHorizontal, extractAllGroupsVertical, extractGroups, splitByChar, splitByString, splitByRegexp, splitByWhitespace, splitByNonAlpha y alphaTokens. Las filas de entrada NULL ahora producen el valor predeterminado del tipo de resultado (por ejemplo, un array vacío) en lugar de generar “Nested type is not allowed inside Nullable type”. #104326 (Alexey Milovidov).
  • Corrige las estadísticas de Iceberg en tablas particionadas. Esto cierra #104321. #104329 (Konstantin Vedernikov).
  • Corrige un error lógico fatal durante el arranque del servidor en macOS (y compilaciones similares de jemalloc), en el que Jemalloc::verifySetup informaba incorrectamente de una discrepancia en jemalloc_enable_background_threads porque los mallctls opcionales background_thread / max_background_threads no existen; la verificación se omite cuando esos mallctls no están disponibles, y getValue ya no deja la salida sin inicializar si falla. Cierra #102183. #104330 (SAYON DEEP).
  • Corrige una regresión que afectaba a la corrección, por la que las consultas SELECT con max_rows_to_read_leaf y read_overflow_mode_leaf = 'throw' podían lanzar incorrectamente TOO_MANY_ROWS incluso cuando un skip index habría reducido la lectura por debajo del límite del leaf. La configuración simétrica para non-leaf (max_rows_to_read / read_overflow_mode) ya estaba contemplada. #104331 (Groene AI).
  • toUUID, toUUIDOrNull, toUUIDOrZero, toUUIDOrDefault, CAST a UUID y Nullable(UUID), accurateCastOrNull a UUID, y los formatos de entrada que interpretan un UUID a partir de texto (Avro, MsgPack, JSONExtract, …) ahora rechazan cadenas con la longitud correcta pero que contienen caracteres no hexadecimales. Antes, estas entradas se convertían silenciosamente en un UUID fabricado al leer más allá del final de la tabla de búsqueda de dígitos hexadecimales; ahora toUUID lanza CANNOT_PARSE_UUID, y las variantes Or* devuelven NULL / el UUID cero / el valor predeterminado proporcionado. #104370 (Groene AI).
  • Corrige Bad cast LOGICAL_ERROR en caseWithExpression (y en SQL CASE expr WHEN ... THEN ... ELSE ...) cuando el supertype solo de THEN y el supertype de (THENs + ELSE) acaban en distintos almacenamientos ColumnDecimal; por ejemplo, valores THEN (UInt16, Int8) con un ELSE de Decimal(9, 2). Cierra #104335. #104378 (Groene AI).
  • Los fallos internos informados mediante logExceptionBeforeStart (flushes de asynchronous insert, refreshes de vistas materialized, errores de parse lanzados durante consultas internas) ahora incrementan correctamente los ProfileEvents FailedInternalQuery, FailedInternalSelectQuery y FailedInternalInsertQuery, junto con los contadores visibles para el usuario FailedQuery, FailedSelectQuery y FailedInsertQuery. Antes, estos contadores internos permanecían en cero para los fallos ocurridos antes de que empezara la ejecución de la consulta, por lo que no contabilizaban una clase importante de fallos internos. #104399 (Groene AI).
  • Corrige el error Code: 36. BAD_ARGUMENTS Expected literal, got {name:Type} que se producía al usar un parámetro de consulta dentro del ajuste base_backup de una sentencia BACKUP o RESTORE (p. ej., BACKUP ... SETTINGS base_backup = S3({backup_name:String}, ...)). La regresión se introdujo en 26.1.5 con el PR #99205. Cierra #103324. #104413 (Groene AI).
  • Corrige un abort del servidor en escrituras de IcebergLocal/IcebergS3 cuando a ALTER TABLE ... DROP COLUMN le sigue un INSERT con iceberg_metadata_staleness_ms mayor que cero. Ahora ALTER invalida la caché local de archivos de metadatos de Iceberg para que las lecturas y escrituras posteriores vean el nuevo esquema. #104419 (Groene AI).
  • Corrige DROP ROLE, DROP USER, DROP SETTINGS PROFILE, DROP ROW POLICY, DROP QUOTA y DROP MASKING POLICY para eliminar las referencias a la entidad eliminada de cualquier otra entidad de acceso que la referenciara (p. ej., la lista DEFAULT ROLE de un usuario, la lista TO de un perfil de ajustes o los beneficiarios de una política de filas) y persistir esa limpieza en disco. Antes, el estado en memoria parecía correcto porque SHOW CREATE filtra los UUID desconocidos, pero los archivos .sql en disco conservaban entradas colgantes ID('<dropped-uuid>'), y las referencias reaparecían en el siguiente reinicio del servidor, manifestándose como errores ACCESS_ENTITY_NOT_FOUND durante la ejecución distribuida de consultas. #104427 (Groene AI).
  • Corrige un abort del servidor provocado por azureBlobStorage, el engine AzureBlobStorage y DeltaLake-on-Azure con una cadena de conexión cuya URL BlobEndpoint tiene un puerto vacío, no numérico o fuera de rango (p. ej., BlobEndpoint=http://host:abc/). Ahora el servidor devuelve un error BAD_ARGUMENTS claro en lugar de abortar en builds de depuración o con sanitizador. #104460 (Groene AI).
  • Permite usar un identificador sin comillas como nombre de usuario en las Table functions remote y remoteSecure, igual que los argumentos de base de datos y tabla aceptan identificadores sin comillas. Antes, esa consulta fallaba con un error de autenticación engañoso que hacía referencia al usuario default. #104465 (Alexey Milovidov).
  • Corrige Logical error: Incorrect ASTSelectWithUnionQuery (modes: M, selects: N) que se activaba cuando el cuerpo de una función definida por el usuario en SQL contiene un UNION ALL interno entre paréntesis (p. ej., CREATE FUNCTION f AS x -> (SELECT 1 UNION ALL (SELECT 1 UNION ALL SELECT 1))). #104477 (Groene AI).
  • Corrige que uniqThetaIntersect devolviera la cardinalidad del primer argumento en lugar de 0 cuando el segundo argumento es un estado uniqTheta vacío; por ejemplo, el resultado de uniqThetaMergeStateIf(s, predicate) cuando el predicado excluye todas las filas. #104529 (Groene AI).
  • Corrige SHOW TABLES y system.tables, que truncaban silenciosamente el listado de las bases de datos DataLakeCatalog respaldadas por catálogos REST de Iceberg (iceberg-rest, onelake, biglake). Cuando el servidor del catálogo paginaba la respuesta de list-tables o list-namespaces (por ejemplo, Microsoft Fabric / OneLake con más de ~50 tablas por espacio de nombres), las tablas de las páginas posteriores quedaban silenciosamente ocultas para SHOW TABLES y system.tables, aunque se podían consultar mediante SELECT directo. RestCatalog ahora sigue el token de continuación next-page-token definido por la especificación OpenAPI de Iceberg REST, en consonancia con el comportamiento existente de PaimonRestCatalog y UnityCatalog. #104531 (Groene AI).
  • La función de tabla input ahora infiere su estructura a partir de la cláusula FORMAT de la consulta INSERT circundante cuando ese formato tiene un esquema fijo (LineAsString, RawBLOB, JSONAsString, etc.), por lo que los usuarios ya no tienen que repetir la estructura como input('line String') para estos formatos. #104532. #104533 (Groene AI).
  • Se actualizó el tipo de dato de los campos del historial de Iceberg de Int32 a Int64. Cierra #94176. #104579 (Smita Kulkarni).
  • Se corrigió Inconsistent AST formatting LOGICAL_ERROR al analizar una llamada a función en la que una lambda va después de una coma, por ejemplo SELECT substring(x, `x` -> `x`). Antes, el parser fusionaba silenciosamente los argumentos anteriores en el lado izquierdo de la lambda, produciendo una llamada de un solo argumento que no podía volver a analizarse para reconstruir el mismo AST. Ahora preserva la aridad original de la función. #104626 (Groene AI).
  • CHECK TABLE t ahora da preferencia a una tabla TEMPORARY frente a una permanente con el mismo nombre cuando no se proporciona un calificador de base de datos, en consonancia con la precedencia ya utilizada por SHOW CREATE TABLE, DESCRIBE TABLE, OPTIMIZE TABLE y ALTER TABLE. Anteriormente, CHECK TABLE t omitía por completo las tablas temporales, por lo que fallaba con UNKNOWN_TABLE en una tabla temporal Log o File, aunque esos motores admiten CHECK. Continuación de #100966. #104637 (Groene AI).
  • Corrige el bucle de terminación y reinicio de Keeper cuando se envía get /keeper/availability_zone con quorum_reads=true a un Keeper sin <placement> configurado. #104663 (myeongjun).
  • Corrige una carrera de dato TOCTOU en FutureSetFromTuple::buildOrderedSetInplace que provoca un error lógico. #104673 (Miсhael Stetsyuk).
  • Corrige varias funciones que devolvían resultados distintos para la misma entrada según si los argumentos llegaban como columnas o constantes: bitRotateLeft / bitRotateRight (recuentos de desplazamiento en los límites), length(FixedString) / concatWithSeparator con entradas LowCardinality(Nullable), roundDown sobre NaN y rightUTF8 sobre UTF-8 no válido. #104710 (Raúl Marín).
  • Se corrigió que anyHeavy devolviera un valor no dominante cuando el valor más frecuente era el valor predeterminado de la columna y los datos estaban repartidos en varias partes de MergeTree (ruta de lectura de columnas dispersas). #104712 (Raúl Marín).
  • Se corrigen varios defectos en el manejo de restricciones de configuración: las restricciones de MergeTreeSettings declaradas sobre el nombre canónico de una configuración podían eludirse escribiendo en un alias de esa configuración; la comprobación de la restricción disallowed_values lanzaba una excepción en rutas de clamp (consultas secundarias, workers ON CLUSTER, vistas SQL SECURITY DEFINER) en lugar de descartar silenciosamente el cambio. #104737 (Raúl Marín).
  • Se corrige una excepción LOGICAL_ERROR (Metadata is not initialized) provocada por OPTIMIZE TABLE, ALTER TABLE ... DELETE, ALTER TABLE ... ADD COLUMN y otras variantes de ALTER en una tabla Iceberg / IcebergLocal / DeltaLake / Hudi adjunta de forma diferida cuyo metadata aún no se había cargado (algo típico después de un reinicio del server, o después de que una escritura previa de metadata fallara y dejara en disco un archivo de metadata corrupto). Ahora la operación continúa normalmente si el metadata se carga correctamente o, en caso contrario, muestra el fallo de carga subyacente como una excepción normal visible para el usuario en lugar de abortar el server en builds de debug / sanitizador. #104738 (Groene AI).
  • Se corrige un segfault debido a un error de use-after-free en AvroConfluentRowInputFormat. #104751 (Miсhael Stetsyuk).
  • Las variantes escalares de numericIndexedVectorPointwiseMultiply, numericIndexedVectorPointwiseDivide, numericIndexedVectorPointwiseEqual y numericIndexedVectorPointwiseNotEqual ahora generan INCORRECT_DATA cuando se llaman con un escalar UInt64 superior a Int64::max. #104784 (FriendLey).
  • Se corrige un error por el que sobrescribir manualmente una configuración mediante su nombre de alias (por ejemplo, SET enable_analyzer = 1 en lugar de SET allow_experimental_analyzer = 1) después de aplicar una configuración compatibility podía hacer que esa sobrescritura se revirtiera tras un cambio posterior de la configuración compatibility. #104829 (Raúl Marín).
  • Se corrige que el logger de AWS quedara deshabilitado después de https://github.com/ClickHouse/ClickHouse/commit/0e8ad4355c9d. #104837 (Konstantin Bogdanov).
  • Se corrigen otras tres funciones que devolvían resultados distintos para la misma entrada según si los argumentos llegaban como columnas o como constantes: transform (y caseWithExpression a través de ella) con un valor predeterminado constante Date/Date32/Enum/FixedString, operadores de comparación entre un String y un FixedString constante, e if/ifNull/nullIf con una rama FixedString bajo una condición constante. #104858 (Raúl Marín).
  • Se corrige el cierre del server con Bad cast from type DB::ColumnConst to DB::ColumnNullable durante la poda de particiones de tablas MergeTree cuando la expresión de partición contiene una cadena de funciones que colapsa en un único valor constante (como floor(NULL, toRelativeYearNum(...))). #104861 (Groene AI).
  • Se corrige una carrera de dato detectada por ThreadSanitizer en el constructor de copia de ContextData: table_function_results se copiaba desde el objeto fuente sin adquirir table_function_results_mutex, por lo que un escritor concurrente de Context::executeTableFunction podía entrar en carrera con la lectura no sincronizada en el constructor de copia. #104879 (Groene AI).
  • Se corrigen las comprobaciones de consistencia de data part para tipos con estructura dinámica y se detectan columns_substreams.txt corruptos. Reenvío de https://github.com/ClickHouse/ClickHouse/pull/103858 con cambios adicionales. #104888 (Pavel Kruglov).
  • Corrige una condición de carrera entre DROP y UNDROP en DatabaseCatalog. #104915 (Azat Khuzhin).
  • Corrige el redimensionamiento dinámico de la caché del sistema de archivos con segmentos descargados parcialmente, incluida la restauración de la contabilidad tras una expulsión fallida. #104921 (Antonio Andelic).
  • DETACH TABLE sobre una tabla temporal (sin la palabra clave TEMPORARY) ahora genera correctamente SYNTAX_ERROR, en línea con el comportamiento de DETACH TEMPORARY TABLE. Antes, establecía silenciosamente una marca interna is_detached y devolvía el control sin error. Para eliminar una tabla temporal, use DROP TEMPORARY TABLE o DROP TABLE (este último resuelve la tabla temporal mediante Context::ResolveExternal). Cierra #103475. #104943 (Groene AI).
  • Hace que la table function filesystem respete max_memory_usage / max_server_memory_usage al cargar el contenido de los archivos. Antes, las lecturas paralelas de contenido, si eran grandes o numerosas, podían superar el límite sin generar MEMORY_LIMIT_EXCEEDED y terminar siendo finalizadas por OOM. #104956 (Alexey Milovidov).
  • Se corrigió un LOGICAL_ERROR generado al filtrar system.detached_tables por uuid (por ejemplo, SELECT count() FROM system.detached_tables WHERE uuid = '...'). La consulta ahora devuelve el resultado esperado en lugar de abortar el servidor. #104979 (Groene AI).
  • flattenTuple ya no genera un LOGICAL_ERROR cuando se invoca sobre una tupla cuya estructura anidada contiene solo hojas Tuple() vacías (por ejemplo, Tuple(c0 Array(Tuple())) o Tuple(c0 Tuple())). Estas entradas ahora producen una excepción ILLEGAL_TYPE_OF_ARGUMENT orientada al usuario, que explica que el resultado del aplanado sería una tupla vacía. #104989 (Groene AI).
  • Corrige un aborto del servidor y un error silencioso de resultados incorrectos al consultar loop(remote(...)) (o cualquier loop() que envuelva un almacenamiento que pueda diferir la agregación) con GROUP BY. Antes, el planner externo añadía MergingAggregatedStep basándose en la etapa de procesamiento informada por el almacenamiento interno, pero LoopSource siempre materializa su select interno con QueryProcessingStage::Complete y emite fragmentos de columnas simples, por lo que MergingAggregatedTransform provocaba un LOGICAL_ERROR (Chunk info was not set for chunk in MergingAggregatedTransform) con enable_parallel_replicas = 1 y, en caso contrario, descartaba silenciosamente la agregación externa. #105001 (Groene AI).
  • clickhouse-benchmark --reconnect (solo, sin valor) dejó de funcionar inadvertidamente en 25.4 debido a un cambio que convirtió --reconnect en una opción entera, exigiendo un valor. La forma sin valor vuelve a funcionar y equivale a --reconnect=1 (reconectar en cada consulta). #105006 (Groene AI).
  • Se corrigió una salida JSON malformada para nombres de columnas terminados en secuencias UTF-8 incompletas. #105012 (Pablo Marcos).
  • Corrige la pérdida silenciosa de datos tras EXCHANGE TABLES o CREATE OR REPLACE TABLE en la tabla de origen de una vista materializada. La arista de dependencia entre la MV y su vista de origen ahora se conserva en el nombre original para que siga activándose en los inserts. La regresión fue introducida por #98779; restaura el comportamiento anterior a la regresión. #105029 (Sema Checherinda).
  • Se corrige CANNOT_COMPILE_CODE Could not find symbol __fixunsdfti al compilar con JIT expresiones que convierten un Float a UInt128, como toUInt128(<Float64 expression>). Faltaban en el resolvedor de símbolos del JIT las builtins sin signo de compiler-rt para conversión de float a entero de 128 bits. Cierra #105031. #105048 (Raúl Marín).
  • Se corrige que clickhouse-local no imprimiera mensajes de registro de una consulta fallida cuando send_logs_level está configurado. #105067 (Alexey Milovidov).
  • Se corrigen resultados incorrectos cuando se hace referencia a la misma vista parametrizada más de una vez en la misma consulta con distintos valor del argumento. Antes, el analizador agrupaba las llamadas en una sola, descartando silenciosamente todos los filtros salvo el primero. #105170 (Alexey Milovidov).
  • Se corrige que la fila TOTALS se mostrara dos veces en la parte inferior de la tabla de resultados en la interfaz web play.html. #103803 (Alexey Milovidov).
  • Se rechazan vectores no finitos (NaN, ±Inf) durante la búsqueda vectorial (ya sea como vectores de búsqueda o como vectores de referencia); antes provocaban un comportamiento indefinido en usearch. #104079 (Groene AI).
  • PromQL: se corrige el operador de agregación para vectores vacíos. #104425 (Vitaly Baranov).
  • PromQL: se corrige el manejo de errores en la API de consulta de Prometheus. #104741 (Vitaly Baranov).
  • Se corrige una condición de carrera en MergeTreeTransaction::afterCommit en la que, tras una pérdida de connection entre la escritura del CSN de commit en ZooKeeper y la finalización de la transacción, la respuesta COMMIT podía llegar al client antes de que el nuevo creation_csn / removal_csn se hiciera visible en system.parts. #104708 (Tuan Pham Anh).
  • Se corrige el crecimiento exponencial del uso de memoria en el parser de KQL al convertir la indexación de arrays anidados (arr[arr[arr[...]]]). #105142 (Alexey Milovidov).
  • Se corrigen resultados incorrectos para RIGHT ANY JOIN cuando la tabla de la derecha tiene varias filas por clave y el block de salida se divide debido a límites de tamaño. Cierra #99431. #102064 (Vladimir Cherkasov).
  • Se comprueba si hay desbordamiento de pila en el lector de Avro durante la deserialización de tipos anidados. #102417 (Pavel Kruglov).
  • Se corrigen filas duplicadas en system.completions para la configuración de MergeTree: cada nombre de configuración aparecía dos veces porque tanto getMergeTreeSettings como getReplicatedMergeTreeSettings se volcaban pese a tener nombres de configuración idénticos. Cierra #102013. #102015 (Groene AI).
  • Se corrige que StorageObjectStorageQueue (S3Queue, AzureQueue) bloqueara el apagado hasta completar la lectura desde el almacenamiento de objetos de archivos procesados parcialmente. Ahora la fuente aborta la lectura inmediatamente al apagarse; la deduplicación garantiza que las filas ya transmitidas a la tabla de destino antes del apagado no se dupliquen cuando se vuelva a intentar procesar el archivo en el siguiente inicio. #103126 (Tuan Pham Anh).
  • Se corrigen las inserciones de varios bloques en el table engine Alias con insert_deduplication_token para que se conserven todos los bloques. #103246 (Enric Calabuig).
  • Se corrigen JSONHas y JSONExtractBool en columnas JSON nativas, que devolvían el valor extraído (convertido a UInt8) en lugar de 0/1. #103313 (zxuhan7).
  • Se protege el formato de entrada CustomSeparated frente a datos malformados o maliciosos que omiten format_custom_row_after_delimiter. La detección de encabezados, la inferencia de esquemas y las filas con un número variable de columnas acumulaban antes campos sin límite y podían asignar muchos gigabytes de memoria antes de fallar. Ahora la lectura falla con INCORRECT_DATA en cuanto una sola fila contiene más de 1.000.000 de campos. #103404 (Groene AI).
  • Se corrige RESTORE de tablas MergeTree replicadas para que la asociación de partes restauradas use backup_restore_keeper_max_retries en lugar del presupuesto habitual de reintentos de inserción de Keeper. #104610 (Pablo Marcos).
  • Se corrigen resultados incorrectos de WHERE p AND <LowCardinality(Nullable(int)) constant> en tablas MergeTree. Antes, esas consultas devolvían cero filas porque la poda de partes derivaba un valor NULL predeterminado del tipo LowCardinality(Nullable(...)) y generaba una condición de guarda notEquals(x, NULL), descartando todas las partes. #104767 (Groene AI).
  • Se corrige un resultado de agregación incorrecto al agrupar por una función no inyectiva de una columna que también es la clave de partición (por ejemplo, PARTITION BY a con GROUP BY intDiv(a, 2) o a % 2). Los valores de distintas particiones que se asignaban al mismo grupo no se fusionaban, lo que producía filas de grupo duplicadas con allow_aggregate_partitions_independently = 1. #104869 (Nihal Z. Miaji).
  • Se corrige una condición de carrera en la transferencia de instantáneas de Keeper por la que una instantánea podía eliminarse o moverse mientras se enviaba a un follower en recuperación. #104941 (Antonio Andelic).
  • Se corrige un error silencioso de resultados incorrectos en hilbertEncode y mortonEncode, por el que un primer argumento Tuple no constante (máscara de rango) usaba los valores de la fila 0 para determinar el desplazamiento de bits de todas las filas. Ahora las funciones calculan los valores de la máscara para cada fila, por lo que el resultado ya no depende de que la entrada sea constante ni del tamaño del bloque. #104992 (Groene AI).
  • Se corrige que clickhouse-local ignorara silenciosamente la configuración a nivel de usuario (profiles, users, quotas, ajustes de control de acceso) cuando el archivo de configuración se detectaba automáticamente en ./clickhouse-local.xml, ~/.clickhouse-local/config.xml o /etc/clickhouse-local/config.xml. Antes, estos ajustes se aplicaban solo cuando se pasaba --config-file o existía ./config.xml en el directorio actual; ahora todas las rutas de detección se comportan de forma coherente. #105008 (Groene AI).
  • Se corrigen las columnas BFloat16 que devolvían silenciosamente cero coincidencias al compararlas con un literal de cadena (p. ej., WHERE bf16_col = '49.9'). #105042 (Raúl Marín).
  • Se corrige el manejo de CLEAR COLUMN y TTL durante los merges en SummingMergeTree, AggregatingMergeTree y CoalescingMergeTree cuando faltan columnas necesarias para el merge o han expirado. Cierra #101953. #105203 (Antonio Andelic).
  • Se corrige una condición de carrera entre DNSCacheUpdater::run y Context::reloadClusterConfig añadiendo una comprobación explícita de null para shared->clusters_config antes de desreferenciarlo. #105220 (Mikhail f. Shiryaev).
  • Se corrige el parsing best_effort de fecha y hora para toDateTime64 con precisión ms y ns. #105233 (Kaviraj Kanagaraj).
  • Se corrige que OSIOWaitMicroseconds informara la espera de E/S durante el ciclo de vida del hilo en lugar de la espera de E/S por consulta. #105246 (Mikhail f. Shiryaev).
  • El table engine Hudi ahora genera INCORRECT_DATA (una excepción normal a nivel de consulta) en lugar de LOGICAL_ERROR cuando un archivo Parquet del directorio de la tabla no sigue la convención de nombres de Hudi [FileId]_[FileWriteToken]_[Timestamp].[extension]. Anteriormente, esos nombres de archivo provocaban una excepción en las builds de depuración. #105266 (Groene AI).
  • Se corrige un interbloqueo en ParallelFormattingOutputFormat ante un fallo de planificación: cuando scheduleFormatterThreadForUnitWithNumber lanza una excepción (p. ej., CANNOT_SCHEDULE_TASK), la unidad quedaba en READY_TO_FORMAT sin ningún hilo formatter para procesarla, lo que provocaba un bloqueo. La llamada de planificación ahora se encapsula en try/catch y cualquier fallo se canaliza a través de onBackgroundException para que el collector finalice correctamente. #105275 (Azat Khuzhin).
  • Se corrige una pérdida silenciosa de datos en Distributed async inserts al recuperarse de un apagado anómalo: si el último archivo .bin de un batch guardado estaba intacto pero uno intermedio estaba corrupto, DistributedAsyncInsertBatch::recoverBatch solo validaba el header del último archivo y luego sendBatch marcaba todo el batch —incluidos los archivos intactos— como dañado, perdiendo sus filas. Ahora se valida individualmente el header de cada archivo, de modo que solo el archivo realmente dañado se mueve a broken/ y las filas que sobreviven llegan al segmento remoto. #105281 (Groene AI).
  • Se corrige una regresión en clickhouse extract-from-config --try: cuando la configuración usaba attributes from_env y no tenía ningún elemento include_from (o tenía uno que apuntaba a un archivo inexistente), todas las substitutions from_env se descartaban silenciosamente y devolvían cadenas vacías. Esto rompía la detección de puertos del entrypoint de Docker en la versión 26.2.5. Cierra #101704. #105283 (Groene AI).
  • Se corrige que INSERT INTO en una tabla SQLite fallara con un error de sintaxis de SQLite cuando el valor insertado es un Enum, JSON o AggregateFunction cuya representación textual contiene una comilla simple. El ajuste output_format_values_escape_quote_with_quote ahora se respeta en las serializations correspondientes (anteriormente, solo String y FixedString lo respetaban). #105285 (Groene AI).
  • Se corrige Code: 44. ILLEGAL_COLUMN: Cannot add column ...: column with this name already exists, lanzado por consultas distribuidas con allow_push_predicate_ast_for_distributed_subqueries = 1 (valor predeterminado) cuando una tupla GLOBAL IN se compara con una subconsulta cuya proyección contiene nombres de columna duplicados; por ejemplo, (x, y) GLOBAL IN (SELECT number, number FROM numbers(5)). #105290 (Groene AI).
  • Se corrige el caso en que reinterpret a Array(LowCardinality(...)) devolvía un error NOT_IMPLEMENTED confuso en tiempo de ejecución; ahora devuelve ILLEGAL_TYPE_OF_ARGUMENT durante la verificación de tipos. #105301 (Raúl Marín).
  • minMap/maxMap (forma de array) y minMappedArrays/maxMappedArrays ahora tratan NaN de forma coherente con ORDER BY: NaN se trata como el último valor (solo se devuelve cuando todos los valores son NaN). Antes, los resultados dependían de la posición de NaN en los datos debido a la semántica de comparación no ordenada de IEEE 754, y no coincidían con la forma con argumento Map de minMap/maxMap, corregida en #100448. #105331 (Raúl Marín).
  • Se corrige una fuga de memoria en la caché ColumnsDescription por tabla para tablas de la familia MergeTree con columnas Nested. Las entradas nunca se desalojaban durante ciclos de ALTER ADD COLUMN/DROP COLUMN cuando share_nested_offsets = 1 (valor predeterminado). #105376 (Groene AI).
  • Se corrige la excepción BAD_ARGUMENTS “It’s a bug! Only integer types are supported by __bitWrapperFunc”, lanzada cuando un SELECT con un skip index TYPE set(N) tiene un átomo WHERE cuyo tipo de resultado es Float, BFloat16 o cualquier otro tipo no entero (por ejemplo, WHERE c0 + 0.1 o WHERE log(c0)). En ese caso, el skip index ahora vuelve a la ruta de filtro normal. #105384 (Groene AI).

Mejora en compilación/pruebas/empaquetado

  • Dejar de usar las bibliotecas y encabezados compiler-rt del sistema. Cierra #91475. #102857 (Konstantin Bogdanov).
  • Actualizar la image base distroless de Docker para corregir CVE de OpenSSL en libssl3t64. #103583 (Rahul Nair).
  • Recibir de forma fiable la clave GPG durante las releases encadenando varios servidores de claves de Ubuntu, en lugar de agotar el tiempo de espera en keyserver.ubuntu.com. #103834 (Mikhail f. Shiryaev).
  • Eliminar y prohibir las comprobaciones de CMake en tiempo de compilación (check_*, try_compile, try_run). El compilador y la cadena de herramientas son fijos, por lo que la detección de funcionalidades en tiempo de configuración es innecesaria y ahora está bloqueada en todo el proyecto; cualquier comportamiento específico de una versión debe condicionarse explícitamente a CMAKE_CXX_COMPILER_VERSION. #103980 (Alexey Milovidov).
  • Actualizar libarchive de la versión 3.8.6 a la 3.8.7. #104047 (Robert Schulze).
  • Actualizar mongo-c-driver a la versión 2.3.0. #104300 (Raúl Marín).
  • Actualizar las dependencias de LLVM para 22.x. #104381 (Joshua Carp).
  • Hacer que las clases de embedded-client y descriptor PTY se compilen en macOS y FreeBSD usando posix_openpt / grantpt / unlockpt de POSIX portable y eliminando las protecciones #if exclusivas de Linux. #104436 (Alexey Milovidov).
  • Actualizar librdkafka a la versión 2.14.1. #105222 (János Benjamin Antal).

lanzamiento de ClickHouse 26.4, 2026-04-30. Presentación, Vídeo

Cambio incompatible con versiones anteriores

  • El operador IN ahora usa una semántica de valores exactos para el tipo Bool: solo los valores 0 y 1 del conjunto coinciden con valores Bool. Antes, los valores numéricos mayores que 255 en el conjunto IN se truncaban incorrectamente a true al compararse con Bool, por lo que SELECT CAST(1, 'Bool') IN (256) devolvía 1. Ahora devuelve correctamente 0. Cierra #92980. #93115 (Ashrith Bandla).
  • La biblioteca H3 se ha actualizado a la v4, lo que mejora la precisión de los cálculos de longitud, área y otras métricas. Este cambio es incompatible con versiones anteriores porque los nuevos resultados difieren de los anteriores. #100348 (Alexey Milovidov).
  • Ya no se permite usar SELECT como identificador sin comillas en un elemento de la lista de expresiones WITH. #101059 (Aruj Bansal).
  • Este parche cambia cómo la tabla Merge manejará las columnas virtuales. Si la tabla subyacente contiene _table o _database, estas columnas se leerán desde el almacenamiento; de lo contrario, se rellenarán después del paso de lectura mediante el paso de expresión. #101742 (Mikhail Artemenko).
  • El operador IN ahora también rechaza conversiones de Decimal con pérdida dentro de tipos compuestos (Tuple, Array, Map), lo que hace que su comportamiento sea coherente con el de las comparaciones escalares de nivel superior. Antes, las comprobaciones de precisión solo se aplicaban a los valores escalares de nivel superior: por ejemplo, CAST('33.3', 'Decimal64(1)') IN (33.33) devolvía correctamente 0, pero CAST(['33.3'], 'Array(Decimal64(1))') IN ([33.33]) devolvía incorrectamente 1 porque la conversión con pérdida se producía dentro de un Array. Ahora ambos casos devuelven correctamente 0. #101812 (Nihal Z. Miaji).
  • Se redujo el valor predeterminado de http_max_fields de 1,000,000 a 1,000 y el de http_max_field_name_size de 128 KB a 4 KB para limitar el uso de memoria previo a la autenticación de las conexiones HTTP. Se añadieron los ajustes http_max_request_header_size y http_headers_read_timeout. Los usuarios que dependan de los límites anteriores más altos pueden restaurarlos mediante ajustes. #103285 (Sema Checherinda).

Nueva funcionalidad

  • Se añade el volcado automático a disco a los hash join y parallel hash join, convirtiéndolos en grace hash join cuando se alcanza el límite de memoria. Este comportamiento se controla con max_bytes_before_external_join. #97813 (János Benjamin Antal).
  • Se añade soporte para Arrow Flight SQL. #91170 (Yakov Olkhovskiy).
  • Agregar compatibilidad con lectura incremental para los motores de tabla Paimon, con seguimiento del progreso de snapshots respaldado por Keeper, incluidas lecturas delta dirigidas de snapshots mediante paimon_target_snapshot_id, y ampliar la cobertura de pruebas para la correspondencia de tipos, la poda de particiones y los escenarios de lectura incremental. #93655 (XiaoBinMu).
  • La función stem ha dejado de ser experimental (anteriormente, era necesario habilitar la configuración allow_experimental_nlp_functions). #102399 (Jimmy Aguilar Mena). Ahora puede aplicar fácilmente stemming a todas las palabras/tokens de las columnas String, FixedString, Array([Fixed]String), Nullable, LowCardinality y Const con la función stem. #99137 (Jimmy Aguilar Mena).
  • Se implementa el nuevo comportamiento de max_insert_block_size_rows, max_insert_block_size_bytes, min_insert_block_size_rows, min_insert_block_size_bytes en el squashing con la configuración de compatibilidad use_strict_insert_block_limits. #94207 (Kirill Kopnev).
  • Se añade la función arrayAutocorrelation(arr [, max_lag]), que calcula la autocorrelación normalizada de un arreglo numérico para cada valor de retraso. Admite arreglos de tipo entero, Float y Decimal. #94776 (Wenyu Chen).
  • Una función SQL obfuscateQuery. Cierra el issue #98010. #98305 (Xuewei Wang).
  • Se añadió compatibilidad con los tipos Map y JSON/Object como atributos de diccionario. Ahora los diccionarios pueden almacenar y recuperar tipos complejos, incluidos Map(String, String), Map(String, Array(String)), JSON y Nullable(JSON), tanto en los layouts FLAT como HASHED. #98627 (yanglongwei).
  • Se añadieron dos nuevos ajustes de MergeTree — replicated_fetches_min_part_level y replicated_fetches_min_part_level_timeout_seconds — que permiten a las réplicas evitar recuperar partes recién insertadas (sin fusionar) de otras réplicas, lo que reduce la sobrecarga de la replicación durante periodos de ingestión intensiva. #98625 (tanner-bruce).
  • Añade soporte para índices de omisión de MergeTree en columnas JSON mediante JSONAllPaths con los tipos de índice bloom_filter, tokenbf_v1, ngrambf_v1 y text (invertido), lo que permite omitir gránulos según el conjunto de rutas JSON presentes en cada gránulo. #98886 (Pavel Kruglov).
  • La función printf ahora admite cadenas de formato no constantes, lo que permite usar distintos formatos por fila según los valores de las columnas. #98991 (Yash ).
  • Se añade un nuevo índice de proyección, commit_order, que reorganiza los datos en orden de inserción. #99004 (Mikhail Artemenko).
  • Se añade la función highlight, que envuelve las apariciones de términos de búsqueda en una cadena de texto con etiquetas HTML (por defecto, <em>/</em>). Admite coincidencias ASCII sin distinción entre mayúsculas y minúsculas, la fusión automática de coincidencias superpuestas y etiquetas de apertura y cierre personalizadas. #99131 (Peng).
  • Implementa cuotas basadas en el hash de la consulta normalizada para proteger los servicios públicos de ClickHouse frente a abusos. 1. Añade compatibilidad con NORMALIZED_QUERY_HASH como tipo de clave de cuota: buckets de cuota separados para cada consulta normalizada única, de modo que CREATE QUOTA q KEYED BY normalized_query_hash realiza un seguimiento independiente de cada consulta distinta. 2. Añade compatibilidad con QUERIES_PER_NORMALIZED_HASH como tipo de recurso de cuota — limita el número máximo de ejecuciones de una misma consulta normalizada dentro de un intervalo, de modo que MAX queries_per_normalized_hash = 100 evita que un mismo patrón de consulta se ejecute más de 100 veces. #99586 (Alexey Milovidov).
  • Ahora, los usuarios pueden escribir consultas con la sintaxis NATURAL JOIN, que hace coincidir automáticamente todas las columnas con el mismo nombre y evita duplicarlas en el resultado. #99840 (Peter Nguyen).
  • Se admite SET TIME ZONE 'tz' como alias de SET session_timezone. #99883 (phulv94).
  • Se añadió soporte para consultas parametrizadas en la interfaz web (play.html): se detectan parámetros de consulta como {name:Type} y se muestran campos de entrada para introducir sus valores. #100041 (Alexey Milovidov).
  • Permite usar la cláusula estándar SQL VALUES como expresión de tabla en FROM, p. ej. SELECT * FROM (VALUES (1, 'a'), (2, 'b')) AS t(id, val). #100143 (Desel72).
  • Se añaden unidades compatibles con PostgreSQL al operador EXTRACT: EPOCH, DOW, DOY, ISODOW, ISOYEAR, WEEK, CENTURY, DECADE, MILLENNIUM. También se corrige EXTRACT(WEEK FROM date), que antes generaba un error. #100274 (Alexey Milovidov).
  • Se añadió compatibilidad con literales compuestos de intervalos según el estándar SQL con calificadores de rango TO, p. ej., INTERVAL '1:30' HOUR TO MINUTE. Internamente, se descomponen en sumas de intervalos. #100453 (Desel72).
  • Añade métricas asíncronas para la memoria de los búferes TCP de recepción y envío del kernel (sk_rmem_alloc, sk_wmem_alloc) de los sockets del pool de conexiones HTTP, notificadas como percentiles p50/p75/p90/p95 y totales por grupo de conexiones. #100575 (Sema Checherinda).
  • Se añadió una web UI para el profiling de jemalloc en ClickHouse Keeper, disponible en /jemalloc en el puerto de control HTTP. #100606 (murphy-4o).
  • Se implementó el comando SYSTEM FLUSH OBJECT STORAGE QUEUE db.table PATH 'x' para los modos ordered y unordered. #100709 (Bharat Nallan).
  • Se añadió la función JSONAllValues, que devuelve todos los valores de una columna JSON como Array(String), con los valores serializados en representación textual y ordenados por sus nombres de ruta. Se añadió compatibilidad con el índice de texto para la expresión JSONAllValues en columnas JSON. Cuando se crea un índice de texto en JSONAllValues(json_column), se utiliza automáticamente para filtrar consultas sobre subcolumnas JSON (p. ej., json_column.key1 = 'value'). #100730 (Anton Popov).
  • Añade una nueva opción de configuración, input_format_column_name_matching_mode, que permite distintos modos de distinguir entre mayúsculas y minúsculas en los formatos de entrada. #99346 (manerone).
  • Se añade el comando watch a clickhouse-keeper-client, con compatibilidad con watch en los comandos get, exists y ls. #100834 (Den Kalantaevskii).
  • Se añadió la solicitud getChildrenRecursive (ListRecursive) a ClickHouse Keeper y el comando lsr a clickhouse-keeper-client. Esto cierra #99916. #100998 (Konstantin Vedernikov).
  • Añade la nueva función arrayTranspose, que toma un array bidimensional (matriz) y lo transpone: SELECT arrayTranspose([[1, 2, 3], [4, 5, 6]]). #101214 (Vitaly Baranov).
  • La configuración auto_statistics_types mergetree tiene como valor predeterminado 'minmax, uniq' — las estadísticas minmax y uniq se crean automáticamente para todas las columnas adecuadas de las tablas nuevas - materialize_statistics_on_insert tiene como valor predeterminado false — las estadísticas ahora se generan durante las fusiones en lugar de en el momento de la inserción, lo que reduce la sobrecarga de inserción. use SET materialize_statistics_on_insert = 1 para restaurar el comportamiento anterior. #101275 (Han Fei).
  • Añade la opción de refresh prefer_dependency_replica para las cadenas de dependencias de vistas materializadas, a fin de reducir la pérdida de datos causada por el retraso de replicación entre réplicas. #101591 (Seva Potapov).
  • Añade la función hasPhrase (alias matchPhrase) para la búsqueda de frases (secuencias continuas de tokens). La búsqueda se realiza por fuerza bruta; es decir, el índice de texto aún no la admite. #101997 (Elmi Ahmadov).
  • Añade las métricas de histograma s3_read_request_duration_microseconds y s3_read_request_bytes para observar el tiempo de vida de la conexión de las solicitudes GET de S3 y los bytes consumidos, visibles en system.histogram_metrics y en el endpoint de Prometheus. #102058 (Sema Checherinda).
  • Los valores Date y Date32 ahora se pueden sumar a los valores Time y Time64 mediante el operador +, lo que da como resultado un DateTime o DateTime64. Por ejemplo, SELECT toDate('2024-01-15') + toTime('14:30:25') devuelve 2024-01-15 14:30:25. El resultado se calcula en la zona horaria de la sesión, y los resultados fuera de rango se tratan según la configuración date_time_overflow_behavior. Cierra #95914. #102421 (Nihal Z. Miaji).
  • El índice de texto ahora es GA y permanece habilitado independientemente del ajuste compatibility, lo que evita que se deshabilite de forma inesperada durante las restauraciones desde copias de seguridad o al ejecutarse en modo de compatibilidad. #101518 (Nikita Fomichev).

funcionalidad experimental

  • Se añadió ALTER TABLE ... EXECUTE remove_orphan_files para tablas Iceberg, con el fin de identificar y eliminar archivos no referenciados del almacenamiento de objetos. #99127 (murphy-4o).
  • Se añadió la opción de configuración query_plan_optimize_join_order_randomize, que aleatoriza las estadísticas usadas para reordenar joins, lo que resulta útil para pruebas. #100643 (Vladimir Cherkasov).
  • Se añadió compatibilidad con funciones de IA en ClickHouse, lo que permite a los usuarios llamar a endpoints de OpenAI y Anthropic mediante SQL. aiGenerate se incluye como la primera función de este tipo. #100831 (George Larionov).
  • Se añadieron funciones de IA: aiClassify, aiExtract y aiTranslate, para aprovechar las API de LLM en ClickHouse. #100832 (George Larionov).
  • Se añadió system.histogram_metric_log, una nueva tabla del sistema que toma periódicamente instantáneas de todas las métricas de histograma (p. ej., latencias de S3/Azure y duraciones de las etapas de procesamiento de solicitudes de Keeper). Además, la columna value de system.histogram_metrics pasa a ser Float64, ya que es más flexible y compatible con el modelo de datos de Prometheus. #103046 (Miсhael Stetsyuk). Es probable que la estructura de la tabla cambie en futuras versiones.

Mejora del rendimiento

  • ClickHouse ahora puede descartar partes de datos completas en las consultas SELECT basándose en estadísticas mín./máx. #94140 (zoomxi).
  • Reducir la contención por bloqueos durante las operaciones de solo lectura en tablas ReplicatedMergeTree con mutaciones completadas. #95771 (Eduard Karacharov).
  • Se respeta optimize_read_in_order al leer proyecciones. Cierra #89453. #95885 (Andrey Zvonov).
  • Pequeñas mejoras en Hash Join y Concurrent Hash Join. #96663 (Yarik Briukhovetskyi).
  • Optimiza la transformación DISTINCT deshabilitando la optimización de columnas LowCardinality cuando los datos de entrada son casi todos distintos. #97113 (Nihal Z. Miaji).
  • Optimización del rendimiento para las consultas con LIKE de #97723. Ahora estas consultas pueden usar índices de texto. #98149 (Elmi Ahmadov).
  • Las funciones matemáticas vectorizadas (exp, log, sigmoid, tanh) ahora están aceleradas en AArch64 (mediante NEON/SVE) y en FreeBSD/Darwin, donde antes usaban un fallback escalar más lento. #98230 (Raúl Marín).
  • Las consultas que filtran por columnas de la clave primaria de MergeTree con alternancias en expresiones regulares sobre cadenas literales, como ^(abc-1|abc-2), ahora pueden usar la poda de la clave primaria cuando las alternativas comparten un prefijo común. #98988 (Yash ).
  • Se generaliza el filtrado dinámico top-k de ORDER BY ... LIMIT para admitir los tipos Nullable, String y COLLATE. #99033 (murphy-4o).
  • Se aceleró el hash join con claves Int32 y Int64 de rango pequeño mediante el uso de una tabla hash de índice directo. #99275 (Hechem Selmi).
  • Consultas discontinuas más rápidas para columnas LowCardinality con un único diccionario. #99285 (Ivan Babrou).
  • Se aceleran las funciones var*Stable y stddev*Stable para columnas Float64 al desvirtualizar el bucle interno. Nota: esto permite optimizaciones del compilador (FMA/registros) que alteran los resultados de coma flotante a nivel de ULP. #99460 (Riyane El Qoqui).
  • Usar la codificación base58 optimizada de Firedancer para entradas de 32/64 bytes (automática para base58Encode). Permitir la decodificación base58 optimizada si el resultado de la decodificación es de 32/64 bytes (de forma explícita con base58Decode('...', 32) o similar). #99461 (Joanna Hulboj).
  • Se habilitan optimizaciones basadas en secciones del enlazador (-ffunction-sections, -fdata-sections, --icf=all) para reducir el tamaño del binario y mejorar el aprovechamiento de la caché de instrucciones. #99474 (Alexey Milovidov).
  • Corrige el escalado negativo en consultas cortas con agregación en máquinas con muchos núcleos. Cuando una consulta lee pocas marcas, el pipeline ya no se expande hasta max_threads después de la agregación, lo que evita la sobrecarga de streams prácticamente vacíos. #99493 (Alexey Milovidov).
  • Mejora el rendimiento de las consultas con réplicas paralelas seleccionando adecuadamente el tamaño de la tarea de lectura. #99801 (Nikita Taranov).
  • Permitir la precarga al leer un archivo remoto mediante la caché de páginas en espacio de usuario. #99919 (Alexey Milovidov).
  • Evitar el cálculo innecesario de la subcolumna .size de String al enumerar subcolumnas. #99941 (Pavel Kruglov).
  • Hacer que la barra de progreso de clickhouse-client sea menos inestable al trabajar desde un hotel con clústeres que tienen un número muy elevado de réplicas. #100145 (Alexey Milovidov).
  • Iniciar MemoryWorker en clickhouse-local cuando la caché de páginas esté habilitada, para que la caché de páginas de espacio de usuario pueda utilizarse realmente. #100306 (Alexey Milovidov).
  • Optimiza las consultas aplicando la cláusula LIMIT dentro de UNION ALL. #100364 (Alexey Milovidov).
  • Se añade compatibilidad con compilación JIT para comparaciones de columnas String y FixedString en ORDER BY, lo que mejora entre un 6 y un 17 % el rendimiento de la ordenación en la fase de merge para claves de ordenación con predominio de cadenas. En coautoría con @lgbo-ustc. #100577 (Raúl Marín).
  • Cuando read_in_order_use_virtual_row está habilitado junto con la nueva configuración read_in_order_use_virtual_row_per_block, ahora se emite información sobre los límites de las filas virtuales después de cada bloque leído de MergeTree, lo que permite que el proceso de mezcla vuelva a priorizar las fuentes a mitad del flujo para las partes cuyos datos quedan completamente filtrados por WHERE/PREWHERE/JOIN. Cierra #99945. #100603 (Vladimir Cherkasov).
  • Conversión más rápida de Float a String para valores enteros grandes al extender la vía rápida de itoa con redondeo compatible con dragonbox. #100649 (Raúl Marín).
  • Sustituye dragonbox por zmij para lograr una conversión de Float a String entre 1.5x y 3x más rápida. #100650 (Raúl Marín).
  • Conversión más rápida de Int128/UInt128 a cadena mediante la sustitución de la división por software por la reducción de Barrett y el desenrollado del bucle de conversión. #100671 (Raúl Marín).
  • Evita generar hilos redundantes en la fusión paralela de uniqExact. #100686 (Jiebin Sun).
  • Se añade la fusión paralela por lotes para uniqExact. #100687 (Jiebin Sun).
  • Mejor paralelización de consultas con vistas simples (con una tabla MergeTree subyacente) ejecutadas con réplicas paralelas. #100815 (Igor Nikonov).
  • Implementa compatibilidad con réplicas paralelas en vistas simples (incluidas las vistas UNION ALL compatibles sobre tablas MergeTree) cuando parallel_replicas_allow_view_over_mergetree=1. Esto permite paralelizar la consulta externa de la vista en lugar de la interna, lo que aumenta la paralelización de consultas entre nodos. #100958 (Igor Nikonov).
  • Optimizar la lectura en el orden de la clave primaria para full_sorting_merge cuando hay filtros con IN en el plan de consulta. #101261 (Nikita Taranov).
  • Optimización de las asignaciones/liberaciones mediante el almacenamiento en caché de la configuración de muestreo, en lugar de recorrer toda la jerarquía del rastreador de memoria. #101267 (Azat Khuzhin).
  • Corrige una regresión significativa en el rendimiento de INSERT cuando deduplicate_insert = 'enable' (predeterminado desde la versión 26.2) al posponer el cálculo del hash de los datos del squashing al sink y usar hashing por lotes de columnas mediante updateHashWithValueRange, lo que reduce la sobrecarga de ~2.5s a ~0.5s para 5M filas con 22 columnas. #101494 (Sema Checherinda).
  • Reduce la sobrecarga del perfilado de bloqueos usando try_lock para evitar medir el tiempo de las adquisiciones sin contención y eliminar la medición del tiempo de retención. #101502 (Antonio Andelic).
  • Se sustituyeron las intrínsecas AVX-512 escritas a mano en arrayDotProduct por bucles autovectorizables independientes de la plataforma, añadiendo compatibilidad con AVX2 y ARM NEON. #101571 (Peng).
  • Mejora el rendimiento de INSERT VALUES para las columnas Map, Array y Tuple cuando los valores se pasan como cadenas escapadas (p. ej., '{\'key\':1}'), evitando recurrir innecesariamente al analizador de expresiones SQL. #102119 (Joanna Hulboj).
  • Se corrigió el uso excesivo de CPU del motor de tabla RabbitMQ. #102711 (Jaap Elst).
  • El optimizador del orden de JOIN ahora infiere predicados transitivos de equi-join a partir de las condiciones JOIN existentes. Por ejemplo, dado A.x = B.x AND B.x = C.x, se reconoce la equivalencia A.x = C.x, lo que permite al optimizador considerar joins directos entre tablas conectadas de forma transitiva. Esto puede mejorar la calidad del plan en esquemas en estrella y en copo de nieve, donde las tablas de dimensiones se conectan a través de una tabla de hechos compartida. Esta funcionalidad se controla mediante la nueva configuración enable_join_transitive_predicates (desactivada de forma predeterminada). #98479 (Alexander Gololobov).
  • Optimiza TRUNCATE DATABASE TABLES LIKE al cancelar previamente las operaciones de merge en paralelo. #98597 (Shaohua Wang).
  • Se añade compatibilidad con la monotonicidad en la multiplicación, lo que permite la poda por clave primaria en expresiones key * constant. #98983 (Amos Bird).
  • Los diccionarios de caché ya no adquieren un bloqueo exclusivo en hasKeys; esto reduce la contención de bloqueos al usar un bloqueo compartido para las lecturas de la caché. #100796 (liuguangliang).
  • Incorporar en línea la subconsulta VIEW en el árbol de consulta para permitir aplicar más optimizaciones a la VIEW. #100830 (Dmitry Novik).
  • Optimizar la carga de la caché al arrancar el servidor. #101500 (Kseniia Sumarokova).
  • Implementar la materialización diferida de columnas para ReplacingMergeTree con FINAL cuando el predicado sea lo bastante selectivo. #101647 (Nikolai Kochetov).
  • Se reactiva la optimización optimize_rewrite_array_exists_to_has (desactivada de forma predeterminada desde la versión 23.10). Reescribe arrayExists(x -> x = elem, arr) como la mucho más rápida has(arr, elem) y ahora omite correctamente la reescritura cuando el tipo de elemento del array y elem no son compatibles para has (p. ej., Date y String), por lo que las consultas que antes fallaban siguen funcionando. Cierra #71431. #100944 (Alexey Milovidov).

Mejora

  • Salida mejorada de EXPLAIN PLAN pretty=1: imprime las columnas de salida de la consulta de nivel superior, muestra las etiquetas/símbolos de la relación de join junto con las filas estimadas del resultado y la localidad, e incluye las columnas de salida de cada paso para los pasos de join/source. Los cambios abarcan la parte de Information Deficit de #98117. #99462 (Kirill Kopnev).
  • Añade la configuración de tabla MergeTree share_nested_offsets (valor predeterminado: true). Cuando se establece en false, las columnas Array con nombres con puntos (p. ej., n.a, n.b) se tratan como columnas independientes, en lugar de compartir archivos de desplazamiento y validar que los arrays tengan el mismo tamaño como parte de la semántica heredada de Nested. #98416 (Amos Bird).
  • Ahora, los usuarios pueden especificar varios métodos de autenticación en el archivo de configuración users.xml/yaml (en SQL, esto siempre fue posible). #91998 (Flip-Liquid).
  • Recarga automática de las conexiones entre nodos de Raft que usan TLS. #93455 (Evgeny).
  • Se amplía cast_keep_nullable para que funcione con tipos Dynamic/JSON. Cuando está habilitado, convertir NULL desde tipos que pueden ser Nullable devolverá NULL; de lo contrario, NULL provocará el error CANNOT_INSERT_NULL_IN_ORDINARY_COLUMN. #96504 (Seva Potapov).
  • Se redujo la huella de memoria de las estructuras de datos internas (objetos ISerialization) gracias a la incorporación de un grupo de objetos. #96563 (Nikita Mikhaylov).
  • Se añade compatibilidad con los campos password e identity en la configuración XML de keeper-client. #96800 (Grigorii Sokolik).
  • Mejora de las escrituras de Iceberg para Unity Catalog. #98162 (Konstantin Vedernikov).
  • Añade la opción de configuración finalize_projection_parts_synchronously para permitir la finalización síncrona de las partes de proyección durante INSERT, lo que reduce el pico de uso de memoria en tablas con muchas proyecciones, mientras mantiene por defecto el comportamiento asíncrono existente. #98228 (Amos Bird).
  • Agregar la columna projections_duration_ms a system.part_log, que registra la duración en milisegundos de la fusión/reconstrucción de cada proyección. #98292 (Amos Bird).
  • Mejora en la cancelación de consultas mediante ExpressionTransform y NumbersRangedSource con KILL QUERY y «cancel query» (Ctrl+C) en clickhouse-client. #98908 (Roman Vasin).
  • Reemplaza la lista source_table_engines codificada de forma fija por una consulta en tiempo de ejecución mediante StorageFactory::getAllStorages(). Esto añade comprobaciones de acceso para algunos motores de tabla que faltaban y cierra #71544. #98984 (pufit).
  • Añade un ajuste para controlar el comportamiento ante incompatibilidades de tipo en Variant y Dynamic (throw o devolver null). #99085 (Bharat Nallan).
  • Mejorar la compatibilidad entre Iceberg y Spark: corregir el manejo inconsistente de rutas causado por el uso combinado de rutas de almacenamiento y rutas de metadata; exigir que las tablas Iceberg escriban una ubicación de tabla que sea una URL o una ruta absoluta; añadir un fallback para calcular el tamaño de los archivos en Azure, ya que algunos lectores de ClickHouse no admiten el conteo de bytes tras el recorrido; manejar version-hint.txt de forma compatible con Spark; introducir abstracciones a nivel de tipos que dificulten mezclar tipos de rutas en el futuro; añadir pruebas para Azure y Local que verifiquen la interoperabilidad entre motores sin carga ni descarga intermedias; corregir el uso de position deletes, que antes dependía de heurísticas de inferencia de rutas cuando ese enfoque no es adecuado. #99163 (Daniil Ivanik). #100420 (Daniil Ivanik).
  • Se corrigió una posible condición de carrera en IPartitionStrategy::cached_result introducida en https://github.com/ClickHouse/ClickHouse/pull/92844. #99400 (Arthur Passos).
  • Los usuarios ahora pueden escribir tipos de datos Interval de ClickHouse en formato Arrow. #99519 (Peter Nguyen).
  • Añade compatibilidad nativa para importar y exportar tipos de datos UUID en los formatos Arrow y Parquet. Los usuarios ahora pueden consultar y transferir directamente datos UUID entre ClickHouse y otras herramientas de datos sin necesidad de realizar conversiones manuales a cadenas ni recurrir a soluciones alternativas. Inferencia lógica automatizada para UUID de nivel superior y compatibilidad con una sugerencia de schema explícita para UUID anidados. #99521 (Ivan).
  • Admite archivos 7z en el almacenamiento de objetos. Cierra #70968. #99600 (Alexey Milovidov).
  • Se añaden los ProfileEvents ObjectStorageListedObjects, ObjectStorageGlobFilteredObjects, ObjectStoragePredicateFilteredObjects y ObjectStorageReadObjects para la introspección del pipeline de listado y lectura de archivos en almacenamiento de objetos (S3, Azure, etc.). #99778 (Sema Checherinda).
  • Se corrige el fallo de la función de tabla merge que provocaba el error UNKNOWN_IDENTIFIER al consultar columnas que no están presentes en todas las tablas distribuidas/remotas subyacentes. #99833 (Alexey Milovidov).
  • Ahora incluimos el tiempo de commit en la métrica del tiempo total de ejecución de las mutaciones para ReplicatedMergeTree. Se había omitido después de #96376. #99936 (alesapin).
  • Se añade un write-ahead log para los objetos blob pendientes de eliminación en MetadataStorageFromDisk, lo que mejora la durabilidad y la coherencia entre los metadatos y el almacenamiento remoto de objetos cuando se eliminan objetos. #100019 (Maksim Kita).
  • Se deshabilitó la generación de SQL con IA (comando ??) en el client embebido (protocolos SSH y WebSocket) para evitar el acceso a las variables de entorno del servidor. #100290 (Alexey Milovidov).
  • Se cambia la interfaz del catálogo para las inserciones de Iceberg. Quedan obsoletas las configuraciones storage_catalog_type, storage_aws_access_key_id, etc. #100334 (Konstantin Vedernikov).
  • Interpretar las tabulaciones como 4 espacios al pegar en clickhouse-client. Cierra #100405. #100416 (Raúl Marín).
  • Evita escanear todo el catálogo remoto del lago de datos para mostrar sugerencias de tablas del tipo “Quizá quiso decir…” cuando show_data_lake_catalogs_in_system_tables está deshabilitado. #100452 (Alsu Giliazova).
  • Aplicar distributed_index_analysis_min_indexes_bytes_to_activate tras la poda de particiones. #100477 (Azat Khuzhin).
  • Se corrige un error de aserción en el pushdown del bloom filter de Parquet al usar cláusulas IN/NOT IN vacías. #100543 (zoomxi).
  • Las estadísticas de columna MinMax ahora almacenan los valores mínimo y máximo como Field (tipado) en lugar de Float64. El formato serializado incluye el nombre del tipo de la columna junto con los valores. La versión del archivo de estadísticas se actualiza a V2; los archivos escritos por versiones anteriores requieren volver a materializarse (ALTER TABLE … MATERIALIZE STATISTICS ALL). corrección #53140. #100605 (Han Fei).
  • Actualizar cppkafka para incluir una corrección del interbloqueo al cerrar el consumidor. #100612 (Azat Khuzhin).
  • La información del objeto que se utiliza para analizar los archivos de datos en Iceberg ahora incluye el número de filas del archivo y su tamaño en bytes, obtenidos del archivo de manifiesto. #100645 (Daniil Ivanik).
  • Se añadió el parámetro de configuración use_separate_cache_arena para poder controlar la separación de la arena de memoria de la caché. #100664 (Seva Potapov).
  • Agrega compatibilidad nativa para importar los tipos de datos StringView y BinaryView de Apache Arrow a columnas String de ClickHouse, lo que mejora la compatibilidad con la ingestión basada en Arrow. #100762 (Ivan).
  • Algunos ajustes del servidor Keeper ahora se recargan en caliente si el archivo de configuración cambia en tiempo de ejecución: max_requests_batch_size, max_requests_batch_bytes_size, max_request_size, quorum_reads. #100773 (Michael Kolupaev).
  • Se incrementan los eventos de perfil MemoryAllocatedWithoutCheck/MemoryAllocatedWithoutCheckBytes en la compilación release. #100899 (Pavel Kruglov).
  • El seguimiento de memoria en Cgroupv2 ahora excluye slab_reclaimable de la memoria del kernel, lo que ofrece una medición más precisa del uso de memoria no recuperable. #100901 (Antonio Andelic).
  • use_partition_pruning = 0 ahora también desactiva la poda del índice MinMax y la optimización de conteo en las columnas de la clave de partición, además de desactivar la poda basada en claves de partición. #100904 (Nihal Z. Miaji).
  • pretty=1 en EXPLAIN [PLAN] ahora muestra las expresiones en un formato legible. #100927 (Kirill Kopnev).
  • accurateCastOrNull y accurateCastOrDefault ahora admiten tipos de destino Tuple, incluidos Tuples anidados con elementos Nullable. Antes, estas funciones rechazaban destinos Tuple porque Tuple no podía estar dentro de Nullable. Cierra #100820. #100942 (Nihal Z. Miaji).
  • Corregir la duplicación de gráficos en la interfaz de Play al cambiar entre los temas claro y oscuro. #101058 (Alexey Milovidov).
  • Actualización de chdig a v26.3.1 (interfaz de perfetto, minigráficos en el resumen para CPU/Memoria/Fusiones/Consultas, system.warnings, búsqueda con regexp en los logs). #101092 (Azat Khuzhin). Actualización de chdig a v26.4.3 (mejoras en perfetto, correcciones para compartir mediante pastila.nl, diferencias de flamegraph, cambio de configuración en tiempo real). #103145 (Azat Khuzhin).
  • Ahora se permite una coma final en la cláusula WITH antes de una consulta SELECT. #101093 (Aruj Bansal).
  • Añade el ajuste de MergeTree compress_per_column_in_compact_parts para controlar cómo se organizan los bloques comprimidos dentro de las partes Compact. Cuando es true (valor predeterminado, que conserva el comportamiento actual), cada columna inicia un nuevo bloque comprimido, lo que permite la descompresión selectiva. Cuando es false, todas las columnas dentro de un gránulo se empaquetan en el mismo bloque comprimido, lo que mejora la relación de compresión y el rendimiento de lectura en cargas de trabajo que siempre leen todas las columnas. #101114 (Amos Bird).
  • Mostrar el tooltip de información de la tabla en la UI de Play solo al pasar el cursor sobre el nombre de la tabla, no sobre toda la fila. #101118 (Alexey Milovidov).
  • Añade iconos específicos para cada motor y mejora la UX de la lista de tablas en la barra lateral de la UI de Play. #101134 (Alexey Milovidov).
  • Compatibilidad con Nullable(Tuple) en los formatos Arrow, ArrowStream, ORC y Parquet heredado. #101272 (Nihal Z. Miaji).
  • Mostrar la fila TOTALS como pie de la tabla en la web UI (play.html). #101286 (Alexey Milovidov).
  • Compatibilidad con el modo multiconsulta en la interfaz web (play.html): ejecución de varias consultas a la vez, con ejecución en paralelo de consultas de tipo SELECT y visualización de resultados por consulta. #101290 (Alexey Milovidov).
  • Se corrige el redimensionamiento de columnas en la interfaz web play.html después de refactorizar la tabla de resultados como un componente web. #101295 (Alexey Milovidov).
  • Se añadió la posibilidad de limitar la cantidad de flushes del perfil de jemalloc en MEMORY_LIMIT_EXCEEDED por intervalo de tiempo. #101396 (Azat Khuzhin).
  • Se añadieron las configuraciones de Keeper nuraft_streaming_mode (valor predeterminado: false), nuraft_max_log_gap_in_stream, nuraft_max_bytes_in_flight_in_stream. Cierra #90743. #101427 (Kseniia Sumarokova).
  • Se añadió la métrica asíncrona CGroupMemoryUsedWithoutPageCache, que informa del uso de memoria del cgroup excluyendo tanto la caché de páginas del kernel del sistema operativo como la caché de páginas en espacio de usuario de ClickHouse, en consonancia con MemoryResidentWithoutPageCache. También se aclaró la descripción de la métrica CGroupMemoryUsed. #101513 (Francesco Ciocchetti).
  • Añade azúcar sintáctico a nivel del analizador sintáctico para la sintaxis de la función OVERLAY del estándar SQL. La función overlay ya existe; esto añade compatibilidad con la forma basada en palabras clave que usa PLACING, FROM y FOR como separadores. #101681 (Desel72).
  • Se añadió el alias de columna INDEX_LENGTH a la tabla del sistema information_schema.tables, en consonancia con los alias existentes en mayúsculas de esta tabla. #101705 (Robert Schulze).
  • La tabla del sistema information_schema.tables ahora ignora las partes inactivas de la tabla. Esto hace que los valores de tamaño de la tabla que se muestran sean más realistas. #101706 (Robert Schulze).
  • La función ngrams ahora rechaza longitudes de ngram no válidas. Ejemplo: SELECT ngrams('abc', 0) ahora devuelve un error. #101922 (Robert Schulze).
  • Como seguimiento de #91820 y #90837: eliminar del mensaje de error los algoritmos no compatibles; ejecutar pruebas específicas de FIPS en compilaciones FIPS. #102067 (Mikhail f. Shiryaev).
  • Limita la altura de las celdas a tres líneas en la Web UI (play.html), con posibilidad de expandirlas al hacer clic. #102154 (Alexey Milovidov).
  • Se añadió una nueva opción que permite forzar el estilo (virtual/path) para los endpoints de S3. Resuelve #82019; #76007. Da continuidad a https://github.com/ClickHouse/ClickHouse/pull/83168. #102378 (Konstantin Vedernikov).
  • La configuración restore_replace_external_engines_to_null ahora también omite la restauración de bases de datos con motores externos (p. ej., DataLakeCatalog, MySQL, PostgreSQL, S3) en lugar de producir un error o iniciar conexiones externas. #102400 (Nikita Fomichev).
  • Se añade soporte para el análisis de índices de texto de la función hasPhrase mediante el modo HINT. #102438 (Elmi Ahmadov).
  • Considerar STATISTICS como solo lectura en ColumnDependency para corregir LOGICAL_ERROR durante MATERIALIZE STATISTICS ALL. #102627 (Konstantin Bogdanov).
  • Crear y poblar system.asynchronous_metric_log en modo keeper-as-server. #102664 (Miсhael Stetsyuk).
  • Se añade la opción de configuración default_system_log_flush_policy.skip_alias_columns para permitir omitir las columnas ALIAS de las tablas de logs del sistema, lo que corrige los logs del sistema respaldados por S3 que rechazan columnas ALIAS. #102669 (Miсhael Stetsyuk).
  • No habilite las estadísticas automáticas para las tablas del sistema. Rara vez pueden aprovecharlas. #102862 (Han Fei).
  • Se admite el tokenizer array para la optimización de LIKE. #102880 (Elmi Ahmadov).
  • Enviar MemoryAllocatedWithoutCheck incluso en compilaciones de producción. #103064 (Azat Khuzhin).
  • Exponer untracked_memory de cada hilo en system.stack_trace. #103065 (Azat Khuzhin).

Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)

  • Se corrige el error Block structure mismatch in stream causado por columnas innecesarias devueltas por la materialización diferida. Soluciona #95191. #96682 (Nikolai Kochetov).
  • Corrige un error lógico en una consulta de política de enmascaramiento de datos al usar ON CLUSTER. #97594 (Bharat Nallan).
  • Se corrige un error al usar Unity Catalog sobre GCS. #98456 (Melvyn Peignon).
  • DataLakeCatalog ahora respeta la configuración http_forbid_headers del servidor al validar la opción auth_header. #98827 (Michael Anastasakis).
  • Se corrigen las llamadas N+1 a HeadObject para globs con expansión entre llaves de S3. #99219 (Konstantin Bogdanov).
  • Validar los cambios de configuración en las consultas CREATE cuando el propio motor también admite parámetros de configuración. #99279 (János Benjamin Antal).
  • Se corrigió un fallo por el que ALTER TABLE UPDATE/DELETE fallaba con el error Missing columns cuando una tabla tiene una columna MATERIALIZED cuya expresión depende de una columna EPHEMERAL. #99281 (Yash ).
  • Las credenciales en las cadenas de conexión de JDBC, ODBC y NATS ahora se enmascaran en los registros de consultas y en la salida de SHOW CREATE, lo que evita la exposición accidental de información confidencial. En las cadenas de conexión con formato URI (p. ej., {scheme}://{user}:{password}@{host}), solo se enmascara la contraseña, mientras que el resto permanece visible para facilitar la depuración. El ajuste nats_token ahora también se enmascara. #99344 (János Benjamin Antal).
  • Corrige el análisis incorrecto de palabras que comienzan con prefijos de meses en el formato DD-month-YYYY por parte de parseDateTimeBestEffort. Cierra #99345. #99350 (Pavel Kruglov).
  • Se corrigió que se ignorara TABLE_UUID_MISMATCH cuando no se usa el analizador. #99380 (Azat Khuzhin).
  • Corrige un error por el que los ajustes explícitos enviados junto con compatibility en la misma solicitud podían ignorarse de forma silenciosa cuando su valor coincidía con el valor predeterminado del servidor. #99402 (Raufs Dunamalijevs).
  • Corrige los casos en los que los números con ceros a la izquierda en la ruta de particionado de Hive producían errores. Corrige #98801. #99458 (Yarik Briukhovetskyi).
  • Se corrige heap-use-after-free cuando se elimina una tabla de forma concurrente mientras hay una consulta de lectura en ejecución (19 casos en CI durante los últimos 90 días). #99483 (Alexey Milovidov).
  • Se corrigió un error en Keeper por el que una solicitud de lectura podía quedarse bloqueada (haciendo que la sesión expirara) si se cerraba una sesión distinta y no relacionada en el mismo servidor justo en un mal momento. #99484 (Michael Kolupaev).
  • Validar la estructura de la columna antes de aplicar parches. #99531 (Seva Potapov).
  • Corrige el fallo de aserción de rows_sources en la fusión vertical cuando SYSTEM STOP/START MERGES se activa y desactiva rápidamente durante la fusión de una tabla con columnas Dynamic. #99532 (Alexey Milovidov).
  • Se corrigió la poda incorrecta de particiones en toWeek(), que provocaba que las consultas con WHERE toWeek(date, mode) = N devolvieran resultados vacíos para las semanas 49-52 en tablas particionadas por toYYYYMM(date). #99542 (Takumi Hara).
  • Se corrige una excepción en funciones que operan con ColumnReplicated con filas no referenciadas producidas por JOIN. #99564 (Hechem Selmi).
  • Corrige un problema por el que CLEAR COLUMN no reconstruía las proyecciones ni reevaluaba las columnas materializadas que dependen de la columna eliminada, lo que podía provocar excepciones o corrupción de datos durante fusiones posteriores. #99565 (Desel72).
  • Se corrigió una excepción (Bad get: has Tuple, actual type String) en ConditionSelectivityEstimator cuando una consulta usa IN con un solo parámetro de consulta escalar (p. ej., WHERE col IN ({p:String})) en una tabla que tiene estadísticas de columna y con use_statistics habilitado. #99614 (Ilya Yatsishin).
  • La parte con proyecciones desconocidas no debe marcarse como perdida para siempre. #99623 (Sema Checherinda).
  • Se corrige una excepción poco frecuente de error lógico durante una fusión vertical cuando SYSTEM STOP MERGES y SYSTEM START MERGES se ejecutan de forma concurrente. #99628 (Desel72).
  • Se corrige una referencia colgante en injectRequiredColumns que provocaba un fallo durante un merge. #99679 (Tuan Pham Anh).
  • Corrige el comportamiento indefinido en el lector del formato Avro al leer valores numéricos que exceden la capacidad del tipo de la columna de destino. Ahora las consultas fallan cuando se producen desbordamientos, en lugar de generar silenciosamente valores incorrectos. #99697 (asyablue22).
  • Se corrige el procesamiento de las comillas de estilo shell en los argumentos de la función de tabla executable. #99794 (Nikita Semenov).
  • Corrige un aborto por falso positivo en NativeReader al deserializar un flujo en formato Native con una discrepancia en el recuento de filas: se cambió de LOGICAL_ERROR a INCORRECT_DATA para que el error se trate como un error de datos en lugar de activar abort() en compilaciones con sanitizador/depuración. #99822 (Rahul Nair).
  • Corregida la interrupción del proceso en la deserialización de la columna Tuple cuando el tipo de serialización en el flujo binario es DETACHED. #99823 (Rahul Nair).
  • Se corrigió la falsa excepción LOGICAL_ERROR durante el redimensionamiento dinámico de la caché del sistema de archivos debido a una condición de carrera en la promoción de la subcola de SLRU. #99850 (Alexey Milovidov).
  • Corregidas las consultas de async insert que mostraban written_rows, read_rows y result_rows en cero en query_log y en la salida del client. #99879 (Sema Checherinda).
  • Corrige la excepción “Bad cast from type X to Y” en KILL QUERY cuando la consulta interna sobre las tablas del sistema devuelve columnas encapsuladas en ColumnConst. #99881 (Alexey Milovidov).
  • Se corrige un error lógico en una subconsulta correlacionada dentro del argumento untuple. #99917 (Vladimir Cherkasov).
  • Corrige una excepción al llamar a right, rightUTF8 u otras funciones de subcadena con una longitud de INT64_MIN (-9223372036854775808), lo que antes provocaba un comportamiento indefinido debido a un desbordamiento de enteros. Ahora las funciones devuelven correctamente el error ARGUMENT_OUT_OF_BOUND. #99934 (Jimmy Aguilar Mena).
  • Ahora ClickHouse debería manejar correctamente las tablas de estilo Spark (donde tenemos la ruta absoluta completa para cada archivo o una ruta relativa a la ruta común de la tabla). Corrige #92348. #99935 (alesapin).
  • Se corrige la excepción “formato AST incoherente” en ALTER TABLE ... MODIFY QUERY con subconsultas anidadas que contienen SETTINGS cuando el propio ALTER también incluye SETTINGS. #99938 (Nikita Mikhaylov).
  • Se revierte #97114 “Mover la estimación de filas en el paso de join antes de la comprobación de que haya 1 hijo” debido a una posible regresión del rendimiento. #99957 (Alexander Gololobov).
  • Corrige un error por el que ClickHouse podía omitir archivos si faltaba el encabezado Content-Length en la respuesta a la solicitud HEAD correspondiente (por ejemplo, debido a la transcodificación descompresiva en GCS). #99971 (Yarik Briukhovetskyi).
  • Corrige un fallo de aserción (excepción en builds de depuración, resultados incorrectos en builds de lanzamiento) al multiplicar estados de agregación de NumericIndexedVector por una constante entera par, provocado por un XOR consigo mismos en bitmaps Roaring con alias en pointwiseAddInplace. #99976 (Desel72).
  • Evitar la excepción Unexpected return type en el pushdown heredado de filtros a través de JOIN USING encadenados cuando los tipos de las claves cambian después de las conversiones de JOIN. #99999 (Alexey Milovidov).
  • Corrige la excepción LOGICAL_ERROR “Tipo de nodo inesperado para la expresión de tabla … se obtuvo IDENTIFIER” cuando se usa una subconsulta escalar dentro de un argumento sin resolver de una función de tabla, p. ej., SELECT * FROM remote('localhost', view(SELECT 2 AS x), concat(x, (SELECT 1))). #100014 (Alexey Milovidov).
  • Se corrigió un fallo de INSERT con VALUES cuando los datos iban seguidos de un comentario SQL al final (-- o /* */) en la línea siguiente. Ahora se omite el comentario en lugar de interpretarlo como otra fila. #100016 (Pratima Patel).
  • Se corrige una excepción en arrayRemove al comparar Tuples con componentes NULL. #100017 (Alexey Milovidov).
  • Se corrige una filtración de datos entre usuarios en system.asynchronous_inserts: cualquier usuario con SELECT sobre la tabla podía ver entradas pendientes de inserción asíncrona de otros usuarios. Ahora las entradas se filtran según el usuario actual, salvo que el usuario tenga el privilegio SHOW_USERS. #100024 (Shaohua Wang).
  • Corrige un caso en el que la conversión de Time64 a UInt64 podía restringir los valores a 24 horas. #100025 (Yarik Briukhovetskyi).
  • Se corrigió un bloqueo del servidor local cuando CREATE DICTIONARY tiene una definición con un valor de lista que contiene una función inexistente. #100036 (Yakov Olkhovskiy).
  • Se corrige un problema que impedía que los formatos CSV y MsgPack analizaran correctamente Nullable(Tuple). Cierra #99753. #100038 (Nihal Z. Miaji).
  • Se corrige el error de CREATE VIEW con UNKNOWN_IDENTIFIER al usar como lado derecho de IN un alias de expresión de función en WITH (por ejemplo, tuple(...)). #100042 (Peng).
  • Se corrigieron las funciones de agregación de series temporales (p. ej., timeSeriesResampleToGridWithStaleness) que fallaban con ILLEGAL_TYPE_OF_ARGUMENT cuando se usaban con initializeAggregation o AggregatingMergeTree en réplicas paralelas. #100053 (Alexey Milovidov).
  • Se corrigió el procesamiento de valores negativos en NumericIndexedVectorDataBSI. #100086 (Daniil Ivanik).
  • Se corrigieron las funciones accurateCastOrDefault y to*OrDefault, que no preservaban el tipo de columna Const para entradas constantes. #100132 (Alexey Milovidov).
  • Los parámetros de consulta omitidos de tipo LowCardinality(Nullable(T)) ahora toman correctamente NULL como valor predeterminado, igual que Nullable(T). #100144 (Denys Melnyk).
  • Se corrige el uso de un valor sin inicializar en StringSearcher.h. #100225 (Konstantin Bogdanov).
  • Permite cancelar subconsultas escalares y otras canalizaciones durante el análisis mediante Ctrl+C. Anteriormente, al pulsar Ctrl+C durante una subconsulta escalar de larga duración no ocurría nada hasta que la subconsulta terminaba. También corrige la barra de progreso y las estadísticas JSON para que informen correctamente de las filas leídas durante la ejecución de subconsultas escalares, tanto en clickhouse-client como en clickhouse-local. En coautoría con @YjyJeff. #100230 (Raúl Marín).
  • Se corrigió una excepción LOGICAL_ERROR en consultas que involucran columnas Dynamic con uniones cruzadas y filtros en tiempo de ejecución, causada por ColumnVariant::filter, que compartía punteros a columnas Variant en lugar de clonarlos en la ruta de optimización hasOnlyNulls. Cierra https://github.com/ClickHouse/ClickHouse/pull/100147. #100234 (Pavel Kruglov).
  • Se corrigió un error en Array de Variant que podía reinterpretar el tipo de dato al llamar a la función arrayFirst/arrayLast. Por ejemplo, antes Array(Variant(Date, Bool)) se convertía en Bool cuando el tipo de variante subyacente real era Date. #100255 (timothygk).
  • Algunos cambios menores en las funciones: las funciones h3 ahora validan mejor los límites; readWKB comprueba los límites de tamaño (una nueva configuración, max_wkb_geometry_elements); las funciones del generador aleatorio limitan el número máximo de iteraciones en sus cálculos. Como seguimiento de #93543. #100270 (Alexey Milovidov).
  • Se corrigió un problema por el que cutURLParameter podía omitir parámetros por error cuando aparecían como subcadenas de otros parámetros. #100280 (Nikita Semenov).
  • Se corrige una excepción cuando la configuración de la ruta del archivo de metadata de Iceberg contiene un byte nulo. #100283 (Alexey Milovidov).
  • Se corrigió el crecimiento cuadrático del número de consultas ejecutadas cuando se usa distributed_index_analysis con predicados que contienen subconsultas IN. #100287 (Anton Popov).
  • Corrige la excepción “Block structure mismatch” al usar GROUP BY ... WITH TOTALS HAVING en combinación con UNION DISTINCT y expresiones Nullable. #100293 (Alexey Milovidov).
  • Se corrige la excepción LOGICAL_ERROR en estimateCompressionRatio cuando el parámetro block_size_bytes es extremadamente grande. #100298 (Alexey Milovidov).
  • Se corrige la excepción “Inconsistent AST formatting” en compilaciones de depuración al usar GROUP BY CUBE(...) WITH ROLLUP o combinaciones similares. #100376 (Alexey Milovidov).
  • Se corrigió una excepción al crear una vista con alias de columnas y consultas SELECT * o EXCEPT/INTERSECT. #100386 (Alexey Milovidov).
  • Soluciona que DROP TABLE se quede bloqueado indefinidamente en tablas con motor Kafka cuando los consumidores se quedan atascados en un rebalance tras un error de heartbeat. #100388 (Alexey Milovidov).
  • Se corrige la excepción ReadBuffer is canceled. Can't read from it. en las operaciones de copia de seguridad y restauración que usan archivos ZIP. #100400 (Alexey Milovidov).
  • Se corrige la excepción TOO_MANY_ROWS en consultas SELECT count() con max_rows_to_read / force_primary_key cuando los datos están repartidos en varias partes con límites de gránulo no alineados. #100408 (Alexey Milovidov).
  • Se corrige system.completions para filtrar correctamente bases de datos, tablas y columnas según los derechos de acceso en todas las combinaciones de permisos: por tabla, por base de datos y con revocación por columna. #100432 (Shaohua Wang).
  • Se corrige un SEGFAULT en NuRaft debido a una condición de carrera. #100444 (Pablo Marcos).
  • min/max/argMin/argMax ahora tratan los NaN de forma coherente con ORDER BY: los NaN siempre se omiten (solo se devuelven cuando todos los valores son NaN). Antes, los resultados dependían de la posición de los NaN en los datos debido a la semántica de comparación no ordenada de IEEE 754. #100448 (Raúl Marín).
  • Se corrigió un error de copiar y pegar por el que delta_lake_snapshot_end_version, cuando se establecía sin delta_lake_snapshot_start_version, se ignoraba silenciosamente en lugar de generar un error BAD_ARGUMENTS. #100454 (Mohammad Lareb Zafar).
  • StorageRabbitMQ::shutdown no es idempotente (accede incondicionalmente a punteros débiles y luego destruye los punteros compartidos correspondientes), pero ahora se invoca dos veces: una vez en StreamingStorageRegistry y después en DatabaseCatalog. Esta corrección hace que el método sea idempotente y añade comprobaciones defensivas de valores nulos. #100455 (Miсhael Stetsyuk).
  • Se corrigió la excepción LOGICAL_ERROR al usar accurateCastOrNull con el tipo de destino QBit. #100470 (Raufs Dunamalijevs).
  • Se corrigió la excepción LOGICAL_ERROR “Stream … not found” al insertar en una tabla con columnas Array(JSON) anidadas en partes wide con optimize_on_insert=0. #100475 (Pavel Kruglov).
  • Validar las rutas de las entradas de archivo en los metadatos de la copia de seguridad para rechazar secuencias de path traversal, rutas absolutas y nombres vacíos durante RESTORE. #100483 (Pablo Marcos).
  • Se corrige un problema por el que la sintaxis LIMIT m OFFSET n WITH TIES no funcionaba. Esta sintaxis es equivalente a LIMIT n, m WITH TIES, que ya funcionaba. #100491 (Nihal Z. Miaji).
  • Se corrige la excepción “No set is registered for key” al usar IN con columnas Nullable(Tuple) que tienen campos con nombre y elementos LowCardinality. #100523 (Alexey Milovidov).
  • Se corrige un desbordamiento de búfer en el montón en usearch sorted_buffer_gt::insert() que podía provocar un cierre inesperado o corromper silenciosamente la memoria durante la búsqueda por similitud vectorial. #100537 (Dustin Healy).
  • Se corrigió un problema por el que EXECUTE AS ignoraba las cláusulas FORMAT e INTO OUTFILE especificadas en la consulta. #100538 (pufit).
  • Corrige la inconsistencia en el formato del AST para SAMPLE con OFFSET a nivel de consulta. Cierra #100576. #100579 (Pavel Kruglov).
  • Corrige el catálogo Polaris en Azure. Desde la versión 25.12, este catálogo en Azure empezó a añadir el bucket al principio de la ruta. Por ejemplo, abfss://polaris-polaris@<some_url>.windows.net/polaris-polaris/<other-path> en lugar de abfss://polaris-polaris@<some_url>.windows.net/<other-path>. Este PR elimina el bucket de la ruta. #100583 (Konstantin Vedernikov).
  • Corrige la excepción por incompatibilidad de tipos en transform cuando la columna por defecto es const en algunos bloques. Cierra #100574. #100616 (Pavel Kruglov).
  • Corrige los casos de NOT_FOUND_COLUMN_IN_BLOCK en los que la parte SELECT de la proyección contiene columnas que no existen en la parte SELECT original de la consulta. Cierra #100194. #100623 (Yarik Briukhovetskyi).
  • Validar las dimensiones de la forma del formato Npy frente al tamaño del archivo y los límites de desbordamiento para evitar ataques de denegación de servicio mediante archivos .npy especialmente diseñados con dimensiones desmesuradamente grandes. También se rechazan las formas vacías y se limita la memoria por fila a 2 GiB. #100625 (Raúl Marín).
  • Se corrige un problema por el que se ignoraba session_timezone al analizar valores DateTime durante las inserciones asíncronas (TCP) y todas las inserciones a través de HTTP. #100647 (Sema Checherinda).
  • Permitir pasar la clave de segmentación a las funciones de tabla cluster() y clusterAllReplicas() al usar una función de tabla como fuente (p. ej., cluster('name', view(...), sharding_key)). #100665 (Sergey Veletskiy).
  • Se corrige un cierre inesperado del servidor (fallo de aserción) al usar funciones de agregación paramétricas con el combinador Array y argumentos NULL, como quantileIfArrayArray(0.5)([[NULL]], [[1]]). #100679 (nerve-bot).
  • Corrige la excepción al calcular el supertipo común para tuplas vacías y no vacías con use_variant_as_common_type activado. #100699 (Antonio Andelic).
  • El servidor ya no deja de iniciarse cuando se configura un disco de Azure blob storage, pero el endpoint no está accesible temporalmente (p. ej., por un fallo de DNS). #100701 (Raúl Marín).
  • Se corrigió el comportamiento indefinido en positiveModulo cuando el divisor sin signo no cabe en el tipo de resultado con signo. #100705 (Raúl Marín).
  • Se corrige el cierre inesperado del servidor (error lógico “tipo de retorno inesperado de __topKFilter”) cuando use_top_k_dynamic_filtering está habilitado y la columna de ORDER BY es de tipo Dynamic o Variant. #100742 (Groene AI).
  • Corrige un fallo del servidor al usar la función has() con PREWHERE/WHERE en una clave Tuple que contiene elementos LowCardinality. #100760 (Groene AI).
  • Se corrige el error de aserción file_offset_of_buffer_end <= getFileSize() (excepción en compilaciones de depuración) al leer tablas Log o StripeLog en almacenamiento de objetos S3 con escrituras concurrentes. #100763 (Alexey Milovidov).
  • Corrige una excepción en el estimador de selectividad de estadísticas cuando una cláusula WHERE incluye una expresión de función (p. ej., toDecimal64(col, 3)) en una tabla con estadísticas activadas. Ahora, el estimador omite esos predicados en lugar de intentar una conversión de tipos no válida. #100764 (Han Fei).
  • Corrige un caso poco frecuente en el que un join con reordenación puede dar un resultado incorrecto. #100790 (Yarik Briukhovetskyi).
  • Corrige los tipos incorrectos de los argumentos de AggregateFunction en el conteo trivial optimizado, lo que provocaba la excepción NUMBER_OF_ARGUMENTS_DOESNT_MATCH al consultar expresiones como count(v0 + v1) en tablas distribuidas. #100794 (YjyJeff).
  • Algunos catálogos pueden mostrar secretos en la sección SETTINGS del resultado de la consulta select * from system.databases. Este PR evita ese comportamiento. #100800 (Konstantin Vedernikov).
  • Corrige el comportamiento indefinido (desbordamiento de enteros con signo) en toStartOfInterval al usar intervalos de Week, Quarter o Year con el argumento origin y valores extremos del intervalo. #100817 (Raúl Marín).
  • Se corrigen los combinadores de funciones de agregación If, Distinct, DistinctIf, IfState con tipo de retorno Tuple y uno o más argumentos Nullable, que no podían leer estados serializados antiguos tras la introducción de Nullable(Tuple). Cierra #98917. #100826 (Nihal Z. Miaji).
  • Se corrige un segfault en s3Cluster y en las consultas distribuidas debido a un use-after-free en el pool de conexiones. #100837 (Konstantin Bogdanov).
  • Se corrige un segfault por desreferenciación de puntero nulo al cargar diccionarios durante el apagado del servidor. Context::getUserDefinedSQLObjectsStorage (desreferencia user_defined_sql_objects_storage) es invocado por los hilos de diccionario de forma concurrente mientras el hilo principal llama a Context::shutdown (establece user_defined_sql_objects_storage en null). Debemos asegurarnos de deshabilitar futuras actualizaciones en el cargador de diccionarios, terminar las consultas de diccionario que se estén ejecutando en ese momento y esperar a que finalicen los hilos de carga de diccionarios, todo ello antes de ejecutar Context::shutdown. De forma similar a lo que hacemos con las consultas normales. #100839 (Miсhael Stetsyuk).
  • Se corrigió el desbordamiento de búfer en ULIDStringToDateTime cuando la entrada contiene bytes no ASCII. #100843 (Konstantin Bogdanov).
  • Corregido un cierre inesperado (LOGICAL_ERROR) al consultar una tabla Merge (o la table function merge()) que engloba varias tablas, incluida una tabla Distributed, con distributed_group_by_no_merge=1 activado. #100859 (Groene AI).
  • Cast_keep_nullable, cuando está habilitado, no lanzará una excepción al convertir un NULL de Dynamic a Variant. #100864 (Seva Potapov).
  • Se corrige un problema por el que los comandos clickhouse-keeper-client get, exists y ls imprimían mensajes de error duplicados de watch_id en stdout en lugar de stderr. #100893 (Mohammad Lareb Zafar).
  • Corrige una excepción en intDiv/intDivOrZero en arrays de tuplas Nullable, p. ej., SELECT intDiv([divide((1, 2), ... AND NULL)], 2). #100895 (Raúl Marín).
  • Evaluar los argumentos del motor de StorageAlias antes de almacenar la definición, para que expresiones como currentDatabase() se resuelvan como literales antes de guardarse en la base de datos. #100902 (Nikolay Degterinsky).
  • Se corrige processAndOptimizeTextIndexFunctions cuando query_plan_merge_expressions = 0, donde ExpressionStep está directamente sobre ReadFromMergeTree. Corrige #100879. #100909 (Jimmy Aguilar Mena).
  • Se actualizó replxx para incluir la corrección de un acceso fuera de límites en do_complete_line. #100925 (Azat Khuzhin).
  • Se corrigen resultados incorrectos cuando un JOIN con la optimización de segmento por PK usa la caché de condiciones de consulta y algunas partes quedan filtradas por condiciones en caché. #100926 (Groene AI).
  • Se corrigió que divide e intDiv devolvieran ILLEGAL_DIVISION en algunos casos al usarse en expresiones de filtro durante el análisis de índices. #100928 (Nihal Z. Miaji).
  • Se corrigieron los errores “La tabla de destino no existe” en las vistas materializadas con tablas internas durante el arranque asíncrono, causados por un orden incorrecto de las dependencias de inicio. #100946 (Nikolay Degterinsky).
  • Corrige el comportamiento indefinido (desbordamiento de enteros con signo) en parseDateTimeBestEffort al parsear cadenas de fecha y hora con más de 18 dígitos fraccionarios de segundo. #100948 (Vasily Chekalkin).
  • Se corrigió un fallo al usar un índice de búsqueda de texto con una cláusula IN que contiene una subconsulta de tipo Tuple, por ejemplo, WHERE (id, str) IN (SELECT (id, str) FROM ...), o cuando el número de columnas de la subconsulta no coincide con el de la tupla del lado izquierdo de IN. #100959 (Anton Popov).
  • Se corrigió un fallo al crear un diccionario de polígonos a partir de una tabla MergeTree que utiliza serialización dispersa de columnas. #100964 (Anton Popov).
  • Se corrige el error lógico “nodo de acción del árbol de consulta no válido” al usar INTERSECT ALL / UNION ALL con expresiones reducidas a constantes. #100977 (Alexey Milovidov).
  • Se corrige un problema que impedía que la función de agregación sumCountOrDefault con uno o más argumentos Nullable leyera estados serializados antiguos tras la introducción de Nullable(Tuple). Cierra #100882. #101021 (Nihal Z. Miaji).
  • Se corrige un cierre inesperado (Logical error: isConst/isSparse/isReplicated assertTypeEquality) en los algoritmos de merge cuando la replicación diferida de columnas (enable_lazy_columns_replication) genera columnas ColumnReplicated que pasan a canalizaciones de merge-sort con entradas que llegan tarde. #101036 (Groene AI).
  • Se corrige el error incorrecto UNKNOWN_IDENTIFIER cuando se usa el mismo alias para varias expresiones en SELECT; ahora se muestra el error correcto MULTIPLE_EXPRESSIONS_FOR_ALIAS. #101040 (Alexey Milovidov).
  • Corrección de las columnas ALIAS con tipos DateTime/DateTime64 que no aplicaban la conversión de zona horaria cuando la zona horaria declarada difiere de la de la expresión. #101043 (Alexey Milovidov).
  • Se corrige que las políticas de fila no se registraran en query_log para vistas, subconsultas e INSERT ... SELECT. Aunque las políticas de fila se aplicaban durante la planificación de la consulta, no se propagaban de los subplanificadores al planificador principal para su registro. Las políticas de fila (solo para el registro) ahora se mantienen en QueryAccessInfo para que tanto los planificadores como los subplanificadores puedan poblarlas. #101044 (Narasimha Pakeer).
  • Se corrige una excepción en DirectJoinMergeTreeEntity cuando los bloques del pipeline contienen columnas ColumnConst que se combinan con columnas normales. #101046 (Alexey Milovidov).
  • Se corrige un espacio innecesario en el formato del alias de columna en la CTE (WITH t (a, b)WITH t(a, b)). #101049 (Alexey Milovidov).
  • Se corrigieron las funciones de tabla remote/cluster que fallaban con funciones de tabla anidadas como merge cuando el analizador está habilitado. #101055 (Alexey Milovidov).
  • Se corrige un problema por el que OFFSET se aplicaba dos veces en consultas distribuidas cuando prefer_localhost_replica=1, lo que producía menos filas de las esperadas. #101071 (Nihal Z. Miaji).
  • Se corrigió un fallo al usar el formato Regexp con una expresión regular no válida en la configuración format_regexp. #101074 (Nihal Z. Miaji).
  • Corrige el error “Illegal type Decimal64 of start parameter” en las funciones de agregación de series temporales al usar serialize_query_plan=1 con réplicas paralelas. #101083 (Groene AI).
  • Se corrige una excepción en optimizeLazyMaterialization cuando se utiliza una proyección con PREWHERE junto con ORDER BY ... LIMIT. #101115 (Anton Popov).
  • Se corrige el fallo del servidor (SIGABRT) al usar funciones de agregación con el combinador Null de uso exclusivamente interno (p. ej., sumNull, avgNull) y con la configuración aggregate_functions_null_for_empty = 1 habilitada. #101147 (Groene AI).
  • Corrige un uso de memoria después de liberarla en la ruta de escritura de la caché del sistema de archivos que podía provocar lecturas de memoria ya liberada al registrar segmentos de archivo completados (detectado por MemorySanitizer en BuzzHouse). #101161 (Groene AI).
  • Se corrige un cierre inesperado del servidor con “Intento de adjuntar una tabla externa a un Set listo sin elementos explícitos” cuando el análisis distribuido de índices encuentra un predicado GLOBAL IN cuyo Set se creó sin elementos explícitos. #101178 (Groene AI).
  • Se corrigen las funciones de agregación MAX/MIN en columnas Decimal que devolvían resultados incorrectos cuando la compilación JIT está activada (tras alcanzar el umbral de compilación). #101203 (Raúl Marín).
  • Se corrigen las optimizaciones de minmax_count_projection y las optimizaciones triviales de COUNT(*), que quedaban deshabilitadas de forma permanente después de una eliminación ligera, incluso tras haberse fusionado todas las partes con una máscara de eliminación ligera. #101212 (Anton Popov).
  • Corrige un caso que podía provocar el error lógico Having zero bytes, ... en la caché cuando se sobrescribía un objeto remoto entre list y read, lo que antes daba lugar a metadatos de objeto obsoletos. #101219 (Kseniia Sumarokova).
  • Se corrige un cierre inesperado del servidor (LOGICAL_ERROR: Bad cast from ColumnVector to ColumnLowCardinality) al consultar una tabla MergeTree con ORDER BY CAST(lc_column, 'Type'), donde lc_column tiene el tipo LowCardinality. #101220 (Groene AI).
  • Se corrige la limpieza de los nodos de procesamiento obsoletos en S3Queue. #101230 (Kseniia Sumarokova).
  • Se corrigió el UB en mergeTreeAnalyzeIndexes() cuando el argumento optimizations no es válido. #101253 (Azat Khuzhin).
  • Se corrige la excepción Logical error: 'partitions_count > 0' al realizar operaciones consecutivas de ALTER TABLE UPDATE en una tabla Iceberg particionada. #101278 (Desel72).
  • Corrige resultados erróneos en consultas cuando se usa una constante entera grande (p. ej., 256, 2147483648) como predicado booleano en una cláusula WHERE con AND sobre tablas MergeTree. Por ejemplo, SELECT count() FROM t WHERE (2147483648 > b) AND 2147483648 devolvía incorrectamente 0 en lugar de coincidir con todas las filas. #101287 (Groene AI).
  • Se corrige el INSERT SELECT desde un clúster de Delta Lake con ReplicatedMergeTree. #101299 (Konstantin Vedernikov).
  • Se corrigió un fallo que provocaba un cierre inesperado con “Error lógico: lectura desde una CTE materializada antes de la materialización” cuando una subconsulta escalar hace referencia a una cadena de CTE materializadas dependientes entre sí. #101305 (Groene AI).
  • Se corrige una condición de carrera en los datos de storage_id en IStorage::getDependentViewsByColumn. #101385 (Nikolay Degterinsky).
  • Se corrigen el formato y la clonación del AST de BACKUP FROM SNAPSHOT. #101405 (Pablo Marcos).
  • Se corrige el cierre inesperado por LOGICAL_ERROR “Current component is empty” al consultar system.part_moves_between_shards con enforce_keeper_component_tracking habilitado. #101462 (Groene AI).
  • Se corrigió un fallo de segmentación en DataTypeDynamic::create() cuando el fuzzer genera un AST malformado del tipo Dynamic. #101464 (Groene AI).
  • Genera un error cuando se usan la configuración delta_lake_snapshot_version o la configuración de versión de CDF sin DeltaKernel habilitado, en lugar de devolver datos incorrectos en silencio. #101489 (Desel72).
  • Se corrige la excepción NOT_FOUND_COLUMN_IN_BLOCK al usar ARRAY JOIN con JOIN USING y con la configuración analyzer_compatibility_join_using_top_level_identifier habilitada. Cierra #101240. #101507 (Vladimir Cherkasov).
  • Se corrigió el fallo en el bucle de reintento de INSERT de Iceberg cuando la tabla se había creado con iceberg_metadata_file_path y la versión de metadatos de destino ya existía. #101548 (Groene AI).
  • Eliminar Nullable de la columna de resultados en arrayIntersect y funciones relacionadas para evitar discrepancias en la serialización/deserialización. #101569 (George Larionov).
  • Se corrige un cierre inesperado del servidor (LOGICAL_ERROR) al hacer SELECT desde una vista materializada basada en una tabla con engine IcebergLocal. #101577 (Groene AI).
  • Se corrige un mensaje de error incorrecto al llamar a intExp10 con un argumento NaN: mostraba intExp2 en lugar de intExp10. #101582 (Krishna Chaitanya).
  • Se corrige un problema por el que allow_statistics=0 no bloqueaba ALTER TABLE ADD STATISTICS ni ALTER TABLE DROP STATISTICS tras la refactorización en #100288. #101585 (Krishna Chaitanya).
  • Se corrige el error por el que KeeperMap CREATE TABLE fallaba con “Cannot create metadata for table” cuando en nodos de ZooKeeper remanentes de un drop parcial anterior a la versión 25.1 faltaba el nodo drop_lock_version. #101623 (Antonio Andelic).
  • Corrige un posible error lógico al leer las subcolumnas de Map. Cierra #100769. Cierra #101336. #101641 (Pavel Kruglov).
  • Da prioridad a la coincidencia exacta de la subcolumna frente a la coincidencia por prefijo en getSubcolumnData para evitar un posible fallo. Cierra #101271. #101645 (Pavel Kruglov).
  • Se corrige un fallo (LOGICAL_ERROR: “ColumnUnique can’t contain null values”) al comparar una columna LowCardinality con una constante NULL de Variant mientras use_variant_default_implementation_for_comparisons está deshabilitado. #101690 (Groene AI).
  • Qué: Se añadió una comprobación de flujo vacío a Bzip2ReadBuffer para que devuelva EOF en lugar de lanzar UNEXPECTED_END_OF_FILE cuando el flujo interno está vacío. #101691 (ClickGap AI Bot).
  • Qué: Se corrigió la descripción invertida de la columna alterable en system.s3_queue_settings y system.azure_queue_settings: se intercambiaron los significados de 0 y 1 para que coincidan con el comportamiento real del código. #101703 (ClickGap AI Bot).
  • Se corrige un error por el que positiveModulo(tuple, number) se derivaba incorrectamente a la división en lugar de al módulo. #101709 (ClickGap AI Bot).
  • Corrige un fallo al configurar thread_pool_size en un disco con caché. Anteriormente, FileCacheSettings::loadFromConfig() rechazaba thread_pool_size como una configuración desconocida, lo que impedía que el servidor arrancara. Esta configuración es un parámetro válido de IDisk que controla la cantidad de hilos usados en operaciones de copia de disco a disco durante los movimientos de partes en segundo plano. #101712 (Francisco).
  • Se corrigió la creación de diccionarios RANGE_HASHED, que aceptaba silenciosamente un atributo de rango MAX inexistente y usaba una configuración de tipos incorrecta cuando los atributos de rango mínimo y máximo tenían tipos distintos. El error se debía a un fallo de copiar y pegar en buildRangeConfiguration, que buscaba min_attr_name en lugar de max_attr_name para el atributo máximo. #101732 (Yakov Olkhovskiy).
  • Se corrige un fallo de acceso a memoria liberada en el planificador de concesión de CPU cuando el temporizador de espera sobrevive al hilo de trabajo cuyos ProfileEvents::Counters referencia. #101761 (Antonio Andelic).
  • Corrige un error en las funciones arrayLevenshteinDistanceWeighted y arraySimilarity. Cierra el issue #101725. #101767 (Mikhail f. Shiryaev).
  • Se corrige un problema por el que la API de consulta de Prometheus ignoraba los cuerpos de formulario en POST. #101794 (James Cunningham).
  • Se corrigió el escape de excepciones desde el destructor Client::~Client de S3 que provocaba el cierre del servidor. #101798 (Gagan Dhakrey).
  • Corrige un use-after-scope en la deserialización en paralelo de rutas dinámicas del tipo Object, que podía provocar bloqueos al leer tablas con muchas rutas dinámicas. #101823 (Antonio Andelic).
  • Se corrigió una salida incorrecta de la función formatDateTime con el formateador %W bajo ciertas configuraciones de formato (no predeterminadas). #101847 (Robert Schulze).
  • Se corrigió el falso negativo de shouldPatchFunction en SYSTEM INSTRUMENT ADD cuando la cadena de búsqueda aparece por primera vez dentro de un argumento de plantilla del nombre de símbolo desdemangleado. #101885 (Pablo Marcos).
  • Se corrigió la pérdida del registro de UDF cuando la sesión de ZooKeeper expiraba durante una actualización periódica; todas las funciones definidas por el usuario podían quedar no disponibles hasta que una actualización completa se realizara correctamente. #101891 (Nikita Fomichev).
  • Se corrigió la descripción de system.codecs de AES_256_GCM_SIV para que indicara AES-256 en lugar de AES-128. #101917 (Jimmy Aguilar Mena).
  • Se corrige un problema por el que se usaban extremos incorrectos en un índice min-max creado sobre una columna JSON, lo que provocaba un resultado de consulta incorrecto. Cierra #101700. #101918 (Pavel Kruglov).
  • El tokenizador splitByString ahora rechaza las cadenas separadoras vacías. #101928 (Robert Schulze).
  • Se corrigió un problema por el que materialize_skip_indexes_on_merge=false no suprimía los índices de texto (de texto completo) durante la fusión. Anteriormente, solo se suprimían los índices de omisión no textuales (minmax, set, bloom_filter); los índices de texto seguían generándose, lo que desperdiciaba CPU y E/S. #101932 (Groene AI).
  • El tokenizador sparseGrams generó tokens más largos que la longitud máxima especificada (esto se debía a un +2 codificado de forma fija en la implementación). #101934 (Elmi Ahmadov).
  • Se corrigió SIGSEGV en MergeTreeDataPartWriterWide::cancel cuando un constructor de flujo lanza una excepción durante addStreams, dejando una entrada nula en column_streams. #101936 (Antonio Andelic).
  • Corrige una excepción al consultar tablas Merge o Distributed con un índice de texto completo y condiciones de filtro combinadas que mezclan has*Tokens con LIKE cuando query_plan_direct_read_from_text_index está habilitado. #101939 (Jimmy Aguilar Mena).
  • Se corrige un comportamiento indefinido al analizar paquetes de consulta del protocolo nativo con valores de QueryProcessingStage no válidos. #101972 (Raúl Marín).
  • Cerrar la conexión TCP cuando se produzca una excepción durante el análisis inicial de la consulta para evitar leer datos basura de un flujo desincronizado. #101989 (Raúl Marín).
  • Corrige una condición de carrera de SLRU en la caché del sistema de archivos 26.1+, que puede provocar un error lógico en la reserva de espacio. En una compilación de depuración, también puede causar un fallo de aserción: 'Previous state is Evicting, but expected state to be Active while setting Evicting flag for 2c1e3484ecdc6b78a8978fa5b17c5097:0:339 (state: Evicting)'.. #101991 (Kseniia Sumarokova).
  • Se corrige una excepción al convertir una cadena con datos sobrantes al tipo Tuple() vacío. #102011 (Alexey Milovidov).
  • Corrige el orden incorrecto de las filas en las consultas que usan ORDER BY con el algoritmo de join grace_hash. Las consultas afectadas podían devolver resultados en un orden incorrecto, lo que producía una salida incorrecta sin que se advirtiera. #102036 (János Benjamin Antal).
  • Corrige un ERROR LÓGICO (Tamaño inesperado del tipo de índice) que podía producirse en consultas RIGHT JOIN y FULL JOIN cuando se había configurado el ajuste max_bytes_in_join. #102042 (Jimmy Aguilar Mena).
  • Corrige los casos en los que Time con valores negativos devolvía resultados incorrectos al compararse con DateTime. Cierra #101670. #102056 (Yarik Briukhovetskyi).
  • Se corrige un crash en la actualización de UDF causado por ZooKeeperRetriesControl, que reintentaba sobre una sesión de ZooKeeper obsoleta (caducada) sin renovarla. #102059 (Nikita Fomichev).
  • Corrige los espacios que faltaban al formatear unlock snapshot. cierra https://github.com/clickhouse/clickhouse/issues/101723. #102063 (Han Fei).
  • Se corrige un fallo (SIGSEGV) al consultar una vista con una cláusula WHERE cuando la consulta interna genera columnas con tipos distintos de los metadatos de la vista (p. ej., Nullable de LEFT JOIN con join_use_nulls). #102085 (Miсhael Stetsyuk).
  • Se corrigen las entradas de VectorSimilarityIndexCache que nunca se desalojaban al eliminar una parte debido a una discrepancia en las claves de la caché. #102152 (Seva Potapov).
  • Hacer NACK de los mensajes defectuosos al usar almacenamiento de RabbitMQ. #102157 (Seva Potapov).
  • Se corrige un error lógico al analizar una cadena incorrecta correspondiente a una tupla vacía. #102289 (Nihal Z. Miaji).
  • Corrige resultados de agregación incorrectos (filas duplicadas) al usar optimize_aggregation_in_order=1 con columnas de GROUP BY en un orden distinto al de la clave de ordenación de la tabla. #102299 (Groene AI).
  • Se corrige un fallo en IcebergLocal ALTER TABLE ... UPDATE al usar el formato Avro, causado porque los tipos envoltorio LowCardinality/Nullable no se desenvolvían antes de la serialización. #102337 (Desel72).
  • Se corrigió un fallo de segmentación en mutaciones sobre columnas materializadas sin expresión. Resuelve #102185. #102342 (zoomxi).
  • Corrección en Coalescing merge tree para el tipo Array. Se cierra #89509. #102384 (Konstantin Vedernikov).
  • Se corrige un segfault (o LOGICAL_ERROR en compilaciones de depuración) al leer archivos Parquet con el push down del filtro bloom habilitado y condiciones de igualdad/desigualdad en la cláusula WHERE. El fallo se producía por un acceso a memoria fuera de límites durante la recuperación de datos del filtro bloom del prefetcher de Parquet, y también podía provocar resultados de consulta incorrectos y no deterministas. #102385 (Groene AI).
  • Corrige el LOGICAL_ERROR que abortaba el redimensionamiento dinámico de la caché del sistema de archivos SLRU, causado por estadísticas de desalojo compartidas entre subcolas y una ruta de recuperación incorrecta para candidatos fallidos. #102396 (Antonio Andelic).
  • Corrige un fallo al inicializar tablas alias sin tabla de destino en una réplica nueva de la base de datos Replicated. Cierra #101320. #102397 (Nikolay Degterinsky).
  • Se corrige una lectura fuera de los límites en las funciones de búsqueda en cadenas (countSubstrings, position, etc.) al buscar una subcadena objetivo compuesta íntegramente por bytes nulos. #102401 (Raúl Marín).
  • Los ajustes de los índices de texto completo (enable_full_text_index, allow_experimental_full_text_index, use_skip_indexes_on_data_read) ya no se desactivan cuando la configuración compatibility apunta a una versión anterior a la 26.1. Antes, esto podía impedir que SharedDatabaseCatalog creara tablas con índices de texto. #102422 (Nikita Fomichev).
  • Corregida una lectura fuera de límites en printf con un % al final. #102472 (Raúl Marín).
  • Corrige una excepción de chassert ReadBuffer is canceled en compilaciones de depuración de AsynchronousMetrics, causada porque rewind no restablecía la marca de cancelación del búfer. #102524 (Yuri Fedoseev).
  • Se corrigió hasToken / hasTokenOrNull con cadenas de búsqueda formadas solo por separadores (p. ej., '()', '!!!') en columnas con un índice de texto: anteriormente, el índice omitía silenciosamente todos los gránulos en lugar de generar BAD_ARGUMENTS (para hasToken) o devolver NULL (para hasTokenOrNull). #102544 (Jimmy Aguilar Mena).
  • Soluciona OOM en solicitudes multi enormes en keeper. Para el tracing de OpenTelemetry, asignamos incondicionalmente >1 KiB a spans de OpenTelemetry en objetos ZooKeeperRequest; es decir, en solicitudes multi realmente enormes, intentamos asignar >10 GiB de memoria adicional. Para solucionarlo, ahora mantenemos los datos compartidos en memoria estática y usamos std::unique_ptr en lugar de std::optional en ZooKeeperOpentelemetrySpans. #102586 (Miсhael Stetsyuk).
  • Corregido el problema por el que CurrentMetric de NamedCollection se inflaba con CREATE NAMED COLLECTION IF NOT EXISTS en colecciones existentes, y no se inicializaba para las colecciones cargadas desde la configuración o el almacenamiento SQL al inicio. Cierra #102507. #102598 (Pablo Marcos).
  • Se corrigió una excepción en getStructureOfRemoteTable cuando el segmento local devuelve columnas vacías debido a DDL concurrente. #102604 (Alexey Milovidov).
  • Corrige la excepción LOGICAL_ERROR cuando varias consultas simultáneas CREATE TABLE IF NOT EXISTS se dirigen a la misma tabla S3Queue en una base de datos Shared. #102610 (Nikita Taranov).
  • Se corrige el fallo LOGICAL_ERROR “Unexpected number of rows in column subchunk” en el lector nativo de Parquet V3 al leer columnas Nullable con un filtro WHERE. #102628 (Groene AI).
  • Se corrigió la descripción del evento de perfil AzureWriteMicroseconds, que indicaba “read” en lugar de “write”. #102639 (Miсhael Stetsyuk).
  • Error en la política de filas que provoca la excepción ‘Not found column in block’ en algunos casos especiales. #102648 (Yarik Briukhovetskyi).
  • Se corrigió una excepción del servidor en ClusterDiscovery cuando un clúster estático (definido en la configuración) se quedaba temporalmente sin nodos activos. #102661 (Kseniia Sumarokova).
  • Corrige una inferencia incorrecta del tipo de dato Date en caso de desbordamiento después del ajuste de la zona horaria. Cierra #102601. #102674 (Pavel Kruglov).
  • Corrige el bloqueo indefinido de SYSTEM WAIT VIEW cuando se elimina la vista materializada actualizable mientras la espera está en curso. #102681 (Nikolay Degterinsky).
  • Se corrige CASE con una expresión Dynamic que devolvía ELSE en todas las filas. Cierra #102511. #102684 (Pavel Kruglov).
  • Corrige la serialización del tipo Dynamic aplanado con tipos de datos codificados en formato binario. Cierra #101911. #102692 (Pavel Kruglov).
  • Se corrige un problema por el que format_schema_source=‘query’ ignoraba silenciosamente los resultados de varias filas. Cierra #101905. #102698 (Pavel Kruglov).
  • Informar del código de salida real a través del client SSH en lugar de asignar todos los errores a 1. Cierra #101741. #102700 (Konstantin Bogdanov).
  • Se corrige la pérdida de encabezados HTTP en los controladores de consultas dinámicas y predefinidas. Cierra #101846. #102706 (Konstantin Bogdanov).
  • Aplicar la corrección por muestreo de Poisson a los perfiles de heap colapsados de jemalloc para ajustarlos a la salida de jeprof. Anteriormente, el formato colapsado subestimaba los tamaños reales de asignación al no tener en cuenta la probabilidad de muestreo. #102759 (Antonio Andelic).
  • Se corrige el fallo provocado por un argumento NULL en la función hasPhrase. #102802 (Nikita Taranov).
  • Se corrige un fallo del servidor (SIGSEGV) al leer archivos Avro con esquemas recursivos que contienen referencias cíclicas a tipos simbólicos. Ahora, esos esquemas se detectan y se rechazan con un mensaje de error claro, en lugar de provocar un fallo. #102853 (Groene AI).
  • Corrige un cierre inesperado del servidor (aserción LOGICAL&#95;ERROR) cuando una función sobre una columna Variant alcanza el límite de memoria u otra excepción no relacionada con la conversión de tipos durante la conversión del resultado en FunctionVariantAdaptor. Ahora la excepción se propaga correctamente en lugar de clasificarse por error como un error interno. #102855 (Groene AI).
  • Se corrige un fallo del servidor en compilaciones de depuración/sanitizador cuando se produce std::length_error durante la inferencia de esquema (p. ej., por valores extremos de input_format_msgpack_number_of_columns o datos de entrada malformados). #102859 (Groene AI).
  • Hacer que la representación de NULL en la serialización de columnas replicadas y dispersas respete la configuración (p. ej., format_tsv_null_representation). #102888 (Hechem Selmi).
  • Retroportado en #103499: Se corrigen las solicitudes a S3 que fallaban con ios_base::clear: unspecified iostream_category error en lugar de reintentarse, debido a que BufferedStreamBuf::flushBuffer de Poco no gestionaba escrituras cortas desde la capa de socket. #102894 (Sema Checherinda).
  • Se corrige el problema por el que las optimizaciones de minmax_count_projection y de COUNT(*) trivial quedaban deshabilitadas de forma permanente tras una eliminación ligera, incluso después de que se hubieran fusionado todas las partes con una máscara de eliminación ligera. #102900 (Anton Popov).
  • Se corrigieron cierres inesperados aleatorios en jemalloc debidos a LTO. #102913 (Azat Khuzhin).
  • Optimiza las cadenas OR de las políticas de fila convirtiéndolas en IN en el nuevo analizador. #102915 (Azat Khuzhin).
  • Corrige la corrupción de metadatos de jemalloc debida a la liberación de la caché de páginas con una alineación incorrecta, que puede provocar bloqueos. #102918 (Azat Khuzhin).
  • Los INSERT simples sin vistas materializadas ya no solicitan una cantidad excesiva de slots e hilos de ConcurrencyControl (max_threads en lugar de max_insert_threads), lo que evita la inanición de slots de CC y el crecimiento descontrolado del número de hilos en clústeres con alto throughput de INSERT. #102961 (Sema Checherinda).
  • Reintroducir ArrowMemoryPool para permitir que se lance MEMORY_LIMIT_EXCEEDED y así evitar el OOM del kernel. #102999 (Azat Khuzhin).
  • Se corrige el problema por el que se ignoraba cast_string_to_date_time_mode al hacer CAST a Nullable(DateTime). Cierra #101840. #103035 (Pavel Kruglov).
  • Se añadió compatibilidad con las columnas ALIAS en la optimización de lectura directa del índice de texto. #103037 (Anton Popov).
  • Retroportado en #103454: se corrige un problema por el que SELECT DISTINCT devolvía silenciosamente resultados incompletos cuando una proyección de agregación coincidía con la consulta y algunas partes de la tabla no tenían datos de proyección (p. ej., la proyección se añadió a una tabla que ya contenía datos y no se ejecutó MATERIALIZE PROJECTION). Cierra #102951. #103052 (Nihal Z. Miaji).
  • Corrige los resultados erróneos devueltos por WHERE x AND toNullable(N) en tablas MergeTree cuando N es un entero de mayor tamaño que UInt8 (p. ej., 256, 65535, 2147483648 o cualquier entero negativo). El filtro descartaba incorrectamente todas las filas porque splitFilterNodeForAllowedInputs usaba un cero NULL al convertir a booleano el remainder Nullable de un AND reducido, lo que hacía que la comparación se convirtiera en NULL bajo la lógica ternaria. #103077 (Groene AI).
  • Se corrigió el tipo de argumento incorrecto que se mostraba en los mensajes de error de las funciones de búsqueda de cadenas (p. ej., locate, position) cuando los argumentos se pasan en orden invertido (locate(needle, haystack) con function_locate_has_mysql_compatible_argument_order = 1). #103102 (Alex Kuleshov).
  • Se corrige que waitForPause quede bloqueado indefinidamente cuando se llama a disableFailPoint sin ningún hilo pausado en el failpoint. #103119 (Shaohua Wang).
  • Limite las cadenas del paquete TCP Hello previo a la autenticación a 64 KB y agregue la configuración del servidor handshake_timeout_milliseconds para limitar el tiempo total del protocolo de enlace, evitando que los clientes no autenticados consuman memoria en exceso o mantengan hilos ocupados indefinidamente. #103284 (Sema Checherinda).
  • Corregidas las estadísticas de ColumnIndex de Parquet cuando min_value > max_value en columnas String. #103334 (Saurabh Kumar Ojha).
  • Validación de datos Dynamic aplanados malformados en Native format. #103392 (Pavel Kruglov).
  • Poblar la columna _time a partir de la función de tabla url. #103437 (Nikita Taranov).
  • Corregida la detección de SVE cuando se utilizan instrucciones SVE no disponibles. #103568 (Raúl Marín).

Mejora en compilación/pruebas/empaquetado

  • La dependencia de Libstemmer (Snowball) ahora utiliza la versión más reciente, la v3.0.1. #99256 (Jimmy Aguilar Mena).
  • Se aleatorizó la configuración en clickhouse-test: use_skip_indexes_for_top_k, use_top_k_dynamic_filtering, query_plan_max_limit_for_top_k_optimization. #91782 (Nikita Fomichev).
  • Implementar una prueba de estrés para las funciones, para comprobar la robustez de sus distintas propiedades. #93543 (Michael Kolupaev).
  • Proporcionar una configuración propia de CMake para llvm-project en lugar de importar la de upstream. #97453 (Konstantin Bogdanov).
  • Aleatorizar más configuraciones optimize_* en la infraestructura de pruebas para mejorar la cobertura de las pasadas de optimización de consultas. #97547 (Alexey Milovidov).
  • Usa la toolchain de Rust nightly-2026-03-22. #98602 (Konstantin Bogdanov).
  • Se usa wasmtime v42.0.1. #98603 (Konstantin Bogdanov).
  • Se usa llvm-project 22.1.1. #98882 (Konstantin Bogdanov).
  • Se reemplazó SANITIZE_COVERAGE (callbacks personalizados del sanitizador, granularidad a nivel de símbolo) por la cobertura basada en código fuente de LLVM (WITH_COVERAGE, -fprofile-instr-generate -fcoverage-mapping) para el pipeline nocturno de cobertura por prueba. El server ahora lee su propio mapa de cobertura de las secciones ELF durante el arranque y recopila tuplas (file, line_start, line_end) por prueba mediante un nuevo comando SYSTEM SET COVERAGE TEST 'name'. La selección de pruebas en las comprobaciones de CI específicas usa consultas por rango de líneas sobre una nueva table CIDB checks_coverage_lines y ordena las pruebas candidatas según cuántas líneas modificadas del diff cubren. #99513 (Nikita Fomichev).
  • Corrige el error de enlazado de llvm-libc en compilaciones con -O0. #100023 (Zheguang Zhao).
  • Se corrigieron dos mensajes de error al arrancar el contenedor cuando la configuración no contenía las opciones logger.log y logger.errorlog (p. ej., cuando todos los mensajes de registro deben enviarse a STDOUT/STDERR). #100239 (Simon).
  • Se prefiere ld64.lld en lugar del ld de Apple (cctools-port ld64) para las compilaciones de macOS. Esto debería reducir significativamente los tiempos de enlace en Darwin, ya que el ld64 de cctools-port es muy lento con -ffunction-sections y -dead_strip. Se vuelve a ld si ld64.lld no está disponible. #100275 (Alexey Milovidov).
  • Pruebas para garantizar que los directorios no registren secretos (REST + Glue). #100307 (Konstantin Vedernikov).
  • Repetir las pruebas modificadas recientemente con distintas configuraciones aleatorias. #100385 (Alexey Milovidov).
  • Registrar las dependencias de archivos #embed en CMake y habilitar el modo de dependencias de ccache para que las recompilaciones sean correctas. #100411 (Alexey Milovidov).
  • Se añadieron pruebas de corrección para consultas TPC-H. #100580 (Raufs Dunamalijevs).
  • Se usa aws-sdk-cpp 1.11.771. #100582 (Konstantin Bogdanov).
  • Permitir que los archivos XML de pruebas de rendimiento hagan referencia a archivos externos con consultas SQL y ajustes mediante el atributo file. #100747 (Raufs Dunamalijevs).
  • Se corrigió la compilación con -march=x86-64-v4 añadiendo la inclusión faltante de TargetSpecific.h en LowerUpperImpl.h. #100932 (Alexey Milovidov).
  • Se corrige la compilación en Gentoo al añadir —no-default-config a cxxflags. #100973 (Isak Ellmer).
  • Se añadió utils/auto-bisect/ — un marco de bisección basado en shell que descarga binarios precompilados de CI y ejecuta un script de prueba proporcionado por el usuario para encontrar el primer commit que introdujo una regresión, sin necesidad de una compilación local. #100989 (Nikita Fomichev).
  • Se desactiva ThinLTO de forma predeterminada en CMake para que las compilaciones locales de los desarrolladores ya no lo activen implícitamente. Las compilaciones de release de CI no se ven afectadas, ya que pasan explícitamente -DENABLE_THINLTO=1. #101041 (Alexey Milovidov).
  • Añade el benchmark TPC-DS SF1 a las pruebas de rendimiento. #101209 (Raufs Dunamalijevs).
  • Se añadieron pruebas sin estado para las eliminaciones ligeras de MergeTree que cubren: el ciclo de vida de la marca has_lightweight_delete, la corrección de COUNT(*) con optimize_trivial_count_query, la integridad de las columnas MATERIALIZED/DEFAULT, la recuperación de la marca en ReplicatedMergeTree, read_in_order con filas eliminadas, múltiples ciclos de eliminación y merge, la ocultación de la columna _row_exists, la variedad de predicados y la aplicación de RBAC en ALTER DELETE. #101792 (Nikita Fomichev).
  • Ahora se publican imágenes distroless de Docker con variantes ubuntu y alpine para las versiones etiquetadas. #101941 (Rahul Nair).
  • Los stack traces ahora muestran rutas relativas limpias (p. ej., src/Common/Exception.cpp) en lugar de rutas contaminadas con el directorio de compilación (p. ej., ./ci/tmp/fast_build/./src/Common/Exception.cpp). #102000 (Raúl Marín).
  • Añade una comprobación de estilo de CI que rechace los archivos de más de 5 MB incluidos en commits del repositorio, con una lista blanca para los datos de prueba legítimos ya existentes. Elimina zookeeper_log.parquet, sin usar, de 14 MB. #102080 (Raúl Marín).
  • Elimina ~400 directivas #include sin usar de las cabeceras para reducir los tiempos de compilación. #102585 (Raúl Marín).
  • Se utiliza wasmtime v43.0.1. #102603 (Konstantin Bogdanov).
  • Se utiliza openssl 3.5.6. #102606 (Konstantin Bogdanov).
  • Use xz 5.8.3. #102607 (Konstantin Bogdanov).
  • Actualización de la imagen base distroless de Docker de Debian 12 (glibc 2.36, OpenSSL 3.0) a Debian 13 (glibc 2.41, OpenSSL 3.5), lo que reduce la superficie de CVE a cero vulnerabilidades alcanzables. #101678 (Rahul Nair).

Lanzamiento de ClickHouse 26.3 LTS, 2026-03-26. Presentación, Vídeo

Cambio incompatible con versiones anteriores

  • Volver a una versión anterior tras actualizar puede provocar pérdida de datos. Las versiones de serialización de los tipos de datos ahora se propagan a los tipos de datos anidados. Por ejemplo, la versión de serialización de String with_size_stream antes se aplicaba solo a las columnas String de nivel superior y a los elementos de Tuple. Ahora se aplica a cualquier tipo String dentro de cualquier tipo anidado, como Array/Map/Variant/JSON/etc. Este comportamiento está controlado por la configuración de MergeTree propagate_types_serialization_versions_to_nested_types, que ahora está activada de forma predeterminada. Después de este cambio, las partes de datos recién creadas no pueden ser leídas por versiones anteriores, pero las partes antiguas pueden leerse en la versión nueva sin problemas. La actualización es segura, pero volver a una versión anterior no lo es: si necesitas revertir después de actualizar a 26.3, ¡los datos escritos por 26.3 en columnas con tipos anidados no podrán leerse! Consulta #101429 para más detalles. #94859 (Pavel Kruglov).
  • Se elimina el tipo de índice de omisión hypothesis. Era una función experimental poco conocida y de utilidad práctica limitada. Crear tablas con INDEX ... TYPE hypothesis ahora producirá un error. #96874 (Alexey Milovidov).
  • Se elimina la función experimental detectProgrammingLanguage. #99567 (Alexey Milovidov).
  • Se corrige la precedencia del operador NOT para ajustarla al estándar SQL: NOT ahora tiene menor precedencia que IS NULL, BETWEEN, LIKE y los operadores aritméticos. Por ejemplo, NOT (x) IS NULL ahora se interpreta como NOT (x IS NULL) en lugar de (NOT x) IS NULL. Esto puede cambiar el resultado de las consultas que dependían del comportamiento anterior (no estándar). #97680 (Alexey Milovidov).
  • Corrige los metadatos de las proyecciones normales para que las proyecciones con claves de ordenación de varias columnas se reconozcan adecuadamente. Se basa en #90429. #91352 (Amos Bird).
  • Se corrigió un problema por el que los archivos de índices de omisión no respetaban la configuración replace_long_file_name_to_hash, lo que provocaba errores de “Nombre de archivo demasiado largo” y fallos al leer índices con nombres largos. Ahora, los nombres de archivo de los índices de omisión se convierten en hash cuando superan max_file_name_length, de forma similar a los archivos de columnas. Esto es retrocompatible (los servidores nuevos leen las partes antiguas), pero una degradación de versión (o el uso de servidores antiguos durante una actualización gradual) puede hacer que se ignoren los índices con nombres largos. #97128 (Raúl Marín).
  • Se activa async insert de forma predeterminada. Ahora ClickHouse agrupará por lotes todas las inserciones pequeñas de forma predeterminada. Este ajuste se define en compatibility. Si establece compatibility=<version less than 26.2>, el valor predeterminado será el anterior, false. Puede activar o desactivar async inserts en varios niveles: en la configuración de los perfiles de usuario, para la sesión, para la consulta o para la tabla MergeTree. #97590 (Sema Checherinda).
  • Se cambió el valor predeterminado de mysql_datatypes_support_level de vacío a decimal,datetime64,date2Date32, lo que permite la asignación correcta de DATE de MySQL a Date32, de DECIMAL/NUMERIC a Decimal y de DATETIME/TIMESTAMP con precisión a DateTime64 de forma predeterminada. Anteriormente, las columnas DATE de MySQL se asignaban a Date, que no puede representar fechas anteriores a 1970-01-01, lo que provocaba corrupción de datos. #97716 (Alexey Milovidov).
  • Aceptar un array de nombres de las partes en lugar de una expresión regular para mergeTreeAnalyzeIndexes{,UUID}, ya que las expresiones regulares son lentas (Funcionalidad experimental). #98474 (Azat Khuzhin).
  • Cambiar el valor predeterminado de stderr_reaction de throw a log_last para las UDF ejecutables. Las UDFs que escriben advertencias en stderr ya no provocan errores cuando el código de salida es 0. Las excepciones por código de salida ahora incluyen el contenido de stderr. #99232 (Xu Jia).

Nueva funcionalidad

  • Se añadió serialización en buckets para columnas Map en MergeTree (map_serialization_version = 'with_buckets'). Las claves se dividen en buckets basados en hash, de modo que al leer una sola clave (m['key']) solo se lea un bucket en lugar de toda la columna, lo que proporciona una aceleración de 2 a 49 veces en búsquedas de una sola clave, según el tamaño del mapa. El número de buckets y la estrategia de asignación a buckets pueden controlarse mediante nuevas configuraciones de MergeTree: map_serialization_version, max_buckets_in_map, map_buckets_strategy, map_buckets_coefficient y map_buckets_min_avg_size. #99200 (Pavel Kruglov).
  • Compatibilidad con CTE materializadas. Permite evaluar las CTE solo una vez durante la ejecución de la consulta y almacenar sus resultados en tablas temporales. Cierra #53449. #94849 (Dmitry Novik).
  • Permite usar determinadas funciones estándar de SQL sin paréntesis por compatibilidad, como NOW. Cierra #52102. #95949 (Aly Kafoury).
  • Ahora puede usar la función de clave de ordenación natural naturalSortKey(s). #90322 (Nazarii Piontko).
  • Ahora puede usar JSON/Object nativo como entrada para las funciones JSONExtract. Cierra #88370. #96711 (Fisnik Kastrati).
  • Si un parámetro de consulta es de tipo Nullable y no se especifica, asumiremos que su valor es NULL. #93869 (Vikash Kumar).
  • Se admite ZooKeeper auxiliar para la base de datos Replicated. #95590 (RinChanNOW).
  • Se añadió compatibilidad con la función has para el tipo JSON a fin de comprobar la existencia de una ruta, de forma similar a Map. #96927 (DQ).
  • Se añadió la función de tabla mergeTreeTextIndex(database, table, index), que permite leer datos directamente desde un índice de texto. Esta función puede usarse para tareas de introspección o para realizar agregaciones sobre los datos del índice de texto. #97003 (Anton Popov).
  • Añade la configuración de MergeTree table_readonly para marcar las tablas como de solo lectura y evitar inserciones y modificaciones. #97652 (Alexey Milovidov).
  • Se añade la nueva configuración use_partition_pruning y el alias use_partition_key. Establécela en false para deshabilitar la poda de particiones en función de la clave de partición. #97888 (Nihal Z. Miaji).
  • Implementa ALTER TABLE ... EXECUTE expire_snapshots('<timestamp>') en tablas Iceberg. #97904 (murphy-4o). #99130
  • Permite que cada entrada type=http de <protocols> especifique una clave <handlers> personalizada que apunte a una sección de configuración <http_handlers_*> independiente, lo que permite definir distintas reglas de enrutamiento HTTP para cada puerto. #98414 (Amos Bird).
  • Se agrega la opción pretty=1 a EXPLAIN para obtener una salida con sangría en forma de árbol, y compact=1 para contraer los pasos de Expression, lo que hace que los planes de consulta sean más legibles. #98500 (Kirill Kopnev).
  • Se añade la configuración del servidor restore_access_entities_with_current_grants. Cuando está habilitada, los usuarios/roles restaurados desde copias de seguridad ven sus grants limitados a lo que el usuario que realiza la restauración puede conceder (con la misma semántica que GRANT CURRENT GRANTS), en lugar de fallar con ACCESS_DENIED. #98795 (pufit).
  • Se añaden las funciones caseFoldUTF8 y removeDiacriticsUTF8 para el plegado de mayúsculas y minúsculas de Unicode y la eliminación de marcas diacríticas. #98973 (George Larionov).
  • Se agregó la función de cadena normalizeUTF8NFKCCasefold para la normalización Unicode NFKC_Casefold, que combina la normalización NFKC con el plegado de mayúsculas y minúsculas. #99276 (George Larionov).
  • Se añade el tokenizer unicode_word para índices de texto completo y la función tokens. Segmenta el texto según las reglas de límites de palabras de Unicode: las palabras ASCII se forman con caracteres conectores (guion bajo, dos puntos, punto y comilla simple), mientras que los caracteres Unicode no ASCII se convierten en tokens de un solo carácter. Nota: 26.3 acepta este tokenizador únicamente con el nombre unicode_word; se renombró a asciiCJK en 26.4. #99357 (Amos Bird).
  • Se agregaron las configuraciones max_skip_unavailable_shards_num y max_skip_unavailable_shards_ratio para limitar cuántos segmentos pueden omitirse sin avisar cuando skip_unavailable_shards está habilitado. Si la cantidad o la proporción de segmentos no disponibles supera el umbral configurado, se genera una excepción en lugar de devolver resultados incompletos sin avisar. #99369 (Alexey Milovidov).
  • Ahora los usuarios pueden usar la palabra clave SOME en expresiones de subconsulta. Se comporta de forma idéntica a ANY. #99842 (Artem Kytkin).
  • Se añade la configuración output_format_trim_fixed_string para eliminar los bytes nulos al final de los valores FixedString en los formatos de salida de texto. #97558 (NeedmeFordev).
  • Se admiten expresiones JOIN de tablas entre paréntesis en la cláusula FROM, p. ej., SELECT * FROM (t1 CROSS JOIN t2). #97650 (Alexey Milovidov).
  • Implementar la función toDaysInMonth: devuelve el número de días del mes correspondiente a la fecha especificada. #99227 (Vitaly Baranov).

Funcionalidad experimental

  • Se añade compatibilidad experimental con funciones definidas por el usuario (UDFs) basadas en WebAssembly, lo que permite implementar lógica de funciones personalizadas en WebAssembly y ejecutarla dentro de ClickHouse. Agradecimientos especiales a Alexey Smirnov por aportar compatibilidad con el backend de Wasmtime. #88747 (Vladimir Cherkasov). Mejoras incrementales en la compatibilidad con UDF de WASM. #99373 (Vasily Chekalkin).
  • Se añade compatibilidad con dialectos SQL externos mediante la biblioteca polyglot. #99496 (Alexey Milovidov).
  • Se añade el códec de compresión de punto flotante ALP (sin fallback ALP_rd para valores double no compresibles). #91362 (Nazarii Piontko).
  • Se añaden indicaciones de tipo diferidas experimentales para columnas JSON. Cuando se habilita mediante allow_experimental_json_lazy_type_hints, la instrucción ALTER TABLE ... MODIFY COLUMN json JSON(path TypeName) que solo añade o modifica indicaciones de tipo se completa de forma instantánea como una operación solo de metadatos, sin reescribir datos históricos. Las indicaciones de tipo se aplican en tiempo de consulta a las partes antiguas y se materializan durante las operaciones INSERT y las fusiones en segundo plano. #97412 (tanner-bruce).
  • Se habilitan lecturas paralelas desde el motor de tabla YTsaurus. #97343 (MikhailBurdukov).

Mejora del rendimiento

  • Mejora el rendimiento de los lagos de datos. En versiones anteriores, la lectura desde el almacenamiento de objetos no ajustaba el pipeline al número de hilos de procesamiento. Esto supone mejoras de varios órdenes de magnitud (~40x) en máquinas multinúcleo. #99548 (Alexey Milovidov).
  • Ahora, la relación entre enable_parallel_replicas y automatic_parallel_replicas_mode es la siguiente. Una consulta puede usar réplicas paralelas solo si enable_parallel_replicas > 0. Además, si automatic_parallel_replicas_mode=1, la decisión de usar réplicas paralelas se toma durante la planificación en función de las estadísticas recopiladas previamente. Si automatic_parallel_replicas_mode=0, las réplicas paralelas se usarán en todas las consultas compatibles, independientemente de las estadísticas. Una excepción destacada es insert-select distribuido con réplicas paralelas: en este caso, las consultas siempre se ejecutarán como si automatic_parallel_replicas_mode=0. #97517 (Nikita Taranov).
  • Permite la poda de particiones cuando el predicado contiene cualquier operador de comparación (=, <, >, !=) y la clave de partición está incluida en una cadena de funciones deterministas (p. ej., PARTITION BY x y predicados como cityHash64(x) % 5 > 2, toYYYYMM(x) < 2026, toYYYYMM(x) = 2026 o toYYYYMM(x) != 2026 usarán la clave de partición para la poda). Cierra #28800. #98432 (Nihal Z. Miaji).
  • Permite la optimización de lectura en orden y la poda de la primary key cuando el tipo de destino de CAST es Nullable y la conversión es monótona; por ejemplo, con PRIMARY KEY x, ClickHouse puede usar la optimización de lectura en orden para ORDER BY x::Nullable(UInt64) y aplicar la poda de la primary key a predicados como WHERE x::Nullable(UInt64) > 500000. #98482 (Nihal Z. Miaji).
  • Se habilitan la poda de índices y el pushdown de filtros cuando una columna de tipo entero se compara con un literal de coma flotante; por ejemplo, predicados como WHERE x < 10.5 ahora pueden usar la clave primaria para la poda, y filtros como prime < 1e9 o number < 1e5 ahora hacen pushdown en las funciones de tabla primes() y numbers() en lugar de provocar una ejecución sin límite. Cierra #85167. #98516 (Nihal Z. Miaji).
  • Se añadió una nueva caché SLRU para los metadatos de Parquet a fin de mejorar el rendimiento de lectura, al eliminar la necesidad de volver a descargar archivos solo para leer esos metadatos. #98140 (Grant Holly).
  • Se admite el intercambio de lados en los joins ANTI, SEMI y FULL según las estadísticas del optimizador. #97498 (Hechem Selmi).
  • Optimiza el descarte de gránulos para pointInPolygon en polígonos grandes y corrige que el análisis de índices de pointInPolygon arroje excepciones durante la poda de la clave primaria. #91633 (Nihal Z. Miaji).
  • Mejora del rendimiento de la función levenshteinDistance. #94543 (Joanna Hulboj).
  • Optimiza las conversiones por lotes de tipo Decimal al evitar llamadas a funciones para cada elemento. #95923 (Konstantin Bogdanov).
  • Las tablas Iceberg ahora admiten la precarga asíncrona de metadatos mediante la configuración de tabla iceberg_metadata_async_prefetch_period_ms, que precarga periódicamente la caché de metadatos. Además, la configuración de consulta iceberg_metadata_staleness_ms permite que las consultas SELECT usen metadatos en caché si son más recientes que el umbral de obsolescencia especificado, lo que elimina las llamadas al catálogo Iceberg durante el procesamiento de solicitudes. #96191 (Arsen Muk).
  • El modo ordered de S3Queue usa S3 ListObjectsV2 StartAfter para evitar volver a listar el historial completo del prefijo, lo que reduce las llamadas a ListObjects. #96370 (Venkata Vineel ).
  • Menor uso de memoria para la deduplicación de inserciones. En general, el bloque original es necesario para la deduplicación, pero en los insert síncronos se pudo omitir y ahorrar memoria por completo. #96661 (Sema Checherinda).
  • Se usa un valor específico de la arquitectura para el tamaño de línea de caché en lugar de un valor fijo de 64. #97357 (Nikita Taranov).
  • Se optimizó ligeramente la lectura del diccionario del índice de texto, lo que mejora el rendimiento general del análisis de índices de texto. #97519 (Anton Popov).
  • Acelera la descompresión de bloques de 16 bytes con LZ4 en ARM. #97774 (Raúl Marín).
  • Se ha refactorizado la tokenización con una nueva interfaz de alto rendimiento, sustituyendo la antigua API de tipo iterador para admitir SIMD y tokenizadores con estado. Parte de #90268. #97871 (Amos Bird).
  • Se mejoró el rendimiento del análisis de índices de texto para consultas con condiciones combinadas que involucran columnas indexadas y no indexadas. Anteriormente, la optimización de salida temprana durante el análisis de índices se deshabilitaba incorrectamente en estos casos. #98096 (Anton Popov).
  • Mejora el rendimiento de las consultas que contienen expresiones constantes que generan arrays o maps muy largos. #98287 (Alexey Milovidov).
  • Se corrigió el análisis de las condiciones sobre claves primarias DateTime64 al compararlas con constantes enteras, lo que antes impedía la poda de gránulos. #98410 (Amos Bird).
  • La configuración optimize_syntax_fuse_functions está activada de forma predeterminada. #98424 (Alexey Milovidov).
  • Optimiza la función de agregación avgWeighted mediante acumuladores locales en lugar del almacenamiento y reenvío fila por fila a través del estado de agregación, mejorando el rendimiento hasta en un 27 % para entradas Nullable. #98793 (Antonio Andelic).
  • Mejora el rendimiento y reduce el uso de memoria de las funciones de ventana paralelas en determinados escenarios, así como de las cargas de trabajo de arrayFold con arrays grandes. Esto también puede reducir la presión de fallos de página y mejorar la estabilidad con límites de memoria ajustados en las consultas afectadas. #98892 (filimonov).
  • Mejora el rendimiento de las fusiones ordenadas. #99013 (Artem Zuikov).
  • Se optimizan INTERSECT ALL y EXCEPT ALL. #99097 (Raufs Dunamalijevs).
  • Se añadió soporte para la optimización read_in_order_use_virtual_row en lecturas en orden inverso. #99198 (Vladimir Cherkasov).
  • Reducir la contención de la caché en los RIGHT y FULL JOINs comprobando si JoinUsedFlags está definido antes de escribir. #99274 (Hechem Selmi).
  • Optimiza PrefetchingHelper::calcPrefetchLookAhead sustituyendo la aritmética de coma flotante por aritmética entera pura, mejorando la disposición de la caché de instrucciones y reduciendo la sobrecarga de ciclos en los bucles de agregación. #99327 (Riyane El Qoqui).
  • Reducir el consumo de memoria de Keeper sustituyendo absl::flat_hash_set por CompactChildrenSet para almacenar los hijos de los nodos. El nuevo contenedor almacena de 0 a 1 hijos directamente, sin asignación en el heap, lo que cubre la mayoría de los nodos de Keeper. Esto reduce el tamaño de KeeperMemNode de 144 a 128 bytes. #99860 (Antonio Andelic).
  • Las proyecciones de agregación ahora funcionan correctamente en las vistas. Corrige #32753. #88798 (Amos Bird).
  • Se añadió compatibilidad con la optimización de conversión de OUTER a INNER join con join_use_nulls. Cierra #90978. #95968 (Vladimir Cherkasov).
  • Mejora la lectura de subcolumnas mediante el cálculo correcto de los tamaños antes de leerlas. Reduce el uso de memoria y acelera la lectura de subcolumnas. #96251 (Pavel Kruglov).
  • Hacer que las cachés de mark, de datos sin comprimir y de páginas utilicen una arena de jemalloc independiente para evitar la fragmentación de memoria cuando las asignaciones de corta duración, es decir, para consultas y solicitudes, se mezclan con asignaciones de mayor duración para las cachés. #96812 (Seva Potapov). #98812. #99021
  • Las tablas con reglas DELETE TTL ahora pueden utilizar el algoritmo de fusión vertical. #97332 (murphy-4o).
  • Aplicar índices de omisión de datos durante el análisis distribuido de índices. #97767 (Azat Khuzhin).
  • Las marcas de los índices secundarios ahora se precargan cuando la configuración prewarm_mark_cache está habilitada (se cargan en la caché de marcas de índice durante la obtención de partes de datos y el arranque de la tabla). #97772 (Anton Popov).
  • Menor bloqueo durante el control de acceso. #97894 (Nikita Taranov).
  • Cuando se habilita apply_row_policy_after_final o apply_prewhere_after_final, las condiciones compuestas con AND en las políticas de fila y en PREWHERE ahora se descomponen para extraer átomos de la clave de ordenación y utilizarlos en el análisis del índice de clave primaria. Anteriormente, si un filtro diferido contenía una combinación de predicados de la clave de ordenación y de predicados que no pertenecían a ella (p. ej., x > 1 AND y != ‘foo’), toda la expresión quedaba excluida del análisis del índice. Ahora, los átomos de la clave de ordenación (como x > 1) se extraen y se usan para la poda de gránulos, incluso dentro de expresiones AND anidadas. #98513 (Yarik Briukhovetskyi).
  • Reduce la contención por bloqueos en MergeTreeBackgroundExecutor al hacer que los recursos de la tarea se liberen sin adquirir el bloqueo. Cierra #93620. #98604 (Dmitry Novik).
  • Corrige el uso excesivo de memoria (~514 MiB) durante la autodetección de formato al leer datos que no son Arrow (p. ej., JSON desde url o file sin un formato explícito), debido a que el lector ArrowStream interpretaba erróneamente los primeros bytes como una longitud de metadatos enorme. #98893 (Konstantin Bogdanov).

Mejora

  • Permite analizar archivos GeoParquet que contienen distintos tipos Geo en la misma columna. #97851 (Mark Needham).
  • Se introduce la función SQL tokensForLikePattern, que tokeniza patrones LIKE respetando la semántica de los comodines: % y _ se consideran comodines, los comodines escapados (\%, \_) se consideran literales y se descartan los tokens adyacentes a comodines no escapados. #97872 (Amos Bird).
  • Se añade un marcador de posición {_schema_hash} para el motor de tabla S3, que inserta un hash de las definiciones de las columnas de la tabla en la ruta de S3. #98265 (Miсhael Stetsyuk).
  • SymbolIndex, addressToSymbol, system.symbols y buildId ahora funcionan en macOS mediante el análisis de las tablas de símbolos Mach-O. #99014 (Alexey Milovidov).
  • La tabla system.stack_trace ahora funciona en macOS, lo que permite inspeccionar las trazas de pila de todos los hilos del servidor. #98982 (Alexey Milovidov).
  • Añade la opción de configuración LDAP por servidor <follow_referrals> (valor predeterminado: false) para controlar si el client LDAP sigue las referencias. Deshabilitar el seguimiento de referencias evita timeouts y bloqueos al buscar desde un base DN raíz de dominio de Active Directory. Los mensajes de registro relacionados con las referencias se han movido de warn a trace. #96765 (paf91).
  • Ahora registramos en una nueva columna llamada skip_indices de la tabla query&#95;log todos los índices de omisión de datos utilizados durante la ejecución de la consulta. Corrige #78676. Autor original @pheepa. #87862 (Grant Holly).
  • Las sugerencias de ACCESS_DENIED ya no revelan los nombres de las columnas, a menos que el usuario pueda mostrar todas las columnas requeridas; los nombres de la base de datos y de la tabla siguen siendo visibles en la sugerencia. #91067 (filimonov).
  • Añade un hilo dedicado a la limpieza para MergeTree, a fin de evitar retrasos en la limpieza cuando la carga de merge es elevada. Esto resuelve #86181. #91574 (Amos Bird).
  • Recargar la configuración del clúster si cambian las IP asociadas al hostname del servidor local, en lugar de las IP de cualquier host. Corrige #81215, #70156 y #65268. #93726 (Zhigao Hong).
  • Permite que optimize_aggregators_of_group_by_keys optimice correctamente las funciones de agregación en las consultas GROUPING SETS. #93935 (Xiaozhe Yu).
  • Keeper-bench: informar de errores en las métricas y generar un archivo JSON de métricas para el modo —input-request-log. #95748 (Mohammad Lareb Zafar).
  • Se añade la nueva cláusula ROLE a CREATE USER. #97074 (Vitaly Baranov).
  • Ahora puede establecer la configuración de internal_replication para un clúster creado por la base de datos Replicated. #97228 (Pervakov Grigorii).
  • Nueva configuración: allow_nullable_tuple_in_extracted_subcolumns controla si las subcolumnas Tuple(...) extraídas de Tuple, Variant, Dynamic y JSON se devuelven como Nullable(Tuple(...)) (NULL para las filas que faltan) o como Tuple(...) (valores de tupla predeterminados para las filas que faltan). Está deshabilitada de forma predeterminada y solo puede cambiarse reiniciando el servidor. #97299 (Nihal Z. Miaji).
  • Agregar información sobre los filtros diferidos como un elemento independiente en la salida de EXPLAIN (al usar Row Policies/PREWHERE con FINAL). Relacionado: #91065. #97374 (Yarik Briukhovetskyi).
  • Habilita type_json_allow_duplicated_key_with_literal_and_nested_object de forma predeterminada. Permite evitar errores por claves duplicadas durante el análisis de JSON como {"a" : 42, "a" : {"b" : 42}}, que ClickHouse puede generar a partir de los datos JSON originales {"a" : 42, "a.b" : 42}. #97423 (Pavel Kruglov).
  • Mejora de Keeper: find_super_nodes es un comando muy útil para depurar el crecimiento inesperado del número de nodos en Keeper. Desafortunadamente, si hay varios supernodos, es casi imposible encontrar más de uno, porque el comando se queda bloqueado indefinidamente al recorrer los hijos del primer supernodo que encuentra. Este PR impide recorrer los hijos de los supernodos. #97819 (pufit).
  • Compatibilidad inicial con el autocompletado para clickhouse-keeper-client. #97828 (Konstantin Bogdanov).
  • Vaciar los búferes de logging asíncrono en caso de cierre inesperado. #97836 (Azat Khuzhin).
  • Se habilita de forma predeterminada la función de suplantación de identidad (consulta EXECUTE AS target_user). #97870 (Vitaly Baranov).
  • Mejora en la cancelación de consultas con el motor de tabla SQLite mediante KILL QUERY y la cancelación de consultas (Ctrl+C) en clickhouse-client. #97944 (Roman Vasin).
  • Se añadió la configuración del servidor jemalloc_profiler_sampling_rate para controlar lg_prof_sample de jemalloc y exponerla como la métrica asíncrona jemalloc.prof.lg_sample. #97945 (Antonio Andelic).
  • Se añade compatibilidad con pesos en la implementación de la cola acotada concurrente. #97962 (Daniil Ivanik).
  • Se añade sslmode a las claves permitidas para los orígenes de diccionario de PostgreSQL. Anteriormente, sslmode no figuraba en la lista de claves permitidas dictionary&#95;allowed&#95;keys de PostgreSQLDictionarySource.cpp, lo que imposibilitaba configurar el modo SSL para las conexiones de diccionario de PostgreSQL. Esto impedía que los diccionarios se conectaran a servidores PostgreSQL que requieren SSL (por ejemplo, AWS RDS, que exige SSL de forma predeterminada), ya que la conexión fallaba durante la negociación TLS y el servidor rechazaba la alternativa no cifrada. #98014 (mcalfin).
  • Mostrar un error claro de “archivo no encontrado” al pasar una ruta de archivo inexistente a clickhouse o clickhouse-local, en lugar de un mensaje genérico confuso. #98048 (Raúl Marín).
  • Ahora también se pueden crear índices de texto en columnas Nullable([Fixed]String) y Array(Nullable([Fixed]String)). #98118 (Jimmy Aguilar Mena).
  • Evite eliminar colecciones con nombre de las que dependan las fuentes de diccionario. #98127 (Pablo Marcos).
  • Se habilita el algoritmo de join grace_hash para consultas con totales. #98144 (János Benjamin Antal).
  • Cancelar antes las fusiones en segundo plano en DROP DATABASE para ordinary shared merge tree. #98161 (Shaohua Wang).
  • Mejora de la cancelación de consultas con MongoDB y MySQL mediante KILL QUERY y la cancelación de consultas (Ctrl+C) en clickhouse-client. #98187 (Roman Vasin).
  • Elimina NetlinkMetricsProvider y usa procfs exclusivamente para recopilar métricas taskstats por hilo. La recopilación basada en Netlink presenta problemas en entornos contenerizados y tiene una latencia en cola peor en situaciones de contención. #98229 (Amos Bird).
  • Se refactorizó el manejo de los archivos de manifiesto de Iceberg para corregir problemas con la caché de archivos de manifiesto. #98231 (Daniil Ivanik).
  • Ahora también tenemos en cuenta los casos en que la clave de ordenación de la tabla puede ser una expresión como toDate(time), y podemos decidir no aplazar expresiones de este tipo si forman parte de filtros. #98237 (Yarik Briukhovetskyi).
  • Añade una nueva métrica MaxAllocatedEphemeralLockSequentialNumber para el número secuencial máximo asignado a los znodes de bloqueo efímeros de ZooKeeper. #98243 (Miсhael Stetsyuk).
  • Actualización de ClickStack a la versión 2.20.0. #98252 (Aaron Knudtson).
  • Se agregó un nuevo evento de perfil KeeperRequestTotalWithSubrequests que cuenta cada subsolicitud dentro de una solicitud múltiple de forma individual, lo que ofrece una mejor visibilidad de la carga de trabajo real de Keeper. El evento existente KeeperRequestTotal sigue contando cada solicitud múltiple como una sola solicitud. #98348 (Antonio Andelic).
  • SYSTEM RELOAD DICTIONARIES ahora recarga los diccionarios en orden topológico para que los diccionarios que toman datos de otros diccionarios vean datos actualizados tras la recarga. #98356 (Alexey Milovidov).
  • Reiniciar la caché de estadísticas después de cambiar la configuración de MergeTree. #98520 (Han Fei).
  • Solo las réplicas “vivas” (a las que se puede acceder) participan en el análisis distribuido de índices. #98521 (Azat Khuzhin).
  • Se añade la configuración access_control_improvements.disallow_config_defined_profiles_for_sql_defined_users (deshabilitada/permitida de forma predeterminada), que impide usar perfiles de configuración definidos en la configuración (excepto el perfil default) para usuarios definidos mediante SQL. #98662 (Alexander Tokmakov).
  • Se limita el número de nodos usados por la heurística automática de réplicas paralelas al número real de nodos del clúster (en lugar de basarse solo en la configuración max_parallel_replicas). #98668 (Nikita Taranov).
  • Implementación de solicitudes redundantes y lectura asíncrona para el análisis distribuido de índices. #98724 (Azat Khuzhin).
  • La deserialización de estados AggregateFunction binarios ahora requiere consumir toda la entrada. Si hay bytes redundantes adicionales al final, ClickHouse lanza una excepción en lugar de aceptar datos de estado malformados. #98786 (Nihal Z. Miaji).
  • Hacer que TRUNCATE DATABASE responda a la cancelación de consultas. #98828 (Shaohua Wang).
  • Se mejora keeper-bench con canalización de solicitudes, período de calentamiento, estadísticas por operación, semillas reproducibles y una mejor gestión de errores. #98906 (Antonio Andelic).
  • Se admite la cláusula SAMPLE en el análisis distribuido de índices. #98931 (Azat Khuzhin).
  • Mostrar el título del gráfico en el dashboard incluso cuando la consulta devuelve un resultado vacío o produce un error. #98975 (Yash ).
  • Los mensajes de error del analizador ya no muestran todas las columnas de una tabla (lo que podía generar excepciones de más de 150 KB). Las listas de columnas ahora están limitadas a 10 elementos. #99002 (Yash ).
  • Devolver correctamente las estadísticas de las columnas de las subconsultas con joins para que la consulta padre pueda utilizarlas para reordenar los joins. #99096 (Alexander Gololobov).
  • Marque la sesión de ZooKeeper como expirada inmediatamente al comenzar la finalización, en lugar de esperar a que termine el hilo de envío. Esto permite que otros hilos establezcan una nueva sesión sin demora. #99102 (Raúl Marín).
  • Se usan más funciones matemáticas de LLVM-libc: exp, exp2, expm1, fabs, fabsl, floor, fmodl, log, log2, logf, pow, scalbn, scalbnl, copysignl, nan, nanf, nanl y las constantes compartidas explogxf. #99118 (Konstantin Bogdanov).
  • Reducir el uso de memoria y corregir una posible duplicación de la salida en el formato collapsed de system.jemalloc_profile_text. #99121 (Antonio Andelic).
  • Se añadió la columna is_subrequest a system.aggregated_zookeeper_log para separar las solicitudes independientes de las subsolicitudes dentro de las solicitudes Multi/MultiRead. Anteriormente, las subsolicitudes se agregaban en las mismas agrupaciones que las solicitudes independientes y, como cada suboperación se registraba con la duración total de la solicitud múltiple, la latencia media resultaba engañosa. Las subsolicitudes ahora tienen latencia cero. #99169 (Miсhael Stetsyuk).
  • Permite el comando ALTER TABLE MODIFY COLUMN x TTL ... sin especificar el tipo de columna. #99208 (Nikolay Degterinsky).
  • Se omiten las solicitudes obsoletas de Keeper para las sesiones que ya se han desconectado, lo que evita recorridos de ida y vuelta innecesarios de Raft. El número de sesiones finalizadas rastreadas está limitado por la configuración de coordinación max_finished_sessions_cache_size. #99246 (Antonio Andelic).
  • Compatibilidad con índices de texto construidos sobre mapValues(map) con el operador IN. #99286 (Anton Popov).
  • Soporte de autocompletado similar al de una shell en clickhouse keeper-client (gestiona el autocompletado de argumentos entre comillas, es decir, 'foo ba', gestiona argumentos escapados, es decir, foo\ ba, hace que ls imprima los nodos entre comillas si contienen espacios en blanco). #99312 (Azat Khuzhin).
  • Se evita que el comando mntr de Keeper se quede bloqueado por contención de bloqueos. #99472 (Antonio Andelic).
  • Se reduce la contención de bloqueos en el despachador de Keeper al invocar callbacks y despachar solicitudes de lectura fuera del ámbito del mutex, y se añaden guardas de bloqueo con perfilado para la observabilidad. #99751 (Antonio Andelic).
  • Se tolera la ausencia de relleno al final del último bloque de archivos Parquet. #99857 (Seva Potapov).

Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)

  • Corrige cómo se guarda el destino de una tabla Alias como dependencia DDL cuando no está totalmente calificado: ahora se guarda con la base de datos de la tabla Alias en lugar de con la base de datos de la sesión. #95175 (Enric Calabuig).
  • Se corrigió un resultado incorrecto o una excepción durante la lectura de subcolumnas de columnas ALIAS. #95408 (Pavel Kruglov).
  • Corrige la ausencia de una columna al usar un alias de identificador no estándar en JOIN con el analizador antiguo. Soluciona #25594, #47288 y #53263. #95679 (Zhigao Hong).
  • Soluciona un fallo en las funciones del dialecto Kusto bin(), bin_at(), extract() e indexof() cuando se pasan argumentos vacíos. #95736 (NeedmeFordev).
  • Prohíbe montar local_object_storage (que se utiliza en datalakes sobre el sistema de archivos local y, posiblemente, por LocalDisk) en cualquier lugar distinto de user_files_path en clickhouse-client. #96201 (Daniil Ivanik).
  • En el motor de tablas DeltaLake, se corrige una condición de carrera lógica al cambiar la versión de la instantánea y se eliminan recargas redundantes y costosas de la instantánea. #96226 (Kseniia Sumarokova).
  • Se corrigió un error lógico al hacer attach de una parte en MergeTree si se habían producido varios cambios de nombre encadenados entre el detach y el attach. #96351 (Alexey Milovidov).
  • Se corrige un error por el que los ajustes explícitos enviados junto con compatibility en la misma solicitud podían ignorarse de forma silenciosa cuando su valor coincidía con el valor predeterminado del servidor. #97078 (Raufs Dunamalijevs).
  • Se corrige un problema por el que el client informaba NETWORK_ERROR en lugar del error de parsing real (con el número de fila correcto) cuando un INSERT con parsing en paralelo encontraba datos no válidos. #97339 (Alexey Milovidov).
  • Corrige un problema por el que la función de agregación sumCount no podía leer estados serializados antiguos tras la introducción de Nullable(Tuple). Cierra #97370. #97502 (Nihal Z. Miaji).
  • Se corrigió la excepción en la comparación de tuplas que involucra elementos del tipo Nothing (p. ej., al comparar con elementos de tupla NULL) cuando se usa con GROUPING SETS y ORDER BY. #97509 (Alexey Milovidov).
  • Corrige el cálculo no determinista de uncompressed_hash para las partes de Compact MergeTree cuando se utilizan varios códecs de compresión, lo que podía provocar un comportamiento incorrecto de deduplicación. #97522 (Alexey Milovidov).
  • Corrige un error lógico por la falta de stream durante INSERT SELECT con JSON y buckets en shared data. Cierra #97331. #97523 (Pavel Kruglov).
  • Se corrigió el problema por el que las excepciones MEMORY_LIMIT_EXCEEDED se informaban incorrectamente como CORRUPTED_DATA durante las fusiones de SummingMergeTree y CoalescingMergeTree. #97537 (János Benjamin Antal).
  • Soluciona la excepción “Context has expired” en subconsultas correlacionadas que contienen funciones de tabla como url(). #97544 (Alexey Milovidov).
  • Se corrigen excepciones y comportamientos incorrectos en optimize_syntax_fuse_functions con proyecciones de agregación, tipos Date y preservación de nombres de columna. #97545 (Alexey Milovidov).
  • Se elimina la reescritura incorrecta de consultas de replaceRegexpOne a extract, que producía resultados erróneos cuando la regexp no coincidía; también se corrige una excepción cuando replaceRegexpOne se usa con GROUP BY ... WITH CUBE y group_by_use_nulls=1. #97546 (Alexey Milovidov).
  • Se corrige el bloqueo indefinido de DROP DATABASE con database_atomic_wait_for_drop_and_detach_synchronously cuando se fuerza la finalización de la consulta. #97586 (Alexey Milovidov).
  • Se corrigió un problema por el que KILL QUERY no podía finalizar consultas bloqueadas durante la generación de WITH FILL, la carga de diccionarios mediante dictGet o ALTER DELETE con mutations_sync=1 en ReplicatedMergeTree. #97589 (Alexey Milovidov).
  • La función de tabla loop llamaba a inner_storage->read() directamente, omitiendo la capa del intérprete, donde se aplican las políticas de fila, los privilegios a nivel de columna y otras comprobaciones de seguridad. Esto permitía que un usuario restringido por políticas de fila leyera todas las filas mediante loop(table), incluso cuando un SELECT directo devolvía cero filas. #97682 (pufit).
  • Corrige la poda incorrecta de particiones al usar DateTime64 anterior a la época Unix con la función toDate(). #97746 (Yarik Briukhovetskyi).
  • Después de este parche, hasPartitionId devolverá false si existe otra partición con un ID de partición superior en el conjunto de partes de datos. #97748 (Mikhail Artemenko).
  • Se corrigen posibles fallos al leer gránulos vacíos en datos compartidos avanzados en JSON. Cierra #97563. #97778 (Pavel Kruglov).
  • Se corrige Cannot schedule a file LOGICAL_ERROR al hacer INSERT en Distributed debido a una condición de carrera entre DROP e INSERT. #97822 (Azat Khuzhin).
  • Se corrigió un cierre inesperado/fallo de aserción del servidor de ClickHouse en la llamada a mapContainsKey/mapContainsKeyLike con el índice de omisión tokenbf_v1. #97826 (Shankar Iyer).
  • Se corrigieron las excepciones LOGICAL&#95;ERROR causadas por LowCardinality dentro de tipos compuestos (Variant, Dynamic, Tuple) en concatWithSeparator, format, las subconsultas IN, GLOBAL IN y los joins con filtros en tiempo de ejecución. #97831 (Raúl Marín).
  • Se corrige la excepción LOGICAL_ERROR Chunk info was not set for chunk in MergingAggregatedTransform al usar ARRAY JOIN con la función de tabla merge() en varias tablas Distributed combinadas con GROUP BY. #97838 (Raúl Marín).
  • Se corrige un cierre inesperado del servidor (std::terminate) causado por una excepción no capturada en el destructor del grupo de conexiones HTTP cuando se alcanza el límite estricto del grupo de conexiones en condiciones de alta concurrencia. La excepción HTTP_CONNECTION_LIMIT_REACHED podía propagarse desde ~PooledConnection al devolver una conexión al grupo para su reutilización, lo que provocaba SIGABRT. #97850 (Antonio Andelic).
  • Corrige un resultado incorrecto cuando se usa el algoritmo grace_hash con joins no equi y el bloque de la izquierda no puede procesarse por completo debido a las restricciones de tamaño del resultado del join. #97866 (János Benjamin Antal).
  • Corrige la ineficiencia de rendimiento en el escaneo de metadatos de DeltaLake introducida en #96686. #97880 (Kseniia Sumarokova).
  • Se corrigió una condición de carrera de datos en el client de ZooKeeper entre sendThread y receiveThread. #97887 (Pablo Marcos).
  • Corrige un error por el que no era posible usar CTE con sentencias insert SELECT distribuidas. Continuación de https://github.com/ClickHouse/ClickHouse/pull/87789. Cierra #95837. #97889 (Yarik Briukhovetskyi).
  • Corrige una excepción en CachedOnDiskReadBufferFromFile::readBigAt. Cierra #97325. #97890 (Kseniia Sumarokova).
  • Se corrige la excepción LOGICAL_ERROR en el motor Alias con columnas materializadas debido a un desajuste de columnas. Cierra #97907. #97921 (Kai Zhu).
  • Se corrige la pérdida de datos de Keeper tras un reinicio al usar Azure Blob Storage con metadatos s3_plain para el almacenamiento de registros. #97987 (Antonio Andelic).
  • Se corrige una compilación errónea del JIT de la función sign para tipos enteros de mayor tamaño que Int8 — los valores fuera del intervalo -128..127 podían producir un signo incorrecto. #98012 (Alexey Milovidov).
  • Se corrigió la excepción DUPLICATE_COLUMN y la aparición silenciosa de valores NULL al leer tablas de Delta Lake que usan el modo “name” de asignación de columnas con campos de struct cuyos nombres contienen puntos (p. ej., STRUCT<`a.foo`: STRING, `b.foo`: STRING>). #98013 (Caio Ishizaka Costa).
  • Se corrige la mutación tras una actualización ligera y los índices secundarios. #98044 (Raúl Marín).
  • Se corrige un resultado incorrecto en las consultas FINAL al mezclar índices de salto de clave primaria y de columnas que no forman parte de la clave primaria. #98097 (Raúl Marín).
  • Se aplican comprobaciones de READ ON FILE a file() escalar y a DESCRIBE TABLE file(). #98115 (Nikolay Degterinsky).
  • Corrige un fallo por el que, al consultar archivos con un patrón glob (p. ej., file('dir/**', 'LineAsString')), se producía una excepción no controlada del sistema de archivos (STD_EXCEPTION) si el directorio contenía un enlace simbólico roto. Ahora los enlaces simbólicos rotos se omiten silenciosamente, y la consulta devuelve resultados de todos los archivos válidos. #98143 (Mark Andreev).
  • Se corrigió un segfault durante la optimización del plan de consulta al convertir un outer join en un inner join con arrayJoin en una expresión de filtro. #98147 (Alexey Milovidov).
  • Se corrigió el problema por el que el formato ProtobufList no funcionaba con el motor Kafka porque el estado de lectura no se restablecía entre mensajes. #98151 (Alexey Milovidov).
  • Corrige un fallo lógico con analyzer_compatibility_join_using_top_level_identifier y ARRAY JOIN; cierra #98164. #98179 (Vladimir Cherkasov).
  • Configura el componente Watch para las respuestas de watch en aggregated_zookeeper_log en lugar de dejarlo vacío. #98202 (Antonio Andelic).
  • Si las columnas de la clave de partición no están incluidas en la clave de ordenación, la poda de particiones podría omitir por error particiones que contienen filas que deberían “prevalecer” durante la deduplicación FINAL. #98242 (Yarik Briukhovetskyi).
  • Se corrige el error lógico “Bad cast from type DB::ColumnConst to DB::ColumnArray” en kql_array_sort_asc/kql_array_sort_desc cuando se llama con argumentos constantes de tipo array. #98251 (Alexey Milovidov).
  • Se corrigió un acceso fuera de rango en ColumnConst::getExtremes que podía provocar un bloqueo cuando extremes = 1 está habilitado. #98263 (Alexey Milovidov).
  • Se corrige un posible interbloqueo cuando dos operaciones concurrentes de MOVE PARTITION actúan sobre el mismo par de tablas en direcciones opuestas. #98264 (Alexey Milovidov).
  • El servidor HTTP ahora devuelve un mensaje de error en el cuerpo de la respuesta en las respuestas 400 Bad Request causadas por cabeceras malformadas, en lugar de devolver un cuerpo vacío. #98268 (Alexey Milovidov).
  • Corrige resultados incorrectos en el análisis distribuido de índices (función experimental) y en la caché de condiciones de consulta. #98269 (Azat Khuzhin).
  • Se corrigió la excepción LOGICAL_ERROR “Resultado no válido de la búsqueda binaria en MergeTreeSetIndex”, provocada por la conversión toDate en columnas clave con datos que cruzan el umbral de 65535. #98276 (Alexey Milovidov).
  • Se corrige la excepción LOGICAL_ERROR cuando un RIGHT JOIN contenido dentro de un CROSS JOIN se intercambia mediante la optimización query_plan_join_swap_table en la ruta de código heredada del paso de JOIN. #98279 (Alexey Milovidov).
  • Validar los datos corruptos durante la deserialización de DDSketch para evitar segfaults, excepciones, bucles infinitos y OOM al leer estados corruptos de la función de agregación quantilesDD. #98284 (Alexey Milovidov).
  • Corrige LOGICAL_ERROR “Intentando ejecutar la acción PLACEHOLDER” al hacer referencia a columnas correlacionadas de consultas externas dentro de funciones lambda como arrayMap. #98285 (Alexey Milovidov).
  • Se corrige una excepción por error lógico en caseWithExpression cuando la expresión CASE incluye materialize(NULL) u otros argumentos Nullable(Nothing). #98290 (Alexey Milovidov).
  • Corregida una excepción por conversión de tipo incorrecta al filtrar la columna virtual _table en la table function merge. #98291 (Alexey Milovidov).
  • Se corrige un fallo esporádico de deduplicación por el que las reinserciones se deduplicaban incorrectamente debido a un orden de limpieza incoherente entre los directorios blocks/ y deduplication_hashes/ de ZooKeeper. #98293 (Alexey Milovidov).
  • Se corrigió una excepción al usar ORDER BY ... WITH FILL junto con LIMIT BY. #98361 (Alexey Milovidov).
  • Corrige la corrupción silenciosa de datos al insertar una columna Date de Parquet/Arrow en una columna Enum: ahora rechaza correctamente la conversión incompatible de tipos en lugar de almacenar valores Enum no válidos. #98364 (Alexey Milovidov).
  • Corrige una excepción al leer un archivo Arrow que contiene una columna Array en una tabla con una columna Nested. #98365 (Alexey Milovidov).
  • Se corrigen las mutaciones MATERIALIZE INDEX y MATERIALIZE PROJECTION que se quedaban bloqueadas cuando se eliminaba el índice o la proyección antes de que terminara la mutación. #98369 (Alexey Milovidov).
  • Se corrigió una excepción al leer desde Nullable(Tuple(...)) cuando el nombre de un elemento de Tuple entra en conflicto con la subcolumna null de Nullable. #98372 (Alexey Milovidov).
  • Se corrigió la excepción “Column … query tree node does not have valid source node” al hacer join entre una tabla Merge (que envuelve una tabla Distributed) y otra tabla. #98376 (Alexey Milovidov).
  • Corrige la conversión incorrecta de Parquet Bool a FixedString en el lector nativo V3, que producía bytes sin procesar en lugar de una representación de cadena. #98378 (Alexey Milovidov).
  • Corregido tryGetColumnDescription para filtrar las subcolumnas según el tipo de la columna padre, en consonancia con otros métodos de búsqueda de columnas. #98391 (Alexey Milovidov).
  • Aceptar credenciales base64 sin relleno en la autenticación HTTP Basic. Algunos clientes HTTP omiten el relleno final = en el encabezado Authorization: Basic, lo que antes provocaba fallos de autenticación. #98392 (Amos Bird).
  • Corrige resultados incorrectos de la poda de particiones tras fusionar partes con columnas Nullable de clave de partición, causados por límites incorrectos del índice min-max. #98405 (Amos Bird).
  • Se corrige una excepción poco frecuente en el ejecutor del pipeline, que podía manifestarse como Received signal 6 (solo en compilaciones de depuración) cuando la expansión del pipeline se solapa con la cancelación de la consulta debido a una condición de carrera. #98428 (Alexey Milovidov).
  • Se corrige la excepción “Column identifier is already registered” cuando se usa count_distinct_optimization con la cláusula QUALIFY. #98433 (Alexey Milovidov).
  • Se corrigió la excepción “cannot be inside Nullable type” al usar IN/NOT IN con argumentos de columna LowCardinality (p. ej., a NOT IN (b) donde a es LowCardinality(String)). #98443 (Alexey Milovidov).
  • Se corrigió la excepción “Pipeline stuck” en los JOIN full_sorting_merge, causada por un interbloqueo en PingPongProcessor cuando la optimización FilterBySetOnTheFly creó una dependencia circular con MergeJoinTransform. #98454 (Alexey Milovidov).
  • Se corrige la excepción LOGICAL_ERROR “Projection cannot increase the number of rows in a block” al fusionar partes con un TTL que elimina todas las filas y una proyección de agregación con una clave GROUP BY constante. #98458 (Alexey Milovidov).
  • Se corrige una excepción por error lógico cuando CROSS JOIN se usa junto con INNER JOIN USING. #98459 (Alexey Milovidov).
  • Se corrige una desreferenciación de puntero nulo en dictGetOrDefault cuando el argumento de la clave es Nullable. #98460 (Alexey Milovidov).
  • Corrige una excepción en consultas DISTINCT al usar proyecciones de agregación cuando materialize provoca diferencias de tipo LowCardinality entre la consulta y la proyección. #98462 (Alexey Milovidov).
  • Se corrige la excepción LOGICAL_ERROR cuando se usa arrayJoin en una expresión de filtro con OUTER JOIN y join_use_nulls activado. #98464 (Alexey Milovidov).
  • Se corrigió la excepción de error lógico “La réplica decidió leer en modo WithOrder, no en ReverseOrder” al usar réplicas paralelas con optimize_aggregation_in_order. #98467 (Alexey Milovidov).
  • Se corrigió un problema por el que ClickHouse Keeper desconectaba a los clientes Java de ZooKeeper después de la solicitud addWatch. El cliente Java espera un cuerpo ErrorResponse de 4 bytes en la respuesta de addWatch, pero Keeper estaba enviando un cuerpo vacío, lo que provocaba EOFException y la desconexión de la sesión. Esto rompía CuratorCache de Apache Curator y cualquier aplicación Java que usara watches persistentes. Corrige #98079. #98499 (Antonio Andelic).
  • Se corrige que las métricas de Keeper zk_followers y zk_synced_followers no disminuyeran cuando un follower deja de estar disponible. Se añaden las nuevas métricas zk_learners y zk_synced_non_voting_followers al comando de cuatro letras mntr. Corrige #54173. #98504 (Antonio Andelic).
  • Se corrigió una excepción LOGICAL_ERROR en renameAndCommitEmptyParts que podía producirse cuando TRUNCATE TABLE se ejecutaba de manera concurrente con OPTIMIZE TABLE usando transacciones de MergeTree. #98508 (Alexey Milovidov).
  • Se corrigió un problema por el que el puerto seguro de Raft de Keeper ignoraba cipherList y dhParamsFile de la configuración de openSSL, y siempre usaba los valores predeterminados en lugar de los especificados por el usuario. Cierra #51188. #98509 (Antonio Andelic).
  • Se corrigieron mensajes de log de Keeper engañosos, como “Recibir la solicitud de la sesión X tomó 9963 ms”, donde el tiempo informado en realidad se invertía en esperar inactivo en poll() entre latidos, y no en realizar la operación en sí. Corrige #79026. #98510 (Antonio Andelic).
  • Corrige un resultado inesperado con read_in_order_use_virtual_row y funciones monótonas; cierra #97837. #98514 (Vladimir Cherkasov).
  • Se corrige LOGICAL_ERROR: Not-ready Set is passed as the second argument for function 'in' al usar PREWHERE con una subconsulta IN en tablas MergeTree. #98522 (Alexey Milovidov).
  • Se corrigen las conexiones TCP de Keeper que, al no responder a la señal de apagado, impedían el cierre ordenado del servidor. #98525 (Alexey Milovidov).
  • Se corrige la excepción “No se encontró la columna de ordenación entre las salidas de ActionsDAG” cuando query_plan_convert_join_to_in está habilitado con query_plan_merge_expressions = 0. #98526 (Alexey Milovidov).
  • Se corrige un fallo en el origen de diccionario de MongoDB con named collections. Cierra #97840. #98528 (Pablo Marcos).
  • Se corrigió LOGICAL_ERROR cuando Identifier queda vacío tras la sustitución de parámetros. #98530 (Pervakov Grigorii).
  • Se corrige un bloqueo mutuo en el pipeline al usar sort_overflow_mode = 'break' junto con funciones de ventana. #98543 (Alexey Milovidov).
  • Se corrigió la reversión de columnas en el motor Buffer al gestionar una excepción al agregar un bloque nuevo. La lógica anterior podía provocar un estado de las columnas en memoria corrupto. #98551 (Pavel Kruglov).
  • Se corrigió la excepción Bad cast from type ColumnConst to ColumnDynamic en la comparación null-safe (<=> / IS NOT DISTINCT FROM) con columnas const Dynamic o Variant y NULL. También se corrigió que IS DISTINCT FROM con Dynamic/Variant frente a NULL devolvía siempre 0 de forma incorrecta. #98553 (Alexey Milovidov).
  • Se corrigió el uso del índice de texto con otros índices de omisión. Anteriormente, podían producirse errores lógicos como “Trying to get non-existing mark” cuando un filtro de consulta utilizaba simultáneamente un índice de texto y otros índices de omisión convencionales. #98555 (Anton Popov).
  • Se corrige el error lógico “TABLE_FUNCTION is not allowed in expression context” cuando una función de tabla con alias aparece varias veces en el mismo ámbito de la consulta (por ejemplo, en las cláusulas PREWHERE y QUALIFY). #98557 (Alexey Milovidov).
  • Corrige el análisis distribuido de índices con expresiones (no solo columnas) en la PK (lo que provoca que no se filtren gránulos redundantes en réplicas remotas). #98561 (Azat Khuzhin).
  • Impedir la eliminación de una columna cuando sus subcolumnas se utilicen en expresiones default/alias de otras columnas, y usar el analizador para las expresiones default en alter drop column. #98569 (Nikita Mikhaylov).
  • Se corrigió el reintento incorrecto de solicitudes de S3 ante errores no reintentables (incluido HTTP_CONNECTION_LIMIT_REACHED) en el client HTTP. #98598 (Sema Checherinda).
  • Se corrige un desbordamiento decimal al aplicar la poda de particiones con DateTime64. #98628 (Yarik Briukhovetskyi).
  • Corrige dos errores en la compilación JIT de expresiones: un error de copia y pega en la verificación de tipos de nativeCast que hacía inalcanzables las ramas de conversión de entero a entero y de float a float, y un TargetMachine nulo (nullptr) incorrecto pasado a LLVM PassBuilder, lo que impedía registrar las pasadas de optimización específicas del destino. #98660 (Alexey Milovidov).
  • Corrige una elusión de RBAC que permitía a los usuarios ejecutar DESCRIBE sobre cualquier tabla mediante remote(), remoteSecure(), cluster() o clusterAllReplicas() apuntando a localhost, sin requerir el privilegio SHOW_COLUMNS. #98669 (pufit).
  • Corrige la excepción BAD_GET y los resultados de consulta incorrectos cuando se usa una expresión no booleana (p. ej., sin(col)) tanto en WHERE como en SELECT con un JOIN, debido a que la optimización de push-down de filtros corrompe nodos DAG compartidos. #98681 (Alexey Milovidov).
  • Corrige LOGICAL_ERROR “La réplica decidió leer en modo Default, no en WithOrder” al usar read_in_order_through_join con réplicas paralelas. #98685 (Alexey Milovidov).
  • Corrige la excepción “Bad cast from type DB::TableFunctionNode to DB::QueryNode” al usar la función de tabla input como argumento de remote. #98694 (Alexey Milovidov).
  • Corrige la resurrección de partes de datos obsoletas causada por la limpieza incorrecta de partes vacías que las cubren. #98698 (Shaohua Wang).
  • Corrige una excepción en LogicalExpressionOptimizerPass cuando una función booleana en una comparación equals devuelve un tipo Variant. #98712 (Alexey Milovidov).
  • Se corrige que parseDateTimeBestEffort analizara incorrectamente palabras que comienzan con prefijos de nombres de meses o días de la semana. Cierra #97965. #98742 (Pavel Kruglov).
  • Corrige la excepción UNKNOWN_IDENTIFIER al consultar la table function merge() o el engine Merge en tablas con columnas JSON que tienen parámetros distintos (p. ej., diferentes campos SKIP) y columnas ALIAS que hacen referencia a subrutas de JSON, cuando está habilitado el nuevo analizador. Cierra #97812. #98753 (Pavel Kruglov).
  • Se corrige la optimización optimize_skip_unused_shards del analizador cuando se usa el motor Distributed en una View. #98754 (Nikolai Kochetov).
  • Corrige el acceso por nombre a las subcolumnas de tuplas (p. ej., SELECT x.a para Tuple(a UUID, b Int32)) en las tablas externas pasadas mediante --external en clickhouse-client. Cierra #96925. #98755 (Pavel Kruglov).
  • Se corrigió la excepción de reverseUTF8 con entradas UTF-8 no válidas (truncadas). #98770 (Alexey Milovidov).
  • Corregida la detección de la utilidad del índice de omisión Set con un predicado OR con false (es decir, or(x, 0)). #98776 (Azat Khuzhin).
  • Corrige una excepción LOGICAL_ERROR (desajuste en la estructura de bloques en removeUnusedColumns) que podía producirse con FINAL + PREWHERE + una expresión WHERE constante + agregaciones independientes de las columnas, como count(). #98778 (Alexey Milovidov).
  • Las entradas de system.trace_log para las recargas automáticas de diccionarios de ClickHouse ahora tienen identificadores de consulta no vacíos. #98784 (Miсhael Stetsyuk).
  • Corrige un fallo en el que podíamos desreferenciar un puntero nulo en tablas del sistema creadas entre el momento en que tomábamos una instantánea de las tablas en la llamada a IDatabaseTablesIterator::table() y el momento en que esas tablas cambiaban en otro hilo durante una iteración posterior. #98792 (Grant Holly).
  • Se corrige un problema por el que SYSTEM START REPLICATED VIEW no activaba la tarea de actualización. #98797 (Pablo Marcos).
  • Corrige la excepción “Inconsistent table names” al usar la función de tabla view() con JOINs dentro de otro JOIN (solo con el analizador antiguo). #98809 (Alexey Milovidov).
  • Se corrige el ajuste de RLIMIT_SIGPENDING (mediante pending_signals). #98829 (Azat Khuzhin).
  • Se corrige una excepción al combinar loop con funciones de tabla de clúster. #98860 (Konstantin Bogdanov).
  • LEFT ANTI JOIN con múltiples columnas de clave de JOIN devolvía resultados incorrectos cuando enable_join_runtime_filters=1 (que es el valor predeterminado). #98871 (Alexander Gololobov).
  • Se corrige WITH FILL STALENESS, que producía filas adicionales rellenadas al leer los datos en varios fragmentos (p. ej., con index_granularity pequeño). #98895 (Alexey Milovidov).
  • Se corrige el error lógico “RPNBuilderFunctionTreeNode has A arguments, attempted to get argument at index B” LOGICAL_ERROR. #98900 (Azat Khuzhin).
  • Corrige el desajuste en el seguimiento de memoria causado por asignaciones fallidas que no se revertían, el comportamiento indefinido de nallocx(0) y un error de una unidad en el seguimiento del pico global. Amplía el seguimiento para abarcar los búferes circulares de io_uring. #98915 (Antonio Andelic).
  • Prohibir adjuntar tablas locales de lago de datos fuera de las rutas del usuario, no solo crearlas. #98936 (Daniil Ivanik).
  • Se corrige una condición de carrera que podía causar la excepción “ReadBuffer is canceled” en consultas que usan urlCluster o funciones de tabla de clúster similares. #98955 (Alexey Milovidov).
  • Se corrige la excepción LOGICAL_ERROR en las funciones financieras (financialNetPresentValue, financialInternalRateOfReturn, etc.) al pasar argumentos de tipo BFloat16. #98958 (Alexey Milovidov).
  • Se corrigen los skip indexes (y las condiciones de la clave primaria) que no se aplicaban a las columnas ALIAS cuando la fusión de expresiones del plan de consulta está deshabilitada (query_plan_merge_expressions = 0 o query_plan_enable_optimizations = 0). #98960 (Peng).
  • Incrementa el evento de perfil InsertQuery para inserciones asíncronas. Cierra #98626. #98962 (Narasimha Pakeer).
  • Corrige la excepción “Comportamiento inconsistente de KeyCondition” en compilaciones de depuración cuando la clave primaria contiene valores NaN de coma flotante, haciendo que accurateLess y accurateEquals manejen NaN de forma coherente con el orden de ordenación de ClickHouse. Cierra #98075. #98964 (Alexey Milovidov).
  • SummingMergeTree ya no suma las columnas de tipo Bool (ni las de otros tipos de dominio). Los valores Bool se conservan tal cual, en lugar de sumarse aritméticamente. #98976 (Yash ).
  • Corrige la excepción Scalar doesn’t exist que se producía al ejecutar una consulta en un segmento remoto con optimize_const_name_size activado y enable_scalar_subquery_optimization = 0. Las constantes grandes sustituidas por referencias __getScalar en la consulta remota no se enviaban al segmento, lo que hacía que la consulta fallara. #98979 (andriibeee).
  • Corrige NOT_FOUND_COLUMN_IN_BLOCK en algunas consultas con GROUP BY y expresiones que incluyen búsquedas inversas en diccionarios, comparaciones de conversión Date/DateTime y comparaciones de tuplas. Cierra #98888. #98980 (Nihal Z. Miaji).
  • Se corrigió un comportamiento indefinido (desreferenciación de un puntero nulo) al cambiar una columna version/sign/is_deleted a EPHEMERAL o ALIAS en motores MergeTree. Ahora, esos cambios se rechazan correctamente. #98985 (Alexey Milovidov).
  • Se corrigió un problema por el que system.grants omitía, en la columna access_object, los parámetros de expresiones regulares de los privilegios URL y S3. #98987 (DQ).
  • Se corrigieron las lecturas de Iceberg BigLake: las credenciales de ADC ahora se reenvían al client S3 de GCS (lo que corrige errores 403), las credenciales de OAuth2 ahora se codifican para URL antes de enviarse (lo que corrige fallos de autenticación en tokens con caracteres especiales) y el recorrido del espacio de nombres ya no se aborta ante respuestas HTTP 400 de BigLake. #98998 (Nikita Fomichev).
  • Se corrigió un problema por el que clickhouse-client no podía cambiar la zona horaria cuando la variable de entorno TZ usa la sintaxis de ruta de archivo de POSIX (por ejemplo, TZ=:/etc/localtime). #99000 (Yash ).
  • Corrige la poda incorrecta o insuficiente cuando se usan startsWith, LIKE y NOT LIKE con una columna FixedString. Además, la función de conversión de tipo de FixedString a String ahora puede podar gránulos cuando se aplica sobre la columna clave. Cierra #98940. #99001 (Nihal Z. Miaji).
  • Se corrigió windowFunnel con strict_deduplication, que devolvía un Level incorrecto al encontrar un evento duplicado. #99003 (Yash ).
  • Corrige un error por el que EXISTS ignoraba las cláusulas LIMIT y OFFSET en las subconsultas, lo que provocaba resultados incorrectos cuando la subconsulta no devolvía ninguna fila debido a un OFFSET o a un límite de cero. Cierra #88722. #99005 (andriibeee).
  • Se corrige la excepción “Block structure mismatch” cuando la optimización de push-down de filtros encuentra una expresión AND que se cortocircuita a una constante con GROUPING SETS. #99010 (Alexey Milovidov).
  • Se corrige una excepción al leer partes de parche (actualizaciones ligeras) cuando el plan de consulta no incluye la columna _part_offset. #99023 (Alexey Milovidov).
  • Una consulta como SELECT * FROM table WHERE pk_id = '', donde pk_id es la clave primaria y es de tipo String, ahora usará correctamente el índice de clave primaria para filtrar gránulos. #99027 (Shankar Iyer).
  • Se corrigió la excepción DEPENDENCIES_NOT_FOUND en el motor Kafka cuando la vista materializada se desacopla mientras el hilo en segundo plano está transmitiendo datos. #99028 (Alexey Milovidov).
  • Corregida una excepción al crear una tabla con una columna EPHEMERAL con el mismo nombre que una columna virtual (p. ej., _part_offset). #99031 (Alexey Milovidov).
  • Corrige el confuso “inflate failed: error de búfer” al leer archivos comprimidos inexistentes mediante la función de tabla url() con patrones glob. Ahora devuelve un resultado vacío, como se esperaba, cuando http_skip_not_found_url_for_globs está habilitado. #99034 (Alexey Milovidov).
  • Se corrige un fallo del servidor (std::terminate) al ejecutar ALTER TABLE ... DROP PART en una patch part tras un cambio de esquema (p. ej., ADD COLUMN). El fallo se producía por la ausencia de columnas del sistema (_part) en los metadatos de la parte de cobertura vacía, lo que provocaba una excepción no capturada dentro de un NOEXCEPT&#95;SCOPE. #99036 (Peng).
  • El proceso del servidor ClickHouse podía bloquearse si se producía una excepción por excederse el límite de memoria durante una lectura de disco en caché. Esto ya se ha corregido. #99042 (Shankar Iyer).
  • Corrige LOGICAL_ERROR al consultar una tabla que tiene tanto una ROW POLICY como una columna ALIAS al usar dictGet. El problema se debía a un acceso prematuro a la expresión de la tabla durante la resolución de la columna ALIAS en el nuevo analizador. #99065 (Peng).
  • Corrige un error por acceso fuera de rango cuando el usuario intenta consultar solo columnas virtuales de una tabla Iceberg con los datos en formato Avro. Es un caso extremadamente raro, así que no se marca como crítico. Corrige #88238. #99080 (alesapin).
  • Se corrigió un fallo de segmentación en una CTE recursiva con remote() + view(). #99081 (Konstantin Bogdanov).
  • Se omite el análisis adicional de índices innecesario cuando se aplica la optimización de lectura en orden. #99084 (Vladimir Cherkasov).
  • Se corrigió un fallo causado por una excepción por límite de memoria lanzada durante la aplicación de un patch part. #99086 (Anton Popov).
  • Se corrigió una aserción de depuración en DDLWorker provocada por un first_failed_task_name obsoleto después de que se eliminara una entrada de ZooKeeper durante la recuperación tras la reinicialización. #99099 (Antonio Andelic).
  • Se corrigió la reconstrucción de los índices de texto en las fusiones con TTL. #99107 (Anton Popov).
  • Corrige un fallo en la consulta ALTER TABLE ... REMOVE SETTINGS para el motor de tabla Iceberg. Corrige #86330. #99108 (alesapin).
  • Corrige un error en la optimización query_plan_convert_any_join_to_semi_or_anti_join, que devolvía un resultado incorrecto para las filas sin coincidencia. Relacionado: https://github.com/ClickHouse/ClickHouse/pull/95995. #99112 (Yarik Briukhovetskyi).
  • Se corrige la excepción LOGICAL_ERROR en ASTColumnsExceptTransformer::transform. #99119 (Pablo Marcos).
  • Corrige una evasión de RBAC que permitía a los usuarios obtener la estructura de la tabla mediante DESCRIBE TABLE o CREATE TABLE AS en funciones de tabla (mysql(), postgresql(), sqlite(), arrowFlight(), jdbc(), odbc(), etc.) sin los privilegios de acceso al origen necesarios. En funciones que infieren el esquema desde servidores remotos, esto también permitía desencadenar conexiones salientes (SSRF) sin autorización. #99122 (pufit).
  • Se corrigió el fallo de Keeper (segfault en NuRaft) durante la reconfiguración dinámica y la transferencia de liderazgo. #99133 (JIaQi Tang).
  • Corrige un fallo al usar una tabla Buffer con SAMPLE cuando el destino no lo admite. #99141 (Kseniia Sumarokova).
  • Se corrige el LOGICAL_ERROR causado por una discrepancia en el orden de las columnas de las partes de parche. #99164 (Pablo Marcos).
  • Se corrige un cierre inesperado muy poco frecuente cuando una tabla Iceberg contiene archivos en formatos mixtos (ORC y Parquet). Corrige #88126. #99168 (alesapin).
  • Se corrigió un problema por el que max_execution_time no se aplicaba a las operaciones de copia de seguridad/restauración. #99205 (Kseniia Sumarokova).
  • Se corrigió un problema por el que insert_deduplication_token se ignoraba silenciosamente en las consultas INSERT SELECT sin ORDER BY ALL. Anteriormente, la deduplicación estaba completamente deshabilitada para los INSERT SELECT sin ordenar, incluso cuando se proporcionaba un token de usuario explícito. Ahora, proporcionar insert_deduplication_token basta para habilitar la deduplicación independientemente de ORDER BY ALL. #99206 (Desel72).
  • Se corrigen las comprobaciones de acceso excesivas durante la optimización InverseDictionaryLookupPass al comprobar el privilegio CREATE_TEMPORARY_TABLE una sola vez antes de la pasada, en lugar de hacerlo en cada nodo visitado. #99210 (Mikhail Artemenko).
  • Corrige un problema por el que clickhouse format --obfuscate producía SQL no válido al ofuscar tipos de skip index, nombres de códecs de compresión, nombres de motores de base de datos y definiciones de layout/source de diccionarios. #99260 (Raúl Marín).
  • Se corrigió un error por el que, en algunos casos, la comparación entre los tipos Time[64] y DateTime[64] resultaba confusa; ahora, en casos como este, los valores de Time[64] se convierten en DateTime[64] al añadir 1970-01-01 como parte de la fecha. #99267 (Yarik Briukhovetskyi).
  • Limitar las restricciones de configuración en el worker de DDL para las consultas DDL distribuidas. #99317 (Pablo Marcos).
  • Corrige pequeños problemas en la autenticación TOTP: la opción de CLI --one-time-password con contraseña vacía y la validación de los valores de configuración <digits> y <period>. #99322 (Vladimir Cherkasov).
  • Se corrige el error lógico unordered_map::at: key not found en el formato de salida Avro al serializar columnas Enum8/Enum16 con valores no presentes en la definición del enum. #99332 (Desel72).
  • Se corrige CHECK TABLE con serialización dispersa en Tuple con Dynamic. Cierra #96588. #99351 (Pavel Kruglov).
  • Se corrigió una validación excesivamente estricta del preprocesador del índice de texto. #99359 (Anton Popov).
  • Se corrige un problema de compatibilidad al actualizar tablas replicadas con índices minmax implícitos de la versión 25.10 a versiones más recientes. #99392 (Raúl Marín).
  • Se eliminó la compatibilidad con las funciones negadas (notEquals, notLike, notIn) en el análisis del índice de texto. Estas funciones nunca podían descartar ningún gránulo, por lo que su análisis en el índice solo añadía sobrecarga sin aportar ningún beneficio. #99393 (Anton Popov).
  • Corrige optimize_skip_unused_shards con el nuevo analizador para el caso en que se usaba una tabla Distributed dentro de una subconsulta con IN. #99436 (Nikolai Kochetov).
  • Se corrige un error de tipo heap-use-after-free en INTERSECT/EXCEPT cuando la consulta produce nombres de columna duplicados. #99471 (Alexey Milovidov).
  • Se corrige un error lógico en ALTER TABLE ... DROP PART cuando se utiliza un parámetro de consulta tipado para el nombre de la parte. #99489 (Alexey Milovidov).
  • Se corrigió la excepción NOT_FOUND_COLUMN_IN_BLOCK cuando se hacía referencia a un predicado de índice de texto (p. ej., hasAllTokens) tanto en las cláusulas SELECT como en WHERE mediante un alias. #99504 (Anton Popov).
  • Corrige los resultados incorrectos al usar hasAllTokens con OR entre columnas que tienen índices de texto separados. #99505 (Anton Popov).
  • Inicializar la caché de páginas en clickhouse-local para que la opción page_cache_max_size surta efecto. #99510 (Alexey Milovidov).
  • Se corrigió un caso poco frecuente en el que una parte de datos se marcaba incorrectamente como dañada y se desasociaba después de la consulta DETACH/ATTACH TABLE. #99529 (Anton Popov).
  • Soluciona la excepción std::length_error al consultar tablas del sistema vacías con el formato Pretty a través de la interfaz HTTP. #99541 (Alexey Milovidov).
  • Se corrigió LOGICAL_ERROR al usar ALTER TABLE ADD COLUMN para crear una columna EPHEMERAL con el mismo nombre que una columna virtual (p. ej., _part_offset). #99549 (Alexey Milovidov).
  • Se corrigió un problema por el que las entradas de VectorSimilarityIndexCache nunca se expulsaban tras eliminar una parte, debido a claves de caché inconsistentes. #99575 (Seva Potapov).
  • Se prohíbe la lectura de credenciales de Google desde un archivo local. Esta configuración es insegura porque permite leer otras credenciales si se conoce la ruta del archivo. #99584 (Konstantin Vedernikov).
  • Se corrige la degradación del rendimiento en el analizador. Se eliminan de ARRAY JOIN las columnas no utilizadas. #99587 (Dmitry Novik).
  • Se corrigió la lectura del índice de texto en tablas con eliminaciones ligeras y políticas de fila ya existentes. #99661 (Anton Popov).
  • Se corrige una desreferenciación de nullptr en el lector de Parquet cuando la ruta filter-in-decoder encuentra páginas descartadas por el filtro. Cierra #99676. #99677 (Alexey Milovidov).
  • Corrige una operación de seek incorrecta en AsynchronousReadBufferFromFileDescriptor con O_DIRECT. Cierra #99358. #99678 (Pavel Kruglov).
  • Se corrigió un heap-buffer-overflow en CompressionCodecT64 y un aborto del proceso en CompressionCodecMultiple al descomprimir datos comprimidos malformados. Ambos problemas fueron detectados por nuevos targets de libFuzzer. Los códecs ahora lanzan una excepción en lugar de bloquearse. #99680 (Rahul).
  • Retrasar el procesamiento hasta que el servidor termine de cargar todas las tablas. #99700 (Seva Potapov).
  • Se corrigió que la fuente de diccionario MySQL omitiera RemoteHostFilter con params de DDL en línea. #99720 (Shaohua Wang).
  • Se corrige un error lógico al iterar sobre tablas de lago de datos en system.tables. #99739 (Konstantin Vedernikov).
  • Se corrigió el análisis de predicados con la función IN en el índice de texto con preprocesador. Se corrigió la colisión entre los tokens buscados en el índice de texto, que podía dar lugar a resultados incorrectos. #99755 (Anton Popov).
  • Se corrige un bucle infinito al leer archivos en formato Npy con dimensiones negativas en la forma. #99812 (Desel72).
  • Corrige un desbordamiento global de búfer en la función CRC32 con argumentos FixedString al evaluarse con cero filas durante el cálculo de la cabecera del plan de consulta. #99835 (Alexey Milovidov).
  • Se corrige un bloqueo (desreferenciación de puntero nulo) al ejecutar ALTER TABLE ... MODIFY COLUMN ... COMMENT en tablas Iceberg. #99838 (Desel72).
  • Se corrigió la configuración aggregate_functions_null_for_empty para que funcione con funciones de agregación que devuelven tipos no Nullable, como Array o Map (por ejemplo, groupArray, sumMap). #99839 (Alexey Milovidov).
  • Se corrigió la excepción LOGICAL_ERROR en la función midpoint al llamarla con tipos enteros mixtos con y sin signo. #99867 (Alexey Milovidov).
  • Se corrige la excepción “Block structure mismatch” en consultas con cláusula HAVING en las que la expresión de filtro contiene tanto una agregación envuelta en una función que devuelve NULL como materialize(0). #99915 (Alexey Milovidov).
  • Se corrige un error de aserción en sipHash128Keyed (y funciones hash con clave similares) cuando el argumento de datos es un Map con claves de Array u otros tipos de Array anidados. #99921 (Alexey Milovidov).
  • Se corrigió la excepción LOGICAL_ERROR “Not-ready Set” en la función IN durante la optimización del plan de consulta mediante convertAnyJoinToSemiOrAntiJoin. #99939 (Alexey Milovidov).

mejora en compilación/pruebas/empaquetado

  • Reducir el tiempo de compilación eliminando inclusiones pesadas de cabeceras y moviendo las instanciaciones costosas de plantillas fuera de las cabeceras. #97893 (Raúl Marín).
  • Reducir el tiempo de compilación de las funciones aritméticas y de las cabeceras relacionadas reduciendo las matrices de despacho de plantillas y eliminando inclusiones pesadas. #98204 (Raúl Marín).
  • Usar mongo-c-driver 2.2.2. #98304 (Konstantin Bogdanov).
  • Usar postgres REL_18_3. #98306 (Konstantin Bogdanov).
  • Habilitar el jemalloc allocator para las builds de UBSan para evitar la acumulación de RSS causada por el deficiente comportamiento de recuperación de memoria de malloc de glibc. #98444 (Alexey Milovidov).
  • Usar el name mangling v0 de Rust y eliminar los símbolos internos de la biblioteca PRQL para reducir la proliferación de nombres de símbolos procedente de las bibliotecas parser combinator. #98446 (Alexey Milovidov).
  • Añadir la suite de benchmark TPC-H y el README de TPC-DS a tests/benchmarks. #98495 (Raufs Dunamalijevs).
  • Añadir pruebas de corrección para las 99 consultas de TPC-DS. #99204 (Raufs Dunamalijevs).
  • Añadir una prueba de integración que reproduce el error de DDL CREATE TABLE + ALTER con una réplica fuera de línea (#44070), marcada como fallo esperado. #99259 (Raufs Dunamalijevs).
  • Integrar jemalloc con el prefijo je_ y eliminar el uso de --wrap del enlazador. #99342 (Azat Khuzhin).

Lanzamiento de ClickHouse 26.2, 2026-02-26. Presentación, Vídeo

Cambio incompatible con versiones anteriores

  • La deduplicación está activada de forma predeterminada para todas las inserciones. Antes estaba desactivada para las inserciones asíncronas y para las MV, pero activada para las inserciones síncronas. El objetivo es tener los mismos valores predeterminados en ambas formas de inserción. Si tiene la deduplicación desactivada explícitamente en su clúster, debe establecer explícitamente deduplicate_insert='backward_compatible_choice' para mantener el comportamiento anterior. Lo mismo sucede con deduplicate_blocks_in_dependent_materialized_views. #95970 (Sema Checherinda).
  • Se ha mejorado el formato de almacenamiento de las estadísticas. Ahora, todas las estadísticas se almacenan en un único archivo. #93414 (Anton Popov). Si no habilitaste explícitamente las estadísticas de tablas, puedes ignorar este punto.
  • Se limitan los metadatos en memoria de S3(Azure)Queue. Las tablas del sistema cambian de nombre de azure_queue a azure_queue_metadata_cache y de system.s3queue a s3queue_metadata_cache. #95809 (Kseniia Sumarokova).
  • Anteriormente, al aplicar una función a una columna Variant, se devolvía NULL de forma silenciosa cuando un subtipo de Variant era incompatible con la función; ahora se lanza una excepción, lo que puede romper consultas que dependían de ese comportamiento silencioso de NULL. #95811 (Bharat Nallan).
  • Las columnas DATE de PostgreSQL ahora se infieren como Date32 en ClickHouse (en versiones anteriores se inferían como Date, lo que provocaba un desbordamiento de los valores fuera de un rango estrecho). Se permite insertar valores Date32 de nuevo en PostgreSQL. Cierra #73084. #95999 (Alexey Milovidov).
  • La semántica de la configuración do_not_merge_across_partitions_select_final se aclaró. Anteriormente, la funcionalidad podía habilitarse automáticamente cuando la configuración no se establecía explícitamente en la configuración. Esto provocó confusión en repetidas ocasiones y, lamentablemente, dio lugar a algunos problemas en producción. Ahora, las reglas son más simples: do_not_merge_across_partitions_select_final=1 habilita la funcionalidad de forma incondicional. Si do_not_merge_across_partitions_select_final=0, el modo automático se usa solo si la nueva configuración enable_automatic_decision_for_merging_across_partitions_for_final=1; de lo contrario, no se usa. Para preservar en la medida de lo posible el comportamiento anterior, los valores predeterminados se establecieron en do_not_merge_across_partitions_select_final=0 y enable_automatic_decision_for_merging_across_partitions_for_final=1. #96110 (Nikita Taranov).
  • Al crear una tabla de S3 con columnas especificadas explícitamente, ClickHouse ahora valida que esos nombres de columna realmente existan en el esquema del archivo remoto. Las consultas que antes funcionaban con nombres de columna que no coincidían ahora fallarán en el momento de crear la tabla. Esto cierra #96089. #96194 (Konstantin Vedernikov).
  • Se prohíbe el uso de subconsultas en ORDER BY y en otras expresiones de clave de tabla. #96847 (Alexey Milovidov).
  • Se habilita apply_row_policy_after_final de forma predeterminada. Inicialmente, cuando optimize_move_to_prewhere_if_final=0, tanto ROW POLICY como PREWHERE respetaban FINAL y se aplicaban después de FINAL. Esto se vio afectado por #87303, que ignoraba optimize_move_to_prewhere_if_final para el filtro de ROW POLICY. Para corregirlo, este PR habilita la configuración apply_row_policy_after_final, introducida en #91065. Con apply_row_policy_after_final habilitado, ROW POLICY seguirá respetando FINAL de forma predeterminada, como antes. Este PR es un cambio incompatible porque modifica el comportamiento de optimize_move_to_prewhere_if_final=1. Ahora, para que ROW POLICY se aplique antes de FINAL, debe usarse apply_row_policy_after_final en lugar de optimize_move_to_prewhere_if_final. #97279 (Nikolai Kochetov).
  • El tipo Date ahora se serializa como el tipo date32 nativo de Arrow en los formatos Arrow/ArrowStream, en lugar de uint16. Herramientas como PyArrow ahora reconocerán correctamente la columna como un tipo de fecha. El comportamiento anterior puede restaurarse con la configuración output_format_arrow_date_as_uint16. Se sigue admitiendo la lectura de archivos Arrow antiguos que usaban uint16 para columnas Date. #96860 (Alexey Milovidov).

Nueva funcionalidad

  • Ahora los usuarios pueden usar ClickStack (una UI de observabilidad) directamente desde ClickHouse, lo que resulta útil para la depuración y el desarrollo local. #96597 (Aaron Knudtson).
  • Se admite la autenticación mediante contraseña de un solo uso basada en el tiempo (TOTP). #71273 (Vladimir Cherkasov).
  • Añade la configuración de la base de datos lazy_load_tables. Cuando está habilitada, las tablas no se cargan durante el arranque de la base de datos; en su lugar, se crea un StorageTableProxy ligero y el table engine real se materializa al acceder por primera vez. #96283 (xiaohuanlin).
  • Se añadió la configuración input_format_max_block_wait_ms para emitir bloques de datos al agotarse el tiempo de espera y se permitió procesar los datos restantes cuando una conexión HTTP se cierra de forma inesperada. #94509 (Mostafa Mohamed Salah).
  • Integración del catálogo de Google BigLake. Esto cierra #95339. #97104 (Konstantin Vedernikov).
  • Se añadió la tabla del sistema system.tokenizers, que muestra todos los tokenizadores disponibles. #96753 (Robert Schulze).
  • Añadir una nueva tabla del sistema system.user_defined_functions para supervisar el estado de carga y la configuración de las UDF. #90340 (Xu Jia).
  • Se añade la tabla system.jemalloc_stats, que expone estadísticas del allocator de memoria jemalloc (mediante malloc_stats_print) para diagnosticar el uso de memoria en servidores compilados con jemalloc. También se añade un endpoint HTTP /jemalloc.html en la interfaz HTTP de ClickHouse para visualizar interactivamente estas estadísticas. #97077 (Antonio Andelic).
  • Se añadió la tabla system.jemalloc_profile_text para leer y analizar perfiles del heap de jemalloc. El formato de salida se controla con la configuración jemalloc_profile_text_output_format (raw, simbolizado o collapsed; el valor predeterminado es collapsed). La resolución de frames inline se controla con jemalloc_profile_text_symbolize_with_inline (cuando está activado, los frames inline se incluyen a costa de una simbolización más lenta; cuando está desactivado, se omiten para obtener una salida más rápida). Para el formato collapsed, jemalloc_profile_text_collapsed_use_count controla si las pilas se ponderan por el número de asignaciones activas (true) o por bytes activos (false, valor predeterminado). Esto facilita el perfilado de memoria y la visualización de flame graphs a partir de perfiles del heap de jemalloc. Corrige #93248. #97218 (Antonio Andelic).
  • Añade la configuración default_dictionary_database, que permite a ClickHouse resolver los diccionarios externos a los que se hace referencia sin un calificador de base de datos dentro de una base de datos predeterminada especificada. Esto simplifica la migración de diccionarios globales definidos en XML a diccionarios definidos en SQL por base de datos, lo que permite que las consultas de diccionario existentes (p. ej., dictGet(‘name’, …)) sigan funcionando sin cambios. #91412 (Dmitrii Plotnikov).
  • Soporte para ZooKeeper auxiliar en DatabaseReplicated. #91683 (RinChanNOW).
  • Implementa la nueva función de tabla primes y la nueva tabla del sistema system.primes, que contiene números primos en orden ascendente. Cierra #90839. #92776 (Nihal Z. Miaji).
  • Los async inserts admiten quorum en paralelo. Los datos insertados se replican en el quorum. Si se detectan duplicados, la consulta espera hasta que los datos insertados previamente también se repliquen. #93356 (Sema Checherinda).
  • Se añadieron las funciones colorOKLABToSRGB, colorSRGBToOKLAB para convertir valores de sRGB a OKLAB y viceversa. #93361 (Pranav Tiwari).
  • Un nuevo ajuste deduplicate_insert que anula insert_deduplicate y async_insert_deduplicate. #94413 (Sema Checherinda).
  • La configuración del servidor insert_deduplication_version permite realizar la migración a un hash de deduplicación unificado. #95409 (Sema Checherinda).
  • Se añade la función hash xxh3_128. #96055 (Raúl Marín).
  • Se añadió la consulta OPTIMIZE <table> DRY RUN PARTS <part names> para simular merges sin hacer commit de la parte resultante. Puede ser útil para pruebas: verificar la corrección del merge en la nueva versión, reproducir de forma determinista errores relacionados con merges y hacer benchmark del rendimiento de los merges de forma fiable. #96122 (Anton Popov).
  • Añade una nueva comprobación habilitada de forma predeterminada mediante la configuración check_named_collection_dependencies para evitar eliminar colecciones nombradas utilizadas por tablas. #96181 (Pablo Marcos).
  • Se agregó system.fail_points para inspeccionar los failpoints existentes en el servidor y verificar si están habilitados o no. Esto ayudará a automatizar las pruebas. #96762 (Pedro Ferreira).
  • Añade acceso basado en roles al catálogo de Glue. Usa la configuración aws_role_arn y, opcionalmente, aws_role_session_name. #90825 (Antonio Andelic).
  • Se añadió una configuración, add_minmax_index_for_temporal_columns, que, al habilitarse, crea automáticamente índices minmax para todas las columnas Date, Date32, Time, Time64, DateTime y DateTime64. #93355 (Michael Jarrett).
  • Soporte para alias de tabla extendidos en JOINs (consultas como SELECT * FROM (SELECT 1) AS t(a) JOIN (SELECT 1) AS u(b) ON a = b). Cierra #95131. #95331 (Yarik Briukhovetskyi).
  • Se añadió compatibilidad con ALTER TABLE RENAME COLUMN para tablas Iceberg. Antes, solo se admitían ADD COLUMN, DROP COLUMN, and MODIFY COLUMN. #97455 (murphy-4o).

Funcionalidad experimental

  • El índice de texto ahora es GA. #96794 (Robert Schulze).
  • El tipo de dato QBit, para el almacenamiento vectorial cuantizado y empaquetado en bits (usado para la búsqueda aproximada de vecinos más cercanos), ahora está disponible de forma general y ya no requiere habilitar una configuración experimental. #95358 (Raufs Dunamalijevs).
  • La búsqueda vectorial en ClickHouse ahora puede usar réplicas en el clúster para distribuir la carga y la búsqueda entre las partes del índice vectorial. Esto permite que ClickHouse admita índices vectoriales grandes que superan la capacidad de memoria de una sola VM. #95876 (Shankar Iyer).
  • Se añade un AST fuzzer del servidor controlado por las configuraciones ast_fuzzer_runs y ast_fuzzer_any_query. Cuando está habilitado, el servidor ejecuta mutaciones aleatorias de cada consulta después de su ejecución normal y descarta los resultados. #97568 (Alexey Milovidov).
  • Se añade la función iif al dialecto KQL experimental. #94790 (happyso).
  • La inferencia de esquema ahora tiene en cuenta allow_experimental_nullable_tuple_type. Cuando está habilitado, permite que los tipos de tupla inferidos sean Nullable(Tuple(...)), de modo que los objetos anidados que falten puedan convertirse en NULL en lugar de en una tupla de elementos NULL. #95525 (Nihal Z. Miaji).
  • La configuración use_statistics_cache ahora está habilitada de forma predeterminada, por lo que las estadísticas de columnas se almacenan en caché en memoria para acelerar la optimización de consultas sin necesidad de volver a cargarlas desde cada parte. #95950 (Han Fei).

Mejora del rendimiento

  • Permite usar cualquier expresión determinista de la clave primaria para la omisión de datos (por ejemplo, ORDER BY cityHash64(user_id)/ ORDER BY length(user_id)). En el caso de las expresiones deterministas, ClickHouse puede aplicar la expresión a las constantes de la consulta y usar el resultado en el índice de la clave primaria para predicados como =, IN y has. Si la expresión también es inyectiva (por ejemplo, ORDER BY hex(p) o ORDER BY reverse(tuple(reverse(p), hex(p)))), podemos usar eficazmente el índice para las formas negadas: !=, NOT IN y NOT has. Cierra #10685. Cierra #82161. #92952 (Nihal Z. Miaji).
  • Se ha mejorado el formato de almacenamiento de las estadísticas. Ahora, todas las estadísticas se almacenan en un único archivo. #93414 (Anton Popov).
  • Permitir la lectura en paralelo para motores de tabla y funciones remotos en la caché del sistema de archivos. #71781 (Kseniia Sumarokova).
  • Se permite usar la caché de páginas en espacio de usuario con archivos locales y con funciones de tabla de almacenamiento de objetos. #77874 (Michael Kolupaev).
  • Se evita el uso innecesario de memcpy en la caché de páginas en espacio de usuario. #77884 (Michael Kolupaev).
  • El valor predeterminado de concurrent_threads_scheduler ahora es max_min_fair en lugar de fair_round_robin. Esto mejora la equidad cuando la carga es alta al priorizar las consultas con menos slots asignados, de modo que las consultas de corta duración no se vean penalizadas por las de larga duración. #95300 (Sergei Trifonov).
  • Si una consulta FINAL usaba la condición de la clave primaria para filtrar, seguida de índices de omisión para otras condiciones, el paso de procesamiento PrimaryKeyExpand ahora solo comprobará la intersección de los rangos iniciales preseleccionados de la clave primaria. #94903 (Shankar Iyer).
  • Al usar réplicas paralelas con funciones de tabla como s3(...), las consultas con una sola subconsulta que envuelve la función de tabla ahora se paralelizan automáticamente entre las réplicas, mientras que antes solo se paralelizaban las referencias directas a funciones de tabla. Cierra #92264. #96332 (phulv94).
  • Se habilita la división en segmentos separados de los archivos de datos y del sistema de la caché. #87834 (MikhailBurdukov).
  • Se aceleran algunas operaciones de hash join al implementar despacho dinámico para ColumnVector::replicate. #79573 (Raúl Marín).
  • Mejora del rendimiento para parallel hash join en casos de predicados complejos. Anteriormente, procesábamos las filas no emparejadas en un solo hilo, lo que no es óptimo; esta optimización paraleliza el procesamiento de las filas no emparejadas en varios hilos. Se puede activar o desactivar con el ajuste parallel_non_joined_rows_processing. Activado de forma predeterminada. #92068 (Yarik Briukhovetskyi).
  • Se optimizó ligeramente el análisis del tipo JSON. #93614 (Pavel Kruglov).
  • Mejora de la huella de memoria del AST. La optimización tiene sentido, ya que los campos no se utilizan cuando no se usa el resaltado ni se analizan VALUES. #93974 (Ilya Yatsishin).
  • Optimiza el consumo de memoria de los objetos AST de Tuple con nombres. Coloca los nombres de columna como cadenas en el objeto Tuple en lugar de mantenerlos en nodos literales AST genéricos. #94704 (Ilya Yatsishin).
  • Se mejora la desvirtualización con opciones adicionales del enlazador. #94737 (Nikita Taranov).
  • Mejora el rendimiento de la clonación de réplicas para tablas ReplicatedMergeTree con muchas partes agrupando en lotes las solicitudes a ZooKeeper. #94847 (c-end).
  • Cuando la etapa de lectura ya tenía filtros PREWHERE, no se podía añadir un filtro nuevo. Este cambio pospone la optimización de PREWHERE hasta después de la optimización de filtros runtime de JOIN, para que los filtros runtime también puedan llevarse a PREWHERE. #95838 (Alexander Gololobov).
  • Acelera la compresión del códec T64 usando despacho dinámico en x86. #95881 (Raúl Marín).
  • Se acelera uniq para tipos numéricos agrupando las inserciones en lotes cuando es posible (sin NULL, sin -If, sin GROUP BY y sin IPv6 ni String). #95904 (Raúl Marín).
  • Optimizaciones de bajo nivel para Keeper: se ha detectado que ZooKeeper::observeOperations supone >20% del consumo de CPU del hilo de recepción de ZooKeeper. Este cambio lo corrige de la siguiente manera: 1. Para AggregatedZooKeeperLog::stats, se usa CityHash64 en lugar de SipHash, ya que es >10x más rápido. 2. Para Coordination::ErrorCounter, se usa std::array<std::atomic<UInt32>, N> en lugar de std::unordered_map y std::mutex. #95962 (Miсhael Stetsyuk).
  • Se eliminó la alineación de 64 bytes para ProfileEvents::Counter para ahorrar memoria. #96097 (Azat Khuzhin).
  • Optimización de memoria: reducir en 50 veces el tamaño de la estructura CachedOnDiskReadBufferFromFile. #96098 (Azat Khuzhin).
  • No copiar los datos antiguos al redimensionar la tabla hash si está vacía. #96180 (Raúl Marín).
  • Se admiten filtros de runtime de JOIN para JOINs RIGHT OUTER. #96183 (Hechem Selmi).
  • La optimización enable_join_runtime_filters ahora es la predeterminada. #89314 (Alexey Milovidov).
  • Anteriormente, la optimización direct read del índice de texto se aplicaba solo cuando todas las partes tenían un índice de texto materializado. Este PR añade compatibilidad parcial: si algunas partes tienen un índice de texto materializado, esas partes lo usarán, mientras que las partes sin un índice de texto materializado recurrirán a la expresión de filtro original. #96411 (Anton Popov).
  • Se añadieron índices secundarios minmax en las columnas de tiempo e índices bloom_filter en las columnas query_id/initial_query_id de las tablas de logs del sistema para agilizar el filtrado. #96712 (Alexey Milovidov).
  • La optimización de materialización diferida ahora se aplica a todas las ramas de una consulta UNION ALL, no solo a la primera. Las consultas que combinan varias lecturas ordenadas y limitadas de distintas tablas MergeTree mediante UNION ALL ahora se beneficiarán de la lectura diferida de columnas en cada rama, lo que reduce la E/S. #96832 (Federico Ginosa).
  • Optimiza el cálculo del skip index minmax durante INSERT eliminando una copia de datos innecesaria y habilitando el cálculo vectorizado de mínimos/máximos en columnas numéricas. #97392 (Raúl Marín).
  • El motor DeltaLake ahora toma el resultado de count() de los metadatos de Delta Lake y muestra las estadísticas correctas de la tabla en system.tables (bytes/filas totales). #96190 (Kseniia Sumarokova).
  • Las columnas no utilizadas también se eliminan del paso de lectura cuando se lee desde un MergeTree. Esto es especialmente útil cuando se hace pushdown de un filtro a PREWHERE. #89982 (János Benjamin Antal).
  • Se mejoró el procesamiento de la consulta SHOW TABLES al obtener solo los nombres de las tablas, y se mejoró getLightweightTablesIterator para que devuelva una estructura que contenga únicamente los nombres de las tablas. Resuelve #93835. #94467 (Smita Kulkarni).
  • Mejora assumeNotNull, coalesce e ifNull para permitir la poda de la clave primaria y del skip index en predicados de rango cuando las columnas clave se envuelven en estas funciones. Cierra #94689. #94754 (Nihal Z. Miaji).
  • Se añaden las extensiones with_data & with_stat a la solicitud getChildren de Keeper. Esto permite obtener no solo la lista de hijos, sino también su stat y/o data en una sola operación. #94826 (Nikolay Degterinsky).
  • El análisis de índices se realiza solo una vez (en la mayoría de los casos), independientemente de si se acaba ejecutando un plan local o uno con réplicas paralelas. #94854 (Nikita Taranov).
  • Permite habilitar el análisis distribuido de índices según la cantidad de partes (distributed_index_analysis_min_parts_to_activate) y el tamaño de los índices (distributed_index_analysis_min_indexes_size_to_activate). #95216 (Azat Khuzhin).
  • Se habilita la optimización de PREWHERE para tablas Iceberg. #95476 (Konstantin Vedernikov).
  • Se reduce el consumo de memoria de algunas clases de AST. #95514 (Raúl Marín).
  • Limita el número de flujos del pipeline generados con split_intersecting_parts_ranges_into_layers habilitado. Ayuda a evitar un consumo excesivo de memoria. #96478 (Nikita Taranov).
  • Se implementó la optimización de conjuntos equivalentes para múltiples joins. Las consultas con múltiples operaciones consecutivas de INNER JOIN ahora se benefician de una mejora en la optimización de pushdown de filtros. Cuando las tablas se unen por columnas equivalentes (p. ej., t1 JOIN t2 ON t1.id = t2.id JOIN t3 ON t2.id = t3.id WHERE t1.id > 10), los filtros aplicados a cualquier tabla de la cadena se hacen pushdown automáticamente a todas las tablas. Cierra #96550. #96596 (Vladimir Cherkasov).
  • Optimiza el escaneo de metadata de delta lake. Incorpora cambios de la PR de delta-kernel https://github.com/delta-io/delta-kernel-rs/pull/1827. #96686 (Kseniia Sumarokova).
  • En la base de datos Replicated, no actualice el clúster almacenado en caché para cada consulta de prueba. #96897 (Tuan Pham Anh).
  • Utiliza el índice de clave primaria al filtrar con startsWithUTF8 si el prefijo contiene únicamente caracteres ASCII. #97055 (vkcku).

Mejora

  • Añadir trazas de OpenTelemetry para las peticiones de Keeper. #91332 (Miсhael Stetsyuk).
  • Nuevas opciones de configuración: logger.startup_console_level & logger.shutdown_console_level para anular el nivel de registro de la consola durante el inicio y el apagado de ClickHouse, respectivamente. #95919 (Garrett Thomas).
  • Se respetan las sobrescrituras de la línea de comandos al recargar la configuración. Cierra #80294. #80295 (Alexey Milovidov).
  • Permitir sobrescrituras de clave-valor en los parámetros de named collection de la función de tabla mongodb. #89616 (vanchaklar).
  • La optimización de lectura en orden para las tablas Iceberg ahora también funciona con funciones de ordenación complejas como icebergBucket y icebergTruncate, no solo con referencias simples a columnas. #90256 (Konstantin Vedernikov).
  • Se añade una nueva columna llamada parts_postpone_reasons en system.mutations para mejorar el diagnóstico, que muestra los motivos de aplazamiento de las partes. #92206 (Shaohua Wang).
  • Seguimiento de los cambios en el número de filas que se van a leer (debido a inserciones/eliminaciones o al uso de la caché de condiciones de consulta) en DataflowStatisticsCache. #93636 (Nikita Taranov).
  • Se admite la consulta SYSTEM RESET DDL WORKER [ON CLUSTER]. Solicita restablecer el estado de DDLWorker en su thread principal. Resulta útil para refrescar la réplica activa cuando se actualizan los ID del host. #93780 (Tuan Pham Anh).
  • Se añade compatibilidad con mutation_ids en system.part_log para los tipos de evento MUTATE_PART y MUTATE_PART_START. #93811 (Shaohua Wang).
  • Las operaciones en segundo plano (Mutate, Merge) ahora pueden configurarse de forma independiente a través del perfil ‘background’. Antes, estas operaciones compartían la configuración con las consultas normales mediante el perfil ‘default’. #93905 (Arsen Muk).
  • Se añadió más información a system.crash_log. #94112 #95857 (Miсhael Stetsyuk).
  • Se añadió la nueva métrica QueryNonInternal para realizar un seguimiento del número de consultas no internas en ejecución. Esta métrica se expone como ClickHouseMetrics_QueryNonInternal y ayuda a los operadores a supervisar la concurrencia de consultas con respecto al límite max_concurrent_queries, que solo se aplica a las consultas no internas. #94284 (Ashwath Singh).
  • Se añade compatibilidad con la recopilación de estadísticas de bytes de entrada para columnas de partes compactas en RuntimeDataflowStatisticsCacheUpdater. #94626 (Nikita Taranov).
  • Añade una comprobación para detectar una configuración incorrecta de Keeper que provoca fallos en la formación del clúster. Cierra #60932. #94682 (Konstantin Bogdanov).
  • Mejorar la deserialización de prefijos JSON al cargar partes. #94848 (Pavel Kruglov).
  • Refactoriza la escritura para usar el pipeline completo de INSERT, que activa las vistas materializadas en la tabla de destino. #94890 (Kai Zhu).
  • Usar optimizaciones del plan de búsqueda por similitud vectorial solo si existe el índice para la columna de búsqueda. #94998 (Eduard Karacharov).
  • Comprobar el límite total de memoria antes de la autenticación del usuario y lanzar (total) memory limit exceeded si el límite total supera lo permitido. #95003 (Nikolai Kochetov).
  • Se añadió la opción de configuración throw_on_unmatched_row_policies que, cuando está habilitada, lanza una excepción si un usuario consulta una tabla que tiene políticas de filas pero ninguna de ellas se le aplica, lo que evita el comportamiento ambiguo de devolver todas las filas debido a una mala configuración del control de acceso. #95014 (Vitaly Baranov).
  • Actualización dinámica de los tokens de acceso de S3 en consultas largas con Unity Catalog. Esto cierra #93981. #95069 (Konstantin Vedernikov).
  • Desactiva la liberación gradual de páginas sucias de jemalloc si ClickHouse está sometido a una presión de memoria sostenida durante memory_worker_decay_adjustment_period_ms milisegundos. Vuelve a activarla si ClickHouse opera en condiciones normales durante el mismo periodo de tiempo. #95145 (Antonio Andelic).
  • Compatibilidad con ZooKeeper auxiliar para S3Queue mediante la configuración keeper_path de s3Queue. #95203 (Diego Nieto).
  • Se respeta max_parts_to_merge_at_once en las fusiones de partes con eliminación por TTL. #95315 (Kseniia Sumarokova).
  • Añadir connection_address y connection_port a query_log para reflejar la conexión física (address y port se reemplazan al conectarse a través de un proxy y auth_use_forwarded_address=1). #95471 (Yakov Olkhovskiy).
  • Corrige el cálculo incorrecto de memoria para la caché de condiciones de la consulta. El problema principal era que no se tenía en cuenta la clave de la caché, que estaba compuesta por varias cadenas (como part_name, el id de la tabla y la condición SQL completa). #95478 (Nikita Mikhaylov).
  • El servidor iniciado con la configuración integrada permitirá gestionar usuarios y permisos, guardándolos en el directorio access, igual que la configuración habitual. Esto mejora las pruebas. También se habilitaron todas las access_control_improvements en la configuración integrada y en clickhouse-local. #95481 (Alexey Milovidov).
  • Se mejoraron los mensajes de error de autenticación de S3 para incluir una indicación de revisar las credenciales cuando se deniega el acceso. #95648 (Gerald Latkovic).
  • Se habilita la caché de estadísticas y se establece el período de actualización de la caché en 300 s. #95841 (Han Fei).
  • Se añadió el nombre del componente a system.aggregated_zookeeper_log. #95882 (Antonio Andelic).
  • Omitir las lecturas desde el almacenamiento de objetos al consultar las tablas DeltaLake desde system.tables. #95899 (Antonio Andelic).
  • Se habilita enable_max_bytes_limit_for_min_age_to_force_merge de forma predeterminada si la configuración compatibility es 26.2 o superior. #95917 (Christoph Wurm).
  • Delta Lake ya está disponible en macOS. Cierra #95979. #95985 (Alexey Milovidov).
  • En versiones anteriores, al combinar expresiones ALTER en conflicto con UPDATE y RENAME COLUMN, se lanzaba un error lógico en lugar de una excepción adecuada. Cierra #70678. #96022 (Alexey Milovidov).
  • Mejora la salida de ayuda de todas las aplicaciones de ClickHouse y añade una opción --no-sudo, junto con algunas correcciones. Da continuidad a #58244 de Ilya Yatsishin. #96025 (Alexey Milovidov).
  • Se agregó el alias distanceCosine para cosineDistance, ya que todas las demás funciones de distancia ya tienen un alias de este tipo. #96065 (Raufs Dunamalijevs).
  • Se añadió compatibilidad con la extensión with_data de Keeper para mejorar la obtención de tablas en la base de datos Replicated. #96090 (Nikolay Degterinsky).
  • Se actualiza chdig a v26.2.1 (nuevas funcionalidades y compatibilidad con MacOS). #96113 (Azat Khuzhin).
  • Mejora del pushdown de filtros para numbers y primes. ClickHouse ahora puede derivar cotas conservadoras de valores a partir de las condiciones WHERE cuando no es posible derivar cotas exactas, y restringir en consecuencia la generación de secuencias (por ejemplo, para WHERE number % 5 < 2 AND number > 100 AND number < 300, ClickHouse solo generará números entre 100 y 300, y luego aplicará el predicado), evitando escaneos no acotados. Cierra #84853. Cierra #93913. #96115 (Nihal Z. Miaji).
  • Anteriormente, el formateador ponía SELECT entre paréntesis cuando había una cláusula COMMENT para evitar ambigüedades en el análisis sintáctico. En su lugar, ahora coloca COMMENT antes de AS SELECT, lo que elimina la ambigüedad sin necesidad de paréntesis. #96293 (Alexey Milovidov).
  • La opción de configuración allow_impersonate_user ahora se encuentra dentro de la sección access_control_improvements, en lugar de ser una opción de configuración del servidor independiente. #96451 (Vitaly Baranov).
  • Hacer que la opción de configuración core_dump.size_limit admita recarga en caliente, para evitar tener que reiniciar los servidores para que los cambios de configuración surtan efecto. #96524 (Miсhael Stetsyuk).
  • Mejora la interoperabilidad del perfilador de CPU y del perfilador en tiempo real con los tiempos de espera de socket. #96601 (Sergei Trifonov).
  • Evita que reaparezcan los datos eliminados si se ejecuta ADD COLUMN poco después de la mutación DROP COLUMN. #96713 (Alexey Milovidov).
  • Cambio del tipo de function_id en system.instrumentation de LowCardinality(Int32) a Int32. #96726 (Copilot).
  • La espera síncrona de las mutaciones respetará la cancelación de consultas y los límites de tiempo. #96756 (Alexey Milovidov).
  • Se añadió el comando de sistema SYSTEM RELOAD DELTA KERNEL TRACING <level> para cambiar el logging de delta-kernel, lo que puede resultar útil para la depuración. #96763 (Kseniia Sumarokova).
  • El filtrado por familia de direcciones IP, es decir, los ajustes dns_allow_resolve_names_to_ipv4/ipv6, se aplica incluso si la caché de DNS está deshabilitada. #96810 (c-end).
  • Mejora de la introspección de jemalloc. #96840 (Azat Khuzhin).
  • Se corrige la interfaz web de /play, que arrojaba QUERY_CACHE_USED_WITH_SYSTEM_TABLE al consultar tablas del sistema. #96869 (Alexey Milovidov).
  • Mejora de la interfaz web: cambiar el favicon para indicar el estado de ejecución de una consulta; mostrar los errores de las consultas auxiliares (carga de bases de datos y tablas) en lugar de ignorarlos silenciosamente. Cierra #85055. #96883 (Alexey Milovidov).
  • Se puede hacer clic en el panel izquierdo de la UI de /play para mostrar u ocultar la lista de bases de datos. #96884 (Alexey Milovidov).
  • DROP DATABASE ahora elimina las tablas en orden inverso de dependencia, lo que mejora la tolerancia a fallos cuando la base de datos contiene tablas con dependencias de carga (por ejemplo, tablas Distributed que usan joinGet). #97057 (Alexey Milovidov).
  • Actualizar yaml-cpp para evitar que se omita YAML no válido. #97333 (Azat Khuzhin).
  • Mostrar un indicador de carga en la barra lateral de play.html mientras se cargan las tablas. #97531 (Alexey Milovidov).
  • Añade un botón para copiar al portapapeles los resultados sin procesar de la consulta en la interfaz web integrada (play.html). #97532 (Alexey Milovidov).
  • Se corrige el ofuscador de consultas (clickhouse-format --obfuscate) para que genere SQL que pueda analizarse en más casos. #97584 (Alexey Milovidov).

Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)

  • Después de ALTER que solo afectan a los metadatos, como ampliar los elementos de los Enums, la optimización de la agregación con proyección puede terminar provocando una excepción. #84143 (Alexey Milovidov).
  • Las vistas materializadas ahora usan como contexto de ejecución la base de datos en la que se crearon, lo que significa que: - es posible omitir la calificación explícita de la base de datos en los nombres a los que se hace referencia en la consulta SELECT de la vista - si no se indica una calificación explícita de la base de datos, se asume la misma base de datos en la que se creó la vista materializada. #88193 (Dmitry Kovalev).
  • Corrige la sustitución de parámetros de consulta en los métodos de autenticación de CREATE USER cuando se usa ON CLUSTER. Los parámetros de consulta en los métodos de autenticación (p. ej., password) no se sustituían, lo que provocaba errores UNKNOWN_QUERY_PARAMETER en nodos remotos. #92777 (xiaohuanlin).
  • Se corrigieron inconsistencias en el análisis de índices de texto para las funciones has, mapContainsKey y mapContainsValue. Anteriormente, las consultas que usaban estas funciones podían devolver resultados distintos dependiendo de si la expresión se evaluaba con o sin un índice de texto. #93578 (Anton Popov).
  • Se corrige un fallo al adjuntar una tabla a una base de datos MaterializedPostgreSQL si dropReplicationSlot lanza una excepción durante el desenrollado de la pila. #96871 (Alexey Milovidov).
  • Las copias de seguridad podían hacer que el servidor fallara si se ejecutaban muchas copias de seguridad concurrentes que competían por los mismos archivos. #93659 (Alexey Milovidov).
  • Corrige las consultas con réplicas paralelas y un JOIN con una tabla no MT. Cierra #92056. #93902 (Igor Nikonov).
  • Corrige un problema por el cual las columnas de Iceberg con un punto en el nombre devolvían NULL como valor. #94335 (Mikhail Koviazin).
  • Se corrigió el manejo de cadenas UTF-8 en stringJaccardIndexUTF8 y se mejoró el rendimiento. #94613 (Joanna Hulboj).
  • Corrige posibles desbordamientos en WITH FILL STALENESS (que provocan UB y/o bucles infinitos). Corrige un posible bucle infinito debido a saltos grandes. Añade compatibilidad con el analizador antiguo (principalmente para pruebas de estrés). #94663 (Azat Khuzhin).
  • Se corrigen posibles consultas distribuidas que pueden quedar bloqueadas cuando los nombres de host se resuelven en varias direcciones y una réplica remota se congela. #94726 (c-end).
  • Corrige un resultado no válido al unir varias expresiones de tabla, cuando la expresión de tabla más a la izquierda es una función de tabla -Cluster. Resuelve #89996. #94748 (Konstantin Bogdanov).
  • Corrige la poda incorrecta de la clave primaria y del índice de omisión para predicados que involucran toWeek, toYearWeek, toStartOfWeek, toLastDayOfWeek y toDayOfWeek, y corrige excepciones en algunas de estas funciones para consultas válidas con LowCardinality(String). #94816 (Nihal Z. Miaji).
  • Se elimina la omisión innecesaria de la comprobación de permisos en las consultas ATTACH para una vista con SQL Security. Esto evita una posible escalada de privilegios cuando un usuario adjunta una vista con un definidor sin validar el acceso requerido. #94865 (pufit).
  • Corrige un fallo al iniciar ReplicatedMergeTree causado por la eliminación simultánea de los directorios delete_tmp_*. #94892 (myeongjun).
  • Se corrige un problema por el que INSERT en tablas Iceberg con vistas materializadas perdía información de deduplicación, lo que provocaba una excepción. #94938 (Daniil Ivanik).
  • Corrige un error por el que SYSTEM DROP QUERY CACHE TAG 'TAGNAME' ON CLUSTER <CLUSTERNAME> hacía que se eliminara toda la caché del clúster. #94978 (Rory Crispin).
  • Mantener la granularidad constante del índice (use_const_adaptive_granularity) tras las fusiones verticales (v2 con una corrección para Nested y en general). #95013 (Azat Khuzhin).
  • Corrige una condición de carrera en la caché del sistema de archivos en la versión 26.1 tras [ClickHouse/ClickHouse#82764](https://github.com/ClickHouse/ClickHouse/pull/82764). #95042 (Kseniia Sumarokova).
  • Se corrige la cancelación de la table function postgresql() mediante KILL QUERY y la cancelación de consultas (Ctrl+C) en clickhouse-client. #95136 (Roman Vasin).
  • Se corrigió la inferencia de tipos para columnas calificadas de tablas de origen cuando se usan varios joins con la cláusula USING. Anteriormente, los joins posteriores actualizaban incorrectamente los tipos de las columnas subyacentes de las tablas de origen a un supertipo común, incluso cuando la columna no intervenía en ese join (p. ej., en SELECT t2.a FROM t1 LEFT JOIN t2 USING (a) LEFT JOIN t3 USING (a), la columna t2.a solo se usa en el primer join, por lo que su tipo debería ser el supertipo de t1.a y t2.a, excluyendo t3.a). Esto podía provocar errores lógicos o fallos cuando las funciones esperaban tipos de columna distintos de los que realmente aparecían en el plan de ejecución. #95157 (Vladimir Cherkasov).
  • Hacer que la transformación de la columna se realice solo una vez al obtener el contenido de la lista y de los archivos .avro del manifiesto. #95164 (Daniil Ivanik).
  • Se corrigió un cálculo incorrecto del tamaño de las columnas JSON que podía provocar un uso excesivo de memoria o estadísticas de columnas erróneas. #95207 (Azat Khuzhin).
  • Se corrigió la contabilización inexacta de memoria al aplicar partes de parche grandes después de actualizaciones ligeras. Anteriormente, aplicar parches grandes podía provocar un uso excesivo de memoria y hacer que el proceso del servidor fuera finalizado por el OOM killer. #95231 (Anton Popov).
  • Se corrigió un comportamiento indefinido que podía provocar resultados incorrectos o una excepción cuando una consulta distribuida con max_parallel_replicas volvía a una réplica local durante el análisis de índices. #95263 (Azat Khuzhin).
  • Se corrige la agregación de columnas dispersas para sum y las series temporales cuando group_by_overflow_mode se establece en any. #95301 (Mikhail Koviazin).
  • Corrige un problema de fiabilidad en la política de disco plain_rewritable, donde un error de red a mitad del proceso de desvincular un archivo de metadatos podía dejar el almacenamiento en un estado incoherente. #95302 (Mikhail Artemenko).
  • Se sustituye Date por Date32 para Iceberg. #95322 (Konstantin Vedernikov).
  • El argumento password de la función de tabla redis ahora se enmascarará en los logs y las tablas del sistema (p. ej.: query_log). #95325 (János Benjamin Antal).
  • Se corrigió un error por el que las tablas podían eliminarse o modificarse mientras una consulta distribuida seguía ejecutándose en ellas, lo que podía provocar excepciones o resultados incorrectos. #95356 (Azat Khuzhin).
  • Se corrige un error lógico en algunos casos al usar LIMIT/OFFSET negativo en consultas distribuidas. #95357 (Nihal Z. Miaji).
  • Se corrigió un error por el que clickhouse-client pedía la contraseña dos veces al conectarse por ssh. #95372 (Isak Ellmer).
  • Se corrige una condición de carrera en el almacenamiento S3(Azure)Queue. #95385 (Kseniia Sumarokova).
  • Corrige el error del filtro de prewhere causado por expresiones lambda en prewhere. #95395 (Xiaozhe Yu).
  • Se corrige optimize_syntax_fuse_functions para que no reescriba sum/count/avg como sumCount() cuando el argumento de agregación es Nullable. Cierra #95390. #95441 (Nihal Z. Miaji).
  • Se evita un posible fallo en las consultas distribuidas en caso de cancelación. #95466 (Aleksandr Musorin).
  • Se corrige la deduplicación del streaming desde el motor S3(Azure)Queue. #95467 (Kseniia Sumarokova).
  • Se corrigió la actualización de las políticas de filas asignadas al usuario inicial en consultas distribuidas. #95469 (Vitaly Baranov).
  • Se corrige la comprobación de discos cifrados sobre plain_rewritable (corrige el posible It is not possible to register multiple plain-rewritable disks with the same object storage prefix). #95470 (Azat Khuzhin).
  • A la función de tabla mergeTreeProjection le faltaba una comprobación de acceso, lo que permitía a los usuarios sin permiso SELECT sobre una tabla (pero con permisos para funciones de tabla) leer datos de sus proyecciones. Esta corrección añade la misma comprobación de acceso que ya tienen mergeTreeIndex y mergeTreeAnalyzeIndexes. #95480 (Alexey Milovidov).
  • Corrige un posible error lógico al leer la subcolumna de tamaño de las subcolumnas dinámicas de los tipos Dynamic/JSON. #95573 (Pavel Kruglov).
  • Se corrige una regresión en la replicación sin copia (experimental) introducida por #94262, por la que las partes compartidas podían eliminarse antes de que otras réplicas terminaran de obtenerlas. #95597 (filimonov).
  • Se corrige un cierre inesperado al aplicar tupleElement a arrays de JSON. Cierra #95581. #95647 (Pavel Kruglov).
  • Se corrige la excepción por error lógico al usar un comodín (*) dentro de una función lambda en una cláusula VALUES de un JOIN con USING. Cierra #93675. #95661 (Vladimir Cherkasov).
  • Se corrigió el error lógico There was an error: Cannot obtain error message al esperar un DDL distribuido y eliminar simultáneamente la base de datos Replicated. Corrige el issue #95539. #95664 (Alexander Tokmakov).
  • Se corrige un problema en la función IN que devolvía resultados incorrectos con valores NULL cuando transform_null_in está habilitada. Cierra #65776. #95674 (Nihal Z. Miaji).
  • Maneja correctamente los tipos LowCardinality Nullable en CAST cuando la configuración cast_keep_nullable está habilitada. Cierra #95670. #95747 (Alexey Milovidov).
  • Corrige la compactación de datos particionados en Delta Lake. #95773 (Kseniia Sumarokova).
  • Se corrige una condición de carrera en la columna Nullable de join en los filtros en tiempo de ejecución. #95775 (Hechem Selmi).
  • Se corrige un posible error lógico en una consulta con comodines (*, table.*) y analyzer_compatibility_join_using_top_level_identifier cuando la columna USING tiene tipos distintos en las tablas y en la lista de selección. Cierra #90477. #95808 (Vladimir Cherkasov).
  • Se corrigieron errores de seguridad de memoria en operaciones del pool de hilos en paralelo (copias de seguridad, agregación, consultas distribuidas) que podían causar excepciones cuando se producía un error durante la programación de tareas. #95818 (Raúl Marín).
  • Corrige un fallo en DROP WORKLOAD cuando se ejecuta de forma concurrente con consultas que usan el workload que se está eliminando. #95856 (Alexey Milovidov).
  • Corrige la lentitud al consultar las tablas del sistema con un usuario que tiene privilegios limitados en muchas bases de datos. Cierra #89371. #95874 (pufit).
  • Se corrigió la ejecución de tupleElement en JSON con rutas anidadas; antes podía dar lugar a resultados de consulta incorrectos. #95907 (Pavel Kruglov).
  • Se corrigió un error NOT_SUPPORTED que podía producirse al usar el algoritmo de JOIN direct con una tabla MergeTree vacía. #95935 (Vladimir Cherkasov).
  • Corrige un problema por el que el client no sugería ni autocompletaba nombres de alias para configuraciones; cierra #92190. #95945 (phulv94).
  • Se ha corregido event_date en system.asynchronous_metric_log. #95947 (Raúl Marín).
  • Se corrige el manejo de las skipping paths en el tipo de datos JSON. Anteriormente, con JSON(SKIP path) se omitían todas las claves JSON con el prefijo path, incluso claves como "pathpath", por lo que esto podía provocar pérdida de datos en esas rutas durante el insert. Ahora ya está corregido y solo se omite la clave "path". #95948 (Pavel Kruglov).
  • Una parte con proyecciones desconocidas no debe marcarse como perdida definitivamente. #95952 (Mikhail Artemenko).
  • Corrige un problema por el que la cadena vacía pasaba a ser NULL en la tabla Join con clave Nullable(String). Cierra #71414. #96002 (Alexey Milovidov).
  • Ahora, el motor de PostgreSQL puede leer correctamente BOOLEAN[]. Cierra #72754. #96006 (Alexey Milovidov).
  • Corrige el formato ProtobufList en el caso de lectura desde un archivo vacío. Cierra #70059. #96007 (Alexey Milovidov).
  • Se corrige un problema en el formato ProtobufList, que generaba un registro fantasma en tablas vacías. Cierra #72596. #96010 (Alexey Milovidov).
  • Corrige la incompatibilidad de tipos en la función if entre UInt64 e Int32 en un caso inusual de consultas distribuidas y PREWHERE, con inferencia de tipos. Cierra #70017. #96012 (Alexey Milovidov).
  • Se corrigen las consultas compiladas con JIT que usan tipos Bool. #96013 (Alexey Milovidov).
  • Se corrige un error lógico al leer una columna UUID de una columna TEXT de SQLite. Cierra #71263. #96016 (Alexey Milovidov).
  • Corrige la conversión de tipos del motor SQLite para DateTime, Date, UUID y otros tipos. Cierra #73481. #96017 (Alexey Milovidov).
  • Los valores FixedString se escapaban incorrectamente en consultas a bases de datos externas como SQLite y PostgreSQL. Cierra #73519. En coautoría con @jh0x. #96019 (Alexey Milovidov).
  • Corrige un error de aserción en WindowTransform con un desplazamiento PRECEDING grande. Cierra #75852. #96026 (Alexey Milovidov).
  • Se corrige un error que podía provocar corrupción de datos cuando las inserciones asíncronas concurrentes usan los mismos nombres de parámetro, pero contienen valores diferentes. #96035 (Seva Potapov).
  • Se corrigió el período de los profilers globales (controlado por global_profiler_real_time_period_ns y global_profiler_cpu_time_period_ns). En lugar del valor configurado, se usaba un valor truncado, lo que hacía que el profiler se activara con más frecuencia de la prevista. #96048 (Antonio Andelic).
  • Antes, si en una entrada estaba presente el archivo de datos de referencia dentro del archivo de manifiesto de Iceberg para position delete, pero su valor era NULL, no obteníamos los límites correctos para los archivos de datos correspondientes. Este PR corrige este error. #96061 (Daniil Ivanik).
  • Se corrige la revocación de roles predeterminados. #96103 (Vitaly Baranov).
  • Se corrige un error de uso tras liberar memoria en el análisis de índices, en una combinación poco frecuente de use_primary_key deshabilitado y un número muy elevado de disyunciones de condiciones que utilizan el índice. #96112 (Alexey Milovidov).
  • Corrige una regresión del códec Gorilla cuando un tamaño especificado explícitamente no se corresponde con el tamaño del tipo de dato y el tamaño del búfer es demasiado pequeño. En versiones anteriores, se producía una excepción durante la descompresión. Cierra #78253. #96118 (Alexey Milovidov).
  • Evita un interbloqueo al cargar diccionarios cuando un diccionario hace referencia a una tabla Merge que, a su vez, lo referencia de forma recursiva. Cierra #78360. #96120 (Alexey Milovidov).
  • Corrección del uso de un valor no inicializado en formatDateTime con especificadores de formato de ancho no fijo, como los de estilo MySQL y JODA. #96133 (Alexey Milovidov).
  • La combinación de las opciones use_const_adaptive_granularity e index_granularity_bytes (que significa “granularidad no adaptativa”) provocó un cálculo erróneo del número de filas que se debían leer y una excepción. #96143 (Alexey Milovidov).
  • La ejecución de una mutación ALTER UPDATE no válida en tablas de almacenamiento de objetos de tipo archivo, como S3 y Azure, podía provocar una desreferenciación de nullptr. Cierra #92994. #96162 (Alexey Milovidov).
  • Se corrigió un problema por el que AccessRights::contains devolvía resultados incorrectos con revocaciones parciales. #96170 (pufit).
  • Se corrigió la colisión de hash en la caché de condiciones de consulta para constantes plegadas de CTE, lo que podía provocar un resultado de consulta incorrecto. Cierra #96060. #96172 (Alexey Milovidov).
  • Se corrige un posible interbloqueo en ProcessList. Puede ocurrir por una posible inversión en el orden de los bloqueos si el overcommit tracker de memoria se activa mientras añadimos una tarea al verificador de cancelación. #96182 (Antonio Andelic).
  • Se corrigió un error por el que las consultas con joins externos (LEFT, RIGHT o FULL) combinados con varios INNER JOINs podían devolver resultados incorrectos debido a una reordenación no válida de joins. Cuando la condición ON de un join externo hacía referencia a columnas de varias tablas unidas previamente, el optimizador no tenía en cuenta todas las dependencias entre tablas y podía reordenar los joins de forma incorrecta, lo que provocaba la ausencia de filas. Cierra #95972. #96193 (Vladimir Cherkasov).
  • Cuando una tabla no tiene estadísticas definidas, ClickHouse no debería intentar cargarlas. Esto evita cierta sobrecarga (más de 100 ms) al comprobar si existen los archivos de estadísticas. (issue #96068). #96233 (Han Fei).
  • Corrige optimize_syntax_fuse_functions para que no reescriba sum/count/avg como sumCount() cuando el argumento de agregación es LowCardinality(Nullable). Cierra #95390. #96239 (Nihal Z. Miaji).
  • Se corrige la poda incorrecta de particiones con not IN y not has en algunos casos. #96241 (Nihal Z. Miaji).
  • Se corrige stack-use-after-scope en el índice de similitud vectorial. #96259 (Alexey Milovidov).
  • Se corrige un problema por el que el ejecutor de pruebas no reconocía los comentarios de sugerencia de error cuando una consulta estaba precedida por un comentario SQL. #96336 (Yakov Olkhovskiy).
  • Se corrige un error lógico en KeyCondition cuando una tabla tiene una clave primaria Nullable y la consulta usa la función coalesce, cuyo primer argumento es constante. #96340 (Alexey Milovidov).
  • La interacción entre GROUPING SETS, group_by_use_nulls y el tipo de dato Tuple con LowCardinality en su interior podía producir una estructura de bloques inesperada en el pipeline de consulta, lo que provocaba un error lógico. Esto surgió tras la introducción de Tuples Nullable. #96358 (Alexey Milovidov).
  • Era posible crear una tabla con una expresión vacía () como índice, lo que provocaba un acceso no válido a la memoria. #96363 (Alexey Milovidov).
  • Se corrigió un fallo del analizador antiguo cuando había JOIN y alias duplicados. #96405 (Ilya Golshtein).
  • Se corrigió el error Nested columns sizes are inconsistent with local_discriminators debido a una optimización errónea del filtrado in-place para columnas Variant. #96410 (Alexey Milovidov).
  • Se corrige un problema por el que CREATE TABLE ... CLONE AS ... ignoraba el calificador completo de la tabla de origen. #96415 (Hasyimi Bahrudin).
  • Corrige la cancelación de la función de tabla mysql con KILL QUERY y al cancelar la consulta (Ctrl+C) en clickhouse-client. #96437 (Roman Vasin).
  • Corrige un bloqueo activo en el hilo de comprobación de cancelación de consultas con valores altos de max_execution_time. #96450 (Sergei Trifonov).
  • Se corrige un error lógico en algunos casos al utilizar valores fraccionarios de LIMIT/OFFSET en consultas distribuidas. #96475 (Nihal Z. Miaji).
  • Se corrige una desreferenciación de puntero nulo en ciertas expresiones con funciones lambda. #96479 (Alexey Milovidov).
  • Corrige resultados erróneos cuando las columnas LowCardinality se convierten en Nullable. #96483 (Nihal Z. Miaji).
  • Corrige un fallo al crear una tabla Iceberg con una cláusula ORDER BY que hace referencia a una columna inexistente o usa un argumento posicional. Cierra #93280. #96484 (Konstantin Vedernikov).
  • Se corrige la excepción del filtro en tiempo de ejecución para columnas Tuple con subcampos Nullable. #96509 (Alexey Milovidov).
  • Se corrige la excepción LOGICAL_ERROR en el lector nativo de Parquet V3 cuando la columna de filtro de PREWHERE contiene valores UInt8 no booleanos. #96594 (Alexey Milovidov).
  • Se corrige la regeneración implícita de índices en las tablas replicadas durante los cambios de metadatos. #96600 (Raúl Marín).
  • Corrige una condición de carrera en DROP WORKLOAD. #96614 (Sergei Trifonov).
  • Se corrige un error en las escrituras en tablas Iceberg por el que las inserciones en particiones podían provocar una distribución incorrecta de los datos entre los archivos de partición. #96620 (Konstantin Vedernikov).
  • Se corrigió heap-use-after-free en CREATE TABLE con restricciones. #96669 (Nikita Taranov).
  • Validar la versión witness en bech32 para evitar el desbordamiento de búfer. #96671 (Raúl Marín).
  • Se corrige un error por el que system.tables producía errores cuando se creaba un catálogo REST de lago de datos con una configuración auth_header no válida. #96680 (Han Fei).
  • Se corrigió min(timestamp), que devolvía epoch (1970-01-01) mediante _minmax_count_projection tras una fusión de TTL cuando se filtran todas las filas de un bloque. #96703 (Raquel Barbadillo).
  • Se mejora la validación de la configuración iceberg_metadata_file_path para evitar el path traversal y garantizar que el archivo de metadata especificado esté dentro del directorio de la tabla. #96754 (Daniil Ivanik).
  • Se corrige un fallo en ifNull con el argumento Variant utilizado en GROUP BY. #96790 (Alexey Milovidov).
  • Se corrigieron las colisiones de claves de caché entre tablas con la opción table_disk=1. #96818 (Raufs Dunamalijevs).
  • Se corrige que el hilo de purga de MemoryWorker se quedara bloqueado debido a una condición de carrera. #96819 (Antonio Andelic).
  • No registrar en los logs datos con credenciales en catálogos Iceberg. #96831 (Konstantin Vedernikov).
  • Se corrigió el código de salida de clickhouse-client tras un error del servidor. #96841 (Vitaly Baranov).
  • Las consultas con CROSS JOIN y réplicas paralelas habilitadas podían devolver resultados incorrectos. Soluciona #74337. #96848 (Igor Nikonov).
  • Se corrigió el error por el que fallaban las consultas ALTER TABLE DROP COLUMN tras haberse realizado previamente una actualización ligera en la misma columna. #96861 (Anton Popov).
  • Corregido el desbordamiento de pila (fallo) al crear copias de seguridad en formato de archivo (.zip, .tzst) en un disco plain_rewritable de almacenamiento de objetos. #96872 (Alexey Milovidov).
  • Se corrige el fallo del servidor cuando una copia de seguridad falla por falta de espacio en el disco u otros errores de E/S en el sistema de archivos de destino. #96873 (Alexey Milovidov).
  • Corrección de EXCEPT ALL y INTERSECT ALL, que no tenían en cuenta la multiplicidad de las filas y se comportaban como sus equivalentes DISTINCT. #96876 (Alexey Milovidov).
  • Se corrige la excepción std::terminate en indexOfAssumeSorted al llamarse con tipos incompatibles (p. ej., un array IPv4 con un valor de búsqueda entero). #96877 (Alexey Milovidov).
  • Se corrigió la excepción Bad cast from type DB::ColumnNullable to DB::ColumnString al usar funciones de ventana con group_by_use_nulls = 1 y CUBE/ROLLUP/GROUPING SETS. #96878 (Alexey Milovidov).
  • Corrige resultados incorrectos cuando las expresiones compiladas con JIT convierten DateTime a DateTime64 (p. ej., en CASE/if/multiIf con tipos DateTime mixtos). El valor se reinterpretaba en lugar de escalarse correctamente, lo que producía marcas de tiempo incorrectas una vez activada la compilación de expresiones. #96879 (Alexey Milovidov).
  • Se corrige la excepción por error lógico en CoalescingMergeTree cuando una expresión de índice de omisión produce una columna constante (p. ej., bloom_filter sobre ifNotFinite(1, c0) para una columna entera). #96880 (Alexey Milovidov).
  • Se corrige el número de puerto incorrecto en el mensaje de error al conectarse accidentalmente por HTTP al puerto del protocolo nativo con TLS habilitado. #96881 (Alexey Milovidov).
  • Corrección para que los SETTINGS por subconsulta se apliquen a las funciones de tabla como file en CTE y subconsultas. #96882 (Alexey Milovidov).
  • Se corrigió una fuga de memoria en objetos BIO al leer certificados X509. #96885 (Alexey Milovidov).
  • Se corrige la excepción LOGICAL_ERROR en el analizador de consultas cuando se pasa una expresión lambda donde se espera un valor concreto (p. ej., como argumento acumulador de arrayFold). #96892 (Alexey Milovidov).
  • Se corrige la excepción ColumnNullable is not compatible with original al convertir tipos anidados complejos (Array de Tuple Nullable que contiene Map con valores Enum Nullable). #96924 (Alexey Milovidov).
  • Se corrige una condición de carrera en la carga paralela del diccionario HASHED segmentado que, en ocasiones, podía hacer que algunas filas no se cargaran. #96953 (Alexey Milovidov).
  • Se corrigió una condición de carrera entre REPLACE PARTITION y las mutaciones en segundo plano que podía hacer que tanto los datos antiguos como los nuevos se vieran después del reemplazo. #96955 (Alexey Milovidov).
  • Se corrigió un problema en la función arrayJoin que producía filas duplicadas cuando se usaba con INNER JOIN y la cláusula WHERE, debido a que la optimización parcial de push-down de predicados enviaba incorrectamente por debajo de un JOIN los filtros que contenían arrayJoin. #96989 (Alexey Milovidov).
  • Corrige un fallo (SEGFAULT) en clearCaches causado por que BlockIO::operator= no movía query_metadata_cache, lo que provocaba la destrucción prematura de instantáneas de almacenamiento en caché y un acceso a memoria ya liberada en el almacenamiento MergeTreeData. #96995 (Alexey Milovidov).
  • Se corrige un fallo de aserción en IfTransformStringsToEnumPass cuando la función if o transform devuelve Nullable(String) (p. ej., con GROUP BY ... WITH CUBE y group_by_use_nulls = true). #97002 (Alexey Milovidov).
  • Se corrigen los datos incorrectos escritos durante INSERT ... SELECT con UNION ALL y JOIN, donde las columnas de texto constantes podían recibir valores erróneos tras la compactación de bloques. #97019 (Hasyimi Bahrudin).
  • Se corrige la excepción de assert_cast (o la corrupción silenciosa de datos en compilaciones release) al generar estadísticas de columnas después de que ALTER TABLE MODIFY COLUMN cambie el tipo de la columna. #97027 (Alexey Milovidov).
  • Se corrigen lecturas de memoria sin inicializar en Azure Blob Storage, el protocolo SSH y las interfaces de Arrow Flight. #97053 (Alexey Milovidov).
  • Se corrigen los casos en los que los índices afectaban al resultado de las consultas con row policy/PREWHERE y FINAL. #97076 (Yarik Briukhovetskyi).
  • Corrige la condición de carrera restante entre REPLACE PARTITION y las mutaciones en segundo plano en tablas MergeTree, que podía provocar la reaparición de datos antiguos. #97105 (Alexey Milovidov).
  • Corregir los índices implícitos con columnas con alias y realizar una validación completa antes de crearlos. #97115 (Raúl Marín).
  • Se corrige un error lógico en FunctionVariantAdaptor con funciones que requieren argumentos const, como arrayROCAUC. #97116 (Bharat Nallan).
  • Corregir las mutaciones atascadas cuando PartCheckThread vuelve a encolar un GET_PART para una parte ya mutada, lo que deja entradas fantasma en parts_to_do. #97162 (Alexey Milovidov).
  • Se corrige la estimación del número de filas del plan de consulta para subconsultas con ORDER BY ... LIMIT, que podía hacer que el optimizador eligiera un orden de join subóptimo. #97193 (Alexander Gololobov).
  • Se corrige la excepción LOGICAL_ERROR en FunctionVariantAdaptor cuando una función que opera sobre columnas Variant devuelve el tipo Nothing, lo que puede ocurrir con Arrays vacíos en consultas UNION ALL. #97213 (Alexey Milovidov).
  • Se corrige una condición de carrera durante las operaciones de copia multiparte en S3 (por ejemplo, durante BACKUP/RESTORE en S3) que podía provocar excepciones en caso de acceso concurrente. #97227 (Azat Khuzhin).
  • Se corrige la excepción LOGICAL_ERROR cuando arrayJoin en la cláusula WHERE hace referencia a columnas de ambos lados de un JOIN. #97239 (Alexey Milovidov).
  • Se corrigió la excepción LOGICAL_ERROR al leer la subcolumna .size de un Nullable(String) disperso en una Tuple con PREWHERE. #97264 (Alexey Milovidov).
  • Se corrige la excepción “El número de filas en el fragmento diferido no coincide con el número de desplazamientos” en LazyMaterializingTransform al leer tablas con granularidad de índice no adaptativa (index_granularity_bytes = 0) usando ORDER BY ... LIMIT. #97270 (Alexey Milovidov).
  • Corrige que SYSTEM RESTART REPLICA pierda una tabla de la base de datos cuando falla la recreación de la tabla con una excepción no relacionada con ZooKeeper (p. ej., límite de memoria), lo que provoca desajustes en el hash de metadatos en DatabaseReplicated. #97276 (Alexey Milovidov).
  • El campo readonly de system.merge_tree_settings ahora refleja correctamente que ciertas configuraciones de MergeTree (por ejemplo, index_granularity) son incondicionalmente de solo lectura. #97277 (Robert Schulze).
  • Se corrigió un cierre inesperado durante la optimización de count() en tablas MergeTree cuando el snapshot de almacenamiento se creó sin datos. #97281 (Pablo Marcos).
  • Corrige un posible fallo al resolver los nombres de las funciones a partir de la información de depuración de las trazas de pila. #97294 (Azat Khuzhin).
  • Soluciona un error lógico con analyzer_compatibility_join_using_top_level_identifier y las columnas ALIAS. Cierra #96228. #97297 (Vladimir Cherkasov).
  • Se corrigió la excepción LOGICAL_ERROR en applyOrder al usar columnas con índice de texto con la cláusula QUALIFY. #97313 (Alexey Milovidov).
  • La tabla del sistema system.functions ahora muestra categories = 'Internal' para las funciones internas, en lugar de categories = ''. #97315 (Robert Schulze).
  • La consulta con una secuencia de RIGHT JOIN y réplicas paralelas habilitadas puede producir un resultado incorrecto. Corrige #74341. #97316 (Igor Nikonov).
  • Se corrigen errores TABLE_UUID_MISMATCH espurios que podían producirse con vistas materializadas actualizables y en otros casos en los que se cambia el nombre de las tablas. #97323 (Azat Khuzhin).
  • Se corrige un segfault en la copia de seguridad de StorageKeeperMap debido al uso de un puntero de almacenamiento colgante tras liberarlo en el lote de copia de seguridad diferido. #97336 (Alexey Milovidov).
  • Se corrige la función exists con una subconsulta escalar dentro de un ALTER UPDATE/DELETE cuando mutations_execute_subqueries_on_initiator está habilitado. La subconsulta escalar se evaluaba de forma incorrecta, lo que podía provocar un error o un comando de mutación corrupto que hiciera que la tabla no pudiera cargarse en el siguiente reinicio del servidor. #97347 (Kirill Kopnev).
  • Se corrige la excepción lógica Unexpected return type from equals. Expected Nullable(UInt8). Got Const(LowCardinality(Nullable(UInt8))) al comparar NULL con una columna Variant que contiene tipos de LowCardinality. #97379 (Alexey Milovidov).
  • Se corrige una posible condición de carrera cuando EXCHANGE TABLES se ejecuta en paralelo con la caché de consultas por segmentos habilitada. #97411 (Konstantin Vedernikov).
  • Corrige la excepción LOGICAL_ERROR en la conversión de Array a QBit cuando nullable_source de un envoltorio Tuple externo reemplaza la columna de array convertida por una columna de tipo incompatible. Cierra #97389. #97413 (Alexey Milovidov).
  • Corrige una inconsistencia en el formateo del AST al reconstruir literales de tupla con alias entre paréntesis; por ejemplo, (('a', 'b') AS x) se reformateaba incorrectamente como tuple(('a', 'b') AS x). #97418 (Alexey Milovidov).
  • Corrige una excepción durante las inserciones asíncronas con deduplicación cuando un error de análisis producía un bloque vacío con cero filas. #97460 (Sema Checherinda).
  • Se corrige la excepción “El número de filas en el fragmento diferido no coincide con el número de desplazamientos” en LazyMaterializingTransform al leer tablas con granularidad de índice no adaptativa (index_granularity_bytes = 0) mediante ORDER BY ... LIMIT. #97482 (Alexey Milovidov).
  • Corrige la configuración de inserción en Iceberg. Añade un alias para la opción allow_experimental_insert_into_iceberg. #97483 (Konstantin Vedernikov).
  • Se corrige ACCESS_DENIED para los usuarios sin el permiso CREATE TEMPORARY TABLE cuando la optimización optimize_inverse_dictionary_lookup reescribe los predicados dictGet(...). ClickHouse ahora omite esa reescritura y ejecuta la expresión original. Cierra #97269. #97484 (Nihal Z. Miaji).
  • Corrige un error de aserción (excepción en compilaciones de depuración o con sanitizador) en Set y MergeTreeIndexSet al procesar columnas con subcolumnas dispersas internas (p. ej., columnas Tuple de partes de MergeTree con distintos perfiles de serialización dispersa). #97493 (Alexey Milovidov).
  • Corrige un posible uso de memoria después de liberarla en StorageKafka2. #97520 (Bharat Nallan).
  • Se corrige el uso de INTO OUTFILE con TRUNCATE y la opción into_outfile_create_parent_directories cuando la ruta de salida contiene directorios. #97549 (Alexey Milovidov).
  • Se corrigió el error BAD_ARGUMENTS al consultar tablas con expresiones lambda dentro de columnas ALIAS mediante la table function merge() con el analizador habilitado. #97551 (Alexey Milovidov).
  • Se corrige la excepción de system.zookeeper_info cuando el zxid de Keeper es 0. #97553 (Alexey Milovidov).
  • Corrige un posible error lógico en el diccionario ip_trie cuando el tipo de clave no es String. #97555 (Bharat Nallan).
  • Se corrigió un problema por el que la autenticación OAuth del catálogo REST no funcionaba para el RestCatalog base (solo funcionaba para catálogos derivados como OneLakeCatalog). Esto rompió el catálogo REST predeterminado tras la introducción del catálogo BigLake. #97561 (Konstantin Vedernikov).
  • Las funciones de Geometry (perimeterSpherical, areaSpherical, etc.) ahora aceptan subtipos geométricos individuales (Polygon, Ring, Point, etc.), además del tipo Variant Geometry. #97571 (Alexey Milovidov).
  • Se corrige la excepción LOGICAL_ERROR al usar isNull/isNotNull sobre subcolumnas de tipos Nullable(Tuple(... Nullable(T) ...)). Cierra #97224. #97582 (Alexey Milovidov).
  • Corrige la desreferenciación de un puntero nulo al aplicar partes de parche durante las actualizaciones ligeras. #97583 (Alexey Milovidov).
  • BaseSettings::readBinary pasa el índice de accessor.find a field_infos[] sin comprobar el valor centinela que indica que no se encontró (es decir, -1), lo que puede provocar un acceso fuera de los límites de std::vector. El problema se detectó gracias al endurecimiento de libcxx. Esto probablemente ocurrió durante la deserialización del plan de consulta, cuando un servidor más reciente envía un ajuste que un servidor más antiguo no reconoce. El método de lectura basado en cadenas ya gestiona esto correctamente; a readBinary le faltaba esa misma comprobación. #97585 (Miсhael Stetsyuk).
  • Corrige resultados incorrectos en consultas UNION ALL en las que una rama tenía un predicado siempre falso: la rama leía datos indebidamente en lugar de no devolver nada. #97620 (Bharat Nallan).
  • Se corrigió el fallo de IN (col) con una referencia de una sola columna que provocaba el error UNSUPPORTED_METHOD. #97646 (Alexey Milovidov).
  • Se corrigió la excepción por error lógico durante GROUP BY ... WITH ROLLUP/CUBE cuando las claves incluyen LowCardinality(Nullable(...)) dentro de Nullable(Tuple(...)). #97647 (Alexey Milovidov).
  • Se corrigió una inconsistencia en el formato del AST para NOT (1, 1, 1) que podía provocar LOGICAL_ERROR en builds de depuración. #97653 (Alexey Milovidov).
  • Corrige la excepción de keeper-converter al encontrarse con archivos de registro de transacciones de ZooKeeper vacíos. #97673 (Alexey Milovidov).

Mejora en compilación/pruebas/empaquetado

  • ClickHouse puede compilarse con clang-23 (master). #95578 (Alexey Milovidov).
  • Se corrige is_local para forzarlo a false cuando bind_host está configurado, y se sustituye por una prueba de integración. Seguimiento de #74741. #93109 #96018 (Zhigao Hong).
  • Pruebas de estrés: se corrigen las pruebas de estrés y de actualización en CI. se ignoran las etiquetas no-{build}. se añade aleatorización de compatibilidad. #94693 (Nikita Fomichev).
  • Publicar el binario parser_memory_profiler de la compilación. La herramienta puede usarse para analizar el consumo de memoria del AST. #95826 (Ilya Yatsishin).
  • Se agregó la marca --symbolize para la herramienta parser_memory_profiler, que genera archivos .heap.sym con los símbolos resueltos en la salida. #96477 (Ilya Yatsishin).
  • Se fijan las imágenes de Docker de terceros en versiones específicas para las pruebas de integración. #96500 (Alexey Milovidov).
  • Se vuelve a habilitar la posibilidad de enlazar OpenSSL dinámicamente. No se recomienda y no se utiliza en ninguna compilación de producción, pero la opción sigue existiendo para los entusiastas de internet. #96506 (Govind R Nair).
  • Reduce el rango de magic_enum de [-100, 1000] al valor predeterminado [-128, 127] mediante una especialización por tipo para Coordination::OpNum, lo que mejora el tiempo de compilación. #96632 (Alexey Milovidov).
  • Se eliminaron los templates de C++ innecesarios de las clases Function para reducir los tiempos de compilación. #96646 (Alexey Milovidov).
  • Se traslada la generación de StorageSystemLicenses a la fase de configuración para mejorar el paralelismo de la compilación. #96697 (Alexey Milovidov).
  • Se paraleliza el escaneo de licencias. #96727 (Raúl Marín).
  • Añadida una prueba funcional sin estado para el soporte del protocolo SSH. #96996 (Alexey Milovidov).
  • Se añadió Kafka 3.9.0 a la infraestructura de pruebas funcionales sin estado, lo que permite probar directamente los motores de tabla Kafka y Kafka2 usando ClickHouse Keeper como ZooKeeper. Seis nuevas pruebas sin estado cubren las operaciones básicas de producción y consumo, las columnas virtuales, INSERT, varios formatos, la gestión de mensajes corruptos y el almacenamiento de offsets basado en Keeper. #96997 (Alexey Milovidov).
  • Se añade un flujo de trabajo de CI para compilar una toolchain de clang optimizada con PGO+BOLT. #96991 (Alexey Milovidov).
  • Usar la compilación de LLVM/Clang optimizada con PGO en CI, lo que debería mejorar la velocidad de compilación entre un 20 y un 30 %. #97031 (Alexey Milovidov).
  • Se reemplazan las funciones matemáticas de glibc por implementaciones de llvm-libc. #90151 (Konstantin Bogdanov).
  • Se actualiza Boost de 1.83 a 1.90 y se corrige un fallo de aserción de devector en compilaciones de depuración. #97037 (Alexey Milovidov).
  • Se actualizó postgres a REL_18_1. #95189 (Konstantin Bogdanov).
  • Se usa libexpat 2.7.3. #95218 (Konstantin Bogdanov).
  • Usar OpenSSL 3.5.5. #95345 (Konstantin Bogdanov).
  • Se usa simdjson v4.2.4. #97129 (Konstantin Bogdanov).
  • Se usa libarchive 3.8.5. #97131 (Konstantin Bogdanov).
  • Se usa fast_float v8.2.3. #97133 (Konstantin Bogdanov).
  • Usar abseil-cpp 20260107.1 y actualizar s2geometry a la versión v0.13.1. #97134 (Konstantin Bogdanov).
  • Aumenta libxml2 a 2.15.1. #95574 (Robert Schulze).
  • Se actualizaron 7 imágenes de Docker para pruebas de integración de Tier-3, sustituyendo imágenes base obsoletas (EOL) o retiradas por versiones compatibles actuales. #97314 (Rahul).
  • Se añaden consultas del benchmark TPC-DS. #97349 (Raufs Dunamalijevs).
  • Sustituye las opciones individuales de CMake para el conjunto de instrucciones x86 (ENABLE_SSSE3, ENABLE_AVX2, NO_SSE3_OR_HIGHER, ARCH_NATIVE, etc.) por una única opción numérica X86_ARCH_LEVEL (1/2/3/4), en línea con los niveles estándar de microarquitectura x86-64 ya utilizados por el sistema de despacho en runtime. #97354 (Raúl Marín).
  • Se evita instanciar variantes de plantilla de division_by_nullable=true para operaciones que no son de división en FunctionBinaryArithmetic, lo que reduce el tiempo de compilación y el tamaño del binario. #97496 (Raúl Marín).
  • Reduce la huella de inclusión de Exception.h eliminándolo de archivos de cabecera muy referenciados, como typeid_cast.h, assert_cast.h, Context_fwd.h, IDataType.h y varios archivos de cabecera de Column. #97497 (Raúl Marín).
  • Use siempre las cabeceras integradas de compiler-rt (sanitizador y las interfaces de XRay) en lugar de las cabeceras del compilador del sistema, y compile de forma predeterminada las bibliotecas compiler-rt a partir del código fuente. #97499 (Raúl Marín).
  • Se evita incluir las cabeceras de boost/multiprecision en wide_integer_impl.h en plataformas con un long double adecuado, lo que mejora el tiempo de compilación. #96633 (Alexey Milovidov).
  • Implementar el job de cobertura de código con LLVM y habilitarlo inicialmente para la rama master. #90952 (Alexey Bakharew).
  • Se habilita el hardening rápido de libcxx para las compilaciones de release. Esto es necesario principalmente para las comprobaciones de acceso fuera de límites. Dados los resultados de las pruebas de rendimiento, no se espera ningún impacto perceptible en el rendimiento. #94757 (Miсhael Stetsyuk).

Lanzamiento de ClickHouse 26.1, 2026-01-29. Presentación, Vídeo

Cambio incompatible con versiones anteriores

  • Corrige el formato inconsistente causado por una sustitución incorrecta de alias en el formateador. Esto cierra #82833. Esto cierra #82832. Esto cierra #68296. Este cambio podría no ser compatible con versiones anteriores: cuando el analizador está deshabilitado, ciertas consultas CREATE VIEW con IN que hacen referencia a un alias no pueden procesarse. Para evitar esta incompatibilidad, habilite el analizador (está habilitado de forma predeterminada desde la versión 24.3). #82838 (Alexey Milovidov).
  • Los códecs DEFLATE_QPL y ZSTD_QAT se eliminaron. Se recomienda a los usuarios convertir los datos existentes comprimidos con DEFLATE_QPL o ZSTD_QAT a otro códec antes de actualizar. Tenga en cuenta que, para usar estos códecs, era necesario habilitar los ajustes enable_deflate_qpl_codec y enable_zstd_qat_codec. #92150 (Robert Schulze).
  • Mejora la depuración de UDF al habilitar la captura de stderr en system.query_log.exception. Anteriormente, el stderr de las UDF solo se registraba en archivos y no se exponía en los registros de consultas, lo que hacía imposible la depuración. Ahora, stderr genera excepciones de forma predeterminada y se acumula por completo (hasta 1 MB) antes de lanzarse, por lo que las trazas completas de Python y los mensajes de error aparecen en system.query_log.exception, lo que facilita una solución eficaz de problemas. #92209 (Xu Jia).
  • La lista vacía de columnas en la cláusula JOIN USING () ahora se considera un error de sintaxis. Anteriormente, debía producir INVALID_JOIN_ON_EXPRESSION durante la ejecución de la consulta. En algunos casos, como al realizar un join con el motor de almacenamiento Join, esto provocaba LOGICAL_ERROR; cierra el issue #82502. #92371 (Vladimir Cherkasov).
  • Utiliza la coincidencia parcial para SKIP REGEXP en el tipo JSON de forma predeterminada. Cierra #79250. #92847 (Pavel Kruglov).
  • Se revierte “Allow INSERT into simple ALIAS columns” (revierte ClickHouse/ClickHouse#84154). No funciona con formatos personalizados y no está protegido por ninguna configuración. #92849 (Azat Khuzhin).
  • Configuración para devolver un error si un catálogo de lago de datos no tiene acceso al almacenamiento de objetos. #93606 (Konstantin Vedernikov).
  • Se ha eliminado el motor de base de datos Lazy y ya no está disponible. Cierra #91231. #93627 (Alexey Milovidov).
  • Se elimina el modo transposed_with_wide_view de metric_log, ya que no se puede usar debido a un error. Ya no es posible definir system.metric_log con este modo. Esto revierte parcialmente #78412. #93867 (Alexey Milovidov).
  • La planificación de CPU para las cargas de trabajo ahora es preventiva de forma predeterminada. Consulte la configuración del servidor cpu_slot_preemption. #94060 (Sergei Trifonov).
  • Se escapan los nombres de archivo de los índices para evitar partes dañadas. Con este cambio, ClickHouse no podrá cargar índices con caracteres no ASCII en su nombre creados por versiones anteriores. Para resolverlo, puede usar la configuración de MergeTree escape_index_filenames. #94079 (Raúl Marín).
  • Las configuraciones de formato exact_rows_before_limit, rows_before_aggregation, cross_to_inner_join_rewrite, regexp_dict_allow_hyperscan, regexp_dict_flag_case_insensitive, regexp_dict_flag_dotall y dictionary_use_async_executor pasaron a ser configuraciones normales (no de formato). Se trata de un cambio puramente interno, sin efectos visibles para el usuario, salvo en el caso (poco probable) de que haya especificado alguna de estas configuraciones en definiciones de table engine de Iceberg o DeltaLake o Kafka o S3 o S3Queue o Azure o Hive o RabbitMQ o Set o FileLog o NATS. En esos casos, estas configuraciones antes se ignoraban; ahora, esas definiciones generan un error. #94106 (Robert Schulze).
  • Las funciones joinGet/joinGetOrNull ahora exigen privilegios SELECT sobre la tabla Join subyacente. Después de este cambio, ejecutar joinGet('db.table', 'column', key) requiere que el usuario tenga el privilegio SELECT tanto sobre las columnas clave definidas en la tabla Join como sobre la columna de atributo recuperada. Las consultas que no cuenten con estos privilegios fallarán con ACCESS_DENIED. Para migrar, otorgue los permisos necesarios mediante GRANT SELECT ON db.join_table TO user para acceso completo a la tabla, o GRANT SELECT(key_col, attr_col) ON db.join_table TO user para acceso a nivel de columna. Este cambio afecta a todos los usuarios y aplicaciones que dependen de joinGet/joinGetOrNull en los casos en que antes no se hubieran configurado privilegios SELECT explícitos. #94307 (Vladimir Cherkasov).
  • Se comprueba SHOW COLUMNS para las consultas CREATE TABLE ... AS .... Anteriormente, se comprobaba SHOW TABLES, lo que supone un privilegio incorrecto para este tipo de comprobación de permisos. #94556 (pufit).
  • Hacer que el formato de salida Hash sea independiente del tamaño de los bloques. #94503 (Alexey Milovidov). Tenga en cuenta que esto cambia los valores hash de salida con respecto a las versiones anteriores.

Nueva funcionalidad

  • API HTTP y Web UI integrada para ClickHouse Keeper. #78181 (pufit y speeedmaster).
  • La deduplicación de async insert ahora funciona con vistas materializadas dependientes. Cuando se produce una colisión por block_id, el bloque original se filtra para eliminar las filas asociadas a ese block_id, y las filas restantes se transforman con todas las consultas SELECT de las vistas materializadas pertinentes; esto reconstruye el bloque original sin las filas en conflicto. #89140 (Sema Checherinda). Se permite usar deduplicación con async inserts cuando intervienen vistas materializadas. #93957 (Sema Checherinda).
  • Se introdujeron una nueva sintaxis y un nuevo framework para simplificar y ampliar la funcionalidad de los índices de proyección. Esto da continuidad a https://github.com/ClickHouse/ClickHouse/pull/81021. #91844 (Amos Bird).
  • Se añade soporte para índices de texto en columnas Array. #89895 (Jimmy Aguilar Mena).
  • Se habilita use_variant_as_common_type de forma predeterminada, lo que permite usar tipos incompatibles dentro de un Array, en consultas UNION y en las ramas de if/multiIf/case. #90677 (Alexey Milovidov).
  • Nueva tabla del sistema zookeeper_info. Implementa #88014. #90809 (Smita Kulkarni).
  • Se admite el tipo Variant en todas las funciones. #90900 (Bharat Nallan).
  • Agrega una métrica ClickHouse_Info al endpoint /metrics de Prometheus que contiene principalmente información sobre la versión, lo que permite crear gráficos para seguir información detallada de la versión a lo largo del tiempo. #91125 (Christoph Wurm).
  • Se introduce un nuevo comando rcfg de cuatro letras para Keeper que permite cambiar la configuración del clúster. Este comando ofrece más posibilidades para modificar la configuración que la solicitud estándar reconfigure. El comando recibe una cadena json como argumento. El conjunto completo de bytes enviados a la interfaz TCP debe tener este aspecto: rcfg{json_string_length_big_endian}{json_string}. Algunos ejemplos del comando podrían ser así: {"preconditions": {"leaders": [1, 2], "members": [1, 2, 3, 4, 5]}, "actions": [{"transfer_leadership": [3]}, {"remove_members": [1, 2]}, {"set_priority": [{"id": 4, "priority": 100}, {"id": 5, "priority": 100}]}, {"transfer_leadership": [4, 5]}, {"set_priority": [{"id": 3, "priority": 0}]}]}. #91354 (alesapin).
  • Se agrega la función reverseBySeparator, que invierte el orden de las subcadenas de una cadena delimitadas por un separador especificado. Cierra #91463. #91780 (Xuewei Wang).
  • Añade la nueva configuración max_insert_block_size_bytes, que permite un control más preciso de la formación de los bloques insertados. #92833 (Kirill Kopnev).
  • Es posible ejecutar consultas DDL con la cláusula ON CLUSTER en una base de datos Replicated si está habilitada la configuración ignore_on_cluster_for_replicated_database. En este caso, se ignorará el nombre del clúster. #92872 (Kirill).
  • Se implementó la función mergeTreeAnalyzeIndexes. #92954 (Azat Khuzhin).
  • Se agregó la nueva configuración use_primary_key. Establézcala en false para desactivar la poda de gránulos según la clave primaria. #93319 (Nihal Z. Miaji).
  • Se añadió la función de tabla icebergLocalCluster. #93323 (Anton Ivashkin).
  • Se añadió la función cosineDistanceTransposed, que aproxima la distancia de coseno entre dos puntos. #93621 (Raufs Dunamalijevs).
  • Se añade la columna files a la tabla system.parts, que muestra el número de archivos en cada parte de datos. #94337 (Match).
  • Añade un scheduler max-min fair para el control de la concurrencia. Proporciona una mayor equidad en situaciones de sobreasignación elevada, cuando muchas consultas compiten por slots de CPU limitados. Las consultas de corta duración no se ven penalizadas por las de larga duración, que han acumulado más slots con el tiempo. Se habilita con el valor max_min_fair de la configuración de servidor concurrent_threads_scheduler. #94732 (Sergei Trifonov).
  • Se añadió la posibilidad de que ClickHouse client sobrescriba el SNI de TLS al conectarse al servidor. #89761 (Matt Klein).
  • Admite tablas temporales en las llamadas a la función joinGet. #92973 (Eduard Karacharov).
  • Admite vectores de eliminación en el motor de tabla DeltaLake. #93852 (Kseniia Sumarokova).
  • Se admiten vectores de eliminación en deltaLakeCluster. #94365 (Kseniia Sumarokova).
  • Compatibilidad con Google Cloud Storage para lagos de datos. #93866 (Konstantin Vedernikov).

Funcionalidad experimental

Mejora del rendimiento

  • La configuración use_skip_indexes_on_data_read ahora está habilitada de forma predeterminada. Esta configuración permite filtrar de forma continua al mismo tiempo que se leen los datos, lo que mejora el rendimiento de las consultas y el tiempo de arranque. #93407 (Shankar Iyer).
  • Mejora el rendimiento de DISTINCT en las columnas LowCardinality. Cierra #5917. #91639 (Nihal Z. Miaji).
  • Optimizar la función de agregación distinctJSONPaths para que lea únicamente las rutas JSON de las partes de datos, en lugar de toda la columna JSON. #92196 (Pavel Kruglov).
  • Más filtros aplicados con pushdown en JOINs. #85556 (Nikita Taranov).
  • Se amplía la compatibilidad con más casos de push down desde la condición ON del join cuando el filtro usa entradas de un solo lado. Se admiten joins ANY, SEMI y ANTI. #92584 (Dmitry Novik).
  • Permite usar conjuntos equivalentes para hacer push down de filtros en SEMI JOIN. Cierra #85239. #92837 (Dmitry Novik).
  • Omitir la lectura del lado izquierdo del hash join cuando el lado derecho está vacío. Antes leíamos el lado izquierdo hasta el primer bloque no vacío, lo que podía implicar mucho trabajo en casos con mucho filtrado o agregación. #94062 (Alexander Gololobov).
  • Uso del método “fastrange” (Daniel Lemire) para particionar datos dentro de la canalización de consultas. Esto podría mejorar la ordenación paralela y los JOINs. #93080 (Alexey Milovidov).
  • Mejora el rendimiento de las funciones de ventana cuando PARTITION BY coincide con la clave de ordenación o es un prefijo de ella. #87299 (Nikita Taranov).
  • Se hace pushdown del filtro externo en las vistas, lo que permite aplicar PREWHERE en nodos locales y remotos. Resuelve #88189. #88316 (Igor Nikonov).
  • Se implementan compilaciones JIT para más funciones. Cierra #73509. #88770 (Alexey Milovidov con Taiyang Li).
  • Si un índice de salto utilizado en una consulta FINAL está en una columna que forma parte de la clave primaria, el paso adicional para comprobar la intersección con la clave primaria en otras partes es innecesario y ya no se realiza. Resuelve #85897. #93899 (Shankar Iyer).
  • Optimiza el rendimiento y el uso de memoria de LIMIT y OFFSET fraccionarios. #91167 (Ahmed Gouda).
  • Se corrige el uso de una lógica de lectura aleatoria más rápida en el prefetcher de Parquet Reader V3. Cierra #90890. #91435 (Arsen Muk).
  • Mejora el rendimiento de icebergCluster. Cierra #91462. #91537 (Yang Jiang).
  • No filtrar por columnas virtuales con filtros constantes. #91588 (c-end).
  • Reduce el uso de memoria de INSERT/merges con wide parts en tablas muy anchas al habilitar búferes de escritura adaptativos. Añade compatibilidad con búferes de escritura adaptativos para discos cifrados. #92250 (Azat Khuzhin).
  • Se mejoró el rendimiento de la búsqueda de texto completo con índice de texto y el tokenizador sparseGrams al reducir el número de tokens buscados en el índice. #93078 (Anton Popov).
  • La función isValidASCII se optimizó para casos positivos, es decir, valores de entrada compuestos únicamente por caracteres ASCII. #93347 (Robert Schulze).
  • La optimización de lectura en orden ahora detecta cuándo las columnas de ORDER BY son constantes debido a las condiciones de WHERE, lo que permite realizar lecturas eficientes en orden inverso. Esto beneficia a consultas multi-tenant como WHERE tenant='42' ORDER BY tenant, event_time DESC, que ahora pueden usar InReverseOrder en lugar de requerir una ordenación completa.”. #94103 (matanper).
  • Se introduce una clase especializada del AST de enum para almacenar parámetros de valor como pares (cadena, entero) en lugar de nodos ASTLiteral, con el fin de optimizar el consumo de memoria. #94178 (Ilya Yatsishin).
  • Análisis distribuido de índices en varias réplicas. Resulta beneficioso para el almacenamiento compartido y para grandes volúmenes de datos en un clúster. Esto se aplica a SharedMergeTree (ClickHouse Cloud) y podría aplicarse a otros tipos de tablas MergeTree sobre almacenamiento compartido. #86786 (Azat Khuzhin).
  • Reducir la sobrecarga de los filtros de runtime de join deshabilitándolos en los siguientes casos: - hay demasiados bits activados en el filtro bloom - se filtran muy pocas filas en runtime. #91578 (Alexander Gololobov).
  • Se usa un búfer en memoria para la entrada de subconsultas correlacionadas para evitar evaluarla varias veces. Parte de #79890. #91205 (Dmitry Novik).
  • Permite que todas las réplicas tomen rangos huérfanos durante la lectura con réplicas en paralelo. Esto mejora el equilibrio de carga y reduce la latencia en la cola larga. #91374 (zoomxi).
  • Las operaciones externas de agregación, ordenación y join ahora respetan la configuración de consulta temporary_files_codec en todos los contextos. Se corrigieron los eventos de perfil ausentes para grace hash join. #92388 (Vladimir Cherkasov).
  • Mejorar la robustez de la detección del uso de memoria de las consultas para el volcado a disco durante la agregación/ordenación. #92500 (Azat Khuzhin).
  • Estimar el recuento total de filas y las estadísticas de NDV (número de valores distintos) de las columnas de la clave de agregación. #92812 (Alexander Gololobov).
  • Optimiza la compresión de las listas de postings con simdcomp. #92871 (Peng Jian).
  • Se refactorizó el procesamiento del modo Ordered de S3Queue con buckets. Esto también debería mejorar el rendimiento al reducir el número de solicitudes a Keeper. #92889 (Kseniia Sumarokova).
  • Las funciones mapContainsKeyLike y mapContainsValueLike ahora pueden usar un índice de texto en mapKeys() o mapValues(), respectivamente. #93049 (Michael Jarrett).
  • Reduce el uso de memoria en sistemas no Linux (habilita la purga inmediata de las páginas sucias de jemalloc). #93360 (Eduard Karacharov).
  • Forzar el purgado de las arenas de jemalloc en caso de que la proporción entre el tamaño de las páginas sucias y max_server_memory_usage supere memory_worker_purge_dirty_pages_threshold_ratio. #93500 (Eduard Karacharov).
  • Reduce el uso de memoria para AST. #93601 (Nikolai Kochetov).
  • En algunos casos, hemos visto que ClickHouse no respeta el límite de memoria al leer desde una tabla. Se ha corregido este comportamiento. #93715 (Nikita Mikhaylov).
  • Se habilitan de forma predeterminada las extensiones CHECK_STAT y TRY_REMOVE de Keeper. #93886 (Mikhail Artemenko).
  • Analizar los límites inferior y superior de los nombres de archivo correspondientes a los borrados posicionales en las entradas del archivo de manifiesto de Iceberg para seleccionar mejor los archivos de datos correspondientes. #93980 (Daniil Ivanik).
  • Agrega dos ajustes más para controlar el número máximo de subcolumnas dinámicas en una columna JSON. El primero es el ajuste de MergeTree merge_max_dynamic_subcolumns_in_compact_part (similar al ya añadido merge_max_dynamic_subcolumns_in_wide_part) que limita el número de subcolumnas dinámicas creadas durante la fusión en una parte Compact. El segundo es el ajuste a nivel de consulta max_dynamic_subcolumns_in_json_type_parsing, que limita el número de subcolumnas dinámicas creadas durante el análisis de datos JSON; permitirá especificar el límite en la inserción. #94184 (Pavel Kruglov).
  • Se optimiza ligeramente la compactación de columnas de tipo JSON en algunos casos. #94247 (Pavel Kruglov).
  • Reduzca el tamaño de las colas del pool de hilos en función de la experiencia en producción. Añada una comprobación explícita del consumo de memoria antes de leer cualquier dato de MergeTree. #94692 (Nikita Mikhaylov).
  • Asegúrese de que el planificador dé prioridad al hilo MemoryWorker cuando haya escasez de CPU, ya que protege el proceso de ClickHouse frente a una amenaza existencial. #94864 (Nikita Mikhaylov).
  • Ejecutar la purga de páginas sucias de jemalloc en un hilo distinto del hilo principal de MemoryWorker. Si la purga es lenta, podría retrasar la actualización del uso de RSS, lo que podría hacer que el proceso se finalice por falta de memoria. Se introduce una nueva configuración memory_worker_purge_total_memory_threshold_ratio para iniciar la purga de páginas sucias según la proporción del uso total de memoria. #94902 (Antonio Andelic).

Mejora

  • system.blob_storage_log ahora está disponible para Azure Blob Storage. #93105 (Alexey Milovidov).
  • Implementar blob_storage_log para Local y HDFS. Corregir un error cuando S3Queue utilizaba algo distinto del nombre del disco para registrar en blob_storage_log. Añadir la columna error_code a blob_storage_log. Dividir el archivo de configuración de pruebas para simplificar las pruebas en local. #93106 (Alexey Milovidov).
  • clickhouse-client y clickhouse-local resaltarán grupos de dígitos (miles, millones, etc.) dentro de los literales numéricos al escribir. Esto cierra #93100. #93108 (Alexey Milovidov).
  • Añade compatibilidad en clickhouse-client con argumentos de línea de comandos que tienen espacios alrededor del signo igual. Cierra #93077. #93174 (Cole Smith).
  • Con <interactive_history_legacy_keymap>true</interactive_history_legacy_keymap>, el cliente de la CLI ahora puede volver a usar Ctrl-R para la búsqueda normal, como antes, mientras que Ctrl-T realiza una búsqueda difusa. #87785 (Larry Snizek).
  • La sentencia para limpiar cachés SYSTEM DROP [...] CACHE daba la falsa impresión de que desactivaba la caché. ClickHouse ahora admite la sentencia SYSTEM CLEAR [...] CACHE, que resulta más clara. La sintaxis anterior sigue estando disponible. #93727 (Pranav Tiwari).
  • Permite usar varias columnas como clave primaria en EmbeddedRocksDB. Cierra #32819. #33917 (usurai).
  • Ahora ya es posible usar IN no constante con escalares (consultas como val1 NOT IN if(cond, val2, val3)). #93495 (Yarik Briukhovetskyi).
  • Evita que los encabezados x-amz-server-side-encryption se propaguen en las solicitudes S3 HeadObject, UploadPart y CompleteMultipartUpload, ya que no son compatibles. #64577 (Francisco J. Jurado Moreno).
  • Seguimiento del particionamiento de Hive en el modo ordered de S3Queue. Resuelve #71161. #81040 (Anton Ivashkin).
  • Optimiza la reserva de espacio en la caché del sistema de archivos. FileCache::collectCandidatesForEviction se ejecutará sin un bloqueo exclusivo. #82764 (Kseniia Sumarokova).
  • Permite una estrategia de rotación compuesta (tamaño + tiempo) para el log del servidor. #87620 (Jianmei Zhang).
  • El client de la CLI ahora puede especificar <warnings>false</warnings> en lugar de la opción de línea de comandos --no-warnings. #87783 (Larry Snizek).
  • Se añade compatibilidad para la función de agregación avg con valores Date, DateTime y Time como argumentos. Cierra #82267. #87845 (Yarik Briukhovetskyi).
  • La optimización use_join_disjunctions_push_down está habilitada de forma predeterminada. #89313 (Alexey Milovidov).
  • Se admiten más motores de tabla y tipos de fuentes de datos en las subconsultas correlacionadas. Cierra #80775. #90175 (Dmitry Novik).
  • Si el esquema de la vista parametrizada se especifica explícitamente, se muestra. Cierra #88875, #81385. #90220 (Grigorii Sokolik).
  • Gestiona correctamente la laguna en las entradas del log de Keeper si los logs son anteriores al último índice confirmado. #90403 (Antonio Andelic).
  • Se mejoró la configuración min_free_disk_bytes_to_perform_insert para que funcione correctamente con volúmenes JBOD. #90878 (Aleksandr Musorin).
  • Ahora se puede especificar la opción storage_class_name en las colecciones con nombre para el motor de tabla S3 y la función de tabla s3. #91926 (János Benjamin Antal).
  • Se admite la inserción en ZooKeeper auxiliar mediante system.zookeeper. #92092 (RinChanNOW).
  • Se agregan nuevas métricas para Keeper: los profile events KeeperChangelogWrittenBytes, KeeperChangelogFileSyncMicroseconds, KeeperSnapshotWrittenBytes y KeeperSnapshotFileSyncMicroseconds, así como las histogram metrics KeeperBatchSizeElements y KeeperBatchSizeBytes. #92149 (Miсhael Stetsyuk).
  • Se ha añadido una nueva configuración, trace_profile_events_list, que limita el trazado con trace_profile_event a la lista especificada de nombres de eventos. Esto permite una recopilación de datos más precisa en cargas de trabajo de gran tamaño. #92298 (Alexey Milovidov).
  • Compatibilidad con SYSTEM NOTIFY FAILPOINT para failpoints pausables. - Compatibilidad con SYSTEM WAIT FAILPOINT fp PAUSE/RESUME. #92368 (Shaohua Wang).
  • Agregar la columna creation (implícita/explícita) a system.data_skipping_indices. #92378 (Raúl Marín).
  • Permitir pasar la descripción de las columnas de las tablas dinámicas de YTsaurus a la fuente del diccionario. #92391 (MikhailBurdukov).
  • En #63985, hicimos posible especificar todos los parámetros necesarios para la configuración de TLS por puerto (consulte protocolos componibles), de modo que ya no dependemos de una configuración global de TLS. Sin embargo, la implementación sigue requiriendo implícitamente que exista una sección de configuración global openSSL.server, lo que entra en conflicto con entornos en los que se necesitan configuraciones de TLS distintas para diferentes puertos. Por ejemplo, en despliegues keeper-in-server, necesitamos configuraciones de TLS independientes para la comunicación entre instancias de Keeper y las conexiones del clickhouse client. #92457 (Miсhael Stetsyuk).
  • Se incorpora un nuevo ajuste input_format_binary_max_type_complexity que limita el número total de nodos de tipo que pueden decodificarse en formato binario para evitar payloads maliciosos. #92519 (Raufs Dunamalijevs).
  • Mostrar las tareas en ejecución en system.background_schedule_pool{,_log}. Añadir documentación. #92587 (Azat Khuzhin).
  • Ejecuta la consulta actual en la búsqueda con Ctrl+R en client si no se encuentra ninguna coincidencia en el historial. #92749 (Azat Khuzhin).
  • Se admite EXPLAIN indices = 1 como alias de EXPLAIN indexes = 1. Resuelve #92483. #92774 (Pranav Tiwari).
  • El lector de Parquet ahora permite leer columnas de tipo Tuple o Map como JSON: select x from file(f.parquet, auto, 'x JSON') funciona incluso si el tipo de la columna x en f.parquet es tuple o map. #92864 (Michael Kolupaev).
  • Se admiten tuplas vacías en el lector de Parquet. #92868 (Michael Kolupaev).
  • Se recurre a la copia en modo lectura y escritura para Azure Blob Storage cuando la copia nativa falla con BadRequest (p. ej., lista de bloques no válida). Anteriormente, esto solo se hacía para el error Unauthorized, que se observaba al copiar un blob entre distintas cuentas de almacenamiento. Pero a veces también vemos el error “The specified block list is invalid”. Así que ahora se ha actualizado la condición para recurrir a lectura y escritura en todos los fallos de la copia nativa. #92888 (Smita Kulkarni).
  • Se corrige el throttling del endpoint de metadatos de EC2 al ejecutar muchas consultas concurrentes de S3 con credenciales de perfil de instancia de EC2. Anteriormente, cada consulta creaba su propio AWSInstanceProfileCredentialsProvider, lo que provocaba solicitudes concurrentes al servicio de metadatos de EC2 y podía dar lugar a timeouts y errores HTTP response code: 403. Ahora, el proveedor de credenciales se almacena en caché y se comparte entre todas las consultas. #92891 (Sav).
  • Se ha rediseñado la configuración insert_select_deduplicate para permitir mantener la compatibilidad con versiones anteriores. #92951 (Sema Checherinda).
  • Registrar las tareas en segundo plano más lentas que la media (background_schedule_pool_log.duration_threshold_milliseconds=30) para evitar un registro excesivo de tareas. #92965 (Azat Khuzhin).
  • En versiones anteriores, algunos nombres de funciones de C++ se mostraban de forma incorrecta (“mangled”) en system.trace_log y system.symbols, y la función demangle no los procesaba correctamente. Cierra #93074. #93075 (Alexey Milovidov).
  • Se introdujo la opción de copia de seguridad backup_data_from_refreshable_materialized_view_targets para omitir la copia de seguridad de las vistas materializadas actualizables. Las RMV con estrategia de actualización APPEND siempre se respaldan. #93076 (Julia Kartseva). #93658 (Julia Kartseva)
  • Usar información de depuración mínima en lugar de no incluir información de depuración para unidades de traducción grandes, como las funciones. #93079 (Alexey Milovidov).
  • Se añadió compatibilidad con MinIO en el SDK de AWS S3 para C++ mediante la implementación de un mapeo de códigos de error para errores específicos de MinIO. Este cambio permite que ClickHouse gestione correctamente y reintente los errores del servidor de MinIO cuando se utilizan implementaciones de MinIO en lugar de AWS S3, lo que mejora la fiabilidad para los usuarios que ejecutan almacenamiento de objetos en clústeres de MinIO autogestionados. #93082 (XiaoBinMu).
  • Escribir perfiles simbolizados de jemalloc (lo que elimina la necesidad de un binario durante la generación de perfiles de heap). #93099 (Azat Khuzhin).
  • Se restauró la herramienta clickhouse git-import: fallaba con commits grandes y no válidos. Véase https://presentations.clickhouse.com/2020-matemarketing/. #93202 (Alexey Milovidov).
  • No mostrar las contraseñas del almacenamiento URL en el registro de consultas. #93245 (Konstantin Vedernikov).
  • Se añadió compatibilidad con el tipo Geometry en flipCoordinates. #93303 (Bharat Nallan).
  • Mejora la UX de SYSTEM INSTRUMENT ADD/REMOVE: usa literales String para los nombres de las funciones, parchea todas las funciones que coincidan y permite usar function_name en REMOVE. #93345 (Pablo Marcos).
  • Se añade una nueva configuración materialize_statistics_on_merge que permite activar o desactivar la materialización de estadísticas durante la fusión. El valor predeterminado es 1. #93379 (Han Fei).
  • ClickHouse ahora puede interpretar SELECT sin paréntesis alrededor de las consultas DESCRIBE SELECT. Cierra #58382. #93429 (Yarik Briukhovetskyi).
  • Añade aleatoriedad a las comprobaciones de corrección de la caché con una probabilidad determinada. #93439 (Kseniia Sumarokova).
  • Añadir la configuración type_json_allow_duplicated_key_with_literal_and_nested_object para permitir paths duplicados en JSON cuando uno es un literal y otro es un objeto anidado, por ejemplo {"a" : 42, "a" : {"b" : 42}}. Es posible que algunos datos se hayan creado antes de que se añadiera esta restricción sobre paths duplicados en https://github.com/ClickHouse/ClickHouse/pull/79317, y que ahora una manipulación posterior de esos datos provoque errores. Con esta configuración, esos datos antiguos aún pueden usarse sin errores. #93604 (Pavel Kruglov).
  • No se imprimen los valores de tipos simples en líneas separadas en Pretty JSON. #93836 (Pavel Kruglov).
  • Cuando hay muchas sentencias alter table ... modify setting ..., puede que no se adquiera el bloqueo en 5 segundos. Es mejor devolver timeout que error lógico. #93856 (Han Fei).
  • Se evita una salida excesiva ante un error de sintaxis. Antes de este cambio, se mostraba el script SQL completo, que podía contener muchas consultas. #93876 (Alexey Milovidov).
  • Cálculo correcto del tamaño en bytes de la solicitud check con estadísticas en Keeper. #93907 (Mikhail Artemenko).
  • Se añadió la configuración use_hash_table_stats_for_join_reordering para controlar si se utilizan estadísticas del tamaño de la tabla hash en tiempo de ejecución para reordenar joins. Esta configuración está habilitada de forma predeterminada, lo que conserva el comportamiento existente de collect_hash_table_stats_during_joins. #93912 (Vladimir Cherkasov).
  • Ahora los usuarios pueden ver parcialmente las opciones de configuración globales anidadas del servidor en la tabla system.server_settings (p. ej., logger.level). Esto solo cubre las opciones de configuración con una estructura fija (sin listas, enumeraciones, repeticiones, etc.). #94001 (Hechem Selmi).
  • QBit ahora se puede comparar por igualdad. #94078 (Raufs Dunamalijevs).
  • Cuando Keeper detecte un snapshot dañado o changelogs inconsistentes, que lance una excepción en lugar de abortar manualmente o limpiar los archivos automáticamente. Esto debería dar lugar a un comportamiento más seguro de Keeper, al depender de la intervención manual. #94168 (Antonio Andelic).
  • Se corrigió la posible presencia de restos en caso de que falle CREATE TABLE. #94174 (Azat Khuzhin).
  • Corrige el acceso a memoria no inicializada (un fallo en OpenSSL) cuando se usa una clave TLS protegida con contraseña. #94182 (Konstantin Bogdanov).
  • Actualiza chdig a la versión v26.1.1. #94290 (Azat Khuzhin).
  • Añade compatibilidad con un particionamiento más genérico para el modo ordered de S3Queue. #94321 (Bharat Nallan).
  • Se añadió el alias use_statistics para el ajuste allow_statistics_optimize. Esto es más coherente con los ajustes existentes use_primary_key y use_skip_indexes. #94366 (Robert Schulze).
  • Se habilitó la configuración input_format_numbers_enum_on_conversion_error para que, en la conversión de números a enums, se compruebe si el elemento existe. #94384 (Elmi Ahmadov).
  • En el modo ordered de S3(Azure)Queue, se limpian los nodos failed según los límites de seguimiento (antes esto solo se hacía en el modo Unordered, tanto para failed como para processed; ahora también se hará en Ordered, pero solo para los nodos failed). #94412 (Kseniia Sumarokova).
  • Se habilitó la gestión de acceso para el usuario default en clickhouse-local. El usuario default de clickhouse-local no tenía el privilegio access&#95;management, lo que hacía que operaciones como DROP ROW POLICY IF EXISTS fallaran con el error ACCESS_DENIED, aunque ese usuario no debería tener restricciones. #94501 (Alexey Milovidov).
  • Se habilita named collection para diccionarios y tablas de YTsaurus. #94582 (MikhailBurdukov).
  • Se añade compatibilidad con colecciones con nombre definidas mediante SQL en BACKUP/RESTORE para S3 y Azure Blob Storage. Cierra #94604. #94605 (Pablo Marcos).
  • Compatibilidad con la agrupación en buckets basada en la clave de partición para S3Queue en modo ordenado. #94698 (Bharat Nallan).
  • Añade una métrica asíncrona con el tiempo transcurrido del merge en ejecución más largo. #94825 (Raúl Marín).
  • Añadir una comprobación del archivo asociado antes de aplicar la eliminación por posición con IcebergBitmapPositionDeleteTransform. #94897 (Yang Jiang).
  • Ahora view_duration_ms muestra el tiempo durante el cual el grupo estuvo activo, no la suma de las duraciones de los hilos que contiene. #94966 (Sema Checherinda).
  • Se elimina el límite máximo del número de tokens de búsqueda en las funciones hasAnyTokens y hasAllTokens, que estaba fijado en 64. Ejemplo: SELECT count() FROM table WHERE hasAllTokens(text, ['token_1', 'token_2', [...], 'token_65']]); La consulta daría como resultado un error BAD_ARGUMENTS porque hay 65 tokens de búsqueda. Con este PR, el límite se ha eliminado por completo y la misma consulta se ejecutaría sin errores. #95152 (Elmi Ahmadov).
  • Se añade la configuración input_format_numbers_enum_on_conversion_error para que, en la conversión de números a Enums, se compruebe si el elemento existe. Cierra: #56144. #56240 (Nikolay Degterinsky).
  • Compartir recursos del analizador de formato entre la lectura del archivo de datos y del archivo de eliminación por posición en tablas Iceberg para reducir las asignaciones de memoria. #94701 (Yang Jiang).

Corrección de errores (mal funcionamiento visible para el usuario en una versión estable oficial)

  • Corrige un error por el que los manejadores de consultas predefinidas interpretaban los espacios en blanco finales como datos durante las operaciones de inserción. #83604 (Fabian Ponce).
  • Se corrige el error INCOMPATIBLE_TYPE_OF_JOIN para el almacenamiento Join cuando se aplica la optimización de outer join a inner join. Resuelve #80794. #84292 (Vladimir Cherkasov).
  • Se corrige la excepción “Invalid number of rows in Chunk” al usar hash join con allow_experimental_join_right_table_sorting activado. #86440 (yanglongwei).
  • Los nombres de archivo siempre se reemplazan por un hash en MergeTree si el sistema de archivos no distingue entre mayúsculas y minúsculas. Anteriormente, en sistemas de archivos que no distinguen entre mayúsculas y minúsculas (como MacOS), esto podía provocar corrupción de datos cuando varios nombres de columna/subcolumna diferían solo por el uso de mayúsculas y minúsculas. #86559 (Pavel Kruglov).
  • Añadir una comprobación completa de permisos durante la fase de creación de la consulta subyacente en una vista materializada. #89180 (pufit).
  • Se corrigió un fallo en la función icebergHash al usar un argumento constante. #90335 (Michael Kolupaev).
  • Corrige un error lógico cuando una mutación sin transacción modifica partes dentro de una transacción activa que finalmente se revierte. #90469 (Shaohua Wang).
  • Actualiza correctamente system.warnings después de convertir una base de datos ordinaria en una base de datos Atomic. #90473 (sdk2).
  • Corrige un error de aserción al leer un archivo Parquet, cuando una parte de una expresión prewhere se usa en otra parte de la consulta. #90635 (Max Kainov).
  • Se corrige un fallo en un clúster de un solo nodo al leer desde Iceberg en modo split-by-buckets. Cierra la issue #90913. #91553 (Konstantin Vedernikov).
  • Corrige un posible error lógico en el motor Log durante la lectura de subcolumnas. Cierra #91710. #91711 (Pavel Kruglov).
  • Se corrigió el error lógico: ‘Storage no admite transacción’ durante ATTACH AS REPLICATED. #91772 (Shaohua Wang).
  • Corrección de un problema por el que los filtros en tiempo de ejecución funcionaban incorrectamente cuando LEFT ANTI JOIN tenía una poscondición adicional. #91824 (Alexander Gololobov).
  • Corrige un error en una comparación null-safe que involucra el tipo Nothing. Cierra #91834. Cierra #84870. Cierra #91821. #91884 (Yarik Briukhovetskyi).
  • Corrige errores en la decodificación de DELTA_BYTE_ARRAY en el lector nativo de Parquet que afectaban a datos de tipo cadena muy repetitivos. #91929 (Daniel Muino).
  • Almacena en caché el esquema solo para el archivo a partir del cual se infirió en los globs, en lugar de para todos los archivos durante la inferencia del esquema. Cierra #91745. #92006 (Pavel Kruglov).
  • Corrige el error Couldn't pack tar archive: Failed to write all bytes causado por un encabezado incorrecto con el tamaño de la entrada del archivo. Soluciona #89075. #92122 (Julia Kartseva).
  • Liberar el flujo de solicitudes en insert select para evitar el cierre de la conexión HTTP. #92175 (Sema Checherinda).
  • Se corrige un error lógico en consultas con múltiples JOIN con la cláusula USING y join_use_nulls. #92251 (Vladimir Cherkasov).
  • Corrige un error lógico al reordenar join con join_use_nulls, cierra https://github.com/clickhouse/clickhouse/issues/90795. #92289 (Vladimir Cherkasov).
  • Corrige el formato inconsistente del AST de arrayElement con un literal negado. Cierra #92288 Cierra #92212 Cierra #91832 Cierra #91789 Cierra #91735 Cierra #88495 Cierra #92386. #92293 (Pavel Kruglov).
  • Se corrige un posible fallo con la configuración join_on_disk_max_files_to_merge. #92335 (Bharat Nallan).
  • issue relacionado con #https://github.com/ClickHouse/support-escalation/issues/6365. #92339 (Tuan Pham Anh).
  • Se corrige la falta de comprobación de acceso en SYSTEM SYNC FILE CACHE. Cierra #92101. #92372 (Kseniia Sumarokova).
  • Se corrigió el paso count_distinct_optimization sobre funciones de ventana y múltiples argumentos. #92376 (Raúl Marín).
  • Corrige el error “No se puede escribir en el búfer finalizado” al usar determinadas funciones de agregación con funciones de ventana. Cierra #91415. #92395 (Jimmy Aguilar Mena).
  • Corrige un error lógico al usar CREATE TABLE ... AS urlCluster() y el motor de base de datos Replicated. Cierra #92216. #92418 (Kseniia Sumarokova).
  • Hereda la configuración de la información de serialización de la parte de origen durante una mutación en MergeTree. Esto corrige un posible resultado incorrecto de la consulta sobre una parte mutada tras cambios en la serialización de los tipos de datos. #92419 (Pavel Kruglov).
  • Se corrige un posible conflicto entre una columna y una subcolumna con el mismo nombre que podía provocar el uso de una serialización incorrecta y fallos en las consultas. Cierra #90219. Cierra #85161. #92453 (Pavel Kruglov).
  • Se corrige un LOGICAL_ERROR causado por una modificación no deseada del plan de consulta al convertir un outer join en un inner join. También se flexibilizan los requisitos de la optimización para poder aplicarla en casos en los que se aplican funciones inyectivas a las claves de agregación en los joins. #92503 (János Benjamin Antal).
  • Corrige un posible error SIZES_OF_COLUMNS_DOESNT_MATCH al ordenar una columna Tuple vacía. Cierra #92422. #92520 (Pavel Kruglov).
  • Verificación de rutas tipadas incompatibles en el tipo JSON. Cierra #91577. #92539 (Pavel Kruglov).
  • Se corrigió el interbloqueo en SHOW CREATE DATABASE para la base de datos Backup. #92541 (Azat Khuzhin).
  • Usar el código de error correcto al validar el índice hypothesis. #92559 (Raúl Marín).
  • Se corrige la resolución de subcolumnas Dynamic en alias de columnas en el analizador. Anteriormente, la subcolumna Dynamic en un alias de columna se envolvía en getSubcolumn y, en algunos casos, ni siquiera podía resolverse. Cierra #91434. #92583 (Pavel Kruglov).
  • Se evita un fallo en tokens() con un segundo argumento NULL. #92586 (Raúl Marín).
  • Corrige un posible cierre inesperado provocado por una mutación in situ de las columnas const PREWHERE subyacentes. Esto podría haber ocurrido durante la reducción del tamaño de columnas (IColumn::shrinkToFit) o el filtrado (IColumn::filter), que podían activarse de forma concurrente en varios hilos. #92588 (Arsen Muk).
  • La creación y materialización de índices de texto en tablas que contienen partes de gran tamaño (más de 4.294.967.295 filas) está temporalmente deshabilitada. Esta limitación evita resultados incorrectos en las consultas, ya que la implementación actual del índice aún no admite partes tan grandes. #92644 (Anton Popov).
  • Corrige un error lógico Too large size (A) passed to allocator al ejecutar JOINs. Cierra #92043. #92667 (Yarik Briukhovetskyi).
  • Se corrige un error por el que los índices ngrambf_v1 con longitud de ngram (1.er parámetro) > 8 lanzaban una excepción. #92672 (Robert Schulze).
  • Se corrige una excepción no controlada durante la recarga en segundo plano de las colecciones con nombre cuando se usa almacenamiento de ZooKeeper. Cierra https://github.com/ClickHouse/clickhouse-private/issues/44180. #92717 (Kseniia Sumarokova).
  • Corrige la lógica incorrecta en las comprobaciones de grants de acceso con comodines. El intento anterior https://github.com/ClickHouse/ClickHouse/pull/90928 abordó una vulnerabilidad crítica, pero acabó siendo demasiado restrictivo, lo que hizo que algunas sentencias GRANT con comodines fallaran debido a revocaciones no relacionadas. #92725 (pufit).
  • Corrige un error en la lógica de omisión de datos al usar not match(...) en WHERE, que provocaba resultados incorrectos. Cierra #92492. #92726 (Nihal Z. Miaji).
  • No intente eliminar los directorios temporales al iniciar si se crea una tabla MergeTree en un disco de solo lectura. #92748 (Alexey Milovidov).
  • Se corrigió “Cannot add action to empty ExpressionActionsChain” para ALTER TABLE REWRITE PARTS (v2). #92754 (Azat Khuzhin).
  • Evita un fallo al leer desde una Connection desconectada. #92807 (Raufs Dunamalijevs).
  • Corrige el error lógico Failed to set file processing within 100 retries en el almacenamiento S3Queue en modo Ordered. Ahora se ha sustituido por una advertencia. Este error podía producirse antes de la versión 25.10 si la sesión de Keeper había expirado; sin embargo, seguirá siendo una advertencia en las versiones 25.10+, ya que aún es teóricamente posible que se produzca este error en caso de una alta concurrencia de procesamiento en modo Ordered. #92814 (Kseniia Sumarokova).
  • Antes, algunas consultas que usaban sharding por PK con una condición falsa fallaban. Ahora ya no fallan. Necesario para https://github.com/ClickHouse/ClickHouse/pull/89313. #92815 (Yarik Briukhovetskyi).
  • Se corrigió el cálculo de los tamaños sin comprimir de los índices de texto en la tabla system.parts. #92832 (Anton Popov).
  • Se corrigió el uso del índice primario en las actualizaciones ligeras que tienen una cláusula IN con subconsultas en el predicado de la cláusula WHERE. #92838 (Anton Popov).
  • Se corrigió la creación de la indicación de tipo para la ruta ‘skip’ en JSON. Cierra #92731. #92842 (Pavel Kruglov).
  • En el motor de tabla S3, debemos evitar almacenar en caché la clave de partición si hay funciones no deterministas. #92844 (Miсhael Stetsyuk).
  • Corrige un posible error FILE_DOESNT_EXIST tras la mutación de una columna dispersa con ratio_of_defaults_for_sparse_serialization=0.0. Cierra #92633. #92860 (Pavel Kruglov).
  • Corrige la inferencia del esquema de Parquet en el antiguo lector de Parquet (no se usa de forma predeterminada) cuando una columna JSON va después de una columna Tupe. Corrige el fallo del antiguo lector de Parquet (no se usa de forma predeterminada) con tuplas vacías. #92867 (Michael Kolupaev).
  • Corrige un error lógico con múltiples joins con una condición constante y join_use_nulls; cierra #92640. #92892 (Vladimir Cherkasov).
  • Corrige un posible error NOT_FOUND_COLUMN_IN_BLOCK durante la inserción en una tabla con una subcolumna en la expresión de partición. Cierra #93210. Cierra #83406. #92905 (Pavel Kruglov).
  • Corrige el error NO_SUCH_COLUMN_IN_TABLE en el motor Merge con tablas con alias. Cierra #88665. #92910 (Pavel Kruglov).
  • Se corrige el caso NULL != NULL para full_sorting_join en una columna LowCardinality(Nullable(T)). #92924 (Vladimir Cherkasov).
  • Se corrigieron varios cierres inesperados durante las fusiones de índices de texto en tablas MergeTree. #92925 (Anton Popov).
  • Se restauran las envolturas LowCardinality en los resultados de expresiones SET, cuando es necesario, durante la agregación con TTL para evitar excepciones durante la optimización de la tabla. #92971 (Seva Potapov).
  • Corrige un error lógico durante el análisis de índices cuando se usa un array vacío en la función has. Cierra #92906. #92995 (Nihal Z. Miaji).
  • Se corrige un posible bloqueo al finalizar el pool de programación en segundo plano (puede provocar bloqueos del servidor durante el apagado). #93008 (Azat Khuzhin).
  • Se corrige un posible error FILE_DOESNT_EXIST después de una mutación de una columna dispersa cuando la configuración ratio_of_defaults_for_sparse_serialization se cambiaba a 1.0 mediante alter. #93016 (Pavel Kruglov).
  • Se corrige un error en la lógica de omisión de datos al usar not materialize(...) o not CAST(...) en WHERE, que provocaba resultados incorrectos. Cierra #88536. #93017 (Nihal Z. Miaji).
  • Se corrige el posible uso de partes obsoletas debido a una race condition TOCTOU en las partes compartidas. #93022 (Azat Khuzhin).
  • Se corrige un bloqueo al deserializar un estado de agregación groupConcat malformado con desplazamientos fuera de rango. #93028 (Raufs Dunamalijevs).
  • Se corrige un problema que dejaba la conexión en un estado incorrecto tras la cancelación preliminar de consultas distribuidas. #93029 (Azat Khuzhin).
  • Corrige los resultados del join cuando la clave de join del lado derecho es una columna dispersa. Esto cierra #92920. Solo puedo reproducir el error con set compatibility='23.3'. No estoy seguro de si debería retroportarse. #93038 (Amos Bird).
  • Se soluciona un posible Cannot finalize buffer after cancellation en estimateCompressionRatio(). Soluciona: #87380. #93068 (Azat Khuzhin).
  • Se corrigieron las fusiones de índices de texto basados en expresiones complejas (como concat(col1, col2)). #93073 (Anton Popov).
  • Se corrige la aplicación de la proyección cuando el filtro contiene subcolumnas. Cierra #92882. #93141 (Pavel Kruglov).
  • Se corrigió un error lógico que se producía en algunos casos al añadir filtros en tiempo de ejecución de join al plan de consulta. Se debía a que se devolvían incorrectamente columnas const duplicadas desde uno de los lados del join. #93144 (Alexander Gololobov).
  • La función especial __applyFilter utilizada por los filtros de tiempo de ejecución de JOIN devolvía ILLEGAL_TYPE_OF_ARGUMENT en algunos casos válidos. #93187 (Alexander Gololobov).
  • Evita que distintas columnas interpoladas se fusionen en la misma columna dentro de un bloque cuando las columnas interpoladas son, en la práctica, alias de la misma columna. #93197 (Yakov Olkhovskiy).
  • No añadir un filtro en tiempo de ejecución al hacer join con la tabla del lado derecho ya rellenada. #93211 (Alexander Gololobov).
  • Se corrige la limpieza de los watches persistentes de Keeper tras una sesión finalizada. Cierra #92480. #93213 (Konstantin Vedernikov).
  • Se corrige el uso de ORDER BY con tuplas en Iceberg. Esto cierra #92977. #93225 (Konstantin Vedernikov).
  • Se corrige un fallo en la configuración s3queue_migrate_old_metadata_to_buckets de S3Queue. Cierra #93392, #93196, #81739. #93232 (Kseniia Sumarokova).
  • Se eliminan las columnas no utilizadas cuando la proyección se reconstruye durante la fusión. Esto reduce el uso de memoria y crea menos partes temporales. #93233 (Nikolai Kochetov).
  • Se corrige la eliminación de columnas no utilizadas de subconsultas cuando hay una subconsulta escalar correlacionada. Antes de esta corrección, una columna podía eliminarse si solo se usaba en la subconsulta correlacionada, y la consulta fallaba con el error NOT_FOUND_COLUMN_IN_BLOCK. #93273 (Dmitry Novik).
  • Corrige la posible falta de una subcolumna en una MV durante un ALTER de la tabla de origen. Cierra #93231. #93276 (Pavel Kruglov).
  • Corrige en el analizador la planificación de consultas del motor de tabla Merge, que podía lanzar ILLEGAL_COLUMN para hostName() al fusionar tablas locales y remotas/Distributed. Cierra #92059. #93286 (Jinlin).
  • Corrige un caso en el que NOT IN con argumentos de Array no constantes devolvía un valor incorrecto, y añade compatibilidad con funciones de Array no constantes. Cierra #14980. #93314 (Yarik Briukhovetskyi).
  • Se corrige el error Not found column en la optimización use_top_k_dynamic_filtering. Corrige #93186. #93316 (Nikolai Kochetov).
  • Se corrigió la reconstrucción de los índices de texto creados sobre subcolumnas. #93326 (Anton Popov).
  • Se corrigió el manejo de un array vacío como segundo argumento de las funciones hasAllTokens y hasAnyTokens. #93328 (Anton Popov).
  • Se corrigió un error lógico al usar filtros de tiempo de ejecución en una consulta con totales para la tabla del lado derecho. #93330 (Alexander Gololobov).
  • El servidor ya no falla si se llama a la función tokens con parámetros del tokenizer no constantes (el 2.º, 3.º y 4.º parámetro), p. ej., SELECT tokens(NULL, 1, materialize(1)). #93383 (Robert Schulze).
  • Se corrigió una vulnerabilidad por desbordamiento de enteros en la deserialización del estado de groupConcat que podía provocar problemas de seguridad de la memoria con estados de agregación manipulados. #93426 (Raufs Dunamalijevs).
  • Se corrigió el análisis del índice de texto en columnas de tipo array cuando el índice no contiene tokens (todos los arrays están vacíos o el tokenizador omite todos los tokens). #93457 (Anton Popov).
  • Evita el inicio de sesión mediante OAuth en ClickHouse Client cuando el nombre de usuario y la contraseña están en la cadena de conexión. #93459 (Krishna Mannem).
  • Corregir la compatibilidad con las credenciales proporcionadas de Azure ADLS Gen2 en DataLakeCatalog: interpretar las claves adls.sas-token.* de los catálogos REST de Iceberg y corregir el análisis de las URL ABFSS. #93477 (Karun Anantharaman).
  • Se corrigió la compatibilidad con GLOBAL IN en el analizador (antes, el Set se volvía a crear en el nodo remoto). #93507 (Azat Khuzhin).
  • Se corrigió la extracción de la subcolumna durante la deserialización directamente en columnas dispersas. #93512 (Pavel Kruglov).
  • Se corrigió la lectura directa desde el índice de texto en consultas de búsqueda duplicadas. #93516 (Anton Popov).
  • Corrección del error NOT_FOUND_COLUMN_IN_BLOCK cuando el runtime filter está habilitado y las tablas unidas devuelven la misma columna varias veces (p. ej., SELECT a, a, a FROM t). #93526 (Alexander Gololobov).
  • Se corrigió un error por el que clickhouse-client pedía la contraseña dos veces al conectarse mediante ssh. #93547 (Isak Ellmer).
  • Asegúrese de que ZooKeeper finalice correctamente al apagarse (corrige un posible bloqueo durante el apagado en casos muy poco probables). #93602 (Azat Khuzhin).
  • Se corrigió LOGICAL_ERROR al restaurar ReplicatedMergeTree con una condición de carrera en la deduplicación. #93612 (Pablo Marcos).
  • Se corrige el uso de columnas dispersas en la actualización de TTL durante la deserialización directa en columnas dispersas en algunos formatos de entrada. Esto corrige el posible error lógico Unexpected type of result TTL column. #93619 (Pavel Kruglov).
  • Se corrigieron las funciones de índice H3 que a veces fallaban o se quedaban bloqueadas al llamarse con valores de entrada no válidos. #93657 (Michael Kolupaev).
  • El uso del índice ngram_bf en datos no UTF-8 provocó una lectura de memoria no inicializada, con valores que podían quedar en la estructura del índice resultante. Cierra #92576. #93663 (Alexey Milovidov).
  • Comprobar que el tamaño del búfer descomprimido sea el esperado. #93690 (Raúl Marín).
  • Impedir que los usuarios obtengan la lista de columnas de una tabla sin verificar el permiso SHOW COLUMNS mediante el motor de tabla merge. #93695 (János Benjamin Antal).
  • Se corrigió la materialización de los índices de omisión creados a partir de subcolumnas. #93708 (Anton Popov).
  • Guardamos los punteros compartidos a los almacenamientos en QueryPipeline::resources::storage_holders para garantizar que los objetos IStorage no se destruyan mientras PipelineExecutor siga activo. #93746 (Miсhael Stetsyuk).
  • Se corrige el problema al adjuntar BD Replicated cuando el host entre servidores cambiaba tras reiniciar. #93779 (Tuan Pham Anh).
  • Se corrige la aserción !read_until_position en ReadBufferFromS3, que se producía cuando la caché estaba habilitada. #93809 (Kseniia Sumarokova).
  • Corrige un error lógico en un caso poco frecuente en el que se usa una tupla vacía con una columna Map. Cierra #93784. #93814 (Nihal Z. Miaji).
  • Se corrigió la corrupción de _part_offset al reconstruir las proyecciones durante las fusiones, y se optimizó el procesamiento de proyecciones al evitar lecturas innecesarias de la columna _part_offset y omitir columnas no necesarias en los cálculos de proyecciones. Esto da continuidad a las optimizaciones introducidas en #93233. #93827 (Amos Bird).
  • Se elimina el manejo de ‘Bad version’. #93843 (Anton Ivashkin).
  • Se corrige que optimize_inverse_dictionary_lookup no funcionara con una consulta distribuida cuando la clave es de tipo entero con signo. Cierra #93259. #93848 (Nihal Z. Miaji).
  • Se corrigió que lag/lead no funcionaran con la consulta distribuida remote(). Cierra #90014. #93858 (Nihal Z. Miaji).
  • Se corrigió un error en el envío de instrumentación del sistema. #93937 (Pablo Marcos).
  • En https://github.com/ClickHouse/ClickHouse/pull/89173, añadimos un campo adicional a la estructura que TraceSender envía a través de una tubería interna. Sin embargo, no se actualizó el tamaño del búfer (aquí), por lo que estamos escribiendo más datos en el búfer de los que permite buffer_size, lo que provoca múltiples flushes. Además, como TraceSender::send se llama desde distintos hilos, los flushes de esos hilos pueden intercalarse, lo que rompe el invariante del que depende el extremo receptor (TraceCollector). #93966 (Miсhael Stetsyuk).
  • Se corrige la conversión de tipos al supertipo durante la operación JOIN del motor de almacenamiento Join con la cláusula USING. Corrige #91672. Corrige #78572. #94000 (Dmitry Novik).
  • Corrección de un problema por el que FilterStep no se añadía correctamente cuando se aplicaba un runtime filter de join sobre una tabla Merge. #94021 (Alexander Gololobov).
  • Una consulta SELECT que incluía un predicado sobre varias columnas con índices de omisión de bloom filter, y en la que había condiciones OR y NOT, podía devolver resultados incoherentes. Esto ya se ha corregido. #94026 (Shankar Iyer).
  • Se corrige CLEAR en una columna con índices dependientes. #94057 (Raúl Marín).
  • Se corrigió el uso de un valor sin inicializar en ReadWriteBufferFromHTTP. #94058 (Alexey Milovidov).
  • Corrige una comprobación errónea de las rutas tipadas en JSON. La comprobación se introdujo en https://github.com/ClickHouse/ClickHouse/pull/92842 y puede provocar un error al iniciar tablas existentes. #94070 (Pavel Kruglov).
  • Se corrige el cierre inesperado durante el análisis del filtro cuando hay un OUTER JOIN. Corrige #90979. #94080 (Dmitry Novik).
  • Se corrigió la precisión de uniqTheta al usar claves de agregación UInt8 en paralelo (max_threads > 1, valor predeterminado). #94095 (Azat Khuzhin).
  • Se corrige un fallo provocado por una excepción lanzada desde una llamada a socket.setBlocking(true) dentro de SCOPE_EXIT. #94100 (Miсhael Stetsyuk).
  • Se corrige la pérdida de datos cuando DROP PARTITION elimina partes creadas por entradas de log posteriores en ReplicatedMergeTree. #94123 (Tuan Pham Anh).
  • Se corrigió un problema en el lector de Parquet v3, que manejaba incorrectamente los arrays que cruzan los límites de página. Esto ocurre, por ejemplo, con archivos escritos por Arrow sin habilitar las estadísticas de página ni el índice de página. Afecta solo a las columnas del tipo de dato Array. El síntoma más probable es que un array cada ~1 MB de datos quede truncado. Antes de esta corrección, use esta configuración como solución alternativa: input_format_parquet_use_native_reader_v3 = 0. #94125 (Michael Kolupaev).
  • Se corrige el exceso de watches en ReplicatedMergeTree mientras se espera una entrada del log. #94133 (Azat Khuzhin).
  • Funciones arrayShuffle, arrayPartialShuffle y arrayRandomSample para materializar columnas constantes, de modo que distintas filas obtengan resultados diferentes. #94134 (Joanna Hulboj).
  • Se corrige una condición de carrera en la evaluación de funciones de tabla en vistas materializadas. #94171 (Alexey Milovidov).
  • Corrige una desreferenciación de nullptr en los motores de base de datos PostgreSQL (cuando la consulta es incorrecta). Cierra #92887. #94180 (Alexey Milovidov).
  • Corrige una fuga de memoria en vistas materializadas actualizables que utilizan consultas SELECT con múltiples subconsultas. #94200 (Antonio Andelic).
  • Soluciona una condición de carrera entre DataPartStorageOnDiskBase::remove y system.parts. Cierra #49076. #94262 (Alexey Milovidov).
  • Se elimina el especificador noexcept incorrecto en la asignación por copia de HashTable, que puede provocar un crash (std::terminate) en caso de excepciones de memoria. #94275 (Nikita Taranov).
  • Anteriormente, al crear una proyección con columnas duplicadas en GROUP BY (p. ej., GROUP BY c0, c0) e insertar datos, se producía un std::length_error si optimize_row_order está habilitado. Cierra #94065. #94277 (Alexey Milovidov).
  • Se corrige un error poco frecuente en el client de ZooKeeper durante la conexión que provoca cuelgues y fallos. #94320 (Azat Khuzhin).
  • Se corrige un problema por el que la optimización de función a subcolumnas no se aplicaba a las subcolumnas. #94323 (Pavel Kruglov).
  • Se corrige un posible resultado incorrecto en RIGHT JOIN anidados cuando enable_lazy_columns_replication está habilitado. El error provocaba que todas las filas de las columnas replicadas devolvieran incorrectamente el mismo valor en lugar de sus valores correspondientes. Cierra #93891. #94339 (Vladimir Cherkasov).
  • Se corrige el pushdown de filtros en SEMI JOIN mediante conjuntos de equivalencia. No se aplica el pushdown del filtro si han cambiado los tipos de los argumentos. Corrige #93264. #94340 (Dmitry Novik).
  • Corrige el uso de DeltaLake CDF con el motor de base de datos DataLake (integración de catálogos de delta lake). Cierra #94122. #94342 (Kseniia Sumarokova).
  • Se corrigió el valor incorrecto de la métrica FilesystemCacheSizeLimit cuando se usaba la política de caché SLRU. #94363 (Kseniia Sumarokova).
  • Crear un motor de base de datos Backup con menos de dos argumentos ahora devuelve un mensaje de error más descriptivo (Wrong number of arguments en lugar de std::out_of_range: InlinedVector::at(size_type) const failed bounds check.). #94374 (Robert Schulze).
  • Ignora las revocaciones imposibles de privilegios globales a nivel de base de datos para privilegios con opción de otorgamiento. #94386 (pufit).
  • Se corrigió la lectura de desplazamientos dispersos en partes compactas. Cierra #94385. #94399 (Pavel Kruglov).
  • No impedir ALTER de columnas con índices implícitos, incluso si se usa el modo throw de alter_column_secondary_index_mode. #94425 (Raúl Marín).
  • Se corrige un crash en TCPHandler cuando varias llamadas a receivePacketsExpectQuery leen Protocol::Client::IgnoredPartUUIDs. #94434 (Miсhael Stetsyuk).
  • Se corrige el enmascaramiento de datos sensibles en system.functions. #94436 (Vitaly Baranov).
  • Corrige la desreferenciación de nullptr con send_profile_events deshabilitado. Esta funcionalidad se introdujo recientemente en el driver de Python de ClickHouse. Cierra #92488. #94466 (Alexey Milovidov).
  • Corrige la incompatibilidad de .mrk del índice de texto durante las operaciones de merge. #94494 (Peng Jian).
  • Cuando read_in_order_use_virtual_row está habilitado, el código accedía a las columnas del índice basándose en el tamaño completo de la clave primaria sin comprobar si el índice se había truncado, lo que provocaba acceso a memoria ya liberada / memoria sin inicializar. Cierra #85596. #94500 (Alexey Milovidov).
  • Corrige un error causado por una incompatibilidad de tipos al enviar tablas externas para subconsultas con GLOBAL IN cuando los tipos son Nullable. Cierra #94097. #94511 (Alexey Milovidov).
  • En versiones anteriores, las consultas con múltiples condiciones de índice sobre la misma expresión podían lanzar por error la excepción Not found column. Cierra #60660. #94515 (Alexey Milovidov).
  • Se corrige el manejo incorrecto de la columna Nullable del join en los filtros en tiempo de ejecución. #94555 (Alexander Gololobov).
  • La creación de una carga de trabajo dentro de otra que está actualmente en uso ya no provoca un fallo. #94599 (Sergei Trifonov).
  • Se corrige un fallo en la optimización de ANY LEFT JOIN cuando se evalúa isNotNull sobre una columna ausente. #94600 (Molly).
  • Corregida la evaluación de expresiones por defecto al hacer referencia a otras columnas con valores por defecto calculados. #94615 (Alexey Milovidov).
  • Corrige problemas de permisos en las operaciones de BACKUP/RESTORE. #94617 (Pablo Marcos).
  • Se corrige un cierre inesperado debido a una conversión de tipo incorrecta cuando el tipo de dato es Nullable(DateTime64). #94627 (Miсhael Stetsyuk).
  • Corrige un error por el que ciertas consultas distribuidas con ORDER BY podían devolver columnas ALIAS con los valores intercambiados (es decir, la columna a mostraba los datos de la columna b y viceversa). #94644 (filimonov).
  • Se corrigió el guardado de los resultados de keeper-bench en un archivo. #94654 (Antonio Andelic).
  • Corrige estimaciones incorrectas con estadísticas de tipo MinMax cuando la columna contiene valores de coma flotante negativos. #94665 (zoomxi).
  • Se corrige la lectura de archivos Parquet cuando la clave de un map es un struct. #94670 (Konstantin Vedernikov).
  • Corrige un posible resultado incorrecto de RIGHT join al usar condiciones ON complejas. Cierra #92913. #94680 (Vladimir Cherkasov).
  • Preservar la granularidad constante del índice (use_const_adaptive_granularity) después de las fusiones verticales. #94725 (Azat Khuzhin).
  • Corrige un error en mutaciones con subconsultas escalares y dependencias de una tabla. Si una tabla tenía dependencias (índice o proyecciones) sobre una columna, las subconsultas escalares podían evaluarse y almacenarse en caché sin ningún dato, lo que podía provocar cambios incorrectos. #94731 (Raúl Marín).
  • Se corrigió el fallback de cpu_pressure de AsynchronousMetrics en caso de error. #94827 (Raúl Marín).
  • A la función getURLHostRFC le faltaban comprobaciones de límites antes de desreferenciar punteros. Cuando se pasaba una cadena vacía a domainRFC, se leía memoria sin inicializar, lo que desencadenaba errores de MSan. #94851 (Alexey Milovidov).
  • Corregir el modo de solo lectura de los discos cifrados. #94852 (Azat Khuzhin).
  • Corrige un error lógico en LIMIT/OFFSET con valores fraccionarios al usar el analizador antiguo con tablas Distributed. Cierra #94712. #94999 (Ahmed Gouda).
  • Se corrige un fallo que se producía en determinadas condiciones cuando los filtros de ejecución de JOIN están habilitados de forma predeterminada. #95000 (Alexander Gololobov).
  • Mejora del enmascaramiento de contraseñas en la URL utilizada en el motor de tabla URL() y la función de tabla url(). #95006 (Vitaly Baranov).
  • La función toStartOfInterval ahora funciona igual que toStartOfX, donde X es Day, Week, Month, Quarter, Year, cuando enable_extended_results_for_datetime_functions está activado. #95011 (Kirill Kopnev).
  • Corrige las comparaciones de cadenas constantes que no tenían en cuenta las opciones cast_string_to_date_time_mode, bool_true_representation, bool_false_representation e input_format_null_as_default. Cierra #91681. #95040 (Nihal Z. Miaji).
  • Se corrige una condición de carrera en la caché del sistema de archivos. #95064 (Alexey Milovidov).
  • Se corrige una condición de carrera poco frecuente en el lector de Parquet. #95068 (Alexey Milovidov).
  • Se corrige un fallo en la optimización top K cuando LIMIT es cero. Cierra #93893. #95072 (Alexey Milovidov).
  • Al convertir DateTime/enteros a Time64, se extrae el componente de hora del día mediante toTime, que no es monótono. La plantilla ToDateTimeMonotonicity afirmaba erróneamente que esta conversión era monótona, lo que provocaba la excepción “Invalid binary search result in MergeTreeSetIndex” en las compilaciones de depuración. #95125 (Alexey Milovidov).
  • La lista de entradas del archivo manifest se volvió a crear solo cuando fue necesario (anteriormente se hacía en cada iteración). #95162 (Daniil Ivanik).

Mejora en compilación/pruebas/empaquetado

Última modificación el 14 de agosto de 2026