19 artículos publicados
CNCF comparte su experiencia migrando su pipeline de métricas de gostatsd a OpenTelemetry, explicando las motivaciones y proceso de esta transición. El artículo documenta cómo modernizar infraestructura de observabilidad en sistemas a gran escala, adoptando el estándar abierto de OpenTelemetry para estandarizar la recopilación de métricas.
Se ha descubierto una vulnerabilidad crítica (CVE-2026-85706) con puntuación CVSS 10 en las APIs de Commits y Repository Files de GitLab Community y Enterprise Edition que permite a atacantes no autenticados leer archivos arbitrarios del servidor. La falla está siendo explotada activamente en la naturaleza y afecta a millones de desarrolladores que utilizan GitLab para gestionar sus repositorios.
Kubernetes v1.37 introduce características de seguridad de almacenamiento críticas: modos de permisos para emptyDir y opciones de bind mount. Estas capacidades permiten a desarrolladores e ingenieros de seguridad implementar políticas rigurosas directamente en Kubernetes, como prohibir la eliminación de archivos entre contenedores o la ejecución de binarios arbitrarios desde volúmenes escribibles, sin necesidad de soluciones complicadas.
OpenBao, el fork de código abierto de HashiCorp Vault mantenido por la Linux Foundation, se integra perfectamente con CloudNativePG para gestionar secretos de infraestructura en Kubernetes de forma independiente del proveedor. Esta combinación proporciona un sistema auto-sanador y sin dependencias de vendor lock-in para la administración segura de credenciales.
Kubernetes v1.37 promueve la característica Pod-Level Resource Managers a estado Beta, permitiendo que el Kubelet tome decisiones de asignación de hardware basadas en declaraciones de recursos a nivel de pod. Esta mejora resuelve el dilema entre asignar recursos exclusivos NUMA-aligned a todos los contenedores o renunciar completamente al alineamiento NUMA, habilitando modelos de asignación híbrida para cargas de trabajo modernas con sidecars ligeros.
Kubernetes v1.37 promociona Memory QoS a Beta, habilitándolo por defecto en nodos Linux con cgroup v2. La característica permite al kernel gestionar mejor la memoria de los contenedores mediante la configuración de parámetros como memory.high y memory.low. Los operadores de clusters pueden controlar el comportamiento mediante nuevos campos de configuración del kubelet sin riesgo, ya que por defecto no se aplica throttling ni reserva de memoria.
Changed Block Tracking (CBT) para controladores CSI en Kubernetes ha pasado de Alpha a Beta con el lanzamiento de v1.0.0 del proyecto external-snapshot-metadata en marzo de 2026. La principal novedad es la promoción de SnapshotMetadataService CRD de v1alpha1 a v1beta1, requiriendo actualización de manifiestos y código cliente, con soporte mínimo para Kubernetes 1.33 y CSI spec 1.10.
Se lanza Cilium 1.20, la segunda versión mayor del año 2026, con mejoras significativas en Gateway API, soporte para TCPRoute/UDPRoute, y IPAM de ENI para IPv6. Esta versión consolida la madurez de Cilium como solución de networking y seguridad en entornos Kubernetes de producción.
Kubernetes v1.37 ha graduado el soporte de histogramas nativos de Prometheus a fase Beta, habilitándolo por defecto. Esta característica proporciona observabilidad de alta resolución y baja cardinalidad para métricas de latencia y duración, reduciendo significativamente el almacenamiento de telemetría y la sobrecarga de scraping comparado con los histogramas clásicos.
El artículo analiza cómo los equipos de plataforma necesitan adaptar su infraestructura para soportar cargas de trabajo de IA distribuida, más allá de simplemente provisionar GPUs. Explora los cuellos de botella que emergen cuando el entrenamiento se extiende a múltiples nodos en un cluster.
Kubernetes v1.37 introduce en fase Alpha un mecanismo de desalojo de workloads de menor prioridad para liberar recursos en nodos saturados, permitiendo que los Pods de mayor prioridad que solicitan escalado dinámico de CPU y memoria completen sus redimensionamientos in-place. Esta característica cierra una brecha crítica en la asignación de recursos que existía desde la adopción del redimensionamiento in-place en v1.35.
La CNCF publica una guía práctica sobre recuperación ante desastres en Kubernetes que va más allá de tener simples copias de seguridad. El documento presenta tres escenarios de fallo reproducibles en un portátil, con orientación específica derivada de cada caso de uso.
Kubernetes 1.37 introduce cinco nuevas condiciones de nodo estándar (DrainInProgress, Drained, MaintenancePlanned, MaintenanceInProgress, GracefulNodeShutdownInProgress) para describir de forma unificada el estado del ciclo de vida de los nodos durante drenaje, mantenimiento y apagado graceful. Esta adición estandariza la forma en que los administradores pueden monitorear y gestionar operaciones de mantenimiento en el cluster.
Un análisis sobre cómo gestionar y monitorizar el uso de GPUs en entornos Kubernetes multiusuario, abordando la transparencia de costos y la asignación de recursos. El artículo explora soluciones para proporcionar métricas seguras y autoservicio que permitan a los equipos entender y optimizar su consumo de infraestructura GPU.
Kubernetes v1.37 marca un hito importante en la evolución del planificador de cargas de trabajo con la graduación a Beta de las APIs Workload y PodGroup, permitiendo gang scheduling avanzado. La versión introduce la nueva API CompositePodGroup para expresar restricciones topológicas multinivel y políticas de preemption en grupos complejos de Pods, nativa para workloads como JobSet y LeaderWorkerSet. Se añaden nuevas APIs de integración de controladores y la librería workloadbuilder para simplificar la adopción en extensiones out-of-tree.
El artículo aborda cómo obtener visibilidad en GitHub Actions sin modificar los archivos de workflow, permitiendo identificar cuellos de botella como trabajos lentos, inestables o en cola. Una solución práctica para organizaciones que enfrentan el crecimiento descontrolado de acciones y necesitan monitoreo efectivo de sus pipelines de integración continua.
Karmada, el proyecto de orquestación Kubernetes multi-clúster y multi-nube, ha alcanzado madurez de producción en la CNCF. Este hito es significativo para empresas globales que escalan entrenamiento e inferencia de IA en infraestructuras híbridas y distribuidas.
China Merchants Bank ganó un concurso de caso de uso de CNCF al desarrollar una plataforma cloud native que unifica el entrenamiento e inferencia de IA en Kubernetes. La solución aumentó la utilización promedio de aceleradores de computación del 35% a más del 60% y redujo el costo de inferencia por millón de tokens en más del 60%.
Kubernetes v1.37 promueve la característica KubeletInUserNamespace a fase beta, permitiendo que todos los componentes del nodo (kubelet, runtimes CRI y OCI, plugins CNI y kube-proxy) se ejecuten como usuario no privilegiado utilizando espacios de nombres de usuario de Linux. Esta mejora de seguridad, que comenzó como experimento en 2018, mitiga vulnerabilidades históricas de escape de contenedores que podrían comprometer privilegios root en el host.