Llevo un tiempo operando varios entornos de IBM Maximo Application Suite sobre OpenShift en paralelo: un cluster de un solo nodo para desarrollo, uno de preproducción y uno de producción. Ahora mismo estoy planificando uno nuevo sobre GCP. Hay tres lecciones que se repiten entre entornos, aunque cada uno tenga su propia infraestructura.
El estado “declarado” no siempre coincide con el estado real. Más de una vez la aplicación estaba caída por lo mismo. Un recurso de configuración (el objeto que controla el modo de despliegue de un workspace) decía “down” mientras alguien intentaba arrancarla escalando el deployment a mano. El operator gana esa pelea siempre. Si vas a cambiar el estado de algo gestionado por un operator, cámbialo a través del recurso que el operator controla, no por debajo.
Los componentes de observabilidad pueden tumbar el propio entorno que deberían vigilar. El stack de logging de un entorno de desarrollo llegó a consumir más de 30 GB de RAM. No tenía límites de memoria y llevaba semanas acumulando logs sin que nadie lo notara, hasta que el nodo entero dejó de responder. La lección no es “no despliegues logging”. Es que cualquier componente de observabilidad necesita los mismos límites de recursos y la misma vigilancia que la aplicación que observa. Es fácil olvidarlo precisamente porque “solo mira, no hace nada”.
Cada entorno tiene su propia personalidad, y eso es un riesgo en sí mismo. El de desarrollo es de un solo nodo y no tolera los mismos parámetros que uno de producción con varios nodos: tamaños de stack, factores de réplica, límites de ingesta… Aplicar la configuración de un entorno a otro “porque en el otro funcionó” es una fuente de incidentes recurrente. Cada entorno necesita su propia configuración, pensada para su propia escala, no una copia.
Ahora que estoy planificando el despliegue nuevo sobre GCP, estas tres lecciones son literalmente la primera checklist que reviso antes de tocar nada.
¿Alguien más gestionando varios entornos de Maximo/OpenShift en paralelo? Me interesa comparar cómo lo resolvéis vosotros.
La monitorización de clusters, incluido cómo dimensionar y vigilar el propio stack de observabilidad, ocupa buena parte de mi manual “Seguridad y monitorización en Kubernetes” (950 páginas, en español). [Descarga la muestra gratuita]([URL de la muestra]) · Consigue el manual completo

Leave a Reply