El trabajo

El cliente
Una empresa estadounidense de servicios de transporte
Estado
En curso, fase 1 entregada
Equipo
6 personas: líder y arquitecto, 2 ingenieros de plataforma, ingeniero DevOps, SRE, scrum master

¿Qué cambió en la organización de ingeniería desde diciembre de 2025?

Las cifras son de toda la organización y salen del conjunto de métricas de ingeniería del cliente, armado a partir de sus pull requests. En el mismo período el equipo creció y adoptó herramientas de IA, así que describen a la organización que apoyamos, no un resultado que nos atribuimos solos.

Los despliegues a producción por día son unas 3 veces los de diciembre de 2025, al empezar. Los paneles pasaron de 18 a 135 sobre OpenTelemetry y el gasto en observabilidad bajó unos USD 5.000 al mes. La promoción de una sola imagen pasó de 4 a 31 repositorios y el CI compartido, de 35 a 76. La cobertura mediana de pruebas ronda el 90 % y el control de calidad pasa en el 89 % de los proyectos.

  • ~3xmás despliegues a producción por día desde el inicio del trabajo (toda la organización)

  • ~USD 5.000menos al mes en gasto de observabilidad

También registrado

  • Paneles de 18 a 135, sobre OpenTelemetry
  • Promoción de una sola imagen de 4 a más de 31 repositorios
  • CI compartido de 35 a más de 76 repositorios
  • Cobertura mediana de pruebas cercana al 90 % en servicios de producto
  • Control de calidad en verde en el 89 % de los proyectos

Qué hicimos, por área

Áreas de trabajo

  • Plataforma interna de desarrollo
  • Infraestructura de autoservicio
  • Ingeniería de versiones y GitOps
  • Observabilidad
  • DevSecOps
  • Métricas de ingeniería (DORA)
El cliente

Un entorno cloud native en crecimiento: más de 150 repositorios en Kubernetes multiclúster

El cliente es una empresa estadounidense de servicios de transporte con más de 150 repositorios activos en Kubernetes multiclúster sobre una nube principal. Lo publicamos sin su nombre, como acordamos.

Antes del trabajo, las versiones salían de la rama principal con congelamientos de código en unos 15 repositorios, el monitoreo era por clúster con 18 paneles y sin OpenTelemetry, y no había portal de desarrollo, catálogo ni caminos predefinidos (golden paths).

Plataforma interna de desarrollo

Un portal Backstage con 11 plantillas de autoservicio

El portal está en servicio desde la primavera boreal de 2026, en alta disponibilidad. Ofrece 11 plantillas de autoservicio y esqueletos de camino predefinido para cinco stacks, entre ellos .NET, Python y Node.js.

  • Unos 66 repositorios y 73 componentes en el catálogo.
  • Más de 35 plugins de backend.
  • Infraestructura de autoservicio con Crossplane en los tres clústeres: 54 recursos gestionados por GitOps y 15 bases de datos de servicio sobre un PostgreSQL compartido por entorno.
Ingeniería de versiones y GitOps

Compilar una vez, promover la misma imagen y manejar cada clúster desde Git

Un modelo de ramas de versión con cortes, fusiones de vuelta y chequeos de desvío automáticos reemplazó los congelamientos de código. Lo usan 17 repositorios, con 34 candidatas y 10 versiones en producción desde septiembre de 2026.

  • Promoción de una sola imagen: de 4 a más de 31 repositorios.
  • Biblioteca de CI compartida: de 35 a más de 76 repositorios, con 9 flujos reutilizables nuevos.
  • Argo CD: de 46 a 101 aplicaciones y de 8 a 29 conjuntos de aplicaciones, más un clúster de gestión sumado en abril de 2026.
Observabilidad

De 18 paneles por clúster a 135 sobre una sola plataforma abierta

Colectores de OpenTelemetry corren en cada clúster y envían a Mimir, Loki, Tempo y Pyroscope centrales, que se leen en Grafana con inicio de sesión único. Lo completan el monitoreo de usuarios reales, OpenCost y exportadores de datos de ingeniería.

Hoy hay 135 paneles, 34 de ellos por servicio o de métricas DORA. Mover métricas y registros (logs) fuera de un APM comercial bajó el gasto en observabilidad unos USD 5.000 al mes.

DevSecOps y métricas de ingeniería

Un flujo de seguridad compartido y un programa de métricas DORA

Desde febrero de 2026 un flujo de seguridad compartido corre análisis de dependencias, secretos, CodeQL y contenedores. El refuerzo de la cadena de suministro del CI está en curso.

El programa DORA está en marcha: los despliegues por día pasaron de unos 4,4 a entre 12 y 16 en toda la organización.

Equipo

Seis personas dentro de la organización de ingeniería del cliente

Un líder y arquitecto, 2 ingenieros de plataforma, un ingeniero DevOps, un SRE y un scrum master, desde diciembre de 2025. El equipo entregó 464 tareas de plataforma y DevOps hasta octubre de 2026; la fase 1 está entregada y la fase 2, en curso.

Stack

  • Kubernetes (multiclúster)
  • Backstage
  • Crossplane
  • Argo CD
  • PostgreSQL
  • OpenTelemetry
  • Mimir
  • Loki
  • Tempo
  • Pyroscope
  • Grafana
  • OpenCost
  • CodeQL

Servicios utilizados

Los servicios detrás de este trabajo.

Preguntas frecuentes

¿Quién es el cliente?

Una empresa estadounidense de servicios de transporte con más de 150 repositorios activos en Kubernetes multiclúster. Publicamos el caso sin su nombre.

¿Qué hace Clouditive para esta empresa de transporte?

Ingeniería de plataforma, DevOps y SRE: un portal de desarrollo en Backstage, infraestructura de autoservicio con Crossplane, ingeniería de versiones, GitOps con Argo CD, observabilidad abierta, un programa de métricas DORA y un flujo de seguridad compartido.

¿Cuánto cambió la frecuencia de despliegue?

Los despliegues a producción por día son unas 3 veces los de diciembre de 2025, medidos en toda la organización de ingeniería que apoyamos.

¿Cómo bajó el gasto en observabilidad?

Las métricas y los registros pasaron de un APM comercial a OpenTelemetry con Mimir, Loki, Tempo, Pyroscope y Grafana, y el gasto bajó unos USD 5.000 al mes.

¿Qué tiene el portal de desarrollo?

Un catálogo de Backstage con unos 66 repositorios y 73 componentes, 11 plantillas de autoservicio, caminos predefinidos para cinco stacks y más de 35 plugins de backend.

¿Qué significa promover una sola imagen?

La imagen se compila una vez y esa misma imagen pasa de un entorno a otro, así producción corre exactamente lo que se probó. Ya cubre más de 31 repositorios, frente a 4 al inicio.

¿De qué tamaño es el equipo?

Seis personas desde diciembre de 2025: un líder y arquitecto, 2 ingenieros de plataforma, un ingeniero DevOps, un SRE y un scrum master.

¿Qué tecnologías usa?

Kubernetes multiclúster, Backstage, Crossplane, Argo CD, OpenTelemetry, Mimir, Loki, Tempo, Pyroscope, Grafana, OpenCost y CodeQL.

¿Qué necesitas resolver?

Respondemos cada pedido en 1 día hábil. Firmamos un NDA antes de la llamada si lo pides.