Transporte: una plataforma interna y unas 3 veces más despliegues por día
Un equipo de 6 hace ingeniería de plataforma, DevOps y SRE desde diciembre de 2025.
Antes y después, según el caso
~3x
más despliegues a producción por día desde que empezamos
~USD 5.000
menos al mes en gasto de observabilidad
18 → 135
paneles, con OpenTelemetry
4 → 31
repositorios con promoción de un único build
Dibujado a partir de las cifras del caso. El cliente no se nombra y su producto no se muestra.
El trabajo
- El cliente
- Una empresa estadounidense de servicios de transporte
- Estado
- En curso, fase 1 entregada
- Equipo
- 6 personas: líder y arquitecto, 2 ingenieros de plataforma, ingeniero DevOps, SRE, scrum master
¿Qué cambió en la organización de ingeniería desde diciembre de 2025?
Las cifras son de toda la organización y salen del conjunto de métricas de ingeniería del cliente, armado a partir de sus pull requests. En el mismo período el equipo creció y adoptó herramientas de IA, así que describen a la organización que apoyamos, no un resultado que nos atribuimos solos.
Los despliegues a producción por día son unas 3 veces los de diciembre de 2025, al empezar. Los paneles pasaron de 18 a 135 sobre OpenTelemetry y el gasto en observabilidad bajó unos USD 5.000 al mes. La promoción de una sola imagen pasó de 4 a 31 repositorios y el CI compartido, de 35 a 76. La cobertura mediana de pruebas ronda el 90 % y el control de calidad pasa en el 89 % de los proyectos.
~3xmás despliegues a producción por día desde el inicio del trabajo (toda la organización)
~USD 5.000menos al mes en gasto de observabilidad
También registrado
- Paneles de 18 a 135, sobre OpenTelemetry
- Promoción de una sola imagen de 4 a más de 31 repositorios
- CI compartido de 35 a más de 76 repositorios
- Cobertura mediana de pruebas cercana al 90 % en servicios de producto
- Control de calidad en verde en el 89 % de los proyectos
Qué hicimos, por área
Áreas de trabajo
El cliente
Un entorno cloud native en crecimiento: más de 150 repositorios en Kubernetes multiclúster
El cliente es una empresa estadounidense de servicios de transporte con más de 150 repositorios activos en Kubernetes multiclúster sobre una nube principal. Lo publicamos sin su nombre, como acordamos.
Antes del trabajo, las versiones salían de la rama principal con congelamientos de código en unos 15 repositorios, el monitoreo era por clúster con 18 paneles y sin OpenTelemetry, y no había portal de desarrollo, catálogo ni caminos predefinidos (golden paths).
Plataforma interna de desarrollo
Un portal Backstage con 11 plantillas de autoservicio
El portal está en servicio desde la primavera boreal de 2026, en alta disponibilidad. Ofrece 11 plantillas de autoservicio y esqueletos de camino predefinido para cinco stacks, entre ellos .NET, Python y Node.js.
- Unos 66 repositorios y 73 componentes en el catálogo.
- Más de 35 plugins de backend.
- Infraestructura de autoservicio con Crossplane en los tres clústeres: 54 recursos gestionados por GitOps y 15 bases de datos de servicio sobre un PostgreSQL compartido por entorno.
Ingeniería de versiones y GitOps
Compilar una vez, promover la misma imagen y manejar cada clúster desde Git
Un modelo de ramas de versión con cortes, fusiones de vuelta y chequeos de desvío automáticos reemplazó los congelamientos de código. Lo usan 17 repositorios, con 34 candidatas y 10 versiones en producción desde septiembre de 2026.
- Promoción de una sola imagen: de 4 a más de 31 repositorios.
- Biblioteca de CI compartida: de 35 a más de 76 repositorios, con 9 flujos reutilizables nuevos.
- Argo CD: de 46 a 101 aplicaciones y de 8 a 29 conjuntos de aplicaciones, más un clúster de gestión sumado en abril de 2026.
Observabilidad
De 18 paneles por clúster a 135 sobre una sola plataforma abierta
Colectores de OpenTelemetry corren en cada clúster y envían a Mimir, Loki, Tempo y Pyroscope centrales, que se leen en Grafana con inicio de sesión único. Lo completan el monitoreo de usuarios reales, OpenCost y exportadores de datos de ingeniería.
Hoy hay 135 paneles, 34 de ellos por servicio o de métricas DORA. Mover métricas y registros (logs) fuera de un APM comercial bajó el gasto en observabilidad unos USD 5.000 al mes.
DevSecOps y métricas de ingeniería
Un flujo de seguridad compartido y un programa de métricas DORA
Desde febrero de 2026 un flujo de seguridad compartido corre análisis de dependencias, secretos, CodeQL y contenedores. El refuerzo de la cadena de suministro del CI está en curso.
El programa DORA está en marcha: los despliegues por día pasaron de unos 4,4 a entre 12 y 16 en toda la organización.
Equipo
Seis personas dentro de la organización de ingeniería del cliente
Un líder y arquitecto, 2 ingenieros de plataforma, un ingeniero DevOps, un SRE y un scrum master, desde diciembre de 2025. El equipo entregó 464 tareas de plataforma y DevOps hasta octubre de 2026; la fase 1 está entregada y la fase 2, en curso.
Stack
Servicios utilizados
Los servicios detrás de este trabajo.
Preguntas frecuentes
¿Quién es el cliente?
Una empresa estadounidense de servicios de transporte con más de 150 repositorios activos en Kubernetes multiclúster. Publicamos el caso sin su nombre.
¿Qué hace Clouditive para esta empresa de transporte?
Ingeniería de plataforma, DevOps y SRE: un portal de desarrollo en Backstage, infraestructura de autoservicio con Crossplane, ingeniería de versiones, GitOps con Argo CD, observabilidad abierta, un programa de métricas DORA y un flujo de seguridad compartido.
¿Cuánto cambió la frecuencia de despliegue?
Los despliegues a producción por día son unas 3 veces los de diciembre de 2025, medidos en toda la organización de ingeniería que apoyamos.
¿Cómo bajó el gasto en observabilidad?
Las métricas y los registros pasaron de un APM comercial a OpenTelemetry con Mimir, Loki, Tempo, Pyroscope y Grafana, y el gasto bajó unos USD 5.000 al mes.
¿Qué tiene el portal de desarrollo?
Un catálogo de Backstage con unos 66 repositorios y 73 componentes, 11 plantillas de autoservicio, caminos predefinidos para cinco stacks y más de 35 plugins de backend.
¿Qué significa promover una sola imagen?
La imagen se compila una vez y esa misma imagen pasa de un entorno a otro, así producción corre exactamente lo que se probó. Ya cubre más de 31 repositorios, frente a 4 al inicio.
¿De qué tamaño es el equipo?
Seis personas desde diciembre de 2025: un líder y arquitecto, 2 ingenieros de plataforma, un ingeniero DevOps, un SRE y un scrum master.
¿Qué tecnologías usa?
Kubernetes multiclúster, Backstage, Crossplane, Argo CD, OpenTelemetry, Mimir, Loki, Tempo, Pyroscope, Grafana, OpenCost y CodeQL.
¿Qué necesitas resolver?
Respondemos cada pedido en 1 día hábil. Firmamos un NDA antes de la llamada si lo pides.