Transporte: uma plataforma para desenvolvedores e cerca de 3x mais deploys por dia
Uma equipe de 6 pessoas cuida de engenharia de plataforma, DevOps e SRE desde dezembro de 2025.
Antes e depois, segundo o caso
~3x
mais deploys em produção por dia desde que começamos
~US$ 5.000
a menos por mês em gastos com observabilidade
18 → 135
dashboards, com OpenTelemetry
4 → 31
repositórios com promoção de um único build
Desenhado a partir dos números do caso. O cliente não é nomeado e seu produto não é mostrado.
O trabalho
- O cliente
- Uma empresa norte-americana de serviços de transporte
- Status
- Em andamento, fase 1 entregue
- Equipe
- 6 pessoas: líder e arquiteto, 2 engenheiros de plataforma, engenheiro DevOps, SRE, scrum master
O que mudou na organização de engenharia desde dezembro de 2025?
Os números são de toda a organização e vêm do conjunto de métricas de engenharia do cliente, montado a partir de seus pull requests. No mesmo período a equipe cresceu e adotou ferramentas de IA, então eles descrevem a organização que apoiamos, não um resultado que atribuímos só a nós.
Os deploys em produção por dia são cerca de 3 vezes os de dezembro de 2025. Os dashboards foram de 18 para 135 em OpenTelemetry, e o gasto com observabilidade caiu cerca de US$ 5.000 por mês. A promoção de uma única imagem foi de 4 para 31 repositórios e o CI compartilhado, de 35 para 76. Os serviços de produto têm cerca de 90% de cobertura de testes, e o quality gate passa em 89% dos projetos.
~3xmais deploys em produção por dia desde o início do trabalho (toda a organização)
~90%de cobertura mediana de testes nos serviços de produto
Também registrado
- Dashboards de 18 para 135, em OpenTelemetry
- Cerca de US$ 5.000 por mês a menos em gasto com observabilidade
- Promoção de uma única imagem de 4 para mais de 31 repositórios
- CI compartilhado de 35 para mais de 76 repositórios
- Quality gate passando em 89% dos projetos
O que fizemos, por área
Áreas de trabalho
O cliente
Um ambiente cloud native em crescimento: mais de 150 repositórios em Kubernetes multicluster
O cliente é uma empresa norte-americana de serviços de transporte com mais de 150 repositórios ativos em Kubernetes multicluster em uma grande nuvem. Publicamos o caso sem o nome dela, como combinado.
Antes do trabalho, as releases saíam do tronco principal com congelamentos de código em cerca de 15 repositórios, o monitoramento era por cluster, com 18 dashboards e sem OpenTelemetry, e não havia portal de desenvolvimento, catálogo nem golden path.
Plataforma interna de desenvolvimento
Um portal Backstage com 11 templates de autosserviço
O portal está no ar desde a primavera de 2026 no hemisfério norte, em alta disponibilidade. Oferece 11 templates de autosserviço e esqueletos de golden path para cinco stacks, entre eles .NET, Python e Node.js.
- Cerca de 66 repositórios e 73 componentes no catálogo.
- Mais de 35 plugins de backend.
- Infraestrutura de autosserviço com Crossplane nos três clusters: 54 recursos gerenciados via GitOps e 15 bancos de dados de serviço em um PostgreSQL compartilhado por ambiente.
Engenharia de releases e GitOps
Build uma vez, promova a mesma imagem e gerencie cada cluster pelo Git
Um modelo de branches de release com cortes, back-merges e verificações de drift automáticos substituiu os congelamentos de código. 17 repositórios o usam, com 34 release candidates e 10 releases em produção desde setembro de 2026.
- Promoção de uma única imagem: de 4 para mais de 31 repositórios.
- Biblioteca de CI compartilhada: de 35 para mais de 76 repositórios, com 9 workflows reutilizáveis novos.
- Argo CD: de 46 para 101 aplicações e de 8 para 29 application sets, além de um cluster de gerenciamento adicionado em abril de 2026.
Observabilidade
De 18 dashboards por cluster a 135 em uma única stack open source
Coletores do OpenTelemetry rodam em cada cluster e enviam para Mimir, Loki, Tempo e Pyroscope centrais, lidos no Grafana com single sign-on. Monitoramento de usuários reais, OpenCost e exportadores de dados de engenharia completam o conjunto.
Hoje são 135 dashboards, 34 deles por serviço ou de métricas DORA. Tirar métricas e logs de um APM comercial reduziu o gasto com observabilidade em cerca de US$ 5.000 por mês.
DevSecOps e métricas de engenharia
Um fluxo de segurança compartilhado e um programa de métricas DORA
Desde fevereiro de 2026, um fluxo de segurança compartilhado roda varreduras de dependências, segredos, CodeQL e contêineres. O reforço da cadeia de suprimentos do CI está em andamento.
O programa DORA está no ar: os deploys por dia passaram de cerca de 4,4 para entre 12 e 16 em toda a organização.
Equipe
Seis pessoas dentro da organização de engenharia do cliente
Um líder e arquiteto, 2 engenheiros de plataforma, um engenheiro DevOps, um SRE e um scrum master, desde dezembro de 2025. A equipe entregou 464 itens de trabalho de plataforma e DevOps até outubro de 2026; a fase 1 está entregue e a fase 2 está em andamento.
Stack
Serviços utilizados
Os serviços por trás deste trabalho.
Perguntas frequentes
Quem é o cliente?
Uma empresa norte-americana de serviços de transporte com mais de 150 repositórios ativos em Kubernetes multicluster. Publicamos o caso sem o nome dela.
O que a Clouditive faz para essa empresa de transporte?
Engenharia de plataforma, DevOps e SRE: um portal de desenvolvimento em Backstage, infraestrutura de autosserviço com Crossplane, engenharia de releases, GitOps com Argo CD, observabilidade open source, um programa de métricas DORA e um fluxo de segurança compartilhado.
Quanto a frequência de deploys mudou?
Os deploys em produção por dia são cerca de 3 vezes os de dezembro de 2025, medidos em toda a organização de engenharia que apoiamos.
Como o gasto com observabilidade caiu?
Métricas e logs saíram de um APM comercial para OpenTelemetry com Mimir, Loki, Tempo, Pyroscope e Grafana, e o gasto caiu cerca de US$ 5.000 por mês.
O que há no portal de desenvolvimento?
Um catálogo do Backstage com cerca de 66 repositórios e 73 componentes, 11 templates de autosserviço, golden paths para cinco stacks e mais de 35 plugins de backend.
O que significa promover uma única imagem?
A imagem é construída uma vez e essa mesma imagem passa de um ambiente para o outro, então a produção roda exatamente o que foi testado. Hoje isso cobre mais de 31 repositórios, contra 4 no início.
Qual é o tamanho da equipe?
Seis pessoas desde dezembro de 2025: um líder e arquiteto, 2 engenheiros de plataforma, um engenheiro DevOps, um SRE e um scrum master.
Qual é a stack?
Kubernetes multicluster, Backstage, Crossplane, Argo CD, OpenTelemetry, Mimir, Loki, Tempo, Pyroscope, Grafana, OpenCost e CodeQL.
O que você precisa resolver?
Respondemos a todo pedido em até 1 dia útil. Assinamos um NDA antes da conversa, se você pedir.