O trabalho

O cliente
Uma empresa norte-americana de serviços de transporte
Status
Em andamento, fase 1 entregue
Equipe
6 pessoas: líder e arquiteto, 2 engenheiros de plataforma, engenheiro DevOps, SRE, scrum master

O que mudou na organização de engenharia desde dezembro de 2025?

Os números são de toda a organização e vêm do conjunto de métricas de engenharia do cliente, montado a partir de seus pull requests. No mesmo período a equipe cresceu e adotou ferramentas de IA, então eles descrevem a organização que apoiamos, não um resultado que atribuímos só a nós.

Os deploys em produção por dia são cerca de 3 vezes os de dezembro de 2025. Os dashboards foram de 18 para 135 em OpenTelemetry, e o gasto com observabilidade caiu cerca de US$ 5.000 por mês. A promoção de uma única imagem foi de 4 para 31 repositórios e o CI compartilhado, de 35 para 76. Os serviços de produto têm cerca de 90% de cobertura de testes, e o quality gate passa em 89% dos projetos.

  • ~3xmais deploys em produção por dia desde o início do trabalho (toda a organização)

  • ~90%de cobertura mediana de testes nos serviços de produto

Também registrado

  • Dashboards de 18 para 135, em OpenTelemetry
  • Cerca de US$ 5.000 por mês a menos em gasto com observabilidade
  • Promoção de uma única imagem de 4 para mais de 31 repositórios
  • CI compartilhado de 35 para mais de 76 repositórios
  • Quality gate passando em 89% dos projetos

O que fizemos, por área

Áreas de trabalho

  • Plataforma interna de desenvolvimento
  • Infraestrutura de autosserviço
  • Engenharia de releases e GitOps
  • Observabilidade
  • DevSecOps
  • Métricas de engenharia (DORA)
O cliente

Um ambiente cloud native em crescimento: mais de 150 repositórios em Kubernetes multicluster

O cliente é uma empresa norte-americana de serviços de transporte com mais de 150 repositórios ativos em Kubernetes multicluster em uma grande nuvem. Publicamos o caso sem o nome dela, como combinado.

Antes do trabalho, as releases saíam do tronco principal com congelamentos de código em cerca de 15 repositórios, o monitoramento era por cluster, com 18 dashboards e sem OpenTelemetry, e não havia portal de desenvolvimento, catálogo nem golden path.

Plataforma interna de desenvolvimento

Um portal Backstage com 11 templates de autosserviço

O portal está no ar desde a primavera de 2026 no hemisfério norte, em alta disponibilidade. Oferece 11 templates de autosserviço e esqueletos de golden path para cinco stacks, entre eles .NET, Python e Node.js.

  • Cerca de 66 repositórios e 73 componentes no catálogo.
  • Mais de 35 plugins de backend.
  • Infraestrutura de autosserviço com Crossplane nos três clusters: 54 recursos gerenciados via GitOps e 15 bancos de dados de serviço em um PostgreSQL compartilhado por ambiente.
Engenharia de releases e GitOps

Build uma vez, promova a mesma imagem e gerencie cada cluster pelo Git

Um modelo de branches de release com cortes, back-merges e verificações de drift automáticos substituiu os congelamentos de código. 17 repositórios o usam, com 34 release candidates e 10 releases em produção desde setembro de 2026.

  • Promoção de uma única imagem: de 4 para mais de 31 repositórios.
  • Biblioteca de CI compartilhada: de 35 para mais de 76 repositórios, com 9 workflows reutilizáveis novos.
  • Argo CD: de 46 para 101 aplicações e de 8 para 29 application sets, além de um cluster de gerenciamento adicionado em abril de 2026.
Observabilidade

De 18 dashboards por cluster a 135 em uma única stack open source

Coletores do OpenTelemetry rodam em cada cluster e enviam para Mimir, Loki, Tempo e Pyroscope centrais, lidos no Grafana com single sign-on. Monitoramento de usuários reais, OpenCost e exportadores de dados de engenharia completam o conjunto.

Hoje são 135 dashboards, 34 deles por serviço ou de métricas DORA. Tirar métricas e logs de um APM comercial reduziu o gasto com observabilidade em cerca de US$ 5.000 por mês.

DevSecOps e métricas de engenharia

Um fluxo de segurança compartilhado e um programa de métricas DORA

Desde fevereiro de 2026, um fluxo de segurança compartilhado roda varreduras de dependências, segredos, CodeQL e contêineres. O reforço da cadeia de suprimentos do CI está em andamento.

O programa DORA está no ar: os deploys por dia passaram de cerca de 4,4 para entre 12 e 16 em toda a organização.

Equipe

Seis pessoas dentro da organização de engenharia do cliente

Um líder e arquiteto, 2 engenheiros de plataforma, um engenheiro DevOps, um SRE e um scrum master, desde dezembro de 2025. A equipe entregou 464 itens de trabalho de plataforma e DevOps até outubro de 2026; a fase 1 está entregue e a fase 2 está em andamento.

Stack

  • Kubernetes (multicluster)
  • Backstage
  • Crossplane
  • Argo CD
  • PostgreSQL
  • OpenTelemetry
  • Mimir
  • Loki
  • Tempo
  • Pyroscope
  • Grafana
  • OpenCost
  • CodeQL

Serviços utilizados

Os serviços por trás deste trabalho.

Perguntas frequentes

Quem é o cliente?

Uma empresa norte-americana de serviços de transporte com mais de 150 repositórios ativos em Kubernetes multicluster. Publicamos o caso sem o nome dela.

O que a Clouditive faz para essa empresa de transporte?

Engenharia de plataforma, DevOps e SRE: um portal de desenvolvimento em Backstage, infraestrutura de autosserviço com Crossplane, engenharia de releases, GitOps com Argo CD, observabilidade open source, um programa de métricas DORA e um fluxo de segurança compartilhado.

Quanto a frequência de deploys mudou?

Os deploys em produção por dia são cerca de 3 vezes os de dezembro de 2025, medidos em toda a organização de engenharia que apoiamos.

Como o gasto com observabilidade caiu?

Métricas e logs saíram de um APM comercial para OpenTelemetry com Mimir, Loki, Tempo, Pyroscope e Grafana, e o gasto caiu cerca de US$ 5.000 por mês.

O que há no portal de desenvolvimento?

Um catálogo do Backstage com cerca de 66 repositórios e 73 componentes, 11 templates de autosserviço, golden paths para cinco stacks e mais de 35 plugins de backend.

O que significa promover uma única imagem?

A imagem é construída uma vez e essa mesma imagem passa de um ambiente para o outro, então a produção roda exatamente o que foi testado. Hoje isso cobre mais de 31 repositórios, contra 4 no início.

Qual é o tamanho da equipe?

Seis pessoas desde dezembro de 2025: um líder e arquiteto, 2 engenheiros de plataforma, um engenheiro DevOps, um SRE e um scrum master.

Qual é a stack?

Kubernetes multicluster, Backstage, Crossplane, Argo CD, OpenTelemetry, Mimir, Loki, Tempo, Pyroscope, Grafana, OpenCost e CodeQL.

O que você precisa resolver?

Respondemos a todo pedido em até 1 dia útil. Assinamos um NDA antes da conversa, se você pedir.