kumbuca
Platform & Reliability Engineering IA first

Seu time de plataforma,
em contrato mensal

Infraestrutura de plataforma, SRE e engenharia de software operados como serviço, com SLA de plataforma e IA na operação. A infraestrutura roda na sua conta de cloud, o IaC fica no seu repositório e a contratação pode ser faturada pelo AWS Marketplace.

Agendar diagnóstico gratuito Ver como funciona
SRE Agent no seu editor, via MCP Stack open source, do Terraform ao OpenTelemetry Faturável pelo AWS Marketplace Primeiras entregas em produção em 30 dias
Clouds que operamos
AWS Google Cloud DigitalOcean MagaluCloud On-premise
Tecnologias open source
Kubernetes Terraform Argo CD FluxCD Prometheus OpenTelemetry
O problema

Entre 5 e 50 devs, a plataforma vira trabalho de tempo inteiro

Entre 5 e 50 desenvolvedores, a operação já exige rotina de plataforma e ainda não sustenta uma squad dedicada de três pessoas. A lacuna aparece na disponibilidade, no custo de cloud e na fatia da semana dos seus engenheiros sêniores que nunca chega ao produto.

Provisionar um ambiente leva semanas

Uma pessoa domina o Terraform. Todo ambiente novo espera na fila dela.

O plantão depende de uma pessoa

Não existe rotação formal, runbook publicado nem SLO definido. Férias e desligamento viram risco operacional.

O custo de cloud sobe sem rastreio

Atribuir gasto por time exigiria tag e owner em cada recurso. Ambientes de teste criados para uma migração antiga seguem faturando todo mês.

Engenheiro sênior mantendo pipeline

Os engenheiros mais caros da empresa mantêm pipeline e manifesto em vez de entregar produto.

Como funciona

O diagnóstico é a primeira fase e não tem custo

A primeira fase dura cinco dias úteis e termina em um relatório priorizado. Você decide as fases seguintes com esse documento em mão.

Começar pelo diagnóstico
01 · SEMANA 1 · SEM CUSTO

Diagnóstico

Mapeamos a infraestrutura, o custo, os riscos e o nível de automação atual. Você recebe um relatório priorizado com estimativa de esforço para cada item.

  • Inventário de infraestrutura e de custo
  • Os cinco maiores riscos de confiabilidade
  • Baseline das métricas DORA a partir do seu CI e do histórico de incidentes
  • Correções aplicáveis nos primeiros 30 dias
02 · 30–60 DIAS

Fundação

Escopo e preço fechados

Em 30 a 60 dias entregamos a base que um time interno levaria cerca de seis meses para montar: IaC versionada, ambientes reproduzíveis a partir do código, CI/CD com rollback automático e observabilidade com SLOs definidos junto com os seus engenheiros.

  • Módulos Terraform no seu Git
  • Golden paths por linguagem
  • Métricas, logs, traces e alertas
  • Runbooks, rotação de plantão e o SRE Agent conectado ao seu editor
03 · CONTÍNUO

Operação

Mensal, aviso prévio de 30 dias

O plantão passa para a nossa rotação no primeiro dia. Com ele vêm o planejamento de capacidade, o patching, o custo e a evolução da plataforma, com os nossos agentes fazendo a primeira leitura de cada alerta.

  • Plantão com rotação e escalonamento definidos
  • Postmortem blameless com ações rastreadas
  • Revisão contínua de custo de cloud
  • Relatório mensal de SLO, incidentes e custo
IA first

Operação assistida por IA, do editor ao plantão

A IA está no caminho de cada deploy, de cada alerta e de cada postmortem: os agentes leem o contexto, propõem a ação e escrevem o rascunho, e um engenheiro aprova antes que qualquer coisa toque a produção.

SRE Agent no seu editor, via MCP

Um servidor MCP conecta VS Code, Cursor ou Claude Code à plataforma. O dev pergunta por que o deploy falhou, puxa o log do pod, confere o error budget e abre um rollback sem sair do editor.

Sandbox de app para IA

Ambiente isolado e efêmero onde o agente sobe a aplicação, roda a suíte de testes e valida a mudança antes de qualquer pull request chegar perto da produção. Sem credencial e sem dado de produção dentro do sandbox.

Triagem de incidente assistida

No alerta, o agente correlaciona métrica, log, trace e o último deploy, e entrega ao plantonista a hipótese inicial ao lado do runbook correspondente. Quem decide e age é o engenheiro.

Postmortem e custo com IA

O rascunho do postmortem sai da timeline real do incidente, pronto para o time revisar. A revisão mensal de custo aponta recurso ocioso e oportunidade de rightsizing, com os números por trás de cada recomendação.

Guardrail: nenhum agente aplica mudança em produção sem aprovação de um engenheiro. Toda ação de agente roda sob identidade nominal, com least privilege e registro em trilha de auditoria, e o seu código-fonte e os seus dados de produção não são usados para treinar modelos de terceiros.

Comparativo

O comparativo é com a contratação do time

Contratar dois SREs e um engenheiro de plataforma é a decisão que a kumbuca substitui. O comparativo abaixo usa os números dessa folha, sem contar ferramenta, treinamento e os meses de processo seletivo.

Montar o time internamente

R$ 1,4 mi a R$ 1,9 mi/ano

Dois SREs e um engenheiro de plataforma, salário com encargos.

  • Três a seis meses de processo seletivo por vaga
  • Férias e desligamento reabrem a lacuna de cobertura
  • Ferramentas, licenças, treinamento e budget de IA entram como custo adicional
  • Conhecimento operacional concentrado em duas ou três pessoas
  • Folha exige headcount aprovado, que é outra linha de orçamento
  • Operação interna não vem com SLA de plataforma

kumbuca

A partir de R$ 298,8 mil/ano

SRE as a Service com plataforma gerenciada, em contrato mensal com aviso prévio de 30 dias. São 12 meses do preço de tabela de R$ 24,9 mil por mês.

  • Diagnóstico na primeira semana, fundação em produção em 30 dias
  • Rotação de plantão com escalonamento definido, sem ponto único de falha
  • Ferramentas, observabilidade, runbooks e agentes de IA inclusos
  • Documentação e runbooks entram como entregável de contrato
  • Faturável pelo AWS Marketplace, dentro do budget de cloud que você já tem
  • SLA de plataforma, penalidade e janela de saída em cláusula
Preços

Planos e preços

Quatro formatos de contratação: a plataforma open source, a infraestrutura de plataforma gerenciada, a operação de confiabilidade ou um projeto com escopo definido. Eles se combinam, e o caminho mais comum começa pela plataforma e adiciona SRE quando os primeiros SLOs passam a valer. Todo valor abaixo é o piso da faixa; o número final sai do diagnóstico.

Self-hosted

Plataforma open source, self-hosted

Você pega os módulos abertos da kumbuca e implanta na sua própria infraestrutura. A implantação e a operação ficam com o seu time.

  • Módulos Terraform e manifestos em repositório público
  • Kubernetes, Argo CD, FluxCD, Prometheus e OpenTelemetry
  • Golden path self-service por linguagem
  • Runbooks e documentação de operação inclusos
  • Roda na sua conta de cloud
  • Suporte pela comunidade. O SRE Agent e o sandbox de IA vêm nos planos pagos.
Código aberto Sem custo
Falar sobre self-hosted
Infraestrutura de plataforma

Infraestrutura de plataforma gerenciada

Entregamos a plataforma interna de desenvolvimento pronta e assumimos a operação dela.

  • Kubernetes e rede provisionados por Terraform
  • CI/CD com rollback automático
  • Ambiente efêmero por pull request
  • Sandbox de app para IA, isolado e sem credencial de produção
  • MCP para plugar no seu editor (SRE Agent)
  • Gestão de secrets com rotação e política de acesso por identidade
  • Roda na sua conta de cloud
A partir de R$ 12,9 mil/mês
Falar com um engenheiro
RECOMENDADO
SRE as a Service

Plantão, SLO e resposta a incidentes

Medimos disponibilidade contra SLO e respondemos pelo plantão, com agentes fazendo a primeira leitura de cada alerta.

  • Rotação em horário comercial, com plantão estendido como complemento
  • SLI/SLO definidos junto com o seu time
  • MCP para plugar no seu editor (SRE Agent)
  • Sandbox de app para IA para validar mudanças antes da produção
  • Triagem assistida por IA, com aprovação humana em toda ação
  • Alertas derivados de SLO, com revisão mensal de ruído
  • Postmortem blameless com ações rastreadas
  • Planejamento de capacidade, patching e custo de cloud como métrica mensal
A partir de R$ 24,9 mil/mês
Agendar diagnóstico
Consultoria

Projetos de engenharia de software e plataforma

Escopo e preço fechados antes do início, com pagamento por entrega.

  • Migração entre clouds ou para Kubernetes
  • Redução de custo de cloud
  • Adoção de IA na engenharia: agentes, MCP e guardrails
  • Hardening de segurança e adequação à LGPD
  • Performance e escalabilidade
  • Due diligence técnica para M&A
  • Liderança técnica em par com o seu time durante o projeto
A partir de R$ 45 mil/escopo
Descrever meu projeto

Todos os planos pagos podem ser faturados pelo AWS Marketplace e chegam na fatura de cloud que você já paga. Veja como funciona o faturamento.

AWS Marketplace

Está dentro do seu budget de cloud

A kumbuca pode ser faturada pelo AWS Marketplace. O valor entra na fatura de AWS que a sua empresa já paga, com a mesma pessoa jurídica, a mesma forma de pagamento e o mesmo centro de custo. Sem cadastrar um fornecedor novo e sem negociar um novo contrato de compras.

Sem novo contrato de compras

A contratação acontece como private offer no Marketplace, sob os termos que a sua empresa já aceitou com a AWS. Sem onboarding de fornecedor, sem nova rodada jurídica e sem novo cadastro no seu ERP.

Uma fatura, um ciclo

Plataforma, SRE e consumo de cloud chegam no mesmo documento, no ciclo de faturamento que o seu financeiro já concilia todo mês.

Abate o compromisso de consumo

Ofertas elegíveis no Marketplace contam para o compromisso de consumo do seu contrato com a AWS (EDP ou Private Pricing). Confirmamos a elegibilidade com você e com a AWS antes de emitir a oferta.

Usa o orçamento de cloud aprovado

O gasto sai do orçamento de infraestrutura que já está aprovado, em vez de abrir uma vaga nova de engenharia e esperar um trimestre para fechá-la.

Prefere manter a contratação separada? Também faturamos direto por nota fiscal no Brasil. A listagem em marketplace e as private offers estão disponíveis para AWS; para Google Cloud, DigitalOcean e MagaluCloud, a contratação é direta.

SLA da plataforma

O nível de serviço da plataforma que operamos

O SLA cobre a plataforma que a kumbuca opera: disponibilidade no ingress, resposta a incidentes, patching e relatório. Os valores abaixo são os compromissos que entram no contrato, e a redação final de cada um é fechada na assinatura.

Compromisso de plataforma Horário comercial Plantão estendido
Disponibilidade da plataforma 99,90% 99,90%
Confirmação de recebimento de P1 (produção indisponível) 30 min 15 min
Confirmação de recebimento de P2 (serviço degradado) 4 h 1 h
Postmortem publicado 5 dias úteis 3 dias úteis
Janela de patching de segurança 7 dias 72 h
Relatório de SLO, incidentes e custo Mensal Mensal
Janela de saída assistida, sem taxa 30 dias 60 dias

SLI de disponibilidade: razão de requisições sem erro 5xx no ingress, apurada em janela mensal dentro da cobertura contratada. Confirmação de recebimento quer dizer que um engenheiro nominal confirma o recebimento e passa a trabalhar no incidente, e é contada a partir do momento em que o alerta chega à rotação. O plantão estendido cobre a janela declarada em contrato. O SLA cobre a camada de plataforma operada pela kumbuca. Ele não se estende a defeito no código da sua aplicação nem a indisponibilidade do provedor de cloud subjacente, que responde pelo SLA dele. Remédio por descumprimento: crédito sobre a mensalidade, fixado em contrato como remédio único e exclusivo.

Perguntas frequentes

Dúvidas que aparecem na primeira call

A infraestrutura fica na conta de quem?

Na sua. O contrato de cloud fica no nome da sua empresa, o IaC no seu repositório e os dados de observabilidade sob o seu controle. A kumbuca opera com acesso nominal e auditável, e todo ativo que criamos é propriedade sua desde o primeiro dia.

Dá para pagar pelo AWS Marketplace?

Sim. Emitimos uma private offer no AWS Marketplace e o valor entra na fatura de AWS que a sua empresa já paga, sem novo contrato de compras. Quando a oferta é elegível, o gasto abate o compromisso de consumo do seu contrato com a AWS; confirmamos isso com você e com a AWS antes de emitir. Faturamento direto por nota fiscal no Brasil também está disponível.

O que quer dizer “IA first” na prática?

Quer dizer que a IA está no caminho da operação. O SRE Agent é um servidor MCP que os seus devs plugam no VS Code, no Cursor ou no Claude Code para consultar a plataforma e abrir um rollback. O sandbox de app permite que agentes rodem e validem uma mudança antes que ela chegue à produção. No alerta, um agente correlaciona métrica, log e o último deploy e entrega ao plantonista a hipótese inicial. Toda ação que altera a produção continua exigindo aprovação humana e fica registrada em trilha de auditoria, e o seu código e os seus dados de produção não são usados para treinar modelos de terceiros.

E se a gente quiser sair?

O contrato prevê uma janela de saída assistida de 30 ou 60 dias, conforme o plano: handover documentado, treinamento do time que assume a operação e revogação de acesso ao final, sem taxa. A transição faz parte do escopo do serviço.

Vocês usam ferramenta proprietária?

Não. A stack é Terraform, Kubernetes, Argo CD, FluxCD, Prometheus, Grafana e OpenTelemetry, toda open source e com profissionais disponíveis no mercado brasileiro. A operação fica documentada em runbook para que o seu time consiga assumir a qualquer momento.

Como funcionam acesso e segurança?

Contas nominais por engenheiro, least privilege, MFA obrigatório e trilha de auditoria completa, e as mesmas regras valem para cada agente. O contrato inclui NDA e cláusulas de LGPD, com acordo de tratamento de dados quando aplicável. Acesso a dados de produção acontece apenas por elevação temporária, aprovada pelo seu time, com TTL definido e sessão registrada em trilha de auditoria.

Nosso time é pequeno ou grande demais?

Atendemos de 5 a 50 desenvolvedores no formato de operação contínua. Abaixo dessa faixa, indicamos um projeto pontual de consultoria. Acima dela, assumimos a operação e conduzimos a formação do time interno em paralelo, com transferência progressiva de escopo.

Em quanto tempo alguma coisa chega em produção?

O relatório de diagnóstico sai em cinco dias úteis. As primeiras entregas de fundação entram em produção em 30 dias, começando por CI/CD com rollback e pelos primeiros SLOs, que são os dois itens de maior efeito imediato na rotina do time.

Vocês substituem nossos desenvolvedores?

Não. Assumimos a plataforma e a operação para que o time de produto trabalhe em produto. O escopo da kumbuca termina na plataforma; a aplicação continua sendo desenvolvida pelo seu time, agora com a plataforma e os agentes trabalhando a favor dele.

Próximo passo

Comece pelo diagnóstico

O diagnóstico leva cinco dias úteis e não tem custo. Você recebe um relatório priorizado da sua infraestrutura, com riscos mapeados e estimativa de esforço por item.

  • Uma call de 45 minutos conduzida pelo engenheiro que vai executar o diagnóstico
  • Acesso somente leitura já é suficiente para começar
  • Relatório com riscos, correções aplicáveis e estimativa de esforço
  • NDA assinado antes de qualquer acesso
Prefere escolher um horário? Abrir a agenda Ou escreva para [email protected]

Respondemos em até um dia útil. Seus dados são usados apenas para responder a esta solicitação, conforme a LGPD, e não são compartilhados com terceiros.