Infraestrutura de plataforma, SRE e engenharia de software operados como serviço, com SLA de plataforma e IA na operação. A infraestrutura roda na sua conta de cloud, o IaC fica no seu repositório e a contratação pode ser faturada pelo AWS Marketplace.
Entre 5 e 50 desenvolvedores, a operação já exige rotina de plataforma e ainda não sustenta uma squad dedicada de três pessoas. A lacuna aparece na disponibilidade, no custo de cloud e na fatia da semana dos seus engenheiros sêniores que nunca chega ao produto.
Uma pessoa domina o Terraform. Todo ambiente novo espera na fila dela.
Não existe rotação formal, runbook publicado nem SLO definido. Férias e desligamento viram risco operacional.
Atribuir gasto por time exigiria tag e owner em cada recurso. Ambientes de teste criados para uma migração antiga seguem faturando todo mês.
Os engenheiros mais caros da empresa mantêm pipeline e manifesto em vez de entregar produto.
A primeira fase dura cinco dias úteis e termina em um relatório priorizado. Você decide as fases seguintes com esse documento em mão.
A IA está no caminho de cada deploy, de cada alerta e de cada postmortem: os agentes leem o contexto, propõem a ação e escrevem o rascunho, e um engenheiro aprova antes que qualquer coisa toque a produção.
Um servidor MCP conecta VS Code, Cursor ou Claude Code à plataforma. O dev pergunta por que o deploy falhou, puxa o log do pod, confere o error budget e abre um rollback sem sair do editor.
Ambiente isolado e efêmero onde o agente sobe a aplicação, roda a suíte de testes e valida a mudança antes de qualquer pull request chegar perto da produção. Sem credencial e sem dado de produção dentro do sandbox.
No alerta, o agente correlaciona métrica, log, trace e o último deploy, e entrega ao plantonista a hipótese inicial ao lado do runbook correspondente. Quem decide e age é o engenheiro.
O rascunho do postmortem sai da timeline real do incidente, pronto para o time revisar. A revisão mensal de custo aponta recurso ocioso e oportunidade de rightsizing, com os números por trás de cada recomendação.
Guardrail: nenhum agente aplica mudança em produção sem aprovação de um engenheiro. Toda ação de agente roda sob identidade nominal, com least privilege e registro em trilha de auditoria, e o seu código-fonte e os seus dados de produção não são usados para treinar modelos de terceiros.
Contratar dois SREs e um engenheiro de plataforma é a decisão que a kumbuca substitui. O comparativo abaixo usa os números dessa folha, sem contar ferramenta, treinamento e os meses de processo seletivo.
Dois SREs e um engenheiro de plataforma, salário com encargos.
SRE as a Service com plataforma gerenciada, em contrato mensal com aviso prévio de 30 dias. São 12 meses do preço de tabela de R$ 24,9 mil por mês.
Quatro formatos de contratação: a plataforma open source, a infraestrutura de plataforma gerenciada, a operação de confiabilidade ou um projeto com escopo definido. Eles se combinam, e o caminho mais comum começa pela plataforma e adiciona SRE quando os primeiros SLOs passam a valer. Todo valor abaixo é o piso da faixa; o número final sai do diagnóstico.
Você pega os módulos abertos da kumbuca e implanta na sua própria infraestrutura. A implantação e a operação ficam com o seu time.
Entregamos a plataforma interna de desenvolvimento pronta e assumimos a operação dela.
Medimos disponibilidade contra SLO e respondemos pelo plantão, com agentes fazendo a primeira leitura de cada alerta.
Escopo e preço fechados antes do início, com pagamento por entrega.
Todos os planos pagos podem ser faturados pelo AWS Marketplace e chegam na fatura de cloud que você já paga. Veja como funciona o faturamento.
A kumbuca pode ser faturada pelo AWS Marketplace. O valor entra na fatura de AWS que a sua empresa já paga, com a mesma pessoa jurídica, a mesma forma de pagamento e o mesmo centro de custo. Sem cadastrar um fornecedor novo e sem negociar um novo contrato de compras.
A contratação acontece como private offer no Marketplace, sob os termos que a sua empresa já aceitou com a AWS. Sem onboarding de fornecedor, sem nova rodada jurídica e sem novo cadastro no seu ERP.
Plataforma, SRE e consumo de cloud chegam no mesmo documento, no ciclo de faturamento que o seu financeiro já concilia todo mês.
Ofertas elegíveis no Marketplace contam para o compromisso de consumo do seu contrato com a AWS (EDP ou Private Pricing). Confirmamos a elegibilidade com você e com a AWS antes de emitir a oferta.
O gasto sai do orçamento de infraestrutura que já está aprovado, em vez de abrir uma vaga nova de engenharia e esperar um trimestre para fechá-la.
Prefere manter a contratação separada? Também faturamos direto por nota fiscal no Brasil. A listagem em marketplace e as private offers estão disponíveis para AWS; para Google Cloud, DigitalOcean e MagaluCloud, a contratação é direta.
O SLA cobre a plataforma que a kumbuca opera: disponibilidade no ingress, resposta a incidentes, patching e relatório. Os valores abaixo são os compromissos que entram no contrato, e a redação final de cada um é fechada na assinatura.
| Compromisso de plataforma | Horário comercial | Plantão estendido |
|---|---|---|
| Disponibilidade da plataforma | 99,90% | 99,90% |
| Confirmação de recebimento de P1 (produção indisponível) | 30 min | 15 min |
| Confirmação de recebimento de P2 (serviço degradado) | 4 h | 1 h |
| Postmortem publicado | 5 dias úteis | 3 dias úteis |
| Janela de patching de segurança | 7 dias | 72 h |
| Relatório de SLO, incidentes e custo | Mensal | Mensal |
| Janela de saída assistida, sem taxa | 30 dias | 60 dias |
SLI de disponibilidade: razão de requisições sem erro 5xx no ingress, apurada em janela mensal dentro da cobertura contratada. Confirmação de recebimento quer dizer que um engenheiro nominal confirma o recebimento e passa a trabalhar no incidente, e é contada a partir do momento em que o alerta chega à rotação. O plantão estendido cobre a janela declarada em contrato. O SLA cobre a camada de plataforma operada pela kumbuca. Ele não se estende a defeito no código da sua aplicação nem a indisponibilidade do provedor de cloud subjacente, que responde pelo SLA dele. Remédio por descumprimento: crédito sobre a mensalidade, fixado em contrato como remédio único e exclusivo.
Na sua. O contrato de cloud fica no nome da sua empresa, o IaC no seu repositório e os dados de observabilidade sob o seu controle. A kumbuca opera com acesso nominal e auditável, e todo ativo que criamos é propriedade sua desde o primeiro dia.
Sim. Emitimos uma private offer no AWS Marketplace e o valor entra na fatura de AWS que a sua empresa já paga, sem novo contrato de compras. Quando a oferta é elegível, o gasto abate o compromisso de consumo do seu contrato com a AWS; confirmamos isso com você e com a AWS antes de emitir. Faturamento direto por nota fiscal no Brasil também está disponível.
Quer dizer que a IA está no caminho da operação. O SRE Agent é um servidor MCP que os seus devs plugam no VS Code, no Cursor ou no Claude Code para consultar a plataforma e abrir um rollback. O sandbox de app permite que agentes rodem e validem uma mudança antes que ela chegue à produção. No alerta, um agente correlaciona métrica, log e o último deploy e entrega ao plantonista a hipótese inicial. Toda ação que altera a produção continua exigindo aprovação humana e fica registrada em trilha de auditoria, e o seu código e os seus dados de produção não são usados para treinar modelos de terceiros.
O contrato prevê uma janela de saída assistida de 30 ou 60 dias, conforme o plano: handover documentado, treinamento do time que assume a operação e revogação de acesso ao final, sem taxa. A transição faz parte do escopo do serviço.
Não. A stack é Terraform, Kubernetes, Argo CD, FluxCD, Prometheus, Grafana e OpenTelemetry, toda open source e com profissionais disponíveis no mercado brasileiro. A operação fica documentada em runbook para que o seu time consiga assumir a qualquer momento.
Contas nominais por engenheiro, least privilege, MFA obrigatório e trilha de auditoria completa, e as mesmas regras valem para cada agente. O contrato inclui NDA e cláusulas de LGPD, com acordo de tratamento de dados quando aplicável. Acesso a dados de produção acontece apenas por elevação temporária, aprovada pelo seu time, com TTL definido e sessão registrada em trilha de auditoria.
Atendemos de 5 a 50 desenvolvedores no formato de operação contínua. Abaixo dessa faixa, indicamos um projeto pontual de consultoria. Acima dela, assumimos a operação e conduzimos a formação do time interno em paralelo, com transferência progressiva de escopo.
O relatório de diagnóstico sai em cinco dias úteis. As primeiras entregas de fundação entram em produção em 30 dias, começando por CI/CD com rollback e pelos primeiros SLOs, que são os dois itens de maior efeito imediato na rotina do time.
Não. Assumimos a plataforma e a operação para que o time de produto trabalhe em produto. O escopo da kumbuca termina na plataforma; a aplicação continua sendo desenvolvida pelo seu time, agora com a plataforma e os agentes trabalhando a favor dele.
O diagnóstico leva cinco dias úteis e não tem custo. Você recebe um relatório priorizado da sua infraestrutura, com riscos mapeados e estimativa de esforço por item.