Playbooks tecnicos

Quando o problema aparece, o primeiro ganho e parar de agir no escuro.

Use estes playbooks para responder a problemas comuns em sistemas web: API lenta, erro 500, deploy quebrado, formulario sem e-mail, conversao sem rastreamento, segredo exposto e pagina que nao indexa.

Como usar

O playbook segura a pressa para preservar evidencia.

Em incidentes pequenos ou grandes, a tentacao e mexer em tudo. O roteiro abaixo ajuda a separar triagem, contencao, correcao e prevencao sem perder o rastro do que aconteceu.

01

Triar

Confirmar sintoma, alcance, horario, rota, origem e mudanca recente.

02

Conter

Reduzir impacto sem destruir logs, evidencias ou caminho de rollback.

03

Prevenir

Transformar o aprendizado em checklist, indicador, documento, teste ou rotina.

Cenarios de resposta

Playbooks para os problemas que mais pedem calma tecnica.

Cada roteiro tem gatilho, primeiros minutos, contencao, correcao, prevencao, evidencias e links para materiais relacionados.

Performance

API lenta em producao

Usuarios percebem lentidao, tempo p95 sobe ou uma rota critica passa a responder fora do padrao.

Primeiros minutos

  • Confirmar qual rota esta lenta e se o problema e geral ou isolado
  • Comparar horario do sintoma com deploy, carga, banco, integracao externa ou campanha ativa
  • Separar logs de backend, proxy e banco do periodo afetado
  • Evitar mudar infraestrutura antes de medir onde esta o gargalo

Contencao

  • Reduzir chamadas repetidas ou fluxos nao essenciais quando houver caminho simples
  • Comunicar area afetada e horario estimado de nova verificacao
  • Se houver versao recem-publicada e evidencia forte, avaliar rollback

Correcao

  • Medir tempo por etapa: controller, service, banco, integracao e serializacao
  • Revisar consultas, indices, payloads e chamadas externas
  • Validar a correcao com a mesma rota, mesmo tipo de payload e horario parecido

Prevencao

  • Registrar tempo p95 de rotas importantes
  • Criar observabilidade minima antes de nova otimizacao
  • Adicionar checklist de performance para rotas criticas
Evidencias que devem ficar registradas

Rota afetada, Tempo p95, Horario, Logs, Mudanca recente, Consulta ou integracao suspeita.

Backend

Erro 500 depois de mudanca

Uma rota publica ou fluxo critico passa a retornar erro 500 depois de deploy, migracao ou mudanca de configuracao.

Primeiros minutos

  • Identificar endpoint, usuario, payload e horario do erro
  • Conferir se o erro aparece em todos os acessos ou apenas em um fluxo
  • Ler stack trace completo antes de tentar corrigir por tentativa
  • Comparar erro com commit, variavel, banco, dependencia ou permissao alterada

Contencao

  • Reduzir exposicao do fluxo com maior impacto quando existir alternativa operacional
  • Avaliar rollback se o erro bloqueia receita, lead ou operacao essencial
  • Evitar apagar logs antes de registrar evidencia minima

Correcao

  • Reproduzir o erro com dados equivalentes
  • Corrigir causa confirmada, nao apenas o sintoma visivel
  • Validar resposta esperada, status HTTP, mensagem de erro e logs depois da correcao

Prevencao

  • Adicionar caso ao checklist de API ou deploy
  • Criar teste para o fluxo que quebrou quando for viavel
  • Registrar incidente e decisao tomada
Evidencias que devem ficar registradas

Endpoint, Payload, Stack trace, Commit, Variaveis, Status HTTP, Usuario afetado.

Deploy

Deploy publicado com rota quebrada

Pipeline ou container sobe, mas uma rota SPA, arquivo tecnico, formulario, API ou pagina publica nao funciona.

Primeiros minutos

  • Confirmar versao publicada, container ativo e horario do deploy
  • Testar home, rota interna, API, formulario, sitemap.xml, robots.txt, ads.txt e feed.xml
  • Conferir logs de Nginx/proxy, backend e frontend servido
  • Comparar ambiente local, container e dominio publico

Contencao

  • Se pagina publica importante quebrou, decidir entre rollback e hotfix curto
  • Registrar rotas afetadas antes de mexer na configuracao
  • Evitar multiplas alteracoes simultaneas em DNS, proxy e app

Correcao

  • Corrigir rota, build, proxy, variavel, base URL ou configuracao de SPA
  • Validar rotas publicas e arquivos tecnicos depois da correcao
  • Confirmar logs sem erro novo nos primeiros acessos

Prevencao

  • Manter checklist pos-deploy obrigatorio
  • Documentar rollback e comandos de validacao
  • Adicionar paginas novas ao sitemap e busca interna
Evidencias que devem ficar registradas

Commit publicado, Rotas testadas, Logs proxy, Logs backend, Status HTTP, Plano de rollback.

Leads

Formulario salva contato, mas e-mail falha

O contato aparece no banco ou log, mas a notificacao por e-mail nao chega ou e rejeitada pelo SMTP.

Primeiros minutos

  • Confirmar se o contato foi salvo antes de analisar o SMTP
  • Conferir remetente, reply-to, usuario autenticado e destinatario
  • Ler a mensagem exata de rejeicao do provedor de e-mail
  • Testar envio com os mesmos dados de ambiente usados em producao

Contencao

  • Preservar contatos salvos para retorno manual
  • Avisar que notificacao automatica esta em validacao, se houver area responsavel
  • Evitar trocar senha ou host sem registrar configuracao atual

Correcao

  • Ajustar From para uma conta reconhecida pelo servidor
  • Manter e-mail do visitante como Reply-To
  • Validar porta, SSL, autenticacao, senha e timeouts

Prevencao

  • Criar teste periodico do formulario principal
  • Monitorar falhas de envio e origem da pagina
  • Registrar variaveis SMTP esperadas sem expor senha no repositorio
Evidencias que devem ficar registradas

ID do contato, Origem da pagina, UTM, Erro SMTP, From, Reply-To, Variaveis de ambiente.

Google Ads

Campanha com clique, mas sem conversao registrada

Google Ads mostra cliques, mas a conversao nao aparece ou o contato chega sem UTMs confiaveis.

Primeiros minutos

  • Abrir a pagina de destino com UTMs reais ou simuladas
  • Testar envio do formulario e confirmar origem recebida no e-mail
  • Usar Tag Assistant para conferir Google tag e evento de conversao
  • Separar problema de tag, formulario, redirecionamento, consentimento ou cache

Contencao

  • Evitar aumentar orcamento ate confirmar que conversao esta mensuravel
  • Manter campanha ativa apenas se o formulario e a pagina estiverem saudaveis
  • Registrar o teste feito com URL, horario e resultado

Correcao

  • Corrigir tag, evento, URL final, UTM ou leitura de parametros pelo formulario
  • Validar novamente no navegador e no Tag Assistant
  • Comparar contato recebido com source, medium e campaign esperados

Prevencao

  • Testar conversao depois de deploy e alteracao de pagina
  • Padronizar sufixo de URL final nas campanhas
  • Manter indicador de origem de leads
Evidencias que devem ficar registradas

URL com UTM, Evento de conversao, Contato recebido, Tag Assistant, Origem, Campanha.

Seguranca

Senha, token ou segredo exposto

Uma senha, token, chave de API, acesso SMTP, banco ou credencial aparece em codigo, log, print ou arquivo versionado.

Primeiros minutos

  • Identificar qual segredo foi exposto e onde apareceu
  • Avaliar se o segredo da acesso a producao, dados, e-mail, DNS ou fornecedor
  • Rotacionar o segredo antes de discutir refatoracao ampla
  • Registrar horario, local e possivel alcance

Contencao

  • Revogar token ou senha antiga
  • Remover acesso desnecessario de usuarios e servicos
  • Evitar compartilhar novamente o segredo em canais abertos

Correcao

  • Mover segredo para variavel de ambiente ou cofre adequado
  • Revisar historico, logs e arquivos relacionados quando aplicavel
  • Validar que a aplicacao funciona com o novo segredo

Prevencao

  • Documentar variaveis sensiveis esperadas sem valor real
  • Separar usuario por responsabilidade
  • Incluir revisao de segredos na rotina mensal
Evidencias que devem ficar registradas

Tipo de segredo, Local de exposicao, Horario, Servico afetado, Rotacao feita, Acessos revisados.

SEO tecnico

Pagina importante nao aparece na busca

Uma pagina editorial, artigo, material ou rota principal foi publicada, mas nao aparece em sitemap, busca interna ou Search Console.

Primeiros minutos

  • Confirmar se a pagina responde 200 em producao
  • Verificar canonical, robots, sitemap.xml e links internos
  • Conferir se a rota existe no frontend e no backend de sitemap
  • Testar se a busca interna encontra o conteudo por termos relevantes

Contencao

  • Evitar pedir revisao de AdSense antes de validar paginas principais
  • Registrar rotas novas que ainda precisam de indexacao
  • Priorizar paginas de maior valor editorial ou comercial

Correcao

  • Adicionar rota ao mapa do site, sitemap XML, busca e links internos
  • Solicitar indexacao no Search Console quando fizer sentido
  • Validar robots.txt, sitemap.xml, ads.txt e feed.xml

Prevencao

  • Usar checklist editorial para toda pagina nova
  • Conectar cada pagina a pelo menos uma rota de descoberta real
  • Atualizar memoria do projeto e checklist de revisao
Evidencias que devem ficar registradas

Status HTTP, Canonical, Sitemap, Busca interna, Links internos, Search Console.

Perguntas comuns

Playbook bom vira memoria tecnica.

O objetivo nao e criar burocracia. E fazer o proximo incidente ser mais facil de entender, corrigir e evitar.

01

Playbook tecnico e a mesma coisa que checklist?

Nao exatamente. Checklist ajuda a validar itens. Playbook organiza uma resposta em etapas quando o problema ja apareceu: triagem, contencao, correcao e prevencao.

02

Quando devo usar um playbook?

Use quando existe sintoma real em producao, campanha, formulario, seguranca, deploy ou indexacao. O objetivo e reduzir tentativa solta e preservar evidencias.

03

Como escolher entre playbook, priorizador e mapa de riscos?

Use o mapa para reconhecer o risco, o priorizador para ordenar urgencia e o playbook para agir no cenario escolhido.

WhatsApp(12) 98855-9188