Defina severidade, cobertura, tempos, responsabilidades e escalada com exemplos operacionais verificáveis.

Um SLA deve ajudar a agir durante problemas. Resposta rápida ou suporte completo não são verificáveis sem relógio, âmbito e ação. Distinga confirmação, investigação, recuperação e solução permanente. Responder imediatamente não significa restaurar o serviço; os resultados não devem ser apresentados como a mesma promessa.
Definir severidade por impacto
Use exemplos de percursos, utilizadores e alternativas. Uma falha de pagamento pode pesar mais do que defeito visual muito visto. Diga quem classifica e revê, e como resolver divergência. Inclua segurança e integridade sem assumir que todo alerta confirma incidente. A matriz deve ser utilizável sob pressão e testada com situações de fronteira.
Clarificar o relógio
Indique fuso, dias, feriados e cobertura fora de horas. Defina início válido, canal e informações necessárias. Se o tempo pausa por dependência do cliente, concrete condições e aviso. Separe compromisso de estimativa dependente de terceiros. Não prometa solução universal para defeitos desconhecidos sem fronteiras. Explique continuidade quando a janela termina.
Atribuir responsabilidades
- Sistemas, ambientes, integrações, versões excluídas e defeitos herdados.
- Acessos, aprovações e comunicação de cliente e fornecedor.
- Contactos, frequência de atualizações e ação perante risco de incumprimento.
- Inclusão ou orçamento separado de emergência, causa e correção permanente.
Ensaiar o acordo
Simule checkout indisponível no fim do horário: quem recebe, publica, comunica e age se o pagamento externo falha? Corrija ambiguidades antes do incidente. Meça relatórios pelo relógio e resultados, não pelo volume de tickets. Ambas as partes devem ter versão atual e compreender promessa e evidência. Documente passagens de turno: um pedido reconhecido sem responsável seguinte pode ficar parado. Exceções também precisam de proprietário e ação, para não transformarem compromissos claros numa lista de justificações sem acompanhamento.
- Manutenção e suporte
- Checklist de manutenção para sites críticos
- Manutenção mensal ou por pedido: comparar disponibilidade
Perguntas frequentes
Resposta é resolução?
Não. Primeira ação, recuperação e reparação duradoura são resultados distintos.
Horário útil inclui noite?
Só se acordado. Dias, fuso e prevenção devem ser explícitos.
Tudo precisa de prazo fixo?
Use obrigações realistas e dependências; falhas desconhecidas podem exigir objetivos distintos.
Quem decide severidade?
Papéis nomeados com exemplos de impacto e revisão.
O que medir?
Resposta, recuperação, condições do relógio, incumprimentos, exceções e correções.
Da ideia a um âmbito que se consegue executar
Partilhe o percurso do utilizador, integrações e condições de lançamento. Podemos preparar uma estimativa com pressupostos e exclusões.
Leitura complementar
Checklist de manutenção para sites críticos
Organize manutenção por percursos de negócio, cópias recuperáveis, atualizações controladas, acessos e provas de trabalho.
Manutenção mensal ou por pedido: comparar disponibilidade
Compare capacidade reservada e trabalho pontual por prevenção, resposta, picos, horas não usadas e custo de esperar.
Passagem de manutenção: provar capacidade operacional
Transfira software com acessos verificados, publicações reproduzíveis, recuperação, dependências e exceções aceites.