IT

Entrada e escalonamento de incidentes

Os incidentes tecnológicos entram por diferentes canais e perdem gravidade, propriedade e disciplina de escalonamento durante a resposta.

Problema de negócios

Os incidentes tecnológicos entram por diferentes canais e perdem gravidade, propriedade e disciplina de escalonamento durante a resposta.

O que as equipes veem

  • O trabalho espera entre receber o incidente e validar o serviço afetado.
  • Os proprietários reconstroem o status do webhook genérico e do Jira.

Por que isso acontece

  • Nenhum estado compartilhado abrange webhook genérico, Jira, Slack.
  • As regras de decisão e de exceção são aplicadas de forma inconsistente.

Por que fica caro

  • A capacidade é consumida pela coordenação e retrabalho.
  • As exceções tardias enfraquecem a visibilidade e a qualidade do serviço.

Resultados de negócios

  • Ciclo de tarefa de criação pós-incidente mais curto
  • Menos transferências e exceções de informações faltantes
  • Limpe a propriedade do incidente recebido para criar tarefas pós-incidente
  • Decisões inspecionáveis e recuperação

KPIs mensuráveis

  • Tempo de resposta: Tempo decorrido desde o recebimento do incidente até a criação da tarefa pós-incidente.
  • Taxa de intervenção manual: Parcela de itens que necessitam de uma pessoa fora das condições de revisão definidas.
  • Idade de exceção: As exceções não resolvidas permanecem sem uma ação concluída.
  • Taxa de conclusão bem-sucedida: Compartilhamento de itens de fluxo de trabalho válidos concluídos sem falha do terminal.

Como funciona o fluxo de trabalho

  1. Receber incidente — Aceite e identifique o gatilho de entrada e escalonamento de incidentes. Webhook genérico
  2. Validar o serviço afetado — Execute a validação do serviço afetado com dados de amostra validados e um resultado auditável. Webhook genérico
  3. Aplicar regras de gravidade — Execute a aplicação de regras de severidade com dados de amostra validados e um resultado auditável. Jira
  4. Atribuir proprietário do incidente — Execute a atribuição do proprietário do incidente com dados de amostra validados e um resultado auditável. Folga
  5. Notificar os respondentes — Execute notificações de resposta com dados de amostra validados e um resultado auditável. Webhook genérico
  6. Escalar por tempo — Execute escalonamento por tempo com dados de amostra validados e um resultado auditável. Jira
  7. Resolução de registro — Execute a resolução de registros com dados de amostra validados e um resultado auditável. Folga
  8. Criar tarefa pós-incidente — Execute a tarefa de criação pós-incidente com dados de amostra validados e um resultado auditável. Webhook genérico
  9. Atualização de auditoria e KPI — Persista o resultado da execução, os fatos de auditoria e os eventos de medição do fluxo de trabalho. Armazenamento de execução SEIDO

Integrações e propriedade

  • Webhook genérico: Forneça informações sobre o fluxo de trabalho
  • Jira: Contexto de pesquisa e atualização
  • Folga: Receba resultados controlados

Responsabilidade humana: Proprietário de serviço de TI

Falha e recuperação

O webhook genérico está temporariamente indisponível.

Tente novamente com espera exponencial limitada; preserve a execução e mova-a para a fila de falhas inspecionáveis ​​após o limite.

Os dados necessários para validar o serviço afetado estão malformados ou ausentes.

Interrompa as ações posteriores e mostre os campos ausentes, as evidências de origem e as ações de correção ao revisor nomeado.

O evento acionador ou provedor é entregue mais de uma vez.

Retorne a execução existente identificada pela chave de idempotência e não repita ações comerciais posteriores.

A decisão humana expira antes de ser concluída.

Escale para o substituto configurado, retenha a solicitação original e registre a expiração e a reatribuição.

Quando não construir isso

  • O volume mensal é muito baixo para justificar a integração do webhook genérico, Jira, Slack.
  • Uma plataforma configurada existente já lida com a entrada e o escalonamento de incidentes com propriedade e relatórios adequados.
  • Dados de origem confiáveis ou acesso à API compatível não estão disponíveis.
  • Nenhum empresário tem autoridade para definir as regras de decisão e exceção.

Fluxos de trabalho relacionados