IT

Acquisizione ed escalation degli incidenti

Gli incidenti tecnologici entrano attraverso canali diversi e perdono gravità, proprietà e disciplina dell'escalation durante la risposta.

Problema aziendale

Gli incidenti tecnologici entrano attraverso canali diversi e perdono gravità, proprietà e disciplina dell'escalation durante la risposta.

Cosa vedono le squadre

  • Il lavoro attende tra la ricezione dell'incidente e la convalida del servizio interessato.
  • I proprietari ricostruiscono lo stato dal webhook generico e Jira.

Perché succede

  • Nessuno stato condiviso si estende su webhook generico, Jira, Slack.
  • Le regole di decisione ed eccezione vengono applicate in modo incoerente.

Perché diventa costoso

  • La capacità viene consumata dal coordinamento e dalla rilavorazione.
  • Le eccezioni tardive indeboliscono la visibilità e la qualità del servizio.

Risultati aziendali

  • Ciclo di attività di creazione post-incidente più breve
  • Meno eccezioni di trasferimento ed informazioni mancanti
  • Cancella la proprietà dalla ricezione dell'incidente per creare un'attività post-incidente
  • Decisioni controllabili e ripresa

KPI misurabili

  • Tempo di consegna: Tempo trascorso dalla ricezione dell'incidente alla creazione dell'attività post-incidente.
  • Tasso di intervento manuale: Quota di elementi che necessitano di una persona al di fuori delle condizioni di revisione definite.
  • Età eccezionale: Le eccezioni tempo non risolte rimangono senza un'azione completata.
  • Tasso di completamento riuscito: Condivisione di elementi del flusso di lavoro validi completati senza errori del terminale.

Come funziona il flusso di lavoro

  1. Ricevi l'incidente — Accettare e identificare l'acquisizione dell'incidente e il fattore scatenante dell'escalation. Webhook generico
  2. Convalidare il servizio interessato — Eseguire la convalida del servizio interessato con dati campione convalidati e un risultato verificabile. Webhook generico
  3. Applicare regole di gravità — Esegui regole di gravità applicate con dati campione convalidati e un risultato verificabile. Jira
  4. Assegna il proprietario dell'incidente — Assegnare il proprietario dell'incidente con dati campione convalidati e un risultato verificabile. Lento
  5. Avvisa i risponditori — Esegui la notifica ai risponditori con dati campione convalidati e un risultato verificabile. Webhook generico
  6. Aumentare in base al tempo — Esegui l'escalation in base al tempo con dati campione convalidati e un risultato verificabile. Jira
  7. Risoluzione della registrazione — Eseguire la risoluzione dei record con dati campione convalidati e un risultato verificabile. Lento
  8. Creare un'attività post-incidente — Esegui la creazione di un'attività post-incidente con dati campione convalidati e un risultato verificabile. Webhook generico
  9. Audit e aggiornamento KPI — Persistenza del risultato dell'esecuzione, dei fatti di audit e degli eventi di misurazione del flusso di lavoro. Negozio di esecuzione SEIDO

Integrazioni e proprietà

  • Webhook generico: Fornire input per il flusso di lavoro
  • Jira: Ricerca e aggiornamento del contesto
  • Lento: Ottieni risultati controllati

Responsabilità umana: Titolare del servizio informatico

Fallimento e ripresa

Il webhook generico è temporaneamente non disponibile.

Riprovare con backoff esponenziale limitato; preservare la corsa e spostarla nella coda degli errori ispezionabili dopo il limite.

I dati richiesti per la convalida del servizio interessato non sono corretti o mancano.

Interrompi le azioni a valle e mostra i campi mancanti, le prove della fonte e l'azione di correzione al revisore nominato.

L'evento trigger o provider viene distribuito più di una volta.

Restituire l'esecuzione esistente identificata dalla chiave di idempotenza e non ripetere le azioni aziendali a valle.

La decisione umana scade prima del completamento.

Passare al sostituto configurato, conservare la richiesta originale e registrare sia la scadenza che la riassegnazione.

Quando non costruirlo

  • Il volume mensile è troppo basso per giustificare l'integrazione di webhook generici, Jira, Slack.
  • Una piattaforma configurata esistente gestisce già l'acquisizione e l'escalation degli incidenti con proprietà e reporting adeguati.
  • Dati di origine affidabili o accesso API supportato non sono disponibili.
  • Nessun imprenditore ha l'autorità di definire le regole decisionali e di eccezione.

Flussi di lavoro correlati