Manutenzione PHP basata su rischio e continuità
La manutenzione non aspetta che si verifichi un guasto. Preserva il supporto, le conoscenze e la capacità di apportare modifiche, mentre il prodotto continua a servire gli utenti.
- Separare gli incidenti, la prevenzione e l'evoluzione.
- Dare priorità in base all'impatto e alla visibilità.
- Misurare lo stato di salute tecnico e operativo.
- Praticare il recupero e il trasferimento.
1. Definire il servizio
Definire sistemi, orari, gravità, canali e responsabilità evita che tutto diventi urgente. Separare l'assistenza agli utenti, gli incidenti tecnici, i problemi ricorrenti e l'evoluzione pianificata.
- Inventario e proprietari.
- Gravità e impatto.
- Orari e procedure di escalation.
- Inserimento e accettazione del lavoro.
2. Costruire un ciclo di prevenzione
Riservare spazio per versioni, dipendenze, backup, certificati, capacità e documentazione. La prevenzione è in competizione con le funzionalità e necessita di una politica visibile.
- Calendario di supporto.
- Dipendenze e vulnerabilità.
- Ripristino del backup.
- Analisi di capacità e costi.
3. Imparare dagli incidenti
Ripristinare prima il servizio; in seguito, comprendere e ridurre la probabilità che il problema si ripresenti. Documentare la cronologia, le prove, la decisione e il follow-up senza attribuire colpe.
- Rilevamento e dichiarazione.
- Contenimento e recupero.
- Analisi causale proporzionata.
- Azioni con proprietario e data.
4. Misura per l'azione
Combina esperienza, errori, latenza, saturazione e segnali aziendali. Ogni avviso necessita di un destinatario e di un'azione; ogni dashboard dovrebbe rispondere a una domanda.
- Obiettivi di servizio.
- Errori per flusso.
- Capacità della coda e del database.
- Andamento degli incidenti e dei debiti.
5. Consegnare il resto in modo sicuro
Ridurre le dimensioni dei batch, automatizzare i controlli e conoscere le procedure di rollback. Manutenzione e sviluppo condividono la definizione di "fatto" e la disciplina di rilascio.
- Revisione e test basati sul rischio.
- Piccoli cambiamenti.
- Finestra e comunicazione.
- Osservazione successiva al rilascio.
6. Preservare la conoscenza
Documenta l'architettura, le operazioni e le decisioni relative al contesto lavorativo del team. Testa l'onboarding e i manuali operativi con un'altra persona per individuare eventuali dipendenze nascoste.
- Mappa del sistema.
- Runbook eseguibili.
- Decisioni rilevanti.
- Rotazione e trasferimento.
Contenuti correlati a questa decisione
Proseguire con la diagnosi, l'esecuzione o l'esperienza correlata.
Applica la guida alla tua applicazione
Analizziamo la situazione, le prove e le opzioni senza vincolare la valutazione all'attuazione.