Incident Template — Pinbox24
Szablon do dokumentowania incydentów na platformie Pinbox24 (W3/W4).
Kopiuj do incident-YYYY-MM-DD-slug.md przed wypełnieniem.
Nagłówek
| Pole | Wartość |
|---|---|
| ID | INCIDENT-YYYY-MM-DD-NNN |
| Platforma | W3 / W4 / Wspólna |
| Severność | P0 (produkcja down) / P1 (degradacja) / P2 (pojedynczy użytkownik) |
| Status | OPEN / RESOLVED / MONITORING |
| Wykryto | YYYY-MM-DDTHH:MMZ |
| Rozwiązano | YYYY-MM-DDTHH:MMZ |
| GH Issue | radieu/p24-infra#NNN |
Symptom
Co widział użytkownik lub monitoring. Dosłowny komunikat błędu.
Oś czasu
| Czas (UTC) | Zdarzenie |
|---|---|
| HH:MM | Wykrycie błędu |
| HH:MM | Początek dochodzenia |
| HH:MM | Root cause ustalony |
| HH:MM | Hotfix wdrożony |
| HH:MM | Weryfikacja OK |
Root cause
Krótki opis co poszło nie tak i dlaczego.
Zmienione pliki / kontenery
| Plik / Kontener | Zmiana | Rollback |
|---|---|---|
container:/path/file.js | stary kod → nowy kod | Przywróć backup z /tmp/... lub rebuild |
Weryfikacja fix
Jak potwierdzono że fix działa. Logi, HTTP status, dane w DB.
Długoterminowy fix
Co należy zrobić żeby ten problem nie wrócił. Issue numer jeśli założony.
Rollback
Jak cofnąć hotfix jeśli fix powoduje nowe problemy.
# Przykład rollback dla hotfixu kontener/plik:
docker cp /tmp/backup-controller.js container:/app/path/controller.js
docker exec container pm2 restart app-nameLekcje
Co można było zrobić lepiej. Co monitoring powinien wykryć.