← Kembali ke Dokumentasi
Contoh dokumentasi backend

incident-runbook.md

docs/06-operations/incident-runbook.md

Contoh isi file untuk sistem antrian. Sesuaikan dengan implementasi proyek Anda.

# Incident runbook

Contoh kasus: antrian tersimpan tetapi notifikasi tertunda.

1. Tentukan waktu mulai, environment, versi release, dan luas dampak.
2. Periksa status antrian melalui service pemilik data, lalu outbox age, queue depth, worker, dan provider.
3. Gunakan trace_id/event_id untuk menelusuri kegagalan; jangan mengirim token atau payload sensitif ke tiket.
4. Perbaiki dependency/config atau kapasitas sesuai bottleneck. Replay hanya event yang memenuhi prosedur idempotency.
5. Verifikasi backlog turun dan notifikasi terkirim tanpa efek ganda.
6. Catat timeline, mitigasi, hasil, akar masalah, dan tindakan lanjutan di JIRA.

Jika pendaftaran ikut gagal, evaluasi rollback aplikasi sesuai deployment.md. Jangan menghapus outbox atau mengubah database manual sebagai langkah default. Isi PIC/eskalasi, dashboard, command replay yang disetujui, dan kriteria selesai sebelum runbook dipakai secara operasional.