تخطَّ إلى المحتوى

لما يكسر: التعامل مع الحوادث

الدرس 7 من 20

الهدف

بعد هالدرس تقدر تتبع 5-step incident playbook لوحدك بدون فريق، تكتب personal runbook للـ 3 حوادث الأكثر احتمالا في منتجك، وتكمّل postmortem doc بعد كل incident حقيقي.

ليش هذا الحين؟

عندك monitoring يخبرك لما شي ينكسر. بس يخبرك وبعدين شنو؟

السؤال الحقيقي هو: لما Better Stack يدز alert الساعة 2 الصبح، وأنت نعسان، شنو تسوي؟ بأي ترتيب؟ وكيف تقرر إذا الموضوع يستاهل تقوم من فراشك؟

الـ incident response الكلاسيكي مصمم للفرق — on-call rotations، handoffs، war rooms. هذا مو لك. أنت الـ on-call. أنت الـ war room. أنت الـ team.

هالدرس يعيد كتابة الـ playbook للـ solo founder: نفس المبادئ، بدون overhead الفريق.

الفكرة

للـ solo founder، الـ incident response تجي في 5 خطوات:

  1. Detect — monitoring يخبرك قبل العميل
  2. Assess — قرّر شكثر الموضوع خطير في 60 ثانية
  3. Communicate — خبّر الـ users إذا يأثر عليهم
  4. Fix — أوقف النزيف أولا، صلّح ثانيا
  5. Learn — اكتب postmortem بدون تلاوم

القاعدة: لا تحاول تفهم ليش انكسر قبل ما توقفه. Rollback أول، investigate ثاني.

محتاج مساعدة؟ راسلنا على mj@shakesbeard.net