خواندن بیشتر: Runbook حادثه — از alert تا postmortem01۲۱ بهمن ۱۴۰۴3 دقیقه#devops#incident#linuxRunbook حادثه — از alert تا postmortemیک سناریوی عملیاتی واقعگرایانه با چکلیست، جدول SLA، بلوکهای کد و یادداشتهای فنی — برای تست layout مقاله.خواندن بیشتر
خواندن بیشتر: مانیتورینگ بدون Overkill02۲ خرداد ۱۴۰۳1 دقیقه#monitoring#linux#devopsمانیتورینگ بدون Overkillچطور از انبوه alert فرار کردیم و فقط چیزهایی را دیدیم که واقعاً میخوابند.خواندن بیشتر
خواندن بیشتر: وقتی دیسک پر شد03۱۷ آبان ۱۴۰۱1 دقیقه#linux#monitoring#hostingوقتی دیسک پر شدlogrotate بود، اما یک app بدون limit به journald فشار آورد.خواندن بیشتر