مقالات عملية مرتبة حسب المجال والمستوى، اختر المجال المناسب واقرأ من مستوى مبتدئ إلى محترف.
لو فزعت لما شفت load average وصل 8، الرقم ممكن يكون طبيعي. مقال للمبتدئ بمثال طابور الكاشير، ثم شرح علمي، قاعدة القسمة على عدد الأنوية بأمر uptime، الفرق بين حِمل المعالج وانتظار القرص، ومتى تقلق فعلًا، مع مصادر رسمية.
لو قفلت الـ SSH فوقف تطبيقك، أو السيرفر عمل reboot ومحدش شغّله، المشكلة إن مفيش حارس يدير خدمتك. دليل للمبتدئ يحوّل تطبيقك لخدمة systemd تشتغل عند الإقلاع وتعيد التشغيل تلقائيًا في ثواني، بملف وحدة جاهز وأوامر systemctl وjournalctl قابلة للنسخ.
Nginx + Certbot بياخدوا 40 سطر إعداد وخطوة تجديد بتتنسي. Caddy بيعمل reverse proxy وHTTPS تلقائي في 3 أسطر، ويجدّد الشهادة لوحده. مقال للمبتدئ بمثال بوابة الكومباوند، شرح ACME، Caddyfile وأوامر قابلة للنسخ، أرقام، trade-offs مقابل Nginx، ومتى متستخدموش، مع مصادر.
لو الـ Pod بتاعك بيموت ويرجع وفي حالته OOMKilled، السبب إنه عدّى سقف الذاكرة. مقال للمبتدئ بمثال حجز الترابيزة في المطعم، شرح علمي لـ cgroups و OOM killer وكود الخروج 137، إعداد YAML وأوامر kubectl قابلة للنسخ، أرقام قبل وبعد من خدمة fintech، الفرق بين requests و limits، 4 trade-offs، ومتى متحطش limit على الذاكرة.
لو حد عمل kubectl edit على الإنتاج ومحدّش عارف مين ولا إمتى، المشكلة مش في الفريق. GitOps بـ ArgoCD بيخلّي Git مصدر الحقيقة الوحيد، والـ cluster يرجّع نفسه لحالته الصح في ثوانٍ. مقال للمبتدئ بمثال الترموستات، المبادئ الأربعة من OpenGitOps، ملف Application كامل قابل للنسخ على ArgoCD، أرقام self-heal مقاسة، 4 trade-offs، ومتى GitOps يبقى overhead.
في الـ default mode، أي pod في الـ cluster يقدر يفتح اتصال على أي pod تاني — بما فيهم الـ database. مقال للمبتدئ بمثال عمارة الشقق المفتوحة، YAML شغّال في 14 سطر، شرح default-deny pattern، وأرقام مقاسة من penetration test على cluster fintech قبل وبعد NetworkPolicy.
لو بتعمل rolling update ولاحظت إن users بيشوفوا 502 في أول 20 ثانية بعد كل deploy، المشكلة مش في الكود — هي إن Kubernetes بيوجّه ترافيك على pod قبل ما الـ app يخلّص استعداد. مقال للمبتدئ بمثال محل الكشري، فرق Liveness و Readiness و Startup Probes، YAML شغّال على Kubernetes 1.32 + كود Node.js قابل للنسخ، أرقام مقاسة من خدمة fintech عربية (18,400 خطأ 5xx → 38 خطأ، نزول 99.79%)، 4 trade-offs خفية في DB checks وفي period/threshold، ومتى Probes تكون تعقيد بدون فايدة.
cron بيشتغل صامت وبيفشل أصمت. لو الـ backup فشل أو السيرفر كان مطفي وقت التشغيل، مفيش حد بيدري. systemd timers بيحل ده في 8 أسطر config مع logs مركزية في journald و Persistent=true لتعويض المهام الفاتت. مقال للمبتدئ بمثال صديق الميه، شرح علمي من توثيق systemd الرسمي، service + timer كاملين شغّالين على Ubuntu 22.04، أرقام من فريق 6 مهندسين على 22 سيرفر (الكشف من 4.6 يوم لـ 38 ثانية)، 4 trade-offs خفية، ومتى cron يفضل خيار أذكى.
لو فريقك بيكرّر نفس السيرفر مرتين، المشكلة مش في الكود — المشكلة إن كل واحد عنده نسخة منفصلة من ذاكرة Terraform. مقال للمبتدئ بمثال ورقة المشتريات على باب التلاجة، شرح علمي لملف الـ state والـ lock، إعداد S3 backend في 6 أسطر، أرقام من فريق 5 مهندسين، trade-offs حقيقية، ومتى متستخدمش backend بعيد.