שאלות ראיון DevOps בישראל 2026 — 35 שאלות ותשובות
זמן קריאה: 9 דקות
ראיון DevOps בישראל בודק ידע מעשי בשלושה צירים: תזמור קונטיינרים (Kubernetes, Docker), אוטומציה של CI/CD, ותשתית כקוד (Terraform). ריכזנו כאן 22 שאלות אמיתיות עם תשובות תמציתיות. נכון להיום פתוחות ב-HiTakeJob 110 משרות Kubernetes ו-68 משרות Docker — ביקוש שממחיש כמה התחום מבוקש.
מפת הנושאים לראיון DevOps
הטבלה מסכמת את תחומי הליבה, הכלים הנפוצים והדגש בכל אחד — כדי לכוון את ההכנה:
| תחום | כלים נפוצים | הדגש בראיון |
|---|---|---|
| קונטיינרים | Docker | Image מול Container, אופטימיזציה |
| תזמור | Kubernetes | Pod, Deployment, Service, סקיילינג |
| אוטומציה | CI/CD, GitHub Actions | אסטרטגיות פריסה, שלבי פייפליין |
| תשתית כקוד | Terraform | State, idempotency, מודולים |
| ניטור | Prometheus, Grafana | Golden Signals, observability |
קונטיינרים ו-Docker
מה ההבדל בין Image ל-Container?
Image הוא תבנית סטטית לקריאה בלבד המכילה את הקוד והתלויות. Container הוא מופע רץ של אותו Image, עם שכבת כתיבה משלו. מ-Image אחד אפשר להריץ מספר Containers במקביל.
מה ההבדל בין CMD ל-ENTRYPOINT ב-Dockerfile?
ENTRYPOINT מגדיר את הפקודה הקבועה שתרוץ תמיד, ו-CMD מספק ארגומנטים ברירת מחדל שניתן לדרוס בזמן הרצה. שילוב של השניים נותן פקודה קבועה עם פרמטרים גמישים.
איך מקטינים גודל של Docker Image?
שימוש ב-multi-stage build כדי שרק תוצרי הבנייה יגיעו לשכבה הסופית, בחירת base image רזה (alpine/distroless), איחוד פקודות RUN לצמצום שכבות, ושימוש ב-.dockerignore. כך מקטינים גם משטח תקיפה.
מהי שכבה (Layer) ב-Docker וכיצד היא משפיעה על מהירות בנייה?
כל הוראה ב-Dockerfile יוצרת שכבה נשמרת ב-cache. אם שכבה לא השתנתה, Docker משתמש ב-cache ומדלג על בנייתה. לכן מסדרים הוראות משתנות פחות (התקנת תלויות) לפני משתנות יותר (העתקת קוד).
Kubernetes ותזמור
מה ההבדל בין Pod ל-Deployment?
Pod הוא יחידת ההרצה הקטנה ביותר ומכיל קונטיינר אחד או יותר. Deployment הוא אובייקט ניהולי שמבטיח שמספר מוגדר של Pods זהים ירוצו תמיד, ומטפל בעדכוני גרסה מבוקרים (rolling update).
מה תפקיד ה-Service ב-Kubernetes?
Service מספק כתובת רשת יציבה וגילוי שירות (service discovery) מול קבוצת Pods שכתובות ה-IP שלהם משתנות. הוא גם מבצע load balancing פנימי בין ה-Pods התואמים ל-selector שלו.
מה ההבדל בין liveness ל-readiness probe?
Liveness probe בודק אם הקונטיינר חי — כישלון מפעיל אתחול מחדש. Readiness probe בודק אם ה-Pod מוכן לקבל תעבורה — כישלון מסיר אותו זמנית מה-Service בלי לאתחל אותו.
איך Kubernetes מבצע Auto-scaling?
HPA (Horizontal Pod Autoscaler) מוסיף או מוריד Pods לפי מדדים כמו ניצול CPU או מטריקות מותאמות. Cluster Autoscaler מוסיף או מוריד nodes פיזיים כשאין מספיק משאבים לתזמן Pods חדשים.
מה ההבדל בין ConfigMap ל-Secret?
שניהם מזריקים קונפיגורציה ל-Pods, אך Secret מיועד למידע רגיש (סיסמאות, טוקנים) ומאוחסן מקודד ב-base64 עם אפשרות להצפנה במנוחה. ConfigMap מיועד לערכי קונפיגורציה לא רגישים.
CI/CD ואוטומציה
מה ההבדל בין Continuous Delivery ל-Continuous Deployment?
Continuous Delivery מוודא שכל שינוי מוכן לפריסה אוטומטית עד לשלב הסופי, אך הפריסה לפרודקשן דורשת אישור ידני. Continuous Deployment מפריס אוטומטית לפרודקשן ללא התערבות אנושית.
מהם השלבים בפייפליין CI/CD טיפוסי?
Build (קימפול), Test (בדיקות אוטומטיות), Security scan, Package (בניית artifact/image), ו-Deploy לסביבות בהדרגה. כישלון בכל שלב עוצר את הפייפליין ומונע קידום קוד פגום.
מהי אסטרטגיית Blue-Green Deployment?
מריצים שתי סביבות זהות — Blue (הפעילה) ו-Green (החדשה). לאחר בדיקת Green, מפנים אליה את כל התעבורה בבת אחת. אם יש תקלה, חוזרים ל-Blue מיידית. זה ממזער downtime וסיכון.
מה ההבדל בין Canary ל-Rolling deployment?
Rolling מחליף Pods בהדרגה עד שכולם בגרסה חדשה. Canary חושף את הגרסה החדשה לאחוז קטן מהמשתמשים תחילה, ורק אם המדדים תקינים מרחיבים בהדרגה. Canary מזהה בעיות מוקדם יותר.
תשתית כקוד ו-Terraform
מהו Terraform State ולמה הוא קריטי?
קובץ ה-state ממפה בין המשאבים המוגדרים בקוד למשאבים בפועל בענן. בלעדיו Terraform לא יודע מה כבר קיים. בעבודת צוות מאחסנים אותו ב-remote backend עם locking למניעת שינויים מקבילים.
מה ההבדל בין terraform plan ל-terraform apply?
plan מחשב ומציג את השינויים הצפויים מבלי לבצע אותם — כלי לבדיקה. apply מבצע את השינויים בפועל מול הספק. תמיד בודקים plan לפני apply בסביבות פרודקשן.
מהו רעיון ה-Idempotency בתשתית כקוד?
הרצה חוזרת של אותה קונפיגורציה מובילה תמיד לאותו מצב סופי, ללא תופעות לוואי. Terraform מיישם זאת: אם המשאב כבר במצב הרצוי, הרצה נוספת לא משנה דבר.
מה ההבדל בין Module ל-Resource?
Resource הוא רכיב תשתית בודד (מכונה, רשת). Module הוא אוסף מאורגן של resources לשימוש חוזר עם משתני קלט ופלט — כמו "פונקציה" של תשתית, שמאפשרת סטנדרטיזציה בין פרויקטים.
ניטור ותפעול
מהם ארבעת ה-Golden Signals לניטור?
Latency (זמן תגובה), Traffic (עומס), Errors (שיעור שגיאות), ו-Saturation (רוויית משאבים). מדדים אלה נותנים תמונה מהירה של בריאות שירות ומהווים בסיס להתראות.
מה ההבדל בין ניטור (Monitoring) ל-Observability?
Monitoring עוקב אחר מדדים ידועים מראש ומתריע על חריגות. Observability הוא היכולת להבין את המצב הפנימי של מערכת מתוך הפלטים שלה (logs, metrics, traces), כולל חקירת בעיות שלא צפינו מראש.
מהו Infrastructure Drift וכיצד מתמודדים איתו?
Drift הוא פער בין המצב המוגדר בקוד לבין המצב בפועל, שנוצר משינויים ידניים. מתמודדים באמצעות זיהוי אוטומטי (terraform plan/drift detection), איסור שינויים ידניים, והחזרת המצב דרך הקוד בלבד.
מה ההבדל בין metrics, logs ו-traces?
Metrics הם מספרים מצטברים לאורך זמן (CPU, latency). Logs הם רשומות אירועים בדידות עם הקשר. Traces עוקבים אחר בקשה בודדת דרך כל השירותים שהיא עוברת. שלושתם יחד ("שלושת עמודי ה-observability") מאפשרים אבחון מלא של תקלה מבוזרת.
מהו SLI, SLO ו-SLA וכיצד הם קשורים?
SLI הוא מדד בפועל (למשל אחוז בקשות מוצלחות). SLO הוא היעד הפנימי לאותו מדד (99.9%). SLA הוא ההתחייבות החוזית ללקוח, לרוב מקלה מה-SLO. ניהול error budget נגזר מה-SLO ומאזן בין קצב פיתוח ליציבות.
רשתות ותשתית ב-Kubernetes
מה ההבדל בין Ingress ל-Service מסוג LoadBalancer?
Service מסוג LoadBalancer חושף שירות בודד דרך load balancer של הענן. Ingress הוא שכבת ניתוב L7 יחידה שמנתבת לפי host ו-path למספר שירותים, וחוסכת load balancers רבים. Ingress מטפל גם ב-TLS termination.
מהו Namespace ב-Kubernetes ומתי משתמשים בו?
Namespace הוא חלוקה לוגית של ה-cluster לסביבות מבודדות (dev, staging, prod) או צוותים. הוא מאפשר הגדרת מכסות משאבים, בקרת גישה (RBAC) והפרדת שמות — בלי להפריד פיזית את ה-cluster.
מהו StatefulSet ובמה הוא שונה מ-Deployment?
Deployment מתאים ל-Pods חסרי מצב שכולם זהים וניתנים להחלפה. StatefulSet מתאים ליישומים עם מצב (מסדי נתונים) — הוא מעניק זהות רשת יציבה, אחסון קבוע לכל Pod, וסדר הרצה ועדכון קבוע.
אבטחה ו-DevSecOps
איך מנהלים סודות (secrets) בתשתית DevOps?
לא שומרים סודות בקוד או ב-image. משתמשים בכספת ייעודית (Vault, cloud secrets manager) או ב-Kubernetes Secrets מוצפנים, מזריקים אותם בזמן ריצה, ומחליפים אותם באופן תקופתי (rotation). גישה מוגבלת לפי Least Privilege.
מהו scanning של image ולמה הוא חשוב בפייפליין?
סריקת image בודקת פגיעויות ידועות (CVEs) בחבילות ובשכבות הבסיס, לפני שה-image מגיע לפרודקשן. שילובו כשלב חוסם ב-CI מונע פריסת רכיבים פגיעים ומהווה חלק מגישת DevSecOps של "shift-left" לאבטחה.
שאלות תרחיש נפוצות
שירות בפרודקשן איטי פתאום — איך תחקור?
מתחילים ממדדים: latency, שיעור שגיאות ורוויית משאבים. בודקים אם נעשה deploy אחרון, בוחנים לוגים ו-traces לזיהוי צוואר הבקבוק, ומצמצמים בהדרגה — האם הבעיה באפליקציה, במסד הנתונים, ברשת או בתשתית. לאחר בלימה מבצעים תחקיר שורש.
איך תבצע rollback בטוח לגרסה שנכשלה?
עם rolling update חוזרים ל-revision הקודם (למשל kubectl rollout undo). בפריסת Blue-Green מפנים את התעבורה בחזרה לסביבה הקודמת. המפתח: גרסאות artifact ניתנות לשחזור, ומסד נתונים תואם לאחור כדי שה-rollback לא ישבור את הסכמה.
Pod נכנס ל-CrashLoopBackOff — מה תבדוק?
מתחילים ב-kubectl logs וב-kubectl describe pod לראות את קוד היציאה ואת האירועים. בודקים משתני סביבה וסודות חסרים, כשל ב-liveness probe, חוסר משאבים (OOMKilled), או תלות חיצונית שלא זמינה. מתקנים את שורש הבעיה ולא רק מאתחלים.
איך תתכנן פריסה ללא downtime?
rolling update עם readiness probes נכונים, maxUnavailable מוגדר, ותאימות לאחור של הסכמה וה-API. משלימים ב-health checks לפני העברת תעבורה, ובאסטרטגיית Canary או Blue-Green למקרים רגישים כדי לזהות בעיות לפני חשיפה מלאה.
טעויות נפוצות בראיון DevOps
מעבר לידע הטכני, יש דפוסים שחוזרים ומפילים מועמדים טובים. הנה הבולטים שבהם:
- שינון הגדרות בלי הבנת ה"למה": מי שיודע לצטט מה זה Pod אך לא מסביר מתי לבחור בו על פני חלופה — נחשף מיד בשאלת המשך.
- קפיצה לפתרון בלי לאבחן: בשאלת תרחיש, מועמדים ממהרים "לאתחל את ה-Pod" במקום לחקור את שורש הבעיה דרך מדדים ולוגים.
- התעלמות מעלות ומאבטחה: ארכיטקטורה שלא מתייחסת ל-cost ול-Least Privilege נראית לא בוגרת בעיני מראיין מנוסה.
- הימנעות מ"אני לא יודע": ניחוש בביטחון גרוע מהודאה כנה ולאחריה תיאור של איך הייתם מבררים.
- דיבור בכלים ולא בעקרונות: תרבות DevOps היא אוטומציה, אחריות משותפת ומשוב מהיר — לא רשימת כלים שהכרתם.
צ'קליסט הכנה לראיון DevOps
לפני הראיון, ודאו שאתם מכסים את הנקודות הבאות:
- לתרגל הסבר בעל-פה של Pod, Deployment, Service ו-Ingress — כולל מתי לבחור בכל אחד.
- לבנות סביבה קטנה בעצמכם: cluster מקומי (minikube/kind), פייפליין CI פשוט ומודול Terraform.
- לתרגל אבחון תרחישים: Pod שקורס, שירות איטי, פריסה שנכשלה.
- לרענן אסטרטגיות פריסה: Rolling, Blue-Green ו-Canary — כולל מתי כל אחת עדיפה.
- להכין דוגמה אמיתית מהניסיון שלכם: אוטומציה שבניתם או תקלה שפתרתם.
- לחזור על יסודות ניטור: Golden Signals, ההבדל בין metrics/logs/traces, ומושגי SLO.
איך להתכונן לראיון DevOps
מעבר לשינון תשובות, כדאי לתרגל תרחישים: איך תפרסו שירות חדש, איך תאבחנו Pod שקורס, איך תבנו פייפליין מאפס. בהכנה כדאי גם להקים סביבה קטנה בעצמכם — cluster מקומי, פייפליין CI פשוט ומודול Terraform — כי מעסיקים מעריכים הבנה מעשית הרבה מעבר לתיאוריה. בישראל התחום מבוקש מאוד — עיינו במשרות Kubernetes, במשרות Docker ובמשרות Terraform, ובדקו את כלל המשרות הפתוחות. להעמקה בשאלות Backend כלליות ראו שאלות ראיון Backend, ולתכנון מערכות ראו שאלות ראיון System Design.
שאלות נפוצות
אילו נושאים הכי חשוב לדעת לראיון DevOps?
Kubernetes ו-Docker הם הליבה, לצד CI/CD ותשתית כקוד עם Terraform. עם 110 משרות Kubernetes ו-68 משרות Docker פתוחות בישראל, שליטה בתזמור קונטיינרים היא הדרישה הנפוצה ביותר, ולצידה ניטור ואבחון תקלות.
האם צריך ניסיון בפיתוח כדי להיות DevOps?
ניסיון בסקריפטינג ובקריאת קוד חיוני, אך אין צורך בניסיון פיתוח מלא. חשוב יותר להבין תשתיות, רשתות, אוטומציה ומערכות הפעלה, ולדעת לכתוב סקריפטים ב-Bash או Python לאוטומציה.
כמה זמן לוקח להתכונן לראיון DevOps?
למי שכבר עובד בתחום, שבוע-שבועיים של רענון על Kubernetes, CI/CD ו-Terraform לרוב מספיקים. לעוברים לתחום, הכנה מעמיקה יותר של חודש-חודשיים כולל פרויקט מעשי תעניק בסיס טוב לראיון.
האם שואלים שאלות קידוד בראיון DevOps?
לרוב לא אלגוריתמים כבדים, אך כן שאלות סקריפטינג מעשיות: לכתוב סקריפט Bash או Python שמעבד לוגים, קורא ל-API או מאתמט משימה. מצפים גם לשאלות על קריאת YAML של Kubernetes ותיקון שגיאות בו.
מה ההבדל בין ראיון DevOps ל-SRE?
יש חפיפה גדולה, אך ראיון SRE נוטה יותר לאמינות, SLO/error budgets, וניתוח תקלות בקנה מידה, ולעיתים כולל שאלות קידוד רציניות יותר. ראיון DevOps מדגיש CI/CD, אוטומציה ותשתית כקוד. ההכנה דומה ברובה.
איזה פרויקט אישי הכי מרשים בראיון DevOps?
פרויקט מקצה לקצה: אפליקציה קטנה עם Dockerfile, פייפליין CI/CD שבונה ובודק, פריסה ל-Kubernetes דרך Terraform או Helm, וניטור בסיסי עם Prometheus ו-Grafana. הוא מדגים את כל צירי הליבה במכה אחת.