← कोर्सच्या मुख्य पानाकडे परत

🩺 Triage card — नर्सचा तक्ता, एका पानावर

धडा 16 एका प्रिंट करता येणाऱ्या पानावर. जो कोणी आत येईल: सराव कधीच बदलत नाही. प्रिंट करा, स्क्रीनशेजारी चिकटवा.

🖨️ कार्ड प्रिंट करा

सराव — या क्रमाने, नेहमी

1 · describekubectl describe pod POD -n NSस्थिती, restarts, conditions — आणि तळाशी Events
2 · eventskubectl get events -n NS --sort-by=.lastTimestampते का सुरूच झाले नाही: scheduling, image pull, probes
3 · logskubectl logs POD -n NS kubectl logs POD --previousकोसळलेल्या कंटेनरच्या शेवटच्या शब्दांसाठी --previous
4 · execkubectl exec -it POD -n NS -- shआत पहा: env, फाइल्स, DNS (nslookup school-api), ports
5 · शेजारीkubectl get endpointslices -n NS kubectl get svc,ingress -n NSगप्प Service = selector ≠ labels, किंवा तयार pods नाहीत

लक्षण जुळवा

लक्षणसहसा अर्थकुठे पहाधडा
Pendingकोणताच बाक बसत नाही: requests खूप मोठे, taints, cluster भरला, PVC unbounddescribe → Events "FailedScheduling"L08 · L15 · L20 · L12
ImagePullBackOffचुकीचे इमेज नाव/tag, किंवा registry परवानगी नाही (ECR: node चा role)describe → Events; इमेजची string, अक्षर न् अक्षरL01 · AWS L05
CrashLoopBackOffसुरू होतो, मरतो, पुन्हा: चुकीचे config, env नाही, कोसळणारे ॲपlogs --previous, मग ConfigMap/SecretL06 · L16
OOMKilledmemory limit च्या पलीकडेdescribe → Last State; limit वाढवा किंवा गळती दुरुस्त कराL08 · L23
Running पण Ready नाहीreadiness probe फसतोय — traffic नाही, पुन्हा सुरू नाहीdescribe → probe failures; आतून readiness path curl कराL07
Restarts वाढतायतliveness probe फसतोय (किंवा ॲप खरंच मरते)logs --previous; probe खूप कडक / खूप लवकरL07
Service काहीच उत्तर देत नाहीselector ≠ pod labels, चुकीचा targetPort, तयार endpoints नाहीतget endpointslices; describe svcL04
Ingress 404 / 502path चा क्रम, चुकीची Service/port, controller नाही, backend Ready नाहीdescribe ingress; controller चे logsL10
दुसऱ्या pod पर्यंत पोहोचत नाहीएखादी NetworkPolicy (default-deny + allow नाही / DNS egress नाही)get networkpolicy; आतून curl ने तपासाL19
Node NotReadykubelet बंद, disk/memory दबाव — किंवा खाली EC2 ची गोष्ट (spot परत घेतला)describe node → Conditions; क्लाउड consoleL13 · AWS L12
सगळे एकदम evict झालेnode वर दबाव; BestEffort pods आधी जातातdescribe node; QoS classesL23
🧭 सरावाचे नियम: logs आधी events (events सांगतात ते का सुरू झाले नाही, logs सांगतात ते का मेले) · प्रत्येक crash loop वर --previous · आधी pod हटवून कधीच "दुरुस्त" करू नका — तुम्ही पुरावा हटवता · Service गप्प असेल तर network आधी labels वर संशय घ्या · शंका असेल तर kubectl get all -n NS आणि वरून खाली वाचा.