Retour à la leçonMission
Mission : trouver la cause racine avant que l'alerte ne réveille tout le monde
Diagnostiquer un Pod en CrashLoopBackOff en combinant logs, événements et métriques, sans se limiter au premier réflexe insuffisant.
Contexte
Une alerte se déclenche en pleine nuit : le Pod api-7d9f-xk2m1 redémarre en boucle. Le développeur de garde lance kubectl logs api-7d9f-xk2m1 et n'obtient presque rien, le conteneur vient tout juste de redémarrer et n'a rien écrit dans ses logs actuels. Il doit rassembler plusieurs sources d'information, pas une seule, pour comprendre ce qui se passe réellement avant de réveiller le reste de l'équipe.