Retour à la leçonMission
Mission : détecter une panne invisible aux health checks basiques
Comprendre pourquoi un health check TCP superficiel peut manquer une panne applicative réelle, et choisir un algorithme adapté à des backends inégaux.
Contexte
Une API critique tourne sur trois serveurs derrière nginx. L'un des trois répond toujours sur le port 8000 (un health check TCP basique le voit UP), mais sa connexion à la base de données interne est cassée : il renvoie une erreur 500 à toutes les vraies requêtes.