Un incident de production, sans accès au serveur
Un site client tombe : plus aucune connexion sortante. Pas d'accès SSH, seulement des journaux en lecture seule.
J'ai commencé par écarter l'hypothèse la plus coûteuse, la compromission. Les journaux contenaient bien des tentatives d'intrusion — toutes en échec, aucune ne rendait compte de la panne. Écartée sur preuves, pas par confort.
La cause était interne. Un composant du site bouclait sur un appel externe, et son propre mécanisme de préchargement amplifiait la boucle jusqu'à ce que l'hébergeur coupe les sorties. Le site n'était pas attaqué : il se saturait tout seul.
Correction proposée et séquencée, laissée à la validation du client. Je ne pousse pas un correctif en production sur un système dont je ne suis pas l'exploitant.
Extrait de mission, anonymisé. Un diagnostic ne se raconte pas avec la surface d'attaque du client dedans.