Vue diagnostic rapide
La target apparaît DOWN et les métriques ne sont plus mises à jour.
- Endpoint /metrics indisponible
- DNS ou réseau
- Authentification/TLS
- Ouvrir Status > Targets
- Lire Last Error
- Tester l’URL depuis le serveur Prometheus
- Corriger uniquement le composant confirmé par les contrôles
- Rejouer le symptôme initial après la correction
- Escalader avec les preuves collectées si la cause reste indéterminée
Plan technicien contextualisé
Effectuez ce contrôle et conservez le résultat observé avant toute modification.
« Ouvrir Status > Targets » doit produire une observation permettant de confirmer ou d’écarter clairement « Endpoint /metrics indisponible ».
Si l’observation est conforme, réduisez la priorité de « Endpoint /metrics indisponible » et passez au contrôle distinct suivant.
Si l’observation est anormale, conservez la preuve et investiguez d’abord « Endpoint /metrics indisponible ». Action associée : Corriger uniquement le composant confirmé par les contrôles.
Effectuez ce contrôle et conservez le résultat observé avant toute modification.
Le nom exact en échec doit être résolu par le DNS attendu vers l’enregistrement attendu, sans timeout.
Si ce nom est correctement résolu, comparez cache applicatif, suffixe DNS et client/réseau où l’échec persiste.
Si la résolution échoue ou renvoie une mauvaise valeur, conservez serveur interrogé et réponse puis corrigez le résolveur, la zone/enregistrement ou le chemin DNS réellement en cause.
Effectuez ce contrôle et conservez le résultat observé avant toute modification.
« Tester l’URL depuis le serveur Prometheus » doit produire une observation permettant de confirmer ou d’écarter clairement « Authentification/TLS ».
Si l’observation est conforme, réduisez la priorité de « Authentification/TLS » et passez au contrôle distinct suivant.
Si l’observation est anormale, conservez la preuve et investiguez d’abord « Authentification/TLS ». Action associée : Escalader avec les preuves collectées si la cause reste indéterminée.
Répétez le même test de validation après correction et confirmez que le symptôme initial a disparu. Validez la stabilité avant de clôturer l’incident.
Avant toute modification de configuration, relevez la valeur actuelle et prévoyez le retour arrière.
Escaladez avec symptôme exact, portée, heure et contrôles déjà effectués si le problème reste non résolu.
+Afficher le guide détaillé completExplications détaillées et contenu de dépannage original.
La target apparaît DOWN et les métriques ne sont plus mises à jour.
Causes probables
- Endpoint /metrics indisponible
- DNS ou réseau
- Authentification/TLS
- Timeout ou réponse trop volumineuse
Contrôles par ordre de priorité
- Ouvrir Status > Targets
- Lire Last Error
- Tester l’URL depuis le serveur Prometheus
- Vérifier certificat, auth et timeout
Quand escalader
Escaladez lorsque la panne touche plusieurs utilisateurs, qu’une dépendance de production est indisponible ou que les journaux pointent vers un composant hors de votre contrôle. Joignez les horodatages, le périmètre, les tests déjà réalisés et le dernier état fonctionnel connu.