Panne / symptôme

Prometheus ne collecte plus une target

La target apparaît DOWN et les métriques ne sont plus mises à jour.

⌚ Environ 4 min de lecture
Voir mes favoris
Problème réel · V2

Vue diagnostic rapide

Ce que vous observez

La target apparaît DOWN et les métriques ne sont plus mises à jour.

Causes probables
  1. Endpoint /metrics indisponible
  2. DNS ou réseau
  3. Authentification/TLS
Premiers contrôles
  1. Ouvrir Status > Targets
  2. Lire Last Error
  3. Tester l’URL depuis le serveur Prometheus
Actions recommandées
  1. Corriger uniquement le composant confirmé par les contrôles
  2. Rejouer le symptôme initial après la correction
  3. Escalader avec les preuves collectées si la cause reste indéterminée
Lancer Symptôme → Cause →
+
Afficher le guide détaillé completExplications détaillées et contenu de dépannage original.

La target apparaît DOWN et les métriques ne sont plus mises à jour.

Causes probables

  • Endpoint /metrics indisponible
  • DNS ou réseau
  • Authentification/TLS
  • Timeout ou réponse trop volumineuse

Contrôles par ordre de priorité

  1. Ouvrir Status > Targets
  2. Lire Last Error
  3. Tester l’URL depuis le serveur Prometheus
  4. Vérifier certificat, auth et timeout

Quand escalader

Escaladez lorsque la panne touche plusieurs utilisateurs, qu’une dépendance de production est indisponible ou que les journaux pointent vers un composant hors de votre contrôle. Joignez les horodatages, le périmètre, les tests déjà réalisés et le dernier état fonctionnel connu.

Validation du diagnostic

Pour « Prometheus ne collecte plus une target », relevez le job, l’instance, l’URL de scrape, le dernier succès et le message d’erreur affiché dans l’état des targets. Distinguez une cible réellement indisponible d’un problème de résolution, de TLS, d’authentification ou de format de métriques côté Prometheus.

Test discriminant

Interrogez l’endpoint de métriques depuis le réseau de Prometheus avec les mêmes paramètres puis consultez l’API ou la page Targets. Vérifiez service discovery, relabeling, certificat et credentials. Un HTTP 200 ne suffit pas : le contenu doit être un format de métriques valide et répondre dans le scrape timeout.

Critère de résolution

Validez la correction lorsque la target reste UP sur plusieurs cycles de scrape, que la dernière erreur disparaît et qu’une métrique connue reçoit de nouveaux échantillons. Vérifiez ensuite une requête simple afin de confirmer que l’ingestion, et pas seulement la connectivité HTTP, est rétablie.

Concepts liés

Référence primaire : Prometheus — HTTP API / targets.

♡ 0