Skip to main content

Comprendre l’API des métriques

L’API des métriques améliore l’observabilité en permettant de surveiller et de gérer les applications et l’infrastructure. L’API des métriques active l’agrégation et la collecte de données en temps réel et fournit une vue d’ensemble des performances de votre système. En outre, les équipes DevOps peuvent utiliser l’API pour configurer des alertes, résoudre des problèmes et optimiser l’allocation des ressources. L’exposition de ces métriques de performances vous permet de mieux détecter les anomalies et les goulets d’étranglement et d’être plus proactif en termes de maintenance du système. Enfin, l’API des métriques permet l’intégration d’un large éventail d’outils de surveillance et de visualisation, ce qui optimise l’observation de systèmes complexes.

En tant qu’administrateur, après avoir configuré l’accès aux métriques, vous pouvez utiliser les requêtes PromQL pour obtenir des informations sur les métriques qui peuvent être utilisées par des visionneuses tierces ou des applications graphiques (Grafana, par exemple).

Cas d’utilisation des métriques

Les métriques peuvent être utilisées dans le cadre de nombreux cas d’utilisation pour concevoir, maintenir, dépanner et évaluer votre déploiement ArcGIS Enterprise.

Identifier les modèles d’utilisation et d’activité

Les modèles d’utilisation et d’activité montrent comment les personnes interagissent avec ArcGIS Enterprise. Il peut s’agir d’une information utile pour les responsables d’entreprise et gestionnaires SIG qui doivent mesurer et communiquer l’impact d’ArcGIS Enterprise dans l’organisation.

Les requêtes par seconde peuvent être regroupées par service, utilisateur et opération. Cela permet d’identifier les services les plus populaires, les services que chaque utilisateur utilise et les types d’opérations que les utilisateurs effectuent sur différents services. Ces informations peuvent orienter vos choix quant au contenu à promouvoir ou supprimer, ainsi que les licences et autorisations d’accès appropriées pour chaque utilisateur.

Détecter, comprendre et résoudre les problèmes système

Comprendre l’état du système peut aider les administrateurs SIG et TI responsables du bon fonctionnement d’ArcGIS Enterprise.

  • Uptime (Temps de disponibilité) : l’état opérationnel ou hors service du système est l’indicateur de performance clé le plus important. Si les utilisateurs signalent des problèmes avec le système, vérifiez d’abord son temps de disponibilité pour voir si le système est disponible.

  • Service Error % (Pourcentage d’erreur de service) : le taux d’erreur donne des informations sur la fréquence à laquelle les services renvoient des erreurs. Cette métrique est particulièrement importante si votre accord de niveau de service (SLA) précise que le taux d’erreur doit rester en dessous d’un certain seuil.

  • Response time (Temps de réponse) : les utilisateurs peuvent être sensibles aux services qui tardent à renvoyer des réponses. Un temps de réponse long peut également indiquer un problème sous-jacent qui doit être traité. Le regroupement des temps de réponse par une combinaison de nom de service, d’utilisateur et d’opération peut aider à identifier les causes des temps de réponse lents.

  • Service load (Charge de service) : certains problèmes sont liés à une charge de service élevée. Une augmentation rapide des requêtes par seconde ou du temps d’utilisation du service par seconde peut être le signe d’un problème dans le système pouvant être causé par un service devant gérer un volume de requêtes important.

  • Machine and process resource usage (Utilisation des ressources machine et processus) : les informations sur l’utilisation de la mémoire, du CPU ou du disque permettent de déterminer si des problèmes système sont liés à une forte utilisation des ressources. La décomposition de l’utilisation par processus peut vous aider à identifier les processus à l’origine d’une forte utilisation des ressources système.

Ajuster le déploiement

Même si le système fonctionne bien actuellement, il peut s’avérer utile d’ajuster sa configuration pour l’optimiser et réduire le risque de problèmes à venir.

  • Service load (Charge de service) : l’impact d’un service sur le système se mesure mieux par le temps utilisé par le service en secondes par seconde. Le fait de savoir quels services présentent une charge plus élevée permet d’identifier les meilleures cibles pour améliorer l’ajustement.

  • Process resource usage (Utilisation des ressources par le processus) : l’utilisation de la mémoire et du processeur dans le cadre de processus individuels peut également faciliter l’identification des parties du système qui ont le plus grand impact sur l’utilisation globale des ressources.

Ressources d’infrastructure de taille adaptée

Les infrastructures pouvant être coûteuses, il est important de veiller à disposer de ressources suffisantes pour fournir la capacité dont vous avez besoin sans payer pour des ressources inutilisées dont vous n'avez pas besoin.

  • About (À propos) : ces informations détaillent les spécifications telles que le système d’exploitation, le processeur et la mémoire pour toutes les machines simultanément. Il s’agit d’un moyen pratique de consulter les spécifications des machines, afin de s’assurer qu’elles satisfont aux exigences du système et qu’elles sont cohérentes pour toutes les machines d’un site ArcGIS Server.

  • Machine resource usage (Utilisation des ressources machine) : une utilisation constamment intensive de la mémoire, du processeur ou du disque peut indiquer que vous devez étendre votre infrastructure pour répondre à vos besoins. À l’inverse, des ressources sous-utilisées peuvent indiquer que vous pourriez réduire les dépenses d’infrastructure sans nuire aux performances.

Métriques disponibles

Les composants d’ArcGIS Enterprise utilisent différents types de métriques via l’API des métriques. Les métriques de machine donnent des informations relatives à la machine sur laquelle le composant est installé (la mémoire disponible, par exemple). Les métriques de service donnent des informations sur les performances des services (le temps de réponse, par exemple). Consultez la rubrique Informations présentées par l’API des métriques pour plus de détails sur chaque type de métrique.

À cette version, tous les composants d’ArcGIS Enterprise ne présentent pas l’API des métriques. Le tableau suivant récapitule les types de métriques disponibles pour différents composants.

Composant

Métriques disponibles

Portal for ArcGIS

  • Métriques de machine

  • Métriques d’organisation

ArcGIS Data Store

  • Métriques de machine

  • Métriques de relational store

Serveurs ArcGIS Server :

  • Serveur SIG ArcGIS

  • ArcGIS GeoEnrichment Server

  • ArcGIS GeoEvent Server

  • ArcGIS Image Server

  • ArcGIS Knowledge Server

  • ArcGIS Workflow Manager Server

  • Métriques de machine

  • Métriques de service

Effacement des métriques

Les métriques recueillent une grande quantité d’informations sur ArcGIS Enterprise. Par défaut, les métriques obsolètes sont effacées du système toutes les heures. Vous pouvez augmenter l’intervalle d’effacement au-delà du seuil par défaut, mais cela peut faire augmenter la taille de la réponse. Pour la plupart des organisations, l’intervalle par défaut est le bon équilibre et vous n’avez pas besoin de le modifier.

Il est recommandé d’augmenter l’intervalle d’effacement par défaut uniquement si les deux conditions suivantes s’appliquent :

  • L’une de vos tâches personnalisées extrait et agrège les métriques Prometheus selon des intervalles supérieurs à 1 heure.

  • Vos services ne présentent pas une cardinalité élevée. Une cardinalité est élevée lorsque de nombreux utilisateurs accèdent régulièrement à de nombreux services.

Pour éviter la perte de données, assurez-vous que l’intervalle d’effacement est plus long que l’intervalle d’extraction défini par votre configuration de tâches Prometheus.