Skip to main content

Estimer le temps avant l’événement (Outils de statistiques spatiales)

Résumé

Prévoit le délai avant un événement en fonction des délais précédents de l’événement. Des variables explicatives peuvent être utilisées pour améliorer les prévisions et l’outil peut identifier les variables qui augmentent ou réduisent le temps avant l’événement.

En savoir plus sur le fonctionnement de l’outil Estimer le temps de survenue

Illustration

Illustration de l’outil Estimer le temps de survenue

Utilisation

  • Chaque observation dans la table ou les entités en entrée doit comporter des champs contenant l’ancienneté de l’observation, un indicateur précisant si l’événement est déjà survenu et des variables explicatives. Ces champs sont respectivement fournis dans les paramètres Age Field (Champ d’ancienneté), Event Indicator Field (Champ d’indicateur d’événement) et Explanatory Variables (Variables explicatives). Les variables explicatives peuvent être continues ou catégorielles et l’indicateur d’événement doit uniquement prendre les valeurs 0 (l’événement ne s’est pas produit) ou 1 (l’événement s’est produit). Pour le champ d’ancienneté, il s’agit souvent de l’âge réel du sujet, mais en général, cela correspond au délai entre la première date/heure possible où l’événement aurait pu survenir et la date/l’heure où il s’est réellement produit (ou la date/l’heure actuelle, si l’événement ne s’est pas produit). Par exemple, pour estimer la durée de vie des arbres, les valeurs du champ d’ancienneté doivent être l’âge actuel de l’arbre s’il est toujours vivant ou l’âge de l’arbre lors de sa mort. Toutefois, pour estimer le temps jusqu’à une nouvelle arrestation, les valeurs du champ doivent être le délai écoulé depuis que le sujet a été remis en liberté (première fois qu’une nouvelle arrestation peut avoir lieu) jusqu’à la date de sa nouvelle arrestation (ou la date actuelle si le sujet n’a pas fait l’objet d’une nouvelle arrestation). L’unité de l’ancienneté (heures, jours, années, etc.) n’a pas besoin d’être spécifiée, mais tous les résultats doivent être interprétés dans cette unité de temps.

  • Prévoir quand un événement va se produire étant une tâche naturellement difficile, nous vous engageons à nourrir des attentes réalistes. L’outil peut uniquement extraire des informations des variables explicatives que vous fournissez, mais des phénomènes complexes tels qu’une panne d’infrastructure impliquent de nombreux facteurs qui sont généralement très circonscrits et propres à chaque sujet. En pratique, vous devez considérer les temps prévus jusqu’à l’événement comme des indications générales du moment où l’événement risque de se produire, et non comme des prévisions précises de dates données. Vous devez également redoubler de prudence et vous méfier lorsque vous extrapolez des temps avant l’événement supérieurs au temps avant l’événement le plus long dans les données en entrée. Même s’ils sont souvent imprécis, les résultats d’une analyse du temps de survenue peuvent toujours être très utiles pour fournir des estimations générales des coûts futurs ou pour prioriser et allouer des ressources aux observations les plus susceptibles d’être les prochaines à expérimenter l’événement.

  • Les modèles de temps de survie ne sont pas intrinsèquement spatiaux, mais l’incorporation d’informations spatiales peut les améliorer par la prise en compte de modèles géographiques. Envisagez d’ajouter des variables explicatives spatiales, telles que des régions géographiques comme variables explicatives catégorielles ou des distances par rapport à des entités clés comme variables explicatives continues. Pour modéliser la mortalité des arbres en milieu urbain, par exemple, la distance par rapport au bâtiment le plus proche peut être importante car l’ombre d’un bâtiment peut réduire la lumière du soleil.

  • Les observations dans lesquelles l’événement ne s’est pas encore produit sont appelées observations censurées et les observations dans lesquelles l’événement est survenu sont appelées observations non censurées. Cette terminologie provient du fait que les informations des observations non censorées sont complètes (le délai avant l’événement est connu), mais que celles des observations censorées sont partielles ; le délai exact avant l’événement n’est pas connu, mais il est plus long qu’un certain délai (l’âge actuel de l’observation).

    Bien que l’estimation des paramètres du modèle utilise à la fois des observations censurées et non censurées, les observations censurées fournissent le plus d’informations car leur temps de survie exact est connu. En règle générale, il est recommandé de disposer d’au moins 10 observations non censurées par variable explicative. Cependant, les variables catégorielles doivent compter comme plusieurs variables. Une variable catégorielle avec deux catégories compte comme une variable ; trois catégories compte comme deux variables ; quatre catégories comptent comme trois variables et ainsi de suite. En outre, chaque catégorie doit comporter plusieurs observations non censurées afin de mieux estimer l’effet de toutes les catégories de la variable catégorielle.

  • L’outil produit différentes sorties, numériques et graphiques, pour comprendre comment les variables explicatives affectent le temps jusqu’à l’événement, pour prévoir à quel moment l’événement va se produire et pour évaluer l’exactitude et la fiabilité du modèle.

    Les messages de géotraitement récapitulent les effets des variables explicatives et la précision du modèle. La classe d’entités ou la table en sortie inclut des champs et des diagrammes contextuels qui estiment quand l’événement doit survenir pour les observations non censorées.

    En savoir plus sur les sorties de l’outil et leur interprétation

Paramètres

Etiqueter Explication Type de données

Input Features or Table (Table ou entités en entrée)

Table ou entités en entrée contenant les champs de l’âge, des variables explicatives et de l’indicateur d’événement de chaque observation.

Table View

Champ Age (Âge)

Champ numérique de l’âge de l’observation. Il s’agit souvent de l’âge de l’observation, mais en général, cela correspond au délai entre le premier moment où l’événement aurait pu survenir et le moment où il s’est réellement produit (ou le moment où l’observation a été censorée). L’unité de l’âge (heures, jours, années, etc.) n’est pas spécifiée, mais tous les résultats doivent être interprétés dans cette unité de temps. Par exemple, si les valeurs d’âge sont en jours et que l’outil prévoit un délai avant l’événement de deux unités de temps dans le futur, cela signifie deux jours dans le futur.

Field

Champ Event Indicator (Indicateur d’événement)

Champ contenant un indicateur ou précisant si l’événement est survenu pour l’observation. Ce champ doit contenir uniquement les valeurs 0 et 1. La valeur 0 indique que l’événement n’est pas survenu (observation censorée) et la valeur 1, que l’événement s’est produit (observation non censorée). Par exemple, pour estimer la durée de vie des arbres, la valeur 0 signifie que l’arbre est vivant (l’événement, la mort de l’arbre, ne s’est pas produit) et la valeur 1 signifie que l’arbre est mort.

Field

Output Features or Table (Table ou entités en sortie)

Table ou entités en entrée contenant les délais prévus avant l’événement pour les observations où l’événement ne s’est pas produit.

Feature Class; Table

Variables explicatives

(Facultatif)

Liste des champs qui représentent les variables explicatives permettant de prévoir le délai avant l’événement. Cochez la case Categorical (Catégoriel) des variables qui représentent des classes ou des catégories, comme le type de matériau ou la fourchette de revenus. Laissez cette case non cochée pour les variables continues.

Colonnes de la table de valeurs :

  • VariableA list of fields representing the explanatory variables that help predict the time to the event.

  • CategoricalSpecifies if the variable is categorical or continuous.

    • CategoricalThe explanatory variable is a categorical variable.

    • NumericThe explanatory variable is a continuous variable.

Value Table

Activer les fenêtres contextuelles de la courbe de survie

(Facultatif)

Indique si des diagrammes contextuels sont générés pour chaque enregistrement en sortie. Les diagrammes contextuels représentent la courbe de survie de référence de chaque enregistrement et une courbe du temps de survie supplémentaire pour les observations censurées.

  • ActivéLes diagrammes contextuels sont générés pour chaque enregistrement du jeu de données. Il s’agit de l’option par défaut.

  • DécochéLes diagrammes contextuels ne sont pas générés.

Boolean

Environnements

Transformations géographiques, Système de coordonnées en sortie

Informations de licence

  • Basic: Oui
  • Standard: Oui
  • Advanced: Oui