Skip to main content

Create Spatial Component Explanatory Variables (Créer des variables explicatives de composant spatial) (Outils de statistiques spatiales)

Résumé

Crée un ensemble de champs de composants spatiaux qui décrivent le mieux les modèles spatiaux d’un ou de plusieurs champs numériques et qui font office de variables explicatives utiles dans un modèle de prévision ou de régression.

Les champs en entrée doivent correspondre aux variables explicatives et dépendantes utilisées dans un modèle de prévision. Les champs de composants spatiaux résultants (appelés vecteurs propres de Moran) peuvent être utilisés comme variables explicatives (en plus des variables explicatives d’origine) qui améliorent souvent la puissance de prévision du modèle en prenant en compte les modèles spatiaux des autres variables.

En savoir plus sur les vecteurs propres de Moran

Illustration

Illustration de l’outil Créer des variables explicatives de composant spatial

Utilisation

  • Cet outil crée des composants spatiaux qui peuvent prévoir avec une grande précision les valeurs des champs en entrée. Chaque composant représente un modèle spatial et les composants sélectionnés sont ceux dont les modèles ressemblent le plus aux modèles des champs en entrée. Par exemple, si un champ possède une vaste tendance d’Ouest en Est, mais qu’il contient également de petits agrégats de valeurs faibles et élevées, le modèle peut être représenté en combinant deux composants : l’un représentant la tendance d’Ouest en Est et l’autre, les agrégats. En incluant des variables explicatives qui ressemblent aux modèles spatiaux des variables explicatives et dépendantes, les effets spatiaux sont pris en compte dans les outils de prévision et de régression, tels que Generalized Linear Regression (Régression linéaire généralisée) et Forest-based and Boosted Classification and Regression (Classification et régression boostées basées sur une forêt). En prenant en compte les effets spatiaux, ces modèles de prévision non spatiaux parviennent généralement à des prévisions plus précises et les déformations spatiales (telles que les modèles spatiaux dans les valeurs résiduelles) sont souvent réduites. Cela est important afin que les prévisions de certaines zones ne soient pas systématiquement sous-estimées ou surestimées par le modèle. En outre, les coefficients des variables explicatives peuvent être plus facilement interprétés car ils estiment la relation directe entre la variable explicative et la variable dépendante tout en filtrant le bruit introduit par les effets spatiaux.

  • Cet outil est destiné à créer des variables explicatives qui peuvent être utilisées dans des modèles de prévison, mais l’outil Filter Spatial Autocorrelation From Field (Filtrer l’autocorrélation spatiale à partir d’un champ) peut également être utilisé à cette fin en supprimant l’autocorrélation spatiale du champ normalisé des valeurs résiduelles d’un modèle de prévision. Les composants spatiaux qui filtrent l’auto-corrélation résiduelle de manière efficace sont souvent des variables explicatives utiles et peuvent souvent offrir une amélioration du modèle équivalente à cet outil en utilisant moins de composants comme variables explicatives. Il est recommandé d’essayer les deux outils et de comparer les résultats de l’inclusion des composants spatiaux de chacun dans le modèle de prévision d’origine (par exemple, en comparant les valeurs R carré ajusté ou AIC).

  • Les composants sont renvoyés sous forme de champs dans la classe d’entités en sortie et, si l’outil est exécuté dans une carte active, la couche d’entités en sortie est dessinée en fonction du premier composant spatial. Les champs en entrée sont également inclus dans la classe d’entités en sortie pour que les variables explicatives d’origine et les variables explicatives des composants spatiaux puissent être utilisées pour prévoir la variable dépendante dans les outils de prévision sans qu’il ne soit nécessaire de fusionner les classes d’entités en entrée et en sortie.

  • Les messages de géotraitement incluent les tables suivantes, qui récapitulent la sélection des composantes spatiales utilisées pour filtrer spatialement le champ en entrée :

    • Neighborhood Search History—Pour chacune des matrices de pondérations spatiales (SWM) testées, les détails de la matrice de pondérations spatiales (tels que le nombre de voisins et la structure de pondération), la valeur p et la valeur R-carré ajusté si tous les composants sont utilisés, la valeur R-carré ajusté si seuls les composants sélectionnés sont utilisés et le nombre de composants sélectionnés sont affichés. La matrice de pondérations spatiales dont la valeur R carré ajusté est la plus élevée avec les composants sélectionnés est utilisée pour créer les composants et est indiquée par un texte en gras et un astérisque.

    • Spatial Component Search History—Pour la matrice de pondérations spatiales sélectionnée, l’ID de chaque composant (par exemple, l’ID 4 indique qu’il s’agit du quatrième composant spatial), la valeur I de Moran et la valeur p du composant, ainsi que la valeur R-carré ajusté du composant (et de tous les composants déjà sélectionnés) sont affichés. Les lignes sont classées en fonction des composants qui prévoient individuellement les champs en entrée de la manière la plus efficace (Valeur R carré la plus élevée).

  • Afin de sélectionner la matrice de pondérations spatiales à utiliser pour créer les composantes spatiales, l’outil génère une liste de matrices de pondérations spatiales candidates et effectue des tests pour identifier celle qui crée les composantes spatiales prévoyant le plus précisément les valeurs des champs en entrée. Si aucun fichier de matrice de pondérations spatiales n’est fourni dans le paramètre Input Spatial Weights Matrix Files (Fichiers de matrice de pondérations spatiales en entrée), 28 matrices de pondérations spatiales sont créées et incluses dans la liste des candidats (reportez-vous à la rubrique Comprendre les vecteurs propres de Moran pour une description de chaque matrice de pondérations spatiales). Si des matrices de pondérations spatiales en entrée sont fournies, vous pouvez utiliser le paramètre Compare Only Input Spatial Weight Matrices (Comparer uniquement les matrices de pondérations spatiales en entrée) pour indiquer si la liste des candidats inclut uniquement les matrices de pondérations spatiales fournies ou si elle inclut les matrices de pondérations spatiales fournies et les 28 matrices de pondérations spatiales créées par l’outil. Par exemple, pour utiliser une seule matrice de pondérations spatiales spécifiée, indiquez la matrice de pondérations spatiales dans le paramètre Input Spatial Weights Matrix Files (Fichiers de matrice de pondérations spatiales en entrée) et laissez le paramètre Compare Only Input Spatial Weight Matrices (Comparer uniquement les matrices de pondérations spatiales en entrée) coché.

  • L’outil sélectionne une matrice de pondérations spatiales parmi les candidats comme suit :

    1. Pour chacune des 28 matrices de pondérations spatiales candidates, la signification statistique de la matrice de pondérations spatiales est testée en prévoyant les champs en entrée, en utilisant toutes les composantes spatiales comme variables explicatives. Le test de signification utilise le R-carré combiné de tous les champs en entrée et effectue une correction Šidák de la valeur p pour prendre en compte le nombre de matrices de pondérations spatiales testées. Toute matrice de pondérations spatiales non statistiquement significative est supprimée de la liste des candidats.

    2. Pour chaque matrice de pondérations spatiales candidate restante, des composantes spatiales sont ajoutées de manière séquentielle en tant que variables explicatives, jusqu’à ce que la composante suivante ne soit pas statistiquement significative seule (la valeur p est supérieure à 0,05) ou que la valeur R-carré ajusté de la composante (et de toutes les composantes précédemment sélectionnées) dépasse la valeur R-carré ajusté obtenue lorsque toutes les composantes de la matrice de pondérations spatiales sont utilisées. Chaque nouveau composant est sélectionné en recherchant celui dont la signification statistique est la plus élevée (valeur p la plus faible) s’il est utilisé pour prévoir les champs en entrée.

    3. La matrice de pondérations spatiales dont la valeur R-carré ajusté résultante est la plus élevée est sélectionnée comme matrice de pondérations spatiales finale et le jeu associé de composantes spatiales sélectionnées est renvoyé en tant que champs dans la classe d’entités en sortie.

    Cette procédure est appelée méthode de sélection FWD (Avant). Elle est entièrement décrite dans la référence suivante :

    • Blanchet, F. Guillaume, Pierre Legendre, and Daniel Borcard. 2008. "Forward selection of explanatory variables." Ecology 89, no. 9: 2623-2632. https://doi.org/10.1890/07-0986.1.

    .

Paramètres

Etiqueter Explication Type de données

Input Features (Entités en entrée)

Entités en entrée contenant les champs des variables explicatives et dépendantes utilisées dans un modèle de prévision.

Feature Layer

Champs en entrée

Champs en entrée des variables explicatives et dépendantes utilisées dans un modèle de prévision.

Field

Entités en sortie

Entités en sortie contenant les champs des composants spatiaux pouvant être utilisés comme variables explicatives supplémentaires dans un modèle de prévision.

Feature Class

Append All Fields From Input Features (Ajouter tous les champs des entités en entrée)

(Facultatif)

Indique si tous les champs sont copiés des entités en entrée dans la classe d’entités en sortie.

  • ActivéTous les champs des entités en entrée sont copiés dans la classe d’entités en sortie. Il s’agit de l’option par défaut.

  • DécochéSeuls les champs en entrée sont copiés dans la classe d’entités en sortie.

Boolean

Fichiers de matrice de pondérations spatiales en entrée

(Facultatif)

Liste des fichiers de matrice de pondérations spatiales en entrée (.swm) à utiliser comme candidats pour la matrice de pondérations spatiales qui sera utilisée afin de créer les variables explicatives des composantes spatiales. Si aucun fichier n’est indiqué, l’outil teste les 28 voisinages différents.

File

Fichier matrice de pondérations spatiales en sortie

(Facultatif)

Fichier SWM en sortie (.swm) des voisins et pondérations sélectionnés par l’outil. Ce paramètre ne s’applique pas si vous spécifiez un fichier .swm en entrée.

File

Champ d’ID unique

(Facultatif)

Champ d’ID unique du fichier .swm en sortie. Ce champ doit être un entier et doit posséder une valeur unique par entité en entrée.

Field

Comparer uniquement les matrices de pondérations spatiales en entrée

(Facultatif)

Indique si seuls les fichiers .swm fournis dans le paramètre Input Spatial Weights Matrix Files (Fichiers de matrice de pondérations spatiales en entrée) doivent être testés ou s’il convient également de tester les 28 voisinages supplémentaires. L’outil utilisera la matrice de pondérations spatiales qui crée les composantes spatiales prévoyant le plus précisément les valeurs des champs en entrée. Ce paramètre s’applique uniquement si au moins une matrice de pondérations spatiales en entrée est fournie.

  • ActivéSeuls les fichiers .swm en entrée indiqués dans le paramètre in_swm sont testés. Il s’agit de l’option par défaut.

  • DécochéLes fichiers .swm en entrée indiqués dans le paramètre in_swm ainsi que les 28 voisinages supplémentaires sont testés.

Boolean

Environnements

Transformations géographiques, Système de coordonnées en sortie, Facteur de traitement parallèle, Générateur de nombres aléatoires

Informations de licence

  • Basic: Oui
  • Standard: Oui
  • Advanced: Oui