Generalized Linear Regression (Régression linéaire généralisée) (Outils de serveur GeoAnalytics)
Résumé
Effectue une régression linéaire généralisée pour générer les prévisions ou pour illustrer une variable dépendante en termes de relations pour définir un ensemble de variables explicatives. Cet outil permet d’adapter des modèles continus (moindres carrés ordinaires), binaires (logistique) et totaux (Poisson).
Héritage :
L’extension ArcGIS GeoAnalytics Server devient obsolète dans ArcGIS Enterprise. La version finale de GeoAnalytics Server a été incluse dans ArcGIS Enterprise 11.3. Cet outil de géotraitement est accessible via ArcGIS Enterprise 11.3 et versions antérieures.
Utilisation
Cet outil peut être utilisé en deux modes opératoires. Vous pouvez évaluer les performances de différents modèles et examiner une diversité de variables explicatives et de paramètres de l’outil. Lorsque vous avez trouvé un modèle adéquat, vous pouvez appliquer le modèle à un nouveau jeu de données.
Cet outil ne prend pas en charge les entrées avec des champs de type date uniquement ou heure uniquement.
Utilisez le paramètre Input Features (Entités en entrée) avec un champ représentant les phénomènes que vous modélisez (paramètre Dependent Variable (Variable dépendante)) et un ou plusieurs champs représentant les variables explicatives.
L’outil Generalized Linear Regression (Régression linéaire généralisée) produit également des entités en sortie et des diagnostics. Les couches d’entités en sortie sont ajoutées automatiquement à la carte avec un schéma de rendu appliqué aux valeurs résiduelles du modèle. Une explication de chaque sortie est fournie ci-dessous.
Veillez à utiliser l’option de paramètre Model Type (Type de modèle) (Continuous [Continu], Binary [Binaire] ou Count [Total]) appropriée de sorte que l’analyse de régression produise des résultats précis.
Les résultats récapitulatifs et diagnostics du modèle sont écrits dans la fenêtre de messages et des diagrammes sont créés sous la classe d’entités en sortie. Les diagnostics générés dépendent de la valeur du paramètre Model Type (Type de modèle). Les trois options de type de modèle sont les suivants :
Utilisez le type de modèle Continuous (Continu) (gaussien) si la variable dépendante accepte une plage étendue de valeurs telles que des températures ou un volume total de ventes. Il est recommandé que la variable dépendante soit distribuée normalement.
Utilisez le type de modèle Binary (Binaire) (logistique) si la variable dépendante admet l’une parmi deux valeurs possibles, telles que réussite et échec ou présence et absence. Le champ qui contient la variable dépendante doit être un champ numérique ou de texte. Si le champ est numérique, il ne doit contenir que des uns et des zéros. Un champ de texte ne doit comporter que deux valeurs distinctes. Si vous utilisez un champ de texte, vous devez utiliser le paramètre Map Dependent Variables (Apparier les variables dépendantes) pour apparier les valeurs de texte distinctes à des uns et des zéros. Les données doivent présenter une variation des uns et des zéros des valeurs de texte distinctes.
Utilisez le type de modèle Count (Total) (Poisson) si la variable dépendante est discrète et représente le nombre d’occurrences d’un événement, tel qu’un nombre de délits. Les modèles de type Total peuvent également être utilisés si la variable dépendante représente un taux et que le dénominateur du taux est une valeur fixe telle que les ventes mensuelles ou le nombre de cas de cancer sur 10 000 personnes parmi la population totale. Dans le modèle Count (Total), il est supposé que la moyenne et la variance de la variable dépendante sont identiques et que les valeurs de la variable dépendante ne peuvent pas être négatives ni contenir de décimale.
Les valeurs des paramètres Dependent Variable (Variable dépendante) et Explanatory Variable (Variable explicative) doivent être des champs numériques contenant une plage de valeurs. Cet outil ne peut pas fonctionner si les variables ont toutes la même valeur (lorsque toutes les valeurs d’un champ sont définies sur 9,0 par exemple).
Les entités qui comportent une ou plusieurs valeurs nulles ou encore des valeurs de chaîne vide dans les champs de prévision ou explicatifs seront exclues de la sortie. Vous pouvez modifier les valeurs à l’aide de l’outil Calculate Field (Calculer un champ), si nécessaire.
Passez en revue les surestimations et sous-estimations évidentes dans les valeurs résiduelles de régression pour identifier des informations permettant de déterminer s’il manque des variables dans le modèle de régression.
Vous pouvez utiliser le modèle de régression qui a été créé pour faire des prévisions pour les autres entités. Pour effectuer ces prévisions, chaque entité de prévision doit posséder des valeurs pour chaque variable explicative fournie. Si les noms des champs des paramètres Input Features (Entités en entrée) et Prediction Locations (Emplacements des prévisions) ne concordent pas, une variable correspondant au paramètre est fournie. Lorsque vous appariez les variables explicatives, les champs des paramètres Input Features (Entités en entrée) et Input Prediction Features (Entités de prévision en entrée) doivent être du même type (les champs de type double doivent être appariés à des champs de type double, par exemple).
L’implémentation GeoAnalytics de la régression linéaire généralisée possède les limites suivantes :
Il s’agit d'un modèle de régression global qui ne tient pas compte de la distribution spatiale des données.
L'analyse ne s'applique pas au test de l’outil d'auto-corrélation spatiale (Moran I) sur les résidus.
Les jeux de classes d’entités (points, lignes, polygones et tables) sont pris en charge en entrée ; les rasters ne sont pas pris en charge.
Vous ne pouvez pas classer les valeurs en plusieurs classes.
Cet outil de géotraitement est mis en œuvre par ArcGIS GeoAnalytics Server. L’analyse est réalisée dans GeoAnalytics Server et les résultats sont stockés dans votre contenu dans ArcGIS Enterprise.
Lorsque vous exécutez des outils GeoAnalytics Server, l’analyse est effectuée dans GeoAnalytics Server. Pour des performances optimales, GeoAnalytics Server doit pouvoir accéder aux données via les couches d’entités hébergées sur votre portail ArcGIS Enterprise ou les partages de fichiers Big Data. Les données qui ne se trouvent pas en local sur GeoAnalytics Server sont transférées sur GeoAnalytics Server avant l’analyse. Autrement dit, l’exécution d’un outil prend plus de temps et, dans certains cas, le transfert des données depuis ArcGIS Pro vers GeoAnalytics Server peut échouer. Le seuil d’échec dépend aussi bien des débits du réseau que de la taille et de la complexité des données. Il est recommandé de toujours partager les données ou de créer un partage de fichiers Big Data.
En savoir plus sur le partage des données dans votre portail.
En savoir plus sur la création d’un partage de fichiers Big Data via ArcGIS Server Manager
Paramètres
| Etiqueter | Explication | Type de données |
|---|---|---|
|
Input Features (Entités en entrée) |
Couche qui contient les variables dépendantes et indépendantes. |
Record Set |
|
Variable dépendante |
Champ numérique contenant les valeurs observées à modéliser. |
Field |
|
Type de modèle |
Précise le type de données à modéliser.
|
String |
|
Variables explicatives |
Liste des champs qui représentent des variables explicatives indépendantes dans le modèle de régression. |
Field |
|
Nom des entités en sortie |
Nom de la classe d’entités qui sera créée contenant des estimations de variable dépendante et les valeurs résiduelles. |
String |
|
Générer la table de coefficients (Facultatif) |
Spécifie si une table en sortie comportant des coefficients (valeurs booléennes) est générée.
|
Boolean |
|
Entités de prédiction en entrée (Facultatif) |
Couche contenant des entités qui représentent des localisations pour lesquelles des estimations seront calculées. Chaque entité dans ce jeu de données doit contenir des valeurs pour toutes les variables explicatives spécifiées. La variable dépendante pour ces entités sera estimée à l’aide du modèle calibré pour les données de la couche en entrée. |
Record Set |
|
Apparier les variables explicatives (Facultatif) |
Apparie les variables explicatives du paramètre Input Prediction Features (Entités de prévision en entrée) aux variables explicatives correspondantes du paramètre Input Features (Entités en entrée). Colonnes de la table de valeurs :
|
Value Table |
|
Apparier les variables dépendantes (Facultatif) |
Deux chaînes représentant les valeurs à apparier à 0 (absence) et à 1 (présence) pour la représentation binaire. Par défaut, 0 et 1 sont utilisés. Par exemple, pour prévoir une arrestation avec les valeurs de champ Arrestation et Pas d’arrestation, saisissez Pas d’arrestation pour Colonnes de la table de valeurs :
|
Value Table |
|
Stockage des données (Facultatif) |
Indique l’instance ArcGIS Data Store dans laquelle la sortie sera stockée. Tous les résultats stockés dans un répertoire de données Big Data spatio-temporelles seront stockés en WGS84. Les résultats stockés dans un répertoire de données relationnelles conservent leur système de coordonnées.
|
String |
Sortie dérivée
| Etiqueter | Explication | Type de données |
|---|---|---|
|
Sortie |
Service d’entités en sortie destiné à recevoir des estimations de variable dépendante pour chaque entité en entrée. |
Record Set |
|
Entités prévues en sortie |
Couche en sortie contenant les variables en entrée et les valeurs explicatives prévisionnelles. |
Record Set |
|
Table en sortie de coefficients |
Table en sortie contenant les coefficients de l’adéquation du modèle. La sortie est créée lorsque le paramètre Generate Coefficient Table (Générer la table de coefficients) est sélectionné. |
Record Set |
Environnements
Système de coordonnées en sortie, Etendue, Espace de travail courant
Cas particuliers
- Système de coordonnées en sortie
-
The coordinate system that will be used for analysis. Analysis will be completed in the input coordinate system unless specified by this parameter. For GeoAnalytics Tools, final results will be stored in the spatiotemporal data store in WGS84.
Informations de licence
- Basic: Requiert ArcGIS GeoAnalytics Server
Disponible avec ArcGIS Enterprise 10.7 - Standard: Requiert ArcGIS GeoAnalytics Server
Disponible avec ArcGIS Enterprise 10.7 - Advanced: Requiert ArcGIS GeoAnalytics Server
Disponible avec ArcGIS Enterprise 10.7