Skip to main content

Rechercher des localisations similaires (Outils GeoAnalytics Desktop)

Résumé

Identifie les entités candidates les plus semblables (ou dissemblables) à une ou plusieurs entités en entrée en fonction d’attributs d’entités.

Illustration

Illustration de l’outil Rechercher des localisations similaires

Utilisation

  • Des entités tabulaires, ponctuelles, linéaires ou surfaciques peuvent être utilisées.

  • Une couche de recherche (candidate) en entrée est requise. Les entités contenues dans la couche de recherche sont classées selon leur similarité avec les emplacements (de référence) en entrée.

  • Si une ou plusieurs entités se trouvent dans la valeur du paramètre Input Layer (Couche en entrée), l’appariement est effectué selon la moyenne des valeurs du paramètre Input Layer (Couche en entrée). Par exemple, s’il existe deux entités Input Layer (Couche en entrée) et que l’un des attributs du paramètre Analysis Fields (Champs d’analyse) contient une variable liée à la population, l’outil recherche les valeurs du paramètre Search Layer (Couche de recherche) dont la population s’approche le plus des valeurs de population moyennes. Si les valeurs de population sont de 100 et 102, par exemple, l’outil recherche des candidats dont la population avoisine 101.

    Remarque :

    S’il existe plusieurs valeurs pour le paramètre Input Layer (Couche en entrée), choisissez des attributs Analysis Fields (Champs d’analyse) dont les valeurs sont similaires. Par exemple, si la valeur de population est 100 pour l’une des entrées et 100 000 pour l’autre entrée, l’outil recherche des correspondances où la population avoisine la moyenne de ces deux valeurs, c’est-à-dire 50 050. Vous remarquerez que cette valeur moyennée est loin de la valeur de population des deux valeurs Input Layer (Couche en entrée).

  • Utilisez le paramètre Most Or Least Similar (Les plus ou les moins similaires) pour rechercher les entités qui sont les plus similaires ou les moins similaires aux entités Input Layer (Couche en entrée) en utilisant respectivement l’option Most similar (Le plus similaire) ou Least similar (Le moins similaire). Dans certains cas, vous pouvez avoir besoin de consulter les deux paramètres. Si la valeur du paramètre Number of Results (Nombre de résultats) est égale à 3 et que la valeur du paramètre Most Or Least Similar (Les plus ou les moins similaires) est définie sur Both (Les deux), par exemple, l’outil renvoie les trois entités candidates les plus similaires et les trois entités candidates les moins similaires.

  • Les solutions proposées dans le paramètre Ouput Features (Entités en sortie) sont la solution la plus similaire ou la solution la moins similaire à la valeur Input Layer (Couche en entrée) cible. Une solution ne peut pas être les deux à la fois (et les solutions ne sont pas dupliquées dans Output Features (Entités en sortie)). En conséquence, lorsque la valeur du paramètre Most Or Least Similar (Les plus ou les moins similaires) est Both (Les deux), le nombre maximal de résultats possibles (la valeur du paramètre Number of Results [Nombre de résultats]) correspond à la moitié du nombre de la valeur Search Layer (Couche de recherche).

  • Un maximum de 10 000 entités de la couche de recherche peuvent être renvoyées.

  • Les options de valeur suivantes sont disponibles pour le paramètre Match Method (Méthode d’appariement) :

    • Attribute values (Valeurs attributaires) : les candidats les plus similaires auront la plus petite somme des différences au carré pour tous les attributs Analysis Fields (Champs d’analyse). Toutes les valeurs sont standardisées avant le calcul des différences.

    • Attribute profiles (Profils attributaires) : la similarité cosinus est mesurée. La similarité cosinus recherche les relations identiques parmi les valeurs attributaires normalisées au lieu de se préoccuper de l’appariement des amplitudes des attributs. Supposons par exemple qu’il existe trois valeurs Analysis Fields (Champs d’analyse) nommées A1, A2 et A3. A2 est deux fois plus grand qu’A1 et A3 est presque identique à A2. Si la valeur du paramètre Match method (Méthode d’appariement) est Attribute profiles (Profils attributaires), l’outil recherche les candidats présentant ces mêmes relations attributaires : A2 est deux fois plus grand qu’A1 et A3 est presque identique à A2. Comme cette méthode recherche des relations entre les attributs, vous devez spécifier au moins deux attributs Analysis Fields (Champs d’analyse). Vous pouvez utiliser la méthode de similarité cosinus (c’est-à-dire l’option Attribute profiles [Profils attributaires]) pour trouver des lieux similaires à Los Angeles, mais à une échelle différente. Par exemple, vous pouvez vous intéresser au profil de la population par rapport au nombre de voitures et au nombre d’habitants de moins de 20 ans. L'index de similarité cosinus est compris entre 1,0 (similarité parfaite) et -1,0 (dissemblance parfaite). L’index de similarité cosinus est indiqué dans le champ simindex (Similarité cosinus) du paramètre Output Features (Entités en sortie).

  • Le paramètre Analysis Fields (Champs d’analyse) doit être numérique et présent, et avoir le même nom de champ et le même type de champ dans les valeurs des paramètres Input Layer (Couche en entrée) et Search Layer (Couche de recherche). Si l’outil ne trouve aucun champ correspondant pour la valeur Search Layer (Couche de recherche), un avertissement indique que les attributs manquants ont été ignorés dans l’analyse.

  • Tous les attributs utilisés pour l'appariement sont inscrits dans la sortie. Le paramètre Append Fields (Ajouter des champs) vous permet de spécifier les champs à ajouter à la table en sortie. Par défaut, aucun champ n’est ajouté. Utilisez le paramètre Append Fields (Ajouter des champs) pour sélectionner dans la valeur Search Layer (Couche de recherche) des champs spécifiques à ajouter.

  • Le paramètre Input Layer (Couche en entrée) et les solutions sont inscrits dans les entités en sortie ainsi que dans les paramètres Analysis Fields (Champs d’analyse) et Append Fields (Ajouter des champs). De plus, les champs suivants sont inclus dans les entités en sortie :

    Nom du champ

    Description

    Remarques

    location_type

    Chaîne indiquant si les entités sont une couche de référence (entrée) ou une couche candidate (recherche).

    simrank

    Lorsque vous spécifiez Most similar (Le plus similaire) ou Both (Les deux) comme valeur du paramètre Most Or Least Similar (Les plus ou les moins similaires), toutes les solutions sont classées des plus similaires aux moins similaires. La valeur de classement de la solution la plus similaire est de 1.

    Ce champ est uniquement inclus dans la valeur Output Features (Entités en sortie) lorsque vous spécifiez Most similar (Le plus similaire) ou Both (Les deux) comme valeur du paramètre Most Or Least Similar (Les plus ou les moins similaires).

    dissimrank

    Lorsque vous spécifiez Least similar (Le moins similaire) ou Both (Les deux) comme valeur du paramètre Most Or Least Similar (Les plus ou les moins similaires), toutes les solutions sont classées des moins similaires aux plus similaires. La valeur de classement de la solution la moins similaire est de 1.

    Ce champ est uniquement inclus uniquement dans la valeur Output Features (Entités en sortie) lorsque vous spécifiez Least similar (Le moins similaire) ou Both (Les deux) comme valeur du paramètre Most Or Least Similar (Les plus ou les moins similaires).

    simindex

    Ce champ quantifie la similarité de chaque solution par rapport à l’entité cible. Lorsque vous spécifiez Attribute values (Valeurs attributaires) comme valeur du paramètre Match Method (Méthode d’appariement), cette valeur représente la somme des différences des valeurs au carré.

    Pour plus d’informations sur le calcul de cet index, reportez-vous à la rubrique Fonctionnement de l’outil Recherche de similarité.

    Ce champ est uniquement inclus dans la valeur Output Features (Entités en sortie) lorsque vous spécifiez Attribute values (Valeurs attributaires) comme valeur du paramètre Match Method (Méthode d’appariement).

    cosimindex

    Ce champ quantifie la similarité de chaque solution par rapport à l’entité cible. Lorsque vous spécifiez Attribute profiles (Profils attributaires) comme valeur du paramètre Match Method (Méthode d’appariement), cette valeur représente la similarité cosinus.

    Pour plus d’informations sur le calcul de cet index, reportez-vous à la rubrique Fonctionnement de l’outil Recherche de similarité.

    Ce champ est uniquement inclus dans la valeur Output Features (Entités en sortie) lorsque vous spécifiez Attribute profiles (Profils attributaires) comme valeur du paramètre Match Method (Méthode d’appariement).

    labelrank

    Ce champ est fourni uniquement à des fins d’affichage. L'outil utilise ce champ pour fournir le rendu par défaut des résultats d'analyse.

    reference_id

    Valeur d’ID unique des entités de référence. Les entités de recherche ont une valeur nulle.

    search_id

    Valeur d’ID unique des entités de recherche. Les entités de référence ont une valeur nulle.

  • La classe d’entités en sortie est ajoutée automatiquement à la table des matières, le rendu par défaut étant appliqué au champ labelrank.

  • Vous pouvez améliorer les performances de l’outil Find Similar Locations (Rechercher des localisations similaires) en suivant un ou plusieurs des conseils ci-après :

    • Définissez l’environnement de l’étendue de manière à analyser uniquement des données d’intérêt.

    • Sélectionnez seulement quelques entités dans la couche de référence.

    • Utilisez les données locales de l’environnement d’exécution de l’analyse.

  • Cet outil de géotraitement est optimisé par Spark. L'analyse est effectuée sur votre ordinateur de bureau à l'aide de plusieurs cœurs en parallèle. Reportez-vous à la rubrique Remarques sur les outils de GeoAnalytics Desktop pour en savoir plus sur l’exécution de l’analyse.

  • Lors de l’exécution d’outils de GeoAnalytics Desktop, l’analyse est effectuée sur votre ordinateur de bureau. Pour des performances optimales, les données doivent être disponibles sur votre bureau : Si vous utilisez une couche d’entités hébergée, il est recommandé d’utiliser ArcGIS GeoAnalytics Server. Si vos données ne sont pas locales, l'exécution d'un outil est plus longue. Pour utiliser votre serveur ArcGIS GeoAnalytics Server en vue d’une analyse, reportez-vous à la rubrique Outils GeoAnalytics.

  • Une analyse semblable peut également être réalisée à l’aide de l’outil Similarity Search (Recherche de similarité) de la boîte à outils Spatial Statistics (Statistiques spatiales) dans ArcGIS Pro.

Paramètres

Etiqueter Explication Type de données

Couche en entrée

Couche de référence (ou une sélection sur une couche) contenant les entités à apparier. L’outil recherche d’autres entités similaires à ces entités. Lorsque plusieurs entités sont fournies, l’appariement repose sur la moyenne des attributs.

Table View

Couche de recherche

Couche candidate (ou une sélection sur une couche) contenant les entités correspondant aux entités candidates. L’outil recherche les entités les plus similaires (ou les moins similaires) à la valeur du paramètre Input Layer (Couche en entrée) parmi ces candidats.

Table View

Jeu de données en sortie

Nom de la classe d’entités en sortie. La classe d’entités en sortie contient un enregistrement pour chacune des valeurs du paramètre Input Layer (Couche en entrée) et pour toutes les solutions trouvées.

Feature Class; Table

Champs d’analyse

Une liste d’attributs numériques représentant les critères d’appariement.

String

Les plus ou les moins similaires

Indique si les entités à rechercher sont les plus similaires ou les moins similaires à la valeur du paramètre Input Layer (Couche en entrée).

  • Le plus similaireLes entités les plus similaires sont recherchées.

  • Le moins similaireLes entités les moins similaires sont recherchées.

  • Les deuxLes entités qui sont les plus similaires et les entités qui sont les moins similaires sont toutes recherchées.

String

Méthode d’appariement

Indique si les appariements de similarité et de dissemblance doivent reposer sur des valeurs ou des relations cosinusoïdales.

  • Valeurs attributairesLa similarité et la dissemblance reposent sur la somme des différences des valeurs attributaires standardisées au carré de tous les attributs Analysis Fields (Champs d’analyse).

  • Profils attributairesLa similarité et la dissemblance sont calculées comme une fonction de la similarité cosinus de tous les attributs Analysis Fields (Champs d’analyse).

String

Nombre de résultats

Nombre de solutions correspondantes qui seront trouvées. Pour classer toutes les entités candidates, dans la limite maximale de 10 000 entités, saisissez zéro ou un nombre supérieur au nombre total d’entités de type Search Layer (Couche de recherche).

Long

Ajouter des champs

(Facultatif)

Une liste facultative d’attributs à inclure avec la sortie. Vous pouvez inclure un identifiant de nom, un champ de catégorie ou un champ de date, par exemple. Ces champs ne sont pas utilisés pour déterminer la similarité. Ils sont inclus dans les attributs du paramètre en sortie pour référence uniquement. Par défaut, aucun champ n’est ajouté.

Field

Environnements

Système de coordonnées en sortie, Étendue, Espace de travail courant

Informations de licence

  • Basic: Non
  • Standard: Non
  • Advanced: Oui