Skip to main content

Statistiques zonales en tant que table (Outils de gestion des données)

Résumé

Crée une table de statistiques descriptives d’un ou de plusieurs champs en entrée d’une table ou d’une classe d’entités.

Illustration

Illustration de l’outil Field Statistics To Table (Statistiques de champ vers table)

Utilisation

  • L’outil accepte une classe d’entités ou une table autonome en entrée.

  • Dans le paramètre Input Fields (Champs en entrée), vous pouvez indiquer plusieurs champs dont les statistiques peuvent être calculées. Le paramètre accepte les champs de type numérique (Court, Long, Entier très grand, Flottant et Double), texte et date (Date, Date uniquement, Heure uniquement et Décalage de l’horodatage).

  • L’ordre des champs spécifiés par le paramètre Input Fields (Champs en entrée) correspond à l’ordre des lignes dans la table en sortie.

  • Le paramètre Group By Field (Grouper par champ) permet de calculer les statistiques des champs en entrée séparément pour chaque valeur unique dans le champ spécifié. Les statistiques de chaque champ en entrée sont calculées et signalées une seule fois par valeur unique dans le groupe par champ.

  • Le paramètre Output Tables (Tables en sortie) comporte quatre options pour la colonne Field Types (Types de champ) :

    • All (Tout) : la totalité des champs en entrée et des statistiques en sortie, quel que soit le type de champ, sont exportés vers une unique table en sortie.

    • Numeric (Numérique) : seuls les champs en entrée de type numérique (Short [Court], Long, Big Integer [Entier très grand], Float [Flottant] et Double) sont exportés et seules les statistiques applicables aux champs de type numérique sont exportées dans la table en sortie.

    • Text (Texte) : seuls les champs en entrée de type texte sont exportés et seules les statistiques applicables aux champs de type texte sont exportées vers la table en sortie.

    • Date : seuls les champs en entrée de type date (Date, Date Only [Date uniquement], Time Only [Heure uniquement], Timestamp Offset [Décalage de l’horodatage]) sont exportés et seules les statistiques applicables aux champs de type date sont exportées dans la table en sortie.

    Pour chaque table en sortie, le nom de la table est spécifiée dans la colonne Output Name (Nom en sortie) du paramètre Output Tables (Tables en sortie) et la table est enregistrée dans l’espace de travail spécifié par le paramètre Output Location (Emplacement en sortie).

  • Il est possible de configurer les statistiques en sortie et leurs noms de champ à l’aide du paramètre Output Statistics (Statistiques en sortie). Si aucune valeur n’est indiquée pour ce paramètre, toutes les statistiques en sortie applicables sont incluses dans les tables en sortie. Le tableau suivant répertorie toutes les statistiques disponibles et le type de champ en sortie correspondant pour chaque option de la colonne Field Types (Types de champ) du paramètre Output Tables (Tables en sortie) :

    Statistique en sortie

    Tous

    Numérique

    Texte

    Date

    Nom de champ

    Texte

    Texte

    Texte

    Texte

    Alias

    Texte

    Texte

    Texte

    Texte

    Type de champ

    Texte

    Texte

    Texte

    Texte

    Valeurs nulles

    Long

    Long

    Long

    Long

    Minimum

    Texte

    Double

    -

    Date

    Maximum

    Texte

    Double

    -

    Date

    Moyenne

    Texte

    Double

    -

    Date

    Écart type

    Double

    Double

    -

    -

    Médiane

    Texte

    Double

    -

    Date

    Effectif

    Long

    Long

    Long

    Long

    Nombre de valeurs uniques

    Long

    Long

    Long

    Long

    Mode

    Texte

    Double

    Texte

    Date

    Le moins courant

    Texte

    Double

    Texte

    Date

    Points aberrants

    Long

    Long

    -

    -

    Somme

    Double

    Double

    -

    -

    Plage

    Texte

    Double

    -

    Texte

    Ecart interquartile

    Double

    Double

    -

    -

    Premier quartile

    Texte

    Double

    -

    Date

    Troisième quartile

    Texte

    Double

    -

    Date

    Coefficient de variation

    Double

    Double

    -

    -

    Inclinaison

    Double

    Double

    -

    -

    Kurtosis

    Double

    Double

    -

    -

  • Les statistiques disponibles sont identiques aux statistiques de la vue Data Engineering. Pour plus de détails sur le mode de calcul de chaque statistique, reportez-vous à la section Interagir avec les statistiques.

  • Si vous sélectionnez All (Tout) pour la colonne Field Types (Types de champ) du paramètre Output Tables (Tables en sortie), tous les types de champ sont exportés dans une même table. Cela peut vous aider à visualiser simultanément tous les champs en entrée ainsi que leurs statistiques. Cela présente des avantages pour certaines applications ; par exemple, lors de l’utilisation des statistiques dans une mise en page ou un rapport. Vous devez cependant connaître certaines mises en garde lors de l’exportation de différents types de champ vers une seule table. Certaines options de statistiques communes à plusieurs types de champ, comme Mode, Least Common (Le moins courant), Minimum et Maximum, sont stockées sous forme de champs de type texte dans la table en sortie. Cela peut générer des problèmes, par exemple, lors du tri de ces valeurs dans les colonnes de statistiques ou de l’enchaînement des statistiques en sortie dans un modèle. La table comporte également des cellules vides car certaines statistiques ne s’appliquent pas aux champs de type texte ou date.

  • Si vous sélectionnez Numeric (Numérique), Text (Texte) ou Date pour la colonne Field Types (Types de champ) du paramètre Output Tables (Tables en sortie), chaque type de champ est exporté dans une table distincte et les tables en sortie incluent uniquement les statistiques applicables à ce type de champ. Certaines statistiques qui s’appliquent à plusieurs types de champ sont stockées dans un format qui correspond au type de champ en entrée. Par exemple, dans la table Numeric (Numérique), le champ Minimum est de type Double, alors que dans la table des dates, il est de type Date. Il est recommandé d’utiliser différentes tables en sortie. Par exemple, pour enregistrer les statistiques avec le même type que celui des champs en entrée, triez les statistiques dans la table en sortie ou utilisez leurs valeurs dans un modèle.

  • Les options Mode et Least Common (Le moins courant) de la colonne Statistic (Statistique) du paramètre Output Statistics (Statistiques en sortie) peuvent correspondre à plusieurs valeurs dans un champ en entrée en cas d’égalité. Plusieurs valeurs sont alors indiquées comme <Null>\ pour les tables en sortie Numeric (Numérique), Text (Texte) et Date. Pour l’option All (Tout), la cellule en sortie contient le texte Multiple Values (Valeurs multiples).

Paramètres

Etiqueter Explication Type de données

Input Table (Table en entrée)

Table en entrée contenant les champs utilisés pour créer la table des statistiques.

Table View

Champs en entrée

Champs contenant les valeurs utilisées pour le calcul des statistiques.

Field

Emplacement en sortie

Emplacement dans lequel les tables en sortie sont créées. Cet emplacement peut être une géodatabase, un dossier ou un jeu de classes d’entités.

Workspace

Tables en sortie

Tables en sortie contenant les statistiques. La colonne Field Types (Types de champ) spécifie les types de champ inclus dans chaque table en sortie et la colonne Output Name (Nom en sortie), le nom de chaque table en sortie. Vous pouvez, par exemple, créer une seule table avec des résumés de tous les types de champ ou créer des tables distinctes pour les résumés des types de champs Numérique, Texte et Date.

Colonnes de la table de valeurs :

  • Field TypesSpecifies the field types that will be included in each output table.

    • NumericA table summarizing numeric fields of the input (Short, Long, Float, and Double types) will be created.

    • TextA table summarizing text fields of the input (Text type) will be created.

    • DateA table summarizing date fields of the input (Date type) will be created.

    • AllA table summarizing all numeric, text, and date fields of the input will be created.

  • Output NameThe name of each output table.

Value Table

Champ de regroupement

(Facultatif)

Champ utilisé pour regrouper les lignes en catégories. Si un champ Regrouper par est indiqué, chaque champ de l’entrée apparaît en tant que ligne dans la table en sortie une fois par valeur unique du champ Regrouper par.

Field

Statistiques en sortie

(Facultatif)

Indique les statistiques qui seront synthétisées ainsi que les noms des champs en sortie contenant les statistiques. La statistique est fournie dans la colonne Statistic (Statistique) et le nom du champ en sortie est indiqué dans la colonne Output Field Name (Nom du champ en sortie). Si aucune valeur n’est indiquée, toutes les statistiques applicables sont calculées pour tous les champs en entrée.

Seules les statistiques applicables aux champs en entrée sont disponibles.

Colonnes de la table de valeurs :

  • StatisticSpecifies the statistic type that will be used.

    • Field nameThe name of the field.

    • AliasThe alias of the field.

    • Field typeThe field type of the field (Short, Long, Double, Float, Text, or Date).

    • NullsThe number of records containing null values in the field.

    • MinimumThe smallest value in the field.

    • MaximumThe largest value in the field.

    • MeanThe mean (sum divided by total count) of all values in the field. To calculate the mean date for date fields, each date is converted to a number by calculating the difference between the date and a reference date (for example, 1900-01-01), calculated in milliseconds.

    • Standard deviationThe standard deviation of the values in the field. It is calculated as the square root of the variance, in which the variance is the average squared difference of each value from the mean of the field.

    • MedianThe median for all values in the field. The median is the middle value in the sorted list of values. If there is an even number of values, the median is the mean of the two middle values in the distribution.

    • CountThe number of nonnull values in the field.

    • Number of unique valuesThe number of unique values in the field.

    • ModeThe most frequently occurring value in the field.

    • Least commonThe least common value in the field.

    • OutliersThe number of records with outlier values in the field. Outliers are values that are more than 1.5 times the interquartile range above the third quartile or below the first quartile of the values of the field.

    • SumThe sum of all values in the field.

    • RangeThe difference between the largest and smallest values in the field.

    • Interquartile rangeThe range between the first quartile and the third quartile of the values in the field. This represents the range of the middle half of the data.

    • First quartileThe value of the first quartile of the field. Quartiles divide the sorted list of values into four groups containing equal numbers of values. The first quartile is the upper limit of the first group in ascending order.

    • Third quartileThe value of the third quartile of the field. Quartiles divide the sorted list of values into four groups containing equal numbers of values. The third quartile is the upper limit of the third group in ascending order.

    • Coefficient of variationThe coefficient of variation of the values in the field. The coefficient of variation is a measure of the relative spread of the values. It is calculated as the standard deviation divided by the mean of the field.

    • SkewnessThe skewness of the values in the field. Skewness measures the symmetry of the distribution. The skewness is calculated as the third moment (the average of the cubed data values) divided by the cubed standard deviation.

    • KurtosisThe kurtosis of the values in the field. Kurtosis describes the heaviness of the tails of a distribution compared to the normal distribution, helping identify the frequency of extreme values. The kurtosis is calculated as the fourth moment (the average of the data values taken to the fourth power) divided by the fourth power of the standard deviation.

  • Output Field NameThe name of the output field

Value Table

Sortie dérivée

Etiqueter Explication Type de données

Table en sortie pour les champs de type Numérique

Tables en sortie pour les données de type Numérique. La table est enregistrée dans l’espace de travail spécifié par le paramètre Output Location (Emplacement en sortie).

Table

Table en sortie pour les champs de type Texte

Tables en sortie pour les données de type Texte. La table est enregistrée dans l’espace de travail spécifié par le paramètre Output Location (Emplacement en sortie).

Table

Table en sortie pour les champs de type Date

Tables en sortie pour les données de type Date. La table est enregistrée dans l’espace de travail spécifié par le paramètre Output Location (Emplacement en sortie).

Table

Table en sortie pour tous les champs

Tables en sortie pour tous les types de données. La table est enregistrée dans l’espace de travail spécifié par le paramètre Output Location (Emplacement en sortie).

Table

Environnements

Cet outil n’utilise pas d’environnement de géotraitement.

Informations de licence

  • Basic: Oui
  • Standard: Oui
  • Advanced: Oui