Vorbereiten von Daten für die Vorhersage (Spatial Statistics Tools)
Zusammenfassung
Optimiert Daten für Vorhersage-Workflows in den Werkzeugen Forest-basierte und geboostete Klassifizierung und Regression, Generalisierte lineare Regression und Auf Vorhandensein beschränkte Vorhersage und in anderen Modellen. Dies ermöglicht das Aufteilen von Features in Trainings- und Test-Datasets, das Extrahieren von Variablen aus Rastern und Entfernungs-Features, das Ausgleichen der Daten zur Verbesserung der Klassifizierungsgenauigkeit und das Durchführen einer räumlichen Ausdünnung an verzerrten räumlichen Daten.
Weitere Informationen zur Funktionsweise des Werkzeugs "Daten für die Vorhersage vorbereiten"
Abbildung

Verwendung
Nach dem Ausgleichen sollten die ausgeglichenen Trainingsdaten nur zum Trainieren von Vorhersagemodellen verwendet werden. Um Genauigkeitsverzerrungen und Datenverluste zu vermeiden, sollten Modelle nicht anhand von Daten, die ausgeglichen wurden, validiert werden.
Die Erweiterung "ArcGIS Spatial Analyst" ist erforderlich, um Raster als erklärende Variablen zu verwenden.
Wenn Sie die Klassifizierung zum Vorhersagen seltener Ereignisse oder nicht ausgeglichener Kategorien verwenden, dann sollten Sie den Parameter Ausgleichstyp verwenden, um die Anzahl der Stichproben in jeder Kategorieebene auszugleichen. Mit Oversampling-Methoden kann die Anzahl der Features insgesamt erhöht werden. Mit Undersampling-Methoden kann dagegen die Anzahl der Features insgesamt verringert werden.
Wenn der Parameter Teilungstyp auf Zufällige Teilung oder auf Räumliche Teilung festgelegt ist, dann können die Ausgabe-Test-Features zum Auswerten der Modellgenauigkeit mit dem Werkzeug Mit Modelldatei für räumliche Statistiken vorhersagen verwendet werden. Stellen Sie sicher, dass beim Ausführen des ausgewählten Analysewerkzeugs die Ausgabe eine Modelldatei für räumliche Statistiken ist.
Wenn der Parameter Teilungstyp auf Zufällige Teilung oder auf Räumliche Teilung festgelegt ist, dann wird durch das Werkzeug sichergestellt, dass in den Ausgabe-Trainings-Features alle Kategorieebenen der vorherzusagenden Variable und aller erklärenden Variablen vorhanden sind. Im Test-Dataset muss nicht jede Kategorieebene vorhanden sein.
Parameter
| Beschriftung | Erläuterung | Datentyp |
|---|---|---|
|
Eingabe-Features |
Die Features, an denen das Teilen, Extrahieren und Ausgleichen durchgeführt werden soll. |
Feature Class |
|
Ausgabe-Features |
Die Ausgabe-Features, die als Trainings-Features in einem Modellwerkzeug verwendet werden sollen. |
Feature Class |
|
Teilungstyp (Optional) |
Gibt die Methode an, die zum Aufteilen der Eingabe-Features in Trainings- und Testteilmengen verwendet werden soll.
|
String |
|
Ausgabe-Testteilmengen-Features (Optional) |
Eine Testteilmenge des Wertes des Parameters Eingabe-Features, die als Test-Features verwendet werden kann. Dieser Parameter ist verfügbar, wenn der Parameter Teilungstyp auf Zufällige Teilung oder auf Räumliche Teilung festgelegt ist. |
Feature Class |
|
Vorherzusagende Variable (Optional) |
Die Variable aus dem Wert des Parameters Eingabe-Features, die die Werte enthält, die zum Trainieren eines Modells verwendet werden sollen. Dieses Feld enthält bekannte (Trainings-)Werte der Variablen, mit denen eine Vorhersage an unbekannten Positionen getroffen wird. |
Field |
|
Variable als kategorisch behandeln (Optional) |
Gibt an, ob der Wert des Parameters Vorherzusagende Variable als kategoriale Variable behandelt wird.
|
Boolean |
|
Erklärende Variablen (Optional) |
Eine Liste der Felder, die erklärende Variablen darstellen und die Vorhersage des Wertes oder der Kategorie des Wertes des Parameters Vorherzusagende Variable unterstützen. Aktivieren Sie das Kontrollkästchen Kategorial für alle Variablen, die Klassen oder Kategorien darstellen (z. B. Landbedeckung oder Anwesenheit oder Abwesenheit). Spalten der Wertetabelle:
|
Value Table |
|
Erklärende Entfernungs-Features (Optional) |
Die erklärenden Trainings-Entfernungs-Features. Erklärende Variablen werden automatisch durch Berechnung einer Entfernung zwischen den bereitgestellten Features und den Werten des Parameters Eingabe-Features erstellt. Entfernungen werden von den einzelnen Features im Wert des Parameters Eingabe-Features zum nächsten Feature in diesem Parameter berechnet. Wenn die Werte dieses Parameters Polygone oder Linien sind, dann werden die Entfernungsattribute als Entfernung zwischen den nächstgelegenen Segmenten des Feature-Paares berechnet. |
Feature Layer |
|
Erklärende Raster (Optional) |
Die aus Rastern extrahierten erklärenden Trainingsvariablen. Erklärende Trainingsvariablen werden automatisch durch Extrahieren von Raster-Zellenwerten erstellt. Für jedes Feature im Wert des Parameters Eingabe-Features wird der Wert der Raster-Zelle an genau dieser Position extrahiert. Beim Extrahieren des Raster-Werts für kontinuierliche Raster wird bilineares Resampling verwendet. Beim Extrahieren eines Raster-Werts aus kategorialen Rastern wird ein Nächster-Nachbar-Resampling durchgeführt. Aktivieren Sie das Kontrollkästchen Kategorial für alle Raster, die Klassen oder Kategorien darstellen, z. B. Landbedeckung oder Anwesenheit oder Abwesenheit. Spalten der Wertetabelle:
|
Value Table |
|
Polygone für Training in Raster-Auflösung konvertieren (Optional) |
Gibt an, wie Polygone behandelt werden sollen, wenn die Werte des Parameters Eingabe-Features Polygone mit einem kategorialen Wert für den Parameter Vorherzusagende Variable sind und nur Werte für den Parameter Erklärende Raster angegeben wurden.
|
Boolean |
|
Prozentsatz der Daten als Testteilmenge (Optional) |
Der Prozentsatz der Eingabe-Features, die als Test- oder Validierungs-Dataset reserviert werden sollen. Die Standardeinstellung ist 10. |
Double |
|
Ausgleichstyp (Optional) |
Gibt die Methode an, die zum Ausgleichen der unausgeglichenen Werte des Parameters Vorherzusagende Variable oder der räumlichen Verzerrung der Eingabe-Features verwendet werden soll. Die Ausgleichsmethode wird nur auf den Wert des Parameters Ausgabe-Features angewendet.
|
String |
|
Minimale Entfernung zum nächsten Nachbarn (Optional) |
Die minimale Entfernung zwischen zwei beliebigen Punkten oder zwei beliebigen Punkten derselben Kategorie des Wertes des Parameters Vorherzusagende Variable, wenn die räumliche Ausdünnung angewendet wird. |
Linear Unit |
|
Anzahl der Iterationen für die Ausdünnung (Optional) |
Die Anzahl der Iterationen, mit denen die optimale räumliche Ausdünnung erzielt werden soll. Dabei wird versucht, möglichst viele Features beizubehalten und dabei sicherzustellen, dass sich keine zwei Features innerhalb der Entfernung befinden, die im Wert des Parameters Minimale Entfernung zum nächsten Nachbarn angegeben ist. Die minimale Anzahl der Iterationen beträgt 1, und die maximale Anzahl beträgt 50. Die Standardeinstellung ist 10. |
Long |
|
Kategoriale erklärende Variablen codieren (Optional) |
Gibt an, ob die kategorialen erklärenden Variablen codiert werden sollen.
|
Boolean |
|
Alle Felder aus den Eingabe-Features anhängen (Optional) |
Gibt an, ob alle Felder aus den Eingabe-Features in die Ausgabe-Features kopiert werden sollen.
|
Boolean |
Umgebungen
Zellengröße, Ausgabe-Koordinatensystem, Zufallszahlengenerator
Lizenzierungsinformationen
- Basic: Eingeschränkt
Spatial Analyst ist erforderlich, um Raster zu verwenden. - Standard: Eingeschränkt
Spatial Analyst ist erforderlich, um Raster zu verwenden. - Advanced: Eingeschränkt
Spatial Analyst ist erforderlich, um Raster zu verwenden.
Verwandte Themen
- Überblick über das Toolset "Modellierung von räumlichen Beziehungen"
- Auswerten von Vorhersagen mit Kreuzvalidierung
- Forest-basierte und geboostete Klassifizierung und Regression
- Generalisierte lineare Regression
- Auf Vorhandensein beschränkte Vorhersage (MaxEnt)
- Funktionsweise des Werkzeugs "Vorhersagen mit Kreuzvalidierung auswerten"
- Funktionsweise des Werkzeugs "Daten für die Vorhersage vorbereiten"
- Suchen eines Geoverarbeitungswerkzeugs