Подготовка данных для прогноза (Инструменты Пространственная статистика)
Краткая информация
Улучшает данные для рабочих процессов прогнозирования в инструментах Классификация на основе леса и регрессия, регрессия с бустингом, Обобщенная линейная регрессия и Прогнозирование только присутствия, а так же для других моделей. Это включает в себя разделение объектов на обучающие и тестовые наборы, извлечение переменных из растров и объектов расстояния, балансировку данных для повышения точности классификации и выполнение пространственного прореживания для пространственных данных со смещением.
Более подробно о том, как работает Подготовка данных для прогноза
Иллюстрация

Использование
Обучающие данные, к которым применялась балансировка, должны использоваться только для обучения моделей прогнозирования. Модели не должны проверяться на сбалансированных данных, чтобы избежать ошибок в точности и утечки данных.
Для использования растров в качестве независимых переменных необходима лицензия дополнительного модуля Spatial Analyst.
Если вы используете классификацию для прогнозирования редких событий или несбалансированных категорий, используйте параметр Тип балансировки, чтобы сбалансировать число выборок в пределах каждого категориального уровня. Методы избыточной выборки увеличат общее число объектов, а методы недостаточной выборки понизят число объектов.
Если параметр Тип разбиения установлен на Произвольное разбиение или Пространственное разбиение, выходные тестовые объекты можно использовать для оценки точности модели с помощью инструмента Прогнозировать, используя файл модели пространственной статистики. Убедитесь, что в качестве выходных данных указан файл модели пространственной статистики, перед тем как запускать выбранный инструмент анализа.
Если параметр Тип разбиения установлен на Произвольное разбиение или Пространственное разбиение, инструмент проверит, что все категориальные уровни как в переменной для прогнозирования, так и в независимых переменных будут представлены в выходных обучающих объектах. В тестовых наборах данных не обязательно должны присутствовать все категориальные уровни.
Параметры
| Подпись | Объяснение | Тип данных |
|---|---|---|
|
Входные объекты |
Объекты, к которым будет применено разбиение, извлечение или балансировка. |
Feature Class |
|
Выходные объекты |
Выходные объекты которые будут использоваться как обучающие объекты в инструменте модели. |
Feature Class |
|
Тип разбиения (Дополнительный) |
Определяет метод, который будет использоваться для разделения входных объектов на обучающие и тестовые поднаборы.
|
String |
|
Выходной тестовый поднабор объектов (Дополнительный) |
Поднабор параметра Входные объекты будет использован в качестве тестовых объектов. Этот параметр доступен, если Тип разбиения установлен на Произвольное разбиение или Пространственное разбиение. |
Feature Class |
|
Переменная для прогнозирования (Дополнительный) |
Переменная из параметра Входные объекты, содержащая значения, используемые для обучения модели. Это поле содержит известные (обучающие) значения переменной, которые будут использованы для прогнозирования в неизвестных местоположениях. |
Field |
|
Рассматривать переменную как Категориальную (Дополнительный) |
Определяет, будет ли значение параметра Переменная для прогнозирования интерпретироваться как категорийная переменная.
|
Boolean |
|
Независимые переменные (Дополнительный) |
Список полей, представляющих независимые переменные, которые помогут прогнозировать значения или категории для параметра Переменная для прогнозирования. Включите опцию Категориальная для любых переменных, которые представляют классы или категории (например, наземный покров – его наличие или отсутствие). Столбцы таблицы значений:
|
Value Table |
|
Независимые объекты расстояния (Дополнительный) |
Независимые объекты расстояния обучения. Независимые переменные будут созданы автоматически, путем вычисления расстояния от предоставленных объектов до Входных объектов. Расстояния будут вычислены от каждого из объектов набора, указанного в параметре Входные объекты до ближайшего объекта из этого набора. Если входные объекты являются полигонами или линиями, атрибуты расстояния вычисляются как расстояние между ближайшими сегментами пары объектов. |
Feature Layer |
|
Независимые растры (Дополнительный) |
Независимые переменные обучения, извлеченные из растров. Независимые переменные обучения будут автоматически созданы путем извлечения значений ячеек растра. Для каждого из Входных объектов значение ячейки растра извлекается в именно в этом местоположении. Билинейный пересчет растра используется, если значение растра извлекается из непрерывных растров. Метод ближайшего соседа используется, если значение растра извлекается из категориальных растров. Включите опцию Категориальная для любых переменных, которые представляют классы или категории например, наземный покров или наличие и отсутствие какого-либо явления. Столбцы таблицы значений:
|
Value Table |
|
Конвертировать полигоны в разрешение растра для обучения (Дополнительный) |
Определяет то, как полигоны будут рассматриваться, если Входные объекты являются полигонами с категориальной Переменной для прогнозирования, и заданы только Независимые растры.
|
Boolean |
|
Процент данных как тестовый поднабор (Дополнительный) |
Процент входных объектов, которые будут сохранены как тестовый или проверочный набор данных. Значение по умолчанию равно 10. |
Double |
|
Тип балансировки (Дополнительный) |
Определяет метод, который будет использоваться для балансировки несбалансированного значения параметра Переменная для прогнозирования или для пространственного смещения входных данных. Метод балансировки применим только к параметру Выходные объекты.
|
String |
|
Минимальное расстояние ближайшего соседства (Дополнительный) |
Минимальное расстояние между двумя любыми точками присутствия или двумя любыми точками в одной и той же категории параметра Переменной для прогнозирования, если применено пространственное прореживание. |
Linear Unit |
|
Число итераций прореживания (Дополнительный) |
Число итераций, которое будет использовано для поиска оптимального решения пространственного прореживания, с поддержанием минимального возможного числа объектов, с тем, чтобы не было двух объектов в пределах Минимального расстояния ближайшей окрестности. Минимальное число итераций - 1, а максимальное - 50. Значение по умолчанию равно 10. |
Long |
|
Кодировать категориальную независимую переменную (Дополнительный) |
Определяет, будет ли кодирована категориальная независимая переменная.
|
Boolean |
|
Присоединить все поля из входных объектов (Дополнительный) |
Указывает, будут ли все поля скопированы из входных пространственных объектов в выходные объекты.
|
Boolean |
Параметры среды
Размер ячейки, Выходная система координат, Генератор случайных чисел
Информация о лицензировании
- Basic: Ограниченные
Для использования растров необходим Spatial Analyst - Standard: Ограниченные
Для использования растров необходим Spatial Analyst - Advanced: Ограниченные
Для использования растров необходим Spatial Analyst
Связанные разделы
- Обзор группы инструментов Моделирование пространственных отношений
- Оценка прогнозов Перекрестной проверкой
- Классификация на основе леса и регрессия, регрессия с бустингом
- Обобщенная линейная регрессия
- Прогноз только присутствия (MaxEnt)
- Как работает Оценка прогнозов перекрестной проверкой
- Как работает Подготовка данных для прогноза
- Поиск инструмента геообработки