Прогнозирование регрессии ЭБК (Инструменты Geostatistical Analyst)
Краткая информация
Прогнозирование регрессии ЭБК – это метод геостатистической интерполяции, который использует Эмпирический байесовский кригинг с растрами независимых переменных, которые будут оказывать влияние на значения данных, которые вы интерполируете. В этом подходе объединены методы кригинга и регрессионного анализа для выполнения прогнозов, которые будут более точными, чем результаты регрессионного анализа или кригинга по отдельности.
Использование
В качестве выходных данных инструмент поддерживает только карты прогнозированных значений. Для создания карт стандартной ошибки прогнозирования, карт квантилей или карт вероятности нужно создать геостатистический слой и сконвертировать его в растр (или несколько растров) с помощью инструмента Слой GA в растры.
Этот метод кригинга пригоден для обработки умеренно нестационарных входных данных.
С этим методом интерполяции могут использоваться только Стандартная круговая и Сглаженная круговая окрестностей поиска.
Если в каком-то из Входных растров независимых переменных имеется много пустых ячеек (NoData), то Выходной геостатистический слой может не отобразиться на карте. Это не является проблемой; все расчеты были произведены корректно. Для визуализации выходных данных сконвертируйте ваш геостатистический слой в растр с помощью инструмента Слой GA в растры или Слой GA в грид. Вы также можете выбрать выходной растр из этого инструмента напрямую с помощью параметра Выходной растр прогнозирования.
Если Входные объекты зависимой переменной определены в географической системе координат, то все расчеты расстояний будут производиться с помощью хордовых расстояний. Для получения более подробных сведений о хордовых расстояниях, см. раздел Вычисление расстояний для данных в географических системах координат в главе справки Что такое эмпирический байесовский кригинг.
Параметры
| Подпись | Объяснение | Тип данных |
|---|---|---|
|
Входные объекты зависимой переменной |
Входные точечные объекты, содержащие поле, значения которого будут проинтерполированы. |
Feature Layer |
|
Поле зависимой переменной |
Поле входных объектов, содержащее значения зависимой переменной. Это поле, значения которого будут проинтерполированы. |
Field |
|
Входные растры независимой переменной |
Входные растры, представляющие независимые переменные, которые будут использованы для создания регрессионной модели. Эти растры должны представлять те переменные, о влиянии которых на значения зависимой переменной вам известно. Например, при интерполяции данных температур в качестве независимой переменной можно использовать растр высот, поскольку значения температуры зависят от высоты местности. Можно использовать до 62 независимых растров. |
Raster Layer; Mosaic Layer |
|
Выходной геостатистический слой |
Выходной геостатистический слой, отображающий результат интерполяции. |
Geostatistical Layer |
|
Выходной растр прогнозирования (Дополнительный) |
Выходной растр, отображающий результат интерполяции. По умолчанию в качестве размера ячейки используется максимальный размер ячеек параметра растра независимых переменных. Чтобы использовать другой размер ячеек, используйте настройку среды размер ячейки. |
Raster Dataset |
|
Выходной класс объектов диагностики (Дополнительный) |
Выходной полигональный класс объектов, который отображает регионы каждой локальной модели и содержит поля с тестовой информацией для локальных моделей. Для каждого поднабора будет создан полигон, который окружает точки в этом поднаборе, чтобы вы могли определить, какие точки были использованы в каждом из поднаборов. Например, если имеется 10 локальных моделей, то будет создано десять выходных полигонов. Класс объектов будет иметь следующие поля:
|
Feature Class |
|
Поле ошибки измерений зависимой переменной (Дополнительный) |
Поле, в котором устанавливается погрешность измерения для каждой точки в объектах зависимой переменной. Для каждой точки значение этого поля должно соответствовать одному стандартному отклонению измеренного значения точки. Используйте это поле, если значения погрешности измерений в каждой точке различаются. Наиболее распространенным источником неустойчивой погрешности измерений является проведение измерений данных разными, отличающимися один от другого измерительными устройствами. У более точных устройств погрешность измерения будет меньше. Например, один термометр округляет значение до ближайшего градуса, а другой — до ближайшей десятой доли градуса. Точность и разброс показаний измерений указывается производителем измерительного устройства; кроме того, эти величины могут быть получены эмпирическим путем. Оставьте этот параметр пустым, если погрешности измерений не наблюдаются, или их значения неизвестны. |
Field |
|
Минимальный совокупный процент дисперсии (Дополнительный) |
Определяет минимальный совокупный процент дисперсии для главных компонент растров независимой переменной. Перед созданием регрессионной модели производится расчет главных компонент независимых переменных, и эти главные компоненты используются в качестве независимых переменных в регрессии. Каждая главная компонента хранит определенный процент дисперсии независимых переменных, и этот параметр определяет, какое минимальное значение процента дисперсии должно быть получено главной компонентой каждой модели. Например, если указано значение 75, то программное обеспечение будет использовать минимальное количество главных компонент, которое необходимо для получения 75% дисперсии независимых переменных. Все главные компоненты не коррелируют друг с другом, поэтому при использовании главных компонент решается проблема мультиколлинеарности (независимые переменные, которые коррелируют друг с другом). Большую часть информации, хранимой в независимых переменных, можно довольно часто зарегистрировать всего в нескольких главных компонентах. Исключив наименее полезные главные компоненты, процесс расчета модели становится более устойчивым без значительной потери точности. Для вычисления главных компонент должна присутствовать вариабельность независимых переменных, поэтому если любой из растров независимой переменной содержат постоянные значения в поднаборе, эти растры констант не будут использоваться для вычисления главных компонентов у этого поднабора. Если все растры независимой переменной в поднаборе содержат постоянные значения, выходной класс объектов диагностики сообщит, что было использовано ноль главных компонентов и получена вариабельность ноль процентов. |
Double |
|
Поднабор полигональных объектов (Дополнительный) |
Полигональные объекты, определяющие места расчета локальных моделей. Для локальных моделей будут использоваться точки внутри каждого полигона. Этот параметр полезен в тех случаях, когда известно, что значения зависимых переменных изменяются в известных регионах. Например, эти полигоны могут представлять административные участки мед. обслуживания, когда в различных участках действуют разные условия мед. обслуживания. Вы также можете использовать инструмент Generate Subset Polygons для создания полигонов поднабора. Полигоны, создаваемые этим инструментом, будут неперекрывающимися и компактными. |
Feature Layer |
|
Тип преобразования зависимой переменной (Дополнительный) |
Тип преобразования, применяемый к входным данным.
|
String |
|
Тип модели вариограммы (Дополнительный) |
Модель вариограммы, которая будет использована для интерполяции.
|
String |
|
Максимальное число точек в каждой локальной модели (Дополнительный) |
Входные данные будут автоматически разделены на группы, не содержащие больше заданного количества точек. Если используется поднабор полигональных объектов, значение этого параметра игнорируется. |
Long |
|
Коэффициент перекрытия областей локальной модели (Дополнительный) |
Коэффициент, который представляет уровень перекрытия между локальными моделями (также называемыми поднаборами). Каждая входная точка может попадать в несколько поднаборов, и коэффициент перекрытия определяет среднее число поднаборов, в которые попадает каждая точка. Высокое значение коэффициента перекрытия позволяет сгладить выходную поверхность, но при этом увеличивает время обработки. Значения должны быть в диапазоне от 1 до 5. Если используется поднабор полигональных объектов, значение этого параметра игнорируется. |
Double |
|
Число моделирований (Дополнительный) |
Число моделируемых вариограмм для каждой локальной модели. При использовании нескольких симуляций расчеты модели будут более стабильными, но для ее расчета потребуется больше времени. |
Long |
|
Окрестность поиска (Дополнительный) |
Определяет, какие точки будут использованы для управления выходными данными. Стандартная - значение по умолчанию. Стандартная окружность
Сглаженная окружность
|
Geostatistical Search Neighborhood |
Параметры среды
Размер ячейки, Совпадающие точки, Текущая рабочая область, Экстент, Географические преобразования, Маска, Выходная система координат, Коэффициент параллельной обработки, Временная рабочая область, Растр привязки
Информация о лицензировании
- Basic: Требуется Geostatistical Analyst
- Standard: Требуется Geostatistical Analyst
- Advanced: Требуется Geostatistical Analyst