Skip to main content

Найти кластеры точек (Инструменты GeoAnalytics Server)

Краткая информация

Находит кластеры точечных объектов в окружающем шуме, на основе пространственного или пространственно-временного распределения.

Прежние версии:

Расширение ArcGIS GeoAnalytics Server устаревает в ArcGIS Enterprise. Финальный релиз of GeoAnalytics Server был включен в состав ArcGIS Enterprise 11.3. Этот инструмент геообработки доступен в ArcGIS Enterprise 11.3 и более ранних версиях.

Более подробно о работе инструмента Кластеризация на основе плотности

Иллюстрация

![Иллюстрация работы инструмента Поиск кластеров точек] (images/DBclustering-A8F16.png)

Использование

  • Этот инструмент геообработки доступен с ArcGIS Enterprise 10.6.1 или более поздними версиями.

  • В инструменте Поиск кластеров точек используется один входной точечный слой. Этот инструмент извлекает кластеры из Входного точечного слоя и определяет окружающий шум.

  • Для инструмента Поиск кластеров точек необходим Входной точечный слой в системе координат проекции или выходная система координат должна быть установленп на [система координат проекции] (../../help/mapping/properties/coordinate-systems-and-projections.md).

  • У параметра Метод кластеризации есть две опции. Заданное расстояние (DBSCAN) использует алгоритм DBSCAN и находит кластеры точек, расположенные в непосредственной близости, на основе заданного расстояния поиска. Автонастройка (HDBSCAN) использует алгоритм HDBSCAN (доступен с ArcGIS Enterprise 10.7 и более поздними версиями) и находит кластеры точек, аналогично DBSCAN, используя различные расстояния, позволяя создавать кластеры с разной плотностью в зависимости от вероятности (или стабильности). Если выбран DBSCAN, кластеры могут быть найдены либо только в двумерном пространстве, либо и в пространстве, и во времени. Если вы установите отметку Использовать время для поиска кластеров, а входной слой имеет включенное время и тип Мгновенный, DBSCAN обнаружит пространственно-временные кластеры точек, находящихся в непосредственной близости, на основе заданного расстояния поиска и продолжительности поиска (поддерживается в ArcGIS Enterprise 10.8 и более новых версиях).

  • Параметр Минимальное число объектов на кластер используется по-разному, в зависимости от выбранного метода кластеризации:

    • Заданное расстояние (DBSCAN) —задает число объектов, которое должно быть найдено в пределах диапазона поиска от точки, с которой начинается формирование кластера. В результатах могут встречаться кластеры с меньшим числом объектов, чем задано этим значением. Расстояние поиска настраивается в параметре Расстояние поиска. При использовании времени для поиска кластеров требуется Длительность поиска. При поиске участников кластера, Минимальное количество объектов на кластер должно быть найдено в пределах Расстояния поиска и Длительности поиска для формирования кластера. Обратите внимание, что это расстояние и длительность не связаны с диаметром или временным экстентом обнаруженных кластеров точек.

    • Автонастройка (HDBSCAN) —задает число объектов, окружающих каждую точку (включая саму точку), которые будут учитываться при оценке плотности. Это число также соответствует минимальному размеру кластера, размешенному при извлечении кластеров.

  • Этот инструмент создает выходной класс объектов с новым целочисленным полем, CLUSTER_ID, где обозначается принадлежность объектов кластерам. Отображение по умолчанию основано на поле COLOR_ID. Разным кластерам присваиваются различные цвета. Цвета распределяются и повторяются таким образом, что каждый кластер визуально отличается от соседних.

  • Если для обнаружения пространственно-временных кластеров используется метод кластеризации Заданное расстояние (HDBSCAN), в результаты также будут включены следующие поля:

    • FEAT_TIME —Оригинальное мгновенное время каждого объекта.

    • START_DATETIME—Время начала экстента времени кластера, которому принадлежит объект.

    • END_DATETIME—Время окончания экстента времени кластера, которому принадлежит объект.

    Свойства времени результирующего слоя будет установлено как интервал в полях START_DATETIME и END_DATETIME, гарантируя, что все элементы кластера объединяются при визуализации пространственно-временных кластеров с помощью бегунка времени. Эти поля используются только для визуализации. Для шумовых объектов START_DATETIME и END_DATETIME будут равны FEAT_TIME.

  • Если Методом кластеризации является Автонастройка (HDBSCAN), выходной класс объектов будет содержать следующие поля:

    • PROB—Вероятность принадлежности объекта к назначенному ему кластеру.

    • OUTLIER—Вероятность того, что объект является выбросом со своим собственным кластером. Более значение означает большую вероятность выброса.

    • EXEMPLAR—Объекты, наиболее характерные для каждого кластера. Такие объекты обозначаются значением 1.

    • STABILITY—Присутствие каждого кластера в диапазоне масштабов. Большее значение указывает на то, что кластер сохраняется в более широком диапазоне масштабов расстояний.

  • При использовании алгоритма HDBSCAN со слоем, содержащим более 3 миллионов объектов, может произойти сбой, если администратор не увеличил значение параметра javaHeapSize в [GeoAnalyticsTools GP Service] (https://developers.arcgis.com/rest/enterprise-administration/server/editservice.htm). Для 3 миллионов объектов требуется около 2 ГБ свободного пространства. Объем оперативной памяти, указанный в javaHeapSize, должен быть доступен на каждом компьютере GeoAnalytics Server в дополнение к 16 ГБ, которые обычно требуются для GeoAnalytics Server. Например, если необходимо кластеризовать 9 миллионов объектов методом HDBSCAN, задайте javaHeapSize на не менее 6144 МБ, или 6 ГБ. В этом случае, каждый компьютер GeoAnalytics Server должен иметь не менее 22 ГБ доступной RAM.

  • Вы можете повысить производительность инструмента Поиск кластеров точек, выполнив одно или несколько из следующих действий:

    • Установите параметр среды экстента таким образом, чтобы анализировались только интересующие вас данные.

    • Будьте избирательны при выборе расстояния поиска и продолжительности. Меньшее расстояние поиска или радиус может работать лучше на тех же данных.

    • Используйте локальные данные, относительно места выполнения анализа.

  • Этот инструмент геообработки работает на ArcGIS GeoAnalytics Server. Анализ выполняется на GeoAnalytics Server, а результаты сохраняются в ресурсах ArcGIS Enterprise.

  • При запуске инструментов GeoAnalytics Server анализ выполняется на GeoAnalytics Server. Для оптимальной производительности предоставьте данные GeoAnalytics Server через векторные слои, размещенные на вашем портале ArcGIS Enterprise, или через общие ресурсы файлов больших данных. Данные, которые не находятся локально на GeoAnalytics Server, будут перемещены на GeoAnalytics Server перед началом анализа. Это означает, что выполнение инструмента займет больше времени, и в некоторых случаях перемещение данных из ArcGIS Pro на GeoAnalytics Server может завершиться с ошибкой. Порог сбоя зависит от скорости сети, а также от размера и сложности данных. Рекомендуется всегда публиковать данные или создавать файловое хранилище больших данных.

    Более подробно о публикации локаторов на портале

    [Узнайте больше о создании совместного файла больших данных через Server Manager

Параметры

Подпись Объяснение Тип данных

Входной точечный слой

Класс точечных объектов, содержащий кластеры точек.

Feature Set

Выходное имя

Имя выходного сервиса пространственных объектов.

String

Минимальное число объектов на кластер

Этот параметр используется по-разному в зависимости от выбранного метода кластеризации следующим образом:

  • Заданное расстояние (DBSCAN) – определяет число объектов, которое должно быть найдено в пределах указанного расстояния от точки, с которой начинается формирование кластера. Расстояние задается с использованием параметра Расстояние поиска.

  • Автонастройка (HDBSCAN) —задает число объектов, окружающих каждую точку (включая саму точку), которые будут учитываться при оценке плотности. Это число также соответствует минимальному размеру кластера, размешенному при извлечении кластеров.

Long

Расстояние поиска

Максимальное расстояние, которое будет учитываться.

Заданное значение Минимальное число объектов на кластер должно быть найдено в пределах этого расстояния, чтобы отнести объекты к кластеру. Отдельные кластеры будут разделяться, как минимум, этим расстоянием. Если объект расположен дальше, чем это расстояние, от следующего ближайшего объекта в кластере, он не будет включен в кластер.

Linear Unit

Хранилище данных

(Дополнительный)

Задает хранилище ArcGIS Data Store, в котором будут храниться выходные данные. Все результаты, находящиеся в хранилище пространственно-временных больших данных, будут храниться в системе WGS84. Результаты в реляционном хранилище данных сохраняют свои систему координат.

  • Хранилище пространственно-временных больших данныхРезультаты будут храниться в хранилище больших пространственно-временных данных. Используется по умолчанию.

  • Реляционное хранилище данныхРезультаты будут храниться в хранилище реляционных данных.

String

Метод кластеризации

(Дополнительный)

Задает метод, который будет использован для определения кластеров.

  • Заданное расстояние (DBSCAN)Использует указанное расстояние для отделения плотных кластеров от окружающего шума. DBSCAN является наиболее быстрым методом кластеризации, но подходит только при наличии четкого расстояния, что хорошо подходит для поиска всех представленных кластеров. Это приводит к получению кластеров с похожей плотностью. Используется по умолчанию.

  • Автонастройка (HDBSCAN)Использует различные расстояния для отделения кластеров с различными плотностями от окружающего шума. HDBSCAN является наиболее ориентированным на данные методом кластеризации для него требуется минимум участия пользователя.

String

Использование времени для поиска кластеров

(Дополнительный)

Определяет, будет ли использоваться время для выявления кластеров с использованием DBSCAN.

  • ОтмеченоПространственно-временные кластеры будут найдены с использованием расстояния поиска и длительности поиска.

  • Не отмеченоПространственные кластеры будут найдены с использованием расстояния поиска, и время будет игнорироваться. Используется по умолчанию.

Boolean

Длительность поиска

(Дополнительный)

При поиске участников кластера заданное минимальное количество точек должно быть найдено в течение этой длительности времени, чтобы сформировать кластер.

Time Unit

Производные выходные данные

Подпись Объяснение Тип данных

Выходной векторный слой

Выходные кластеры точек.

Feature Set

Параметры среды

Выходная система координат, Экстент, Текущая рабочая область

Особые случаи

Выходная система координат

The coordinate system that will be used for analysis. Analysis will be completed in the input coordinate system unless specified by this parameter. For GeoAnalytics Tools, final results will be stored in the spatiotemporal data store in WGS84.

Информация о лицензировании

  • Basic: Требуется ArcGIS GeoAnalytics Server
    Доступно с ArcGIS Enterprise 10.6.1
  • Standard: Требуется ArcGIS GeoAnalytics Server
    Доступно с ArcGIS Enterprise 10.6.1
  • Advanced: Требуется ArcGIS GeoAnalytics Server
    Доступно с ArcGIS Enterprise 10.6.1