Buscar clústeres de puntos (Herramientas de GeoAnalytics Desktop)
Resumen
Busca clústeres de entidades de puntos dentro del ruido colindante en función de su distribución espacial o espaciotemporal.
Más información sobre cómo funciona Clustering basado en densidad
Ilustración

Uso
La entrada de Buscar clústeres de puntos es una capa de puntos. Esta herramienta extrae clústeres del valor del parámetro Capa de puntos de entrada e identifica cualquier ruido colindante.
Buscar agrupaciones de puntos requiere que la Capa de puntos de entrada esté proyectada o que el sistema de coordenadas de salida esté configurado como un sistema de coordenadas proyectado.
Existen dos opciones para el parámetro Método de clustering. Distancia definida (DBSCAN) utiliza el algoritmo DBSCAN y busca clústeres de puntos que estén muy próximos en función de una distancia de búsqueda especificada. Autoajuste (HDBSCAN) utiliza el algoritmo HDBSCAN y busca clústeres de puntos de forma similar a DBSCAN, utilizando distancias variables teniendo en cuenta los clústeres con densidades variables en función de la probabilidad (o estabilidad) de clúster. Si elige DBSCAN, encontrará clústeres solo en espacio bidimensional o en espacio y tiempo. Si selecciona Utilizar hora para buscar clústeres y la capa de entrada tiene el tiempo habilitado y es del tipo de instante, DBSCAN descubrirá clústeres espaciotemporales de puntos que estén muy próximos en función de una distancia de búsqueda y una duración de búsqueda especificadas.
El parámetro Entidades mínimas por clúster se utiliza de manera diferente en función del método de clustering:
Distancia definida (DBSCAN): Especifica el número de entidades que se deben encontrar dentro de una distancia de búsqueda determinada de un punto para que este pueda empezar a formar un clúster. Los resultados podrían incluir clústeres con menos entidades que este valor. La distancia de búsqueda se define con el parámetro Distancia de búsqueda. Al utilizar el tiempo para encontrar clústeres, se requiere Duración de búsqueda. Al buscar miembros de un clúster, las Entidades mínimas por clúster debe encontrarse dentro de la Distancia de búsqueda y la Duración de búsqueda para formar un clúster. Tenga en cuenta que esta distancia y duración no están relacionadas con el diámetro o la extensión temporal de los clústeres de puntos descubiertos.
Autoajuste (HDBSCAN): Especifica el número de entidades vecinas de cada punto (incluido el punto) que se tendrán en cuenta a la hora de estimar la densidad. Este número es además el tamaño de clúster mínimo permitido al extraer los clústeres.
Esta herramienta genera una clase de entidad de salida con un nuevo campo de tipo entero,
CLUSTER_ID, que identifica el grupo en el que se encuentra cada entidad. La representación en pantalla predeterminada se basa en el campoCOLOR_ID. Si hay varios clústeres, se asigna un color a cada uno. Los colores se asignarán y repetirán de forma que cada clúster sea visualmente diferente de sus clústeres vecinos.Si usa el método de clustering Distancia definida (DBSCAN) con el tiempo para descubrir clústeres espaciotemporales, los resultados también incluirán estos campos:
FEAT_TIME: El tiempo de instante original de cada entidad.START_DATETIME—La hora de inicio de la extensión temporal del clúster al que pertenece una entidad.END_DATETIME—La hora de finalización de la extensión temporal del clúster al que pertenece una entidad.
Las propiedades de tiempo de la capa de resultados se definirá como un intervalo en los campos
START_DATETIMEyEND_DATETIME, lo cual garantiza que todos los miembros del clúster se dibujen juntos al visualizar clústeres espaciotemporales en un control deslizante de tiempo. Estos campos se utilizan únicamente para la visualización. En el caso de las entidades de ruido,START_DATETIMEyEND_DATETIMEequivaldrán aFEAT_TIME.Si Método de clustering es Autoajustable (HDBSCAN), la clase de entidad de salida también contendrá los siguientes campos:
PROB—La probabilidad de que una entidad pertenezca a su clúster asignado.OUTLIER—La posibilidad de que una entidad sea un valor atípico dentro de su propio clúster. Un valor más alto indica que es más probable que la entidad sea un valor atípico.EXEMPLAR—Las entidades más representativas de cada clúster. Estas entidades se indican con un valor de 1.STABILITY—La persistencia de cada clúster en un rango de escalas. Un valor mayor indica que un clúster persiste en un rango más amplio de escalas de distancia.
Puede mejorar el rendimiento de la herramienta Buscar clústeres de puntos aplicando uno o varios de los consejos siguientes:
Defina el entorno de extensión para analizar únicamente datos de interés.
Sea selectivo en cuanto a la distancia y la duración de la búsqueda. Es posible que una distancia o un radio de búsqueda más reducidos ofrezcan mejores resultados con los mismos datos.
Utilice datos locales en los que se ejecute el análisis.
Esta herramienta de geoprocesamiento se basa en Spark. El análisis se completa en su equipo de escritorio utilizando varios núcleos en paralelo. Consulte Consideraciones acerca de las herramientas de GeoAnalytics Desktop para obtener más información acerca de la ejecución de análisis.
Al ejecutar herramientas de GeoAnalytics Desktop, el análisis se completa en su equipo de escritorio. Para un rendimiento óptimo, los datos deben estar disponibles en su escritorio. Si utiliza una capa de entidades alojada, se recomienda utilizar ArcGIS GeoAnalytics Server. Si sus datos no están almacenados localmente, se tardará más tiempo en ejecutar una herramienta. Para utilizar su servidor ArcGIS GeoAnalytics Server con el fin de realizar análisis, consulte GeoAnalytics Tools.
Parámetros
| Etiqueta | Explicación | Tipo de datos |
|---|---|---|
|
Capa de puntos de entrada |
La clase de entidad de punto que contiene los clústeres de puntos. |
Feature Layer |
|
Clase de entidad de salida |
Una clase de entidad nueva con los clústeres de puntos resultantes. |
Feature Class |
|
Método de clustering |
Especifica el método que se utilizará para definir clústeres.
|
String |
|
Entidades mínimas por clúster |
Este parámetro se utiliza de forma diferente según el método de clustering elegido, como se indica a continuación:
|
Long |
|
Distancia de búsqueda |
La distancia máxima que se considerará. El valor de Entidades mínimas por clúster especificado se deberá encontrar dentro de esta distancia para que pertenezcan a un clúster. Los clústeres individuales estarán separados, al menos, por esta distancia. Si una entidad se encuentra a una distancia mayor que esta respecto de la siguiente entidad más cercana en el clúster, no se incluirá en el clúster. |
Linear Unit |
|
Utilizar hora para buscar clústeres (Opcional) |
Especifica si se utilizará o no el tiempo para detectar clústeres con DBSCAN.
|
Boolean |
|
Duración de búsqueda (Opcional) |
Al buscar miembros de clústeres, la cantidad mínima especificada de puntos debe estar dentro de esta duración de tiempo para formar un clúster. |
Time Unit |
Entornos
Sistema de coordenadas de salida, Extensión, Espacio de trabajo actual
Información de licenciamiento
- Basic: No
- Standard: No
- Avanzado: Sí