Correlación cruzada de series temporales (Herramientas de minería de patrones en espacio-tiempo)
Resumen
Calcula la correlación cruzada en varios intervalos de tiempo entre dos series temporales almacenadas en un cubo de espacio-tiempo.
La correlación cruzada se calcula emparejando los valores correspondientes de cada serie temporal y calculando un coeficiente de correlación de Pearson. A continuación, la segunda serie temporal se desplaza un intervalo de tiempo y se calcula una nueva correlación. Este desplazamiento se repite hasta un número máximo especificado de intervalos de tiempo. El intervalo de tiempo (desplazamiento) con la correlación más sólida es una estimación del retraso entre los cambios en una serie temporal y las respuestas en la otra (por ejemplo, el retraso entre el gasto en publicidad y los ingresos por ventas). Puede filtrar y eliminar tendencias de las series temporales para comprobar si existe una dependencia estadísticamente significativa entre las variables. Asimismo, puede incluir vecinos espaciales en los cálculos para incorporar relaciones espaciales entre las dos series temporales.
Más información sobre el funcionamiento de la correlación cruzada de series temporales
Ilustración

Uso
El signo (positivo o negativo) de un valor de intervalo temporal se interpreta como el desplazamiento de la variable de análisis secundaria con respecto a la variable de análisis principal. Por ejemplo, un valor de intervalo de tiempo de 5 significa que la variable secundaria se desplaza cinco periodos de tiempo hacia delante (a la derecha en el eje temporal) antes de calcular la correlación cruzada. Si el intervalo de tiempo con la correlación más sólida es positivo, significa que los cambios en el valor de la variable de análisis secundaria se producen antes que los cambios en la variable de análisis principal. Del mismo modo, un valor de intervalo de tiempo de -3 significa que la serie temporal secundaria se desplaza tres periodos de tiempo hacia atrás (hacia la izquierda en el eje temporal). Si el intervalo de tiempo con la correlación más sólida es negativo, significa que los cambios en la variable de análisis principal se producen antes que los cambios en la variable de análisis secundaria.
La salida principal de la herramienta es una clase de entidad que contiene los resultados de la correlación cruzada de cada ubicación para todos los intervalos de tiempo. En un mapa, se agregará una capa de grupo que contenga seis capas de diferentes campos de las entidades de salida: tres capas de las correlaciones más sólidas (la más positiva, la más negativa y la más sólida en valor absoluto) y tres capas de los intervalos de tiempo asociados para cada una de las correlaciones más sólidas. Puede utilizar estas capas para identificar rápidamente las ubicaciones con las correlaciones más sólidas y los intervalos de tiempo que produjeron las correlaciones.
Si lo desea, puede crear gráficos emergentes en las entidades de salida que resuman y muestren las correlaciones a través de todos los intervalos en cada ubicación. También puede crear tablas de salida que contengan todas las correlaciones individuales entre ubicaciones en cada intervalo de tiempo.
Utilice el parámetro Vecinos espaciales a incluir en los cálculos para calcular las correlaciones cruzadas utilizando las vecindades alrededor de cada ubicación. Esto es útil cuando las series temporales de lugares cercanos tienden a ser más similares que las series temporales de lugares más alejados. Si se utilizan vecinos, la correlación cruzada de una ubicación es una media ponderada de las correlaciones entre la variable principal de la ubicación focal y la variable secundaria de cada uno de sus vecinos (incluida ella misma). Por ejemplo, si una ubicación tiene cinco vecinos, la correlación cruzada de la ubicación es una media ponderada de seis correlaciones: la correlación entre la variable principal de la ubicación focal y la variable secundaria de la ubicación focal, la correlación entre la variable principal de la ubicación focal y la variable secundaria del primer vecino, la correlación entre la variable principal de la ubicación y la variable secundaria del segundo vecino, y así sucesivamente. El parámetro Método de ponderación de vecinos espaciales especifica las ponderaciones que se utilizarán en la media ponderada.
Para comprobar la significación estadística de las correlaciones cruzadas en cada intervalo, es preciso seleccionar el parámetro Filtrar y eliminar tendencias. Si se selecciona esta opción, se calcularán los valores p y los intervalos de confianza del 95% para todos los intervalos de todas las ubicaciones. Además, las pruebas de significación solo pueden realizarse en correlaciones por pares entre dos series temporales (en lugar de una media ponderada de correlaciones múltiples), de modo que, si incluye vecinos espaciales en los cálculos, solo la tabla de correlaciones por pares de salida contendrá valores p e intervalos de confianza. Si no se incluyen los vecinos, las entidades de salida y la tabla de correlaciones de intervalos de salida contendrán campos de valor p e intervalo de confianza.
Precaución:
Las pruebas de significación estadística se realizan de forma independiente para cada intervalo de tiempo de cada ubicación, y no hay corrección para pruebas de hipótesis múltiples. Sea prudente a la hora de interpretar la importancia de cualquier valor p o intervalo de confianza.
Más información sobre cómo eliminar tendencias y filtrar la autocorrelación
Se puede introducir la misma variable de análisis para las variables de análisis principal y secundaria (lo que se denomina análisis de autocorrelación). Sin embargo, es posible que los resultados sean difíciles de interpretar, ya que una serie temporal siempre está perfectamente correlacionada consigo misma cuando el valor del intervalo de tiempo es cero (no desplazado). Las entidades de salida y las tablas de correlación contendrán los resultados de correlación de todos los intervalos de tiempo, y los resultados del intervalo de tiempo cero pueden filtrarse o deseleccionarse.
Parámetros
| Etiqueta | Explicación | Tipo de datos |
|---|---|---|
|
Cubo de espacio-tiempo de entrada |
El cubo de espacio-tiempo que contiene la variable que se analizará. Los cubos espacio-temporales tienen una extensión de archivo |
File |
|
Variable de análisis principal |
Variable numérica del cubo de espacio-tiempo que contiene los valores de serie temporal de la variable principal. |
String |
|
Variable de análisis secundaria |
Variable numérica del cubo de espacio-tiempo que contiene los valores de serie temporal de la variable secundaria. Cuando se utilizan intervalos de tiempo, la variable de análisis secundaria se desplaza con respecto a la variable de análisis principal. |
String |
|
Entidades de salida |
Entidades de salida que contienen las correlaciones cruzadas de todas las ubicaciones para todos los intervalos de tiempo. La salida también tendrá campos de las correlaciones más sólidas (positivas, negativas y absolutas) y campos de las correlaciones de todos los intervalos de tiempo. Si filtra y elimina tendencias, y no utiliza vecinos, la salida contendrá campos de valores p e intervalos de confianza del 95 por ciento de todas las correlaciones cruzadas. |
Feature Class |
|
Habilitar series temporales emergentes (Opcional) |
Especifica si se crearán gráficos de series temporales en los elementos emergentes de cada entidad de salida que muestren los resultados de la correlación cruzada. Las series temporales emergentes no son compatibles con las salidas de los shapefiles.
|
Boolean |
|
Intervalo de tiempo máximo (Opcional) |
Número máximo de intervalos de tiempo que se utilizarán para desplazar la variable de análisis secundaria. Las correlaciones cruzadas se calcularán para cada valor de intervalo de tiempo hasta el máximo. Proporcione un valor positivo incluso para intervalos de tiempo negativos; por ejemplo, si se proporciona 10 para este parámetro y la dirección del intervalo de tiempo desplaza la variable secundaria en ambas direcciones, se calcularán correlaciones cruzadas para todos los intervalos de tiempo comprendidos entre -10 y 10. Si no se proporciona ningún valor, se determinará un valor basado en la longitud de la serie temporal. Proporcione un valor de 0 para calcular únicamente la correlación bruta entre las series temporales sin ningún intervalo de tiempo. |
Long |
|
Dirección del intervalo de tiempo de la variable secundaria (Opcional) |
Especifica la dirección del intervalo de tiempo. La variable secundaria puede desplazarse hacia delante en el tiempo (en relación con la variable principal), hacia atrás en el tiempo o en ambas direcciones.
|
String |
|
Vecinos espaciales a incluir en los cálculos (Opcional) |
Especifica los vecinos alrededor de cada ubicación que se utilizarán en los cálculos. Si se utilizan vecinos, la correlación cruzada de una ubicación es la media ponderada de las correlaciones entre la variable principal de la ubicación focal y la variable secundaria de cada uno de sus vecinos (incluida ella misma).
|
String |
|
Número de vecinos espaciales (Opcional) |
Número de ubicaciones más cercanas que se incluirán como vecinas en los cálculos. |
Long |
|
Banda de distancia (Opcional) |
Todas las ubicaciones dentro de esta distancia se incluirán como vecinas. Si no se proporciona ningún valor, se calculará uno durante el procesamiento y se incluirá como mensaje de geoprocesamiento. Si la distancia especificada da como resultado más de 1000 vecinos, solo las 1000 ubicaciones más cercanas se incluirán como vecinas. En el caso de los polígonos, para determinar los vecinos se utiliza la distancia entre los centroides. |
Linear Unit |
|
Método de ponderación de vecinos espaciales (Opcional) |
Especifica el esquema de ponderación que se aplicará a los vecinos espaciales al calcular las correlaciones. Las ponderaciones se utilizan al calcular la media ponderada de la correlación entre la entidad focal y cada vecino.
|
String |
|
Filtrar y eliminar tendencia (Opcional) |
Especifica si las tendencias, la estacionalidad y la autocorrelación se eliminarán de la variable de análisis principal y se utilizarán para filtrar la variable de análisis secundaria.
|
Boolean |
|
Tabla de correlaciones de intervalos de salida (Opcional) |
Tabla que contiene las correlaciones de cada intervalo de tiempo de cada ubicación. |
Table |
|
Tabla de correlaciones por pares de salida (Opcional) |
Tabla que contiene las correlaciones por pares entre cada ubicación y cada vecino en todos los intervalos de tiempo. |
Table |
Salida derivada
| Etiqueta | Explicación | Tipo de datos |
|---|---|---|
|
Grupo de capas de salida |
Una capa de grupo de las capas de salida. |
Group Layer |
Entornos
Factor de procesamiento en paralelo, Sistema de coordenadas de salida
Información de licenciamiento
- Basic: Sí
- Standard: Sí
- Avanzado: Sí