Skip to main content

热点分析 (Getis-Ord Gi*) (空间统计工具)

汇总

给定一组加权要素,使用 Getis-Ord Gi* 统计识别具有统计显著性的热点和冷点。

了解有关“热点分析 (Getis-Ord Gi*)”工作原理的详细信息

插图

“热点分析”工具图示

用法

  • 此工具用于识别具有统计显著性的高值(热点)和低值(冷点)的空间聚类。 此工具使用 z 得分、p 值和置信区间 (Gi_Bin) 为输入要素类中的每个要素创建一个新的输出要素类。

  • z 得分和 p 值都是统计显著性的度量值,用于逐个要素地判断是否拒绝零假设。 实际上,它们可指明观测所得的高值或低值的空间聚类是否比我们在这些相同值的随机分布中预期的更加明显。 z 得分和 p 值字段不体现任何类型的 错误发现率 (FDR) 校正

  • 无论是否应用 FDR 校正,Gi_Bin 字段都会识别统计显著性的热点和冷点。 置信区间 +3 到 -3 中的要素反映置信度为 99% 的统计显著性;置信区间 +2 到 -2 中的要素反映置信度为 95% 的统计显著性;置信区间 +1 到 -1 中的要素反映置信度为 90% 的统计显著性;而置信区间 0 中要素的聚类则不具有统计显著性。 在没有 FDR 校正的情况下,统计显著性以 p 值和 z 得分字段为基础。 如果选中应用错误发现率 (FDR) 校正参数,确定置信度的关键 p 值会降低以兼顾多重测试空间依赖性

  • 如果要素的 z 得分高且 p 值小,则表示有一个高值的空间聚类。 如果 z 得分低并为负数且 p 值小,则表示有一个低值的空间聚类。 z 得分越高(或越低),聚类密集程度就越大。 如果 z 得分接近零,则表示不存在明显的空间聚类。

  • z 得分基于随机化零假设进行计算。 有关 z 得分的详细信息,请参阅什么是 z 得分? 什么是 p 值?

  • 如果未投影输入要素值(即,坐标单位为度、分和秒),或者将输出坐标系设置为地理坐标系,则采用弦测量方法计算距离。 使用弦距离测量法是因为此方法不仅计算速度快,而且提供真实测地线距离的良好估测,至少对于彼此 30 度以内的点是这样。 弦距离是基于扁椭球体计算的。 给定地球表面上的任意两点,两点之间的弦距离是从三维地球穿过然后连接该两点的一条线的长度。 弦距离报表将以米为单位。

    注意:

    如果您的研究区域超过 30 度,则请确保投影数据。 弦距离无法准确估算超出 30 度的测地线距离。

  • 分析时如使用弦距离,距离范围或距离阈值参数值(如指定)应以米为单位。

  • 对于线和面要素,距离计算中会使用要素的质心。 对于多点、折线或由多部分组成的面,将会使用所有要素部分的加权平均中心来计算质心。 点要素的加权项是 1;线要素的加权项是长度;而面要素的加权项是面积。

  • 输入字段应包含多种值。 此统计数学方法要求待分析的变量存在一定程度的变化;例如,如果所有输入都是 1 便无法求解。 要使用此工具分析事件数据的空间模式,应考虑聚合事件数据或使用优化的热点分析工具。

    注:

    如果您重点关注各点存在与否,而不是每个点的特定测量属性,则事件数据为表示事件(犯罪、交通事故)或对象(树、店铺)的点。

  • 优化的热点分析工具可以对数据进行评估,以自动选择可优化热点结果的参数设置。 此工具将聚合事件数据、选择合适的分析范围,并针对多重测试空间依赖性调整结果。 工具选择的参数选项将以消息形式写入,这些选项可在使用此工具时帮助您优化参数选择。 此工具使您可以完全控制您的参数设置,赋予您极大的灵活性。

  • 空间关系的概念化参数值指定的选项,应反映要分析的要素之间的固有关系。 对要素在空间中彼此交互方式构建的模型越逼真,结果就越准确。 选择空间关系的概念化:最佳做法中给出了建议。 以下是其他提示:

    • 固定距离范围选项为默认值。 距离范围或距离阈值参数将确保每个要素至少拥有一个相邻要素。 这一点非常重要,但通常,此默认值并不是适用于分析的最合适的距离。 为分析选择适合的比例(距离范围)的其他策略在选择固定距离范围值的最佳做法中进行了概括介绍。

    • 使用反距离反距离平方选项时,如果在距离范围或距离阈值参数中输入零,则所有要素均被视为所有其他要素的相邻要素;如果将此参数留空,则将应用默认距离。

      如果距离权重小于 1,则对其取倒数时将变得不稳定。 因此,相隔小于 1 个单位距离的要素的权重为 1。

      对于“反距离”选项(反距离反距离平方无差别的区域),为避免产生除数为零的情况,任何重合两点的权重值均将指定为 1。 这样便可确保将要素包含在分析之内。

  • 空间关系的概念化参数的附加选项(包括空间-时间关系)在使用生成空间权重矩阵工具时可用。 要利用这些附加选项,请在分析前先构造空间权重矩阵文件;为空间关系的概念化参数选择通过文件获取空间权重;为权重矩阵文件参数提供您所创建的空间权重文件的路径。

  • 有关空间-时间聚类分析的详细信息,请参阅空间-时间分析文档。

  • 地图图层可用于定义输入要素类。 使用带选区的图层时,只有选定的要素才会包含在分析中。

  • 如果提供的是一个带 .swm 扩展名的权重矩阵文件,则需要输入的是一个使用生成空间权重矩阵工具或生成网络空间权重工具创建的空间权重矩阵文件;否则,此工具需要输入一个 ASCII 格式的空间权重矩阵文件。 在某些情况下,根据您所使用的空间权重矩阵文件类型,工具行为会有所不同:

    • ASCII 格式的空间权重矩阵文件

      • 按原样使用权重。 将缺失的要素转要素关系视为零。

      • 除非指定一个自身潜力字段参数值或明确包括自身潜力权重,否则自身潜力的默认权重为 0。

      • 支持不对称关系,并且允许要素拥有自身不具备邻域的临近要素。 这意味着,原始要素的本地平均值计算中包括临近要素,而全局平均值计算中则不包括临近要素。

      • 如果对权重进行了行标准化,则选择集的分析结果很有可能不正确。 要对选择集运行分析,请将 ASCII 数据读入表并使用生成空间权重矩阵工具中空间关系概念化参数的转换表选项,将 ASCII 空间权重文件转换为 .swm 文件。

    • SWM 格式的空间权重矩阵文件

      • 如果对权重进行了行标准化,则会针对选择集将其重新标准化;否则按原样使用权重。

      • 除非指定一个自身潜力字段参数值,否则自身潜力的默认权重为 1。

  • 使用 ASCII 格式的空间权重矩阵文件运行您的分析会占用大量内存。 如果要分析的要素超过 5,000 个,则考虑将 ASCII 格式的空间权重矩阵文件转换为 SWM 格式的文件。 首先,将 ASCII 权重置入一个带格式的表中(例如,使用 Excel)。 接下来运行生成空间权重矩阵工具,并使用空间关系的概念化参数的转换表选项。 输出是 SWM 格式的空间权重矩阵文件。

  • 该工具的输出要素类会自动添加到内容列表中,同时对 Gi_Bin 字段应用默认渲染。 由热到冷的渲染由 <ArcGIS Pro>\\Resources\\ArcToolBox\\Templates\\Layers 路径下的图层文件进行定义。 需要时,可通过重新应用图层符号系统重新应用默认渲染。

  • 此工具的输出包括一个直方图,该直方图会对输入字段值进行绘制,可以在内容窗格的输出要素类下访问该直方图。

  • 空间关系建模帮助主题提供了有关此工具参数的更多信息。

    注意:

    在使用 shapefile 时,请注意 shapefile 无法存储空值。 根据非 shapefile 输入创建 shapefile 的工具或其他过程可能会将空值存储(或解释)为零。 某些情况下,空值则以极大的负值储存于 shapefile 中。 这会产生意外的结果。 有关详细信息,请参阅 shapefile 输出的地理处理注意事项

    旧版本:

    行标准化对此工具没有影响:无论是否进行行标准化,此工具的结果都是相同的。 标准化参数已被禁用;它保留下来仅用于支持向后兼容。

  • 当从 Python 使用此工具时,运行该工具返回的 result 对象具有以下输出:

    索引位置

    描述

    数据类型

    0

    输出要素类

    要素类

    1

    结果字段名 (GiZScore)

    字段

    2

    概率字段名 (GiPValue)

    字段

    3

    源 ID 字段名 (SOURCE_ID)

    字段

参数

标注 说明 数据类型

输入要素类

将要执行热点分析的要素类。

Feature Layer

输入字段

要评估的数值字段(例如,受害者数量、犯罪率和测试得分等)。

Field

输出要素类

用于接收 z 得分和 p 值结果的输出要素类。

Feature Class

空间关系的概念化

指定要素空间关系的定义方式。

  • 反距离与远处的要素相比,附近的邻近要素对目标要素的计算的影响要大一些。

  • 反距离平方反距离类似,但它的坡度更明显,因此影响将下降得更快,并且只有目标要素的最近邻域会对要素的计算产生重大影响。

  • 固定距离范围将对邻近要素环境中的每个要素进行分析。 在指定临界距离(距离范围或距离阈值)内的邻近要素将分配有值为 1 的权重,并对目标要素的计算产生影响。 在指定临界距离外的邻近要素将分配值为零的权重,并且不会对目标要素的计算产生任何影响。

  • 无差别的区域在目标要素的指定临界距离(距离范围或距离阈值)内的要素将分配有值为 1 的权重,并且会影响目标要素的计算。 一旦超出该临界距离,权重(以及邻近要素对目标要素计算的影响)就会随距离的增加而减小。

  • K - 最近邻将最近的 k 要素包含在分析中;k 是指定的数字参数。

  • 仅邻接边仅共享边界或重叠的相邻面要素会影响目标面要素的计算。

  • 邻接边拐角共享边界、节点或重叠的面要素会影响目标面要素的计算。

  • 通过文件获取空间权重将由指定空间权重文件定义空间关系。 指向空间权重文件的路径由权重矩阵文件参数指定。

String

距离法

指定计算每个要素与邻近要素之间的距离的方式。

  • 欧氏将使用两点间的直线距离。

  • 曼哈顿沿垂直轴度量的两点间的距离(城市街区),计算方法是对两点的 x 和 y 坐标的差值(绝对值)求和。

String

标准化

行标准化对此工具没有影响:无论是否进行行标准化,此工具的结果都是相同的。 此参数已被禁用;它保留下来仅用于支持向后兼容。

  • 将不会对空间权重执行标准化。

  • 将不会对空间权重执行标准化。

String

距离范围或距离阈值

(可选)

“反距离”和“固定距离”选项的中断距离。 将在对目标要素的分析中忽略为该要素指定的中断之外的要素。 但是,对于无差别的区域,指定距离之外的要素的影响会随距离的增加而减弱,而在距离阈值之内的要素将被同等对待。 提供的距离值应与输出坐标系的值相匹配。

对于空间关系的“反距离”概念化,值为 0 表示未应用任何阈值距离;当将此参数留空时,将计算并应用默认阈值。 默认值为确保每个要素至少具有一个邻域的欧氏距离。

当指定了面邻接(仅邻接边邻接边拐角)或通过文件获取空间权重的空间概念化选项时,该参数无效。

Double

自身潜力字段

(可选)

此字段表示自身潜力 - 要素与其自身之间的距离或权重。

Field

权重矩阵文件

(可选)

包含诸多权重的文件的路径,这些权重用于定义要素间的空间关系或可能的时态关系。

File

应用错误发现率 (FDR) 校正

(可选)

指定统计显著性是否以 FDR 校正为基础。

  • 选中统计显著性将以 FDR 校正为基础。

  • 未选中统计显著性不会以 FDR 校正为基础,而将以 p 值和 z 得分字段为基础。 这是默认设置。

Boolean

邻居数

(可选)

用于指定将包含在分析中的相邻要素数目的整数。

Long

派生输出

标注 说明 数据类型

结果字段

结果字段名 (GiZScore)。

Field

概率字段

概率字段名 (GiPValue)。

Field

Source_ID

源 ID 字段名 (SOURCE_ID)。

Field

环境

输出坐标系, 地理变换, 当前工作空间, 临时工作空间, 维护全限定的字段名, 输出包含 M 值, M 分辨率, M 容差, 输出包含 Z 值, 默认输出 Z 值, Z 分辨率, Z 容差, XY 分辨率, XY 容差

特殊情况

输出坐标系

Feature geometry is projected to the output coordinate system prior to analysis, so values entered for the Distance Band or Threshold Distance parameter should match those specified in the output coordinate system. All mathematical computations are based on the spatial reference of the output coordinate system. When the output coordinate system is based on degrees, minutes, and seconds, geodesic distances are estimated using chordal distances in meters.

许可信息

  • 基本: 是
  • 标准: 是
  • 高级: 是