使用空间统计模型文件预测 (空间统计工具)
汇总
使用经过训练的空间统计模型(.ssm 文件)预测连续或分类值。
用法
此工具的应用情景示例如下:
对于一个经过训练的基于森林的海草发生分类和回归模型,使用许多表示为属性和栅格的环境解释变量,除了与上游工厂和主要港口的距离之外,还可以根据对这些环境解释变量的未来预测,预测未来海草的出现。
由专家训练的模型可以与其他人共享以进行预测,而无需共享敏感数据。 例如,有关儿童血铅水平及其房屋的征税宗地 ID 的信息模型,结合宗地属性(例如房屋年龄)、人口普查数据(例如收入和教育水平)和反映铅和铅化合物的毒物排放的国家数据集,可以预测没有血铅水平数据的宗地的铅暴露风险。 此类风险预测可能会推动该地区的政策和教育计划。
一位野生动物生态学家采集了观测到的濒危物种存在位置的外业数据。 他们需要估计该物种在更广泛研究领域的存在,并与其他研究人员共享他们的工作。 使用已知的存在位置并提供基本因素作为栅格,生态学家可以使用仅存在预测对物种的存在进行建模,并共享经过训练的模型,而无需共享有关物种出现的敏感信息。 模型可用于创建最有可能发现该物种的预测位置的地图。
输入模型文件参数值是由空间统计工具箱的空间关系建模工具集中的各种工具创建的
.ssm文件。 您可以使用广义线性回归、基于森林的增强分类和回归以及仅存在预测 (MaxEnt) 工具创建模型文件,方法是在每个工具中指定输出训练模型文件参数值。要了解每个模型如何对每个模型类型进行预测,请参阅“广义线性回归”工作原理、“基于森林的增强分类和回归”工作原理以及“仅存在预测”工作原理。
当使用预测类型参数的预测至要素选项时,请使用输出预测要素参数以创建具有预测的要素类。 使用预测至栅格选项时,使用输出预测表面参数创建预测值的栅格。
要预测至栅格,必须仅使用栅格对
.ssm文件进行训练。需要 ArcGIS Spatial Analyst 扩展模块许可才能使用使用栅格训练的
.ssm文件。注:
建议您在运行此工具之前先运行描述空间统计模型文件工具,以了解变量名称、类型、描述和单位以相应地准备数据。 您还可以使用模型诊断来评估输入模型文件的质量。
解释变量可以来自字段、可通过距离要素进行计算得出或者从栅格中提取得出。 解释变量的组合应与输入模型文件相匹配。
如果在创建模型文件时将解释变量或栅格标记为分类,则将选中分类参数并将匹配变量视为分类。 您可以在运行此工具之前使用描述空间统计模型文件工具来确定模型文件中哪些变量是分类变量。
训练和预测变量应该为相似的字段类型。 例如,所有数值字段类型都可以与所有其他数值字段类型相匹配,但是如果训练字段为文本,则相应的预测变量也应该为文本。
注:
建议您在匹配训练和预测变量之前设置变量单位。 如果训练好的模型文件和预测的变量单位不同,结果可能不正确。 例如,如果您使用以美元为单位的收入变量训练模型,但在进行预测时将该变量与以印度卢比为单位的收入进行匹配,则训练变量和预测变量之间的变量范围可能不一致,从而导致预测变量不准确。
该工具还创建描述模型性能的消息和图表。 可将鼠标悬停在进度条上、单击弹出按钮或展开地理处理窗格中的消息部分来访问消息。 您还可以使用地理处理历史 访问之前运行该工具的消息。 这些消息包括模型诊断和有关模型的其他信息。
在地理处理消息中,模型参数表描述了要预测的变量和字段类型以及用于创建模型的解释变量。 该表还包含每个变量的单位(如果使用设置空间统计模型文件属性工具设置),以帮助确保在使用模型进行预测时它们与预测变量保持一致。
注意:
建议您在信任预测结果之前评估模型诊断。 如果在不保留任何验证数据的情况下训练模型,则无法评估预测的准确性。
注意:
使用 ArcPy 运行工具时,匹配解释变量、匹配距离要素和匹配解释栅格参数值表中提供的变量的顺序和大小写很重要。 例如,如果您有两个表示温度和湿度的解释变量,并且温度值预期在湿度值之前,则您必须按该顺序提供变量。 使用描述空间统计模型文件工具的派生输出来获取输入模型文件中存储的变量的正确顺序。
使用与预测值比较的字段参数来评估模型预测结果与真实观测值的对比情况。 如果输入预测要素中存在一个包含真实观测值的字段,请将其设置为与预测值比较的字段参数值。 这会将评估指标添加到地理处理信息中,并将符号系统更改为用于回归的残差和用于分类的准确度状态。
当指定了与预测值比较的字段参数时,输出符号系统将是用于回归分析的残差,或表示分类分析的预测是否正确。
当指定了与预测值比较的字段参数时,地理处理消息中将额外包含一个带评估指标的验证数据表,比如用于分类的准确度和用于预测的 R 方。
参数
| 标注 | 说明 | 数据类型 |
|---|---|---|
|
输入模型文件 |
用于新预测的空间统计模型文件。 |
File |
|
预测类型 |
指定要使用的操作模式。 该工具可以预测新要素或创建预测栅格表面。
|
String |
|
输入预测要素 (可选) |
表示将进行预测的位置的要素类。 此要素类还必须包含作为字段提供的任何解释变量,这些字段与用于训练输入模型的那些相对应。 |
Feature Layer |
|
输出预测要素 (可选) |
包含预测结果的输出要素类。 |
Feature Class |
|
输出预测栅格 (可选) |
包含预测结果的输出栅格。 默认像元大小将为输入栅格的最大像元大小。 |
Raster Dataset |
|
匹配解释变量 (可选) |
输入模型的解释变量列表和输入预测要素的对应字段。 对于 值表列:
|
Value Table |
|
匹配距离要素 (可选) |
输入模型的解释距离要素和相应的预测距离要素的列表。 对于 值表列:
|
Value Table |
|
匹配解释栅格 (可选) |
输入模型的解释栅格和相应的预测栅格的列表。 对于 值表列:
|
Value Table |
|
与预测值比较的字段 (可选) |
来自输入预测要素参数值的字段,它包含在创建 |
Field |
环境
输出坐标系, 并行处理因子, 像元大小, 范围, 像元大小投影方法, 掩膜, 随机数生成器, 捕捉栅格
特殊情况
- 随机数生成器
-
The Random Generator Type used is always Mersenne Twister.
许可信息
- 基本: 受限
需要 Spatial Analyst 才能使用栅格。 - 标准: 受限
需要 Spatial Analyst 才能使用栅格。 - 高级: 受限
需要 Spatial Analyst 才能使用栅格。