使用训练深度学习模型向导
在 Advanced 许可等级下可用。
需具有 Image Analyst 许可才能使用。
训练深度学习模型向导是一个辅助工作流,用于帮助您使用收集的训练数据训练深度学习模型。 在获得训练数据后,在影像选项卡的深度学习工具下拉菜单
中打开训练深度学习模型向导
。
此向导分为三页:开始、训练和结果。
要使用训练深度学习模型向导,请完成以下步骤:
单击影像选项卡。
单击深度学习工具下拉菜单
,然后选择训练深度学习模型
。随即显示训练深度学习模型向导窗格。
入门
在向导的开始页面中,需要指定如何训练深度学习模型。
指定如何训练模型。
自动设置参数 - 系统将自动设置模型类型、参数和超参数以构建最佳模型。 此选项同时需要 ArcGIS Pro Advanced 许可和 ArcGIS Image Analyst 扩展模块。
自行指定参数 - 您自行设置模型类型、参数和超参数以构建模型。 此选项仅需要 ArcGIS Image Analyst 扩展模块。
单击下一步按钮移至训练页面。
训练模型
在训练页面中,设置训练的参数信息。 根据您在开始页面中指定的选项,这些参数可能有所不同。
- 指定必填参数。
|
输入训练数据 |
包含训练模型所需的影像片、标注和统计数据的文件夹。 此数据为导出训练数据进行深度学习工具的输出。 |
|
输出模型 (自动训练) |
输出的训练模型将作为深度学习包( |
|
输出文件夹 (手动训练) |
将存储训练模型的输出文件夹位置。 |
- (可选)设置其他参数。
自动训练参数
|
参数 |
描述 |
|---|---|
|
预训练模型 |
将用于微调新模型的预训练模型。 输入为 Esri 模型定义文件 ( 可以对具有相似类的预训练模型进行微调以适应新模型。 预训练模型必须已使用将用于训练新模型的相同模型类型和骨干模型进行了训练。 仅支持使用 ArcGIS 训练的模型进行微调。 |
|
总时间限制(小时) |
AutoDL 模型训练所需的总时间限制(小时)。 默认值为 2 小时。 |
|
自动 DL 模式 |
指定将使用的 AutoDL 模式以及 AutoDL 搜索的强度。
|
|
神经网络 |
指定要用于训练模型的架构。 默认情况下,将使用所有网络。 |
|
保存评估的模型 |
指定是否保存所有评估的模型。
|
手动训练参数
|
参数 |
描述 |
|---|---|
|
最大轮数 |
应用于将训练模型的最大轮数。 最大轮数值为 1 意味着数据集将通过神经网络向前和向后传递一次。 默认值为 20。 |
|
预训练模型 |
将用于微调新模型的预训练模型。 输入为 Esri 模型定义文件 ( 可以对具有相似类的预训练模型进行微调以适应新模型。 预训练模型必须已使用将用于训练新模型的相同模型类型和骨干模型进行了训练。 仅支持使用 ArcGIS 训练的模型进行微调。 |
|
模型类型 |
指定要用于训练深度学习模型的模型类型。 有关不同模型类型的详细信息,请参阅深度学习模型架构。 |
|
模型参数 |
将使用模型类型参数中的信息填充此参数。 这些参数会有所变化,具体取决于模型架构。 ArcGIS 预训练模型和自定义深度学习模型可能具有该工具支持的其他参数。 有关适用于每种模型类型的自变量的详细信息,请参阅深度学习自变量。 |
|
数据增强 |
指定要使用的数据增强类型。 数据增强方法使用现有数据创建经过修改的数据集副本,实现人为增加训练集合。
|
|
增强参数 |
在增强参数中指定每个转换对应的值。
|
|
批处理大小 |
一次需要处理以便用于训练的训练样本数。 增加批量大小可以提高工具性能;但是随着批量大小增加,所用内存也将随之增加。 如果可用于批量大小集的 GPU 内存不足,则该工具将尝试估计并使用最佳批量大小。 如果出现内存不足错误,则降低批量大小。 |
|
验证百分比 |
将用于验证模型的训练样本的百分比。 默认值为 10。 |
|
影像片大小 |
将用于训练模型的影像大小。 影像将裁剪为指定的影像片大小。 |
|
将大小调整为 |
调整影像片大小。 在调整影像片大小后,将裁剪影像片大小的像素块,以用于训练。 该参数将仅应用于对象检测 (PASCAL VOC)、对象分类(已标注切片)和超分辨率数据。 大小调整值通常为影像片大小值的一半。 如果此大小调整值小于影像片大小值,则将使用大小调整值创建像素块进行训练。 |
|
学习率 |
在整个训练过程中,现有信息将被新获取的信息覆盖的比率。 如果未指定任何值,则系统将在训练过程中从学习曲线中提取最佳学习率。 |
|
骨干模型 |
指定要用作训练新模型的架构的预配置神经网络。 这种方法称为迁移学习。 此外,从 PyTorch Image Models (timm) 指定受支持卷积神经网络时还可以使用 timm 作为前缀,例如 timm:resnet31、timm:inception_v4、timm:efficientnet_b3 等。 |
|
监控指标 |
指定在检查点设置和提前停止时要监控的指标。 |
|
当模型停止改进时停止 |
指定是否将实施提前停止。
|
|
冻结模型 |
指定是否冻结预训练模型中的骨干图层,以使权重和偏差保持原始设计。
|
|
权重初始化方案 |
指定要用于为图层初始化权重的方案。 要使用多光谱数据训练模型,模型必须容纳不同类型的可用波段。 为此,需要重新初始化模型中的第一个图层。
仅当在模型中使用多光谱影像时,此参数才适用。 |
|
启用 Tensorboard |
指定工具训练时是否启用 Tensorboard 指标。 可以使用工具消息中的 URL 访问 Tensorboard。
该参数仅支持以下模型:CycleGAN、DeepLab、Faster RCNN、Feature Classifier、Image Captioner、Mask RCNN、Multi-Task Road Extractor、Pix2Pix、PSPNet Classifier、RetinaNet、Single-Shot Detector、SuperResolution 和 U-Net Classifier。 |
- 单击下一步按钮移至结果页面。
查看结果
结果页面将显示已训练模型的关键详细信息,以供您查看。 它还允许您将已训练模型与其他模型进行比较。 在推断中使用深度学习模型之前,需要了解这些模型。 检查模型可帮助您了解模型的训练方式及其性能。 在许多情况下,可能需要比较多个模型。
|
项目 |
描述 |
|---|---|
|
Model |
使用浏览按钮 |
|
Compare |
使用比较按钮 |
|
模型类型 |
模型架构的名称。 |
|
骨干 |
用作训练模型架构的预配置神经网络的名称。 |
|
学习率 |
神经网络训练中使用的学习率。 如果您未指定该值,则将由训练工具进行计算。 |
|
训练和验证损失 |
本部分显示了一个图表,用于显示训练模型过程中的训练损失和验证损失。
|
|
分析模型 |
指标或数值,具体取决于模型架构。 例如,像素分类模型将显示每个类的以下指标:精确率、召回率和 f1 分数。 对象检测模型将显示平均精确率得分。 |
|
示例结果 |
显示地面参考和预测对的示例。
|
|
轮次详细信息 |
此表包含每个轮次的信息,例如训练损失、验证损失、时间和其他指标。
|


