Skip to main content

Классифицировать текст при помощи глубокого обучения (Инструменты GeoAI)

Краткая информация

Запускает обученную модель классификации текста для текстового поля в классе объектов или таблице и обновляет каждую запись, добавляя метку назначенного класса или категории, при этом каждый класс имеет значение достоверности.

Узнайте больше о том, как работает классификация текста

Использование

  • Для этого инструмента требуется файл определения модели, содержащий информацию о модели. Модель можно обучить с помощью инструмента Обучение классификации текста поезда. Значение параметра Входной файл определения модели может быть JSON-файлом Esri model definition ('.emd') или пакетом модели глубокого обучения ('.dlpk'). Файлы моделей могут храниться локально или размещаться в ArcGIS Living Atlas of the World.

  • Файлы модели должны храниться локально или быть размещены на . Чтобы установить Mistral backbone, см. ArcGIS Mistral Backbone.

  • Этот инструмент поддерживает использование языковых моделей сторонних разработчиков, созданных с использованием функции расширяемости модели. Функция расширяемости модели позволяет выполнять задачи классификации текста с использованием пользовательского файла модели глубокого обучения (.dlpk), который не создается с помощью инструмента [Обучение классификации текста](train-text-classification-model.yml. Чтобы узнать больше о создании пользовательского файла модели для глубокого обучения ('.dlpk'), см. Использовать сторонние языковые модели с ArcGIS.

  • Этот инструмент может работать на центральном процессоре или графическом процессоре; однако глубокое обучение является интенсивным вычислительным процессом, поэтому рекомендуется использовать именно графический процессор. Чтобы запустить этот инструмент с использованием графического процессора, установите Тип процессора как GPU. Если имеется более одного GPU, можно вместо этого задать GPU ID.

  • Информацию о требованиях к запуску этого инструмента и проблемах, с которыми вы можете столкнуться, см. в разделе Часто задаваемые вопросы по глубокому обучению.

Параметры

Подпись Объяснение Тип данных

Входная таблица

Входной класс точечных, линейных, полигональных объектов или таблица, содержащие текст, который будет классифицирован и отмечен.

Feature Layer; Table View

Текстовое поле

Текстовое поле во входном классе объектов или таблице, которое содержит текст для классификации.

Field

Входной файл определения модели

Обученная модель, которая будет использоваться для классификации. Файлом определения модели может быть файл JSON определения модели Esri (.emd) или пакет модели глубокого обучения (.dlpk), который хранится локально или размещен на ArcGIS Living Atlas (.dlpk_remote).

Чтобы использовать файл .dlpk, обученный с помощью Mistral backbone, он должен быть установлен перед использованием модели. Чтобы установить Mistral backbone, см. ArcGIS Mistral Backbone

Файл .dlpk также может быть сторонней языковой моделью.

Внимание:

Файл сторонней языковой модели .dlpk потенциально может содержать вредоносный код. Используйте эти модели только в том случае, если вы доверяете их источнику.

File

Поле метки класса

(Дополнительный)

Имя поля, которое будет содержать метку класса или категории, назначенную моделью. По умолчанию имя поля - ClassLabel

String

Аргументы модели

(Дополнительный)

Дополнительные аргументы, которые будут использоваться моделью при выполнении вывода. Поддерживаемые аргументы модели включают Sequence Length и Threshold, которые будут использоваться для корректировки выходных данных модели. Аргумент модели Threshold применяется только для классификации текста с несколькими метками.

Примечание:

При использовании сторонней языковой модели аргументы модели будут обновлены в соответствии с параметрами, указанными в файле .dlpk. Чтобы узнать больше об определении аргументов модели, см. раздел getParameterInfo в разделе Использовать сторонние языковые модели с ArcGIS.

Столбцы таблицы значений:

  • NameThe name of the function argument.

  • ValueThe value of the function argument.

Value Table

Получение объяснения для каждого прогноза

(Дополнительный)

Указывает, будут ли создаваться пояснения SHAP. Время на создание пояснения будет зависеть от длины входных данных.

  • ОтмеченоПояснение SHAP будет создано для каждой строки выходной таблицы.

  • Не отмеченоПояснения SHAP созданы не будут. Используется по умолчанию.

Boolean

Размер пакета

(Дополнительный)

Число обучающих примеров, которые обрабатываются одновременно. Значение по умолчанию равно 4.

Увеличение размера пакета может повысить производительность инструмента, но по мере его увеличения используется все больше памяти. При появлении ошибки переполнения памяти задайте меньший размер пакета.

Double

Производные выходные данные

Подпись Объяснение Тип данных

Обновленная таблица

Выходной класс точечных, линейных, полигональных объектов или таблица, содержащие классифицированный и отмеченный текст, полученный из входных данных, вместе со значением достоверности для каждого класса.

Table View; Feature Layer

Параметры среды

Тип процессора, GPU ID

Информация о лицензировании

  • Basic: Нет
  • Standard: Нет
  • Advanced: Да