Transformer du texte à l’aide d’algorithmes de Deep Learning (Outils GeoAI)
Résumé
Exécute un modèle entraîné de séquence en séquence sur un champ de texte dans une table ou classe d’entités et le met à jour avec un nouveau champ contenant le texte converti, transformé ou traduit.
En savoir plus sur le fonctionnement de l’outil Transformation de texte
Utilisation
- Cet outil requiert l’installation des structures de Deep Learning. Pour configurer votre machine afin d’utiliser des structures de Deep Learning dans ArcGIS Pro, consultez la rubrique Installer les structures de Deep Learning pour ArcGIS.
Cet outil nécessite un fichier de définition de modèle contenant des informations de modèle entraîné. Le modèle peut être entraîné à l’aide de l’outil Train Text Transformation Model (Entraîner le modèle de transformation de texte). La valeur du paramètre Input Model Definition File (Fichier de définition du modèle en entrée) peut être un fichier JSON de définition de modèle Esri (
.emd) ou un paquetage de modèle de Deep Learning (.dlpk). Les fichiers de modèle peuvent être stockés en local ou hébergés sur ArcGIS Living Atlas of the World.Cet outil prend en charge les modèles entraînés avec des backbones basés sur un module de transformation et le backbone Mistral. Pour installer le backbone Mistral, consultez la page ArcGIS Mistral Backbone.
Cet outil prend en charge l’utilisation de modèles de langage tiers créés avec la fonctionnalité d’extensibilité du modèle. La fonctionnalité d’extensibilité du modèle permet de réaliser des tâches de transformation de texte à l’aide d’un fichier de modèle Deep Learning personnalisé (
.dlpk) qui n’est pas créé avec l’outil Train Text Transformation Model (Entraîner le modèle de transformation de texte). Pour en savoir plus sur la création d’un fichier de modèle de Deep Learning (.dlpk) personnalisé, reportez-vous à la rubrique Utiliser des modèles de langage tiers avec ArcGIS.Cet outil peut s’exécuter sur un CPU ou un GPU. Toutefois, le Deep Learning sollicite d’importantes ressources de calcul et un GPU est recommandé. Pour exécuter cet outil avec un GPU, définissez le paramètre d’environnement Type de processeur sur GPU. Si vous avez plusieurs processeurs, spécifiez plutôt le paramètre d’environnement ID de GPU.
Pour obtenir des informations sur les exigences relatives à l’exécution de cet outil ainsi que sur les problèmes qui peuvent survenir, reportez-vous à la rubrique Forum aux questions sur le Deep Learning.
Paramètres
| Etiqueter | Explication | Type de données |
|---|---|---|
|
Input Table (Table en entrée) |
Table ou classe d’entités ponctuelles, linéaires ou surfaciques en entrée contenant le texte à transformer. |
Feature Layer; Table View |
|
Text Field (Champ de texte) |
Champ de texte dans la classe d’entités en entrée ou la table et qui contient le texte à transformer. |
Field |
|
Fichier de définition de modèle en entrée |
Modèle entraîné qui servira pour la transformation de texte. Le fichier de définition du modèle peut être un fichier JSON de définition de modèle Esri ( Pour utiliser un fichier Le fichier Attention :Un fichier de modèle de langage tiers |
File |
|
Result Field (Champ de résultat) (Facultatif) |
Nom du champ qui doit contenir le texte transformé dans la table ou la classe d’entités en sortie. Le nom du champ par défaut est |
String |
|
Arguments du modèle (Facultatif) |
Arguments supplémentaires qui seront utilisés par le modèle lors de la réalisation de l’inférence. L’argument du modèle pris en charge est Remarque :Lorsque vous utilisez un modèle de langage tiers, les arguments du modèle sont mis à jour conformément aux paramètres spécifiés dans le fichier Colonnes de la table de valeurs :
|
Value Table |
|
Batch Size (Taille de lot) (Facultatif) |
Nombre d’échantillons d’entraînement qui seront traités en une fois La valeur par défaut est 4. L’augmentation de la taille du lot peut améliorer les performances de l’outil. Cependant, plus la taille augmente, plus la mémoire utilisée est importante. Si une erreur se produit en raison d’une mémoire insuffisante, utillisez une taille de lot plus petite. |
Double |
|
Minimum Sequence Length (Longueur de séquence minimale) (Facultatif) |
Nombre minimal de caractères de la chaîne de texte en sortie. La valeur par défaut est 20. |
Double |
|
Maximum Sequence Length (Longueur de séquence maximale) (Facultatif) |
Nombre maximal de caractères de la chaîne de texte en sortie. La valeur par défaut est 50. |
Double |
Sortie dérivée
| Etiqueter | Explication | Type de données |
|---|---|---|
|
Updated Table (Table mise à jour) |
Table ou classe d’entités ponctuelles, linéaires ou surfaciques en sortie qui contient le texte transformé obtenu à partir des données en entrée. |
Table View; Feature Layer |
Environnements
Informations de licence
- Basic: Non
- Standard: Non
- Advanced: Oui