Skip to main content

Texttransformationsmodell trainieren (GeoAI Tools)

Zusammenfassung

Trainiert ein Texttransformationsmodell, mit dem Text transformiert, übersetzt oder zusammengefasst werden soll.

Weitere Informationen zur Funktionsweise der Texttransformation

Verwendung

  • Dieses Werkzeug kann auch zum Optimieren eines bestehenden bereits trainierten Modells eingesetzt werden.

  • Um dieses Werkzeug mithilfe einer GPU auszuführen, legen Sie die Umgebung für den Prozessortyp auf GPU fest. Bei mehr als einer GPU geben Sie stattdessen die Umgebung GPU-ID an.

  • Als Eingabe für das Werkzeug dient eine Tabelle oder Feature-Class mit Trainingsdaten, wobei ein Textfeld den Eingabetext und ein Beschriftungsfeld den transformierten Text enthält.

  • Dieses Werkzeug verwendet Transformer-basierte Backbones für das Training von Texttransformationsmodellen und unterstützt auch das In-Context-Learning mit Prompts unter Verwendung des Mistral-LLM. Informationen zur Installation des Mistral-Backbone finden Sie unter ArcGIS Mistral Backbone.

  • Weitere Informationen zu den Voraussetzungen für die Ausführung dieses Werkzeugs und eventuell dabei auftretenden Problemen finden Sie unter Häufig gestellte Fragen zu Deep Learning.

Parameter

Beschriftung Erläuterung Datentyp

Eingabetabelle

Eine Feature-Class oder Tabelle, die ein Textfeld mit dem Eingabetext für das Modell und ein Beschriftungsfeld mit dem transformierten Zieltext enthält.

Feature Layer; Table View

Textfeld

Ein Textfeld in der Eingabe-Feature-Class oder Eingabetabelle, das den vom Modell zu transformierenden Eingabetext enthält.

Field

Beschriftungsfeld

Ein Textfeld in der Eingabe-Feature-Class oder Eingabetabelle, das den transformierten Zieltext für das Training des Modells enthält.

Field

Ausgabemodell

Der Speicherort des Ausgabeordners, in dem das trainierte Modell gespeichert wird.

Folder

Datei des vortrainierten Modells

(Optional)

Ein vortrainiertes Modell, das zum Feintuning des neuen Modells verwendet wird. Die Eingabe kann eine Esri Modelldefinitionsdatei (.emd) oder eine Deep-Learning-Paketdatei (.dlpk) sein.

Ein vortrainiertes Modell, mit dem ein ähnlicher Task ausgeführt wird, kann optimiert werden, um es auf das neue Modell abzustimmen. Das vortrainierte Modell muss mit dem gleichen Modelltyp und dem gleichen Backbone-Modell trainiert worden sein, das für das Training des neuen Modells verwendet wird.

File

Max. Epochen

(Optional)

Die maximale Anzahl von Epochen, für die das Modell trainiert wird. Die Einstellung "Max. Epochen" auf 1 bedeutet, dass das Dataset einmal durch das neuronale Netz geleitet wird. Der Standardwert ist 5.

Long

Modell-Backbone

(Optional)

Gibt das vorkonfigurierte neuronale Netzwerk an, das als Architektur für das Training des neuen Modells verwendet werden soll.

  • t5-smallDas neue Modell wird mit dem neuronalen Netzwerk T5 trainiert. T5 ist eine einheitliche Umgebung zum Konvertieren von Sprachproblemen in ein Text-in-Text-Format. t5-small ist die kleine Variante von T5.

  • t5-baseDas neue Modell wird mit dem neuronalen Netzwerk T5 trainiert. T5 ist eine einheitliche Umgebung zum Konvertieren von Sprachproblemen in ein Text-in-Text-Format. t5-base ist die mittlere Variante von T5.

  • t5-largeDas neue Modell wird mit dem neuronalen Netzwerk T5 trainiert. T5 ist eine einheitliche Umgebung zum Konvertieren von Sprachproblemen in ein Text-in-Text-Format. t5-large ist die große Variante von T5.

  • mistralDas Modell wird mithilfe des Mistral-LLM (Large Language Model) trainiert. Mistral ist ein reiner Decoder-Transformator, der Sliding Window Attention, Grouped-Query Attention und den Byte-Fallback-BPE-Tokenizer verwendet. Informationen zur Installation des Mistral-Backbone finden Sie unter ArcGIS Mistral Backbone.

String

Batch-Größe

(Optional)

Die Anzahl der Trainingsgebiete, die gleichzeitig verarbeitet werden sollen. Der Standardwert ist 2.

Durch Vergrößern der Batch-Größe kann die Performance des Werkzeugs verbessert werden; mit zunehmender Batch-Größe erhöht sich jedoch auch der Speicherbedarf. Wenn ein Fehler vom Typ "Nicht genügend Arbeitsspeicher" auftritt, verwenden Sie eine kleinere Batch-Größe.

Double

Modellargumente

(Optional)

Zusätzliche Argumente, die für die Initialisierung des Modells verwendet werden sollen. Das unterstützte Modellargument ist Sequence Length. Es wird zum Festlegen der maximalen Sequenzlänge der Trainingsdaten, die beim Training des Modells berücksichtigt werden sollen, verwendet.

Spalten der Wertetabelle:

  • NameThe name of the function argument.

  • ValueThe value of the function argument.

Value Table

Lernrate

(Optional)

Die Schrittgröße, die angibt, in welchem Umfang die Modellgewichtungen beim Trainingsprozess angepasst werden sollen. Wenn kein Wert angegeben ist, wird automatisch eine optimale Lernrate abgeleitet.

Double

Validierungsprozentsatz

(Optional)

Der Prozentsatz der Trainingsgebiete, die für die Überprüfung des Modells verwendet werden sollen. Der Standardwert ist 10 für Transformer-basierte Modell-Backbones und 50 für den Mistral-Backbone.

Double

Beenden, wenn sich das Modell nicht mehr verbessert

(Optional)

Gibt an, ob das Modelltraining beendet wird, wenn sich das Modell nicht mehr verbessert, oder fortgesetzt wird, bis der Parameterwert Max. Epochen erreicht wurde.

  • AktiviertDas Modelltraining wird beendet, wenn sich das Modell nicht mehr verbessert, und zwar unabhängig vom Parameterwert Max. Epochen. Dies ist die Standardeinstellung.

  • DeaktiviertDas Modelltraining wird fortgesetzt, bis der Parameterwert Max. Epochen erreicht wurde.

Boolean

Modell-Backbone trainierbar machen

(Optional)

Gibt an, ob die Backbone-Layer im vorab trainierten Modell fixiert werden sollen, sodass die Gewichtungen und Verzerrungen wie ursprünglich vorgesehen beibehalten werden.

  • AktiviertDie Backbone-Layer werden nicht fixiert, und die Gewichtungen und Verzerrungen des Parameterwertes Modell-Backbone können geändert werden, um sie an die Trainingsgebiete anzupassen. Die Verarbeitung dauert zwar länger, führt aber in der Regel zu besseren Ergebnissen. Dies ist die Standardeinstellung.

  • DeaktiviertDie Backbone-Layer werden fixiert, und die vordefinierten Gewichtungen und Verzerrungen des Parameterwertes Modell-Backbone werden beim Training nicht geändert.

Boolean

HTML-Tags entfernen

(Optional)

Gibt an, ob HTML-Tags aus dem Eingabetext entfernt werden sollen.

  • AktiviertDie HTML-Tags im Eingabetext werden entfernt. Dies ist die Standardeinstellung.

  • DeaktiviertDie HTML-Tags im Eingabetext werden nicht entfernt.

Boolean

URLs entfernen

(Optional)

Gibt an, ob URLs aus dem Eingabetext entfernt werden sollen.

  • AktiviertDie URLs im Eingabetext werden entfernt. Dies ist die Standardeinstellung.

  • DeaktiviertDie URLs im Eingabetext werden nicht entfernt.

Boolean

Prompt

(Optional)

Eine spezifische Eingabe oder Anweisung, die an ein LLM (Large Language Model) gegeben wird, um eine erwartete Ausgabe zu erzeugen.

Der Standardwert ist Eingabetext aus dem Textfeld in den transformierten Text im Beschriftungsfeld umwandeln.

String

Umgebungen

Prozessortyp, GPU-ID

Lizenzierungsinformationen

  • Basic: Nein
  • Standard: Nein
  • Advanced: Ja