Knowledge Studio-Lösungen migrieren
Verwenden Sie angepasste Modelle und andere Ressourcen, die Sie in Knowledge Studio erstellt haben, indem Sie sie auf Discoverymigrieren.
Modell unverändert verwenden
Um sofort mit der Verwendung Ihres Knowledge Studio-Modells zu beginnen, exportieren Sie das Modell aus Knowledge Studio und importieren Sie es in Discovery als Aufbereitung für maschinelles Lernen.
Wenn Sie ein Knowledge Studio-Modell importieren, um es unverändert in Discoveryzu verwenden, können im Modell definierte Entitätstypen auf Stammebene erkannt werden, wenn sie in Ihren Dokumenten auftreten. Alle Erwähnungen von Entitätsuntertypen, die auftreten, werden als Erwähnungen des übergeordneten Entitätstyps identifiziert. Die Subtypentitäten selbst werden nicht beibehalten. Wenn das Modell weiterhin zwischen verschiedenen Subtypen einer Entität unterscheiden soll, müssen Sie zusätzliche Schritte ausführen. Weitere Informationen finden Sie unter Subtypinformationen erhalten.
Sie können nicht mit der Aktualisierung eines Modells fortfahren, das Sie als ML-Aufbereitung importieren.
Die folgenden Modelltypen können unverändert importiert und verwendet werden:
- In Knowledge Studio erstellte regelbasierte Modelle, die Entitäten in Dokumenten anhand von Regeln finden, die Sie definieren. (Dateiformat: .pear)
- In Knowledge Studio erstellte Modelle für maschinelles Lernen, die die sprachlichen Nuancen, Bedeutungen und Beziehungen verstehen, die für Ihre Branche spezifisch sind (Dateiformat: .zip)
Welche Modelle Sie hinzufügen können, hängt von Ihrem Bereitstellungstyp ab:
- IBM Cloud Sie können nur Modelle hinzufügen, die mit einer IBM Watson® Knowledge Studio-Instanz erstellt wurden, die in IBM Cloud gehostet wird.
- IBM Cloud Pak for DataIBM Software Hub Sie können Modelle hinzufügen, die mit einer Instanz von IBM Watson® Knowledge Studio erstellt wurden, die auf IBM Cloud Pak® for Data oder IBM Cloud gehostet wird.
Weitere Informationen finden Sie unter Importierte ML-Modelle zum Suchen nach angepassten Begriffen verwenden.
Korpus als Trainingsdaten verwenden
Discovery verfügt über ein Entitätsextraktionstool, mit dem Sie ein Typsystem definieren können. Die Benutzerschnittstelle des Entitätsextraktionsprogramms ähnelt der Benutzerschnittstelle von Knowledge Studio, die zum Annotieren von Dokumenten verwendet wird, die Sie zum Korpus eines Modells für maschinelles Lernen hinzufügen. In Knowledge Studiodefinieren Sie jedoch nur Entitäten auf Stammebene, keine Subtypen oder Beziehungen.
Als Alternative zum Importieren eines Knowledge Studio-Modells und zum Anwenden als Aufbereitung können Sie auch ein Knowledge Studio-Korpus importieren. Wenn Sie ein Knowledge Studio-Korpus zum Entitätsextraktionstool Discovery hinzufügen, werden alle Entitäten auf Stammebene aus dem Korpus als neue Entitäten im Arbeitsbereich des Entitätsextraktionsprogramms Discovery dargestellt. Entitätssubtypen werden nicht erkannt. Sie können jedoch zusätzliche Schritte ausführen, um Subtypinformationen aufzubewahren.
Beziehungen und Koreferenzen aus dem Modell für maschinelles Lernen Knowledge Studio werden nicht dargestellt. Es sind auch keine benutzerdefinierten Wörterverzeichnisse vorhanden, die dem Modell zugeordnet sind.
Beachten Sie Folgendes, wenn Sie auswählen, ob ein Modell oder ein Korpus importiert werden soll:
- Sie können mit der Bearbeitung des Typsystems fortfahren, wenn Sie das Korpus importieren. Wenn Sie ein trainiertes Modell importieren, können Sie es anschließend nicht in Discoverybearbeiten.
- Ein importiertes Modell, das Sie als Aufbereitung auf eine Objektgruppe anwenden, kann alle Entitätssubtypen, Beziehungen und Koreferenzinformationen erkennen, für die das ursprüngliche Modell zusätzlich zu den Entitäten auf Stammebene trainiert wurde. Eine Entitätsextraktoraufbereitung kann nur Entitäten suchen und taggen.
Weitere Informationen finden Sie unter Knowledge Studio-Korpus importieren.
Subtypinformationen beibehalten
Wenn Sie ein Knowledge Studio-Modell in Discoveryimportieren, dann werden alle im Modell definierten Subtypen als Erwähnungen des übergeordneten Entitätstyps identifiziert. Die Subtypentitäten selbst werden nicht beibehalten. Um die Subtypinformationen beizubehalten, müssen Sie Ihr Typsystem vereinfachen, indem Sie Entitätssubtypen in neue Entitätstypen auf Stammebene konvertieren.
Führen Sie diese Schritte nur aus, wenn Sie sicher sind, dass die Untertypunterscheidungen dem Modell einen signifikanten Wert verleihen. In vielen Anwendungsfällen ist die Verwendung der Entitätstypen auf Stammebene ausreichend.
Sie können diese Prozedur nicht verwenden, um Subtypen beizubehalten, wenn Dokumente in Ihrem Korpus mit dem Service Natural Language Understanding vorannotiert wurden. Stellen Sie sicher, dass Ihr abgeflachtes Typsystem die zulässige Anzahl von Entitätstypen für Ihren Plan nicht überschreitet. Weitere Informationen finden Sie unter Entity extractor limits.
Ihr Modell kann beispielsweise Entitätstypen mit der folgenden Hierarchie enthalten:
APPLIANCES
FURNITURE
PATIO
LIVING
DINING
Eine vereinfachte Version des Typs 'sytem' sieht wie folgt aus:
APPLIANCES
FURNITURE_NONE
FURNITURE_PATIO
FURNITURE_LIVING
FURNITURE_DINING
Ein nützlicher Ansatz zur Vereinfachung des Typsystems umfasst die folgenden Änderungen:
- Fügen Sie die Bezeichnung des übergeordneten Entitätstyps (
FURNITURE) als Präfix zur Bezeichnung jedes untergeordneten Subtyps hinzu, um eine neue Entität auf Stammebene zu erzeugen, die die hierarchische Beziehung in ihrer Bezeichnung beibehält. Beispiel:FURNITURE_PATIO,FURNITURE_LIVINGundFURNITURE_DINING. - Hängen Sie das Wort NONE an die übergeordnete Entitätsbeschriftung auf Stammebene an, um es als übergeordnetes Element anzugeben. Beispiel:
FURNITURE_NONE. - Behalten Sie die Bezeichnungen von Entitätstypen bei, die keine untergeordneten Typen unverändert haben. Beispielsweise ändert sich die Bezeichnung
APPLIANCESnicht.
Führen Sie die folgenden Schritte aus, um Informationen zum Entitätssubtyp beizubehalten:
-
Stellen Sie sicher, dass die Annotation und das Training des Knowledge Studio-Modells abgeschlossen sind und das Modell bereitgestellt werden kann.
-
Exportieren Sie das Typsystem, das zum Annotieren der Dokumente in Ihrem Korpus verwendet wurde, aus Knowledge Studio als JSON-Datei.
Führen Sie die entsprechenden Schritte zum Exportieren basierend auf Ihrem Knowledge Studio-Bereitstellungstyp aus:
- IBM CloudRessourcen aus einem anderen Arbeitsbereich hochladen
- IBM Cloud Pak for DataIBM Software HubHochladen von Ressourcen aus einem anderen Arbeitsbereich
-
Ändern Sie die JSON-Datei des Typsystems. Fügen Sie für jeden Subtyp einen neuen Entitätstyp auf Stammebene hinzu.
Das ursprüngliche Typsystem kann beispielsweise die folgenden Typen enthalten:
{ "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20", "label":"FURNITURE", "sireProp":{ "mentionType":null, "subtypes":["PATIO","LIVING","DINING"], "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"], "clazz":null, "color":"black", "hotkey":"m", "backGroundColor":"#00FFFF", "active":true, "roleOnly":false}, "creationDate":1610611788484, "source":null, "modifiedDate":0, "typeType":null, "typeClass":null, "typeVersion":null, "typeDesc":null, "typeSuperType":null, "typeSuperTypeId":null, "typeCreateDate":null, "typeUpdateDate":null, "typeProvenance":null, "alchemyAPITypes":null, "nluAPITypes":null},Nehmen Sie die folgende Änderung vor, um die Subtypen in neue Typen auf Stammebene zu konvertieren:
{ "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20", "label":"FURNITURE_NONE", "sireProp":{ "mentionType":null, "subtypes":null, "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"], "clazz":null, "and so on" } }, { "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20", "label":"FURNITURE_PATIO", "sireProp":{ "mentionType":null, "subtypes":null, "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"], "clazz":null, "and so on" } }, { "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20", "label":"FURNITURE_LIVING", "sireProp":{ "mentionType":null, "subtypes":null, "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"], "clazz":null, "and so on" } }, { "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20", "label":"FURNITURE_DINING", "sireProp":{ "mentionType":null, "subtypes":null, "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"], "clazz":null, "and so on" } }, -
Weisen Sie jedem neuen Entitätstyp auf Stammebene eine eindeutige ID zu.
-
Exportieren Sie das Korpus für Ihr Machine Learning-Modell aus Knowledge Studio als komprimierte Datei.
Führen Sie die entsprechenden Schritte zum Exportieren basierend auf Ihrem Knowledge Studio-Bereitstellungstyp aus:
- IBM CloudRessourcen aus einem anderen Arbeitsbereich hochladen
- IBM Cloud Pak for DataIBM Software HubHochladen von Ressourcen aus einem anderen Arbeitsbereich
-
Aktualisieren Sie im heruntergeladenen Korpus für alle Erwähnungen mit einem definierten Subtyp die Typinformationen für die Erwähnung, um den neuen Entitätstyp auf Stammebene anzugeben.
Das ursprüngliche Typsystem kann beispielsweise die Erwähnung des Subtyps
PATIOenthalten:{ "id" : "Blogs_shopper.com_dc5cf4764d91f87575b17ac8a5268462.en-M92", "source" : "IMPORT", "properties" : { "SIRE_ENTITY_CLASS" : "SPC", "SIRE_MENTION_CLASS" : "SPC", "SIRE_ENTITY_LEVEL" : "NONE", "SIRE_ENTITY_SUBTYPE" : "PATIO", "SIRE_MENTION_ROLE" : "FURNITURE", "SIRE_MENTION_TYPE" : "NONE" }, "type" : "FURNITURE", "begin" : 3221, "end" : 3234, "inCoref" : false },Ersetzen Sie den Wert von
SIRE_MENTION_ROLEundtypefür die Erwähnung durch die neue Entitätsbezeichnung auf Stammebene, z. B.FURNITURE_PATIO. Geben SieNONEals Wert fürSIRE_ENTITY_SUBTYPEan.{ "id" : "Blogs_shopper.com_dc5cf4764d91f87575b17ac8a5268462.en-M92", "source" : "IMPORT", "properties" : { "SIRE_ENTITY_CLASS" : "SPC", "SIRE_MENTION_CLASS" : "SPC", "SIRE_ENTITY_LEVEL" : "NONE", "SIRE_ENTITY_SUBTYPE" : "NONE", "SIRE_MENTION_ROLE" : "FURNITURE_PATIO", "SIRE_MENTION_TYPE" : "NONE" }, "type" : "FURNITURE_PATIO", "begin" : 3221, "end" : 3234, "inCoref" : false },Vergessen Sie nicht, die Bezeichnungen der übergeordneten Erwähnungen umzubenennen.
Suchen Sie beispielsweise nach Erwähnungen, die
"SIRE_ENTITY_SUBTYPE" : "OTHER"angeben, und ändern Sie dann den Wert vonOTHERinNONE.Ändern Sie den Wert von
SIRE_MENTION_ROLEundtypefür die Erwähnung in die Bezeichnung des neuen übergeordneten Entitätstyps.Ändern Sie beispielsweise die Werte
SIRE_MENTION_ROLEundtypefür diese Erwähnungen vonFURNITUREinFURNITURE_NONEundSIRE_ENTITY_SUBTYPEinNONE.{ "id" : "Sports_herald.com_be99aca94a7cff5abb74476b844a11b6.en-M75", "source" : "IMPORT", "properties" : { "SIRE_MENTION_CLASS" : "SPC", "SIRE_ENTITY_LEVEL" : "NONE", "SIRE_ENTITY_SUBTYPE" : "NONE", "SIRE_ENTITY_CLASS" : "SPC", "SIRE_MENTION_TYPE" : "NONE", "SIRE_MENTION_ROLE" : "FURNITURE_NONE" }, "type" : "FURNITURE_NONE", "begin" : 2063, "end" : 2071, "inCoref" : false }, -
Fügen Sie Annotationen für Beziehungen hinzu, die auf der Basis der neuen abgewickelten Entitätstypen fehlen.
-
Erstellen Sie einen Arbeitsbereich Knowledge Studio und laden Sie dann das konvertierte Typsystem hoch.
Führen Sie die entsprechenden Schritte zum Hochladen eines Typsystems basierend auf Ihrem Bereitstellungstyp Knowledge Studio aus:
- IBM CloudTypsystem zum Arbeitsbereich hinzufügen
- IBM Cloud Pak for DataIBM Software HubHinzufügen eines Typsystems zum Arbeitsbereich
-
Laden Sie die annotierten Dokumente in den Arbeitsbereich hoch. Behalten Sie die ursprüngliche Dateistruktur der exportierten Daten bei. Stellen Sie sicher, dass die komprimierte Datei beispielsweise dasselbe Stammverzeichnis wie die ursprünglich exportierte Datei hat.
Führen Sie die entsprechenden Schritte zum Hochladen von Dokumenten basierend auf Ihrem Knowledge Studio-Bereitstellungstyp aus:
- IBM CloudDokumente zu einem Arbeitsbereich hinzufügen
- IBM Cloud Pak for DataIBM Software HubHinzufügen von Dokumenten zu einem Arbeitsbereich
-
Klicken Sie in Knowledge Studioauf Trainieren, um das Modell erneut zu trainieren.
Weitere Informationen finden Sie unter dem für Ihren Einsatztyp zutreffenden Thema:
- IBM CloudModell für maschinelles Lernen trainieren
- IBM Cloud Pak for DataIBM Software HubTraining des maschinellen Lernmodells
-
Jetzt können Sie das Modell aus Knowledge Studio exportieren und in Discovery importieren, um es als Aufbereitung für maschinelles Lernen zu verwenden.
Weitere Informationen finden Sie unter Importierte ML-Modelle zum Suchen nach angepassten Begriffen verwenden.