Knowledge Studio-Lösungen migrieren

Verwenden Sie angepasste Modelle und andere Ressourcen, die Sie in Knowledge Studio erstellt haben, indem Sie sie auf Discoverymigrieren.

Modell unverändert verwenden

Um sofort mit der Verwendung Ihres Knowledge Studio-Modells zu beginnen, exportieren Sie das Modell aus Knowledge Studio und importieren Sie es in Discovery als Aufbereitung für maschinelles Lernen.

Wenn Sie ein Knowledge Studio-Modell importieren, um es unverändert in Discoveryzu verwenden, können im Modell definierte Entitätstypen auf Stammebene erkannt werden, wenn sie in Ihren Dokumenten auftreten. Alle Erwähnungen von Entitätsuntertypen, die auftreten, werden als Erwähnungen des übergeordneten Entitätstyps identifiziert. Die Subtypentitäten selbst werden nicht beibehalten. Wenn das Modell weiterhin zwischen verschiedenen Subtypen einer Entität unterscheiden soll, müssen Sie zusätzliche Schritte ausführen. Weitere Informationen finden Sie unter Subtypinformationen erhalten.

Sie können nicht mit der Aktualisierung eines Modells fortfahren, das Sie als ML-Aufbereitung importieren.

Die folgenden Modelltypen können unverändert importiert und verwendet werden:

  • In Knowledge Studio erstellte regelbasierte Modelle, die Entitäten in Dokumenten anhand von Regeln finden, die Sie definieren. (Dateiformat: .pear)
  • In Knowledge Studio erstellte Modelle für maschinelles Lernen, die die sprachlichen Nuancen, Bedeutungen und Beziehungen verstehen, die für Ihre Branche spezifisch sind (Dateiformat: .zip)

Welche Modelle Sie hinzufügen können, hängt von Ihrem Bereitstellungstyp ab:

  • IBM Cloud Sie können nur Modelle hinzufügen, die mit einer IBM Watson® Knowledge Studio-Instanz erstellt wurden, die in IBM Cloud gehostet wird.
  • IBM Cloud Pak for DataIBM Software Hub Sie können Modelle hinzufügen, die mit einer Instanz von IBM Watson® Knowledge Studio erstellt wurden, die auf IBM Cloud Pak® for Data oder IBM Cloud gehostet wird.

Weitere Informationen finden Sie unter Importierte ML-Modelle zum Suchen nach angepassten Begriffen verwenden.

Korpus als Trainingsdaten verwenden

Discovery verfügt über ein Entitätsextraktionstool, mit dem Sie ein Typsystem definieren können. Die Benutzerschnittstelle des Entitätsextraktionsprogramms ähnelt der Benutzerschnittstelle von Knowledge Studio, die zum Annotieren von Dokumenten verwendet wird, die Sie zum Korpus eines Modells für maschinelles Lernen hinzufügen. In Knowledge Studiodefinieren Sie jedoch nur Entitäten auf Stammebene, keine Subtypen oder Beziehungen.

Als Alternative zum Importieren eines Knowledge Studio-Modells und zum Anwenden als Aufbereitung können Sie auch ein Knowledge Studio-Korpus importieren. Wenn Sie ein Knowledge Studio-Korpus zum Entitätsextraktionstool Discovery hinzufügen, werden alle Entitäten auf Stammebene aus dem Korpus als neue Entitäten im Arbeitsbereich des Entitätsextraktionsprogramms Discovery dargestellt. Entitätssubtypen werden nicht erkannt. Sie können jedoch zusätzliche Schritte ausführen, um Subtypinformationen aufzubewahren.

Beziehungen und Koreferenzen aus dem Modell für maschinelles Lernen Knowledge Studio werden nicht dargestellt. Es sind auch keine benutzerdefinierten Wörterverzeichnisse vorhanden, die dem Modell zugeordnet sind.

Beachten Sie Folgendes, wenn Sie auswählen, ob ein Modell oder ein Korpus importiert werden soll:

  • Sie können mit der Bearbeitung des Typsystems fortfahren, wenn Sie das Korpus importieren. Wenn Sie ein trainiertes Modell importieren, können Sie es anschließend nicht in Discoverybearbeiten.
  • Ein importiertes Modell, das Sie als Aufbereitung auf eine Objektgruppe anwenden, kann alle Entitätssubtypen, Beziehungen und Koreferenzinformationen erkennen, für die das ursprüngliche Modell zusätzlich zu den Entitäten auf Stammebene trainiert wurde. Eine Entitätsextraktoraufbereitung kann nur Entitäten suchen und taggen.

Weitere Informationen finden Sie unter Knowledge Studio-Korpus importieren.

Subtypinformationen beibehalten

Wenn Sie ein Knowledge Studio-Modell in Discoveryimportieren, dann werden alle im Modell definierten Subtypen als Erwähnungen des übergeordneten Entitätstyps identifiziert. Die Subtypentitäten selbst werden nicht beibehalten. Um die Subtypinformationen beizubehalten, müssen Sie Ihr Typsystem vereinfachen, indem Sie Entitätssubtypen in neue Entitätstypen auf Stammebene konvertieren.

Führen Sie diese Schritte nur aus, wenn Sie sicher sind, dass die Untertypunterscheidungen dem Modell einen signifikanten Wert verleihen. In vielen Anwendungsfällen ist die Verwendung der Entitätstypen auf Stammebene ausreichend.

Sie können diese Prozedur nicht verwenden, um Subtypen beizubehalten, wenn Dokumente in Ihrem Korpus mit dem Service Natural Language Understanding vorannotiert wurden. Stellen Sie sicher, dass Ihr abgeflachtes Typsystem die zulässige Anzahl von Entitätstypen für Ihren Plan nicht überschreitet. Weitere Informationen finden Sie unter Entity extractor limits.

Ihr Modell kann beispielsweise Entitätstypen mit der folgenden Hierarchie enthalten:

APPLIANCES
FURNITURE
  PATIO
  LIVING
  DINING

Eine vereinfachte Version des Typs 'sytem' sieht wie folgt aus:

APPLIANCES
FURNITURE_NONE
FURNITURE_PATIO
FURNITURE_LIVING
FURNITURE_DINING

Ein nützlicher Ansatz zur Vereinfachung des Typsystems umfasst die folgenden Änderungen:

  • Fügen Sie die Bezeichnung des übergeordneten Entitätstyps (FURNITURE) als Präfix zur Bezeichnung jedes untergeordneten Subtyps hinzu, um eine neue Entität auf Stammebene zu erzeugen, die die hierarchische Beziehung in ihrer Bezeichnung beibehält. Beispiel: FURNITURE_PATIO, FURNITURE_LIVING und FURNITURE_DINING.
  • Hängen Sie das Wort NONE an die übergeordnete Entitätsbeschriftung auf Stammebene an, um es als übergeordnetes Element anzugeben. Beispiel: FURNITURE_NONE.
  • Behalten Sie die Bezeichnungen von Entitätstypen bei, die keine untergeordneten Typen unverändert haben. Beispielsweise ändert sich die Bezeichnung APPLIANCES nicht.

Führen Sie die folgenden Schritte aus, um Informationen zum Entitätssubtyp beizubehalten:

  1. Stellen Sie sicher, dass die Annotation und das Training des Knowledge Studio-Modells abgeschlossen sind und das Modell bereitgestellt werden kann.

  2. Exportieren Sie das Typsystem, das zum Annotieren der Dokumente in Ihrem Korpus verwendet wurde, aus Knowledge Studio als JSON-Datei.

    Führen Sie die entsprechenden Schritte zum Exportieren basierend auf Ihrem Knowledge Studio-Bereitstellungstyp aus:

  3. Ändern Sie die JSON-Datei des Typsystems. Fügen Sie für jeden Subtyp einen neuen Entitätstyp auf Stammebene hinzu.

    Das ursprüngliche Typsystem kann beispielsweise die folgenden Typen enthalten:

    {
      "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20",
      "label":"FURNITURE",
      "sireProp":{
        "mentionType":null,
        "subtypes":["PATIO","LIVING","DINING"],
        "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"],
        "clazz":null,
        "color":"black",
        "hotkey":"m",
        "backGroundColor":"#00FFFF",
        "active":true,
        "roleOnly":false},
        "creationDate":1610611788484,
        "source":null,
        "modifiedDate":0,
        "typeType":null,
        "typeClass":null,
        "typeVersion":null,
        "typeDesc":null,
        "typeSuperType":null,
        "typeSuperTypeId":null,
        "typeCreateDate":null,
        "typeUpdateDate":null,
        "typeProvenance":null,
        "alchemyAPITypes":null,
        "nluAPITypes":null},
    

    Nehmen Sie die folgende Änderung vor, um die Subtypen in neue Typen auf Stammebene zu konvertieren:

    {
      "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20",
      "label":"FURNITURE_NONE",
      "sireProp":{
        "mentionType":null,
        "subtypes":null,
        "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"],
        "clazz":null,
        "and so on"
        }
    },
    {
      "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20",
      "label":"FURNITURE_PATIO",
      "sireProp":{
        "mentionType":null,
        "subtypes":null,
        "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"],
        "clazz":null,
        "and so on"
        }
    },
    {
      "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20",
      "label":"FURNITURE_LIVING",
      "sireProp":{
        "mentionType":null,
        "subtypes":null,
        "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"],
        "clazz":null,
        "and so on"
        }
    },
    {
      "id":"b9d6caa2-90ac-47ff-91f6-2149b8ffcf20",
      "label":"FURNITURE_DINING",
      "sireProp":{
        "mentionType":null,
        "subtypes":null,
        "roles":["b9d6caa2-90ac-47ff-91f6-2149b8ffcf20","93ba1f27-173f-4714-b31e-77bdd8cb9932"],
        "clazz":null,
        "and so on"
        }
    },
    
  4. Weisen Sie jedem neuen Entitätstyp auf Stammebene eine eindeutige ID zu.

  5. Exportieren Sie das Korpus für Ihr Machine Learning-Modell aus Knowledge Studio als komprimierte Datei.

    Führen Sie die entsprechenden Schritte zum Exportieren basierend auf Ihrem Knowledge Studio-Bereitstellungstyp aus:

  6. Aktualisieren Sie im heruntergeladenen Korpus für alle Erwähnungen mit einem definierten Subtyp die Typinformationen für die Erwähnung, um den neuen Entitätstyp auf Stammebene anzugeben.

    Das ursprüngliche Typsystem kann beispielsweise die Erwähnung des Subtyps PATIO enthalten:

    {
      "id" : "Blogs_shopper.com_dc5cf4764d91f87575b17ac8a5268462.en-M92",
      "source" : "IMPORT",
      "properties" : {
        "SIRE_ENTITY_CLASS" : "SPC",
        "SIRE_MENTION_CLASS" : "SPC",
        "SIRE_ENTITY_LEVEL" : "NONE",
        "SIRE_ENTITY_SUBTYPE" : "PATIO",
        "SIRE_MENTION_ROLE" : "FURNITURE",
        "SIRE_MENTION_TYPE" : "NONE"
      },
      "type" : "FURNITURE",
      "begin" : 3221,
      "end" : 3234,
      "inCoref" : false
    },
    

    Ersetzen Sie den Wert von SIRE_MENTION_ROLE und type für die Erwähnung durch die neue Entitätsbezeichnung auf Stammebene, z. B. FURNITURE_PATIO. Geben Sie NONE als Wert für SIRE_ENTITY_SUBTYPE an.

    {
      "id" : "Blogs_shopper.com_dc5cf4764d91f87575b17ac8a5268462.en-M92",
      "source" : "IMPORT",
      "properties" : {
        "SIRE_ENTITY_CLASS" : "SPC",
        "SIRE_MENTION_CLASS" : "SPC",
        "SIRE_ENTITY_LEVEL" : "NONE",
        "SIRE_ENTITY_SUBTYPE" : "NONE",
        "SIRE_MENTION_ROLE" : "FURNITURE_PATIO",
        "SIRE_MENTION_TYPE" : "NONE"
      },
      "type" : "FURNITURE_PATIO",
      "begin" : 3221,
      "end" : 3234,
      "inCoref" : false
    },
    

    Vergessen Sie nicht, die Bezeichnungen der übergeordneten Erwähnungen umzubenennen.

    Suchen Sie beispielsweise nach Erwähnungen, die "SIRE_ENTITY_SUBTYPE" : "OTHER" angeben, und ändern Sie dann den Wert von OTHER in NONE.

    Ändern Sie den Wert von SIRE_MENTION_ROLE und type für die Erwähnung in die Bezeichnung des neuen übergeordneten Entitätstyps.

    Ändern Sie beispielsweise die Werte SIRE_MENTION_ROLE und type für diese Erwähnungen von FURNITURE in FURNITURE_NONE und SIRE_ENTITY_SUBTYPE in NONE.

    {
      "id" : "Sports_herald.com_be99aca94a7cff5abb74476b844a11b6.en-M75",
      "source" : "IMPORT",
      "properties" : {
        "SIRE_MENTION_CLASS" : "SPC",
        "SIRE_ENTITY_LEVEL" : "NONE",
        "SIRE_ENTITY_SUBTYPE" : "NONE",
        "SIRE_ENTITY_CLASS" : "SPC",
        "SIRE_MENTION_TYPE" : "NONE",
        "SIRE_MENTION_ROLE" : "FURNITURE_NONE"
      },
      "type" : "FURNITURE_NONE",
      "begin" : 2063,
      "end" : 2071,
      "inCoref" : false
    },
    
  7. Fügen Sie Annotationen für Beziehungen hinzu, die auf der Basis der neuen abgewickelten Entitätstypen fehlen.

  8. Erstellen Sie einen Arbeitsbereich Knowledge Studio und laden Sie dann das konvertierte Typsystem hoch.

    Führen Sie die entsprechenden Schritte zum Hochladen eines Typsystems basierend auf Ihrem Bereitstellungstyp Knowledge Studio aus:

  9. Laden Sie die annotierten Dokumente in den Arbeitsbereich hoch. Behalten Sie die ursprüngliche Dateistruktur der exportierten Daten bei. Stellen Sie sicher, dass die komprimierte Datei beispielsweise dasselbe Stammverzeichnis wie die ursprünglich exportierte Datei hat.

    Führen Sie die entsprechenden Schritte zum Hochladen von Dokumenten basierend auf Ihrem Knowledge Studio-Bereitstellungstyp aus:

  10. Klicken Sie in Knowledge Studioauf Trainieren, um das Modell erneut zu trainieren.

    Weitere Informationen finden Sie unter dem für Ihren Einsatztyp zutreffenden Thema:

  11. Jetzt können Sie das Modell aus Knowledge Studio exportieren und in Discovery importieren, um es als Aufbereitung für maschinelles Lernen zu verwenden.

    Weitere Informationen finden Sie unter Importierte ML-Modelle zum Suchen nach angepassten Begriffen verwenden.