Diese Dokumentation bezieht sich auf IBM Watson® Knowledge Studio on IBM Cloud®. Die Dokumentation für die Vorgängerversion von Knowledge Studio on IBM Marketplace kann über diesen Link aufgerufen werden.

Daten sichern und wiederherstellen

Wenn Sie einen Arbeitsbereich für Knowledge Studio sichern und wiederherstellen möchten, führen Sie die folgenden Tasks aus. Führen Sie diese Tasks auch aus, wenn Sie eine manuelle Datenmigration von einer Knowledge Studio-Instanz auf eine andere vornehmen möchten (z. B. bei der Migration von einer Instanz in IBM Marketplace auf eine Instanz in IBM Cloud).

Manuelle Datenmigration ist der Prozess, bei dem Ihre Daten von einer Instanz gesichert und in einer anderen Instanz wiederhergestellt werden.

Knowledge Studio unter IBM Cloud verwendet den Begriff Arbeitsbereich, während Knowledge Studio unter IBM Marketplace den Begriff Projekt verwendet. Beide Begriffe bezeichnen die gleiche Funktionalität. Der einzige Unterschied liegt in der verwendeten Terminologie.

Führen Sie die folgenden Schritte aus, um Ihre Daten zu sichern und wiederherzustellen:

  1. In Erfahrung bringen, welche Daten gesichert werden können
  2. Sicherung vorbereiten
  3. Artefakte aus der aktuellen Instanz herunterladen
  4. Arbeitsbereiche in der neuen Instanz erneut erstellen
  5. Arbeitsbereichsdaten wiederherstellen
  6. Modelle wiederherstellen
  7. Unvollständige Annotationstasks wiederherstellen

Diese Daten können gesichert werden

Die folgenden Artefakte können manuell gesichert und migriert werden:

  • Bearbeitbare Wörterverzeichnisse
  • Typsystem
  • Genehmigte Ground Truth-Dokumentgruppen

Die folgenden Artefakttypen können nicht manuell gesichert und migriert werden:

  • In Bearbeitung befindliche Dokumente der Annotationsbenutzer
  • Annotationstasks
  • Modelle und Snapshots
  • Schreibgeschützte Wörterverzeichnisse

Sicherung vorbereiten

Führen Sie die folgenden Schritte aus, um die Sicherung und Wiederherstellung Ihrer Daten vorzubereiten:

  1. Beenden Sie alle in Bearbeitung befindlichen Tasks in Ihrem Arbeitsbereich.

    • Beenden Sie alle in Bearbeitung befindlichen Annotationstasks. Nur Dokumente, die annotiert, beurteilt, genehmigt und in die Ground Truth hochgestuft wurden, können gesichert werden. Wenn Sie die Annotationstasks nicht beenden, gehen alle Ergebnisse der aktiven und nicht abgeschlossenen Annotationstasks verloren.

    • Wenn Sie Annotationstasks erstellt haben, um auszuführende Arbeiten zu überwachen, die erst nach der Wiederherstellung des Arbeitsbereichs begonnen bzw. ausgeführt werden, erstellen Sie eine Liste der ausstehenden Annotationstasks. Notieren Sie unbedingt die von Ihnen importierten Dokumentgruppen, die noch nicht zur Ground Truth hinzugefügt wurden. Notieren Sie außerdem, welche Personen Sie als Annotatorbenutzer für die einzelnen Dokumentgruppen zugeordnet haben. Nach der Wiederherstellung des Arbeitsbereichs müssen Sie diese Dokumentgruppen erneut hochladen und die Annotationstasks erneut erstellen.

  2. Tokenizer-Verwendung verstehen

    In Arbeitsbereichen für Machine Learning-Modelle wird standardmäßig der auf Machine Learning basierende Tokenizer verwendet. Wenn Sie einen wörterverzeichnisbasierten Tokenizer verwenden und aufgrund Ihrer speziellen Anforderungen beibehalten müssen, können Sie den Arbeitsbereich so konfigurieren, dass nach der Wiederherstellung der wörterverzeichnisbasierte Tokenizer verwendet wird. Weitere Informationen hierzu finden Sie unter Tokenizer.

  3. Modellressourcen verwalten

    Ihr Modell sowie die zugehörigen Versionen und Snapshot-Daten können nicht migriert werden. Die Ressourcen, die Sie zum Trainieren dieser Artefakte verwendet haben, können migriert werden (ausgenommen schreibgeschützte Wörterverzeichnisse). Daher können Sie nach der Migration das Modell erneut erstellen. Das Modell, das erstellt wird, führt dieselben Modelle aus, die Sie vor der Migration generiert haben. Sie verwenden die gleichen Ressourcen für das Training.

    Wenn Sie bereits über ein bereitgestelltes Modell verfügen und den Arbeitsbereich nach dem Sichern löschen möchten, heben Sie die Bereitstellung des Modells auf. Sie können das Modell erneut erstellen und implementieren, nachdem Sie den Arbeitsbereich aus der Sicherung wiederhergestellt haben. Informationen zum Aufheben der Bereitstellung von Modellen finden Sie unter Bereitstellung von Machine Learning-Modellen aufheben und Bereitstellung regelbasierter Modelle aufheben.

    Wenn Sie das Modell nicht aus der Implementierung zurückziehen, ist das Ergebnis ein verwaistes implementiertes Modell. Für verwaiste bereitgestellte Modelle fallen weiter Gebühren in Ihren Monatsrechnungen an.

  4. Informationen für schreibgeschützte Wörterverzeichnisse verwalten

    Schreibgeschützte Wörterverzeichnisse können nicht migriert werden. Stellen Sie fest, aus welcher Quelle das schreibgeschützte Wörterverzeichnis importiert wurde, damit es nach der Migration erneut in Ihren Arbeitsbereich hochgeladen werden kann.

  5. Erstellen Sie eine Liste der aktuellen Benutzerrollen.

    Dieser Schritt ist optional. Er wird normalerweise ausgeführt, wenn ein Arbeitsbereich über mehrere Instanzen migriert wird und der neue Arbeitsbereich mit dem ursprünglichen Arbeitsbereich identisch sein muss. Wenn Sie nur die Arbeitsbereichsdaten in einen neuen Arbeitsbereich migrieren möchten, können Sie diesen Schritt überspringen.

    Wenn Sie Arbeitsbereiche über mehrere Instanzen migrieren, sollten Sie in Betracht ziehen, eine Liste der Benutzer und ihrer Rollen für die Instanz zu erstellen, die Sie sichern möchten. Ein Benutzer mit der Rolle 'Administrator' kann die Liste von der Seite 'Benutzerkontoverwaltung' aus drucken. Nachdem die Arbeitsbereiche in der neuen Instanz erneut erstellt wurden, muss ein Benutzer mit der Rolle 'Administrator' die Benutzer hinzufügen und ihnen Rollen zuordnen.

    Weitere Informationen zu Rollen finden Sie in Benutzerrollen in Knowledge Studio.

  6. Arbeitsbereichsinformationen notieren

    Solange Sie noch Zugriff auf die aktuelle Instanz haben, notieren Sie die folgenden Informationen für jeden Arbeitsbereich, den Sie migrieren möchten:

    • Arbeitsbereichsname
    • Beschreibung des Arbeitsbereichs
    • Eigentümer des Arbeitsbereichs
    • Sprache
    • Falls nicht abgeschlossene Annotationstasks vorhanden sind (sie können nicht gesichert oder migriert werden), notieren Sie die Annotationsbenutzer, denen diese Tasks im Arbeitsbereich zugeordnet sind. Notieren Sie auch die Details der Annotationstasks (z. B. den Tasknamen, das Fälligkeitsdatum und welche Dokumentgruppen welchen Benutzern zugeordnet sind).

Artefakte herunterladen

Laden Sie für jeden Arbeitsbereich, den Sie migrieren möchten, die folgenden Artefakte herunter. Speichern Sie diese Artefakte an einer sicheren Position, aus der sie später in die neue Instanz hochgeladen werden können.

  • Typsystem

  • Wörterbücher

    Hinweis:

    • Nur bearbeitbare Wörterverzeichnisse werden heruntergeladen. Sie können keine schreibgeschützten Wörterverzeichnisse herunterladen.
    • Bei Wörterverzeichnissen werden Entitätstypzuordnungen nicht migriert. Nachdem Sie diese Artefakte wiederhergestellt haben, müssen Sie die Wörterverzeichnisse möglicherweise den Entitätstypen zuordnen.
  • Dokumente

    Informationen zum Herunterladen dieser Artefakte, damit sie in einen neuen Arbeitsbereich importiert werden können, finden Sie unter Ressourcen aus einem anderen Arbeitsbereich hochladen.

Arbeitsbereiche erneut erstellen

In diesem Schritt muss lediglich die Sprache mit der Einstellung des ursprünglichen (heruntergeladenen) Arbeitsbereichs übereinstimmen. Die übrigen Einstellungen können von den Einstellungen des ursprünglichen Arbeitsbereichs abweichen.

Erstellen Sie die einzelnen Arbeitsbereiche erneut, indem Sie die folgenden Informationen von der vorherigen Instanz in die neue kopieren:

  • Arbeitsbereichsname

  • Beschreibung des Arbeitsbereichs

  • Sprache der Dokumente (diese Einstellung muss mit der Einstellung im ursprünglichen Arbeitsbereich übereinstimmen)

  • Wenn Sie zuvor einen wörterverzeichnisbasierten Tokenizer im Arbeitsbereich verwendet haben und diesen aus gegebenem Anlass weiterhin verwenden möchten, müssen Sie bei der Erstellung des Arbeitsbereichs angeben, dass anstelle des Standard-Tokenizers der wörterverzeichnisbasierte Tokenizer verwendet werden soll. Weitere Informationen hierzu finden Sie unter Tokenizer.

    Um einen wörterverzeichnisbasierten Tokenizer zu verwenden, erweitern Sie den Abschnitt Erweiterte Optionen im Fenster 'Arbeitsbereich erstellen' (in IBM Marketplace das Fenster 'Arbeitsbereich erstellen') und ändern Sie die Einstellung für Tokenizer.

Arbeitsbereichsdaten wiederherstellen

Nachdem Sie die Arbeitsbereiche erneut erstellt haben, laden Sie die zuvor heruntergeladenen Artefakte hoch:

  1. Laden Sie das Typsystem aus der zuvor erstellten Typsystemsicherung hoch. Weitere Informationen finden Sie unter Ressourcen aus einem anderen Arbeitsbereich hochladen.

    Erst nach dem Hochladen des Typsystems können Sie andere Artefakte hochladen, die Sie aus der Sicherung des Arbeitsbereichs übernehmen möchten.

  2. Laden Sie die Wörterverzeichnisse aus der zuvor erstellten Sicherung der Wörterverzeichnisse hoch. Weitere Informationen finden Sie unter Ressourcen aus einem anderen Arbeitsbereich hochladen.

    Wenn in der vorherigen Version des Arbeitsbereichs schreibgeschützte Wörterverzeichnisse verwendet wurden, laden Sie sie aus der ursprünglichen Quelle erneut in diesen Arbeitsbereich hoch.

  3. Für Wörterverzeichnisvorannotatoren ordnen Sie die Wörterverzeichnisse einem Entitätstyp zu. Wörterverzeichnisse, für die keine Zuordnungen für Entitätstypen vorhanden sind, wenden keine Annotationen an, wenn Sie Dokumente vorab mit Annotationen versehen.

  4. Laden Sie die Dokumente, die Sie aus der vorherigen Version des Arbeitsbereichs heruntergeladen haben, in diese Version des Arbeitsbereichs hoch. Weitere Informationen finden Sie unter Ressourcen aus einem anderen Arbeitsbereich hochladen.

Modelle wiederherstellen

Jetzt sind alle Artefakte, die zum Trainieren des Modells in der vorherigen (gesicherten) Version des Arbeitsbereichs verwendet wurden, in der neuen Instanz verfügbar.

Führen Sie die folgenden Schritte aus, um ein Machine Learning-Modell, das Sie in der vorherigen Instanz bereitgestellt hatten, erneut bereitzustellen:

  1. Trainieren Sie das Machine Learning-Modell.

    Wenden Sie keine Vorannotationen auf die annotierten Dokumente an, die Sie in diesen Arbeitsbereich migriert haben. Andernfalls gehen alle Annotationen in den betreffenden Dokumenten verloren, die von Annotatorbenutzern hinzugefügt wurden.

  2. Stellen Sie das Modell erneut bereit, nachdem Sie es erstellt haben. Weitere Informationen finden Sie unter Machine Learning-Modell verwenden.

Führen Sie die folgenden Schritte aus, um ein regelbasiertes Modell erneut bereitzustellen, das Sie in der vorherigen Instanz bereitgestellt hatten:

  1. Regelbasiertes Modell erstellen.
  2. Regelbasiertes Modell bereitstellen.

Unvollständige Annotationstasks wiederherstellen

Wenn Sie im vorherigen Arbeitsbereich Annotationstasks erstellt hatten, die noch nicht abgeschlossen waren, führen Sie die folgenden Schritte aus, um die betreffenden Annotationstasks erneut zu erstellen:

  1. Laden Sie alle noch nicht annotierten Dokumente hoch, die Sie jedoch zur Ground Truth hinzufügen möchten, um das Modell zu verbessern.
  2. Erstellen Sie aus den neu importierten und nicht annotierten Dokumenten Annotationsgruppen.
  3. Erstellen Sie die Annotationstasks erneut. Weisen Sie den Tasks denselben Namen sowie ein geeignetes Fälligkeitsdatum zu und ordnen Sie Annotationsgruppen den gewünschten Annotatorbenutzern zu.