Gestión de modelos de lenguaje personalizado

La interfaz de personalización incluye el método POST /v1/customizations para la creación de un modelo de lenguaje personalizado. La interfaz también incluye el método POST /v1/customizations/train para entrenar un modelo personalizado con los datos más recientes de su recurso de palabras. Para obtener más información, consulte

La interfaz también incluye métodos para listar información sobre modelos de idioma personalizados, restablecer un modelo personalizado a su estado inicial, actualizar un modelo personalizado y suprimir un modelo personalizado. No puede entrenar, restablecer, actualizar o suprimir un modelo personalizado mientras el servicio está gestionando otra operación en ese modelo, incluida la adición de recursos al modelo.

Listado de modelos de lenguaje personalizado

La interfaz de personalización proporciona dos métodos para ver información acerca de los modelos de lenguaje personalizado propiedad de las credenciales especificadas:

  • El método GET /v1/customizations lista información sobre todos los modelos de idioma personalizados o, si especifica el parámetro language, sobre todos los modelos de idioma personalizados para el idioma especificado. Si especifica un idioma, utilice el identificador de idioma del nombre del modelo base, por ejemplo, en-US para un modelo inglés de EE.UU.
  • El método GET /v1/customizations/{customization_id} muestra información sobre un modelo de lenguaje personalizado especificado. Utilice este método para sondear el servicio sobre el estado de una solicitud de entrenamiento o de una solicitud para añadir palabras nuevas.

Ambos métodos devuelven la información siguiente acerca de un modelo personalizado:

  • customization_id identifica el GUID (identificador global exclusivo) del modelo personalizado. El GUID sirve para identificar el modelo en los métodos de la interfaz.
  • created es la fecha y la hora en Hora Universal Coordinada (UTC) en que se ha creado el modelo personalizado.
  • updated es la fecha y la hora en Hora Universal Coordinada (UTC) en que se ha actualizado el modelo personalizado.
  • language es el idioma del modelo personalizado. El valor coincide con el identificador de idioma del nombre del modelo base. Por ejemplo, en-US para un modelo de idioma inglés de EE.UU.
  • dialect es el dialecto del idioma para el modelo personalizado, que no coincide necesariamente con el idioma del modelo personalizado para los modelos en español de la generación anterior. Para obtener más información, consulte la descripción del campo dialect en Crear un modelo de idioma personalizado.
  • owner identifica las credenciales de la instancia de servicio propietaria del modelo personalizado.
  • name es el nombre del modelo personalizado.
  • description muestra la descripción del modelo personalizado, si se ha especificada una al crearlo.
  • base_model indica el nombre del modelo de lenguaje para el que se ha creado el modelo personalizado.
  • versions proporciona una lista de las versiones disponibles del modelo personalizado. Cada elemento de la matriz indica una versión del modelo base con la que se puede utilizar el modelo personalizado. Existen varias versiones sólo si el modelo personalizado se actualiza a una nueva versión de su modelo base. De lo contrario, solo se muestra una versión. Para obtener más información, consulte Listado de información de versión para un modelo personalizado.

El método también devuelve un campo status que indica el estado del modelo personalizado:

  • pending indica que el modelo se ha creado. Está esperando que se añadan datos de entrenamiento válidos (corpus, palabras o gramáticas) o que el servicio termine de analizar los datos que se han añadido.
  • ready indica que el modelo contiene datos válidos y que está listo para ser entrenado. Si el modelo contiene una mezcla de recursos válidos y no válidos, el entrenamiento del modelo falla a menos que establezca el parámetro de consulta strict en false. Para obtener más información, consulte Errores de entrenamiento.
  • training indica que el modelo se está entrenando con los datos.
  • available indica que el modelo se ha entrenado y está preparado para que se utilice con una solicitud de reconocimiento.
  • upgrading indica que el modelo se está actualizando.
  • failed indica que el entrenamiento del modelo ha fallado. Examine las palabras del recurso de palabras del modelo para determinar los errores que han impedido que el modelo se entrene.

Además, la salida incluye un campo progress que indica el estado del entrenamiento de un modelo personalizado. Si ha utilizado el método POST /v1/customizations/{customization_id}/train para entrenar correctamente el modelo, este campo tiene un valor de 100. Si el modelo no está completamente formado y available, el campo tiene un valor de 0.

Cuando supervises la formación o la actualización de un modelo personalizado, consulta el valor del campo status, no el valor del campo progress. Si la operación falla por cualquier motivo, el valor del campo status cambia para reflejar el fallo; el valor del campo progress permanece 0.

Ejemplo de lista de todos los modelos de idioma personalizados

El ejemplo siguiente incluye el parámetro de consulta language para ver todos los modelos de lenguaje personalizados en inglés de Estados Unidos que son propiedad de las credenciales especificadas:

IBM Cloud

curl -X GET -u "apikey:{apikey}" \
"{url}/v1/customizations?language=en-US"

IBM Cloud Pak for Data IBM Software Hub

curl -X GET \
--header "Authorization: Bearer {token}" \
"{url}/v1/customizations?language=en-US"

Las credenciales poseen dos modelos de este tipo. El primer modelo está a la espera de datos o está siendo procesado por el servicio. El segundo modelo está completamente entrenado y listo para utilizarse. Ambos modelos personalizados se basan en modelos de generación anterior; el primer modelo personalizado tiene dos versiones disponibles.

{
  "customizations": [
    {
      "customization_id": "74f4807e-b5ff-4866-824e-6bba1a84fe96",
      "created": "2016-06-01T14:21:26.894Z",
      "updated": "2020-01-18T18:42:25.324Z",
      "language": "en-US",
      "dialect": "en-US",
      "versions": [
        "en-US_BroadbandModel.v2018-07-31",
        "en-US_BroadbandModel.v2020-01-16"
      ],
      "owner": "297cfd08-330a-22ba-93ce-1a73f454dd98",
      "name": "Example model",
      "description": "Example custom language model",
      "base_model_name": "en-US_BroadbandModel",
      "status": "pending",
      "progress": 0
    },
    {
      "customization_id": "8391f918-3b76-e109-763c-b7732fae4829",
      "created": "2017-12-02T18:51:37.291Z",
      "updated": "2017-12-02T20:02:10.624Z",
      "language": "en-US",
      "dialect": "en-US",
      "versions": [
        "en-US_BroadbandModel.v2017-11-15"
      ],
      "owner": "297cfd08-330a-22ba-93ce-1a73f454dd98",
      "name": "Example model two",
      "description": "Example custom language model two",
      "base_model_name": "en-US_BroadbandModel",
      "status": "available",
      "progress": 100
    }
  ]
}

Listar un ejemplo de modelo de idioma personalizado específico

En el ejemplo siguiente se devuelve información sobre el modelo personalizado que tiene el ID de personalización especificado:

IBM Cloud

curl -X GET -u "apikey:{apikey}" \
"{url}/v1/customizations/{customization_id}"

IBM Cloud Pak for Data IBM Software Hub

curl -X GET \
--header "Authorization: Bearer {token}" \
"{url}/v1/customizations/{customization_id}"

La respuesta duplica la información del ejemplo anterior:

{
  "customization_id": "74f4807e-b5ff-4866-824e-6bba1a84fe96",
  "created": "2016-06-01T14:21:26.894Z",
  "updated": "2020-01-18T18:42:25.324Z",
  "language": "en-US",
  "dialect": "en-US",
  "versions": [
    "en-US_BroadbandModel.v2018-07-31",
    "en-US_BroadbandModel.v2020-01-16"
  ],
  "owner": "297cfd08-330a-22ba-93ce-1a73f454dd98",
  "name": "Example model",
  "description": "Example custom language model",
  "base_model_name": "en-US_BroadbandModel",
  "status": "pending",
  "progress": 0
}

Restablecimiento de un modelo de lenguaje personalizado

Utilice el método POST /v1/customizations/{customization_id}/reset para restablecer un modelo personalizado. Cuando se restablece un modelo, se eliminan todos los corpus y todas las palabras del modelo y se inicializa el modelo con su estado en el momento de la creación. El método no suprime el propio modelo ni los metadatos, como por ejemplo su nombre y su idioma. Sin embargo, cuando se restablece un modelo, su recurso de palabras está vacío y se debe volver a crear añadiendo corpus y palabras.

Restablecer un ejemplo de modelo de idioma personalizado

En el ejemplo siguiente se restablece el modelo personalizado con el ID de personalización especificado:

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
"{url}/v1/customizations/{customization_id}/reset"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
"{url}/v1/customizations/{customization_id}/reset"

Supresión de un modelo de lenguaje personalizado

Utilice el método DELETE /v1/customizations/{customization_id} para suprimir un modelo de lenguaje personalizado que ya no necesita. El método suprime todos los corpus y todas las palabras que están asociados con el modelo personalizado y el propio modelo. Utilice este método con precaución: un modelo personalizado y sus datos no se pueden recuperar después de suprimir el modelo.

Ejemplo de supresión de un modelo de idioma personalizado

En el ejemplo siguiente se suprime el modelo personalizado con el ID de personalización especificado:

IBM Cloud

curl -X DELETE -u "apikey:{apikey}" \
"{url}/v1/customizations/{customization_id}"

IBM Cloud Pak for Data IBM Software Hub

curl -X DELETE \
--header "Authorization: Bearer {token}" \
"{url}/v1/customizations/{customization_id}"