Configurar el modelo de IA para el servicio de recuperación

El servicio de recuperación en watsonx.data permite a los administradores configurar qué modelo base impulsa las tareas basadas en la recuperación, como texto a SQL, respuesta a preguntas y RAG. A nivel de instancia, puede elegir entre los modelos Granite (predeterminado), Llama y GPT, en función de los requisitos de licencia y carga de trabajo.

Procedimiento

  1. Inicie una sesión en la consola de watsonx.data.

  2. En el menú de navegación, seleccione Configuraciones y haga clic en el mosaico Modelo de servicio de recuperación.

  3. En la sección Servicio de recuperación, elija uno de los siguientes modelos de IA disponibles:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
    • gpt-oss-120b


    Para utilizar gpt-oss-120b el servicio de recuperación, primero debe implementar el modelo en la región de Toronto. Para obtener instrucciones detalladas, consulte Implementación de modelos básicos bajo demanda(ruta rápida).

  4. Aparecerá un cuadro de diálogo de confirmación, haga clic en Seleccionar.

  5. En Texto a SQL, elija uno de los siguientes modelos de IA disponibles:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
  6. Aparecerá un cuadro de diálogo de confirmación, haga clic en Seleccionar.