Configurar el modelo de IA para el servicio de recuperación
El servicio de recuperación en watsonx.data permite a los administradores configurar qué modelo base impulsa las tareas basadas en la recuperación, como texto a SQL, respuesta a preguntas y RAG. A nivel de instancia, puede elegir entre los modelos Granite (predeterminado), Llama y GPT, en función de los requisitos de licencia y carga de trabajo.
Procedimiento
-
Inicie una sesión en la consola de watsonx.data.
-
En el menú de navegación, seleccione Configuraciones y haga clic en el mosaico Modelo de servicio de recuperación.
-
En la sección Servicio de recuperación, elija uno de los siguientes modelos de IA disponibles:
- granite-3-8b-instruct
- llama-3-3-70b-instruct
- gpt-oss-120b
Para utilizar gpt-oss-120b el servicio de recuperación, primero debe implementar el modelo en la región de Toronto. Para obtener instrucciones detalladas, consulte Implementación de modelos básicos bajo demanda(ruta rápida). -
Aparecerá un cuadro de diálogo de confirmación, haga clic en Seleccionar.
-
En Texto a SQL, elija uno de los siguientes modelos de IA disponibles:
- granite-3-8b-instruct
- llama-3-3-70b-instruct
-
Aparecerá un cuadro de diálogo de confirmación, haga clic en Seleccionar.