Configurar modelo de IA para serviço de recuperação
O Serviço de Recuperação no watsonx.data permite que os administradores configurem qual modelo básico alimenta tarefas baseadas em recuperação, como texto para SQL, resposta a perguntas e RAG. No nível da instância, você pode escolher entre os modelos granite (padrão), llama e gpt, com base nos requisitos de licenciamento e carga de trabalho.
Procedimento
-
Efetue login no console do watsonx.data.
-
No menu de navegação, selecione Configurações e clique no bloco Modelo de serviço de recuperação.
-
Na seção Serviço de recuperação, escolha um dos seguintes modelos de IA disponíveis:
- granite-3-8b-instruct
- llama-3-3-70b-instruct
- gpt-oss-120b
Para usar gpt-oss-120b com o Serviço de Recuperação, você deve primeiro implantar o modelo na região de Toronto. Para obter instruções detalhadas, consulte Implantação de modelos básicos sob demanda(caminho rápido). -
Aparece uma caixa de diálogo de confirmação, clique em Selecionar.
-
Em Texto para SQL, escolha um dos seguintes modelos de IA disponíveis:
- granite-3-8b-instruct
- llama-3-3-70b-instruct
-
Aparece uma caixa de diálogo de confirmação, clique em Selecionar.