Configurar modelo de IA para serviço de recuperação

O Serviço de Recuperação no watsonx.data permite que os administradores configurem qual modelo básico alimenta tarefas baseadas em recuperação, como texto para SQL, resposta a perguntas e RAG. No nível da instância, você pode escolher entre os modelos granite (padrão), llama e gpt, com base nos requisitos de licenciamento e carga de trabalho.

Procedimento

  1. Efetue login no console do watsonx.data.

  2. No menu de navegação, selecione Configurações e clique no bloco Modelo de serviço de recuperação.

  3. Na seção Serviço de recuperação, escolha um dos seguintes modelos de IA disponíveis:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
    • gpt-oss-120b


    Para usar gpt-oss-120b com o Serviço de Recuperação, você deve primeiro implantar o modelo na região de Toronto. Para obter instruções detalhadas, consulte Implantação de modelos básicos sob demanda(caminho rápido).

  4. Aparece uma caixa de diálogo de confirmação, clique em Selecionar.

  5. Em Texto para SQL, escolha um dos seguintes modelos de IA disponíveis:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
  6. Aparece uma caixa de diálogo de confirmação, clique em Selecionar.