配置检索服务的人工智能模型

检索服务允许 watsonx.data 管理员配置用于驱动基于检索的任务(如文本转SQL、问答和RAG)的基础模型。 在实例级别,您可以根据许可和工作负载需求,在花岗岩(默认)、羊驼和GPT模型之间进行选择。

过程

  1. 登录控制台 watsonx.data。

  2. 从导航菜单中选择“配置”,然后点击 “检索服务模型”磁贴。

  3. 检索服务部分,请选择以下可用的人工智能模型之一:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
    • gpt-oss-120b


    要使用 gpt-oss-120b 检索服务,您必须先在多伦多区域部署该模型。 有关详细说明,请参阅 《按需部署基础模型(快速路径)》

  4. 出现一个确认对话框,点击“选择”。

  5. “文本转SQL”下,选择以下可用的AI模型之一:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
  6. 出现一个确认对话框,点击“选择”。