검색 서비스를 위한 AI 모델 구성

검색 서비스는 관리자가 텍스트-SQL 변환, 질문 답변, RAG(Retrieval-Assisted watsonx.data Generation)와 같은 검색 기반 작업을 구동하는 파운데이션 모델을 구성할 수 있도록 합니다. 인스턴스 수준에서는 라이선스 및 워크로드 요구 사항에 따라 Granite(기본값), Llama 및 GPT 모델 중에서 선택할 수 있습니다.

프로시저

  1. watsonx.data 콘솔에 로그인하십시오.

  2. 탐색 메뉴에서 구성 (Configurations)을 선택하고 검색 서비스 모델(Retrieval service model) 타일을 클릭합니다.

  3. 검색 서비스 섹션에서 다음 사용 가능한 AI 모델 중 하나를 선택하십시오:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
    • gpt-oss-120b


    검색 서비스와 함께 gpt-oss-120b 사용하려면 먼저 토론토 리전에 모델을 배포해야 합니다. 자세한 지침은 '요청 시 파운데이션 모델 배포(빠른 경로) '를 참조하십시오.

  4. 확인 대화 상자가 나타납니다. 선택을 클릭하십시오.

  5. 텍스트를 SQL로 변환에서 다음 사용 가능한 AI 모델 중 하나를 선택하세요:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
  6. 확인 대화 상자가 나타납니다. 선택을 클릭하십시오.