검색 서비스를 위한 AI 모델 구성
검색 서비스는 관리자가 텍스트-SQL 변환, 질문 답변, RAG(Retrieval-Assisted watsonx.data Generation)와 같은 검색 기반 작업을 구동하는 파운데이션 모델을 구성할 수 있도록 합니다. 인스턴스 수준에서는 라이선스 및 워크로드 요구 사항에 따라 Granite(기본값), Llama 및 GPT 모델 중에서 선택할 수 있습니다.
프로시저
-
watsonx.data 콘솔에 로그인하십시오.
-
탐색 메뉴에서 구성 (Configurations)을 선택하고 검색 서비스 모델(Retrieval service model) 타일을 클릭합니다.
-
검색 서비스 섹션에서 다음 사용 가능한 AI 모델 중 하나를 선택하십시오:
- granite-3-8b-instruct
- llama-3-3-70b-instruct
- gpt-oss-120b
검색 서비스와 함께 gpt-oss-120b 사용하려면 먼저 토론토 리전에 모델을 배포해야 합니다. 자세한 지침은 '요청 시 파운데이션 모델 배포(빠른 경로) '를 참조하십시오. -
확인 대화 상자가 나타납니다. 선택을 클릭하십시오.
-
텍스트를 SQL로 변환에서 다음 사용 가능한 AI 모델 중 하나를 선택하세요:
- granite-3-8b-instruct
- llama-3-3-70b-instruct
-
확인 대화 상자가 나타납니다. 선택을 클릭하십시오.