Mit watsonx Code Assistant Individuell mit einem lokalen IBM Granite

watsonx Code Assistant Einzelne

Einzelne Benutzer können über watsonx Code Assistant auf ein lokales Modell über Ollama zugreifen, eine weit verbreitete lokale Inferenzmaschine für große Sprachmodelle. Ollama umhüllt das zugrundeliegende Modellprojekt llama.cpp.

Um die Leistung zu steigern und den vollen Funktionsumfang für Ihr Unternehmen zu nutzen, stellen Sie eine Testversion von watsonx Code Assistant auf IBM Cloud bereit. Weitere Informationen finden Sie unter Einrichten Ihres watsonx Code Assistant Service in IBM Cloud.

Installieren Sie die Erweiterung watsonx Code Assistant

Sie können Ollama für die Verwendung in Microsoft Visual Studio Code einrichten.

Diese Einstellung ist für das Eclipse IDE-Plug-in nicht verfügbar. Es ist nur mit der Erweiterung Visual Studio Code verfügbar.

  1. Öffnen Sie die watsonx Code Assistant seite im Visual Studio Marketplace.

  2. Klicken Sie auf der Marketplace-Seite auf Installieren.

  3. Klicken Sie in Visual Studio Code auf Installieren der Erweiterung.

  4. Setzen Sie in den Einstellungen der Erweiterung Wca: Backend Provider auf ollama.

    Hinweis für IBM Mitarbeiter: Ein Wechsel des Backend-Providers führt immer zu wcaCore zurück, wenn Sie ein IBM oder Red Hat Mitarbeiter sind und die interne WCA@IBM Erweiterung verwenden. Um den Wechsel des Backend-Anbieters zu ermöglichen:

    • Deaktivieren Sie in den WCA@IBM Erweiterungseinstellungen die Option WCA@IBM-Modus für watsonx Code Assistant aktivieren“.
    • Als Alternative können Sie die Erweiterung WCA@IBM deaktivieren

Ollama installieren

Starten Sie den Ollama-Inferenzserver

Führen Sie in einem Konsolenfenster aus:

ollama serve

Lassen Sie dieses Fenster geöffnet, während Sie Ollama verwenden.

Wenn Sie die Meldung ' Error: listen tcp 127.0.0.1:11434: bind: address already in use erhalten, ist der Ollama-Server bereits gestartet.

Installieren Sie das IBM Granite

Installieren Sie zunächst das Modell " granite-code:8b aus der Ollama-Bibliothek.

  1. Öffnen Sie ein neues Konsolenfenster.

  2. Geben Sie in der Befehlszeile ' ollama run granite-code:8b ein, um das Modell herunterzuladen und einzusetzen. Im Folgenden ist ein Beispiel für die Ausgabe dargestellt:

    pulling manifest
    pulling 8718ec280572... 100% ▕███████████████████████ 4.6 GB
    pulling e50df8490144... 100% ▕███████████████████████ ▏  123 B
    pulling 58d1e17ffe51... 100% ▕███████████████████████▏  11 KB
    pulling 9893bb2c2917... 100% ▕███████████████████████▏  108 B
    pulling 0e851433eda0... 100% ▕███████████████████████▏  485 B
    verifying sha256 digest
    writing manifest
    removing any unused layers
    success
    >>>
    
  3. Geben Sie " /bye nach " >>> ein, um die Ollama-Befehlsshell zu verlassen.

  4. Probieren Sie das Modell aus, indem Sie es eintippen:

    ollama run granite-code:8b "How do I create a python class?"
    
  5. Die Antwort sieht in etwa wie folgt aus:

    To create a Python class, you can define a new class using the "class" keyword followed by the name of the class and a colon. Inside the class definition, you can specify the methods and attributes that the class will have. Here is an example: ...
    

Konfigurieren Sie den Ollama-Host

Standardmäßig läuft der Ollama-Server unter der IP-Adresse 127.0.0.1, Port 11434 und http als Protokoll. Wenn Sie die IP-Adresse oder den Port, an dem Ollama verfügbar ist, ändern:

  1. Öffnen Sie in Visual Studio Code die Erweiterungseinstellungen für watsonx Code Assistant.

  2. Unter Wca > Local: API Host fügen Sie die Host-IP und den Port hinzu.

Konfigurieren Sie das zu verwendende Granite

Standardmäßig verwendet watsonx Code Assistant das Modell " granite-code:8b sowohl für den Chat als auch für die Codevervollständigung. Wenn Ihre Umgebung über genügend Kapazität verfügt, installieren Sie das Modell ' granite-code:8b-base.

Um ein anderes Modell zu verwenden:

  1. Installieren Sie das Modell ' granite-code:8b-base. Siehe Installation des IBM Granite.

  2. Öffnen Sie in Visual Studio Code die Erweiterungseinstellungen für watsonx Code Assistant.

  3. Unter Wca > Lokal: Code Gen Model, geben Sie " granite-code:8b-base ein.

Sichern Ihrer Einrichtung

Standardmäßig läuft der Ollama-Server unter der IP-Adresse 127.0.0.1, Port 11434, mit http als Protokoll, auf Ihrem lokalen Gerät. Um stattdessen https zu verwenden oder einen Proxyserver zu verwenden, siehe Ollama-Dokumentation.

Wechsel von einem lokalen Modell zu IBM Cloud

Sie könnten sich entscheiden, von einem lokalen Modell zu einer Dienstinstanz auf IBM Cloud zu wechseln. Sie können Visual Studio Code dann so konfigurieren, dass es von einem lokalen Modell zu IBM Cloud wechselt.

Weitere Informationen finden Sie unter Einrichten Ihres watsonx Code Assistant Service in IBM Cloud.

So aktualisieren Sie Ihren Visual Studio Code, um IBM Cloud anstelle von Ollama zu verwenden:

  1. Beenden Sie Visual Studio Code.

  2. Beenden Sie die Ollama-Anwendung.

  3. Starten Sie Visual Studio Code und öffnen Sie dann watsonx Code Assistant. Sie sollten die Meldung ' Ollama is not running in your IDE. sehen

  4. Klicken Sie auf Switch to watsonx Code Assistant on IBM Cloud.

Als Alternative können Sie die Einstellungen der Erweiterung ändern:

  1. Öffnen Sie in Visual Studio Code die Erweiterungseinstellungen für watsonx Code Assistant.

  2. Wechseln Sie in Wca: Backend Provider von " ollama zu " wcaCore.

  3. Starten Sie die Erweiterungen neu, um die Änderung zu übernehmen.