IBM watsonx Code Assistant Modelldetails

watsonx Code Assistant

{{{site.data.keyword.wca_full_notm}} wurde entwickelt, um den Lebenszyklus der Softwareentwicklung zu beschleunigen und basiert auf IBM Granite Code Models.

Allgemeine Programmierung

Zu den öffentlichen Datenquellen, die zum Trainieren der Modelle verwendet wurden, gehören:

  • GitHub
  • StarCoder
  • CommitPack
  • Glaive-code-assistant

Java

Erweitertes Unternehmensmodell Java zur Behebung, Erklärung, Generierung von Einheitstests und Korrektur. Dieses Modell nutzt die Vorteile der neuen Unternehmensdaten von Java, die auf diese Anwendungsfälle zugeschnitten sind, und einen Code-Stau von Hunderten von IBM WebSphere Entwicklern.

Zu den öffentlichen Datenquellen, die zum Trainieren der Modelle verwendet wurden, gehören:

  • methods2test
  • Jakarta EE Quellcode und Dokumentation
  • MicroProfile Quellcode und Dokumentation

Jakarta EE Spezifikationen

Copyright © 2016-2023, Eclipse Foundation und Copyright © 2016-2024, Eclipse Foundation AISBL. Diese Software oder dieses Dokument enthält Material, das von den JarkataEE Spezifikationen kopiert oder abgeleitet wurde, die unter https://jakarta.ee/specifications/ erhältlich sind. Diese Software kann Material erzeugen, das die hier genannten Dokumente implementiert, von ihnen kopiert oder von ihnen abgeleitet ist. Es liegt in der Verantwortung des Nutzers, festzustellen, ob die Anforderungen der Eclipse Foundation Specification License ( https://www.eclipse.org/legal/efsl/ ) für die erzeugten Materialien gelten.

MicroProfile Spezifikationen und API-Dokumentation

Copyright © 2016-2023, Eclipse Foundation und Copyright © 2016-2024 Eclipse Foundation AISBL. Diese Software oder dieses Dokument enthält Material, das von Eclipse Foundation MicroProfile Spezifikationsdokumenten und Eclipse Foundation MicroProfile API-Dokumentation kopiert oder abgeleitet wurde, die unter https://microprofile.io/specifications/ verfügbar sind. Diese Software kann Material erzeugen, das die hier genannten Dokumente implementiert, von ihnen kopiert oder von ihnen abgeleitet ist. Es liegt in der Verantwortung des Nutzers, festzustellen, ob die Anforderungen der Eclipse Foundation Specification License ( https://www.eclipse.org/legal/efsl/ ) für die erzeugten Materialien gelten.

Sonstige (wie natürliche Sprache und Mathematik)

Zu den öffentlichen Datenquellen, die zum Trainieren der Modelle verwendet wurden, gehören:

  • MathInstruct
  • OpenWebMath
  • S2ORC: Das offene Forschungskorpus von Semantic Scholar
  • RedPajama 1T
  • Stack Exchange
  • Wikimedia