IBM watsonx Code Assistant Modelldetails
watsonx Code Assistant
{{{site.data.keyword.wca_full_notm}} wurde entwickelt, um den Lebenszyklus der Softwareentwicklung zu beschleunigen und basiert auf IBM Granite Code Models.
Allgemeine Programmierung
Zu den öffentlichen Datenquellen, die zum Trainieren der Modelle verwendet wurden, gehören:
- GitHub
- StarCoder
- CommitPack
- Glaive-code-assistant
Java
Erweitertes Unternehmensmodell Java zur Behebung, Erklärung, Generierung von Einheitstests und Korrektur. Dieses Modell nutzt die Vorteile der neuen Unternehmensdaten von Java, die auf diese Anwendungsfälle zugeschnitten sind, und einen Code-Stau von Hunderten von IBM WebSphere Entwicklern.
Zu den öffentlichen Datenquellen, die zum Trainieren der Modelle verwendet wurden, gehören:
- methods2test
- Jakarta EE Quellcode und Dokumentation
- MicroProfile Quellcode und Dokumentation
Jakarta EE Spezifikationen
Copyright © 2016-2023, Eclipse Foundation und Copyright © 2016-2024, Eclipse Foundation AISBL. Diese Software oder dieses Dokument enthält Material, das von den JarkataEE Spezifikationen kopiert oder abgeleitet wurde, die unter https://jakarta.ee/specifications/ erhältlich sind. Diese Software kann Material erzeugen, das die hier genannten Dokumente implementiert, von ihnen kopiert oder von ihnen abgeleitet ist. Es liegt in der Verantwortung des Nutzers, festzustellen, ob die Anforderungen der Eclipse Foundation Specification License ( https://www.eclipse.org/legal/efsl/ ) für die erzeugten Materialien gelten.
MicroProfile Spezifikationen und API-Dokumentation
Copyright © 2016-2023, Eclipse Foundation und Copyright © 2016-2024 Eclipse Foundation AISBL. Diese Software oder dieses Dokument enthält Material, das von Eclipse Foundation MicroProfile Spezifikationsdokumenten und Eclipse Foundation MicroProfile API-Dokumentation kopiert oder abgeleitet wurde, die unter https://microprofile.io/specifications/ verfügbar sind. Diese Software kann Material erzeugen, das die hier genannten Dokumente implementiert, von ihnen kopiert oder von ihnen abgeleitet ist. Es liegt in der Verantwortung des Nutzers, festzustellen, ob die Anforderungen der Eclipse Foundation Specification License ( https://www.eclipse.org/legal/efsl/ ) für die erzeugten Materialien gelten.
Sonstige (wie natürliche Sprache und Mathematik)
Zu den öffentlichen Datenquellen, die zum Trainieren der Modelle verwendet wurden, gehören:
- MathInstruct
- OpenWebMath
- S2ORC: Das offene Forschungskorpus von Semantic Scholar
- RedPajama 1T
- Stack Exchange
- Wikimedia