Questions fréquemment posées sur la facturation d' Red Hat AI Inference

Les questions fréquemment posées concernant la facturation d' Red Hat AI Inference peuvent porter notamment sur les coûts ou les tarifs de stockage. Pour consulter toutes les FAQ concernant IBM Cloud®, rendez-vous sur notre Bibliothèque questions fréquemment posées.

Comment fonctionne la facturation ?

L'utilisation d' Inférence d'IA Red Hat entraîne des coûts. Si vous utilisez l'alignement de modèles, vous devez également prendre en compte les coûts liés à l'IBM Cloud® Object Storage e, qui sert d'espace de stockage.

Si vous déployez votre modèle sur un autre service, vous devrez vous acquitter des frais supplémentaires liés à ce service.

Comment le coût est-il calculé dans l' Inférence d'IA Red Hat?

Le coût lié à l'utilisation d' Inférence d'IA Red Hat s est calculé à partir de métriques mesurées en jetons. Chaque jeton correspond à une quantité spécifique de puissance de calcul nécessaire aux tâches de traitement. Le nombre total de jetons consommés influe directement sur l'ampleur de la génération de données, du réglage fin du modèle ou de l'inférence. Cet indicateur sert de base à notre système de facturation, permettant aux utilisateurs de suivre et de maîtriser leurs coûts en fonction des ressources informatiques utilisées.

Génération de données synthétiques (SDG)
Les jetons de sortie (SYN-DATA-TOKEN) sont calculés en fonction du volume de données générées par le service à partir de l'ensemble de la taxonomie d'entrée. Le texte est tokenisé à l'aide de la bibliothèque de tokenisation d' Hugging Face, avec les paramètres de tokenisation du modèle teacher de Mistral.
Formation à l'alignement des modèles
Les jetons d’entrée (MODEL-TRAIN-TOKEN) sont calculés en fonction de la quantité de données introduites dans le système pour l’entraînement à l’alignement du modèle, ainsi que des connaissances de base d’ Granite, qui sont utilisées pour améliorer la précision sans perte de connaissances. En raison des connaissances de base utilisées, le coût est minime.
Inférence à l'aide d'un modèle
Les coûts d'inférence sont calculés séparément pour les tokens d'entrée et de sortie, modèle par modèle. Les jetons d'entrée correspondent à votre invite ou à votre requête envoyée au modèle, tandis que les jetons de sortie correspondent à la réponse générée par le modèle. Chaque modèle dispose de sa propre structure tarifaire, en fonction de sa taille et de ses besoins en puissance de calcul.

Comment puis-je consulter et suivre les informations relatives aux coûts pendant l'entraînement d'un modèle?

  1. Avant de commencer à exécuter quoi que ce soit dans l' Inférence d'IA Red Hat, vous pouvez utiliser l'estimateur de coûts pour obtenir une estimation du coût potentiel.

  2. Importez votre taxonomie

  3. Lorsque vous définissez les paramètres de génération des données, vérifiez le coût estimé avant de lancer la tâche.

  4. Une fois les données générées, vous pouvez également consulter le nombre estimé de jetons de sortie dans les détails relatifs à cette génération de données.

  5. Lorsque vous définissez les détails de la tâche de formation, vérifiez le coût estimé avant de lancer la tâche.

  6. Une fois les tâches terminées, vous pouvez consulter les coûts réels dans la section Facturation et utilisation. Vous pouvez consulter les tarifs d' Inférence d'IA Red Hat, ainsi que ceux du service IBM Cloud® Object Storage, qui sert d'espace de stockage.

Les opérations ayant échoué sont-elles facturées?

Les opérations ayant échoué ne sont pas facturées. Les opérations réussies et celles annulées par l'utilisateur sont facturées, bien que ces dernières soient facturées au prorata en fonction du traitement déjà effectué.