Preguntas más frecuentes sobre la facturación de Red Hat AI Inference

Las preguntas frecuentes sobre la facturación de Red Hat AI Inference pueden incluir consultas sobre los costes o las tarifas de almacenamiento. Para consultar todas las preguntas frecuentes sobre IBM Cloud®, visita nuestra Biblioteca preguntas más frecuentes.

¿Cómo funciona la facturación?

El uso de Inferencia de IA de Red Hat conlleva costes. Si utilizas la alineación de modelos, también incurrirás en costes por el servicio IBM Cloud® Object Storage, que se utiliza como ubicación de almacenamiento.

Si implementas tu modelo en otro servicio, se te aplicarán cargos adicionales por dicho servicio.

¿Cómo se calculan los costes en Inferencia de IA de Red Hat?

El coste derivado del uso de Inferencia de IA de Red Hat se basa en métricas que se miden en tokens. Cada token corresponde a una cantidad específica de potencia de cálculo necesaria para las tareas de procesamiento. El número total de tokens consumidos influye directamente en la escala de generación de datos, el ajuste fino del modelo o la inferencia. Esta métrica sirve de base para nuestro sistema de facturación, lo que permite a los usuarios supervisar y controlar sus costes en función de los recursos informáticos utilizados.

Generación de datos sintéticos (SDG)
Los tokens de salida (SYN-DATA-TOKEN) se calculan en función del volumen de datos generados por el servicio a partir de toda la taxonomía de entrada. El texto se ha tokenizado utilizando la biblioteca de tokenización de Hugging Face con la información de tokenización del modelo teacher de Mistral.
Formación sobre alineación de modelos
Los tokens de entrada (MODEL-TRAIN-TOKEN) se calculan en función de la cantidad de datos introducidos en el sistema para el entrenamiento de alineación del modelo, así como del conocimiento base de Granite que se utiliza para aumentar la precisión sin pérdida de conocimiento. Debido a los conocimientos básicos que se utilizan, el coste es mínimo.
Inferencia con un modelo
Los costes de inferencia se calculan por separado para los tokens de entrada y de salida, según cada modelo. Los tokens de entrada representan la indicación o consulta enviada al modelo, mientras que los tokens de salida representan la respuesta generada por el modelo. Cada modelo tiene su propia estructura de precios en función de su tamaño y sus requisitos computacionales.

¿Cómo puedo consultar y realizar un seguimiento de la información sobre costes mientras entreno un modelo?

  1. Antes de empezar a ejecutar cualquier cosa en Inferencia de IA de Red Hat, puede utilizar la herramienta de estimación de costes para obtener una estimación de cuál podría ser el coste.

  2. Sube tu taxonomía

  3. Cuando configure los detalles para la generación de datos, revise el coste estimado antes de iniciar el trabajo.

  4. Una vez generados los datos, también puedes consultar el número estimado de tokens de salida en los detalles de dicha generación de datos.

  5. Cuando configure los detalles del trabajo de formación, revise el coste estimado antes de iniciar el trabajo.

  6. Una vez finalizados los trabajos, puede consultar los costes reales en Facturación y uso. Puede consultar los costes tanto de Inferencia de IA de Red Hat como del servicio IBM Cloud® Object Storage, que se utiliza como ubicación de almacenamiento.

¿Se facturan las operaciones fallidas?

Las operaciones fallidas no se facturan. Se facturan tanto las operaciones realizadas con éxito como las canceladas por el usuario, aunque estas últimas se prorratean en función del procesamiento que se haya completado.