Inferencia

Ejecutar un modelo ya entrenado para obtener una predicción.

Explicación completa

La inferencia es el uso del modelo en producción, frente al entrenamiento. Su coste se mide en tokens o segundos de GPU y es el gasto recurrente principal de cualquier producto con IA.

Ejemplo

Cada respuesta de un chatbot es una inferencia.

Última actualización:

Términos relacionados