AWS Certified AI Practitioner
Precio basado en tokens
Aprende cómo se factura la IA generativa, por qué los tokens de salida cuestan más que los de entrada, y cómo el modo bajo demanda, el batch, el Provisioned Throughput y el prompt caching cambian el costo de la misma carga de trabajo.
Intermedio 20 minutos 4 Objetivos de aprendizaje
- Explicar cómo funciona el precio basado en tokens y por qué la entrada y la salida se cobran distinto
- Estimar el costo mensual de una carga de trabajo a partir de sus volúmenes de tokens
- Comparar bajo demanda, batch y Provisioned Throughput e identificar cuál encaja en un escenario dado
- Describir cómo el prompt caching reduce costos y cuáles son sus limitaciones
