AWS Certified AI Practitioner

La tarification au token

Comprenez comment l'IA générative se facture, pourquoi les tokens de sortie coûtent plus cher que ceux d'entrée, et comment le mode à la demande, le batch, le Provisioned Throughput et le prompt caching changent le coût d'une même charge de travail.

Intermédiaire 20 minutes 4 Objectifs d'apprentissage
  1. Expliquer le fonctionnement de la tarification au token et pourquoi entrée et sortie sont facturées différemment
  2. Estimer le coût mensuel d'une charge de travail à partir de ses volumes de tokens
  3. Comparer le mode à la demande, le batch et le Provisioned Throughput et identifier lequel convient à un scénario
  4. Décrire comment le prompt caching réduit le coût et quelles sont ses limites