AWS Certified AI Practitioner
La tarification au token
Comprenez comment l'IA générative se facture, pourquoi les tokens de sortie coûtent plus cher que ceux d'entrée, et comment le mode à la demande, le batch, le Provisioned Throughput et le prompt caching changent le coût d'une même charge de travail.
Intermédiaire 20 minutes 4 Objectifs d'apprentissage
- Expliquer le fonctionnement de la tarification au token et pourquoi entrée et sortie sont facturées différemment
- Estimer le coût mensuel d'une charge de travail à partir de ses volumes de tokens
- Comparer le mode à la demande, le batch et le Provisioned Throughput et identifier lequel convient à un scénario
- Décrire comment le prompt caching réduit le coût et quelles sont ses limites
