AWS Certified AI Practitioner
Origine des modèles et options de déploiement
D'où vient le modèle de votre application (modèle pré-entraîné open source, modèle managé, ou modèle que vous entraînez vous-même) et comment vous le servez en production : API managée contre auto-hébergement, et inférence temps réel, serverless, asynchrone ou batch.
Intermédiaire 20 minutes 4 Objectifs d'apprentissage
- Comparer les trois origines possibles d'un modèle : utiliser un modèle pré-entraîné, le personnaliser, ou entraîner le vôtre
- Distinguer un service d'API managée d'une API auto-hébergée pour servir un modèle
- Choisir entre inférence temps réel, serverless, asynchrone et batch selon le trafic et la taille des charges utiles
- Rattacher un scénario de production à l'option de déploiement que ses contraintes imposent
