AWS Certified AI Practitioner

Origine des modèles et options de déploiement

D'où vient le modèle de votre application (modèle pré-entraîné open source, modèle managé, ou modèle que vous entraînez vous-même) et comment vous le servez en production : API managée contre auto-hébergement, et inférence temps réel, serverless, asynchrone ou batch.

Intermédiaire 20 minutes 4 Objectifs d'apprentissage
  1. Comparer les trois origines possibles d'un modèle : utiliser un modèle pré-entraîné, le personnaliser, ou entraîner le vôtre
  2. Distinguer un service d'API managée d'une API auto-hébergée pour servir un modèle
  3. Choisir entre inférence temps réel, serverless, asynchrone et batch selon le trafic et la taille des charges utiles
  4. Rattacher un scénario de production à l'option de déploiement que ses contraintes imposent