AWS Certified AI Practitioner
Origen del modelo y opciones de despliegue
De dónde sale el modelo de tu aplicación (preentrenado de código abierto, uno administrado o uno que entrenas tú) y cómo lo sirves en producción: API administrada frente a autoalojada, e inferencia en tiempo real, serverless, asíncrona o por lotes.
Intermedio 20 minutos 4 Objetivos de aprendizaje
- Comparar las tres fuentes de un modelo: usar uno preentrenado, personalizarlo o entrenar el tuyo
- Distinguir un servicio de API administrada de una API autoalojada para servir un modelo
- Elegir entre inferencia en tiempo real, serverless, asíncrona y por lotes según tráfico y payload
- Emparejar un escenario de producción con la opción de despliegue que exigen sus restricciones
