AWS Certified AI Practitioner

Origens do modelo e opções de implantação

De onde vem o modelo da sua aplicação (pré-treinado open source, um modelo gerenciado ou um que você mesmo treina) e como servi-lo em produção: API gerenciada versus auto-hospedada, e inferência em tempo real, serverless, assíncrona ou em lote.

Intermediário 20 minutos 4 Objetivos de aprendizado
  1. Comparar as três origens de um modelo: usar um pré-treinado, customizar um ou treinar o seu
  2. Distinguir um serviço de API gerenciada de uma API auto-hospedada para servir um modelo
  3. Escolher entre inferência em tempo real, serverless, assíncrona e em lote pelo tráfego e pelo tamanho do payload
  4. Associar um cenário de produção à opção de implantação que as restrições exigem