AWS Certified AI Practitioner

Avaliar aplicações de RAG e de agentes

Um sistema RAG tem dois lugares para falhar e um agente tem muitos. Esta lição mostra como localizar a falha com as métricas que a AWS oferece para knowledge bases e agentes, em vez de chutar no modelo.

Intermediário 20 minutos 5 Objetivos de aprendizado
  1. Separar uma falha de recuperação de uma falha de geração em uma aplicação RAG
  2. Descrever as métricas prontas dos jobs de avaliação de RAG retrieve only e retrieve and generate no Amazon Bedrock
  3. Distinguir faithfulness de correctness e explicar por que as duas são necessárias
  4. Explicar por que um agente precisa ter a trajetória avaliada, não apenas a resposta final
  5. Identificar os níveis de avaliação do AgentCore e os evaluators prontos que medem o uso de ferramentas