AWS Certified AI Practitioner

تقييم تطبيقات RAG والوكلاء

نظام RAG له موضعان للفشل، والوكيل له مواضع كثيرة. هذا الدرس يبيّن كيف تحدّد موضع العطب بالمقاييس التي توفرها AWS لقواعد المعرفة والوكلاء، بدل التخمين في النموذج.

متوسط 20 دقائق 5 أهداف التعلّم
  1. فصل فشل الاسترجاع عن فشل التوليد في تطبيق RAG
  2. وصف المقاييس المدمجة لمهام تقييم RAG بنوعيها: الاسترجاع فقط، والاسترجاع مع التوليد، في Amazon Bedrock
  3. التمييز بين الأمانة والصحة وشرح لماذا يلزم المقياسان معاً
  4. شرح لماذا يحتاج الوكيل تقييم مساره لا إجابته النهائية وحدها
  5. تحديد مستويات التقييم في AgentCore والمقيِّمات المدمجة التي تقيس استعمال الأدوات