تقييم تجارب الذكاء الاصطناعي: الجودة والثقة والسلامة والمقاييس
تعلّم تقييم تجارب الذكاء الاصطناعي بأساليب تشغيلية خاصة بالذكاء الاصطناعي لا تلتقطها مقاييس قابلية الاستخدام التقليدية بالكامل. ابنِ معايير رصد جودة المخرجات، وقِس معايرة الثقة والاتكال المفرط والتعافي من الهلوسة، وصمّم رحلات فريق أحمر لتجربة المستخدم ومكتبات سيناريوهات، وصنّف الخطورة، وحدد حدود المراجعة البشرية والتصعيد، واجمع أدلة جاهزة للقرار لبوابة إطلاق بالإطلاق أو عدمه أو الإطلاق المشروط.
بنهاية هذا Course، تستطيع بناء معيار رصد جودة مخرجات، وقياس معايرة الثقة وجهد التصحيح، وتصميم رحلات فريق أحمر ومكتبات سيناريوهات، وتصنيف الخطورة، وتحديد حدود المراجعة البشرية، وإنتاج حزمة أدلة تقييم جاهزة للقرار لتوصية بوابة إطلاق.
المنهج
عدد المستويات: ٣ · عدد الدروس: ٣٠قد يتضمن كل درس اختبارًا قصيرًا
قد يتضمن كل مستوى امتحانًا
أكمل الدروس المتاحة
اجتز كل الاختبارات والامتحانات المضبوطة
لا تُفتح الأنشطة المقفلة قبل استيفاء متطلباتها
يُحتسب تقدّم الدورة المكتملة تلقائيًا ضمن المسار المهني عندما تنتمي الدورة إلى مهمة.
- بناء حكم تقييمي عملي واحد عبر 30 درسًا ثنائي اللغة
- ربط كل ادعاء جودة بدليل حقيقي قائم على السيناريو، لا برقم إجمالي غير مدعوم
- فصل ما يدعمه قرار بوابة الإطلاق فعليًا عمّا يفضّل عرض توضيحي مُنتقى بعناية الإيحاء به، في كل خطوة
- استخدام تقييمات قائمة على السيناريو لتدريب أحكام ممارسة تقييم مصمم منتجات ذكاء اصطناعي عامل الحقيقية
- مصممو UX/المنتج الذين يحتاجون إلى تقرير ما إذا كانت تجربة الذكاء الاصطناعي جيدة وآمنة ومفهومة بما يكفي للإطلاق
- المصممون الذين يبنون معايير رصد جودة المخرجات ومكتبات السيناريوهات ورحلات فريق أحمر لتجربة المستخدم لميزات الذكاء الاصطناعي
- فرق المنتج المسؤولة عن تقييم الثقة والسلامة وإمكانية الوصول قبل قرار إطلاق الذكاء الاصطناعي
- كل من يجب أن يحوّل أدلة تقييم الذكاء الاصطناعي إلى توصية بوابة إطلاق واضحة وجاهزة للقرار
- 3 مستويات متدرجة و30 درسًا ثنائي اللغة
- 30 Quiz للدروس تضم 10 أسئلة سيناريو لكل منها
- 3 Exam للمستويات تضم 15 سؤال نقل تعلم لكل منها
- Practice Task واحدة بتحقق بنيوي تنتج مراجعة تقييم تجربة ذكاء اصطناعي وبوابة إطلاق كاملة
تُمنح بعد استيفاء متطلبات الإتمام المضبوطة لهذه الدورة.