المقصود
تُعدّ أسئلة الاختيار من متعدد الأنسب لتقييم المعرفة والاستدلال، لكنها لا تناسب مهام التوليد مثل التلخيص والترجمة وكتابة المقالات.
الشاهد
“Close-ended outputs are easier to verify and reproduce.”
📕 من كتاب: AI Engineering بقلم Chip Huyen
ما الذي تثبته الفكرة؟
يُثبت وجود حدٍّ فاصل بين أنواع المهام عند تقييمها باستخدام أسئلة الاختيار من متعدد.
حدود الفكرة
لا يزعم أن أسئلة الاختيار من متعدد عديمة الفائدة في مهام التوليد، بل فقط أنها ليست مثالية لها.
اقرأ أيضاً
مفاهيم
روابط للقراءة
- هندسة الذكاء الاصطناعي
- المجال: التكنولوجيا