المقصود

ينبغي أن تُمثّل مجموعات التقييم شرائح بيانات مختلفة حتى تتمكن الفرق من اكتشاف الانحيازات وفروق الأداء عبر مجموعات المستخدمين وظروف الاستخدام.

الشاهد

“You should have multiple evaluation sets to represent different data slices.”

📕 من كتاب: AI Engineering بقلم Chip Huyen

ما الذي تثبته الفكرة؟

هذا يثبت أن التقييم القائم على الشرائح موصى به للكشف عن الانحيازات وحالات الفشل المحلية.

حدود الفكرة

لا يثبت أي الشرائح المحددة هي الأفضل لكل تطبيق، ولا أن هذا وحده يضمن العدالة.

اقرأ أيضاً

مفاهيم

روابط للقراءة