المقصود

يمكن أن يقلل RLHF من الهلوسة في بعض السياقات، لكن المقطع يذكر أن InstructGPT مثال على حالة أصبحت فيها الهلوسة أسوأ.

الشاهد

“After making an incorrect assumption, a model can continue hallucinating to justify the initial wrong assumption.”

📕 من كتاب: AI Engineering بقلم Chip Huyen

ما الذي تثبته الفكرة؟

هذا يبيّن أن RLHF ليس حلاً مضمونًا للهلوسة.

حدود الفكرة

لا يثبت أن RLHF ضار عمومًا، لأن النص يذكر أيضًا أنه حسّن جوانب أخرى.

اقرأ أيضاً

مفاهيم

روابط للقراءة