مفهوم: التمهيد المسبق (Prefill)
مفهوم: prefill عدد الذرات: 3 | عدد الكتب: 1
هذا المفهوم يظهر في 3 ذرة عبر 1 كتاباً في الأطلس.
📊 إحصائيات المفهوم
| المقياس | القيمة |
|---|---|
| إجمالي الذرات | 3 |
| عدد الكتب | 1 |
| ذرات قوي | 3 (100%) |
| ذرات جوهر | 2 |
| أنواع الحجج | 3 |
📚 كيف عالج كل كتاب هذا المفهوم
هندسة الذكاء الاصطناعي (3 ذرة)
يؤدي التداخل بين الملء المسبق وفك الترميز إلى الإضرار بزمن الاستجابة
“هذا واحد prefilling job can drain computational resources من existing decoding jobs, sloفوزg down TPOT لـ هؤلاء requests.”
🌟 أبرز الذرات في هذا المفهوم
1. يؤدي التداخل بين الملء المسبق وفك الترميز إلى الإضرار بزمن الاستجابة
الكتاب: هندسة الذكاء الاصطناعي (تشيب هويين)
الادعاء: Adding a جديد query can بطيء existing decoding jobs لأن the جديد prefill job drains computational resources من them.
الشاهد: “هذا واحد prefilling job can drain computational resources من existing decoding jobs, sloفوزg down TPOT لـ هؤلاء requests.”
2. فصل مرحلة التعبئة المسبقة عن مرحلة فك الترميز يساعد
الكتاب: هندسة الذكاء الاصطناعي (تشيب هويين)
الادعاء: Assigning prefill و decode إلى مختلف instances can significantly تحسين throughput بينما still اجتماع latency requirements.
الشاهد: “assigning pre‐ fill و decode operations إلى مختلف instances (e.g., مختلف GPUs) can signifi‐ cantly تحسين the مجلد من processed requests بينما adhering إلى latency requirements.”
3. الاستدلال له مرحلتان
الكتاب: هندسة الذكاء الاصطناعي (تشيب هويين)
الادعاء: Transformer-based language نموذج inference has a parallel prefill stage و a sequential decode stage.
الشاهد: “Inference لـ transformer-based language نماذج, therefore, consists من اثنان steps: Prefill”
🔍 كيف يختلف هذا المفهوم بين الكتب؟
من خلال تحليل 3 ذرة عبر 1 كتب:
الطرق المطبقة
- Assigning prefill و decode إلى مختلف instances can significantly تحسين throughput بينما still اجتماع latency requirements.
📌 ملاحظة
هذا المفهوم مترجم آلياً من المحتوى الإنجليزي الأصلي. الشواهد النصية محفوظة بالإنجليزية لضمان الدقة.