مفهوم: ذاكرة المفتاح والقيمة المؤقتة (KV Cache)
مفهوم: kv-cache عدد الذرات: 2 | عدد الكتب: 1
هذا المفهوم يظهر في 2 ذرة عبر 1 كتاباً في الأطلس.
📊 إحصائيات المفهوم
| المقياس | القيمة |
|---|---|
| إجمالي الذرات | 2 |
| عدد الكتب | 1 |
| ذرات قوي | 2 (100%) |
| ذرات جوهر | 2 |
| أنواع الحجج | 2 |
📚 كيف عالج كل كتاب هذا المفهوم
هندسة الذكاء الاصطناعي (2 ذرة)
السياق الطويل يواجه اختناقات في الذاكرة
“creating a bottleneck لـ running applications مع long سياق”
🌟 أبرز الذرات في هذا المفهوم
1. السياق الطويل يواجه اختناقات في الذاكرة
الكتاب: هندسة الذكاء الاصطناعي (تشيب هويين)
الادعاء: لـ long-سياق LLM inference, the KV cache can become a hardware storage bottleneck و increase loading latency.
الشاهد: “creating a bottleneck لـ running applications مع long سياق”
2. يقلل PagedAttention (انتباه مفهرس) من التجزئة
الكتاب: هندسة الذكاء الاصطناعي (تشيب هويين)
الادعاء: PagedAttention (انتباه مفهرس) improves LLM serving efficiency بواسطة dividing the KV cache into non-contiguous blocks و reducing fragmentation.
الشاهد: “dividing the KV cache into non-contiguous blocks, reducing fragmentation”
🔍 كيف يختلف هذا المفهوم بين الكتب؟
من خلال تحليل 2 ذرة عبر 1 كتب:
الطرق المطبقة
- PagedAttention (انتباه مفهرس) improves LLM serving efficiency بواسطة dividing the KV cache into non-contiguous blocks و reducing fragmentation.
📌 ملاحظة
هذا المفهوم مترجم آلياً من المحتوى الإنجليزي الأصلي. الشواهد النصية محفوظة بالإنجليزية لضمان الدقة.