مفهوم: ذاكرة المفتاح والقيمة المؤقتة (KV Cache)

مفهوم: kv-cache عدد الذرات: 2 | عدد الكتب: 1

هذا المفهوم يظهر في 2 ذرة عبر 1 كتاباً في الأطلس.

📊 إحصائيات المفهوم

المقياسالقيمة
إجمالي الذرات2
عدد الكتب1
ذرات قوي2 (100%)
ذرات جوهر2
أنواع الحجج2

📚 كيف عالج كل كتاب هذا المفهوم

هندسة الذكاء الاصطناعي (2 ذرة)

السياق الطويل يواجه اختناقات في الذاكرة

“creating a bottleneck لـ running applications مع long سياق”

🌟 أبرز الذرات في هذا المفهوم

1. السياق الطويل يواجه اختناقات في الذاكرة

الكتاب: هندسة الذكاء الاصطناعي (تشيب هويين)

الادعاء: لـ long-سياق LLM inference, the KV cache can become a hardware storage bottleneck و increase loading latency.

الشاهد: “creating a bottleneck لـ running applications مع long سياق”

→ اقرأ التحليل الكامل


2. يقلل PagedAttention (انتباه مفهرس) من التجزئة

الكتاب: هندسة الذكاء الاصطناعي (تشيب هويين)

الادعاء: PagedAttention (انتباه مفهرس) improves LLM serving efficiency بواسطة dividing the KV cache into non-contiguous blocks و reducing fragmentation.

الشاهد: “dividing the KV cache into non-contiguous blocks, reducing fragmentation”

→ اقرأ التحليل الكامل


🔍 كيف يختلف هذا المفهوم بين الكتب؟

من خلال تحليل 2 ذرة عبر 1 كتب:

الطرق المطبقة

  • PagedAttention (انتباه مفهرس) improves LLM serving efficiency بواسطة dividing the KV cache into non-contiguous blocks و reducing fragmentation.

📌 ملاحظة

هذا المفهوم مترجم آلياً من المحتوى الإنجليزي الأصلي. الشواهد النصية محفوظة بالإنجليزية لضمان الدقة.