المقصود

تواجه تطبيقات الذكاء الاصطناعي تحديًا كبيرًا في الكمون لأن توليد الرموز يتم بشكل تسلسلي ولأن توقعات المستخدمين منخفضة جدًا.

الشاهد

“getting AI applications’ latency down to the 100 ms latency expected for a typical internet application is a huge challenge”

📕 من كتاب: AI Engineering بقلم Chip Huyen

ما الذي تثبته الفكرة؟

يثبت هذا أن سرعة الاستدلال تمثل قيدًا هندسيًا حاسمًا لتطبيقات الذكاء الاصطناعي.

حدود الفكرة

لا يحدد هذا مدى تكرار وصول الأنظمة إلى 100 مللي ثانية، ولا يبين تقنيات التحسين التي تعمل على نحو أفضل.

اقرأ أيضاً

مفاهيم

روابط للقراءة