تتميز الأرقام العشرية بدقتها العالية ولكنها تستهلك موارد كثيرة. تعمل تقنية التكميم على تقليل الدقة العددية لأوزان النموذج وتفعيلاته، عادةً من أرقام عشرية 32 بت إلى أعداد صحيحة 8 بت أو 4 بت. وبذلك، يتقلص حجم النموذج، ويزداد سرعة تشغيله، ويستهلك طاقة أقل.
يكمن التحدي في الدقة. يؤدي التكميم المفرط إلى تدهور جودة المخرجات، خاصةً في المهام التي تتطلب دقة عددية عالية. يُعد التكميم بعد التدريب غير مكلف ولكنه يُفقد بعض البيانات. أما التدريب المُراعي للتكميم فيُحاكي الدقة المنخفضة أثناء التدريب، مما يُعيد جزءًا كبيرًا من الدقة المفقودة.
مستويات التكميم الشائعة
- فاصلة عائمة 16 بت، ضغط طفيف
- عدد صحيح مكون من 8 بت، يستخدم على نطاق واسع للاستدلال
- عدد صحيح من 4 بت، عدواني ولكنه ممكن مع الحذر
- ثنائي وثلاثي، تجريبي
تختلف إمكانيات دعم الأجهزة. بعض المعالجات المسرّعة تدعم معالجة 8 بت بشكل أصلي، مما يوفر تسارعًا كبيرًا. بينما تلجأ معالجات أخرى إلى مسارات أبطأ. يعتمد اختيار نظام التكميم على الهدف من النشر بقدر اعتماده على النموذج.
Comments
No comments yet. Be the first to share a thought.
Leave a comment