خطوات الاستخدام
الخطوة الأولى: إدخال عدد البتات الأصلي (Original Bits). هذا هو دقة الأرقام المستخدمة في النموذج الأصلي، مثل 32 بت لنوع FP32. كلما زاد عدد البتات، زادت دقة التمثيل ولكن زاد حجم النموذج. أدخل القيمة المناسبة بناءً على النموذج الذي تستخدمه.
الخطوة الثانية: إدخال عدد البتات المستهدف (Target Bits). هذا هو الدقة الجديدة التي ترغب في تقليص النموذج إليها، مثل 8 بت لنوع INT8. اختيار دقة أقل يقلل حجم النموذج ويسرع الاستدلال، لكنه قد يؤثر على دقة المخرجات.
الخطوة الثالثة: حساب نسبة ضغط التكميم (Compression Ratio). تقسم عدد البتات الأصلي على عدد البتات المستهدف للحصول على النسبة. مثلاً، إذا كان الأصلي 32 بت والهدف 8 بت، تكون النسبة 4:1 (أي أن النموذج المضغوط أصغر بأربع مرات). هذه النسبة تعكس التخفيض في حجم التخزين النظري، مع افتراض عدم تغير عدد المعاملات.