خطوات الاستخدام
الخطوة 1: فهم المدخلات الأساسية. تقوم حاسبة كفاءة Segment Anything بتقدير وقت المعالجة بناءً على ثلاثة عوامل رئيسية: عدد بكسلات الصورة (imagePixels) الذي يمثل حجم الصورة الكلي (العرض × الارتفاع)، وعدد النقاط (points) المستخدمة في التوجيه، وعدد الأقنعة (masks) الناتجة. كلما زادت هذه القيم، زاد الحمل الحسابي على نموذج SAM، مما يزيد من وقت المعالجة. يجب إدخال هذه القيم بدقة للحصول على تقدير واقعي.
الخطوة 2: إدخال عدد بكسلات الصورة. أدخل إجمالي عدد البكسلات في الصورة (على سبيل المثال، 1920×1080 = 2,073,600 بكسل). هذا الرقم يؤثر مباشرة على مرحلة تشفير الصورة (Image Encoder) في SAM، حيث يستخدم نموذج محول الرؤية (ViT) الذي يتناسب تعقيده الحسابي مع مساحة الصورة. تذكر أن SAM يقسم الصورة إلى بقع (patches) بحجم 16×16، لذا فإن عدد البقع يساوي عدد البكسلات / 256، ويؤثر هذا على وقت المعالجة الأولي.
الخطوة 3: إدخال عدد النقاط. أدخل عدد النقاط الموجبة والسالبة المستخدمة لتوجيه النموذج (على سبيل المثال، 5 نقاط لكل قناع). كل نقطة تُعالج بواسطة مشفر النقاط (Point Encoder) وتُدمج مع تضمين الصورة. في النماذج الحديثة، تُرسل النقاط دفعة واحدة، لذا فإن الزيادة الخطية في عدد النقاط تؤدي إلى زيادة شبه خطية في وقت المعالجة، خاصة في مرحلة فك التشفير (Mask Decoder).