خطوات الاستخدام
ابدأ بتحديد التكلفة الإجمالية للساعة لتشغيل نموذج الذكاء الاصطناعي الخاص بك (instanceHourlyCost). هذه القيمة تعتمد على نوع المثيل (instance) المستخدم في السحابة، مثل AWS EC2 أو Google Cloud AI Platform، وتشمل تكلفة الوحدة الحاسوبية والذاكرة والتخزين. على سبيل المثال، إذا كنت تستخدم مثيل GPU مثل NVIDIA A100، فقد تتراوح التكلفة بين 3 إلى 10 دولارات للساعة. احرص على تضمين أي رسوم إضافية مثل تراخيص البرامج أو تكاليف الشبكة.
أدخل عدد الاستعلامات التي يمكن للنموذج معالجتها في الساعة (queriesPerHour). هذا الرقم يعتمد على أداء النموذج، زمن الاستجابة المطلوب، وطبيعة المهمة (مثل توليد النص أو التصنيف). يمكنك تقديره من خلال اختبار الضغط أو استخدام بيانات قياسية من موفر الخدمة. على سبيل المثال، نموذج صغير مثل GPT-2 قد يعالج 5000 استعلام في الساعة، بينما نموذج كبير مثل GPT-4 قد يعالج 200 استعلام فقط.
لحساب تكلفة التقديم لكل استعلام (Cost Per Query)، قم بقسمة التكلفة الإجمالية للساعة على عدد الاستعلامات في الساعة. الصيغة الرياضية بسيطة: costPerQuery = instanceHourlyCost / queriesPerHour. الناتج يمثل متوسط التكلفة لكل طلب خدمة فردي.