التكلفة لكل مهمة ناجحة مقابل تكلفة الطلب
Updated August 27, 2026 · first published August 27, 2026
يعد قياس التكلفة لكل طلب مفيداً، لكنه ليس الوحدة التي يشتريها المستخدم. الطلب الذي يفشل، أو يعيد المحاولة ثلاث مرات، أو ينتج إجابة غير صالحة للاستخدام لا يمثل وحدة عمل ناجحة. في بيئات الإنتاج، المقياس الأكثر دقة وموثوقية هو التكلفة لكل مهمة ناجحة: إجمالي تكاليف النماذج والأدوات مقسوماً على المهام التي حققت معايير الجودة المطلوبة.
المعادلة الحسابية
استخدم المعادلة: تكلفة المهمة الناجحة = إجمالي الإنفاق المنسوب / عدد المهام الناجحة. يشمل ذلك تكاليف رموز الإدخال والإخراج، والتخزين المؤقت، ورموز التفكير الاستدلالي (reasoning)، واستدعاء الأدوات، وإعادة المحاولة، ومسارات التراجع (fallback). حدد شروط النجاح مسبقاً: مثل قبول إجابة الدعم من العميل، أو تصنيف يتجاوز حد الثقة، أو سير عمل اكتمل دون تدخل بشري للتصحيح.
لماذا تضلل متوسطات الطلبات
تنخفض متوسطات تكلفة الطلب ظاهرياً عند احتساب المحاولات الفاشلة الرخيصة. كما تخفي الحالات الشاذة المكلفة: قد يكون لخاصية معينة متوسط تكلفة منخفض، بينما تستهلك حالاتها الفاشلة استدلالاً مكلفاً ومراجعة بشرية مطولة. قم بتقسيم البيانات حسب الخاصية والنموذج وفئة العملاء والنتيجة، واعرض تكلفة المهام الناجحة عند الشريحتين p50 وp95.
مراقبة مقام المعادلة بدقة
يحتاج كل استدعاء للنموذج إلى معرف طلب (request ID) ووسم للخاصية؛ ويجب على التطبيق إصدار حدث بالنتيجة مرتبط بهذا المعرف. سجل النجاح، وسبب الفشل، وزمن الاستجابة، وأي تصحيح بشري. قم بمطابقة فواتير المزودين في البسط وعاين عينات من المهام للتحقق من المقام.
توجيه التحسينات الهندسية
إذا كانت تكلفة الطلب مرتفعة ولكن معدل النجاح ممتاز، فإن التخزين المؤقت أو التوجيه الذكي قد يساعدان. أما إذا كانت تكلفة الطلب منخفضة ولكن تكلفة المهمة الناجحة مرتفعة، فالمشكلة في الجودة: تكرار المحاولات، أو سياق غير كافٍ، أو قواعد توقف ضعيفة.
Related
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →