التكلفة الفعلية لكل مهمة في النماذج الرائدة

Updated September 22, 2026 · first published September 22, 2026

تخبرك أسعار القائمة بتكلفة الرمز الواحد، لكنها لا تخبرك بتكلفة المهمة المكتملة، لأن النماذج تستهلك أعدادًا مختلفة جدًا من الرموز لإنجاز العمل نفسه. تضع هذه الصفحة التكلفة المقيسة لكل مهمة ونتيجة الجودة جنبًا إلى جنب لكل من Claude Opus 5.5 وClaude Opus 5 وClaude Fable 5.1 وGPT-6 Astra وGPT-6 Sol عند كل مستوى effort. لكل رقم مصدر، ولا شيء مقدَّر.

الجواب المختصر: GPT-6 Sol هو أرخص طريق للوصول إلى أي نتيجة حتى 47.5. وفوق 47.5 يكون Opus 5.5 الأرخص عند كل مستوى. لا يوجد إعداد كفء من حيث التكلفة لـ GPT-6 Astra فوق low ولا لـ Opus 5 ولا لـ Fable 5.1: كل واحد منها يتفوق عليه إعداد ما من Sol أو Opus 5.5 في النتيجة والسعر معًا.

المنهجية

جميع النتائج والتكاليف مأخوذة من Artificial Analysis Intelligence Index الإصدار v4.3.2، بتاريخ الاطلاع 22 سبتمبر 2026. يضم المؤشر عشرة تقييمات: AA-Briefcase وGDPval-AA وAutomationBench-AA وTerminal-Bench 4.0 وSciCode وHumanity's Last Exam وGDP.pdf وCritPt وAA-Omniscience وAA-LCR. تشغّل Artificial Analysis كل نموذج عند كل مستوى effort عبر واجهة API الخاصة بالمزوّد، وتسجل ما تدفعه بأسعار القائمة. التكلفة لكل مهمة هي هذا الإنفاق لكل مهمة، مقسومًا بين الإدخال والإخراج. تمر جميع الصفوف بالمجموعة نفسها، لذا يمكن مقارنتها مباشرة.

هناك حدّان قبل قراءة الأرقام. أولًا، المؤشر مزيج واحد من المهام. مزيج مهامك سيغيّر التكاليف، ولهذا يشرح القسم الأخير كيف تقيس تكاليفك بنفسك. ثانيًا، لا تُقارن النتائج بين إصدارات مختلفة من المؤشر، فلا تخلط هذه الأرقام بأرقام نُشرت سابقًا.

القائمة الكاملة: 26 إعدادًا

رموز الإخراج لكل مهمة هي الرموز التي يكتبها النموذج، بما فيها الاستدلال. لا تنشر Artificial Analysis التقسيم بين الإدخال والإخراج لإعدادات GPT-6 Sol الأربعة الوسطى، لذلك تظهر تلك الخانات بقيمة n/a.

النموذجEffortIntelligence Indexالتكلفة لكل مهمةتكلفة الإدخالتكلفة الإخراجرموز الإخراج لكل مهمةعلى الحد الأمثل
GPT-6 Solnone28.1$0.33$0.28$0.054,900لا
GPT-6 Sollow33.9$0.13n/an/a3,400نعم
GPT-6 Solmedium (افتراضي)39.8$0.25n/an/a6,500نعم
GPT-6 Solhigh42.8$0.37n/an/a10,200نعم
GPT-6 Solxhigh44.1$0.53n/an/a16,000نعم
GPT-6 Solmax47.5$1.06$0.74$0.3131,200نعم
GPT-6 Astralow45.8$0.82$0.60$0.224,400نعم
GPT-6 Astramedium49.6$1.54$1.06$0.489,600لا
GPT-6 Astrahigh50.9$1.73$1.13$0.5911,800لا
GPT-6 Astraxhigh52.4$2.31$1.46$0.8516,900لا
GPT-6 Astramax52.7$3.26$1.90$1.3627,200لا
Claude Opus 5low39.4$1.10$0.73$0.3714,700لا
Claude Opus 5medium44.8$2.19$1.47$0.7229,000لا
Claude Opus 5high (افتراضي)48.1$3.61$2.46$1.1646,200لا
Claude Opus 5xhigh49.7$4.88$3.36$1.5260,700لا
Claude Opus 5max50.8$5.86$4.05$1.8172,500لا
Claude Opus 5.5low42.3$0.55$0.35$0.2010,200لا
Claude Opus 5.5medium (افتراضي)51.2$1.34$0.82$0.5125,700نعم
Claude Opus 5.5high53.6$1.82$1.11$0.7135,600نعم
Claude Opus 5.5xhigh56.0$3.46$2.15$1.3165,700نعم
Claude Opus 5.5max57.6$5.98$3.60$2.38119,200نعم
Claude Fable 5.1low46.8$2.37$1.30$1.0821,600لا
Claude Fable 5.1medium48.9$2.98$1.59$1.3927,900لا
Claude Fable 5.1high51.2$3.91$2.01$1.9038,100لا
Claude Fable 5.1xhigh53.2$5.98$2.96$3.0260,500لا
Claude Fable 5.1max53.4$7.63$3.73$3.9078,100لا

على الحد الأمثل يعني أنه لا يوجد إعداد آخر في هذا الجدول يحقق نتيجة أعلى بمال أقل.

الحد الأمثل للتكلفة

عشرة من الإعدادات الستة والعشرين تقع على الحد الأمثل. بعد ترتيبها حسب التكلفة، هي الإعدادات الوحيدة التي تستحق النظر إذا كان السعر هو المعيار الوحيد. كل ما عداها يدفع أكثر مقابل النتيجة نفسها أو أقل.

الإعدادIntelligence Indexالتكلفة لكل مهمةلكل 10,000 مهمة
GPT-6 Sol · low33.9$0.13$1,300
GPT-6 Sol · medium39.8$0.25$2,500
GPT-6 Sol · high42.8$0.37$3,700
GPT-6 Sol · xhigh44.1$0.53$5,300
GPT-6 Astra · low45.8$0.82$8,200
GPT-6 Sol · max47.5$1.06$10,600
Claude Opus 5.5 · medium51.2$1.34$13,400
Claude Opus 5.5 · high53.6$1.82$18,200
Claude Opus 5.5 · xhigh56.0$3.46$34,600
Claude Opus 5.5 · max57.6$5.98$59,800

للحد الأمثل منطقتان. من 0.13 دولار إلى 1.06 دولار يكاد يكون كله GPT-6 Sol، والاستثناء الوحيد هو GPT-6 Astra low عند 0.82 دولار. ومن 1.34 دولار فصاعدًا لا يوجد إلا Opus 5.5. الفارق بين المنطقتين صغير: يحقق Opus 5.5 medium نتيجة أعلى من Sol max بـ 3.7 نقطة مقابل 0.28 دولار إضافية لكل مهمة.

مقارنة مباشرة عند نتيجة مساوية أو أفضل

يقارن كل زوج إعدادًا أرخص بإعداد أغلى يحقق النتيجة نفسها أو أقل.

الإعداد الأرخصالإعداد الأغلىفارق النتيجةالتوفير
Opus 5.5 medium: 51.2, $1.34Opus 5 high: 48.1, $3.61+3.1 لصالح Opus 5.563%
Opus 5.5 medium: 51.2, $1.34Opus 5 max: 50.8, $5.86+0.4 لصالح Opus 5.577%
Opus 5.5 medium: 51.2, $1.34Fable 5.1 high: 51.2, $3.91تعادل66%
Opus 5.5 high: 53.6, $1.82GPT-6 Astra max: 52.7, $3.26+0.9 لصالح Opus 5.544%
Opus 5.5 high: 53.6, $1.82Fable 5.1 max: 53.4, $7.63+0.2 لصالح Opus 5.576%
GPT-6 Sol max: 47.5, $1.06Opus 5 high: 48.1, $3.61+0.6 لصالح Opus 571%

يهم صف Opus 5 الفرق التي لم تنتقل بعد. كان Opus 5 يعمل افتراضيًا على high. أما Opus 5.5 فيعمل افتراضيًا على medium، وعند هذا الإعداد يحقق 3.1 نقطة أكثر بتكلفة أقل بنسبة 63% لكل مهمة. تقول Anthropic إن Opus 5.5 أرخص بنسبة 40% من Opus 5؛ والفارق المقيس على هذا المؤشر أوسع من هذا الادعاء.

أين يذهب المال: الإدخال لا الإخراج

في كل النماذج يمثل الإدخال ما بين نصف التكلفة لكل مهمة وثلاثة أرباعها تقريبًا. في Opus 5.5 عند medium، يذهب 0.82 دولار من 1.34 دولار إلى الإدخال، أي 61%. وفي GPT-6 Astra عند max تبلغ النسبة 58%، وفي GPT-6 Sol عند max تبلغ 70%، وفي Fable 5.1 عند max تبلغ 49%. تعيد مهام الوكلاء إرسال سياقها المتنامي في كل خطوة، لذا يزداد إنفاق الإدخال مع عدد الخطوات، لا مع طول الإجابة فقط.

لهذا يكلّف GPT-6 Sol بلا استدلال أكثر منه عند low: 0.33 دولار مقابل 0.13 دولار، رغم أنه لا يكتب سوى 4,900 رمز إخراج. 0.28 دولار من 0.33 دولار هي إدخال. السبب المرجح هو كثرة الخطوات، وكل خطوة تعيد إرسال السياق. إيقاف الاستدلال لا يجعل الوكيل أرخص إذا احتاج بعده إلى جولات أكثر.

بالنسبة إلى فاتورتك، يعني هذا أن التخزين المؤقت مهم بقدر أهمية اختيار النموذج. يتقاضى Opus 5.5 وGPT-6 Sol كلاهما 0.20 دولار لكل مليون رمز إدخال مخزّن مؤقتًا. ويتقاضى GPT-6 Astra دولارًا واحدًا، وOpus 5 نحو 0.50 دولار.

حجم الرموز مقابل سعر القائمة

GPT-6 Astra هو أكثر النماذج هنا اقتصادًا في الرموز. عند max يكتب 27,200 رمز إخراج لكل مهمة، مقابل 119,200 لـ Opus 5.5 عند max. لكن Astra يتقاضى 10 دولارات و50 دولارًا لكل مليون، أي 2.5× سعر Opus 5.5. يفوز سعر القائمة: يكلّف Opus 5.5 high نحو 1.82 دولار لكل مهمة بنتيجة 53.6، بينما يكلّف Astra max نحو 3.26 دولار بنتيجة 52.7.

Opus 5.5 عند max هو الموضع الوحيد الذي تصبح فيه الإطالة مكلفة. تكلّف رموز الإخراج البالغة 119,200 نحو 2.38 دولار قبل أي إدخال، وتكلّف المهمة كاملة 5.98 دولار. هذا يشتري أعلى نتيجة في الجدول، 57.6، لكنه يساوي 4.5× تكلفة medium.

تناقص العائد مع رفع مستوى effort

يوضح كل صف ما تشتريه زيادة مستوى effort درجة واحدة، بنقاط المؤشر مقابل التكلفة الإضافية لكل مهمة.

النموذجmedium → highxhigh → max
GPT-6 Sol+3.0 نقطة مقابل +48%+3.4 نقطة مقابل +100%
GPT-6 Astra+1.3 نقطة مقابل +12%+0.3 نقطة مقابل +41%
Claude Opus 5+3.3 نقطة مقابل +65%+1.1 نقطة مقابل +20%
Claude Opus 5.5+2.4 نقطة مقابل +36%+1.6 نقطة مقابل +73%
Claude Fable 5.1+2.3 نقطة مقابل +31%+0.2 نقطة مقابل +28%

في Fable 5.1 وGPT-6 Astra لا يشتري max شيئًا يُذكر: 0.2 و0.3 نقطة مقابل زيادة 28% و41%. وفي Opus 5.5 لا يزال الانتقال إلى max يضيف 1.6 نقطة، لكن بتكلفة أعلى بنسبة 73%. استخدم max فقط في المهام التي قست فيها أن النقاط الإضافية تغيّر النتيجة.

متى يكفي GPT-6 Sol max

المؤشر متوسط، والفجوة بين Sol max وOpus 5.5 medium ليست متساوية عبر التقييمات. النتائج لكل تقييم من Artificial Analysis:

التقييمOpus 5.5 medium ($1.34)GPT-6 Sol max ($1.06)
Terminal-Bench 4.052.543.9
AutomationBench-AA61.261.6
GDPval-AA (Elo)15761487
AA-Briefcase (Elo)16421483
Humanity's Last Exam54.747.9
SciCode59.357.6
CritPt27.730.9
AA-LCR84.383.7

في AutomationBench وCritPt يعادل GPT-6 Sol أداء Opus 5.5 عند medium أو يتفوق عليه، بتكلفة 1.06 دولار لكل مهمة مقابل 1.34 دولار. وفي Terminal-Bench وتقييمات العمل المعرفي وHumanity's Last Exam يتقدم Opus 5.5 بفارق كبير. يمكن تشغيل أتمتة سير العمل على Sol. أما وكلاء الطرفية والبرمجة والعمل المعرفي كثيف المستندات فهي حيث يستحق Opus 5.5 سعره.

ادعاءات المزوّد مقابل الأرقام المستقلة

كثيرًا ما تختلف أرقام المزوّدين عن الأرقام المستقلة، لأنها تستخدم بيئات اختبار وإعدادات مختلفة. تعلن Anthropic أن Opus 5.5 عند xhigh يحقق 66.4% في Terminal-Bench 4.0. وتقيس Artificial Analysis نسبة 59.6% عند المستوى نفسه.

EffortOpus 5.5Fable 5.1
low31.3%40.4%
medium52.5%44.9%
high56.6%52.0%
xhigh59.6%55.1%
max59.6%52.0%

قد يتغير الترتيب أيضًا حسب المؤشر. في Vals AI Index يأتي Fable 5.1 أولًا بنسبة 68.83%، وGPT-6 Astra ثالثًا بنسبة 66.61%، وOpus 5.5 رابعًا بنسبة 66.16%. لا تُنشر هناك التكلفة لكل مهمة على الأساس نفسه، لذا لا يغيّر ذلك الحد الأمثل أعلاه. المؤشر الواحد مجرد زاوية نظر واحدة.

أسعار القائمة ومهمة كثيفة الذاكرة المؤقتة

حسبت Digital Applied سعر مهمة وكيل واحدة كثيفة الذاكرة المؤقتة على كل نموذج: 8M رمز قراءة من الذاكرة المؤقتة، و400K إدخال غير مخزّن، و600K رمز كتابة في الذاكرة المؤقتة، و300K رمز إخراج. تتبع النتيجة الحد الأمثل، مع غرامة إضافية على GPT-6 Astra.

النموذجالإدخال $/MTokالإخراج $/MTokقراءة الذاكرة المؤقتة $/MTokمهمة كثيفة الذاكرة المؤقتة (Digital Applied)
GPT-6 Sol$2.00$10.00$0.20$6.90
Claude Opus 5.5$4.00$20.00$0.20$12.20
Claude Opus 5$5.00$25.00$0.50$17.25
Claude Fable 5.1$10.00$50.00$0.25$28.50
GPT-6 Astra (≤272K)$10.00$50.00$1.00$34.50
GPT-6 Astra (>272K)$20.00$75.00n/a$61.50

يحاسب GPT-6 Astra الطلب كله بسعر 20 دولارًا و75 دولارًا لكل مليون بمجرد تجاوز الإدخال 272K رمز. أما Opus 5.5 فيحافظ على سعر واحد عبر نافذته البالغة 1M رمز. تكلّف الكتابة في الذاكرة المؤقتة لدى Opus 5.5 نحو 5 دولارات لكل مليون للذاكرة المؤقتة لمدة 5 دقائق و8 دولارات لمدة ساعة، وتُحاسب الدفعات بنسبة 50%، ويضاعف الوضع السريع السعر. للتفاصيل، راجع نموذج تكلفة Claude Opus 5.5 واقتصاديات الوضع السريع في Opus 5.5.

كيف تقيس تكلفتك الخاصة لكل مهمة

  1. سجّل الرموز لكل مهمة لا لكل طلب: الإدخال غير المخزّن، والإدخال المخزّن، والكتابة في الذاكرة المؤقتة، والإخراج، مجموعة عبر كل خطوات المهمة.
  2. خذ عينة من بضع مئات من المهام الحقيقية وأعد تشغيلها على إعدادين أو ثلاثة مرشحة، مثل Sol max وOpus 5.5 medium وOpus 5.5 high.
  3. قيّم كل نتيجة بالفحص نفسه الذي تستخدمه في الإنتاج، واحسب عدد المهام الناجحة.
  4. اقسم الإنفاق الكلي على عدد المهام الناجحة. التكلفة لكل مهمة ناجحة هي الرقم الذي تجب مقارنته، لأن الإعداد الرخيص الذي يفشل أكثر ليس رخيصًا.
  5. اختر أرخص إعداد يتجاوز عتبة الجودة لديك، ثم وجّه المهام الفاشلة فقط إلى إعداد أعلى.
  6. أعد التشغيل عندما يتغير سعر أو مستوى effort الافتراضي.

لمعرفة كيف تغيّر مستويات effort فاتورة النموذج الواحد، راجع مستويات effort في Opus 5.5 هي السعر الحقيقي.

تحفظات

المصادر

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research