التكلفة الفعلية لكل مهمة في النماذج الرائدة
Updated September 22, 2026 · first published September 22, 2026
تخبرك أسعار القائمة بتكلفة الرمز الواحد، لكنها لا تخبرك بتكلفة المهمة المكتملة، لأن النماذج تستهلك أعدادًا مختلفة جدًا من الرموز لإنجاز العمل نفسه. تضع هذه الصفحة التكلفة المقيسة لكل مهمة ونتيجة الجودة جنبًا إلى جنب لكل من Claude Opus 5.5 وClaude Opus 5 وClaude Fable 5.1 وGPT-6 Astra وGPT-6 Sol عند كل مستوى effort. لكل رقم مصدر، ولا شيء مقدَّر.
الجواب المختصر: GPT-6 Sol هو أرخص طريق للوصول إلى أي نتيجة حتى 47.5. وفوق 47.5 يكون Opus 5.5 الأرخص عند كل مستوى. لا يوجد إعداد كفء من حيث التكلفة لـ GPT-6 Astra فوق low ولا لـ Opus 5 ولا لـ Fable 5.1: كل واحد منها يتفوق عليه إعداد ما من Sol أو Opus 5.5 في النتيجة والسعر معًا.
المنهجية
جميع النتائج والتكاليف مأخوذة من Artificial Analysis Intelligence Index الإصدار v4.3.2، بتاريخ الاطلاع 22 سبتمبر 2026. يضم المؤشر عشرة تقييمات: AA-Briefcase وGDPval-AA وAutomationBench-AA وTerminal-Bench 4.0 وSciCode وHumanity's Last Exam وGDP.pdf وCritPt وAA-Omniscience وAA-LCR. تشغّل Artificial Analysis كل نموذج عند كل مستوى effort عبر واجهة API الخاصة بالمزوّد، وتسجل ما تدفعه بأسعار القائمة. التكلفة لكل مهمة هي هذا الإنفاق لكل مهمة، مقسومًا بين الإدخال والإخراج. تمر جميع الصفوف بالمجموعة نفسها، لذا يمكن مقارنتها مباشرة.
هناك حدّان قبل قراءة الأرقام. أولًا، المؤشر مزيج واحد من المهام. مزيج مهامك سيغيّر التكاليف، ولهذا يشرح القسم الأخير كيف تقيس تكاليفك بنفسك. ثانيًا، لا تُقارن النتائج بين إصدارات مختلفة من المؤشر، فلا تخلط هذه الأرقام بأرقام نُشرت سابقًا.
القائمة الكاملة: 26 إعدادًا
رموز الإخراج لكل مهمة هي الرموز التي يكتبها النموذج، بما فيها الاستدلال. لا تنشر Artificial Analysis التقسيم بين الإدخال والإخراج لإعدادات GPT-6 Sol الأربعة الوسطى، لذلك تظهر تلك الخانات بقيمة n/a.
| النموذج | Effort | Intelligence Index | التكلفة لكل مهمة | تكلفة الإدخال | تكلفة الإخراج | رموز الإخراج لكل مهمة | على الحد الأمثل |
|---|---|---|---|---|---|---|---|
| GPT-6 Sol | none | 28.1 | $0.33 | $0.28 | $0.05 | 4,900 | لا |
| GPT-6 Sol | low | 33.9 | $0.13 | n/a | n/a | 3,400 | نعم |
| GPT-6 Sol | medium (افتراضي) | 39.8 | $0.25 | n/a | n/a | 6,500 | نعم |
| GPT-6 Sol | high | 42.8 | $0.37 | n/a | n/a | 10,200 | نعم |
| GPT-6 Sol | xhigh | 44.1 | $0.53 | n/a | n/a | 16,000 | نعم |
| GPT-6 Sol | max | 47.5 | $1.06 | $0.74 | $0.31 | 31,200 | نعم |
| GPT-6 Astra | low | 45.8 | $0.82 | $0.60 | $0.22 | 4,400 | نعم |
| GPT-6 Astra | medium | 49.6 | $1.54 | $1.06 | $0.48 | 9,600 | لا |
| GPT-6 Astra | high | 50.9 | $1.73 | $1.13 | $0.59 | 11,800 | لا |
| GPT-6 Astra | xhigh | 52.4 | $2.31 | $1.46 | $0.85 | 16,900 | لا |
| GPT-6 Astra | max | 52.7 | $3.26 | $1.90 | $1.36 | 27,200 | لا |
| Claude Opus 5 | low | 39.4 | $1.10 | $0.73 | $0.37 | 14,700 | لا |
| Claude Opus 5 | medium | 44.8 | $2.19 | $1.47 | $0.72 | 29,000 | لا |
| Claude Opus 5 | high (افتراضي) | 48.1 | $3.61 | $2.46 | $1.16 | 46,200 | لا |
| Claude Opus 5 | xhigh | 49.7 | $4.88 | $3.36 | $1.52 | 60,700 | لا |
| Claude Opus 5 | max | 50.8 | $5.86 | $4.05 | $1.81 | 72,500 | لا |
| Claude Opus 5.5 | low | 42.3 | $0.55 | $0.35 | $0.20 | 10,200 | لا |
| Claude Opus 5.5 | medium (افتراضي) | 51.2 | $1.34 | $0.82 | $0.51 | 25,700 | نعم |
| Claude Opus 5.5 | high | 53.6 | $1.82 | $1.11 | $0.71 | 35,600 | نعم |
| Claude Opus 5.5 | xhigh | 56.0 | $3.46 | $2.15 | $1.31 | 65,700 | نعم |
| Claude Opus 5.5 | max | 57.6 | $5.98 | $3.60 | $2.38 | 119,200 | نعم |
| Claude Fable 5.1 | low | 46.8 | $2.37 | $1.30 | $1.08 | 21,600 | لا |
| Claude Fable 5.1 | medium | 48.9 | $2.98 | $1.59 | $1.39 | 27,900 | لا |
| Claude Fable 5.1 | high | 51.2 | $3.91 | $2.01 | $1.90 | 38,100 | لا |
| Claude Fable 5.1 | xhigh | 53.2 | $5.98 | $2.96 | $3.02 | 60,500 | لا |
| Claude Fable 5.1 | max | 53.4 | $7.63 | $3.73 | $3.90 | 78,100 | لا |
على الحد الأمثل يعني أنه لا يوجد إعداد آخر في هذا الجدول يحقق نتيجة أعلى بمال أقل.
الحد الأمثل للتكلفة
عشرة من الإعدادات الستة والعشرين تقع على الحد الأمثل. بعد ترتيبها حسب التكلفة، هي الإعدادات الوحيدة التي تستحق النظر إذا كان السعر هو المعيار الوحيد. كل ما عداها يدفع أكثر مقابل النتيجة نفسها أو أقل.
| الإعداد | Intelligence Index | التكلفة لكل مهمة | لكل 10,000 مهمة |
|---|---|---|---|
| GPT-6 Sol · low | 33.9 | $0.13 | $1,300 |
| GPT-6 Sol · medium | 39.8 | $0.25 | $2,500 |
| GPT-6 Sol · high | 42.8 | $0.37 | $3,700 |
| GPT-6 Sol · xhigh | 44.1 | $0.53 | $5,300 |
| GPT-6 Astra · low | 45.8 | $0.82 | $8,200 |
| GPT-6 Sol · max | 47.5 | $1.06 | $10,600 |
| Claude Opus 5.5 · medium | 51.2 | $1.34 | $13,400 |
| Claude Opus 5.5 · high | 53.6 | $1.82 | $18,200 |
| Claude Opus 5.5 · xhigh | 56.0 | $3.46 | $34,600 |
| Claude Opus 5.5 · max | 57.6 | $5.98 | $59,800 |
للحد الأمثل منطقتان. من 0.13 دولار إلى 1.06 دولار يكاد يكون كله GPT-6 Sol، والاستثناء الوحيد هو GPT-6 Astra low عند 0.82 دولار. ومن 1.34 دولار فصاعدًا لا يوجد إلا Opus 5.5. الفارق بين المنطقتين صغير: يحقق Opus 5.5 medium نتيجة أعلى من Sol max بـ 3.7 نقطة مقابل 0.28 دولار إضافية لكل مهمة.
مقارنة مباشرة عند نتيجة مساوية أو أفضل
يقارن كل زوج إعدادًا أرخص بإعداد أغلى يحقق النتيجة نفسها أو أقل.
| الإعداد الأرخص | الإعداد الأغلى | فارق النتيجة | التوفير |
|---|---|---|---|
| Opus 5.5 medium: 51.2, $1.34 | Opus 5 high: 48.1, $3.61 | +3.1 لصالح Opus 5.5 | 63% |
| Opus 5.5 medium: 51.2, $1.34 | Opus 5 max: 50.8, $5.86 | +0.4 لصالح Opus 5.5 | 77% |
| Opus 5.5 medium: 51.2, $1.34 | Fable 5.1 high: 51.2, $3.91 | تعادل | 66% |
| Opus 5.5 high: 53.6, $1.82 | GPT-6 Astra max: 52.7, $3.26 | +0.9 لصالح Opus 5.5 | 44% |
| Opus 5.5 high: 53.6, $1.82 | Fable 5.1 max: 53.4, $7.63 | +0.2 لصالح Opus 5.5 | 76% |
| GPT-6 Sol max: 47.5, $1.06 | Opus 5 high: 48.1, $3.61 | +0.6 لصالح Opus 5 | 71% |
يهم صف Opus 5 الفرق التي لم تنتقل بعد. كان Opus 5 يعمل افتراضيًا على high. أما Opus 5.5 فيعمل افتراضيًا على medium، وعند هذا الإعداد يحقق 3.1 نقطة أكثر بتكلفة أقل بنسبة 63% لكل مهمة. تقول Anthropic إن Opus 5.5 أرخص بنسبة 40% من Opus 5؛ والفارق المقيس على هذا المؤشر أوسع من هذا الادعاء.
أين يذهب المال: الإدخال لا الإخراج
في كل النماذج يمثل الإدخال ما بين نصف التكلفة لكل مهمة وثلاثة أرباعها تقريبًا. في Opus 5.5 عند medium، يذهب 0.82 دولار من 1.34 دولار إلى الإدخال، أي 61%. وفي GPT-6 Astra عند max تبلغ النسبة 58%، وفي GPT-6 Sol عند max تبلغ 70%، وفي Fable 5.1 عند max تبلغ 49%. تعيد مهام الوكلاء إرسال سياقها المتنامي في كل خطوة، لذا يزداد إنفاق الإدخال مع عدد الخطوات، لا مع طول الإجابة فقط.
لهذا يكلّف GPT-6 Sol بلا استدلال أكثر منه عند low: 0.33 دولار مقابل 0.13 دولار، رغم أنه لا يكتب سوى 4,900 رمز إخراج. 0.28 دولار من 0.33 دولار هي إدخال. السبب المرجح هو كثرة الخطوات، وكل خطوة تعيد إرسال السياق. إيقاف الاستدلال لا يجعل الوكيل أرخص إذا احتاج بعده إلى جولات أكثر.
بالنسبة إلى فاتورتك، يعني هذا أن التخزين المؤقت مهم بقدر أهمية اختيار النموذج. يتقاضى Opus 5.5 وGPT-6 Sol كلاهما 0.20 دولار لكل مليون رمز إدخال مخزّن مؤقتًا. ويتقاضى GPT-6 Astra دولارًا واحدًا، وOpus 5 نحو 0.50 دولار.
حجم الرموز مقابل سعر القائمة
GPT-6 Astra هو أكثر النماذج هنا اقتصادًا في الرموز. عند max يكتب 27,200 رمز إخراج لكل مهمة، مقابل 119,200 لـ Opus 5.5 عند max. لكن Astra يتقاضى 10 دولارات و50 دولارًا لكل مليون، أي 2.5× سعر Opus 5.5. يفوز سعر القائمة: يكلّف Opus 5.5 high نحو 1.82 دولار لكل مهمة بنتيجة 53.6، بينما يكلّف Astra max نحو 3.26 دولار بنتيجة 52.7.
Opus 5.5 عند max هو الموضع الوحيد الذي تصبح فيه الإطالة مكلفة. تكلّف رموز الإخراج البالغة 119,200 نحو 2.38 دولار قبل أي إدخال، وتكلّف المهمة كاملة 5.98 دولار. هذا يشتري أعلى نتيجة في الجدول، 57.6، لكنه يساوي 4.5× تكلفة medium.
تناقص العائد مع رفع مستوى effort
يوضح كل صف ما تشتريه زيادة مستوى effort درجة واحدة، بنقاط المؤشر مقابل التكلفة الإضافية لكل مهمة.
| النموذج | medium → high | xhigh → max |
|---|---|---|
| GPT-6 Sol | +3.0 نقطة مقابل +48% | +3.4 نقطة مقابل +100% |
| GPT-6 Astra | +1.3 نقطة مقابل +12% | +0.3 نقطة مقابل +41% |
| Claude Opus 5 | +3.3 نقطة مقابل +65% | +1.1 نقطة مقابل +20% |
| Claude Opus 5.5 | +2.4 نقطة مقابل +36% | +1.6 نقطة مقابل +73% |
| Claude Fable 5.1 | +2.3 نقطة مقابل +31% | +0.2 نقطة مقابل +28% |
في Fable 5.1 وGPT-6 Astra لا يشتري max شيئًا يُذكر: 0.2 و0.3 نقطة مقابل زيادة 28% و41%. وفي Opus 5.5 لا يزال الانتقال إلى max يضيف 1.6 نقطة، لكن بتكلفة أعلى بنسبة 73%. استخدم max فقط في المهام التي قست فيها أن النقاط الإضافية تغيّر النتيجة.
متى يكفي GPT-6 Sol max
المؤشر متوسط، والفجوة بين Sol max وOpus 5.5 medium ليست متساوية عبر التقييمات. النتائج لكل تقييم من Artificial Analysis:
| التقييم | Opus 5.5 medium ($1.34) | GPT-6 Sol max ($1.06) |
|---|---|---|
| Terminal-Bench 4.0 | 52.5 | 43.9 |
| AutomationBench-AA | 61.2 | 61.6 |
| GDPval-AA (Elo) | 1576 | 1487 |
| AA-Briefcase (Elo) | 1642 | 1483 |
| Humanity's Last Exam | 54.7 | 47.9 |
| SciCode | 59.3 | 57.6 |
| CritPt | 27.7 | 30.9 |
| AA-LCR | 84.3 | 83.7 |
في AutomationBench وCritPt يعادل GPT-6 Sol أداء Opus 5.5 عند medium أو يتفوق عليه، بتكلفة 1.06 دولار لكل مهمة مقابل 1.34 دولار. وفي Terminal-Bench وتقييمات العمل المعرفي وHumanity's Last Exam يتقدم Opus 5.5 بفارق كبير. يمكن تشغيل أتمتة سير العمل على Sol. أما وكلاء الطرفية والبرمجة والعمل المعرفي كثيف المستندات فهي حيث يستحق Opus 5.5 سعره.
ادعاءات المزوّد مقابل الأرقام المستقلة
كثيرًا ما تختلف أرقام المزوّدين عن الأرقام المستقلة، لأنها تستخدم بيئات اختبار وإعدادات مختلفة. تعلن Anthropic أن Opus 5.5 عند xhigh يحقق 66.4% في Terminal-Bench 4.0. وتقيس Artificial Analysis نسبة 59.6% عند المستوى نفسه.
| Effort | Opus 5.5 | Fable 5.1 |
|---|---|---|
| low | 31.3% | 40.4% |
| medium | 52.5% | 44.9% |
| high | 56.6% | 52.0% |
| xhigh | 59.6% | 55.1% |
| max | 59.6% | 52.0% |
قد يتغير الترتيب أيضًا حسب المؤشر. في Vals AI Index يأتي Fable 5.1 أولًا بنسبة 68.83%، وGPT-6 Astra ثالثًا بنسبة 66.61%، وOpus 5.5 رابعًا بنسبة 66.16%. لا تُنشر هناك التكلفة لكل مهمة على الأساس نفسه، لذا لا يغيّر ذلك الحد الأمثل أعلاه. المؤشر الواحد مجرد زاوية نظر واحدة.
أسعار القائمة ومهمة كثيفة الذاكرة المؤقتة
حسبت Digital Applied سعر مهمة وكيل واحدة كثيفة الذاكرة المؤقتة على كل نموذج: 8M رمز قراءة من الذاكرة المؤقتة، و400K إدخال غير مخزّن، و600K رمز كتابة في الذاكرة المؤقتة، و300K رمز إخراج. تتبع النتيجة الحد الأمثل، مع غرامة إضافية على GPT-6 Astra.
| النموذج | الإدخال $/MTok | الإخراج $/MTok | قراءة الذاكرة المؤقتة $/MTok | مهمة كثيفة الذاكرة المؤقتة (Digital Applied) |
|---|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | $0.20 | $6.90 |
| Claude Opus 5.5 | $4.00 | $20.00 | $0.20 | $12.20 |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $17.25 |
| Claude Fable 5.1 | $10.00 | $50.00 | $0.25 | $28.50 |
| GPT-6 Astra (≤272K) | $10.00 | $50.00 | $1.00 | $34.50 |
| GPT-6 Astra (>272K) | $20.00 | $75.00 | n/a | $61.50 |
يحاسب GPT-6 Astra الطلب كله بسعر 20 دولارًا و75 دولارًا لكل مليون بمجرد تجاوز الإدخال 272K رمز. أما Opus 5.5 فيحافظ على سعر واحد عبر نافذته البالغة 1M رمز. تكلّف الكتابة في الذاكرة المؤقتة لدى Opus 5.5 نحو 5 دولارات لكل مليون للذاكرة المؤقتة لمدة 5 دقائق و8 دولارات لمدة ساعة، وتُحاسب الدفعات بنسبة 50%، ويضاعف الوضع السريع السعر. للتفاصيل، راجع نموذج تكلفة Claude Opus 5.5 واقتصاديات الوضع السريع في Opus 5.5.
كيف تقيس تكلفتك الخاصة لكل مهمة
- سجّل الرموز لكل مهمة لا لكل طلب: الإدخال غير المخزّن، والإدخال المخزّن، والكتابة في الذاكرة المؤقتة، والإخراج، مجموعة عبر كل خطوات المهمة.
- خذ عينة من بضع مئات من المهام الحقيقية وأعد تشغيلها على إعدادين أو ثلاثة مرشحة، مثل Sol max وOpus 5.5 medium وOpus 5.5 high.
- قيّم كل نتيجة بالفحص نفسه الذي تستخدمه في الإنتاج، واحسب عدد المهام الناجحة.
- اقسم الإنفاق الكلي على عدد المهام الناجحة. التكلفة لكل مهمة ناجحة هي الرقم الذي تجب مقارنته، لأن الإعداد الرخيص الذي يفشل أكثر ليس رخيصًا.
- اختر أرخص إعداد يتجاوز عتبة الجودة لديك، ثم وجّه المهام الفاشلة فقط إلى إعداد أعلى.
- أعد التشغيل عندما يتغير سعر أو مستوى effort الافتراضي.
لمعرفة كيف تغيّر مستويات effort فاتورة النموذج الواحد، راجع مستويات effort في Opus 5.5 هي السعر الحقيقي.
تحفظات
- جميع التكاليف بأسعار قائمة API على مزيج مهام Artificial Analysis. الخصومات وتسعير الدفعات والتخزين المؤقت الخاص بك تغيّرها.
- تصنّف Artificial Analysis إدخالات Opus 5.5 وFable 5.1 بعلامة Default Fallback. راجع ملاحظات المنهجية قبل اعتبار كل صف إعداد API نفسه.
- النتائج من إصدار المؤشر v4.3.2 فقط. الإصدارات السابقة استخدمت تقييمات مختلفة ولا يمكن مقارنتها.
- مهمة Digital Applied كثيفة الذاكرة المؤقتة حمل عمل توضيحي واحد، وليست قياسًا.
- تتغير الأرقام عندما يغيّر المزوّدون الأسعار أو الإعدادات الافتراضية. تاريخ الاطلاع هو 22 سبتمبر 2026.
المصادر
- Artificial Analysis Intelligence Index
- Artificial Analysis: Claude Opus 5.5
- Artificial Analysis: Claude Opus 5
- Artificial Analysis: Claude Fable 5.1
- Artificial Analysis: GPT-6 Astra
- Artificial Analysis: GPT-6 Sol
- Digital Applied: GPT-6 Sol vs Claude Opus 5.5 cost benchmarks
- Digital Applied: Claude Opus 5.5 vs GPT-6 Astra
- Digital Applied: Is Claude Fable 5.1 still worth it?
- Digital Applied: Claude Opus 5.5 launch pricing and benchmarks
- Digital Applied: Opus 5.5 vs Grok 4.7 vs Muse Spark 1.3 cost per task
Related
- نموذج تكلفة Claude Opus 5.5
- مستويات effort في Opus 5.5 هي السعر الحقيقي
- اقتصاديات الوضع السريع في Opus 5.5
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →