نموذج تكلفة Claude Fable 5.1
آخر تحديث September 1, 2026 · نُشر أول مرة September 1, 2026
سعر Claude Fable 5.1 (claude-fable-5-1) هو $10 لكل مليون رمز إدخال و$50 لكل مليون رمز إخراج. أما Opus 5 فسعره $5 و$25. وإذا قرأت هذه الأرقام الأربعة وحدها بدت Fable علاوة ثابتة بمقدار 2×. وهذا نموذج خاطئ. فسعر الإدخال المخزَّن مؤقتاً يتحرك في الاتجاه المعاكس، وفي أي حمل إنتاجي تقع معظم الرموز عادةً في الذاكرة المؤقتة.
الأسعار الأربعة التي تهم
النموذج ليس سعراً واحداً. فـ Fable 5.1 تحاسب على 5 أنواع من الرموز، واثنان منها فقط على العنوان الرئيسي.
| نوع الرمز | Fable 5.1 | Opus 5 |
|---|---|---|
| الإدخال (غير مخزَّن) | $10.00 / MTok | $5.00 / MTok |
| الإخراج | $50.00 / MTok | $25.00 / MTok |
| كتابة الذاكرة المؤقتة (5 دقائق) | $12.50 / MTok | $6.25 / MTok |
| كتابة الذاكرة المؤقتة (ساعة واحدة: 1-hour) | $20.00 / MTok | $10.00 / MTok |
| قراءة الذاكرة المؤقتة | $0.25 / MTok | $0.50 / MTok |
قراءة الذاكرة المؤقتة هي الاستثناء. فهي 2.5% من سعر قائمة الإدخال لدى Fable نفسها، وهي نصف ما يكلّفه الرمز المخزَّن نفسه على Opus 5. كل صف آخر هو 2×، أما هذا الصف وحده فهو 0.5×.
ماذا يفعل ذلك بحمل حقيقي
خذ وكيلاً بموجّه نظام من 100,000 رمز مع مخطط الأدوات والسياق المسترجَع، يُعاد استخدامها طوال جلسة. في استدعاء بارد تكلّف البادئة $1.00 على Fable و$0.50 على Opus 5. وفي استدعاء دافئ تكلّف $0.025 على Fable و$0.05 على Opus 5. فالمزوّد الذي كان أغلى بمرتين صار الآن بنصف السعر، على الموجّه نفسه، لأن الشيء الوحيد الذي تغيّر هو هل أصابت البادئة الذاكرة المؤقتة.
لذا فإن نقطة التعادل هي نسبة إصابة الذاكرة المؤقتة لا تفضيل نموذج. دون نحو 50% من رموز الإدخال المخدومة من الذاكرة المؤقتة، تهيمن علاوة إدخال Fable ويكون Opus 5 أرخص في البادئة. وفوقها يتقدم سعر Fable المخزَّن ويواصل التقدم. وتبقى رموز الإخراج 2× في الحالتين، ولذلك فإن الرافعة الثانية هي طول الإخراج لا اختيار النموذج.
الإخراج هو الجانب غير المحدود
تقبل Fable 5.1 نافذة سياق من 1M رمز ويمكنها إخراج ما يصل إلى 128K رمز في رد واحد. وبسعر $50 لكل مليون، فإن رداً واحداً من 128K يكلّف $6.40 إخراجاً. والتفكير الممتد مفعّل دائماً في هذا النموذج — ولا سبيل إلى إيقافه، وعنصر التحكم القديم budget_tokens يُرفض بخطأ 400. وما تحصل عليه بدلاً منه هو إعداد effort من low إلى max. وهذا الآن مقبض تكلفة، ومكانه في سياسة التوجيه بجانب اختيار النموذج، لا في الإعدادات الافتراضية للتطبيق التي لا يراجعها أحد.
لا يُعاد الاستدلال الخام أبداً، فلا تستطيع قياساتك إعادة بناء تكلفة التفكير من نص الرد. يجب أن تقرأها من كتلة usage في كل استدعاء وتخزّنها. وليس في هذا النموذج Priority Tier أيضاً، فلا يمكن شراء زمن الاستجابة — ويجب أن يتم تخطيط السعة بالتزامن والطوابير من جانبك.
ما الذي تقيسه قبل أن توجّه الحركة
ثلاثة حقول تحدد هل Fable 5.1 رخيصة أم باهظة عليك، ولا يظهر أي منها في جدول الأسعار.
- نسبة إصابة الذاكرة المؤقتة لكل ميزة. لا متوسط على مستوى الحساب — فواجهة محادثة عند 90% ومهمة دفعية عند 0% تُلغي إحداهما الأخرى لتعطي 45% بلا معنى.
- تضخم كتابة الذاكرة المؤقتة. كتابة 1-hour تكلّف 2× سعر إدخال القائمة. والبادئة التي تُعاد كتابتها أكثر مما تُقرأ خسارة صافية عند أي TTL.
- رموز الإخراج لكل مهمة ناجحة. لا تُبرَّر علاوة الإخراج 2× إلا إذا قلّت المحاولات المطلوبة. قِس التكلفة لكل مهمة ناجحة لا التكلفة لكل استدعاء.
ثم أجرِ المقارنة جسراً للتباين مع نموذجك الحالي، تفصل فيه السعر عن الحجم عن المزيج. فنموذج بضعف سعر القائمة ونصف السعر المخزَّن سيظهر كحركتين كبيرتين متعاكستين، والمتوسط سيخفيهما معاً.
ذات صلة
مقالات ذات صلة
هل تريد تطبيق ذلك على منصتك؟ أحضر فواتير المزوّدين وسجلات البوابة وأهم تدفقات العمل؛ وسنحدد محركات التكلفة وفرص التوفير. احجز تدقيقًا مجانيًا →