معايير السياق الطويل لـ GPT-6 Sol: ما قيس فعلاً، وما يخص GPT-5.6 Sol
آخر تحديث September 27, 2026 · نُشر أول مرة September 27, 2026
حتى 27 سبتمبر 2026، لدى GPT-6 Sol درجة مستقلة واحدة فقط في السياق الطويل: 84% في Artificial Analysis AA-LCR v1.1، مساوية لـ GPT-5.6 Sol. تبلغ مستندات هذا الاختبار نحو 100K رمز في المتوسط. ولم ينشر أحد بعد كيف يصمد GPT-6 Sol عند 256K أو 512K أو 1M رمز. ومعظم أرقام السياق الطويل المنسوبة إلى «Sol» على الإنترنت، ومنها درجة MRCR البالغة 91.5%، تخص GPT-5.6 Sol. أما GPT-6 Sol فصدر في 22 سبتمبر.
هذا مهم للتكلفة لأن السياق الطويل هو الموضع الذي تقفز فيه أسعار GPT-6. فوق 272K رمز إدخال يُفوتر الطلب كله بأسعار السياق الطويل. وتحديد حجم السياق الذي يحتفظ به الوكيل يعني الموازنة بين هذا السعر وبيانات جودة لم توجد بعد.
ما درجات السياق الطويل المتوفرة لـ GPT-6 Sol؟
درجة إجمالية واحدة، عند نحو 100K رمز.
| النموذج | AA-LCR v1.1 | الترتيب |
|---|---|---|
| GPT-6 Sol (max) | 84.0% | 7 |
| GPT-5.6 Sol (max) | 84.0% | 7 |
| GPT-6 Astra | 80.7% | 27 |
| Kimi K3 (المتصدر، 24 سبتمبر 2026) | 88.7% | 1 |
يضم AA-LCR 100 سؤال مكتوبة يدوياً على مجموعات مستندات يبلغ متوسطها 99,325 رمزاً. ويجب تركيب الإجابات من عدة مقاطع لا العثور عليها في مقطع واحد. فهو يختبر الاستدلال على مدخل طويل. ولا يُظهر كيف تتغير الدقة مع نمو المدخل، لأن كل الأسئلة بطول متقارب.
أي أرقام للسياق الطويل تخص GPT-5.6 Sol لا GPT-6 Sol؟
درجات MRCR. قارنت التغطية الإعلامية لإطلاق GPT-6 Astra بين Astra و«Sol» في اختبار MRCR v2 ذي 8 إبر من OpenAI. وكان ذلك Sol هو GPT-5.6 Sol، وهو ما يؤكده تقرير Vellum.
| MRCR v2، 8 إبر | 256K–512K | 512K–1M |
|---|---|---|
| GPT-6 Astra | 100% | 96.3% |
| GPT-5.6 Sol | 91.5% | 73.8% |
| GPT-6 Sol | غير منشورة | |
وتذكر مراجعة OrcaRouter لـ GPT-6 Sol الأمر نفسه: لدى GPT-5.6 Sol نتيجة منشورة لاسترجاع السياق الطويل، ولا يوجد لـ GPT-6 Sol ما يعادلها.
أين بحثنا؟
المواضع التي كانت ستنشرها، وفُحصت كلها في 27 سبتمبر 2026:
- Context Arena، لوحة صدارة MRCR. لا تضم قائمة نماذجها ونتائج الإبر الـ 8 أي مدخل GPT-6. وأحدث نماذج OpenAI فيها هي GPT-5.6 Sol وTerra وLuna.
- OpenAI: منشور إطلاق GPT-6 وملحق بطاقة النظام الخاص بـ Sol وLuna. ولا يقدم أي منهما نتائج Sol بحسب طول السياق.
- Artificial Analysis: AA-LCR فقط، كما أعلاه.
- Vals وVellum وDataCamp وemergent.sh وllm-stats وOrcaRouter: لا نتائج للسياق الطويل بحسب الطول لـ GPT-6 Sol.
ماذا ينبغي للفرق أن تفعل إلى أن تتوفر بيانات بحسب الطول؟
أبقِ طلبات GPT-6 Sol دون 272K رمز إدخال وضغط السياق مبكراً. تُظهر الأدلة حتى الآن أن GPT-6 Sol يطابق GPT-5.6 Sol عند نحو 100K. وقد حافظ GPT-5.6 Sol على 91.5% حتى 512K في MRCR لكنه هبط إلى 73.8% بعد ذلك. ومن المعقول توقع أن يكون GPT-6 Sol قابلاً للاستخدام حتى نحو 250K، لكن ذلك استنتاج لا قياس. وفوق 272K تدفع ضعف سعر الإدخال مقابل جودة لم يقسها أحد.
وفي Codex هذا هو الافتراضي أصلاً. فهو يمنح GPT-6 Sol نافذة 272K ويضغط عند 244,800 رمز. أما لوكلائك أنت، فأضف تنبيهاً على الطلبات التي تتجاوز 272K، وعامل أي زيادة على أنها أمر يجب اختباره. وشغّل فحص استرجاع خاصاً بك على مستنداتك قبل الاعتماد على سياق يتجاوز 256K.
سنحدّث هذه الصفحة حين تنشر Context Arena أو جهة تقييم مستقلة أخرى نتائج GPT-6 Sol بحسب طول السياق.
المصادر
- Artificial Analysis: GPT-6 Sol مقابل GPT-5.6 Sol
- Artificial Analysis: الإعلان عن AA-LCR
- BenchLM: لوحة صدارة AA-LCR
- Vellum: شرح معايير GPT-6 Astra
- OrcaRouter: GPT-6 Sol مقابل GPT-5.6 Sol
- Context Arena: لوحة صدارة MRCR
مقالات ذات صلة
- الضغط التلقائي في Codex على GPT-6 Sol: الإعدادات الافتراضية الفعلية
- أسعار GPT-6 Sol ونموذج التكلفة
- أسعار GPT-6 وقفزة سعر السياق الطويل عند 272K
هل تريد تطبيق ذلك على منصتك؟ أحضر فواتير المزوّدين وسجلات البوابة وأهم تدفقات العمل؛ وسنحدد محركات التكلفة وفرص التوفير. احجز تدقيقًا مجانيًا →