GPT-6 Sol ile Codex otomatik sıkıştırma: kaynak koddaki varsayılanlar ve yükseltmenin maliyeti
Güncellendi September 27, 2026 · ilk yayın September 27, 2026
Codex, GPT-6 Sol oturumunu 244,800 tokende otomatik sıkıştırır: modele atadığı 272,000 tokenlik pencerenin %90ı. model_auto_compact_token_limit değerini bu sayının üstüne çıkarmak, model_context_window değerini de yükseltmediğiniz sürece hiçbir şey yapmaz. Pencereyi 272K'nın üstüne taşırsanız, çizgiyi geçen her tur uzun bağlam fiyatıyla faturalanır. Sayıları Codex 0.157.1 kaynak kodundan ve Codex'in indirdiği model kataloğundan okuduk.
Codex GPT-6 Sol'a hangi bağlam penceresini veriyor?
API 922,000'e kadar kabul etse de Codex 272,000 token verir. Codex bir model kataloğu indirir ve bunu ~/.codex/models_cache.json içinde önbelleğe alır. gpt-6-sol girişi, context_window değerini 272,000, max_context_window değerini 872,000 olarak listeler. Ayrıca effective_context_window_percent değerini 95 yapar ve auto_compact_token_limit alanını boş bırakır. GPT-6 Astra ve GPT-6 Luna aynı değerlere sahip.
272K rastgele bir sayı değil. Tam olarak GPT-6 uzun bağlam fiyatlandırmasının başladığı yer.
| Değer | Token | Nereden geliyor |
|---|---|---|
| Bağlam penceresi | 272,000 | model kataloğundaki context_window |
| Kullanılabilir pencere | 258,400 | pencerenin %95i (effective_context_window_percent) |
| Otomatik sıkıştırma eşiği | 244,800 | pencerenin %90ı, kodda hesaplanır |
| İzin verilen en büyük pencere | 872,000 | model kataloğundaki max_context_window |
| API girdi limiti | 922,000 | OpenAI model spesifikasyonu (çıktıyla birlikte toplam 1.05M) |
Codex ne zaman sıkıştıracağına nasıl karar veriyor?
Yapılandırdığınız limit ile bağlam penceresinin %90ından küçük olanı seçer. codex-rs/protocol/src/openai_models.rs içinde auto_compact_token_limit(), context_window * 9 / 10 değerini hesaplar. Bu değeri ya da yapılandırdığınız limiti döndürür, hangisi düşükse. Katalog GPT-6 Sol için bir limit göndermediğinden, varsayılan sonuç 272,000 × 0.9 = 244,800.
Yani bu ayar sıkıştırmayı yalnızca daha erkene alabilir. Varsayılan pencereyle config.toml içine model_auto_compact_token_limit = 300000 yazsanız bile Codex uyarı vermeden 244,800'de sıkıştırmaya devam eder. Sıkıştırmayı daha geç yapmak için model_context_window değerini de yükseltmeniz gerekir ve bu tavanı da kaydırır: 872,000 maksimumunda varsayılan eşik 784,800 olur.
İkinci bir ayar olan model_auto_compact_token_limit_scope varsayılan olarak total değerindedir ve etkin bağlamın tamamını sayar. Alternatif body_after_prefix, konuşmanın önceden taşıdığı bağlamdan sonra eklediği kısmı sayar.
Codex penceresini 272K'nın üstüne çıkarmak ne kadara mal olur?
Tur başına, ek tokenlerin çok ötesinde. Bir GPT-6 Sol isteğinin girdisi 272K tokeni geçtiği anda, isteğin tamamı uzun bağlam fiyatıyla faturalanır. Girdi ve önbellekli girdi iki kat, çıktı 1,5 kat pahalıya gelir. Uzun bir ajan oturumunda neredeyse her tur tüm geçmişi yeniden gönderir, bu yüzden girdinin çoğu önbelleğe alınmış ön ektir.
| Tur başına bağlam | Önbellekli girdi fiyatı | Tur başına önbellekli bağlam maliyeti | Tur başına önbelleksiz maliyet |
|---|---|---|---|
| 240K (varsayılanda sıkıştırılır) | $0.20 / 1M | $0.048 | $0.48 |
| 270K | $0.20 / 1M | $0.054 | $0.54 |
| 300K (pencere yükseltildi) | $0.40 / 1M | $0.12 | $1.20 |
| 400K (pencere yükseltildi) | $0.40 / 1M | $0.16 | $1.60 |
270K'dan 300K'ya çıkmak tokeni %11 artırır, ama her turun maliyetini 2,2 kat yapar. ChatGPT planında bir fatura görmezsiniz, ancak aynı tokenler 5 saatlik ve haftalık Codex limitlerinize sayılır, bu yüzden daha büyük pencere onları daha hızlı tüketir. context-window-paid-twice yazısı, bu tekrarlı ücretin uzun oturumlarda neden baskın olduğunu açıklıyor.
GPT-6 Sol 244K tokene yakınken hâlâ doğru mu?
Bunu henüz kimse ölçmedi. GPT-6 Sol için bilinen tek bağımsız uzun bağlam skoru Artificial Analysis AA-LCR: %84, GPT-5.6 Sol ile aynı. Bu testteki belgeler ortalama yaklaşık 100K token. 256K–512K aralığında “Sol” için alıntılanan MRCR rakamları GPT-5.6 Sol'a ait. GPT-6 Sol uzun bağlam benchmark özetimiz, 27 Eylül 2026 itibarıyla neyin yayımlanıp neyin yayımlanmadığını listeliyor.
Ne ayarlamalısınız?
Çoğu ekip için hiçbir şey. Varsayılan zaten maliyet açısından güvenli seçim. 244,800'de sıkıştırmak her isteği, çıktı için pay bırakarak 272K fiyat çizgisinin altında tutar. Üç durum değişiklik gerektirir:
- Sıkıştırmanın daha erken olmasını istiyorsanız, örneğin uzun konuşmalar önceki talimatları erken kaybetmeye başlıyorsa.
model_auto_compact_token_limitdeğerini düşürün, mesela 200000. 244,800'in altındaki değerler gerçekten geçerli olur. - Mevcut varsayılanları yazılı hale getirmek istiyorsanız, böylece gelecekteki bir katalog güncellemesi onları sessizce değiştiremez.
model_context_window = 272000ve 244,800 veya altında bir limit ayarlayın. - Tek bir oturumda 258K'nın üstünde canlı bağlama ihtiyacınız varsa.
model_context_windowdeğerini yükseltin ve 272K'nın üstündeki her turda uzun bağlam fiyatını kabul edin. Codex arayüzünde fiyat değişikliğini gösteren bir şey olmadığı için bunun için bir uyarı kurun.
# ~/.codex/config.toml
model = "gpt-6-sol"
model_context_window = 272000 # pin the default window, below the 272K price line
model_auto_compact_token_limit = 240000 # anything above 244,800 is ignored at this window
Kaynaklar
- Codex 0.157.1 kaynağı:
auto_compact_token_limit()veusable_context_window() - Codex 0.157.1 kaynağı: model bilgisine uygulanan yapılandırma geçersiz kılmaları
- Codex 0.157.1 kaynağı: sıkıştırma kapsamı ve sert bağlam tavanı
- OpenAI API fiyatlandırması
- Artificial Analysis: GPT-6 Sol vs GPT-5.6 Sol
İlgili
- GPT-6 Sol uzun bağlam benchmarkları: gerçekte ölçülen şeyler
- GPT-6 fiyatlandırması ve 272K uzun bağlam fiyat sıçraması
- Bağlam penceresinin parasını iki kez ödüyorsunuz
- ChatGPT Pro, Codex'i ne kadar içeriyor?
Bunu kendi altyapınıza uygulamak mı istiyorsunuz? Sağlayıcı faturalarını, ağ geçidi kayıtlarını ve ana iş akışlarını getirin; maliyet etkenlerini ve tasarruf yolunu çıkaralım. Ücretsiz denetim planlayın →