Kostenmodel GPT-6 Luna
Bijgewerkt September 23, 2026 · eerst gepubliceerd September 23, 2026
GPT-6 Luna is het goedkope model in de GPT-6-familie van OpenAI, uitgebracht op 22 september 2026 naast GPT-6 Sol. OpenAI richt het op werk met hoog volume en een duidelijk doel: samenvatten, extractie en snelle vragen. Tegen $0.10 per 1M input-tokens is dit het model waar je als eerste naartoe routeert, en waar je pas van afstapt als de taak bewijst dat er meer nodig is.
Prijzen van GPT-6 Luna
| Tier | Input | Gecachete input | Output |
|---|---|---|---|
| Standard | $0.10 | $0.01 | $0.50 |
| Batch of flex | $0.05 | $0.005 | $0.25 |
| Fast mode | $0.20 | $0.02 | $1.00 |
| Lange context (meer dan 272K input) | $0.20 | $0.02 | $0.75 |
Per 1M tokens, van de prijspagina van OpenAI. Een cache-schrijfactie kost $0.125. Luna heeft hetzelfde contextvenster van 1,050,000 tokens als de rest van GPT-6, een kennisgrens van mei 2026 (de nieuwste van de drie) en het volledige effortbereik van none tot max.
Dezelfde score als GPT-5.6 Luna, 61% goedkoper per taak
Artificial Analysis liet beide Luna-generaties op max effort door zijn Intelligence Index (v4.3.2) lopen.
| Model | Indexscore | Kosten per taak | Outputsnelheid |
|---|---|---|---|
| GPT-6 Luna (max) | 37 | $0.07 | 132.2 tokens/s |
| GPT-5.6 Luna (max) | 37 | $0.18 | 142.3 tokens/s |
| GPT-6 Sol (low) | 33.9 | $0.13 | — |
De score bewoog niet. De kosten per taak daalden 61%, vooral door de lagere prijs per token. GPT-6 Luna op max verslaat ook GPT-6 Sol op low effort, zowel op score als op kosten. Als je Sol op low effort draaide om geld te besparen, is Luna op max op deze index de betere deal.
Wat hoog volume kost
Een miljoen classificatierequests per maand, elk met 600 input-tokens en 100 output-tokens, zonder caching:
| Model | Maandelijkse kosten |
|---|---|
| GPT-6 Luna, batch | $55 |
| GPT-6 Luna | $110 |
| GPT-5.6 Luna | $240 |
| Claude Haiku 4.5 | $1,100 |
| GPT-6 Sol | $2,200 |
| GPT-6 Astra | $11,000 |
Claude Haiku 4.5 kost 10× meer per token en scoorde 15 op dezelfde index, als niet-redenerend model. Hetzelfde werk van Sol naar Luna verplaatsen verlaagt de rekening met 95%, en daarom loont het een router te bouwen die alleen de moeilijke gevallen naar Sol stuurt.
De keerzijde: latentie en breedsprakigheid
De indexcijfers hierboven gelden voor max effort, en op max effort is Luna traag met starten. Artificial Analysis mat 104 seconden tot het eerste token. Het gebruikte ook 150M output-tokens over de hele index, tegen een mediaan van 84M, wat Artificial Analysis als enigszins breedsprakig omschrijft. Die breedsprakigheid zit al in de $0.07 per taak, dus het kostencijfer klopt, maar de wachttijd past niet bij een chat voor gebruikers.
Draai Luna voor interactief verkeer op none, low of het standaard medium en meet de nauwkeurigheid op je eigen prompts. De scores op deze pagina gelden alleen voor max effort, dus de nauwkeurigheid bij lagere instellingen moet je testen, niet opzoeken. Bewaar max effort voor batchjobs, waar latentie er niet toe doet en batchprijzen de rekening nogmaals halveren.
Rate limits schalen verder dan bij Sol
Luna begint op Tier 1 met 500K tokens per minuut, net als Sol, maar bereikt op Tier 5 180M tokens per minuut (Sol stopt bij 40M), met tot 30,000 requests per minuut. Voor bulkpipelines telt die ruimte net zo zwaar als de prijs.
Hoe je Luna gebruikt
- Routeer op taaktype: extractie, classificatie, tagging en korte samenvattingen gaan standaard naar Luna.
- Stuur niet-urgent volume via de Batch API tegen $0.05/$0.25.
- Kies effort per route: low voor interactief, max voor offlinejobs.
- Escaleer naar GPT-6 Sol wanneer een validator de output van Luna afwijst, niet vooraf.
Bronnen: modelpagina OpenAI GPT-6 Luna, Artificial Analysis: GPT-6 Luna, Artificial Analysis: GPT-5.6 Luna, TechCrunch. Prijzen gelezen op 23 september 2026.
Gerelateerd
- Prijzen GPT-6: Astra, Sol en Luna
- Kostenmodel GPT-6 Sol
- Kostenmodel GPT-6 Astra
- Kostengids voor redeneermodellen
- Tracker voor LLM-API-prijzen
Wilt u dit toepassen op uw stack? Neem leveranciersfacturen, gatewaylogs en de belangrijkste workflows mee; we brengen kostenfactoren en besparingskansen in kaart. Plan een gratis audit →