Ga naar inhoud

Kostenmodel GPT-6 Luna

Bijgewerkt September 23, 2026 · eerst gepubliceerd September 23, 2026

GPT-6 Luna is het goedkope model in de GPT-6-familie van OpenAI, uitgebracht op 22 september 2026 naast GPT-6 Sol. OpenAI richt het op werk met hoog volume en een duidelijk doel: samenvatten, extractie en snelle vragen. Tegen $0.10 per 1M input-tokens is dit het model waar je als eerste naartoe routeert, en waar je pas van afstapt als de taak bewijst dat er meer nodig is.

Prijzen van GPT-6 Luna

TierInputGecachete inputOutput
Standard$0.10$0.01$0.50
Batch of flex$0.05$0.005$0.25
Fast mode$0.20$0.02$1.00
Lange context (meer dan 272K input)$0.20$0.02$0.75

Per 1M tokens, van de prijspagina van OpenAI. Een cache-schrijfactie kost $0.125. Luna heeft hetzelfde contextvenster van 1,050,000 tokens als de rest van GPT-6, een kennisgrens van mei 2026 (de nieuwste van de drie) en het volledige effortbereik van none tot max.

Dezelfde score als GPT-5.6 Luna, 61% goedkoper per taak

Artificial Analysis liet beide Luna-generaties op max effort door zijn Intelligence Index (v4.3.2) lopen.

ModelIndexscoreKosten per taakOutputsnelheid
GPT-6 Luna (max)37$0.07132.2 tokens/s
GPT-5.6 Luna (max)37$0.18142.3 tokens/s
GPT-6 Sol (low)33.9$0.13—

De score bewoog niet. De kosten per taak daalden 61%, vooral door de lagere prijs per token. GPT-6 Luna op max verslaat ook GPT-6 Sol op low effort, zowel op score als op kosten. Als je Sol op low effort draaide om geld te besparen, is Luna op max op deze index de betere deal.

Wat hoog volume kost

Een miljoen classificatierequests per maand, elk met 600 input-tokens en 100 output-tokens, zonder caching:

ModelMaandelijkse kosten
GPT-6 Luna, batch$55
GPT-6 Luna$110
GPT-5.6 Luna$240
Claude Haiku 4.5$1,100
GPT-6 Sol$2,200
GPT-6 Astra$11,000

Claude Haiku 4.5 kost 10× meer per token en scoorde 15 op dezelfde index, als niet-redenerend model. Hetzelfde werk van Sol naar Luna verplaatsen verlaagt de rekening met 95%, en daarom loont het een router te bouwen die alleen de moeilijke gevallen naar Sol stuurt.

De keerzijde: latentie en breedsprakigheid

De indexcijfers hierboven gelden voor max effort, en op max effort is Luna traag met starten. Artificial Analysis mat 104 seconden tot het eerste token. Het gebruikte ook 150M output-tokens over de hele index, tegen een mediaan van 84M, wat Artificial Analysis als enigszins breedsprakig omschrijft. Die breedsprakigheid zit al in de $0.07 per taak, dus het kostencijfer klopt, maar de wachttijd past niet bij een chat voor gebruikers.

Draai Luna voor interactief verkeer op none, low of het standaard medium en meet de nauwkeurigheid op je eigen prompts. De scores op deze pagina gelden alleen voor max effort, dus de nauwkeurigheid bij lagere instellingen moet je testen, niet opzoeken. Bewaar max effort voor batchjobs, waar latentie er niet toe doet en batchprijzen de rekening nogmaals halveren.

Rate limits schalen verder dan bij Sol

Luna begint op Tier 1 met 500K tokens per minuut, net als Sol, maar bereikt op Tier 5 180M tokens per minuut (Sol stopt bij 40M), met tot 30,000 requests per minuut. Voor bulkpipelines telt die ruimte net zo zwaar als de prijs.

Hoe je Luna gebruikt

Bronnen: modelpagina OpenAI GPT-6 Luna, Artificial Analysis: GPT-6 Luna, Artificial Analysis: GPT-5.6 Luna, TechCrunch. Prijzen gelezen op 23 september 2026.

Gerelateerd


Wilt u dit toepassen op uw stack? Neem leveranciersfacturen, gatewaylogs en de belangrijkste workflows mee; we brengen kostenfactoren en besparingskansen in kaart. Plan een gratis audit →

Terug naar finopsllm.com