23 september 2026
OpenAI bracht GPT-6 Sol en GPT-6 Luna uit op 22 september 2026, en beide modellen kosten ongeveer de helft van hun GPT-5.6-tegenhangers. GPT-6 Sol kost $2 per miljoen inputtokens en $10 per miljoen outputtokens. GPT-6 Luna, bedoeld voor werk op grote schaal, kost $0,10 en $0,50. Beide modellen hebben een contextvenster van 1.050.000 tokens.
Wat zijn GPT-6 Sol en GPT-6 Luna?
GPT-6 Sol is het werkpaard voor programmeren, agenttaken en het automatiseren van bedrijfsprocessen. Het model staat onder GPT-6 Astra, dat OpenAI op 4 september 2026 uitbracht, maar het verslaat Astra nu op de eigen benchmark voor zakelijke taken. GPT-6 Luna is de kleine, snelle optie voor klussen die je duizenden keren per dag draait, zoals velden uit documenten halen of tickets samenvatten.
Beide modellen verwerken tekst en afbeeldingen en geven tekst terug. Sol heeft een kennisgrens van 20 april 2026 en Luna van 18 mei 2026. Elk model schrijft maximaal 128.000 tokens in een antwoord. Je bepaalt zelf hoe hard het model nadenkt met een instelling voor denkkracht, die loopt van geen tot max. Hetzelfde model kan dus goedkoop en snel zijn, of langzaam en grondig.
Waar je ze vandaag kunt gebruiken:
- API-modelnamen: gpt-6-sol en gpt-6-luna
- ChatGPT Work en Codex voor Plus, Pro, Business, Enterprise en Education
- GPT-6 Luna in de desktop-app voor Free- en Go-gebruikers
- Tot 90 procent korting op gecachete input, binnen een venster van 30 minuten
- Een dashboard voor prompt caching, cachediagnostiek, expliciete cachebreekpunten en cache prewarming
Benchmarks en prijzen van GPT-6 Sol
Dit haal je uit de tabel: Sol levert een punt of twee ruwe score in voor een flink lagere kosten per taak.
| Wat wordt gemeten | GPT-6 Sol | Beste concurrent in OpenAI’s eigen tabel |
|---|---|---|
| DeepSWE v1.1 (bugs oplossen als agent) | 68,8% op max effort | 69,9% (Claude Fable 5) |
| OSWorld 2.0 (een computer bedienen) | 60,5% | 60,3% (Claude Opus 5) |
| AutomationBench 1.0.6 (zakelijke taken) | 33,2% voor $0,27 per taak | Verslaat GPT-6 Astra en Claude Opus 5 |
| Agents’ Last Exam (lange agenttaken) | 56,4% op max effort | Verslaat Claude Opus 5 voor 60% minder |
| Prijs per miljoen tokens | $2 in, $10 uit | $10 in, $50 uit (Claude Fable 5.1) |
| Contextvenster | 1.050.000 tokens | 1.000.000 tokens (Claude Fable 5.1) |
Dit zijn de eigen metingen van OpenAI. OpenAI schrijft in de aankondiging dat de cijfers van concurrenten uit openbare rapporten komen en niet zelf zijn overgedaan, en dat de scores niet meten hoe vaak een model faalt in normaal dagelijks gebruik.
GPT-6 Luna maakt de grootste sprong. Het model scoort 66,6 procent op DeepSWE v1.1 op max effort, 2,2 punten achter Sol, en kost daarbij 93 procent minder per taak dan Claude Opus 5. Tegenover zijn eigen voorganger wint het 5,4 procentpunt en zakken de kosten per taak met 58 procent.
Wat OpenAI niet vertelt over GPT-6 Sol
De vergelijkingstabel was binnen een paar uur achterhaald. OpenAI zet Sol af tegen Claude Opus 5 en Claude Fable 5.1. Anthropic bracht diezelfde dag Claude Opus 5.5 uit voor $4 en $20 per miljoen tokens, met hogere scores dan Fable 5.1 op de meeste eigen programmeerbenchmarks. Het kostenvoordeel dat OpenAI claimt is echt, maar kleiner dan de aankondiging suggereert, want het Anthropic-model in de tabel is niet meer het model dat je zou kopen.
Twee andere gaten vallen op. OpenAI geeft beide modellen een venster van 1.050.000 tokens, maar publiceert geen enkele benchmark voor lange context die laat zien hoe goed ze het op die lengte doen. En op de dag van de lancering verschenen de varianten Sol Pro en Luna Pro op OpenRouter zonder dat de aankondiging ze noemt. Wat ze onderscheidt van de basismodellen is dus niet gedocumenteerd.
Wat dit betekent
GPT-6 Luna is het model dat je als eerste moet testen, en het is het model dat de meeste teams onderschatten. Een supportteam dat 40 miljoen tokens per maand door een classificatie- of extractiestap haalt, betaalt nu ongeveer $4 aan input waar GPT-5.6 Luna er zo’n $8 voor rekende, en krijgt een model dat op programmeertaken dicht bij Sol zit. Dat is precies het soort verandering dat een pilot naar productie tilt.
GPT-6 Sol is het testen waard als je al GPT-5.6 Sol draait, want de prijs halveert en de scores gaan omhoog. Begin je met een schone lei, test dan zelf tegen Claude Opus 5.5 in plaats van tegen de Opus 5-cijfers in de tabel van OpenAI, en meet de kosten per afgeronde taak in plaats van per miljoen tokens. De instelling voor denkkracht verandert het tokengebruik enorm, dus de prijs op papier zegt weinig zolang je niet hebt vastgesteld hoeveel denkkracht jouw werk echt nodig heeft. Wij zouden als eerste een ophaaltaak met lange context testen, want dat is de enige claim waarvoor OpenAI geen bewijs publiceert.
Voor meer informatie, bekijk de officiële aankondiging van GPT-6 Sol en GPT-6 Luna op de blog van OpenAI