OpenAI lanceert GPT-6 Astra

04-09-2026

OpenAI heeft op 3 september 2026 GPT-6 Astra gelanceerd voor $10 per miljoen input-tokens en $50 per miljoen output-tokens. Het opvallendste is dat het model software rechtstreeks via het scherm bedient, in plaats van via API's. Zakelijke klanten uit het Daybreak-programma zijn als eerste aan de beurt voor de lancering, waarna de API en betaalde ChatGPT-abonnementen volgen.

Geschreven door:

Jorick van Weelie

Marketing Lead bij DataNorth | Next-Gen AI-enthousiast & Tech Storyteller

Meld je aan voor de Nieuwsbrief

Gepubliceerd 4 september 2026

OpenAI bracht GPT-6 Astra uit op 3 september 2026, voor $10 per miljoen invoertokens en $50 per miljoen uitvoertokens. Astra is gebouwd om software te bedienen zoals een mens dat doet. OpenAI meldt 72,6% op een offline deel van OSWorld 2.0, tegenover 65,7% voor GPT-5.6 Sol. De toegang begint bij een kleine groep zakelijke klanten, omdat Astra het eerste OpenAI-model is dat het niveau Critical voor cyberveiligheid bereikt binnen het Preparedness Framework van het bedrijf.

Wat kan GPT-6 Astra?

GPT-6 Astra werkt via schermen en knoppen, in plaats van via een API-koppeling voor elke applicatie. OpenAI laat zien hoe het model online formulieren invult, CRM-records bijwerkt, spreadsheets bewerkt, webonderzoek doet en engineeringsoftware zoals KiCad en FreeCAD bedient. De belofte is dat het model de klus afmaakt in plaats van uitlegt hoe jij dat moet doen.

Op OSWorld 2.0 meldt OpenAI dat Astra ongeveer 40 minuten per taak nodig heeft, waar GPT-5.6 Sol er ongeveer 75 nodig heeft. Dat is zo’n 47% minder tijd. OpenAI vernieuwde ook de Codex-harness, die volgens het bedrijf taken 1,9 keer sneller afrondt dan de huidige Sol-ervaring op de Mind2Web-benchmark.

Astra heeft in Codex een nieuwe functie voor lange sessies. In plaats van alle informatie tot één samenvatting te comprimeren wanneer het geheugen vol raakt, bewaart Astra nu de gegevens over meerdere contextvensters heen. Hierdoor blijven ook de eerdere delen van je gesprek gewoon doorzoekbaar. Je activeert deze experimentele functie via het configuratiebestand van Codex.

GPT-6 Astra benchmarks en prijzen

De tabel hieronder laat zien waar Astra duidelijk voorloopt, waar het nauwelijks voorloopt, en op welke onafhankelijke score het juist achterblijft.

Wat wordt gemetenGPT-6 AstraClaude
OSWorld 2.0, offline set (een computer bedienen)72,6%Claude Opus 5: 70,2%
Terminal-Bench 4.0 (terminal- en systeemtaken)57,9%Claude Fable 5.1: 55,8%
DeepSWE v1.1 (echte softwarebugs oplossen)74,1%Claude Opus 5: 73,7%
Artificial Analysis Intelligence Index v4.1.1 (onafhankelijke totaalscore)61,2Claude Fable 5.1: 65,7
ExploitBench (bekende lekken omzetten in werkende exploits)100%GPT-5.6 Sol: 78,5%
Prijs per miljoen tokens, invoer en uitvoer$10 en $50Claude Fable 5.1: $10 en $50

De genoemde cijfers komen rechtstreeks van OpenAI’s eigen lanceringspagina, inclusief de gepubliceerde Artificial Analysis-scores. Omdat OpenAI de meeste vergelijkende tests zelf heeft uitgevoerd, is enige voorzichtigheid geboden. Zo blijkt uit de voetnoten dat de testresultaten voor Claude (op OSWorld en BenchCAD) gebaseerd zijn op andere instellingen dan ontwikkelaar Anthropic zelf hanteert. Beschouw deze cijfers voorlopig dus slechts als een indicatie, totdat onafhankelijke partijen de resultaten kunnen reproduceren.

Fast mode verdubbelt de prijs naar $20 en $100 per miljoen tokens, voor maximaal twee keer de snelheid. Cache-leesacties en schrijfacties worden apart berekend en die tarieven staan niet op de lanceringspagina.

Hoe verhoudt GPT-6 Astra zich tot Claude Fable 5.1 en GPT-5.6 Sol?

Tegenover zijn eigen voorganger is het gat groot, precies op de punten die OpenAI aanprijst.

  • Terminal-Bench 4.0 gaat van 37,3% naar 57,9%.
  • ARC-AGI-3 gaat van 7,8% naar 99,9%.
  • FrontierMath Tier 4 gaat van 83,0% naar 97,6%.
  • Op de eigen langecontexttest van OpenAI, bij 512K tot 1M tokens, gaat de score van 73,8% naar 96,3%.

Tegenover Anthropic ligt het veel dichter bij elkaar.

  • Op DeepSWE v1.1, de codeerbenchmark waar de meeste teams naar kijken, scoort Astra 74,1% tegenover 73,7% voor Claude Opus 5 en 73,8% voor Gemini 3.8 Flash.
  • Op Humanity’s Last Exam met tools scoort Astra 57,2%, terwijl Claude Fable 5.1 op 65,0% uitkomt.
  • Op de Artificial Analysis Intelligence Index staat Astra op 61,2 tegenover 65,7 voor Fable 5.1.

Dit zijn de cijfers uit OpenAI’s eigen vergelijkingstabel. Als we er objectief naar kijken, is de conclusie een stuk genuanceerder dan de AGI-hype doet vermoeden. Astra blinkt weliswaar uit in computertaken, cybersecurity en complexe wiskunde, maar op het gebied van algemeen redeneren en alledaags programmeerwerk presteert het simpelweg op hetzelfde niveau als de concurrentie.

Wat OpenAI niet vertelt over GPT-6 Astra

Er ontbreken twee belangrijke details op de lanceringspagina. Ten eerste vermeldt OpenAI nergens de exacte grootte van het contextvenster. Er is wel een tabel die tot één miljoen tokens reikt, wat suggereert dat het venster minstens zo groot is, maar een harde specificatie ontbreekt. Ten tweede is er geen releasedatum voor het grote publiek. Astra is voorlopig alleen beschikbaar voor een beperkte groep organisaties, al volgen betaalde ChatGPT-abonnees en de API in de komende dagen. Let op: voor zakelijke accounts staat het model standaard uit, dus beheerders moeten dit zelf handmatig activeren.

Eén specifieke opmerking op de pagina krijgt eigenlijk te weinig aandacht: de gedachtegang van Astra is lastiger te volgen dan die van GPT-5.6 Sol. Volgens OpenAI komt dit doordat het nieuwe model problemen simpelweg in minder stappen oplost. Het bedrijf neemt deze afname in transparantie serieus en benadrukt dat controleerbaarheid een belangrijke onderzoeksprioriteit blijft. Is jullie interne toezicht (of governance) afhankelijk van het kunnen analyseren van de exacte stappen die de AI neemt? Dan is dit een cruciaal punt om rekening mee te houden.

Wat dit betekent

Maak je gebruik van browser- of desktopautomatisering? Dan is GPT-6 Astra zeker het testen waard zodra je toegang hebt. Hier zit namelijk de échte vernieuwing: het model kan zelfstandig meerstapstaken uitvoeren in bestaande software. Dit doet het twee keer zo snel als zijn voorganger én een stuk veiliger. Uit de tests van OpenAI bleek dat Astra keurig binnen de toegestane kaders bleef, terwijl GPT-5.6 Sol in bijna de helft van de gevallen buiten de lijntjes kleurde. Voor teams die voorheen zelf koppelingen moesten bouwen voor elke interne tool, verandert dit de keuze tussen zelf ontwikkelen of simpelweg een AI de tool laten bedienen compleet.

Ontwikkel je echter een chatbot of een codeer-assistent? Dan is direct overstappen nog niet nodig. Astra is even duur als Claude Fable 5.1, maar scoort lager op de onafhankelijke ranglijsten die OpenAI zelf deelt. Je betaalt bij Astra de meerprijs voor de functionaliteit om een computer te besturen; iets wat de meeste codeertools helemaal niet nodig hebben. Houd bovendien rekening met praktische obstakels: de strenge veiligheidscontroles kunnen legitieme taken vertragen of stoppen. Via de API wordt een gemarkeerde taak zelfs direct afgebroken. Test het model daarom eerst met processen die probleemloos onderbroken mogen worden, voordat je het in de productieomgeving inzet.

Voor meer informatie, bekijk de officiële aankondiging van GPT-6 Astra op de blog van OpenAI.

Maak DataNorth AI je Google favoriet