Google Lanceert Gemini 3.8 Flash & Gemini 3.8 Flash Cyber

03-09-2026

Google heeft Gemini 3.8 Flash algemeen beschikbaar gemaakt met een contextvenster van 1 miljoen tokens en dezelfde tijdelijke tokenprijzen als Gemini 3.7 Flash. De upgrade richt zich op coding agents en professionele workflows, maar kan meer redeneertokens verbruiken.

Geschreven door:

Jorick van Weelie

Marketing Lead bij DataNorth | Next-Gen AI-enthousiast & Tech Storyteller

Meld je aan voor de Nieuwsbrief

Publicatiedatum: 3 september 2026

Google heeft op 2 september Gemini 3.8 Flash en de beperkte variant Gemini 3.8 Flash Cyber uitgebracht. Gemini 3.8 Flash is algemeen beschikbaar via de Gemini API en Google AI Studio, met een contextvenster van 1 miljoen tokens en tijdelijke introductieprijzen op het niveau van Gemini 3.7 Flash.

Voor teams die al met Gemini bouwen, zit de belangrijkste verandering in agenttaken en coding. Tegelijk waarschuwt Google dat 3.8 Flash meer redeneertokens kan gebruiken dan 3.7 Flash.

Wat is Gemini 3.8 Flash en wat kan het model?

Gemini 3.8 Flash is het nieuwste productieklare Flash-model van Google. Het accepteert tekst, afbeeldingen, video, audio en PDF-bestanden als invoer en levert tekst als uitvoer. Google noemt een maximale input van 1.048.576 tokens en maximaal 65.536 outputtokens.

De nadruk ligt op agentisch werk: plannen, tools gebruiken, programmeren en langere taken met meerdere redeneerstappen. Google zegt dat 3.8 Flash duidelijk beter presteert dan 3.7 Flash en op geselecteerde evaluaties in de buurt komt van duurdere frontiermodellen. Dit zijn cijfers van Google, niet van onafhankelijke tests door DataNorth.

Daarnaast is Gemini 3.8 Flash Cyber uitgebracht. Die variant is alleen beschikbaar voor vertrouwde beveiligingsteams via het Fairwind Program en richt zich op kwetsbaarheden vinden en patches ontwikkelen.

Prijs, toegang en belangrijkste specificaties

OnderdeelGemini 3.8 Flash
StatusAlgemeen beschikbaar
Model-IDgemini-3.8-flash
Contextvenster1.048.576 inputtokens
Maximale output65.536 tokens
Introductieprijs input$0,75 per 1M tokens
Introductieprijs output$3,75 per 1M tokens
DenkstandenLow, medium en high

De introductieprijs geldt tot en met 31 december 2026. Vanaf 1 januari 2027 noemt Google $1,50 per miljoen inputtokens en $7,50 per miljoen outputtokens als standaardprijs.

Ontwikkelaars kunnen het model gebruiken in Google AI Studio, de Gemini API, Android Studio, Antigravity en Stitch. Ook Gemini Enterprise staat op de beschikbaarheidslijst. Functieaanroepen, code execution, structured outputs, zoekgronding en context caching worden ondersteund. De Live API, beeldgeneratie en audiogeneratie niet.

Gemini 3.8 Flash benchmarks en prijzen

Het patroon is steeds hetzelfde. Gemini 3.8 Flash komt dicht bij Claude Opus 5 op programmeren en zakelijke analyse, en verliest ruim op zwaarder agentwerk.

Wat wordt er gemetenGemini 3.8 FlashClaude Opus 5
DeepSWE v1.1 (lange programmeerklussen)73,7%74,0%
Terminal-Bench 2.1 (programmeren in de terminal)89,4%89,1%
Vals Finance Agent v2 (financiële analyse)61,4%58,6%
HLE-Verified (expertniveau redeneren)54,9%54,4%
Terminal-Bench 4.0 (zwaarder agentwerk)19,1%51,8%
OSWorld 2.0 (een computer bedienen)59,0%75,4%

Dit zijn de eigen cijfers van Google, gepubliceerd bij de lancering. De onderste twee regels komen uit dezelfde evaluatie, maar haalden de blogpost niet. Onafhankelijke metingen van Artificial Analysis zetten Gemini 3.8 Flash op 59 punten, tegenover 63 voor Opus 5.

Wat kan Gemini 3.8 Flash Cyber?

De Cyber-versie is getraind om softwarefouten te vinden en de reparatie te schrijven. Google koos bewust voor dichten boven aanvallen, en zegt dat diezelfde beveiligingstraining het hoofdmodel beter liet programmeren. Toegang loopt via het Fairwind-programma, alleen voor overheden, vitale infrastructuur en softwarebeheerders.

  • CWE-Bench, een externe reparatietest: 47,2%, net achter een topconcurrent op 47,8%.
  • Eigen kwetsbaarheidstest van Google over 20 programmeertalen: boven de 70% succes.
  • Chrome-beveiligingsteam: 2,6 keer meer correcte reparaties dan veel grotere modellen.
  • Beveiliger Wiz: hogere recall op zijn pentestset, tegen lagere kosten.
  • Google Cloud-onderzoek: één kritieke fout gevonden binnen twee uur, werk van normaal maanden.
  • Beschikbaarheid: alleen op aanvraag, zonder gepubliceerde prijs of releasedatum.

Wat ontbreekt in de aankondiging?

Google publiceerde geen exact lanceringstijdstip, alleen de kalenderdatum 2 september. Die datum valt binnen het overlappende deel van het rolling 24-uursvenster en Google meldt dat het model nu beschikbaar is. Daarom telt deze release mee volgens de afgesproken datumregel.

Voor API-teams is de overstap niet volledig zonder wijzigingen. Google adviseert temperature, top_p en top_k te verwijderen. thinking_budget wordt vervangen door thinking_level, de stand minimal wordt niet ondersteund en candidate_count vervalt.

Belangrijker is dat er geen onafhankelijk bewijs is dat de benchmarkwinst ook leidt tot lagere totale kosten per afgeronde taak. Een gelijk tarief per token kan alsnog duurder uitpakken als het model langer redeneert.

Wat dit betekent

Product- en ontwikkelteams die Gemini 3.7 Flash al gebruiken, kunnen 3.8 Flash het beste eerst testen op coding agents, documentrijke workflows en taken met tools. Meet daarbij totale tokens, latency en taakvoltooiing.

Oordeel: Gemini 3.8 Flash is nu het testen waard. Het model is productiegeschikt en begint met bekende tarieven, maar het hogere mogelijke tokenverbruik vraagt om een praktijktest voor een brede migratie.

Voor meer informatie, bekijk de officiële aankondiging van Gemini 3.8 Flash op de website van Google.

Maak DataNorth AI je Google favoriet