Publicatiedatum: 3 september 2026
Google heeft op 2 september Gemini 3.8 Flash en de beperkte variant Gemini 3.8 Flash Cyber uitgebracht. Gemini 3.8 Flash is algemeen beschikbaar via de Gemini API en Google AI Studio, met een contextvenster van 1 miljoen tokens en tijdelijke introductieprijzen op het niveau van Gemini 3.7 Flash.
Voor teams die al met Gemini bouwen, zit de belangrijkste verandering in agenttaken en coding. Tegelijk waarschuwt Google dat 3.8 Flash meer redeneertokens kan gebruiken dan 3.7 Flash.
Wat is Gemini 3.8 Flash en wat kan het model?
Gemini 3.8 Flash is het nieuwste productieklare Flash-model van Google. Het accepteert tekst, afbeeldingen, video, audio en PDF-bestanden als invoer en levert tekst als uitvoer. Google noemt een maximale input van 1.048.576 tokens en maximaal 65.536 outputtokens.
De nadruk ligt op agentisch werk: plannen, tools gebruiken, programmeren en langere taken met meerdere redeneerstappen. Google zegt dat 3.8 Flash duidelijk beter presteert dan 3.7 Flash en op geselecteerde evaluaties in de buurt komt van duurdere frontiermodellen. Dit zijn cijfers van Google, niet van onafhankelijke tests door DataNorth.
Daarnaast is Gemini 3.8 Flash Cyber uitgebracht. Die variant is alleen beschikbaar voor vertrouwde beveiligingsteams via het Fairwind Program en richt zich op kwetsbaarheden vinden en patches ontwikkelen.
Prijs, toegang en belangrijkste specificaties
| Onderdeel | Gemini 3.8 Flash |
|---|---|
| Status | Algemeen beschikbaar |
| Model-ID | gemini-3.8-flash |
| Contextvenster | 1.048.576 inputtokens |
| Maximale output | 65.536 tokens |
| Introductieprijs input | $0,75 per 1M tokens |
| Introductieprijs output | $3,75 per 1M tokens |
| Denkstanden | Low, medium en high |
De introductieprijs geldt tot en met 31 december 2026. Vanaf 1 januari 2027 noemt Google $1,50 per miljoen inputtokens en $7,50 per miljoen outputtokens als standaardprijs.
Ontwikkelaars kunnen het model gebruiken in Google AI Studio, de Gemini API, Android Studio, Antigravity en Stitch. Ook Gemini Enterprise staat op de beschikbaarheidslijst. Functieaanroepen, code execution, structured outputs, zoekgronding en context caching worden ondersteund. De Live API, beeldgeneratie en audiogeneratie niet.
Gemini 3.8 Flash benchmarks en prijzen
Het patroon is steeds hetzelfde. Gemini 3.8 Flash komt dicht bij Claude Opus 5 op programmeren en zakelijke analyse, en verliest ruim op zwaarder agentwerk.
| Wat wordt er gemeten | Gemini 3.8 Flash | Claude Opus 5 |
|---|---|---|
| DeepSWE v1.1 (lange programmeerklussen) | 73,7% | 74,0% |
| Terminal-Bench 2.1 (programmeren in de terminal) | 89,4% | 89,1% |
| Vals Finance Agent v2 (financiële analyse) | 61,4% | 58,6% |
| HLE-Verified (expertniveau redeneren) | 54,9% | 54,4% |
| Terminal-Bench 4.0 (zwaarder agentwerk) | 19,1% | 51,8% |
| OSWorld 2.0 (een computer bedienen) | 59,0% | 75,4% |
Dit zijn de eigen cijfers van Google, gepubliceerd bij de lancering. De onderste twee regels komen uit dezelfde evaluatie, maar haalden de blogpost niet. Onafhankelijke metingen van Artificial Analysis zetten Gemini 3.8 Flash op 59 punten, tegenover 63 voor Opus 5.
Wat kan Gemini 3.8 Flash Cyber?
De Cyber-versie is getraind om softwarefouten te vinden en de reparatie te schrijven. Google koos bewust voor dichten boven aanvallen, en zegt dat diezelfde beveiligingstraining het hoofdmodel beter liet programmeren. Toegang loopt via het Fairwind-programma, alleen voor overheden, vitale infrastructuur en softwarebeheerders.
- CWE-Bench, een externe reparatietest: 47,2%, net achter een topconcurrent op 47,8%.
- Eigen kwetsbaarheidstest van Google over 20 programmeertalen: boven de 70% succes.
- Chrome-beveiligingsteam: 2,6 keer meer correcte reparaties dan veel grotere modellen.
- Beveiliger Wiz: hogere recall op zijn pentestset, tegen lagere kosten.
- Google Cloud-onderzoek: één kritieke fout gevonden binnen twee uur, werk van normaal maanden.
- Beschikbaarheid: alleen op aanvraag, zonder gepubliceerde prijs of releasedatum.
Wat ontbreekt in de aankondiging?
Google publiceerde geen exact lanceringstijdstip, alleen de kalenderdatum 2 september. Die datum valt binnen het overlappende deel van het rolling 24-uursvenster en Google meldt dat het model nu beschikbaar is. Daarom telt deze release mee volgens de afgesproken datumregel.
Voor API-teams is de overstap niet volledig zonder wijzigingen. Google adviseert temperature, top_p en top_k te verwijderen. thinking_budget wordt vervangen door thinking_level, de stand minimal wordt niet ondersteund en candidate_count vervalt.
Belangrijker is dat er geen onafhankelijk bewijs is dat de benchmarkwinst ook leidt tot lagere totale kosten per afgeronde taak. Een gelijk tarief per token kan alsnog duurder uitpakken als het model langer redeneert.
Wat dit betekent
Product- en ontwikkelteams die Gemini 3.7 Flash al gebruiken, kunnen 3.8 Flash het beste eerst testen op coding agents, documentrijke workflows en taken met tools. Meet daarbij totale tokens, latency en taakvoltooiing.
Oordeel: Gemini 3.8 Flash is nu het testen waard. Het model is productiegeschikt en begint met bekende tarieven, maar het hogere mogelijke tokenverbruik vraagt om een praktijktest voor een brede migratie.
Voor meer informatie, bekijk de officiële aankondiging van Gemini 3.8 Flash op de website van Google.