Google lanceert Gemini 3.6 Flash

22-07-2026

Gemini 3.6 Flash is het nieuwe standaardmodel van Google, uitgebracht op 21 juli 2026 met een contextvenster van 1 miljoen tokens, een kenniscutoff van maart 2026 en een lagere prijs per token dan Gemini 3.5 Flash.

Geschreven door:

Jorick van Weelie

Marketing Lead bij DataNorth | Next-Gen AI-enthousiast & Tech Storyteller

Meld je aan voor de Nieuwsbrief

Gepubliceerd: 22 juli 2026

Google heeft op 21 juli 2026 Gemini 3.6 Flash uitgebracht, het nieuwe standaard workhorse-model in de Gemini-familie en de opvolger van Gemini 3.5 Flash. In dezelfde aankondiging lanceerde Google DeepMind ook Gemini 3.5 Flash-Lite en Gemini 3.5 Flash Cyber. Gemini 3.6 Flash behoudt het contextvenster van 1 miljoen tokens, verschuift de kennis cutoff naar maart 2026 en gebruikt ongeveer 17 procent minder output-tokens dan 3.5 Flash, terwijl het hoger scoort op coding, long-context en computer-use benchmarks.

Wat heeft Google vandaag uitgebracht?

Google bracht op 21 juli 2026 drie modellen tegelijk uit. Gemini 3.6 Flash is de belangrijkste release: het nieuwe standaardmodel in de Gemini-familie, gepositioneerd als de dagelijkse workhorse voor coding, kenniswerk en multimodale taken. Daarnaast leverde Google Gemini 3.5 Flash-Lite, het meest kostenefficiënte model in de Flash-klasse, en Gemini 3.5 Flash Cyber, een model dat is afgestemd op het vinden en oplossen van cybersecurity-kwetsbaarheden en dat via een pilotprogramma alleen beschikbaar is voor overheden en vertrouwde partners.

Google bracht in deze aankondiging geen Gemini 3.5 Pro uit. Het bedrijf gaf aan dat het Pro-model onder de interne verwachtingen bleef op coding en complex redeneren, waardoor de bredere release is uitgesteld. Google gaf ook alvast een hint over Gemini 4 als volgende grote model.

Wat kan Gemini 3.6 Flash?

Gemini 3.6 Flash accepteert tekst, afbeelding, video, audio en PDF als input en werkt met een contextvenster van 1 miljoen tokens en een outputlimiet van 64.000 tokens. De kennis cutoff ligt op maart 2026, tegenover januari 2025 bij Gemini 3.5 Flash. Google meldt dat het model minder redeneerstappen en tool-aanroepen nodig heeft om workflows met meerdere stappen af te ronden, wat grotendeels verklaart waarom het ongeveer 17 procent minder output-tokens gebruikt dan zijn voorganger.

Het model is gebouwd voor agentic werk en tool-gebruik, naast dagelijkse coding- en kennistaken. Het draait op ongeveer 280 tokens per seconde, waardoor het bij interactief gebruik een van de snellere modellen in zijn klasse is. Gemini 3.6 Flash was op de dag van de aankondiging al beschikbaar in GitHub Copilot.

Gemini 3.6 Flash benchmarks en technische specificaties

Gemini 3.6 Flash scoort 50 op de Artificial Analysis Intelligence Index, een samengestelde benchmark voor redeneren, kennis, wiskunde en coding. Op SWE-Bench Pro haalt het 58,7 procent, tegenover 55,1 procent voor Gemini 3.5 Flash, en op Terminal-Bench 2.1 scoort het 78,0 procent tegenover 76,2 procent. Op de GDM-MRCR v2 long-context retrieval-test op de volledige diepte van 1 miljoen tokens bereikt het 54,0 procent, ongeveer het dubbele van beide voorgangers.

Voor computer use scoort Gemini 3.6 Flash 83 procent op OSWorld Verified, tegenover 78,4 procent voor Gemini 3.5 Flash. Google meldt token-besparingen tot 65 procent op afzonderlijke evaluaties zoals DeepSWE, terwijl de totale output-tokenreductie ongeveer 17 procent bedraagt over de Artificial Analysis Index. Bij elkaar laten de cijfers zien dat Gemini 3.6 Flash beter presteert op coding, long-context retrieval en computer use, en tegelijk meer doet met minder tokens.

Wat kost Gemini 3.6 Flash?

Gemini 3.6 Flash kost via de Gemini API 1,50 dollar per 1 miljoen input-tokens en 7,50 dollar per 1 miljoen output-tokens. De outputprijs is gedaald van 9,00 dollar per 1 miljoen tokens bij Gemini 3.5 Flash. In combinatie met het lagere tokenverbruik dalen de effectieve kosten van typische workloads verder dan de outputprijs alleen suggereert.

Gemini 3.5 Flash-Lite staat onder Gemini 3.6 Flash als de meest kostenefficiënte optie in de Flash-klasse voor taken met veel volume en lage latency. Gemini 3.5 Flash Cyber is niet algemeen beschikbaar en wordt alleen via een beperkte pilot aangeboden aan overheden en vertrouwde partners. Google plaatste de prijsstelling in de context van een oplopende prijsconcurrentie tussen aanbieders van frontier-modellen.

Hoe verhoudt Gemini 3.6 Flash zich tot Gemini 3.5 Flash?

Gemini 3.6 Flash verbetert op vrijwel alle vlakken ten opzichte van Gemini 3.5 Flash en verlaagt tegelijk de kosten. Het wint op coding (58,7 procent tegenover 55,1 procent op SWE-Bench Pro), long-context retrieval (54,0 procent tegenover ongeveer de helft daarvan op dezelfde diepte) en computer use (83 procent tegenover 78,4 procent op OSWorld Verified). Tegelijk gebruikt het ongeveer 17 procent minder output-tokens en daalt de outputprijs van 9,00 naar 7,50 dollar per 1 miljoen tokens.

De kennis cutoff schuift ook meer dan een jaar op, van januari 2025 naar maart 2026, waardoor het model minder vaak externe retrieval nodig heeft voor recente feiten. Voor teams die al Gemini 3.5 Flash gebruiken is Gemini 3.6 Flash een upgrade met dezelfde context en lagere kosten, geen nieuwe modelklasse.

Alle details zijn beschikbaar via de officiële aankondigingen van Google en Google DeepMind.

Maak DataNorth AI je Google favoriet