Gepubliceerd: 14 augustus 2026
Google lanceerde op 13 augustus 2026 Gemini 3.7 Flash, een snel en goedkoop model dat het bedrijf neerzet als zijn sterkste model voor programmeren en agents. Gemini 3.7 Flash verschijnt 23 dagen na Gemini 3.6 Flash, houdt hetzelfde contextvenster van 1.048.576 tokens aan en start met een introductieprijs van 0,75 dollar per miljoen inputtokens en 3,75 dollar per miljoen outputtokens. In de eigen metingen van Google scoort het model 65,3 procent op DeepSWE v1.1, tegenover 49,0 procent voor Gemini 3.6 Flash.
Wat kan Gemini 3.7 Flash?
Gemini 3.7 Flash is de snelle, goedkope laag van Google, deze ronde afgestemd op software engineering, agentworkflows en taken met veel stappen in plaats van op pure redeneerkracht. Google noemt het zijn slimste werkpaardmodel tot nu toe voor programmeren en agents, en elke benchmark die het bedrijf naar buiten bracht is een software engineering- of automatiseringstest. Het model accepteert tekst, afbeeldingen, video, audio en PDF als invoer. Volgens Google levert het werkende layouts en complete applicaties op met minder prompts, waarbij het een screenshot, afbeelding of designsysteem nauwkeurig volgt.
Het model kent drie denkniveaus, low, medium en high, met medium als standaard. De instelling minimal, die bij sommige eerdere Gemini-modellen werkte, geeft nu een foutmelding. Omdat outputtokens ook denktokens bevatten, is dat de belangrijkste knop voor de kosten per aanroep. Google zegt verder dat het model de bedoeling van een opdracht beter uitvraagt, bijstuurt bij obstakels en meer moeite steekt in planning over meerdere stappen en in tool calls, precies het gedrag dat het voor agentgebruik nodig heeft.
Benchmarks en technische specificaties van Gemini 3.7 Flash
Google publiceerde vijf benchmarkparen tegenover Gemini 3.6 Flash, allemaal uit eigen metingen.
- Gemini 3.7 Flash scoort 43,6 procent op FrontierCode 1.1 Main tegenover 34,4 procent voor Gemini 3.6 Flash,
- 65,3 procent op DeepSWE v1.1 tegenover 49,0 procent,
- Een Elo van 1588 op WebDev Arena tegenover 1538,
- 34,0 procent op GDP.pdf tegenover 22,0 procent,
- 30,4 procent op AutomationBench tegenover 17,0 procent.
Dat laatste cijfer is ook op absoluut niveau interessant: bij 30,4 procent faalt het model nog altijd ongeveer zeven van de tien automatiseringstaken met meerdere stappen.
De modelkaart bevat vier scores die niet in de aankondiging stonden.
- Gemini 3.7 Flash haalt 97,0 procent op GDM-MRCR v2 bij 128k,
- 85,8 procent op Terminal-bench 2.1,
- 47,9 procent op OSWorld-2.0 voor computergebruik.
- Op de zwaardere Terminal-bench 3.0 zakt de score naar 14,9 procent, een nuttige herinnering dat een benchmarkcijfer sterk afhangt van welke editie je aanhaalt.
Qua specificaties heeft Gemini 3.7 Flash een inputcontextvenster van 1.048.576 tokens en een outputlimiet van 65.536 tokens, beide gelijk aan Gemini 3.6 Flash, en een kennisgrens van maart 2026. De onafhankelijke site Artificial Analysis geeft het model 56 punten op de Intelligence Index tegenover 52 voor Gemini 3.6 Flash, en zet het op plek 1 van 186 modellen op uitvoersnelheid met 340,1 tokens per seconde.
Prijzen van Gemini 3.7 Flash en de vergelijking met GPT-5.6 Luna en DeepSeek V4-Flash
Gemini 3.7 Flash kost 0,75 dollar per miljoen inputtokens en 3,75 dollar per miljoen outputtokens. In een voetnoot schrijft Google zelf dat dit introductietarief op 31 december 2026 afloopt, waarna het tarief stijgt naar 1,50 dollar per miljoen inputtokens en 7,50 dollar per miljoen outputtokens, precies wat Gemini 3.6 Flash bij lancering kostte. Context caching kost 0,075 dollar per miljoen tokens plus 0,50 dollar per miljoen tokens per uur opslag. Google heeft Gemini 3.6 Flash op hetzelfde introductietarief gezet, waardoor beide modellen nu evenveel kosten en de overstap puur een kwestie van capaciteit is.
Tegenover concurrenten is Gemini 3.7 Flash niet de goedkoopste optie in zijn categorie. GPT-5.6 Luna van OpenAI staat op 0,20 dollar per miljoen inputtokens en 1,20 dollar per miljoen outputtokens, en DeepSeek V4-Flash op 0,14 dollar en 0,28 dollar. Gemini 3.7 Flash zit wel onder Claude Haiku 4.5, dat op 1,00 dollar en 5,00 dollar staat. Artificial Analysis komt uit op een gemengde prijs van 0,58 dollar per miljoen tokens voor Gemini 3.7 Flash, de helft van de 1,16 dollar die het voor Gemini 3.6 Flash noteerde.
Waar is Gemini 3.7 Flash beschikbaar?
De toegang voor ontwikkelaars ging op 13 augustus 2026 open. Gemini 3.7 Flash draait via de Gemini API in Google AI Studio, in Android Studio, in Google Antigravity voor agentworkflows en binnen het Gemini Enterprise Agent Platform en de bijbehorende app. De modelnaam is gemini-3.7-flash.
Voor consumenten is het aanbod smaller. In de Gemini-app bereik je het model alleen via Spark, de altijd actieve persoonlijke agent van Google, waarvoor een abonnement op Google AI Pro of Ultra nodig is. Google zegt dat Spark in meer dan 160 landen beschikbaar is, met in een voetnoot een uitzondering voor de Europese Economische Ruimte, het Verenigd Koninkrijk, Zwitserland en Nigeria. Lezers in die regio’s kunnen Gemini 3.7 Flash vandaag niet via de Gemini-app gebruiken, ongeacht wat ze voor AI Pro of Ultra betalen. Toegang via de API blijft wel open. Google noemde geen termijn voor die markten. De release komt met bijgewerkte Frontier Safety-maatregelen voor chemisch, biologisch, radiologisch en nucleair misbruik en voor offensieve cyberactiviteiten.
Ga voor de volledige details en meer informatie naar de officiële Google Gemini 3.7 Flash aankondiging.