Gepubliceerd: 27 augustus 2026
Google lanceerde Gemini 3.5 Transcribe op 26 augustus 2026. Het zet spraak om in tekst met 2,6 procent woordfouten, dus ongeveer 97 van elke 100 woorden komen goed door. Het vervangt Chirp 3 en zit nu in publieke preview voor ontwikkelaars.
Wat kan Gemini 3.5 Transcribe?
De meeste spraaktools geven je een ruw transcript, inclusief stopwoorden. Gemini 3.5 Transcribe ruimt onderweg op. Het haalt de uhs en ahs eruit, zet er leestekens en opmaak in, en volgt correcties. Zeg laten we dinsdag afspreken, nee, woensdag, en er staat woensdag. Zwaarder werk, zoals een afbeelding maken, geeft het door aan andere Gemini-modellen.
Het herkent zelf de taal, uit meer dan 85 talen. In opnames labelt het tot drie sprekers met tijdstempels, al is meer dan drie nog experimenteel. Je kunt het ook een lijst met eigen vaktermen en productnamen geven, zodat die goed gespeld worden.
Nauwkeurigheid en beschikbaarheid van Gemini 3.5 Transcribe
Google meet het model af tegen Chirp 3, zijn transcriptiemodel uit 2025, met cijfers van Artificial Analysis.
| Wat wordt gemeten | Gemini 3.5 Transcribe |
|---|---|
| Woordfouten, opgenomen audio | 2,6 procent |
| Woordfouten, live streaming | 4,0 procent |
| FLEURS meertalige test, opgenomen | 5,04 procent |
| FLEURS meertalige test, streaming | 5,50 procent |
| Snelheid tot definitief transcript | 70 procent sneller dan Chirp 3 |
| Talen die automatisch herkend worden | meer dan 85 |
| Sprekers gelabeld in een opname | tot 3 |
Deze cijfers komen van Artificial Analysis en niet uit het eigen lab van Google, wat het vermelden waard is, want leveranciers beoordelen meestal hun eigen werk. Het verschil tussen 2,6 en 4,0 procent telt ook: live ondertiteling wordt zichtbaar slechter dan een verwerkte opname. Google heeft geen prijs gepubliceerd, dus een businesscase valt nog niet te maken.
Waar het al draait
Dit is geen beperkte test. Het model drijft nu al dictatie in Gboard op Android aan, spraakbediening in de Gemini-app voor Mac, en de microfoon in Google Antigravity. Chrome volgt, waarna je in elk webveld kunt dicteren. Voor teams is dat een gratis upgrade waar ze zelf niets voor hoeven te doen.
Die breedte is hier het echte signaal. Google zet zijn hele productlijn in een keer over van Chirp 3. Als een bedrijf zijn eigen model tegelijk uitfaseert in Search, Docs, Gmail en Keep, heeft het vertrouwen in de vervanger.
Google publiceerde ook GlucoFM
Diezelfde dag publiceerden Google Research en UNSW Sydney GlucoFM, een klein model dat continue glucosedata leest. Het splitst een bloedsuikercurve in een traag onderliggend patroon en de korte pieken door eten of stress. Met 0,72 miljoen parameters versloeg het veel grotere modellen op de gerapporteerde tests.
Nog geen reden voor enthousiasme. Er is geen model om te downloaden, geen goedkeuring van een toezichthouder, en elke test keek terug op oude data. Google zegt dat zelf ook. Nuttig is vooral het recept, dat op een enkele GPU traint.
Wat dit betekent
De moeite waard om nu te testen als je iets bouwt dat luistert: vergadernotities, transcripties van klantgesprekken, spraakagents of dictatie in je eigen app. Een foutmarge van 2,6 procent die extern is gecontroleerd is sterker dan wat de meeste transcriptie leveranciers laten zien. Begin met opgenomen audio, waar de nauwkeurigheid het hoogst is, voordat je iets live belooft.
Twee dingen remmen je af. Er is geen prijs gepubliceerd, dus finance kan nog niets goedkeuren. En sprekerherkenning stopt bij drie stemmen, wat de meeste echte vergaderingen uitsluit. Neem je vijf mensen aan tafel op, dan komt dit model er niet uit.
Voor meer informatie, bekijk de officiële aankondiging van Gemini 3.5 Transcribe op de blog van Google.