Opent in een nieuw tabblad

ElevenLabs lanceert Eleven v4 en Eleven v4 Turbo

29-09-2026

ElevenLabs bracht op 28 september 2026 Eleven v4 en Eleven v4 Turbo uit. Turbo begint na ongeveer 150 milliseconden te praten, tegenover 262 voor Cartesia Sonic 3.6 en 814 voor GPT-4o mini TTS van OpenAI.

Geschreven door:

Jorick van Weelie

Marketing Lead bij DataNorth | Next-Gen AI-enthousiast & Tech Storyteller

ElevenLabs releases Eleven v4 and Eleven v4 Turbo with 150ms time to first speech
Meld je aan voor de Nieuwsbrief

Gepubliceerd: 29 september 2026

ElevenLabs bracht op 28 september 2026 Eleven v4 en Eleven v4 Turbo uit. De Turbo-versie begint na ongeveer 150 milliseconden te praten, tegenover 262 milliseconden voor Cartesia Sonic 3.6 en 814 milliseconden voor GPT-4o mini TTS van OpenAI in dezelfde test. Beide modellen spreken meer dan 90 talen.

Wat kunnen Eleven v4 en Eleven v4 Turbo?

De twee modellen verdelen het werk. Eleven v4 is gemaakt voor audio die je een keer produceert en publiceert, zoals een luisterboek of een voice-over. Eleven v4 Turbo is gemaakt voor een stem die moet antwoorden terwijl iemand zit te wachten, zoals een telefoonagent of een live assistent.

De belangrijkste functie is sturing via audiotags. Je schrijft [laughs], [whispers] of [door slams] gewoon in het script en het model voert het uit. Eleven v3 had dit al, maar v4 volgt een reeks tags betrouwbaarder, en dat telt als een zin twee aanwijzingen achter elkaar nodig heeft.

Professional Voice Clones zijn terug nadat ze in v3 ontbraken. Dat is de variant die je traint op een lange opname van een spreker, en die studio’s en merken in de praktijk gebruiken. Instant clones werken nog steeds vanaf een fragment van 10 seconden.

Wat je moet weten om het te proberen:

  • Meer dan 90 talen, met een eigen accent in plaats van een Engelse stem die vreemde woorden voorleest
  • Tot 10.000 tekens in een enkele generatie
  • Meer dan 17.500 bestaande stemmen werken met v4
  • Output als MP3, WAV of PCM, en mu-law voor telefonie
  • Beschikbaar in de webapp, de API met REST en streaming, en ElevenAgents
  • Gratis laag van 10.000 credits per maand, betaalde pakketten vanaf $6 per maand

Snelheid van Eleven v4 Turbo tegenover Cartesia en OpenAI

Onthoud dit uit de tabel: het verschil met de dichtstbijzijnde concurrent is geen paar procent maar bijna een factor twee, en tegenover OpenAI meer dan vijf.

ModelMediane tijd tot eerste spraakOntwikkelaar
Eleven v4 Turboongeveer 150 msElevenLabs
Cartesia Sonic 3.6262 msCartesia
OpenAI GPT-4o mini TTS814 msOpenAI

Dit zijn de eigen metingen van ElevenLabs, in september 2026 uitgevoerd over WebSockets met identieke scripts, standaardinstellingen en zonder netwerktijd. Dat laatste telt. Netwerktijd is juist wat je gebruikers merken, en het weglaten ervan vleit elk model in de tabel, ook de concurrenten. ElevenLabs meldt daarnaast een mediane inferentietijd van ongeveer 100 milliseconden, dus de rekentijd van het model zelf en niet het moment waarop het geluid begint.

Het bedrijf zegt verder dat Eleven v4 in september 2026 eerste werd op het Artificial Analysis Provider Voice Arena Leaderboard, en dat ongeveer 75% van de luisteraars het model verkoos in blinde tests tegen vijf concurrerende diensten. Dat leaderboard komt van een derde partij. De luistertest is van ElevenLabs zelf.

Wat ElevenLabs niet vertelt

Er is geen gepubliceerd prijsverschil tussen v4 en v4 Turbo. De pakketten staan in credits per maand en niet in kosten per minuut audio, dus je kunt niet uitrekenen wat een miljoen tekens Turbo kost tegenover een miljoen tekens v4 zonder het te draaien. Voor een callcenter dat een overstap overweegt is dat juist het getal dat de businesscase bepaalt.

Ook ontbreekt een kwaliteitsvergelijking tussen de twee. ElevenLabs noemt v4 het kwaliteitsmodel en Turbo het snelle model, maar publiceert geen cijfer over hoeveel expressie je inlevert als je voor snelheid kiest.

Wat dit betekent

Nu al het testen waard als je een spraakagent draait waar mensen live mee praten. Denk aan een klein team met telefonische support of een boekingsagent, waar de stilte voordat de bot antwoordt precies is waar bellers over klagen. Op ongeveer 150 milliseconden zit Turbo binnen de pauze die mensen in een normaal gesprek laten vallen, en het dichtstbijzijnde alternatief niet. Test het met je eigen netwerk erbij, want in het gepubliceerde cijfer is de netwerktijd eruit gehaald.

Eerder volgen dan overstappen als je afgewerkte audio produceert. De winst van v4 op v3 is echt maar beperkt voor vooraf opgenomen werk, waar 600 milliseconden extra je niets kost. De enige reden om nu te bewegen zijn Professional Voice Clones, die v3 niet bood. Als je een merkstem op een gekloonde spreker zet, rechtvaardigt dat alleen al de overstap en is de rest van de release meegenomen.

Voor meer informatie, bekijk de officiële aankondiging van Eleven v4 op de website van ElevenLabs.

Maak DataNorth AI je Google favoriet