Gepubliceerd: 22 augustus 2026
DeepSeek bracht op 21 augustus 2026 DeepSeek-V4-Flash-Vision-Exp uit, een experimentele multimodale versie van zijn V4-Flash model die afbeeldingen en schermafbeeldingen kan lezen. Op DeepSeeks eigen agent-benchmarks verslaat het model Anthropics Claude Opus 4.8 op 3 van de 11 tests, waaronder Agents Last Exam met 27,3 tegen 25,7, tegen dezelfde prijs als het tekst-only V4-Flash.
Wat is DeepSeek-V4-Flash-Vision-Exp en wat is er veranderd?
V4-Flash-Vision-Exp is een multimodale variant van DeepSeeks bestaande V4-Flash model, dat op 31 juli 2026 uitkwam. De nieuwe checkpoint behoudt de tekstredenering, agent tool use en het contextvenster van 1 miljoen tokens van V4-Flash ongewijzigd, en voegt het lezen van afbeeldingen en schermafbeeldingen toe. DeepSeek zegt dat het model op elke tekstbenchmark gelijk presteert aan V4-Flash, dus de visie-toevoeging kost niets aan tekstkwaliteit.
Het model verschijnt samen met DeepSeek Harness 0.1.1, een update van het agent-framework met ingebouwde ondersteuning voor de nieuwe checkpoint, en een gratis Files API waarmee ontwikkelaars een afbeelding eenmalig uploaden en via een file ID hergebruiken in plaats van opnieuw te uploaden. Beide zijn gericht op agentic workflows die schermlezen combineren met tool calls.
Hoe presteert het tegenover Claude Opus 4.8?
DeepSeek publiceerde resultaten op vijf multimodale en agentic benchmarks.
- V4-Flash-Vision-Exp scoort 27,3 op Agents Last Exam tegen 25,7 voor Opus 4.8,
- 35,0 op ZeroBench tegen 34,0,
- Op ApexBench Pass@1 blijft het achter met 36,5 tegenover 39,4,
- Op Terminal-Bench 2.1 scoort het 83,9 tegen 85,0.
- Het verschil loopt op bij coderen op repository niveau. NL2Repo geeft V4-Flash-Vision-Exp 57,7 tegen 69,7 voor Opus 4.8, een verschil van 12 punten dat DeepSeek niet wegpraat.
Over de gepubliceerde benchmarks wint het model op 3 van de 11, dus “in de buurt van Opus 4.8” dekt de lading beter dan “verslaat Opus 4.8”. DeepSeek testte zelf, zonder onafhankelijke verificatie.
Wat kost het en hoe krijg je toegang?
V4-Flash-Vision-Exp is nu live op DeepSeeks API onder de identifier deepseek-v4-flash-vision-exp, en op OpenRouter. De prijs is identiek aan V4-Flash: $0,44 per miljoen inputtokens en $1,32 per miljoen outputtokens tijdens piekuren, de helft daarbuiten. Afbeeldingen worden als inputtokens gefactureerd, tot 384 tokens per afbeelding.
Anders dan DeepSeeks gebruikelijke praktijk om open weights op Hugging Face te publiceren voor V4-Flash en V4-Pro, heeft het bedrijf voor deze experimentele checkpoint geen downloadbare weights vrijgegeven. Voorlopig is het alleen via de API beschikbaar, en DeepSeek heeft niet gezegd of en wanneer dat verandert.
Wat dit betekent
Nu de moeite waard voor teams die al op DeepSeeks API draaien en een agent nodig hebben die een schermafbeelding of grafiek kan lezen zonder van provider te wisselen of Opus 4.8-prijzen te betalen. De verhouding van 3 op 11 benchmarks is eerlijk genoeg om op te vertrouwen: dit is een capabele, goedkope visie-toevoeging, geen frontier multimodaal model.
Het verschil bij NL2Repo is het echte signaal. Voor codeeragents die over een hele repository moeten redeneren vanuit schermafbeeldingen blijven Opus 4.8 en GPT-5.6 Sol voorop lopen. Teams die lichte schermlezende agents bouwen met een beperkt budget kunnen dit model testen; teams met serieus visueel codeerwerk kunnen beter wachten tot het verschil kleiner wordt.
Ga voor meer informatie naar de officiële DeepSeek’s aankondiging van V4-Flash-Vision-Exp.