DeepSeek onthult experimenteel visiemodel dat in interne tests het niveau van de Opus 4.8 van Anthropic benadert
Belangrijkste punten
- •DeepSeek kondigde op 21 augustus 2026 DeepSeek-V4-Flash-Vision-Exp aan, waarmee voor het eerst beeld- en screenshotverwerking wordt toegevoegd aan de V4 Flash-modelfamilie.
- •Het experimentele model behoudt de mogelijkheden van DeepSeek-V4-Flash op het gebied van tekst, redeneren, agents en algemene kennis en is voor ontwikkelaars beschikbaar via de API van DeepSeek.
- •De eigen interne evaluaties van DeepSeek toonden prestaties vergelijkbaar met de Opus 4.8 van Anthropic in multimodale agenttests, maar er zijn nog externe benchmarks nodig om de beweringen te verifiëren.
- •De lancering vindt plaats te midden van toenemende AI-concurrentie tussen China en de Verenigde Staten, waaronder de Amerikaanse controle op Chinese ontwikkelaars en het nationale AI-investeringsplan van China tot 2030.
- •Anthropic bereidt naar verluidt een mogelijke beursgang voor die al in deze maand kan worden aangevraagd, waarbij Morgan Stanley, Goldman Sachs en JPMorgan naar verluidt betrokken zijn bij de voorbereidingen.

China's DeepSeek heeft een experimenteel multimodaal AI-model geïntroduceerd dat afbeeldingen en screenshots kan verwerken, waarmee het zijn V4-modelfamilie uitbreidt in een periode waarin de concurrentie tussen 's werelds grootste ontwikkelaars van kunstmatige intelligentie — in zowel China als de Verenigde Staten — steeds heviger wordt.
De release, aangekondigd op 21 augustus 2026, voegt voor het eerst visuele verwerking toe aan de V4-lijn, terwijl het bestaande tekstsysteem in stand blijft en niet wordt vervangen. Beeldinvoer is inmiddels een standaardmogelijkheid geworden bij frontier-modellen van OpenAI, Google en Anthropic, en met deze toevoeging komt de nieuwste modelfamilie van DeepSeek op dat basisniveau.
DeepSeek voegt visuele mogelijkheden toe aan V4 Flash
DeepSeek kondigde DeepSeek-V4-Flash-Vision-Exp aan, een experimenteel model dat visuele verwerking toevoegt aan zijn V4 Flash-platform. Gebruikers kunnen afbeeldingen en screenshots uploaden en het model vervolgens vragen de inhoud te analyseren of taken uit te voeren op basis van wat het ziet.
Het bedrijf zei dat het nieuwe model de tekstmogelijkheden van DeepSeek-V4-Flash behoudt, waaronder redeneren, agenttaken en algemene kennis. DeepSeek omschreef de release als een multimodale uitbreiding van zijn nieuwere modelfamilie en niet als een vervanging van het bestaande tekstsysteem.
"Dit experimentele multimodale model komt qua tekstmogelijkheden overeen met DeepSeek-V4-Flash — waaronder agents, redeneren en wereldkennis," aldus DeepSeek.
Het model is beschikbaar via de application programming interface van DeepSeek, waarmee ontwikkelaars op afbeeldingen gebaseerde functies — zoals het analyseren van geüploade screenshots — aan hun eigen producten en diensten kunnen toevoegen en visuele AI-toepassingen bovenop het platform kunnen bouwen.
Het nieuws over de release werd gedeeld op X door Walter Bloomberg (@DeItaone):
DEEPSEEK CHALLENGES ANTHROPIC WITH NEW AI MODEL
DeepSeek has unveiled an experimental multimodal AI model capable of analyzing images, screenshots and text while performing autonomous tasks.
Called DeepSeek-V4-Flash-Vision-Exp, the model reportedly approaches Anthropic's Opus…
— Walter Bloomberg (@DeItaone) August 21, 2026
DeepSeek vergelijkt model met de Opus 4.8 van Anthropic
DeepSeek meldde dat interne evaluaties uitwezen dat het nieuwe model in multimodale agenttests presteert op een niveau dat vergelijkbaar is met de Opus 4.8 van Anthropic. Deze tests meten hoe AI-systemen taken aanpakken die zowel visuele invoer als beperkte menselijke begeleiding vereisen. Met de vergelijking wordt het experimentele model direct afgezet tegen een van de high-end systemen van Anthropic.
Anthropic heeft binnen zijn Claude-lijn nadrukkelijk ingezet op agentmogelijkheden, waaronder een computer-use-functie die eind 2024 werd geïntroduceerd en het model in staat stelt te interpreteren wat er op een scherm verschijnt en taken binnen applicaties uit te voeren — wat overlapt met de screenshotgestuurde taken waarvoor het nieuwe model van DeepSeek is gebouwd.
De beweringen van DeepSeek zijn echter gebaseerd op eigen tests, en er zullen bredere externe benchmarks nodig zijn om de prestaties over verschillende workloads te vergelijken.
DeepSeek heeft al vision-language-modellen ontwikkeld binnen zijn DeepSeek-VL-familie, een eerdere lijn modellen die beeldbegrip combineren met taalverwerking. De nieuwste release brengt vergelijkbare visuele functies naar de nieuwere V4-lijn, waardoor het takenpakket dat het platform aankan groter wordt. Het bedrijf, een AI-lab dat wordt gesteund door het Chinese kwantitatieve hedgefonds High-Flyer, kreeg in januari 2025 voor het eerst wereldwijd de aandacht, toen zijn redeneermodel R1 resultaten behaalde die konden concurreren met toonaangevende Amerikaanse systemen, tegen een fractie van de gerapporteerde trainingskosten.
AI-concurrentie tussen China en de VS neemt toe
De lancering komt terwijl Chinese AI-bedrijven hun modelontwikkeling op het gebied van tekst, visie en agentmogelijkheden verder uitbouwen. China heeft daarnaast een nationaal plan tot 2030 geïntroduceerd dat oproept tot grotere investeringen in AI-chips, grootschalige rekensystemen, multimodale modellen, autonome agents en blockchaintechnologie.
Chinese ontwikkelaars krijgen daarnaast te maken met toenemende controle door Amerikaanse functionarissen over de concurrentie in geavanceerde AI. De recente discussie omvatte onder meer zorgen over intellectuele eigendom, trainingsmethoden voor modellen en toegang tot de high-end computerhardware die nodig is om grote modellen te trainen.
Ondertussen bereidt Anthropic naar verluidt een mogelijke beursgang voor. Het bedrijf zou al in deze maand een aanvraag kunnen indienen, waarbij Morgan Stanley, Goldman Sachs en JPMorgan naar verluidt betrokken zijn bij de voorbereidingen.
De mogelijke beursnotering heeft aandacht getrokken nadat SpaceX een IPO afrondde die circa 86,2 miljard dollar ophaalde, inclusief de overallotment. Vergelijkingen tussen de twee bedrijven blijven speculatief, omdat Anthropic nog geen definitieve emissievoorwaarden of een bevestigde waardering heeft aangekondigd.
Het nieuwe model van DeepSeek betreedt die concurrerende omgeving terwijl ontwikkelaars in China en de Verenigde Staten multimodale AI-systemen — modellen die tekst, afbeeldingen en autonome taakuitvoering combineren — verder uitbreiden voor zowel consumenten- als zakelijk gebruik.