# DeepSeek V4.1 Flash vervangt binnenkort ook V4 Pro in de API

Het nieuwe model verwerkt tekst en afbeeldingen. Pro-aanvragen gaan vanaf 14 september automatisch naar Flash.

- Canonieke URL: https://ngnews.nl/artikel/deepseek-v4-1-flash-vervangt-binnenkort-ook-v4-pro-in-de-api
- Gepubliceerd: 2026-09-10T18:06:11Z
- Rubriek: Tech
- Uitgever: Nxt

![Grafiek van DeepSeek met de globale KV-cache per token: van 389.120 bytes bij V1 naar 890 bytes bij V4.1 Flash; cijfers van de fabrikant.](https://ngnews.nl/web/images/nxt-8036ccf65498b5b82ba3.jpg)

© 2023 DeepSeek · MIT · Oorspronkelijke grafiek van DeepSeek over de globale KV-cache per token. Dit is een vergelijking van de fabrikant.

[Gebruiksvoorwaarden beeld](https://ngnews.nl/web/licenses/deepseek-v41-MIT.txt)

DeepSeek heeft op 10 september V4.1 Flash uitgebracht. Het model is via de API, de koppeling voor ontwikkelaars, beschikbaar onder de naam deepseek-flash. De bijbehorende modelkaart beschrijft ondersteuning voor tekst en afbeeldingen als invoer; de antwoorden bestaan uit tekst.

Bronnen bij deze passage: [1. DeepSeek — aankondiging en API-omschakeling](https://api-docs.deepseek.com/news/news260910/) · [2. DeepSeek — modelkaart en cachegrafiek](https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash) · [3. DeepSeek — wijzigingslog](https://api-docs.deepseek.com/updates/)

## Pro-aanvragen krijgen een ander model

Vanaf 14 september om 06.00 uur Nederlandse en Belgische tijd worden alle aanvragen voor deepseek-v4-pro doorgestuurd naar V4.1 Flash. Volgens DeepSeek geldt dan ook het Flash-tarief. Die situatie blijft bestaan totdat het bedrijf V4.1 Pro uitbrengt.

Bronnen bij deze passage: [1. DeepSeek — aankondiging en API-omschakeling](https://api-docs.deepseek.com/news/news260910/)

## Oude Flash-namen blijven tijdelijk werken

De vorige V4 Flash en V4 Flash Vision Exp zijn al teruggetrokken. Hun bestaande API-namen verwijzen tijdelijk naar de opvolger. Wie een oude modelnaam blijft gebruiken, krijgt daardoor niet vanzelf hetzelfde model als voorheen.

Bronnen bij deze passage: [1. DeepSeek — aankondiging en API-omschakeling](https://api-docs.deepseek.com/news/news260910/)

## Ruimte voor lange invoer

In de modelkaart noemt DeepSeek een contextvenster van maximaal één miljoen tokens. De architectuur verwerkt die invoer anders dan het antwoord: volgens DeepSeek zijn tijdens de invoerverwerking acht miljard parameters actief en tijdens het genereren zestien miljard.

Bronnen bij deze passage: [2. DeepSeek — modelkaart en cachegrafiek](https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash)

## Verdieping: Wat de cachegrafiek laat zien

Het gaat om opgeslagen tussenresultaten per token.

DeepSeek vergelijkt in de afgebeelde grafiek de globale KV-cache van zijn modelgeneraties. Voor V4.1 Flash noemt het 890 bytes per token, tegenover 3.514 voor V4 Flash. Dat is bijna vier keer kleiner. Deze cachemaat is een technische vergelijking van DeepSeek en staat niet gelijk aan het totale geheugen dat nodig is om het model te draaien.

Bronnen bij deze passage: [2. DeepSeek — modelkaart en cachegrafiek](https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash)

## Bronnen

- [1. DeepSeek — aankondiging en API-omschakeling](https://api-docs.deepseek.com/news/news260910/)
- [2. DeepSeek — modelkaart en cachegrafiek](https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash)
- [3. DeepSeek — wijzigingslog](https://api-docs.deepseek.com/updates/)

[Bronnen en werkwijze](https://ngnews.nl/bronnen#werkwijze)
