De officiële
DeepSeek-chat en mobiele app zijn gratis toegankelijk. Voor de DeepSeek API betaal je per verwerkte input- en outputtoken.
DeepSeek heeft momenteel geen algemeen consumentenabonnement dat vergelijkbaar is met ChatGPT Plus. Gratis toegang betekent niet dat iedere functie onbeperkt beschikbaar blijft. De capaciteit, wachttijd en dagelijkse limieten kunnen veranderen.
In dit artikel staan de API-prijzen die DeepSeek op 24 juli 2026 publiceert. Voor een overzicht van alle functies lees je onze
complete uitleg over DeepSeek.
Is de DeepSeek-chat gratis?
Ja. Via de officiële website en app kun je zonder betaald abonnement met DeepSeek werken.
De gratis omgeving is geschikt voor:
- vragen en uitleg;
- teksten schrijven;
- samenvatten;
- programmeren;
- documenten analyseren;
- experimenteren met V4;
- algemene dagelijkse taken.
DeepSeek kan gratis gebruik tijdens drukte beperken. Zie gratis toegang daarom niet als een contractuele garantie voor onbeperkte capaciteit.
Is de DeepSeek API gratis?
Nee. Voor de API maak je een ontwikkelaarsaccount aan en voeg je saldo toe. Daarna worden kosten afgetrokken op basis van het aantal verwerkte tokens.
Een token kan een woorddeel, leesteken, getal of ander tekstelement zijn. Nederlandse tekst bestaat niet uit precies één token per woord. De daadwerkelijke tokenisatie hangt af van de inhoud.
Actuele API-prijzen
De bedragen hieronder zijn in Amerikaanse dollars per één miljoen tokens.
| Model | Input met cache-hit | Input zonder cache-hit | Output |
| deepseek-v4-flash | $0,0028 | $0,14 | $0,28 |
| deepseek-v4-pro | $0,003625 | $0,435 | $0,87 |
V4 Flash is dus goedkoper dan V4 Pro. Voor een uitgebreide modelkeuze bekijk je ons
overzicht van alle DeepSeek-modellen.
Wat is een cache-hit?
DeepSeek schakelt context caching standaard in. Wanneer een nieuw verzoek een eerder verwerkte prefix exact hergebruikt, kan dat deel tegen het lagere cachetarief worden afgerekend.
Dit is nuttig wanneer je steeds dezelfde invoer gebruikt, zoals:
- een lang systeembericht;
- dezelfde handleiding;
- een productcatalogus;
- een contract waarover meerdere vragen worden gesteld;
- een vaste set instructies voor klantenservice.
Caching werkt op basis van herbruikbare voorvoegsels en is best effort. Je hebt dus geen garantie dat iedere herhaling volledig als cache-hit telt.
Plaats stabiele, herbruikbare tekst vooraan en veranderlijke opdrachten achteraan. In de API-respons kun je prompt_cache_hit_tokens en prompt_cache_miss_tokens controleren.
Rekenvoorbeeld 1: een lang document analyseren
Stel dat je één miljoen niet-gecachete inputtokens verwerkt en 100.000 outputtokens ontvangt.
V4 Flash
- Input: 1 × $0,14 = $0,14
- Output: 0,1 × $0,28 = $0,028
- Totaal: $0,168
V4 Pro
- Input: 1 × $0,435 = $0,435
- Output: 0,1 × $0,87 = $0,087
- Totaal: $0,522
Dit voorbeeld toont alleen modelkosten. Opslag, softwareontwikkeling, retries en menselijke controle zijn niet meegerekend.
Rekenvoorbeeld 2: duizend korte taken
Duizend taken gebruiken elk 2.000 inputtokens en 500 outputtokens. Dat is samen twee miljoen inputtokens en 500.000 outputtokens.
V4 Flash
- Input: 2 × $0,14 = $0,28
- Output: 0,5 × $0,28 = $0,14
- Totaal: $0,42
V4 Pro
- Input: 2 × $0,435 = $0,87
- Output: 0,5 × $0,87 = $0,435
- Totaal: $1,305
Bij grote aantallen blijft het verschil tussen Flash en Pro oplopen. Kijk daarom naar kosten per geslaagde taak, niet alleen naar prijs per token.
Rekenvoorbeeld 3: veel hergebruikte context
Stel dat tien miljoen inputtokens als cache-hit worden verwerkt en het model één miljoen outputtokens maakt.
V4 Flash
- Gecachete input: 10 × $0,0028 = $0,028
- Output: 1 × $0,28 = $0,28
- Totaal: $0,308
V4 Pro
- Gecachete input: 10 × $0,003625 = $0,03625
- Output: 1 × $0,87 = $0,87
- Totaal: $0,90625
Eerdere verzoeken waarmee de cache werd opgebouwd en niet-gecachete delen komen hier nog bij.
Wanneer kies je V4 Flash?
Flash is meestal de beste keuze voor:
- prototypes;
- klantenservice;
- classificatie;
- samenvattingen;
- grote volumes;
- eenvoudige programmeertaken;
- verwerking waarbij snelheid belangrijk is.
Begin een nieuw project bij voorkeur met Flash. Maak daarna een vaste evaluatieset en test of Pro werkelijk betere resultaten geeft.
Wanneer is V4 Pro de meerprijs waard?
Pro kan logisch zijn voor:
- complexe programmeeragents;
- moeilijke redeneertaken;
- grote codebases;
- opdrachten met kostbare fouten;
- diepgaande technische analyse;
- processen waarin menselijke correctie veel duurder is dan tokens.
Een duurder model is alleen goedkoper wanneer het voldoende extra bruikbare resultaten levert.
API versus lokaal draaien
Bij lokaal gebruik betaal je niet per token. Je hebt wel andere kosten:
- aanschaf of huur van hardware;
- elektriciteit;
- installatie en onderhoud;
- beveiliging;
- opslag;
- updates;
- technische ondersteuning.
Voor incidenteel gebruik is een goedkope API meestal voordeliger. Voor structureel grote volumes of gevoelige gegevens kan eigen hosting interessanter worden.
Onze
lokale DeepSeek-handleiding helpt je de hardwarekant beoordelen.
Kosten beheersen
- Gebruik Flash als standaardmodel.
- Stel een maximale outputlengte in.
- Stuur niet steeds volledige onnodige chatgeschiedenis mee.
- Houd vaste context gelijk voor cache-hits.
- Log tokengebruik per functie en klant.
- Bouw eigen dag- en maandlimieten.
- Gebruik afzonderlijke API-sleutels per omgeving.
- Test retries met exponentiële wachttijden.
- Laat een model niet onbeperkt zichzelf opnieuw aanroepen.
- Controleer je saldo en actuele prijspagina regelmatig.
De implementatie staat stap voor stap in onze
DeepSeek API-handleiding.
Veelgestelde vragen
Heeft DeepSeek een betaald abonnement?
DeepSeek vermeldt momenteel gratis toegang tot de officiële chat en app. De API wordt afzonderlijk per token betaald.
Is V4 Pro gratis in de chat?
De officiële website biedt gratis toegang tot V4. Beschikbaarheid, modi en gebruikslimieten kunnen veranderen.
Welk model is het goedkoopst?
V4 Flash heeft de laagste actuele API-prijzen.
Kost thinking mode extra?
Er staat geen afzonderlijke toeslag voor thinking mode in de prijstabel. Langere redenering kan wel meer outputtokens gebruiken en daardoor de totale kosten verhogen.
Kan ik DeepSeek zonder API-kosten gebruiken?
Ja, via de gratis chat of door een geschikt open model lokaal te draaien. Lokaal gebruik brengt wel hardware- en energiekosten mee.
Conclusie
DeepSeek behoort tot de goedkoopste grote AI-aanbieders voor API-gebruik. V4 Flash is voor de meeste toepassingen de beste start. V4 Pro is bedoeld voor moeilijkere opdrachten waarbij extra kwaliteit de hogere prijs rechtvaardigt.
De gratis chat is aantrekkelijk voor gewone gebruikers, maar organisaties moeten gratis toegang niet verwarren met onbeperkte capaciteit of geschikte zakelijke privacyvoorwaarden.
Controleer vóór productie altijd opnieuw de officiële prijspagina. AI-tarieven kunnen zonder lange overgangsperiode veranderen.