Is DeepSeek gratis? Prijzen en API-kosten uitgelegd

Blog
zaterdag, 25 juli 2026 om 5:15
Scherm met geld
De officiële DeepSeek-chat en mobiele app zijn gratis toegankelijk. Voor de DeepSeek API betaal je per verwerkte input- en outputtoken.
DeepSeek heeft momenteel geen algemeen consumentenabonnement dat vergelijkbaar is met ChatGPT Plus. Gratis toegang betekent niet dat iedere functie onbeperkt beschikbaar blijft. De capaciteit, wachttijd en dagelijkse limieten kunnen veranderen.
In dit artikel staan de API-prijzen die DeepSeek op 24 juli 2026 publiceert. Voor een overzicht van alle functies lees je onze complete uitleg over DeepSeek.

Is de DeepSeek-chat gratis?

Ja. Via de officiële website en app kun je zonder betaald abonnement met DeepSeek werken.
De gratis omgeving is geschikt voor:
  • vragen en uitleg;
  • teksten schrijven;
  • samenvatten;
  • programmeren;
  • documenten analyseren;
  • experimenteren met V4;
  • algemene dagelijkse taken.
DeepSeek kan gratis gebruik tijdens drukte beperken. Zie gratis toegang daarom niet als een contractuele garantie voor onbeperkte capaciteit.

Is de DeepSeek API gratis?

Nee. Voor de API maak je een ontwikkelaarsaccount aan en voeg je saldo toe. Daarna worden kosten afgetrokken op basis van het aantal verwerkte tokens.
Een token kan een woorddeel, leesteken, getal of ander tekstelement zijn. Nederlandse tekst bestaat niet uit precies één token per woord. De daadwerkelijke tokenisatie hangt af van de inhoud.

Actuele API-prijzen

De bedragen hieronder zijn in Amerikaanse dollars per één miljoen tokens.
ModelInput met cache-hitInput zonder cache-hitOutput
deepseek-v4-flash$0,0028$0,14$0,28
deepseek-v4-pro$0,003625$0,435$0,87
V4 Flash is dus goedkoper dan V4 Pro. Voor een uitgebreide modelkeuze bekijk je ons overzicht van alle DeepSeek-modellen.

Wat is een cache-hit?

DeepSeek schakelt context caching standaard in. Wanneer een nieuw verzoek een eerder verwerkte prefix exact hergebruikt, kan dat deel tegen het lagere cachetarief worden afgerekend.
Dit is nuttig wanneer je steeds dezelfde invoer gebruikt, zoals:
  • een lang systeembericht;
  • dezelfde handleiding;
  • een productcatalogus;
  • een contract waarover meerdere vragen worden gesteld;
  • een vaste set instructies voor klantenservice.
Caching werkt op basis van herbruikbare voorvoegsels en is best effort. Je hebt dus geen garantie dat iedere herhaling volledig als cache-hit telt.
Plaats stabiele, herbruikbare tekst vooraan en veranderlijke opdrachten achteraan. In de API-respons kun je prompt_cache_hit_tokens en prompt_cache_miss_tokens controleren.

Rekenvoorbeeld 1: een lang document analyseren

Stel dat je één miljoen niet-gecachete inputtokens verwerkt en 100.000 outputtokens ontvangt.

V4 Flash

  • Input: 1 × $0,14 = $0,14
  • Output: 0,1 × $0,28 = $0,028
  • Totaal: $0,168

V4 Pro

  • Input: 1 × $0,435 = $0,435
  • Output: 0,1 × $0,87 = $0,087
  • Totaal: $0,522
Dit voorbeeld toont alleen modelkosten. Opslag, softwareontwikkeling, retries en menselijke controle zijn niet meegerekend.

Rekenvoorbeeld 2: duizend korte taken

Duizend taken gebruiken elk 2.000 inputtokens en 500 outputtokens. Dat is samen twee miljoen inputtokens en 500.000 outputtokens.

V4 Flash

  • Input: 2 × $0,14 = $0,28
  • Output: 0,5 × $0,28 = $0,14
  • Totaal: $0,42

V4 Pro

  • Input: 2 × $0,435 = $0,87
  • Output: 0,5 × $0,87 = $0,435
  • Totaal: $1,305
Bij grote aantallen blijft het verschil tussen Flash en Pro oplopen. Kijk daarom naar kosten per geslaagde taak, niet alleen naar prijs per token.

Rekenvoorbeeld 3: veel hergebruikte context

Stel dat tien miljoen inputtokens als cache-hit worden verwerkt en het model één miljoen outputtokens maakt.

V4 Flash

  • Gecachete input: 10 × $0,0028 = $0,028
  • Output: 1 × $0,28 = $0,28
  • Totaal: $0,308

V4 Pro

  • Gecachete input: 10 × $0,003625 = $0,03625
  • Output: 1 × $0,87 = $0,87
  • Totaal: $0,90625
Eerdere verzoeken waarmee de cache werd opgebouwd en niet-gecachete delen komen hier nog bij.

Wanneer kies je V4 Flash?

Flash is meestal de beste keuze voor:
  • prototypes;
  • klantenservice;
  • classificatie;
  • samenvattingen;
  • grote volumes;
  • eenvoudige programmeertaken;
  • verwerking waarbij snelheid belangrijk is.
Begin een nieuw project bij voorkeur met Flash. Maak daarna een vaste evaluatieset en test of Pro werkelijk betere resultaten geeft.

Wanneer is V4 Pro de meerprijs waard?

Pro kan logisch zijn voor:
  • complexe programmeeragents;
  • moeilijke redeneertaken;
  • grote codebases;
  • opdrachten met kostbare fouten;
  • diepgaande technische analyse;
  • processen waarin menselijke correctie veel duurder is dan tokens.
Een duurder model is alleen goedkoper wanneer het voldoende extra bruikbare resultaten levert.

API versus lokaal draaien

Bij lokaal gebruik betaal je niet per token. Je hebt wel andere kosten:
  • aanschaf of huur van hardware;
  • elektriciteit;
  • installatie en onderhoud;
  • beveiliging;
  • opslag;
  • updates;
  • technische ondersteuning.
Voor incidenteel gebruik is een goedkope API meestal voordeliger. Voor structureel grote volumes of gevoelige gegevens kan eigen hosting interessanter worden.
Onze lokale DeepSeek-handleiding helpt je de hardwarekant beoordelen.

Kosten beheersen

  • Gebruik Flash als standaardmodel.
  • Stel een maximale outputlengte in.
  • Stuur niet steeds volledige onnodige chatgeschiedenis mee.
  • Houd vaste context gelijk voor cache-hits.
  • Log tokengebruik per functie en klant.
  • Bouw eigen dag- en maandlimieten.
  • Gebruik afzonderlijke API-sleutels per omgeving.
  • Test retries met exponentiële wachttijden.
  • Laat een model niet onbeperkt zichzelf opnieuw aanroepen.
  • Controleer je saldo en actuele prijspagina regelmatig.
De implementatie staat stap voor stap in onze DeepSeek API-handleiding.

Veelgestelde vragen

Heeft DeepSeek een betaald abonnement?

DeepSeek vermeldt momenteel gratis toegang tot de officiële chat en app. De API wordt afzonderlijk per token betaald.

Is V4 Pro gratis in de chat?

De officiële website biedt gratis toegang tot V4. Beschikbaarheid, modi en gebruikslimieten kunnen veranderen.

Welk model is het goedkoopst?

V4 Flash heeft de laagste actuele API-prijzen.

Kost thinking mode extra?

Er staat geen afzonderlijke toeslag voor thinking mode in de prijstabel. Langere redenering kan wel meer outputtokens gebruiken en daardoor de totale kosten verhogen.

Kan ik DeepSeek zonder API-kosten gebruiken?

Ja, via de gratis chat of door een geschikt open model lokaal te draaien. Lokaal gebruik brengt wel hardware- en energiekosten mee.

Conclusie

DeepSeek behoort tot de goedkoopste grote AI-aanbieders voor API-gebruik. V4 Flash is voor de meeste toepassingen de beste start. V4 Pro is bedoeld voor moeilijkere opdrachten waarbij extra kwaliteit de hogere prijs rechtvaardigt.
De gratis chat is aantrekkelijk voor gewone gebruikers, maar organisaties moeten gratis toegang niet verwarren met onbeperkte capaciteit of geschikte zakelijke privacyvoorwaarden.
Controleer vóór productie altijd opnieuw de officiële prijspagina. AI-tarieven kunnen zonder lange overgangsperiode veranderen.
loading

Populair nieuws

Laatste reacties

Loading