Een computerscherm vol programmacode
Nieuws13 augustus · 06:105 min leestijd

DeepSeek brengt V4-Pro uit preview en houdt de tarieven gelijk

DeepSeek zet V4-Pro als officiële versie op zijn API, onder dezelfde modelnaam en tegen hetzelfde tarief. Er kwam geen aankondiging bij, de gewichten blijven voorlopig de preview en de aangekondigde prijsverhoging staat nog op dezelfde pagina.

Update · 13 augustus · 16:37

DeepSeek zet bedragen en datum bij de verhoging: nieuwe tarieven gaan zondag in

DeepSeek heeft de bedragen bij de aangekondigde verhoging gezet. Vanaf zondag 16 augustus om 18:00 Nederlandse tijd gelden voor V4-Pro en V4-Flash piek- en daltarieven, waarbij het daltarief precies de helft van het piektarief is. Voor V4-Pro gaat een miljoen uitvoertokens van 0,87 dollar naar 1,98 buiten de piek en 3,96 erin. Invoer bij een cachemisser loopt van 0,435 naar 0,66 en 1,32, bij een cachetreffer van 0,003625 naar 0,022 en 0,044. V4-Flash volgt dezelfde lijn: uitvoer van 0,28 naar 0,66 en 1,32, invoer van 0,14 naar 0,22 en 0,44, cachetreffers van 0,0028 naar 0,007 en 0,014. Reuters vat de sprong samen als 50 tot 1.100 procent boven de huidige prijzen, afhankelijk van model, tokensoort en tijdstip; dat maximum is de cachetreffer op V4-Pro, die ruim twaalf keer duurder wordt.

De piekuren lopen van 01:00 tot 04:00 en van 06:00 tot 10:00 UTC, oftewel 03:00 tot 06:00 en 08:00 tot 12:00 Nederlandse zomertijd. Een Nederlandse werkochtend valt daarmee volledig in het dure venster: de agentrun die vandaag 0,87 dollar per miljoen uitvoertokens kostte, kost maandag om tien uur 3,96 dollar, ruim viereneenhalf keer zoveel. Batchwerk dat naar de middag of de avond kan, betaalt de helft van dat piektarief. DeepSeek publiceerde bij dezelfde wijziging alsnog een officiële releasenota voor V4-Pro, die er vanochtend nog niet was, met instelbare redeneerdiepte (laag, hoog en maximaal) voor Pro en Flash, native ondersteuning voor de OpenAI Responses API gericht op Codex, en V4-Pro in de app en op het web onder "Expert Mode".

DeepSeek-V4-Pro staat sinds woensdag als officiële versie op de eigen API, onder dezelfde modelnaam en tegen hetzelfde tarief van 0,435 en 0,87 dollar per miljoen in- en uitvoertokens.

Wie het model al aanroept, kreeg die wissel zonder er iets voor te doen. In de eigen documentatie staat dat deepseek-v4-pro is bijgewerkt naar DeepSeek-V4-Pro-0813 en dat de aanroepmethode ongewijzigd blijft. Elke agent, batchtaak of RAG-opstelling die op die naam draait, praat sinds woensdag dus met een ander model dan dinsdag, terwijl de rekening hetzelfde blijft. Er kwam geen aankondiging bij en geen regel in de changelog, dus wie uitvoer door een vaste prompt of een parser haalt, controleert die deze week beter zelf.

Dezelfde naam, ander model

Op de prijspagina staat DeepSeek-V4-Pro-0813 nu als modelversie, met 0,435 dollar per miljoen invoertokens bij een cachemisser, 0,003625 dollar bij een cachetreffer en 0,87 dollar per miljoen uitvoertokens. Dat zijn precies de bedragen die er in de previewperiode ook stonden. Het contextvenster blijft 1 miljoen tokens, de maximale uitvoer 384.000 tokens, en Pro ondersteunt nu ook het Responses API-formaat naast de OpenAI- en Anthropic-vorm. De limiet op gelijktijdige verzoeken blijft 500, tegen 2.500 voor het lichtere V4-Flash. Pandaily leest die verhouding als een bewuste tweedeling in de V4-reeks, met Flash voor volume en Pro voor zwaardere redeneer- en agenttaken.

De stap zelf stond al aangekondigd. Bij de bèta van V4-Flash schreef DeepSeek in de changelog dat de officiële V4-Pro "binnenkort" zou volgen, maar aan diezelfde changelog is voor 0813 niets toegevoegd. Modelplatform OpenRouter zette het model op 12 augustus online en noemt het de GA-release van V4-Pro. Decrypt beschrijft hoe DeepSeek de wissel zonder blogpost en zonder aankondiging doorvoerde.

De benchmarkgrafiek die DeepSeek bij de V4-preview publiceerde en die nog steeds bij de open gewichten staat, met DeepSeek-V4-Pro-Max naast Claude Opus 4.6, GPT-5.4 en Gemini 3.1 Pro, plus twee grafieken over rekenkosten en KV-cache bij lange context. Bron: DeepSeek / Hugging Face (MIT)
De benchmarkgrafiek die DeepSeek bij de V4-preview publiceerde en die nog steeds bij de open gewichten staat, met DeepSeek-V4-Pro-Max naast Claude Opus 4.6, GPT-5.4 en Gemini 3.1 Pro, plus twee grafieken over rekenkosten en KV-cache bij lange context. Bron: DeepSeek / Hugging Face (MIT)

De sprong die DeepSeek zelf claimt

Cijfers zijn er wel, alleen niet in een releasenota. OpenRouter geeft de winst door die DeepSeek rapporteert tegenover de preview: Terminal Bench 2.1 van 72,1 naar 87,9, DeepSWE van 12,8 naar 62,7 en CyberGym van 52,7 naar 83,3. Het Chinese techmedium 36Kr komt op dezelfde reeks uit en telt er de interne testsets bij op, waar DSBench-Hard van 31,1 naar 67,2 gaat.

Door DeepSeek gerapporteerde scores voor V4-Pro, preview tegenover de officiële 0813-versie (bron: OpenRouter, 36Kr)

Daarmee is een omkering van twee weken geleden weer rechtgetrokken. Bij de publieke bèta van V4-Flash, die met 82,7 op Terminal Bench 2.1 hoger uitkwam dan de 72,1 van de toenmalige V4-Pro-preview, was het goedkope model even sterker dan het vlaggenschip. Met 87,9 staat Pro weer bovenaan de eigen reeks. Het voorbehoud van toen geldt onverkort: dit zijn scores van de leverancier, niet van een onafhankelijke meting.

Wat een onafhankelijke meting laat zien

Meetbureau Artificial Analysis heeft 0813 inmiddels doorgemeten en komt uit op 53 op zijn Intelligence Index, tegen 62 voor Claude Fable 5 en 60 voor Kimi K3. Geen koppositie dus. De kostenkant valt anders uit: een gestandaardiseerde taak uit diezelfde index kost op V4-Pro ongeveer 0,06 dollar, tegen 0,84 op Kimi K3 en 3,14 op Fable 5. De uitvoersnelheid ligt op 83 tokens per seconde, sneller dan het gemiddelde in die vergelijking.

Eén beperking hoort erbij. V4-Pro verwerkt geen beeld. Voor een werkstroom die facturen, schermafdrukken of foto's moet lezen, valt het model af, hoe laag de tokenprijs ook is.

De gewichten zijn niet wat de API draait

DeepSeek is een open-weight-lab, maar dat geldt op dit moment niet voor deze bouw. De publieke repo van V4-Pro is voor het laatst op 22 juni gewijzigd en de modelkaart presenteert daar nog steeds een previewversie van de V4-reeks. Een datum voor het publiceren van de 0813-gewichten heeft DeepSeek niet genoemd. Bij het lichtere model ging dat anders: de gewichten van DeepSeek-V4-Flash-0731 verschenen op de dag van de officiële release.

Dat verschil telt zodra zelf hosten je uitweg is uit een prijsverhoging of een vraag over waar data blijft. Wat je vandaag kunt downloaden, is niet het model dat achter de API zit.

Een tarief zonder garantie

De voetnoot die vorige week de toon zette, staat nog steeds op precies dezelfde prijspagina: een brede verhoging van alle API-tarieven komt eraan, significant, zonder bedrag en zonder datum. De overgang naar de officiële versie heeft die aankondiging niet ingetrokken. DeepSeek zette met die aangekondigde verhoging zelf de eerste stap terug van zijn belofte dat capabele modellen bijna niets hoeven te kosten, en noemde daarbij 0,435 en 0,87 dollar al als de bedragen van dat moment. Ze zijn de overgang naar de officiële versie ongeschonden doorgekomen, maar een prijsbelofte zijn ze niet.

Wat er woensdag veranderde, zit vooral in wat DeepSeek verkoopt. Een half jaar lang ging het verhaal over de bodem van de tokenprijs, en het antwoord kwam telkens in tienden van centen. Met een officieel vlaggenschip dat op agenttaken in de buurt van de dure westerse modellen komt en tegelijk een aangekondigde verhoging boven zich heeft hangen, verschuift het zwaartepunt naar de bovenkant van de reeks. Niet het goedkoopste model, maar het zwaarste dat nog in een mkb-begroting past. De preview die daar sinds april stond is stil verdwenen, en wat er nu draait moet opnieuw gemeten worden.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Modelwissel zonder verrassingen

Als de aanbieder je model stilletjes vervangt, wil je een opstelling die dat opvangt in plaats van een integratie die eraan vastzit. Ik denk mee over de keuze, ontwerp de laag ertussen, bouw hem en automatiseer de rest, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Amerikaanse AI-labs verlagen tarieven, tokenindex een kwart lager
Nieuws
5 min

15 aug 06:10

Amerikaanse AI-labs verlagen tarieven, tokenindex een kwart lager

Klanten van OpenAI en Anthropic betalen sinds midden juli bijna een kwart minder per miljoen tokens. Anthropic schrapte bovendien een verhoging die op 1 september zou ingaan, terwijl de topmodellen onveranderd duur blijven.

DeepSeek kondigt een brede prijsverhoging aan voor zijn API
Nieuws
5 min

6 aug 12:11

DeepSeek kondigt een brede prijsverhoging aan voor zijn API

DeepSeek kondigt op zijn eigen prijspagina een brede verhoging aan van alle API-tarieven, zonder bedrag of datum. De eerder aangekondigde piektarieven zijn van die pagina verdwenen, en elke tokenbegroting die op prijs rustte moet opnieuw door de rekenmachine.

DeepSeek zet V4-Flash in publieke beta en rekent in piekuren straks het dubbele
Nieuws
5 min

31 jul 12:27

DeepSeek zet V4-Flash in publieke beta en rekent in piekuren straks het dubbele

DeepSeek zet V4-Flash in publieke beta met fors hogere scores op agent-taken, en kondigt aan dat de tarieven tijdens piekuren verdubbelen. Dat piekblok valt precies in de Nederlandse werkochtend.

Chinese militaire onderzoekers trainen defensiesystemen op output van OpenAI en Anthropic
Nieuws
5 min

31 jul 12:12

Chinese militaire onderzoekers trainen defensiesystemen op output van OpenAI en Anthropic

Reuters vond in ruim tachtig Chinese papers en patenten dat aan het leger gelieerde onderzoekers output van OpenAI- en Anthropic-modellen gebruiken voor drones, doelherkenning en socialemediamonitoring. Dat verhardt het debat over modeltoegang.

Moonshot lanceert Kimi K3, het grootste open AI-model ter wereld
Nieuws
4 min

18 jul 06:11

Moonshot lanceert Kimi K3, het grootste open AI-model ter wereld

Moonshot AI bracht Kimi K3 uit, met 2,8 biljoen parameters het grootste open-weight model ter wereld. De benchmarks zetten het vlak achter Claude en GPT, tegen een fractie van de prijs.

DeepSeek geeft agentharnas Harness vrij onder MIT-licentie
Nieuws
5 min

13 aug 20:27

DeepSeek geeft agentharnas Harness vrij onder MIT-licentie

DeepSeek zet zijn agentharnas Harness onder de MIT-licentie op GitHub, als zelf te draaien alternatief voor Claude Code en Codex. Elk model past erachter, en de API-tarieven van DeepSeek gaan zondag omhoog.