Een computerscherm vol programmacode
Nieuws13 augustus · 06:105 min leestijd

DeepSeek brengt V4-Pro uit preview en houdt de tarieven gelijk

DeepSeek zet V4-Pro als officiële versie op zijn API, onder dezelfde modelnaam en tegen hetzelfde tarief. Er kwam geen aankondiging bij, de gewichten blijven voorlopig de preview en de aangekondigde prijsverhoging staat nog op dezelfde pagina.

DeepSeek-V4-Pro staat sinds woensdag als officiële versie op de eigen API, onder dezelfde modelnaam en tegen hetzelfde tarief van 0,435 en 0,87 dollar per miljoen in- en uitvoertokens.

Wie het model al aanroept, kreeg die wissel zonder er iets voor te doen. In de eigen documentatie staat dat deepseek-v4-pro is bijgewerkt naar DeepSeek-V4-Pro-0813 en dat de aanroepmethode ongewijzigd blijft. Elke agent, batchtaak of RAG-opstelling die op die naam draait, praat sinds woensdag dus met een ander model dan dinsdag, terwijl de rekening hetzelfde blijft. Er kwam geen aankondiging bij en geen regel in de changelog, dus wie uitvoer door een vaste prompt of een parser haalt, controleert die deze week beter zelf.

Dezelfde naam, ander model

Op de prijspagina staat DeepSeek-V4-Pro-0813 nu als modelversie, met 0,435 dollar per miljoen invoertokens bij een cachemisser, 0,003625 dollar bij een cachetreffer en 0,87 dollar per miljoen uitvoertokens. Dat zijn precies de bedragen die er in de previewperiode ook stonden. Het contextvenster blijft 1 miljoen tokens, de maximale uitvoer 384.000 tokens, en Pro ondersteunt nu ook het Responses API-formaat naast de OpenAI- en Anthropic-vorm. De limiet op gelijktijdige verzoeken blijft 500, tegen 2.500 voor het lichtere V4-Flash. Pandaily leest die verhouding als een bewuste tweedeling in de V4-reeks, met Flash voor volume en Pro voor zwaardere redeneer- en agenttaken.

De stap zelf stond al aangekondigd. Bij de bèta van V4-Flash schreef DeepSeek in de changelog dat de officiële V4-Pro "binnenkort" zou volgen, maar aan diezelfde changelog is voor 0813 niets toegevoegd. Modelplatform OpenRouter zette het model op 12 augustus online en noemt het de GA-release van V4-Pro. Decrypt beschrijft hoe DeepSeek de wissel zonder blogpost en zonder aankondiging doorvoerde.

De benchmarkgrafiek die DeepSeek bij de V4-preview publiceerde en die nog steeds bij de open gewichten staat, met DeepSeek-V4-Pro-Max naast Claude Opus 4.6, GPT-5.4 en Gemini 3.1 Pro, plus twee grafieken over rekenkosten en KV-cache bij lange context. Bron: DeepSeek / Hugging Face (MIT)
De benchmarkgrafiek die DeepSeek bij de V4-preview publiceerde en die nog steeds bij de open gewichten staat, met DeepSeek-V4-Pro-Max naast Claude Opus 4.6, GPT-5.4 en Gemini 3.1 Pro, plus twee grafieken over rekenkosten en KV-cache bij lange context. Bron: DeepSeek / Hugging Face (MIT)

De sprong die DeepSeek zelf claimt

Cijfers zijn er wel, alleen niet in een releasenota. OpenRouter geeft de winst door die DeepSeek rapporteert tegenover de preview: Terminal Bench 2.1 van 72,1 naar 87,9, DeepSWE van 12,8 naar 62,7 en CyberGym van 52,7 naar 83,3. Het Chinese techmedium 36Kr komt op dezelfde reeks uit en telt er de interne testsets bij op, waar DSBench-Hard van 31,1 naar 67,2 gaat.

Door DeepSeek gerapporteerde scores voor V4-Pro, preview tegenover de officiële 0813-versie (bron: OpenRouter, 36Kr)

Daarmee is een omkering van twee weken geleden weer rechtgetrokken. Bij de publieke bèta van V4-Flash, die met 82,7 op Terminal Bench 2.1 hoger uitkwam dan de 72,1 van de toenmalige V4-Pro-preview, was het goedkope model even sterker dan het vlaggenschip. Met 87,9 staat Pro weer bovenaan de eigen reeks. Het voorbehoud van toen geldt onverkort: dit zijn scores van de leverancier, niet van een onafhankelijke meting.

Wat een onafhankelijke meting laat zien

Meetbureau Artificial Analysis heeft 0813 inmiddels doorgemeten en komt uit op 53 op zijn Intelligence Index, tegen 62 voor Claude Fable 5 en 60 voor Kimi K3. Geen koppositie dus. De kostenkant valt anders uit: een gestandaardiseerde taak uit diezelfde index kost op V4-Pro ongeveer 0,06 dollar, tegen 0,84 op Kimi K3 en 3,14 op Fable 5. De uitvoersnelheid ligt op 83 tokens per seconde, sneller dan het gemiddelde in die vergelijking.

Eén beperking hoort erbij. V4-Pro verwerkt geen beeld. Voor een werkstroom die facturen, schermafdrukken of foto's moet lezen, valt het model af, hoe laag de tokenprijs ook is.

De gewichten zijn niet wat de API draait

DeepSeek is een open-weight-lab, maar dat geldt op dit moment niet voor deze bouw. De publieke repo van V4-Pro is voor het laatst op 22 juni gewijzigd en de modelkaart presenteert daar nog steeds een previewversie van de V4-reeks. Een datum voor het publiceren van de 0813-gewichten heeft DeepSeek niet genoemd. Bij het lichtere model ging dat anders: de gewichten van DeepSeek-V4-Flash-0731 verschenen op de dag van de officiële release.

Dat verschil telt zodra zelf hosten je uitweg is uit een prijsverhoging of een vraag over waar data blijft. Wat je vandaag kunt downloaden, is niet het model dat achter de API zit.

Een tarief zonder garantie

De voetnoot die vorige week de toon zette, staat nog steeds op precies dezelfde prijspagina: een brede verhoging van alle API-tarieven komt eraan, significant, zonder bedrag en zonder datum. De overgang naar de officiële versie heeft die aankondiging niet ingetrokken. DeepSeek zette met die aangekondigde verhoging zelf de eerste stap terug van zijn belofte dat capabele modellen bijna niets hoeven te kosten, en noemde daarbij 0,435 en 0,87 dollar al als de bedragen van dat moment. Ze zijn de overgang naar de officiële versie ongeschonden doorgekomen, maar een prijsbelofte zijn ze niet.

Wat er woensdag veranderde, zit vooral in wat DeepSeek verkoopt. Een half jaar lang ging het verhaal over de bodem van de tokenprijs, en het antwoord kwam telkens in tienden van centen. Met een officieel vlaggenschip dat op agenttaken in de buurt van de dure westerse modellen komt en tegelijk een aangekondigde verhoging boven zich heeft hangen, verschuift het zwaartepunt naar de bovenkant van de reeks. Niet het goedkoopste model, maar het zwaarste dat nog in een mkb-begroting past. De preview die daar sinds april stond is stil verdwenen, en wat er nu draait moet opnieuw gemeten worden.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Modelwissel zonder verrassingen

Als de aanbieder je model stilletjes vervangt, wil je een opstelling die dat opvangt in plaats van een integratie die eraan vastzit. Ik denk mee over de keuze, ontwerp de laag ertussen, bouw hem en automatiseer de rest, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

DeepSeek kondigt een brede prijsverhoging aan voor zijn API
Nieuws
5 min

6 aug 12:11

DeepSeek kondigt een brede prijsverhoging aan voor zijn API

DeepSeek kondigt op zijn eigen prijspagina een brede verhoging aan van alle API-tarieven, zonder bedrag of datum. De eerder aangekondigde piektarieven zijn van die pagina verdwenen, en elke tokenbegroting die op prijs rustte moet opnieuw door de rekenmachine.

Moonshot lanceert Kimi K3, het grootste open AI-model ter wereld
Nieuws
4 min

18 jul 06:11

Moonshot lanceert Kimi K3, het grootste open AI-model ter wereld

Moonshot AI bracht Kimi K3 uit, met 2,8 biljoen parameters het grootste open-weight model ter wereld. De benchmarks zetten het vlak achter Claude en GPT, tegen een fractie van de prijs.

DeepSeek zet V4-Flash in publieke beta en rekent in piekuren straks het dubbele
Nieuws
5 min

31 jul 12:27

DeepSeek zet V4-Flash in publieke beta en rekent in piekuren straks het dubbele

DeepSeek zet V4-Flash in publieke beta met fors hogere scores op agent-taken, en kondigt aan dat de tarieven tijdens piekuren verdubbelen. Dat piekblok valt precies in de Nederlandse werkochtend.

Chinese militaire onderzoekers trainen defensiesystemen op output van OpenAI en Anthropic
Nieuws
5 min

31 jul 12:12

Chinese militaire onderzoekers trainen defensiesystemen op output van OpenAI en Anthropic

Reuters vond in ruim tachtig Chinese papers en patenten dat aan het leger gelieerde onderzoekers output van OpenAI- en Anthropic-modellen gebruiken voor drones, doelherkenning en socialemediamonitoring. Dat verhardt het debat over modeltoegang.

Open-weight ontwijkt de Amerikaanse lock-in en belandt in Beijing
Inzicht
6 min

18 jul 17:00

Open-weight ontwijkt de Amerikaanse lock-in en belandt in Beijing

Bedrijven kiezen open-weight modellen om onder de Amerikaanse AI-lock-in uit te komen. Maar de sterkste open modellen komen nu uit Chinese labs. Zo ruil je één afhankelijkheid in voor een jurisdictierisico, tenzij je echt zelf host.

Meituan brengt LongCat-2.0 uit: een open codeermodel van 1,6 biljoen parameters, getraind zonder Nvidia
Nieuws
6 min

30 jun 08:32

Meituan brengt LongCat-2.0 uit: een open codeermodel van 1,6 biljoen parameters, getraind zonder Nvidia

Het Chinese Meituan geeft LongCat-2.0 vrij onder de MIT-licentie: een open codeermodel van 1,6 biljoen parameters, volledig getraind op Chinese chips zonder een enkele Nvidia-kaart. Dat verschuift opnieuw de prijs-kwaliteitverhouding.