DeepSeek-V4-Pro staat sinds woensdag als officiële versie op de eigen API, onder dezelfde modelnaam en tegen hetzelfde tarief van 0,435 en 0,87 dollar per miljoen in- en uitvoertokens.
Wie het model al aanroept, kreeg die wissel zonder er iets voor te doen. In de eigen documentatie staat dat deepseek-v4-pro is bijgewerkt naar DeepSeek-V4-Pro-0813 en dat de aanroepmethode ongewijzigd blijft. Elke agent, batchtaak of RAG-opstelling die op die naam draait, praat sinds woensdag dus met een ander model dan dinsdag, terwijl de rekening hetzelfde blijft. Er kwam geen aankondiging bij en geen regel in de changelog, dus wie uitvoer door een vaste prompt of een parser haalt, controleert die deze week beter zelf.
Dezelfde naam, ander model
Op de prijspagina staat DeepSeek-V4-Pro-0813 nu als modelversie, met 0,435 dollar per miljoen invoertokens bij een cachemisser, 0,003625 dollar bij een cachetreffer en 0,87 dollar per miljoen uitvoertokens. Dat zijn precies de bedragen die er in de previewperiode ook stonden. Het contextvenster blijft 1 miljoen tokens, de maximale uitvoer 384.000 tokens, en Pro ondersteunt nu ook het Responses API-formaat naast de OpenAI- en Anthropic-vorm. De limiet op gelijktijdige verzoeken blijft 500, tegen 2.500 voor het lichtere V4-Flash. Pandaily leest die verhouding als een bewuste tweedeling in de V4-reeks, met Flash voor volume en Pro voor zwaardere redeneer- en agenttaken.
De stap zelf stond al aangekondigd. Bij de bèta van V4-Flash schreef DeepSeek in de changelog dat de officiële V4-Pro "binnenkort" zou volgen, maar aan diezelfde changelog is voor 0813 niets toegevoegd. Modelplatform OpenRouter zette het model op 12 augustus online en noemt het de GA-release van V4-Pro. Decrypt beschrijft hoe DeepSeek de wissel zonder blogpost en zonder aankondiging doorvoerde.

De sprong die DeepSeek zelf claimt
Cijfers zijn er wel, alleen niet in een releasenota. OpenRouter geeft de winst door die DeepSeek rapporteert tegenover de preview: Terminal Bench 2.1 van 72,1 naar 87,9, DeepSWE van 12,8 naar 62,7 en CyberGym van 52,7 naar 83,3. Het Chinese techmedium 36Kr komt op dezelfde reeks uit en telt er de interne testsets bij op, waar DSBench-Hard van 31,1 naar 67,2 gaat.
Daarmee is een omkering van twee weken geleden weer rechtgetrokken. Bij de publieke bèta van V4-Flash, die met 82,7 op Terminal Bench 2.1 hoger uitkwam dan de 72,1 van de toenmalige V4-Pro-preview, was het goedkope model even sterker dan het vlaggenschip. Met 87,9 staat Pro weer bovenaan de eigen reeks. Het voorbehoud van toen geldt onverkort: dit zijn scores van de leverancier, niet van een onafhankelijke meting.
Wat een onafhankelijke meting laat zien
Meetbureau Artificial Analysis heeft 0813 inmiddels doorgemeten en komt uit op 53 op zijn Intelligence Index, tegen 62 voor Claude Fable 5 en 60 voor Kimi K3. Geen koppositie dus. De kostenkant valt anders uit: een gestandaardiseerde taak uit diezelfde index kost op V4-Pro ongeveer 0,06 dollar, tegen 0,84 op Kimi K3 en 3,14 op Fable 5. De uitvoersnelheid ligt op 83 tokens per seconde, sneller dan het gemiddelde in die vergelijking.
Eén beperking hoort erbij. V4-Pro verwerkt geen beeld. Voor een werkstroom die facturen, schermafdrukken of foto's moet lezen, valt het model af, hoe laag de tokenprijs ook is.
De gewichten zijn niet wat de API draait
DeepSeek is een open-weight-lab, maar dat geldt op dit moment niet voor deze bouw. De publieke repo van V4-Pro is voor het laatst op 22 juni gewijzigd en de modelkaart presenteert daar nog steeds een previewversie van de V4-reeks. Een datum voor het publiceren van de 0813-gewichten heeft DeepSeek niet genoemd. Bij het lichtere model ging dat anders: de gewichten van DeepSeek-V4-Flash-0731 verschenen op de dag van de officiële release.
Dat verschil telt zodra zelf hosten je uitweg is uit een prijsverhoging of een vraag over waar data blijft. Wat je vandaag kunt downloaden, is niet het model dat achter de API zit.
Een tarief zonder garantie
De voetnoot die vorige week de toon zette, staat nog steeds op precies dezelfde prijspagina: een brede verhoging van alle API-tarieven komt eraan, significant, zonder bedrag en zonder datum. De overgang naar de officiële versie heeft die aankondiging niet ingetrokken. DeepSeek zette met die aangekondigde verhoging zelf de eerste stap terug van zijn belofte dat capabele modellen bijna niets hoeven te kosten, en noemde daarbij 0,435 en 0,87 dollar al als de bedragen van dat moment. Ze zijn de overgang naar de officiële versie ongeschonden doorgekomen, maar een prijsbelofte zijn ze niet.
Wat er woensdag veranderde, zit vooral in wat DeepSeek verkoopt. Een half jaar lang ging het verhaal over de bodem van de tokenprijs, en het antwoord kwam telkens in tienden van centen. Met een officieel vlaggenschip dat op agenttaken in de buurt van de dure westerse modellen komt en tegelijk een aangekondigde verhoging boven zich heeft hangen, verschuift het zwaartepunt naar de bovenkant van de reeks. Niet het goedkoopste model, maar het zwaarste dat nog in een mkb-begroting past. De preview die daar sinds april stond is stil verdwenen, en wat er nu draait moet opnieuw gemeten worden.
Veelgestelde vragen
Modelwissel zonder verrassingen
Als de aanbieder je model stilletjes vervangt, wil je een opstelling die dat opvangt in plaats van een integratie die eraan vastzit. Ik denk mee over de keuze, ontwerp de laag ertussen, bouw hem en automatiseer de rest, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
