DeepSeek maakt V4 Pro algemeen beschikbaar en bouwt de prijslijst om naar dal- en piektarieven
DeepSeek heeft de algemene beschikbaarheid van DeepSeek-V4-Pro-0813 aangekondigd, als vervanger van de previewversie van zijn topmodel. Volgens de technische documentatie telt het model 1,7 biljoen parameters, heeft het een MIT-licentie en een contextvenster van een miljoen tokens, aangevuld met een nieuwe module voor speculative decoding met de naam DSpark. Tot de nieuwe functies behoren de parameter `reasoning_effort`, met drie niveaus om de verwerking te doseren, en native ondersteuning voor de Responses API van OpenAI. De resultaten op agentische benchmarks in de model card, zoals Terminal Bench 2.1 en DeepSWE, zijn voorlopig cijfers van het bedrijf zelf, in afwachting van onafhankelijke validatie.
De ingrijpendste wijziging betreft de economie van de dienst: vanaf 16 augustus, 16:00 UTC, laat DeepSeek de enkele prijslijst los ten gunste van twee tijdvakken met vaste prijzen, piek en dal. De documentatie noemt als piekuren de vensters 01:00–04:00 en 06:00–10:00 UTC, met daltarieven op de helft van de piektarieven. De vergelijking tussen de oude en de nieuwe prijslijst voor V4 Pro laat een forse stijging zien: output tijdens piekuren gaat van 0,87 naar 3,96 dollar per miljoen tokens, terwijl input met cache hit procentueel het hardst stijgt — ongeveer twaalf keer, tot 0,044 dollar. Ook buiten de piek blijft de lijst boven de oude: output gaat van 0,87 naar 1,98 dollar per miljoen tokens. Daarmee keert het bedrijf de agressieve prijspolitiek om die het in het segment van open modellen had gekenmerkt.
De release valt midden in een fase van industriële expansie. Volgens Reuters haalde DeepSeek in juni 2026 zo'n 7,4 miljard dollar op in zijn eerste externe financieringsronde en zou het een nieuwe ronde overwegen bij een waardering van ongeveer 74 miljard — een cijfer dat echter een persbureaubericht blijft, zonder officiële bevestiging. Dat alles terwijl de Chinese binnenlandse concurrentie — van Alibaba en ByteDance tot MiniMax, Moonshot AI en Zhipu AI — het tempo van releases opvoert. De MIT-licentie houdt de gewichten in de categorie open releases, maar de kosten van gebruik via de API hangen niet langer alleen af van het gekozen model: ze hangen ook af van het uur waarop je het bevraagt.
Er blijven hiaten in de beschikbare informatie. De tijdvakken staan weliswaar in UTC, maar de bron zegt niet of ze voortkomen uit een omrekening vanuit de tijd in Peking, waardoor de praktische impact op Europese gebruikers onzeker blijft tot de ingangsdatum. Daarbij komt dat het ontbreken van een officiële prijs-prestatievergelijking met concurrerende modellen en van architectuurdetails buiten de DSpark-module een volledige beoordeling van de marktpositie in de weg staat.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Ik heb de aankondigingspagina in de officiële API-documentatie van DeepSeek gelezen (news260813): releasedatum 13 augustus 2026, parameter reasoning_effort in drie niveaus, native ondersteuning voor de Responses API en een nieuwe prijslijst die ingaat op 16 augustus om 16:00 UTC. Op de officiële pagina Models & Pricing heb ik beide tabellen overgenomen en de verschillen zelf herberekend in plaats van de "12x" te herhalen die op aggregatorsites rondging: de factor twaalf slaat op input met cache hit, terwijl de output ongeveer 4,6 keer stijgt. Specificaties en licentie heb ik gecontroleerd op de officiële model card op Hugging Face (1,7 biljoen parameters, MIT, DSpark, 384K output). Als onafhankelijke tweede bronnen gebruikte ik het Reuters-bericht van 13 augustus — dat datum, distributiekanalen en prijsstijging bevestigt — en een analyse van Unite.AI om de cijfers voor context en output te kruisen. Sites die het nieuws doorgaven zonder terug te gaan naar de officiële documentatie heb ik terzijde gelegd.
- Incertezze
- De benchmarkscores (Terminal Bench 2.1, DeepSWE en de overige die derden noemen) komen van het bedrijf zelf en zijn nog niet gereproduceerd door onafhankelijke evaluaties. De piekvensters staan in UTC, maar de tekst zegt niet of ze uit een omrekening vanuit de tijd in Peking voortkomen; het praktische effect voor Europese gebruikers moet dus bij de ingangsdatum worden gecontroleerd. De nieuwe ronde bij ongeveer 74 miljard dollar blijft een persbureaubericht dat het bedrijf niet heeft bevestigd. Er is geen officiële prijs-prestatievergelijking met concurrerende modellen gepubliceerd, en geen architectuurdetail buiten het aantal parameters en de DSpark-module.
- Perché pubblicarla
- Dit is de release van een topmodel met MIT-gelicentieerde gewichten door het lab dat de prijzen voor inferentie sterker heeft gedrukt dan wie ook — en hij komt met de omgekeerde beweging: de eerste prijsverhoging, met tijdvakken die tot nu toe geen gangbare praktijk waren in de markt voor taalmodellen. Voor wie agents bouwt op de DeepSeek-API's is dit operationeel nieuws met een precieze datum — 16 augustus, 16:00 UTC — en cijfers die op de officiële pagina na te lopen zijn, geen prestatiebelofte. En het is een geval waarmee je scherp kunt uitleggen wat het verschil is tussen de prijs van gecachete input en die van output: precies het punt waar de verhoging echt bijt bij wie agents met lange context laat draaien.
Fonti / Sources
- DeepSeek API Docs — annuncio del rilascio GA di DeepSeek-V4-Pro (13 agosto 2026)
- DeepSeek API Docs — Models & Pricing (listino attuale e listino picco/fuori picco)
- Hugging Face — model card ufficiale deepseek-ai/DeepSeek-V4-Pro-0813
- Reuters — «DeepSeek releases official V4 Pro model as it steps up expansion» (13 agosto 2026)