DeepSeek porta V4 Pro in disponibilità generale e ristruttura i listini a fasce orarie
DeepSeek ha annunciato la disponibilità generale di DeepSeek-V4-Pro-0813, sostituendo la versione preview del modello di punta. Secondo la documentazione tecnica, il modello presenta 1.700 miliardi di parametri, licenza MIT e una finestra di contesto di un milione di token, affiancata da un nuovo modulo di speculative decoding denominato DSpark. Tra le funzionalità introdotte figura il parametro `reasoning_effort`, declinato su tre livelli per modulare l'elaborazione, e il supporto nativo alla Responses API di OpenAI. I risultati sui benchmark agentici riportati nella model card, quali Terminal Bench 2.1 e DeepSWE, rimangono al momento dati dichiarati dall'azienda in attesa di validazione indipendente.
La modifica operativa più impattante riguarda l'economia del servizio: a partire dalle 16:00 UTC del 16 agosto, DeepSeek abbandona il listino unico per due fasce orarie a prezzo fisso, picco e fuori picco. La documentazione indica come ore di picco la finestra 01:00–04:00 e 06:00–10:00 UTC, con tariffe fuori picco fissate alla metà di quelle di picco. L'analisi comparativa tra il vecchio e il nuovo listino per V4 Pro evidenzia un rialzo marcato: il costo di output in fascia di picco passa da 0,87 dollari a 3,96 dollari per milione di token, mentre l'input con cache hit registra l'aumento percentuale più elevato, salendo di circa dodici volte fino a 0,044 dollari. Anche fuori picco il listino resta sopra il precedente: l'output passa da 0,87 a 1,98 dollari per milione di token. Questa scelta segna un'inversione di tendenza rispetto alla politica di prezzi aggressivi che aveva contraddistinto l'azienda nel settore dei modelli aperti.
Il rilascio si inserisce in un contesto di espansione industriale. Come riferito da Reuters, DeepSeek ha raccolto circa 7,4 miliardi di dollari a giugno 2026 nel suo primo round di finanziamento esterno e starebbe valutando un nuovo round di finanziamenti a una valutazione di circa 74 miliardi, cifra che tuttavia resta un'indiscrezione di agenzia non confermata ufficialmente. L'operazione si svolge mentre la concorrenza interna cinese — da Alibaba e ByteDance a MiniMax, Moonshot AI e Zhipu AI — moltiplica i rilasci. La licenza MIT mantiene i pesi nella categoria dei rilasci aperti, ma il costo dell'uso via API non dipende più solo dal modello scelto: dipende anche dall'ora in cui lo si interroga.
Permangono criticità nell'informazione disponibile. Sebbene le fasce orarie siano espresse in UTC, la fonte non specifica se queste derivino da una conversione dall'orario di Pechino, rendendo incerto l'impatto pratico sugli utenti europei fino all'entrata in vigore. Inoltre, l'assenza di un confronto ufficiale prezzo-prestazioni con i modelli concorrenti e la mancanza di dettagli architetturali oltre al modulo DSpark limitano la valutazione completa del posizionamento del prodotto sul mercato.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Ho letto la pagina di annuncio nella documentazione API ufficiale di DeepSeek (news260813): data del rilascio 13 agosto 2026, parametro reasoning_effort a tre livelli, supporto nativo alla Responses API, nuovo listino in vigore dalle 16:00 UTC del 16 agosto. Sulla pagina ufficiale Models & Pricing ho trascritto entrambe le tabelle e ricalcolato gli scarti invece di ripetere il «12x» che circolava sugli aggregatori: il fattore dodici riguarda l'input con cache hit, mentre l'output cresce di circa 4,6 volte. Specifiche e licenza verificate sulla model card ufficiale su Hugging Face (1.700 miliardi di parametri, MIT, DSpark, 384K di output). Come seconde fonti indipendenti ho usato il dispaccio Reuters del 13 agosto — che conferma data, canali di distribuzione e rialzo — e un'analisi di Unite.AI per il riscontro su contesto e output. Ho scartato i siti che rilanciavano la notizia senza risalire alla documentazione ufficiale.
- Incertezze
- I punteggi sui benchmark (Terminal Bench 2.1, DeepSWE e gli altri citati da analisi terze) sono dichiarati dall'azienda e non ancora replicati da valutazioni indipendenti. Le fasce di picco sono riportate in UTC, ma il testo non chiarisce se derivino da una conversione dall'orario di Pechino: l'effetto pratico sugli utenti europei va verificato all'entrata in vigore. Il nuovo round a circa 74 miliardi di dollari resta un'indiscrezione di agenzia non confermata dall'azienda. Non esiste un confronto ufficiale prezzo/prestazioni con i concorrenti, né il dettaglio dell'architettura oltre al numero di parametri e al modulo DSpark.
- Perché pubblicarla
- È il rilascio di un modello di punta con pesi in licenza MIT da parte del laboratorio che più di ogni altro ha compresso i prezzi dell'inferenza, e arriva con la mossa opposta: il primo rialzo di listino, con fasce orarie che finora nel mercato dei modelli linguistici non erano prassi. Per chi in Italia costruisce agenti sulle API DeepSeek è una notizia operativa con una data precisa — 16 agosto, 16:00 UTC — e numeri verificabili sulla pagina ufficiale, non una promessa di prestazioni. E permette di raccontare con precisione la differenza fra il prezzo dell'input in cache e quello dell'output: il punto dove l'aumento morde davvero chi fa girare agenti a lungo contesto.
Fonti / Sources
- DeepSeek API Docs — annuncio del rilascio GA di DeepSeek-V4-Pro (13 agosto 2026)
- DeepSeek API Docs — Models & Pricing (listino attuale e listino picco/fuori picco)
- Hugging Face — model card ufficiale deepseek-ai/DeepSeek-V4-Pro-0813
- Reuters — «DeepSeek releases official V4 Pro model as it steps up expansion» (13 agosto 2026)