DeepSeek rend V4 Pro généralement disponible et refond ses tarifs par plages horaires
DeepSeek a annoncé la disponibilité générale de DeepSeek-V4-Pro-0813, qui remplace la version préliminaire de son modèle phare. D'après la documentation technique, le modèle compte 1 700 milliards de paramètres, une licence MIT et une fenêtre de contexte d'un million de tokens, accompagnée d'un nouveau module de speculative decoding baptisé DSpark. Parmi les nouveautés figurent le paramètre `reasoning_effort`, décliné en trois niveaux pour moduler le traitement, et la prise en charge native de la Responses API d'OpenAI. Les résultats des benchmarks agentiques mentionnés dans la model card, comme Terminal Bench 2.1 et DeepSWE, restent pour l'instant des données déclarées par l'entreprise, en attente de validation indépendante.
Le changement opérationnel le plus lourd de conséquences touche l'économie du service : à partir du 16 août à 16h00 UTC, DeepSeek abandonne le tarif unique au profit de deux plages horaires à prix fixe, pointe et heures creuses. La documentation situe les heures de pointe dans les fenêtres 01h00–04h00 et 06h00–10h00 UTC, les tarifs hors pointe étant fixés à la moitié de ceux de pointe. La comparaison entre l'ancienne et la nouvelle grille pour V4 Pro fait apparaître une hausse nette : le coût de sortie en heures de pointe passe de 0,87 à 3,96 dollars par million de tokens, tandis que l'entrée avec cache hit enregistre la plus forte progression en pourcentage, environ douze fois plus, jusqu'à 0,044 dollar. Même hors pointe, la grille reste au-dessus de la précédente : la sortie passe de 0,87 à 1,98 dollar par million de tokens. Ce choix marque un renversement par rapport à la politique de prix agressifs qui avait distingué l'entreprise dans le domaine des modèles ouverts.
La sortie s'inscrit dans un contexte d'expansion industrielle. Selon Reuters, DeepSeek a levé environ 7,4 milliards de dollars en juin 2026 lors de son premier tour de financement externe et envisagerait un nouveau tour sur une valorisation d'environ 74 milliards — un chiffre qui reste toutefois une information d'agence, non confirmée officiellement. Le tout alors que la concurrence intérieure chinoise — d'Alibaba et ByteDance à MiniMax, Moonshot AI et Zhipu AI — multiplie les sorties. La licence MIT maintient les poids dans la catégorie des publications ouvertes, mais le coût d'utilisation via l'API ne dépend plus seulement du modèle choisi : il dépend aussi de l'heure à laquelle on l'interroge.
Des zones d'ombre subsistent. Les plages sont exprimées en UTC, mais la source ne précise pas si elles résultent d'une conversion depuis l'heure de Pékin, ce qui laisse l'impact concret sur les utilisateurs européens incertain jusqu'à l'entrée en vigueur. S'y ajoutent l'absence de comparatif officiel prix-performances avec les modèles concurrents et le manque de détails architecturaux au-delà du module DSpark, qui limitent toute évaluation complète du positionnement du produit sur le marché.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- J'ai lu la page d'annonce dans la documentation officielle de l'API DeepSeek (news260813) : sortie datée du 13 août 2026, paramètre reasoning_effort à trois niveaux, prise en charge native de la Responses API et nouvelle grille tarifaire en vigueur le 16 août à 16h00 UTC. Sur la page officielle Models & Pricing, j'ai relevé les deux tableaux et recalculé moi-même les écarts au lieu de reprendre le « 12x » qui circulait sur les sites agrégateurs : le facteur douze concerne l'entrée avec cache hit, tandis que la sortie augmente d'environ 4,6 fois. Spécifications et licence vérifiées sur la model card officielle Hugging Face (1 700 milliards de paramètres, MIT, DSpark, 384K de sortie). Comme secondes sources indépendantes, la dépêche Reuters du 13 août — qui confirme la date, les canaux de distribution et la hausse — et une analyse d'Unite.AI pour recouper les chiffres de contexte et de sortie. J'ai écarté les sites qui relayaient l'information sans remonter à la documentation officielle.
- Incertezze
- Les scores aux benchmarks (Terminal Bench 2.1, DeepSWE et les autres cités par des analyses tierces) sont déclarés par l'entreprise et n'ont pas encore été reproduits par des évaluations indépendantes. Les plages de pointe sont données en UTC, mais le texte ne dit pas si elles proviennent d'une conversion depuis l'heure de Pékin : l'effet pratique pour les utilisateurs européens devra être vérifié à l'entrée en vigueur. Le nouveau tour de table à environ 74 milliards de dollars reste une information d'agence non confirmée par l'entreprise. Aucun comparatif officiel prix/performances avec les modèles concurrents n'est publié, ni de détail d'architecture au-delà du nombre de paramètres et du module DSpark.
- Perché pubblicarla
- C'est la sortie d'un modèle phare aux poids sous licence MIT par le laboratoire qui, plus que tout autre, a comprimé les prix de l'inférence — et elle s'accompagne du mouvement inverse : la première hausse tarifaire, avec des plages horaires qui n'étaient jusqu'ici pas d'usage sur le marché des modèles de langage. Pour qui construit des agents sur les API DeepSeek, c'est une nouvelle opérationnelle avec une date précise — 16 août, 16h00 UTC — et des chiffres vérifiables sur la page officielle, pas une promesse de performances. Et c'est un cas qui permet d'expliquer précisément la différence entre le prix de l'entrée en cache et celui de la sortie : l'endroit exact où la hausse mord vraiment ceux qui font tourner des agents à long contexte.
Fonti / Sources
- DeepSeek API Docs — annuncio del rilascio GA di DeepSeek-V4-Pro (13 agosto 2026)
- DeepSeek API Docs — Models & Pricing (listino attuale e listino picco/fuori picco)
- Hugging Face — model card ufficiale deepseek-ai/DeepSeek-V4-Pro-0813
- Reuters — «DeepSeek releases official V4 Pro model as it steps up expansion» (13 agosto 2026)