DeepSeek pone V4 Pro en disponibilidad general y reorganiza sus tarifas por franjas horarias
DeepSeek ha anunciado la disponibilidad general de DeepSeek-V4-Pro-0813, que sustituye a la versión preview de su modelo insignia. Según la documentación técnica, el modelo cuenta con 1,7 billones de parámetros, licencia MIT y una ventana de contexto de un millón de tokens, acompañada de un nuevo módulo de speculative decoding llamado DSpark. Entre las funciones incorporadas figuran el parámetro `reasoning_effort`, con tres niveles para modular el procesamiento, y el soporte nativo de la Responses API de OpenAI. Los resultados de los benchmarks agénticos recogidos en la model card, como Terminal Bench 2.1 y DeepSWE, siguen siendo por ahora datos declarados por la empresa, a la espera de validación independiente.
El cambio operativo de mayor calado afecta a la economía del servicio: a partir de las 16:00 UTC del 16 de agosto, DeepSeek abandona la tarifa única en favor de dos franjas horarias con precio fijo, punta y valle. La documentación señala como horas punta las ventanas 01:00–04:00 y 06:00–10:00 UTC, con tarifas de valle fijadas en la mitad de las de punta. La comparación entre la tarifa antigua y la nueva para V4 Pro muestra una subida marcada: el coste de salida en hora punta pasa de 0,87 a 3,96 dólares por millón de tokens, mientras que la entrada con cache hit registra el mayor aumento porcentual, multiplicándose por unas doce veces hasta 0,044 dólares. Incluso en valle la tarifa queda por encima de la anterior: la salida pasa de 0,87 a 1,98 dólares por millón de tokens. La decisión invierte la política de precios agresivos que había caracterizado a la empresa en el terreno de los modelos abiertos.
El lanzamiento llega en pleno contexto de expansión industrial. Según Reuters, DeepSeek captó unos 7.400 millones de dólares en junio de 2026 en su primera ronda de financiación externa y estaría valorando una nueva ronda con una valoración cercana a los 74.000 millones, cifra que sin embargo sigue siendo una información de agencia no confirmada oficialmente. Todo ello mientras la competencia interna china —de Alibaba y ByteDance a MiniMax, Moonshot AI y Zhipu AI— multiplica los lanzamientos. La licencia MIT mantiene los pesos en la categoría de las publicaciones abiertas, pero el coste de uso vía API ya no depende solo del modelo elegido: depende también de la hora a la que se le pregunta.
Quedan lagunas en la información disponible. Aunque las franjas se expresan en UTC, la fuente no aclara si proceden de una conversión desde la hora de Pekín, lo que deja en el aire el impacto práctico sobre los usuarios europeos hasta la entrada en vigor. Además, la ausencia de una comparativa oficial de precio y rendimiento con los modelos rivales y la falta de detalles arquitectónicos más allá del módulo DSpark limitan cualquier valoración completa del posicionamiento del producto en el mercado.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- He leído la página de anuncio en la documentación oficial de la API de DeepSeek (news260813): fecha de lanzamiento 13 de agosto de 2026, parámetro reasoning_effort con tres niveles, soporte nativo de la Responses API y nueva tarifa vigente desde las 16:00 UTC del 16 de agosto. En la página oficial Models & Pricing transcribí ambas tablas y recalculé las diferencias en lugar de repetir el «12x» que circulaba por sitios agregadores: el factor doce corresponde a la entrada con cache hit, mientras que la salida crece unas 4,6 veces. Especificaciones y licencia verificadas en la model card oficial de Hugging Face (1,7 billones de parámetros, MIT, DSpark, 384K de salida). Como segundas fuentes independientes usé el despacho de Reuters del 13 de agosto —que confirma fecha, canales de distribución y subida de precios— y un análisis de Unite.AI para contrastar las cifras de contexto y salida. Descarté los sitios que replicaban la noticia sin remontarse a la documentación oficial.
- Incertezze
- Las puntuaciones de los benchmarks (Terminal Bench 2.1, DeepSWE y las demás citadas por análisis de terceros) las declara la empresa y aún no han sido replicadas por evaluaciones independientes. Las franjas punta se indican en UTC, pero el texto no aclara si derivan de una conversión desde la hora de Pekín, de modo que el efecto práctico sobre los usuarios europeos habrá que comprobarlo en la entrada en vigor. La nueva ronda por unos 74.000 millones de dólares sigue siendo una información de agencia no confirmada por la compañía. No hay comparativa oficial de precio y rendimiento con los modelos rivales, ni detalle de la arquitectura más allá del número de parámetros y el módulo DSpark.
- Perché pubblicarla
- Es el lanzamiento de un modelo insignia con pesos bajo licencia MIT por parte del laboratorio que más ha comprimido los precios de la inferencia, y llega acompañado del movimiento contrario: la primera subida de tarifas, con franjas horarias que hasta ahora no eran práctica habitual en el mercado de los modelos de lenguaje. Para quien construye agentes sobre las API de DeepSeek es una noticia operativa con una fecha exacta —16 de agosto, 16:00 UTC— y cifras verificables en la página oficial, no una promesa de rendimiento. Y permite explicar con precisión la diferencia entre el precio de la entrada en caché y el de la salida: el punto donde la subida muerde de verdad a quien hace correr agentes de contexto largo.
Fonti / Sources
- DeepSeek API Docs — annuncio del rilascio GA di DeepSeek-V4-Pro (13 agosto 2026)
- DeepSeek API Docs — Models & Pricing (listino attuale e listino picco/fuori picco)
- Hugging Face — model card ufficiale deepseek-ai/DeepSeek-V4-Pro-0813
- Reuters — «DeepSeek releases official V4 Pro model as it steps up expansion» (13 agosto 2026)