DeepSeek disponibiliza o V4 Pro de forma geral e reorganiza os preços por faixas horárias
A DeepSeek anunciou a disponibilidade geral do DeepSeek-V4-Pro-0813, substituindo a versão preview do seu modelo principal. Segundo a documentação técnica, o modelo tem 1,7 trilhão de parâmetros, licença MIT e uma janela de contexto de um milhão de tokens, acompanhada de um novo módulo de speculative decoding chamado DSpark. Entre as funcionalidades introduzidas estão o parâmetro `reasoning_effort`, com três níveis para modular o processamento, e o suporte nativo à Responses API da OpenAI. Os resultados dos benchmarks agênticos indicados no model card, como Terminal Bench 2.1 e DeepSWE, permanecem por ora dados declarados pela empresa, à espera de validação independente.
A mudança operacional de maior impacto diz respeito à economia do serviço: a partir das 16:00 UTC de 16 de agosto, a DeepSeek abandona a tabela única em favor de duas faixas horárias com preço fixo, pico e fora de pico. A documentação indica como horas de pico as janelas 01:00–04:00 e 06:00–10:00 UTC, com tarifas fora de pico fixadas na metade das de pico. A comparação entre a tabela antiga e a nova para o V4 Pro mostra uma alta acentuada: o custo de saída no horário de pico passa de 0,87 para 3,96 dólares por milhão de tokens, enquanto a entrada com cache hit registra o maior aumento percentual, subindo cerca de doze vezes, até 0,044 dólar. Mesmo fora de pico a tabela fica acima da anterior: a saída passa de 0,87 para 1,98 dólar por milhão de tokens. A decisão inverte a política de preços agressivos que caracterizara a empresa no campo dos modelos abertos.
O lançamento acontece em pleno contexto de expansão industrial. Segundo a Reuters, a DeepSeek captou cerca de 7,4 bilhões de dólares em junho de 2026 na sua primeira rodada de financiamento externo e estaria avaliando uma nova rodada com valuation de aproximadamente 74 bilhões — número que, no entanto, continua sendo uma informação de agência, sem confirmação oficial. Tudo isso enquanto a concorrência interna chinesa — de Alibaba e ByteDance a MiniMax, Moonshot AI e Zhipu AI — multiplica os lançamentos. A licença MIT mantém os pesos na categoria das publicações abertas, mas o custo de uso via API já não depende apenas do modelo escolhido: depende também da hora em que se faz a consulta.
Permanecem lacunas na informação disponível. Embora as faixas estejam expressas em UTC, a fonte não esclarece se derivam de uma conversão a partir do horário de Pequim, o que deixa incerto o impacto prático sobre os utilizadores europeus até a entrada em vigor. Além disso, a ausência de uma comparação oficial de preço e desempenho com os modelos concorrentes e a falta de detalhes de arquitetura para além do módulo DSpark limitam qualquer avaliação completa do posicionamento do produto no mercado.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Li a página de anúncio na documentação oficial da API da DeepSeek (news260813): data de lançamento 13 de agosto de 2026, parâmetro reasoning_effort em três níveis, suporte nativo à Responses API e nova tabela em vigor às 16:00 UTC de 16 de agosto. Na página oficial Models & Pricing transcrevi as duas tabelas e recalculei as diferenças em vez de repetir o «12x» que circulava em sites agregadores: o fator doze diz respeito à entrada com cache hit, enquanto a saída sobe cerca de 4,6 vezes. Especificações e licença verificadas no model card oficial no Hugging Face (1,7 trilhão de parâmetros, MIT, DSpark, 384K de saída). Como segundas fontes independentes usei o despacho da Reuters de 13 de agosto — que confirma data, canais de distribuição e aumento — e uma análise da Unite.AI para cruzar os números de contexto e saída. Descartei os sites que repercutiam a notícia sem recorrer à documentação oficial.
- Incertezze
- As pontuações dos benchmarks (Terminal Bench 2.1, DeepSWE e as demais citadas por análises de terceiros) são declaradas pela empresa e ainda não foram replicadas por avaliações independentes. As faixas de pico são indicadas em UTC, mas o texto não esclarece se derivam de uma conversão do horário de Pequim, de modo que o efeito prático sobre os utilizadores europeus terá de ser verificado na entrada em vigor. A nova rodada com valuation de cerca de 74 bilhões de dólares continua sendo uma informação de agência não confirmada pela empresa. Não há comparação oficial de preço e desempenho com os modelos concorrentes, nem detalhes de arquitetura além do número de parâmetros e do módulo DSpark.
- Perché pubblicarla
- É o lançamento de um modelo principal com pesos sob licença MIT pelo laboratório que mais comprimiu os preços da inferência — e chega acompanhado do movimento oposto: o primeiro aumento de tabela, com faixas horárias que até agora não eram prática no mercado dos modelos de linguagem. Para quem constrói agentes sobre as APIs da DeepSeek, é uma notícia operacional com data precisa — 16 de agosto, 16:00 UTC — e números verificáveis na página oficial, não uma promessa de desempenho. E é um caso que permite contar com precisão a diferença entre o preço da entrada em cache e o da saída: o ponto onde o aumento realmente morde quem faz rodar agentes de contexto longo.
Fonti / Sources
- DeepSeek API Docs — annuncio del rilascio GA di DeepSeek-V4-Pro (13 agosto 2026)
- DeepSeek API Docs — Models & Pricing (listino attuale e listino picco/fuori picco)
- Hugging Face — model card ufficiale deepseek-ai/DeepSeek-V4-Pro-0813
- Reuters — «DeepSeek releases official V4 Pro model as it steps up expansion» (13 agosto 2026)