A startup chinesa DeepSeek lançou na última quinta-feira (13) a versão oficial de seu modelo principal, DeepSeek-V4-Pro, e elevou os custos de sua API em até 1.100%. A medida indica uma mudança na disputa de preços entre desenvolvedoras de inteligência artificial no país.
A nova estrutura de preços da DeepSeek diferencia tarifas para horários de pico e fora de pico. Durante os períodos de maior demanda, definidos como das noveh às doze horas e das catorze às dezoito horas, no fuso de Pequim, os custos para entrada em cache atingem 0,3 yuan (US$ 0,04) por milhão de tokens. Anteriormente, o modelo possuía preços fixos de 0,025 yuan, três yuans e seis yuans, respectivamente.
O modelo mais leve, DeepSeek-V4-Flash, também viu seus custos crescerem. O preço de entrada em cache no horário de pico subiu 400%, chegando a 0,1 yuan por milhão de tokens. Com essas novas tarifas, o DeepSeek-V4-Pro se aproxima dos valores cobrados pelo GLM-5.2, da Zhipu AI, que cobra dois yuans pela entrada em cache.
Em termos de desempenho, a DeepSeek afirma que o V4-Pro supera o GLM-5.2 em diversos testes de agentes e supera o Claude Opus 4.8, da Anthropic, em avaliações selecionadas. A série DeepSeek-V4 foi apresentada em abril, oferecendo uma janela de contexto de um milhão de tokens, e a versão Pro possui 1,6 trilhão de parâmetros.
O lançamento oficial ocorreu quase um mês após a previsão inicial. A empresa, que levantou cerca de 50 bilhões de yuans em sua primeira rodada de financiamento externo, avaliada em mais de 350 bilhões de yuans, abriu testes globais para uma versão de prévia do DeepSeek Harness na mesma quinta-feira.


