DeepSeek atualiza modelo V4-Pro com capacidade de 1M de contexto e 384K de saída

DeepSeek 旗下 do modelo deepseek-v4-pro foi atualizado para DeepSeek-V4-Pro-0813. De acordo com as informações atualmente divulgadas, esta atualização não veio acompanhada de ajustes de preço. Embora a DeepSeek tenha anteriormente anunciado planos para um aumento geral nos preços dos serviços de API, os preços atuais permanecem os mesmos de antes.

Melhorias nas especificações principais da atualização DeepSeek-V4-Pro-0813

Em termos de especificações principais, o deepseek-v4-pro suporta um comprimento de contexto de 1M, com um comprimento máximo de saída de até 384K Token, e suporta tanto o modo de não pensamento quanto o modo de pensamento, sendo que o modo de pensamento está definido como ativado por padrão. Para o processamento de grandes bibliotecas de código, análise de documentos em larga escala e tarefas de Agent que requerem a execução contínua de muitos passos, uma janela de contexto de 1M e uma saída máxima de 384K significam que uma única chamada pode acomodar e gerar uma quantidade considerável de conteúdo, reduzindo os custos de múltiplas divisões e concatenações.

Em termos de capacidades complementares, o deepseek-v4-pro cobre basicamente as necessidades de desenvolvimento de Agent mais comuns atualmente. Este modelo suporta JSON Output, Tool Calls, Responses API e Anthropic API, além de suportar a funcionalidade de continuação de prefixo de diálogo e FIM em fase Beta, sendo que a FIM só pode ser utilizada no modo de não pensamento.

Quanto à forma de integração da API, o deepseek-v4-pro é compatível com os formatos da OpenAI e da Anthropic, permitindo que os desenvolvedores escolham o caminho de integração de acordo com a sua stack tecnológica. Em termos de preços, o deepseek-v4-pro atualmente tem uma tarifa de 0,025 yuan por milhão de Tokens para entradas com cache hit, 3 yuan para entradas com cache miss e 6 yuan para saídas.

Comparação de preços e desempenho da versão Pro da DeepSeek

Para comparação, o deepseek-v4-flash da mesma série tem preços de 0,02 yuan por milhão de Tokens para entradas com cache hit, 1 yuan para entradas com cache miss e 2 yuan para saídas. Ou seja, nos dois principais itens de cobrança, entradas com cache miss e saídas, o preço da versão Pro é 3 vezes superior ao da versão Flash. Embora o preço absoluto da Pro seja superior ao da Flash, considerando a sua maior janela de contexto e capacidade de saída, a relação custo-benefício por Token continua a ser competitiva.

As duas versões também diferem nas limitações de concorrência. O deepseek-v4-flash tem uma limitação de concorrência de 2500, enquanto o deepseek-v4-pro tem uma limitação de 500. A partir dessa diferença de configuração, a Flash é claramente mais voltada para cenários de chamadas de alta frequência e em larga escala, adequada para aplicações que requerem respostas rápidas e muitos pedidos paralelos; enquanto a Pro concentra ainda mais recursos em tarefas de especificações mais elevadas, priorizando a profundidade e complexidade de uma única chamada.

stone
stone