Oferece análise responsiva e geração de código para fluxos de trabalho interativos.
Voltar para modelos
Raciocínio rápido Contexto de um milhão de tokens Saída pronta para ferramentas
DeepSeek
DeepSeek V4 Flash
Raciocínio rápido a um preço prático68% de descontoEntradaTextoSaídaTexto
Formato da APIOpenAI
Um modelo de raciocínio rápido e de pesos abertos para programação, análise e fluxos de trabalho diários de agentes.
deepseek-v4-flashPreço de entrada$0.07$0.22por milhão de tokens
Preço de saída$0.14$0.66por milhão de tokens
Leitura de cache$0.00138$0.007por milhão de tokens
Janela de contexto1M tokensContexto máximo por requisição
Saída máxima384K
CobrançaPor token
SaúdeOperacionalSucesso 100% · latência 2.7s · vazão 73.3
Detalhes do modelo
Capacidades, benchmarks e uso típico
DeepSeek V4 Flash é o membro da família DeepSeek V4 orientado para baixa latência. É exposto através do adaptador local DeepSeek como um modelo texto-entrada/texto-saída com raciocínio, chamada de ferramentas, saída estruturada e uma janela de contexto de 1M tokens. Os preços originais de tokens seguem a configuração ativa de preços do new-api local; o preço de cache é o preço configurado de leitura de cache.
Lida com grandes repositórios, documentos longos e conversas estendidas.
Suporta chamada de funções e respostas estruturadas para integração de aplicações.

