OLETOKEN
Voltar para modelos

DeepSeek

DeepSeek V4 Flash

Raciocínio rápido a um preço prático68% de desconto
EntradaTextoSaídaTexto

Formato da APIOpenAI

Um modelo de raciocínio rápido e de pesos abertos para programação, análise e fluxos de trabalho diários de agentes.

deepseek-v4-flash
Preço de entrada$0.07$0.22por milhão de tokens
Preço de saída$0.14$0.66por milhão de tokens
Leitura de cache$0.00138$0.007por milhão de tokens
Janela de contexto1M tokensContexto máximo por requisição
Saída máxima384K
CobrançaPor token
SaúdeOperacionalSucesso 100% · latência 2.7s · vazão 73.3

Detalhes do modelo

Capacidades, benchmarks e uso típico

DeepSeek V4 Flash é o membro da família DeepSeek V4 orientado para baixa latência. É exposto através do adaptador local DeepSeek como um modelo texto-entrada/texto-saída com raciocínio, chamada de ferramentas, saída estruturada e uma janela de contexto de 1M tokens. Os preços originais de tokens seguem a configuração ativa de preços do new-api local; o preço de cache é o preço configurado de leitura de cache.

Raciocínio rápido

Oferece análise responsiva e geração de código para fluxos de trabalho interativos.

Contexto de um milhão de tokens

Lida com grandes repositórios, documentos longos e conversas estendidas.

Saída pronta para ferramentas

Suporta chamada de funções e respostas estruturadas para integração de aplicações.