OLETOKEN
Volver a los modelos

DeepSeek

DeepSeek V4 Flash

Razonamiento rápido a un precio práctico68% de descuento
EntradaTextoSalidaTexto

Formato de APIOpenAI

Un modelo de razonamiento rápido con pesos abiertos para programación, análisis y flujos de trabajo de agentes cotidianos.

deepseek-v4-flash
Precio de entrada$0.07$0.22por millón de tokens
Precio de salida$0.14$0.66por millón de tokens
Lectura de caché$0.00138$0.007por millón de tokens
Ventana de contexto1M tokensContexto máximo por solicitud
Salida máxima384K
FacturaciónPor token
EstadoOperativoÉxito 100% · latencia 2.7s · rendimiento 73.3

Detalles del modelo

Capacidades, benchmarks y uso habitual

DeepSeek V4 Flash es el miembro de la familia DeepSeek V4 orientado a la latencia. Se expone a través del adaptador local de DeepSeek como un modelo de entrada/salida de texto con razonamiento, llamada a herramientas, salida estructurada y una ventana de contexto de 1M de tokens. Los precios originales de los tokens siguen la configuración de precios activa del new-api local; el precio de caché es el precio de lectura de caché configurado.

Razonamiento rápido

Ofrece análisis ágil y generación de código para flujos de trabajo interactivos.

Contexto de un millón de tokens

Maneja repositorios grandes, documentos largos y conversaciones extendidas.

Salida preparada para herramientas

Admite llamadas a funciones y respuestas estructuradas para la integración de aplicaciones.