OLETOKEN
返回模型列表

DeepSeek

DeepSeek V4 Flash

高性价比高速推理68% 优惠
输入文本输出文本

API 格式OpenAI

面向编程、分析和日常智能体工作流的高速开源推理模型。

deepseek-v4-flash
输入价格$0.07$0.22每百万 tokens
输出价格$0.14$0.66每百万 tokens
缓存读取$0.00138$0.007每百万 tokens
上下文窗口1M tokens单次请求可携带的最大上下文
最大输出384K
计费方式按 Token
健康状态正常成功率 100% · 延迟 2.7s · 吞吐 73.3

模型详情

能力、基准与典型用法

DeepSeek V4 Flash 是 DeepSeek V4 系列中面向低延迟场景的模型。当前本地 DeepSeek 适配器将其作为文本输入、文本输出模型提供,支持推理、工具调用、结构化输出和百万 Token 上下文。Token 原价依据当前 new-api 生效的本地价格配置,缓存价格为已配置的缓存读取价格。

高速推理

为交互式任务提供响应迅速的分析和代码生成。

百万 Token 上下文

可以处理大型代码仓库、长文档和持续时间较长的对话。

工具调用

支持函数调用和结构化响应,便于接入应用。

DeepSeek V4 Flash