DeepSeek V4 Flash API 价格
价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。
DeepSeek V4 Flash
deepseek-v4-flash DeepSeek V4 Flash 是什么模型?
DeepSeek 官方把 V4 Flash 和 V4 Pro 作为同一代文本模型的两个服务档位。Flash 更适合高频对话、批量 Agent 步骤和对延迟、成本更敏感的编码任务;Pro 面向复杂推理、长链路工程和更强调最终质量的工作负载。两者使用不同模型 ID,因此可以在应用路由层按任务难度选择,而不必维护两套请求协议。
DeepSeek 官方 API 文档为两款模型公布了 1M 上下文、最高 384K 输出、可切换思考模式,以及 JSON Output、Tool Calls、Responses、Anthropic API、前缀补全和 FIM 等能力。这些属于 DeepSeek 上游规格;Roko API 当前页面只把模型目录已经配置的 Chat、流式输出、可用分组和价格列为已接入能力。
选择模型时,不建议只比较单次请求价格。高吞吐场景应关注 Flash 的响应时间和每个合格结果成本;复杂 Agent 任务则应比较 Pro 能否减少重试、人工修正和模型升级次数。最稳妥的做法是让 Flash 处理默认流量,只在任务难度或验收结果达到阈值时升级到 Pro。
DeepSeek V4 Flash 适合哪些场景?
以下建议结合官方模型定位与分层路由方法整理;实际选择应以当前 Roko API 配置和自己的任务评测为准。
Flash:高并发文本任务
适合分类、抽取、摘要、常规对话和大批量 Agent 中间步骤,重点控制延迟和单位任务成本。
Flash:日常编码与工具循环
适合代码解释、局部修改、工具返回总结和可快速验收的编码任务,再把失败样本升级到 Pro。
Pro:复杂推理与工程任务
适合跨模块分析、复杂调试、架构方案和需要持续保持约束的长链路工程任务。
Flash → Pro 分级路由
先用 Flash 处理默认流量,根据任务类型、置信度或自动验收结果升级到 Pro,平衡质量与预算。
DeepSeek V4 Flash API 常用参数
仅列出当前 Roko API 接入已经明确支持或公开配置的字段。
| 参数 | 类型 | 要求 | 说明 |
|---|---|---|---|
model | string | 必填 | 固定填写 deepseek-v4-flash。 |
messages | array | 必填 | 按顺序传入对话消息;至少包含一条用户消息。 |
stream | boolean | 可选 | 设为 true 时使用 SSE 流式返回。 |
DeepSeek V4 Flash API 调用示例
使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。
curl https://api.rokoapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [
{"role": "user", "content": "分析这个代码库的模块依赖,指出最可能导致线上故障的三个风险,并为每项风险给出验证步骤"}
],
"stream": true
}' 计费与上线建议
- 1
Flash 和 Pro 使用独立模型 ID 与独立价格;页面价格读取 Roko API 当前模型目录,不直接复制 DeepSeek 或供应商报价。
- 2
当前 Roko API 目录未单列缓存命中价格,因此本页不会把上游缓存折扣作为当前计费承诺。
- 3
生产路由建议记录每个模型的首次通过率、重试次数、响应时间和单个合格任务总成本。
- 4
DeepSeek 上游价格和高峰、低峰规则可能调整;Roko API 实际扣费以调用时的模型价格配置与 usage 为准。
DeepSeek V4 Flash API 常见问题
DeepSeek V4 Flash API 使用哪个模型 ID?
使用 deepseek-v4-flash。模型 ID 区分字符,请直接复制本页显示的值。
DeepSeek V4 Flash API 怎么计费?
Roko API 当前按 Token 计费:输入 $0.6000 / 1M tokens,输出 $1.4000 / 1M tokens,缓存读取 $0.0120 / 1M tokens,缓存写入 $0.7500 / 1M tokens,1 小时缓存写入 $1.2000 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。
DeepSeek V4 Flash API 使用哪个接口?
当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。
DeepSeek V4 Flash 和 Pro 应该怎么选?
默认从 Flash 开始:它适合高吞吐、常规编码和可快速验收的任务。复杂推理、跨文件工程或 Flash 未通过自动验收时,再升级到 Pro。
DeepSeek V4 官方上下文窗口和最大输出是多少?
DeepSeek 官方模型页公布为 1M 上下文、最高 384K 输出。只有当 Roko API 模型目录也配置这些字段时,本页才会把它们显示为当前接入规格。
DeepSeek V4 支持思考模式和工具调用吗?
DeepSeek 官方说明 Flash 和 Pro 支持思考模式、JSON Output 与 Tool Calls。Roko API 的实际参数和协议支持以当前模型目录、开发文档及真实接口响应为准。
DeepSeek V4 Flash 支持图片输入吗?
纯文本模型 deepseek-v4-flash 不接收图片。图片理解需要使用独立的实验模型 deepseek-v4-flash-vision-exp,并先确认当前 Roko API 已开放对应图片协议。
相关文本模型
比较同系列或其他文本模型的价格与当前接入能力。