DeepSeek · V4 文本模型系列● 可用

DeepSeek V4 Flash API 价格与调用指南

DeepSeek V4 Flash 是 V4 系列面向高吞吐文本任务的快速档。Roko API 当前使用 deepseek-v4-flash 模型 ID,通过 OpenAI 兼容 Chat Completions 端点调用,并按实际输入和输出 Token 计费。

OpenAI 兼容 按 Token 计费 Chat流式输出
PRICING

DeepSeek V4 Flash API 价格

价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。

DeepSeek V4 Flash

DeepSeek V4 Flash

deepseek-v4-flash
输入 Token$0.6000 / 1M tokens当前目录价格 · 按实际 Token 计费
输出 Token$1.4000 / 1M tokens当前目录价格 · 按实际 Token 计费
缓存读取 Token$0.0120 / 1M tokens当前目录价格 · 按实际 Token 计费
缓存写入 Token$0.7500 / 1M tokens当前目录价格 · 按实际 Token 计费
1 小时缓存写入 Token$1.2000 / 1M tokens当前目录价格 · 按实际 Token 计费
价格快照 正在刷新价格…
OVERVIEW

DeepSeek V4 Flash 是什么模型?

DeepSeek 官方把 V4 Flash 和 V4 Pro 作为同一代文本模型的两个服务档位。Flash 更适合高频对话、批量 Agent 步骤和对延迟、成本更敏感的编码任务;Pro 面向复杂推理、长链路工程和更强调最终质量的工作负载。两者使用不同模型 ID,因此可以在应用路由层按任务难度选择,而不必维护两套请求协议。

DeepSeek 官方 API 文档为两款模型公布了 1M 上下文、最高 384K 输出、可切换思考模式,以及 JSON Output、Tool Calls、Responses、Anthropic API、前缀补全和 FIM 等能力。这些属于 DeepSeek 上游规格;Roko API 当前页面只把模型目录已经配置的 Chat、流式输出、可用分组和价格列为已接入能力。

选择模型时,不建议只比较单次请求价格。高吞吐场景应关注 Flash 的响应时间和每个合格结果成本;复杂 Agent 任务则应比较 Pro 能否减少重试、人工修正和模型升级次数。最稳妥的做法是让 Flash 处理默认流量,只在任务难度或验收结果达到阈值时升级到 Pro。

USE CASES

DeepSeek V4 Flash 适合哪些场景?

以下建议结合官方模型定位与分层路由方法整理;实际选择应以当前 Roko API 配置和自己的任务评测为准。

01

Flash:高并发文本任务

适合分类、抽取、摘要、常规对话和大批量 Agent 中间步骤,重点控制延迟和单位任务成本。

02

Flash:日常编码与工具循环

适合代码解释、局部修改、工具返回总结和可快速验收的编码任务,再把失败样本升级到 Pro。

03

Pro:复杂推理与工程任务

适合跨模块分析、复杂调试、架构方案和需要持续保持约束的长链路工程任务。

04

Flash → Pro 分级路由

先用 Flash 处理默认流量,根据任务类型、置信度或自动验收结果升级到 Pro,平衡质量与预算。

PARAMETERS

DeepSeek V4 Flash API 常用参数

仅列出当前 Roko API 接入已经明确支持或公开配置的字段。

参数类型要求说明
modelstring必填固定填写 deepseek-v4-flash。
messagesarray必填按顺序传入对话消息;至少包含一条用户消息。
streamboolean可选设为 true 时使用 SSE 流式返回。
QUICKSTART

DeepSeek V4 Flash API 调用示例

使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。

Base URLhttps://api.rokoapi.com/v1
curl https://api.rokoapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {"role": "user", "content": "分析这个代码库的模块依赖,指出最可能导致线上故障的三个风险,并为每项风险给出验证步骤"}
    ],
    "stream": true
  }'
PRODUCTION

计费与上线建议

  1. 1

    Flash 和 Pro 使用独立模型 ID 与独立价格;页面价格读取 Roko API 当前模型目录,不直接复制 DeepSeek 或供应商报价。

  2. 2

    当前 Roko API 目录未单列缓存命中价格,因此本页不会把上游缓存折扣作为当前计费承诺。

  3. 3

    生产路由建议记录每个模型的首次通过率、重试次数、响应时间和单个合格任务总成本。

  4. 4

    DeepSeek 上游价格和高峰、低峰规则可能调整;Roko API 实际扣费以调用时的模型价格配置与 usage 为准。

FAQ

DeepSeek V4 Flash API 常见问题

DeepSeek V4 Flash API 使用哪个模型 ID?

使用 deepseek-v4-flash。模型 ID 区分字符,请直接复制本页显示的值。

DeepSeek V4 Flash API 怎么计费?

Roko API 当前按 Token 计费:输入 $0.6000 / 1M tokens,输出 $1.4000 / 1M tokens,缓存读取 $0.0120 / 1M tokens,缓存写入 $0.7500 / 1M tokens,1 小时缓存写入 $1.2000 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。

DeepSeek V4 Flash API 使用哪个接口?

当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。

DeepSeek V4 Flash 和 Pro 应该怎么选?

默认从 Flash 开始:它适合高吞吐、常规编码和可快速验收的任务。复杂推理、跨文件工程或 Flash 未通过自动验收时,再升级到 Pro。

DeepSeek V4 官方上下文窗口和最大输出是多少?

DeepSeek 官方模型页公布为 1M 上下文、最高 384K 输出。只有当 Roko API 模型目录也配置这些字段时,本页才会把它们显示为当前接入规格。

DeepSeek V4 支持思考模式和工具调用吗?

DeepSeek 官方说明 Flash 和 Pro 支持思考模式、JSON Output 与 Tool Calls。Roko API 的实际参数和协议支持以当前模型目录、开发文档及真实接口响应为准。

DeepSeek V4 Flash 支持图片输入吗?

纯文本模型 deepseek-v4-flash 不接收图片。图片理解需要使用独立的实验模型 deepseek-v4-flash-vision-exp,并先确认当前 Roko API 已开放对应图片协议。

RELATED

比较同系列或其他文本模型的价格与当前接入能力。

浏览全部文本模型 →