Google · 最新一代 Flash 工作模型● 预览

Gemini 3.7 Flash API 价格与迁移指南

Gemini 3.7 Flash 是 Google 面向复杂编码、Agent 工作流和可靠多步骤执行推出的新一代 Flash 模型。Google 已将其设为稳定版本,但 Roko API 当前目录仍标记为预览;使用 gemini-3.7-flash 模型 ID 即可调用 Chat 与流式端点。

OpenAI 兼容 按 Token 计费 Chat流式输出
PRICING

Google Gemini 3.7 Flash API 价格

价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。

Google Gemini 3.7 Flash

Google Gemini 3.7 Flash

gemini-3.7-flash
输入 Token$0.7250 / 1M tokens当前目录价格 · 按实际 Token 计费
输出 Token$3.7200 / 1M tokens当前目录价格 · 按实际 Token 计费
价格快照 正在刷新价格…
OVERVIEW

Gemini 3.7 Flash 是什么模型?

Google 将 Gemini 3.7 Flash 定位为当前最强的 Flash 工作模型,重点覆盖复杂编码、Agent 工作流与可靠的多步骤执行。官方模型卡公布 1M 输入上下文、65,536 最大输出,并支持 low、medium、high 三档思考。

从 3.6 迁移时,需要特别注意 minimal 思考档位已移除,同时应重新检查 temperature、top_p、top_k、candidate_count 和旧式 thinking budget 等参数。相同标价也不代表相同任务成本,版本变化可能改变思考 Token 与输出长度。

Google 官方状态是稳定可用,而 Roko API 当前模型目录的 availability 仍为 preview。页面以 Roko API 状态为准展示“预览”,并只把 Chat、流式模式、分组和三类 Token 价格视为当前已配置能力。

USE CASES

Gemini 3.7 Flash 适合哪些场景?

以下场景结合 Google 官方定位和预览路由的上线方法整理;生产流量应保留明确回退。

01

复杂编码 Agent

适合代码库理解、跨文件修改、终端反馈迭代和需要持续验证的复杂开发任务。

02

可靠多步骤执行

适合任务拆解、连续工具步骤和需要在中间失败后调整计划的 Agent 流程。

03

高质量 Flash 默认路由

适合需要比旧 Flash 更强任务完成率、同时重视吞吐和成本的工作负载。

04

受控灰度升级

适合从 3.6 replay、shadow、canary 后逐步迁移,并随时回退到已验证版本。

PARAMETERS

Google Gemini 3.7 Flash API 常用参数

仅列出当前 Roko API 接入已经明确支持或公开配置的字段。

参数类型要求说明
modelstring必填固定填写 gemini-3.7-flash。
messagesarray必填按顺序传入对话消息;至少包含一条用户消息。
streamboolean可选设为 true 时使用 SSE 流式返回。
QUICKSTART

Google Gemini 3.7 Flash API 调用示例

使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。

Base URLhttps://api.rokoapi.com/v1
curl https://api.rokoapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.7-flash",
    "messages": [
      {"role": "user", "content": "为这个多服务仓库设计一次无停机升级,列出依赖顺序、失败回退、观测指标和自动化验收步骤"}
    ],
    "stream": true
  }'
PRODUCTION

计费与上线建议

  1. 1

    本页价格读取 Roko API 当前 gemini-3.7-flash 复杂表达式,而不是直接采用 Google 介绍价或 EvoLink 折扣价。

  2. 2

    输入、输出和缓存读取分别计费;思考 Token 可能增加输出侧用量,应通过真实 usage 建立预算。

  3. 3

    Roko API 当前把模型标记为预览,生产部署应限制流量比例、设置 3.6 回退并监控错误率和参数兼容性。

  4. 4

    Google 介绍价存在时间窗口,Roko API 实际扣费仍以请求发生时的价格配置为准。

FAQ

Google Gemini 3.7 Flash API 常见问题

Google Gemini 3.7 Flash API 使用哪个模型 ID?

使用 gemini-3.7-flash。模型 ID 区分字符,请直接复制本页显示的值。

Google Gemini 3.7 Flash API 怎么计费?

Roko API 当前按 Token 计费:输入 $0.7250 / 1M tokens,输出 $3.7200 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。

Google Gemini 3.7 Flash API 使用哪个接口?

当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。

Gemini 3.7 Flash 在 Roko API 中是正式版还是预览?

Google 官方已标记为稳定版本,但 Roko API 当前模型目录仍标记 preview,因此本页按当前目录显示“预览”。上线前应保留流量限制和回退路径。

Gemini 3.7 Flash 支持哪些 thinking level?

Google 官方支持 low、medium、high,不支持 minimal。Roko API 当前目录没有公开推理参数,是否接受相应字段应以当前接口验证为准。

从 Gemini 3.6 Flash 迁移需要注意什么?

应移除 minimal 与旧式 thinking budget,并重新检查自定义采样参数和候选数量。建议先 replay,再逐步灰度,避免直接替换全部生产流量。

Gemini 3.7 Flash 和 3.6 Flash 价格相同吗?

当前 Roko API 目录中的输入、输出和缓存读取费率相同,但相同费率不代表相同任务总成本;思考 Token、输出长度和重试率仍可能变化。

RELATED

比较同系列或其他文本模型的价格与当前接入能力。

浏览全部文本模型 →