Google · 生产级 Flash 模型● 可用

Gemini 3.5 Flash API 价格与调用指南

Gemini 3.5 Flash 是 Google 面向多步骤 Agent、编码循环和高吞吐长任务推出的稳定 Flash 模型。Roko API 当前使用 gemini-3.5-flash 模型 ID,通过 OpenAI 兼容 Chat Completions 端点提供 Chat 与流式调用。

OpenAI 兼容 按 Token 计费 Chat流式输出
PRICING

Google Gemini 3.5 Flash API 价格

价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。

Google Gemini 3.5 Flash

Google Gemini 3.5 Flash

gemini-3.5-flash
输入 Token$1.2000 / 1M tokens当前目录价格 · 按实际 Token 计费
输出 Token$8.0000 / 1M tokens当前目录价格 · 按实际 Token 计费
价格快照 正在刷新价格…
OVERVIEW

Gemini 3.5 Flash 是什么模型?

Google 官方将 Gemini 3.5 Flash 定位为面向真实生产任务的高速度、低成本模型,重点覆盖子 Agent、多步骤工作流、长周期任务和快速编程迭代。它适合作为需要质量、吞吐和成本平衡的默认执行层。

Google 官方模型卡公布了文本、图像、视频、音频和 PDF 输入、文本输出、1,048,576 输入 Token 与 65,536 输出 Token,并列出思考、缓存、代码执行、函数调用和结构化输出等能力。这些是上游规格,不等同于 Roko API 当前已经透传的字段。

Roko API 当前目录只明确配置 Chat、流式模式、default 与 svip 分组,以及输入和输出 Token 价格,因此页面不会把官方多模态、工具或推理参数直接标记为当前已开放能力。需要相关能力时,应先通过真实请求验证协议和返回格式。

USE CASES

Gemini 3.5 Flash 适合哪些场景?

以下场景依据 Google 官方定位整理;实际接口能力以 Roko API 当前目录和调用结果为准。

01

高吞吐 Agent 步骤

适合分类、抽取、规划、结果整理和可自动验收的多步骤 Agent 常规节点。

02

快速编程循环

适合代码生成、调试、重构和测试编写等需要多次低延迟迭代的开发任务。

03

长文档与仓库分析

适合需要保持大量背景材料、代码或文档约束的长上下文分析任务。

04

稳定生产基线

适合作为 Gemini Flash 家族的稳定基线,与 3.6、3.7 组成可回退的灰度路由。

PARAMETERS

Google Gemini 3.5 Flash API 常用参数

仅列出当前 Roko API 接入已经明确支持或公开配置的字段。

参数类型要求说明
modelstring必填固定填写 gemini-3.5-flash。
messagesarray必填按顺序传入对话消息;至少包含一条用户消息。
streamboolean可选设为 true 时使用 SSE 流式返回。
QUICKSTART

Google Gemini 3.5 Flash API 调用示例

使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。

Base URLhttps://api.rokoapi.com/v1
curl https://api.rokoapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.5-flash",
    "messages": [
      {"role": "user", "content": "阅读下面的服务设计与错误日志,输出根因假设、验证顺序和可以自动检查的修复验收标准"}
    ],
    "stream": true
  }'
PRODUCTION

计费与上线建议

  1. 1

    本页展示 Roko API 当前 gemini-3.5-flash 输入与输出价格,不直接采用 Google 或 EvoLink 的公开报价。

  2. 2

    当前目录没有单列缓存价格,因此不会把 Google 或供应商缓存折扣显示为 Roko API 当前计费项。

  3. 3

    长上下文、媒体和思考 Token 都可能改变总用量;上线前应读取真实响应 usage 并建立成本样本。

  4. 4

    建议记录首次通过率、重试次数、输出长度和单个合格任务成本,再决定是否升级到更新的 Flash 版本。

FAQ

Google Gemini 3.5 Flash API 常见问题

Google Gemini 3.5 Flash API 使用哪个模型 ID?

使用 gemini-3.5-flash。模型 ID 区分字符,请直接复制本页显示的值。

Google Gemini 3.5 Flash API 怎么计费?

Roko API 当前按 Token 计费:输入 $1.2000 / 1M tokens,输出 $8.0000 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。

Google Gemini 3.5 Flash API 使用哪个接口?

当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。

Gemini 3.5 Flash 的官方上下文窗口是多少?

Google 官方模型卡列出 1,048,576 输入 Token 和 65,536 输出 Token。Roko API 当前目录没有配置这两个字段,因此不会把它们显示为当前接入上限。

Gemini 3.5 Flash 支持图片、视频和音频吗?

Google 官方模型支持文本、图像、视频、音频和 PDF 输入,但 Roko API 当前目录未声明这些输入模态。生产使用前应通过当前 OpenAI 兼容端点验证具体消息格式。

Gemini 3.5 Flash 和 3.6 Flash 怎么选?

3.5 可作为稳定基线;3.6 更强调代码生成、Agent 执行和空间推理。建议使用真实任务 replay 与灰度流量比较完成率、延迟和总成本。

RELATED

比较同系列或其他文本模型的价格与当前接入能力。

浏览全部文本模型 →