Google · Agent 与编程 Flash 模型● 可用

Gemini 3.6 Flash API 价格与调用指南

Gemini 3.6 Flash 是 Google 面向代码生成、Agent 执行和空间推理优化的稳定 Flash 模型。Roko API 当前通过 gemini-3.6-flash 模型 ID 提供 OpenAI 兼容 Chat 与流式调用,并分别展示输入、输出和缓存读取 Token 价格。

OpenAI 兼容 按 Token 计费 Chat流式输出
PRICING

Google Gemini 3.6 Flash API 价格

价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。

Google Gemini 3.6 Flash

Google Gemini 3.6 Flash

gemini-3.6-flash
输入 Token$0.6750 / 1M tokens当前目录价格 · 按实际 Token 计费
输出 Token$3.3750 / 1M tokens当前目录价格 · 按实际 Token 计费
价格快照 正在刷新价格…
OVERVIEW

Gemini 3.6 Flash 是什么模型?

Google 官方模型卡将 Gemini 3.6 Flash 定位为面向真实任务的高速度、高效率模型,重点增强代码生成、Agent 执行和空间推理,适合需要多轮规划、工具结果处理和快速迭代的工作流。

官方规格包括文本、图像、视频、音频和 PDF 输入、文本输出、1,048,576 输入 Token、65,536 输出 Token,以及思考、缓存、函数调用、代码执行和结构化输出等能力。Roko API 是否透传这些上游能力,必须以当前目录和接口验证为准。

Roko API 当前明确配置 Chat、流式模式、两个可用分组和三类 Token 价格;没有配置多模态、推理或工具字段。因此本页会介绍官方能力和迁移风险,但只把已经配置的部分列入当前接入信息。

USE CASES

Gemini 3.6 Flash 适合哪些场景?

以下场景来自 Google 官方模型定位;是否适合当前项目应通过 Roko API 的真实请求和质量门槛验证。

01

编程与调试 Agent

适合代码生成、问题定位、测试补全和需要连续验证的快速开发循环。

02

多步骤 Agent 执行

适合规划、执行、读取工具结果和修正下一步动作相互依赖的工作流。

03

空间与视觉推理评估

官方重点优化空间推理;媒体输入协议是否可用,仍需先验证当前 Roko API 接入。

04

3.5 到 3.7 的过渡基线

适合作为生产灰度和回退路由,比较新版本收益时保留稳定的中间基线。

PARAMETERS

Google Gemini 3.6 Flash API 常用参数

仅列出当前 Roko API 接入已经明确支持或公开配置的字段。

参数类型要求说明
modelstring必填固定填写 gemini-3.6-flash。
messagesarray必填按顺序传入对话消息;至少包含一条用户消息。
streamboolean可选设为 true 时使用 SSE 流式返回。
QUICKSTART

Google Gemini 3.6 Flash API 调用示例

使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。

Base URLhttps://api.rokoapi.com/v1
curl https://api.rokoapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.6-flash",
    "messages": [
      {"role": "user", "content": "审查这段异步任务代码的状态机和重试设计,列出竞态风险,并给出带测试用例的修改方案"}
    ],
    "stream": true
  }'
PRODUCTION

计费与上线建议

  1. 1

    页面使用 Roko API 当前复杂表达式价格:输入、输出和缓存读取分别计费,不以 Google 或 EvoLink 价格代替。

  2. 2

    思考 Token 如果由上游产生,通常计入输出侧用量;是否返回相应 usage 字段,以当前接口响应为准。

  3. 3

    迁移时不要假设采样参数、候选数量和 thinking 控制与旧版本完全一致,应先回放真实请求。

  4. 4

    生产评估应统计缓存命中、重试 Token、任务接受率和回退比例,以单个合格任务成本比较版本。

FAQ

Google Gemini 3.6 Flash API 常见问题

Google Gemini 3.6 Flash API 使用哪个模型 ID?

使用 gemini-3.6-flash。模型 ID 区分字符,请直接复制本页显示的值。

Google Gemini 3.6 Flash API 怎么计费?

Roko API 当前按 Token 计费:输入 $0.6750 / 1M tokens,输出 $3.3750 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。

Google Gemini 3.6 Flash API 使用哪个接口?

当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。

Gemini 3.6 Flash 的官方上下文和输出上限是多少?

Google 官方模型卡列出 1,048,576 输入 Token 和 65,536 输出 Token。Roko API 当前目录未配置这两个字段,因此页面不会把它们当作当前接入承诺。

Gemini 3.6 Flash 支持多模态和工具吗?

Google 官方支持多模态输入、函数调用、代码执行和结构化输出等能力,但 Roko API 当前目录尚未声明对应模态和工具字段,应先验证真实请求协议。

Gemini 3.6 Flash 如何设置 thinking?

Google 原生接口使用 thinking level。Roko API 当前目录没有公开推理配置,本页不会擅自加入 reasoning_effort 参数;可用字段以当前开发文档和接口响应为准。

RELATED

比较同系列或其他文本模型的价格与当前接入能力。

浏览全部文本模型 →