文档

模型与价格

更新于 2026-09-09

定价页

模型定价 展示构建时快照,并在浏览器端尝试刷新实时价格。

模型、定价和开发文档统一来自后台模型目录。仅有目录元数据、尚未开放调用或尚未定价的模型也会展示,并明确标注“暂不可用”或“暂未定价”。

新模型如何发布

管理员在控制台保存模型资料与价格后,后端会校验模型 ID、能力、端点和计费规则,并从可执行规则自动生成 pricing_display。公开目录会立即返回新版本;配置了 Cloudflare Pages Deploy Hook 时,连续修改会合并,在目录稳定约 60 秒后触发一次静态站重建。因此普通新模型会自动获得通用模型页、价格条目和开发文档页,无需单独修改页面代码。

目录中的 publication.ready 表示模型是否已具备启用状态、渠道路由、端点、支持模式和完整价格;publication.issues 会列出缺失项。公开目录用于展示与同步,当前 API Key 的实际可调用范围仍以 GET /v1/models 为准。

模型落地页

每个模型有独立 URL,例如 /models/deepseek-v4-flash/,包含:

  • 档位对比与输入 / 输出价格
  • 供应商与能力标签
  • 可复制的调用示例

模型开发文档

侧栏「模型文档」为后台目录中的每个模型提供开发指南(模型 ID、参数、示例、可用状态与定价),例如 /docs/models/deepseek-v4-flash/

新增生成模型

当前模型目录按调用方式分为:

  • 文本聊天:claude-sonnet-5deepseek-v4-flashdeepseek-v4-progemini-3.5-flashgemini-3.6-flashgemini-3.7-flashglm-5.2gpt-5.5gpt-5.6-solgpt-5.6-terragrok-4.5grok-4.6minimax-m3
  • 图像生成:gpt-image-2grok-imagine-image-2.0midjourneynano-banana-2nano-banana-pro
  • 视频生成:veo-3.1seedance-2.0seedance-2.0-proseedance-2.0-fastseedance-2.0-miniseedance-2.5hailuo-3grok-imagine-video-1.5gemini-omnikling-3.0-turbokling-o3happy-horse-1.1wan-2.7sora-2sora-2-pro
  • 音乐生成:suno-v6
  • 暂未开放:nano-banana(仅保留目录说明,不作为当前可用模型)

文本模型使用 OpenAI 兼容的 POST /v1/chat/completions,默认支持流式返回。音乐、图像、视频任务分别提交到 POST /v1/audios/tasksPOST /v1/images/tasksPOST /v1/videos/tasks,再通过 GET /v1/tasks/{task_id} 查询结果。完整请求参数分别见音频生成任务图像生成任务视频生成任务;实际可用模型以控制台渠道配置和 /v1/models 返回为准。

当前目录中的 suno-v6Suno v6 展示,并按后台固定价格计费;gpt-image-2 按 Token 计费,文本输入、图像输入和图像输出分别使用独立倍率。管理员在控制台修改后的价格优先于代码默认值。

grok-imagine-image-2.0 支持文生图与 1–3 张参考图编辑,输出 1K / 2K、Low / Medium,单次可生成 1–10 张。模型按分辨率、质量和输出张数计费,输入图片按每张每次请求单独计费;完整字段见图像生成任务

2026-08-21 固定价格快照

本批 EvoLink 模型按供应商当日美元成本价加 10% 固定为 RokoAPI 售价,不依赖请求发生时的实时 credits。文本模型按实际输入、输出和缓存 Token 结算;MiniMax M3Grok 4.5/4.6 还会按上下文长度选择对应价格档位。

grok-imagine-video-1.5 是例外:当前接入 TTAPI 非官转的 grok-imagine-video-1.5-fast,按任务时长分档计费。6~10 秒、12~20 秒、21~30 秒的含服务费售价分别为 $0.099$0.22$0.33;7 秒和 11 秒不受上游支持。

Veo 3.1 按生成视频的输出数量、秒数、分辨率和音频开关组合计费:

输出规格不生成音频生成音频
720p / 1080p$0.1034 /秒$0.1540 /秒
4K$0.3080 /秒$0.3608 /秒

Veo 3.1 支持 4、6、8 秒输出,n 支持 1–4;请求未传 generate_audio 时,上游预览模型默认生成音频,计费也按“生成音频”档执行。其他文本与生成模型的当前固定表达式及价格档位以模型定价为准。

模型 ID、系列与别名

  • 调用请求使用模型 ID,例如 suno-v6
  • 页面按系列聚合,例如 DeepSeek V4 的 Flash 与 Pro 共用一个系列页。
  • Midjourney 的公开调用 ID 统一为 midjourney;旧的 Midjourney v7Midjourney v8.1mj-v7mj-v8.1 已停止开放。
  • midjourney 提供 Fast、Turbo 两种速度,默认 Fast。常规生成的含服务费售价分别为 $0.055$0.077 /次;HD 任务按对应速度价格的 1.5 倍结算,完成后以上游实际 quota 校准。
  • Suno 模型必须带版本号。suno-v6 的公开名称为 Suno v6,不再用无版本的 suno 表示当前版本。

组合参数计费

RokoAPI 的统一计费规则可以同时考虑文本 Token、图片数量、分辨率、画质、视频输出时长、参考素材时长、生成方式和内置工具调用次数。因此,同一个模型在 1K / 2K / 4K480p / 720p / 1080p、文生 / 图生 / 参考生等组合下可以产生不同费用,而不需要为每一种能力重复创建模型。

异步生成任务会在提交时按固定价格表和请求参数预扣预计费用,并在任务完成后按实际 Token 或输出时长结算差额。EvoLink 视频模型采用后台保存的价格快照,不跟随供应商积分实时变化;价格表更新时由管理员审核后统一发布。任务失败则按任务退款规则处理。请求前请以模型定价展示的当前规则为准。

如何读取组合价格

消费者不需要理解或执行后台的高级表达式。公开模型目录 GET /api/catalog/models 会为可结构化展示的表达式返回 pricing_display

{
  "billing_mode": "tiered_expr",
  "pricing_display": {
    "currency": "USD",
    "basis": "duration",
    "unit": "second",
    "summary": "按生成时长和所选参数计费",
    "formula": "总价 = 输出时长(秒) × 对应档位单价",
    "dimensions": [
      { "key": "resolution", "label": "分辨率", "values": ["720p", "1080p"] },
      { "key": "quality", "label": "画质", "values": ["standard", "hd"] }
    ],
    "rates": [
      {
        "when": { "resolution": "720p", "quality": "standard" },
        "price_usd": 0.08,
        "unit": "second"
      }
    ],
    "modifiers": [],
    "notes": [],
    "expr_hash": "..."
  }
}
  • summaryformula 可以直接展示给用户。
  • dimensions 用来生成分辨率、画质、速度、生成方式和音频等筛选项。
  • rates 是对应参数组合的美元单价;视频通常是每秒,图片通常是每个输出。
  • basistokens 时,token_rates 给出输入、输出、缓存读写等每百万 Token 的美元参考单价;实际费用仍按请求用量结算。
  • modifiers 是输入图片或参考媒体等附加费用。
  • notes 说明预扣与最终结算之间可能存在的差额。
  • expr_hash 标识生成该价格表的表达式版本,可用于客户端缓存失效。

Token 模型示例:

{
  "basis": "tokens",
  "unit": "usage",
  "token_rates": [
    { "key": "input", "label": "输入 Token", "price_usd_per_million": 1.021429 },
    { "key": "output", "label": "输出 Token", "price_usd_per_million": 4.242857 },
    { "key": "cache_read", "label": "缓存读取", "price_usd_per_million": 0.204286 }
  ]
}

billing_expr 仍是后端扣费的唯一事实来源,只适合管理员审计。Star-Task 等消费端应渲染 pricing_display,不得在浏览器中执行 billing_expr。如果媒体模型的 rates 为空,或 Token 模型的 token_rates 为空,应显示“按实际用量计费,请以结算记录为准”,而不是自行猜测价格。

调用端用于计价的请求值必须与模型能力元数据保持一致:resolution 对应分辨率,quality 对应画质,speed 对应速度,generation_type 对应文生、图生、参考生或编辑方式,seconds / duration 对应输出时长,n 对应输出数量,generate_audio / audio_enabled 对应是否生成音频。具体可选值以同一模型的 generation_config 和开发页为准。

Star-Task 应分别读取公开目录与当前令牌可调用模型,再按精确模型 ID 合并;公开目录中的禁用模型可以展示,但不能据此判断当前令牌可调用:

const catalog = await fetch("https://rokoapi.com/api/catalog/models").then((response) =>
  response.json(),
);
const callable = await fetch("https://api.rokoapi.com/v1/models", {
  headers: { Authorization: `Bearer ${serverSideToken}` },
}).then((response) => response.json());

const callableIds = new Set(callable.data.map((model: { id: string }) => model.id));
const cards = catalog.data.map((model: { model_name: string; pricing_display?: unknown }) => ({
  ...model,
  callable: callableIds.has(model.model_name),
}));

令牌只能保存在 Star-Task 服务端。页面根据用户选择的参数匹配 rates[].when,用 price_usd × seconds × n(或 formula 指定的规则)显示预估总价;提交和最终扣费仍以后端为准。

注意

  • 禁用 JavaScript 时仍可阅读快照内容
  • 实时刷新失败不会清空页面,只会保留快照并提示
  • 价格变更后可通过 Deploy Hook 触发 Pages 重新构建