Moonshot AI · K2.7 Code 高速路由● 可用

Kimi K2.7 Code HighSpeed API 价格与调用指南

Kimi K2.7 Code HighSpeed 与标准版使用相同模型能力和 256K 上下文,重点提升交互式编程与 Agent 的输出速度。Roko API 使用独立模型 ID 和独立 Token 价格。

OpenAI 兼容 按 Token 计费 image 输入text 输入video 输入 text 输出 Chat流式输出推理工具调用
PRICING

Kimi K2.7 Code HighSpeed API 价格

价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。

Kimi K2.7 Code HighSpeed

Kimi K2.7 Code HighSpeed

kimi-k2.7-code-highspeed
输入 Token$2.0400 / 1M tokens当前目录价格 · 按实际 Token 计费
输出 Token$8.4800 / 1M tokens当前目录价格 · 按实际 Token 计费
价格快照 正在刷新价格…
OVERVIEW

为什么选择 Kimi K2.7 Code HighSpeed?

Moonshot AI 将 HighSpeed 定义为 Kimi K2.7 Code 的高速服务档,与标准版保持相同模型能力、文本图片视频输入和 256K 上下文。

官方给出的常规编程场景输出速度约为 180 Token/s,短上下文可达约 260 Token/s。速度会受到请求长度、并发与上游资源影响,不应把该数字视为固定 SLA。

高速版 Token 单价高于标准版,因此更适合对等待时间敏感的交互工作流;离线批处理或成本优先任务可优先选择标准版。

USE CASES

HighSpeed 适合哪些场景?

当响应等待时间比最低单价更重要时,高速路由更有价值。

01

IDE 编程助手

适合需要快速连续反馈的代码生成、解释和局部修改。

02

终端 Agent

适合工具调用之间等待时间会直接影响开发节奏的执行流程。

03

多模态调试

适合结合截图或视频快速分析界面和运行结果。

04

低延迟原型验证

适合在开发阶段快速比较提示词、工具定义和任务路由。

PARAMETERS

Kimi K2.7 Code HighSpeed API 常用参数

仅列出当前 Roko API 接入已经明确支持或公开配置的字段。

参数类型要求说明
modelstring必填固定填写 kimi-k2.7-code-highspeed。
messagesarray必填按顺序传入对话消息;至少包含一条用户消息。
streamboolean可选设为 true 时使用 SSE 流式返回。
max_tokensinteger可选限制本次请求的最大输出,不能超过当前目录配置的 32,768 Token。
reasoning_effortstring可选控制推理强度;可用值以当前上游接口响应为准。
toolsarray可选向模型声明可调用的函数工具及其参数结构。
QUICKSTART

Kimi K2.7 Code HighSpeed API 调用示例

使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。

Base URLhttps://api.rokoapi.com/v1
curl https://api.rokoapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2.7-code-highspeed",
    "messages": [
      {"role": "user", "content": "根据错误日志和界面截图定位问题,给出最小修复补丁并生成回归测试"}
    ],
    "stream": true
  }'
PRODUCTION

计费与上线建议

  1. 1

    高速版当前配置为输入 $2.0400、输出 $8.4800 / 1M Token;标准版当前为输入 $1.0200、输出 $4.2400 / 1M Token。

  2. 2

    当前目录没有发布独立缓存命中单价;页面直接读取生产模型目录,不再根据官网价格进行二次换算。

  3. 3

    生产选型应比较每个成功任务的总时长与总成本,而不是只比较标称输出速度。

FAQ

Kimi K2.7 Code HighSpeed API 常见问题

Kimi K2.7 Code HighSpeed API 使用哪个模型 ID?

使用 kimi-k2.7-code-highspeed。模型 ID 区分字符,请直接复制本页显示的值。

Kimi K2.7 Code HighSpeed API 怎么计费?

Roko API 当前按 Token 计费:输入 $2.0400 / 1M tokens,输出 $8.4800 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。

Kimi K2.7 Code HighSpeed API 使用哪个接口?

当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。

HighSpeed 的输出速度固定是 180 Token/s 吗?

不是。180 Token/s 是官方给出的常规场景参考值,短上下文可达约 260 Token/s,实际速度会随负载和请求特征变化。

HighSpeed 和标准版的上下文是否一致?

一致,两者均支持 256K 上下文,并共享 Kimi K2.7 Code 的模型能力。

什么时候应选择标准版?

离线批处理、可等待任务或成本优先流量更适合标准版;实时交互和开发节奏敏感的任务可选择 HighSpeed。

Kimi K2.7 Code HighSpeed 的当前接入上下文窗口是多少?

当前 Roko API 模型目录配置为 262,144 Token。

RELATED

比较同系列或其他文本模型的价格与当前接入能力。

浏览全部文本模型 →