Moonshot AI · 多模态编程与 Agent 模型● 可用

Kimi K2.7 Code API 与 HighSpeed 高速版指南

Kimi K2.7 Code 面向长程代码任务、深度思考和多步工具调用,并支持文本、图片与视频输入。Roko API 同时提供标准版 kimi-k2.7-code 和高速版 kimi-k2.7-code-highspeed。

OpenAI 兼容 按 Token 计费 image 输入text 输入video 输入 text 输出 Chat流式输出推理工具调用
PRICING

Kimi K2.7 Code API 价格

价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。

Kimi K2.7 Code

Kimi K2.7 Code

kimi-k2.7-code
输入 Token$1.0200 / 1M tokens当前目录价格 · 按实际 Token 计费
输出 Token$4.2400 / 1M tokens当前目录价格 · 按实际 Token 计费
价格快照 正在刷新价格…
OVERVIEW

Kimi K2.7 Code 与 HighSpeed 有什么区别?

Moonshot AI 官方说明,Kimi K2.7 Code 在长上下文中强化指令遵循和编程任务成功率,同时支持多模态理解、对话与 Agent 任务。标准版与高速版使用相同模型能力和 256K 上下文。

HighSpeed 的主要差异是输出速度和价格。官方给出的常规编程场景输出速度约为 180 Token/s,短上下文可达约 260 Token/s;标准版更适合成本优先流量,高速版适合交互延迟敏感的开发工作流。

K2.7 Code 不支持关闭思考。多轮工具调用需要保留并回传完整的 assistant 消息,避免丢失 reasoning_content 或 tool_calls 导致上下文断裂。

USE CASES

Kimi K2.7 Code 适合哪些场景?

标准版和高速版能力一致,主要根据单位成本与交互速度选择。

01

代码库理解与修改

适合读取较长工程上下文、定位关联文件并持续完成代码修改。

02

多模态调试

适合结合界面截图、操作视频和工具结果分析软件问题。

03

多步工具调用

适合需要推理、调用工具、校验输出并继续执行的 Agent 工作流。

04

高速交互式编码

HighSpeed 适合对首轮反馈与持续输出速度敏感的 IDE、终端和结对编程场景。

PARAMETERS

Kimi K2.7 Code API 常用参数

仅列出当前 Roko API 接入已经明确支持或公开配置的字段。

参数类型要求说明
modelstring必填固定填写 kimi-k2.7-code。
messagesarray必填按顺序传入对话消息;至少包含一条用户消息。
streamboolean可选设为 true 时使用 SSE 流式返回。
max_tokensinteger可选限制本次请求的最大输出,不能超过当前目录配置的 32,768 Token。
reasoning_effortstring可选控制推理强度;可用值以当前上游接口响应为准。
toolsarray可选向模型声明可调用的函数工具及其参数结构。
QUICKSTART

Kimi K2.7 Code API 调用示例

使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。

Base URLhttps://api.rokoapi.com/v1
curl https://api.rokoapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2.7-code",
    "messages": [
      {"role": "user", "content": "审查这个模块的并发实现,修复数据竞争,并输出修改后的代码、测试和验证命令"}
    ],
    "stream": true
  }'
PRODUCTION

计费与上线建议

  1. 1

    标准版当前为输入 $1.0200、输出 $4.2400 / 1M Token;HighSpeed 当前为输入 $2.0400、输出 $8.4800 / 1M Token。

  2. 2

    当前目录没有发布独立缓存命中单价;模型支持自动上下文缓存,但页面不会自行推算缓存价格。

  3. 3

    多模态输入和长思考会增加 Token 用量,选择高速版时应同时评估节省的等待时间与更高单价。

FAQ

Kimi K2.7 Code API 常见问题

Kimi K2.7 Code API 使用哪个模型 ID?

使用 kimi-k2.7-code。模型 ID 区分字符,请直接复制本页显示的值。

Kimi K2.7 Code API 怎么计费?

Roko API 当前按 Token 计费:输入 $1.0200 / 1M tokens,输出 $4.2400 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。

Kimi K2.7 Code API 使用哪个接口?

当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。

Kimi K2.7 Code 和 HighSpeed 的能力一样吗?

官方说明两者是同一个模型,均支持 256K 上下文和相同能力;高速版主要提升输出速度,同时采用更高价格。

Kimi K2.7 Code 能关闭思考吗?

不能。官方文档明确说明 K2.7 Code 不支持非思考模式,多轮调用还应完整保留模型返回的思考和工具信息。

Kimi K2.7 Code 支持 Responses API 吗?

当前 Moonshot 官方 Responses 文档只声明 Kimi K3,因此 Roko API 对 K2.7 Code 两个模型仅公开 Chat Completions。

Kimi K2.7 Code 的当前接入上下文窗口是多少?

当前 Roko API 模型目录配置为 262,144 Token。

RELATED

比较同系列或其他文本模型的价格与当前接入能力。

浏览全部文本模型 →