MiniMax · 长上下文 Agent 模型● 可用

MiniMax M3 API 价格与长上下文指南

MiniMax M3 面向编程 Agent、长文档和多步骤任务,并采用标准与长上下文两档 Token 价格。Roko API 当前使用 minimax-m3 模型 ID,通过 OpenAI 兼容 Chat Completions 接口提供 Chat 与流式输出。

OpenAI 兼容 按 Token 计费 Chat流式输出
PRICING

MiniMax M3 API 价格

价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。

MiniMax M3

MiniMax M3

minimax-m3
输入 Token$0.5435–$1.3588 / 1M tokens当前目录价格 · 按实际 Token 计费
输出 Token$2.1741–$5.4353 / 1M tokens当前目录价格 · 按实际 Token 计费
缓存读取 Token$0.1084–$0.2718 / 1M tokens当前目录价格 · 按实际 Token 计费
缓存写入 Token$0.6794–$1.6985 / 1M tokens当前目录价格 · 按实际 Token 计费
1 小时缓存写入 Token$0.6794–$1.6985 / 1M tokens当前目录价格 · 按实际 Token 计费
价格快照 正在刷新价格…
OVERVIEW

MiniMax M3 是什么模型?

MiniMax 将 M3 定位为面向编程和 Agent 工作流的旗舰模型,采用稀疏注意力架构,官方公布最高 1M Token 上下文,并支持图像、视频等多模态输入。它适合分析大型代码库、长文档和需要持续维护任务状态的复杂工作流。

MiniMax 官方说明 M3 可开启或关闭思考,并按上下文长度区分标准与长上下文价格。Roko API 当前复杂表达式以 524,288 Token 为边界:不超过该长度使用标准档,超过后使用长上下文档,并分别计算输入、输出、缓存读取、缓存写入和 1 小时缓存写入。

1M 上下文、多模态输入和思考控制属于上游模型能力。Roko API 当前目录只明确配置 OpenAI 兼容 Chat、流式模式、default 与 svip 分组和五类 Token 价格,因此页面不会把上游完整能力自动展示为当前已开放字段。

USE CASES

MiniMax M3 适合哪些场景?

以下场景结合 MiniMax 官方定位与长上下文成本边界整理;实际可用参数以当前 Roko API 接入为准。

01

代码库级 Agent

适合跨文件代码理解、故障排查、工程修改和需要持续规划、执行与验证的仓库任务。

02

长文档与知识分析

适合处理大量技术材料、研究文档和长期对话,但应关注 524,288 Token 后的长上下文价格。

03

多步骤自动化工作流

适合任务拆分、工具结果整理和多轮修正,并用缓存降低重复前缀的成本。

04

上游多模态研究任务

官方支持图像和视频输入;是否能通过当前 Roko API 使用,应以接入文档和接口验证结果为准。

PARAMETERS

MiniMax M3 API 常用参数

仅列出当前 Roko API 接入已经明确支持或公开配置的字段。

参数类型要求说明
modelstring必填固定填写 minimax-m3。
messagesarray必填按顺序传入对话消息;至少包含一条用户消息。
streamboolean可选设为 true 时使用 SSE 流式返回。
QUICKSTART

MiniMax M3 API 调用示例

使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。

Base URLhttps://api.rokoapi.com/v1
curl https://api.rokoapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-m3",
    "messages": [
      {"role": "user", "content": "分析这个代码库的架构、依赖和测试覆盖,找出三个最高风险问题,并给出可以分步验证的修复方案"}
    ],
    "stream": true
  }'
PRODUCTION

计费与上线建议

  1. 1

    本页展示 Roko API 当前 minimax-m3 复杂表达式价格,不使用 MiniMax 官网或供应商价格替代实际扣费。

  2. 2

    上下文长度不超过 524,288 Token:输入 $0.5435、输出 $2.1741、缓存读取 $0.1084、缓存写入与 1 小时缓存写入均为 $0.6794 / 1M Token。

  3. 3

    上下文长度超过 524,288 Token:输入 $1.3588、输出 $5.4353、缓存读取 $0.2718、缓存写入与 1 小时缓存写入均为 $1.6985 / 1M Token。

  4. 4

    长上下文任务应同时记录请求总长度、缓存命中率、输出量和每个合格结果成本,避免只比较起始单价。

FAQ

MiniMax M3 API 常见问题

MiniMax M3 API 使用哪个模型 ID?

使用 minimax-m3。模型 ID 区分字符,请直接复制本页显示的值。

MiniMax M3 API 怎么计费?

Roko API 当前按 Token 计费:输入 $0.5435–$1.3588 / 1M tokens,输出 $2.1741–$5.4353 / 1M tokens,缓存读取 $0.1084–$0.2718 / 1M tokens,缓存写入 $0.6794–$1.6985 / 1M tokens,1 小时缓存写入 $0.6794–$1.6985 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。

MiniMax M3 API 使用哪个接口?

当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。

MiniMax M3 的官方上下文窗口是多少?

MiniMax 官方公布最高 1M Token 上下文。Roko API 当前目录未单列上下文窗口字段,但计费表达式会在 524,288 Token 后切换到长上下文档。

MiniMax M3 为什么显示价格区间?

因为当前 Roko API 按请求上下文长度采用两档价格:不超过 524,288 Token 使用标准档,超过后使用长上下文档。价格卡片展示两档费率范围,具体边界以本页计费说明为准。

MiniMax M3 支持多模态和思考控制吗?

MiniMax 官方说明支持图像、视频输入,并可开关思考。Roko API 当前目录未把这些能力配置为公开字段,实际可用性以当前接口文档和响应为准。

MiniMax M3 的缓存如何计费?

当前 Roko API 分别计算缓存读取、缓存写入和 1 小时缓存写入,并同样按 524,288 Token 边界切换费率。

RELATED

比较同系列或其他文本模型的价格与当前接入能力。

浏览全部文本模型 →