MiniMax M3 API 价格
价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。
MiniMax M3
minimax-m3 MiniMax M3 是什么模型?
MiniMax 将 M3 定位为面向编程和 Agent 工作流的旗舰模型,采用稀疏注意力架构,官方公布最高 1M Token 上下文,并支持图像、视频等多模态输入。它适合分析大型代码库、长文档和需要持续维护任务状态的复杂工作流。
MiniMax 官方说明 M3 可开启或关闭思考,并按上下文长度区分标准与长上下文价格。Roko API 当前复杂表达式以 524,288 Token 为边界:不超过该长度使用标准档,超过后使用长上下文档,并分别计算输入、输出、缓存读取、缓存写入和 1 小时缓存写入。
1M 上下文、多模态输入和思考控制属于上游模型能力。Roko API 当前目录只明确配置 OpenAI 兼容 Chat、流式模式、default 与 svip 分组和五类 Token 价格,因此页面不会把上游完整能力自动展示为当前已开放字段。
MiniMax M3 适合哪些场景?
以下场景结合 MiniMax 官方定位与长上下文成本边界整理;实际可用参数以当前 Roko API 接入为准。
代码库级 Agent
适合跨文件代码理解、故障排查、工程修改和需要持续规划、执行与验证的仓库任务。
长文档与知识分析
适合处理大量技术材料、研究文档和长期对话,但应关注 524,288 Token 后的长上下文价格。
多步骤自动化工作流
适合任务拆分、工具结果整理和多轮修正,并用缓存降低重复前缀的成本。
上游多模态研究任务
官方支持图像和视频输入;是否能通过当前 Roko API 使用,应以接入文档和接口验证结果为准。
MiniMax M3 API 常用参数
仅列出当前 Roko API 接入已经明确支持或公开配置的字段。
| 参数 | 类型 | 要求 | 说明 |
|---|---|---|---|
model | string | 必填 | 固定填写 minimax-m3。 |
messages | array | 必填 | 按顺序传入对话消息;至少包含一条用户消息。 |
stream | boolean | 可选 | 设为 true 时使用 SSE 流式返回。 |
MiniMax M3 API 调用示例
使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。
curl https://api.rokoapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
"messages": [
{"role": "user", "content": "分析这个代码库的架构、依赖和测试覆盖,找出三个最高风险问题,并给出可以分步验证的修复方案"}
],
"stream": true
}' 计费与上线建议
- 1
本页展示 Roko API 当前 minimax-m3 复杂表达式价格,不使用 MiniMax 官网或供应商价格替代实际扣费。
- 2
上下文长度不超过 524,288 Token:输入 $0.5435、输出 $2.1741、缓存读取 $0.1084、缓存写入与 1 小时缓存写入均为 $0.6794 / 1M Token。
- 3
上下文长度超过 524,288 Token:输入 $1.3588、输出 $5.4353、缓存读取 $0.2718、缓存写入与 1 小时缓存写入均为 $1.6985 / 1M Token。
- 4
长上下文任务应同时记录请求总长度、缓存命中率、输出量和每个合格结果成本,避免只比较起始单价。
MiniMax M3 API 常见问题
MiniMax M3 API 使用哪个模型 ID?
使用 minimax-m3。模型 ID 区分字符,请直接复制本页显示的值。
MiniMax M3 API 怎么计费?
Roko API 当前按 Token 计费:输入 $0.5435–$1.3588 / 1M tokens,输出 $2.1741–$5.4353 / 1M tokens,缓存读取 $0.1084–$0.2718 / 1M tokens,缓存写入 $0.6794–$1.6985 / 1M tokens,1 小时缓存写入 $0.6794–$1.6985 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。
MiniMax M3 API 使用哪个接口?
当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。
MiniMax M3 的官方上下文窗口是多少?
MiniMax 官方公布最高 1M Token 上下文。Roko API 当前目录未单列上下文窗口字段,但计费表达式会在 524,288 Token 后切换到长上下文档。
MiniMax M3 为什么显示价格区间?
因为当前 Roko API 按请求上下文长度采用两档价格:不超过 524,288 Token 使用标准档,超过后使用长上下文档。价格卡片展示两档费率范围,具体边界以本页计费说明为准。
MiniMax M3 支持多模态和思考控制吗?
MiniMax 官方说明支持图像、视频输入,并可开关思考。Roko API 当前目录未把这些能力配置为公开字段,实际可用性以当前接口文档和响应为准。
MiniMax M3 的缓存如何计费?
当前 Roko API 分别计算缓存读取、缓存写入和 1 小时缓存写入,并同样按 524,288 Token 边界切换费率。
相关文本模型
比较同系列或其他文本模型的价格与当前接入能力。