Models

AI 模型库

一站式探索 Roko API 已上线模型。统一路由连接不同供应商,以公开价格选择适合任务与预算的模型。

58 个模型系列 · 58 个模型目录 ID · 快照

显示 58 个结果

查看价目表 →
文本 Claude · 可用

Claude Sonnet 5

Anthropic Claude Sonnet 5 长上下文智能体与编程模型,支持流式响应和工具调用。

输入起价 $1.8000 / 1M tokens 输出 $9.0000 / 1M tokens
文本 DeepSeek · 可用

DeepSeek V4 Flash

DeepSeek V4 Flash 高速长上下文文本模型,适合聊天、推理与高并发任务。

输入起价 $0.6000 / 1M tokens 输出 $1.4000 / 1M tokens
文本 DeepSeek · 可用

DeepSeek V4 Flash Vision exp

DeepSeek多模态模型

输入起价 $0.6000 / 1M tokens 输出 $1.4000 / 1M tokens
文本 DeepSeek · 可用

DeepSeek V4 Pro

DeepSeek V4 Pro 长上下文推理模型,适合复杂分析、编程和智能体工作流。

输入起价 $1.2850 / 1M tokens 输出 $3.8570 / 1M tokens
图像 ByteDance · 可用

Doubao Seedream 4.5

火山引擎方舟 Doubao Seedream 4.5 官方图像生成模型,支持文生图、多图参考、图像编辑、组图和 4K 输出。

输入起价 $0.0393 / 次 输出 $0.0393 / 次
图像 ByteDance · 可用

Doubao Seedream 5.0 Lite

火山引擎方舟 Doubao Seedream 5.0 Lite 官方高性价比图像生成模型,支持文生图、参考图、组图生成、流式输出和联网工具。

输入起价 $0.0345 / 次 输出 $0.0345 / 次
图像 ByteDance · 可用

Doubao Seedream 5.0 Pro

火山引擎方舟 Doubao Seedream 5.0 Pro 官方高质量图像生成模型,支持文生图、参考图生成与图像编辑。

输入起价 $0.0450 / 次 输出 $0.0450 / 次
视频 Google · 可用

Gemini Omni

Gemini Omni 多模态视频模型,支持文生、图生、参考生成和视频编辑。

输入起价 按实际 Token 用量计费 输出 总价 = 各类 Token 用量 × 对应单价
文本 Z.ai · 可用

GLM 5.2

智谱 GLM-5.2 长上下文推理与编程模型,支持流式响应和工具调用。

输入起价 $1.0000 / 1M tokens 输出 $3.5000 / 1M tokens
文本 Z.ai · 可用

GLM-5.3

GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,以极致低成本架构实现超越 GLM-5.2 的更强智能

输入起价 $1.1420 / 1M tokens 输出 $4.0000 / 1M tokens
文本 Z.ai · 可用

GLM-5.3-Flash

GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,以极致低成本架构实现超越 GLM-5.2 的更强智能

输入起价 $0.1140 / 1M tokens 输出 $0.4000 / 1M tokens
音频 Google · 可用

Google FlowMusic Lyria 3 Pro

FlowMusic Lyria 3 Pro 音乐生成模型,支持根据提示词、歌词和音乐参数创建音频。

输入起价 $0.033000 / 次 输出 总价按请求参数和实际用量计算
音频 Google · 可用

Google FlowMusic Lyria 3.5

FlowMusic Lyria 3.5 音乐生成模型,支持根据提示词、歌词和音乐参数创建音频。

输入起价 $0.033000 / 次 输出 总价按请求参数和实际用量计算
文本 Google · 可用

Google Gemini 3.5 Flash

Google Gemini 3.5 Flash 多模态长上下文聊天模型,支持流式响应和工具调用。

输入起价 $1.2000 / 1M tokens 输出 $8.0000 / 1M tokens
文本 Google · 可用

Google Gemini 3.6 Flash

Google Gemini 3.6 Flash 长上下文多模态聊天模型,支持流式响应、推理与工具调用。

输入起价 $0.6750 / 1M tokens 输出 $3.3750 / 1M tokens
文本 Google · 预览

Google Gemini 3.7 Flash

Google Gemini 3.7 Flash 高速文本聊天模型,支持流式响应。

输入起价 $0.7250 / 1M tokens 输出 $3.7200 / 1M tokens
视频 Google · 可用

Google Gemini Omni 1.1 Flash

Google Gemini Omni 1.1 Flash 视频生成模型,支持 3~10 秒文生、首尾帧图生、多素材参考、视频编辑和视频延长,输出覆盖 360p、720p、1080p 和 4K。

输入起价 按实际 Token 用量计费 输出 总价 = 各类 Token 用量 × 对应单价
视频 Google · 可用

Google Veo 3.1

Google Veo 3.1 视频生成模型,支持文生视频、首尾帧图生视频、参考图生成、音频生成及 720p、1080p、4K 输出。

输入起价 查看价目表 输出 总价 = 输出时长(秒) × 输出数量 × 对应档位单价
文本 OpenAI · 可用

GPT 5.5

ChatGPT 5.5 文本聊天、推理与编程模型,通过 GRS AI 提供 OpenAI 兼容调用并支持流式响应。

输入起价 $4.5000 / 1M tokens 输出 $27.0000 / 1M tokens
文本 OpenAI · 可用

GPT 5.6 Sol

ChatGPT 5.6 Sol 高性能推理与编程模型,通过 GRS AI 提供 OpenAI 兼容调用并支持流式响应。

输入起价 $4.5000 / 1M tokens 输出 $5.6250 / 1M tokens
文本 OpenAI · 可用

GPT 5.6 Terra

ChatGPT 5.6 Terra 均衡型推理与编程模型,通过 GRS AI 提供 OpenAI 兼容调用并支持流式响应。

输入起价 $1.8000 / 1M tokens 输出 $2.2500 / 1M tokens
图像 OpenAI · 可用

GPT Image 2

GPT Image 2 图像生成模型,支持文生图、图生图与多图参考编辑。

输入起价 $0.0250 / 次 输出 $0.0250 / 次
图像 xAI · 可用

Grok Imagine Image 2.0

xAI Grok Imagine Image 2.0 图像生成与编辑模型,支持文生图、1-3 张参考图编辑、13 种预设比例、1K/2K 输出和单次生成 1-10 张图片。

输入起价 查看价目表 输出 总价 = 生成数量 × 对应档位单价
视频 xAI · 可用

Grok Imagine Video 1.5

Grok 1.5 Fast 视频模型(TTAPI 非官转),支持 6 秒、8~10 秒、12~30 秒文生、图生和最多 7 张图片参考生成,输出 480p 或 720p。

输入起价 查看价目表 输出 总价 = 所选时长档位对应的固定价格
视频 MiniMax · 可用

Hailuo H3

Hailuo 3 视频生成模型,支持 4~15 秒文生、首尾帧图生和图片、视频、音频参考生成,输出 768p 或 2K。

输入起价 查看价目表 输出 总价由输出时长、参考媒体时长和所选档位共同计算
视频 HappyHorse · 可用

Happy Horse 1.0

Happy Horse 1.0 视频生成与编辑模型,支持 3~15 秒文生视频、图生视频、1~9 张图片参考生成,以及最长 15 秒的视频编辑。

输入起价 查看价目表 输出 总价由输出时长、参考媒体时长和所选档位共同计算
视频 HappyHorse · 可用

Happy Horse 1.1

Happy Horse 1.1 视频生成模型,支持 3~15 秒文生视频、图生视频和 1~9 张图片参考生成。

输入起价 查看价目表 输出 总价 = 输出时长(秒) × 对应档位单价
文本 Moonshot · 可用

Kimi K2.7 Code

Moonshot AI Kimi K2.7 Code 多模态编程与 Agent 模型,支持 256K tokens 上下文、长程代码任务、图片与视频理解、深度思考和多步工具调用。

输入起价 $1.0200 / 1M tokens 输出 $4.2400 / 1M tokens
文本 Moonshot · 可用

Kimi K2.7 Code HighSpeed

Moonshot AI Kimi K2.7 Code 高速版,与标准版能力和 256K tokens 上下文一致,常规编程场景约 180 tokens/s,短上下文可达约 260 tokens/s。

输入起价 $2.0400 / 1M tokens 输出 $8.4800 / 1M tokens
文本 Moonshot · 可用

Kimi K3

Moonshot AI Kimi K3 旗舰多模态推理模型,拥有 1M tokens 上下文,面向长程编程、端到端知识工作、视觉理解、深度推理和 Agent 工作流。

输入起价 $3.1400 / 1M tokens 输出 $15.7000 / 1M tokens
视频 Kuaishou · 可用

Kling 3.0 Turbo

Kling 3.0 Turbo 高速视频生成模型,支持 3~15 秒文生和单首帧图生视频、最多 6 个分镜,输出 720p 或 1080p。

输入起价 查看价目表 输出 总价 = 输出时长(秒) × 对应档位单价
视频 Kuaishou · 可用

Kling O3

Kling O3 视频生成与编辑模型,支持 3~15 秒文生、图生、参考生成和视频编辑;文生与图生支持 720p、1080p、4K 及可选音效,参考与编辑按当前计费规范支持 720p、1080p 且关闭音效。

输入起价 查看价目表 输出 总价 = 输出时长(秒) × 对应档位单价
图像 Midjourney · 可用

Midjourney Image

Midjourney 统一图像模型,支持文生图、图片混合、图像描述、Seed 查询、局部重绘以及放大、变体、平移、缩放和重做操作。

输入起价 查看价目表 输出 总价按请求参数和实际用量计算
视频 Midjourney · 可用

Midjourney Video

Midjourney 视频模型,支持根据起始帧、可选结束帧与提示词生成固定 5 秒视频,并可从已完成任务继续延长 5 秒;支持 SD、HD 与每次 1、2、4 个结果。

输入起价 查看价目表 输出 总价 = 生成数量 × 对应档位单价
文本 MiniMax · 可用

MiniMax M3

MiniMax M3 长上下文多模态聊天模型,支持流式响应、深度思考与工具调用。

输入起价 按实际 Token 用量计费 输出 总价 = 各类 Token 用量 × 对应单价
图像 Google · 可用

Nano Banana

Nano Banana 图像生成模型,支持文生图与图生图。

输入起价 $0.0080 / 次 输出 $0.0080 / 次
图像 Google · 可用

Nano Banana 2

Nano Banana 2 图像生成模型,支持文生图、图生图与多种画幅比例。

输入起价 $0.0200 / 次 输出 $0.0200 / 次
图像 Google · 可用

Nano Banana Pro

Nano Banana Pro 高质量图像生成模型,支持文生图、图生图与高分辨率输出。

输入起价 $0.0300 / 次 输出 $0.0300 / 次
视频 OpenAI · 暂不可用

OpenAI Sora 2

Sora 2 视频生成模型,支持文生视频和单图参考生成。

输入起价 $0.093225 / 秒 输出 总价 = 输出时长(秒) × 对应档位单价
视频 OpenAI · 暂不可用

OpenAI Sora 2 Pro

Sora 2 Pro 高质量视频生成模型,支持文生视频和单图参考生成。

输入起价 查看价目表 输出 总价 = 所选时长档位对应的固定价格
视频 ByteDance · 可用

Seedance 2.0

Seedance 2.0 视频生成模型,支持文生、图生和图片、视频、音频参考生成。

输入起价 查看价目表 输出 总价由输出时长、参考媒体时长和所选档位共同计算
视频 ByteDance · 可用

Seedance 2.0 Fast

Seedance 2.0 Fast 高速视频生成模型,支持文生、图生和多媒体参考生成。

输入起价 查看价目表 输出 总价由输出时长、参考媒体时长和所选档位共同计算
视频 ByteDance · 可用

Seedance 2.0 Mini

Seedance 2.0 Mini 轻量视频生成模型,支持文生、图生和多媒体参考生成。

输入起价 查看价目表 输出 总价由输出时长、参考媒体时长和所选档位共同计算
视频 ByteDance · 可用

Seedance 2.0 Pro

Seedance 2.0 Pro 专业视频生成模型,支持文生、图生和多媒体参考生成。

输入起价 查看价目表 输出 总价由输出时长、参考媒体时长和所选档位共同计算
视频 ByteDance · 可用

Seedance 2.5

Seedance 家族的 2.5 视频生成与编辑模型,支持 4~30 秒文生视频、图生视频、多模态参考生成、视频编辑和视频延长。

输入起价 查看价目表 输出 总价由输出时长、参考媒体时长和所选档位共同计算
音频 Suno · 可用

Suno V5.5

Suno 5.5 音乐生成模型,支持根据文字描述生成歌曲,也支持自定义歌词、风格标签和纯音乐。

输入起价 $0.0600 / 次 输出 $0.0600 / 次
文本 Tencent · 预览

Tencent Hy4 preview

腾讯混元 Hy4 preview 是 770B 总参数、49B 激活参数的 MoE 文本模型,面向 Agent、Coding 与生产力场景优化,支持深度思考、Function Calling、结构化输出与上下文缓存。

输入起价 $0.9200 / 1M tokens 输出 $2.7600 / 1M tokens
视频 Vidu · 可用

Vidu Q3

Vidu Q3 官方参考生视频模型,支持主体或 1~7 张参考图生成 3~16 秒视频,支持音画同出。

输入起价 查看价目表 输出 总价 = 输出时长(秒) × 对应档位单价
视频 Vidu · 可用

Vidu Q3 Mix

Vidu Q3 Mix 官方参考生视频模型,支持 1~7 张参考图生成 3~16 秒 720p 或 1080p 视频。

输入起价 查看价目表 输出 总价 = 输出时长(秒) × 对应档位单价
视频 Vidu · 可用

Vidu Q3 Pro

Vidu Q3 Pro 官方高质量视频模型,支持 1~16 秒文生、图生和首尾帧生视频,可选 540p、720p、1080p 并支持音画同出。

输入起价 查看价目表 输出 总价 = 输出时长(秒) × 对应档位单价
视频 Vidu · 可用

Vidu Q3 Pro Fast

Vidu Q3 Pro Fast 官方高速图生视频模型,支持 1~16 秒、720p 或 1080p。

输入起价 查看价目表 输出 总价 = 输出时长(秒) × 对应档位单价
视频 Vidu · 可用

Vidu Q3 Turbo

Vidu Q3 Turbo 官方高速视频模型,支持文生、图生、首尾帧和参考生视频,可选 540p、720p、1080p 并支持音画同出。

输入起价 查看价目表 输出 总价 = 输出时长(秒) × 对应档位单价
视频 Alibaba · 可用

Wan 2.7

Wan 2.7 视频生成与编辑模型,支持 2~15 秒文生和图生、参考图片/视频/音频生成,以及 2~10 秒视频编辑。

输入起价 查看价目表 输出 总价由输出时长、参考媒体时长和所选档位共同计算
视频 Alibaba · 可用

Wan 3.0

Wan 3.0 视频生成模型,支持 2~30 秒或自动时长的文生、首尾帧图生,以及图片、视频、音频、文档和网页参考生成。

输入起价 查看价目表 输出 总价由输出时长、参考媒体时长和所选档位共同计算
文本 xAI · 可用

xAI Grok 4.5

xAI Grok 4.5 推理与多模态聊天模型,支持流式响应、结构化输出和工具调用。

输入起价 按实际 Token 用量计费 输出 总价 = 各类 Token 用量 × 对应单价
文本 xAI · 可用

xAI Grok 4.6

xAI Grok 4.6 推理与多模态聊天模型,支持流式响应、结构化输出和工具调用。

输入起价 按实际 Token 用量计费 输出 总价 = 各类 Token 用量 × 对应单价
文本 Xiaomi · 可用

Xiaomi MiMo V2.5

Xiaomi MiMo V2.5

输入起价 $0.1400 / 1M tokens 输出 $0.2800 / 1M tokens
文本 Xiaomi · 可用

Xiaomi MiMo V2.5 Pro

Xiaomi MiMo V2.5 Pro

输入起价 $0.4350 / 1M tokens 输出 $0.8700 / 1M tokens