文档
模型与价格
更新于 2026-09-09
定价页
模型定价 展示构建时快照,并在浏览器端尝试刷新实时价格。
模型、定价和开发文档统一来自后台模型目录。仅有目录元数据、尚未开放调用或尚未定价的模型也会展示,并明确标注“暂不可用”或“暂未定价”。
新模型如何发布
管理员在控制台保存模型资料与价格后,后端会校验模型 ID、能力、端点和计费规则,并从可执行规则自动生成 pricing_display。公开目录会立即返回新版本;配置了 Cloudflare Pages Deploy Hook 时,连续修改会合并,在目录稳定约 60 秒后触发一次静态站重建。因此普通新模型会自动获得通用模型页、价格条目和开发文档页,无需单独修改页面代码。
目录中的 publication.ready 表示模型是否已具备启用状态、渠道路由、端点、支持模式和完整价格;publication.issues 会列出缺失项。公开目录用于展示与同步,当前 API Key 的实际可调用范围仍以 GET /v1/models 为准。
模型落地页
每个模型有独立 URL,例如 /models/deepseek-v4-flash/,包含:
- 档位对比与输入 / 输出价格
- 供应商与能力标签
- 可复制的调用示例
模型开发文档
侧栏「模型文档」为后台目录中的每个模型提供开发指南(模型 ID、参数、示例、可用状态与定价),例如 /docs/models/deepseek-v4-flash/。
新增生成模型
当前模型目录按调用方式分为:
- 文本聊天:
claude-sonnet-5、deepseek-v4-flash、deepseek-v4-pro、gemini-3.5-flash、gemini-3.6-flash、gemini-3.7-flash、glm-5.2、gpt-5.5、gpt-5.6-sol、gpt-5.6-terra、grok-4.5、grok-4.6、minimax-m3 - 图像生成:
gpt-image-2、grok-imagine-image-2.0、midjourney、nano-banana-2、nano-banana-pro - 视频生成:
veo-3.1、seedance-2.0、seedance-2.0-pro、seedance-2.0-fast、seedance-2.0-mini、seedance-2.5、hailuo-3、grok-imagine-video-1.5、gemini-omni、kling-3.0-turbo、kling-o3、happy-horse-1.1、wan-2.7、sora-2、sora-2-pro - 音乐生成:
suno-v6 - 暂未开放:
nano-banana(仅保留目录说明,不作为当前可用模型)
文本模型使用 OpenAI 兼容的 POST /v1/chat/completions,默认支持流式返回。音乐、图像、视频任务分别提交到 POST /v1/audios/tasks、POST /v1/images/tasks、POST /v1/videos/tasks,再通过 GET /v1/tasks/{task_id} 查询结果。完整请求参数分别见音频生成任务、图像生成任务与视频生成任务;实际可用模型以控制台渠道配置和 /v1/models 返回为准。
当前目录中的 suno-v6 以 Suno v6 展示,并按后台固定价格计费;gpt-image-2 按 Token 计费,文本输入、图像输入和图像输出分别使用独立倍率。管理员在控制台修改后的价格优先于代码默认值。
grok-imagine-image-2.0 支持文生图与 1–3 张参考图编辑,输出 1K / 2K、Low / Medium,单次可生成 1–10 张。模型按分辨率、质量和输出张数计费,输入图片按每张每次请求单独计费;完整字段见图像生成任务。
2026-08-21 固定价格快照
本批 EvoLink 模型按供应商当日美元成本价加 10% 固定为 RokoAPI 售价,不依赖请求发生时的实时 credits。文本模型按实际输入、输出和缓存 Token 结算;MiniMax M3 与 Grok 4.5/4.6 还会按上下文长度选择对应价格档位。
grok-imagine-video-1.5 是例外:当前接入 TTAPI 非官转的 grok-imagine-video-1.5-fast,按任务时长分档计费。6~10 秒、12~20 秒、21~30 秒的含服务费售价分别为 $0.099、$0.22、$0.33;7 秒和 11 秒不受上游支持。
Veo 3.1 按生成视频的输出数量、秒数、分辨率和音频开关组合计费:
| 输出规格 | 不生成音频 | 生成音频 |
|---|---|---|
| 720p / 1080p | $0.1034 /秒 | $0.1540 /秒 |
| 4K | $0.3080 /秒 | $0.3608 /秒 |
Veo 3.1 支持 4、6、8 秒输出,n 支持 1–4;请求未传 generate_audio 时,上游预览模型默认生成音频,计费也按“生成音频”档执行。其他文本与生成模型的当前固定表达式及价格档位以模型定价为准。
模型 ID、系列与别名
- 调用请求使用模型 ID,例如
suno-v6。 - 页面按系列聚合,例如 DeepSeek V4 的 Flash 与 Pro 共用一个系列页。
- Midjourney 的公开调用 ID 统一为
midjourney;旧的Midjourney v7、Midjourney v8.1、mj-v7与mj-v8.1已停止开放。 midjourney提供 Fast、Turbo 两种速度,默认 Fast。常规生成的含服务费售价分别为$0.055、$0.077/次;HD 任务按对应速度价格的 1.5 倍结算,完成后以上游实际 quota 校准。- Suno 模型必须带版本号。
suno-v6的公开名称为 Suno v6,不再用无版本的suno表示当前版本。
组合参数计费
RokoAPI 的统一计费规则可以同时考虑文本 Token、图片数量、分辨率、画质、视频输出时长、参考素材时长、生成方式和内置工具调用次数。因此,同一个模型在 1K / 2K / 4K、480p / 720p / 1080p、文生 / 图生 / 参考生等组合下可以产生不同费用,而不需要为每一种能力重复创建模型。
异步生成任务会在提交时按固定价格表和请求参数预扣预计费用,并在任务完成后按实际 Token 或输出时长结算差额。EvoLink 视频模型采用后台保存的价格快照,不跟随供应商积分实时变化;价格表更新时由管理员审核后统一发布。任务失败则按任务退款规则处理。请求前请以模型定价展示的当前规则为准。
如何读取组合价格
消费者不需要理解或执行后台的高级表达式。公开模型目录 GET /api/catalog/models 会为可结构化展示的表达式返回 pricing_display:
{
"billing_mode": "tiered_expr",
"pricing_display": {
"currency": "USD",
"basis": "duration",
"unit": "second",
"summary": "按生成时长和所选参数计费",
"formula": "总价 = 输出时长(秒) × 对应档位单价",
"dimensions": [
{ "key": "resolution", "label": "分辨率", "values": ["720p", "1080p"] },
{ "key": "quality", "label": "画质", "values": ["standard", "hd"] }
],
"rates": [
{
"when": { "resolution": "720p", "quality": "standard" },
"price_usd": 0.08,
"unit": "second"
}
],
"modifiers": [],
"notes": [],
"expr_hash": "..."
}
}
summary与formula可以直接展示给用户。dimensions用来生成分辨率、画质、速度、生成方式和音频等筛选项。rates是对应参数组合的美元单价;视频通常是每秒,图片通常是每个输出。- 当
basis为tokens时,token_rates给出输入、输出、缓存读写等每百万 Token 的美元参考单价;实际费用仍按请求用量结算。 modifiers是输入图片或参考媒体等附加费用。notes说明预扣与最终结算之间可能存在的差额。expr_hash标识生成该价格表的表达式版本,可用于客户端缓存失效。
Token 模型示例:
{
"basis": "tokens",
"unit": "usage",
"token_rates": [
{ "key": "input", "label": "输入 Token", "price_usd_per_million": 1.021429 },
{ "key": "output", "label": "输出 Token", "price_usd_per_million": 4.242857 },
{ "key": "cache_read", "label": "缓存读取", "price_usd_per_million": 0.204286 }
]
}
billing_expr 仍是后端扣费的唯一事实来源,只适合管理员审计。Star-Task 等消费端应渲染 pricing_display,不得在浏览器中执行 billing_expr。如果媒体模型的 rates 为空,或 Token 模型的 token_rates 为空,应显示“按实际用量计费,请以结算记录为准”,而不是自行猜测价格。
调用端用于计价的请求值必须与模型能力元数据保持一致:resolution 对应分辨率,quality 对应画质,speed 对应速度,generation_type 对应文生、图生、参考生或编辑方式,seconds / duration 对应输出时长,n 对应输出数量,generate_audio / audio_enabled 对应是否生成音频。具体可选值以同一模型的 generation_config 和开发页为准。
Star-Task 应分别读取公开目录与当前令牌可调用模型,再按精确模型 ID 合并;公开目录中的禁用模型可以展示,但不能据此判断当前令牌可调用:
const catalog = await fetch("https://rokoapi.com/api/catalog/models").then((response) =>
response.json(),
);
const callable = await fetch("https://api.rokoapi.com/v1/models", {
headers: { Authorization: `Bearer ${serverSideToken}` },
}).then((response) => response.json());
const callableIds = new Set(callable.data.map((model: { id: string }) => model.id));
const cards = catalog.data.map((model: { model_name: string; pricing_display?: unknown }) => ({
...model,
callable: callableIds.has(model.model_name),
}));
令牌只能保存在 Star-Task 服务端。页面根据用户选择的参数匹配 rates[].when,用 price_usd × seconds × n(或 formula 指定的规则)显示预估总价;提交和最终扣费仍以后端为准。
注意
- 禁用 JavaScript 时仍可阅读快照内容
- 实时刷新失败不会清空页面,只会保留快照并提示
- 价格变更后可通过 Deploy Hook 触发 Pages 重新构建