首页/文档中心/模型列表

模型列表

本站提供 GPT 系列文本模型与图像生成模型,统一由一套 API Key 调用。

模型清单会随上游能力更新而调整。GET /v1/models 的实时返回为准, 也可在控制台「令牌」页面查看当前分组可用模型。

文本模型

模型名定位输入 / 百万 token输出 / 百万 token
gpt-5.6-sol旗舰推理,复杂任务首选,支持提示词缓存折扣¥18.25¥109.50
gpt-5.6-terra能力与成本均衡,适合常规生产负载¥9.13¥54.75
gpt-5.6-luna轻量高速,适合分类、抽取、摘要等高并发场景¥3.65¥21.90
gpt-5.65.6 代通用版本¥18.25¥109.50
gpt-6第六代通用旗舰,支持提示词缓存折扣¥18.25¥109.50
gpt-5.5上一代旗舰,稳定可用¥18.25¥109.50
codex-auto-review代码审查专用,低延迟、低成本¥3.65¥21.90

图像生成模型

模型名定位输入 / 百万 token输出 / 百万 token
gpt-image-1通用图像生成,质量与速度平衡¥18.25¥146.00
gpt-image-1.5细节与文字渲染增强¥18.25¥146.00

即将上线的模型

以下模型已接入上游,但计费参数仍在配置中,暂不建议在生产环境依赖

思考档位

部分模型支持通过模型名后缀指定推理强度。后缀形如 -low / -medium / -high, 推理强度越高,输出质量越好、token 消耗也越多。

档位适用场景
-low简单问答、格式转换,追求速度与低成本
-medium日常开发、内容生成,默认推荐
-high复杂推理、代码重构、多步分析
并非所有模型都支持全部档位。若请求返回 404 或 400,说明该模型不支持所请求的档位,请换用无后缀的模型名。

如何查询实时模型列表

curl https://aitokone.com/v1/models \
  -H "Authorization: Bearer sk-你的密钥"

返回结果可直接用于客户端的「拉取模型」功能,见 客户端接入

计费方式

按 token 用量实时扣费,公式如下:

扣费额度 = (输入 tokens + 缓存 tokens × 缓存倍率 + 输出 tokens × 输出倍率)
           × 模型倍率 × 分组倍率

上表中的「每百万 token」价格由该公式折算得出,完整换算说明见 定价与计费

← 上一篇:API 参考 下一篇:定价与计费 →