gpt-5.4-mini API 国内调用与价格(2026)
参考价按当前渠道倍率折算、含服务费,实际以定价页实时显示为准;不同档位的渠道来源与稳定性不同,高稳定需求建议选官转档位(逆向与官转的区别)。数据更新于 2026-08-25。
在云雾API 站内,gpt-5.4-mini 的调用量超过 830 万次,是 GPT-5 系列里被调用最多的型号之一。按 OpenAI 的命名规律,mini 是 gpt-5.4 的轻量档,面向量大、对单次质量要求不极端的场景。
值得注意的是它标签齐全:对话、识图、思考、工具四项都在,多模态输入和 function calling 没有被砍掉。站内提供 16 个渠道档位,Chat Completions 与 Responses 两种接口均可调用。
价格详情
| 价目 | 输入 /1M tokens | 输出 /1M tokens | 相当于官方 |
|---|---|---|---|
| 官方基准价 | $0.75 | $4.50 | — |
| 本站最低参考价 | $0.0317 | $0.190 | 约 0.4 折 |
该模型支持提示词缓存,缓存命中部分按输入价约 10% 计费,长系统提示词场景可显著降本。
同系列模型价格对比
| 模型 | 本站最低参考(输入) | 相当于官方 |
|---|---|---|
| gpt-4o | $0.296/1M | 约 1.2 折 |
| gpt-4o-mini | $0.0178/1M | 约 1.2 折 |
| gpt-4.1 | $0.237/1M | 约 1.2 折 |
| gpt-4.1-mini | $0.0474/1M | 约 1.2 折 |
| gpt-5 | $0.0529/1M | 约 0.4 折 |
| gpt-5-mini | $0.0106/1M | 约 0.4 折 |
| gpt-5-nano | $0.0025/1M | 约 0.5 折 |
| gpt-5.1 | $0.0529/1M | 约 0.4 折 |
适用场景
- 线上客服与工单机器人:多轮对话加工具调用查库,量大且延迟敏感
- 票据、截图类图片信息抽取:识图能力够用,成本压得住
- Agent 工作流的执行节点:规划用旗舰档,批量小步骤交给 mini
- 分类、打标、JSON 结构化输出这类跑批任务
接入代码(OpenAI 兼容)
任何 OpenAI SDK 只改 base_url 一行即可切换到中转接口,模型名填 gpt-5.4-mini:
from openai import OpenAI
client = OpenAI(
api_key="sk-你的令牌",
base_url="https://v2.cloudmist.cloud/v1"
)
resp = client.chat.completions.create(
model="gpt-5.4-mini",
messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)curl、Node.js 及更多客户端写法见 base_url 配置详解。
选型与接入建议
同为轻量档,gpt-5.4-mini 与 gpt-5-mini 接口完全兼容,改模型名即可平移;5.4-mini 代际更新,新项目建议直接从它起步。要更强的综合能力,往上是 gpt-5.4 和带思考的 gpt-5.6-sol;要把成本压到极限,下面还有 gpt-5-nano,但能力边界要自己实测把关。
接入用 OpenAI 兼容 SDK,base_url 填 https://v2.cloudmist.cloud/v1;Cursor、NextChat、沉浸式翻译等客户端均可接入。多档渠道可选,详见下方价格表。
常见问题
国内如何调用 gpt-5.4-mini?
在本站注册并创建 API Key,OpenAI 兼容 SDK 把 base_url 改为 https://v2.cloudmist.cloud/v1(Claude Code 填 https://v2.cloudmist.cloud,不带 /v1),模型名填 gpt-5.4-mini 即可,国内网络直连,支持支付宝/微信人民币充值。
gpt-5.4-mini 通过中转站调用什么价格?
本站参考价输入 $0.0317/1M tokens、输出 $0.190/1M tokens 起(约 0.4 折),提供 16 个渠道档位,价格与稳定性各有侧重,实际以站内定价页实时显示为准。
gpt-5.4-mini 相比 gpt-5-mini 值得换吗?
两者接口兼容,迁移只需改模型名。5.4-mini 代际更新,站内调用量也明显更高,新项目建议直接选它;老项目若 gpt-5-mini 跑得稳、成本可控,可以先切一小部分流量做 A/B,对比效果后再整体迁移。
它的思考能力怎么用起来?
站内标签带"思考"。走 Responses 接口时可通过推理相关参数控制思考深度,简单任务调低省 token,复杂任务调高换质量,具体参数以实际接口返回为准。走 Chat Completions 时按默认行为即可覆盖多数场景。
放在沉浸式翻译或 Cursor 里表现如何?
沉浸式翻译这类高频小请求场景正是 mini 档的主场,延迟和成本优势明显。Cursor 里适合设为快速问答与轻量补全模型,复杂重构再切旗舰档。两者接入都只需把 base_url 指到 https://v2.cloudmist.cloud/v1。