gpt-5 API 国内调用与价格(2026)
参考价按当前渠道倍率折算、含服务费,实际以定价页实时显示为准;不同档位的渠道来源与稳定性不同,高稳定需求建议选官转档位(逆向与官转的区别)。数据更新于 2026-08-25。
在 gpt-5 之前,OpenAI 一直是两条腿走路:4o 管对话,o 系管推理,什么任务交给谁,得开发者自己判断。2025年8月发布的 gpt-5 把两条线合并了——同一个模型,简单问题直接答,难题通过 reasoning_effort 参数开思考,API 同步提供 gpt-5 / gpt-5-mini / gpt-5-nano 三档,按预算自由降级。
作为这一代的标准旗舰,它在代码生成、多步工具调用、数学与逻辑推理上全面超过 4 系,也是后续 gpt-5.1、gpt-5.2 等迭代版本的基座。想知道"当前 OpenAI 的标准水位"在哪里,从 gpt-5 开始测就对了。
本站以第三方 API 中转/聚合服务的形式同时提供 openai(chat completions)与 openai-response(responses)两种端点,渠道档位丰富;多档渠道可选,详见下方价格表。
| 上下文窗口 | 400K tokens |
|---|---|
| 知识截止 | 2024-09 |
价格详情
| 价目 | 输入 /1M tokens | 输出 /1M tokens | 相当于官方 |
|---|---|---|---|
| 官方基准价 | $1.25 | $10.00 | — |
| 本站最低参考价 | $0.0529 | $0.423 | 约 0.4 折 |
该模型支持提示词缓存,缓存命中部分按输入价约 10% 计费,长系统提示词场景可显著降本。
同系列模型价格对比
| 模型 | 本站最低参考(输入) | 相当于官方 |
|---|---|---|
| gpt-4o | $0.296/1M | 约 1.2 折 |
| gpt-4o-mini | $0.0178/1M | 约 1.2 折 |
| gpt-4.1 | $0.237/1M | 约 1.2 折 |
| gpt-4.1-mini | $0.0474/1M | 约 1.2 折 |
| gpt-5-mini | $0.0106/1M | 约 0.4 折 |
| gpt-5-nano | $0.0025/1M | 约 0.5 折 |
| gpt-5.1 | $0.0529/1M | 约 0.4 折 |
| gpt-5.2 | $0.074/1M | 约 0.4 折 |
适用场景
- 复杂推理:数学、算法题、多步逻辑链,reasoning_effort 调到 medium/high 后可与专职推理模型掰手腕;
- Agent 与多步工具调用:自主决定调用时机,串联搜索-计算-写文件的长链路任务,是编码 agent 的可靠底座;
- 生产级代码生成:从需求描述直出可运行代码,调试时能读懂完整报错栈并给出针对性修改;
- 一套 prompt 三档路由:同一提示词在 5 / mini / nano 之间按难度分层调度,显著压低总成本。
接入代码(OpenAI 兼容)
任何 OpenAI SDK 只改 base_url 一行即可切换到中转接口,模型名填 gpt-5:
from openai import OpenAI
client = OpenAI(
api_key="sk-你的令牌",
base_url="https://v2.cloudmist.cloud/v1"
)
resp = client.chat.completions.create(
model="gpt-5",
messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)curl、Node.js 及更多客户端写法见 base_url 配置详解。
选型与接入建议
与 gpt-5.1:5.1 是迭代版,加入自适应推理(简单问题少想、难题多想),对话风格更自然,新接入可以直接上 5.1;选 gpt-5 的理由是它发布最早、行为被摸得最透、第三方评测与教程覆盖最全。与 gpt-4.1:不需要思考的纯执行类任务留在 4.1 更快更省;与 gpt-4o:一般只在维护老项目时保留。预算敏感就往 gpt-5-mini / gpt-5-nano 降档,同一套代码只换 model 名。
接入注意:对延迟敏感的接口把 reasoning_effort 设为 minimal,避免默认思考拖慢首 token;新集成建议直接用 responses 端点。OpenAI 兼容 SDK 的 base_url 填 https://v2.cloudmist.cloud/v1;Cursor、NextChat、沉浸式翻译等客户端均可接入。
常见问题
国内如何调用 gpt-5?
在本站注册并创建 API Key,OpenAI 兼容 SDK 把 base_url 改为 https://v2.cloudmist.cloud/v1(Claude Code 填 https://v2.cloudmist.cloud,不带 /v1),模型名填 gpt-5 即可,国内网络直连,支持支付宝/微信人民币充值。
gpt-5 通过中转站调用什么价格?
本站参考价输入 $0.0529/1M tokens、输出 $0.423/1M tokens 起(约 0.4 折),提供 15 个渠道档位,价格与稳定性各有侧重,实际以站内定价页实时显示为准。
gpt-5 的思考深度怎么控制?
用 reasoning_effort 参数,可选 minimal / low / medium / high:档位越高思考越深,延迟和 token 消耗也越大。日常对话用 minimal 或 low,数学、复杂调试再上 high。两个端点都支持这个参数。
该走 chat completions 还是 responses 端点?
新集成建议 responses(/v1/responses):推理状态传递更完整,新的内置工具生态也在这条线上演进。存量代码走 chat completions 一样能用,本站两个端点都已开通,可以先跑通再逐步迁移。
gpt-5 和 gpt-5.1 差距大吗,要不要换?
基准能力同级,5.1 主要赢在自适应推理和更自然的对话观感。已经稳定跑在 gpt-5 上的业务不必急着换;新项目或对话类产品可以直接从 5.1 起步,两者成本档位相近。
从 gpt-4o 迁移到 gpt-5 有哪些坑?
把 model 名换成 gpt-5 基本就能跑,但注意两点:一是 chat completions 里 max_tokens 要改成 max_completion_tokens;二是它默认会消耗思考 token,延迟和账单结构会变,对话类接口记得把 reasoning_effort 压到 minimal。