🎉 新版站点已上线 — 新用户请在 v2.cloudmist.cloud 注册使用,本站教程均以新站地址为准 · 老用户账号已迁移完成,用原用户名/邮箱 + 原密码可直接登录 新站(登不上请在用户名后加 _82350),原站余额可继续在 api.cloudmist.cloud 用完,新站需重建令牌并改用新站 base_url
首页 › 模型库 › o4-mini

o4-mini API 国内调用与价格(2026)

云雾API 运营团队 · 数据来自站内实时价目 · 更新于 2026-08-25
模型类型对话 · 识图
计费方式按量(tokens)
官方基准(输入)$1.10/1M
本站最低参考(输入)$0.0558/1M
相当于官方约 0.5 折
可选渠道档位11 档
站内累计调用2 万 次

参考价按当前渠道倍率折算、含服务费,实际以定价页实时显示为准;不同档位的渠道来源与稳定性不同,高稳定需求建议选官转档位(逆向与官转的区别)。数据更新于 2026-08-25。

想要推理链的准确率,又扛不住旗舰推理模型的成本——o4-mini 解决的就是这个取舍。它是 OpenAI 2025年4月推出的轻量推理模型,回答前先在内部展开多步思考再输出结论,数学、代码、逻辑类任务的正确率明显高于同价位的对话模型。

它还支持视觉输入,能对截图、图表、几何图形先读图再推理,这在轻量推理档里不多见。云雾API 开放 openai 与 openai-response 双端点、11 个渠道档位,多档渠道可选,详见下方价格表。

上下文窗口200,000 tokens
知识截止2024年6月

价格详情

价目输入 /1M tokens输出 /1M tokens相当于官方
官方基准价$1.10$4.40—
本站最低参考价$0.0558$0.223约 0.5 折

该模型支持提示词缓存,缓存命中部分按输入价约 25% 计费,长系统提示词场景可显著降本。

同系列模型价格对比

模型本站最低参考(输入)相当于官方
gpt-4o$0.296/1M约 1.2 折
gpt-4o-mini$0.0178/1M约 1.2 折
gpt-4.1$0.237/1M约 1.2 折
gpt-4.1-mini$0.0474/1M约 1.2 折
gpt-5$0.0529/1M约 0.4 折
gpt-5-mini$0.0106/1M约 0.4 折
gpt-5-nano$0.0025/1M约 0.5 折
gpt-5.1$0.0529/1M约 0.4 折

适用场景

接入代码(OpenAI 兼容)

任何 OpenAI SDK 只改 base_url 一行即可切换到中转接口,模型名填 o4-mini:

from openai import OpenAI

client = OpenAI(
    api_key="sk-你的令牌",
    base_url="https://v2.cloudmist.cloud/v1"
)
resp = client.chat.completions.create(
    model="o4-mini",
    messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)

curl、Node.js 及更多客户端写法见 base_url 配置详解。

选型与接入建议

同门对比:gpt-4o-mini 更便宜但没有推理链,简单任务用它就够;gpt-5-mini 是更新一代,原生把对话和思考合在一个模型里,新项目建议直接从 gpt-5-mini 起步。o4-mini 更适合两类用户:需要输出行为可复现的存量项目,以及做模型对比实验的研究者。

接入注意:OpenAI 兼容 SDK 的 base_url 填 https://v2.cloudmist.cloud/v1,模型名写 o4-mini。推理模型的思考过程会消耗输出 token,max_completion_tokens 要比预期答案长度多留一段余量,否则可能只烧了思考没出答案。

常见问题

国内如何调用 o4-mini?

在本站注册并创建 API Key,OpenAI 兼容 SDK 把 base_url 改为 https://v2.cloudmist.cloud/v1(Claude Code 填 https://v2.cloudmist.cloud,不带 /v1),模型名填 o4-mini 即可,国内网络直连,支持支付宝/微信人民币充值。

o4-mini 通过中转站调用什么价格?

本站参考价输入 $0.0558/1M tokens、输出 $0.223/1M tokens 起(约 0.5 折),提供 11 个渠道档位,价格与稳定性各有侧重,实际以站内定价页实时显示为准。

o4-mini 和 gpt-4o-mini 是什么关系?名字太像了

没有关系,是两条产品线。gpt-4o-mini 是对话模型的轻量档,响应快、按提示词直接作答;o4-mini 是推理模型 o 系列的轻量档,回答前先内部思考。遇到多步逻辑题,o4-mini 的正确率通常高不少;闲聊和简单改写则用 gpt-4o-mini 更划算。

思考过程产生的 token 也计费吗?

计。推理模型的内部思考(reasoning tokens)按输出 token 计费,虽然思考内容不会返回给你。同样一个问题,o4-mini 的实际输出消耗会比对话模型高,预算时要把这部分算进去,也因此不建议拿它跑大批量简单任务。

2026年了还有必要选 o4-mini 吗?

看情况。GPT-5 系列已经把推理并进主线,新项目一般直接用 gpt-5-mini。但 o4-mini 的行为和输出风格是固定的,适合需要结果可复现的存量项目、论文实验对照组,以及针对 o 系列调优过提示词的老工作流。

它读图的效果怎么样?

支持视觉输入,而且和普通识图模型的区别在于它会把图里的信息纳入推理链:读一张函数图像后做求值、看流程图后判断逻辑漏洞,而不是只描述画面。工程图、报表截图类的判断任务可以一试。

注册即送免费测试额度

一个 API Key 调用 Claude、GPT、Gemini、DeepSeek 等 200+ 大模型,国内直连、人民币充值。

立即注册,领测试额度 →
相关内容
本站为云雾API 注册、登录与充值入口站点 · 模型与价格以控制台实时数据为准 · 更新于 2026-08-25
Claude、GPT、Gemini 等名称为各自权利人商标,本站为独立第三方 API 中转/聚合服务,与上述厂商无隶属或授权关系。