gemini-3.1-pro-preview API 国内调用与价格(2026)
参考价按当前渠道倍率折算、含服务费,实际以定价页实时显示为准;不同档位的渠道来源与稳定性不同,高稳定需求建议选官转档位(逆向与官转的区别)。数据更新于 2026-08-25。
gemini-3.1-pro-preview 是 Google Gemini 3.1 世代的 Pro 档预览版。按 Gemini 家族一贯的命名规律,Pro 代表旗舰能力档,面向复杂推理和高质量输出;preview 后缀则表明它仍处于预览阶段,接口行为与输出风格可能随上游更新而调整。能力标签覆盖对话、思考、多模态三项——除了常规文本对话,它支持思考模式(先内部推理再作答),也能接受图文混合输入。
别被 preview 三个字吓退。在云雾API 站内,这个模型的累计调用量已经超过两百万次,是 Gemini 3 系 Pro 档里被用得最多的一个,大量开发者已经拿它跑实际生产任务,而不是浅尝辄止。站内为它配置了 12 个渠道档位,多档渠道可选,详见下方价格表。
接入格式上它双端开放:既有 Gemini 原生接口,也有 OpenAI 兼容接口。用 Gemini SDK 的项目可以原样迁入,存量 OpenAI 格式代码只改 base_url 与模型名就能直接调用。
价格详情
| 价目 | 输入 /1M tokens | 输出 /1M tokens | 相当于官方 |
|---|---|---|---|
| 官方基准价 | $2.00 | $12.00 | — |
| 本站最低参考价 | $0.152 | $0.913 | 约 0.8 折 |
该模型支持提示词缓存,缓存命中部分按输入价约 10% 计费,长系统提示词场景可显著降本。
同系列模型价格对比
| 模型 | 本站最低参考(输入) | 相当于官方 |
|---|---|---|
| gemini-2.5-pro | $0.0951/1M | 约 0.8 折 |
| gemini-2.5-flash | $0.0228/1M | 约 0.8 折 |
| gemini-2.5-flash-lite | $0.0076/1M | 约 0.8 折 |
| gemini-3-flash-preview | $0.0381/1M | 约 0.8 折 |
| gemini-3.5-flash | $0.114/1M | 约 0.8 折 |
| gemini-3.7-flash | $0.0571/1M | 约 0.8 折 |
| gemini-3.1-flash-image-preview | $0.0118/次 | 约 0.7 折 |
| veo3.1 | $0.592/次 | 约 8.5 折 |
适用场景
- 复杂任务的推理与拆解:需求分析、技术方案评审、法律与财务文档审读,这类"想清楚再答"的任务开思考模式收益最明显。
- 多模态理解:合同扫描件、报表截图、UI 设计稿混着文字一起丢进去,做结构化提取、纠错或评审。
- 高质量长文写作:研究报告、方案书、深度文章的初稿与多轮改写,Pro 档的行文组织能力明显强于速度档。
- Agent 编排中的"大脑"角色:由它负责规划与关键决策,把翻译、摘要等执行类子任务分发给 flash 档模型,效果与成本比较均衡。
接入代码(OpenAI 兼容)
任何 OpenAI SDK 只改 base_url 一行即可切换到中转接口,模型名填 gemini-3.1-pro-preview:
from openai import OpenAI
client = OpenAI(
api_key="sk-你的令牌",
base_url="https://v2.cloudmist.cloud/v1"
)
resp = client.chat.completions.create(
model="gemini-3.1-pro-preview",
messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)curl、Node.js 及更多客户端写法见 base_url 配置详解。
选型与接入建议
家族内怎么选:
- 对比 gemini-2.5-pro:2.5-pro 是上一代稳定版,接口行为稳定、久经验证;gemini-3.1-pro-preview 代表更新的能力。生产链路求稳可以先压在 2.5-pro,追新能力、能接受预览版变动的团队直接上 3.1。
- 对比 gemini-3-flash-preview / gemini-3.5-flash / gemini-3.7-flash:Flash 是速度档,翻译、客服、批量处理这类高频简单任务交给它们更划算;只有推理密度高的任务才值得动用 Pro。
- 对比 gemini-3.1-flash-image-preview 与 veo3.1:这两个分别负责生图和生视频,文本理解与推理类需求都归 Pro 管,不要拿错工具。
国内接入:OpenAI 兼容 SDK 把 base_url 填 https://v2.cloudmist.cloud/v1 即可,Cursor、NextChat、沉浸式翻译等客户端均可接入。另外建议把模型名做成配置项——preview 版后续可能转正或更名,留一手方便无痛切换。
常见问题
国内如何调用 gemini-3.1-pro-preview?
在本站注册并创建 API Key,OpenAI 兼容 SDK 把 base_url 改为 https://v2.cloudmist.cloud/v1(Claude Code 填 https://v2.cloudmist.cloud,不带 /v1),模型名填 gemini-3.1-pro-preview 即可,国内网络直连,支持支付宝/微信人民币充值。
gemini-3.1-pro-preview 通过中转站调用什么价格?
本站参考价输入 $0.152/1M tokens、输出 $0.913/1M tokens 起(约 0.8 折),提供 12 个渠道档位,价格与稳定性各有侧重,实际以站内定价页实时显示为准。
gemini-3.1-pro-preview 的 preview 后缀到底意味着什么?
意味着它是预览版:能力已完整开放,但上游可能调整接口细节、输出风格,后续也可能推出转正版本。建议把模型名写成配置项,对输出做好兼容解析;对稳定性要求极高的链路,可用 gemini-2.5-pro 作为兜底方案。
开启思考模式会明显拖慢响应吗?
会有影响。思考类模型在正式输出前先做内部推理,首 token 延迟通常高于纯对话档,换来的是复杂问题上更高的正确率。适合"答对比答快重要"的任务;延迟敏感的对话场景建议改用 flash 系列,或调低思考强度。
多模态输入在 OpenAI 兼容格式下怎么传?
按 OpenAI 的 vision 消息格式,把 image_url(支持 base64 的 data URI)放进 content 数组即可;走 Gemini 原生接口则按 inline_data 方式传图。两种格式在云雾API 都已打通,选团队熟悉的一种即可,无需改动消息结构。
用它替换项目里的 GPT 系列模型要改多少代码?
改动很小:base_url 指向 https://v2.cloudmist.cloud/v1,model 字段换成 gemini-3.1-pro-preview,其余消息结构、流式输出写法都兼容。需要注意不同家族的 prompt 习惯有差异,建议迁移后重测几条核心用例再全量切换。