gemini-3.7-flash API 国内调用与价格(2026)
参考价按当前渠道倍率折算、含服务费,实际以定价页实时显示为准;不同档位的渠道来源与稳定性不同,高稳定需求建议选官转档位(逆向与官转的区别)。数据更新于 2026-08-25。
单看站内数据,gemini-3.7-flash 是云雾API 上 Gemini 3 系 Flash 档跑量最大的一个——累计调用量三百多万次,把同门的 gemini-3.5-flash 和 gemini-3-flash-preview 都甩在身后。版本号 3.7 表明它是 Flash 速度线目前较新的迭代,标签覆盖对话、识图与工具调用,延续"快、省、够用"路线。站内 12 个渠道档位,多档渠道可选,详见下方价格表。
价格详情
| 价目 | 输入 /1M tokens | 输出 /1M tokens | 相当于官方 |
|---|---|---|---|
| 官方基准价 | $0.75 | $3.75 | — |
| 本站最低参考价 | $0.0571 | $0.285 | 约 0.8 折 |
该模型支持提示词缓存,缓存命中部分按输入价约 10% 计费,长系统提示词场景可显著降本。
同系列模型价格对比
| 模型 | 本站最低参考(输入) | 相当于官方 |
|---|---|---|
| gemini-2.5-pro | $0.0951/1M | 约 0.8 折 |
| gemini-2.5-flash | $0.0228/1M | 约 0.8 折 |
| gemini-2.5-flash-lite | $0.0076/1M | 约 0.8 折 |
| gemini-3-flash-preview | $0.0381/1M | 约 0.8 折 |
| gemini-3.1-pro-preview | $0.152/1M | 约 0.8 折 |
| gemini-3.5-flash | $0.114/1M | 约 0.8 折 |
| gemini-3.1-flash-image-preview | $0.0118/次 | 约 0.7 折 |
| veo3.1 | $0.592/次 | 约 8.5 折 |
适用场景
- 浏览器插件与翻译场景:高频短请求、要求秒回,正是 Flash 档的主场,沉浸式翻译类工具接它很顺。
- RAG 问答生成端:检索到的片段交给它组织成答案,吞吐高,适合知识库、文档助手。
- 结构化信息抽取:从网页、邮件、聊天记录里按 schema 抽字段、输出 JSON。
- 多轮陪聊与社区机器人:响应快、人设保持稳定,成本撑得住大日活。
接入代码(OpenAI 兼容)
任何 OpenAI SDK 只改 base_url 一行即可切换到中转接口,模型名填 gemini-3.7-flash:
from openai import OpenAI
client = OpenAI(
api_key="sk-你的令牌",
base_url="https://v2.cloudmist.cloud/v1"
)
resp = client.chat.completions.create(
model="gemini-3.7-flash",
messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)curl、Node.js 及更多客户端写法见 base_url 配置详解。
选型与接入建议
选型逻辑很直接:新项目在 Flash 档里优先试 gemini-3.7-flash,它更新,站内用量也证明了接受度;gemini-3.5-flash 留给已调通的存量业务。海量极简单任务(打标、去重、分类),gemini-2.5-flash-lite 的成本下限更低;遇到需要深度推理的难题,直接升档 gemini-3.1-pro-preview,不要硬压在 Flash 上省钱。接 OpenAI 兼容 SDK 时 base_url 填 https://v2.cloudmist.cloud/v1;Cursor、NextChat、沉浸式翻译等客户端均可接入。
常见问题
国内如何调用 gemini-3.7-flash?
在本站注册并创建 API Key,OpenAI 兼容 SDK 把 base_url 改为 https://v2.cloudmist.cloud/v1(Claude Code 填 https://v2.cloudmist.cloud,不带 /v1),模型名填 gemini-3.7-flash 即可,国内网络直连,支持支付宝/微信人民币充值。
gemini-3.7-flash 通过中转站调用什么价格?
本站参考价输入 $0.0571/1M tokens、输出 $0.285/1M tokens 起(约 0.8 折),提供 12 个渠道档位,价格与稳定性各有侧重,实际以站内定价页实时显示为准。
从 gemini-2.5-flash 迁到 gemini-3.7-flash 需要改代码吗?
基本不用:两者在本站走同样的 Gemini 原生和 OpenAI 兼容端点,把 model 字段换成 gemini-3.7-flash 即可。要注意新版模型的输出风格可能略有变化,涉及严格格式解析(如 JSON 抽取)的链路,切换后先回归测试一遍。
它为什么比同门其他 Flash 用量高?
站内累计调用量三百多万次,确实是 3 系 Flash 里最高的。通常规律是:更新的迭代在相近成本下体验更好,开发者会自然向新版集中。具体到你的业务,还是建议用真实任务 A/B 一轮,数据比口碑可靠。
怎么让它稳定输出 JSON?
三个实用技巧:在 system 提示里给出完整 schema 和一个输出示例;明确要求"只输出 JSON,不要任何解释";客户端再做一层解析失败重试。Flash 档模型指令遵循不错,配合这三板斧,批量抽取的成功率可以做得很高。