gemini-3.5-flash API 国内调用与价格(2026)
参考价按当前渠道倍率折算、含服务费,实际以定价页实时显示为准;不同档位的渠道来源与稳定性不同,高稳定需求建议选官转档位(逆向与官转的区别)。数据更新于 2026-08-25。
在 Gemini 的 Flash 速度线里,gemini-3.5-flash 站在 3 系的中段:比首发的 gemini-3-flash-preview 晚一个版本号,又被更新的 gemini-3.7-flash 接续。Flash 在 Gemini 命名体系里一贯代表"快与省"——响应快、成本低,还保留识图和工具调用能力,定位是扛业务主流量的工作马。云雾API 站内它的累计调用量接近两百万次,配有 12 个渠道档位,多档渠道可选,详见下方价格表。
价格详情
| 价目 | 输入 /1M tokens | 输出 /1M tokens | 相当于官方 |
|---|---|---|---|
| 官方基准价 | $1.50 | $9.00 | — |
| 本站最低参考价 | $0.114 | $0.685 | 约 0.8 折 |
该模型支持提示词缓存,缓存命中部分按输入价约 10% 计费,长系统提示词场景可显著降本。
同系列模型价格对比
| 模型 | 本站最低参考(输入) | 相当于官方 |
|---|---|---|
| gemini-2.5-pro | $0.0951/1M | 约 0.8 折 |
| gemini-2.5-flash | $0.0228/1M | 约 0.8 折 |
| gemini-2.5-flash-lite | $0.0076/1M | 约 0.8 折 |
| gemini-3-flash-preview | $0.0381/1M | 约 0.8 折 |
| gemini-3.1-pro-preview | $0.152/1M | 约 0.8 折 |
| gemini-3.7-flash | $0.0571/1M | 约 0.8 折 |
| gemini-3.1-flash-image-preview | $0.0118/次 | 约 0.7 折 |
| veo3.1 | $0.592/次 | 约 8.5 折 |
适用场景
- 高频对话与客服机器人:低延迟、扛并发,适合面向终端用户的实时交互。
- 工具调用流水线:作为 Agent 的执行手,按指令调函数、填参数、串联外部接口。
- 图片轻量理解:票据识别、界面截图问答、图片内容审核初筛。
- 批量文本处理:摘要、改写、分类打标,量大时成本优势明显。
接入代码(OpenAI 兼容)
任何 OpenAI SDK 只改 base_url 一行即可切换到中转接口,模型名填 gemini-3.5-flash:
from openai import OpenAI
client = OpenAI(
api_key="sk-你的令牌",
base_url="https://v2.cloudmist.cloud/v1"
)
resp = client.chat.completions.create(
model="gemini-3.5-flash",
messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)curl、Node.js 及更多客户端写法见 base_url 配置详解。
选型与接入建议
同门三个 Flash 的分工:gemini-3-flash-preview 是 3 系首发预览,gemini-3.7-flash 是更靠后的迭代、站内调用量也更高——新项目建议直接从 3.7 起步,3.5 更适合已调通 prompt、不想折腾的存量业务。任务极简单、预算敏感,可退到 gemini-2.5-flash-lite;推理密度高的难题则升档到 gemini-3.1-pro-preview。接入方面,OpenAI 兼容 SDK 把 base_url 填 https://v2.cloudmist.cloud/v1,Cursor、NextChat、沉浸式翻译等客户端均可接入。
常见问题
国内如何调用 gemini-3.5-flash?
在本站注册并创建 API Key,OpenAI 兼容 SDK 把 base_url 改为 https://v2.cloudmist.cloud/v1(Claude Code 填 https://v2.cloudmist.cloud,不带 /v1),模型名填 gemini-3.5-flash 即可,国内网络直连,支持支付宝/微信人民币充值。
gemini-3.5-flash 通过中转站调用什么价格?
本站参考价输入 $0.114/1M tokens、输出 $0.685/1M tokens 起(约 0.8 折),提供 12 个渠道档位,价格与稳定性各有侧重,实际以站内定价页实时显示为准。
gemini-3.5-flash 与 gemini-3.7-flash 差在哪,该换吗?
按版本号规律,3.7 是 Flash 线更靠后的迭代,站内调用量也明显更高。两者接口完全一致,同一把 key 改个模型名就能 A/B 对比,建议拿自己的真实 prompt 各跑一轮,按效果和价格表择优;存量业务如果表现稳定,也不必急着迁。
它适合做 Agent 的执行模型吗?
适合。它支持工具调用,延迟低、成本可控,正好承接 Agent 流程里的高频执行动作——查接口、填参数、格式转换。规划和复杂决策环节交给 Pro 档,执行环节交给它,是比较常见的分层用法。
识图能力可以拿来做 OCR 类任务吗?
轻量场景可以:票据要素提取、截图问答、图文混排内容的粗解析都能胜任。但版面复杂、字体极小或手写体较多时准确率会下降,重要单据建议再用 Pro 档模型或专用 OCR 工具复核一遍。