🎉 新版站点已上线 — 新用户请在 v2.cloudmist.cloud 注册使用,本站教程均以新站地址为准 · 老用户账号已迁移完成,用原用户名/邮箱 + 原密码可直接登录 新站(登不上请在用户名后加 _82350),原站余额可继续在 api.cloudmist.cloud 用完,新站需重建令牌并改用新站 base_url
首页 › 模型库 › gemini-3-flash-preview

gemini-3-flash-preview API 国内调用与价格(2026)

云雾API 运营团队 · 数据来自站内实时价目 · 更新于 2026-08-25
模型类型对话 · 识图 · 工具
计费方式按量(tokens)
官方基准(输入)$0.50/1M
本站最低参考(输入)$0.0381/1M
相当于官方约 0.8 折
可选渠道档位12 档
站内累计调用782 万 次

参考价按当前渠道倍率折算、含服务费,实际以定价页实时显示为准;不同档位的渠道来源与稳定性不同,高稳定需求建议选官转档位(逆向与官转的区别)。数据更新于 2026-08-25。

把名字拆开,这个模型的定位就清楚了:Gemini 3 世代、flash 速度档、preview 预览状态。它承接 2.5-flash 的生态位——快、单价友好、覆盖日常主力任务,又带着新一代的能力底子。

数据更有说服力:它在云雾API 的累计调用量已超 782 万次,约为 gemini-2.5-flash 的四倍——大量用户已用真实流量把它投成速度档的新默认。另一个细节:它的能力标签比 2.5-flash 多了"工具"一项,函数调用是这一代被明显加强的方向,对 Agent 工作流是实打实的利好。

站内开放 gemini 与 openai 双端点、12 个渠道档位,多档渠道可选,详见下方价格表。

价格详情

价目输入 /1M tokens输出 /1M tokens相当于官方
官方基准价$0.50$3.00—
本站最低参考价$0.0381$0.228约 0.8 折

该模型支持提示词缓存,缓存命中部分按输入价约 10% 计费,长系统提示词场景可显著降本。

同系列模型价格对比

模型本站最低参考(输入)相当于官方
gemini-2.5-pro$0.0951/1M约 0.8 折
gemini-2.5-flash$0.0228/1M约 0.8 折
gemini-2.5-flash-lite$0.0076/1M约 0.8 折
gemini-3.1-pro-preview$0.152/1M约 0.8 折
gemini-3.5-flash$0.114/1M约 0.8 折
gemini-3.7-flash$0.0571/1M约 0.8 折
gemini-3.1-flash-image-preview$0.0118/次约 0.7 折
veo3.1$0.592/次约 8.5 折

适用场景

接入代码(OpenAI 兼容)

任何 OpenAI SDK 只改 base_url 一行即可切换到中转接口,模型名填 gemini-3-flash-preview:

from openai import OpenAI

client = OpenAI(
    api_key="sk-你的令牌",
    base_url="https://v2.cloudmist.cloud/v1"
)
resp = client.chat.completions.create(
    model="gemini-3-flash-preview",
    messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)

curl、Node.js 及更多客户端写法见 base_url 配置详解。

选型与接入建议

和兄弟型号的取舍:求稳选 gemini-2.5-flash,它是正式版,行为不会突然变;求新选本模型,能力代际领先,但 preview 后缀意味着上游可能随时调整行为甚至换版,核心生产链路要留好回退开关。同属 3 系的 gemini-3.5-flash、gemini-3.7-flash 是更晚的迭代;现在才开始选型的话,三个都拿真实流量测一轮,按效果和账单定。需要更强推理能力的,再看同代的 gemini-3.1-pro-preview。

接入:OpenAI 兼容 SDK 的 base_url 填 https://v2.cloudmist.cloud/v1,模型名 gemini-3-flash-preview;Cursor、NextChat、沉浸式翻译等客户端均可接入。工程建议:模型名做成配置项而非硬编码,转正或换版可一键切换。

常见问题

国内如何调用 gemini-3-flash-preview?

在本站注册并创建 API Key,OpenAI 兼容 SDK 把 base_url 改为 https://v2.cloudmist.cloud/v1(Claude Code 填 https://v2.cloudmist.cloud,不带 /v1),模型名填 gemini-3-flash-preview 即可,国内网络直连,支持支付宝/微信人民币充值。

gemini-3-flash-preview 通过中转站调用什么价格?

本站参考价输入 $0.0381/1M tokens、输出 $0.228/1M tokens 起(约 0.8 折),提供 12 个渠道档位,价格与稳定性各有侧重,实际以站内定价页实时显示为准。

带 preview 后缀的模型,敢放进生产环境吗?

分链路看。站内 782 万+ 的调用量说明大量生产流量已经在跑,日常任务问题不大。但 preview 意味着上游可能更新模型行为,输出格式和风格存在随版本漂移的可能。建议:强依赖输出格式的链路加一层校验,并保留一键回退到 gemini-2.5-flash 的配置开关。

已经在用 2.5-flash 的项目,值得切过来吗?

值得测,不建议裸切。它是新一代速度档,工具调用明显加强,如果你的场景涉及函数调用或 Agent 编排,收益大概率能感知到;纯问答场景差异未必明显。拿 10% 流量灰度一到两周,对比质量和 token 消耗,再决定是否全量。

它跟 gemini-3.5-flash、gemini-3.7-flash 是什么关系?

都是 Gemini 3 世代的 flash 速度档,版本号越高迭代越晚。三者在站内都有可观的调用量,并不存在"谁淘汰谁"的定论。选型看两点:哪个在你的任务上表现稳定,以及价格表里各自的渠道档位差。同代模型之间迁移成本几乎为零,可以放心横向对比。

工具调用的代码要按哪种格式写?

走 OpenAI 兼容端点时,直接用标准的 tools / function calling 字段,存量 GPT 项目的工具定义基本不用改;走 gemini 原生端点则用 functionDeclarations 格式。建议团队内统一选一个端点,避免两种格式混写增加维护成本。

注册即送免费测试额度

一个 API Key 调用 Claude、GPT、Gemini、DeepSeek 等 200+ 大模型,国内直连、人民币充值。

立即注册,领测试额度 →
相关内容
本站为云雾API 注册、登录与充值入口站点 · 模型与价格以控制台实时数据为准 · 更新于 2026-08-25
Claude、GPT、Gemini 等名称为各自权利人商标,本站为独立第三方 API 中转/聚合服务,与上述厂商无隶属或授权关系。