🎉 新版站点已上线 — 新用户请在 v2.cloudmist.cloud 注册使用,本站教程均以新站地址为准 · 老用户账号已迁移完成,用原用户名/邮箱 + 原密码可直接登录 新站(登不上请在用户名后加 _82350),原站余额可继续在 api.cloudmist.cloud 用完,新站需重建令牌并改用新站 base_url
首页 › 模型库 › kimi-k3

kimi-k3 API 国内调用与价格(2026)

云雾API 运营团队 · 数据来自站内实时价目 · 更新于 2026-08-25
模型类型对话 · 思考 · 工具
计费方式按量(tokens)
官方基准(输入)$3.00/1M
本站最低参考(输入)$1.73/1M
相当于官方约 5.8 折
可选渠道档位5 档
站内累计调用10 万 次

参考价按当前渠道倍率折算、含服务费,实际以定价页实时显示为准;不同档位的渠道来源与稳定性不同,高稳定需求建议选官转档位(逆向与官转的区别)。数据更新于 2026-08-25。

kimi-k2 在 2025 年 7 月以万亿参数 MoE 的姿态开源,把月之暗面(Moonshot AI)推到了开源阵营头部;kimi-k3 则是这条产品线的下一代主力。从命名规律和站内数据看,它接棒 k2 的旗舰位置,能力标签在"对话"之外新增了"思考"与"工具"——意味着这一代原生支持推理式思考和 function calling,不再是单纯的聊天模型。

在云雾API(第三方 API 中转/聚合服务)站内,kimi-k3 累计调用已近 10 万次,提供 5 个渠道档位,走标准 OpenAI 兼容端点接入。它还支持 prompt caching:system prompt 或长上下文前缀重复出现时,命中缓存的部分计费明显降低,对固定提示词模板的批量任务尤其友好,具体见下方价格表。

需要说明:kimi-k3 属于较新的型号,参数规模、上下文窗口等细节以月之暗面后续披露为准。本页只基于站内真实调用数据与产品命名规律给出定位,不做臆测。

价格详情

价目输入 /1M tokens输出 /1M tokens相当于官方
官方基准价$3.00$15.00—
本站最低参考价$1.73$8.62约 5.8 折

该模型支持提示词缓存,缓存命中部分按输入价约 10% 计费,长系统提示词场景可显著降本。

同系列模型价格对比

模型本站最低参考(输入)相当于官方
kimi-k2$0.345/1M约 5.8 折

适用场景

接入代码(OpenAI 兼容)

任何 OpenAI SDK 只改 base_url 一行即可切换到中转接口,模型名填 kimi-k3:

from openai import OpenAI

client = OpenAI(
    api_key="sk-你的令牌",
    base_url="https://v2.cloudmist.cloud/v1"
)
resp = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)

curl、Node.js 及更多客户端写法见 base_url 配置详解。

选型与接入建议

kimi-k3 vs kimi-k2:k2 是开源的万亿参数 MoE,权重可自部署,站内标签只有"对话";k3 多了思考与工具调用,渠道档位也更多(5 档对 4 档)。简单说:纯对话、摘要、翻译这类轻任务,k2 够用且更省;要跑 function calling、多步 Agent、复杂推理,直接上 k3;想自己部署权重的,目前只有 k2 有开源版本。

接入方面,kimi-k3 走 OpenAI 兼容端点:任何支持自定义 base_url 的 SDK 或客户端,把 base_url 填成 https://v2.cloudmist.cloud/v1 即可,Cursor、NextChat、沉浸式翻译都能直接用。它没有提供 anthropic 格式端点,想在 Claude Code 里挂国产替补模型的话,建议看 grok-4.6 或 deepseek-v4-pro 这类双端点型号。多档渠道可选,差异详见下方价格表,按稳定性要求选档即可。

常见问题

国内如何调用 kimi-k3?

在本站注册并创建 API Key,OpenAI 兼容 SDK 把 base_url 改为 https://v2.cloudmist.cloud/v1(Claude Code 填 https://v2.cloudmist.cloud,不带 /v1),模型名填 kimi-k3 即可,国内网络直连,支持支付宝/微信人民币充值。

kimi-k3 通过中转站调用什么价格?

本站参考价输入 $1.73/1M tokens、输出 $8.62/1M tokens 起(约 5.8 折),提供 5 个渠道档位,价格与稳定性各有侧重,实际以站内定价页实时显示为准。

kimi-k3 相比 kimi-k2 到底升级了什么?

从站内可验证的信息看:k3 新增了思考与工具调用标签,支持 prompt caching,渠道档位从 4 档增加到 5 档;k2 的优势则是开源可自部署。参数与训练细节官方尚未完整披露,选型建议以你的实际任务试跑结果为准。

kimi-k3 能在哪些客户端里直接用?

支持 OpenAI 兼容协议、可自定义 base_url 的客户端都行:Cursor、NextChat、沉浸式翻译等,base_url 填 https://v2.cloudmist.cloud/v1,模型名 kimi-k3。Claude Code 需要 anthropic 端点,kimi-k3 暂不提供。

kimi-k3 的 prompt caching 是怎么生效的?

当请求前缀(通常是长 system prompt 或复用的上下文)与近期请求重复时,命中部分按缓存价计费,输入成本显著下降。对"固定指令 + 批量数据"的任务收益最大;缓存价格详见下方价格表。

站内 kimi-k3 的 5 个渠道档位怎么选?

档位差异主要在价格与承载链路。生产业务建议选稳定性优先的档位,个人开发和测试可以用低价档;拿不准就先用默认分组跑一段时间,再按报错率和延迟调整。

注册即送免费测试额度

一个 API Key 调用 Claude、GPT、Gemini、DeepSeek 等 200+ 大模型,国内直连、人民币充值。

立即注册,领测试额度 →
相关内容
本站为云雾API 注册、登录与充值入口站点 · 模型与价格以控制台实时数据为准 · 更新于 2026-08-25
Claude、GPT、Gemini 等名称为各自权利人商标,本站为独立第三方 API 中转/聚合服务,与上述厂商无隶属或授权关系。