kimi-k3 API 国内调用与价格(2026)
参考价按当前渠道倍率折算、含服务费,实际以定价页实时显示为准;不同档位的渠道来源与稳定性不同,高稳定需求建议选官转档位(逆向与官转的区别)。数据更新于 2026-08-25。
kimi-k2 在 2025 年 7 月以万亿参数 MoE 的姿态开源,把月之暗面(Moonshot AI)推到了开源阵营头部;kimi-k3 则是这条产品线的下一代主力。从命名规律和站内数据看,它接棒 k2 的旗舰位置,能力标签在"对话"之外新增了"思考"与"工具"——意味着这一代原生支持推理式思考和 function calling,不再是单纯的聊天模型。
在云雾API(第三方 API 中转/聚合服务)站内,kimi-k3 累计调用已近 10 万次,提供 5 个渠道档位,走标准 OpenAI 兼容端点接入。它还支持 prompt caching:system prompt 或长上下文前缀重复出现时,命中缓存的部分计费明显降低,对固定提示词模板的批量任务尤其友好,具体见下方价格表。
需要说明:kimi-k3 属于较新的型号,参数规模、上下文窗口等细节以月之暗面后续披露为准。本页只基于站内真实调用数据与产品命名规律给出定位,不做臆测。
价格详情
| 价目 | 输入 /1M tokens | 输出 /1M tokens | 相当于官方 |
|---|---|---|---|
| 官方基准价 | $3.00 | $15.00 | — |
| 本站最低参考价 | $1.73 | $8.62 | 约 5.8 折 |
该模型支持提示词缓存,缓存命中部分按输入价约 10% 计费,长系统提示词场景可显著降本。
同系列模型价格对比
| 模型 | 本站最低参考(输入) | 相当于官方 |
|---|---|---|
| kimi-k2 | $0.345/1M | 约 5.8 折 |
适用场景
- Agent 工作流:"思考 + 工具"两个标签叠加,正是多步规划、循环调用工具这类 Agent 场景需要的组合,可作为国产模型里跑 Agent 的主力候选。
- 代码与技术任务:k2 一代已以代码与 Agent 能力见长,k3 作为迭代版适合承接代码生成、code review、脚本改写等任务。
- 中文长文处理:Kimi 系产品一贯以中文长文见长,合同分析、论文精读、资料汇总这类任务可以优先试它。
- 固定模板的批量调用:配合 prompt caching,做分类、抽取、审核这类"同一段长指令 + 不同数据"的流水线任务,成本结构相当友好。
接入代码(OpenAI 兼容)
任何 OpenAI SDK 只改 base_url 一行即可切换到中转接口,模型名填 kimi-k3:
from openai import OpenAI
client = OpenAI(
api_key="sk-你的令牌",
base_url="https://v2.cloudmist.cloud/v1"
)
resp = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)curl、Node.js 及更多客户端写法见 base_url 配置详解。
选型与接入建议
kimi-k3 vs kimi-k2:k2 是开源的万亿参数 MoE,权重可自部署,站内标签只有"对话";k3 多了思考与工具调用,渠道档位也更多(5 档对 4 档)。简单说:纯对话、摘要、翻译这类轻任务,k2 够用且更省;要跑 function calling、多步 Agent、复杂推理,直接上 k3;想自己部署权重的,目前只有 k2 有开源版本。
接入方面,kimi-k3 走 OpenAI 兼容端点:任何支持自定义 base_url 的 SDK 或客户端,把 base_url 填成 https://v2.cloudmist.cloud/v1 即可,Cursor、NextChat、沉浸式翻译都能直接用。它没有提供 anthropic 格式端点,想在 Claude Code 里挂国产替补模型的话,建议看 grok-4.6 或 deepseek-v4-pro 这类双端点型号。多档渠道可选,差异详见下方价格表,按稳定性要求选档即可。
常见问题
国内如何调用 kimi-k3?
在本站注册并创建 API Key,OpenAI 兼容 SDK 把 base_url 改为 https://v2.cloudmist.cloud/v1(Claude Code 填 https://v2.cloudmist.cloud,不带 /v1),模型名填 kimi-k3 即可,国内网络直连,支持支付宝/微信人民币充值。
kimi-k3 通过中转站调用什么价格?
本站参考价输入 $1.73/1M tokens、输出 $8.62/1M tokens 起(约 5.8 折),提供 5 个渠道档位,价格与稳定性各有侧重,实际以站内定价页实时显示为准。
kimi-k3 相比 kimi-k2 到底升级了什么?
从站内可验证的信息看:k3 新增了思考与工具调用标签,支持 prompt caching,渠道档位从 4 档增加到 5 档;k2 的优势则是开源可自部署。参数与训练细节官方尚未完整披露,选型建议以你的实际任务试跑结果为准。
kimi-k3 能在哪些客户端里直接用?
支持 OpenAI 兼容协议、可自定义 base_url 的客户端都行:Cursor、NextChat、沉浸式翻译等,base_url 填 https://v2.cloudmist.cloud/v1,模型名 kimi-k3。Claude Code 需要 anthropic 端点,kimi-k3 暂不提供。
kimi-k3 的 prompt caching 是怎么生效的?
当请求前缀(通常是长 system prompt 或复用的上下文)与近期请求重复时,命中部分按缓存价计费,输入成本显著下降。对"固定指令 + 批量数据"的任务收益最大;缓存价格详见下方价格表。
站内 kimi-k3 的 5 个渠道档位怎么选?
档位差异主要在价格与承载链路。生产业务建议选稳定性优先的档位,个人开发和测试可以用低价档;拿不准就先用默认分组跑一段时间,再按报错率和延迟调整。