中文 ▾
获取 API 密钥

5 分钟发起首个请求

将你的 Kimi API 密钥放入任何兼容 OpenAI 的客户端,即可开始生成无审查文本。本指南将向你展示如何配置 SDK 并了解实际的 token 定价。

安装 OpenAI Python/Node SDK

首先安装标准的 OpenAI 客户端库。这之所以可行,是因为我们的 API 遵循相同的 OpenAI 兼容接口。你不需要专用的供应商 SDK。只需运行 pip install openai(Python)或 npm install openai(Node.js)。该库会自动处理 JSON 序列化和 HTTP 请求。

配置 Base URL 和 API 密钥

将你的客户端指向我们的接口。将 base URL 设置为 https://api.kimiapi.top/v1,并提供来自仪表板的 API 密钥。此密钥用于验证你的预付额度。你可以在注册页面通过 Google 或电子邮件即时生成新密钥。开始使用无需信用卡。

curl https://api.kimiapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

发送首个聊天补全请求

向 uncensored 模型发送简单消息。该模型经过调整,可在合法成人用途下无拒绝地回答。它支持 100,000-token 的上下文窗口,但最大输出为 32,000 个 token。响应直接返回文本。错误和拒绝不会消耗你的额度。

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

启用 SSE 流式输出

对于实时响应,请启用流式输出。SDK 通过 Server-Sent Events (SSE) 流式传输 token。最后一个 chunk 包含用于计费的总 token 用量。这种方法降低了长输出的感知延迟。你可以在应用逻辑中处理到达的每个 token。

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

使用 JSON 模式获取结构化输出

通过将 response_format 设置为 {"type": "json_object"} 来确保一致的可机器读取输出。这会强制模型返回有效的 JSON。它非常适合数据提取或配置生成。模型不会破坏结构,使你在代码中解析响应变得更加容易。

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

查看用量和成本

通过仪表板监控你的用量。输入成本为每百万 token 0.25 美元;输出为每百万 token 1.00 美元。如果收到 401,请检查你的密钥。402 表示你需要使用 USDT 或 USDC 充值。429 表示你达到了每分钟 300 次请求的速率限制。额度永不过期,因此方便时再充值。

技术规格

购买额度前,请先确认接口是否满足你的需求——以下是全部真实参数。

项目说明
接口格式兼容 OpenAI:任何 OpenAI SDK 或客户端只需更换 base URL 和密钥
Base URLhttps://api.kimiapi.top/v1
接口POST /v1/chat/completions · GET /v1/models
认证Authorization: Bearer YOUR_KEY
模型 IDuncensored
上下文窗口100,000 tokens(输入与输出合计)
JSON 模式response_format: {"type": "json_object"}
最大输出不单独限制输出;提示+回复共 100,000 个 token 窗口内,max_tokens 可选
流式输出支持 SSE,最后一块包含 token 用量
采样参数temperature、top_p、stop、seed、presence_penalty、frequency_penalty
函数调用支持 tools、tool_choice;回复包含 tool_calls(流式同样支持),结果以 role: tool 消息返回
速率限制每个密钥每分钟 300 次请求
并发每个密钥同时最多 8 个请求
请求大小每次请求不超过 8 MB
响应头X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency
计费预付额度,按实际 token 用量扣费;错误和拒绝不收费
额度有效期付费额度永不过期,无订阅
价格输入 $0.25 / 百万 tokens · 输出 $1.00 / 百万 tokens
充值USDT(TRC20)或 USDC(Base),$10–$500 任意整数金额
免费试用$0.50,有效期 7 天,无需银行卡 · 试用密钥:2 个并发请求,每分钟 60 次;首次充值后恢复完整限额(8 和 300)
赠送额度满 $50 送 5%,满 $100 送 10%
登录Google 或邮箱 + 密码
密钥每个账户一个有效密钥;生成新密钥后旧密钥失效
内容政策允许成人内容;涉及未成年人的性内容一律拒绝

错误代码

错误以 JSON 返回,type 字段固定;失败或被拒绝的请求不计费。

状态码类型含义
400bad_requestJSON 无效、消息为空、参数错误或超出上下文窗口
401missing_key · invalid_key · key_revoked缺少密钥、密钥错误或已被新密钥替换
402no_credit余额不足——充值后立即恢复
403content_blocked涉及未成年人的性内容——拒绝且不计费
404not_found未知接口
413request_too_large请求体超过 8 MB
429rate_limited · concurrency超过每分钟 300 次或 8 个并发——稍后重试
503upstream_busy模型繁忙——几秒后重试

问答

Kimi API 的计费方式是怎样的?

你只需为实际的 token 使用付费。输入 token 每百万 token 0.25 美元,输出 token 每百万 token 1.00 美元。错误和拒绝不收费。额度为预付且永不过期。

支持哪些加密货币支付?

我们接受 USDT (TRC20) 和 USDC (Base)。充值金额范围为 10 至 500 美元。支付直接处理,无需信用卡或 PayPal。

上下文窗口限制是多少?

该模型支持 100,000-token 的上下文窗口,涵盖提示词和补全。不过,除非你指定更低的限制,否则每个请求的最大输出为 32,000 个 token。

只差一张表单,即可获得密钥

创建账户,复制密钥,更改 base URL。这就是全部设置。