PT ▾
Obter chave de API

Primeira requisição em cinco minutos

Insira sua chave de API Kimi em qualquer cliente compatível com OpenAI e comece a gerar texto sem censura. Este guia mostra exatamente como configurar seu SDK e entender o preço real dos tokens.

Instale o SDK OpenAI Python/Node

Comece instalando a biblioteca cliente padrão da OpenAI. Isso funciona porque nossa API segue a mesma interface compatível com OpenAI. Você não precisa de um SDK de fornecedor especial. Basta executar pip install openai para Python ou npm install openai para Node.js. A biblioteca cuida da serialização JSON e das requisições HTTP automaticamente.

Configure URL Base e Chave de API

Aponte seu cliente para nosso endpoint. Defina a URL base como https://api.kimiapi.top/v1 e forneça sua chave de API obtida no painel. Esta chave autentica seu crédito pré-pago. Você pode gerar uma nova chave instantaneamente via Google ou e-mail na página de cadastro. Não é necessário cartão de crédito para começar.

curl https://api.kimiapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Envie sua primeira conclusão de chat

Envie uma mensagem simples para o modelo uncensored. Este modelo é ajustado para responder sem recusas para uso adulto lícito. Ele suporta uma janela de contexto de 100.000 tokens, embora a saída máxima seja de 32.000 tokens. A resposta retorna texto diretamente. Erros e recusas não consomem seu crédito.

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Ative o streaming com SSE

Para respostas em tempo real, ative o streaming. O SDK transmite tokens via Server-Sent Events (SSE). O último chunk contém o uso total de tokens para faturamento. Esta abordagem reduz a latência percebida para saídas longas. Você pode processar cada token conforme ele chega na lógica da sua aplicação.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Use o modo JSON para saída estruturada

Garanta uma saída consistente e legível por máquina definindo response_format como {"type": "json_object"}. Isso força o modelo a retornar JSON válido. É ideal para extração de dados ou geração de configuração. O modelo não quebrará a estrutura, facilitando a análise das respostas no seu código.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Verifique o uso e os custos

Monitore seu uso pelo painel. O custo de entrada é de $0,25 por milhão de tokens; a saída é de $1,00 por milhão de tokens. Se receber 401, verifique sua chave. 402 significa que você precisa recarregar com USDT ou USDC. 429 indica que você atingiu o limite de 300 requisições por minuto. O crédito nunca expira, então recarregue quando for conveniente.

Especificações técnicas

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
Base URLhttps://api.kimiapi.top/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
Janela de contexto100.000 tokens (entrada + saída)
Modo JSONresponse_format: {"type": "json_object"}
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Limite de taxa300 requisições por minuto por chave
Concorrência8 requisições ao mesmo tempo por chave
Tamanhoaté 8 MB por requisição
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Validadecrédito pago não expira, sem assinatura
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Bônus+5% a partir de $50, +10% a partir de $100
LoginGoogle ou e-mail e senha
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Como funciona a cobrança da API Kimi?

Você paga apenas pelo uso real de tokens. Tokens de entrada custam $0,25 por milhão e tokens de saída custam $1,00 por milhão. Erros e recusas são gratuitos. O crédito é pré-pago e nunca expira.

Quais pagamentos com criptomoedas são aceitos?

Aceitamos USDT (TRC20) e USDC (Base). Recargas variam de $10 a $500. Os pagamentos são processados diretamente, sem cartões ou PayPal.

Qual é o limite da janela de contexto?

O modelo suporta uma janela de contexto de 100.000 tokens para prompt e conclusão. No entanto, a saída máxima por requisição é de 32.000 tokens, a menos que você especifique um limite menor.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.