ES ▾
Obtener clave de API

Primera petición en cinco minutos

Inserta tu clave de API de Kimi en cualquier cliente compatible con OpenAI y empieza a generar texto sin censura. Esta guía te muestra cómo configurar tu SDK y entender la facturación real por token.

Instalar SDK de OpenAI para Python/Node

Empieza instalando la librería cliente estándar de OpenAI. Esto funciona porque nuestra API sigue la misma interfaz compatible con OpenAI. No necesitas un SDK específico del proveedor. Simplemente ejecuta pip install openai para Python o npm install openai para Node.js. La librería gestiona automáticamente la serialización JSON y las peticiones HTTP.

Configurar URL base y clave de API

Apunta tu cliente a nuestro endpoint. Establece la URL base en https://api.kimiapi.top/v1 y proporciona tu clave de API desde el panel. Esta clave autentica tu crédito prepago. Puedes generar una nueva clave al instante mediante Google o correo electrónico en la página de registro. No se requiere tarjeta de crédito para empezar.

curl https://api.kimiapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Enviar tu primera completación de chat

Envía un mensaje simple al modelo uncensored. Este modelo está optimizado para responder sin rechazos para uso adulto lícito. Admite una ventana de contexto de 100.000 tokens, aunque la salida máxima es de 32.000 tokens. La respuesta devuelve texto directamente. Los errores y rechazos no consumen tu crédito.

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Habilitar streaming con SSE

Para respuestas en tiempo real, habilita el streaming. El SDK transmite tokens mediante Server-Sent Events (SSE). El último fragmento contiene el uso total de tokens para facturación. Este enfoque reduce la latencia percibida en salidas largas. Puedes procesar cada token a medida que llega en la lógica de tu aplicación.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Usar modo JSON para salida estructurada

Asegura una salida legible por máquina estableciendo response_format en {"type": "json_object"}. Esto obliga al modelo a devolver JSON válido. Es ideal para extracción de datos o generación de configuración. El modelo no romperá la estructura, facilitando el análisis de las respuestas en tu código.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Revisar uso y costes

Monitorea tu uso mediante el panel. El costo de los tokens de entrada es de $0.25 por millón de tokens; el de salida es de $1.00 por millón de tokens. Si recibes un 401, verifica tu clave. Un 402 significa que necesitas recargar con USDT o USDC. Un 429 indica que alcanzaste el límite de 300 peticiones por minuto. El crédito no caduca, así que recarga cuando te sea conveniente.

Especificaciones técnicas

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
Base URLhttps://api.kimiapi.top/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaciónAuthorization: Bearer YOUR_KEY
ID del modelouncensored
Ventana de contexto100.000 tokens (entrada + salida)
Modo JSONresponse_format: {"type": "json_object"}
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Límite de peticiones300 por minuto por clave
Concurrencia8 peticiones a la vez por clave
Tamaño de peticiónhasta 8 MB
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Caducidadel crédito pagado no caduca, sin suscripción
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Bono+5 % desde $50, +10 % desde $100
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Cómo funciona la facturación de la API de Kimi?

Pagas solo por el uso real de tokens. Los tokens de entrada cuestan $0.25 por millón, y los tokens de salida cuestan $1.00 por millón. Los errores y rechazos son gratuitos. El crédito es prepago y no caduca.

¿Qué pagos con criptomonedas se aceptan?

Aceptamos USDT (TRC20) y USDC (Base). Las recargas van de $10 a $500. Los pagos se procesan directamente sin tarjetas ni PayPal.

¿Cuál es el límite de la ventana de contexto?

El modelo admite una ventana de contexto de 100.000 tokens para el prompt y la completación. Sin embargo, la salida máxima por petición es de 32.000 tokens, salvo que indiques un límite menor.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave y cambia la URL base. Eso es toda la configuración.