Primera petición en cinco minutos
Inserta tu clave de API de Kimi en cualquier cliente compatible con OpenAI y empieza a generar texto sin censura. Esta guía te muestra cómo configurar tu SDK y entender la facturación real por token.
Instalar SDK de OpenAI para Python/Node
Empieza instalando la librería cliente estándar de OpenAI. Esto funciona porque nuestra API sigue la misma interfaz compatible con OpenAI. No necesitas un SDK específico del proveedor. Simplemente ejecuta pip install openai para Python o npm install openai para Node.js. La librería gestiona automáticamente la serialización JSON y las peticiones HTTP.
Configurar URL base y clave de API
Apunta tu cliente a nuestro endpoint. Establece la URL base en https://api.kimiapi.top/v1 y proporciona tu clave de API desde el panel. Esta clave autentica tu crédito prepago. Puedes generar una nueva clave al instante mediante Google o correo electrónico en la página de registro. No se requiere tarjeta de crédito para empezar.
curl https://api.kimiapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Enviar tu primera completación de chat
Envía un mensaje simple al modelo uncensored. Este modelo está optimizado para responder sin rechazos para uso adulto lícito. Admite una ventana de contexto de 100.000 tokens, aunque la salida máxima es de 32.000 tokens. La respuesta devuelve texto directamente. Los errores y rechazos no consumen tu crédito.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Habilitar streaming con SSE
Para respuestas en tiempo real, habilita el streaming. El SDK transmite tokens mediante Server-Sent Events (SSE). El último fragmento contiene el uso total de tokens para facturación. Este enfoque reduce la latencia percibida en salidas largas. Puedes procesar cada token a medida que llega en la lógica de tu aplicación.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Usar modo JSON para salida estructurada
Asegura una salida legible por máquina estableciendo response_format en {"type": "json_object"}. Esto obliga al modelo a devolver JSON válido. Es ideal para extracción de datos o generación de configuración. El modelo no romperá la estructura, facilitando el análisis de las respuestas en tu código.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Revisar uso y costes
Monitorea tu uso mediante el panel. El costo de los tokens de entrada es de $0.25 por millón de tokens; el de salida es de $1.00 por millón de tokens. Si recibes un 401, verifica tu clave. Un 402 significa que necesitas recargar con USDT o USDC. Un 429 indica que alcanzaste el límite de 300 peticiones por minuto. El crédito no caduca, así que recarga cuando te sea conveniente.
Especificaciones técnicas
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Base URL | https://api.kimiapi.top/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticación | Authorization: Bearer YOUR_KEY |
| ID del modelo | uncensored |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Modo JSON | response_format: {"type": "json_object"} |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Límite de peticiones | 300 por minuto por clave |
| Concurrencia | 8 peticiones a la vez por clave |
| Tamaño de petición | hasta 8 MB |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Bono | +5 % desde $50, +10 % desde $100 |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Cómo funciona la facturación de la API de Kimi?
Pagas solo por el uso real de tokens. Los tokens de entrada cuestan $0.25 por millón, y los tokens de salida cuestan $1.00 por millón. Los errores y rechazos son gratuitos. El crédito es prepago y no caduca.
¿Qué pagos con criptomonedas se aceptan?
Aceptamos USDT (TRC20) y USDC (Base). Las recargas van de $10 a $500. Los pagos se procesan directamente sin tarjetas ni PayPal.
¿Cuál es el límite de la ventana de contexto?
El modelo admite una ventana de contexto de 100.000 tokens para el prompt y la completación. Sin embargo, la salida máxima por petición es de 32.000 tokens, salvo que indiques un límite menor.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave y cambia la URL base. Eso es toda la configuración.