Eerste verzoek in vijf minuten
Voer je Kimi API-sleutel in elke OpenAI-compatibele client en begin met het genereren van ongecensureerde tekst. Deze gids laat je precies zien hoe je je SDK configureert en de echte tokenprijzen begrijpt.
OpenAI Python/Node SDK installeren
Installeer eerst de standaard OpenAI-clientbibliotheek. Dit werkt omdat onze API dezelfde OpenAI-compatibele interface volgt. Je hebt geen speciale vendor-SDK nodig. Voer gewoon pip install openai uit voor Python of npm install openai voor Node.js. De bibliotheek verwerkt de JSON-serialisatie en HTTP-verzoeken automatisch.
Basis-URL en API-sleutel configureren
Wijs je client naar onze endpoint. Stel de basis-URL in op https://api.kimiapi.top/v1 en voer je API-sleutel in via het dashboard. Deze sleutel verifieert je prepaid tegoed. Je kunt direct een nieuwe sleutel genereren via Google of e-mail op de aanmeldpagina. Er is geen creditcard nodig om te beginnen.
curl https://api.kimiapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Eerste chatvoltooiing versturen
Stuur een eenvoudig bericht naar het uncensored model. Dit model is afgestemd op het beantwoorden zonder weigeringen voor wettelijk volwassen gebruik. Het ondersteunt een contextvenster van 100.000 tokens, hoewel de maximale uitvoer 32.000 tokens is. De respons retourneert tekst direct. Fouten en weigeringen verbruiken niet je tegoed.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Streaming inschakelen met SSE
Schakel streaming in voor realtime-antwoorden. De SDK streamt tokens via Server-Sent Events (SSE). De laatste chunk bevat het totale tokengebruik voor facturering. Deze aanpak vermindert de waargenomen latentie voor lange outputs. Je kunt elke token verwerken zodra deze aankomt in je applicatielogica.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
JSON-modus gebruiken voor gestructureerde output
Zorg voor consistente, machine-leesbare output door response_format in te stellen op {"type": "json_object"}. Dit forceert het model om geldige JSON te retourneren. Het is ideaal voor gegevensextractie of configuratiegeneratie. Het model breekt de structuur niet, wat het parseren van antwoorden in je code vergemakkelijkt.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Gebruik en kosten controleren
Bewaker je gebruik via het dashboard. Invoer kost $0,25 per miljoen tokens; uitvoer kost $1,00 per miljoen tokens. Als je een 401-fout krijgt, controleer dan je sleutel. Een 402 betekent dat je moet opwaarderen met USDT of USDC. Een 429 betekent dat je de limiet van 300 verzoeken per minuut hebt bereikt.tegoed verloopt nooit, dus laad op wanneer het jou schikt.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Base URL | https://api.kimiapi.top/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| JSON-modus | response_format: {"type": "json_object"} |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Verzoekgrootte | tot 8 MB |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Hoe werkt de facturering voor de Kimi API?
Je betaalt alleen voor echt tokengebruik. Inputtokens kosten $0,25 per miljoen, en outputtokens kosten $1,00 per miljoen. Fouten en weigeringen zijn gratis. Tegoed is prepaid en vervalt nooit.
Welke cryptobetalingen worden geaccepteerd?
We accepteren USDT (TRC20) en USDC (Base). Opwaarderingen variëren van $10 tot $500. Betalingen worden direct verwerkt zonder kaarten of PayPal.
Wat is de limiet van het contextvenster?
Het model ondersteunt een contextvenster van 100.000 tokens voor zowel prompt als voltooiing. De maximale output per verzoek is echter 32.000 tokens, tenzij je een lagere limiet opgeeft.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele installatie.