NL ▾
API-sleutel aanvragen

Eerste verzoek in vijf minuten

Voer je Kimi API-sleutel in elke OpenAI-compatibele client en begin met het genereren van ongecensureerde tekst. Deze gids laat je precies zien hoe je je SDK configureert en de echte tokenprijzen begrijpt.

OpenAI Python/Node SDK installeren

Installeer eerst de standaard OpenAI-clientbibliotheek. Dit werkt omdat onze API dezelfde OpenAI-compatibele interface volgt. Je hebt geen speciale vendor-SDK nodig. Voer gewoon pip install openai uit voor Python of npm install openai voor Node.js. De bibliotheek verwerkt de JSON-serialisatie en HTTP-verzoeken automatisch.

Basis-URL en API-sleutel configureren

Wijs je client naar onze endpoint. Stel de basis-URL in op https://api.kimiapi.top/v1 en voer je API-sleutel in via het dashboard. Deze sleutel verifieert je prepaid tegoed. Je kunt direct een nieuwe sleutel genereren via Google of e-mail op de aanmeldpagina. Er is geen creditcard nodig om te beginnen.

curl https://api.kimiapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Eerste chatvoltooiing versturen

Stuur een eenvoudig bericht naar het uncensored model. Dit model is afgestemd op het beantwoorden zonder weigeringen voor wettelijk volwassen gebruik. Het ondersteunt een contextvenster van 100.000 tokens, hoewel de maximale uitvoer 32.000 tokens is. De respons retourneert tekst direct. Fouten en weigeringen verbruiken niet je tegoed.

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Streaming inschakelen met SSE

Schakel streaming in voor realtime-antwoorden. De SDK streamt tokens via Server-Sent Events (SSE). De laatste chunk bevat het totale tokengebruik voor facturering. Deze aanpak vermindert de waargenomen latentie voor lange outputs. Je kunt elke token verwerken zodra deze aankomt in je applicatielogica.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

JSON-modus gebruiken voor gestructureerde output

Zorg voor consistente, machine-leesbare output door response_format in te stellen op {"type": "json_object"}. Dit forceert het model om geldige JSON te retourneren. Het is ideaal voor gegevensextractie of configuratiegeneratie. Het model breekt de structuur niet, wat het parseren van antwoorden in je code vergemakkelijkt.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Gebruik en kosten controleren

Bewaker je gebruik via het dashboard. Invoer kost $0,25 per miljoen tokens; uitvoer kost $1,00 per miljoen tokens. Als je een 401-fout krijgt, controleer dan je sleutel. Een 402 betekent dat je moet opwaarderen met USDT of USDC. Een 429 betekent dat je de limiet van 300 verzoeken per minuut hebt bereikt.tegoed verloopt nooit, dus laad op wanneer het jou schikt.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Base URLhttps://api.kimiapi.top/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
Contextvenster100.000 tokens (invoer + uitvoer)
JSON-modusresponse_format: {"type": "json_object"}
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Verzoekgroottetot 8 MB
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Bonus+5% vanaf $50, +10% vanaf $100
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Hoe werkt de facturering voor de Kimi API?

Je betaalt alleen voor echt tokengebruik. Inputtokens kosten $0,25 per miljoen, en outputtokens kosten $1,00 per miljoen. Fouten en weigeringen zijn gratis. Tegoed is prepaid en vervalt nooit.

Welke cryptobetalingen worden geaccepteerd?

We accepteren USDT (TRC20) en USDC (Base). Opwaarderingen variëren van $10 tot $500. Betalingen worden direct verwerkt zonder kaarten of PayPal.

Wat is de limiet van het contextvenster?

Het model ondersteunt een contextvenster van 100.000 tokens voor zowel prompt als voltooiing. De maximale output per verzoek is echter 32.000 tokens, tenzij je een lagere limiet opgeeft.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele installatie.