DE ▾
API-Schlüssel erhalten

Erste Anfrage in fünf Minuten

Gib deinen Kimi API-Schlüssel in einen OpenAI-kompatiblen Client ein und beginne mit der Generierung unzensierter Texte. Diese Anleitung zeigt dir genau, wie du dein SDK konfigurierst und die echten Token-Preise verstehst.

OpenAI Python/Node SDK installieren

Beginne mit der Installation der Standard-OpenAI-Clientbibliothek. Das funktioniert, weil unsere API derselben OpenAI-kompatiblen Schnittstelle folgt. Du benötigst kein spezielles Anbieter-SDK. Führe einfach pip install openai für Python oder npm install openai für Node.js aus. Die Bibliothek übernimmt die JSON-Serialisierung und HTTP-Anfragen automatisch.

Basis-URL und API-Schlüssel konfigurieren

Richte deinen Client auf unseren Endpunkt ein. Lege die Basis-URL auf https://api.kimiapi.top/v1 fest und gib deinen API-Schlüssel aus dem Dashboard ein. Dieser Schlüssel authentifiziert dein Prepaid-Guthaben. Du kannst einen neuen Schlüssel sofort über Google oder E-Mail auf der Anmeldeseite generieren. Keine Kreditkarte erforderlich.

curl https://api.kimiapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Erste Chat-Vervollständigung senden

Sende eine einfache Nachricht an das uncensored-Modell. Dieses Modell ist darauf ausgelegt, ohne Ablehnungen zu antworten, für die rechtliche Nutzung durch Erwachsene. Es unterstützt ein Kontextfenster mit 100.000 Token, wobei die maximale Ausgabe 32.000 Token beträgt. Die Antwort wird direkt als Text zurückgegeben. Fehler und Ablehnungen verbrauchen nicht dein Guthaben.

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Streaming mit SSE aktivieren

Aktiviere für Echtzeit-Antworten das Streaming. Das SDK streamt Token über Server-Sent Events (SSE). Das letzte Chunk enthält die gesamte Token-Nutzung für die Abrechnung. Dieser Ansatz reduziert die wahrgenommene Latenz bei langen Ausgaben. Du kannst jeden Token verarbeiten, sobald er in deiner Anwendungslogik eingeht.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

JSON-Modus für strukturierte Ausgaben verwenden

Stelle eine konsistente, maschinenlesbare Ausgabe sicher, indem du response_format auf {"type": "json_object"} setzt. Dies zwingt das Modell, gültiges JSON zurückzugeben. Es ist ideal für Datenextraktion oder Konfigurationsgenerierung. Das Modell bricht die Struktur nicht, was das Parsen der Antworten in deinem Code erleichtert.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Nutzung und Kosten prüfen

Überwache deine Nutzung über das Dashboard. Input-Kosten betragen $0,25 pro Million Token; Output kostet $1,00 pro Million Token. Bei einem 401-Fehler prüfe deinen Schlüssel. Ein 402 bedeutet, dass du mit USDT oder USDC aufladen musst. Ein 429 zeigt an, dass du das Limit von 300 Anfragen pro Minute erreicht hast. Guthaben verfällt nie, also lade auf, wenn es dir passt.

Technische Daten

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Base-URLhttps://api.kimiapi.top/v1
EndpunktePOST /v1/chat/completions · GET /v1/models
AuthentifizierungAuthorization: Bearer YOUR_KEY
Modell-IDuncensored
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
JSON-Modusresponse_format: {"type": "json_object"}
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Ratenlimit300 Anfragen pro Minute und Schlüssel
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Anfragegrößebis 8 MB
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Bonus+5 % ab $50, +10 % ab $100
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Wie funktioniert die Abrechnung für die Kimi API?

Du zahlst nur für tatsächliche Token-Nutzung. Input-Token kosten $0,25 pro Million, Output-Token kosten $1,00 pro Million. Fehler und Ablehnungen sind kostenlos. Guthaben ist Prepaid und verfällt nie.

Welche Krypto-Zahlungen werden akzeptiert?

Wir akzeptieren USDT (TRC20) und USDC (Base). Aufladungen liegen zwischen $10 und $500. Zahlungen werden direkt ohne Karten oder PayPal verarbeitet.

Was ist die Grenze des Kontextfensters?

Das Modell unterstützt ein Kontextfenster mit 100.000 Token für Prompt und Completion. Die maximale Ausgabe pro Anfrage beträgt jedoch 32.000 Token, es sei denn, du gibst einen niedrigeren Grenzwert an.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.