Erste Anfrage in fünf Minuten
Gib deinen Kimi API-Schlüssel in einen OpenAI-kompatiblen Client ein und beginne mit der Generierung unzensierter Texte. Diese Anleitung zeigt dir genau, wie du dein SDK konfigurierst und die echten Token-Preise verstehst.
OpenAI Python/Node SDK installieren
Beginne mit der Installation der Standard-OpenAI-Clientbibliothek. Das funktioniert, weil unsere API derselben OpenAI-kompatiblen Schnittstelle folgt. Du benötigst kein spezielles Anbieter-SDK. Führe einfach pip install openai für Python oder npm install openai für Node.js aus. Die Bibliothek übernimmt die JSON-Serialisierung und HTTP-Anfragen automatisch.
Basis-URL und API-Schlüssel konfigurieren
Richte deinen Client auf unseren Endpunkt ein. Lege die Basis-URL auf https://api.kimiapi.top/v1 fest und gib deinen API-Schlüssel aus dem Dashboard ein. Dieser Schlüssel authentifiziert dein Prepaid-Guthaben. Du kannst einen neuen Schlüssel sofort über Google oder E-Mail auf der Anmeldeseite generieren. Keine Kreditkarte erforderlich.
curl https://api.kimiapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Erste Chat-Vervollständigung senden
Sende eine einfache Nachricht an das uncensored-Modell. Dieses Modell ist darauf ausgelegt, ohne Ablehnungen zu antworten, für die rechtliche Nutzung durch Erwachsene. Es unterstützt ein Kontextfenster mit 100.000 Token, wobei die maximale Ausgabe 32.000 Token beträgt. Die Antwort wird direkt als Text zurückgegeben. Fehler und Ablehnungen verbrauchen nicht dein Guthaben.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Streaming mit SSE aktivieren
Aktiviere für Echtzeit-Antworten das Streaming. Das SDK streamt Token über Server-Sent Events (SSE). Das letzte Chunk enthält die gesamte Token-Nutzung für die Abrechnung. Dieser Ansatz reduziert die wahrgenommene Latenz bei langen Ausgaben. Du kannst jeden Token verarbeiten, sobald er in deiner Anwendungslogik eingeht.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
JSON-Modus für strukturierte Ausgaben verwenden
Stelle eine konsistente, maschinenlesbare Ausgabe sicher, indem du response_format auf {"type": "json_object"} setzt. Dies zwingt das Modell, gültiges JSON zurückzugeben. Es ist ideal für Datenextraktion oder Konfigurationsgenerierung. Das Modell bricht die Struktur nicht, was das Parsen der Antworten in deinem Code erleichtert.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Nutzung und Kosten prüfen
Überwache deine Nutzung über das Dashboard. Input-Kosten betragen $0,25 pro Million Token; Output kostet $1,00 pro Million Token. Bei einem 401-Fehler prüfe deinen Schlüssel. Ein 402 bedeutet, dass du mit USDT oder USDC aufladen musst. Ein 429 zeigt an, dass du das Limit von 300 Anfragen pro Minute erreicht hast. Guthaben verfällt nie, also lade auf, wenn es dir passt.
Technische Daten
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Base-URL | https://api.kimiapi.top/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Anfragegröße | bis 8 MB |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Wie funktioniert die Abrechnung für die Kimi API?
Du zahlst nur für tatsächliche Token-Nutzung. Input-Token kosten $0,25 pro Million, Output-Token kosten $1,00 pro Million. Fehler und Ablehnungen sind kostenlos. Guthaben ist Prepaid und verfällt nie.
Welche Krypto-Zahlungen werden akzeptiert?
Wir akzeptieren USDT (TRC20) und USDC (Base). Aufladungen liegen zwischen $10 und $500. Zahlungen werden direkt ohne Karten oder PayPal verarbeitet.
Was ist die Grenze des Kontextfensters?
Das Modell unterstützt ein Kontextfenster mit 100.000 Token für Prompt und Completion. Die maximale Ausgabe pro Anfrage beträgt jedoch 32.000 Token, es sei denn, du gibst einen niedrigeren Grenzwert an.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.