Pierwsze zapytanie w pięć minut
Wklej swój klucz API Kimi do dowolnego klienta zgodnego z OpenAI i zacznij generować tekst bez cenzury. Ten przewodnik pokazuje, jak skonfigurować SDK i zrozumieć rzeczywiste ceny tokenów.
Zainstaluj SDK OpenAI Python/Node
Zacznij od instalacji standardowej biblioteki klienta OpenAI. Działa to, ponieważ nasze API obsługuje ten sam interfejs kompatybilny z OpenAI. Nie potrzebujesz dedykowanego SDK dostawcy. Uruchom po prostu pip install openai dla Pythona lub npm install openai dla Node.js. Biblioteka automatycznie obsługuje serializację JSON i żądania HTTP.
Skonfiguruj base URL i klucz API
Skieruj klienta na nasz endpoint. Ustaw bazowy URL na https://api.kimiapi.top/v1 i podaj swój klucz API z panelu. Klucz uwierzytelnia Twój przedpłacony kredyt. Możesz wygenerować nowy klucz natychmiast przez Google lub e-mail na stronie rejestracji. Nie jest wymagana karta kredytowa, aby rozpocząć.
curl https://api.kimiapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Wyślij swoje pierwsze uzupełnienie czatu
Wyślij prostą wiadomość do modelu uncensored. Model jest dostrojony do odpowiadania bez odmów w przypadku legalnego użytku dorosłego. Obsługuje okno kontekstu o rozmiarze 100 000 tokenów, przy czym maksymalna długość odpowiedzi to 32 000 tokenów. Odpowiedź zwraca tekst bezpośrednio. Błędy i odmowy nie zużywają Twojego kredytu.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Włącz strumieniowanie za pomocą SSE
Włącz strumieniowanie dla odpowiedzi w czasie rzeczywistym. SDK przesyła tokeny za pomocą zdarzeń wysłanych przez serwer (SSE). Ostatni fragment zawiera całkowite zużycie tokenów do rozliczeń. Podejście to zmniejsza postrzegane opóźnienie przy długich odpowiedziach. Możesz przetwarzać każdy token w momencie jego przybycia w logice swojej aplikacji.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Użyj trybu JSON dla danych ustrukturyzowanych
Zapewnij spójny, czytelny dla maszyny wynik, ustawiając response_format na {"type": "json_object"}. To wymusza na modelu zwracanie poprawnego JSON. Jest to idealne do ekstrakcji danych lub generowania konfiguracji. Model nie zepsuje struktury, co ułatwia parsowanie odpowiedzi w Twoim kodzie.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Sprawdź użycie i koszty
Monitoruj swoje zużycie przez panel. Koszt wejścia to $0,25 za milion tokenów; koszt wyjścia to $1,00 za milion tokenów. Jeśli otrzymasz błąd 401, sprawdź swój klucz. Błąd 402 oznacza, że musisz doładować środki w USDT lub USDC. Błąd 429 oznacza, że przekroczyłeś limit 300 zapytań na minutę. Kredyt nigdy nie wygasa, więc doładuj go, gdy będzie Ci wygodnie.
Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Base URL | https://api.kimiapi.top/v1 |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| ID modelu | uncensored |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Rozmiar zapytania | do 8 MB |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Bonus | +5% od $50, +10% od $100 |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Jak działa rozliczanie API Kimi?
Płacisz tylko za rzeczywiste użycie tokenów. Tokeny wejściowe kosztują $0,25 za milion, a tokeny wyjściowe $1,00 za milion. Błędy i odrzucenia są darmowe. Kredyt jest przedpłacony i nigdy nie wygasa.
Jakie płatności kryptowalutami są akceptowane?
Akceptujemy USDT (TRC20) i USDC (Base). Doładowania wynoszą od $10 do $500. Płatności są przetwarzane bezpośrednio, bez kart lub PayPal.
Jaki jest limit okna kontekstu?
Model obsługuje okno kontekstu 100 000 tokenów zarówno dla promptu, jak i uzupełnienia. Maksymalne wyjście na zapytanie to jednak 32 000 tokenów, chyba że określisz niższy limit.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień base URL. To cały proces konfiguracji.