PL ▾
Pobierz klucz API

Pierwsze zapytanie w pięć minut

Wklej swój klucz API Kimi do dowolnego klienta zgodnego z OpenAI i zacznij generować tekst bez cenzury. Ten przewodnik pokazuje, jak skonfigurować SDK i zrozumieć rzeczywiste ceny tokenów.

Zainstaluj SDK OpenAI Python/Node

Zacznij od instalacji standardowej biblioteki klienta OpenAI. Działa to, ponieważ nasze API obsługuje ten sam interfejs kompatybilny z OpenAI. Nie potrzebujesz dedykowanego SDK dostawcy. Uruchom po prostu pip install openai dla Pythona lub npm install openai dla Node.js. Biblioteka automatycznie obsługuje serializację JSON i żądania HTTP.

Skonfiguruj base URL i klucz API

Skieruj klienta na nasz endpoint. Ustaw bazowy URL na https://api.kimiapi.top/v1 i podaj swój klucz API z panelu. Klucz uwierzytelnia Twój przedpłacony kredyt. Możesz wygenerować nowy klucz natychmiast przez Google lub e-mail na stronie rejestracji. Nie jest wymagana karta kredytowa, aby rozpocząć.

curl https://api.kimiapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Wyślij swoje pierwsze uzupełnienie czatu

Wyślij prostą wiadomość do modelu uncensored. Model jest dostrojony do odpowiadania bez odmów w przypadku legalnego użytku dorosłego. Obsługuje okno kontekstu o rozmiarze 100 000 tokenów, przy czym maksymalna długość odpowiedzi to 32 000 tokenów. Odpowiedź zwraca tekst bezpośrednio. Błędy i odmowy nie zużywają Twojego kredytu.

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Włącz strumieniowanie za pomocą SSE

Włącz strumieniowanie dla odpowiedzi w czasie rzeczywistym. SDK przesyła tokeny za pomocą zdarzeń wysłanych przez serwer (SSE). Ostatni fragment zawiera całkowite zużycie tokenów do rozliczeń. Podejście to zmniejsza postrzegane opóźnienie przy długich odpowiedziach. Możesz przetwarzać każdy token w momencie jego przybycia w logice swojej aplikacji.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Użyj trybu JSON dla danych ustrukturyzowanych

Zapewnij spójny, czytelny dla maszyny wynik, ustawiając response_format na {"type": "json_object"}. To wymusza na modelu zwracanie poprawnego JSON. Jest to idealne do ekstrakcji danych lub generowania konfiguracji. Model nie zepsuje struktury, co ułatwia parsowanie odpowiedzi w Twoim kodzie.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Sprawdź użycie i koszty

Monitoruj swoje zużycie przez panel. Koszt wejścia to $0,25 za milion tokenów; koszt wyjścia to $1,00 za milion tokenów. Jeśli otrzymasz błąd 401, sprawdź swój klucz. Błąd 402 oznacza, że musisz doładować środki w USDT lub USDC. Błąd 429 oznacza, że przekroczyłeś limit 300 zapytań na minutę. Kredyt nigdy nie wygasa, więc doładuj go, gdy będzie Ci wygodnie.

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
Base URLhttps://api.kimiapi.top/v1
EndpointyPOST /v1/chat/completions · GET /v1/models
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Tryb JSONresponse_format: {"type": "json_object"}
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Limit zapytań300 zapytań na minutę na klucz
Równoległe zapytaniado 8 jednocześnie na klucz
Rozmiar zapytaniado 8 MB
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Bonus+5% od $50, +10% od $100
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Jak działa rozliczanie API Kimi?

Płacisz tylko za rzeczywiste użycie tokenów. Tokeny wejściowe kosztują $0,25 za milion, a tokeny wyjściowe $1,00 za milion. Błędy i odrzucenia są darmowe. Kredyt jest przedpłacony i nigdy nie wygasa.

Jakie płatności kryptowalutami są akceptowane?

Akceptujemy USDT (TRC20) i USDC (Base). Doładowania wynoszą od $10 do $500. Płatności są przetwarzane bezpośrednio, bez kart lub PayPal.

Jaki jest limit okna kontekstu?

Model obsługuje okno kontekstu 100 000 tokenów zarówno dla promptu, jak i uzupełnienia. Maksymalne wyjście na zapytanie to jednak 32 000 tokenów, chyba że określisz niższy limit.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień base URL. To cały proces konfiguracji.