Permintaan pertama dalam lima menit
Masukkan kunci API Kimi Anda ke klien yang kompatibel dengan OpenAI dan mulai menghasilkan teks tanpa sensor. Panduan ini menunjukkan kepada Anda cara mengonfigurasi SDK dan memahami harga token yang sebenarnya.
Instal SDK Python/Node OpenAI
Mulailah dengan menginstal pustaka klien OpenAI standar. Ini berfungsi karena API kami mengikuti antarmuka yang kompatibel dengan OpenAI. Anda tidak memerlukan SDK vendor khusus. Cukup jalankan pip install openai untuk Python atau npm install openai untuk Node.js. Pustaka ini menangani serialisasi JSON dan permintaan HTTP secara otomatis.
Konfigurasi URL Dasar dan Kunci API
Arahkan klien Anda ke endpoint kami. Atur URL dasar menjadi https://api.kimiapi.top/v1 dan berikan kunci API Anda dari dasbor. Kunci ini mengautentikasi saldo prabayar Anda. Anda dapat membuat kunci baru secara instan melalui Google atau email di halaman pendaftaran. Tidak diperlukan kartu kredit untuk memulai.
curl https://api.kimiapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Kirim Penyelesaian Chat Pertama Anda
Kirim pesan sederhana ke model uncensored. Model ini disesuaikan untuk menjawab tanpa penolakan untuk penggunaan dewasa yang sah. Model ini mendukung jendela konteks 100.000 token, meskipun output maksimum adalah 32.000 token. Respons mengembalikan teks secara langsung. Kesalahan dan penolakan tidak mengonsumsi kredit Anda.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Aktifkan Streaming dengan SSE
Untuk respons waktu nyata, aktifkan streaming. SDK mengalirkan token melalui Server-Sent Events (SSE). Chunk terakhir berisi penggunaan token total untuk penagihan. Pendekatan ini mengurangi latensi yang dirasakan untuk output panjang. Anda dapat memproses setiap token saat tiba di logika aplikasi Anda.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Gunakan Mode JSON untuk Output Terstruktur
Pastikan output yang dapat dibaca mesin secara konsisten dengan mengatur response_format menjadi {"type": "json_object"}. Ini memaksa model untuk mengembalikan JSON yang valid. Ini sangat ideal untuk ekstraksi data atau pembuatan konfigurasi. Model tidak akan merusak struktur, sehingga lebih mudah untuk mengurai respons dalam kode Anda.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Periksa Penggunaan dan Biaya
Pantau penggunaan Anda melalui dasbor. Biaya input adalah $0,25 per juta token; output adalah $1,00 per juta token. Jika Anda menerima 401, periksa kunci Anda. 402 berarti Anda perlu mengisi ulang dengan USDT atau USDC. 429 menunjukkan Anda mencapai batas 300 permintaan per menit. Saldo tidak pernah kedaluwarsa, jadi isi ulang saat nyaman.
Spesifikasi teknis
Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.
| Item | Nilai |
|---|---|
| Format | kompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci |
| Base URL | https://api.kimiapi.top/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autentikasi | Authorization: Bearer YOUR_KEY |
| ID model | uncensored |
| Jendela konteks | 100.000 token (input + output) |
| Mode JSON | response_format: {"type": "json_object"} |
| Output maksimal | hingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah) |
| Streaming | ya — server-sent events; potongan terakhir berisi penggunaan token |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool |
| Batas laju | 300 permintaan per menit per kunci |
| Konkurensi | 8 permintaan bersamaan per kunci |
| Ukuran permintaan | hingga 8 MB |
| Header respons | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Penagihan | saldo prabayar sesuai pemakaian nyata; error dan penolakan gratis |
| Masa berlaku | saldo berbayar tidak kedaluwarsa, tanpa langganan |
| Harga | $0,25 per 1 juta token input · $1,00 per 1 juta token output |
| Isi saldo | USDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500 |
| Uji coba gratis | $0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama |
| Bonus | +5% mulai $50, +10% mulai $100 |
| Masuk | Google atau email dan kata sandi |
| Kunci | satu kunci aktif per akun; kunci baru menggantikan yang lama |
| Konten | konten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak |
Kode error
Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.
| Kode | Tipe | Arti |
|---|---|---|
400 | bad_request | JSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang |
401 | missing_key · invalid_key · key_revoked | kunci tidak ada, salah, atau sudah diganti |
402 | no_credit | saldo habis — isi ulang dan lanjut seketika |
403 | content_blocked | konten seksual dengan anak di bawah umur — ditolak, tidak ditagih |
404 | not_found | endpoint tidak dikenal |
413 | request_too_large | body lebih dari 8 MB |
429 | rate_limited · concurrency | lebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi |
503 | upstream_busy | model sibuk — coba lagi beberapa detik lagi |
Tanya jawab
Bagaimana sistem penagihan untuk API Kimi?
Anda hanya membayar untuk penggunaan token yang sebenarnya. Token input berharga $0,25 per juta, dan token output berharga $1,00 per juta. Kesalahan dan penolakan gratis. Saldo prabayar tidak pernah kedaluwarsa.
Pembayaran kripto apa saja yang diterima?
Kami menerima USDT (TRC20) dan USDC (Base). Pengisian saldo berkisar antara $10 hingga $500. Pembayaran diproses secara langsung tanpa kartu atau PayPal.
Berapa batas jendela konteks?
Model ini mendukung jendela konteks 100.000 token untuk prompt dan penyelesaian. Namun, output maksimum per permintaan adalah 32.000 token kecuali Anda menentukan batas yang lebih rendah.
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kuncinya, ubah URL dasar. Itu saja seluruh pengaturannya.