Prima richiesta in cinque minuti
Inserisci la tua chiave API Kimi in qualsiasi client compatibile con OpenAI e inizia a generare testo senza censura. Questa guida ti mostra esattamente come configurare il tuo SDK e comprendere i prezzi reali dei token.
Installa SDK OpenAI Python/Node
Inizia installando la libreria client standard OpenAI. Funziona perché la nostra API segue la stessa interfaccia compatibile con OpenAI. Non hai bisogno di uno SDK vendor speciale. Esegui semplicemente pip install openai per Python o npm install openai per Node.js. La libreria gestisce automaticamente la serializzazione JSON e le richieste HTTP.
Configura URL base e chiave API
Indirizza il tuo client al nostro endpoint. Imposta l'URL base su https://api.kimiapi.top/v1 e fornisci la tua chiave API dal dashboard. Questa chiave autentica il tuo credito prepagato. Puoi generare una nuova chiave istantaneamente tramite Google o email nella pagina di registrazione. Non è richiesta una carta di credito per iniziare.
curl https://api.kimiapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Invia la tua prima chat completion
Invia un messaggio semplice al modello uncensored. Questo modello è ottimizzato per rispondere senza rifiuti per uso adulto lecito. Supporta una finestra di contesto da 100.000 token, sebbene l'output massimo sia di 32.000 token. La risposta restituisce testo direttamente. Errori e rifiuti non consumano il tuo credito.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Abilita lo streaming con SSE
Per risposte in tempo reale, abilita lo streaming. L'SDK trasmette i token tramite Server-Sent Events (SSE). L'ultimo chunk contiene l'utilizzo totale dei token per la fatturazione. Questo approccio riduce la latenza percepita per output lunghi. Puoi elaborare ogni token man mano che arriva nella logica della tua applicazione.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Usa la modalità JSON per output strutturati
Assicurati un output macchina-leggibile coerente impostando response_format su {"type": "json_object"}. Questo forza il modello a restituire JSON valido. È ideale per l'estrazione di dati o la generazione di configurazioni. Il modello non romperà la struttura, rendendo più facile analizzare le risposte nel tuo codice.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Verifica utilizzo e costi
Monitora il tuo utilizzo tramite il dashboard. I costi di input sono $0,25 per milione di token; l'output è $1,00 per milione di token. Se ricevi un 401, controlla la tua chiave. Un 402 significa che devi ricaricare con USDT o USDC. Un 429 indica che hai raggiunto il limite di 300 richieste al minuto. Il credito non scade mai, quindi ricarica quando preferisci.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Base URL | https://api.kimiapi.top/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Finestra di contesto | 100.000 token (input + output) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Bonus | +5% da $50, +10% da $100 |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Come funziona la fatturazione per l'API Kimi?
Paghi solo per l'effettivo utilizzo dei token. I token di input costano $0,25 per milione, quelli di output $1,00 per milione. Errori e rifiuti sono gratuiti. Il credito è prepagato e non scade mai.
Quali pagamenti in criptovalute sono accettati?
Accettiamo USDT (TRC20) e USDC (Base). Le ricariche vanno da $10 a $500. I pagamenti sono elaborati direttamente senza carte o PayPal.
Qual è il limite della finestra di contesto?
Il modello supporta una finestra di contesto da 100.000 token sia per il prompt che per il completamento. Tuttavia, l'output massimo per richiesta è di 32.000 token a meno che non specifichi un limite inferiore.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.