IT ▾
Ottieni la chiave API

Prima richiesta in cinque minuti

Inserisci la tua chiave API Kimi in qualsiasi client compatibile con OpenAI e inizia a generare testo senza censura. Questa guida ti mostra esattamente come configurare il tuo SDK e comprendere i prezzi reali dei token.

Installa SDK OpenAI Python/Node

Inizia installando la libreria client standard OpenAI. Funziona perché la nostra API segue la stessa interfaccia compatibile con OpenAI. Non hai bisogno di uno SDK vendor speciale. Esegui semplicemente pip install openai per Python o npm install openai per Node.js. La libreria gestisce automaticamente la serializzazione JSON e le richieste HTTP.

Configura URL base e chiave API

Indirizza il tuo client al nostro endpoint. Imposta l'URL base su https://api.kimiapi.top/v1 e fornisci la tua chiave API dal dashboard. Questa chiave autentica il tuo credito prepagato. Puoi generare una nuova chiave istantaneamente tramite Google o email nella pagina di registrazione. Non è richiesta una carta di credito per iniziare.

curl https://api.kimiapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Invia la tua prima chat completion

Invia un messaggio semplice al modello uncensored. Questo modello è ottimizzato per rispondere senza rifiuti per uso adulto lecito. Supporta una finestra di contesto da 100.000 token, sebbene l'output massimo sia di 32.000 token. La risposta restituisce testo direttamente. Errori e rifiuti non consumano il tuo credito.

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Abilita lo streaming con SSE

Per risposte in tempo reale, abilita lo streaming. L'SDK trasmette i token tramite Server-Sent Events (SSE). L'ultimo chunk contiene l'utilizzo totale dei token per la fatturazione. Questo approccio riduce la latenza percepita per output lunghi. Puoi elaborare ogni token man mano che arriva nella logica della tua applicazione.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Usa la modalità JSON per output strutturati

Assicurati un output macchina-leggibile coerente impostando response_format su {"type": "json_object"}. Questo forza il modello a restituire JSON valido. È ideale per l'estrazione di dati o la generazione di configurazioni. Il modello non romperà la struttura, rendendo più facile analizzare le risposte nel tuo codice.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Verifica utilizzo e costi

Monitora il tuo utilizzo tramite il dashboard. I costi di input sono $0,25 per milione di token; l'output è $1,00 per milione di token. Se ricevi un 401, controlla la tua chiave. Un 402 significa che devi ricaricare con USDT o USDC. Un 429 indica che hai raggiunto il limite di 300 richieste al minuto. Il credito non scade mai, quindi ricarica quando preferisci.

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
Base URLhttps://api.kimiapi.top/v1
EndpointPOST /v1/chat/completions · GET /v1/models
AutenticazioneAuthorization: Bearer YOUR_KEY
ID modellouncensored
Finestra di contesto100.000 token (input + output)
Modalità JSONresponse_format: {"type": "json_object"}
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Limite di frequenza300 richieste al minuto per chiave
Concorrenza8 richieste contemporanee per chiave
Dimensionefino a 8 MB per richiesta
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Scadenzail credito pagato non scade, nessun abbonamento
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Bonus+5% da $50, +10% da $100
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Come funziona la fatturazione per l'API Kimi?

Paghi solo per l'effettivo utilizzo dei token. I token di input costano $0,25 per milione, quelli di output $1,00 per milione. Errori e rifiuti sono gratuiti. Il credito è prepagato e non scade mai.

Quali pagamenti in criptovalute sono accettati?

Accettiamo USDT (TRC20) e USDC (Base). Le ricariche vanno da $10 a $500. I pagamenti sono elaborati direttamente senza carte o PayPal.

Qual è il limite della finestra di contesto?

Il modello supporta una finestra di contesto da 100.000 token sia per il prompt che per il completamento. Tuttavia, l'output massimo per richiesta è di 32.000 token a meno che non specifichi un limite inferiore.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.