Первый запрос за пять минут
Вставьте свой API-ключ Kimi в любой клиент, совместимый с OpenAI, и начните генерацию текста без цензуры. Это руководство покажет, как настроить SDK и понять реальную стоимость токенов.
Установка SDK OpenAI для Python/Node
Начните с установки стандартной библиотеки клиента OpenAI. Это работает, потому что наш API использует тот же совместимый с OpenAI интерфейс. Вам не нужен специальный SDK поставщика. Просто выполните pip install openai для Python или npm install openai для Node.js. Библиотека автоматически обрабатывает сериализацию JSON и HTTP-запросы.
Настройка базового URL и API-ключа
Направьте клиент на наш эндпоинт. Установите базовый URL в https://api.kimiapi.top/v1 и укажите API-ключ из панели управления. Этот ключ аутентифицирует ваш предоплаченный баланс. Вы можете мгновенно создать новый ключ через Google или электронную почту на странице регистрации. Для начала не нужна кредитная карта.
curl https://api.kimiapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Отправка первого запроса на завершение чата
Отправьте простое сообщение модели uncensored. Эта модель настроена на ответы без отказов для законного использования взрослыми. Она поддерживает контекстное окно на 100 000 токенов, хотя максимальный вывод составляет 32 000 токенов. Ответ возвращается текстом напрямую. Ошибки и отказы не расходуют ваш баланс.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Включение потоковой передачи через SSE
Для получения ответов в реальном времени включите потоковую передачу. SDK передает токены через Server-Sent Events (SSE). Последний фрагмент содержит общее количество использованных токенов для учета расходов. Этот подход снижает воспринимаемую задержку при длинных выводах. Вы можете обрабатывать каждый токен по мере его поступления в логике вашего приложения.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Использование JSON-режима для структурированного вывода
Обеспечьте согласованный вывод, машино-читаемый для программ, установив response_format в {"type": "json_object"}. Это заставляет модель возвращать валидный JSON. Это идеально подходит для извлечения данных или генерации конфигураций. Модель не нарушит структуру, что упрощает парсинг ответов в вашем коде.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Проверка использования и расходов
Отслеживайте использование через панель управления. Стоимость входных данных составляет $0,25 за миллион токенов; выходные — $1,00 за миллион токенов. Если получен код 401, проверьте ключ. Код 402 означает, что нужно пополнить баланс USDT или USDC. Код 429 указывает на достижение лимита в 300 запросов в минуту. Баланс не сгорает, поэтому пополняйте его, когда удобно.
Технические характеристики
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Base URL | https://api.kimiapi.top/v1 |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Авторизация | Authorization: Bearer YOUR_KEY |
| ID модели | uncensored |
| Контекстное окно | 100 000 токенов (вход и ответ вместе) |
| JSON-режим | response_format: {"type": "json_object"} |
| Максимум ответа | до остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Лимит запросов | 300 запросов в минуту на ключ |
| Параллельные запросы | до 8 одновременно на ключ |
| Размер запроса | до 8 МБ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Бонус | +5% от $50, +10% от $100 |
| Вход | Google или e-mail и пароль |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Как работает тарификация API Kimi?
Вы платите только за фактическое использование токенов. Входные токены стоят $0,25 за миллион, выходные — $1,00 за миллион. Ошибки и отказы бесплатны. Баланс предоплачен и не сгорает.
Какие криптовалютные платежи принимаются?
Мы принимаем USDT (TRC20) и USDC (Base). Пополнения от $10 до $500. Платежи обрабатываются напрямую, без карт или PayPal.
Каков лимит контекстного окна?
Модель поддерживает контекстное окно на 100 000 токенов как для промпта, так и для ответа. Однако максимальный объем вывода за один запрос составляет 32 000 токенов, если вы не укажете меньший лимит.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.