पहला अनुरोध पांच मिनट में
अपनी Kimi API कुंजी किसी भी OpenAI-संगत क्लाइंट में डालें और बिना सेंसर टेक्स्ट जनरेट करना शुरू करें। यह गाइड आपको दिखाती है कि अपने SDK को कैसे कॉन्फ़िगर करें और वास्तविक टोकन मूल्य निर्धारण को समझें।
OpenAI Python/Node SDK इंस्टॉल करें
मानक OpenAI क्लाइंट लाइब्रेरी को इंस्टॉल करके शुरू करें। यह काम करता है क्योंकि हमारा API समान OpenAI-कम्पैटिबल इंटरफ़ेस का पालन करता है। आपको किसी विशेष वेंडर SDK की आवश्यकता नहीं है। बस Python के लिए pip install openai या Node.js के लिए npm install openai चलाएं। लाइब्रेरी स्वचालित रूप से JSON सीरियलाइज़ेशन और HTTP अनुरोध संभालती है।
बेस URL और API कुंजी कॉन्फ़िगर करें
अपने क्लाइंट को हमारे एंडपॉइंट की ओर निर्देशित करें। बेस URL को https://api.kimiapi.top/v1 पर सेट करें और डैशबोर्ड से अपनी API कुंजी प्रदान करें। यह कुंजी आपके प्रीपेड क्रेडिट को प्रमाणीकृत करती है। आप साइन-अप पेज पर Google या ईमेल के माध्यम से तुरंत एक नई कुंजी जनरेट कर सकते हैं। शुरू करने के लिए कोई क्रेडिट कार्ड की आवश्यकता नहीं है।
curl https://api.kimiapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
अपना पहला चैट पूर्णता अनुरोध भेजें
uncensored मॉडल को एक सरल संदेश भेजें। यह मॉडल कानूनी वयस्क उपयोग के लिए अस्वीकृतियों के बिना उत्तर देने के लिए ट्यून्ड है। यह 100,000-टोकन कॉन्टेक्स्ट विंडो का समर्थन करता है, हालांकि अधिकतम आउटपुट 32,000 टोकन है। प्रतिक्रिया सीधे टेक्स्ट लौटाती है। त्रुटियां और अस्वीकृतियां आपके क्रेडिट का उपभोग नहीं करतीं।
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SSE के साथ स्ट्रीमिंग सक्षम करें
वास्तविक समय के उत्तरों के लिए, स्ट्रीमिंग सक्षम करें। SDK टोकन को Server-Sent Events (SSE) के माध्यम से स्ट्रीम करता है। अंतिम चंक बिलिंग के लिए कुल टोकन उपयोग दर्शाता है। यह दृष्टिगोचर विलंबता को कम करता है। आप अपने एप्लिकेशन लॉजिक में आने वाले प्रत्येक टोकन को संभाल सकते हैं।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
संरचित आउटपुट के लिए JSON मोड का उपयोग करें
response_format को {"type": "json_object"} पर सेट करके संगत मशीन-पठनीय आउटपुट सुनिश्चित करें। यह मॉडल को वैध JSON लौटने पर मजबूर करता है। यह डेटा एक्सट्रैक्शन या कॉन्फ़िगरेशन जनरेशन के लिए आदर्श है। मॉडल संरचना को तोड़ेगा नहीं, जिससे आपके कोड में प्रतिक्रियाओं को पार्स करना आसान हो जाता है।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
उपयोग और लागत की जांच करें
डैशबोर्ड के माध्यम से अपने उपयोग की निगरानी करें। इनपुट लागत प्रति मिलियन टोकन $0.25 है; आउटपुट प्रति मिलियन टोकन $1.00 है। यदि आपको 401 मिलता है, तो अपनी कुंजी की जांच करें। 402 का मतलब है कि आपको USDT या USDC के साथ टॉप-अप करने की आवश्यकता है। 429 का संकेत है कि आपने प्रति मिनट 300 अनुरोध सीमा को छुआ है। क्रेडिट कभी समाप्त नहीं होता, इसलिए जब सुविधा हो तब टॉप-अप करें।
तकनीकी विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| Base URL | https://api.kimiapi.top/v1 |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| मॉडल ID | uncensored |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| JSON मोड | response_format: {"type": "json_object"} |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| अनुरोध का आकार | 8 MB तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| बोनस | $50 से +5%, $100 से +10% |
| साइन इन | Google या ईमेल और पासवर्ड |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
Kimi API के लिए बिलिंग कैसे काम करती है?
आप केवल वास्तविक टोकन उपयोग के लिए भुगतान करते हैं। इनपुट टोकन के लिए $0.25 प्रति मिलियन और आउटपुट टोकन के लिए $1.00 प्रति मिलियन लागत है। त्रुटियां और अस्वीकृतियां मुफ्त हैं। क्रेडिट प्रीपेड है और कभी समाप्त नहीं होता।
कौन से क्रिप्टो भुगतान स्वीकार किए जाते हैं?
हम USDT (TRC20) और USDC (Base) स्वीकार करते हैं। टॉप-अप $10 से $500 की सीमा में होते हैं। भुगतान कार्ड या PayPal के बिना सीधे संसाधित किए जाते हैं।
कॉन्टेक्स्ट विंडो सीमा क्या है?
मॉडल प्रॉम्प्ट और उत्तर दोनों के लिए 100,000-टोकन की कॉन्टेक्स्ट विंडो का समर्थन करता है। हालांकि, यदि आप कम सीमा निर्दिष्ट नहीं करते हैं, तो प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।