TH ▾
รับคีย์ API

ส่งคำขอแรกในห้านาที

ใส่คีย์ API Kimi ของคุณลงในไคลเอนต์ที่เข้ากันได้กับ OpenAI และเริ่มสร้างข้อความแบบไม่เซ็นเซอร์ คู่มือนี้แสดงวิธีกำหนดค่า SDK ของคุณและทำความเข้าใจราคาโทเคนจริง

ติดตั้ง OpenAI Python/Node SDK

เริ่มต้นด้วยการติดตั้งไลบรารีไคลเอนต์มาตรฐานของ OpenAI สิ่งนี้ใช้งานได้เพราะ API ของเราใช้อินเทอร์เฟซที่เข้ากันได้กับ OpenAI คุณไม่จำเป็นต้องใช้ SDK พิเศษ แค่รัน pip install openai สำหรับ Python หรือ npm install openai สำหรับ Node.js ไลบรารีนี้จะจัดการการ serialize JSON และการส่งคำขอ HTTP ให้โดยอัตโนมัติ

กำหนดค่า Base URL และคีย์ API

ชี้ไคลเอนต์ของคุณไปยังเอนด์พอยต์ของเรา ตั้งค่า base URL เป็น https://api.kimiapi.top/v1 และระบุ API key จากแดชบอร์ด คีย์นี้จะยืนยันเครดิตแบบเติมเงินล่วงหน้าของคุณ คุณสามารถสร้างคีย์ใหม่ได้ทันทีผ่าน Google หรืออีเมลในหน้าลงทะเบียน ไม่จำเป็นต้องใช้บัตรเครดิตเพื่อเริ่มต้น

curl https://api.kimiapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

ส่ง Chat Completion ครั้งแรกของคุณ

ส่งข้อความง่ายไปยังโมเดล uncensored ตอบได้โดยไม่ปฏิเสธ ใช้ context window 100,000 โทเคน แต่ max output 32,000 โทเคน ส่งข้อความตรง ข้อผิดพลาดไม่ตัดเครดิต

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

เปิดใช้งานสตรีมมิงด้วย SSE

สำหรับการตอบกลับแบบเรียลไทม์ ให้เปิดใช้งานสตรีมมิง SDK จะสตรีมโทเคนผ่าน Server-Sent Events (SSE) ชิ้นสุดท้ายประกอบด้วยข้อมูลการใช้โทเคนทั้งหมดสำหรับการเรียกเก็บเงิน วิธีนี้ช่วยลดความล่าช้าที่รับรู้สำหรับผลลัพธ์ที่ยาว คุณสามารถประมวลผลแต่ละโทเคนเมื่อมาถึงในตรรกะแอปพลิเคชันของคุณ

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

ใช้โหมด JSON สำหรับเอาต์พุตที่มีโครงสร้าง

รับรองเอาต์พุตที่อ่านโดยเครื่องได้อย่างสม่ำเสมอโดยการตั้งค่า response_format เป็น {"type": "json_object"} สิ่งนี้บังคับให้โมเดลส่งคืน JSON ที่ถูกต้อง เหมาะสำหรับการดึงข้อมูลหรือการสร้างการกำหนดค่า โมเดลจะไม่ทำลายโครงสร้าง ทำให้แยกการตอบกลับในโค้ดของคุณง่ายขึ้น

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

ตรวจสอบการใช้งานและค่าใช้จ่าย

ตรวจสอบการใช้งานของคุณผ่านแดชบอร์ด ค่าอินพุตคือ $0.25 ต่อล้านโทเคน; เอาต์พุตคือ $1.00 ต่อล้านโทเคน หากคุณได้รับ 401 ให้ตรวจสอบคีย์ของคุณ 402 หมายถึงคุณต้องเติมเงินด้วย USDT หรือ USDC 429 หมายถึงคุณถึงขีดจำกัด 300 คำขอต่อนาที เครดิตไม่หมดอายุ ดังนั้นให้เติมเงินเมื่อสะดวก

ข้อมูลจำเพาะทางเทคนิค

ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน

รายการค่า
รูปแบบ APIรองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์
Base URLhttps://api.kimiapi.top/v1
เอนด์พอยต์POST /v1/chat/completions · GET /v1/models
การยืนยันตัวตนAuthorization: Bearer YOUR_KEY
ID โมเดลuncensored
หน้าต่างบริบท100,000 โทเคน (อินพุตรวมเอาต์พุต)
โหมด JSONresponse_format: {"type": "json_object"}
เอาต์พุตสูงสุดได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก)
สตรีมมิงรองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้
พารามิเตอร์temperature, top_p, stop, seed, presence_penalty, frequency_penalty
การเรียกใช้ฟังก์ชันรองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool
ขีดจำกัดอัตรา300 คำขอต่อนาทีต่อคีย์
คำขอพร้อมกันสูงสุด 8 คำขอพร้อมกันต่อคีย์
ขนาดคำขอไม่เกิน 8 MB
เฮดเดอร์ของคำตอบX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
การคิดเงินเครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน
อายุเครดิตเครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน
ราคา$0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต
เติมเงินUSDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500
เครดิตทดลองใช้ฟรี$0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก
โบนัส+5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100
เข้าสู่ระบบGoogle หรืออีเมลและรหัสผ่าน
คีย์หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม
เนื้อหาอนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์

รหัสข้อผิดพลาด

ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน

รหัสประเภทความหมาย
400bad_requestJSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท
401missing_key · invalid_key · key_revokedไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว
402no_creditเครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที
403content_blockedเนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน
404not_foundไม่รู้จักเอนด์พอยต์
413request_too_largeขนาดเกิน 8 MB
429rate_limited · concurrencyเกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่
503upstream_busyโมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที

ถาม-ตอบ

ระบบบิลลิ่งของ Kimi API ทำงานอย่างไร?

คุณจ่ายเฉพาะการใช้โทเคนจริง โทเคนอินพุตราคา $0.25 ต่อล้าน และโทเคนเอาต์พุตราคา $1.00 ต่อล้าน ข้อผิดพลาดและการปฏิเสธฟรี เครดิตแบบเติมเงินล่วงหน้าและไม่หมดอายุ

ยอมรับการชำระเงินคริปโตสกุลใดบ้าง?

เรายอมรับ USDT (TRC20) และ USDC (Base) การเติมเงินอยู่ระหว่าง $10 ถึง $500 การชำระเงินดำเนินการโดยตรงโดยไม่ต้องใช้บัตรหรือ PayPal

ขีดจำกัดหน้าต่างบริบทคือเท่าใด?

โมเดลรองรับหน้าต่างบริบท 100,000 โทเคนสำหรับทั้งพรอมต์และ completion อย่างไรก็ตาม เอาต์พุตสูงสุดต่อคำขอคือ 32,000 โทเคน เว้นแต่คุณจะระบุขีดจำกัดที่ต่ำกว่า

คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว

สร้างบัญชี คัดลอกคีย์ เปลี่ยน base URL นั่นคือการตั้งค่าทั้งหมด