คำขอแรกในห้านาที
เชื่อมต่อไคลเอนต์ที่เข้ากันได้กับ OpenAI ของคุณกับ API ไม่เซ็นเซอร์ของเราโดยการอัปเดตบรรทัดการกำหนดค่าสามบรรทัด SDK และเครื่องมือที่คุณใช้อยู่แล้วทำงานได้ทันที
ติดตั้ง OpenAI SDK
เอนด์พอยต์ของเราปฏิบัติตามโปรโตคอล chat.completions มาตรฐาน คุณสามารถใช้ SDK ทางการจากภาษาที่คุณต้องการได้ สำหรับ Python ให้ติดตั้งแพ็กเกจผ่าน pip สำหรับ Node.js ให้ใช้ npm ไลบรารีเหล่านี้จัดการการ serialize การทำซ้ำ และการสตรีมมิงได้ทันที
pip install openai
npm install openai
ตรวจสอบให้แน่ใจว่าคุณกำลังใช้เวอร์ชันล่าสุดของ SDK เพื่อรองรับพารามิเตอร์ทั้งหมดเช่น tool_choice และ response_format ไลบรารีไคลเอนต์จัดการคำขอ HTTP ดังนั้นคุณจึงต้องโฟกัสเฉพาะโครงสร้างของ payload
กำหนดค่า Base URL และคีย์
ชี้ไคลเอนต์ของคุณไปยังเอนด์พอยต์เฉพาะของเรา คุณไม่จำเป็นต้องเปลี่ยนตรรกะชื่อโมเดล; เราคาดหวังให้คุณส่ง model: "uncensored" ในคำขอของคุณ การตรวจสอบสิทธิ์จัดการผ่านคีย์ API อย่างง่ายที่ส่งในหัวเรื่อง
ตั้งค่า base_url เป็น https://api.qwenapi.top/v1 สร้าง qwen api key จากแดชบอร์ด คีย์แสดงทันทีหลังสมัคร ไม่ต้องการเบอร์โทรหรือบัตรเครดิตสำหรับการตั้งค่าเริ่มต้น
คำขอการตอบกลับแชทพื้นฐาน
ส่งคำขอการตอบกลับมาตรฐาน โมเดลจะส่งข้อความตอบกลับโดยตรง ไม่มีชั้นการกำหนดเส้นทางที่ซับซ้อน; คุณกำลังพูดคุยกับอินสแตนซ์เดียวที่ปรับแต่งสำหรับการส่งออกแบบไม่เซ็นเซอร์
ด้านล่างคือตัวอย่างขั้นต่ำโดยใช้ curl เพื่อตรวจสอบการเชื่อมต่อและรูปแบบการตอบกลับ
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'การตอบกลับมีข้อความที่สร้างใน choices[0].message.content คุณสามารถปรับพารามิเตอร์เช่น temperature และ top_p เพื่อควบคุมความคิดสร้างสรรค์
การตอบกลับแบบสตรีมมิง
สำหรับการสร้างโทเคนแบบเรียลไทม์ ให้เปิดใช้งานสตรีมมิง เซิร์ฟเวอร์ส่ง Server-Sent Events (SSE) ชิ้นสุดท้ายรวมถึงสถิติการใช้โทเคน ทำให้คุณสามารถติดตามการบริโภคเครดิตได้อย่างแม่นยำ
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
สตรีมมิงมีความจำเป็นสำหรับผลลัพธ์ที่ยาว คุณสามารถแยกวิเคราะห์สตรีมและแสดงผลโทเคนเมื่อมาถึง ไลบรารี SDK จัดการการแยกวิเคราะห์ SSE โดยอัตโนมัติ
รองรับการเรียกใช้ฟังก์ชัน
กำหนดเครื่องมือในคำขอของคุณ โมเดลจะส่งการเรียกใช้เครื่องมือที่มีโครงสร้าง คุณดำเนินการเครื่องมือ ส่งผลลัพธ์กลับ และโมเดลจะดำเนินการต่อ สิ่งนี้ทำงานกับ tool_choice และคำจำกัดความของฟังก์ชันมาตรฐาน
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
โหมด JSON ก็พร้อมใช้งานผ่าน response_format ใช้เมื่อคุณต้องการผลลัพธ์ JSON ที่เข้มงวดโดยไม่มีความหนักของเครื่องมือ
ขีดจำกัด ข้อผิดพลาด และบริบท
หน้าต่างบริบทคือ 100,000 โทเคนรวม ผลลัพธ์สูงสุดต่อคำขอคือ 32,000 โทเคน (2,048 หากไม่ได้ระบุ) ขีดจำกัดอัตราคือ 300 คำขอต่อนาทีและ 8 คำขอพร้อมกันต่อคีย์ ร่างคำขอต้องอยู่ใต้ 8 MB
จัดการข้อผิดพลาด: 401 หมายถึงคีย์ไม่ถูกต้อง, 402 หมายถึงเครดิตไม่เพียงพอ, 429 หมายถึงเกินขีดจำกัดอัตรา ข้อผิดพลาดไม่มีค่าใช้จ่าย; คุณจ่ายเฉพาะสำหรับโทเคนที่ใช้งานจริง เครดิตไม่หมดอายุ หากมีการเรียกเก็บเงินซ้ำ ให้ใช้หน้า Support เพื่อแก้ไข
สตรีมมิง
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)ข้อมูลจำเพาะทางเทคนิค
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| ID โมเดล | uncensored |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| โหมด JSON | response_format: {"type": "json_object"} |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
นี่คือ API Qwen ทางการหรือไม่?
ไม่ เราเป็นผู้ให้บริการอิสระที่รันโมเดลภาษาขนาดใหญ่แบบไม่เซ็นเซอร์ เราไม่มีความเกี่ยวข้องกับทีม Qwen ดั้งเดิมหรือผู้จัดจำหน่ายรายอื่น เราให้บริการอินสแตนซ์ของเราเองที่ปรับแต่งสำหรับการใช้งานแบบไม่เซ็นเซอร์
ฉันจะเติมเงินเครดิตได้อย่างไร?
ชำระเงินด้วยคริปโตเท่านั้นผ่าน USDT (TRC20) หรือ USDC (Base) การเติมเงินขั้นต่ำคือ $10 คุณได้รับโบนัส +5% สำหรับ $50+ และ +10% สำหรับ $100+ ไม่รับบัตรเครดิตหรือ PayPal
ขนาดหน้าต่างบริบทคือเท่าไหร่?
โมเดลรองรับ 100,000 โทเคนสำหรับพรอมต์และการตอบกลับรวมกัน ผลลัพธ์สูงสุดต่อคำขอคือ 32,000 โทเคน หากคุณไม่ได้ตั้งค่า <code>max_tokens</code> ขีดจำกัดจะอยู่ที่ 2,048 โทเคน
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน base URL นั่นคือการตั้งค่าทั้งหมด