पाँच मिनट में पहला अनुरोध
अपने मौजूदा OpenAI-संगत क्लाइंट को कॉन्फ़िगरेशन की तीन पंक्तियाँ अपडेट करके हमारे बिना सेंसर API से जोड़ें। वही SDK और टूल्स जो आप पहले ही उपयोग करते हैं, तुरंत काम करेंगे।
OpenAI SDK इंस्टॉल करें
हमारा एंडपॉइंट मानक chat.completions प्रोटोकॉल का पालन करता है, इसलिए आप अपनी पसंदीभाषा के आधिकारिक SDK का उपयोग कर सकते हैं। Python के लिए, पैकेज को pip के माध्यम से इंस्टॉल करें। Node.js के लिए, npm का उपयोग करें। ये लाइब्रेरियाँ सीरियलाइज़ेशन, पुनःप्रयास और स्ट्रीमिंग को आउट-ऑफ-द-बॉक्स हैंडल करती हैं।
pip install openai
npm install openai
सुनिश्चित करें कि आप SDK के एक हालिया संस्करण का उपयोग कर रहे हैं ताकि tool_choice और response_format जैसे सभी पैरामीटर्स का समर्थन हो सके। क्लाइंट लाइब्रेरी HTTP अनुरोधों को प्रबंधित करती है, इसलिए आपको केवल पेलोड संरचना पर ध्यान केंद्रित करने की आवश्यकता है।
बेस यूआरएल और कुंजी कॉन्फ़िगर करें
अपने क्लाइंट को हमारे समर्पित एंडपॉइंट की ओर निर्देशित करें। आपको मॉडल नाम लॉजिक को बदलने की आवश्यकता नहीं है; हम उम्मीद करते हैं कि आप अपने अनुरोधों में model: "uncensored" पास करेंगे। प्रमाणीकरण एक सरल API कुंजी को हेडर में पास करके संभाला जाता है।
base_url को https://api.qwenapi.top/v1 पर सेट करें। डैशबोर्ड पर अपनी qwen api key जनरेट करें। कुंजी साइनअप के तुरंत बाद प्रदर्शित होती है। प्रारंभिक सेटअप के लिए फ़ोन नंबर या क्रेडिट कार्ड की आवश्यकता नहीं है।
मूल चैट पूर्णता अनुरोध
एक मानक पूर्णता अनुरोध भेजें। मॉडल टेक्स्ट प्रतिक्रियाएँ सीधे देता है। कोई जटिल रूटिंग परतें नहीं हैं; आप बिना सेंसर आउटपुट के लिए ट्यून्ड एकल इंस्टेंस से बात कर रहे हैं।
कनेक्टिविटी और प्रतिक्रिया प्रारूप की जाँच करने के लिए curl का उपयोग करके नीचे एक न्यूनतम उदाहरण दिया गया है।
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'प्रतिक्रिया में choices[0].message.content में जनरेटेड टेक्स्ट होता है। आप रचनात्मकता को नियंत्रित करने के लिए temperature और top_p जैसे पैरामीटर समायोजित कर सकते हैं।
स्ट्रीमिंग प्रतिक्रियाएँ
वास्तविक समय टोकन जनरेशन के लिए, स्ट्रीमिंग को सक्षम करें। सर्वर सर्वर-सेंट इवेंट्स (SSE) भेजता है। अंतिम चंक में टोकन उपयोग के आँकड़े शामिल होते हैं, जिससे आप क्रेडिट खपत की सटीक निगरानी कर सकते हैं।
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
लंबे आउटपुट के लिए स्ट्रीमिंग आवश्यक है। आप स्ट्रीम को पार्स कर सकते हैं और टोकन को आने पर रेंडर कर सकते हैं। SDK SSE पार्सिंग को स्वचालित रूप से संभालता है।
फ़ंक्शन कॉलिंग समर्थन
अपने अनुरोध में टूल्स परिभाषित करें। मॉडल संरचित टूल कॉल लौटाता है। आप टूल निष्पादित करते हैं, परिणाम वापस पास करते हैं, और मॉडल जारी रखता है। यह tool_choice और मानक फ़ंक्शन परिभाषाओं के साथ काम करता है।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
JSON मोड response_format के माध्यम से भी उपलब्ध है। जब आपको टूल ओवरहेड के बिना कठोर JSON आउटपुट की आवश्यकता हो, तो इसका उपयोग करें।
सीमाएँ, त्रुटियाँ और कॉन्टेक्स्ट
कॉन्टेक्स्ट विंडो कुल 100,000 टोकन है। प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है (अनिर्दिष्ट होने पर 2,048)। रेट लिमिट प्रति मिनट 300 अनुरोध और प्रति कुंजी 8 समानांतर अनुरोध हैं। अनुरोध बॉडी 8 MB से कम रहनी चाहिए।
त्रुटियों को संभालें: 401 का अर्थ अमान्य कुंजी है, 402 का अर्थ अपर्याप्त क्रेडिट है, 429 का अर्थ रेट लिमिट पार हो गया है। त्रुटियाँ मुफ़्त हैं; आप केवल खपित टोकन के लिए भुगतान करते हैं। क्रेडिट कभी समाप्त नहीं होता है। यदि डबल चार्ज होता है, तो समाधान के लिए सपोर्ट पेज का उपयोग करें।
स्ट्रीमिंग
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)तकनीकी विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| मॉडल ID | uncensored |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON मोड | response_format: {"type": "json_object"} |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| अनुरोध का आकार | 8 MB तक |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| बोनस | $50 से +5%, $100 से +10% |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
| साइन इन | Google या ईमेल और पासवर्ड |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
क्या यह आधिकारिक Qwen API है?
नहीं। हम एक स्वतंत्र प्रदाता हैं जो एक बिना सेंसर बड़े भाषा मॉडल चला रहे हैं। हम मूल Qwen टीम या किसी अन्य विक्रेता से संबद्ध नहीं हैं। हम बिना सेंसर उपयोग के लिए अनुकूलित अपनी ही इंसटेंस प्रदान करते हैं।
मैं क्रेडिट कैसे टॉप-अप करूँ?
भुगतान केवल USDT (TRC20) या USDC (Base) के माध्यम से क्रिप्टो-मात्र है। न्यूनतम टॉप-अप $10 है। $50+ के लिए +5% बोनस और $100+ के लिए +10% बोनस मिलता है। कार्ड या PayPal स्वीकार नहीं किया जाता है।
कॉन्टेक्स्ट विंडो का आकार क्या है?
मॉडल संयुक्त प्रॉम्प्ट और पूर्णता के लिए 100,000 टोकन का समर्थन करता है। प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है। यदि आप <code>max_tokens</code> सेट नहीं करते हैं, तो सीमा डिफ़ॉल्ट रूप से 2,048 टोकन पर हो जाती है।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएँ, कुंजी कॉपी करें, बेस यूआरएल बदलें। यही पूरी सेटअप है।