Pierwsze zapytanie w pięć minut
Połącz istniejącego klienta zgodnego z OpenAI z naszym bezcenzuralnym API, zmieniając trzy linie konfiguracji. Te same SDK i narzędzia, których już używasz, działają natychmiast.
Zainstaluj SDK OpenAI
Nasz endpoint korzysta ze standardowego protokołu chat.completions, więc możesz użyć oficjalnych SDK dla wybranego języka. Dla Pythona zainstaluj pakiet przez pip. Dla Node.js użyj npm. Biblioteki te obsługują serializację, ponawianie i strumieniowanie.
pip install openai
npm install openai
Upewnij się, że używasz najnowszej wersji SDK, aby obsługiwać wszystkie parametry, takie jak tool_choice i response_format. Biblioteka klienta zarządza żądaniami HTTP, więc skup się tylko na strukturze ładunku.
Skonfiguruj Base URL i Klucz
Skieruj klienta na nasz dedykowany endpoint. Nie musisz zmieniać logiki nazwy modelu; oczekujemy, że przekażesz model: "uncensored" w swoich zapytaniach. Uwierzytelnianie odbywa się za pomocą prostego klucza API przekazanego w nagłówku.
Ustaw base_url na https://api.qwenapi.top/v1. Wygeneruj swój qwen api key w panelu. Klucz jest wyświetlany od razu po zalogowaniu się. Nie jest wymagany numer telefonu ani karta kredytowa do początkowej konfiguracji.
Podstawowe zapytanie Chat Completion
Wyślij standardowe zapytanie uzupełniające. Model zwraca odpowiedzi tekstowe bezpośrednio. Nie ma złożonych warstw routingu; rozmawiasz z jedną instancją dostrojoną do wyjść bez cenzury.
Poniżej znajduje się minimalny przykład użycia curl do weryfikacji łączności i formatu odpowiedzi.
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Odpowiedź zawiera wygenerowany tekst w choices[0].message.content. Możesz dostosować parametry, takie jak temperature i top_p, aby kontrolować kreatywność.
Odpowiedzi strumieniowe
Aby generować tokeny w czasie rzeczywistym, włącz strumieniowanie. Serwer wysyła zdarzenia wysyłane przez serwer (SSE). Ostatni fragment zawiera statystyki użycia tokenów, pozwalając na dokładne śledzenie zużycia kredytu.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Strumieniowanie jest niezbędne dla długich wyjść. Możesz parsować strumień i renderować tokeny po ich napływaniu. SDK automatycznie parsuje SSE.
Wsparcie dla wywoływania funkcji
Zdefiniuj narzędzia w swoim zapytaniu. Model zwraca strukturalne wywoływanie funkcji. Wykonujesz narzędzie, przesyłasz wynik z powrotem, a model kontynuuje. Działa to z tool_choice i standardowymi definicjami funkcji.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Tryb JSON jest również dostępny przez response_format. Użyj go, gdy potrzebujesz ścisłego wyjścia JSON bez narzutu narzędzi.
Limity, błędy i kontekst
Okno kontekstu wynosi 100 000 tokenów łącznie. Maksymalne wyjście na zapytanie to 32 000 tokenów (2,048 jeśli nieokreślone). Limity zapytań to 300 zapytań na minutę i 8 równoległych zapytań na klucz. Ciała zapytań muszą mieścić się w 8 MB.
Obsługuj błędy: 401 oznacza nieprawidłowy klucz, 402 oznacza niewystarczający kredyt, 429 oznacza przekroczenie limitu zapytań. Błędy są darmowe; płacisz tylko za zużyte tokeny. Kredyt nigdy nie wygasa. Jeśli doładujesz podwójnie, skorzystaj ze strony Wsparcie w celu naprawienia problemu.
Strumieniowanie
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| ID modelu | uncensored |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Tryb JSON | response_format: {"type": "json_object"} |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Rozmiar zapytania | do 8 MB |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Bonus | +5% od $50, +10% od $100 |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy to oficjalny API Qwen?
Nie. Jesteśmy niezależnym dostawcą uruchamiającym bezcenzuralny model językowy LLM. Nie jesteśmy powiązani z oryginalnym zespołem Qwen ani żadnym innym dostawcą. Oferujemy własną instancję dostrojoną do użytku bez cenzury.
Jak doładować kredyt?
Płatności tylko krypto przez USDT (TRC20) lub USDC (Base). Minimalne doładowanie to $10. Otrzymujesz +5% bonusu za $50+ i +10% za $100+. Nie akceptujemy kart ani PayPal.
Jaki jest rozmiar okna kontekstu?
Model obsługuje 100 000 tokenów dla połączonego promptu i uzupełnienia. Maksymalne wyjście na zapytanie to 32 000 tokenów. Jeśli nie ustawisz <code>max_tokens</code>, limit domyślnie wynosi 2,048 tokenów.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień base URL. To cała konfiguracja.