PL ▾
qwenapi.topPobierz klucz API

Pierwsze zapytanie w pięć minut

Połącz istniejącego klienta zgodnego z OpenAI z naszym bezcenzuralnym API, zmieniając trzy linie konfiguracji. Te same SDK i narzędzia, których już używasz, działają natychmiast.

Zainstaluj SDK OpenAI

Nasz endpoint korzysta ze standardowego protokołu chat.completions, więc możesz użyć oficjalnych SDK dla wybranego języka. Dla Pythona zainstaluj pakiet przez pip. Dla Node.js użyj npm. Biblioteki te obsługują serializację, ponawianie i strumieniowanie.

pip install openai

npm install openai

Upewnij się, że używasz najnowszej wersji SDK, aby obsługiwać wszystkie parametry, takie jak tool_choice i response_format. Biblioteka klienta zarządza żądaniami HTTP, więc skup się tylko na strukturze ładunku.

Skonfiguruj Base URL i Klucz

Skieruj klienta na nasz dedykowany endpoint. Nie musisz zmieniać logiki nazwy modelu; oczekujemy, że przekażesz model: "uncensored" w swoich zapytaniach. Uwierzytelnianie odbywa się za pomocą prostego klucza API przekazanego w nagłówku.

Ustaw base_url na https://api.qwenapi.top/v1. Wygeneruj swój qwen api key w panelu. Klucz jest wyświetlany od razu po zalogowaniu się. Nie jest wymagany numer telefonu ani karta kredytowa do początkowej konfiguracji.

Podstawowe zapytanie Chat Completion

Wyślij standardowe zapytanie uzupełniające. Model zwraca odpowiedzi tekstowe bezpośrednio. Nie ma złożonych warstw routingu; rozmawiasz z jedną instancją dostrojoną do wyjść bez cenzury.

Poniżej znajduje się minimalny przykład użycia curl do weryfikacji łączności i formatu odpowiedzi.

curl https://api.qwenapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Odpowiedź zawiera wygenerowany tekst w choices[0].message.content. Możesz dostosować parametry, takie jak temperature i top_p, aby kontrolować kreatywność.

Odpowiedzi strumieniowe

Aby generować tokeny w czasie rzeczywistym, włącz strumieniowanie. Serwer wysyła zdarzenia wysyłane przez serwer (SSE). Ostatni fragment zawiera statystyki użycia tokenów, pozwalając na dokładne śledzenie zużycia kredytu.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Strumieniowanie jest niezbędne dla długich wyjść. Możesz parsować strumień i renderować tokeny po ich napływaniu. SDK automatycznie parsuje SSE.

Wsparcie dla wywoływania funkcji

Zdefiniuj narzędzia w swoim zapytaniu. Model zwraca strukturalne wywoływanie funkcji. Wykonujesz narzędzie, przesyłasz wynik z powrotem, a model kontynuuje. Działa to z tool_choice i standardowymi definicjami funkcji.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Tryb JSON jest również dostępny przez response_format. Użyj go, gdy potrzebujesz ścisłego wyjścia JSON bez narzutu narzędzi.

Limity, błędy i kontekst

Okno kontekstu wynosi 100 000 tokenów łącznie. Maksymalne wyjście na zapytanie to 32 000 tokenów (2,048 jeśli nieokreślone). Limity zapytań to 300 zapytań na minutę i 8 równoległych zapytań na klucz. Ciała zapytań muszą mieścić się w 8 MB.

Obsługuj błędy: 401 oznacza nieprawidłowy klucz, 402 oznacza niewystarczający kredyt, 429 oznacza przekroczenie limitu zapytań. Błędy są darmowe; płacisz tylko za zużyte tokeny. Kredyt nigdy nie wygasa. Jeśli doładujesz podwójnie, skorzystaj ze strony Wsparcie w celu naprawienia problemu.

Strumieniowanie

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
EndpointyPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.qwenapi.top/v1
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Tryb JSONresponse_format: {"type": "json_object"}
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limit zapytań300 zapytań na minutę na klucz
Rozmiar zapytaniado 8 MB
Równoległe zapytaniado 8 jednocześnie na klucz
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Bonus+5% od $50, +10% od $100
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Czy to oficjalny API Qwen?

Nie. Jesteśmy niezależnym dostawcą uruchamiającym bezcenzuralny model językowy LLM. Nie jesteśmy powiązani z oryginalnym zespołem Qwen ani żadnym innym dostawcą. Oferujemy własną instancję dostrojoną do użytku bez cenzury.

Jak doładować kredyt?

Płatności tylko krypto przez USDT (TRC20) lub USDC (Base). Minimalne doładowanie to $10. Otrzymujesz +5% bonusu za $50+ i +10% za $100+. Nie akceptujemy kart ani PayPal.

Jaki jest rozmiar okna kontekstu?

Model obsługuje 100 000 tokenów dla połączonego promptu i uzupełnienia. Maksymalne wyjście na zapytanie to 32 000 tokenów. Jeśli nie ustawisz <code>max_tokens</code>, limit domyślnie wynosi 2,048 tokenów.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień base URL. To cała konfiguracja.

Pobierz klucz API