Erste Anfrage in fünf Minuten
Verbinde deinen OpenAI-kompatiblen Client mit unserer unzensierten API. Ändere drei Konfigurationszeilen. Deine SDKs funktionieren sofort.
OpenAI-SDK installieren
Unser Endpunkt folgt dem Standard-chat.completions-Protokoll, sodass du die offiziellen SDKs aus deiner bevorzugten Sprache nutzen kannst. Für Python installierst du das Paket über pip. Für Node.js nutzt du npm. Diese Bibliotheken behandeln Serialisierung, Retries und Streaming out of the box.
pip install openai
npm install openai
Stelle sicher, dass du eine aktuelle Version des SDK verwendest, um alle Parameter wie tool_choice und response_format zu unterstützen. Die Client-Bibliothek übernimmt die HTTP-Anfragen, sodass du dich nur auf die Payload-Struktur konzentrieren musst.
Base URL und Schlüssel konfigurieren
Richte deinen Client auf unseren dedizierten Endpunkt ein. Du musst die Modellnamenslogik nicht ändern; wir erwarten, dass du model: "uncensored" in deinen Anfragen übergibst. Die Authentifizierung erfolgt über einen einfachen API-Schlüssel im Header.
Setze die base_url auf https://api.qwenapi.top/v1. Generiere deinen qwen api key im Dashboard. Der Schlüssel wird direkt nach der Anmeldung angezeigt. Für die initiale Einrichtung sind keine Telefonnummer oder Kreditkarte erforderlich.
Einfache Chat-Vervollständigungsanfrage
Sende eine Standard-Anfrage. Das Modell gibt Text zurück. Keine komplexen Schichten; du sprichst direkt mit einer auf unzensierte Ausgaben optimierten Instanz.
Hier ist ein minimales curl-Beispiel zur Überprüfung von Verbindung und Antwortformat.
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Die Antwort enthält den generierten Text in choices[0].message.content. Du kannst Parameter wie temperature und top_p anpassen, um die Kreativität zu steuern.
Streaming-Antworten
Aktiviere Streaming für Echtzeit-Token. Der Server sendet SSE. Das letzte Chunk enthält Token-Statistiken für genaue Guthabenverfolgung.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Streaming ist für lange Ausgaben essenziell. Du kannst den Stream parsen und Token rendern, sobald sie eintreffen. Das SDK übernimmt das SSE-Parsing automatisch.
Unterstützung für Function Calling
Definiere Tools in deiner Anfrage. Das Modell gibt strukturierte tool_calls zurück. Du führst das Tool aus, übergibst das Ergebnis zurück und das Modell fährt fort. Das funktioniert mit tool_choice und standardmäßigen Funktionsdefinitionen.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Der JSON-Modus ist über response_format verfügbar. Nutze ihn für striktes JSON ohne Tool-Overhead.
Grenzen, Fehler und Kontext
Das Kontextfenster umfasst insgesamt 100.000 Token. Maximaler Output pro Anfrage: 32.000 Token (2.048, wenn nicht angegeben). Ratenlimits: 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel. Anfragekörper müssen unter 8 MB bleiben.
Behandle Fehler: 401 bedeutet ungültiger Schlüssel, 402 bedeutet unzureichendes Guthaben, 429 bedeutet Ratenlimit überschritten. Fehler sind kostenlos; du zahlst nur für verbrauchte Token. Guthaben verfällt nie. Bei einer Doppelbelastung nutze die Support-Seite zur Behebung.
Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Technische Daten
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.qwenapi.top/v1 |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-Modus | response_format: {"type": "json_object"} |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dies die offizielle Qwen-API?
Nein. Wir sind ein unabhängiger Anbieter, der ein unzensiertes Large Language Model betreibt. Wir stehen nicht im Zusammenhang mit dem ursprünglichen Qwen-Team oder einem anderen Anbieter. Wir bedienen unsere eigene Instanz, die für den unzensierten Einsatz optimiert ist.
Wie lade ich Guthaben auf?
Zahlungen erfolgen ausschließlich per Krypto über USDT (TRC20) oder USDC (Base). Mindestaufladung: 10 $. Du erhältst +5 % Bonus ab 50 $ und +10 % ab 100 $. Keine Karten oder PayPal.
Wie groß ist das Kontextfenster?
Das Modell unterstützt 100.000 Token für Prompt und Antwort zusammen. Maximal 32.000 Token pro Anfrage. Ohne <code>max_tokens</code> gelten 2.048 Token.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.