Première requête en cinq minutes
Connectez votre client compatible OpenAI à notre API sans censure en modifiant trois lignes de configuration. Les mêmes SDK et outils que vous utilisez déjà fonctionnent immédiatement.
Installer le SDK OpenAI
Notre endpoint suit le protocole standard chat.completions, ce qui vous permet d'utiliser les SDK officiels de votre langage préféré. Pour Python, installez le package via pip. Pour Node.js, utilisez npm. Ces bibliothèques gèrent la sérialisation, les réessais et le streaming nativement.
pip install openai
npm install openai
Assurez-vous d'utiliser une version récente du SDK pour prendre en charge tous les paramètres comme tool_choice et response_format. La bibliothèque cliente gère les requêtes HTTP, vous n'avez donc qu'à vous concentrer sur la structure des données.
Configurer l'URL de base et la clé
Configurez votre client pour qu'il pointe vers notre endpoint dédié. Vous n'avez pas besoin de modifier la logique du nom du modèle ; nous attendons que vous passiez model: "uncensored" dans vos requêtes. L'authentification est gérée via une clé API simple transmise dans l'en-tête.
Définissez base_url sur https://api.qwenapi.top/v1. Générez votre qwen api key sur le tableau de bord. La clé est affichée immédiatement après l'inscription. Aucun numéro de téléphone ni carte bancaire n'est requis pour la configuration initiale.
Requête de complétion de chat basique
Envoyez une requête de complétion standard. Le modèle renvoie des réponses textuelles directement. Il n'y a pas de couches de routage complexes ; vous vous adressez à une seule instance ajustée pour des sorties sans censure.
Voici un exemple minimal utilisant curl pour vérifier la connectivité et le format de réponse.
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'La réponse contient le texte généré dans choices[0].message.content. Vous pouvez ajuster des paramètres comme temperature et top_p pour contrôler la créativité.
Réponses en streaming
Pour la génération de tokens en temps réel, activez le streaming. Le serveur envoie des Server-Sent Events (SSE). Le dernier chunk inclut les statistiques d'utilisation des tokens, vous permettant de suivre précisément la consommation de crédit.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Le streaming est essentiel pour les sorties longues. Vous pouvez analyser le flux et restituer les tokens à leur arrivée. Le SDK gère automatiquement l'analyse du SSE.
Prise en charge de l'appel de fonctions
Définissez des outils dans votre requête. Le modèle renvoie des appels d'outils structurés. Vous exécutez l'outil, renvoyez le résultat et le modèle continue. Cela fonctionne avec tool_choice et les définitions d'outils standard.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Le mode JSON est également disponible via response_format. Utilisez-le lorsque vous avez besoin d'une sortie JSON stricte sans surcharge d'outils.
Limites, erreurs et contexte
La fenêtre de contexte est de 100 000 tokens au total. La sortie maximale par requête est de 32 000 tokens (2 048 si non spécifié). Les limites de débit sont de 300 requêtes par minute et 8 requêtes simultanées par clé. Les corps de requête doivent rester inférieurs à 8 Mo.
Gérez les erreurs : 401 signifie clé invalide, 402 signifie crédit insuffisant, 429 signifie limite de débit dépassée. Les erreurs sont gratuites ; vous ne payez que pour les tokens consommés. Le crédit n'expire jamais. En cas de double facturation, utilisez la page Support pour une correction.
Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| Concurrence | 8 requêtes simultanées par clé |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
S'agit-il de l'API officielle Qwen ?
Non. Nous sommes un fournisseur indépendant exécutant un modèle de langage large sans censure. Nous ne sommes pas affiliés à l'équipe Qwen originale ni à aucun autre fournisseur. Nous servons notre propre instance ajustée pour une utilisation sans censure.
Comment recharger du crédit ?
Les paiements sont exclusivement en crypto via USDT (TRC20) ou USDC (Base). Le rechargement minimum est de 10 $. Vous bénéficiez d'un bonus de +5 % pour 50 $+ et de +10 % pour 100 $+. Aucune carte ni PayPal n'est acceptée.
Quelle est la taille de la fenêtre de contexte ?
Le modèle prend en charge 100 000 tokens pour le prompt et la complétion combinés. La sortie maximale par requête est de 32 000 tokens. Si vous ne définissez pas <code>max_tokens</code>, la limite par défaut est de 2 048 tokens.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.