Prima richiesta in cinque minuti
Collega il tuo client compatibile con OpenAI alla nostra API senza censura aggiornando tre righe di configurazione. Gli stessi SDK e strumenti che usi già funzionano immediatamente.
Installa l'SDK OpenAI
Il nostro endpoint segue il protocollo standard chat.completions, quindi puoi utilizzare gli SDK ufficiali del tuo linguaggio preferito. Per Python, installa il pacchetto tramite pip. Per Node.js, usa npm. Queste librerie gestiscono serializzazione, ritentativi e streaming direttamente.
pip install openai
npm install openai
Assicurati di usare una versione recente dell'SDK per supportare tutti i parametri come tool_choice e response_format. La libreria client gestisce le richieste HTTP, quindi devi concentrarti solo sulla struttura del payload.
Configura URL di base e chiave
Indirizza il tuo client al nostro endpoint dedicato. Non devi modificare la logica del nome del modello; ci aspettiamo che tu passi model: "uncensored" nelle tue richieste. L'autenticazione è gestita tramite una semplice chiave API passata nell'header.
Imposta base_url su https://api.qwenapi.top/v1. Genera la tua qwen api key dalla dashboard. La chiave appare subito dopo la registrazione. Non servono numero di telefono o carta di credito per la configurazione iniziale.
Richiesta di completamento chat di base
Invia una richiesta di completamento standard. Il modello restituisce risposte testuali direttamente. Non ci sono layer di routing complessi; stai parlando con un'unica istanza ottimizzata per output senza censura.
Di seguito è riportato un esempio minimo che usa curl per verificare la connettività e il formato della risposta.
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'La risposta contiene il testo generato in choices[0].message.content. Puoi regolare parametri come temperature e top_p per controllare la creatività.
Risposte in streaming
Per la generazione di token in tempo reale, abilita lo streaming. Il server invia Server-Sent Events (SSE). L'ultimo chunk include statistiche sull'utilizzo dei token, consentendoti di tracciare con precisione il consumo di credito.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Lo streaming è essenziale per output lunghi. Puoi analizzare lo stream e visualizzare i token al loro arrivo. L'SDK gestisce automaticamente l'analisi SSE.
Supporto chiamata di funzioni
Definisci gli strumenti nella tua richiesta. Il modello restituisce chiamate di strumenti strutturate. Esecuti lo strumento, passi il risultato e il modello continua. Questo funziona con tool_choice e definizioni di funzioni standard.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
La modalità JSON è disponibile anche tramite response_format. Usala quando hai bisogno di un output JSON rigoroso senza overhead degli strumenti.
Limiti, errori e contesto
La finestra di contesto è di 100.000 token in totale. L'output massimo per richiesta è di 32.000 token (2.048 se non specificato). I limiti di richiesta sono 300 richieste al minuto e 8 richieste parallele per chiave. I corpi delle richieste devono rimanere sotto 8 MB.
Gestisci gli errori: 401 significa chiave non valida, 402 significa credito insufficiente, 429 significa limite di richieste superato. Gli errori sono gratuiti; paghi solo per i token consumati. Il credito non scade mai. Se c'è un doppio addebito, usa la pagina Supporto per una risoluzione.
Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Finestra di contesto | 100.000 token (input + output) |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modalità JSON | response_format: {"type": "json_object"} |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Bonus | +5% da $50, +10% da $100 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
È l'API ufficiale di Qwen?
No. Siamo un provider indipendente che esegue un modello linguistico di grandi dimensioni senza censura. Non siamo affiliati al team originale di Qwen né ad altri fornitori. Serviamo la nostra istanza ottimizzata per l'uso senza censura.
Come ricarico il credito?
I pagamenti sono solo in criptovalute tramite USDT (TRC20) o USDC (Base). Il minimo per la ricarica è $10. Ottieni un bonus del +5% per $50+ e del +10% per $100+. Non accettiamo carte o PayPal.
Qual è la dimensione della finestra di contesto?
Il modello supporta 100.000 token per il prompt e il completamento combinati. L'output massimo per richiesta è di 32.000 token. Se non imposti <code>max_tokens</code>, il limite predefinito è di 2.048 token.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.