IT ▾
qwenapi.topOttieni la chiave API

Prima richiesta in cinque minuti

Collega il tuo client compatibile con OpenAI alla nostra API senza censura aggiornando tre righe di configurazione. Gli stessi SDK e strumenti che usi già funzionano immediatamente.

Installa l'SDK OpenAI

Il nostro endpoint segue il protocollo standard chat.completions, quindi puoi utilizzare gli SDK ufficiali del tuo linguaggio preferito. Per Python, installa il pacchetto tramite pip. Per Node.js, usa npm. Queste librerie gestiscono serializzazione, ritentativi e streaming direttamente.

pip install openai

npm install openai

Assicurati di usare una versione recente dell'SDK per supportare tutti i parametri come tool_choice e response_format. La libreria client gestisce le richieste HTTP, quindi devi concentrarti solo sulla struttura del payload.

Configura URL di base e chiave

Indirizza il tuo client al nostro endpoint dedicato. Non devi modificare la logica del nome del modello; ci aspettiamo che tu passi model: "uncensored" nelle tue richieste. L'autenticazione è gestita tramite una semplice chiave API passata nell'header.

Imposta base_url su https://api.qwenapi.top/v1. Genera la tua qwen api key dalla dashboard. La chiave appare subito dopo la registrazione. Non servono numero di telefono o carta di credito per la configurazione iniziale.

Richiesta di completamento chat di base

Invia una richiesta di completamento standard. Il modello restituisce risposte testuali direttamente. Non ci sono layer di routing complessi; stai parlando con un'unica istanza ottimizzata per output senza censura.

Di seguito è riportato un esempio minimo che usa curl per verificare la connettività e il formato della risposta.

curl https://api.qwenapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La risposta contiene il testo generato in choices[0].message.content. Puoi regolare parametri come temperature e top_p per controllare la creatività.

Risposte in streaming

Per la generazione di token in tempo reale, abilita lo streaming. Il server invia Server-Sent Events (SSE). L'ultimo chunk include statistiche sull'utilizzo dei token, consentendoti di tracciare con precisione il consumo di credito.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Lo streaming è essenziale per output lunghi. Puoi analizzare lo stream e visualizzare i token al loro arrivo. L'SDK gestisce automaticamente l'analisi SSE.

Supporto chiamata di funzioni

Definisci gli strumenti nella tua richiesta. Il modello restituisce chiamate di strumenti strutturate. Esecuti lo strumento, passi il risultato e il modello continua. Questo funziona con tool_choice e definizioni di funzioni standard.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

La modalità JSON è disponibile anche tramite response_format. Usala quando hai bisogno di un output JSON rigoroso senza overhead degli strumenti.

Limiti, errori e contesto

La finestra di contesto è di 100.000 token in totale. L'output massimo per richiesta è di 32.000 token (2.048 se non specificato). I limiti di richiesta sono 300 richieste al minuto e 8 richieste parallele per chiave. I corpi delle richieste devono rimanere sotto 8 MB.

Gestisci gli errori: 401 significa chiave non valida, 402 significa credito insufficiente, 429 significa limite di richieste superato. Gli errori sono gratuiti; paghi solo per i token consumati. Il credito non scade mai. Se c'è un doppio addebito, usa la pagina Supporto per una risoluzione.

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.qwenapi.top/v1
AutenticazioneAuthorization: Bearer YOUR_KEY
ID modellouncensored
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Finestra di contesto100.000 token (input + output)
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Modalità JSONresponse_format: {"type": "json_object"}
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
Concorrenza8 richieste contemporanee per chiave
Scadenzail credito pagato non scade, nessun abbonamento
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Bonus+5% da $50, +10% da $100
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

È l'API ufficiale di Qwen?

No. Siamo un provider indipendente che esegue un modello linguistico di grandi dimensioni senza censura. Non siamo affiliati al team originale di Qwen né ad altri fornitori. Serviamo la nostra istanza ottimizzata per l'uso senza censura.

Come ricarico il credito?

I pagamenti sono solo in criptovalute tramite USDT (TRC20) o USDC (Base). Il minimo per la ricarica è $10. Ottieni un bonus del +5% per $50+ e del +10% per $100+. Non accettiamo carte o PayPal.

Qual è la dimensione della finestra di contesto?

Il modello supporta 100.000 token per il prompt e il completamento combinati. L'output massimo per richiesta è di 32.000 token. Se non imposti <code>max_tokens</code>, il limite predefinito è di 2.048 token.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API