Primeira requisição em cinco minutos
Conecte seu cliente compatível com OpenAI à nossa API sem censura atualizando três linhas de configuração. Os mesmos SDKs e ferramentas que você já usa funcionam imediatamente.
Instale o SDK do OpenAI
Nosso endpoint segue o protocolo padrão chat.completions, permitindo que você use os SDKs oficiais da linguagem de sua preferência. Para Python, instale o pacote via pip. Para Node.js, use npm. Essas bibliotecas lidam com serialização, retentativas e streaming nativamente.
pip install openai
npm install openai
Certifique-se de usar uma versão recente do SDK para suportar todos os parâmetros, como tool_choice e response_format. A biblioteca de cliente gerencia as requisições HTTP, então você só precisa se preocupar com a estrutura do payload.
Configure URL Base e Chave
Aponte seu cliente para nosso endpoint dedicado. Você não precisa alterar a lógica do nome do modelo; esperamos que você passe model: "uncensored" em suas requisições. A autenticação é feita por meio de uma chave de API simples passada no cabeçalho.
Defina o base_url para https://api.qwenapi.top/v1. Gere sua qwen api key no painel. A chave é exibida imediatamente após o cadastro. Não é necessário número de telefone ou cartão de crédito para a configuração inicial.
Requisição Básica de Conclusão de Chat
Envie uma requisição de conclusão padrão. O modelo retorna respostas de texto diretamente. Não há camadas complexas de roteamento; você está falando com uma única instância ajustada para saídas sem censura.
Abaixo está um exemplo mínimo usando curl para verificar a conectividade e o formato da resposta.
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'A resposta contém o texto gerado em choices[0].message.content. Você pode ajustar parâmetros como temperature e top_p para controlar a criatividade.
Respostas em Streaming
Para geração de tokens em tempo real, ative o streaming. O servidor envia Server-Sent Events (SSE). O último chunk inclui estatísticas de uso de tokens, permitindo que você acompanhe o consumo de crédito com precisão.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
O streaming é essencial para saídas longas. Você pode analisar o stream e renderizar os tokens conforme chegam. O SDK faz a análise do SSE automaticamente.
Suporte à Chamada de Funções
Defina ferramentas em sua requisição. O modelo retorna chamadas de ferramentas estruturadas. Você executa a ferramenta, passa o resultado de volta e o modelo continua. Isso funciona com tool_choice e definições padrão de funções.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
O modo JSON também está disponível via response_format. Use-o quando precisar de saída JSON estrita sem a sobrecarga de ferramentas.
Limites, Erros e Contexto
A janela de contexto é de 100.000 tokens no total. A saída máxima por requisição é de 32.000 tokens (2.048 se não especificado). Os limites de taxa são de 300 requisições por minuto e 8 requisições simultâneas por chave. Os corpos das requisições devem permanecer abaixo de 8 MB.
Trate erros: 401 significa chave inválida, 402 significa crédito insuficiente, 429 significa limite de taxa excedido. Erros são gratuitos; você paga apenas pelos tokens consumidos. O crédito nunca expira. Se houver cobrança dupla, use a página de Suporte para resolver.
Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Especificações técnicas
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| Autenticação | Authorization: Bearer YOUR_KEY |
| ID do modelo | uncensored |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de taxa | 300 requisições por minuto por chave |
| Tamanho | até 8 MB por requisição |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Validade | crédito pago não expira, sem assinatura |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Esta é a API oficial do Qwen?
Não. Somos um provedor independente que executa um modelo de linguagem grande sem censura. Não temos afiliação com a equipe original do Qwen ou qualquer outro fornecedor. Oferecemos nossa própria instância ajustada para uso sem censura.
Como recarregar o crédito?
Os pagamentos são exclusivos em criptomoedas via USDT (TRC20) ou USDC (Base). O valor mínimo de recarga é US$ 10. Você recebe bônus de +5% para depósitos de US$ 50+ e +10% para US$ 100+. Não aceitamos cartões ou PayPal.
Qual é o tamanho da janela de contexto?
O modelo suporta 100.000 tokens para o prompt e a conclusão combinados. A saída máxima por requisição é de 32.000 tokens. Se você não definir <code>max_tokens</code>, o limite padrão é de 2.048 tokens.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave e altere a URL base. Essa é toda a configuração necessária.