PT ▾
qwenapi.topObter chave de API

Primeira requisição em cinco minutos

Conecte seu cliente compatível com OpenAI à nossa API sem censura atualizando três linhas de configuração. Os mesmos SDKs e ferramentas que você já usa funcionam imediatamente.

Instale o SDK do OpenAI

Nosso endpoint segue o protocolo padrão chat.completions, permitindo que você use os SDKs oficiais da linguagem de sua preferência. Para Python, instale o pacote via pip. Para Node.js, use npm. Essas bibliotecas lidam com serialização, retentativas e streaming nativamente.

pip install openai

npm install openai

Certifique-se de usar uma versão recente do SDK para suportar todos os parâmetros, como tool_choice e response_format. A biblioteca de cliente gerencia as requisições HTTP, então você só precisa se preocupar com a estrutura do payload.

Configure URL Base e Chave

Aponte seu cliente para nosso endpoint dedicado. Você não precisa alterar a lógica do nome do modelo; esperamos que você passe model: "uncensored" em suas requisições. A autenticação é feita por meio de uma chave de API simples passada no cabeçalho.

Defina o base_url para https://api.qwenapi.top/v1. Gere sua qwen api key no painel. A chave é exibida imediatamente após o cadastro. Não é necessário número de telefone ou cartão de crédito para a configuração inicial.

Requisição Básica de Conclusão de Chat

Envie uma requisição de conclusão padrão. O modelo retorna respostas de texto diretamente. Não há camadas complexas de roteamento; você está falando com uma única instância ajustada para saídas sem censura.

Abaixo está um exemplo mínimo usando curl para verificar a conectividade e o formato da resposta.

curl https://api.qwenapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

A resposta contém o texto gerado em choices[0].message.content. Você pode ajustar parâmetros como temperature e top_p para controlar a criatividade.

Respostas em Streaming

Para geração de tokens em tempo real, ative o streaming. O servidor envia Server-Sent Events (SSE). O último chunk inclui estatísticas de uso de tokens, permitindo que você acompanhe o consumo de crédito com precisão.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

O streaming é essencial para saídas longas. Você pode analisar o stream e renderizar os tokens conforme chegam. O SDK faz a análise do SSE automaticamente.

Suporte à Chamada de Funções

Defina ferramentas em sua requisição. O modelo retorna chamadas de ferramentas estruturadas. Você executa a ferramenta, passa o resultado de volta e o modelo continua. Isso funciona com tool_choice e definições padrão de funções.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

O modo JSON também está disponível via response_format. Use-o quando precisar de saída JSON estrita sem a sobrecarga de ferramentas.

Limites, Erros e Contexto

A janela de contexto é de 100.000 tokens no total. A saída máxima por requisição é de 32.000 tokens (2.048 se não especificado). Os limites de taxa são de 300 requisições por minuto e 8 requisições simultâneas por chave. Os corpos das requisições devem permanecer abaixo de 8 MB.

Trate erros: 401 significa chave inválida, 402 significa crédito insuficiente, 429 significa limite de taxa excedido. Erros são gratuitos; você paga apenas pelos tokens consumidos. O crédito nunca expira. Se houver cobrança dupla, use a página de Suporte para resolver.

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Especificações técnicas

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.qwenapi.top/v1
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Janela de contexto100.000 tokens (entrada + saída)
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Modo JSONresponse_format: {"type": "json_object"}
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite de taxa300 requisições por minuto por chave
Tamanhoaté 8 MB por requisição
Concorrência8 requisições ao mesmo tempo por chave
Validadecrédito pago não expira, sem assinatura
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Bônus+5% a partir de $50, +10% a partir de $100
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha
Chavesuma chave ativa por conta; uma nova substitui a anterior

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Esta é a API oficial do Qwen?

Não. Somos um provedor independente que executa um modelo de linguagem grande sem censura. Não temos afiliação com a equipe original do Qwen ou qualquer outro fornecedor. Oferecemos nossa própria instância ajustada para uso sem censura.

Como recarregar o crédito?

Os pagamentos são exclusivos em criptomoedas via USDT (TRC20) ou USDC (Base). O valor mínimo de recarga é US$ 10. Você recebe bônus de +5% para depósitos de US$ 50+ e +10% para US$ 100+. Não aceitamos cartões ou PayPal.

Qual é o tamanho da janela de contexto?

O modelo suporta 100.000 tokens para o prompt e a conclusão combinados. A saída máxima por requisição é de 32.000 tokens. Se você não definir <code>max_tokens</code>, o limite padrão é de 2.048 tokens.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave e altere a URL base. Essa é toda a configuração necessária.

Obter chave de API