Primera petición en cinco minutos
Conecta tu cliente compatible con OpenAI a nuestra API sin censura actualizando tres líneas de configuración. Los mismos SDKs y herramientas que ya usas funcionan de inmediato.
Instalar el SDK de OpenAI
Nuestro endpoint sigue el protocolo estándar chat.completions, por lo que puedes usar los SDKs oficiales de tu lenguaje preferido. Para Python, instala el paquete vía pip. Para Node.js, usa npm. Estas bibliotecas manejan la serialización, los reintentos y el streaming de forma predeterminada.
pip install openai
npm install openai
Asegúrate de usar una versión reciente del SDK para admitir todos los parámetros como tool_choice y response_format. La biblioteca de cliente gestiona las peticiones HTTP, así que solo necesitas centrarte en la estructura del payload.
Configurar URL base y clave
Apunta tu cliente a nuestro endpoint dedicado. No necesitas cambiar la lógica del nombre del modelo; esperamos que pases model: "uncensored" en tus peticiones. La autenticación se maneja mediante una clave de API simple pasada en el encabezado.
Configura el base_url como https://api.qwenapi.top/v1. Genera tu qwen api key en el panel de control. La clave se muestra inmediatamente después de registrarte. No se requiere número de teléfono ni tarjeta de crédito para la configuración inicial.
Petición básica de finalización de chat
Envía una petición de finalización estándar. El modelo devuelve respuestas de texto directamente. No hay capas de enrutamiento complejas; estás hablando con una única instancia ajustada para salidas sin censura.
A continuación se muestra un ejemplo mínimo usando curl para verificar la conectividad y el formato de respuesta.
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'La respuesta contiene el texto generado en choices[0].message.content. Puedes ajustar parámetros como temperature y top_p para controlar la creatividad.
Respuestas en streaming
Para la generación de tokens en tiempo real, habilita el streaming. El servidor envía Server-Sent Events (SSE). El último fragmento incluye estadísticas de uso de tokens, lo que te permite rastrear el consumo de crédito con precisión.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
El streaming es esencial para salidas largas. Puedes analizar el flujo y renderizar los tokens a medida que llegan. El SDK analiza el SSE automáticamente.
Soporte para llamadas a funciones
Define herramientas en tu petición. El modelo devuelve llamadas a herramientas estructuradas. Ejecutas la herramienta, pasas el resultado de vuelta y el modelo continúa. Esto funciona con tool_choice y definiciones de funciones estándar.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
El modo JSON también está disponible vía response_format. Úsalo cuando necesites una salida JSON estricta sin la sobrecarga de herramientas.
Límites, errores y contexto
La ventana de contexto es de 100,000 tokens en total. La salida máxima por petición es de 32,000 tokens (2,048 si no se especifica). Los límites de peticiones son de 300 peticiones por minuto y 8 peticiones simultáneas por clave. Los cuerpos de las peticiones deben permanecer por debajo de 8 MB.
Maneja los errores: 401 significa clave inválida, 402 significa crédito insuficiente, 429 significa límite de peticiones excedido. Los errores son gratuitos; solo pagas por los tokens consumidos. El crédito no caduca. Si se te cobra dos veces, usa la página de Soporte para solucionarlo.
Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Especificaciones técnicas
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| Autenticación | Authorization: Bearer YOUR_KEY |
| ID del modelo | uncensored |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Límite de peticiones | 300 por minuto por clave |
| Tamaño de petición | hasta 8 MB |
| Concurrencia | 8 peticiones a la vez por clave |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Bono | +5 % desde $50, +10 % desde $100 |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
Errores y qué hacer
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es esta la API oficial de Qwen?
No. Somos un proveedor independiente que ejecuta un modelo de lenguaje grande sin censura. No estamos afiliados al equipo original de Qwen ni a ningún otro proveedor. Ofrecemos nuestra propia instancia ajustada para uso sin censura.
¿Cómo recargo el crédito?
Los pagos son solo con criptomonedas mediante USDT (TRC20) o USDC (Base). El recargo mínimo es de $10. Obtienes un bono del +5% para $50+ y del +10% para $100+. No aceptamos tarjetas ni PayPal.
¿Cuál es el tamaño de la ventana de contexto?
El modelo admite 100,000 tokens para el prompt y la respuesta combinados. La salida máxima por petición es de 32,000 tokens. Si no estableces <code>max_tokens</code>, el límite predeterminado es de 2,048 tokens.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.