Первый запрос за пять минут
Подключите ваш клиент, совместимый с OpenAI, к нашему API без цензуры, изменив три строки конфигурации. Те же SDK и инструменты, которые вы уже используете, работают сразу.
Установите SDK OpenAI
Наш эндпоинт следует стандартному протоколу chat.completions, поэтому вы можете использовать официальные SDK на вашем предпочитаемом языке. Для Python установите пакет через pip. Для Node.js используйте npm. Эти библиотеки обрабатывают сериализацию, повторные попытки и потоковую передачу из коробки.
pip install openai
npm install openai
Убедитесь, что вы используете последнюю версию SDK для поддержки параметров, таких как tool_choice и response_format. Библиотека управляет HTTP-запросами, поэтому вам нужно сосредоточиться только на структуре полезной нагрузки.
Настройте базовый URL и ключ
Направьте ваш клиент на наш выделенный эндпоинт. Не нужно менять логику имени модели; ожидаем, что вы передадите model: "uncensored" в запросах. Аутентификация осуществляется с помощью простого API-ключа в заголовке.
Установите base_url в https://api.qwenapi.top/v1. Сгенерируйте свой qwen api key на панели управления. Ключ отображается сразу после регистрации. Для начальной настройки не требуются номер телефона или кредитная карта.
Базовый запрос на завершение чата
Отправьте стандартный запрос на completion. Модель возвращает текстовые ответы напрямую. Нет сложных слоёв маршрутизации; вы общаетесь с одним экземпляром, настроенным на вывод без цензуры.
Ниже приведен минимальный пример с использованием curl для проверки подключения и формата ответа.
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Ответ содержит сгенерированный текст в choices[0].message.content. Вы можете настроить параметры, такие как temperature и top_p, чтобы контролировать креативность.
Потоковые ответы
Для генерации токенов в реальном времени включите потоковую передачу. Сервер отправляет Server-Sent Events (SSE). Последний чанк содержит статистику использования токенов, что позволяет точно отслеживать расход средств.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Потоковая передача необходима для длинных выводов. Вы можете парсить поток и отображать токены по мере их поступления. SDK автоматически обрабатывает парсинг SSE.
Поддержка вызова функций
Определите инструменты в запросе. Модель возвращает структурированные вызовы инструментов. Вы выполняете инструмент, передаете результат обратно, и модель продолжает работу. Это работает с tool_choice и стандартными определениями функций.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
JSON-режим также доступен через response_format. Используйте его, когда нужен строгий вывод JSON без накладных расходов на инструменты.
Лимиты, ошибки и контекст
Контекстное окно составляет 100 000 токенов суммарно. Максимальный вывод на запрос — 32 000 токенов (2 048, если не указано иное). Лимит запросов — 300 запросов в минуту и 8 параллельных запросов на ключ. Тело запроса должно быть не более 8 МБ.
Обработка ошибок: 401 означает неверный ключ, 402 — недостаточный предоплаченный баланс, 429 — превышен лимит запросов. Ошибки бесплатны; вы платите только за потребленные токены. Предоплаченный баланс не сгорает. При двойном списании используйте страницу поддержки для исправления.
Потоковая передача
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Технические характеристики
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| Авторизация | Authorization: Bearer YOUR_KEY |
| ID модели | uncensored |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Контекстное окно | 100 000 токенов (вход и ответ вместе) |
| Максимум ответа | до остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-режим | response_format: {"type": "json_object"} |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Лимит запросов | 300 запросов в минуту на ключ |
| Размер запроса | до 8 МБ |
| Параллельные запросы | до 8 одновременно на ключ |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Бонус | +5% от $50, +10% от $100 |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
| Вход | Google или e-mail и пароль |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Это официальный API Qwen?
Нет. Мы независимый провайдер, запускающий модель без цензуры. Мы не связаны с оригинальной командой Qwen или другими поставщиками. Мы обслуживаем свой экземпляр, настроенный для нецензурного использования.
Как пополнить баланс?
Только криптоплатежи: USDT (TRC20) или USDC (Base). Минимальное пополнение — $10. Бонус +5% при $50+ и +10% при $100+. Карты и PayPal не принимаются.
Какой размер контекстного окна?
Модель поддерживает 100 000 токенов для суммарного промпта и генерации. Максимальный вывод на запрос — 32 000 токенов. Если вы не установили <code>max_tokens</code>, лимит по умолчанию составляет 2 048 токенов.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.