5분 내 첫 요청
구성 줄 세 가지만 수정하여 기존 OpenAI 호환 클라이언트를 무검열 API에 연결하세요. 이미 사용 중인 SDK와 도구는 즉시 작동합니다.
OpenAI SDK 설치
당사의 엔드포인트는 표준 chat.completions 프로토콜을 따르므로 선호하는 언어의 공식 SDK를 사용할 수 있습니다. Python의 경우 pip를 통해 패키지를 설치하세요. Node.js의 경우 npm을 사용하세요. 이러한 라이브러리는 직렬화, 재시도 및 스트리밍을 기본적으로 처리합니다.
pip install openai
npm install openai
tool_choice 및 response_format과 같은 모든 매개변수를 지원하려면 최신 버전의 SDK를 사용하고 있는지 확인하세요. 클라이언트 라이브러리가 HTTP 요청을 관리하므로 페이로드 구조에만 집중하면 됩니다.
Base URL 및 키 구성
클라이언트를 전용 엔드포인트로 지정하세요. 모델 이름 로직을 변경할 필요가 없습니다. 요청에 model: "uncensored"를 전달해야 합니다. 인증은 헤더에 전달되는 간단한 API 키로 처리됩니다.
base_url을(를) https://api.qwenapi.top/v1로 설정하세요. 대시보드에서 qwen api key를 생성하세요. 키는 회원가입 직후 표시됩니다. 초기 설정에는 전화번호나 신용카드가 필요하지 않습니다.
기본 채팅 완료 요청
표준 완료 요청을 보내세요. 모델은 텍스트 응답을 직접 반환합니다. 복잡한 라우팅 레이어가 없으며, 무검열 출력을 위해 조정된 단일 인스턴스와 통신하는 것입니다.
아래는 연결 및 응답 형식을 확인하기 위한 curl을 사용한 최소 예제입니다.
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'응답에는 choices[0].message.content에 생성된 텍스트가 포함됩니다. 창의력을 제어하기 위해 temperature 및 top_p과 같은 매개변수를 조정할 수 있습니다.
스트리밍 응답
실시간 토큰 생성을 위해 스트리밍을 활성화하세요. 서버는 서버 전송 이벤트(SSE)를 보냅니다. 마지막 청크에는 토큰 사용 통계가 포함되어 있어 크레딧 소비를 정확하게 추적할 수 있습니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
스트리밍은 긴 출력에 필수적입니다. 스트림을 파싱하고 도착하는 대로 토큰을 렌더링할 수 있습니다. SDK는 SSE 파싱을 자동으로 처리합니다.
함수 호출 지원
요청에 도구를 정의하세요. 모델은 구조화된 도구 호출을 반환합니다. 도구를 실행하고 결과를 다시 전달하면 모델이 계속 진행됩니다. 이는 tool_choice 및 표준 함수 정의와 함께 작동합니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
response_format을 통해 JSON 모드도 사용할 수 있습니다. 도구 오버헤드 없이 엄격한 JSON 출력이 필요한 경우 사용하세요.
한도, 오류 및 컨텍스트
컨텍스트 창은 총 100,000 토큰입니다. 요청당 최대 출력은 32,000 토큰이며(미지정 시 2,048), 요청 제한은 분당 300개 요청 및 키당 8개의 동시 요청입니다. 요청 본문은 8 MB 미만이어야 합니다.
오류를 처리하세요: 401은 유효하지 않은 키, 402는 크레딧 부족, 429는 요청 제한 초과를 의미합니다. 오류는 무료이며 소모된 토큰에 대해서만 요금이 부과됩니다. 크레딧은 만료되지 않습니다. 중복 과금된 경우 지원 페이지에서 해결하세요.
스트리밍
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)기술 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| 인증 | Authorization: Bearer YOUR_KEY |
| 모델 ID | uncensored |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON 모드 | response_format: {"type": "json_object"} |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 속도 제한 | 키당 분당 300회 |
| 요청 크기 | 최대 8 MB |
| 동시 요청 | 키당 동시 8개 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
이것이 공식 Qwen API인가요?
아닙니다. 당사는 무검열 대형 언어 모델을 운영하는 독립적인 서비스 제공업체입니다. 원래 Qwen 팀이나 기타 벤더와 제휴 관계가 없습니다. 무검열 사용에 맞게 조정된 자체 인스턴스를 제공합니다.
크레딧을 충전하는 방법은 무엇인가요?
지불은 USDT(TRC20) 또는 USDC(Base)를 통한 암호화폐 전용입니다. 최소 충전 금액은 $10입니다. $50 이상 충전 시 +5%, $100 이상 충전 시 +10% 보너스를 제공합니다. 신용카드나 PayPal은 지원되지 않습니다.
컨텍스트 창 크기는 얼마인가요?
이 모델은 프롬프트와 응답의 합계가 100,000 토큰까지 지원됩니다. 요청당 최대 출력은 32,000 토큰입니다. <code>max_tokens</code>을 설정하지 않으면 제한값은 2,048 토큰으로 기본 설정됩니다.