Yêu cầu đầu tiên trong năm phút
Kết nối máy khách tương thích OpenAI của bạn với API không kiểm duyệt của chúng tôi bằng cách cập nhật ba dòng cấu hình. Các SDK và công cụ bạn đã sử dụng sẽ hoạt động ngay lập tức.
Cài đặt SDK OpenAI
Endpoint của chúng tôi tuân theo giao thức chat.completions tiêu chuẩn, vì vậy bạn có thể sử dụng các SDK chính thức từ ngôn ngữ ưa thích của mình. Đối với Python, hãy cài đặt gói qua pip. Đối với Node.js, hãy sử dụng npm. Các thư viện này xử lý tuần tự hóa, thử lại và truyền phát ngay lập tức.
pip install openai
npm install openai
Đảm bảo bạn đang sử dụng phiên bản SDK mới nhất để hỗ trợ tất cả các tham số như tool_choice và response_format. Thư viện máy khách quản lý các yêu cầu HTTP, vì vậy bạn chỉ cần tập trung vào cấu trúc tải trọng.
Cấu hình URL cơ sở và Khóa
Trỏ client của bạn đến endpoint chuyên dụng của chúng tôi. Bạn không cần thay đổi logic tên mô hình; chúng tôi mong bạn truyền model: "uncensored" trong các yêu cầu của mình. Xác thực được xử lý thông qua một khóa API đơn giản được truyền trong header.
Đặt base_url thành https://api.qwenapi.top/v1. Tạo qwen api key của bạn trên bảng điều khiển. Khóa được hiển thị ngay sau khi đăng ký. Không cần số điện thoại hay thẻ tín dụng cho thiết lập ban đầu.
Yêu cầu hoàn thành trò chuyện cơ bản
Gửi yêu cầu hoàn thành tiêu chuẩn. Mô hình trả về phản hồi văn bản trực tiếp. Không có lớp định tuyến phức tạp; bạn đang nói chuyện với một phiên bản duy nhất được tinh chỉnh cho đầu ra không kiểm duyệt.
Dưới đây là một ví dụ tối thiểu sử dụng curl để xác minh kết nối và định dạng phản hồi.
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Phản hồi chứa văn bản được tạo trong choices[0].message.content. Bạn có thể điều chỉnh các tham số như temperature và top_p để kiểm soát sự sáng tạo.
Phản hồi truyền phát
Để tạo token theo thời gian thực, hãy bật streaming. Máy chủ gửi các sự kiện gửi qua máy chủ (SSE). Mảnh cuối cùng bao gồm thống kê sử dụng token, cho phép bạn theo dõi chính xác việc tiêu thụ tín dụng.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Truyền phát rất cần thiết cho các đầu ra dài. Bạn có thể phân tích luồng và hiển thị token khi chúng đến. SDK xử lý phân tích SSE tự động.
Hỗ trợ gọi hàm
Xác định các công cụ trong yêu cầu của bạn. Mô hình trả về các cuộc gọi công cụ có cấu trúc. Bạn thực thi công cụ, truyền kết quả lại và mô hình tiếp tục. Điều này hoạt động với tool_choice và các định nghĩa công cụ tiêu chuẩn.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Chế độ JSON cũng có sẵn qua response_format. Hãy sử dụng nó khi bạn cần đầu ra JSON nghiêm ngặt mà không có chi phí công cụ.
Giới hạn, Lỗi và Ngữ cảnh
Cửa sổ ngữ cảnh là 100,000 token tổng cộng. Đầu ra tối đa cho mỗi yêu cầu là 32,000 token (2,048 nếu không chỉ định). Giới hạn tốc độ là 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời mỗi khóa. Thân yêu cầu phải dưới 8 MB.
Xử lý lỗi: 401 có nghĩa là khóa không hợp lệ, 402 có nghĩa là không đủ tín dụng, 429 có nghĩa là vượt quá giới hạn tốc độ. Lỗi miễn phí; bạn chỉ trả tiền cho các token đã sử dụng. Tín dụng không bao giờ hết hạn. Nếu bạn bị tính phí gấp đôi, hãy sử dụng trang Hỗ trợ để sửa.
Truyền phát
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| Xác thực | Authorization: Bearer YOUR_KEY |
| ID mô hình | uncensored |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Thưởng | +5% từ $50, +10% từ $100 |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Đây có phải là API Qwen chính thức không?
Không. Chúng tôi là nhà cung cấp độc lập chạy mô hình ngôn ngữ lớn không kiểm duyệt. Chúng tôi không liên kết với nhóm Qwen gốc hoặc bất kỳ nhà cung cấp nào khác. Chúng tôi cung cấp phiên bản riêng đã được tinh chỉnh cho việc sử dụng không kiểm duyệt.
Tôi nạp tiền tín dụng như thế nào?
Thanh toán chỉ bằng tiền điện tử qua USDT (TRC20) hoặc USDC (Base). Nạp tiền tối thiểu là $10. Bạn nhận được +5% tiền thưởng cho $50+ và +10% cho $100+. Không chấp nhận thẻ hoặc PayPal.
Kích thước cửa sổ ngữ cảnh là bao nhiêu?
Mô hình hỗ trợ 100,000 token cho prompt và phần hoàn thành kết hợp. Lượng output tối đa cho mỗi yêu cầu là 32,000 token. Nếu bạn không đặt <code>max_tokens</code>, giới hạn mặc định là 2,048 token.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.