VI ▾
qwenapi.topLấy khóa API

Yêu cầu đầu tiên trong năm phút

Kết nối máy khách tương thích OpenAI của bạn với API không kiểm duyệt của chúng tôi bằng cách cập nhật ba dòng cấu hình. Các SDK và công cụ bạn đã sử dụng sẽ hoạt động ngay lập tức.

Cài đặt SDK OpenAI

Endpoint của chúng tôi tuân theo giao thức chat.completions tiêu chuẩn, vì vậy bạn có thể sử dụng các SDK chính thức từ ngôn ngữ ưa thích của mình. Đối với Python, hãy cài đặt gói qua pip. Đối với Node.js, hãy sử dụng npm. Các thư viện này xử lý tuần tự hóa, thử lại và truyền phát ngay lập tức.

pip install openai

npm install openai

Đảm bảo bạn đang sử dụng phiên bản SDK mới nhất để hỗ trợ tất cả các tham số như tool_choice và response_format. Thư viện máy khách quản lý các yêu cầu HTTP, vì vậy bạn chỉ cần tập trung vào cấu trúc tải trọng.

Cấu hình URL cơ sở và Khóa

Trỏ client của bạn đến endpoint chuyên dụng của chúng tôi. Bạn không cần thay đổi logic tên mô hình; chúng tôi mong bạn truyền model: "uncensored" trong các yêu cầu của mình. Xác thực được xử lý thông qua một khóa API đơn giản được truyền trong header.

Đặt base_url thành https://api.qwenapi.top/v1. Tạo qwen api key của bạn trên bảng điều khiển. Khóa được hiển thị ngay sau khi đăng ký. Không cần số điện thoại hay thẻ tín dụng cho thiết lập ban đầu.

Yêu cầu hoàn thành trò chuyện cơ bản

Gửi yêu cầu hoàn thành tiêu chuẩn. Mô hình trả về phản hồi văn bản trực tiếp. Không có lớp định tuyến phức tạp; bạn đang nói chuyện với một phiên bản duy nhất được tinh chỉnh cho đầu ra không kiểm duyệt.

Dưới đây là một ví dụ tối thiểu sử dụng curl để xác minh kết nối và định dạng phản hồi.

curl https://api.qwenapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Phản hồi chứa văn bản được tạo trong choices[0].message.content. Bạn có thể điều chỉnh các tham số như temperature và top_p để kiểm soát sự sáng tạo.

Phản hồi truyền phát

Để tạo token theo thời gian thực, hãy bật streaming. Máy chủ gửi các sự kiện gửi qua máy chủ (SSE). Mảnh cuối cùng bao gồm thống kê sử dụng token, cho phép bạn theo dõi chính xác việc tiêu thụ tín dụng.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Truyền phát rất cần thiết cho các đầu ra dài. Bạn có thể phân tích luồng và hiển thị token khi chúng đến. SDK xử lý phân tích SSE tự động.

Hỗ trợ gọi hàm

Xác định các công cụ trong yêu cầu của bạn. Mô hình trả về các cuộc gọi công cụ có cấu trúc. Bạn thực thi công cụ, truyền kết quả lại và mô hình tiếp tục. Điều này hoạt động với tool_choice và các định nghĩa công cụ tiêu chuẩn.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Chế độ JSON cũng có sẵn qua response_format. Hãy sử dụng nó khi bạn cần đầu ra JSON nghiêm ngặt mà không có chi phí công cụ.

Giới hạn, Lỗi và Ngữ cảnh

Cửa sổ ngữ cảnh là 100,000 token tổng cộng. Đầu ra tối đa cho mỗi yêu cầu là 32,000 token (2,048 nếu không chỉ định). Giới hạn tốc độ là 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời mỗi khóa. Thân yêu cầu phải dưới 8 MB.

Xử lý lỗi: 401 có nghĩa là khóa không hợp lệ, 402 có nghĩa là không đủ tín dụng, 429 có nghĩa là vượt quá giới hạn tốc độ. Lỗi miễn phí; bạn chỉ trả tiền cho các token đã sử dụng. Tín dụng không bao giờ hết hạn. Nếu bạn bị tính phí gấp đôi, hãy sử dụng trang Hỗ trợ để sửa.

Truyền phát

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.qwenapi.top/v1
Xác thựcAuthorization: Bearer YOUR_KEY
ID mô hìnhuncensored
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chế độ JSONresponse_format: {"type": "json_object"}
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Đây có phải là API Qwen chính thức không?

Không. Chúng tôi là nhà cung cấp độc lập chạy mô hình ngôn ngữ lớn không kiểm duyệt. Chúng tôi không liên kết với nhóm Qwen gốc hoặc bất kỳ nhà cung cấp nào khác. Chúng tôi cung cấp phiên bản riêng đã được tinh chỉnh cho việc sử dụng không kiểm duyệt.

Tôi nạp tiền tín dụng như thế nào?

Thanh toán chỉ bằng tiền điện tử qua USDT (TRC20) hoặc USDC (Base). Nạp tiền tối thiểu là $10. Bạn nhận được +5% tiền thưởng cho $50+ và +10% cho $100+. Không chấp nhận thẻ hoặc PayPal.

Kích thước cửa sổ ngữ cảnh là bao nhiêu?

Mô hình hỗ trợ 100,000 token cho prompt và phần hoàn thành kết hợp. Lượng output tối đa cho mỗi yêu cầu là 32,000 token. Nếu bạn không đặt <code>max_tokens</code>, giới hạn mặc định là 2,048 token.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.

Lấy khóa API