VI ▾
qwenapi.topLấy khóa API

Qwen không kiểm duyệt: cách hoạt động và các lựa chọn thay thế

Mô hình Qwen không kiểm duyệt tạo văn bản không giới hạn với ngữ cảnh dài, tích hợp trực tiếp vào các quy trình tương thích OpenAI của bạn. Bằng cách chuyển sang endpoint chuyên dụng này, bạn sẽ truy cập được cửa sổ ngữ cảnh 100k token và hệ thống thanh toán tín dụng trả trước chính xác mà không cần qua các cổng đa mô hình phức tạp.

Cập nhật

Điểm chính

  • Phiên bản Qwen không kiểm duyệt chạy trên máy chủ chuyên dụng, đảm bảo hiệu suất ổn định mà không có nhiễu định tuyến đa mô hình.
  • Bạn có thể tích hợp API này bằng các SDK OpenAI tiêu chuẩn bằng cách chỉ cần cập nhật base_url và khóa API.
  • Giá cả minh bạch và trả trước: $0,25 cho mỗi triệu token đầu vào và $1,00 cho mỗi triệu token đầu ra.
  • Mô hình hỗ trợ truyền phát (streaming), gọi hàm và chế độ JSON, phù hợp cho logic ứng dụng phức tạp.

Hiểu về Mô hình Qwen Không Kiểm Duyệt

Khi các nhà phát triển tìm kiếm biến thể uncensored qwen, họ thường muốn một mô hình trả lời trực tiếp mà không có sự đạo đức hóa không cần thiết hoặc từ chối đối với nội dung hợp pháp. Phiên bản cụ thể này là một mô hình trọng số mở được tinh chỉnh để ưu tiên đầu ra mang tính thực tế và sáng tạo hơn là các bộ lọc an toàn chung chung. Đây không phải là một mô hình độc quyền từ một gã khổng lồ công nghệ như OpenAI hay Google; thay vào đó, đó là một mô hình ngôn ngữ lớn riêng biệt được lưu trữ trên các máy chủ độc lập.

Mô hình xuất sắc trong việc xử lý tài liệu dài và hướng dẫn phức tạp nhờ cửa sổ ngữ cảnh 100.000 token. Điều này cho phép bạn dán toàn bộ cơ sở mã, hợp đồng pháp lý hoặc bài báo nghiên cứu dài vào một prompt duy nhất. Mô hình xử lý các đầu vào này mà không cắt ngắn sớm, đảm bảo bạn giữ lại toàn bộ sắc thái của dữ liệu. Không giống như các nhà cung cấp api không kiểm duyệt chung chung có thể tổng hợp hàng tá mô hình, dịch vụ này tập trung vào một phiên bản được tối ưu hóa, giảm biến động độ trễ và đảm bảo hành vi dự đoán được.

  • Kiến trúc trọng số mở để minh bạch.
  • Được tinh chỉnh để từ chối tối thiểu cho các chủ đề tiêu chuẩn.
  • Cửa sổ ngữ cảnh lớn để phân tích sâu.

Thiết lập Môi trường của Bạn

Tích hợp qwen api rất đơn giản vì nó tuân theo tiêu chuẩn chat-completions của OpenAI. Bạn không cần SDK độc quyền hoặc thư viện xác thực phức tạp. Hầu hết các môi trường phát triển hiện đại đều đã bao gồm các công cụ cần thiết để giao tiếp với các endpoint tương thích OpenAI. Bạn chỉ cần điều chỉnh cấu hình để trỏ đến base URL cụ thể của chúng tôi.

Base URL cho dịch vụ này là https://api.qwenapi.top/v1. Bằng cách cập nhật biến đơn lẻ này trong cấu hình máy khách của bạn, bạn có thể chuyển từ bất kỳ nhà cung cấp nào khác sang phiên bản không kiểm duyệt này. Cách tiếp cận này hoạt động với Python, Node.js và các ngôn ngữ khác hỗ trợ định dạng API OpenAI. Bạn cũng cần đảm bảo phiên bản thư viện máy khách của bạn đủ mới để hỗ trợ các tính năng bạn định sử dụng, chẳng hạn như streaming hoặc gọi hàm.

Vì qwen api key là cơ chế xác thực duy nhất, bạn có thể tạo một khóa ngay lập tức qua bảng điều khiển. Không cần các luồng OAuth phức tạp hoặc thiết lập tài khoản dịch vụ. Sự đơn giản này giảm thời gian từ khi đăng ký đến yêu cầu thành công đầu tiên của bạn chỉ còn vài phút.

Xác thực bằng Khóa API của Bạn

Xác thực trong môi trường api không kiểm duyệt này dựa trên token bearer đơn giản. Khi bạn tạo tài khoản, bạn nhận được một khóa API duy nhất xác định số dư trả trước của bạn. Khóa này phải được bao gồm trong tiêu đề Authorization của mọi yêu cầu bạn gửi đến endpoint /v1/chat/completions.

Giữ khóa của bạn an toàn vì nó rút trực tiếp từ tín dụng trả trước của bạn. Nếu bạn mất khóa, bạn có thể tạo một khóa mới thông qua bảng điều khiển, khóa này sẽ thay thế khóa trước đó. Khóa cũ sẽ ngừng hoạt động ngay lập tức, đảm bảo rằng chỉ bạn mới có quyền truy cập vào số dư còn lại. Không có phí đăng ký hàng tháng đi kèm với khóa; nó đơn thuần là một định danh thanh toán.

Bạn có thể tạo tài khoản bằng đăng nhập Google hoặc kết hợp email và mật khẩu tiêu chuẩn. Không cần xác minh số điện thoại, điều này tăng tốc quá trình đăng ký. Một khi bạn có khóa, bạn có thể bắt đầu gửi yêu cầu ngay lập tức. Hệ thống theo dõi việc sử dụng token theo thời gian thực, vì vậy bạn có thể theo dõi số dư của mình khi phát triển ứng dụng của mình.

Gửi Yêu cầu Đầu tiên của Bạn

Tạo yêu cầu đầu tiên của bạn liên quan đến việc gửi yêu cầu POST đến endpoint /v1/chat/completions. Bạn phải cung cấp ID model là uncensored, cùng với mảng messages chứa lịch sử hội thoại của bạn. Cấu trúc của thân yêu cầu giống hệt với những gì bạn sẽ gửi cho các dịch vụ tương thích OpenAI khác.

Dưới đây là một ví dụ cơ bản sử dụng cURL để chứng minh sự đơn giản của việc tích hợp:

curl https://api.qwenapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Phản hồi sẽ chứa phần hoàn thành của mô hình trong mảng choices. Bạn có thể trích xuất văn bản và sử dụng nó trong ứng dụng của mình. Nếu bạn gặp lỗi, phản hồi sẽ bao gồm mã lỗi và thông báo tiêu chuẩn, cho phép bạn xử lý các vấn đề một cách duyên dáng. Định dạng tiêu chuẩn này có nghĩa là bạn có thể chuyển đổi giữa các mô hình hoặc nhà cung cấp khác nhau bằng cách chỉ thay đổi base URL và ID mô hình.

Mô hình hỗ trợ cả hoàn thành văn bản đơn giản và định dạng hội thoại. Bạn có thể duy trì trạng thái bằng cách bao gồm các tin nhắn trước đó trong mảng messages, cho phép mô hình ghi nhớ ngữ cảnh trong giới hạn 100k token. Điều này làm cho nó phù hợp cho các bot trò chuyện, trợ lý mã hóa và các công cụ tạo nội dung.

Cấu hình Temperature và Top-P

Kiểm soát độ ngẫu nhiên trong đầu ra của mô hình rất quan trọng cho các trường hợp sử dụng khác nhau. qwen api hỗ trợ các tham số tiêu chuẩn như temperature và top_p để điều chỉnh mức độ sáng tạo và xác định của các phản hồi. Giá trị temperature kiểm soát độ ngẫu nhiên: các giá trị thấp hơn làm cho đầu ra tập trung và xác định hơn, trong khi các giá trị cao hơn tăng cường sự sáng tạo và đa dạng.

Tham số top_p cung cấp một cách thay thế để kiểm soát sự đa dạng bằng cách chỉ xem xét khối xác suất hàng đầu. Sử dụng cả hai tham số cùng nhau cho phép kiểm soát tinh vi đối với hành vi của mô hình. Ví dụ, nhiệt độ thấp và top_p thấp là lý tưởng cho việc tạo mã, nơi độ chính xác là quan trọng nhất. Nhiệt độ và top_p cao hơn có thể tốt hơn cho việc viết sáng tạo hoặc brainstorming.

Bạn cũng có thể đặt các chuỗi stop để dừng quá trình tạo tại các điểm cụ thể, điều này hữu ích cho đầu ra có cấu trúc. Ngoài ra, seed cho phép kết quả có thể tái lập nếu bạn đặt một giá trị seed cụ thể. Các tham số này cung cấp độ chính xác cần thiết để tích hợp mô hình vào môi trường sản xuất mà không có các biến đổi không dự đoán được.

Xử lý Phản hồi Streaming

Đối với các ứng dụng yêu cầu phản hồi thời gian thực, API uncensored qwen hỗ trợ Server-Sent Events (SSE). Truyền phát (streaming) cho phép bạn nhận các token khi chúng được tạo ra, thay vì chờ đợi toàn bộ phản hồi hoàn tất. Điều này cải thiện đáng kể trải nghiệm người dùng trong các giao diện trò chuyện và công cụ tương tác.

Khi bạn đặt tham số stream thành true, API sẽ trả về một chuỗi các chunk. Mỗi chunk chứa một phần kết quả hoàn thành và thống kê sử dụng. Chunk cuối cùng bao gồm tổng số token cho yêu cầu, điều này rất quan trọng để tính phí và giám sát chính xác. Tính năng này đặc biệt hữu ích cho các phản hồi dài vì nó giảm độ trễ cảm nhận được.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Triển khai streaming yêu cầu xử lý các sự kiện SSE trong mã máy khách của bạn. Hầu hết các SDK hiện đại đều có hỗ trợ tích hợp cho điều này, khiến việc tích hợp trở nên dễ dàng. Bạn có thể cập nhật giao diện người dùng theo thời gian thực khi các token đến, cung cấp trải nghiệm mượt mà và đáp ứng. Khả năng này là tiêu chuẩn trong hệ sinh thái tương thích OpenAI, đảm bảo tương thích với cơ sở hạ tầng hiện có của bạn.

Triển khai Gọi Hàm

Một trong những tính năng mạnh mẽ nhất của qwen api là hỗ trợ gọi hàm (còn được gọi là sử dụng công cụ). Điều này cho phép mô hình tạo ra dữ liệu JSON có cấu trúc kích hoạt các hành động cụ thể trong ứng dụng của bạn. Bạn xác định các hàm mà bạn muốn mô hình gọi, bao gồm tên, mô tả và lược đồ tham số của chúng.

Sau đó, mô hình sẽ quyết định khi nào gọi một hàm và cung cấp các đối số cần thiết. Điều này rất vô giá để xây dựng các agent có thể tương tác với các hệ thống bên ngoài, chẳng hạn như lấy dữ liệu thời tiết, truy vấn cơ sở dữ liệu hoặc điều khiển các thiết bị thông minh. Tham số response_format có thể được đặt thành json_object để đảm bảo đầu ra là JSON hợp lệ nghiêm ngặt, điều này rất quan trọng cho việc phân tích đáng tin cậy.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Gọi hàm nâng cao khả năng sử dụng của mô hình vượt xa việc tạo văn bản đơn giản. Nó cầu nối khoảng cách giữa hiểu ngôn ngữ tự nhiên và thực thi chương trình. Bằng cách tận dụng tính năng này, bạn có thể tạo các ứng dụng phức tạp hơn có thể thực hiện các hành động dựa trên ý định của người dùng. Khả năng của mô hình hiểu các lược đồ phức tạp làm cho nó trở thành một công cụ linh hoạt cho các kiến trúc dựa trên API hiện đại.

Theo dõi Việc sử dụng Token

Hiểu rõ việc sử dụng token là chìa khóa để quản lý chi phí hiệu quả. qwen api cung cấp thống kê sử dụng chi tiết trong mọi phản hồi, đặc biệt khi sử dụng streaming. Mỗi chunk trong phản hồi streaming đều bao gồm số lượng token, và chunk cuối cùng cung cấp tổng số token đầu vào và đầu ra cho yêu cầu.

Sự minh bạch này cho phép bạn theo dõi chi phí theo thời gian thực. Bạn có thể triển khai logic trong ứng dụng của mình để dừng quá trình tạo nếu số lượng token tiếp cận một giới hạn nhất định, ngăn ngừa các khoản phí không mong muốn. Mô hình trả trước đảm bảo rằng bạn chỉ trả tiền cho những gì bạn sử dụng, không có phí ẩn hoặc chi phí đăng ký. Lỗi và từ chối không tính phí, vì vậy bạn có thể thử nghiệm tự do.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Bằng cách theo dõi việc sử dụng, bạn có thể tối ưu hóa các prompt của mình và điều chỉnh các tham số để cân bằng chi phí và hiệu suất. Ví dụ, giảm nhiệt độ có thể làm giảm số lượng token trong một số trường hợp, trong khi tăng nó có thể cải thiện chất lượng phản hồi. Thường xuyên xem lại dữ liệu sử dụng của bạn giúp bạn xác định các điểm không hiệu quả và cải thiện hiệu quả tổng thể của ứng dụng của bạn.

Quản lý số dư trả trước của bạn

qwen api hoạt động theo hệ thống tín dụng trả trước, giúp loại bỏ rủi ro hóa đơn bất ngờ. Bạn có thể nạp tiền vào tài khoản bằng tiền điện tử, cụ thể là USDT trên mạng TRC20 hoặc USDC trên mạng Base. Không có gói đăng ký hàng tháng hay cam kết hàng năm, mang lại cho bạn toàn quyền kiểm soát chi tiêu.

Bạn có thể top up bất kỳ số nguyên nào từ $10 đến $500. Đối với các lần top up lớn hơn, bạn nhận được tín dụng bổ sung: +5% cho $50 và +10% cho $100. Tín dụng bổ sung này kéo dài thời gian sử dụng số dư của bạn và mang lại giá trị tốt hơn. Tín dụng của bạn không bao giờ hết hạn, vì vậy bạn có thể top up khi giá cả thuận lợi và sử dụng dần theo thời gian.

Không hoàn tiền cho tín dụng, nhưng các lỗi như tính phí trùng lặp sẽ được xử lý qua trang hỗ trợ. Mô hình trả trước này rất lý tưởng cho các nhà phát triển muốn có chi phí dự đoán được và truy cập ngay lập tức vào API. Nó cũng đơn giản hóa việc lập ngân sách, vì bạn biết chính xác số lượng yêu cầu mà ngân sách của bạn có thể hỗ trợ dựa trên giá token.

Hỏi đáp

Kích thước cửa sổ ngữ cảnh cho mô hình qwen không kiểm duyệt là bao nhiêu?

Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token, bao gồm cả prompt và phần hoàn thành. Điều này cho phép xử lý các tài liệu lớn và duy trì các cuộc hội thoại dài mà không bị cắt ngắn. Tuy nhiên, lượng đầu ra tối đa cho mỗi yêu cầu là 32.000 token, hoặc 2.048 nếu không được chỉ định.

Tôi thanh toán cho dịch vụ API như thế nào?

Thanh toán chỉ được chấp nhận bằng tiền điện tử: USDT trên mạng TRC20 hoặc USDC trên mạng Base. Bạn có thể top up bất kỳ số nguyên nào từ $10 đến $500, với tín dụng bổ sung có sẵn cho các số tiền lớn hơn. Không chấp nhận thẻ tín dụng, PayPal hoặc chuyển khoản ngân hàng.

Mô hình qwen không kiểm duyệt có từ chối nội dung không?

Mô hình được tinh chỉnh để trả lời mà không từ chối nội dung đối với mục đích người trưởng thành hợp pháp. Mô hình không chặn các chủ đề gây tranh cãi, hư cấu hoặc nghiên cứu bảo mật. Tuy nhiên, mô hình có một giới hạn cứng chặn nội dung tình dục liên quan đến trẻ vị thành niên, giới hạn này luôn được thực thi.

Tôi có thể sử dụng API này với các SDK OpenAI tiêu chuẩn không?

Có, API tương thích với OpenAI. Bạn có thể sử dụng các SDK chính thức của OpenAI hoặc bất kỳ máy khách tương thích nào bằng cách chỉ cần thay đổi base URL thành https://api.qwenapi.top/v1 và cập nhật khóa API của bạn. Cấu trúc endpoint và định dạng yêu cầu giống hệt với API chat completions tiêu chuẩn của OpenAI.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quy trình thiết lập.

Lấy khóa API