無審查 Qwen:運作原理與替代方案
無審查 Qwen 模型提供高上下文、無限制的文本生成,可直接融入您現有的 OpenAI 相容工作流程。透過切換到此專用端點,您將獲得 100k 上下文視窗和精確的預付計費,無需多模型閘道的額外開銷。
更新於
重點
- 無審查 Qwen 執行個體運行於專用伺服器,確保一致的效能,無多模型路由的雜訊。
- 您可以透過標準 OpenAI SDK 整合此 API,只需更新 base_url 與 API 金鑰即可。
- 計費透明且為預付制:每百萬輸入 token 為 $0.25,每百萬輸出 token 為 $1.00。
- 該模型支援串流輸出、函式呼叫和 JSON 模式,適合複雜的應用程式邏輯。
了解無審查 Qwen 模型
當開發者尋求 無審查的 qwen變體時,他們通常希望模型能直接回答,不對合法內容進行不必要的說教或拒絕。此特定實例是一個開放權重模型,經過微調以優先考慮事實與創意輸出,而非通用安全過濾器。它不是來自單一科技巨頭(如 OpenAI 或 Google)的專有模型;相反地,它是託管在獨立伺服器上的獨立大型語言模型。
由於擁有 100,000-token 的上下文視窗,該模型擅長處理長文件和複雜指令。這允許您將整個程式碼庫、法律合約或長篇研究論文貼入單一提示詞中。該模型處理這些輸入時不會提前截斷,確保您保留資料的完整細微差別。與可能會聚合數十個模型的通用無審查 api 供應商不同,此服務專注於一個最佳化的實例,從而減少延遲變異並確保行為可預測。
- 開放權重架構,確保透明度。
- 針對標準主題的最小拒絕進行調整。
- 高上下文視窗,適合深度分析。
設定您的環境
整合qwen api 非常簡單,因為它遵循 OpenAI chat-completions 標準。您不需要專有 SDK 或複雜的驗證程式庫。大多數現代開發環境已經包含與 OpenAI 相容端點通訊所需的工具。您只需調整設定以指向我們特定的基礎 URL 即可。
此服務的基礎 URL 為 https://api.qwenapi.top/v1。透過更新客戶端設定中的這個單一變數,即可從任何其他供應商切換至此無審查實例。此方法適用於支援 OpenAI API 格式的 Python、Node.js 及其他語言。你還需要確保客戶端程式庫版本足夠新,以支援你打算使用的功能,例如串流輸出或函式呼叫。
由於qwen api key 是唯一的驗證機制,您可以透過儀表板即時產生一個。無需複雜的 OAuth 流程或服務帳戶設定。這種簡化將從註冊到首次成功請求的時間縮短至幾分鐘。
使用您的 API 金鑰進行身份驗證
此無審查 api 環境中的驗證依賴於簡單的 bearer token。建立帳戶時,您會收到一個唯一的 API 金鑰,用於識別您的預付額度。此金鑰必須包含在您發送到Authorization 標頭中的每個請求中,指向/v1/chat/completions 端點。
請妥善保管您的金鑰,因為它會直接從您的預付額度中扣款。如果您遺失了金鑰,可以透過儀表板產生一個新的,它將取代舊的金鑰。舊金鑰將立即失效,確保只有您可以存取剩餘餘額。該金鑰沒有附帶月度訂閱費;它純粹是一個計費標識符。
您可以使用 Google 登入或標準的電子郵件與密碼組合建立帳戶。不需要電話號碼驗證,這加快了上手流程。取得金鑰後,您可以立即開始發送請求。系統會即時追蹤 token 使用情況,因此您可以在開發應用程式時監控您的餘額。
發送您的第一個請求
建立第一個請求涉及發送 POST 請求到/v1/chat/completions 端點。您必須提供model ID 為uncensored,以及包含您對話歷史的messages 陣列。請求主體的結構與您發送到其他 OpenAI 相容服務的結構相同。
以下是使用 cURL 的基本範例,展示整合的簡易性:
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'回應將包含 choices 陣列中的模型補全內容。您可以提取文字並在您的應用程式中使用。如果遇到錯誤,回應將包含標準錯誤代碼和訊息,讓您可以優雅地處理問題。這種標準格式意味著您可以透過僅更改基礎 URL 和模型 ID 來在不同模型或供應商之間切換。
該模型支援簡單文本補全和對話格式。您可以透過在 messages 陣列中包含先前訊息來維護狀態,允許模型在 100k token 限制內記住上下文。這使其適合聊天機器人、程式碼助手和內容生成工具。
設定 temperature 和 top_p
控制模型輸出的隨機性對於不同的使用案例至關重要。qwen api 支援標準參數,如temperature 和top_p,以調整回應的創造性和確定性。temperature 值控制隨機性:較低的值使輸出更集中和確定,而較高的值增加創造性和多樣性。
top_p 參數提供另一種通過僅考慮最高概率質量來控制多樣性的方法。同時使用這兩個參數可以對模型行為進行微調控制。例如,低 temperature 和低 top_p 非常適合程式碼生成,其中準確性至關重要。較高的 temperature 和 top_p 可能更適合創意寫作或腦力激盪。
您也可以設定 stop 序列以在特定點停止生成,這對於結構化輸出很有用。此外,seed 允許在設定特定種子值時產生可重現的結果。這些參數為您提供了將模型整合到生產環境中所需的精確度,而無需不可預測的變異。
處理串流回應
對於需要即時回饋的應用程式,無審查 qwen API 支援 Server-Sent Events (SSE)。串流輸出允許您在 token 生成時接收它們,而不是等待整個回應完成。這顯著改善了聊天介面和互動式工具的用戶體驗。
當您將 stream 參數設置為 true 時,API 會返回一系列區塊。每個區塊包含部分補全和使用統計數據。最後一個區塊包含請求的總 token 計數,這對於準確計費和監控至關重要。此功能對於長回應特別有用,因為它減少了感知延遲。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)實作串流輸出需要在您的客戶端程式碼中處理 SSE 事件。大多數現代 SDK 內建支援此功能,使其容易整合。隨著 token 到達,您可以即時更新 UI,提供流暢且具回應性的互動。此功能在 OpenAI 相容生態系統中是標準配置,確保與您現有基礎設施的相容性。
實作函式呼叫
qwen api 最強大的功能之一是其對函式呼叫(也稱為工具使用)的支援。這允許模型生成結構化的 JSON 資料,以觸發應用程式中的特定動作。您可以定義希望模型呼叫的函式,包括它們的名稱、描述和參數架構。
然後模型將決定何時呼叫函式並提供必要的參數。這對於構建可以與外部系統交互的代理非常有價值,例如獲取天氣數據、查詢資料庫或控制智慧設備。response_format 參數可以設置為 json_object,以確保輸出是嚴格有效的 JSON,這對於可靠解析至關重要。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);函式呼叫增強了模型超越簡單文本生成的實用性。它彌合了自然語言理解和程式化執行之間的差距。透過利用此功能,您可以創建更複雜的應用程式,這些應用程式可以根據用戶意圖執行操作。模型理解複雜架構的能力使其成為現代 API 驅動架構的多功能工具。
監控 token 使用情況
了解您的 token 使用情況對於有效管理成本至關重要。qwen api 在每個回應中提供詳細的使用統計數據,特別是在串流時。串流回應中的每個區塊都包含 token 計數,最後一個區塊提供請求的總輸入和輸出 token。
這種透明度允許您即時追蹤成本。您可以在應用程式中實現邏輯,如果 token 計數接近某個限制,則停止生成,防止意外費用。預付模式確保您只為使用的內容付費,沒有隱藏費用或訂閱成本。錯誤和拒絕不會產生費用,因此您可以自由實驗。
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)透過監控使用情況,您可以優化提示詞並調整參數,以平衡成本和效能。例如,在某些情況下降低 temperature 可能會減少 token 計數,而增加它可能會提高回應質量。定期審查您的使用數據有助於您識別低效之處並提高應用程式的整體效率。
管理您的預付額度
qwen api 採用預付額度系統,可消除意外帳單的風險。您可以使用加密貨幣為帳戶儲值,具體為 TRC20 網路上的 USDT 或 Base 網路上的 USDC。沒有月費或年度綁定,讓您完全掌控支出。
你可以儲值 $10 至 $500 之間的任意整數金額。對於較大的儲值,你會獲得額外額度:儲值 $50 贈送 +5%,儲值 $100 贈送 +10%。此額外額度可延長你餘額的有效期限,並提供更高的價值。你的額度永不過期,因此你可以在價格有利時儲值,並隨時間逐步使用。
額度通常不予退費,但如重複扣款等錯誤可透過支援頁面處理。此預付模型非常適合希望成本可預測並立即存取 API 的開發人員。它也簡化了預算規劃,因為您可以根據 token 定價,精確知道您的預算可支援多少請求。
問答
無審查 qwen 模型的上下文視窗大小為何?
該模型支援 100,000-token 的上下文視窗,包含提示詞與補全內容。這允許處理大型文件並維持長對話而不會截斷。然而,每個請求的最大輸出為 32,000 token,若未指定則為 2,048。
我如何為 API 服務付費?
僅接受加密貨幣付款:TRC20 網路上的 USDT 或 Base 網路上的 USDC。您可以儲值 $10 至 $500 之間的任意整數金額,較大金額可獲得額外額度。不接受信用卡、PayPal 或銀行轉帳。
無審查 qwen 模型會拒絕內容嗎?
該模型經過微調,可對合法成人內容無審查地回答。它不會封鎖有爭議、虛構或安全研究主題。然而,它有一個硬性限制,會封鎖涉及未成年人的性內容,且此限制始終生效。
我可以使用標準 OpenAI SDK 來使用此 API 嗎?
是的,此 API 與 OpenAI 相容。您可以使用官方的 OpenAI SDK 或任何相容的客戶端,只需將基礎 URL 更改為 https://api.qwenapi.top/v1 並更新您的 API 金鑰即可。端點結構與請求格式與標準 OpenAI 聊天補全 API 完全相同。