5分で初リクエスト
既存のOpenAI互換クライアントを無検閲APIに接続するには、3つの設定行を更新するだけです。すでに使用しているSDKやツールはすぐに利用可能です。
OpenAI SDKのインストール
当社のエンドポイントは標準のchat.completionsプロトコルに従っているため、お好みの言語の公式SDKを使用できます。Pythonの場合はpipでパッケージをインストールします。Node.jsの場合はnpmを使用します。これらのライブラリはシリアライズ、リトライ、ストリーミングを標準で処理します。
pip install openai
npm install openai
tool_choiceやresponse_formatなどのパラメータをサポートするために、SDKの最新バージョンを使用していることを確認してください。クライアントライブラリがHTTPリクエストを管理するため、ペイロード構造に集中するだけで済みます。
ベースURLとキーの設定
クライアントを当社の専用エンドポイントにポイントしてください。モデル名のロジックを変更する必要はありません。リクエストにmodel: "uncensored"を渡すことを想定しています。認証はヘッダーに渡すシンプルなAPIキーによって行われます。
base_urlをhttps://api.qwenapi.top/v1に設定します。qwen api keyはダッシュボードで生成してください。キーはサインアップ直後に表示されます。初期設定に電話番号やクレジットカードは必要ありません。
基本的なチャット完了リクエスト
標準的なcompletionリクエストを送信します。モデルはテキスト応答を直接返します。複雑なルーティング層はなく、無検閲の出力にチューニングされた単一インスタンスと通信しています。
以下は、接続性とレスポンス形式を確認するためのcurlを使用した最小限の例です。
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'レスポンスにはchoices[0].message.contentに生成されたテキストが含まれます。temperatureやtop_pなどのパラメータを調整して創造性を制御できます。
ストリーミングレスポンス
リアルタイムのトークン生成にはストリーミングを有効にします。サーバーはServer-Sent Events (SSE) を送信します。最後のチャンクにはトークン使用統計が含まれており、クレジットの消費を正確に追跡できます。
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
ストリーミングは長い出力に不可欠です。ストリームを解析し、トークンが到着するたびにレンダリングできます。SDKはSSEの解析を自動的に処理します。
関数呼び出しのサポート
リクエストでツールを定義します。モデルは構造化された関数呼び出しを返します。ツールを実行して結果を渡すと、モデルは処理を続行します。これはtool_choiceと標準的な関数定義で動作します。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
JSONモードもresponse_format経由で利用可能です。ツールオーバーヘッドなしで厳密なJSON出力が必要な場合に使用してください。
制限、エラー、コンテキスト
コンテキストウィンドウは合計100,000トークンです。1つのリクエストあたりの最大出力は32,000トークン(未指定の場合は2,048)です。レート制限は1分あたり300リクエスト、キーあたり8つの同時リクエストです。リクエストボディは8 MB未満である必要があります。
エラーを処理してください:401は無効なキー、402はクレジット不足、429はレート制限超過を意味します。エラーは無料です。消費されたトークンのみに対して課金されます。クレジットは期限切れになりません。二重課金された場合は、サポートページで修正を依頼してください。
ストリーミング
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)技術仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.qwenapi.top/v1 |
| 認証 | Authorization: Bearer YOUR_KEY |
| モデル ID | uncensored |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| JSON モード | response_format: {"type": "json_object"} |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| レート制限 | キーごとに毎分 300 リクエスト |
| リクエストサイズ | 最大 8 MB |
| 同時実行 | キーごとに同時 8 リクエストまで |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| ログイン | Google またはメール+パスワード |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
これは公式のQwen APIですか?
いいえ。当社は独立したプロバイダーであり、無検閲のLLMを運用しています。元のQwenチームやその他のベンダーとは提携していません。無検閲用途に最適化された独自のインスタンスを提供しています。
クレジットをチャージするには?
支払いにはUSDT(TRC20)またはUSDC(Base)の暗号通貨のみを使用します。最小チャージ額は$10です。$50以上で+5%ボーナス、$100以上で+10%ボーナスが付与されます。カードやPayPalは利用できません。
コンテキストウィンドウのサイズは?
モデルは、プロンプトとcompletionを合わせて100,000トークンまでサポートします。1つのリクエストあたりの最大出力は32,000トークンです。<code>max_tokens</code>を設定しない場合、制限のデフォルト値は2,048トークンになります。