Qwen ไม่เซ็นเซอร์: วิธีการทำงานและทางเลือกอื่น
โมเดล Qwen แบบไม่เซ็นเซอร์ให้การสร้างข้อความที่มีความยาวบริบทสูงและไม่มีข้อจำกัด ซึ่งสามารถผสานเข้ากับเวิร์กโฟลว์ที่เข้ากันได้กับ OpenAI ที่มีอยู่ของคุณได้โดยตรง โดยการเปลี่ยนไปใช้เอนด์พอยต์เฉพาะนี้ คุณจะได้เข้าถึงหน้าต่างบริบท 100k และการชำระเงินแบบเติมเงินที่ชัดเจน โดยไม่มีภาระของเกตเวย์หลายโมเดล
อัปเดตแล้ว
จุดสำคัญ
- อินสแตนซ์ Qwen แบบไม่เซ็นเซอร์ทำงานบนเซิร์ฟเวอร์เฉพาะ รับประกันประสิทธิภาพที่สม่ำเสมอโดยไม่มีความแปรปรวนจากการจัดเส้นทางหลายโมเดล
- คุณสามารถผสานรวม API นี้โดยใช้ SDK มาตรฐานของ OpenAI ได้โดยการอัปเดต base_url และคีย์ API เพียงอย่างเดียว
- ราคาโปร่งใสและแบบเติมเงินล่วงหน้า: $0.25 ต่อล้านโทเคนอินพุต และ $1.00 ต่อล้านโทเคนเอาต์พุต
- โมเดลรองรับสตรีมมิง การเรียกใช้ฟังก์ชัน และโหมด JSON ทำให้เหมาะสำหรับตรรกะแอปพลิเคชันที่ซับซ้อน
ทำความเข้าใจโมเดล Qwen แบบไม่เซ็นเซอร์
เมื่อนักพัฒนาต้องการตัวแปรของ uncensored qwen พวกเขามักจะต้องการโมเดลที่ตอบคำถามโดยตรงโดยไม่มีการให้เหตุผลทางศีลธรรมหรือการปฏิเสธที่ไม่จำเป็นสำหรับเนื้อหาที่ถูกต้องตามกฎหมาย ตัวอย่างเฉพาะนี้คือโมเดลแบบเปิดน้ำหนักที่ปรับแต่งมาเพื่อให้ความสำคัญกับผลลัพธ์เชิงข้อเท็จจริงและเชิงสร้างสรรค์มากกว่าตัวกรองความปลอดภัยทั่วไป ไม่ใช่โมเดลที่เป็นกรรมสิทธิ์จากยักษ์ใหญ่ด้านเทคโนโลยีรายเดียวเช่น OpenAI หรือ Google แต่เป็นโมเดลภาษาขนาดใหญ่ที่แตกต่างกันที่โฮสต์บนเซิร์ฟเวอร์อิสระ
โมเดลมีความเชี่ยวชาญในการจัดการเอกสารยาวและคำแนะนำที่ซับซ้อนเนื่องจากหน้าต่างบริบทขนาด 100,000 โทเคน สิ่งนี้ช่วยให้คุณวางโค้ดทั้งหมด สัญญาทางกฎหมาย หรือเอกสารวิจัยที่ยาวลงในพรอมต์เดียวได้ โมเดลประมวลผลข้อมูลนำเข้าเหล่านี้โดยไม่มีการตัดทอนก่อนหน้า เพื่อให้แน่ใจว่าคุณยังคงรักษาความละเอียดอ่อนทั้งหมดของข้อมูลไว้ได้ ต่างจากผู้ให้บริการ uncensored api ทั่วไปที่อาจรวมโมเดลหลายสิบตัว บริการนี้มุ่งเน้นไปที่อินสแตนซ์ที่ปรับให้เหมาะสมเพียงตัวเดียว ซึ่งช่วยลดความแปรปรวนของเวลาแฝงและรับประกันพฤติกรรมที่คาดเดาได้
- สถาปัตยกรรมแบบเปิดน้ำหนักเพื่อความโปร่งใส
- ปรับแต่งเพื่อการปฏิเสธเนื้อหาน้อยที่สุดสำหรับหัวข้อมาตรฐาน
- หน้าต่างบริบทสูงสำหรับการวิเคราะห์เชิงลึก
การตั้งค่าสภาพแวดล้อมของคุณ
การรวม qwen api นั้นง่ายเพราะมันสอดคล้องกับมาตรฐาน OpenAI chat-completions คุณไม่จำเป็นต้องใช้ SDK เฉพาะหรือไลบรารีการตรวจสอบสิทธิ์ที่ซับซ้อน สภาพแวดล้อมการพัฒนาสมัยใหม่ส่วนใหญ่มีเครื่องมือที่จำเป็นสำหรับการสื่อสารกับเอนด์พอยต์ที่เข้ากันได้กับ OpenAI แล้ว คุณเพียงแค่ต้องปรับการกำหนดค่าให้ชี้ไปยัง URL ฐานเฉพาะของเรา
base URL สำหรับบริการนี้คือ https://api.qwenapi.top/v1 โดยการอัปเดตตัวแปรเดียวนี้ในการกำหนดค่าไคลเอนต์ของคุณ คุณสามารถเปลี่ยนจากผู้ให้บริการรายอื่นใดไปยังอินสแตนซ์ที่ไม่มีการเซ็นเซอร์นี้ได้ วิธีการนี้ใช้งานได้กับ Python, Node.js และภาษาอื่นๆ ที่รองรับรูปแบบ API ของ OpenAI คุณยังต้องตรวจสอบให้แน่ใจว่าเวอร์ชันไลบรารีไคลเอนต์ของคุณใหม่พอที่จะรองรับฟีเจอร์ที่คุณตั้งใจจะใช้ เช่น การสตรีมมิงหรือการเรียกใช้ฟังก์ชัน
เนื่องจาก qwen api key เป็นกลไกการตรวจสอบสิทธิ์เพียงอย่างเดียว คุณสามารถสร้างคีย์ได้ทันทีผ่านแดชบอร์ด ไม่จำเป็นต้องใช้ขั้นตอน OAuth ที่ซับซ้อนหรือการตั้งค่าบัญชีบริการ ความเรียบง่ายนี้ช่วยลดเวลาตั้งแต่การสมัครไปจนถึงคำขอสำเร็จครั้งแรกของคุณให้เหลือเพียงไม่กี่นาที
การตรวจสอบสิทธิ์ด้วยคีย์ API ของคุณ
การตรวจสอบสิทธิ์ในสภาพแวดล้อม uncensored api นี้ขึ้นอยู่กับ bearer token แบบเรียบง่าย เมื่อคุณสร้างบัญชี คุณจะได้รับคีย์ API เฉพาะที่ระบุยอดเงินเติมเงินของคุณ คีย์นี้ต้องรวมอยู่ในส่วนหัว Authorization ของทุกคำขอที่คุณส่งไปยังเอนด์พอยต์ /v1/chat/completions
เก็บคีย์ของคุณให้ปลอดภัยเนื่องจากคีย์นี้ดึงจากเครดิตแบบเติมเงินล่วงหน้าของคุณโดยตรง หากคุณสูญหายคีย์ คุณสามารถสร้างคีย์ใหม่ผ่านแดชบอร์ด ซึ่งจะแทนที่คีย์ก่อนหน้า คีย์เก่าจะหยุดทำงานทันที รับประกันว่าคุณเพียงผู้เดียวที่มีการเข้าถึงยอดคงเหลือที่เหลือ ไม่มีค่าธรรมเนียมการสมัครสมาชิกรายเดือนที่แนบมากับคีย์ มันเป็นตัวระบุการชำระเงินเท่านั้น
คุณสามารถสร้างบัญชีโดยใช้การเข้าสู่ระบบของ Google หรือการรวมกันของอีเมลและรหัสผ่านมาตรฐาน ไม่จำเป็นต้องตรวจสอบหมายเลขโทรศัพท์ ซึ่งช่วยเร่งกระบวนการลงทะเบียน เมื่อคุณมีคีย์แล้ว คุณสามารถเริ่มทำคำขอได้ทันที ระบบติดตามการใช้โทเคนแบบเรียลไทม์ ดังนั้นคุณสามารถติดตามยอดคงเหลือของคุณขณะพัฒนาแอปพลิเคชันของคุณ
การทำคำขอครั้งแรกของคุณ
การสร้างคำขอครั้งแรกของคุณเกี่ยวข้องกับการส่งคำขอ POST ไปยังเอนด์พอยต์ /v1/chat/completions คุณต้องระบุ ID ของ model เป็น uncensored พร้อมอาร์เรย์ messages ที่ประกอบด้วยประวัติการสนทนาของคุณ โครงสร้างของส่วนหัวคำขอเหมือนกันกับสิ่งที่คุณจะส่งไปยังบริการที่เข้ากันได้กับ OpenAI อื่นๆ
นี่คือตัวอย่างพื้นฐานโดยใช้ cURL เพื่อแสดงความเรียบง่ายของการผสาน:
curl https://api.qwenapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'การตอบกลับจะประกอบด้วยผลลัพธ์ของโมเดลในอาร์เรย์ choices คุณสามารถดึงข้อความและนำไปใช้ในแอปพลิเคชันของคุณได้ หากเกิดข้อผิดพลาด การตอบกลับจะรวมรหัสข้อผิดพลาดและข้อความมาตรฐานไว้ ทำให้คุณสามารถจัดการปัญหาได้อย่างราบรื่น รูปแบบมาตรฐานนี้หมายความว่าคุณสามารถสลับระหว่างโมเดลหรือผู้ให้บริการต่างๆ ได้โดยการเปลี่ยนเฉพาะ URL ฐานและ ID โมเดล
โมเดลรองรับทั้งการสร้างข้อความตอบกลับ (text completion) แบบง่ายและรูปแบบการสนทนา คุณสามารถรักษาสถานะได้โดยการรวมข้อความก่อนหน้าลงในอาร์เรย์ messages ซึ่งทำให้โมเดลสามารถจดจำบริบทภายในขีดจำกัด 100k โทเคนได้ สิ่งนี้ทำให้เหมาะสำหรับแชทบอท ผู้ช่วยโค้ด และเครื่องมือสร้างเนื้อหา
การกำหนดค่า Temperature และ Top-P
การควบคุมความสุ่มของผลลัพธ์ของโมเดลมีความสำคัญสำหรับกรณีการใช้งานที่แตกต่างกัน qwen api รองรับพารามิเตอร์มาตรฐานเช่น temperature และ top_p เพื่อปรับแต่งความคิดสร้างสรรค์และความแน่นอนของการตอบกลับ ค่า temperature ควบคุมความสุ่ม: ค่าที่ต่ำกว่าทำให้ผลลัพธ์มีจุดโฟกัสและแน่นอนมากขึ้น ในขณะที่ค่าที่สูงขึ้นเพิ่มความสร้างสรรค์และความหลากหลาย
พารามิเตอร์ top_p เสนอวิธีทางเลือกในการควบคุมความหลากหลายโดยพิจารณาเฉพาะมวลความน่าจะเป็นสูงสุด การใช้พารามิเตอร์ทั้งสองร่วมกันช่วยให้สามารถควบคุมพฤติกรรมของโมเดลได้อย่างละเอียดอ่อน ตัวอย่างเช่น temperature ต่ำและ top_p ต่ำเหมาะสำหรับการสร้างโค้ดซึ่งความถูกต้องเป็นสิ่งสำคัญที่สุด temperature และ top_p ที่สูงกว่าอาจดีกว่าสำหรับการเขียนเชิงสร้างสรรค์หรือการระดมความคิด
คุณยังสามารถกำหนดลำดับ stop เพื่อหยุดการสร้างข้อความที่จุดเฉพาะ ซึ่งจะมีประโยชน์สำหรับผลลัพธ์ที่มีโครงสร้าง นอกจากนี้ seed ช่วยให้ได้ผลลัพธ์ที่สามารถทำซ้ำได้หากคุณกำหนดค่า seed เฉพาะ พารามิเตอร์เหล่านี้ให้คุณมีความแม่นยำที่จำเป็นในการผสานรวมโมเดลเข้ากับสภาพแวดล้อมการผลิตโดยไม่มีการเปลี่ยนแปลงที่ไม่คาดคิด
การจัดการการตอบกลับแบบสตรีมมิง
สำหรับแอปพลิเคชันที่ต้องการการตอบกลับแบบเรียลไทม์ API uncensored qwen รองรับ Server-Sent Events (SSE) การสตรีมมิงช่วยให้คุณได้รับโทเคนเมื่อถูกสร้างขึ้น แทนที่จะรอให้การตอบกลับทั้งหมดเสร็จสิ้น สิ่งนี้ปรับปรุงประสบการณ์ของผู้ใช้ในอินเทอร์เฟซแชทและเครื่องมือแบบโต้ตอบได้อย่างมีนัยสำคัญ
เมื่อคุณตั้งค่าพารามิเตอร์ stream เป็น true API จะส่งชุดของ chunks แต่ละ chunk จะประกอบด้วย partial completion และสถิติการใช้งาน chunk สุดท้ายจะรวมถึงจำนวนโทเคนรวมสำหรับคำขอ ซึ่งมีความสำคัญสำหรับการเรียกเก็บเงินและการตรวจสอบที่แม่นยำ คุณสมบัตินี้มีประโยชน์เป็นพิเศษสำหรับการตอบกลับที่ยาวนานเนื่องจากลดเวลาแฝงที่รับรู้ได้
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)การนำการสตรีมมิงไปใช้ต้องการการจัดการเหตุการณ์ SSE ในโค้ดไคลเอนต์ของคุณ SDK สมัยใหม่มักมีการรองรับในตัวสำหรับสิ่งนี้ ทำให้การผสานรวมทำได้ง่าย คุณสามารถอัปเดต UI ได้แบบเรียลไทม์เมื่อโทเคนมาถึง ซึ่งให้การโต้ตอบที่ราบรื่นและตอบสนองได้รวดเร็ว ความสามารถนี้เป็นมาตรฐานในระบบนิเวศที่เข้ากันได้กับ OpenAI ซึ่งรับประกันความเข้ากันได้กับโครงสร้างพื้นฐานที่มีอยู่ของคุณ
การนำ Function Calling ไปใช้
ฟีเจอร์ที่ทรงพลังที่สุดอย่างหนึ่งของ qwen api คือการรองรับการเรียกใช้ฟังก์ชัน (หรือที่เรียกว่าการใช้เครื่องมือ) สิ่งนี้ทำให้โมเดลสามารถสร้างข้อมูล JSON ที่มีโครงสร้างซึ่งกระตุ้นการกระทำเฉพาะในแอปพลิเคชันของคุณ คุณกำหนดฟังก์ชันที่คุณต้องการให้โมเดลเรียก รวมถึงชื่อ คำอธิบาย และสคีมาของพารามิเตอร์
จากนั้นโมเดลจะตัดสินใจเมื่อจะเรียกใช้ฟังก์ชันและให้อาร์กิวเมนต์ที่จำเป็น สิ่งนี้มีคุณค่าอย่างยิ่งสำหรับการสร้างเอเจนต์ที่สามารถโต้ตอบกับระบบภายนอก เช่น การดึงข้อมูลสภาพอากาศ การสอบถามฐานข้อมูล หรือการควบคุมอุปกรณ์อัจฉริยะ พารามิเตอร์ response_format สามารถตั้งค่าเป็น json_object เพื่อให้แน่ใจว่าผลลัพธ์เป็น JSON ที่ถูกต้องอย่างเคร่งครัด ซึ่งมีความสำคัญต่อการแยกวิเคราะห์ที่เชื่อถือได้
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);การเรียกใช้ฟังก์ชันเพิ่มประโยชน์ใช้สอยของโมเดลเกินกว่าการสร้างข้อความแบบง่าย มันเชื่อมโยงช่องว่างระหว่างความเข้าใจภาษาธรรมชาติและการทำงานตามโปรแกรม โดยการใช้คุณสมบัตินี้ คุณสามารถสร้างแอปพลิเคชันที่ซับซ้อนมากขึ้นที่สามารถดำเนินการตามเจตนาของผู้ใช้ ความสามารถของโมเดลในการเข้าใจสคีมาที่ซับซ้อนทำให้มันเป็นเครื่องมืออเนกประสงค์สำหรับสถาปัตยกรรมที่ขับเคลื่อนด้วย API ในยุคปัจจุบัน
การติดตามการใช้โทเคน
ความเข้าใจในการใช้งานโทเคนของคุณเป็นกุญแจสำคัญในการจัดการต้นทุนอย่างมีประสิทธิภาพ qwen api ให้สถิติการใช้งานโดยละเอียดในการตอบกลับทุกครั้ง โดยเฉพาะเมื่อสตรีมมิง แต่ละ chunk ในการตอบกลับแบบสตรีมมิงจะรวมถึงจำนวนโทเคน และ chunk สุดท้ายจะให้จำนวนโทเคนอินพุตและเอาต์พุตรวมสำหรับคำขอ
ความโปร่งใสนี้ช่วยให้คุณติดตามต้นทุนแบบเรียลไทม์ คุณสามารถใช้ตรรกะในแอปพลิเคชันของคุณเพื่อหยุดการสร้างข้อความหากจำนวนโทเคนเข้าใกล้ขีดจำกัด tertentu เพื่อป้องกันค่าใช้จ่ายที่ไม่คาดคิด โมเดลแบบเติมเงินล่วงหน้ารับประกันว่าคุณจะจ่ายเฉพาะสิ่งที่ใช้เท่านั้น ไม่มีค่าธรรมเนียมที่ซ่อนอยู่หรือต้นทุนการสมัครสมาชิก ข้อผิดพลาดและการปฏิเสธไม่เรียกเก็บเงิน ดังนั้นคุณสามารถทดลองได้อย่างอิสระ
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)โดยการตรวจสอบการใช้งาน คุณสามารถปรับแต่งพรอมต์และปรับพารามิเตอร์เพื่อปรับสมดุลระหว่างต้นทุนและประสิทธิภาพ ตัวอย่างเช่น การลด temperature อาจลดจำนวนโทเคนในบางกรณี ในขณะที่การเพิ่มอาจปรับปรุงคุณภาพการตอบกลับ การตรวจสอบข้อมูลการใช้งานของคุณเป็นประจำช่วยให้คุณระบุจุดที่ไม่มีประสิทธิภาพและปรับปรุงประสิทธิภาพโดยรวมของแอปพลิเคชันของคุณ
การจัดการยอดเงินเติม
qwen api ทำงานบนระบบเครดิตแบบเติมเงินล่วงหน้า ซึ่งขจัดความเสี่ยงจากบิลที่ไม่คาดคิด คุณเติมเงินบัญชีของคุณโดยใช้คริปโทเคอร์เรนซี โดยเฉพาะ USDT บนเครือข่าย TRC20 หรือ USDC บนเครือข่าย Base ไม่มีสมาชิกรายเดือนหรือพันธกรณีรายปี giving you full control over your spending
คุณสามารถเติมเงินจำนวนเต็มใดๆ ระหว่าง $10 ถึง $500 สำหรับการเติมเงินจำนวนมากขึ้น คุณจะได้รับเครดิตโบนัส: +5% สำหรับ $50 และ +10% สำหรับ $100 เครดิตโบนัสนี้ยืดอายุการใช้งานของยอดเงินของคุณและให้มูลค่าที่ดีขึ้น เครดิตของคุณไม่หมดอายุ ดังนั้นคุณสามารถเติมเงินเมื่อราคาเอื้ออำนวยและใช้งานได้ตลอดเวลา
ไม่มีการคืนเงินสำหรับเครดิต แต่ข้อผิดพลาดเช่นการเรียกเก็บเงินซ้ำจะได้รับการจัดการผ่านหน้าสนับสนุน โมเดลการเติมเงินนี้เหมาะสำหรับนักพัฒนาที่ต้องการต้นทุนที่คาดการณ์ได้และการเข้าถึง API ทันที นอกจากนี้ยังช่วยทำให้การวางแผนงบประมาณง่ายขึ้น เนื่องจากคุณทราบจำนวนคำขอที่งบประมาณของคุณสามารถรองรับได้โดยอ้างอิงจากราคาโทเคน
ถาม-ตอบ
ขนาดหน้าต่างบริบทสำหรับโมเดล qwen แบบไม่เซ็นเซอร์คืออะไร?
โมเดลรองรับหน้าต่างบริบทขนาด 100,000 โทเคน ซึ่งรวมถึงทั้งพรอมต์และการสร้างข้อความตอบกลับ (completion) สิ่งนี้ช่วยให้สามารถประมวลผลเอกสารขนาดใหญ่และรักษาการสนทนาที่ยาวนานได้โดยไม่มีการตัดทอน อย่างไรก็ตาม ผลลัพธ์สูงสุดต่อคำขอคือ 32,000 โทเคน หรือ 2,048 หากไม่ได้ระบุ
ฉันจะชำระเงินสำหรับบริการ API ได้อย่างไร?
การชำระเงินยอมรับผ่านคริปโทเคอร์เรนซีเท่านั้น: USDT บนเครือข่าย TRC20 หรือ USDC บนเครือข่าย Base คุณสามารถเติมเงินจำนวนเต็มใดๆ ตั้งแต่ $10 ถึง $500 โดยมีเครดิตโบนัสสำหรับจำนวนที่สูงขึ้น ไม่มีบัตรเครดิต PayPal หรือการโอนเงินผ่านธนาคารที่ยอมรับ
โมเดล qwen แบบไม่เซ็นเซอร์ปฏิเสธเนื้อหาหรือไม่?
โมเดลได้รับการปรับแต่งให้ตอบคำถามโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย โมเดลไม่บล็อกหัวข้อที่ถกเถกัน เนื้อหาเชิงสมมติ หรือหัวข้อด้านการวิจัยความปลอดภัย อย่างไรก็ตาม โมเดลมีขีดจำกัดที่แข็งเกร็งที่บล็อกเนื้อหาทางเพศที่เกี่ยวข้องกับเด็ก ซึ่งจะถูกบังคับใช้เสมอ
ฉันสามารถใช้ API นี้กับ SDK มาตรฐานของ OpenAI ได้หรือไม่?
ใช่ API นี้เข้ากันได้กับ OpenAI คุณสามารถใช้ SDK ทางการของ OpenAI หรือไคลเอนต์ที่เข้ากันได้ใดๆ ได้โดยการเปลี่ยน base URL เป็น https://api.qwenapi.top/v1 และอัปเดตคีย์ API ของคุณ โครงสร้างเอนด์พอยต์และรูปแบบคำขอจะเหมือนกับ API การสร้างข้อความสนทนามาตรฐานของ OpenAI
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน base URL นั่นคือการตั้งค่าทั้งหมด