ผสานรวม API โมเดลภาษาขนาดใหญ่แบบไม่เซ็นเซอร์อย่างรวดเร็ว
ด้วยการกำหนดค่าพื้นฐานและตัวอย่างโค้ดง่ายๆ คุณสามารถนำโมเดลภาษาขนาดใหญ่แบบไม่เซ็นเซอร์ไปใช้ในแอปพลิเคชันของคุณภายในไม่กี่นาที เราให้บริการ API gateway ที่เข้ากันได้กับโปรโตคอลมาตรฐานของ OpenAI รองรับสตรีมมิงและการเรียกใช้เครื่องมือ เพื่อช่วยคุณสร้างแอปพลิเคชันที่ไม่ถูกจำกัดเนื้อหาได้อย่างรวดเร็ว
การกำหนดค่าพื้นฐาน
หัวใจสำคัญของการเชื่อมต่อ API gateway คือการกำหนดค่า Base URL และ凭证การตรวจสอบสิทธิ์ให้ถูกต้อง บริการของเราเข้ากันได้กับโปรโตคอล OpenAI อย่างสมบูรณ์ คุณเพียงแค่ตั้งค่า Base URL เป็น https://api.llmzhongzhuan.com/v1 และแนบ API Key ของคุณในหัวขอ HTTP เท่านั้น
แต่ละบัญชีจะได้รับ API Key เพียงคีย์เดียว ซึ่งจะแสดงทันทีหลังการลงทะเบียน หากต้องการเปลี่ยน สามารถสร้างใหม่ในแผงควบคุม โดยคีย์เก่าจะหมดอายุทันที การออกแบบนี้ช่วยทำให้กระบวนการตรวจสอบสิทธิ์ง่ายขึ้น และรับประกันความปลอดภัยในการเข้าถึง เราไม่รองรับการจัดการคีย์หลายคีย์แบบขนาน แนะนำให้เก็บรักษาคีย์อย่างเหมาะสมตามสถาปัตยกรรมแอปพลิเคชันของคุณ
อินเทอร์เฟซการสนทนาแบบสร้างได้
อินเตอร์เฟซการสนทนามาตรฐานอยู่ที่ POST /v1/chat/completions ร่างคำขอต้องประกอบด้วย model (คงที่เป็น uncensored), messages อาร์เรย์ และพารามิเตอร์เสริม อินเตอร์เฟซนี้รองรับการตอบกลับแบบไม่สตรีมมิง เหมาะสำหรับสถานการณ์ที่ต้องการผลลัพธ์ครบถ้วน
โมเดลทำงานบนเซิร์ฟเวอร์ GPU ประสิทธิภาพสูงที่ติดตั้งแยกต่างหาก มีหน้าต่างบริบทสูงถึง 100,000 โทเคน ไม่ว่าการประมวลผลข้อความยาวหรือการปฏิบัติตามคำสั่งที่ซับซ้อน จะให้ประสบการณ์การเข้าถึง API ดั้งเดิมที่เสถียร
curl https://api.llmzhongzhuan.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
การตอบสนองแบบสตรีม (SSE)
สำหรับแอปพลิเคชันที่ต้องการการตอบกลับแบบเรียลไทม์ ให้เปิดใช้งานพารามิเตอร์ stream: true เพื่อรับ chunked response ผ่าน Server-Sent Events (SSE) การสตรีมมิงช่วยลดความล่าช้าในการส่งคำแรก (TTFT) อย่างมีนัยสำคัญ และยกระดับประสบการณ์ผู้ใช้
เซิร์ฟเวอร์จะส่งข้อมูล JSON ทีละส่วนอย่างต่อเนื่องจนกว่าการตอบสนองจะสิ้นสุด ไคลเอนต์ต้องนำข้อมูลเหล่านี้มาประกอบกันเพื่อสร้างข้อความสมบูรณ์ โหมดนี้เหมาะมากสำหรับแชทบอทหรือสถานการณ์การสร้างเนื้อหาแบบเรียลไทม์ เพื่อให้แน่ใจว่าข้อมูลจะถึงผู้ใช้ปลายทางอย่างรวดเร็ว
from openai import OpenAI
client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
การสอบถามรายการโมเดล
สามารถรับรายการโมเดลที่มีอยู่ในปัจจุบันผ่าน GET /v1/models คำขอจะส่งคืนการตอบสนอง JSON มาตรฐานที่มีฟิลด์ id, object และ owned_by เป็นต้น
ปัจจุบันมีเพียง ID โมเดลเดียวคือ: uncensored โมเดลนี้เป็นโมเดลแบบเปิดน้ำหนัก ซึ่งได้รับการปรับแต่งพิเศษเพื่อลบการเซ็นเซอร์เนื้อหา เหมาะสำหรับเนื้อหาสำหรับผู้ใหญ่ การวิจัยด้านความปลอดภัย และหัวข้อถกเถียง โปรดทราบว่าเราไม่ให้บริการ Embedding หรือการสร้างมัลติโมดัล โดยมุ่งเน้นที่การสนทนาข้อความล้วน
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
การจัดการข้อผิดพลาดและขีดจำกัดอัตรา
บริการปฏิบัติตามมาตรฐานรหัสสถานะ HTTP 401 Unauthorized หมายถึง API Key ไม่ถูกต้อง; 402 Payment Required หมายถึงยอดคงเหลือในบัญชีไม่เพียงพอ ต้องเติมเงินก่อนจึงจะส่งคำขอต่อได้; 429 Too Many Requests หมายถึงเกินขีดจำกัดอัตรา โดยจำกัดไว้ที่ 300 คำขอต่อนาที
นอกจากนี้ ขนาดของ request body ต่อคำขอจำกัดไว้ที่ 8 MB หากพบ rate limit แนะนำให้ใช้กลยุทธ์การลองซ้ำแบบ exponential backoff บริการ AI ไม่เซ็นเซอร์ของเรารักษา throughput สูงไปพร้อมกันกับการกระจายทรัพยากรอย่างเป็นธรรม
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
ตัวอย่างโค้ด
นี่คือตัวอย่างที่สมบูรณ์สำหรับการส่งคำขอแบบสตรีมโดยใช้ Python SDK โค้ดแสดงวิธีการเริ่มต้นไคลเอนต์ สร้างประวัติข้อความ และจัดการสตรีมข้อมูล SSE
โปรดตรวจสอบให้แน่ใจว่าได้ติดตั้งไลบรารี openai แล้ว และแทนที่ YOUR_API_KEY ด้วยคีย์จริง ตัวอย่างนี้แสดงให้เห็นอย่างชัดเจนว่าวิธีการรับผลลัพธ์การสร้างแบบเรียลไทม์จาก api zhongzhuan สำหรับโมเดลที่ไม่มีการเซ็นเซอร์ เพื่อช่วยให้ผู้พัฒนาสามารถผสานรวมเข้ากับระบบที่มีอยู่ได้อย่างรวดเร็ว
ข้อมูลจำเพาะ API
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| ID โมเดล | uncensored |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmzhongzhuan.com/v1 |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| โหมด JSON | response_format: {"type": "json_object"} |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
คำถามที่พบบ่อย
บัญชีสามารถมี API Key ได้หลายคีย์หรือไม่?
บัญชีหนึ่งมีคีย์ API ได้เพียงหนึ่งคีย์ หากเปลี่ยน สามารถสร้างคีย์ใหม่ได้ทันที โดยคีย์เก่าจะหมดอายุทันที การออกแบบนี้ช่วยจัดการสิทธิ์ให้สะดวกขึ้น
API Key สามารถใช้กับแอปพลิเคชันหลายตัวได้หรือไม่?
ได้ API Key เดียวสามารถนำไปใช้ซ้ำในแอปพลิเคชันหรือสภาพแวดล้อมหลายแห่งได้ ตราบใดที่พวกเขาใช้โควตาของบัญชีเดียวกัน เนื่องจากแต่ละบัญชีมีเพียงคีย์เดียว จึงแนะนำให้จัดการการใช้งานหลายแอปพลิเคชันผ่านการตรวจสอบความถี่ของคำขอและยอดคงเหลือ
โมเดลแบบไม่เซ็นเซอร์มีเนื้อหาสำหรับผู้ใหญ่ทั้งหมดหรือไม่?
โมเดลไม่เซ็นเซอร์เนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมาย เรื่องแต่ง และหัวข้อถกเถียง แต่ห้ามเนื้อหาลามกอนาจารที่เกี่ยวข้องกับเด็กอย่างเคร่งครัด นี่คือข้อจำกัดเนื้อหาเพียงข้อเดียวเพื่อให้สอดคล้องกับข้อกำหนดพื้นฐาน เนื้อหาผู้ใหญ่ประเภทอื่นสร้างได้ตามปกติ
เพียงกรอกแบบฟอร์มเพื่อรับคีย์
สร้างบัญชี คัดลอกคีย์ แก้ไข Base URL การ configuration ก็ง่ายแค่นี้