TH ▾

ผสานรวม API โมเดลภาษาขนาดใหญ่แบบไม่เซ็นเซอร์อย่างรวดเร็ว

ด้วยการกำหนดค่าพื้นฐานและตัวอย่างโค้ดง่ายๆ คุณสามารถนำโมเดลภาษาขนาดใหญ่แบบไม่เซ็นเซอร์ไปใช้ในแอปพลิเคชันของคุณภายในไม่กี่นาที เราให้บริการ API gateway ที่เข้ากันได้กับโปรโตคอลมาตรฐานของ OpenAI รองรับสตรีมมิงและการเรียกใช้เครื่องมือ เพื่อช่วยคุณสร้างแอปพลิเคชันที่ไม่ถูกจำกัดเนื้อหาได้อย่างรวดเร็ว

การกำหนดค่าพื้นฐาน

หัวใจสำคัญของการเชื่อมต่อ API gateway คือการกำหนดค่า Base URL และ凭证การตรวจสอบสิทธิ์ให้ถูกต้อง บริการของเราเข้ากันได้กับโปรโตคอล OpenAI อย่างสมบูรณ์ คุณเพียงแค่ตั้งค่า Base URL เป็น https://api.llmzhongzhuan.com/v1 และแนบ API Key ของคุณในหัวขอ HTTP เท่านั้น

แต่ละบัญชีจะได้รับ API Key เพียงคีย์เดียว ซึ่งจะแสดงทันทีหลังการลงทะเบียน หากต้องการเปลี่ยน สามารถสร้างใหม่ในแผงควบคุม โดยคีย์เก่าจะหมดอายุทันที การออกแบบนี้ช่วยทำให้กระบวนการตรวจสอบสิทธิ์ง่ายขึ้น และรับประกันความปลอดภัยในการเข้าถึง เราไม่รองรับการจัดการคีย์หลายคีย์แบบขนาน แนะนำให้เก็บรักษาคีย์อย่างเหมาะสมตามสถาปัตยกรรมแอปพลิเคชันของคุณ

อินเทอร์เฟซการสนทนาแบบสร้างได้

อินเตอร์เฟซการสนทนามาตรฐานอยู่ที่ POST /v1/chat/completions ร่างคำขอต้องประกอบด้วย model (คงที่เป็น uncensored), messages อาร์เรย์ และพารามิเตอร์เสริม อินเตอร์เฟซนี้รองรับการตอบกลับแบบไม่สตรีมมิง เหมาะสำหรับสถานการณ์ที่ต้องการผลลัพธ์ครบถ้วน

โมเดลทำงานบนเซิร์ฟเวอร์ GPU ประสิทธิภาพสูงที่ติดตั้งแยกต่างหาก มีหน้าต่างบริบทสูงถึง 100,000 โทเคน ไม่ว่าการประมวลผลข้อความยาวหรือการปฏิบัติตามคำสั่งที่ซับซ้อน จะให้ประสบการณ์การเข้าถึง API ดั้งเดิมที่เสถียร

curl https://api.llmzhongzhuan.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

การตอบสนองแบบสตรีม (SSE)

สำหรับแอปพลิเคชันที่ต้องการการตอบกลับแบบเรียลไทม์ ให้เปิดใช้งานพารามิเตอร์ stream: true เพื่อรับ chunked response ผ่าน Server-Sent Events (SSE) การสตรีมมิงช่วยลดความล่าช้าในการส่งคำแรก (TTFT) อย่างมีนัยสำคัญ และยกระดับประสบการณ์ผู้ใช้

เซิร์ฟเวอร์จะส่งข้อมูล JSON ทีละส่วนอย่างต่อเนื่องจนกว่าการตอบสนองจะสิ้นสุด ไคลเอนต์ต้องนำข้อมูลเหล่านี้มาประกอบกันเพื่อสร้างข้อความสมบูรณ์ โหมดนี้เหมาะมากสำหรับแชทบอทหรือสถานการณ์การสร้างเนื้อหาแบบเรียลไทม์ เพื่อให้แน่ใจว่าข้อมูลจะถึงผู้ใช้ปลายทางอย่างรวดเร็ว

from openai import OpenAI

client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

การสอบถามรายการโมเดล

สามารถรับรายการโมเดลที่มีอยู่ในปัจจุบันผ่าน GET /v1/models คำขอจะส่งคืนการตอบสนอง JSON มาตรฐานที่มีฟิลด์ id, object และ owned_by เป็นต้น

ปัจจุบันมีเพียง ID โมเดลเดียวคือ: uncensored โมเดลนี้เป็นโมเดลแบบเปิดน้ำหนัก ซึ่งได้รับการปรับแต่งพิเศษเพื่อลบการเซ็นเซอร์เนื้อหา เหมาะสำหรับเนื้อหาสำหรับผู้ใหญ่ การวิจัยด้านความปลอดภัย และหัวข้อถกเถียง โปรดทราบว่าเราไม่ให้บริการ Embedding หรือการสร้างมัลติโมดัล โดยมุ่งเน้นที่การสนทนาข้อความล้วน

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

การจัดการข้อผิดพลาดและขีดจำกัดอัตรา

บริการปฏิบัติตามมาตรฐานรหัสสถานะ HTTP 401 Unauthorized หมายถึง API Key ไม่ถูกต้อง; 402 Payment Required หมายถึงยอดคงเหลือในบัญชีไม่เพียงพอ ต้องเติมเงินก่อนจึงจะส่งคำขอต่อได้; 429 Too Many Requests หมายถึงเกินขีดจำกัดอัตรา โดยจำกัดไว้ที่ 300 คำขอต่อนาที

นอกจากนี้ ขนาดของ request body ต่อคำขอจำกัดไว้ที่ 8 MB หากพบ rate limit แนะนำให้ใช้กลยุทธ์การลองซ้ำแบบ exponential backoff บริการ AI ไม่เซ็นเซอร์ของเรารักษา throughput สูงไปพร้อมกันกับการกระจายทรัพยากรอย่างเป็นธรรม

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

ตัวอย่างโค้ด

นี่คือตัวอย่างที่สมบูรณ์สำหรับการส่งคำขอแบบสตรีมโดยใช้ Python SDK โค้ดแสดงวิธีการเริ่มต้นไคลเอนต์ สร้างประวัติข้อความ และจัดการสตรีมข้อมูล SSE

โปรดตรวจสอบให้แน่ใจว่าได้ติดตั้งไลบรารี openai แล้ว และแทนที่ YOUR_API_KEY ด้วยคีย์จริง ตัวอย่างนี้แสดงให้เห็นอย่างชัดเจนว่าวิธีการรับผลลัพธ์การสร้างแบบเรียลไทม์จาก api zhongzhuan สำหรับโมเดลที่ไม่มีการเซ็นเซอร์ เพื่อช่วยให้ผู้พัฒนาสามารถผสานรวมเข้ากับระบบที่มีอยู่ได้อย่างรวดเร็ว

ข้อมูลจำเพาะ API

ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน

รายการค่า
รูปแบบ APIรองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์
เอนด์พอยต์POST /v1/chat/completions · GET /v1/models
ID โมเดลuncensored
การยืนยันตัวตนAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmzhongzhuan.com/v1
เอาต์พุตสูงสุดได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก)
พารามิเตอร์temperature, top_p, stop, seed, presence_penalty, frequency_penalty
สตรีมมิงรองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้
หน้าต่างบริบท100,000 โทเคน (อินพุตรวมเอาต์พุต)
การเรียกใช้ฟังก์ชันรองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool
โหมด JSONresponse_format: {"type": "json_object"}
คำขอพร้อมกันสูงสุด 8 คำขอพร้อมกันต่อคีย์
เฮดเดอร์ของคำตอบX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
ขีดจำกัดอัตรา300 คำขอต่อนาทีต่อคีย์
ขนาดคำขอไม่เกิน 8 MB
เครดิตทดลองใช้ฟรี$0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก
เติมเงินUSDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500
โบนัส+5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100
อายุเครดิตเครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน
การคิดเงินเครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน
ราคา$0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต
คีย์หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม
เข้าสู่ระบบGoogle หรืออีเมลและรหัสผ่าน
เนื้อหาอนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์

รหัสข้อผิดพลาด

ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน

รหัสประเภทความหมาย
400bad_requestJSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท
401missing_key · invalid_key · key_revokedไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว
402no_creditเครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที
403content_blockedเนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน
404not_foundไม่รู้จักเอนด์พอยต์
413request_too_largeขนาดเกิน 8 MB
429rate_limited · concurrencyเกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่
503upstream_busyโมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที

คำถามที่พบบ่อย

บัญชีสามารถมี API Key ได้หลายคีย์หรือไม่?

บัญชีหนึ่งมีคีย์ API ได้เพียงหนึ่งคีย์ หากเปลี่ยน สามารถสร้างคีย์ใหม่ได้ทันที โดยคีย์เก่าจะหมดอายุทันที การออกแบบนี้ช่วยจัดการสิทธิ์ให้สะดวกขึ้น

API Key สามารถใช้กับแอปพลิเคชันหลายตัวได้หรือไม่?

ได้ API Key เดียวสามารถนำไปใช้ซ้ำในแอปพลิเคชันหรือสภาพแวดล้อมหลายแห่งได้ ตราบใดที่พวกเขาใช้โควตาของบัญชีเดียวกัน เนื่องจากแต่ละบัญชีมีเพียงคีย์เดียว จึงแนะนำให้จัดการการใช้งานหลายแอปพลิเคชันผ่านการตรวจสอบความถี่ของคำขอและยอดคงเหลือ

โมเดลแบบไม่เซ็นเซอร์มีเนื้อหาสำหรับผู้ใหญ่ทั้งหมดหรือไม่?

โมเดลไม่เซ็นเซอร์เนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมาย เรื่องแต่ง และหัวข้อถกเถียง แต่ห้ามเนื้อหาลามกอนาจารที่เกี่ยวข้องกับเด็กอย่างเคร่งครัด นี่คือข้อจำกัดเนื้อหาเพียงข้อเดียวเพื่อให้สอดคล้องกับข้อกำหนดพื้นฐาน เนื้อหาผู้ใหญ่ประเภทอื่นสร้างได้ตามปกติ

เพียงกรอกแบบฟอร์มเพื่อรับคีย์

สร้างบัญชี คัดลอกคีย์ แก้ไข Base URL การ configuration ก็ง่ายแค่นี้

รับคีย์ API