बिना सेंसर बड़े मॉडल API का तेज़ एकीकरण
मूल कॉन्फ़िगरेशन और सरल कोड उदाहरणों के माध्यम से, बिना सेंसर LLM को अपने एप्लिकेशन में मिनटों में जोड़ें। हम OpenAI प्रोटोकॉल के अनुरूप API एंडपॉइंट सेवा प्रदान करते हैं, जो स्ट्रीमिंग और टूल कॉलिंग का समर्थन करती है।
मूल कॉन्फ़िगरेशन
API मध्यस्थ सेवा से जुड़ने की मुख्य बात सही Base URL और प्रमाणीकरण प्रमाणपत्र कॉन्फ़िगर करना है। हमारी सेवा पूरी तरह से OpenAI प्रोटोकॉल के साथ संगत है; आपको केवल Base URL को https://api.llmzhongzhuan.com/v1 पर सेट करना है और अनुरोध हेडर में अपनी API कुंजी प्रदान करनी है।
प्रत्येक खाते को केवल एक API कुंजी आवंटित की जाती है, जो पंजीकरण के तुरंत बाद प्रदर्शित होती है। यदि बदलना हो, तो बैकएंड में पुनः जनरेट करें; पुरानी कुंजी तुरंत अमान्य हो जाएगी। यह डिज़ाइन प्रमाणीकरण प्रक्रिया को सरल बनाता है और प्रवेश सुरक्षा को सुनिश्चित करता है। हम बहु-कुंजी समानांतर प्रबंधन का समर्थन नहीं करते हैं; अपनी एप्लिकेशन आर्किटेक्चर के अनुसार कुंजी का उचित प्रबंधन करने की सलाह दी जाती है।
जेनेरेटिव चैट इंटरफ़ेस
मानक चैट इंटरफ़ेस POST /v1/chat/completions पर स्थित है। अनुरोध बॉडी में model (स्थिर मान uncensored), messages सरणी और वैकल्पिक पैरामीटर शामिल होने चाहिए। यह इंटरफ़ेस गैर-स्ट्रीमिंग प्रतिक्रिया का समर्थन करता है, जो पूर्ण परिणाम प्राप्त करने की आवश्यकता वाले परिदृश्यों के लिए उपयुक्त है।
मॉडल स्वतंत्र रूप से तैनात उच्च-प्रदर्शन GPU सर्वरों पर चलता है, जिसकी कॉन्टेक्स्ट विंडो 100,000 टोकन तक है। लंबे टेक्स्ट या जटिल निर्देशों के लिए स्थिर API अनुभव प्रदान करता है।
curl https://api.llmzhongzhuan.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
स्ट्रीमिंग प्रतिक्रिया (SSE)
रियल-टाइम फीडबैक वाले एप्लिकेशन के लिए, stream: true सक्षम करें और SSE के माध्यम से चंक प्रतिक्रिया प्राप्त करें। स्ट्रीमिंग से TTFT कम होता है और उपयोगकर्ता अनुभव बेहतर होता है।
सर्वर JSON खंडों को निरंतर धकेलता है जब तक कि प्रतिक्रिया समाप्त न हो जाए। क्लाइंट को इन खंडों को जोड़कर पूर्ण पाठ बनाना होगा। यह मोड चैटबॉट या वास्तविक सामग्री जनरेशन जैसे परिदृश्यों के लिए बहुत उपयुक्त है, जो सुनिश्चित करता है कि डेटा तेज़ी से अंतिम उपयोगकर्ता तक पहुंचे।
from openai import OpenAI
client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
मॉडल सूची क्वेरी
GET /v1/models के माध्यम से वर्तमान उपलब्ध मॉडल की सूची प्राप्त की जा सकती है। अनुरोध id, object और owned_by जैसे फ़ील्ड्स वाले मानक JSON प्रतिक्रिया लौटाएगा।
वर्तमान में केवल एक मॉडल ID है: uncensored। यह एक ओपन-वेट मॉडल है जिसे विशेष रूप से सेंसर हटाने के लिए ट्यून किया गया है। यह वयस्क सामग्री, सुरक्षा अनुसंधान और विवादित विषयों के लिए उपयुक्त है।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
त्रुटि प्रबंधन और रेट लिमिट
सेवा मानक HTTP स्टेटस कोड नियमों का पालन करती है। 401 Unauthorized का अर्थ है कि API कुंजी अमान्य है; 402 Payment Required का अर्थ है कि खाते का शेष राशि कम है, अनुरोध जारी रखने के लिए टॉप-अप करना आवश्यक है; 429 Too Many Requests का अर्थ है कि रेट लिमिट ट्रिगर हो गया है, वर्तमान सीमा प्रति मिनट 300 अनुरोध है।
इसके अलावा, एक अनुरोध बॉडी का आकार 8 MB तक सीमित है। यदि रेट लिमिट मिले, तो एक्सपोनेंशियल बैकऑफ़ रीट्राई लागू करें। हमारी बिना सेंसर AI सेवा उच्च थ्रूपुट बनाए रखते हुए संसाधन वितरण की समानता सुनिश्चित करती है।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
उदाहरण कोड
नीचे Python SDK के साथ स्ट्रीमिंग अनुरोध का पूर्ण उदाहरण दिया गया है। कोड क्लाइंट को इनिशियलाइज़ करने, संदेश इतिहास बनाने और SSE डेटा स्ट्रीम को हैंडल करने का प्रदर्शन करता है।
सुनिश्चित करें कि openai लाइब्रेरी इंस्टॉल है और YOUR_API_KEY को वास्तविक कुंजी से बदलें। यह उदाहरण दिखाता है कि api एंडपॉइंट इंटरफ़ेस के माध्यम से बिना प्रतिबंध AI से रियल-टाइम परिणाम कैसे प्राप्त करें।
API विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| मॉडल ID | uncensored |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmzhongzhuan.com/v1 |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| JSON मोड | response_format: {"type": "json_object"} |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| अनुरोध का आकार | 8 MB तक |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| बोनस | $50 से +5%, $100 से +10% |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| साइन इन | Google या ईमेल और पासवर्ड |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
अक्सर पूछे जाने वाले प्रश्न
खाते में कई API कुंजी हो सकती हैं?
प्रत्येक खाते के लिए केवल एक API कुंजी की अनुमति है। यदि कुंजी बदलनी हो, तो बैकएंड में नई कुंजी जनरेट करें; पुरानी कुंजी तुरंत अमान्य हो जाएगी। यह डिज़ाइन अधिकार प्रबंधन को सरल बनाता है और सुनिश्चित करता है कि प्रत्येक खाते के लिए प्रवेश प्रमाणपत्र अद्वितीय और स्पष्ट हो।
API कुंजी कई एप्लिकेशन के लिए उपयोग की जा सकती है?
हाँ, एकल API कुंजी को कई एप्लिकेशन या वातावरण में पुन: उपयोग किया जा सकता है, जब तक कि वे एक ही खाते की क्वाटा साझा करते हैं। चूँकि प्रत्येक खाते में केवल एक कुंजी होती है, बहु-एप्लिकेशन उपयोग को अनुरोध आवृत्ति और शेष राशि की निगरानी द्वारा प्रबंधित करने की सलाह दी जाती है।
बिना सेंसर मॉडल सभी वयस्क सामग्री को शामिल करता है?
मॉडल कानूनी वयस्क सामग्री, काल्पनिक कहानियों और विवादित विषयों पर बिना सेंसर है, लेकिन किशोरों की यौन सामग्री पर कड़ा प्रतिबंध है। यह एकमात्र कठोर सीमा है जो मौलिक अनुपालन सुनिश्चित करती है।
केवल फॉर्म भरें और कुंजी प्राप्त करें
खाता बनाएं, कुंजी कॉपी करें, Base URL बदलें। कॉन्फ़िगरेशन इतना ही सरल है।