HI ▾

बिना सेंसर बड़े मॉडल API का तेज़ एकीकरण

मूल कॉन्फ़िगरेशन और सरल कोड उदाहरणों के माध्यम से, बिना सेंसर LLM को अपने एप्लिकेशन में मिनटों में जोड़ें। हम OpenAI प्रोटोकॉल के अनुरूप API एंडपॉइंट सेवा प्रदान करते हैं, जो स्ट्रीमिंग और टूल कॉलिंग का समर्थन करती है।

मूल कॉन्फ़िगरेशन

API मध्यस्थ सेवा से जुड़ने की मुख्य बात सही Base URL और प्रमाणीकरण प्रमाणपत्र कॉन्फ़िगर करना है। हमारी सेवा पूरी तरह से OpenAI प्रोटोकॉल के साथ संगत है; आपको केवल Base URL को https://api.llmzhongzhuan.com/v1 पर सेट करना है और अनुरोध हेडर में अपनी API कुंजी प्रदान करनी है।

प्रत्येक खाते को केवल एक API कुंजी आवंटित की जाती है, जो पंजीकरण के तुरंत बाद प्रदर्शित होती है। यदि बदलना हो, तो बैकएंड में पुनः जनरेट करें; पुरानी कुंजी तुरंत अमान्य हो जाएगी। यह डिज़ाइन प्रमाणीकरण प्रक्रिया को सरल बनाता है और प्रवेश सुरक्षा को सुनिश्चित करता है। हम बहु-कुंजी समानांतर प्रबंधन का समर्थन नहीं करते हैं; अपनी एप्लिकेशन आर्किटेक्चर के अनुसार कुंजी का उचित प्रबंधन करने की सलाह दी जाती है।

जेनेरेटिव चैट इंटरफ़ेस

मानक चैट इंटरफ़ेस POST /v1/chat/completions पर स्थित है। अनुरोध बॉडी में model (स्थिर मान uncensored), messages सरणी और वैकल्पिक पैरामीटर शामिल होने चाहिए। यह इंटरफ़ेस गैर-स्ट्रीमिंग प्रतिक्रिया का समर्थन करता है, जो पूर्ण परिणाम प्राप्त करने की आवश्यकता वाले परिदृश्यों के लिए उपयुक्त है।

मॉडल स्वतंत्र रूप से तैनात उच्च-प्रदर्शन GPU सर्वरों पर चलता है, जिसकी कॉन्टेक्स्ट विंडो 100,000 टोकन तक है। लंबे टेक्स्ट या जटिल निर्देशों के लिए स्थिर API अनुभव प्रदान करता है।

curl https://api.llmzhongzhuan.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

स्ट्रीमिंग प्रतिक्रिया (SSE)

रियल-टाइम फीडबैक वाले एप्लिकेशन के लिए, stream: true सक्षम करें और SSE के माध्यम से चंक प्रतिक्रिया प्राप्त करें। स्ट्रीमिंग से TTFT कम होता है और उपयोगकर्ता अनुभव बेहतर होता है।

सर्वर JSON खंडों को निरंतर धकेलता है जब तक कि प्रतिक्रिया समाप्त न हो जाए। क्लाइंट को इन खंडों को जोड़कर पूर्ण पाठ बनाना होगा। यह मोड चैटबॉट या वास्तविक सामग्री जनरेशन जैसे परिदृश्यों के लिए बहुत उपयुक्त है, जो सुनिश्चित करता है कि डेटा तेज़ी से अंतिम उपयोगकर्ता तक पहुंचे।

from openai import OpenAI

client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

मॉडल सूची क्वेरी

GET /v1/models के माध्यम से वर्तमान उपलब्ध मॉडल की सूची प्राप्त की जा सकती है। अनुरोध id, object और owned_by जैसे फ़ील्ड्स वाले मानक JSON प्रतिक्रिया लौटाएगा।

वर्तमान में केवल एक मॉडल ID है: uncensored। यह एक ओपन-वेट मॉडल है जिसे विशेष रूप से सेंसर हटाने के लिए ट्यून किया गया है। यह वयस्क सामग्री, सुरक्षा अनुसंधान और विवादित विषयों के लिए उपयुक्त है।

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

त्रुटि प्रबंधन और रेट लिमिट

सेवा मानक HTTP स्टेटस कोड नियमों का पालन करती है। 401 Unauthorized का अर्थ है कि API कुंजी अमान्य है; 402 Payment Required का अर्थ है कि खाते का शेष राशि कम है, अनुरोध जारी रखने के लिए टॉप-अप करना आवश्यक है; 429 Too Many Requests का अर्थ है कि रेट लिमिट ट्रिगर हो गया है, वर्तमान सीमा प्रति मिनट 300 अनुरोध है।

इसके अलावा, एक अनुरोध बॉडी का आकार 8 MB तक सीमित है। यदि रेट लिमिट मिले, तो एक्सपोनेंशियल बैकऑफ़ रीट्राई लागू करें। हमारी बिना सेंसर AI सेवा उच्च थ्रूपुट बनाए रखते हुए संसाधन वितरण की समानता सुनिश्चित करती है।

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

उदाहरण कोड

नीचे Python SDK के साथ स्ट्रीमिंग अनुरोध का पूर्ण उदाहरण दिया गया है। कोड क्लाइंट को इनिशियलाइज़ करने, संदेश इतिहास बनाने और SSE डेटा स्ट्रीम को हैंडल करने का प्रदर्शन करता है।

सुनिश्चित करें कि openai लाइब्रेरी इंस्टॉल है और YOUR_API_KEY को वास्तविक कुंजी से बदलें। यह उदाहरण दिखाता है कि api एंडपॉइंट इंटरफ़ेस के माध्यम से बिना प्रतिबंध AI से रियल-टाइम परिणाम कैसे प्राप्त करें।

API विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
मॉडल IDuncensored
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmzhongzhuan.com/v1
अधिकतम आउटपुट100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
कॉन्टेक्स्ट विंडो100,000 टोकन (इनपुट + आउटपुट मिलाकर)
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
JSON मोडresponse_format: {"type": "json_object"}
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
अनुरोध का आकार8 MB तक
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
बोनस$50 से +5%, $100 से +10%
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है
साइन इनGoogle या ईमेल और पासवर्ड
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें

अक्सर पूछे जाने वाले प्रश्न

खाते में कई API कुंजी हो सकती हैं?

प्रत्येक खाते के लिए केवल एक API कुंजी की अनुमति है। यदि कुंजी बदलनी हो, तो बैकएंड में नई कुंजी जनरेट करें; पुरानी कुंजी तुरंत अमान्य हो जाएगी। यह डिज़ाइन अधिकार प्रबंधन को सरल बनाता है और सुनिश्चित करता है कि प्रत्येक खाते के लिए प्रवेश प्रमाणपत्र अद्वितीय और स्पष्ट हो।

API कुंजी कई एप्लिकेशन के लिए उपयोग की जा सकती है?

हाँ, एकल API कुंजी को कई एप्लिकेशन या वातावरण में पुन: उपयोग किया जा सकता है, जब तक कि वे एक ही खाते की क्वाटा साझा करते हैं। चूँकि प्रत्येक खाते में केवल एक कुंजी होती है, बहु-एप्लिकेशन उपयोग को अनुरोध आवृत्ति और शेष राशि की निगरानी द्वारा प्रबंधित करने की सलाह दी जाती है।

बिना सेंसर मॉडल सभी वयस्क सामग्री को शामिल करता है?

मॉडल कानूनी वयस्क सामग्री, काल्पनिक कहानियों और विवादित विषयों पर बिना सेंसर है, लेकिन किशोरों की यौन सामग्री पर कड़ा प्रतिबंध है। यह एकमात्र कठोर सीमा है जो मौलिक अनुपालन सुनिश्चित करती है।

केवल फॉर्म भरें और कुंजी प्राप्त करें

खाता बनाएं, कुंजी कॉपी करें, Base URL बदलें। कॉन्फ़िगरेशन इतना ही सरल है।

API कुंजी प्राप्त करें