API मध्यस्थता: API कुंजी प्राप्त करने से लेकर त्रुटियों को हल करने तक
यहाँ डेवलपर्स द्वारा इंटीग्रेशन और उपयोग के दौरान बार-बार पूछे जाने वाले प्रश्नों के उत्तर दिए गए हैं, जिन्हें "शुरुआत, क्रेडिट और बिलिंग, त्रुटियाँ, क्षमता की सीमाएँ, सामग्री और गोपनीयता" के पाँच समूहों में व्यवस्थित किया गया है। प्रत्येक उत्तर विशिष्ट संख्याओं और कार्रवाइयों पर केंद्रित है, ताकि आप अपनी स्थिति के अनुसार तुरंत जांच सकें और यदि आवश्यक हो तो इंटरफ़ेस विवरण देखने के लिए दस्तावेज़ पृष्ठ पर वापस जा सकें।
मुख्य बिंदु
- साइन अप केवल ईमेल और पासवर्ड के साथ होता है, API कुंजी तुरंत दिखाई देती है; नए खाते में $0.50 का मुफ़्त ट्रायल क्रेडिट होता है, जो 7 दिनों के लिए मान्य है, भुगतान की जानकारी भरे बिना।
- 402 का अर्थ है बैलेंस खत्म हो गया है, 429 का अर्थ है अनुरोध बहुत तेज़ी से भेजे जा रहे हैं, और 503 का अर्थ है कि थोड़ी देर बाद फिर से प्रयास करें। इन तीनों के समाधान पूरी तरह अलग हैं।
- कॉन्टेक्स्ट विंडो 100,000 टोकन है, एकल आउटपुट की अधिकतम लंबाई 32,000 है, अनुरोध बॉडी 8 MB से अधिक नहीं होनी चाहिए, केवल टेक्स्ट समर्थित है।
- प्रॉम्प्ट को प्रशिक्षण के लिए इस्तेमाल नहीं किया जाएगा।
शुरुआत
पहली API कुंजी कैसे प्राप्त करें?
कुंजी पृष्ठ खोलें और ईमेल व पासवर्ड से साइन अप करें। साइन अप पूरा होते ही कुंजी तुरंत पृष्ठ पर दिख जाएगी। भुगतान की जानकारी भरने की आवश्यकता नहीं है; इसे कॉपी करके एनवायरनमेंट वेरिएबल में सेट करें और API कॉल शुरू करें।
एक खाते में कितनी API कुंजियाँ हो सकती हैं?
प्रत्येक खाते के लिए एक कुंजी। बदलने की आवश्यकता होने पर नई कुंजी जनरेट करें, लेकिन ध्यान रखें: नई कुंजी जनरेट करने के बाद पुरानी कुंजी तुरंत अमान्य हो जाएगी, और पुरानी कुंजी का उपयोग कर रही सभी सेवाएँ 401 त्रुटि प्राप्त करने लगेंगी। इसलिए कृपया नई कुंजी वितरण की प्रक्रिया तैयार करने के बाद ही यह ऑपरेशन करें।
एंडपॉइंट URL और मॉडल नाम क्या हैं?
URL https://api.llmzhongzhuan.com/v1,对话请求发往 /v1/chat/completions है, मॉडल सूची GET /v1/models से देखें। मॉडल नाम केवल एक है, जो uncensored लिखा जाता है।
मौजूदा OpenAI कोड को कैसे बदलें?
आमतौर पर केवल दो जगह बदलनी होती हैं: base_url को ऊपर दिए गए URL से बदलें, API कुंजी को साइट की API कुंजी से बदलें, और model फ़ील्ड को uncensored पर सेट करें। अनुरोध बॉडी और प्रतिक्रिया संरचना OpenAI चैट कॉम्पलीशन फॉर्मेट को बनाए रखती है, इसलिए अधिकांश कोड को नहीं बदलना पड़ता है। विशिष्ट फ़्रेमवर्क लेखन के लिए फ़्रेमवर्क कॉन्फ़िगरेशन देखें।
क्रेडिट और बिलिंग
मुफ़्त ट्रायल क्रेडिट कितना है और इसकी गणना कैसे की जाती है?
नए खाते को $0.50 दिया जाता है, जो 7 दिनों के लिए मान्य है। इनपुट के लिए प्रति मिलियन टोकन $0.25 और आउटपुट के लिए प्रति मिलियन टोकन $1.00 की दर से गणना की जाती है। मान लें कि प्रत्येक अनुरोध में 800 इनपुट टोकन और 400 आउटपुट टोकन हैं, तो एक अनुरोध लगभग $0.0006 का खर्च करता है, जिससे मुफ़्त ट्रायल क्रेडिट से लगभग 800 से अधिक ऐसे अनुरोध भेजे जा सकते हैं। यह एक अनुमानित गणना है, वास्तविकता आपकी प्रॉम्प्ट लंबाई पर निर्भर करती है।
टॉप-अप करने के बाद क्या प्रीपेड क्रेडिट समाप्त हो जाता है?
नहीं। टॉप-अप प्रीपेड क्रेडिट है, इसमें कोई सब्सक्रिप्शन नहीं है और न ही समाप्ति पर शून्य होने का नियम है। केवल मुफ़्त ट्रायल क्रेडिट पर ध्यान दें, जो 7 दिनों के बाद समाप्त हो जाता है।
एक अनुरोध में कितना खर्च हुआ, यह कैसे पता करें?
प्रतिक्रिया में usage फ़ील्ड होता है, जिसमें इनपुट और आउटपुट टोकन की संख्या होती है। स्ट्रीमिंग अनुरोधों में, अंत में स्वचालित रूप से एक अतिरिक्त स्ट्रीम चंक usage फ़ील्ड के साथ आता है। इन दो संख्याओं को प्रति टोकन मूल्य से गुणा करने पर उस अनुरोध की लागत निकलती है। स्थिरता प्रैक्टिस में मॉनिटरिंग के उदाहरण देखें।
पूर्ण मूल्य कहाँ देखें?
मूल्य मूल्य निर्धारण पृष्ठ पर निर्भर करते हैं। पृष्ठ पर इनपुट और आउटपुट के लिए अलग-अलग प्रति टोकन मूल्य स्पष्ट रूप से लिखा है, कोई छिपी हुई प्रति अनुरोध लागत नहीं है।
त्रुटियाँ और रेट लिमिट
402 लौटाया जाता है तो इसका क्या अर्थ है?
त्रुटि कोड no_credit है, जिसका अर्थ है कि खाते की शेष राशि खत्म हो गई है या मुफ़्त ट्रायल क्रेडिट समाप्त हो गया है। हल करने का एक ही तरीका है: प्रीपेड क्रेडिट टॉप-अप करें। इस त्रुटि के लिए रीट्राई न करें, रीट्राई से सफलता नहीं मिलेगी, केवल अतिरिक्त अनुरोध उत्पन्न होंगे।
429 लौटाया जाता है तो इसे कैसे संभालें?
प्रति API कुंजी प्रति मिनट अधिकतम 300 अनुरोध, सीमा पार करने पर 429 लौटाया जाता है। पहले भेजने की दर कम करें, फिर यादृच्छिक ज़िटर के साथ एक्सपोनेंशियल बैकऑफ़ रीट्राई जोड़ें। बैच प्रोसेसिंग के लिए समानांतर अनुरोध की अधिकतम सीमा और टिकर का उपयोग करके अनुरोधों को समतल करने की सलाह दी जाती है, उदाहरण कोड स्थिरता लेख में दिया गया है।
क्या 503 upstream_busy एक खराबी है?
नहीं, यह स्थायी खराबी नहीं है, इसका अर्थ है कि सेवा अस्थायी रूप से व्यस्त है। कुछ सेकंड बाद रीट्राई करने पर आमतौर पर सफलता मिल जाती है, एक्सपोनेंशियल बैकऑफ़ का उपयोग करने और अधिकतम रीट्राई संख्या को सीमित करने की सलाह दी जाती है।
403 content_blocked क्या है?
इसका अर्थ है कि अनुरोध में सामग्री ब्लॉकिंग ट्रिगर हुई है। किशोरों से संबंधित यौन सामग्री चाहे वह काल्पनिक हो या रोलप्ले, सभी मामलों में 403 लौटाया जाएगा। 403 मिलने पर अनुरोध को दोबारा भेजें नहीं, कृपया अनुरोध सामग्री की जाँच करें और उसे संशोधित करें।
क्षमता की सीमाएँ
कॉन्टेक्स्ट विंडो कितनी लंबी है, आउटपुट कितना लंबा लिखा जा सकता है?
कुल कॉन्टेक्स्ट विंडो 100,000 टोकन है, इनपुट और आउटपुट का योग इससे अधिक नहीं हो सकता। max_tokens डिफ़ॉल्ट रूप से 2048 है, एकल अनुरोध के लिए अधिकतम 32,000 तक सेट किया जा सकता है। यदि इनपुट plus max_tokens सीमा से अधिक हो जाता है, तो 400 लौटाया जाता है, लंबी सामग्री लिखते समय इनपुट के लिए स्थान छोड़ना न भूलें।
क्या स्ट्रीमिंग और फ़ंक्शन कॉलिंग समर्थित है?
दोनों समर्थित हैं। stream को true पर सेट करने पर SSE स्ट्रीमिंग आउटपुट प्राप्त होता है; फ़ंक्शन कॉलिंग OpenAI के tools फॉर्मेट का उपयोग करती है। temperature, top_p, stop जैसे सामान्य सैंपलिंग पैरामीटर पास-थ्रू होते हैं।
क्या वेक्टर, इमेज या ऑडियो जनरेट किया जा सकता है?
नहीं। साइट केवल टेक्स्ट चैट प्रदान करती है, वेक्टर, इमेज, ऑडियो, वीडियो और फाइन-ट्यूनिंग नहीं है, और केवल एक ही मॉडल है। यदि आपके व्यवसाय को इन क्षमताओं की आवश्यकता है, तो आपको अन्य समाधानों को अलग से जोड़ना होगा।
क्या अनुरोध बॉडी का आकार सीमित है?
हाँ, एकल अनुरोध बॉडी 8 MB से अधिक नहीं होनी चाहिए। जब बहुत लंबी दस्तावेज़ को प्रॉम्प्ट में डालते हैं, तो टोकन संख्या के अलावा, कुल बाइट संख्या पर भी ध्यान दें।
लाइव और दैनिक संचालन
लाइव से पहले सबसे महत्वपूर्ण कौन से कदम उठाए जाएँ?
सबसे पहले /v1/models का उपयोग करके मॉडल सूची की पुष्टि करें, फिर लंबे इनपुट, स्ट्रीमिंग और त्रुटि मार्गों को शामिल करके परीक्षण चलाएं। इसके बाद 402, 429 और 503 के लिए अलग-अलग हैंडलिंग शाखाएं तैयार करें और usage डेटा को सहेजें। अंत में, शीर्ष समय पर यह पता चलने से बचने के लिए शेष राशि के लिए एक अलर्ट सीट सेट करें। इन जांच बिंदुओं को रिलीज प्रक्रिया में शामिल करना न भूलें, ताकि ड्यूटी पर मौजूद सदस्य उन्हें क्रमवार सत्यापित कर सकें।
ऑनलाइन अचानक सभी 401 लौटा रहे हैं, पहले क्या जांचें?
सबसे पहले यह पुष्टि करें कि किसी ने बैकएंड में API कुंजी को फिर से जनरेट किया है या नहीं, क्योंकि फिर से जनरेट करने के बाद पुरानी कुंजी तुरंत अमान्य हो जाती है। इसके बाद यह जांचें कि क्या वातावरण चर (environment variables) हाल की रिलीज में खो गए हैं, या क्या कुंजी में स्पेस और नई लाइन मिल गई हैं। वर्तमान प्रभावी कुंजी को केवल एक स्थान पर सहेजने से इन समस्याओं की जांच में अधिकतर समय बचता है।
कई सेवाएं एक ही कुंजी साझा कर रही हैं, तो किन बातों का ध्यान रखें?
रेट लिमिट कुंजी के आधार पर मिलाकर लागू किया जाता है, इसलिए सभी सेवाओं के अनुरोधों का योग प्रति मिनट 300 से अधिक नहीं होना चाहिए। यदि एक बैच प्रसंस्करण कार्य सभी क्षमता को घेर लेता है, तो लाइव सेवाएं भी 429 प्राप्त कर सकती हैं। बैच प्रसंस्करण के लिए अलग से रेट लिमिट सेट करने की सलाह दी जाती है, लाइव अनुरोधों को प्राथमिकता दें, और यदि आवश्यक हो तो बैच प्रसंस्करण को रात में अलग समय पर चलाएं।
लागत अनपेक्षित रूप से बढ़ने से कैसे बचें?
आउटपुट टोकन की इकाई लागत इनपुट से चार गुना है, इसलिए max_tokens और प्रॉम्प्ट में मांगी गई लंबाई को प्राथमिकता दें। usage को फ़ंक्शन के आधार पर गिनें, और यदि किसी फ़ंक्शन का औसत आउटपुट अचानक दोगुना हो जाए, तो यह जांचें कि क्या यह प्रॉम्प्ट में हुए बदलाव के कारण है। प्रीपेड मोड का लाभ यह है कि शेष राशि खत्म होने पर सेवा रुक जाती है, इसलिए अप्रत्याशित अतिरिक्त बिल नहीं आते।
सामग्री और गोपनीयता
किस प्रकार की सामग्री की अनुमति है?
कानूनी वयस्क सामग्री, काल्पनिक रचनाएं और विवादास्पद विषयों को सीधे अस्वीकार नहीं किया जाता, सेवा 18 वर्ष से अधिक आयु के वय उपयोगकर्ताओं के लिए है। किशोरों से संबंधित यौन सामग्री हमेशा ब्लॉक की जाती है। इस प्रकार की सेवाओं की लागत और समझौतों के बारे में अधिक जानने के लिए असीमित AI API की लागत और समझौते पढ़ें।
क्या मेरे प्रॉम्प्ट को प्रशिक्षण के लिए इस्तेमाल किया जाएगा?
नहीं, प्रॉम्प्ट को प्रशिक्षण के लिए इस्तेमाल नहीं किया जाएगा। इसके अलावा, इस पृष्ठ पर अन्य भंडारण या लॉग विवरणों के बारे में कोई जानकारी नहीं दी गई है, कृपया दस्तावेज़ को मानक मानें।
यह सेवा एग्रीगेटर (अग्रीगेटर) रिले से कैसे अलग है?
इस साइट पर केवल एक ही मॉडल है, इसलिए कई मॉडल नामों को मैप करने की आवश्यकता नहीं है, मॉडल सूची को /v1/models के माध्यम से स्वयं सत्यापित किया जा सकता है। रिले के सामान्य सिद्धांतों और जोखिमों को समझने के लिए, आप पहले रिले सिद्धांत लेख पढ़ सकते हैं।
अक्सर पूछे जाने वाले प्रश्न
शुरू कैसे करें?
ईमेल और पासवर्ड से साइन अप करें, कुंजी तुरंत दिख जाएगी, भुगतान की जानकारी भरने की आवश्यकता नहीं है। नए खाते में $0.50 का मुफ़्त ट्रायल क्रेडिट मिलता है, जो 7 दिनों के लिए मान्य है।
402 लौटाया जाता है तो क्या करें?
402 त्रुटि कोड no_credit है, जिसका अर्थ है कि शेष राशि खत्म हो गई है या ट्रायल समाप्त हो गया है, आपको प्रीपेड शेष राशि टॉप-अप करनी चाहिए, पुनः प्रयास न करें।
रेट लिमिट क्या है?
प्रति कुंजी प्रति मिनट 300 अनुरोध, सीमा पार करने पर 429 लौटाया जाता है, सुझाव है कि समानांतर अनुरोध सीमा और एक्सपोनेंशियल बैकऑफ़ का उपयोग करके अनुरोधों को समतल बनाएं।
कॉन्टेक्स्ट विंडो और आउटपुट की अधिकतम लंबाई क्या है?
कॉन्टेक्स्ट विंडो की कुल लंबाई 100,000 टोकन है, max_tokens डिफ़ॉल्ट रूप से 2048 है और अधिकतम 32,000 तक जा सकता है, अनुरोध बॉडी 8 MB से अधिक नहीं होनी चाहिए।
प्रॉम्प्ट को प्रशिक्षण के लिए इस्तेमाल किया जाएगा?
नहीं, प्रॉम्प्ट को प्रशिक्षण के लिए इस्तेमाल नहीं किया जाएगा।
केवल फॉर्म भरें और API कुंजी प्राप्त करें
खाता बनाएं, API कुंजी कॉपी करें, Base URL बदलें। कॉन्फ़िगरेशन इतना ही सरल है।