HI ▾
API कुंजी प्राप्त करें

बड़े मॉडल API अक्सर पूछे जाने वाले प्रश्न: विषयानुसार उत्तर खोजें

जब डेवलपर्स पहली बार बड़े मॉडल API का उपयोग करते हैं, तो उनके मन में एक साथ कई सवाल आते हैं: कुंजी कहाँ से आएगी, क्या छवि भेज सकते हैं, क्या अचानक रुक जाएगा, एक बार में कितना लिख सकते हैं। इन्हें विषयानुसार पाँच समूहों में बाँटा गया है। उत्तर एक वाक्य में दिए गए हैं, विस्तार के लिए संबंधित लेख पर संकेत है। आप सीधे उसी समूह पर जा सकते हैं जिसमें आपकी जिज्ञासा है।

अद्यतन

मुख्य बिंदु

  • प्रवेश द्वार ईमेल और पासवर्ड पंजीकरण है, API कुंजी तुरंत दिखाई देती है, एक खाते के लिए एक कुंजी, जिसे पुनः उत्पन्न किया जा सकता है।
  • सक्षमता की सीमा शुद्ध टेक्स्ट चैट है, एकल मॉडल, स्ट्रीमिंग और फ़ंक्शन कॉलिंग समर्थित है, इमेज, ऑडियो, वेक्टर और फाइन-ट्यूनिंग नहीं है।
  • एक अनुरोध में प्रॉम्प्ट और आउटपुट का योग 100,000 टोकन से अधिक नहीं होना चाहिए, प्रति API कुंजी प्रति मिनट 300 अनुरोध।
  • कानूनी वयस्क सामग्री का उपयोग किया जा सकता है, लेकिन किशोरों से संबंधित यौन सामग्री को ब्लॉक कर दिया जाता है, सेवा केवल वयस्कों के लिए है।

खाता और कुंजी

पहली API कुंजी कैसे प्राप्त करें?

API कुंजी पृष्ठ पर जाएं, ईमेल और पासवर्ड से पंजीकरण करें, पंजीकरण पूरा होने पर API कुंजी दिखाई दे जाएगी, भुगतान जानकारी भरने की आवश्यकता नहीं है।

क्या एक खाते में कई API कुंजी बनाई जा सकती हैं?

नहीं, एक खाते के लिए एक ही API कुंजी। विभिन्न प्रोजेक्ट्स के लिए उपयोग को अलग करने के लिए, अपनी बैकएंड पर प्रोजेक्ट टैग लगाकर बिलिंग करें, कई API कुंजियों पर निर्भर न रहें।

API कुंजी लीक हो गई है तो क्या करें?

तुरंत पुनः उत्पन्न करें। उस क्षण पुरानी API कुंजी अमान्य हो जाती है, इसलिए नई API कुंजी को सभी स्थानों पर डिप्लॉय करने के बाद ही पुरानी API कुंजी को बदलें।

क्या नए उपयोगकर् पहले ट्रायल कर सकते हैं?

हाँ। नए खाते में $0.50 का मुफ़्त ट्रायल क्रेडिट होता है, जो 7 दिनों के लिए मान्य होता है, इस दौरान किसी भुगतान विधि की आवश्यकता नहीं होती।

रजिस्टर करने से लेकर पहला अनुरोध भेजने तक की पूरी प्रक्रिया देखने के लिए, आप चैटबॉट लेख में दिए गए पूरे प्रोजेक्ट को बना सकते हैं।

यदि आप एक साथ कई प्रोजेक्ट्स प्रबंधित कर रहे हैं, तो कई API कुंजियों पर निर्भर रहने की उम्मीद न करें, बल्कि अपनी बैकएंड में प्रत्येक कॉल पर प्रोजेक्ट टैग लगाएं और usage को रिकॉर्ड करें। इस तरह माह के अंत में टैग के आधार पर सारांश तैयार करें, यह किसी भी कंसोल की ग्रानुलर स्टैटिस्टिक्स से अधिक स्पष्ट होगा।

क्या कॉल किया जा सकता है, क्या नहीं

API एंडपॉइंट और मॉडल नाम क्या है?

URL https://api.apidamoxing.com/v1,模型名固定为 uncensored है। सेवा में केवल एक ही मॉडल है।

कौन से एंडपॉइंट उपलब्ध हैं?

दो: POST /v1/chat/completions चैट के लिए, GET /v1/models मॉडल सूची देखने के लिए। अन्य पथ 404 लौटाएंगे।

क्या इमेज, ऑडियो भेजा जा सकता है या वेक्टर सर्च किया जा सकता है?

नहीं। यहाँ केवल टेक्स्ट प्रोसेस किया जाता है, इमेज, ऑडियो, वीडियो, वेक्टर एम्बेडिंग नहीं है, और न ही फाइन-ट्यूनिंग उपलब्ध है।

क्या स्ट्रीमिंग और फ़ंक्शन कॉलिंग समर्थित है?

दोनों समर्थित हैं। स्ट्रीमिंग के लिए अनुरोध में stream: true जोड़ें, SSE लौटाया जाता है; फ़ंक्शन कॉलिंग OpenAI के tools प्रारूप का पालन करती है।

क्या मौजूदा OpenAI SDK का उपयोग किया जा सकता है?

हाँ, base_url को ऊपर दिए गए URL पर सेट करें, api_key को अपनी API कुंजी से बदलें। Python, Node या curl सभी काम करते हैं।

एक सामान्य गलतफहमी यह है कि "चूंकि यह OpenAI फॉर्मेट के साथ संगत है, इसलिए यह OpenAI की सभी सुविधाओं का समर्थन करता है"। संगतता का अर्थ है अनुरोध और प्रतिक्रिया का फॉर्मेट, इसका अर्थ यह नहीं है कि फीचर सेट समान है। यहाँ केवल टेक्स्ट चैट है, इसलिए इमेज अंडरस्टैंडिंग, स्पीच-टू-टेक्स्ट, वेक्टर सर्च से जुड़े मौजूदा कोड को अलग करना होगा और उन्हें किसी अन्य इम्प्लीमेंटेशन से बदलना होगा।

लंबाई, आवृत्ति और पैरामीटर

एक अनुरोध में कितना डाला जा सकता है?

इनपुट और आउटपुट का योग अधिकतम 100,000 टोकन हो सकता है। अनुरोध बॉडी स्वयं 8 MB तक सीमित है, हालाँकि टेक्स्ट उपयोग में टोकन सीमा पहले आती है।

उत्तर आधे में क्यों कट जाता है?

अक्सर max_tokens तक पहुँच जाता है, डिफ़ॉल्ट मान 2048 है। इसे बढ़ाएं, एक बार में अधिकतम 32,000, साथ ही कुल योग 100,000 से अधिक न हो, इसका ध्यान रखें।

प्रति मिनट कितने अनुरोध भेजे जा सकते हैं?

प्रति कुंजी 300। बैच कार्यों के लिए यह सुझाव दिया जाता है कि आप अपने पक्ष पर पहले ही रेट लिमिट लागू करके कतार में खड़े हों, ताकि रेट लिमिट टूटने पर उसे ठीक करने की जरूरत न पड़े।

temperature, top_p, stop मान्य होंगे?

हाँ, ये मानक सैंपलिंग फ़ील्ड्स मॉडल को वैसे ही पास किए जाएंगे, जैसा कि आप चैट कंप्लीशन एंडपॉइंट से उम्मीद करते हैं।

प्रत्येक फ़ील्ड का विवरण कहाँ देखें?

इंटरफ़ेस पैरामीटर विवरण में प्रत्येक की तालिका है, और दस्तावेज़ पृष्ठ एक संक्षिप्त संदर्भ प्रदान करता है।

"लंबा" से क्या तात्पर्य है: 100,000 टोकन लगभग कई हजार चीनी अक्षरों के बराबर होते हैं, यह सामग्री पर निर्भर करता है। यह केवल एक अनुमानित मात्रा है, सटीक रूपांतरण नहीं। बहुत लंबे दस्तावेजों को संभालते समय, पहले भागों में बाँटना और फिर सारांश तैयार करना एक सुरक्षित तरीका है।

लागत और शेष राशि

शुल्क कैसे लागू होता है?

प्रति टोकन: इनपुट प्रति मिलियन $0.25, आउटपुट प्रति मिलियन $1.00, कोई मासिक शुल्क नहीं, और कोई सदसुता नहीं चाहिए।

पैसे पहले दिए जाते हैं या बाद में?

पहले। खाते में प्रीपेड क्रेडिट टॉप-अप करें, जितना उपयोग करें उतना ही कटाया जाएगा, शेष राशि कभी खत्म नहीं होगी।

पैसे खत्म होने पर क्या होगा?

अनुरोध विफल हो जाएंगे, स्टेटस कोड 402, एरर कोड no_credit। फ्री ट्रायल क्रेडिट की समाप्ति पर भी यही व्यवहार होगा; शेष राशि भरने पर सेवा पुनः शुरू हो जाएगी।

किसी फ़ंक्शन की लागत का अनुमान कैसे लगाएं?

टोकन और शुल्क में दिए गए उदाहरणों का संदर्भ लें; मुख्य बात यह है कि प्रतिक्रिया के usage को पढ़ें और उसे प्रति इकाई लागत से गुणा करें।

एक अतिरिक्त बजट आदत: प्रत्येक टॉप-अप "इस चक्र में अनुमानित उपयोग" के आधार पर करें, एक बार में बहुत अधिक न जोड़ें। चूंकि यह प्रीपेड है, शेष राशि आपकी कठोर सीमा है; खत्म होने पर रुक जाएंगे, अनपेक्षित बिल नहीं आएंगे।

लाइव और डिबगिंग की व्यावहारिक समस्याएं

क्या डेवलपमेंट और लाइव के लिए एक ही कुंजी साझा की जा सकती है?

चूंकि एक खाते के लिए केवल एक कुंजी होती है, इसलिए व्यावहारिक रूप से साझा किया जाता है। कुंजी को केवल सर्वर के एनवायरनमेंट वेरिएबल्स में रखें, कोड रिपॉजिटरी या फ्रंटएंड पेज में न लिखें, और यह समझें कि पुनर्जनरेट करने से सभी वातावरण एक साथ अमान्य हो जाएंगे।

क्या 503 मिलने पर तुरंत पुनः प्रयास करें?

नहीं। इसका अर्थ है कि सेवा अस्थायी रूप से व्यस्त है; कुछ सेकंड रुककर पुनः प्रयास करें और अधिकतम पुनः प्रयास की संख्या निर्धारित करें। लगातार तेज़ी से भेजने से अनुरोध क्वोटा बर्बाद होगा।

इंटरफ़ेस कॉल धीमी है, क्या कोई समस्या है?

लंबे टेक्स्ट जनरेट करने में समय लगता है, आउटपुट जितना लंबा होगा उतना ही समय लगेगा। स्ट्रीमिंग सक्षम करें ताकि उपयोगकर्ता को पहले अक्षर दिखाई दें, और क्लाइंट टाइमआउट को थोड़ा ढीलदार सेट करें।

चैट जितनी लंबी होती जाती है, सीमा से कैसे बचें?

अपने बैकएंड पर इतिहास को काटें, केवल हालिया कुछ चरणों को ही रखें; पुराना सामग्री सारांश में बदल सकते हैं। अनुरोध भेजने से पहले कुल मात्रा का अनुमान लगाएं, इंटरफ़ेस से 400 मिलने का इंतज़ार न करें।

किसी विशिष्ट अनुरोध में कितने टोकन उपयोग हुए, यह सत्यापित करें?

प्रतिक्रिया के usage फ़ील्ड को पढ़ें, जिसमें इनपुट, आउटपुट और कुल शामिल हैं। स्ट्रीमिंग प्रतिक्रिया में यह डेटा ब्लॉक के अंतिम भाग में उपलब्ध होता है, अतिरिक्त पैरामीटर की आवश्यकता नहीं है।

ये प्रश्न बार-बार इसलिए आते हैं क्योंकि ये "कोड चलने" के बाद के अगले चरण में होते हैं। इस खंड को लाइव से पहले की चेकलिस्ट के रूप में उपयोग करें और सुनिश्चित करें कि आपके प्रोग्राम में प्रत्येक बिंदु के लिए उचित हैंडलिंग है।

सामग्री की सीमाएं और उपयोगकर्ता

किस सामग्री को अस्वीकार किया जाएगा?

कानूनी वयस्क सामग्री, उपन्यास और विवादास्पद विषयों को अस्वीकार नहीं किया जाता। किशोरों से संबंधित यौन सामग्री हमेशा ब्लॉक हो जाती है और 403 लौटाती है, चाहे वह उपन्यास हो या भूमिका निभाना।

कौन उपयोग कर सकता है?

केवल 18 वर्ष या उससे अधिक आयु के वयस्कों के लिए। यदि आपकी सेवा सार्वजनिक है, तो प्रवेश द्वार पर आयु सत्यापन सुनिश्चित करें।

क्या मेरे प्रॉम्प्ट को प्रशिक्षण के लिए इस्तेमाल किया जाएगा?

नहीं, प्रॉम्प्ट प्रशिक्षण के लिए उपयोग नहीं किए जाते।

त्रुटि आने पर पहले क्या देखें?

सबसे पहले प्रतिक्रिया बॉडी में error ऑब्जेक्ट के code और message को पढ़ें, फिर स्टेटस कोड से मिलान करें: 401 कुंजी की समस्या है, 402 शेष राशि की, 403 सामग्री की, 429 रेट लिमिट की, 503 सर्विस अस्थायी रूप से व्यस्त है, कुछ सेकंड प्रतीक्षा करें और पुनः प्रयास करें।

सामान्य प्रश्न

इंटरफ़ेस कॉल के लिए क्या चाहिए?

एक पंजीकृत खाते की कुंजी, https://api.apidamoxing.com/v1 की ओर HTTPS अनुरोध, और हेडर में Bearer टोकन; शेष सब चैट कंप्लीशन फॉर्मेट के समान है।

कौन से फीचर्स सपोर्टेड हैं और कौन से नहीं?

टेक्स्ट चैट, स्ट्रीमिंग आउटपुट और फ़ंक्शन कॉलिंग सपोर्टेड हैं; इमेज, ऑडियो, वीडियो, वेक्टर एम्बेडिंग और फाइन-ट्यूनिंग सपोर्टेड नहीं हैं।

प्रतिक्रिया ट्रंकेट क्यों हो जाती है?

आमतौर पर max_tokens तक पहुंचने पर; डिफ़ॉल्ट 2048 है, जिसे 32,000 तक बढ़ाया जा सकता है। साथ ही, प्रॉम्प्ट और आउटपुट का कुल योग 100,000 टोकन से अधिक नहीं होना चाहिए।

शेष राशि खत्म होने पर क्या होगा?

अनुरोध 402 और no_credit लौटाता है। प्रीपेड क्रेडिट टॉप-अप करने के बाद जारी रखें, बैलेंस कभी खत्म नहीं होता।

कौन इस सेवा का उपयोग नहीं कर सकता?

18 वर्ष से कम आयु। किशोरों से संबंधित यौन सामग्री चाहे वह काल्पनिक हो, उसे ब्लॉक कर दिया जाता है और 403 लौटाया जाता है।

केवल फॉर्म भरें और कुंजी प्राप्त करें

खाता बनाएं, कुंजी कॉपी करें, Base URL बदलें। कॉन्फ़िगरेशन इतना ही आसान है।

API कुंजी प्राप्त करें