व्हिस्पर पाइपलाइन्स के लिए क्विकस्टार्ट
मानक OpenAI-कम्पैटिबल चैट कम्प्लीशंस API के माध्यम से अपने स्पीच या इमेज पाइपलाइन्स में हमारे बिना सेंसर टेक्स्ट मॉडल को इंटीग्रेट करें। यह गाइड अनुरोध भेजने, स्ट्रीमिंग हैंडल करने और पोस्ट-प्रोसेसिंग टास्क के लिए कॉन्टेक्स्ट विंडो प्रबंधित करने के लिए आवश्यक चरणों को कवर करती है।
पूर्वशर्तें
शुरू करने से पहले, सुनिश्चित करें कि आपके पास सक्रिय खाता और API कुंजी है। केवल ईमेल और पासवर्ड का उपयोग करके Get API key पृष्ठ पर साइन अप करें। कुंजी तुरंत उपलब्ध होती है। आपको 7 दिनों के लिए मान्य $0.50 का मुफ़्त ट्रायल क्रेडिट प्राप्त होता है, क्रेडिट कार्ड की आवश्यकता नहीं है। उत्पादन के लिए, क्रिप्टो (USDT या USDC) के माध्यम से $10 से टॉप-अप करें। हमारा मूल्य स्पष्ट है: $0.25 प्रति 1M इनपुट टोकन और $1.00 प्रति 1M आउटपुट टोकन। क्रेडिट कभी समाप्त नहीं होते।
Base URL: https://api.whisperapis.com/v1। यह एंडपॉइंट किसी भी OpenAI-कम्पैटिबल क्लाइंट के साथ काम करता है। आपको केवल बेस URL कॉन्फ़िगर करने और अपने API कुंजी को ऑथोराइजेशन हेडर में प्रदान करने की आवश्यकता है। बेसिक HTTP अनुरोधों के लिए विशेष SDK की आवश्यकता नहीं है।
क्लाइंट प्रारंभ करें
अधिकतर डेवलपर आधिकारिक OpenAI SDK या एक कम्पैटिबल लाइब्रेरी का उपयोग करेंगे। हमारे बेस URL की ओर इशारा करके क्लाइंट को इनिशियलाइज़ करें। यह सुनिश्चित करता है कि सभी अनुरोध हमारे बिना सेंसर मॉडल की ओर रूट होते हैं, न कि OpenAI के सर्वर की ओर। मॉडल ID हमेशा uncensored होती है।
सुनिश्चित करें कि आपका एनवायरनमेंट वेरिएबल OPENAI_API_KEY आपके डैशबोर्ड से प्राप्त कुंजी पर सेट है। यदि आप किसी अलग भाषा या लाइब्रेरी का उपयोग कर रहे हैं, तो सत्यापित करें कि वह कस्टम बेस URL का समर्थन करती है। SDK आपके लिए JSON सिरियलाइज़ेशन और हेडर इंजेक्शन संभालता है, जिससे आपकी पाइपलाइन स्क्रिप्ट्स में बॉइलरप्लेट कोड कम हो जाता है।
चैट कम्प्लीशन भेजें
अपने पाइपलाइन आउटपुट को रिफाइन करने के लिए एक मानक चैट कम्प्लीशन अनुरोध भेजें। उदाहरण के लिए, स्पीच-टू-टेक्स्ट ट्रांसक्रिप्ट से स्ट्रक्चर्ड JSON निकालें या बिना कंटेंट फ़िल्टर के छवियों के लिए कैप्शन जनरेट करें।
एंडपॉइंट POST /v1/chat/completions है। मॉडल ID, अपने मैसेजेस एरे और वैकल्पिक रूप से बिना सेंसर व्यवहार को परिभाषित करने के लिए अपने सिस्टम प्रॉम्प्ट को शामिल करें।
curl https://api.whisperapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'हमारा मॉडल हाई-कॉन्टेक्स्ट डेटा को अच्छी तरह संभालता है, कुल 100,000 टोकन तक समर्थन करता है। यह एक ही पास में लंबे ट्रांसक्रिप्ट या विस्तृत इमेज विवरणों को प्रोसेस करने के लिए आदर्श है।
स्ट्रीमिंग रिस्पॉन्स
वास्तविक-समय पोस्ट-प्रोसेसिंग या इंटरैक्टिव पाइपलाइनों के लिए, स्ट्रीमिंग सक्षम करें। अपने अनुरोध में stream पैरामीटर को true पर सेट करें। API एकल JSON ऑब्जेक्ट के बजाय सर्वर-सेंट इवेंट्स (SSE) लौटाता है।
delta फ़ील्ड्स को आने पर पार्स करें। इससे बड़े आउटपुट के लिए अनुभवित लेटेंसी कम हो जाती है, जैसे कि विस्तृत स्क्रिप्ट जनरेट करना या शोर वाले OCR परिणामों से लंबे टेक्स्ट ब्लॉक निकालना। स्ट्रीमिंग फॉर्मेट मानक OpenAI SDK स्ट्रीमिंग हैंडलर के साथ संगत है।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)सुनिश्चित करें कि आपका क्लाइंट पार्शियल चंक को सही तरीके से हैंडल करता है। स्ट्रीम finish_reason के साथ stop या length के साथ समाप्त होने पर पूरा टेक्स्ट रिस्पॉन्स पुनर्स्थापित करने के लिए डेल्टा को एग्रीगेट करें।
टूल कॉलिंग सपोर्ट
हमारा बिना सेंसर मॉडल फ़ंक्शन कॉलिंग का समर्थन करता है, जिससे आप अपनी पाइपलाइन्स के लिए स्ट्रक्चर्ड आउटपुट परिभाषित कर सकते हैं। JSON स्कीमा परिभाषाओं के साथ अपने टूल्स को tools एरे में परिभाषित करें।
मॉडल रिस्पॉन्स में टूल कॉल लौटाता है, जिसे आप कन्वर्सेशन कॉन्टेक्स्ट को अपडेट करने के लिए एक्जीक्यूट कर सकते हैं। यह अनस्ट्रक्चर्ड टेक्स्ट से विशिष्ट डेटा पॉइंट्स, जैसे कि स्पीच ट्रांसक्रिप्ट से तारीखें, नाम या निर्देशांक निकालने के लिए उपयोगी है।
from openai import OpenAI
client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)अगले मैसेजेस में टूल कॉल API को वापस पास करें। मॉडल परिणामों के आधार पर अपने आउटपुट को रिफाइन करेगा। यह चैट इंटरफ़ेस से बाहर न निकलते हुए जटिल मल्टी-स्टेप रीजनिंग को सक्षम बनाता है। खराब JSON रिस्पॉन्स से बचने के लिए सुनिश्चित करें कि आपकी स्कीमा स्ट्रिक्ट हो।
सीमाएं, त्रुटियां और कॉन्टेक्स्ट
अपने उपयोग की निगरानी करें ताकि बाधाओं से बचा जा सके। API प्रति कुंजी 300 requests per minute की सीमा लागू करता है। यदि आप इससे अधिक हो जाते हैं, तो आपको 429 रेट लिमिट त्रुटि प्राप्त होती है। अपने क्लाइंट में एक्सपोनेंशियल बैकऑफ लागू करें।
सामान्य त्रुटियां:
401: अमान्य या समाप्त API कुंजी। डैशबोर्ड से अपनी कुंजी रीजेनरेट करें।402: अपर्याप्त क्रेडिट। प्रोसेसिंग जारी रखने के लिए अपने खाते में टॉप-अप करें।429: रेट लिमिट पार। अनुरोध आवृत्ति कम करें या छोटी टास्क को बैच करें।
कॉन्टेक्स्ट विंडो: मॉडल प्रॉम्प्ट + कम्प्लीशन के लिए 100,000 टोकन का समर्थन करता है। यदि आपका इनपुट इससे अधिक है, तो पुराने मैसेजेस ट्रंक करें या डेटा को विभाजित करें। अनुरोध बॉडी 8 MB तक सीमित हैं। विश्वसनीय प्रदर्शन के लिए सुनिश्चित करें कि आपके पेलोड इन बाधाओं के भीतर फिट हों।
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);API विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| मॉडल ID | uncensored |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.whisperapis.com/v1 |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| JSON मोड | response_format: {"type": "json_object"} |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| अनुरोध का आकार | 8 MB तक |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| बोनस | $50 से +5%, $100 से +10% |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| साइन इन | Google या ईमेल और पासवर्ड |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
कॉन्टेक्स्ट विंडो का आकार क्या है?
मॉडल 100,000 टोकन की कॉन्टेक्स्ट विंडो का समर्थन करता है, जिसमें प्रॉम्प्ट और कम्प्लीशन दोनों शामिल हैं। इससे आप एक ही अनुरोध में बड़े ट्रांसक्रिप्ट या विस्तृत विवरण प्रोसेस कर सकते हैं।
क्या यह API छवि या ऑडियो जनरेट करता है?
नहीं। यह केवल टेक्स्ट चैट कम्प्लीशंस API है। इसका डिज़ाइन अन्य मॉडलिटीज जैसे स्पीच-टू-टेक्स्ट या इमेज जनरेशन से टेक्स्ट आउटपुट के पोस्ट-प्रोसेसिंग के लिए किया गया है। यह ऑडियो, छवि या वीडियो जनरेट नहीं करता है।
मैं स्ट्रीमिंग त्रुटियों को कैसे हैंडल करूं?
स्ट्रीमिंग रिस्पॉन्स SSE इवेंट्स लौटाते हैं। यदि कोई त्रुटि होती है, तो स्ट्रीम आमतौर पर अंतिम चंक के error फ़ील्ड में एक त्रुटि संदेश के साथ समाप्त हो जाती है। सुनिश्चित करें कि आपका क्लाइंट कनेक्शन ड्रॉप को सहजता से हैंडल करे और यदि आवश्यक हो तो पुनः प्रयास करे।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।