पांच मिनट में पहला अनुरोध
अपने मौजूदा OpenAI-संगत क्लाइंट को सेकंडों में हमारी बिना सेंसर API से जोड़ें। यह क्विकस्टार्ट बेस कॉन्फ़िगरेशन, मानक अनुरोधों, स्ट्रीमिंग और 'बिना सेंसर' मॉडल के साथ टूल उपयोग को कवर करता है।
बेस URL और प्रमाणीकरण
अपने OpenAI SDK या किसी भी संगत क्लाइंट को हमारे बेस URL की ओर निर्देशित करें। आपको किसी विशिष्ट लाइब्रेरी की आवश्यकता नहीं है; कोई भी उपकरण जो एक मानक API कुंजी स्वीकार करता है, यहाँ काम करेगा। Google या ईमेल से साइन इन करने के बाद डैशबोर्ड से अपनी कुंजी प्राप्त करें। कुंजी तुरंत प्रदर्शित होती है और सभी अनुरोधों के लिए एकमात्र प्रमाणीकरण है।
बेस URL को https://api.ollamaapi.top/v1 पर सेट करें। सभी चैट पूर्णताओं के लिए मॉडल ID uncensored का उपयोग करें। यह मॉडल ओपन-वेट है, कम अस्वीकृतियों के लिए ट्यून्ड है, और प्रमुख विक्रेता मॉडल से अलग है। यह GPT, Claude या कोई अन्य स्वामित्व वाला मॉडल नहीं है। प्रमाणीकरण केवल Bearer टोकन हेडर पर निर्भर करता है।
पहला अनुरोध
कनेक्टिविटी परीक्षण करने के लिए एक मानक चैट पूर्णता अनुरोध भेजें। एंडपॉइंट messages, model, और temperature या max_tokens जैसे वैकल्पिक पैरामीटर वाले JSON पेलोड स्वीकार करता है। मॉडल आईडी हमेशा uncensored होती है। प्रतिक्रियाएं सहायक की सामग्री और टोकन उपयोग मापदंडों सहित संरचित JSON लौटाती हैं।
यदि अनुरोध सफल होता है, तो आपको 200 OK प्रतिक्रिया मिलती है। यदि प्रमाणीकरण विफल होता है, तो आपको 401 त्रुटि मिलती है। यदि आपके पास फंड नहीं हैं, तो आपको 402 त्रुटि मिलती है। ये त्रुटियां मुफ्त हैं, इसलिए आप केवल सफल टोकन उपयोग के लिए भुगतान करते हैं। अपने एप्लिकेशन में एकीकृत करने से पहले अपनी विन्यास सत्यापित करने के लिए इस नमूने का उपयोग करें।
curl https://api.ollamaapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
आधिकारिक ओपनएआई पायथन लाइब्रेरी या किसी संगत क्लाइंट का उपयोग करें। अपने बेस यूआरएल और एपीआई कुंजी के साथ क्लाइंट को इनिशियलाइज़ करें। मॉडल को uncensored पर सेट करें। अपने संदेशों को role और content वाले डिकशनरी की सूची के रूप में पास करें। लाइब्रेरी स्वचालित रूप से सीरियलाइज़ेशन और प्रतिक्रिया पार्सिंग संभालती है।
स्ट्रीमिंग प्रतिक्रियाएँ stream पैरामीटर के माध्यम से समर्थित हैं। यह आपको टोकन को उत्पन्न होते ही प्रोसेस करने की अनुमति देता है, जो लंबे आउटपुट या रियल-टाइम यूआई अपडेट के लिए उपयोगी है। अंतिम चंक बिलिंग के लिए कुल टोकन उपयोग शामिल करता है। नेटवर्क त्रुटियों से चार्ज नहीं लगते हैं, इसलिए सुनिश्चित करें कि आप अपवादों को सुचारू रूप से संभालें।
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
openai npm पैकेज इंस्टॉल करें या किसी भी fetch-आधारित wrapper का उपयोग करें। आधार URL https://api.ollamaapi.top/v1 और अपनी API कुंजी के साथ क्लाइंट कॉन्फ़िगर करें। मॉडल आईडी uncensored ही रहती है। messages के साथ अनुरोध बॉडी पास करें और top_p या seed जैसे वैकल्पिक सेटिंग्स।
नोड.जेएस उपयोगकर्ता स्वच्छ कोड के लिए async/await पैटर्न का लाभ उठा सकते हैं। प्रतिक्रिया ऑब्जेक्ट में choices, usage, और id शामिल हैं। आप पहले चॉइस से सहायक का संदेश निकाल सकते हैं। त्रुटि हैंडलिंग में रेट लिमिट (429) और अपर्याप्त क्रेडिट (402) को ध्यान में रखना चाहिए। ये त्रुटियाँ टोकन नहीं खाती हैं, इसलिए आपका प्रीपेड बैलेंस सफल प्रतिक्रिया उत्पन्न होने तक अक्षुण्ण रहता है।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
स्ट्रीमिंग प्रतिक्रियाएं
अपने अनुरोध में stream: true सेट करके स्ट्रीमिंग सक्षम करें। API एक Server-Sent Events (SSE) स्ट्रीम लौटाता है। प्रत्येक चंक आंशिक सामग्री रखता है, जिससे आप टोकन को जनरेट होते हुए प्रदर्शित कर सकते हैं। इससे उपयोगकर्ताओं के लिए अनुभवित विलंबता कम होती है और लंबी पाठ जनरेशन के लिए अनुभव बेहतर होता है।
स्ट्रीम में अंतिम चंक में पूर्ण टोकन उपयोग डेटा शामिल होता है। आप रियल-टाइम में खपट को ट्रैक करने के लिए इसका उपयोग कर सकते हैं। ध्यान दें कि स्ट्रीमिंग मूल्य निर्धारण मॉडल को नहीं बदलती है; आप अभी भी प्रति 1M इनपुट और आउटपुट टोकन के लिए भुगतान करते हैं। स्ट्रीमिंग के दौरान त्रुटियां भी मुफ़्त हैं। यदि कनेक्शन टूट जाता है, तो आप बिना किसी दंड के अनुरोध को रीज्यूम या रीस्टार्ट कर सकते हैं।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
सीमाएं, त्रुटियां और संदर्भ
कॉन्टेक्स्ट विंडो कुल 100,000 टोकन है, जिसमें प्रॉम्प्ट और पूर्णता दोनों शामिल हैं। प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है (2,048 यदि max_tokens अनसेट है)। यदि आप कॉन्टेक्स्ट विंडो से अधिक हो जाते हैं, तो अनुरोध विफल हो जाता है। त्रुटियों में अमान्य कुंजियों के लिए 401, अपर्याप्त क्रेडिट के लिए 402, और रेट लिमिट के लिए 429 शामिल हैं। रेट लिमिट प्रति मिनट 300 अनुरोध और प्रति कुंजी 8 समानांतर अनुरोध है। अनुरोध बॉडी 8 MB तक सीमित है। त्रुटियां मुफ़्त हैं, जिसका अर्थ है कि आप विफल अनुरोधों या अस्वीकृतियों के लिए भुगतान नहीं करते हैं। क्रेडिट कभी समाप्त नहीं होता है, और कोई सदस्यता आवश्यक नहीं है।
API विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| Base URL | https://api.ollamaapi.top/v1 |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| मॉडल ID | uncensored |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| JSON मोड | response_format: {"type": "json_object"} |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| अनुरोध का आकार | 8 MB तक |
| बोनस | $50 से +5%, $100 से +10% |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| साइन इन | Google या ईमेल और पासवर्ड |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
क्या यह API फ़ंक्शन कॉलिंग का समर्थन करता है?
हाँ, API <code>tools</code> और <code>tool_choice</code> पैरामीटर के माध्यम से फ़ंक्शन कॉलिंग का समर्थन करता है। आप अपने अनुरोध में टूल्स परिभाषित कर सकते हैं और मॉडल टूल उपयोग के लिए संरचित JSON लौटाएगा। यह सुविधा सभी मानक OpenAI-संगत क्लाइंट्स के साथ काम करती है।
यदि मैं कॉन्टेक्स्ट विंडो से अधिक हो जाता हूं तो क्या होता है?
यदि कुल टोकन (प्रॉम्प्ट + पूर्णता) 100,000 से अधिक हो जाते हैं, तो अनुरोध त्रुटि के साथ विफल हो जाएगा। यह त्रुटि मुफ़्त है, इसलिए आपको प्रयास के लिए शुल्क नहीं दिया जाएगा। आप <code>max_tokens</code> पैरामीटर को समायोजित कर सकते हैं या सीमाओं में रहने के लिए अपने प्रॉम्प्ट को छोटा कर सकते हैं।
क्या ट्रायल क्रेडिट पुन: उपयोग योग्य है?
नहीं, $0.50 का ट्रायल क्रेडिट 7 दिनों के लिए मान्य है और प्रति खाते केवल एक बार उपयोग किया जा सकता है। उपयोग के बाद यह समाप्त नहीं होता है, लेकिन यदि उपयोग नहीं किया जाता है, तो 7 दिनों के बाद इसे खो दिया जाता है। ट्रायल प्राप्त करने के लिए क्रेडिट कार्ड की आवश्यकता नहीं है।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।
API कुंजी पाएँ