HI ▾

होस्टेड बिना सेंसर LLM API

API कुंजी पाएँ
प्रति 1M इनपुट टोकन
$0.25
आउटपुट टोकन / 1M
$1.00
टोकन संदर्भ विंडो
100,000

पांच मिनट में पहला अनुरोध

अपने मौजूदा OpenAI-संगत क्लाइंट को सेकंडों में हमारी बिना सेंसर API से जोड़ें। यह क्विकस्टार्ट बेस कॉन्फ़िगरेशन, मानक अनुरोधों, स्ट्रीमिंग और 'बिना सेंसर' मॉडल के साथ टूल उपयोग को कवर करता है।

बेस URL और प्रमाणीकरण

अपने OpenAI SDK या किसी भी संगत क्लाइंट को हमारे बेस URL की ओर निर्देशित करें। आपको किसी विशिष्ट लाइब्रेरी की आवश्यकता नहीं है; कोई भी उपकरण जो एक मानक API कुंजी स्वीकार करता है, यहाँ काम करेगा। Google या ईमेल से साइन इन करने के बाद डैशबोर्ड से अपनी कुंजी प्राप्त करें। कुंजी तुरंत प्रदर्शित होती है और सभी अनुरोधों के लिए एकमात्र प्रमाणीकरण है।

बेस URL को https://api.ollamaapi.top/v1 पर सेट करें। सभी चैट पूर्णताओं के लिए मॉडल ID uncensored का उपयोग करें। यह मॉडल ओपन-वेट है, कम अस्वीकृतियों के लिए ट्यून्ड है, और प्रमुख विक्रेता मॉडल से अलग है। यह GPT, Claude या कोई अन्य स्वामित्व वाला मॉडल नहीं है। प्रमाणीकरण केवल Bearer टोकन हेडर पर निर्भर करता है।

पहला अनुरोध

कनेक्टिविटी परीक्षण करने के लिए एक मानक चैट पूर्णता अनुरोध भेजें। एंडपॉइंट messages, model, और temperature या max_tokens जैसे वैकल्पिक पैरामीटर वाले JSON पेलोड स्वीकार करता है। मॉडल आईडी हमेशा uncensored होती है। प्रतिक्रियाएं सहायक की सामग्री और टोकन उपयोग मापदंडों सहित संरचित JSON लौटाती हैं।

यदि अनुरोध सफल होता है, तो आपको 200 OK प्रतिक्रिया मिलती है। यदि प्रमाणीकरण विफल होता है, तो आपको 401 त्रुटि मिलती है। यदि आपके पास फंड नहीं हैं, तो आपको 402 त्रुटि मिलती है। ये त्रुटियां मुफ्त हैं, इसलिए आप केवल सफल टोकन उपयोग के लिए भुगतान करते हैं। अपने एप्लिकेशन में एकीकृत करने से पहले अपनी विन्यास सत्यापित करने के लिए इस नमूने का उपयोग करें।

curl https://api.ollamaapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK

आधिकारिक ओपनएआई पायथन लाइब्रेरी या किसी संगत क्लाइंट का उपयोग करें। अपने बेस यूआरएल और एपीआई कुंजी के साथ क्लाइंट को इनिशियलाइज़ करें। मॉडल को uncensored पर सेट करें। अपने संदेशों को role और content वाले डिकशनरी की सूची के रूप में पास करें। लाइब्रेरी स्वचालित रूप से सीरियलाइज़ेशन और प्रतिक्रिया पार्सिंग संभालती है।

स्ट्रीमिंग प्रतिक्रियाएँ stream पैरामीटर के माध्यम से समर्थित हैं। यह आपको टोकन को उत्पन्न होते ही प्रोसेस करने की अनुमति देता है, जो लंबे आउटपुट या रियल-टाइम यूआई अपडेट के लिए उपयोगी है। अंतिम चंक बिलिंग के लिए कुल टोकन उपयोग शामिल करता है। नेटवर्क त्रुटियों से चार्ज नहीं लगते हैं, इसलिए सुनिश्चित करें कि आप अपवादों को सुचारू रूप से संभालें।

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK

openai npm पैकेज इंस्टॉल करें या किसी भी fetch-आधारित wrapper का उपयोग करें। आधार URL https://api.ollamaapi.top/v1 और अपनी API कुंजी के साथ क्लाइंट कॉन्फ़िगर करें। मॉडल आईडी uncensored ही रहती है। messages के साथ अनुरोध बॉडी पास करें और top_p या seed जैसे वैकल्पिक सेटिंग्स।

नोड.जेएस उपयोगकर्ता स्वच्छ कोड के लिए async/await पैटर्न का लाभ उठा सकते हैं। प्रतिक्रिया ऑब्जेक्ट में choices, usage, और id शामिल हैं। आप पहले चॉइस से सहायक का संदेश निकाल सकते हैं। त्रुटि हैंडलिंग में रेट लिमिट (429) और अपर्याप्त क्रेडिट (402) को ध्यान में रखना चाहिए। ये त्रुटियाँ टोकन नहीं खाती हैं, इसलिए आपका प्रीपेड बैलेंस सफल प्रतिक्रिया उत्पन्न होने तक अक्षुण्ण रहता है।

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

स्ट्रीमिंग प्रतिक्रियाएं

अपने अनुरोध में stream: true सेट करके स्ट्रीमिंग सक्षम करें। API एक Server-Sent Events (SSE) स्ट्रीम लौटाता है। प्रत्येक चंक आंशिक सामग्री रखता है, जिससे आप टोकन को जनरेट होते हुए प्रदर्शित कर सकते हैं। इससे उपयोगकर्ताओं के लिए अनुभवित विलंबता कम होती है और लंबी पाठ जनरेशन के लिए अनुभव बेहतर होता है।

स्ट्रीम में अंतिम चंक में पूर्ण टोकन उपयोग डेटा शामिल होता है। आप रियल-टाइम में खपट को ट्रैक करने के लिए इसका उपयोग कर सकते हैं। ध्यान दें कि स्ट्रीमिंग मूल्य निर्धारण मॉडल को नहीं बदलती है; आप अभी भी प्रति 1M इनपुट और आउटपुट टोकन के लिए भुगतान करते हैं। स्ट्रीमिंग के दौरान त्रुटियां भी मुफ़्त हैं। यदि कनेक्शन टूट जाता है, तो आप बिना किसी दंड के अनुरोध को रीज्यूम या रीस्टार्ट कर सकते हैं।

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

सीमाएं, त्रुटियां और संदर्भ

कॉन्टेक्स्ट विंडो कुल 100,000 टोकन है, जिसमें प्रॉम्प्ट और पूर्णता दोनों शामिल हैं। प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है (2,048 यदि max_tokens अनसेट है)। यदि आप कॉन्टेक्स्ट विंडो से अधिक हो जाते हैं, तो अनुरोध विफल हो जाता है। त्रुटियों में अमान्य कुंजियों के लिए 401, अपर्याप्त क्रेडिट के लिए 402, और रेट लिमिट के लिए 429 शामिल हैं। रेट लिमिट प्रति मिनट 300 अनुरोध और प्रति कुंजी 8 समानांतर अनुरोध है। अनुरोध बॉडी 8 MB तक सीमित है। त्रुटियां मुफ़्त हैं, जिसका अर्थ है कि आप विफल अनुरोधों या अस्वीकृतियों के लिए भुगतान नहीं करते हैं। क्रेडिट कभी समाप्त नहीं होता है, और कोई सदस्यता आवश्यक नहीं है।

API विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
Base URLhttps://api.ollamaapi.top/v1
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
मॉडल IDuncensored
अधिकतम आउटपुट100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
JSON मोडresponse_format: {"type": "json_object"}
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
कॉन्टेक्स्ट विंडो100,000 टोकन (इनपुट + आउटपुट मिलाकर)
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
अनुरोध का आकार8 MB तक
बोनस$50 से +5%, $100 से +10%
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
साइन इनGoogle या ईमेल और पासवर्ड
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें

प्रश्न और उत्तर

क्या यह API फ़ंक्शन कॉलिंग का समर्थन करता है?

हाँ, API <code>tools</code> और <code>tool_choice</code> पैरामीटर के माध्यम से फ़ंक्शन कॉलिंग का समर्थन करता है। आप अपने अनुरोध में टूल्स परिभाषित कर सकते हैं और मॉडल टूल उपयोग के लिए संरचित JSON लौटाएगा। यह सुविधा सभी मानक OpenAI-संगत क्लाइंट्स के साथ काम करती है।

यदि मैं कॉन्टेक्स्ट विंडो से अधिक हो जाता हूं तो क्या होता है?

यदि कुल टोकन (प्रॉम्प्ट + पूर्णता) 100,000 से अधिक हो जाते हैं, तो अनुरोध त्रुटि के साथ विफल हो जाएगा। यह त्रुटि मुफ़्त है, इसलिए आपको प्रयास के लिए शुल्क नहीं दिया जाएगा। आप <code>max_tokens</code> पैरामीटर को समायोजित कर सकते हैं या सीमाओं में रहने के लिए अपने प्रॉम्प्ट को छोटा कर सकते हैं।

क्या ट्रायल क्रेडिट पुन: उपयोग योग्य है?

नहीं, $0.50 का ट्रायल क्रेडिट 7 दिनों के लिए मान्य है और प्रति खाते केवल एक बार उपयोग किया जा सकता है। उपयोग के बाद यह समाप्त नहीं होता है, लेकिन यदि उपयोग नहीं किया जाता है, तो 7 दिनों के बाद इसे खो दिया जाता है। ट्रायल प्राप्त करने के लिए क्रेडिट कार्ड की आवश्यकता नहीं है।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

API कुंजी पाएँ