Pierwsze zapytanie w pięć minut
Połącz istniejącego klienta kompatybilnego z OpenAI z naszym API bez cenzury w kilka sekund. Ten przewodnik obejmuje konfigurację podstawową, standardowe zapytania, strumieniowanie i użycie narzędzi z modelem „bez cenzury”.
Podstawowy URL i uwierzytelnianie
Wskaż swoje SDK OpenAI lub dowolny kompatybilny klient na nasz podstawowy URL. Nie potrzebujesz specjalnej biblioteki; każde narzędzie akceptujące standardowy klucz API zadziała. Pobierz klucz z panelu po zalogowaniu się przez Google lub e-mail. Klucz jest wyświetlany natychmiast i jest jedynym wymagającym poświadczeniem do wszystkich zapytań.
Ustaw bazowy URL na https://api.ollamaapi.top/v1. Używaj ID modelu uncensored do wszystkich uzupełnień w czacie. Model ma otwarte wagi, jest dostrojony do mniejszej liczby odrzuceń i różni się od modeli głównych dostawców. Nie jest to GPT, Claude ani żaden inny model własnościowy. Autoryzacja opiera się wyłącznie na nagłówku Bearer token.
Pierwsze zapytanie
Wyślij standardowe zapytanie o uzupełnienie czatu, aby przetestować łączność. Endpoint akceptuje ładunki JSON z messages, model oraz opcjonalnymi parametrami takimi jak temperature lub max_tokens. Identyfikator modelu to zawsze uncensored. Odpowiedzi zwracają strukturalny JSON zawierający treść asystenta oraz metryki użycia tokenów.
Jeśli zapytanie się powiedzie, otrzymasz odpowiedź 200 OK. Jeśli uwierzytelnienie się nie powiedzie, otrzymasz błąd 401. Jeśli brakuje środków, otrzymasz błąd 402. Te błędy są darmowe, więc płacisz tylko za pomyślne użycie tokenów. Użyj tego przykładu, aby zweryfikować konfigurację przed integracją z aplikacją.
curl https://api.ollamaapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Pythona
Użyj oficjalnej biblioteki OpenAI dla Pythona lub dowolnego kompatybilnego klienta. Zainicjuj klienta, podając podstawowy URL i klucz API. Ustaw model na uncensored. Przekaż wiadomości jako listę słowników zawierających role i content. Biblioteka automatycznie obsługuje serializację i parsowanie odpowiedzi.
Odpowiedzi strumieniowe są obsługiwane za pomocą parametru stream. Pozwala to przetwarzać tokeny w miarę ich generowania, co jest przydatne przy długich outputach lub aktualizacjach interfejsu w czasie rzeczywistym. Ostatni fragment zawiera całkowite zużycie tokenów do rozliczeń. Upewnij się, że obsługujesz wyjątki, ponieważ błędy sieciowe nie generują opłat.
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node.js
Zainstaluj pakiet npm openai lub użyj dowolnego wrappera opartego na fetch. Skonfiguruj klienta z podstawowym URL https://api.ollamaapi.top/v1 i swoim kluczem API. Identyfikator modelu pozostaje uncensored. Przekaż ciało żądania z messages oraz opcjonalnymi ustawieniami takimi jak top_p lub seed.
Użytkownicy Node.js mogą wykorzystać wzorce async/await dla czystszego kodu. Obiekt odpowiedzi zawiera choices, usage i id. Możesz wyodrębnić wiadomość asystenta z pierwszego wyboru. Obsługa błędów powinna uwzględniać limity (429) i niewystarczający kredyt (402). Te błędy nie zużywają tokenów, więc Twój przedpłacony balans pozostaje nienaruszony do momentu wygenerowania pomyślnej odpowiedzi.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Odpowiedzi strumieniowe
Włącz strumieniowanie, ustawiając stream: true w zapytaniu. API zwraca strumień zdarzeń wysłanych przez serwer (SSE). Każdy fragment zawiera częściową treść, co pozwala wyświetlać tokeny w miarę ich generowania. Zmniejsza to postrzegane opóźnienie dla użytkowników i poprawia doświadczenie przy generowaniu długich tekstów.
Ostatni fragment strumienia zawiera kompletne dane o zużyciu tokenów. Możesz ich użyć do śledzenia konsumpcji w czasie rzeczywistym. Pamiętaj, że strumieniowanie nie zmienia modelu cenowego; nadal płacisz za 1 mln tokenów wejściowych i wyjściowych. Błędy podczas strumieniowania są również darmowe. Jeśli połączenie zostanie zerwane, możesz wznowić lub ponowić zapytanie bez kary.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limity, błędy i kontekst
Okno kontekstu wynosi łącznie 100 000 tokenów, w tym zarówno prompt, jak i uzupełnienie. Maksymalna liczba tokenów wyjściowych na zapytanie to 32 000 (2 048, jeśli max_tokens nie jest ustawione). Przekroczenie okna kontekstu powoduje błąd zapytania. Błędy obejmują 401 za nieprawidłowe klucze, 402 za niewystarczający kredyt oraz 429 za limity zapytań. Limit zapytań to 300 zapytań na minutę i 8 równoległych zapytań na klucz. Ciała zapytań są ograniczone do 8 MB. Błędy są darmowe, co oznacza, że nie płacisz za odrzucone zapytania lub odrzucenia. Kredyt nigdy nie wygasa, a subskrypcja nie jest wymagana.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Base URL | https://api.ollamaapi.top/v1 |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| ID modelu | uncensored |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozmiar zapytania | do 8 MB |
| Bonus | +5% od $50, +10% od $100 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy API obsługuje wywoływanie funkcji?
Tak, API obsługuje wywoływanie funkcji za pomocą parametrów <code>tools</code> i <code>tool_choice</code>. Możesz zdefiniować narzędzia w zapytaniu, a model zwróci strukturalny JSON do ich użycia. Ta funkcja działa ze wszystkimi standardowymi klientami kompatybilnymi z OpenAI.
Co się stanie, jeśli przekroczysz okno kontekstu?
Jeśli łączna liczba tokenów (prompt + uzupełnienie) przekroczy 100 000, zapytanie zakończy się błędem. Ten błąd jest darmowy, więc nie płacisz za próbę. Możesz dostosować parametr <code>max_tokens</code> lub skrócić prompt, aby zmieścić się w limitach.
Czy kredyt próbny jest wielokrotnego użytku?
Nie, kredyt próbny za $0,50 jest ważny przez 7 dni i można go użyć tylko raz na konto. Nie wygasa po użyciu, ale jeśli nie zostanie wykorzystany, traci ważność po 7 dniach. Nie jest wymagana karta kredytowa do otrzymania kredytu.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień podstawowy URL. To cała konfiguracja.
Pobierz klucz API