PL ▾

API LLM bez cenzury w chmurze

Pobierz klucz API
za 1M tokenów wejściowych
$0.25
Tokeny wyjściowe / 1M
$1.00
okno kontekstu tokenów
100,000

Pierwsze zapytanie w pięć minut

Połącz istniejącego klienta kompatybilnego z OpenAI z naszym API bez cenzury w kilka sekund. Ten przewodnik obejmuje konfigurację podstawową, standardowe zapytania, strumieniowanie i użycie narzędzi z modelem „bez cenzury”.

Podstawowy URL i uwierzytelnianie

Wskaż swoje SDK OpenAI lub dowolny kompatybilny klient na nasz podstawowy URL. Nie potrzebujesz specjalnej biblioteki; każde narzędzie akceptujące standardowy klucz API zadziała. Pobierz klucz z panelu po zalogowaniu się przez Google lub e-mail. Klucz jest wyświetlany natychmiast i jest jedynym wymagającym poświadczeniem do wszystkich zapytań.

Ustaw bazowy URL na https://api.ollamaapi.top/v1. Używaj ID modelu uncensored do wszystkich uzupełnień w czacie. Model ma otwarte wagi, jest dostrojony do mniejszej liczby odrzuceń i różni się od modeli głównych dostawców. Nie jest to GPT, Claude ani żaden inny model własnościowy. Autoryzacja opiera się wyłącznie na nagłówku Bearer token.

Pierwsze zapytanie

Wyślij standardowe zapytanie o uzupełnienie czatu, aby przetestować łączność. Endpoint akceptuje ładunki JSON z messages, model oraz opcjonalnymi parametrami takimi jak temperature lub max_tokens. Identyfikator modelu to zawsze uncensored. Odpowiedzi zwracają strukturalny JSON zawierający treść asystenta oraz metryki użycia tokenów.

Jeśli zapytanie się powiedzie, otrzymasz odpowiedź 200 OK. Jeśli uwierzytelnienie się nie powiedzie, otrzymasz błąd 401. Jeśli brakuje środków, otrzymasz błąd 402. Te błędy są darmowe, więc płacisz tylko za pomyślne użycie tokenów. Użyj tego przykładu, aby zweryfikować konfigurację przed integracją z aplikacją.

curl https://api.ollamaapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK Pythona

Użyj oficjalnej biblioteki OpenAI dla Pythona lub dowolnego kompatybilnego klienta. Zainicjuj klienta, podając podstawowy URL i klucz API. Ustaw model na uncensored. Przekaż wiadomości jako listę słowników zawierających role i content. Biblioteka automatycznie obsługuje serializację i parsowanie odpowiedzi.

Odpowiedzi strumieniowe są obsługiwane za pomocą parametru stream. Pozwala to przetwarzać tokeny w miarę ich generowania, co jest przydatne przy długich outputach lub aktualizacjach interfejsu w czasie rzeczywistym. Ostatni fragment zawiera całkowite zużycie tokenów do rozliczeń. Upewnij się, że obsługujesz wyjątki, ponieważ błędy sieciowe nie generują opłat.

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Node.js

Zainstaluj pakiet npm openai lub użyj dowolnego wrappera opartego na fetch. Skonfiguruj klienta z podstawowym URL https://api.ollamaapi.top/v1 i swoim kluczem API. Identyfikator modelu pozostaje uncensored. Przekaż ciało żądania z messages oraz opcjonalnymi ustawieniami takimi jak top_p lub seed.

Użytkownicy Node.js mogą wykorzystać wzorce async/await dla czystszego kodu. Obiekt odpowiedzi zawiera choices, usage i id. Możesz wyodrębnić wiadomość asystenta z pierwszego wyboru. Obsługa błędów powinna uwzględniać limity (429) i niewystarczający kredyt (402). Te błędy nie zużywają tokenów, więc Twój przedpłacony balans pozostaje nienaruszony do momentu wygenerowania pomyślnej odpowiedzi.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Odpowiedzi strumieniowe

Włącz strumieniowanie, ustawiając stream: true w zapytaniu. API zwraca strumień zdarzeń wysłanych przez serwer (SSE). Każdy fragment zawiera częściową treść, co pozwala wyświetlać tokeny w miarę ich generowania. Zmniejsza to postrzegane opóźnienie dla użytkowników i poprawia doświadczenie przy generowaniu długich tekstów.

Ostatni fragment strumienia zawiera kompletne dane o zużyciu tokenów. Możesz ich użyć do śledzenia konsumpcji w czasie rzeczywistym. Pamiętaj, że strumieniowanie nie zmienia modelu cenowego; nadal płacisz za 1 mln tokenów wejściowych i wyjściowych. Błędy podczas strumieniowania są również darmowe. Jeśli połączenie zostanie zerwane, możesz wznowić lub ponowić zapytanie bez kary.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limity, błędy i kontekst

Okno kontekstu wynosi łącznie 100 000 tokenów, w tym zarówno prompt, jak i uzupełnienie. Maksymalna liczba tokenów wyjściowych na zapytanie to 32 000 (2 048, jeśli max_tokens nie jest ustawione). Przekroczenie okna kontekstu powoduje błąd zapytania. Błędy obejmują 401 za nieprawidłowe klucze, 402 za niewystarczający kredyt oraz 429 za limity zapytań. Limit zapytań to 300 zapytań na minutę i 8 równoległych zapytań na klucz. Ciała zapytań są ograniczone do 8 MB. Błędy są darmowe, co oznacza, że nie płacisz za odrzucone zapytania lub odrzucenia. Kredyt nigdy nie wygasa, a subskrypcja nie jest wymagana.

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
Base URLhttps://api.ollamaapi.top/v1
UwierzytelnianieAuthorization: Bearer YOUR_KEY
EndpointyPOST /v1/chat/completions · GET /v1/models
ID modeluuncensored
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Tryb JSONresponse_format: {"type": "json_object"}
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Limit zapytań300 zapytań na minutę na klucz
Równoległe zapytaniado 8 jednocześnie na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozmiar zapytaniado 8 MB
Bonus+5% od $50, +10% od $100
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Czy API obsługuje wywoływanie funkcji?

Tak, API obsługuje wywoływanie funkcji za pomocą parametrów <code>tools</code> i <code>tool_choice</code>. Możesz zdefiniować narzędzia w zapytaniu, a model zwróci strukturalny JSON do ich użycia. Ta funkcja działa ze wszystkimi standardowymi klientami kompatybilnymi z OpenAI.

Co się stanie, jeśli przekroczysz okno kontekstu?

Jeśli łączna liczba tokenów (prompt + uzupełnienie) przekroczy 100 000, zapytanie zakończy się błędem. Ten błąd jest darmowy, więc nie płacisz za próbę. Możesz dostosować parametr <code>max_tokens</code> lub skrócić prompt, aby zmieścić się w limitach.

Czy kredyt próbny jest wielokrotnego użytku?

Nie, kredyt próbny za $0,50 jest ważny przez 7 dni i można go użyć tylko raz na konto. Nie wygasa po użyciu, ale jeśli nie zostanie wykorzystany, traci ważność po 7 dniach. Nie jest wymagana karta kredytowa do otrzymania kredytu.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień podstawowy URL. To cała konfiguracja.

Pobierz klucz API