Eerste verzoek in vijf minuten
Verbind je bestaande OpenAI-compatibele client binnen enkele seconden met onze ongecensureerde API. Deze quickstart behandelt basisconfiguratie, standaardverzoeken, streaming en toolgebruik met het 'uncensored' model.
Basis-URL & Authenticatie
Wijs je OpenAI SDK of een andere compatibele client naar onze basis-URL. Je hebt geen specifieke bibliotheek nodig; elke tool die een standaard API-sleutel accepteert, werkt hier. Haal je sleutel op in het dashboard na het inloggen met Google of e-mail. De sleutel wordt direct weergegeven en is het enige vereiste referentiemateriaal voor alle verzoeken.
Stel de basis-URL in op https://api.ollamaapi.top/v1. Gebruik de model-ID uncensored voor alle chatcompleties. Dit model is open-weight, getuned voor minder weigeringen en verschilt van modellen van grote leveranciers. Het is geen GPT, Claude of een ander propriëtair model. Authenticatie verloopt uitsluitend via de Bearer-token header.
Eerste verzoek
Stuur een standaard chatcompletion-verzoek om de connectiviteit te testen. Het endpoint accepteert JSON-payloads met messages, model en optionele parameters zoals temperature of max_tokens. De model-ID is altijd uncensored. Antwoorden retourneren gestructureerde JSON inclusief de inhoud van de assistent en tokenverbruiksmetrics.
Als het verzoek slaagt, ontvang je een 200 OK-antwoord. Als de authenticatie faalt, krijg je een 401-fout. Als je geen tegoed hebt, krijg je een 402-fout. Deze fouten zijn gratis, dus je betaalt alleen voor succesvol tokengebruik. Gebruik dit voorbeeld om je configuratie te verifiëren voordat je het in je applicatie integreert.
curl https://api.ollamaapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
Gebruik de officiële OpenAI Python-bibliotheek of een andere compatibele client. Initialiseer de client met je basis-URL en API-sleutel. Stel het model in op uncensored. Geef je berichten door als een lijst met dictionaries met role en content. De bibliotheek verwerkt serialisatie en responsparsering automatisch.
Streaming responses worden ondersteund via de parameter stream. Hiermee kun je tokens verwerken terwijl ze worden gegenereerd, wat nuttig is voor lange uitvoeren of realtime UI-updates. De laatste chunk bevat het totale tokenverbruik voor facturering. Zorg dat je uitzonderingen afhandelt, omdat netwerkfouten geen kosten met zich meebrengen.
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
Installeer het openai npm-pakket of gebruik een fetch-gebaseerde wrapper. Configureer de client met de basis-URL https://api.ollamaapi.top/v1 en je API-sleutel. De model-ID blijft uncensored. Geef de request body mee met messages en optionele instellingen zoals top_p of seed.
Node.js-gebruikers kunnen async/await-patronen gebruiken voor schone code. Het responsobject bevat choices, usage en id. Je kunt het bericht van de assistent extraheren uit de eerste keuze. Foutafhandeling moet rekening houden met rate limits (429) en onvoldoende tegoed (402). Deze fouten verbruiken geen tokens, dus je prepaid tegoed blijft intact totdat een succesvol antwoord is gegenereerd.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming antwoorden
Schakel streaming in door stream: true in je verzoek in te stellen. De API retourneert een Server-Sent Events (SSE)-stream. Elke chunk bevat gedeeltelijke inhoud, waardoor je tokens kunt weergeven terwijl ze worden gegenereerd. Dit vermindert de waargenomen latentie voor gebruikers en verbetert de ervaring bij het genereren van lange teksten.
De laatste chunk in de stream bevat de volledige tokenverbruiksgegevens. Je kunt dit gebruiken om het verbruik in realtime te volgen. Houd er rekening mee dat streaming het prijsmodel niet verandert; je betaalt nog steeds per 1M input- en outputtokens. Fouten tijdens streaming zijn ook gratis. Als de verbinding verbroken raakt, kun je het verzoek hervatten of opnieuw starten zonder boete.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limieten, fouten & context
Het contextvenster is in totaal 100.000 tokens, inclusief zowel prompt als completion. De maximale uitvoer per verzoek is 32.000 tokens (2.048 als max_tokens niet is ingesteld). Als je het contextvenster overschrijdt, faalt het verzoek. Fouten zijn 401 voor ongeldige sleutels, 402 voor onvoldoende tegoed en 429 voor rate limits. Het rate limit is 300 verzoeken per minuut en 8 gelijktijdige verzoeken per sleutel. Request bodies zijn beperkt tot 8 MB. Fouten zijn gratis, wat betekent dat je niet betaalt voor mislukte verzoeken of afwijzingen. Het tegoed verloopt nooit en er is geen abonnement nodig.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Base URL | https://api.ollamaapi.top/v1 |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Model-ID | uncensored |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| JSON-modus | response_format: {"type": "json_object"} |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Verzoekgrootte | tot 8 MB |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Ondersteunt deze API function calling?
Ja, de API ondersteunt function calling via de parameters <code>tools</code> en <code>tool_choice</code>. Je kunt tools definiëren in je verzoek en het model retourneert gestructureerde JSON voor toolgebruik. Deze functie werkt met alle standaard OpenAI-compatibele clients.
Wat gebeurt er als ik het contextvenster overschrijd?
Als het totale aantal tokens (prompt + completion) meer dan 100.000 bedraagt, faalt het verzoek met een fout. Deze fout is gratis, dus je wordt niet aangerekend voor de poging. Je kunt de parameter <code>max_tokens</code> aanpassen of je prompt inkorten om binnen de limieten te blijven.
Is het proeftegoed herbruikbaar?
Nee, het proeftegoed van $0,50 is 7 dagen geldig en kan slechts één keer per account worden gebruikt. Het vervalt niet na gebruik, maar als het ongebruikt blijft, gaat het na 7 dagen verloren. Er is geen creditcard nodig om het proeftegoed te claimen.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele configuratie.
API-sleutel aanvragen