Première requête en cinq minutes
Connectez votre client compatible OpenAI à notre API sans censure en quelques secondes. Ce guide rapide couvre la configuration de base, les requêtes standard, le streaming et l'utilisation des outils avec le modèle « sans censure ».
URL de base et authentification
Configurez votre SDK OpenAI ou tout client compatible pour pointer vers notre URL de base. Vous n'avez pas besoin d'une bibliothèque spécifique ; tout outil acceptant une clé API standard fonctionne ici. Récupérez votre clé depuis le tableau de bord après vous être connecté avec Google ou par e-mail. La clé s'affiche immédiatement et est l'unique identifiant requis pour toutes les requêtes.
Définissez l'URL de base sur https://api.ollamaapi.top/v1. Utilisez l'ID de modèle uncensored pour toutes les complétions de chat. Ce modèle à poids ouverts est ajusté pour réduire les refus et se distingue des modèles des grands fournisseurs. Il ne s'agit pas de GPT, Claude ou d'un autre modèle propriétaire. L'authentification repose uniquement sur l'en-tête Bearer.
Première requête
Envoyez une requête standard de chat completion pour tester la connectivité. L'endpoint accepte des charges utiles JSON avec messages, model, et des paramètres optionnels comme temperature ou max_tokens. L'ID du modèle est toujours uncensored. Les réponses renvoient du JSON structuré incluant le contenu de l'assistant et les métriques d'utilisation des tokens.
Si la requête réussit, vous recevez une réponse 200 OK. Si l'authentification échoue, vous obtenez une erreur 401. Si vous n'avez pas de fonds, vous obtenez une erreur 402. Ces erreurs sont gratuites, vous ne payez donc que pour l'utilisation réussie des tokens. Utilisez cet exemple pour vérifier votre configuration avant de l'intégrer à votre application.
curl https://api.ollamaapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Utilisez la bibliothèque officielle OpenAI pour Python ou tout client compatible. Initialisez le client avec votre URL de base et votre clé API. Définissez le modèle sur uncensored. Transmettez vos messages sous forme de liste de dictionnaires contenant role et content. La bibliothèque gère automatiquement la sérialisation et l'analyse des réponses.
Les réponses en streaming sont prises en charge via le paramètre stream. Cela vous permet de traiter les tokens au fur et à mesure de leur génération, ce qui est utile pour les sorties longues ou les mises à jour d'interface utilisateur en temps réel. Le dernier bloc contient l'utilisation totale des tokens pour la facturation. Assurez-vous de gérer les exceptions correctement, car les erreurs réseau ne sont pas facturées.
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node.js
Installez le package npm openai ou utilisez n'importe quel wrapper basé sur fetch. Configurez le client avec l'URL de base https://api.ollamaapi.top/v1 et votre clé API. L'ID de modèle reste uncensored. Transmettez le corps de la requête avec messages et des paramètres optionnels comme top_p ou seed.
Les utilisateurs de Node.js peuvent tirer parti des modèles async/await pour un code propre. L'objet de réponse inclut choices, usage et id. Vous pouvez extraire le message de l'assistant depuis le premier choix. La gestion des erreurs doit prendre en compte les limites de débit (429) et le crédit insuffisant (402). Ces erreurs ne consomment pas de tokens, votre solde prépayé reste donc intact jusqu'à la génération d'une réponse réussie.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming
Activez le streaming en définissant stream: true dans votre requête. L'API renvoie un flux Server-Sent Events (SSE). Chaque bloc contient du contenu partiel, vous permettant d'afficher les tokens au fur et à mesure de leur génération. Cela réduit la latence perçue pour les utilisateurs et améliore l'expérience pour la génération de texte long.
Le dernier bloc du flux inclut les données complètes d'utilisation des tokens. Vous pouvez les utiliser pour suivre la consommation en temps réel. Notez que le streaming ne modifie pas le modèle de tarification ; vous payez toujours par 1M de tokens d'entrée et de sortie. Les erreurs lors du streaming sont également gratuites. Si la connexion est coupée, vous pouvez reprendre ou redémarrer la requête sans pénalité.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, erreurs et contexte
La fenêtre de contexte est de 100 000 tokens au total, incluant à la fois le prompt et la complétion. Le maximum de sortie par requête est de 32 000 tokens (2 048 si max_tokens n'est pas défini). Si vous dépassez la fenêtre de contexte, la requête échoue. Les erreurs incluent 401 pour les clés invalides, 402 pour le crédit insuffisant et 429 pour les limites de débit. La limite de débit est de 300 requêtes par minute et 8 requêtes simultanées par clé. Les corps de requête sont limités à 8 Mo. Les erreurs sont gratuites, ce qui signifie que vous ne payez pas pour les requêtes échouées ou les refus. Le crédit n'expire jamais et aucun abonnement n'est requis.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Base URL | https://api.ollamaapi.top/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Cette API prend-elle en charge l'appel de fonctions ?
Oui, l'API prend en charge l'appel de fonctions via les paramètres <code>tools</code> et <code>tool_choice</code>. Vous pouvez définir des fonctions dans votre requête et le modèle renverra du JSON structuré pour leur utilisation. Cette fonctionnalité est compatible avec tous les clients OpenAI standard.
Que se passe-t-il si je dépasse la fenêtre de contexte ?
Si le nombre total de tokens (prompt + complétion) dépasse 100 000, la requête échouera avec une erreur. Cette erreur est gratuite, vous ne serez donc pas facturé pour la tentative. Vous pouvez ajuster le paramètre <code>max_tokens</code> ou raccourcir votre prompt pour respecter les limites.
Le crédit d'essai est-il réutilisable ?
Non, le crédit d'essai de 0,50 $ est valable 7 jours et ne peut être utilisé qu'une fois par compte. Il n'expire pas après utilisation, mais s'il n'est pas utilisé, il est perdu après 7 jours. Aucune carte bancaire n'est requise pour réclamer le crédit d'essai.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.
Obtenir une clé API