FR ▾

API LLM hébergée sans censure

Obtenir une clé API
par 1 M de tokens d'entrée
$0.25
Tokens de sortie / 1 M
$1.00
fenêtre de contexte
100,000

Première requête en cinq minutes

Connectez votre client compatible OpenAI à notre API sans censure en quelques secondes. Ce guide rapide couvre la configuration de base, les requêtes standard, le streaming et l'utilisation des outils avec le modèle « sans censure ».

URL de base et authentification

Configurez votre SDK OpenAI ou tout client compatible pour pointer vers notre URL de base. Vous n'avez pas besoin d'une bibliothèque spécifique ; tout outil acceptant une clé API standard fonctionne ici. Récupérez votre clé depuis le tableau de bord après vous être connecté avec Google ou par e-mail. La clé s'affiche immédiatement et est l'unique identifiant requis pour toutes les requêtes.

Définissez l'URL de base sur https://api.ollamaapi.top/v1. Utilisez l'ID de modèle uncensored pour toutes les complétions de chat. Ce modèle à poids ouverts est ajusté pour réduire les refus et se distingue des modèles des grands fournisseurs. Il ne s'agit pas de GPT, Claude ou d'un autre modèle propriétaire. L'authentification repose uniquement sur l'en-tête Bearer.

Première requête

Envoyez une requête standard de chat completion pour tester la connectivité. L'endpoint accepte des charges utiles JSON avec messages, model, et des paramètres optionnels comme temperature ou max_tokens. L'ID du modèle est toujours uncensored. Les réponses renvoient du JSON structuré incluant le contenu de l'assistant et les métriques d'utilisation des tokens.

Si la requête réussit, vous recevez une réponse 200 OK. Si l'authentification échoue, vous obtenez une erreur 401. Si vous n'avez pas de fonds, vous obtenez une erreur 402. Ces erreurs sont gratuites, vous ne payez donc que pour l'utilisation réussie des tokens. Utilisez cet exemple pour vérifier votre configuration avant de l'intégrer à votre application.

curl https://api.ollamaapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK Python

Utilisez la bibliothèque officielle OpenAI pour Python ou tout client compatible. Initialisez le client avec votre URL de base et votre clé API. Définissez le modèle sur uncensored. Transmettez vos messages sous forme de liste de dictionnaires contenant role et content. La bibliothèque gère automatiquement la sérialisation et l'analyse des réponses.

Les réponses en streaming sont prises en charge via le paramètre stream. Cela vous permet de traiter les tokens au fur et à mesure de leur génération, ce qui est utile pour les sorties longues ou les mises à jour d'interface utilisateur en temps réel. Le dernier bloc contient l'utilisation totale des tokens pour la facturation. Assurez-vous de gérer les exceptions correctement, car les erreurs réseau ne sont pas facturées.

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Node.js

Installez le package npm openai ou utilisez n'importe quel wrapper basé sur fetch. Configurez le client avec l'URL de base https://api.ollamaapi.top/v1 et votre clé API. L'ID de modèle reste uncensored. Transmettez le corps de la requête avec messages et des paramètres optionnels comme top_p ou seed.

Les utilisateurs de Node.js peuvent tirer parti des modèles async/await pour un code propre. L'objet de réponse inclut choices, usage et id. Vous pouvez extraire le message de l'assistant depuis le premier choix. La gestion des erreurs doit prendre en compte les limites de débit (429) et le crédit insuffisant (402). Ces erreurs ne consomment pas de tokens, votre solde prépayé reste donc intact jusqu'à la génération d'une réponse réussie.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Réponses en streaming

Activez le streaming en définissant stream: true dans votre requête. L'API renvoie un flux Server-Sent Events (SSE). Chaque bloc contient du contenu partiel, vous permettant d'afficher les tokens au fur et à mesure de leur génération. Cela réduit la latence perçue pour les utilisateurs et améliore l'expérience pour la génération de texte long.

Le dernier bloc du flux inclut les données complètes d'utilisation des tokens. Vous pouvez les utiliser pour suivre la consommation en temps réel. Notez que le streaming ne modifie pas le modèle de tarification ; vous payez toujours par 1M de tokens d'entrée et de sortie. Les erreurs lors du streaming sont également gratuites. Si la connexion est coupée, vous pouvez reprendre ou redémarrer la requête sans pénalité.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites, erreurs et contexte

La fenêtre de contexte est de 100 000 tokens au total, incluant à la fois le prompt et la complétion. Le maximum de sortie par requête est de 32 000 tokens (2 048 si max_tokens n'est pas défini). Si vous dépassez la fenêtre de contexte, la requête échoue. Les erreurs incluent 401 pour les clés invalides, 402 pour le crédit insuffisant et 429 pour les limites de débit. La limite de débit est de 300 requêtes par minute et 8 requêtes simultanées par clé. Les corps de requête sont limités à 8 Mo. Les erreurs sont gratuites, ce qui signifie que vous ne payez pas pour les requêtes échouées ou les refus. Le crédit n'expire jamais et aucun abonnement n'est requis.

Fiche technique de l'API

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
Base URLhttps://api.ollamaapi.top/v1
AuthentificationAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID du modèleuncensored
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Mode JSONresponse_format: {"type": "json_object"}
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Fenêtre de contexte100 000 tokens (entrée + sortie)
Limite de débit300 requêtes par minute et par clé
Concurrence8 requêtes simultanées par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Taillejusqu'à 8 Mo par requête
Bonus+5 % dès 50 $, +10 % dès 100 $
Validitéle crédit payé n'expire jamais, sans abonnement
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
ConnexionGoogle ou e-mail et mot de passe
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Cette API prend-elle en charge l'appel de fonctions ?

Oui, l'API prend en charge l'appel de fonctions via les paramètres <code>tools</code> et <code>tool_choice</code>. Vous pouvez définir des fonctions dans votre requête et le modèle renverra du JSON structuré pour leur utilisation. Cette fonctionnalité est compatible avec tous les clients OpenAI standard.

Que se passe-t-il si je dépasse la fenêtre de contexte ?

Si le nombre total de tokens (prompt + complétion) dépasse 100 000, la requête échouera avec une erreur. Cette erreur est gratuite, vous ne serez donc pas facturé pour la tentative. Vous pouvez ajuster le paramètre <code>max_tokens</code> ou raccourcir votre prompt pour respecter les limites.

Le crédit d'essai est-il réutilisable ?

Non, le crédit d'essai de 0,50 $ est valable 7 jours et ne peut être utilisé qu'une fois par compte. Il n'expire pas après utilisation, mais s'il n'est pas utilisé, il est perdu après 7 jours. Aucune carte bancaire n'est requise pour réclamer le crédit d'essai.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API