IT ▾

API LLM ospitata senza censura

Ottieni la chiave API
per 1M token di input
$0.25
Token di output / 1M
$1.00
contesto di token
100,000

Prima richiesta in cinque minuti

Collega il tuo client OpenAI esistente alla nostra API senza censura in pochi secondi. Questa guida rapida copre la configurazione di base, le richieste standard, lo streaming e l'uso degli strumenti con il modello 'uncensored'.

URL di base e autenticazione

Indirizza il tuo SDK OpenAI o qualsiasi client compatibile al nostro URL di base. Non è necessaria una libreria specifica; qualsiasi strumento che accetta una chiave API standard funziona qui. Recupera la tua chiave dalla dashboard dopo aver effettuato l'accesso con Google o email. La chiave viene visualizzata immediatamente ed è l'unica credenziale necessaria per tutte le richieste.

Imposta l'URL di base su https://api.ollamaapi.top/v1. Usa l'ID del modello uncensored per tutti i completamenti di chat. Questo modello è open-weight, ottimizzato per ridurre i rifiuti ed è distinto dai modelli dei principali fornitori. Non è GPT, Claude o qualsiasi altro modello proprietario. L'autenticazione si basa esclusivamente sull'intestazione del token Bearer.

Prima richiesta

Invia una richiesta standard di completamento della chat per testare la connettività. L'endpoint accetta payload JSON con messages, model e parametri opzionali come temperature o max_tokens. L'ID del modello è sempre uncensored. Le risposte restituiscono un JSON strutturato contenente il contenuto dell'assistente e le metriche di utilizzo dei token.

Se la richiesta ha successo, ricevi una risposta 200 OK. Se l'autenticazione fallisce, ricevi un errore 401. Se non hai fondi, ricevi un errore 402. Questi errori sono gratuiti, quindi paghi solo per l'utilizzo effettivo dei token. Usa questo esempio per verificare la tua configurazione prima di integrarla nella tua applicazione.

curl https://api.ollamaapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK Python

Usa la libreria ufficiale OpenAI per Python o qualsiasi client compatibile. Inizializza il client con il tuo URL di base e chiave API. Imposta il modello su uncensored. Passa i tuoi messaggi come una lista di dizionari contenenti role e content. La libreria gestisce automaticamente la serializzazione e l'analisi delle risposte.

Le risposte in streaming sono supportate tramite il parametro stream. Questo ti permette di elaborare i token man mano che vengono generati, utile per output lunghi o aggiornamenti UI in tempo reale. L'ultimo chunk contiene l'utilizzo totale dei token per la fatturazione. Assicurati di gestire le eccezioni in modo appropriato, poiché gli errori di rete non comportano costi.

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Node.js

Installa il pacchetto npm openai o usa un wrapper basato su fetch. Configura il client con l'URL di base https://api.ollamaapi.top/v1 e la tua chiave API. L'ID del modello rimane uncensored. Passa il corpo della richiesta con messages e impostazioni opzionali come top_p o seed.

Gli utenti Node.js possono sfruttare i pattern async/await per un codice pulito. L'oggetto di risposta include choices, usage e id. Puoi estrarre il messaggio dell'assistente dalla prima scelta. La gestione degli errori dovrebbe tenere conto dei limiti di velocità (429) e del credito insufficiente (402). Questi errori non consumano token, quindi il tuo saldo prepagato rimane intatto fino alla generazione di una risposta di successo.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Risposte in streaming

Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce uno stream di Server-Sent Events (SSE). Ogni chunk contiene contenuto parziale, permettendoti di visualizzare i token man mano che vengono generati. Questo riduce la latenza percepita per gli utenti e migliora l'esperienza per la generazione di testi lunghi.

L'ultimo chunk nello stream include i dati completi sull'utilizzo dei token. Puoi usarli per monitorare i consumi in tempo reale. Nota che lo streaming non modifica il modello di pricing; paghi ancora per 1M token di input e output. Anche gli errori durante lo streaming sono gratuiti. Se la connessione si interrompe, puoi riprendere o riavviare la richiesta senza penalità.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limiti, errori e contesto

La finestra di contesto è di 100.000 token in totale, inclusi sia prompt che completamento. Il massimo output per richiesta è 32.000 token (2.048 se max_tokens non è impostato). Se superi la finestra di contesto, la richiesta fallisce. Gli errori includono 401 per chiavi non valide, 402 per credito insufficiente e 429 per limiti di velocità. Il limite di richieste è di 300 richieste al minuto e 8 richieste parallele per chiave. I corpi delle richieste sono limitati a 8 MB. Gli errori sono gratuiti, il che significa che non paghi per le richieste fallite o i rifiuti. Il credito non scade mai e non è richiesto un abbonamento.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
Base URLhttps://api.ollamaapi.top/v1
AutenticazioneAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
ID modellouncensored
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Modalità JSONresponse_format: {"type": "json_object"}
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Finestra di contesto100.000 token (input + output)
Limite di frequenza300 richieste al minuto per chiave
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Dimensionefino a 8 MB per richiesta
Bonus+5% da $50, +10% da $100
Scadenzail credito pagato non scade, nessun abbonamento
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

L'API supporta la chiamata di funzioni?

Sì, l'API supporta la chiamata di funzioni tramite i parametri <code>tools</code> e <code>tool_choice</code>. Puoi definire gli strumenti nella richiesta e il modello restituirà un JSON strutturato per l'uso degli strumenti. Questa funzionalità è compatibile con tutti i client standard compatibili con OpenAI.

Cosa succede se supero la finestra di contesto?

Se i token totali (prompt + completamento) superano 100.000, la richiesta fallirà con un errore. Questo errore è gratuito, quindi non ti verrà addebitato il costo per il tentativo. Puoi regolare il parametro <code>max_tokens</code> o accorciare il prompt per rimanere entro i limiti.

Il credito di prova è riutilizzabile?

No, il credito di prova da $0,50 è valido per 7 giorni e può essere utilizzato una sola volta per account. Non scade dopo l'utilizzo, ma se non viene utilizzato, viene perso dopo 7 giorni. Non è richiesta una carta di credito per ottenere il credito di prova.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API