Primeira requisição em cinco minutos
Conecte seu cliente compatível com OpenAI à nossa API sem censura em segundos. Este guia rápido cobre configuração básica, requisições padrão, streaming e uso de ferramentas com o modelo 'sem censura'.
URL Base & Autenticação
Aponte seu SDK OpenAI ou qualquer cliente compatível para nossa URL base. Você não precisa de uma biblioteca específica; qualquer ferramenta que aceite uma chave de API padrão funciona aqui. Recupere sua chave no painel após entrar com Google ou e-mail. A chave é exibida imediatamente e é a única credencial necessária para todas as requisições.
Defina a URL base como https://api.ollamaapi.top/v1. Use o ID do modelo uncensored para todas as conclusões de chat. Este modelo é de pesos abertos, ajustado para ter menos recusas e é distinto dos modelos de grandes fornecedores. Não é GPT, Claude ou qualquer outro modelo proprietário. A autenticação depende exclusivamente do cabeçalho Bearer token.
Primeira Requisição
Envie uma solicitação padrão de conclusão de chat para testar a conectividade. O endpoint aceita payloads JSON com messages, model e parâmetros opcionais como temperature ou max_tokens. O ID do modelo é sempre uncensored. As respostas retornam JSON estruturado incluindo o conteúdo do assistente e métricas de uso de tokens.
Se a requisição for bem-sucedida, você receberá uma resposta 200 OK. Se a autenticação falhar, você receberá um erro 401. Se não tiver fundos, você receberá um erro 402. Esses erros são gratuitos, então você paga apenas pelo uso de tokens bem-sucedidos. Use esta amostra para verificar sua configuração antes de integrar ao seu aplicativo.
curl https://api.ollamaapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Use a biblioteca oficial OpenAI Python ou qualquer cliente compatível. Inicialize o cliente com sua URL base e chave de API. Defina o modelo para uncensored. Passe suas mensagens como uma lista de dicionários contendo role e content. A biblioteca lida com serialização e análise de resposta automaticamente.
O streaming de respostas é suportado pelo parâmetro stream. Isso permite que você processe tokens conforme são gerados, o que é útil para saídas longas ou atualizações de interface do usuário em tempo real. O último chunk contém o uso total de tokens para faturamento. Certifique-se de tratar exceções de forma adequada, pois erros de rede não geram cobranças.
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node
Instale o pacote npm openai ou use qualquer wrapper baseado em fetch. Configure o cliente com a URL base https://api.ollamaapi.top/v1 e sua chave de API. O ID do modelo permanece uncensored. Passe o corpo da requisição com messages e configurações opcionais como top_p ou seed.
Usuários de Node.js podem aproveitar padrões async/await para código limpo. O objeto de resposta inclui choices, usage e id. Você pode extrair a mensagem do assistente da primeira escolha. O tratamento de erros deve considerar limites de requisições (429) e crédito insuficiente (402). Esses erros não consomem tokens, então seu saldo pré-pago permanece intacto até que uma resposta bem-sucedida seja gerada.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respostas em Streaming
Ative o streaming definindo stream: true na sua requisição. A API retorna um stream de Server-Sent Events (SSE). Cada chunk contém conteúdo parcial, permitindo que você exiba tokens conforme são gerados. Isso reduz a latência percebida para os usuários e melhora a experiência para geração de texto longo.
O último chunk do stream inclui os dados completos de uso de tokens. Você pode usá-los para acompanhar o consumo em tempo real. Observe que o streaming não altera o modelo de precificação; você ainda paga por 1M de tokens de entrada e saída. Erros durante o streaming também são gratuitos. Se a conexão cair, você pode retomar ou reiniciar a requisição sem penalidades.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, Erros & Contexto
A janela de contexto é de 100.000 tokens no total, incluindo prompt e conclusão. A saída máxima por solicitação é de 32.000 tokens (2.048 se max_tokens estiver não definido). Se você exceder a janela de contexto, a solicitação falhará. Os erros incluem 401 para chaves inválidas, 402 para crédito insuficiente e 429 para limites de requisições. O limite de requisições é de 300 solicitações por minuto e 8 requisições simultâneas por chave. Os corpos das solicitações são limitados a 8 MB. Erros são gratuitos, o que significa que você não paga por solicitações falhas ou recusas. O crédito nunca expira e não é necessária assinatura.
Ficha técnica da API
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Base URL | https://api.ollamaapi.top/v1 |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID do modelo | uncensored |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Modo JSON | response_format: {"type": "json_object"} |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamanho | até 8 MB por requisição |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Validade | crédito pago não expira, sem assinatura |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Esta API suporta chamada de funções?
Sim, a API suporta chamada de funções via parâmetros <code>tools</code> e <code>tool_choice</code>. Você pode definir ferramentas na sua requisição e o modelo retornará JSON estruturado para uso de ferramentas. Este recurso funciona com todos os clientes compatíveis com OpenAI.
O que acontece se eu exceder a janela de contexto?
Se o total de tokens (prompt + conclusão) exceder 100.000, a requisição falhará com erro. Este erro é gratuito, então você não é cobrado pela tentativa. Ajuste o parâmetro <code>max_tokens</code> ou encurte seu prompt para permanecer dentro dos limites.
O crédito de teste é reutilizável?
Não, o crédito de teste de $0,50 é válido por 7 dias e pode ser usado apenas uma vez por conta. Não expira após o uso, mas se não utilizado, é perdido após 7 dias. Nenhum cartão de crédito é necessário para obter o teste.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.
Obter chave de API