RU ▾

Размещенный API LLM без цензуры

Получить API-ключ
за 1 млн входных токенов
$0.25
Выходные токены / 1 млн
$1.00
контекстное окно
100,000

Первый запрос за пять минут

Подключите ваш существующий клиент, совместимый с OpenAI, к нашему API без цензуры за несколько секунд. Это краткое руководство охватывает базовую конфигурацию, стандартные запросы, потоковую передачу и использование инструментов с моделью 'uncensored'.

Базовый URL и аутентификация

Направьте ваш SDK OpenAI или любой другой совместимый клиент на наш базовый URL. Вам не нужна специальная библиотека; здесь подойдет любой инструмент, принимающий стандартный API-ключ. Получите ключ в панели управления после входа через Google или электронную почту. Ключ отображается сразу и является единственным удостоверением для всех запросов.

Установите базовый URL в https://api.ollamaapi.top/v1. Используйте идентификатор модели uncensored для всех чат-завершений. Эта модель с открытыми весами настроена на меньшее количество отказов и отличается от моделей крупных вендоров. Это не GPT, Claude или какая-либо другая проприетарная модель. Аутентификация основана исключительно на заголовке Bearer token.

Первый запрос

Отправьте стандартный запрос на завершение чата, чтобы проверить подключение. Эндпоинт принимает JSON-пакеты с параметрами messages, model и необязательными параметрами, такими как temperature или max_tokens. Идентификатор модели всегда uncensored. Ответы возвращают структурированный JSON, включая содержимое ассистента и метрики использования токенов.

Если запрос успешен, вы получаете ответ 200 OK. Если аутентификация не пройдена, возникает ошибка 401. Если у вас недостаточно средств, возникает ошибка 402. Эти ошибки бесплатны, поэтому вы платите только за успешное использование токенов. Используйте этот пример, чтобы проверить конфигурацию перед интеграцией в приложение.

curl https://api.ollamaapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK

Используйте официальную библиотеку OpenAI для Python или любой совместимый клиент. Инициализируйте клиент, указав базовый URL и API-ключ. Установите модель в uncensored. Передавайте сообщения в виде списка словарей, содержащих role и content. Библиотека автоматически выполняет сериализацию и разбор ответов.

Поддерживаются потоковые ответы через параметр stream. Это позволяет обрабатывать токены по мере их генерации, что полезно для длинных выводов или обновлений пользовательского интерфейса в реальном времени. Последний чанк содержит общее количество использованных токенов для выставления счетов. Убедитесь, что вы корректно обрабатываете исключения, так как ошибки сети не влекут за собой расходов.

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK

Установите пакет npm openai или используйте любую обертку на основе fetch. Настройте клиент с базовым URL https://api.ollamaapi.top/v1 и вашим API-ключом. Идентификатор модели остается uncensored. Передайте тело запроса с параметром messages и необязательными настройками, такими как top_p или seed.

Пользователи Node.js могут использовать паттерны async/await для чистого кода. Объект ответа включает choices, usage и id. Вы можете извлечь сообщение ассистента из первого варианта. Обработка ошибок должна учитывать лимиты запросов (429) и недостаточный баланс (402). Эти ошибки не потребляют токены, поэтому ваш предоплаченный баланс остается нетронутым до получения успешного ответа.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Потоковые ответы

Включите потоковую передачу, установив stream: true в запросе. API возвращает поток Server-Sent Events (SSE). Каждый чанк содержит частичное содержимое, позволяя отображать токены по мере их генерации. Это снижает воспринимаемую задержку для пользователей и улучшает опыт генерации длинных текстов.

Последний чанк в потоке содержит полные данные об использовании токенов. Вы можете использовать их для отслеживания потребления в реальном времени. Обратите внимание, что потоковая передача не меняет модель ценообразования; вы все равно платите за 1 млн входных и выходных токенов. Ошибки во время потоковой передачи также бесплатны. Если соединение прервется, вы можете возобновить или перезапустить запрос без штрафов.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Лимиты, ошибки и контекст

Контекстное окно составляет 100 000 токенов суммарно, включая промпт и ответ. Максимальный объем вывода на запрос — 32 000 токенов (2 048, если max_tokens не задан). Если вы превысите контекстное окно, запрос завершится ошибкой. Ошибки включают 401 для недействительных ключей, 402 для недостаточного баланса и 429 для лимитов запросов. Лимит запросов составляет 300 запросов в минуту и 8 параллельных запросов на ключ. Тела запросов ограничены 8 МБ. Ошибки бесплатны, то есть вы не платите за неудачные запросы или отказы. Баланс не сгорает, подписка не требуется.

Характеристики API

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
Base URLhttps://api.ollamaapi.top/v1
АвторизацияAuthorization: Bearer YOUR_KEY
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
ID моделиuncensored
Максимум ответадо остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет)
JSON-режимresponse_format: {"type": "json_object"}
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
Контекстное окно100 000 токенов (вход и ответ вместе)
Лимит запросов300 запросов в минуту на ключ
Параллельные запросыдо 8 одновременно на ключ
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Размер запросадо 8 МБ
Бонус+5% от $50, +10% от $100
Срок действияоплаченный баланс не сгорает, без подписки
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
ВходGoogle или e-mail и пароль
Ключиодин активный ключ на аккаунт; новый заменяет старый
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд

Вопросы и ответы

Поддерживает ли этот API вызов функций?

Да, API поддерживает вызов функций через параметры <code>tools</code> и <code>tool_choice</code>. Вы можете определить инструменты в запросе, и модель вернет структурированный JSON для их использования. Эта функция работает со всеми стандартными клиентами, совместимыми с OpenAI.

Что произойдет, если я превышу контекстное окно?

Если общее количество токенов (промпт + завершение) превысит 100 000, запрос завершится ошибкой. Эта ошибка бесплатна, поэтому вы не платите за попытку. Вы можете изменить параметр <code>max_tokens</code> или сократить промпт, чтобы уложиться в лимиты.

Можно ли использовать пробный баланс повторно?

Нет, пробный баланс $0,50 действителен в течение 7 дней и может быть использован только один раз на аккаунт. Он не сгорает после использования, но если не используется, то сгорает через 7 дней. Для получения пробного баланса не требуется банковская карта.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключ