KO ▾

호스팅된 무검열 LLM API

API 키 받기
입력 토큰 100만 개당
$0.25
출력 토큰 / 100만 개
$1.00
토큰 컨텍스트 창
100,000

5분 내 첫 요청

기존 OpenAI 호환 클라이언트를 몇 초 만에 무검열 API에 연결하세요. 이 빠른 시작 가이드에서는 기본 구성, 표준 요청, 스트리밍 및 '무검열' 모델을 사용한 도구 사용 방법을 다룹니다.

기본 URL 및 인증

OpenAI SDK 또는 호환 가능한 클라이언트를 기본 URL로 지정하세요. 특정 라이브러리가 필요하지 않습니다. 표준 API 키를 받는 모든 도구가 여기서 작동합니다. Google 또는 이메일로 로그인한 후 대시보드에서 키를 가져오세요. 키는 즉시 표시되며 모든 요청에 필요한 유일한 자격 증명입니다.

기본 URL을 https://api.ollamaapi.top/v1로 설정하세요. 모든 채팅 완성에는 모델 ID uncensored를 사용하세요. 이 모델은 오픈 웨이트 모델로, 거부 응답이 적도록 조정되었으며 주요 벤더 모델과 구별됩니다. GPT, Claude 또는 기타 독점 모델이 아닙니다. 인증은 Bearer 토큰 헤더에만 의존합니다.

첫 번째 요청

연결성을 테스트하기 위해 표준 채팅 완성 요청을 보내세요. 엔드포인트는 messages, model 및 temperature 또는 max_tokens과 같은 선택적 매개변수를 포함하는 JSON 페이로드를 받습니다. 모델 ID는 항상 uncensored입니다. 응답에는 어시스턴트의 콘텐츠와 토큰 사용량 메트릭스를 포함한 구조화된 JSON이 반환됩니다.

요청이 성공하면 200 OK 응답을 받습니다. 인증에 실패하면 401 오류가 발생합니다. 자금이 부족하면 402 오류가 발생합니다. 이러한 오류는 무료이므로 성공적인 토큰 사용에만 요금이 부과됩니다. 애플리케이션에 통합하기 전에 이 샘플을 사용하여 구성을 확인하세요.

curl https://api.ollamaapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK

공식 OpenAI Python 라이브러리 또는 호환 가능한 클라이언트를 사용하세요. 기본 URL과 API 키로 클라이언트를 초기화하세요. 모델을 uncensored로 설정하세요. role 및 content을 포함하는 사전 목록으로 메시지를 전달하세요. 라이브러리는 직렬화 및 응답 파싱을 자동으로 처리합니다.

스트리밍 응답은 stream 매개변수를 통해 지원됩니다. 이를 통해 생성되는 토큰을 처리할 수 있으며, 긴 출력이나 실시간 UI 업데이트에 유용합니다. 마지막 청크에는 청구를 위한 총 토큰 사용량이 포함됩니다. 네트워크 오류는 요금이 부과되지 않으므로 예외를 적절히 처리하세요.

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK

openai npm 패키지를 설치하거나 fetch 기반 래퍼를 사용하세요. 기본 URL https://api.ollamaapi.top/v1 및 API 키로 클라이언트를 구성하세요. 모델 ID는 여전히 uncensored입니다. messages 및 top_p 또는 seed과 같은 선택적 설정이 있는 요청 본문을 전달하세요.

Node.js 사용자는 깔끔한 코드를 위해 async/await 패턴을 활용할 수 있습니다. 응답 객체에는 choices, usage 및 id이 포함됩니다. 첫 번째 선택에서 어시스턴트의 메시지를 추출할 수 있습니다. 오류 처리에는 속도 제한(429) 및 부족 크레딧(402)이 포함되어야 합니다. 이러한 오류는 토큰을 소비하지 않으므로 선불 잔액은 성공적인 응답이 생성될 때까지 그대로 유지됩니다.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

스트리밍 응답

요청에 stream: true을 설정하여 스트리밍을 활성화하세요. API는 서버 전송 이벤트(SSE) 스트림을 반환합니다. 각 청크에는 부분 콘텐츠가 포함되어 생성되는 토큰을 표시할 수 있습니다. 이는 사용자의 지각된 지연 시간을 줄이고 긴 형식 텍스트 생성에 대한 경험을 향상시킵니다.

스트림의 마지막 청크에는 완전한 토큰 사용량 데이터가 포함됩니다. 이를 사용하여 실시간으로 소비량을 추적할 수 있습니다. 스트리밍은 가격 책정 모델을 변경하지 않습니다. 여전히 입력 및 출력 토큰 100만 개당 요금이 부과됩니다. 스트리밍 중 오류도 무료입니다. 연결이 끊기면 패널티 없이 요청을 재개하거나 다시 시작할 수 있습니다.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

제한, 오류 및 컨텍스트

컨텍스트 창은 프롬프트와 완성을 모두 포함하여 총 100,000 토큰입니다. 요청당 최대 출력은 32,000 토큰입니다 (max_tokens이 설정되지 않은 경우 2,048). 컨텍스트 창을 초과하면 요청이 실패합니다. 오류에는 잘못된 키에 대한 401, 부족 크레딧에 대한 402, 속도 제한에 대한 429가 포함됩니다. 속도 제한은 분당 300개 요청 및 키당 8개의 동시 요청입니다. 요청 본문의 크기는 8 MB로 제한됩니다. 오류는 무료이므로 실패한 요청이나 거부에는 요금이 부과되지 않습니다. 크레딧은 만료되지 않으며 구독이 필요하지 않습니다.

API 사양

크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.

항목내용
형식OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작
Base URLhttps://api.ollamaapi.top/v1
인증Authorization: Bearer YOUR_KEY
엔드포인트POST /v1/chat/completions · GET /v1/models
모델 IDuncensored
최대 출력100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음)
JSON 모드response_format: {"type": "json_object"}
파라미터temperature, top_p, stop, seed, presence_penalty, frequency_penalty
함수 호출지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송
스트리밍지원 — SSE, 마지막 청크에 토큰 사용량 포함
컨텍스트 창100,000 토큰 (입력 + 출력)
속도 제한키당 분당 300회
동시 요청키당 동시 8개
응답 헤더X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
요청 크기최대 8 MB
보너스$50 이상 +5%, $100 이상 +10%
유효기간유료 크레딧은 만료되지 않으며 구독 없음
과금선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료
무료 체험$0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용
가격입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00
충전USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액
로그인Google 또는 이메일과 비밀번호
키계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효
콘텐츠성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부

오류 코드

오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.

코드유형의미
400bad_request잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과
401missing_key · invalid_key · key_revoked키 없음·잘못됨·새 키로 교체됨
402no_credit잔액 없음 — 충전하면 즉시 재개
403content_blocked미성년자 관련 성적 콘텐츠 — 거부, 과금 없음
404not_found알 수 없는 엔드포인트
413request_too_large본문 8 MB 초과
429rate_limited · concurrency분당 300회 또는 동시 8개 초과 — 잠시 후 재시도
503upstream_busy모델 혼잡 — 몇 초 후 재시도

질문과 답변

이 API는 함수 호출을 지원하나요?

네, API는 <code>tools</code> 및 <code>tool_choice</code> 매개변수를 통해 함수 호출을 지원합니다. 요청에 도구를 정의하면 모델이 도구 사용에 대한 구조화된 JSON을 반환합니다. 이 기능은 모든 표준 OpenAI 호환 클라이언트에서 작동합니다.

컨텍스트 창을 초과하면 어떻게 되나요?

총 토큰 수(프롬프트 + 완성)가 100,000을 초과하면 요청이 오류로 실패합니다. 이 오류는 무료이므로 시도 시 요금이 부과되지 않습니다. <code>max_tokens</code> 매개변수를 조정하거나 프롬프트를 줄여 제한 내에 머무르세요.

체험 크레딧은 재사용 가능한가요?

아니요, $0.50 체험 크레딧은 7일 동안 유효하며 계정당 한 번만 사용할 수 있습니다. 사용 후 만료되지는 않지만, 사용하지 않으면 7일 후 소멸됩니다. 체험을 받기 위해 신용카드가 필요하지 않습니다.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것으로 끝입니다.

API 키 받기