VI ▾

API LLM không kiểm duyệt được lưu trữ

Lấy khóa API
trên 1 triệu token đầu vào
$0.25
Token đầu ra / 1 triệu
$1.00
ngữ cảnh token
100,000

Yêu cầu đầu tiên trong năm phút

Kết nối máy khách tương thích OpenAI hiện có của bạn với API không kiểm duyệt của chúng tôi trong vài giây. Hướng dẫn nhanh này bao gồm cấu hình cơ bản, yêu cầu tiêu chuẩn, truyền phát và sử dụng công cụ với mô hình 'không kiểm duyệt'.

URL cơ bản & Xác thực

Định hướng SDK OpenAI hoặc bất kỳ máy khách tương thích nào tới URL gốc của chúng tôi. Bạn không cần thư viện cụ thể; bất kỳ công cụ nào chấp nhận khóa API tiêu chuẩn đều hoạt động ở đây. Lấy khóa của bạn từ bảng điều khiển sau khi đăng nhập bằng Google hoặc email. Khóa được hiển thị ngay lập tức và là thông tin xác thực duy nhất cần thiết cho mọi yêu cầu.

Đặt URL cơ bản thành https://api.ollamaapi.top/v1. Sử dụng ID mô hình uncensored cho tất cả các hoàn thành trò chuyện. Mô hình này có trọng số mở, được tinh chỉnh để giảm thiểu từ chối và khác biệt với các mô hình của nhà cung cấp lớn. Nó không phải là GPT, Claude hoặc bất kỳ mô hình độc quyền nào khác. Xác thực dựa hoàn toàn vào tiêu đề token Bearer.

Yêu cầu đầu tiên

Gửi yêu cầu hoàn thành trò chuyện tiêu chuẩn để kiểm tra kết nối. Endpoint chấp nhận tải trọng JSON với messages, model và các tham số tùy chọn như temperature hoặc max_tokens. ID mô hình luôn là uncensored. Phản hồi trả về JSON có cấu trúc bao gồm nội dung của trợ lý và số liệu sử dụng token.

Nếu yêu cầu thành công, bạn nhận được phản hồi 200 OK. Nếu xác thực thất bại, bạn nhận được lỗi 401. Nếu bạn thiếu tiền, bạn nhận được lỗi 402. Những lỗi này miễn phí, vì vậy bạn chỉ trả tiền cho việc sử dụng token thành công. Sử dụng mẫu này để xác minh cấu hình của bạn trước khi tích hợp vào ứng dụng của mình.

curl https://api.ollamaapi.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK Python

Sử dụng thư viện Python OpenAI chính thức hoặc bất kỳ máy khách tương thích nào. Khởi tạo máy khách với URL cơ bản và khóa API của bạn. Đặt mô hình thành uncensored. Chuyển tin nhắn của bạn dưới dạng danh sách các từ điển chứa role và content. Thư viện xử lý tự động việc tuần tự hóa và phân tích phản hồi.

Phản hồi truyền phát (streaming) được hỗ trợ qua tham số stream. Điều này cho phép bạn xử lý token khi chúng được tạo, hữu ích cho đầu ra dài hoặc cập nhật giao diện người dùng theo thời gian thực. Chunk cuối cùng chứa tổng số token đã sử dụng để tính phí. Đảm bảo bạn xử lý ngoại lệ một cách tinh tế, vì lỗi mạng không tính phí.

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Node.js

Cài đặt gói npm openai hoặc sử dụng bất kỳ trình bao bọc dựa trên fetch nào. Định cấu hình máy khách với URL gốc https://api.ollamaapi.top/v1 và khóa API của bạn. ID mô hình vẫn là uncensored. Truyền thân yêu cầu với messages và các cài đặt tùy chọn như top_p hoặc seed.

Người dùng Node.js có thể tận dụng các mẫu async/await để có mã sạch sẽ. Đối tượng phản hồi bao gồm choices, usage và id. Bạn có thể trích xuất tin nhắn của trợ lý từ lựa chọn đầu tiên. Xử lý lỗi nên tính đến giới hạn tốc độ (429) và thiếu tín dụng (402). Những lỗi này không tiêu thụ token, vì vậy số dư trả trước của bạn vẫn nguyên vẹn cho đến khi tạo ra phản hồi thành công.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát

Bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về luồng Sự kiện do máy chủ gửi (SSE). Mỗi chunk chứa nội dung một phần, cho phép bạn hiển thị token khi chúng được tạo. Điều này giảm độ trễ cảm nhận đối với người dùng và cải thiện trải nghiệm cho việc tạo văn bản dài.

Chunk cuối cùng trong luồng bao gồm dữ liệu sử dụng token đầy đủ. Bạn có thể sử dụng điều này để theo dõi mức tiêu thụ theo thời gian thực. Lưu ý rằng truyền phát không thay đổi mô hình giá; bạn vẫn trả tiền trên mỗi 1 triệu token đầu vào và đầu ra. Lỗi trong quá trình truyền phát cũng miễn phí. Nếu kết nối bị ngắt, bạn có thể tiếp tục hoặc khởi động lại yêu cầu mà không bị phạt.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Giới hạn, Lỗi & Ngữ cảnh

Cửa sổ ngữ cảnh là 100.000 token tổng cộng, bao gồm cả prompt và completion. Đầu ra tối đa cho mỗi yêu cầu là 32.000 token (2.048 nếu max_tokens không được đặt). Nếu bạn vượt quá cửa sổ ngữ cảnh, yêu cầu sẽ thất bại. Lỗi bao gồm 401 cho khóa không hợp lệ, 402 cho tín dụng không đủ và 429 cho giới hạn tốc độ. Giới hạn tốc độ là 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời cho mỗi khóa. Thân yêu cầu được giới hạn ở 8 MB. Lỗi miễn phí, nghĩa là bạn không phải trả tiền cho các yêu cầu thất bại hoặc từ chối. Tín dụng không bao giờ hết hạn và không cần đăng ký.

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Base URLhttps://api.ollamaapi.top/v1
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
ID mô hìnhuncensored
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Chế độ JSONresponse_format: {"type": "json_object"}
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Kích thước yêu cầutối đa 8 MB
Thưởng+5% từ $50, +10% từ $100
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

API này có hỗ trợ gọi hàm không?

Có, API hỗ trợ gọi hàm thông qua các tham số <code>tools</code> và <code>tool_choice</code>. Bạn có thể định nghĩa công cụ trong yêu cầu và mô hình sẽ trả về JSON có cấu trúc cho việc sử dụng công cụ. Tính năng này hoạt động với tất cả các máy khách tương thích OpenAI tiêu chuẩn.

Điều gì xảy ra nếu tôi vượt quá cửa sổ ngữ cảnh?

Nếu tổng số token (prompt + completion) vượt quá 100.000, yêu cầu sẽ thất bại với lỗi. Lỗi này miễn phí, vì vậy bạn không bị tính phí cho lần thử đó. Bạn có thể điều chỉnh tham số <code>max_tokens</code> hoặc rút ngắn prompt của mình để nằm trong giới hạn.

Tín dụng dùng thử có thể tái sử dụng không?

Không, tín dụng dùng thử $0.50 có hiệu lực trong 7 ngày và chỉ được sử dụng một lần cho mỗi tài khoản. Nó không hết hạn sau khi sử dụng, nhưng nếu không dùng, nó sẽ bị mất sau 7 ngày. Không cần thẻ tín dụng để nhận tín dụng dùng thử.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ thiết lập.

Lấy khóa API