Yêu cầu đầu tiên trong năm phút
Kết nối máy khách tương thích OpenAI hiện có của bạn với API không kiểm duyệt của chúng tôi trong vài giây. Hướng dẫn nhanh này bao gồm cấu hình cơ bản, yêu cầu tiêu chuẩn, truyền phát và sử dụng công cụ với mô hình 'không kiểm duyệt'.
URL cơ bản & Xác thực
Định hướng SDK OpenAI hoặc bất kỳ máy khách tương thích nào tới URL gốc của chúng tôi. Bạn không cần thư viện cụ thể; bất kỳ công cụ nào chấp nhận khóa API tiêu chuẩn đều hoạt động ở đây. Lấy khóa của bạn từ bảng điều khiển sau khi đăng nhập bằng Google hoặc email. Khóa được hiển thị ngay lập tức và là thông tin xác thực duy nhất cần thiết cho mọi yêu cầu.
Đặt URL cơ bản thành https://api.ollamaapi.top/v1. Sử dụng ID mô hình uncensored cho tất cả các hoàn thành trò chuyện. Mô hình này có trọng số mở, được tinh chỉnh để giảm thiểu từ chối và khác biệt với các mô hình của nhà cung cấp lớn. Nó không phải là GPT, Claude hoặc bất kỳ mô hình độc quyền nào khác. Xác thực dựa hoàn toàn vào tiêu đề token Bearer.
Yêu cầu đầu tiên
Gửi yêu cầu hoàn thành trò chuyện tiêu chuẩn để kiểm tra kết nối. Endpoint chấp nhận tải trọng JSON với messages, model và các tham số tùy chọn như temperature hoặc max_tokens. ID mô hình luôn là uncensored. Phản hồi trả về JSON có cấu trúc bao gồm nội dung của trợ lý và số liệu sử dụng token.
Nếu yêu cầu thành công, bạn nhận được phản hồi 200 OK. Nếu xác thực thất bại, bạn nhận được lỗi 401. Nếu bạn thiếu tiền, bạn nhận được lỗi 402. Những lỗi này miễn phí, vì vậy bạn chỉ trả tiền cho việc sử dụng token thành công. Sử dụng mẫu này để xác minh cấu hình của bạn trước khi tích hợp vào ứng dụng của mình.
curl https://api.ollamaapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Sử dụng thư viện Python OpenAI chính thức hoặc bất kỳ máy khách tương thích nào. Khởi tạo máy khách với URL cơ bản và khóa API của bạn. Đặt mô hình thành uncensored. Chuyển tin nhắn của bạn dưới dạng danh sách các từ điển chứa role và content. Thư viện xử lý tự động việc tuần tự hóa và phân tích phản hồi.
Phản hồi truyền phát (streaming) được hỗ trợ qua tham số stream. Điều này cho phép bạn xử lý token khi chúng được tạo, hữu ích cho đầu ra dài hoặc cập nhật giao diện người dùng theo thời gian thực. Chunk cuối cùng chứa tổng số token đã sử dụng để tính phí. Đảm bảo bạn xử lý ngoại lệ một cách tinh tế, vì lỗi mạng không tính phí.
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node.js
Cài đặt gói npm openai hoặc sử dụng bất kỳ trình bao bọc dựa trên fetch nào. Định cấu hình máy khách với URL gốc https://api.ollamaapi.top/v1 và khóa API của bạn. ID mô hình vẫn là uncensored. Truyền thân yêu cầu với messages và các cài đặt tùy chọn như top_p hoặc seed.
Người dùng Node.js có thể tận dụng các mẫu async/await để có mã sạch sẽ. Đối tượng phản hồi bao gồm choices, usage và id. Bạn có thể trích xuất tin nhắn của trợ lý từ lựa chọn đầu tiên. Xử lý lỗi nên tính đến giới hạn tốc độ (429) và thiếu tín dụng (402). Những lỗi này không tiêu thụ token, vì vậy số dư trả trước của bạn vẫn nguyên vẹn cho đến khi tạo ra phản hồi thành công.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Phản hồi truyền phát
Bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về luồng Sự kiện do máy chủ gửi (SSE). Mỗi chunk chứa nội dung một phần, cho phép bạn hiển thị token khi chúng được tạo. Điều này giảm độ trễ cảm nhận đối với người dùng và cải thiện trải nghiệm cho việc tạo văn bản dài.
Chunk cuối cùng trong luồng bao gồm dữ liệu sử dụng token đầy đủ. Bạn có thể sử dụng điều này để theo dõi mức tiêu thụ theo thời gian thực. Lưu ý rằng truyền phát không thay đổi mô hình giá; bạn vẫn trả tiền trên mỗi 1 triệu token đầu vào và đầu ra. Lỗi trong quá trình truyền phát cũng miễn phí. Nếu kết nối bị ngắt, bạn có thể tiếp tục hoặc khởi động lại yêu cầu mà không bị phạt.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Giới hạn, Lỗi & Ngữ cảnh
Cửa sổ ngữ cảnh là 100.000 token tổng cộng, bao gồm cả prompt và completion. Đầu ra tối đa cho mỗi yêu cầu là 32.000 token (2.048 nếu max_tokens không được đặt). Nếu bạn vượt quá cửa sổ ngữ cảnh, yêu cầu sẽ thất bại. Lỗi bao gồm 401 cho khóa không hợp lệ, 402 cho tín dụng không đủ và 429 cho giới hạn tốc độ. Giới hạn tốc độ là 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời cho mỗi khóa. Thân yêu cầu được giới hạn ở 8 MB. Lỗi miễn phí, nghĩa là bạn không phải trả tiền cho các yêu cầu thất bại hoặc từ chối. Tín dụng không bao giờ hết hạn và không cần đăng ký.
Thông số API
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Base URL | https://api.ollamaapi.top/v1 |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID mô hình | uncensored |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Kích thước yêu cầu | tối đa 8 MB |
| Thưởng | +5% từ $50, +10% từ $100 |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
API này có hỗ trợ gọi hàm không?
Có, API hỗ trợ gọi hàm thông qua các tham số <code>tools</code> và <code>tool_choice</code>. Bạn có thể định nghĩa công cụ trong yêu cầu và mô hình sẽ trả về JSON có cấu trúc cho việc sử dụng công cụ. Tính năng này hoạt động với tất cả các máy khách tương thích OpenAI tiêu chuẩn.
Điều gì xảy ra nếu tôi vượt quá cửa sổ ngữ cảnh?
Nếu tổng số token (prompt + completion) vượt quá 100.000, yêu cầu sẽ thất bại với lỗi. Lỗi này miễn phí, vì vậy bạn không bị tính phí cho lần thử đó. Bạn có thể điều chỉnh tham số <code>max_tokens</code> hoặc rút ngắn prompt của mình để nằm trong giới hạn.
Tín dụng dùng thử có thể tái sử dụng không?
Không, tín dụng dùng thử $0.50 có hiệu lực trong 7 ngày và chỉ được sử dụng một lần cho mỗi tài khoản. Nó không hết hạn sau khi sử dụng, nhưng nếu không dùng, nó sẽ bị mất sau 7 ngày. Không cần thẻ tín dụng để nhận tín dụng dùng thử.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ thiết lập.
Lấy khóa API