5 分鐘內完成首次請求
在幾秒鐘內將你現有的 OpenAI 相容客戶端連接到我們的無審查 API。此快速入門涵蓋基礎配置、標準請求、串流輸出以及與「無審查」模型的工具使用。
基礎 URL 與身份驗證
將你的 OpenAI SDK 或任何相容客戶端指向我們的基礎 URL。你不需要特定的函式庫;任何接受標準 API 金鑰的工具都可以在此使用。登入 Google 或電子郵件後,從儀表板取得你的金鑰。金鑰會立即顯示,並且是所有請求所需的唯一憑證。
將基礎 URL 設定為 https://api.ollamaapi.top/v1。對於所有聊天補全,請使用模型 ID uncensored。此模型為開放權重模型,經過調整以減少拒絕回應,並與主要供應商模型不同。它不是 GPT、Claude 或其他任何專有模型。身份驗證完全依賴於 Bearer token 標頭。
首次請求
發送標準的聊天完成請求以測試連線。端點接受包含 messages、model 以及 temperature 或 max_tokens 等選用參數的 JSON 載入。模型 ID 始終為 uncensored。回應會回傳結構化的 JSON,包含助理的內容與 token 使用量指標。
如果請求成功,你會收到 200 OK 回應。如果身份驗證失敗,你會收到 401 錯誤。如果資金不足,你會收到 402 錯誤。這些錯誤是免費的,因此你只需為成功的 token 使用付費。使用此範例在將配置整合到應用程式之前驗證你的設定。
curl https://api.ollamaapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
使用官方的 OpenAI Python 函式庫或任何相容客戶端。使用你的基礎 URL 和 API 金鑰初始化客戶端。將模型設定為 uncensored。將你的訊息作為包含 role 和 content 的字典列表傳遞。函式庫會自動處理序列化和回應解析。
透過 stream 參數支援串流回應。這允許你在生成 token 時處理它們,這對於長輸出或即時 UI 更新很有用。最後一個區塊包含用於計費的總 token 使用量。確保優雅地處理異常,因為網路錯誤不會產生費用。
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
安裝 openai npm 套件或使用任何基於 fetch 的封裝。使用基礎 URL https://api.ollamaapi.top/v1 和你的 API 金鑰配置客戶端。模型 ID 仍為 uncensored。傳遞包含 messages 以及如 top_p 或 seed 等可選設定的請求主體。
Node.js 使用者可利用 async/await 模式撰寫簡潔的程式碼。回應物件包含 choices、usage 和 id。你可以從第一個候選項目中提取助理的訊息。錯誤處理應考慮速率限制(429)和額度不足(402)。這些錯誤不會消耗 token,因此你的預付額度在產生成功回應之前將保持不變。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
串流回應
在請求中設定 stream: true 以啟用串流。API 返回伺服器發送的事件 (SSE) 串流。每個區塊包含部分內容,允許你在生成 token 時顯示它們。這降低了使用者的感知延遲,並改善了長篇文字生成的體驗。
串流輸出的最後一個區塊包含完整的 token 使用資料。你可以用此來即時追蹤用量。請注意,串流輸出不會改變計費模式;你仍然按照每 1M 個輸入與輸出 token 計費。串流過程中的錯誤也免費。如果連線中斷,你可以恢復或重新發起請求,不會受到懲罰。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
限制、錯誤與上下文
上下文視窗總共為 100,000 個 token,包括提示詞和補全。每次請求的最大輸出為 32,000 個 token(如果未設定 max_tokens,則為 2,048)。如果你超出上下文視窗,請求將失敗。錯誤包括無效金鑰的 401、額度不足的 402 和速率限制的 429。速率限制為每分鐘 300 次請求和每個金鑰 8 個並行請求。請求主體限制為 8 MB。錯誤是免費的,意味著你不會為失敗的請求或拒絕付費。額度永不過期,且不需要訂閱。
API 技術參數
購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。
| 項目 | 說明 |
|---|---|
| 介面格式 | 相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰 |
| Base URL | https://api.ollamaapi.top/v1 |
| 驗證 | Authorization: Bearer YOUR_KEY |
| 端點 | POST /v1/chat/completions · GET /v1/models |
| 模型 ID | uncensored |
| 最大輸出 | 不另設輸出上限;提示+回覆共 100,000 個 token 視窗內,max_tokens 可選 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 取樣參數 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 函式呼叫 | 支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳 |
| 串流輸出 | 支援 SSE,最後一段包含 token 用量 |
| 上下文視窗 | 100,000 tokens(輸入與輸出合計) |
| 速率限制 | 每把金鑰每分鐘 300 次請求 |
| 並行請求 | 每把金鑰同時最多 8 個請求 |
| 回應標頭 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 請求大小 | 每次請求不超過 8 MB |
| 贈送額度 | 滿 $50 送 5%,滿 $100 送 10% |
| 額度效期 | 付費額度永不過期,無訂閱 |
| 計費 | 預付額度,按實際 token 用量扣費;錯誤和拒絕不收費 |
| 免費試用 | $0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300) |
| 價格 | 輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens |
| 儲值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額 |
| 登入 | Google 或電子郵件 + 密碼 |
| 金鑰 | 每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效 |
| 內容政策 | 允許成人內容;涉及未成年人的性內容一律拒絕 |
錯誤代碼
錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。
| 狀態碼 | 類型 | 含義 |
|---|---|---|
400 | bad_request | JSON 無效、訊息為空、參數錯誤或超出上下文視窗 |
401 | missing_key · invalid_key · key_revoked | 缺少金鑰、金鑰錯誤或已被新金鑰取代 |
402 | no_credit | 餘額不足——儲值後立即恢復 |
403 | content_blocked | 涉及未成年人的性內容——拒絕且不計費 |
404 | not_found | 未知端點 |
413 | request_too_large | 請求內容超過 8 MB |
429 | rate_limited · concurrency | 超過每分鐘 300 次或 8 個並行——稍後重試 |
503 | upstream_busy | 模型忙碌——幾秒後重試 |
問答
此 API 是否支援函式呼叫?
是的,API 透過 <code>tools</code> 和 <code>tool_choice</code> 參數支援函式呼叫。你可以在請求中定義工具,模型將返回用於工具使用的結構化 JSON。此功能適用於所有標準的 OpenAI 相容客戶端。
如果我超出上下文視窗會發生什麼事?
如果總 token 數(提示詞 + 補全)超過 100,000,請求將因錯誤而失敗。此錯誤免費,因此你不會為此嘗試付費。你可以調整 <code>max_tokens</code> 參數或縮短提示詞以保持在限制範圍內。
試用額度可以重複使用嗎?
不行,$0.50 的免費試用額度有效期為 7 天,每個帳戶只能使用一次。使用後不會過期,但如果未使用,7 天後將失效。領取試用無需信用卡。