快速入門:整合 LLM 代理
僅需更改基礎 URL 即可整合我們的無審查 LLM 代理。即插即用的 OpenAI 相容性,讓現有程式碼無需修改即可運作。
基礎 URL 與驗證
將標準 OpenAI 基礎 URL 替換為我們的端點。驗證透過 Authorization 標頭中的 Bearer token 處理。此方法適用於任何 OpenAI 相容的客戶端程式庫。你無需更改程式碼邏輯,只需修改設定值。我們的 API 模擬標準 OpenAI 介面結構,確保你現有的整合程式碼保持有效。這將整合時間從天數縮短至分鐘。你可以隨時從儀表板重新產生金鑰,這會立即使舊金鑰失效。這在無需應用程式中複雜 token 輪換邏輯的情況下提供安全性。
首次請求
發送標準聊天完成請求以測試連線。該端點接受包含模型識別碼和訊息歷史的 JSON 負載。我們的模型識別碼為「uncensored」。此識別碼告訴代理程式將你的請求路由至哪個無審查模型。回應結構複製 OpenAI 格式,包含助理的訊息內容。你可以透過檢查 JSON 輸出中的 content 欄位來驗證回應。這確認你的驗證和負載結構正確。該端點支援標準請求的串流輸出和非串流模式。
curl https://api.llmproxyapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK 整合
使用官方 OpenAI Python 函式庫與我們的 API 互動。將 api_key 設為您的代理金鑰,並將 base_url 設為我們的端點。函式庫的其他行為與標準 OpenAI 用法完全相同。這包括對非同步用戶端、重試機制和標準錯誤處理的支援。您可以傳入通常使用的相同參數,例如 temperature 和 max_tokens。代理會在後端處理路由至無審查模型。這使您能在獲得我們模型能力的同時,維持現有的 Python 程式碼庫。
from openai import OpenAI
client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK 整合
Node.js SDK 透過覆寫基礎 URL 與我們的 API 配合。使用您的代理 API 金鑰和正確的端點初始化用戶端。所有其他方法(如 chat.completions.create)均能正常運作。這包括處理標準回應物件和錯誤類型。您可以使用與 OpenAI 相同的訊息結構和參數。代理確保請求由無審查模型處理。這種相容性讓開發人員可以快速更換供應商,而無需重寫用戶端邏輯。這非常適合已使用 OpenAI SDK 模式的微服務。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
串流回應
透過在請求中將 stream 參數設定為 true 來啟用串流。API 返回伺服器發送事件 (SSE) 串流。每個區塊包含部分 token 更新,允許即時顯示回應。這對於聊天介面和需要立即回饋的應用程式至關重要。串流以包含完整回應中繼資料的最終區塊結束。你可以使用首選語言中的標準 SSE 程式庫來解析區塊。此功能與 OpenAI SDK 無縫運作,SDK 會自動處理解析邏輯。這提供流暢的使用者體驗,無需等待整個回應生成。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
速率限制與約束
我們的 API 對每個金鑰實施每分鐘 300 次請求的限制。若超過此限制,您將收到 429 狀態碼。請針對這些情況實施具有指數退避的重試邏輯。請求主體大小上限為 8 MB。此限制適用於總 JSON 資料,包括提示詞和上下文。定價基於用量:每百萬輸入 token 0.25 美元,每百萬輸出 token 1.00 美元。額度為預付額度且永不過期。若餘額不足,請求將返回 402 錯誤。驗證錯誤返回 401 狀態。沒有複雜的路由或供應商選擇;模型是固定的。
API 技術參數
購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。
| 項目 | 說明 |
|---|---|
| 介面格式 | 相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰 |
| 端點 | POST /v1/chat/completions · GET /v1/models |
| 模型 ID | uncensored |
| 驗證 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmproxyapi.com/v1 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 上下文視窗 | 64,000 tokens(輸入與輸出合計) |
| 取樣參數 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 函式呼叫 | 支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳 |
| 最大輸出 | 不另設輸出上限;提示+回覆共 64,000 個 token 視窗內,max_tokens 可選 |
| 串流輸出 | 支援 SSE,最後一段包含 token 用量 |
| 並行請求 | 每把金鑰同時最多 8 個請求 |
| 速率限制 | 每把金鑰每分鐘 300 次請求 |
| 回應標頭 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 請求大小 | 每次請求不超過 8 MB |
| 儲值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額 |
| 贈送額度 | 滿 $50 送 5%,滿 $100 送 10% |
| 額度效期 | 付費額度永不過期,無訂閱 |
| 價格 | 輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens |
| 計費 | 預付額度,按實際 token 用量扣費;錯誤和拒絕不收費 |
| 免費試用 | $0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300) |
| 內容政策 | 允許成人內容;涉及未成年人的性內容一律拒絕 |
| 登入 | Google 或電子郵件 + 密碼 |
| 金鑰 | 每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效 |
錯誤代碼
錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。
| 狀態碼 | 類型 | 含義 |
|---|---|---|
400 | bad_request | JSON 無效、訊息為空、參數錯誤或超出上下文視窗 |
401 | missing_key · invalid_key · key_revoked | 缺少金鑰、金鑰錯誤或已被新金鑰取代 |
402 | no_credit | 餘額不足——儲值後立即恢復 |
403 | content_blocked | 涉及未成年人的性內容——拒絕且不計費 |
404 | not_found | 未知端點 |
413 | request_too_large | 請求內容超過 8 MB |
429 | rate_limited · concurrency | 超過每分鐘 300 次或 8 個並行——稍後重試 |
503 | upstream_busy | 模型忙碌——幾秒後重試 |
問答
你們提供嵌入或影像生成嗎?
不提供。我們的 API 僅限文字聊天補全。若需嵌入,須使用獨立服務或模型。我們專注於無審查模型的高效能文字推論。
這是官方的 OpenAI 服務嗎?
否,我們是獨立服務。我們與 OpenAI API 格式相容,但託管自己的無審查模型。這不是 GPT-4、GPT-3.5 或任何其他 OpenAI 模型。您可以使用相同的 SDK,但底層模型不同。
如果我超出額度會發生什麼事?
請求將返回 402 Payment Required 錯誤。您可以隨時使用加密貨幣(USDT 或 USDC)為帳戶儲值。額度永不過期,因此您可以隨時存入資金。沒有月費,僅按用量付費。
只差一張表單,即可取得金鑰
建立帳戶、複製金鑰、更改基礎 URL。這就是整個設定。