VI ▾

Proxy LLM không kiểm duyệt thay thế trực tiếphttps://api.llmproxyapi.com/v1

Bắt đầu nhanh: Tích hợp LLM Proxy

Tích hợp proxy LLM không kiểm duyệt của chúng tôi bằng cách thay đổi một URL cơ sở duy nhất. Tương thích trực tiếp với OpenAI có nghĩa là mã hiện tại của bạn hoạt động mà không cần sửa đổi.

URL cơ sở & Xác thực

Thay thế URL cơ sở OpenAI tiêu chuẩn bằng endpoint của chúng tôi. Xác thực được xử lý qua token Bearer trong tiêu đề Authorization. Cách tiếp cận này hoạt động với bất kỳ thư viện khách hàng tương thích OpenAI nào. Bạn không cần thay đổi logic mã của mình, chỉ cần thay đổi các giá trị cấu hình. API của chúng tôi mô phỏng cấu trúc giao diện OpenAI tiêu chuẩn, đảm bảo mã tích hợp hiện tại của bạn vẫn hợp lệ. Điều này giảm thời gian tích hợp xuống còn vài phút thay vì vài ngày. Bạn có thể tạo lại khóa bất cứ lúc nào từ bảng điều khiển, điều này ngay lập tức vô hiệu hóa khóa cũ. Điều này cung cấp bảo mật mà không yêu cầu logic xoay token phức tạp trong ứng dụng của bạn.

Yêu cầu đầu tiên

Gửi yêu cầu hoàn thành hội thoại tiêu chuẩn để kiểm tra kết nối. Endpoint chấp nhận tải trọng JSON với định danh mô hình và lịch sử tin nhắn. ID mô hình của chúng tôi là "uncensored". Định danh này cho proxy biết mô hình không kiểm duyệt nào sẽ định tuyến yêu cầu của bạn đến. Cấu trúc phản hồi giống với định dạng OpenAI, chứa nội dung tin nhắn của trợ lý. Bạn có thể xác minh phản hồi bằng cách kiểm tra trường content trong đầu ra JSON. Điều này xác nhận xác thực và cấu trúc tải trọng của bạn là chính xác. Endpoint hỗ trợ cả chế độ truyền phát và không truyền phát cho các yêu cầu tiêu chuẩn.

curl https://api.llmproxyapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Tích hợp SDK Python

Sử dụng thư viện Python chính thức của OpenAI để tương tác với API của chúng tôi. Đặt api_key thành khóa proxy của bạn và base_url thành endpoint của chúng tôi. Hành vi còn lại của thư viện vẫn giống hệt với cách sử dụng OpenAI tiêu chuẩn. Điều này bao gồm hỗ trợ cho client bất đồng bộ, cơ chế thử lại và xử lý lỗi tiêu chuẩn. Bạn có thể truyền cùng các tham số bạn thường dùng, chẳng hạn như temperature và max tokens. Proxy xử lý việc định tuyến đến mô hình không kiểm duyệt ở hậu trường. Điều này cho phép bạn duy trì cơ sở mã Python hiện có trong khi truy cập vào các khả năng của mô hình chúng tôi.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Tích hợp SDK Node.js

SDK Node.js hoạt động với API của chúng tôi bằng cách ghi đè URL cơ sở. Khởi tạo client với khóa API proxy của bạn và endpoint chính xác. Tất cả các phương thức khác, chẳng hạn như chat.completions.create, hoạt động như mong đợi. Điều này bao gồm xử lý các đối tượng phản hồi và loại lỗi tiêu chuẩn. Bạn có thể sử dụng cùng các cấu trúc tin nhắn và tham số như khi dùng với OpenAI. Proxy đảm bảo yêu cầu được xử lý bởi mô hình không kiểm duyệt. Tính tương thích này cho phép các nhà phát triển chuyển đổi nhà cung cấp nhanh chóng mà không cần viết lại logic client. Nó lý tưởng cho các microservice đã sử dụng mẫu SDK OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát

Bật truyền phát (streaming) bằng cách đặt tham số stream thành true trong yêu cầu của bạn. API trả về luồng Sự kiện gửi bởi máy chủ (SSE). Mỗi chunk chứa các cập nhật token từng phần, cho phép hiển thị phản hồi theo thời gian thực. Điều này rất quan trọng cho các giao diện trò chuyện và các ứng dụng yêu cầu phản hồi ngay lập tức. Luồng kết thúc bằng một chunk cuối cùng chứa siêu dữ liệu phản hồi đầy đủ. Bạn có thể phân tích các chunk bằng các thư viện SSE tiêu chuẩn trong ngôn ngữ bạn chọn. Tính năng này hoạt động liền mạch với các SDK OpenAI, những thứ xử lý logic phân tích cú pháp một cách tự động. Nó mang lại trải nghiệm người dùng mượt mà mà không cần chờ toàn bộ phản hồi được tạo ra.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Giới hạn tốc độ & Ràng buộc

API của chúng tôi áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được mã trạng thái 429. Đảm bảo bạn triển khai logic thử lại với độ trễ tăng dần theo cấp số nhân cho những trường hợp này. Kích thước thân yêu cầu được giới hạn ở 8 MB. Ràng buộc này áp dụng cho tổng tải trọng JSON, bao gồm prompt và ngữ cảnh. Giá cả dựa trên mức sử dụng: $0,25 cho mỗi triệu token đầu vào và $1,00 cho mỗi triệu token đầu ra. Tín dụng là tín dụng trả trước và không hết hạn. Nếu số dư của bạn không đủ, yêu cầu sẽ trả về lỗi 402. Lỗi xác thực trả về trạng thái 401. Không có định tuyến phức tạp hay lựa chọn nhà cung cấp; mô hình được cố định.

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
EndpointPOST /v1/chat/completions · GET /v1/models
ID mô hìnhuncensored
Xác thựcAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmproxyapi.com/v1
Chế độ JSONresponse_format: {"type": "json_object"}
Cửa sổ ngữ cảnh64.000 token (đầu vào + đầu ra)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Đầu ra tối đatối đa phần còn lại của cửa sổ 64.000 token; max_tokens tùy chọn (không giới hạn riêng)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Kích thước yêu cầutối đa 8 MB
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Bạn có cung cấp embedding hay tạo ảnh không?

Không, chúng tôi không cung cấp embedding, tạo ảnh, âm thanh hoặc video. API của chúng tôi chỉ dành cho hoàn thành hội thoại văn bản. Nếu bạn cần embedding, bạn phải sử dụng dịch vụ hoặc mô hình riêng. Chúng tôi tập trung vào suy luận văn bản hiệu suất cao với mô hình không kiểm duyệt.

Đây có phải là dịch vụ chính thức của OpenAI không?

Không, chúng tôi là một dịch vụ độc lập. Chúng tôi tương thích với định dạng API của OpenAI, nhưng chúng tôi lưu trữ mô hình không kiểm duyệt của riêng mình. Đây không phải là GPT-4, GPT-3.5 hay bất kỳ mô hình OpenAI nào khác. Bạn có thể sử dụng cùng các SDK, nhưng mô hình nền tảng khác nhau.

Điều gì xảy ra nếu tôi vượt quá tín dụng?

Yêu cầu sẽ trả về lỗi 402 Payment Required. Bạn có thể nạp tiền vào tài khoản bất cứ lúc nào bằng tiền điện tử (USDT hoặc USDC). Tín dụng không bao giờ hết hạn, vì vậy bạn có thể thêm tiền khi thuận tiện. Không có phí đăng ký hàng tháng, chỉ trả theo mức sử dụng.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API