クイックスタート:LLMプロキシの統合
ベースURLの変更だけで無検閲LLMプロキシを統合できます。OpenAIとのドロップイン互換性により、既存コードを変更せずに動作します。
ベースURLと認証
標準的なOpenAIのベースURLを当社のエンドポイントに置き換えてください。認証は、AuthorizationヘッダーにBearerトークンを設定することで処理されます。この方法は、OpenAI互換のクライアントライブラリであればすべて対応しています。コードロジックを変更する必要はなく、設定値のみを変更してください。当社のAPIは標準的なOpenAIのインターフェース構造を模倣しているため、既存の統合コードの有効性を維持できます。これにより、統合に要する時間を数日ではなく数分に短縮できます。キーはダッシュボードからいつでも再生成でき、古いキーは直ちに無効になります。これにより、アプリケーション内で複雑なトークンローテーションロジックを実装することなくセキュリティを確保できます。
最初のリクエスト
接続性をテストするために標準のチャット完了リクエストを送信してください。エンドポイントはモデル識別子とメッセージ履歴を含むJSONペイロードを受け入れます。当社のモデルIDは「uncensored」です。この識別子は、プロキシにリクエストをルーティングする無検閲モデルを指定します。レスポンス構造はOpenAI形式を反映しており、アシスタントのメッセージ内容を含みます。JSON出力のcontentフィールドを確認することでレスポンスを検証できます。これにより、認証とペイロード構造が正しいことが確認できます。エンドポイントは標準リクエストのストリーミングモードと非ストリーミングモードの両方をサポートしています。
curl https://api.llmproxyapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK統合
公式のOpenAI Pythonライブラリを使用して当社のAPIと連携します。api_keyにプロキシキーを設定し、base_urlを当社のエンドポイントに設定してください。ライブラリの残りの動作は標準的なOpenAIの使用法と同じです。これには非同期クライアント、リトライ、標準的なエラーハンドリングのサポートが含まれます。通常使用するのと同じパラメータ(temperatureやmax_tokensなど)を渡すことができます。プロキシはバックグラウンドで無検閲モデルへのルーティングを処理します。これにより、既存のPythonコードベースを維持したまま、当社のモデルの機能にアクセスできます。
from openai import OpenAI
client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK統合
Node.js SDKはベースURLの上書きでAPIを利用します。プロキシAPIキーと正しいエンドポイントでクライアントを初期化します。chat.completions.createなど他のメソッドも期待通りに動作します。標準レスポンスオブジェクトやエラータイプの処理も含まれます。OpenAIと同じメッセージ構造とパラメータが使用可能です。プロキシはリクエストが無検閲モデルで処理されることを保証します。この互換性により、クライアントロジックを書き換えずにプロバイダを素早く切り替えられます。OpenAI SDKパターンを既に使用しているマイクロサービスに最適です。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
ストリーミングレスポンス
リクエストでstreamパラメータをtrueに設定してストリーミングを有効化します。APIはServer-Sent Events (SSE)ストリームを返します。各チャンクには部分的なトークン更新が含まれ、レスポンスのリアルタイム表示を可能にします。これはチャットインターフェースや即時フィードバックが必要なアプリケーションに不可欠です。ストリームは最終チャンクで終了し、完全なレスポンスメタデータを含みます。お好みの言語の標準SSEライブラリでチャンクを解析できます。この機能はOpenAI SDKとシームレスに連携し、SDKが解析ロジックを自動処理します。完全なレスポンス生成を待たずに滑らかなユーザー体験を提供します。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
レート制限と制約
当社のAPIはキーあたり1分あたり300リクエストの制限を適用します。これを超えると、429ステータスコードが返されます。これらのケースには指数バックオフ付きのリトライロジックを実装してください。リクエストボディのサイズは8 MBに制限されています。この制約はプロンプトとコンテキストを含む合計JSONペイロードに適用されます。料金は従量課金制で、入力トークン100万トークンあたり$0.25、出力トークン100万トークンあたり$1.00です。クレジットは前払いで期限切れになりません。残高が不足している場合、リクエストは402エラーを返します。認証エラーは401ステータスを返します。複雑なルーティングやベンダー選択はなく、モデルは固定です。
API 仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| モデル ID | uncensored |
| 認証 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmproxyapi.com/v1 |
| JSON モード | response_format: {"type": "json_object"} |
| コンテキスト長 | 64,000 トークン(入力+出力) |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| 最大出力 | 64,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レート制限 | キーごとに毎分 300 リクエスト |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| リクエストサイズ | 最大 8 MB |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| ログイン | Google またはメール+パスワード |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
埋め込みや画像生成は提供していますか?
いいえ、埋め込み、画像、音声、動画の生成は提供していません。当APIはテキストチャット完了に限定されています。埋め込みが必要な場合は、別のサービスやモデルを使用してください。当社は無検閲モデルによる高性能テキスト推論に注力しています。
これは公式のOpenAIサービスですか?
いいえ、当社は独立したサービスです。OpenAI API形式と互換性がありますが、独自の無検閲モデルをホストしています。GPT-4、GPT-3.5、またはその他のOpenAIモデルではありません。同じSDKを使用できますが、基盤となるモデルは異なります。
クレジットを使い果たした場合どうなりますか?
リクエストは402 Payment Requiredエラーを返します。アカウントはいつでも暗号通貨(USDTまたはUSDC)でチャージできます。クレジットは期限切れにならないため、都合の良い時に資金を追加できます。月額サブスクリプション料はなく、従量課金の利用料のみです。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベースURLを変更します。セットアップはこれだけです。