البدء السريع: دمج وكيل LLM
ادمج LLM proxy بدون رقابة مع تغيير بسيط في عنوان URL الأساسي. توافق Drop-in مع OpenAI يعني أن شيفرتك الحالية تعمل دون تعديل.
عنوان URL الأساسي والمصادقة
استبدل عنوان URL الأساسي القياسي لـ OpenAI بنقطة النهاية الخاصة بنا. تتم المصادقة عبر رمز Bearer في رأس Authorization. يعمل هذا النهج مع أي مكتبة عميل متوافقة مع OpenAI. لا تحتاج إلى تغيير منطق الكود الخاص بك، فقط قيم التكوين. تحاكي واجهة برمجة التطبيقات (API) لدينا هيكل واجهة OpenAI القياسية، مما يضمن بقاء كود التكامل الحالي صالحاً. هذا يقلل وقت التكامل إلى دقائق بدلاً من أيام. يمكنك إعادة إنشاء مفتاح API الخاص بك في أي وقت من لوحة التحكم، مما يلغي صلاحية المفتاح القديم فوراً. يوفر هذا الأمان دون الحاجة إلى منطق معقد لتدوير الرموز في التطبيق الخاص بك.
الطلب الأول
أرسل طلب إكمال محادثة قياسي لاختبار الاتصال. تقبل نقطة النهاية حمولات JSON مع معرف النموذج وسجل الرسائل. معرف النموذج لدينا هو "uncensored". يخبر هذا المعرف الوكيل بنموذج بدون رقابة لتوجيه طلبك إليه. يعكس هيكل الاستجابة تنسيق OpenAI، ويحتوي على محتوى رسالة المساعد. يمكنك التحقق من الاستجابة عن طريق التحقق من حقل content في إخراج JSON. يؤكد هذا أن المصادقة وهيكل الحمولة صحيحان. تدعم نقطة النهاية كل من أوضاع البث المتدفق وغير المتدفق للطلبات القياسية.
curl https://api.llmproxyapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
دمج حزمة SDK لـ Python
استخدم مكتبة Python الرسمية لـ OpenAI للتفاعل مع الـ API الخاص بنا. اضبط api_key ليكون مفتاح الـ proxy الخاص بك، وbase_url ليكون نقطة النهاية الخاصة بنا. يبقى سلوك باقي المكتبة مطابقاً للاستخدام القياسي لـ OpenAI. يشمل ذلك دعم العملاء غير المتزامنين، وإعادة المحاولة، ومعالجة الأخطاء القياسية. يمكنك تمرير نفس المعاملات التي تستخدمها عادةً، مثل temperature وmax tokens. يتولى الـ proxy توجيه الطلبات إلى النموذج بدون رقابة خلف الكواليس. يتيح لك ذلك الحفاظ على شيفرتك الحالية في Python مع الحصول على إمكانيات النموذج الخاص بنا.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
دمج حزمة SDK لـ Node.js
يعمل حزمة Node.js SDK مع الـ API الخاص بنا عن طريق تجاوز عنوان URL الأساسي. قم بتهيئة العميل بمفتاح الـ API الخاص بك ونقطة النهاية الصحيحة. تعمل جميع الطرق الأخرى، مثل chat.completions.create، كما هو متوقع. يشمل ذلك معالجة كائنات الاستجابة القياسية وأنواع الأخطاء. يمكنك استخدام هياكل الرسائل نفسها والمعاملات التي تستخدمها مع OpenAI. يضمن الـ proxy معالجة الطلب بواسطة النموذج بدون رقابة. يتيح هذا التوافق للمطورين تبديل المزودين بسرعة دون إعادة كتابة منطق العميل. إنه مثالي للخدمات المصغرة التي تستخدم بالفعل نمط SDK الخاص بـ OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
الاستجابات المتدفقة
فعّل البث المتدفق عن طريق تعيين المعامل stream إلى true في طلبك. تُرجع الـ API دفق أحداث موجهة للسيرفر (SSE). يحتوي كل جزء على تحديثات جزئية للرموز، مما يتيح العرض الفوري للاستجابة. يعد هذا أمرًا حاسمًا لواجهات الدردشة والتطبيقات التي تتطلب ملاحظات فورية. ينتهي الدفق بجزء نهائي يحتوي على بيانات التعريف الكاملة للاستجابة. يمكنك تحليل الأجزاء باستخدام مكتبات SSE القياسية في لغتك المفضلة. تعمل هذه الميزة بسلاسة مع حزم تطوير البرمجيات (SDKs) الخاصة بـ OpenAI، التي تقوم بمنطق التحليل تلقائيًا. توفر تجربة مستخدم سلسة دون الحاجة للانتظار لتوليد الاستجابة بأكملها.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
حدود المعدل والقيود
تفرض واجهة برمجة التطبيقات (API) الخاصة بنا حداً قدره 300 طلب في الدقيقة لكل مفتاح. إذا تجاوزت هذا الحد، فستحصل على رمز حالة 429. تأكد من تنفيذ منطق إعادة المحاولة مع زيادة عكسية للأسلوب لهذه الحالات. حجم جسم الطلب محدود بـ 8 MB. ينطبق هذا القيد على حمولة JSON الإجمالية، بما في ذلك الموجّه والسياق. التسعير يعتمد على الاستخدام: 0.25 دولار لكل مليون رمز إدخال و1.00 دولار لكل مليون رمز إخراج. الأرصدة مسبقة الدفع ولا تنتهي صلاحيتها أبداً. إذا كان رصيدك غير كافٍ، فستعيد الطلبات خطأ 402. تعيد أخطاء المصادقة رمز حالة 401. لا يوجد توجيه معقد أو اختيار مورد؛ النموذج ثابت.
مواصفات API
كل الحدود والميزات الفعلية للـ API في مكان واحد — راجعها قبل شحن الرصيد.
| البند | القيمة |
|---|---|
| صيغة API | متوافق مع OpenAI: يعمل أي SDK من OpenAI بتغيير base URL والمفتاح فقط |
| نقاط النهاية | POST /v1/chat/completions · GET /v1/models |
| معرّف النموذج | uncensored |
| المصادقة | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmproxyapi.com/v1 |
| وضع JSON | response_format: {"type": "json_object"} |
| نافذة السياق | 64,000 رمز (المدخلات والمخرجات معاً) |
| المعاملات | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| استدعاء الدوال | نعم — tools و tool_choice؛ الرد يتضمن tool_calls حتى أثناء البث؛ تُرسل النتائج كرسالة role: tool |
| أقصى مخرجات | حتى ما تبقى من نافذة 64,000 رمزًا؛ max_tokens اختياري (بلا حد منفصل) |
| البث المتدفق | نعم — server-sent events؛ آخر جزء يتضمن استهلاك الرموز |
| الطلبات المتزامنة | حتى 8 في الوقت نفسه لكل مفتاح |
| حدّ المعدل | 300 طلب في الدقيقة لكل مفتاح |
| ترويسات الرد | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| حجم الطلب | حتى 8 MB |
| شحن الرصيد | USDT (TRC20) أو USDC (Base)، أي مبلغ صحيح من $10 إلى $500 |
| مكافأة | +5% من $50، +10% من $100 |
| الصلاحية | الرصيد المدفوع لا تنتهي صلاحيته، بدون اشتراك |
| السعر | $0.25 لكل مليون رمز مدخلات · $1.00 لكل مليون رمز مخرجات |
| الفوترة | رصيد مسبق الدفع حسب الاستهلاك الفعلي؛ الأخطاء والرفض مجانية |
| رصيد تجريبي مجاني | $0.50 لمدة 7 أيام، بدون بطاقة · مفتاح تجريبي: طلبان متوازيان، 60 طلبًا في الدقيقة؛ الحدود الكاملة (8 و300) بعد أول شحن |
| المحتوى | محتوى البالغين مسموح؛ يُرفض أي محتوى جنسي يتعلق بالقاصرين |
| تسجيل الدخول | Google أو البريد الإلكتروني وكلمة المرور |
| المفاتيح | مفتاح نشط واحد لكل حساب؛ المفتاح الجديد يحل محل القديم |
رموز الأخطاء
تصل الأخطاء بصيغة JSON مع type ثابت؛ الطلبات الفاشلة أو المرفوضة لا تُحتسب.
| الرمز | النوع | المعنى |
|---|---|---|
400 | bad_request | JSON غير صالح أو رسائل فارغة أو معامل خاطئ أو تجاوز نافذة السياق |
401 | missing_key · invalid_key · key_revoked | لا يوجد مفتاح أو المفتاح خاطئ أو تم استبداله |
402 | no_credit | الرصيد فارغ — اشحن وتستأنف الطلبات فوراً |
403 | content_blocked | محتوى جنسي يتعلق بقاصرين — مرفوض دون احتساب |
404 | not_found | نقطة نهاية غير معروفة |
413 | request_too_large | جسم الطلب أكبر من 8 MB |
429 | rate_limited · concurrency | تجاوز 300 في الدقيقة أو 8 متزامنة — انتظر ثم أعد المحاولة |
503 | upstream_busy | النموذج مشغول — أعد المحاولة بعد ثوانٍ |
أسئلة وأجوبة
هل تقدمون توليد التضمينات أو الصور؟
لا، لا نقدم توليد التضمينات أو الصور أو الصوت أو الفيديو. واجهة برمجة التطبيقات (API) مخصصة حصرياً لإكمال محادثات النص. إذا كنت بحاجة إلى التضمينات، فيجب عليك استخدام خدمة أو نموذج منفصل. نحن نركز على استنتاج النص عالي الأداء باستخدام النموذج بدون رقابة.
هل هذه خدمة رسمية من OpenAI؟
لا، نحن خدمة مستقلة. نحن متوافقون مع تنسيق واجهة برمجة التطبيقات (API) الخاصة بـ OpenAI، لكننا نستضيف نموذجنا الخاص بدون رقابة. إنه ليس GPT-4 أو GPT-3.5 أو أي نموذج آخر من OpenAI. يمكنك استخدام نفس حزم SDK، لكن النموذج الأساسي مختلف.
ماذا يحدث إذا تجاوزت الرصيد الخاص بي؟
ستعيد الطلبات خطأ "402 Payment Required". يمكنك شحن رصيد حسابك في أي وقت باستخدام العملات المشفرة (USDT أو USDC). الرصيد المسبق الدفع لا ينتهي صلاحيته أبداً، لذا يمكنك إضافة الأموال عند الراحة. لا توجد رسوم اشتراك شهرية، فقط الدفع حسب الاستخدام.
مفتاحك على بُعد نموذج واحد
أنشئ حساباً، انسخ المفتاح، غيّر عنوان URL الأساسي. هذا هو الإعداد الكامل.