Быстрый старт: интеграция LLM-прокси
Интегрируйте наш прокси LLM без цензуры, изменив только базовый URL. Совместимость с OpenAI в формате «готовая замена» означает, что ваш существующий код работает без изменений.
Базовый URL и аутентификация
Замените стандартный базовый URL OpenAI на наш эндпоинт. Аутентификация осуществляется с помощью токена Bearer в заголовке Authorization. Этот подход работает с любой библиотекой клиента, совместимой с OpenAI. Вам не нужно изменять логику кода, только значения конфигурации. Наш API имитирует стандартную структуру интерфейса OpenAI, гарантируя, что ваш существующий код интеграции остается действительным. Это сокращает время интеграции до минут, а не дней. Вы можете сгенерировать заново свой ключ в любое время через панель управления, что немедленно сделает старый ключ недействительным. Это обеспечивает безопасность без необходимости сложной логики ротации токенов в вашем приложении.
Первый запрос
Отправьте стандартный запрос на завершение чата, чтобы проверить подключение. Эндпоинт принимает полезную нагрузку в формате JSON с идентификатором модели и историей сообщений. Идентификатор нашей модели — «uncensored». Этот идентификатор указывает прокси, какую модель без цензуры использовать для маршрутизации вашего запроса. Структура ответа зеркально отражает формат OpenAI, содержа сообщение ассистента. Вы можете проверить ответ, проверив поле content в выводе JSON. Это подтверждает, что ваша аутентификация и структура полезной нагрузки корректны. Эндпоинт поддерживает как потоковую, так и непотоковую передачу для стандартных запросов.
curl https://api.llmproxyapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Интеграция Python SDK
Используйте официальную библиотеку OpenAI для Python для взаимодействия с нашим API. Установите значение api_key в ваш ключ прокси, а значение base_url — в наш эндпоинт. Остальное поведение библиотеки остаётся таким же, как при стандартном использовании OpenAI. Это включает поддержку асинхронных клиентов, повторные попытки и стандартную обработку ошибок. Вы можете передавать те же параметры, которые обычно используете, например, температуру и максимальное количество токенов. Прокси обрабатывает маршрутизацию к модели без цензуры LLM в фоновом режиме. Это позволяет вам сохранять существующую кодовую базу на Python, получая при этом доступ к возможностям нашей модели.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Интеграция Node SDK
SDK для Node.js работает с нашим API путём переопределения базового URL. Инициализируйте клиент, указав ваш прокси-API-ключ и правильный эндпоинт. Все остальные методы, такие как chat.completions.create, работают как ожидается. Это включает обработку стандартных объектов ответов и типов ошибок. Вы можете использовать те же структуры сообщений и параметры, что и при работе с OpenAI. Прокси-сервер гарантирует, что запрос обрабатывается моделью без цензуры. Эта совместимость позволяет разработчикам быстро менять провайдеров без переписывания логики клиента. Это идеально подходит для микросервисов, которые уже используют шаблон SDK OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Потоковая передача ответов
Включите потоковую передачу, установив параметр stream в true в вашем запросе. API возвращает поток Server-Sent Events (SSE). Каждый чанк содержит частичные обновления токенов, что позволяет отображать ответ в реальном времени. Это критически важно для интерфейсов чата и приложений, требующих немедленной обратной связи. Поток завершается финальным чанком, содержащим метаданные полного ответа. Вы можете обрабатывать чанки с помощью стандартных библиотек SSE на вашем предпочтительном языке. Эта функция бесшовно работает с SDK OpenAI, которые автоматически обрабатывают логику разбора. Это обеспечивает плавный пользовательский опыт без ожидания генерации всего ответа.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Лимиты запросов и ограничения
Наш API ограничивает количество запросов до 300 в минуту на ключ. Если вы превысите этот лимит, вы получите код статуса 429. Убедитесь, что вы реализовали логику повторных попыток с экспоненциальной задержкой для таких случаев. Размер тела запроса ограничен 8 МБ. Это ограничение применяется к общему JSON-пэйлоаду, включая промпт и контекст. Тарификация зависит от использования: $0,25 за миллион входных токенов и $1,00 за миллион выходных токенов. Кредиты являются предоплаченными и не сгорают. Если вашего баланса недостаточно, запросы вернут ошибку 402. Ошибки аутентификации возвращают статус 401. Нет сложной маршрутизации или выбора поставщика; модель фиксирована.
Характеристики API
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| ID модели | uncensored |
| Авторизация | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmproxyapi.com/v1 |
| JSON-режим | response_format: {"type": "json_object"} |
| Контекстное окно | 64 000 токенов (вход и ответ вместе) |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Максимум ответа | до остатка окна в 64 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Параллельные запросы | до 8 одновременно на ключ |
| Лимит запросов | 300 запросов в минуту на ключ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Размер запроса | до 8 МБ |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Бонус | +5% от $50, +10% от $100 |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
| Вход | Google или e-mail и пароль |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Предлагаете ли вы эмбеддинги или генерацию изображений?
Нет, мы не предоставляем эмбеддинги, генерацию изображений, аудио или видео. Наш API предназначен исключительно для завершений текстовых чатов. Если вам нужны эмбеддинги, используйте отдельный сервис или модель. Мы специализируемся на высокоскоростном текстовом инференсе с моделью без цензуры.
Это официальный сервис OpenAI?
Нет, мы — независимый сервис. Мы совместимы с форматом API OpenAI, но размещаем собственную модель без цензуры. Это не GPT-4, GPT-3.5 и не любая другая модель OpenAI. Вы можете использовать те же SDK, но лежащая в основе модель отличается.
Что произойдет, если я превышу лимит средств?
Запросы вернут ошибку 402 Payment Required. Вы можете пополнить свой аккаунт в любое время с помощью криптовалюты (USDT или USDC). Баланс не сгорает, поэтому вы можете добавлять средства, когда вам удобно. Нет ежемесячной абонентской платы, только оплата по факту использования.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.