KO ▾

무검열 LLM 프록시https://api.llmproxyapi.com/v1

시작: LLM 프록시 통합

기본 URL 변경 하나로 무검열 LLM 프록시를 통합하세요. OpenAI 호환성 덕분에 기존 코드를 수정하지 않고도 작동합니다.

기본 URL 및 인증

표준 OpenAI 기본 URL을 당사 엔드포인트로 교체하세요. 인증은 Authorization 헤더의 Bearer 토큰으로 처리됩니다. 이 방식은 모든 OpenAI 호환 클라이언트 라이브러리에서 작동합니다. 코드 로직을 변경할 필요 없이 구성 값만 변경하면 됩니다. 당사 API는 표준 OpenAI 인터페이스 구조를 모방하여 기존 통합 코드가 유효하도록 보장합니다. 이를 통해 통합 시간을 일에서 분으로 줄일 수 있습니다. 대시보드에서 키를 언제든지 재생성할 수 있으며, 이는 이전 키를 즉시 무효화합니다. 이를 통해 애플리케이션에 복잡한 토큰 회전 로직 없이 보안을 제공합니다.

첫 번째 요청

연결성을 테스트하기 위해 표준 채팅 완료 요청을 보내세요. 엔드포인트는 모델 식별자와 메시지 기록이 포함된 JSON 페이로드를 허용합니다. 당사 모델 ID는 "uncensored"입니다. 이 식별자는 프록시가 요청을 무검열 모델로 라우팅하도록 지시합니다. 응답 구조는 OpenAI 형식을 따르며 어시스턴트의 메시지 내용을 포함합니다. JSON 출력의 content 필드를 확인하여 응답을 검증할 수 있습니다. 이는 인증과 페이로드 구조가 올바르다는 것을 확인합니다. 엔드포인트는 표준 요청에 스트리밍 및 비스트리밍 모드를 모두 지원합니다.

curl https://api.llmproxyapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK 통합

공식 OpenAI Python 라이브러리를 사용하여 API와 상호 작용하세요. api_key를 프록시 키로 설정하고 base_url을 엔드포인트로 설정하세요. 라이브러리의 나머지 동작은 표준 OpenAI 사용 방식과 동일하게 유지됩니다. 여기에는 비동기 클라이언트, 재시도 및 표준 오류 처리가 포함됩니다. temperature 및 max tokens와 같이 일반적으로 사용하는 동일한 매개변수를 전달할 수 있습니다. 프록시는 백그라운드에서 무검열 모델로 라우팅을 처리합니다. 이를 통해 기존 Python 코드베이스를 유지하면서도 모델의 기능에 접근할 수 있습니다.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK 통합

Node.js SDK는 기본 URL을 재정의하여 API와 함께 작동합니다. 프록시 API 키와 올바른 엔드포인트를 사용하여 클라이언트를 초기화하세요. chat.completions.create와 같은 모든 다른 메서드는 예상대로 작동합니다. 여기에는 표준 응답 객체 및 오류 유형 처리가 포함됩니다. OpenAI와 동일한 메시지 구조 및 매개변수를 사용할 수 있습니다. 프록시는 요청이 무검열 모델에 의해 처리되도록 보장합니다. 이 호환성으로 인해 개발자는 클라이언트 로직을 다시 작성하지 않고도 공급자를 빠르게 전환할 수 있습니다. 이미 OpenAI SDK 패턴을 사용하는 마이크로서비스에 이상적입니다.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

스트리밍 응답

요청에서 stream 매개변수를 true로 설정하여 스트리밍을 활성화하세요. API는 서버 전송 이벤트(SSE) 스트림을 반환합니다. 각 청크에는 부분 토큰 업데이트가 포함되어 실시간 응답 표시가 가능합니다. 이는 채팅 인터페이스와 즉각적인 피드백이 필요한 애플리케이션에 중요합니다. 스트림은 전체 응답 메타데이터를 포함하는 마지막 청크로 종료됩니다. 선호하는 언어의 표준 SSE 라이브러리를 사용하여 청크를 구문 분석할 수 있습니다. 이 기능은 구문 분석 로직을 자동으로 처리하는 OpenAI SDK와 원활하게 작동합니다. 전체 응답이 생성될 때까지 기다리지 않고도 매끄러운 사용자 경험을 제공합니다.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

속도 제한 및 제약 사항

당사 API는 키당 분당 300개의 요청 제한을 시행합니다. 이를 초과하면 429 상태 코드가 반환됩니다. 이러한 경우 지수 백오프 재시도 로직을 구현하세요. 요청 본문 크기는 8 MB로 제한됩니다. 이 제약은 프롬프트와 컨텍스트를 포함한 전체 JSON 페이로드에 적용됩니다. 가격은 사용량 기반입니다: 입력 토큰 백만 개당 $0.25, 출력 토큰 백만 개당 $1.00. 크레딧은 선불이며 만료되지 않습니다. 잔액이 부족하면 요청 시 402 오류가 반환됩니다. 인증 오류는 401 상태를 반환합니다. 복잡한 라우팅이나 벤더 선택이 없으며 모델은 고정되어 있습니다.

API 사양

크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.

항목내용
형식OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작
엔드포인트POST /v1/chat/completions · GET /v1/models
모델 IDuncensored
인증Authorization: Bearer YOUR_KEY
Base URLhttps://api.llmproxyapi.com/v1
JSON 모드response_format: {"type": "json_object"}
컨텍스트 창64,000 토큰 (입력 + 출력)
파라미터temperature, top_p, stop, seed, presence_penalty, frequency_penalty
함수 호출지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송
최대 출력64,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음)
스트리밍지원 — SSE, 마지막 청크에 토큰 사용량 포함
동시 요청키당 동시 8개
속도 제한키당 분당 300회
응답 헤더X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
요청 크기최대 8 MB
충전USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액
보너스$50 이상 +5%, $100 이상 +10%
유효기간유료 크레딧은 만료되지 않으며 구독 없음
가격입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00
과금선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료
무료 체험$0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용
콘텐츠성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부
로그인Google 또는 이메일과 비밀번호
키계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효

오류 코드

오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.

코드유형의미
400bad_request잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과
401missing_key · invalid_key · key_revoked키 없음·잘못됨·새 키로 교체됨
402no_credit잔액 없음 — 충전하면 즉시 재개
403content_blocked미성년자 관련 성적 콘텐츠 — 거부, 과금 없음
404not_found알 수 없는 엔드포인트
413request_too_large본문 8 MB 초과
429rate_limited · concurrency분당 300회 또는 동시 8개 초과 — 잠시 후 재시도
503upstream_busy모델 혼잡 — 몇 초 후 재시도

질문과 답변

임베딩이나 이미지 생성을 제공하나요?

아니요, 임베딩, 이미지, 오디오, 비디오 생성을 제공하지 않습니다. 당사 API는 텍스트 채팅 전용입니다. 임베딩이 필요하면 별도 서비스나 모델을 사용해야 합니다. 우리는 무검열 모델을 사용한 고성능 텍스트 추론에 집중합니다.

이것이 공식 OpenAI 서비스인가요?

아니요, 당사는 독립적인 서비스입니다. OpenAI API 형식과 호환되지만 자체 무검열 모델을 호스팅합니다. GPT-4, GPT-3.5 또는 기타 OpenAI 모델이 아닙니다. 동일한 SDK를 사용할 수 있지만, underlying 모델은 다릅니다.

크레딧을 초과하면 어떻게 되나요?

요청 시 402 Payment Required 오류가 반환됩니다. 암호화폐(USDT 또는 USDC)로 언제든 계정을 충전할 수 있습니다. 크레딧은 만료되지 않으므로 편리할 때 자금을 추가할 수 있습니다. 월 구독료는 없으며, 사용한 만큼만 지불합니다.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것뿐입니다.

API 키 받기