NL ▾

Drop-in ongecensureerd LLM-proxyhttps://api.llmproxyapi.com/v1

Snelstart: Integreer de LLM-proxy

Integreer onze ongecensureerde LLM-proxy met een enkele wijziging van de base URL. Drop-in OpenAI-compatibiliteit betekent dat je bestaande code zonder aanpassingen werkt.

Base URL & Authenticatie

Vervang je standaard OpenAI base URL door onze endpoint. Authenticatie verloopt via een Bearer token in de Authorization header. Deze aanpak werkt met elke OpenAI-compatible client library. Je hoeft je code logica niet aan te passen, alleen de configuratiewaarden. Onze API imiteert de standaard OpenAI interface structuur, waardoor je bestaande integratiecode geldig blijft. Dit vermindert de integratietijd tot minuten in plaats van dagen. Je kunt je sleutel op elk moment regenereren via je dashboard, waardoor de oude sleutel direct ongeldig wordt. Dit biedt veiligheid zonder dat je complexe token rotation logica in je applicatie nodig hebt.

Eerste Verzoek

Stuur een standaard chat completion verzoek om de connectiviteit te testen. De endpoint accepteert JSON payloads met een model identifier en message history. Onze model ID is "uncensored". Deze identifier vertelt de proxy welk ongecensureerde model je verzoek moet routeren. De response structuur is identiek aan het OpenAI-formaat en bevat de berichtinhoud van de assistant. Je kunt de response verifiëren door het content veld in de JSON output te controleren. Dit bevestigt dat je authenticatie en payload structuur correct zijn. De endpoint ondersteunt zowel streaming als non-streaming modi voor standaard verzoeken.

curl https://api.llmproxyapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK Integratie

Gebruik de officiële OpenAI Python-bibliotheek om met onze API te communiceren. Stel de api_key in op je proxiesleutel en de base_url op ons endpoint. Het gedrag van de bibliotheek blijft identiek aan standaard OpenAI-gebruik. Dit omvat ondersteuning voor asynchrone clients, retries en standaard foutafhandeling. Je kunt dezelfde parameters doorgeven die je normaal gebruikt, zoals temperature en max_tokens. De proxy regelt de routing naar het ongecensureerde model op de achtergrond. Hierdoor behoud je je bestaande Python-codebase terwijl je toegang krijgt tot de mogelijkheden van ons model.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK Integratie

De Node.js SDK werkt met onze API door de basis-URL te overschrijven. Initialiseer de client met je proxy-API-sleutel en het juiste endpoint. Alle andere methoden, zoals chat.completions.create, werken zoals verwacht. Dit omvat het verwerken van standaard responsobjecten en fouttypen. Je kunt dezelfde berichtstructuren en parameters gebruiken als bij OpenAI. De proxy zorgt ervoor dat het verzoek wordt verwerkt door het ongecensureerde model. Deze compatibiliteit stelt ontwikkelaars in staat providers snel te wisselen zonder hun clientlogica te herschrijven. Het is ideaal voor microservices die al het OpenAI SDK-patroon gebruiken.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming Reacties

Schakel streaming in door de parameter stream in je verzoek in te stellen op true. De API retourneert een Server-Sent Events (SSE)-stream. Elke chunk bevat gedeeltelijke tokenupdates, waardoor de respons in realtime kan worden weergegeven. Dit is cruciaal voor chatinterfaces en applicaties die onmiddellijke feedback vereisen. De stream eindigt met een laatste chunk met volledige responsmetadata. Je kunt de chunks parseren met standaard SSE-bibliotheken in je voorkeurstaal. Deze functie werkt naadloos met de OpenAI SDKs, die de parserlogica automatisch afhandelen. Het biedt een vloeiende gebruikerservaring zonder te hoeven wachten tot de volledige respons is gegenereerd.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Rate Limits & Beperkingen

Onze API handhaaft een limiet van 300 verzoeken per minuut per key. Als je dit overschrijdt, ontvang je een 429 status code. Zorg dat je retry logica implementeert met exponential backoff voor deze gevallen. De request body size is beperkt tot 8 MB. Deze beperking geldt voor de totale JSON payload, inclusief prompt en context. Prijzen zijn usage-based: $0,25 per miljoen input tokens en $1,00 per miljoen output tokens. Credits zijn prepaid en vervallen niet. Als je saldo onvoldoende is, retourneren verzoeken een 402 fout. Authenticatie fouten retourneren een 401 status. Er is geen complexe routing of vendor selectie; het model is fixed.

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
EndpointsPOST /v1/chat/completions · GET /v1/models
Model-IDuncensored
AuthenticatieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmproxyapi.com/v1
JSON-modusresponse_format: {"type": "json_object"}
Contextvenster64.000 tokens (invoer + uitvoer)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Max. uitvoertot de rest van het venster van 64.000 tokens; max_tokens optioneel (geen aparte limiet)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Bonus+5% vanaf $50, +10% vanaf $100
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Bieden jullie embeddings of image generatie?

Nee, wij bieden geen embeddings, image, audio of video generatie. Onze API is strikt voor tekst chat-completies. Als je embeddings nodig hebt, moet je een aparte service of model gebruiken. Wij focussen op high-performance text inference met het ongecensureerde model.

Is dit een officiële OpenAI-service?

Nee, wij zijn een onafhankelijke service. Wij zijn compatibel met het OpenAI API-formaat, maar wij hosten ons eigen ongecensureerde model. Het is geen GPT-4, GPT-3.5 of een ander OpenAI-model. Je kunt dezelfde SDK's gebruiken, maar het underlying model verschilt.

Wat gebeurt er als ik mijn tegoed overschrijd?

Verzoeken retourneren een 402 Payment Required-fout. Je kunt je account op elk moment opwaarderen met crypto (USDT of USDC). Credits vervallen nooit, dus je kunt geld toevoegen wanneer het jou uitkomt. Er zijn geen maandelijkse abonnementskosten, alleen pay-as-you-go gebruik.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de key, verander de base URL. Dat is de hele setup.

API-sleutel aanvragen