Snelstart: Integreer de LLM-proxy
Integreer onze ongecensureerde LLM-proxy met een enkele wijziging van de base URL. Drop-in OpenAI-compatibiliteit betekent dat je bestaande code zonder aanpassingen werkt.
Base URL & Authenticatie
Vervang je standaard OpenAI base URL door onze endpoint. Authenticatie verloopt via een Bearer token in de Authorization header. Deze aanpak werkt met elke OpenAI-compatible client library. Je hoeft je code logica niet aan te passen, alleen de configuratiewaarden. Onze API imiteert de standaard OpenAI interface structuur, waardoor je bestaande integratiecode geldig blijft. Dit vermindert de integratietijd tot minuten in plaats van dagen. Je kunt je sleutel op elk moment regenereren via je dashboard, waardoor de oude sleutel direct ongeldig wordt. Dit biedt veiligheid zonder dat je complexe token rotation logica in je applicatie nodig hebt.
Eerste Verzoek
Stuur een standaard chat completion verzoek om de connectiviteit te testen. De endpoint accepteert JSON payloads met een model identifier en message history. Onze model ID is "uncensored". Deze identifier vertelt de proxy welk ongecensureerde model je verzoek moet routeren. De response structuur is identiek aan het OpenAI-formaat en bevat de berichtinhoud van de assistant. Je kunt de response verifiëren door het content veld in de JSON output te controleren. Dit bevestigt dat je authenticatie en payload structuur correct zijn. De endpoint ondersteunt zowel streaming als non-streaming modi voor standaard verzoeken.
curl https://api.llmproxyapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK Integratie
Gebruik de officiële OpenAI Python-bibliotheek om met onze API te communiceren. Stel de api_key in op je proxiesleutel en de base_url op ons endpoint. Het gedrag van de bibliotheek blijft identiek aan standaard OpenAI-gebruik. Dit omvat ondersteuning voor asynchrone clients, retries en standaard foutafhandeling. Je kunt dezelfde parameters doorgeven die je normaal gebruikt, zoals temperature en max_tokens. De proxy regelt de routing naar het ongecensureerde model op de achtergrond. Hierdoor behoud je je bestaande Python-codebase terwijl je toegang krijgt tot de mogelijkheden van ons model.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK Integratie
De Node.js SDK werkt met onze API door de basis-URL te overschrijven. Initialiseer de client met je proxy-API-sleutel en het juiste endpoint. Alle andere methoden, zoals chat.completions.create, werken zoals verwacht. Dit omvat het verwerken van standaard responsobjecten en fouttypen. Je kunt dezelfde berichtstructuren en parameters gebruiken als bij OpenAI. De proxy zorgt ervoor dat het verzoek wordt verwerkt door het ongecensureerde model. Deze compatibiliteit stelt ontwikkelaars in staat providers snel te wisselen zonder hun clientlogica te herschrijven. Het is ideaal voor microservices die al het OpenAI SDK-patroon gebruiken.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming Reacties
Schakel streaming in door de parameter stream in je verzoek in te stellen op true. De API retourneert een Server-Sent Events (SSE)-stream. Elke chunk bevat gedeeltelijke tokenupdates, waardoor de respons in realtime kan worden weergegeven. Dit is cruciaal voor chatinterfaces en applicaties die onmiddellijke feedback vereisen. De stream eindigt met een laatste chunk met volledige responsmetadata. Je kunt de chunks parseren met standaard SSE-bibliotheken in je voorkeurstaal. Deze functie werkt naadloos met de OpenAI SDKs, die de parserlogica automatisch afhandelen. Het biedt een vloeiende gebruikerservaring zonder te hoeven wachten tot de volledige respons is gegenereerd.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Rate Limits & Beperkingen
Onze API handhaaft een limiet van 300 verzoeken per minuut per key. Als je dit overschrijdt, ontvang je een 429 status code. Zorg dat je retry logica implementeert met exponential backoff voor deze gevallen. De request body size is beperkt tot 8 MB. Deze beperking geldt voor de totale JSON payload, inclusief prompt en context. Prijzen zijn usage-based: $0,25 per miljoen input tokens en $1,00 per miljoen output tokens. Credits zijn prepaid en vervallen niet. Als je saldo onvoldoende is, retourneren verzoeken een 402 fout. Authenticatie fouten retourneren een 401 status. Er is geen complexe routing of vendor selectie; het model is fixed.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Model-ID | uncensored |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmproxyapi.com/v1 |
| JSON-modus | response_format: {"type": "json_object"} |
| Contextvenster | 64.000 tokens (invoer + uitvoer) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Max. uitvoer | tot de rest van het venster van 64.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Verzoekgrootte | tot 8 MB |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Bieden jullie embeddings of image generatie?
Nee, wij bieden geen embeddings, image, audio of video generatie. Onze API is strikt voor tekst chat-completies. Als je embeddings nodig hebt, moet je een aparte service of model gebruiken. Wij focussen op high-performance text inference met het ongecensureerde model.
Is dit een officiële OpenAI-service?
Nee, wij zijn een onafhankelijke service. Wij zijn compatibel met het OpenAI API-formaat, maar wij hosten ons eigen ongecensureerde model. Het is geen GPT-4, GPT-3.5 of een ander OpenAI-model. Je kunt dezelfde SDK's gebruiken, maar het underlying model verschilt.
Wat gebeurt er als ik mijn tegoed overschrijd?
Verzoeken retourneren een 402 Payment Required-fout. Je kunt je account op elk moment opwaarderen met crypto (USDT of USDC). Credits vervallen nooit, dus je kunt geld toevoegen wanneer het jou uitkomt. Er zijn geen maandelijkse abonnementskosten, alleen pay-as-you-go gebruik.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de key, verander de base URL. Dat is de hele setup.