DE ▾

Sofort einsetzbarer unzensierter LLM-Proxyhttps://api.llmproxyapi.com/v1

Schnellstart: LLM-Proxy integrieren

Integriere unseren unzensierten LLM-Proxy durch Änderung der Basis-URL. Die sofortige OpenAI-Kompatibilität bedeutet, dass dein bestehender Code ohne Änderungen funktioniert.

Basis-URL & Authentifizierung

Ersetze deine Standard-OpenAI-Basis-URL durch unseren Endpunkt. Die Authentifizierung erfolgt über einen Bearer-Token im Authorization-Header. Dieser Ansatz funktioniert mit jeder OpenAI-kompatiblen Client-Bibliothek. Du musst deine Code-Logik nicht ändern, nur die Konfigurationswerte. Unsere API imitiert die Standard-OpenAI-Schnittstellenstruktur, sodass dein bestehender Integrationscode gültig bleibt. Dies reduziert die Integrationszeit von Tagen auf Minuten. Du kannst deinen Schlüssel jederzeit über dein Dashboard neu generieren, wodurch der alte Schlüssel sofort ungültig wird. Dies bietet Sicherheit, ohne komplexe Token-Rotationslogik in deiner Anwendung zu erfordern.

Erste Anfrage

Sende eine Standard-Chat-Vervollständigungsanfrage, um die Konnektivität zu testen. Der Endpunkt akzeptiert JSON-Payloads mit einer Modellkennung und einem Nachrichtenverlauf. Unsere Modellkennung ist „uncensored“. Diese Kennung teilt dem Proxy mit, welches unzensierte Modell deine Anfrage routen soll. Die Antwortstruktur spiegelt das OpenAI-Format wider und enthält den Inhalt der Assistenten-Nachricht. Du kannst die Antwort überprüfen, indem du das Feld „content“ in der JSON-Ausgabe prüfst. Dies bestätigt, dass deine Authentifizierung und Payload-Struktur korrekt sind. Der Endpunkt unterstützt sowohl Streaming- als auch Nicht-Streaming-Modi für Standardanfragen.

curl https://api.llmproxyapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python-SDK-Integration

Verwende die offizielle OpenAI Python-Bibliothek, um mit unserer API zu interagieren. Setze den api_key auf deinen Proxy-Schlüssel und den base_url auf unseren Endpunkt. Das Verhalten der Bibliothek im Übrigen bleibt identisch zur Standard-Nutzung von OpenAI. Dies umfasst die Unterstützung für asynchrone Clients, Wiederholungsversuche und die Standard-Fehlerbehandlung. Du kannst dieselben Parameter übergeben, die du normalerweise verwenden würdest, wie Temperatur und maximale Token. Der Proxy übernimmt im Hintergrund das Routing zum unzensierten Modell. So kannst du deine bestehende Python-Codebasis beibehalten und gleichzeitig auf die Fähigkeiten unseres Modells zugreifen.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node-SDK-Integration

Das Node.js SDK funktioniert mit unserer API durch Überschreiben der Basis-URL. Initialisiere den Client mit deinem Proxy-API-Schlüssel und dem korrekten Endpunkt. Alle anderen Methoden wie chat.completions.create funktionieren wie erwartet. Dies umfasst Standardantwortobjekte und Fehlertypen. Du kannst dieselben Nachrichtenstrukturen und Parameter wie bei OpenAI verwenden. Der Proxy stellt sicher, dass die Anfrage vom unzensierten Modell verarbeitet wird. Diese Kompatibilität ermöglicht es Entwicklern, Anbieter schnell zu wechseln, ohne Client-Logik neu zu schreiben. Es ist ideal für Microservices, die bereits das OpenAI SDK-Muster nutzen.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-Antworten

Aktiviere Streaming, indem du den Parameter stream in deiner Anfrage auf true setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück. Jeder Chunk enthält partielle Token-Updates, die Echtzeitanzeige der Antwort ermöglichen. Dies ist kritisch für Chat-Schnittstellen und Anwendungen, die sofortiges Feedback benötigen. Der Stream endet mit einem finalen Chunk, der die vollständigen Antwortmetadaten enthält. Du kannst die Chunks mit Standard-SSE-Bibliotheken in deiner bevorzugten Sprache analysieren. Dieses Feature funktioniert nahtlos mit den OpenAI SDKs, die die Parsing-Logik automatisch handhaben. Es bietet eine flüssige Benutzererfahrung, ohne auf die Generierung der gesamten Antwort zu warten.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ratenlimits & Einschränkungen

Unsere API durchsetzt ein Limit von 300 Anfragen pro Minute pro Schlüssel. Wenn du dieses überschreitest, erhältst du einen 429-Statuscode. Stelle sicher, dass du Wiederholungslogik mit exponentiellem Backoff für diese Fälle implementierst. Die Größe des Anfragekörpers ist auf 8 MB begrenzt. Diese Einschränkung gilt für die gesamte JSON-Payload, einschließlich Prompt und Kontext. Die Preise sind nutzungsabhängig: 0,25 $ pro Million Input-Token und 1,00 $ pro Million Output-Token. Guthaben sind Prepaid-Guthaben und verfallen nie. Wenn dein Guthaben nicht ausreicht, geben Anfragen einen 402-Fehler zurück. Authentifizierungsfehler geben einen 401-Status zurück. Es gibt kein komplexes Routing oder eine Anbieterauswahl; das Modell ist fest.

Funktionen und Limits

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
Modell-IDuncensored
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.llmproxyapi.com/v1
JSON-Modusresponse_format: {"type": "json_object"}
Kontextfenster64.000 Tokens (Eingabe + Ausgabe)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Max. Ausgabebis zum Rest des 64.000-Token-Fensters; max_tokens optional (kein separates Limit)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Ratenlimit300 Anfragen pro Minute und Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Anfragegrößebis 8 MB
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Bietet ihr Embeddings oder Bildgenerierung an?

Nein, wir bieten keine Embeddings, Bild-, Audio- oder Videogenerierung an. Unsere API ist ausschließlich für Text-Chat-Vervollständigungen gedacht. Für Embedments musst du einen separaten Dienst oder ein separates Modell nutzen. Wir konzentrieren uns auf hochperformante Text-Inferenz mit dem unzensierten Modell.

Ist dies ein offizieller OpenAI-Dienst?

Nein, wir sind ein unabhängiger Dienst. Wir sind mit dem OpenAI-API-Format kompatibel, hosten aber unser eigenes unzensiertes Modell. Es ist kein GPT-4, GPT-3.5 oder ein anderes OpenAI-Modell. Du kannst dieselben SDKs verwenden, aber das zugrunde liegende Modell ist ein anderes.

Was passiert, wenn ich mein Guthaben überschreite?

Anfragen geben einen 402-Fehler „Payment Required“ zurück. Du kannst dein Konto jederzeit per Krypto (USDT oder USDC) aufladen. Guthaben verfällt nie, sodass du Geld hinzufügen kannst, wenn es dir passt. Es gibt keine monatlichen Abogebühren, nur Pay as you go-Nutzung.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten