API sans censure prête à l’emploi
LLM API pay as you go sans censure
Modifiez votre URL de base et votre clé API pour accéder à un proxy LLM sans censure haute performance, compatible exactement avec OpenAI. Pas de routage complexe, pas de dépendance à un fournisseur, juste de la génération de texte.
- Un seul modèle sans censure, pas de routage
- Compatibilité exacte avec les SDK OpenAI
- Crédit prépayé, sans abonnements
Essayez avec une seule requête
curl https://api.llmproxyapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llmproxyapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmproxyapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Ce que vous obtenez
Inférence sans censure
Le modèle répond sans refus de contenu pour un usage adulte légal, ce qui le rend idéal pour l’écriture créative, le jeu de rôle et la recherche en sécurité où les modèles standards pourraient se montrer réticents.
Aucun changement de code requis
Utilisez les SDK officiels OpenAI en modifiant simplement le base_url et la clé API. Votre code existant fonctionne immédiatement avec notre endpoint.
Grande fenêtre de contexte
Traitez jusqu’à 100 000 tokens par requête. Gérez de longs documents, des bases de code ou des conversations étendues sans stratégies de fractionnement complexes.
Tarification simple et prépayée
Payez uniquement ce que vous utilisez sans frais mensuels. Les crédits n’expirent jamais, et vous pouvez recharger via crypto (USDT ou USDC) à partir de 10 $.
Streaming et outils
Prend en charge les réponses en streaming via SSE et l’appel de fonctions pour créer des workflows agents ou des interfaces de chat en temps réel.
Limites transparentes
300 requêtes par minute par clé avec une limite de corps de requête de 8 Mo. Une clé par compte, révocable et régénérable à tout moment.
Comment ça marche
Créer un compte
Inscrivez-vous avec une adresse e-mail et un mot de passe pour recevoir immédiatement votre clé API, sans carte bancaire requise pour l’essai.
Configurer le SDK
Mettez à jour le base_url de votre client vers https://api.llmproxyapi.com/v1 et définissez votre nouvelle clé API.
Envoyer des requêtes
Effectuez des requêtes POST vers /v1/chat/completions en utilisant la structure de charge utile standard d’OpenAI.
Ce que les gens créent avec
Écriture créative et jeu de rôle
Générez des histoires, des scénarios ou des dialogues de personnages sans que le modèle ne refuse d’explorer des thèmes matures ou non conventionnels. Idéal pour des expériences narratives immersives.
Recherche en sécurité
Testez les LLM pour les failles de jailbreak ou les injections de prompt en utilisant un modèle qui n’applique pas les filtres de sécurité standards. Analysez le comportement brut du modèle.
Pipelines de génération de contenu
Alimentez de grands documents dans l’API pour la résumation ou l’extraction. La fenêtre de contexte de 100k tokens gère des entrées étendues sans nécessiter de prétraitement complexe.
Workflows agents
Intégrez l’appel de fonctions dans vos scripts d’automatisation. L’API prend en charge les définitions de fonctions, permettant aux agents d’interagir efficacement avec des systèmes externes.
Pourquoi un proxy LLM sans censure ?
Les fournisseurs LLM standards appliquent souvent des filtres de contenu qui bloquent le contenu adulte légal, les sujets de niche ou certains raisonnements. Notre API LLM sans censure sert un seul modèle à poids ouverts, ajusté pour répondre sans ces refus. Il ne s’agit pas de supprimer toute la qualité, mais les barrières arbitraires. Vous bénéficiez d’une inférence cohérente et directe pour la création et la recherche, là où les modèles standards refusent de générer du texte valide.
Le modèle N’EST PAS GPT, Claude, Gemini, Grok ou DeepSeek. C’est un modèle indépendant exécuté sur nos propres serveurs GPU. Nous nous concentrons uniquement sur la génération de texte, garantissant des performances élevées pour les tâches qui comptent le plus pour les développeurs qui ont besoin de sortie brute.
Compatibilité OpenAI prêt à l’emploi
Notre API est conçue pour être un remplacement prêt à l’emploi d’OpenAI. Vous pouvez utiliser les SDK officiels OpenAI pour Python, Node.js et d’autres langages sans réécrire votre logique. La structure de l’endpoint imite l’API chat-completions d’OpenAI, prenant en charge le streaming via Server-Sent Events (SSE) et l’appel de fonctions.
Pour intégrer, modifiez deux variables : base_url vers https://api.llmproxyapi.com/v1 et votre API key. Le reste est identique. Cette simplicité réduit le temps d'intégration de plusieurs heures à quelques minutes, vous permettant de tester l'inférence sans censure immédiatement dans vos pipelines existants.
Performance et fenêtre de contexte
Nous fournissons une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion. Cela vous permet de traiter de grandes bases de code, de longs documents ou des historiques de conversation étendus en une seule requête. Pour la plupart des cas d’usage, cela réduit le besoin de stratégies de fractionnement complexes et préserve la cohérence du contexte.
Notre infrastructure est optimisée pour la vitesse. Vous pouvez envoyer jusqu’à 300 requêtes par minute avec une limite de corps de requête de 8 Mo. Cette capacité est suffisante pour la plupart des applications de production, des interfaces de chat aux jobs de traitement par lots. Si vous avez besoin d’un débit plus élevé ou d’un routage multi-modèles, ce proxy n’est pas adapté ; nous proposons un modèle unique et ciblé.
Tarification simple et prépayée
Nos tarifs sont transparents. Vous payez $0,25 par 1M de tokens en entrée et $1,00 par 1M de tokens en sortie. Pas d’abonnement mensuel, pas de frais cachés. Vous préchargez du crédit qui n'expire jamais. Vous pouvez recharger à partir de 10 $ en crypto (USDT ou USDC).
Nous proposons également des crédits bonus : +5 % sur les dépôts de 50 $ ou plus, et +10 % sur les dépôts de 100 $ ou plus. Les nouveaux comptes reçoivent un crédit d'essai gratuit de 0,50 $ valable 7 jours, sans carte requise. Cela vous permet de tester la qualité et les performances du modèle avant d'engager des fonds.
Questions et réponses
Cette API est-elle identique à celle d’OpenAI ?
Oui, il suit le schéma chat-completions d’OpenAI. Vous pouvez utiliser les SDK officiels OpenAI en modifiant l’URL de base et la clé API. Cependant, le modèle sous-jacent n’est ni GPT-4 ni GPT-3.5 ; il s’agit d’un modèle sans censure indépendant, avec ses propres capacités et limites.
Quel contenu est bloqué ?
Le modèle est sans censure pour le contenu adulte légal, mais nous appliquons une limite stricte : le contenu sexuel impliquant des mineurs est toujours bloqué. Il s’agit du seul filtre de contenu strict appliqué. Tous les autres sujets, y compris les thèmes controversés ou pour adultes, sont généralement autorisés.
Puis-je l’utiliser pour les embeddings ou la génération d’images ?
Non. Notre API prend uniquement en charge la génération de texte via chat-completions. Nous ne proposons pas d’embeddings, de génération d’images, d’audio ou de vidéo. Si vous avez besoin de ces capacités, vous devrez utiliser un autre service ou appeler plusieurs API.
Comment fonctionne le crédit prépayé ?
Vous payez à l’avance. Les crédits sont déduits à mesure que vous utilisez l’API. Les crédits inutilisés n’expirent jamais. Vous pouvez recharger votre solde à tout moment, et nous offrons des bonus pour les dépôts plus importants. Il n’y a pas de frais mensuels ni d’abonnements.
Utilisez-vous mes prompts pour l’entraînement ?
Non. Vos prompts et vos complétions ne sont pas utilisés pour entraîner notre modèle. Nous accordons de l’importance à la confidentialité des développeurs qui envoient des données sensibles ou du contenu propriétaire via l’API. Votre compte ne nécessite qu’une adresse e-mail et un mot de passe.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l’URL de base. C’est toute la configuration.