AccueilDocumentation
Guide d'intégration API rapide
Intégrez notre API compatible OpenAI en quelques minutes pour obtenir des réponses directes sans filtre. Ce guide couvre l'authentification, les endpoints principaux, le streaming et la gestion des limites pour vous permettre d'utiliser votre IA sans censure immédiatement.
Authentification et URL de base
Pour utiliser notre API IA, vous avez besoin d'une clé API et de la bonne URL de base. Inscrivez-vous sur la page Obtenir une clé API avec votre e-mail et mot de passe pour obtenir votre clé immédiatement ; aucune carte n'est requise pour l'essai. Utilisez l'URL de base https://api.llmsincensura.com/v1 avec n'importe quel client compatible OpenAI. L'authentification s'effectue en envoyant votre clé dans l'en-tête Authorization: Bearer YOUR_API_KEY. Cette méthode standard garantit que votre LLM sans censure fonctionne avec les outils que vous connaissez déjà.
Le modèle à servir est uncensored. Assurez-vous de le configurer dans vos requêtes. Pas de chemins complexes ; vous envoyez du texte et recevez du texte brut. Si votre application nécessite un endpoint spécifique, c'est le seul dont vous avez besoin pour le chat. La simplicité est la clé d'une intégration rapide et sans friction.
Endpoint /v1/chat/completions
Le cœur de l'API IA sans censure est l'endpoint de complétion de chat. Envoyez une liste de messages (système, utilisateur, assistant) et recevez une réponse complète. Cette approche directe évite les refus de contenu courants sur d'autres modèles pour les sujets adultes ou controversés. La structure JSON est identique à celle d'OpenAI, facilitant le changement si vous venez d'une autre plateforme.
Rappelez-vous que nous ne supportons que cet endpoint pour le texte. Pas d'embeddings ni de génération d'images. Pour commencer, testez une requête simple avec curl pour vérifier que votre clé fonctionne et que la réponse arrive sans filtrage.
curl https://api.llmsincensura.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Intégration avec Python
Les développeurs Python peuvent utiliser la bibliothèque officielle openai en adaptant l'URL de base. Cela permet de profiter de l'écosystème existant d'outils et de SDK. Configurez la clé et le base_url pour pointer vers nos serveurs. Le modèle uncensored traitera votre entrée en maintenant le contexte jusqu'à 100 000 tokens.
Cette configuration est idéale pour les scripts d'automatisation ou les applications backend qui nécessitent des réponses rapides et sans censure. La vitesse de réponse est généralement élevée grâce à l'infrastructure dédiée sur nos propres serveurs GPU.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmsincensura.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration avec Node.js
Dans l'écosystème JavaScript/Node, l'intégration est tout aussi directe. Utilisez le SDK OpenAI et écrasez l'URL de base. Cela permet aux applications web ou serveurs Node de consommer l'IA sans restrictions sans modifier la logique de votre code existant. La gestion des erreurs et des promesses fonctionne exactement comme prévu avec les autres clients OpenAI.
Il est important de rappeler que le modèle n'est ni GPT ni Claude, mais un modèle à poids ouverts ajusté spécifiquement pour ce service. Cela garantit une cohérence du comportement sans filtre. Configurez les variables d'environnement pour sécuriser votre clé en production.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmsincensura.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming avec SSE
Pour améliorer l'expérience utilisateur, activez le streaming en définissant stream: true dans votre requête. Vous recevrez des fragments de texte au fur et à mesure de leur génération, ce qui réduit la latence perçue. C'est crucial pour les applications de chat en temps réel où les utilisateurs s'attendent à voir la réponse lettre par lettre.
Le streaming conserve les mêmes propriétés de non-filtrage que les réponses complètes. Vous pouvez traiter ces fragments côté client ou serveur pour rendre la réponse progressivement. C'est le meilleur moyen de montrer la puissance d'une IA de chat sans censure dans les applications interactives.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites et gestion des erreurs
Votre clé a une limite de 300 requêtes par minute. Si vous dépassez ce seuil, vous recevrez une erreur 429. Il existe également une limite de corps de requête de 8 Mo. Si votre clé est invalide, vous obtiendrez un 401 ; si vous n'avez pas de crédit, un 402. Le contexte maximum est de 100 k tokens combinés (prompt + réponse).
La seule restriction stricte de contenu est l'interdiction du contenu sexuel impliquant des mineurs, qui s'applique toujours. Pour les autres sujets, le modèle est très permissif. Consultez les codes d'erreur standard d'OpenAI pour déboguer votre intégration rapidement.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.llmsincensura.com/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Limite de débit | 300 requêtes par minute et par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions fréquentes
Que se passe-t-il si votre solde est épuisé ?
Si votre solde atteint zéro, vous recevrez une erreur 402 lors de vos requêtes. Vous pouvez recharger à partir de 10 $ avec des cryptomonnaies (USDT ou USDC) et le crédit n'expire jamais. Aucun abonnement mensuel obligatoire.
Puis-je utiliser cette API à des fins commerciales ?
Oui, le modèle est conçu pour un usage général, y compris commercial. Il n'y a pas de restrictions d'utilisation basées sur le secteur, tant que le contenu n'est pas à caractère sexuel impliquant des mineurs. Votre confidentialité est protégée et nous n'utilisons pas vos prompts pour entraîner d'autres modèles.
Comment régénérer ma clé API ?
Vous pouvez régénérer votre clé à tout moment depuis votre tableau de bord. La génération d'une nouvelle clé invalide immédiatement l'ancienne. Cela est utile si vous pensez que votre clé a été compromise ou si vous avez besoin de clés distinctes pour les environnements de développement et de production.
Votre clé est à portée de main
Créez un compte, copiez la clé et modifiez l'URL de base. C'est aussi simple que ça.
Obtenir une clé API