DE ▾
Unzensierte API für KI ohne Filterllmsincensura.com
$0,25pro 1M Input-Token
100.000Token-Kontextfenster
API-Schlüssel erhalten

StartseiteDokumentation

Schnellstart-Anleitung zur API-Integration

Integriere unsere OpenAI-kompatible API in Minuten für direkte, unzensierte Antworten. Diese Anleitung behandelt Authentifizierung, Hauptendpunkte, Streaming und Limits, damit du sofort mit deiner unzensierten KI arbeiten kannst.

Authentifizierung und Base URL

Um unsere KI-API zu nutzen, benötigst du einen API-Schlüssel und die korrekte Basis-URL. Registriere dich auf der Seite Get API key mit deiner E-Mail-Adresse und deinem Passwort, um deinen Schlüssel sofort zu erhalten; für die Testversion wird keine Kreditkarte benötigt. Verwende die Basis-URL https://api.llmsincensura.com/v1 mit jedem OpenAI-kompatiblen Client. Die Authentifizierung erfolgt durch Senden deines Schlüssels im Header Authorization: Bearer YOUR_API_KEY. Dieses Standardverfahren stellt sicher, dass dein unzensiertes LLM mit den Tools funktioniert, die du bereits kennst.

Das Modell, das du aufrufst, ist uncensored. Stelle sicher, dass du es in deinen Anfragen konfigurierst. Es gibt keine komplexen Pfade; du sendest Text und erhältst rohen Text zurück. Wenn deine Anwendung einen spezifischen Endpoint benötigt, ist dies der einzige, den du für Chat-Funktionen brauchst. Einfachheit ist der Schlüssel für eine schnelle und reibungslose Integration.

Endpunkt /v1/chat/completions

Der Kern der unzensierten KI-API ist der Chat-Completion-Endpunkt. Sende eine Liste von Nachrichten (System, Benutzer, Assistent) und erhalte eine vollständige Antwort. Dieser direkte Ansatz vermeidet die bei anderen Modellen für erwachsene oder kontroverse Themen üblichen Inhaltsfilter. Die JSON-Struktur ist identisch mit der von OpenAI, was den Wechsel von einer anderen Plattform erleichtert.

Denke daran, dass wir nur diesen Endpoint für Text unterstützen. Es gibt keine Embeddings oder Bildgenerierung. Zum Einstieg kannst du eine einfache Anfrage mit curl testen, um zu prüfen, ob dein Schlüssel funktioniert und die Antwort ohne Filterung eintrifft.

curl https://api.llmsincensura.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python-Integration

Python-Entwickler können die offizielle Bibliothek openai nutzen, indem sie die Basis-URL anpassen. Dies ermöglicht die Nutzung des bestehenden Ökosystems aus Tools und SDKs. Konfiguriere den Schlüssel und die base_url, um auf unsere Server zu verweisen. Das Modell uncensored verarbeitet deine Eingabe und behält den Kontext bis zu 100.000 Token bei.

Diese Konfiguration ist ideal für Automatisierungsskripte oder Backend-Anwendungen, die schnelle und unzensierte Antworten benötigen. Die Antwortgeschwindigkeit ist aufgrund der dedizierten Infrastruktur auf unseren eigenen GPU-Servern in der Regel hoch.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmsincensura.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js-Integration

Im JavaScript/Node-Ökosystem ist die Integration ebenfalls direkt. Verwende das OpenAI-SDK und überschreibe die Basis-URL. Dies ermöglicht es Webanwendungen oder Node-Servern, einschränkungsfreie KI zu nutzen, ohne die Logik des bestehenden Codes zu ändern. Die Fehlerbehandlung und Promise-Verarbeitung funktioniert genau wie bei anderen OpenAI-Clients.

Wichtig ist, dass das Modell weder GPT noch Claude ist, sondern ein Open-Weight-Modell, das speziell für diesen Dienst angepasst wurde. Dies gewährleistet ein konsistentes, unzensiertes Verhalten. Konfiguriere Umgebungsvariablen, um deinen Schlüssel in der Produktion sicher zu halten.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmsincensura.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming mit SSE

Um die Nutzererfahrung zu verbessern, aktiviere das Streaming, indem du stream: true in deiner Anfrage setzt. Du erhältst Textfragmente, während sie generiert werden, was die wahrgenommene Latenz reduziert. Dies ist entscheidend für Echtzeit-Chat-Anwendungen, in denen Nutzer die Antwort zeichenweise sehen möchten.

Das Streaming behält dieselben Eigenschaften ohne Inhaltsfilter wie die vollständigen Antworten. Du kannst diese Fragmente client- oder serverseitig verarbeiten, um die Antwort schrittweise darzustellen. Dies ist die beste Möglichkeit, die Leistung einer unzensierten Chat-KI in interaktiven Anwendungen zu zeigen.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limits und Fehlerbehandlung

Dein Schlüssel hat ein Limit von 300 Anfragen pro Minute. Wird dieses Limit überschritten, erhältst du einen 429-Fehler. Es gibt zudem eine Begrenzung des Anfragekörpers auf 8 MB. Bei einem ungültigen Schlüssel erhältst du einen 401-Fehler, bei fehlendem Guthaben einen 402-Fehler. Das maximale Kontextfenster beträgt 100k Token (Prompt + Antwort).

Die einzige strenge Inhaltsbeschränkung ist das Verbot von kinderpornografischem Inhalt, das immer gilt. Bei anderen Themen ist das Modell sehr tolerant. Siehe die Standard-OpenAI-Fehlercodes, um deine Integration schnell zu debuggen.

Funktionen und Limits

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
Base-URLhttps://api.llmsincensura.com/v1
AuthentifizierungAuthorization: Bearer YOUR_KEY
Modell-IDuncensored
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
JSON-Modusresponse_format: {"type": "json_object"}
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Ratenlimit300 Anfragen pro Minute und Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Anfragegrößebis 8 MB
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Häufig gestellte Fragen

Was passiert, wenn mein Guthaben aufgebraucht ist?

Wenn dein Guthaben null ist, erhältst du einen 402-Fehler bei Anfragen. Du kannst ab $10 mit Kryptowährungen (USDT oder USDC) aufladen; das Guthaben verfällt nie. Keine monatlichen Pflichtabonnements.

Kann ich die API für kommerzielle Zwecke nutzen?

Ja, das Modell ist für den allgemeinen, auch kommerziellen, Einsatz konzipiert. Es gibt keine branchenspezifischen Einschränkungen, solange der Inhalt nicht kinderpornografisch ist. Deine Privatsphäre ist geschützt; wir nutzen deine Prompts nicht zum Trainieren anderer Modelle.

Wie erstelle ich meinen API-Schlüssel neu?

Du kannst deinen Schlüssel jederzeit über dein Konto-Panel neu generieren. Sobald du einen neuen Schlüssel erstellst, wird der alte sofort ungültig. Das ist nützlich, wenn du vermutest, dass dein Schlüssel kompromittiert wurde, oder wenn du verschiedene Schlüssel für Entwicklungs- und Produktionsumgebungen benötigst.

Dein Schlüssel ist nur einen Schritt entfernt

Erstelle ein Konto, kopiere den Schlüssel und ändere die Base URL. So einfach ist das.

API-Schlüssel erhalten