DE ▾
API-Schlüssel erhalten

API-Dokumentation: Unzensierter OpenAI-kompatibler Endpunkt

Starte mit unserem unzensierten OpenAI-kompatiblen Endpunkt in wenigen Minuten. Nutze Standard-OpenAI-SDKs, um Text zu senden und uneingeschränkte Antworten mit vorhersehbaren Preisen und ohne Anbieterbindung zu erhalten.

Basis-URL und Authentifizierung

Die API folgt der Standard-Oberfläche von OpenAI, was die Integration einfach macht. Nutze die Basis-URL https://api.uncensoredendpoint.com/v1 für alle Anfragen. Die Authentifizierung basiert auf einem einzelnen API-Schlüssel, der bei der Anmeldung erstellt wird. Füge diesen Schlüssel im Authorization-Header als Bearer-Token ein. Jedes Konto ist auf einen aktiven Schlüssel beschränkt, der jederzeit neu generiert werden kann, um den Zugriff sofort zu widerrufen. Dieses Setup funktioniert mit jedem Client, der Standard-OpenAI-kompatible Endpunkte unterstützt, und stellt sicher, dass du proprietäre Anbieterbindung vermeidest.

Erste Anfrage

Sende eine Standard-Chat-Vervollständigungsanfrage, um das unzensierte LLM zu testen, das auf unserer Infrastruktur gehostet wird. Die Modell-ID ist einfach „uncensored“. Dieser Endpunkt filtert keine rechtmäßigen Erwachseneninhalte, kreative Texte oder kontroverse Themen und bietet eine saubere Ausgabe für uneingeschränkte Nutzung. Du kannst bis zu 8 MB pro Anfragekörper senden. Stelle sicher, dass dein Client für die Verarbeitung der Standard-JSON-Antwortstruktur konfiguriert ist.

curl https://api.uncensoredendpoint.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Überprüfe, ob die Antwort den generierten Text enthält. Bei einer Fehlermeldung prüfe die Gültigkeit deines API-Schlüssels oder deinen Kontostand. Das Modell verfügt über ein Kontextfenster von 100.000 Token, was umfangreiche Eingaben und Ausgaben in einer einzigen Anfrage ermöglicht.

Python SDK-Integration

Nutze die offizielle OpenAI Python-Bibliothek, um mit der API zu interagieren. Konfiguriere den Client mit deiner spezifischen Basis-URL und deinem API-Schlüssel. Die Bibliothek verarbeitet die Serialisierung und Fehleranalyse automatisch. Dieser Ansatz ist ideal für Backend-Dienste oder Datenverarbeitungspipelines, in denen du zuverlässige, synchrone Aufrufe an die unzensierte KI-API benötigst.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Denke daran, dass die Modell-ID auf „uncensored“ gesetzt werden muss. Das SDK verwaltet die HTTP-Verbindungen effizient. Du kannst Timeouts und Wiederholungen nach Bedarf für deine spezifische Bereitstellungsumgebung anpassen. Diese Methode stellt sicher, dass du eine verifizierte, gepflegte Client-Bibliothek nutzt.

Node SDK-Integration

Das Node.js OpenAI SDK funktioniert identisch zur Python-Version. Initialisiere den Client mit deiner Basis-URL und deinem Schlüssel. Dies ist nützlich für Server-Side-Rendering oder API-Gateways in JavaScript-Umgebungen. Das Paket verarbeitet Stream-Handling und JSON-Parsing nativ.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Setze den Modellparameter auf „uncensored“. Das SDK gibt ein Antwortobjekt zurück, das die Vervollständigungsdaten enthält. Du kannst dies direkt in Express-Routen oder andere Node.js-Frameworks integrieren. Stelle sicher, dass deine Umgebung die erforderliche Node.js-Version für das von dir gewählte SDK unterstützt.

Streaming-Antworten

Aktiviere Streaming, indem du den Parameter stream auf true setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück, kein einzelnes JSON-Objekt. Dies ermöglicht es dir, Text-Token anzuzeigen, während sie generiert werden, was die wahrgenommene Latenz für Endbenutzer verbessert. Jedes Ereignis im Stream enthält einen Teil der Antwort.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Analysiere jedes SSE-Ereignis, um den Delta-Inhalt zu extrahieren. Dies ist entscheidend für Chat-Schnittstellen, bei denen Benutzer Echtzeit-Tippeffekte erwarten. Der unzensierte OpenAI-kompatible Endpunkt unterstützt dieses Standard-Streaming-Verhalten und gewährleistet die Kompatibilität mit den meisten modernen Web-Clients.

Ratenlimits und Einschränkungen

Jeder API-Schlüssel ist auf 300 Anfragen pro Minute beschränkt. Wenn du dieses Limit überschreitet, gibt die API einen 429-Statuscode zurück, der das Ratenlimit anzeigt. Die maximale Größe des Anfragekörpers beträgt 8 MB. Bei Authentifizierungsfehlern, wie einem ungültigen Schlüssel, erhältst du einen 401-Status. Während Probleme mit Prepaid-Guthaben auftreten können, sind spezifische HTTP-Codes für Zahlungszustände nicht in allen Client-Implementierungen konsistent garantiert.

Das Kontextfenster beträgt 100.000 Token für Prompt und Vervollständigung zusammen. Dies ist ein hartes Limit; dessen Überschreitung führt zu einem Fehler. Es werden keine SLAs oder Verfügbarkeitsgarantien bereitgestellt. Der Dienst ist für eine einfache, hochvolumige Nutzung ohne komplexes Routing oder Multi-Modell-Aggregation konzipiert.

API-Spezifikation

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
Modell-IDuncensored
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.uncensoredendpoint.com/v1
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
JSON-Modusresponse_format: {"type": "json_object"}
Anfragegrößebis 8 MB
Ratenlimit300 Anfragen pro Minute und Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Bonus+5 % ab $50, +10 % ab $100
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Ist der API-Schlüssel der unzensierten KI an eine bestimmte Modellversion gebunden?

Ja, der Schlüssel funktioniert ausschließlich mit der Modell-ID „uncensored“. Dies ist ein einzelnes Open-Weight-Modell, das auf unseren eigenen GPU-Servern läuft, kein Routing-Dienst zwischen mehreren Anbietern. Du musst die Modellversionierung nicht manuell verwalten.

Wie funktioniert das Kontextfenster?

Das Limit von 100.000 Token gilt für die Summe aus deinem Eingabe-Prompt und der generierten Ausgabe. Wenn deine kombinierte Token-Anzahl dieses Limit überschreitet, schlägt die Anfrage fehl. Dies ermöglicht große Dokumente oder lange Gesprächsverläufe in einer einzelnen API-Anfrage.

Kann ich diesen Endpunkt für Function Calling nutzen?

Ja, der chat-completions-Endpunkt unterstützt Tool- und Function Calling. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt bei Bedarf strukturierte JSON-Ausgaben zurück. Dies funktioniert mit Standard-OpenAI-kompatiblen Client-Bibliotheken.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhaltenLies die Dokumentation