API-Dokumentation: Unzensierter OpenAI-kompatibler Endpunkt
Starte mit unserem unzensierten OpenAI-kompatiblen Endpunkt in wenigen Minuten. Nutze Standard-OpenAI-SDKs, um Text zu senden und uneingeschränkte Antworten mit vorhersehbaren Preisen und ohne Anbieterbindung zu erhalten.
Basis-URL und Authentifizierung
Die API folgt der Standard-Oberfläche von OpenAI, was die Integration einfach macht. Nutze die Basis-URL https://api.uncensoredendpoint.com/v1 für alle Anfragen. Die Authentifizierung basiert auf einem einzelnen API-Schlüssel, der bei der Anmeldung erstellt wird. Füge diesen Schlüssel im Authorization-Header als Bearer-Token ein. Jedes Konto ist auf einen aktiven Schlüssel beschränkt, der jederzeit neu generiert werden kann, um den Zugriff sofort zu widerrufen. Dieses Setup funktioniert mit jedem Client, der Standard-OpenAI-kompatible Endpunkte unterstützt, und stellt sicher, dass du proprietäre Anbieterbindung vermeidest.
Erste Anfrage
Sende eine Standard-Chat-Vervollständigungsanfrage, um das unzensierte LLM zu testen, das auf unserer Infrastruktur gehostet wird. Die Modell-ID ist einfach „uncensored“. Dieser Endpunkt filtert keine rechtmäßigen Erwachseneninhalte, kreative Texte oder kontroverse Themen und bietet eine saubere Ausgabe für uneingeschränkte Nutzung. Du kannst bis zu 8 MB pro Anfragekörper senden. Stelle sicher, dass dein Client für die Verarbeitung der Standard-JSON-Antwortstruktur konfiguriert ist.
curl https://api.uncensoredendpoint.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Überprüfe, ob die Antwort den generierten Text enthält. Bei einer Fehlermeldung prüfe die Gültigkeit deines API-Schlüssels oder deinen Kontostand. Das Modell verfügt über ein Kontextfenster von 100.000 Token, was umfangreiche Eingaben und Ausgaben in einer einzigen Anfrage ermöglicht.
Python SDK-Integration
Nutze die offizielle OpenAI Python-Bibliothek, um mit der API zu interagieren. Konfiguriere den Client mit deiner spezifischen Basis-URL und deinem API-Schlüssel. Die Bibliothek verarbeitet die Serialisierung und Fehleranalyse automatisch. Dieser Ansatz ist ideal für Backend-Dienste oder Datenverarbeitungspipelines, in denen du zuverlässige, synchrone Aufrufe an die unzensierte KI-API benötigst.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Denke daran, dass die Modell-ID auf „uncensored“ gesetzt werden muss. Das SDK verwaltet die HTTP-Verbindungen effizient. Du kannst Timeouts und Wiederholungen nach Bedarf für deine spezifische Bereitstellungsumgebung anpassen. Diese Methode stellt sicher, dass du eine verifizierte, gepflegte Client-Bibliothek nutzt.
Node SDK-Integration
Das Node.js OpenAI SDK funktioniert identisch zur Python-Version. Initialisiere den Client mit deiner Basis-URL und deinem Schlüssel. Dies ist nützlich für Server-Side-Rendering oder API-Gateways in JavaScript-Umgebungen. Das Paket verarbeitet Stream-Handling und JSON-Parsing nativ.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Setze den Modellparameter auf „uncensored“. Das SDK gibt ein Antwortobjekt zurück, das die Vervollständigungsdaten enthält. Du kannst dies direkt in Express-Routen oder andere Node.js-Frameworks integrieren. Stelle sicher, dass deine Umgebung die erforderliche Node.js-Version für das von dir gewählte SDK unterstützt.
Streaming-Antworten
Aktiviere Streaming, indem du den Parameter stream auf true setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück, kein einzelnes JSON-Objekt. Dies ermöglicht es dir, Text-Token anzuzeigen, während sie generiert werden, was die wahrgenommene Latenz für Endbenutzer verbessert. Jedes Ereignis im Stream enthält einen Teil der Antwort.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Analysiere jedes SSE-Ereignis, um den Delta-Inhalt zu extrahieren. Dies ist entscheidend für Chat-Schnittstellen, bei denen Benutzer Echtzeit-Tippeffekte erwarten. Der unzensierte OpenAI-kompatible Endpunkt unterstützt dieses Standard-Streaming-Verhalten und gewährleistet die Kompatibilität mit den meisten modernen Web-Clients.
Ratenlimits und Einschränkungen
Jeder API-Schlüssel ist auf 300 Anfragen pro Minute beschränkt. Wenn du dieses Limit überschreitet, gibt die API einen 429-Statuscode zurück, der das Ratenlimit anzeigt. Die maximale Größe des Anfragekörpers beträgt 8 MB. Bei Authentifizierungsfehlern, wie einem ungültigen Schlüssel, erhältst du einen 401-Status. Während Probleme mit Prepaid-Guthaben auftreten können, sind spezifische HTTP-Codes für Zahlungszustände nicht in allen Client-Implementierungen konsistent garantiert.
Das Kontextfenster beträgt 100.000 Token für Prompt und Vervollständigung zusammen. Dies ist ein hartes Limit; dessen Überschreitung führt zu einem Fehler. Es werden keine SLAs oder Verfügbarkeitsgarantien bereitgestellt. Der Dienst ist für eine einfache, hochvolumige Nutzung ohne komplexes Routing oder Multi-Modell-Aggregation konzipiert.
API-Spezifikation
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.uncensoredendpoint.com/v1 |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist der API-Schlüssel der unzensierten KI an eine bestimmte Modellversion gebunden?
Ja, der Schlüssel funktioniert ausschließlich mit der Modell-ID „uncensored“. Dies ist ein einzelnes Open-Weight-Modell, das auf unseren eigenen GPU-Servern läuft, kein Routing-Dienst zwischen mehreren Anbietern. Du musst die Modellversionierung nicht manuell verwalten.
Wie funktioniert das Kontextfenster?
Das Limit von 100.000 Token gilt für die Summe aus deinem Eingabe-Prompt und der generierten Ausgabe. Wenn deine kombinierte Token-Anzahl dieses Limit überschreitet, schlägt die Anfrage fehl. Dies ermöglicht große Dokumente oder lange Gesprächsverläufe in einer einzelnen API-Anfrage.
Kann ich diesen Endpunkt für Function Calling nutzen?
Ja, der chat-completions-Endpunkt unterstützt Tool- und Function Calling. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt bei Bedarf strukturierte JSON-Ausgaben zurück. Dies funktioniert mit Standard-OpenAI-kompatiblen Client-Bibliotheken.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.