API-documentatie: Ongecensureerd OpenAI-compatibel endpoint
Kom in actie met ons uncensored openai-compatible endpoint in enkele minuten. Gebruik standaard OpenAI SDK's om tekst te versturen en onbeperkte antwoorden te ontvangen met voorspelbare prijzen en geen leveranciersafhankelijkheid.
Base URL en authenticatie
De API volgt de standaard OpenAI-interface, wat integratie eenvoudig maakt. Gebruik de base URL https://api.uncensoredendpoint.com/v1 voor alle verzoeken. Authenticatie is afhankelijk van één API-sleutel die je tijdens het aanmaken genereert. Voeg deze sleutel toe aan de Authorization header als Bearer token. Elke account is beperkt tot één actieve sleutel, die op elk moment kan worden geregenereerd om toegang direct te intrekken. Deze opstelling werkt met elke client die standaard OpenAI-compatible endpoints ondersteunt, zodat je eigendomssloten vermijdt.
Eerste verzoek
Stuur een standaard chat completion verzoek om de ongecensureerde llm te testen die op onze infrastructuur wordt gehost. De model-ID is eenvoudigweg "uncensored". Dit endpoint filtert geen wettelijk volwassen inhoud, creatief schrijven of controversiële onderwerpen, wat een schone output biedt voor onbeperkt gebruik. Je kunt maximaal 8 MB per request body versturen. Zorg ervoor dat je client is geconfigureerd om de standaard JSON-response structuur te verwerken.
curl https://api.uncensoredendpoint.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Controleer of de response de gegenereerde tekst bevat. Als je een foutmelding krijgt, controleer dan de geldigheid van je sleutel of je accounttegoed. Het model werkt met een contextvenster van 100.000 tokens, waardoor je aanzienlijke input en output binnen één verzoek kunt verwerken.
Python SDK-integratie
Gebruik de officiële OpenAI Python library om met de API te communiceren. Configureer de client met je specifieke base URL en API-sleutel. De bibliotheek verwerkt serialisatie en foutparsen automatisch. Deze aanpak is ideaal voor backend-diensten of data-verwerkingspijplijnen waar je betrouwbare, synchronische calls nodig hebt naar de ongecensureerde ai api.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Onthoud dat de model-ID op "uncensored" moet staan. De SDK beheert de HTTP-verbindingen efficiënt. Je kunt time-outs en retries aanpassen aan je specifieke deployomgeving. Deze methode zorgt ervoor dat je een geverifieerde, onderhouden client library gebruikt.
Node SDK-integratie
De Node.js OpenAI SDK werkt identiek aan de Python-versie. Initialiseer de client met je base URL en sleutel. Dit is nuttig voor server-side rendering of API-gateways in JavaScript-omgevingen. Het pakket verwerkt streaming en JSON-parsing native.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Stel de model-parameter in op "uncensored". De SDK retourneert een response object dat de completion-data bevat. Je kunt dit direct integreren in Express routes of andere Node.js-frameworks. Zorg ervoor dat je omgeving de vereiste Node.js-versie ondersteunt voor de SDK die je kiest.
Streaming antwoorden
Schakel streaming in door de stream parameter op true te zetten. De API retourneert een Server-Sent Events (SSE) stream, geen enkel JSON-object. Hiermee kun je teksttokens weergeven zodra ze gegenereerd zijn, wat de waargenomen latentie voor eindgebruikers verbetert. Elk event in de stream bevat een gedeeltelijk stuk van de response.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Parseer elk SSE-event om de delta-content te extraheren. Dit is cruciaal voor chatinterfaces waar gebruikers real-time typ-effecten verwachten. Het uncensored openai-compatible endpoint ondersteunt dit standaard streaminggedrag, wat compatibiliteit met de meeste moderne webclients garandeert.
Rate limits en beperkingen
Elke API-sleutel is beperkt tot 300 verzoeken per minuut. Als je deze limiet overschrijdt, retourneert de API een 429 statuscode die rate limiting aangeeft. De maximale grootte van de request body is 8 MB. Voor authenticatiefouten, zoals een ongeldige sleutel, ontvang je een 401 status. Hoewel er problemen met prepaid credit kunnen optreden, worden specifieke HTTP-codes voor betalingsstatussen niet gegarandeerd consistent geleverd door alle client-implementaties.
Het contextvenster is 100.000 tokens voor prompt en completion samen. Dit is een harde limiet; overschrijding leidt tot een fout. Er zijn geen SLA's of uptime-garanties beschikbaar. De service is ontworpen voor eenvoudige, hoogvolume gebruik zonder complexe routing of multi-model aggregatie.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Model-ID | uncensored |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredendpoint.com/v1 |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| JSON-modus | response_format: {"type": "json_object"} |
| Verzoekgrootte | tot 8 MB |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is de ongekansureerde API-sleutel gekoppeld aan een specifieke modelversie?
Ja, de sleutel werkt uitsluitend met de model-ID "uncensored". Dit is een enkel open-weight model dat op onze eigen GPU-servers draait, geen doorloorservice tussen meerdere leveranciers. Je hoeft modelversies niet handmatig te beheren.
Hoe werkt het contextvenster?
De limiet van 100.000 tokens geldt voor de som van je input-prompt en de gegenereerde output. Als je gecombineerde tokenaantal dit overschrijdt, mislukt het verzoek. Dit maakt het mogelijk om grote documenten of lange gespreks geschiedenisën in één API-aanroep te verwerken.
Kan ik dit endpoint gebruiken voor function calling?
Ja, het chat-completions endpoint ondersteunt tool en function calling. Je kunt tools definiëren in je verzoek, en het model retourneert gestructureerde JSON-output wanneer dit gepast is. Dit werkt met standaard OpenAI-compatibele client libraries.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.