NL ▾
API-sleutel aanvragen

API-documentatie: Ongecensureerd OpenAI-compatibel endpoint

Kom in actie met ons uncensored openai-compatible endpoint in enkele minuten. Gebruik standaard OpenAI SDK's om tekst te versturen en onbeperkte antwoorden te ontvangen met voorspelbare prijzen en geen leveranciersafhankelijkheid.

Base URL en authenticatie

De API volgt de standaard OpenAI-interface, wat integratie eenvoudig maakt. Gebruik de base URL https://api.uncensoredendpoint.com/v1 voor alle verzoeken. Authenticatie is afhankelijk van één API-sleutel die je tijdens het aanmaken genereert. Voeg deze sleutel toe aan de Authorization header als Bearer token. Elke account is beperkt tot één actieve sleutel, die op elk moment kan worden geregenereerd om toegang direct te intrekken. Deze opstelling werkt met elke client die standaard OpenAI-compatible endpoints ondersteunt, zodat je eigendomssloten vermijdt.

Eerste verzoek

Stuur een standaard chat completion verzoek om de ongecensureerde llm te testen die op onze infrastructuur wordt gehost. De model-ID is eenvoudigweg "uncensored". Dit endpoint filtert geen wettelijk volwassen inhoud, creatief schrijven of controversiële onderwerpen, wat een schone output biedt voor onbeperkt gebruik. Je kunt maximaal 8 MB per request body versturen. Zorg ervoor dat je client is geconfigureerd om de standaard JSON-response structuur te verwerken.

curl https://api.uncensoredendpoint.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Controleer of de response de gegenereerde tekst bevat. Als je een foutmelding krijgt, controleer dan de geldigheid van je sleutel of je accounttegoed. Het model werkt met een contextvenster van 100.000 tokens, waardoor je aanzienlijke input en output binnen één verzoek kunt verwerken.

Python SDK-integratie

Gebruik de officiële OpenAI Python library om met de API te communiceren. Configureer de client met je specifieke base URL en API-sleutel. De bibliotheek verwerkt serialisatie en foutparsen automatisch. Deze aanpak is ideaal voor backend-diensten of data-verwerkingspijplijnen waar je betrouwbare, synchronische calls nodig hebt naar de ongecensureerde ai api.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Onthoud dat de model-ID op "uncensored" moet staan. De SDK beheert de HTTP-verbindingen efficiënt. Je kunt time-outs en retries aanpassen aan je specifieke deployomgeving. Deze methode zorgt ervoor dat je een geverifieerde, onderhouden client library gebruikt.

Node SDK-integratie

De Node.js OpenAI SDK werkt identiek aan de Python-versie. Initialiseer de client met je base URL en sleutel. Dit is nuttig voor server-side rendering of API-gateways in JavaScript-omgevingen. Het pakket verwerkt streaming en JSON-parsing native.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Stel de model-parameter in op "uncensored". De SDK retourneert een response object dat de completion-data bevat. Je kunt dit direct integreren in Express routes of andere Node.js-frameworks. Zorg ervoor dat je omgeving de vereiste Node.js-versie ondersteunt voor de SDK die je kiest.

Streaming antwoorden

Schakel streaming in door de stream parameter op true te zetten. De API retourneert een Server-Sent Events (SSE) stream, geen enkel JSON-object. Hiermee kun je teksttokens weergeven zodra ze gegenereerd zijn, wat de waargenomen latentie voor eindgebruikers verbetert. Elk event in de stream bevat een gedeeltelijk stuk van de response.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Parseer elk SSE-event om de delta-content te extraheren. Dit is cruciaal voor chatinterfaces waar gebruikers real-time typ-effecten verwachten. Het uncensored openai-compatible endpoint ondersteunt dit standaard streaminggedrag, wat compatibiliteit met de meeste moderne webclients garandeert.

Rate limits en beperkingen

Elke API-sleutel is beperkt tot 300 verzoeken per minuut. Als je deze limiet overschrijdt, retourneert de API een 429 statuscode die rate limiting aangeeft. De maximale grootte van de request body is 8 MB. Voor authenticatiefouten, zoals een ongeldige sleutel, ontvang je een 401 status. Hoewel er problemen met prepaid credit kunnen optreden, worden specifieke HTTP-codes voor betalingsstatussen niet gegarandeerd consistent geleverd door alle client-implementaties.

Het contextvenster is 100.000 tokens voor prompt en completion samen. Dit is een harde limiet; overschrijding leidt tot een fout. Er zijn geen SLA's of uptime-garanties beschikbaar. De service is ontworpen voor eenvoudige, hoogvolume gebruik zonder complexe routing of multi-model aggregatie.

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
EndpointsPOST /v1/chat/completions · GET /v1/models
Model-IDuncensored
AuthenticatieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredendpoint.com/v1
Contextvenster100.000 tokens (invoer + uitvoer)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
JSON-modusresponse_format: {"type": "json_object"}
Verzoekgroottetot 8 MB
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Geldigheidbetaald tegoed verloopt niet, geen abonnement
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Bonus+5% vanaf $50, +10% vanaf $100
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is de ongekansureerde API-sleutel gekoppeld aan een specifieke modelversie?

Ja, de sleutel werkt uitsluitend met de model-ID "uncensored". Dit is een enkel open-weight model dat op onze eigen GPU-servers draait, geen doorloorservice tussen meerdere leveranciers. Je hoeft modelversies niet handmatig te beheren.

Hoe werkt het contextvenster?

De limiet van 100.000 tokens geldt voor de som van je input-prompt en de gegenereerde output. Als je gecombineerde tokenaantal dit overschrijdt, mislukt het verzoek. Dit maakt het mogelijk om grote documenten of lange gespreks geschiedenisën in één API-aanroep te verwerken.

Kan ik dit endpoint gebruiken voor function calling?

Ja, het chat-completions endpoint ondersteunt tool en function calling. Je kunt tools definiëren in je verzoek, en het model retourneert gestructureerde JSON-output wanneer dit gepast is. Dit werkt met standaard OpenAI-compatibele client libraries.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.

API-sleutel ophalenDocumentatie lezen