FR ▾
Obtenir une clé API

Documentation API : Endpoint OpenAI compatible sans censure

Commencez avec notre endpoint OpenAI compatible sans censure en quelques minutes. Utilisez les SDK OpenAI standard pour envoyer du texte et recevoir des réponses sans restriction avec une tarification prévisible et sans dépendance à un fournisseur.

URL de base et authentification

L'API suit l'interface standard OpenAI, ce qui rend l'intégration simple. Utilisez l'URL de base https://api.uncensoredendpoint.com/v1 pour toutes les requêtes. L'authentification repose sur une seule clé API générée lors de l'inscription. Incluez cette clé dans l'en-tête Authorization en tant que jeton Bearer. Chaque compte est limité à une clé active, qui peut être régénérée à tout moment pour révoquer l'accès instantanément. Cette configuration fonctionne avec tout client prenant en charge les endpoints compatibles OpenAI, vous assurant d'éviter l'enfermement propriétaire.

Première requête

Envoyez une requête standard de chat completion pour tester le LLM sans censure hébergé sur notre infrastructure. L'ID du modèle est simplement « uncensored ». Cet endpoint ne filtre pas le contenu adulte légal, l'écriture créative ou les sujets controversés, fournissant une sortie propre pour une utilisation sans restriction. Vous pouvez envoyer jusqu'à 8 Mo par corps de requête. Assurez-vous que votre client est configuré pour gérer la structure de réponse JSON standard.

curl https://api.uncensoredendpoint.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Vérifiez que la réponse inclut le texte généré. Si vous recevez une erreur, vérifiez la validité de votre clé ou le solde de votre compte. Le modèle fonctionne avec une fenêtre de contexte de 100 000 tokens, permettant des entrées et sorties substantielles en une seule requête.

Intégration SDK Python

Utilisez la bibliothèque Python officielle OpenAI pour interagir avec l'API. Configurez le client avec votre URL de base et votre clé API spécifiques. La bibliothèque gère automatiquement la sérialisation et l'analyse des erreurs. Cette approche est idéale pour les services backend ou les pipelines de traitement de données où vous avez besoin d'appels synchrones fiables à l'API IA sans censure.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

N'oubliez pas que l'ID du modèle doit être défini sur « uncensored ». Le SDK gérera efficacement les connexions HTTP. Vous pouvez ajuster les délais d'attente et les tentatives en fonction de votre environnement de déploiement spécifique. Cette méthode garantit que vous utilisez une bibliothèque cliente vérifiée et maintenue.

Intégration SDK Node.js

Le SDK OpenAI Node.js fonctionne de manière identique à la version Python. Initialisez le client avec votre URL de base et votre clé. Cela est utile pour le rendu côté serveur ou les passerelles API dans les environnements JavaScript. Le package gère nativement le traitement du streaming et l'analyse JSON.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Définissez le paramètre du modèle sur « uncensored ». Le SDK renverra un objet de réponse contenant les données de complétion. Vous pouvez l'intégrer directement dans les routes Express ou d'autres frameworks Node.js. Assurez-vous que votre environnement prend en charge la version requise de Node.js pour le SDK que vous choisissez.

Réponses en streaming

Activez le streaming en définissant le paramètre stream sur true. L'API renvoie un flux SSE (Server-Sent Events), et non un objet JSON unique. Cela permet d'afficher les tokens au fur et à mesure de leur génération, améliorant la latence perçue pour les utilisateurs finaux. Chaque événement du flux contient un fragment partiel de la réponse.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Analysez chaque événement SSE pour extraire le contenu delta. C'est crucial pour les interfaces de chat où les utilisateurs s'attendent à un effet de frappe en temps réel. L'endpoint compatible OpenAI sans censure prend en charge ce comportement de streaming standard, assurant la compatibilité avec la plupart des clients web modernes.

Limites de débit et contraintes

Chaque clé API est limitée à 300 requêtes par minute. Si vous dépassez cette limite, l'API renvoie un code d'état 429 indiquant une limitation de débit. La taille maximale du corps de la requête est de 8 Mo. Pour les erreurs d'authentification, telles qu'une clé invalide, vous recevrez un code d'état 401. Bien que des problèmes de crédit prépayé puissent survenir, les codes HTTP spécifiques aux états de paiement ne sont pas garantis d'être cohérents dans toutes les implémentations clientes.

La fenêtre de contexte est de 100 000 tokens pour le prompt et la complétion combinés. Il s'agit d'une limite stricte ; le dépasser entraînera une erreur. Aucune garantie de SLA ou de disponibilité n'est fournie. Le service est conçu pour une utilisation simple à haut volume, sans routage complexe ni agrégation multi-modèles.

Fiche technique de l'API

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
EndpointsPOST /v1/chat/completions · GET /v1/models
ID du modèleuncensored
AuthentificationAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredendpoint.com/v1
Fenêtre de contexte100 000 tokens (entrée + sortie)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Mode JSONresponse_format: {"type": "json_object"}
Taillejusqu'à 8 Mo par requête
Limite de débit300 requêtes par minute et par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrence8 requêtes simultanées par clé
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Validitéle crédit payé n'expire jamais, sans abonnement
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Bonus+5 % dès 50 $, +10 % dès 100 $
ConnexionGoogle ou e-mail et mot de passe
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

La clé API de l'IA sans censure est-elle liée à une version spécifique du modèle ?

Oui, la clé fonctionne exclusivement avec l'ID de modèle « uncensored ». Il s'agit d'un modèle à poids ouverts unique exécuté sur nos propres serveurs GPU, et non d'un service de routage entre plusieurs fournisseurs. Vous n'avez pas besoin de gérer manuellement les versions du modèle.

Comment fonctionne la fenêtre de contexte ?

La limite de 100 000 tokens s'applique à la somme de votre prompt d'entrée et de la sortie générée. Si le nombre total de tokens dépasse cette limite, la requête échouera. Cela permet d'envoyer de grands documents ou de longs historiques de conversation en une seule requête API.

Puis-je utiliser cet endpoint pour l'appel de fonctions ?

Oui, l'endpoint chat-completions prend en charge l'appel d'outils et de fonctions. Vous pouvez définir des outils dans votre requête, et le modèle renverra une sortie JSON structurée si nécessaire. Cela fonctionne avec les bibliothèques clientes standard compatibles OpenAI.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir la clé APILire la documentation