Documentation API : Endpoint OpenAI compatible sans censure
Commencez avec notre endpoint OpenAI compatible sans censure en quelques minutes. Utilisez les SDK OpenAI standard pour envoyer du texte et recevoir des réponses sans restriction avec une tarification prévisible et sans dépendance à un fournisseur.
URL de base et authentification
L'API suit l'interface standard OpenAI, ce qui rend l'intégration simple. Utilisez l'URL de base https://api.uncensoredendpoint.com/v1 pour toutes les requêtes. L'authentification repose sur une seule clé API générée lors de l'inscription. Incluez cette clé dans l'en-tête Authorization en tant que jeton Bearer. Chaque compte est limité à une clé active, qui peut être régénérée à tout moment pour révoquer l'accès instantanément. Cette configuration fonctionne avec tout client prenant en charge les endpoints compatibles OpenAI, vous assurant d'éviter l'enfermement propriétaire.
Première requête
Envoyez une requête standard de chat completion pour tester le LLM sans censure hébergé sur notre infrastructure. L'ID du modèle est simplement « uncensored ». Cet endpoint ne filtre pas le contenu adulte légal, l'écriture créative ou les sujets controversés, fournissant une sortie propre pour une utilisation sans restriction. Vous pouvez envoyer jusqu'à 8 Mo par corps de requête. Assurez-vous que votre client est configuré pour gérer la structure de réponse JSON standard.
curl https://api.uncensoredendpoint.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Vérifiez que la réponse inclut le texte généré. Si vous recevez une erreur, vérifiez la validité de votre clé ou le solde de votre compte. Le modèle fonctionne avec une fenêtre de contexte de 100 000 tokens, permettant des entrées et sorties substantielles en une seule requête.
Intégration SDK Python
Utilisez la bibliothèque Python officielle OpenAI pour interagir avec l'API. Configurez le client avec votre URL de base et votre clé API spécifiques. La bibliothèque gère automatiquement la sérialisation et l'analyse des erreurs. Cette approche est idéale pour les services backend ou les pipelines de traitement de données où vous avez besoin d'appels synchrones fiables à l'API IA sans censure.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
N'oubliez pas que l'ID du modèle doit être défini sur « uncensored ». Le SDK gérera efficacement les connexions HTTP. Vous pouvez ajuster les délais d'attente et les tentatives en fonction de votre environnement de déploiement spécifique. Cette méthode garantit que vous utilisez une bibliothèque cliente vérifiée et maintenue.
Intégration SDK Node.js
Le SDK OpenAI Node.js fonctionne de manière identique à la version Python. Initialisez le client avec votre URL de base et votre clé. Cela est utile pour le rendu côté serveur ou les passerelles API dans les environnements JavaScript. Le package gère nativement le traitement du streaming et l'analyse JSON.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Définissez le paramètre du modèle sur « uncensored ». Le SDK renverra un objet de réponse contenant les données de complétion. Vous pouvez l'intégrer directement dans les routes Express ou d'autres frameworks Node.js. Assurez-vous que votre environnement prend en charge la version requise de Node.js pour le SDK que vous choisissez.
Réponses en streaming
Activez le streaming en définissant le paramètre stream sur true. L'API renvoie un flux SSE (Server-Sent Events), et non un objet JSON unique. Cela permet d'afficher les tokens au fur et à mesure de leur génération, améliorant la latence perçue pour les utilisateurs finaux. Chaque événement du flux contient un fragment partiel de la réponse.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Analysez chaque événement SSE pour extraire le contenu delta. C'est crucial pour les interfaces de chat où les utilisateurs s'attendent à un effet de frappe en temps réel. L'endpoint compatible OpenAI sans censure prend en charge ce comportement de streaming standard, assurant la compatibilité avec la plupart des clients web modernes.
Limites de débit et contraintes
Chaque clé API est limitée à 300 requêtes par minute. Si vous dépassez cette limite, l'API renvoie un code d'état 429 indiquant une limitation de débit. La taille maximale du corps de la requête est de 8 Mo. Pour les erreurs d'authentification, telles qu'une clé invalide, vous recevrez un code d'état 401. Bien que des problèmes de crédit prépayé puissent survenir, les codes HTTP spécifiques aux états de paiement ne sont pas garantis d'être cohérents dans toutes les implémentations clientes.
La fenêtre de contexte est de 100 000 tokens pour le prompt et la complétion combinés. Il s'agit d'une limite stricte ; le dépasser entraînera une erreur. Aucune garantie de SLA ou de disponibilité n'est fournie. Le service est conçu pour une utilisation simple à haut volume, sans routage complexe ni agrégation multi-modèles.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredendpoint.com/v1 |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Taille | jusqu'à 8 Mo par requête |
| Limite de débit | 300 requêtes par minute et par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrence | 8 requêtes simultanées par clé |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
La clé API de l'IA sans censure est-elle liée à une version spécifique du modèle ?
Oui, la clé fonctionne exclusivement avec l'ID de modèle « uncensored ». Il s'agit d'un modèle à poids ouverts unique exécuté sur nos propres serveurs GPU, et non d'un service de routage entre plusieurs fournisseurs. Vous n'avez pas besoin de gérer manuellement les versions du modèle.
Comment fonctionne la fenêtre de contexte ?
La limite de 100 000 tokens s'applique à la somme de votre prompt d'entrée et de la sortie générée. Si le nombre total de tokens dépasse cette limite, la requête échouera. Cela permet d'envoyer de grands documents ou de longs historiques de conversation en une seule requête API.
Puis-je utiliser cet endpoint pour l'appel de fonctions ?
Oui, l'endpoint chat-completions prend en charge l'appel d'outils et de fonctions. Vous pouvez définir des outils dans votre requête, et le modèle renverra une sortie JSON structurée si nécessaire. Cela fonctionne avec les bibliothèques clientes standard compatibles OpenAI.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.