Documentazione API: Endpoint compatibile con OpenAI senza censura
Inizia con il nostro endpoint compatibile con OpenAI senza censura in pochi minuti. Usa gli SDK OpenAI standard per inviare testo e ricevere risposte senza restrizioni con prezzi prevedibili e senza lock-in del fornitore.
URL base e autenticazione
L'API segue l'interfaccia standard OpenAI, rendendo l'integrazione semplice. Usa l'URL base https://api.uncensoredendpoint.com/v1 per tutte le richieste. L'autenticazione si basa su una singola chiave API generata durante la registrazione. Inserisci questa chiave nell'intestazione Authorization come token Bearer. Ogni account è limitato a una chiave attiva, che può essere rigenerata in qualsiasi momento per revocare l'accesso istantaneamente. Questa configurazione funziona con qualsiasi client che supporti endpoint compatibili con OpenAI standard, garantendo che tu eviti il lock-in proprietario.
Prima richiesta
Invia una richiesta standard di completamento chat per testare il LLM senza censura ospitato sulla nostra infrastruttura. L'ID del modello è semplicemente "uncensored". Questo endpoint non filtra i contenuti adulti leciti, la scrittura creativa o gli argomenti controversi, fornendo un output pulito per un uso senza restrizioni. Puoi inviare fino a 8 MB per corpo della richiesta. Assicurati che il tuo client sia configurato per gestire la struttura di risposta JSON standard.
curl https://api.uncensoredendpoint.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Verifica che la risposta includa il testo generato. Se ricevi un errore, controlla la validità della tua chiave o il saldo dell'account. Il modello opera con una finestra di contesto di 100.000 token, consentendo input e output sostanziali in una singola richiesta.
Integrazione SDK Python
Usa la libreria ufficiale OpenAI Python per interagire con l'API. Configura il client con il tuo URL base e chiave API specifici. La libreria gestisce automaticamente la serializzazione e l'analisi degli errori. Questo approccio è ideale per servizi backend o pipeline di elaborazione dati in cui hai bisogno di chiamate affidabili e sincrone all'API AI senza censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Ricorda che l'ID del modello deve essere impostato su "uncensored". L'SDK gestirà le connessioni HTTP in modo efficiente. Puoi regolare i timeout e i tentativi di nuovo in base alle esigenze del tuo ambiente di distribuzione. Questo metodo garantisce che tu stia utilizzando una libreria client verificata e mantenuta.
Integrazione SDK Node.js
L'SDK OpenAI Node.js funziona identicamente alla versione Python. Inizializza il client con il tuo URL base e chiave. Questo è utile per il rendering lato server o i gateway API negli ambienti JavaScript. Il pacchetto gestisce nativamente lo streaming e l'analisi JSON.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Imposta il parametro del modello su "uncensored". L'SDK restituirà un oggetto di risposta contenente i dati di completamento. Puoi integrarlo direttamente nelle route Express o in altri framework Node.js. Assicurati che il tuo ambiente supporti la versione richiesta di Node.js per l'SDK che scegli.
Risposte in streaming
Abilita lo streaming impostando il parametro stream su true. L'API restituisce uno stream di Server-Sent Events (SSE), non un singolo oggetto JSON. Ciò ti consente di visualizzare i token di testo man mano che vengono generati, migliorando la latenza percepita per gli utenti finali. Ogni evento nello stream contiene un frammento parziale della risposta.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Analizza ogni evento SSE per estrarre il contenuto delta. Questo è cruciale per le interfacce chat in cui gli utenti si aspettano effetti di digitazione in tempo reale. L'endpoint compatibile con OpenAI senza censura supporta questo comportamento di streaming standard, garantendo la compatibilità con la maggior parte dei client web moderni.
Limiti di velocità e vincoli
Ogni chiave API è limitata a 300 richieste al minuto. Se superi questo limite, l'API restituisce un codice di stato 429 che indica il limite di velocità. La dimensione massima del corpo della richiesta è di 8 MB. Per gli errori di autenticazione, come una chiave non valida, riceverai un codice di stato 401. Sebbene possano verificarsi problemi con il credito prepagato, i codici HTTP specifici per gli stati di pagamento non sono garantiti come coerenti in tutte le implementazioni client.
La finestra di contesto è di 100.000 token per prompt e completamento combinati. Questo è un limite rigido; superarlo comporterà un errore. Non sono forniti SLA o garanzie di uptime. Il servizio è progettato per un utilizzo semplice e ad alto volume senza routing complesso o aggregazione multi-modello.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredendpoint.com/v1 |
| Finestra di contesto | 100.000 token (input + output) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Dimensione | fino a 8 MB per richiesta |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrenza | 8 richieste contemporanee per chiave |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Bonus | +5% da $50, +10% da $100 |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
La chiave API dell'AI senza censura è legata a una specifica versione del modello?
Sì, la chiave funziona esclusivamente con l'ID del modello "uncensored". Si tratta di un singolo modello a pesi aperti eseguito sui nostri server GPU, non di un servizio di instradamento tra più fornitori. Non devi gestire manualmente le versioni del modello.
Come funziona la finestra di contesto?
Il limite di 100.000 token si applica alla somma del tuo prompt di input e dell'output generato. Se il conteggio totale dei token supera questo valore, la richiesta fallirà. Ciò consente di inviare documenti di grandi dimensioni o cronologie di conversazioni lunghe in una singola chiamata API.
Posso usare questo endpoint per la chiamata di funzioni?
Sì, l'endpoint chat-completions supporta la chiamata di strumenti e funzioni. Puoi definire gli strumenti nella tua richiesta e il modello restituirà un output JSON strutturato quando appropriato. Questo funziona con le librerie client standard compatibili con OpenAI.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.