Documentación de API: Endpoint compatible con OpenAI sin censura
Comienza con nuestro endpoint compatible con OpenAI sin censura en minutos. Usa SDKs estándar de OpenAI para enviar texto y recibir respuestas sin restricciones con precios predecibles y sin dependencia de proveedor.
URL base y autenticación
La API sigue la interfaz estándar de OpenAI, lo que facilita la integración. Usa la URL base https://api.uncensoredendpoint.com/v1 para todas las peticiones. La autenticación se basa en una única clave de API generada durante el registro. Incluye esta clave en el encabezado Authorization como token Bearer. Cada cuenta está limitada a una clave activa, que se puede regenerar en cualquier momento para revocar el acceso al instante. Esta configuración funciona con cualquier cliente que admita endpoints compatibles con OpenAI, asegurando que evites el bloqueo propietario.
Primera petición
Envía una petición estándar de finalización de chat para probar el LLM sin censura alojado en nuestra infraestructura. El ID del modelo es simplemente "uncensored". Este endpoint no filtra contenido adulto lícito, escritura creativa o temas controvertidos, proporcionando una salida limpia para uso sin restricciones. Puedes enviar hasta 8 MB por cuerpo de petición. Asegúrate de que tu cliente esté configurado para manejar la estructura de respuesta JSON estándar.
curl https://api.uncensoredendpoint.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Verifica que la respuesta incluya el texto generado. Si recibes un error, comprueba la validez de tu clave o el saldo de tu cuenta. El modelo opera con una ventana de contexto de 100.000 tokens, lo que permite entradas y salidas sustanciales en una sola petición.
Integración con SDK de Python
Usa la biblioteca oficial de Python de OpenAI para interactuar con la API. Configura el cliente con tu URL base y clave de API específicas. La biblioteca maneja la serialización y el análisis de errores automáticamente. Este enfoque es ideal para servicios backend o pipelines de procesamiento de datos donde necesitas llamadas sincrónicas y confiables a la API de IA sin censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Recuerda que el ID del modelo debe establecerse en "uncensored". El SDK gestionará las conexiones HTTP de manera eficiente. Puedes ajustar los tiempos de espera y los reintentos según sea necesario para tu entorno de implementación específico. Este método asegura que estés utilizando una biblioteca de cliente verificada y mantenida.
Integración con SDK de Node.js
El SDK de OpenAI para Node.js funciona igual que la versión de Python. Inicializa el cliente con tu base URL y clave. Esto es útil para renderizado del lado del servidor o pasarelas API en entornos JavaScript. El paquete gestiona el streaming y el análisis JSON de forma nativa.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Establece el parámetro del modelo en "uncensored". El SDK devolverá un objeto de respuesta que contiene los datos de finalización. Puedes integrarlo directamente en rutas de Express u otros frameworks de Node.js. Asegúrate de que tu entorno admita la versión de Node.js requerida para el SDK que elijas.
Respuestas en streaming
Habilita el streaming estableciendo el parámetro stream en true. La API devuelve un flujo de Server-Sent Events (SSE), no un único objeto JSON. Esto te permite mostrar tokens de texto a medida que se generan, mejorando la latencia percibida para los usuarios finales. Cada evento en el flujo contiene un fragmento parcial de la respuesta.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Analiza cada evento SSE para extraer el contenido delta. Esto es crucial para interfaces de chat donde los usuarios esperan efectos de escritura en tiempo real. El endpoint compatible con OpenAI sin censura admite este comportamiento de streaming estándar, asegurando la compatibilidad con la mayoría de los clientes web modernos.
Límites de peticiones y restricciones
Cada clave de API tiene un límite de 300 peticiones por minuto. Si excedes este límite, la API devuelve un código de estado 429 indicando límite de peticiones. El tamaño máximo del cuerpo de la petición es de 8 MB. Para errores de autenticación, como una clave inválida, recibirás un código de estado 401. Aunque pueden ocurrir problemas con el crédito prepago, no se garantiza que los códigos HTTP específicos para los estados de pago sean consistentes en todas las implementaciones de clientes.
La ventana de contexto es de 100.000 tokens para la suma de prompt y finalización. Este es un límite estricto; excederlo resultará en un error. No hay SLAs ni garantías de disponibilidad proporcionados. El servicio está diseñado para un uso directo y de alto volumen sin enrutamiento complejo ni agregación de múltiples modelos.
Ficha técnica de la API
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID del modelo | uncensored |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredendpoint.com/v1 |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Modo JSON | response_format: {"type": "json_object"} |
| Tamaño de petición | hasta 8 MB |
| Límite de peticiones | 300 por minuto por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrencia | 8 peticiones a la vez por clave |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Bono | +5 % desde $50, +10 % desde $100 |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿La clave de API de la IA sin censura está vinculada a una versión específica del modelo?
Sí, la clave funciona exclusivamente con el ID del modelo "uncensored". Es un único modelo de pesos abiertos ejecutado en nuestros propios servidores GPU, no un servicio de enrutamiento entre múltiples proveedores. No necesitas gestionar manualmente las versiones del modelo.
¿Cómo funciona la ventana de contexto?
El límite de 100.000 tokens se aplica a la suma de tu prompt de entrada y la salida generada. Si tu conteo combinado de tokens supera este límite, la petición fallará. Esto permite procesar documentos grandes o historiales de conversaciones extensos en una sola llamada a la API.
¿Puedo usar este endpoint para llamadas a funciones?
Sí, el endpoint de chat-completions admite llamadas a herramientas y funciones. Puedes definir herramientas en tu petición y el modelo devolverá una salida JSON estructurada cuando corresponda. Esto funciona con las bibliotecas de clientes estándar compatibles con OpenAI.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.