Documentação da API: Endpoint compatível com OpenAI sem censura
Comece com nosso endpoint compatível com OpenAI sem censura em minutos. Use SDKs padrão do OpenAI para enviar texto e receber respostas ilimitadas com preços previsíveis e sem lock-in de fornecedor.
URL Base e Autenticação
A API segue a interface padrão do OpenAI, tornando a integração direta. Use a URL base https://api.uncensoredendpoint.com/v1 para todas as requisições. A autenticação depende de uma única chave de API gerada durante o registro. Inclua esta chave no cabeçalho Authorization como um token Bearer. Cada conta está limitada a uma chave ativa, que pode ser regenerada a qualquer momento para revogar o acesso instantaneamente. Esta configuração funciona com qualquer cliente que suporte endpoints compatíveis com OpenAI, garantindo que você evite o lock-in proprietário.
Primeira Requisição
Envie uma requisição padrão de conclusão de chat para testar o LLM sem censura hospedado em nossa infraestrutura. O ID do modelo é simplesmente "uncensored". Este endpoint não filtra conteúdo adulto legal, escrita criativa ou tópicos controversos, fornecendo uma saída limpa para uso ilimitado. Você pode enviar até 8 MB por corpo de requisição. Certifique-se de que seu cliente esteja configurado para lidar com a estrutura de resposta JSON padrão.
curl https://api.uncensoredendpoint.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Verifique se a resposta inclui o texto gerado. Se você receber um erro, verifique a validade da sua chave ou o saldo da conta. O modelo opera com uma janela de contexto de 100.000 tokens, permitindo entrada e saída substanciais dentro de uma única requisição.
Integração com SDK Python
Use a biblioteca oficial do OpenAI para Python para interagir com a API. Configure o cliente com sua URL base e chave de API específicas. A biblioteca lida com serialização e análise de erros automaticamente. Esta abordagem é ideal para serviços de backend ou pipelines de processamento de dados onde você precisa de chamadas confiáveis e síncronas para a API de IA sem censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Lembre-se de que o ID do modelo deve ser definido como "uncensored". O SDK gerenciará as conexões HTTP de forma eficiente. Você pode ajustar timeouts e retentativas conforme necessário para o seu ambiente de implantação específico. Este método garante que você esteja usando uma biblioteca de cliente verificada e mantida.
Integração com SDK Node.js
O SDK OpenAI para Node.js funciona de forma idêntica à versão Python. Inicialize o cliente com sua URL base e chave. Isso é útil para renderização no lado do servidor ou gateways de API em ambientes JavaScript. O pacote lida nativamente com manipulação de streaming e análise JSON.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Defina o parâmetro do modelo como "uncensored". O SDK retornará um objeto de resposta contendo os dados de conclusão. Você pode integrar isso diretamente em rotas Express ou outros frameworks Node.js. Certifique-se de que seu ambiente suporte a versão necessária do Node.js para o SDK que você escolher.
Respostas em Streaming
Ative o streaming definindo o parâmetro stream como true. A API retorna um stream de Server-Sent Events (SSE), não um único objeto JSON. Isso permite que você exiba tokens de texto conforme são gerados, melhorando a latência percebida para usuários finais. Cada evento no stream contém um fragmento parcial da resposta.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Analise cada evento SSE para extrair o conteúdo delta. Isso é crucial para interfaces de chat onde os usuários esperam efeitos de digitação em tempo real. O endpoint compatível com OpenAI sem censura suporta este comportamento de streaming padrão, garantindo compatibilidade com a maioria dos clientes web modernos.
Limites de Requisição e Restrições
Cada chave de API está limitada a 300 requisições por minuto. Se você exceder esse limite, a API retorna um código de status 429 indicando limite de requisições. O tamanho máximo do corpo da requisição é 8 MB. Para erros de autenticação, como uma chave inválida, você receberá um código de status 401. Embora possam ocorrer problemas com crédito pré-pago, códigos HTTP específicos para estados de pagamento não são garantidos como consistentes em todas as implementações de cliente.
A janela de contexto é de 100.000 tokens para prompt e conclusão combinados. Este é um limite rígido; excedê-lo resultará em um erro. Não há SLAs ou garantias de disponibilidade fornecidos. O serviço é projetado para uso direto e de alto volume, sem roteamento complexo ou agregação de múltiplos modelos.
Ficha técnica da API
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID do modelo | uncensored |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredendpoint.com/v1 |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Modo JSON | response_format: {"type": "json_object"} |
| Tamanho | até 8 MB por requisição |
| Limite de taxa | 300 requisições por minuto por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Validade | crédito pago não expira, sem assinatura |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
A chave de API de IA sem censura está vinculada a uma versão específica do modelo?
Sim, a chave funciona exclusivamente com o ID do modelo "uncensored". Este é um único modelo de pesos abertos executado em nossos próprios servidores GPU, não um serviço de roteamento entre vários fornecedores. Você não precisa gerenciar o versionamento do modelo manualmente.
Como funciona a janela de contexto?
O limite de 100.000 tokens aplica-se à soma do seu prompt de entrada e da saída gerada. Se a contagem combinada de tokens exceder isso, a requisição falhará. Isso permite o uso de documentos grandes ou históricos longos de conversação em uma única chamada de API.
Posso usar este endpoint para chamada de funções?
Sim, o endpoint de chat-completions suporta chamada de ferramentas e funções. Você pode definir ferramentas na sua requisição, e o modelo retornará uma saída JSON estruturada quando apropriado. Isso funciona com bibliotecas de cliente padrão compatíveis com OpenAI.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.