PL ▾
Pobierz klucz API

Dokumentacja API: Endpoint kompatybilny z OpenAI bez cenzury

Rozpocznij pracę z naszym endpointem kompatybilnym z OpenAI bez cenzury w kilka minut. Użyj standardowych SDK OpenAI do wysyłania tekstu i otrzymywania nieograniczonych odpowiedzi przy przewidywalnych cenach i bez lock-inu dostawcy.

Base URL i uwierzytelnianie

API jest zgodne ze standardowym interfejsem OpenAI, co ułatwia integrację. Użyj podstawowego adresu URL https://api.uncensoredendpoint.com/v1 do wszystkich zapytań. Autoryzacja opiera się na jednym kluczu API wygenerowanym podczas rejestracji. Dołącz ten klucz do nagłówka Authorization jako token Bearer. Każde konto może mieć aktywny tylko jeden klucz, który można wygenerować ponownie w dowolnym momencie, aby natychmiast unieważnić dostęp. To rozwiązanie działa z każdym klientem obsługującym standardowe endpointy zgodne z OpenAI, zapewniając uniknięcie lock-inu.

Pierwsze zapytanie

Wyślij standardowe zapytanie chat completion, aby przetestować LLM bez cenzury hostowany na naszej infrastrukturze. Identyfikator modelu to po prostu "uncensored". Ten endpoint nie filtruje legalnej treści dla dorosłych, twórczości literackiej ani kontrowersyjnych tematów, zapewniając czysty output do nieograniczonego użytku. Możesz wysyłać do 8 MB na ciało zapytania. Upewnij się, że Twój klient jest skonfigurowany do obsługi standardowej struktury odpowiedzi JSON.

curl https://api.uncensoredendpoint.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Sprawdź, czy odpowiedź zawiera wygenerowany tekst. Jeśli otrzymasz błąd, sprawdź ważność klucza lub stan konta. Model obsługuje okno kontekstu o pojemności 100 000 tokenów, co pozwala na przesłanie znacznej ilości danych wejściowych i wyjściowych w jednym zapytaniu.

Integracja z Python SDK

Użyj oficjalnej biblioteki Python OpenAI do interakcji z API. Skonfiguruj klienta ze swoim konkretnym base URL i kluczem API. Biblioteka automatycznie obsługuje serializację i parsowanie błędów. To podejście jest idealne dla usług backendowych lub potoków przetwarzania danych, gdzie potrzebujesz niezawodnych, synchronicznych wywołań do API AI bez cenzury.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Pamiętaj, że identyfikator modelu musi być ustawiony na "uncensored". SDK będzie efektywnie zarządzać połączeniami HTTP. Możesz dostosować timeouty i retry, jeśli zajdzie taka potrzeba w środowisku wdrożenia. Ta metoda zapewnia, że używasz zweryfikowanej, utrzymywanej biblioteki klienta.

Integracja z Node SDK

SDK OpenAI Node.js działa identycznie jak wersja Python. Zainicjuj klienta swoim base URL i kluczem. Jest to przydatne do renderowania po stronie serwera lub bramek API w środowiskach JavaScript. Pakiet natywnie obsługuje strumieniowanie i parsowanie JSON.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Ustaw parametr modelu na "uncensored". SDK zwróci obiekt odpowiedzi zawierający dane completion. Możesz zintegrować to bezpośrednio w trasach Express lub innych frameworkach Node.js. Upewnij się, że Twoje środowisko obsługuje wymaganą wersję Node.js dla wybranego SDK.

Odpowiedzi strumieniowe

Włącz strumieniowanie, ustawiając parametr stream na true. API zwraca strumień Server-Sent Events (SSE), a nie pojedynczy obiekt JSON. Pozwala to wyświetlać tokeny tekstu w miarę ich generowania, poprawiając postrzeganą latencję dla użytkowników końcowych. Każde zdarzenie w strumieniu zawiera częściowy fragment odpowiedzi.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Parsuj każde zdarzenie SSE, aby wyodrębnić zawartość delta. Jest to kluczowe dla interfejsów czatu, gdzie użytkownicy oczekują efektu pisania w czasie rzeczywistym. Endpoint kompatybilny z OpenAI bez cenzury obsługuje to standardowe zachowanie strumieniowania, zapewniając kompatybilność z większością nowoczesnych klientów webowych.

Limity zapytań i ograniczenia

Każdy klucz API jest ograniczony do 300 zapytań na minutę. Jeśli przekroczysz ten limit, API zwróci kod statusu 429 wskazujący na limit zapytań. Maksymalny rozmiar ciała zapytania to 8 MB. W przypadku błędów uwierzytelniania, takich jak nieprawidłowy klucz, otrzymasz status 401. Choć mogą wystąpić problemy z przedpłaconym kredytem, konkretne kody HTTP dla stanów płatności nie są gwarantowane jako spójne we wszystkich implementacjach klientów.

Okno kontekstu wynosi 100 000 tokenów dla promptu i completion łącznie. Jest to limit twardy; jego przekroczenie spowoduje błąd. Nie zapewniamy żadnych SLA ani gwarancji dostępności. Usługa została zaprojektowana do prostego, wysokopoziomowego użytku bez skomplikowanego routingu ani agregacji wielu modeli.

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
EndpointyPOST /v1/chat/completions · GET /v1/models
ID modeluuncensored
UwierzytelnianieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredendpoint.com/v1
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Tryb JSONresponse_format: {"type": "json_object"}
Rozmiar zapytaniado 8 MB
Limit zapytań300 zapytań na minutę na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Równoległe zapytaniado 8 jednocześnie na klucz
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Bonus+5% od $50, +10% od $100
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Czy klucz API AI bez cenzury jest powiązany z konkretną wersją modelu?

Tak, klucz działa wyłącznie z identyfikatorem modelu "uncensored". To pojedynczy model o otwartych wagach uruchomiony na naszych własnych serwerach GPU, a nie usługa routingu między wieloma dostawcami. Nie musisz ręcznie zarządzać wersjami modelu.

Jak działa okno kontekstu?

Limit 100 000 tokenów dotyczy sumy Twojego promptu wejściowego i wygenerowanego outputu. Jeśli łączna liczba tokenów przekroczy ten limit, zapytanie zostanie odrzucone. Pozwala to na przesyłanie dużych dokumentów lub długich historii konwersacji w jednym wywołaniu API.

Czy mogę użyć tego endpointa do wywoływania funkcji?

Tak, endpoint chat-completions obsługuje wywoływanie narzędzi i funkcji. Możesz zdefiniować narzędzia w zapytaniu, a model zwróci strukturalny output JSON, gdy będzie to odpowiednie. Działa to z standardowymi bibliotekami klientów kompatybilnymi z OpenAI.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień base URL. To cały proces konfiguracji.

Pobierz klucz APIPrzeczytaj dokumentację