Документация API: Эндпоинт, совместимый с OpenAI, без цензуры
Начните работу с нашим эндпоинтом, совместимым с OpenAI и не имеющим цензуры, за считанные минуты. Используйте стандартные SDK OpenAI для отправки текста и получения неограниченных ответов с предсказуемым ценообразованием и без привязки к поставщику.
Базовый URL и аутентификация
API следует стандартному интерфейсу OpenAI, что упрощает интеграцию. Используйте базовый URL https://api.uncensoredendpoint.com/v1 для всех запросов. Аутентификация основана на одном API-ключе, сгенерированном при регистрации. Включите этот ключ в заголовок Authorization в виде токена Bearer. На один аккаунт действует только один активный ключ, который можно перегенерировать в любое время для мгновенного отзыва доступа. Эта настройка работает с любым клиентом, поддерживающим стандартные эндпоинты, совместимые с OpenAI, что позволяет избежать проприетарной привязки.
Первый запрос
Отправьте стандартный запрос на завершение чата, чтобы протестировать LLM без цензуры, размещенную на нашей инфраструктуре. Идентификатор модели — просто "uncensored". Этот эндпоинт не фильтрует законный контент для взрослых, творческие тексты или спорные темы, обеспечивая чистый вывод для неограниченного использования. Вы можете отправлять до 8 МБ на тело запроса. Убедитесь, что ваш клиент настроен на обработку стандартной структуры ответа JSON.
curl https://api.uncensoredendpoint.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Проверьте, что ответ содержит сгенерированный текст. Если вы получили ошибку, проверьте действительность ключа или баланс аккаунта. Модель работает с контекстным окном на 100 000 токенов, что позволяет обрабатывать значительные объемы ввода и вывода в одном запросе.
Интеграция с Python SDK
Используйте официальную библиотеку OpenAI Python для взаимодействия с API. Настройте клиент с вашим базовым URL и API-ключом. Библиотека автоматически обрабатывает сериализацию и разбор ошибок. Этот подход идеален для бэкенд-сервисов или конвейеров обработки данных, где вам нужны надежные синхронные вызовы к API без цензуры.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Помните, что идентификатор модели должен быть установлен в "uncensored". SDK будет эффективно управлять HTTP-соединениями. Вы можете настроить таймауты и повторные попытки по мере необходимости для вашей конкретной среды развертывания. Этот метод гарантирует, что вы используете проверенную и поддерживаемую клиентскую библиотеку.
Интеграция с Node SDK
Node.js OpenAI SDK работает идентично версии для Python. Инициализируйте клиент с вашим базовым URL и ключом. Это полезно для серверного рендеринга или API-шлюзов в средах JavaScript. Пакет нативно обрабатывает потоковую передачу и парсинг JSON.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Установите параметр модели в "uncensored". SDK вернет объект ответа, содержащий данные завершения. Вы можете интегрировать это напрямую в маршруты Express или другие фреймворки Node.js. Убедитесь, что ваша среда поддерживает требуемую версию Node.js для выбранного SDK.
Потоковые ответы
Включите потоковую передачу, установив параметр stream в true. API возвращает поток Server-Sent Events (SSE), а не единый объект JSON. Это позволяет отображать токены текста по мере их генерации, улучшая воспринимаемую задержку для конечных пользователей. Каждое событие в потоке содержит частичный фрагмент ответа.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Разбирайте каждое событие SSE, чтобы извлечь содержимое дельты. Это критически важно для интерфейсов чата, где пользователи ожидают эффекты набора текста в реальном времени. Эндпоинт, совместимый с OpenAI и не имеющий цензуры, поддерживает это стандартное поведение потоковой передачи, обеспечивая совместимость с большинством современных веб-клиентов.
Лимиты запросов и ограничения
Каждый API-ключ ограничен 300 запросами в минуту. Если вы превысите этот лимит, API вернет код состояния 429, указывающий на ограничение частоты запросов. Максимальный размер тела запроса составляет 8 МБ. При ошибках аутентификации, таких как недействительный ключ, вы получите код состояния 401. Хотя могут возникать проблемы с предоплаченным балансом, конкретные HTTP-коды для состояний оплаты не гарантируются как согласованные во всех реализациях клиентов.
Контекстное окно составляет 100 000 токенов для промпта и завершения в сумме. Это жесткий лимит; его превышение приведет к ошибке. SLA или гарантии доступности не предоставляются. Сервис предназначен для прямого использования с большими объемами без сложной маршрутизации или агрегации нескольких моделей.
Характеристики API
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| ID модели | uncensored |
| Авторизация | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredendpoint.com/v1 |
| Контекстное окно | 100 000 токенов (вход и ответ вместе) |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Максимум ответа | до остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| JSON-режим | response_format: {"type": "json_object"} |
| Размер запроса | до 8 МБ |
| Лимит запросов | 300 запросов в минуту на ключ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Параллельные запросы | до 8 одновременно на ключ |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Бонус | +5% от $50, +10% от $100 |
| Вход | Google или e-mail и пароль |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Привязан ли API-ключ к конкретной версии модели?
Да, ключ работает исключительно с идентификатором модели "uncensored". Это единая модель с открытыми весами, работающая на наших собственных GPU-серверах, а не сервис маршрутизации между несколькими поставщиками. Вам не нужно вручную управлять версиями модели.
Как работает контекстное окно?
Лимит в 100 000 токенов применяется к сумме вашего входного промпта и сгенерированного вывода. Если общее количество токенов превышает этот лимит, запрос будет отклонен. Это позволяет обрабатывать большие документы или длинные истории переписки в одном вызове API.
Можно ли использовать этот эндпоинт для вызова функций?
Да, эндпоинт chat-completions поддерживает вызов инструментов и функций. Вы можете определить инструменты в запросе, и модель вернет структурированный JSON-вывод при необходимости. Это работает со стандартными библиотеками клиентов, совместимых с OpenAI.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.