JA ▾
API キーを取得

API ドキュメント:無検閲 OpenAI 互換エンドポイント

数分で無検閲の OpenAI 互換エンドポイントを使い始めましょう。標準的な OpenAI SDK を使用してテキストを送信し、予測可能な価格とベンダーロックインなしで制限のないレスポンスを受け取ります。

Base URL と認証

API は標準的な OpenAI インターフェースに従っており、統合は簡単です。すべてのリクエストに Base URL https://api.uncensoredendpoint.com/v1 を使用してください。認証はサインアップ時に生成された単一の API キーに依存します。このキーを Authorization ヘッダーに Bearer トークンとして含めてください。各アカウントはアクティブなキーが 1 つに制限されており、いつでも再生成してアクセスを即時取り消すことができます。このセットアップは標準的な OpenAI 互換エンドポイントをサポートするすべてのクライアントで機能し、独自のプロプライエタリなロックインを回避できます。

最初のリクエスト

インフラストラクチャ上でホストされている無検閲 LLM に標準的なチャット完了リクエストを送信してテストします。モデル ID は単に「uncensored」です。このエンドポイントは法的な成人向けコンテンツ、創作文学、または論争的なトピックをフィルタリングせず、制限のない使用のためのクリーンな出力を提供します。リクエストボディあたり最大 8 MB まで送信できます。クライアントが標準的な JSON レスポンス構造を処理するように構成してください。

curl https://api.uncensoredendpoint.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

レスポンスに生成されたテキストが含まれていることを確認してください。エラーが発生した場合は、キーの有効性またはアカウント残高を確認してください。モデルは 100,000 トークンのコンテキストウィンドウで動作し、単一のリクエスト内で大量の入力と出力を可能にします。

Python SDK 統合

API と対話するために公式の OpenAI Python ライブラリを使用します。クライアントを特定の Base URL と API キーで構成します。ライブラリはシリアライゼーションとエラー解析を自動的に処理します。このアプローチは、無検閲 AI API への信頼性が高く同期された呼び出しが必要なバックエンドサービスやデータ処理パイプラインに最適です。

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

モデル ID を「uncensored」に設定する必要があることを忘れないでください。SDK は HTTP 接続を効率的に管理します。特定のデプロイメント環境に合わせてタイムアウトとリトライを調整できます。この方法により、検証済みでメンテナンスされているクライアントライブラリを使用していることを保証します。

Node SDK 統合

Node.js OpenAI SDK は Python 版と同じように動作します。Base URL とキーでクライアントを初期化します。これは JavaScript 環境でのサーバーサイドレンダリングや API ゲートウェイに役立ちます。パッケージはストリーミング処理と JSON パースをネイティブに処理します。

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

モデルパラメータを「uncensored」に設定します。SDK は完了データを含むレスポンスオブジェクトを返します。これを Express ルートや他の Node.js フレームワークに直接統合できます。SDK を選択する場合、環境が必要な Node.js バージョンをサポートしていることを確認してください。

ストリーミングレスポンス

stream パラメータを true に設定してストリーミングを有効にします。API は単一の JSON オブジェクトではなく、Server-Sent Events (SSE) ストリームを返します。これにより、テキストトークンが生成されるたびにそれらを表示でき、エンドユーザーの知覚されるレイテンシーを改善します。ストリームの各イベントにはレスポンスの部分的なチャンクが含まれています。

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

各 SSE イベントを解析してデルタコンテンツを抽出します。これは、ユーザーがリアルタイムのタイピング効果を期待するチャットインターフェースにとって重要です。無検閲 OpenAI 互換エンドポイントはこの標準的なストリーミング動作をサポートしており、ほとんどの最新のウェブクライアントとの互換性を確保します。

レート制限と制約

各 API キーは 1 分あたり 300 リクエストに制限されています。この制限を超えると、API はレート制限を示す 429 ステータスコードを返します。最大リクエストボディサイズは 8 MB です。無効なキーなどの認証エラーの場合、401 ステータスが返されます。前払いクレジットの問題が発生する場合がありますが、支払い状態の特定の HTTP コードはすべてのクライアント実装で一貫していることが保証されるとは限りません。

コンテキストウィンドウは、プロンプトと完了の合計で 100,000 トークンです。これはハードリミットであり、これを超えるとエラーが発生します。SLA や稼働時間の保証はありません。このサービスは、複雑なルーティングやマルチモデル集約なしで、シンプルで高ボリュームの使用を目的としています。

API 仕様

購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。

項目内容
形式OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作
エンドポイントPOST /v1/chat/completions · GET /v1/models
モデル IDuncensored
認証Authorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredendpoint.com/v1
コンテキスト長100,000 トークン(入力+出力)
ストリーミング対応 — SSE、最後のチャンクにトークン使用量
パラメータtemperature、top_p、stop、seed、presence_penalty、frequency_penalty
関数呼び出し対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送
最大出力100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし)
JSON モードresponse_format: {"type": "json_object"}
リクエストサイズ最大 8 MB
レート制限キーごとに毎分 300 リクエスト
レスポンスヘッダーX-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency
同時実行キーごとに同時 8 リクエストまで
無料トライアル$0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大
課金前払いクレジットから実使用量で課金。エラーと拒否は無料
有効期限購入クレジットは失効なし、サブスクなし
チャージUSDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額
料金入力 100 万トークン $0.25 · 出力 100 万トークン $1.00
ボーナス$50 以上で +5%、$100 以上で +10%
ログインGoogle またはメール+パスワード
キーアカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効
コンテンツ成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否

エラーコード

エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。

コードタイプ意味
400bad_requestJSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過
401missing_key · invalid_key · key_revokedキーなし・誤り・新しいキーに置換済み
402no_credit残高ゼロ — チャージすれば即再開
403content_blocked未成年者を含む性的コンテンツ — 拒否、課金なし
404not_found不明なエンドポイント
413request_too_large本文が 8 MB 超
429rate_limited · concurrency毎分 300 回または同時 8 件を超過 — 待って再試行
503upstream_busyモデル混雑 — 数秒後に再試行

質問と回答

無検閲 AI API キーは特定のモデルバージョンに紐付きますか?

はい、キーは「uncensored」モデル ID のみで動作します。これは複数のベンダー間のルーティングサービスではなく、自社の GPU サーバーで実行される単一のオープンウェイトモデルです。モデルのバージョン管理を手動で行う必要はありません。

コンテキストウィンドウはどのように機能しますか?

100,000 トークンの制限は、入力プロンプトと生成された出力の合計に適用されます。結合されたトークン数がこれを超えると、リクエストは失敗します。これにより、単一の API 呼び出しで大きなドキュメントや長い会話履歴が可能になります。

このエンドポイントで関数呼び出しを使用できますか?

はい、chat-completions エンドポイントはツールと関数呼び出しをサポートしています。リクエストでツールを定義すると、適切な場合にモデルは構造化された JSON 出力を返します。これは標準的な OpenAI 互換クライアントライブラリで動作します。

キーはフォーム 1 つで手に入ります

アカウントを作成し、キーをコピーし、Base URL を変更します。それがセットアップ全体です。

API キーを取得ドキュメントを読む