VI ▾
Lấy khóa API

Tài liệu API: Endpoint tương thích OpenAI không kiểm duyệt

Bắt đầu với endpoint tương thích OpenAI không kiểm duyệt của chúng tôi chỉ trong vài phút. Sử dụng các SDK OpenAI tiêu chuẩn để gửi văn bản và nhận phản hồi không hạn chế với giá cả dự đoán được và không bị khóa nhà cung cấp.

URL cơ bản và Xác thực

API tuân theo giao diện OpenAI tiêu chuẩn, giúp việc tích hợp trở nên đơn giản. Sử dụng base URL https://api.uncensoredendpoint.com/v1 cho tất cả các yêu cầu. Xác thực dựa trên một khóa API duy nhất được tạo khi đăng ký. Bao gồm khóa này trong header Authorization dưới dạng token Bearer. Mỗi tài khoản chỉ giới hạn một khóa hoạt động, có thể được tạo lại bất cứ lúc nào để thu hồi quyền truy cập ngay lập tức. Cấu hình này hoạt động với bất kỳ client nào hỗ trợ các endpoint tương thích OpenAI tiêu chuẩn, đảm bảo bạn tránh được tình trạng khóa độc quyền.

Yêu cầu đầu tiên

Gửi một yêu cầu hoàn thành hội thoại tiêu chuẩn để kiểm tra LLM không kiểm duyệt được lưu trữ trên cơ sở hạ tầng của chúng tôi. ID mô hình đơn giản là "uncensored". Endpoint này không lọc nội dung người lớn hợp pháp, văn học sáng tạo hoặc các chủ đề gây tranh cãi, cung cấp kết quả sạch để sử dụng không giới hạn. Bạn có thể gửi tối đa 8 MB cho mỗi thân yêu cầu. Đảm bảo client của bạn được cấu hình để xử lý cấu trúc phản hồi JSON tiêu chuẩn.

curl https://api.uncensoredendpoint.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Xác minh phản hồi bao gồm văn bản được tạo. Nếu bạn nhận được lỗi, hãy kiểm tra tính hợp lệ của khóa hoặc số dư tài khoản. Mô hình hoạt động với cửa sổ ngữ cảnh 100.000 token, cho phép đầu vào và đầu ra đáng kể trong một yêu cầu đơn lẻ.

Tích hợp SDK Python

Sử dụng thư viện Python chính thức của OpenAI để tương tác với API. Cấu hình client với base URL và khóa API cụ thể của bạn. Thư viện tự động xử lý việc tuần tự hóa và phân tích lỗi. Cách tiếp cận này lý tưởng cho các dịch vụ backend hoặc quy trình xử lý dữ liệu nơi bạn cần các cuộc gọi đồng bộ, đáng tin cậy vào API AI không kiểm duyệt.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredendpoint.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Nhớ rằng ID mô hình phải được đặt thành "uncensored". SDK sẽ quản lý các kết nối HTTP một cách hiệu quả. Bạn có thể điều chỉnh thời gian chờ và thử lại khi cần cho môi trường triển khai cụ thể của mình. Phương pháp này đảm bảo bạn đang sử dụng thư viện client đã được xác minh và duy trì.

Tích hợp SDK Node.js

SDK OpenAI Node.js hoạt động giống hệt phiên bản Python. Khởi tạo client với URL cơ bản và khóa của bạn. Điều này hữu ích cho việc hiển thị phía máy chủ hoặc cổng API trong môi trường JavaScript. Gói phần mềm xử lý xử lý luồng và phân tích JSON một cách bản địa.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredendpoint.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Đặt tham số mô hình thành "uncensored". SDK sẽ trả về một đối tượng phản hồi chứa dữ liệu hoàn thành. Bạn có thể tích hợp trực tiếp vào các tuyến Express hoặc các khung công tác Node.js khác. Đảm bảo môi trường của bạn hỗ trợ phiên bản Node.js yêu cầu cho SDK bạn đã chọn.

Phản hồi truyền phát

Bật truyền phát bằng cách đặt tham số stream thành true. API trả về luồng Sự kiện gửi máy chủ (SSE), không phải một đối tượng JSON đơn lẻ. Điều này cho phép bạn hiển thị các token văn bản khi chúng được tạo, cải thiện độ trễ cảm nhận cho người dùng cuối. Mỗi sự kiện trong luồng chứa một phần nhỏ của phản hồi.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Phân tích từng sự kiện SSE để trích xuất nội dung delta. Điều này rất quan trọng cho các giao diện trò chuyện nơi người dùng mong đợi hiệu ứng gõ theo thời gian thực. Endpoint tương thích OpenAI không kiểm duyệt hỗ trợ hành vi truyền phát tiêu chuẩn này, đảm bảo tương thích với hầu hết các client web hiện đại.

Giới hạn tốc độ và Ràng buộc

Mỗi khóa API bị giới hạn 300 yêu cầu mỗi phút. Nếu bạn vượt quá giới hạn này, API sẽ trả về mã trạng thái 429 cho biết giới hạn tốc độ. Kích thước thân yêu cầu tối đa là 8 MB. Đối với lỗi xác thực, chẳng hạn như khóa không hợp lệ, bạn sẽ nhận được mã trạng thái 401. Trong khi các vấn đề về tín dụng trả trước có thể xảy ra, các mã HTTP cụ thể cho trạng thái thanh toán không được đảm bảo là nhất quán trên tất cả các triển khai client.

Cửa sổ ngữ cảnh là 100.000 token cho cả prompt và kết hợp hoàn thành. Đây là giới hạn cứng; vượt quá nó sẽ dẫn đến lỗi. Không có SLA hoặc bảo đảm thời gian hoạt động nào được cung cấp. Dịch vụ được thiết kế cho việc sử dụng khối lượng cao, đơn giản mà không có định tuyến phức tạp hoặc tổng hợp đa mô hình.

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
EndpointPOST /v1/chat/completions · GET /v1/models
ID mô hìnhuncensored
Xác thựcAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredendpoint.com/v1
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Chế độ JSONresponse_format: {"type": "json_object"}
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thưởng+5% từ $50, +10% từ $100
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Khóa API AI không kiểm duyệt có gắn với một phiên bản mô hình cụ thể không?

Có, khóa này hoạt động độc quyền với ID mô hình "uncensored". Đây là một mô hình trọng số mở duy nhất chạy trên máy chủ GPU của chúng tôi, không phải dịch vụ định tuyến giữa nhiều nhà cung cấp. Bạn không cần quản lý phiên bản mô hình thủ công.

Cửa sổ ngữ cảnh hoạt động như thế nào?

Giới hạn 100.000 token áp dụng cho tổng số token của prompt đầu vào và kết quả tạo ra. Nếu tổng số token của bạn vượt quá giới hạn này, yêu cầu sẽ thất bại. Điều này cho phép xử lý tài liệu lớn hoặc lịch sử hội thoại dài trong một lệnh gọi API.

Tôi có thể sử dụng endpoint này cho gọi hàm không?

Có, endpoint chat-completions hỗ trợ gọi công cụ và hàm. Bạn có thể định nghĩa công cụ trong yêu cầu của mình, và mô hình sẽ trả về kết quả JSON có cấu trúc khi thích hợp. Điều này hoạt động với các thư viện client tương thích OpenAI tiêu chuẩn.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ thiết lập.

Lấy khóa APIĐọc tài liệu