VI ▾

Unrestricted: Hướng dẫn nhanh: Tích hợp LLM không kiểm duyệt

Bắt đầu với API không giới hạn trong vài phút. Hướng dẫn này bao gồm URL cơ sở, xác thực và các endpoint cụ thể cần thiết cho việc tạo văn bản thô mà không có bộ lọc nội dung.

URL cơ sở và Xác thực

Để bắt đầu sử dụng unrestricted llm, bạn cần một khóa API từ bảng điều khiển của mình. URL cơ sở cho tất cả các yêu cầu là https://api.unrestricted.cc/v1. URL này tương thích với các SDK chính thức của OpenAI và bất kỳ máy khách nào hỗ trợ các endpoint tương thích với OpenAI. Bạn chỉ cần đặt biến base_url trong cấu hình máy khách của bạn thành giá trị này và cung cấp khóa của bạn trong tiêu đề Authorization dưới dạng token Bearer. API phục vụ một mô hình đơn nhất được xác định là uncensored, đây là một mô hình trọng số mở được tinh chỉnh để trả lời mà không có các từ chối nội dung tiêu chuẩn cho mục đích người dùng trưởng thành hợp pháp.

Yêu cầu đầu tiên

Một yêu cầu cơ bản gửi một prompt đến endpoint hoàn tất trò chuyện. Mô hình trả về văn bản trực tiếp, tránh các bộ lọc từ chối thường thấy trong các trình bao bọc dành cho người tiêu dùng. Điều này khiến nó trở thành một llm mã hóa không kiểm duyệt lý tưởng để tạo các đoạn mã hoặc giải thích kỹ thuật mà không có phần đệm trò chuyện không cần thiết. Gửi yêu cầu POST đến /v1/chat/completions với các thông báo hệ thống và người dùng của bạn. Phản hồi sẽ chứa văn bản được tạo trong mảng choices.

curl https://api.unrestricted.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Tích hợp Python SDK

Sử dụng SDK Python chính thức giúp việc tích hợp trở nên đơn giản. Bạn chỉ cần trỏ khách hàng đến URL cơ sở của chúng tôi. Cách tiếp cận này hoạt động cho cả việc tạo văn bản đơn giản và các cấu trúc prompt phức tạp hơn. SDK tự động xử lý tuần tự hóa JSON, vì vậy bạn có thể tập trung vào logic ứng dụng của mình. Hãy nhớ rằng ID mô hình luôn là uncensored cho dịch vụ này. Endpoint llm không kiểm duyệt trực tuyến này được thiết kế cho các nhà phát triển cần quyền truy cập đáng tin cậy, theo chương trình vào các đầu ra văn bản không được lọc.

from openai import OpenAI

client = OpenAI(base_url="https://api.unrestricted.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Tích hợp Node SDK

Đối với các môi trường JavaScript và TypeScript, SDK Node của OpenAI hoạt động với cấu hình tối thiểu. Khởi tạo máy khách với khóa API và URL cơ sở chính xác của bạn. Sau đó, bạn có thể gọi phương thức hoàn tất hội thoại giống như bạn sẽ làm với các dịch vụ tương thích OpenAI khác. Sự linh hoạt này cho phép bạn đưa API vào các cơ sở mã hiện có mà không cần viết lại logic máy khách HTTP của bạn. Cấu trúc phản hồi khớp với định dạng OpenAI tiêu chuẩn, đảm bảo dễ dàng phân tích cú pháp nội dung được tạo.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unrestricted.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát

Bạn có thể bật chế độ truyền phát bằng cách đặt stream: true trong yêu cầu của mình. API trả dữ liệu dưới dạng Sự kiện được gửi bởi máy chủ (SSE), cho phép bạn xử lý các token khi chúng được tạo. Điều này hữu ích cho các ứng dụng thời gian thực hoặc khi bạn muốn hiển thị tiến trình cho người dùng. Chunk cuối cùng của luồng chứa thống kê sử dụng token. Truyền phát giảm độ trễ cảm nhận bằng cách cung cấp nội dung từng phần thay vì chờ phản hồi đầy đủ hoàn tất.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Giới hạn, Lỗi và Ngữ cảnh

Cửa sổ ngữ cảnh hỗ trợ tổng cộng 100.000 token, với tối đa 32.000 token mỗi yêu cầu. Nếu bạn không chỉ định max_tokens, giới hạn mặc định là 2.048 token. Giới hạn tốc độ được đặt ở mức 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời mỗi khóa. Các lỗi phổ biến bao gồm 401 cho khóa không hợp lệ, 402 cho tín dụng không đủ và 429 cho giới hạn tốc độ. Lỗi không tiêu thụ tín dụng trả trước của bạn. Thân yêu cầu được giới hạn ở 8 MB. Những giới hạn này đảm bảo hiệu suất ổn định cho việc sử dụng API khối lượng lớn.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
EndpointPOST /v1/chat/completions · GET /v1/models
ID mô hìnhuncensored
Base URLhttps://api.unrestricted.cc/v1
Xác thựcAuthorization: Bearer YOUR_KEY
Chế độ JSONresponse_format: {"type": "json_object"}
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Kích thước yêu cầutối đa 8 MB
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Thưởng+5% từ $50, +10% từ $100
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Đăng nhậpGoogle hoặc email và mật khẩu

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

API này có giống với OpenAI API tiêu chuẩn không?

Nó sử dụng cấu trúc JSON và tương thích SDK giống nhau, nhưng phục vụ một mô hình khác. Mô hình không kiểm duyệt và không áp dụng các từ chối nội dung tiêu chuẩn, phù hợp cho các trường hợp sử dụng không giới hạn.

Tôi xử lý lỗi trong mã của mình như thế nào?

Kiểm tra mã trạng thái HTTP. Lỗi 401 có nghĩa là khóa API của bạn không hợp lệ. Lỗi 402 cho biết bạn cần nạp tiền tín dụng. Lỗi 429 có nghĩa là bạn đã vượt quá giới hạn tốc độ. Lỗi không tính phí vào số dư của bạn.

Tôi có thể sử dụng cái này cho các tác vụ lập trình không?

Có. Mô hình hiệu quả như một LLM lập trình không kiểm duyệt, tạo mã và giải thích kỹ thuật mà không lọc dựa trên các chính sách nội dung phổ biến. Nó hỗ trợ gọi hàm và chế độ JSON cho đầu ra có cấu trúc.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.