PL ▾

Unrestricted: Szybki start: Zintegruj LLM bez cenzury

Zacznij pracę z API bez ograniczeń w kilka minut. Przewodnik obejmuje podstawowy URL, uwierzytelnianie i konkretne endpointy potrzebne do generowania tekstu bez filtrów treści.

Podstawowy URL i uwierzytelnianie

Aby rozpocząć korzystanie z LLM bez ograniczeń, potrzebujesz klucza API z panelu. Podstawowy URL dla wszystkich zapytań to https://api.unrestricted.cc/v1. Ten URL jest kompatybilny z oficjalnymi SDK OpenAI i dowolnym klientem obsługującym endpointy kompatybilne z OpenAI. Po prostu ustaw zmienną base_url w konfiguracji klienta na tę wartość i podaj swój klucz w nagłówku Authorization jako token Bearer. API obsługuje pojedynczy model zidentyfikowany jako uncensored, który jest modelem o otwartych wagach dostrojonym do odpowiadania bez standardowych odmów treści dla prawnego użytku dorosłego.

Pierwsze zapytanie

Podstawowe zapytanie wysyła prompt do endpointu ukończeń czatu. Model zwraca tekst bezpośrednio, unikając filtrów odmowy powszechnych w interfejsach konsumenckich. Dzięki temu jest to idealny bezcenzuralny LLM do kodowania do generowania fragmentów kodu lub wyjaśnień technicznych bez zbędnego konwersacyjnego wypełnienia. Wyślij żądanie POST do /v1/chat/completions ze swoimi wiadomościami systemowymi i użytkownika. Odpowiedź będzie zawierać wygenerowany tekst w tablicy choices.

curl https://api.unrestricted.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integracja Python SDK

Korzystanie z oficjalnego SDK Pythona upraszcza integrację. Musisz tylko wskazać klientowi nasz podstawowy URL. To podejście działa zarówno do prostego generowania tekstu, jak i bardziej złożonych struktur promptów. SDK automatycznie serializuje JSON, więc możesz skupić się na logice swojej aplikacji. Pamiętaj, że identyfikator modelu to zawsze uncensored dla tej usługi. To endpoint LLM online bez cenzury jest przeznaczony dla programistów, którzy potrzebują niezawodnego, programistycznego dostępu do niesfiltrowanych wyjść tekstowych.

from openai import OpenAI

client = OpenAI(base_url="https://api.unrestricted.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integracja Node SDK

W środowiskach JavaScript i TypeScript SDK Node OpenAI działa przy minimalnej konfiguracji. Zainicjuj klienta swoim kluczem API i poprawnym podstawowym URL. Następnie możesz wywołać metodę ukończeń czatu tak samo jak w innych usługach kompatybilnych z OpenAI. Ta elastyczność pozwala wdrożyć API w istniejących bazach kodu bez przepisywania logiki klienta HTTP. Struktura odpowiedzi odpowiada standardowemu formatowi OpenAI, zapewniając łatwe parsowanie wygenerowanej treści.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unrestricted.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Odpowiedzi strumieniowe

Możesz włączyć strumieniowanie, ustawiając stream: true w swoim żądaniu. API zwraca dane jako zdarzenia wysyłane przez serwer (SSE), pozwalając Ci przetwarzać tokeny w miarę ich generowania. Jest to przydatne w aplikacjach czasu rzeczywistego lub gdy chcesz wyświetlać postęp użytkownikowi. Ostatni fragment strumienia zawiera statystyki użycia tokenów. Strumieniowanie zmniejsza postrzeganą opóźnienie, dostarczając treść inkrementalnie, zamiast czekać na ukończenie pełnej odpowiedzi.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limity, błędy i kontekst

Okno kontekstu obsługuje łącznie 100 000 tokenów, z maksymalną wyjściową liczbą 32 000 tokenów na zapytanie. Jeśli nie określisz max_tokens, limit domyślnie wynosi 2048 tokenów. Limity zapytań są ustawione na 300 zapytań na minutę i 8 równoległych zapytań na klucz. Powszechne błędy obejmują 401 dla nieprawidłowych kluczy, 402 dla niewystarczającego kredytu i 429 dla limitów zapytań. Błędy nie zużywają Twojego przedpłaconego kredytu. Ciało żądania jest ograniczone do 8 MB. Limity te zapewniają stabilną wydajność przy dużym wolumenie użycia API.

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
EndpointyPOST /v1/chat/completions · GET /v1/models
ID modeluuncensored
Base URLhttps://api.unrestricted.cc/v1
UwierzytelnianieAuthorization: Bearer YOUR_KEY
Tryb JSONresponse_format: {"type": "json_object"}
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Limit zapytań300 zapytań na minutę na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozmiar zapytaniado 8 MB
Równoległe zapytaniado 8 jednocześnie na klucz
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Bonus+5% od $50, +10% od $100
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
LogowanieGoogle albo e-mail i hasło

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Czy to to samo co standardowe API OpenAI?

Używa tej samej struktury JSON i kompatybilności SDK, ale obsługuje inny model. Model jest bez cenzury i nie stosuje standardowych odmów treści, co czyni go odpowiednim do zastosowań bez ograniczeń.

Jak obsłużyć błędy w moim kodzie?

Sprawdź kod statusu HTTP. Błąd 401 oznacza, że Twój klucz API jest nieprawidłowy. Błąd 402 wskazuje, że musisz doładować kredyt. Błąd 429 oznacza przekroczenie limitu zapytań. Błędy nie obciążają Twojego salda.

Czy mogę użyć tego do zadań programistycznych?

Tak. Model jest skuteczny jako bezcenzuralny LLM do kodowania, generując kod i wyjaśnienia techniczne bez filtrowania na podstawie powszechnych polityk treści. Obsługuje wywoływanie funkcji i tryb JSON dla danych strukturalnych.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień podstawowy URL. To cała konfiguracja.