Unrestricted: Szybki start: Zintegruj LLM bez cenzury
Zacznij pracę z API bez ograniczeń w kilka minut. Przewodnik obejmuje podstawowy URL, uwierzytelnianie i konkretne endpointy potrzebne do generowania tekstu bez filtrów treści.
Podstawowy URL i uwierzytelnianie
Aby rozpocząć korzystanie z LLM bez ograniczeń, potrzebujesz klucza API z panelu. Podstawowy URL dla wszystkich zapytań to https://api.unrestricted.cc/v1. Ten URL jest kompatybilny z oficjalnymi SDK OpenAI i dowolnym klientem obsługującym endpointy kompatybilne z OpenAI. Po prostu ustaw zmienną base_url w konfiguracji klienta na tę wartość i podaj swój klucz w nagłówku Authorization jako token Bearer. API obsługuje pojedynczy model zidentyfikowany jako uncensored, który jest modelem o otwartych wagach dostrojonym do odpowiadania bez standardowych odmów treści dla prawnego użytku dorosłego.
Pierwsze zapytanie
Podstawowe zapytanie wysyła prompt do endpointu ukończeń czatu. Model zwraca tekst bezpośrednio, unikając filtrów odmowy powszechnych w interfejsach konsumenckich. Dzięki temu jest to idealny bezcenzuralny LLM do kodowania do generowania fragmentów kodu lub wyjaśnień technicznych bez zbędnego konwersacyjnego wypełnienia. Wyślij żądanie POST do /v1/chat/completions ze swoimi wiadomościami systemowymi i użytkownika. Odpowiedź będzie zawierać wygenerowany tekst w tablicy choices.
curl https://api.unrestricted.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integracja Python SDK
Korzystanie z oficjalnego SDK Pythona upraszcza integrację. Musisz tylko wskazać klientowi nasz podstawowy URL. To podejście działa zarówno do prostego generowania tekstu, jak i bardziej złożonych struktur promptów. SDK automatycznie serializuje JSON, więc możesz skupić się na logice swojej aplikacji. Pamiętaj, że identyfikator modelu to zawsze uncensored dla tej usługi. To endpoint LLM online bez cenzury jest przeznaczony dla programistów, którzy potrzebują niezawodnego, programistycznego dostępu do niesfiltrowanych wyjść tekstowych.
from openai import OpenAI
client = OpenAI(base_url="https://api.unrestricted.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integracja Node SDK
W środowiskach JavaScript i TypeScript SDK Node OpenAI działa przy minimalnej konfiguracji. Zainicjuj klienta swoim kluczem API i poprawnym podstawowym URL. Następnie możesz wywołać metodę ukończeń czatu tak samo jak w innych usługach kompatybilnych z OpenAI. Ta elastyczność pozwala wdrożyć API w istniejących bazach kodu bez przepisywania logiki klienta HTTP. Struktura odpowiedzi odpowiada standardowemu formatowi OpenAI, zapewniając łatwe parsowanie wygenerowanej treści.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unrestricted.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Odpowiedzi strumieniowe
Możesz włączyć strumieniowanie, ustawiając stream: true w swoim żądaniu. API zwraca dane jako zdarzenia wysyłane przez serwer (SSE), pozwalając Ci przetwarzać tokeny w miarę ich generowania. Jest to przydatne w aplikacjach czasu rzeczywistego lub gdy chcesz wyświetlać postęp użytkownikowi. Ostatni fragment strumienia zawiera statystyki użycia tokenów. Strumieniowanie zmniejsza postrzeganą opóźnienie, dostarczając treść inkrementalnie, zamiast czekać na ukończenie pełnej odpowiedzi.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limity, błędy i kontekst
Okno kontekstu obsługuje łącznie 100 000 tokenów, z maksymalną wyjściową liczbą 32 000 tokenów na zapytanie. Jeśli nie określisz max_tokens, limit domyślnie wynosi 2048 tokenów. Limity zapytań są ustawione na 300 zapytań na minutę i 8 równoległych zapytań na klucz. Powszechne błędy obejmują 401 dla nieprawidłowych kluczy, 402 dla niewystarczającego kredytu i 429 dla limitów zapytań. Błędy nie zużywają Twojego przedpłaconego kredytu. Ciało żądania jest ograniczone do 8 MB. Limity te zapewniają stabilną wydajność przy dużym wolumenie użycia API.
Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| ID modelu | uncensored |
| Base URL | https://api.unrestricted.cc/v1 |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Tryb JSON | response_format: {"type": "json_object"} |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozmiar zapytania | do 8 MB |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Bonus | +5% od $50, +10% od $100 |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy to to samo co standardowe API OpenAI?
Używa tej samej struktury JSON i kompatybilności SDK, ale obsługuje inny model. Model jest bez cenzury i nie stosuje standardowych odmów treści, co czyni go odpowiednim do zastosowań bez ograniczeń.
Jak obsłużyć błędy w moim kodzie?
Sprawdź kod statusu HTTP. Błąd 401 oznacza, że Twój klucz API jest nieprawidłowy. Błąd 402 wskazuje, że musisz doładować kredyt. Błąd 429 oznacza przekroczenie limitu zapytań. Błędy nie obciążają Twojego salda.
Czy mogę użyć tego do zadań programistycznych?
Tak. Model jest skuteczny jako bezcenzuralny LLM do kodowania, generując kod i wyjaśnienia techniczne bez filtrowania na podstawie powszechnych polityk treści. Obsługuje wywoływanie funkcji i tryb JSON dla danych strukturalnych.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień podstawowy URL. To cała konfiguracja.