NL ▾

Unrestricted: Snelstartgids: Integreer de ongecensureerde LLM

Kom binnen enkele minuten van start met de onbeperkte API. Deze gids behandelt de basis-URL, authenticatie en de specifieke endpoints voor ruwe tekstgeneratie zonder inhoudsfilters.

Basis-URL en authenticatie

Om de ongecensureerde LLM te gebruiken, heb je een API-sleutel nodig vanuit je dashboard. De basis-URL voor alle verzoeken is https://api.unrestricted.cc/v1. Deze URL is compatibel met de officiële OpenAI SDK's en elke client die OpenAI-compatibele endpoints ondersteunt. Stel de variabele base_url in je clientconfiguratie eenvoudig in op deze waarde en lever je sleutel in de Authorization-header als Bearer-token. De API biedt één model aan, geïdentificeerd als uncensored, een open-weight model dat is afgestemd op het geven van antwoorden zonder standaard inhoudelijke weigeringen voor wettelijk volwassen gebruik.

Eerste verzoek

Een basisverzoek stuurt een prompt naar het chatcompleties-endpoint. Het model retourneert tekst direct, waardoor filters die vaak voorkomen in consumenten-wrappers worden vermeden. Dit maakt het een ideaal ongecensureerd coderen LLM voor het genereren van codesnippets of technische uitleg zonder onnodige conversatievulling. Stuur een POST-verzoek naar /v1/chat/completions met je systeem- en gebruikersberichten. Het antwoord bevat de gegenereerde tekst in de choices-array.

curl https://api.unrestricted.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK-integratie

Het gebruik van de officiële Python SDK maakt integratie eenvoudig. Je hoeft de client alleen naar onze basis-URL te verwijzen. Deze aanpak werkt voor zowel eenvoudige tekstgeneratie als complexere promptstructuren. De SDK verwerkt JSON-serialisatie automatisch, zodat je je kunt concentreren op de logica van je applicatie. Onthoud dat de model-ID voor deze dienst altijd uncensored is. Dit ongecensureerde LLM online-endpoint is ontworpen voor ontwikkelaars die betrouwbare, programmatische toegang nodig hebben tot ongefilterde tekstuitvoer.

from openai import OpenAI

client = OpenAI(base_url="https://api.unrestricted.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK-integratie

Voor JavaScript- en TypeScript-omgevingen werkt de OpenAI Node SDK met minimale configuratie. Initialiseer de client met je API-sleutel en de juiste basis-URL. Je kunt vervolgens de chatcompleties-methode aanroepen, net zoals bij andere OpenAI-compatibele diensten. Deze flexibiliteit stelt je in staat de API in bestaande codebases te integreren zonder je HTTP-clientlogica te herschrijven. De responsstructuur komt overeen met de standaard OpenAI-indeling, wat het parseren van de gegenereerde inhoud vergemakkelijkt.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unrestricted.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-antwoorden

Je kunt streaming inschakelen door stream: true in je verzoek in te stellen. De API retourneert gegevens als Server-Sent Events (SSE), waardoor je tokens kunt verwerken zodra ze worden gegenereerd. Dit is handig voor realtime-toepassingen of wanneer je voortgang aan de gebruiker wilt tonen. De laatste chunk van de stream bevat de token-gebruiksstatistieken. Streaming vermindert de waargenomen latentie door inhoud incrementeel te leveren in plaats van te wachten tot de volledige respons klaar is.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limieten, fouten en context

Het contextvenster ondersteent in totaal 100.000 tokens, met een maximum van 32.000 tokens per verzoek. Als je max_tokens niet opgeeft, wordt de limiet standaard ingesteld op 2.048 tokens. Rate limits zijn ingesteld op 300 verzoeken per minuut en 8 gelijktijdige verzoeken per sleutel. Veelvoorkomende fouten zijn 401 voor ongeldige sleutels, 402 voor onvoldoende tegoed en 429 voor rate limits. Fouten verbruiken je prepaid tegoed niet. De request body is beperkt tot 8 MB. Deze limieten zorgen voor stabiele prestaties bij hoogvolume API-gebru.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
EndpointsPOST /v1/chat/completions · GET /v1/models
Model-IDuncensored
Base URLhttps://api.unrestricted.cc/v1
AuthenticatieAuthorization: Bearer YOUR_KEY
JSON-modusresponse_format: {"type": "json_object"}
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Contextvenster100.000 tokens (invoer + uitvoer)
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
Gelijktijdige verzoekentot 8 tegelijk per sleutel
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Bonus+5% vanaf $50, +10% vanaf $100
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is dit hetzelfde als de standaard OpenAI API?

Het gebruikt dezelfde JSON-structuur en SDK-compatibiliteit, maar levert een ander model. Het model is ongecensureerd en past geen standaard inhoudsbeperkingen toe, geschikt voor onbeperkt gebruik.

Hoe verwerk ik fouten in mijn code?

Controleer de HTTP-statuscode. Een 401-fout betekent dat je API-sleutel ongeldig is. Een 402-fout geeft aan dat je je prepaid tegoed moet opwaarderen. Een 429-fout betekent dat je het rate limit hebt overschreden. Fouten belasten je saldo niet.

Kan ik dit gebruiken voor programmeertaken?

Ja. Het model is effectief als ongecensureerde coding llm, genereert code en technische uitleg zonder filtering op basis van veelgebruikt inhoudsbeleid. Het ondersteunt function calling en JSON-modus voor gestructureerde uitvoer.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.