Unrestricted: 시작하기: 무검열 LLM 통합
몇 분 안에 제한 없는 API를 시작하세요. 이 가이드는 콘텐츠 필터 없이 원시 텍스트 생성에 필요한 기본 URL, 인증 및 특정 엔드포인트를 다룹니다.
기본 URL 및 인증
무제한 LLM을 사용하려면 대시보드에서 API 키가 필요합니다. 모든 요청의 Base URL은 https://api.unrestricted.cc/v1입니다. 이 URL은 공식 OpenAI SDK와 OpenAI 호환 엔드포인트를 지원하는 모든 클라이언트와 호환됩니다. 클라이언트 구성에서 base_url 변수를 이 값으로 설정하고 Authorization 헤더에 Bearer 토큰으로 키를 제공하세요. API는 uncensored로 식별되는 단일 모델을 제공하며, 이는 합법적인 성인 사용에 대해 일반적인 콘텐츠 거부 없이 응답하도록 조정된 오픈 웨이트 모델입니다.
첫 번째 요청
기본 요청은 프롬프트를 채팅 완성 엔드포인트로 전송합니다. 모델은 소비자 래퍼에서 흔히 볼 수 있는 거부 필터를 피하고 텍스트를 직접 반환합니다. 이는 불필요한 대화적 여백 없이 코드 스니펫이나 기술적 설명을 생성하는 데 이상적인 무검열 코딩 LLM입니다. 시스템 및 사용자 메시지와 함께 /v1/chat/completions로 POST 요청을 보내세요. 응답에는 choices 배열에 생성된 텍스트가 포함됩니다.
curl https://api.unrestricted.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK 통합
공식 Python SDK를 사용하면 통합이 단순해집니다. 클라이언트를 기본 URL로 지정하기만 하면 됩니다. 이 방법은 단순 텍스트 생성과 더 복잡한 프롬프트 구조 모두에 적용됩니다. SDK는 JSON 직렬화를 자동으로 처리하므로 애플리케이션 로직에 집중할 수 있습니다. 이 서비스의 모델 ID는 항상 uncensored입니다. 이 무검열 LLM 온라인 엔드포인트는 필터링되지 않은 텍스트 출력에 대한 신뢰할 수 있는 프로그래밍식 접근이 필요한 개발자를 위해 설계되었습니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.unrestricted.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK 통합
JavaScript 및 TypeScript 환경에서는 OpenAI Node SDK가 최소한의 구성으로 작동합니다. API 키와 올바른 기본 URL로 클라이언트를 초기화하세요. 그런 다음 다른 OpenAI 호환 서비스에서 하듯 채팅 완료 메서드를 호출할 수 있습니다. 이 유연성은 HTTP 클라이언트 로직을 다시 작성하지 않고도 기존 코드베이스에 API를 삽입할 수 있게 합니다. 응답 구조는 표준 OpenAI 형식과 일치하여 생성된 콘텐츠의 쉬운 파싱을 보장합니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unrestricted.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍 응답
요청에 stream: true을 설정하여 스트리밍을 활성화할 수 있습니다. API는 서버 전송 이벤트(SSE)로 데이터를 반환하여 생성되는 토큰을 처리할 수 있게 합니다. 이는 실시간 애플리케이션이나 사용자에게 진행 상황을 표시하려는 경우에 유용합니다. 스트림의 마지막 청크에는 토큰 사용량 통계가 포함됩니다. 스트리밍은 전체 응답이 완료될 때까지 기다리는 대신 콘텐츠를 점진적으로 제공하여 지각된 지연 시간을 줄입니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
제한, 오류 및 컨텍스트
컨텍스트 창은 총 100,000개의 토큰을 지원하며, 요청당 최대 출력은 32,000개의 토큰입니다. max_tokens을 지정하지 않으면 제한은 2,048개로 기본값이 설정됩니다. 속도 제한은 분당 300개 요청 및 키당 8개의 동시 요청으로 설정됩니다. 일반적인 오류로는 유효하지 않은 키에 대한 401, 잔액 부족에 대한 402, 속도 제한에 대한 429가 있습니다. 오류는 선불 크레딧을 소모하지 않습니다. 요청 본문의 크기는 8 MB로 제한됩니다. 이러한 제한은 대용량 API 사용에 안정적인 성능을 보장합니다.
기술 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 모델 ID | uncensored |
| Base URL | https://api.unrestricted.cc/v1 |
| 인증 | Authorization: Bearer YOUR_KEY |
| JSON 모드 | response_format: {"type": "json_object"} |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 속도 제한 | 키당 분당 300회 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 요청 크기 | 최대 8 MB |
| 동시 요청 | 키당 동시 8개 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
| 로그인 | Google 또는 이메일과 비밀번호 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
표준 OpenAI API와 동일한가요?
동일한 JSON 구조와 SDK 호환성을 사용하지만 다른 모델을 제공합니다. 이 모델은 무검열이며 표준 콘텐츠 거부를 적용하지 않아 제한 없는 사용 사례에 적합합니다.
코드에서 오류를 어떻게 처리하나요?
HTTP 상태 코드를 확인하세요. 401 오류는 API 키가 유효하지 않음을 의미합니다. 402 오류는 크레딧 충전이 필요함을 나타냅니다. 429 오류는 속도 제한을 초과했음을 의미합니다. 오류는 잔액에 청구되지 않습니다.
코딩 작업에 사용할 수 있나요?
네. 이 모델은 일반적인 콘텐츠 정책 기반 필터링 없이 코드와 기술적 설명을 생성하는 무검열 코딩 LLM으로 효과적입니다. 구조화된 출력을 위해 함수 호출과 JSON 모드를 지원합니다.