PT ▾

Unrestricted: Início rápido: Integre o LLM sem censura

Comece com a API sem restrições em minutos. Este guia cobre a URL base, autenticação e os endpoints específicos necessários para geração de texto bruto sem filtros de conteúdo.

URL base e autenticação

Para começar a usar o llm sem censura, você precisa de uma chave de API no seu painel. A URL base para todas as requisições é https://api.unrestricted.cc/v1. Esta URL é compatível com os SDKs oficiais da OpenAI e qualquer cliente que suporte endpoints compatíveis com OpenAI. Basta definir a variável base_url na configuração do seu cliente para este valor e fornecer sua chave no cabeçalho Authorization como um token Bearer. A API fornece um único modelo identificado como uncensored, que é um modelo de pesos abertos ajustado para responder sem recusas de conteúdo padrão para uso adulto lícito.

Primeira requisição

Uma solicitação básica envia um prompt para o endpoint de conclusões de chat. O modelo retorna texto diretamente, evitando os filtros de recusa comuns em wrappers de consumo. Isso o torna um llm de codificação sem censura ideal para gerar trechos de código ou explicações técnicas sem preenchimento conversacional desnecessário. Envie uma solicitação POST para /v1/chat/completions com suas mensagens de sistema e usuário. A resposta conterá o texto gerado no array choices.

curl https://api.unrestricted.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integração com SDK Python

Usar o SDK oficial do Python simplifica a integração. Você só precisa apontar o cliente para nossa URL base. Esta abordagem funciona tanto para geração de texto simples quanto para estruturas de prompt mais complexas. O SDK lida com a serialização JSON automaticamente, então você pode focar na lógica da sua aplicação. Lembre-se de que o ID do modelo é sempre uncensored para este serviço. Este endpoint de llm sem censura online é projetado para desenvolvedores que precisam de acesso programático e confiável a saídas de texto sem filtros.

from openai import OpenAI

client = OpenAI(base_url="https://api.unrestricted.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integração com SDK Node.js

Para ambientes JavaScript e TypeScript, o SDK Node.js da OpenAI funciona com configuração mínima. Inicialize o cliente com sua chave de API e a URL base correta. Você pode então chamar o método de chat completions exatamente como faria com outros serviços compatíveis com OpenAI. Esta flexibilidade permite integrar a API em bases de código existentes sem reescrever a lógica do cliente HTTP. A estrutura da resposta corresponde ao formato padrão da OpenAI, garantindo fácil análise do conteúdo gerado.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unrestricted.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Respostas em streaming

Você pode ativar o streaming definindo stream: true na sua solicitação. A API retorna dados como Server-Sent Events (SSE), permitindo que você processe tokens conforme são gerados. Isso é útil para aplicativos em tempo real ou quando você deseja exibir o progresso ao usuário. O último fragmento do stream contém as estatísticas de uso de tokens. O streaming reduz a latência percebida entregando conteúdo incrementalmente, em vez de esperar que a resposta completa seja concluída.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites, erros e contexto

A janela de contexto suporta 100.000 tokens no total, com uma saída máxima de 32.000 tokens por solicitação. Se você não especificar max_tokens, o limite padrão é de 2.048 tokens. Os limites de taxa são definidos para 300 solicitações por minuto e 8 requisições simultâneas por chave. Erros comuns incluem 401 para chaves inválidas, 402 para crédito insuficiente e 429 para limites de taxa. Erros não consomem seu crédito pré-pago. O corpo da solicitação é limitado a 8 MB. Esses limites garantem desempenho estável para uso de API em alta escala.

Recursos e limites

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
EndpointsPOST /v1/chat/completions · GET /v1/models
ID do modelouncensored
Base URLhttps://api.unrestricted.cc/v1
AutenticaçãoAuthorization: Bearer YOUR_KEY
Modo JSONresponse_format: {"type": "json_object"}
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Janela de contexto100.000 tokens (entrada + saída)
Limite de taxa300 requisições por minuto por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamanhoaté 8 MB por requisição
Concorrência8 requisições ao mesmo tempo por chave
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Validadecrédito pago não expira, sem assinatura
Bônus+5% a partir de $50, +10% a partir de $100
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
Chavesuma chave ativa por conta; uma nova substitui a anterior
LoginGoogle ou e-mail e senha

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Isso é o mesmo que a API padrão da OpenAI?

Ele usa a mesma estrutura JSON e compatibilidade com SDK, mas fornece um modelo diferente. O modelo é sem censura e não aplica recusas de conteúdo padrão, tornando-o adequado para casos de uso irrestritos.

Como lidar com erros no meu código?

Verifique o código de status HTTP. Um erro 401 indica que sua chave de API é inválida. Um erro 402 indica que você precisa recarregar seu crédito. Um erro 429 indica que você excedeu o limite de requisições. Erros não cobram seu saldo.

Posso usar isso para tarefas de codificação?

Sim. O modelo é eficaz como um LLM de programação sem censura, gerando código e explicações técnicas sem filtrar com base em políticas de conteúdo comuns. Suporta chamada de funções e modo JSON para saída estruturada.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.