API OpenAI compatível sem filtros para uso adulto

https://api.llmsemcensura.com/v1uncensored

Integração Rápida com Nossa API

Integre nossa API OpenAI compatível em minutos para gerar texto sem recusas de conteúdo adulto. Utilize o endpoint de chat-completions com o modelo 'uncensored' e tenha controle total sobre o contexto de 64.000 tokens.

https://api.llmsemcensura.com/v1uncensored

Autenticação e Base URL

Para começar, acesse nossa plataforma e crie uma conta apenas com e-mail e senha. Após a confirmação, sua chave de API será exibida imediatamente. Não é necessário cartão de crédito para o trial. Utilize a base URL https://api.llmsemcensura.com/v1 em seus clientes e defina a chave no cabeçalho Authorization: Bearer SUA_CHAVE. O modelo a ser invocado é identificado por uncensored.

Endpoint Chat Completions

O endpoint POST /v1/chat/completions é a única rota necessária para uso textual. Envie mensagens na estrutura de messages e receba respostas diretas. Não oferecemos embeddings ou geração de imagens. O modelo é aberto e roda em nossos servidores GPU, sem uso dos dados para treinamento de outros modelos. Configure o model como uncensored nas requisições.

Exemplo básico de requisição:

curl https://api.llmsemcensura.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Suporte a Streaming (SSE)

Para aplicações que exigem baixa latência percebida, ative o streaming definindo stream: true. A API retornará um fluxo de eventos Server-Sent Events (SSE), permitindo a exibição do texto token por token. Isso é ideal para interfaces de chat responsivas. O cliente deve processar o stream até o evento done.

Exemplo de uso com streaming:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Function Calling e Tools

O modelo suporta chamadas de função nativas. Você pode definir tools no corpo da requisição para que a IA retorne argumentos estruturados em vez de texto livre. Isso facilita a integração com sistemas externos. O formato de resposta segue o padrão OpenAI, retornando tool_calls quando apropriado.

Gerenciamento de Tokens e Limite

O contexto total (prompt + completion) é limitado a 64.000 tokens. O preço é de $0,25 por 1M de tokens de entrada e $1,00 por 1M de saída. O crédito pago nunca expira. Você pode recarregar a partir de $10, com bônus de +5% acima de $50 e +10% acima de $100. O trial inicial oferece $0,50 válidos por 7 dias.

Exemplo de Código Python

A biblioteca oficial openai funciona nativamente. Basta alterar a base_url e fornecer sua chave. O código abaixo demonstra uma interação simples. Certifique-se de instalar o pacote via pip antes de executar.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmsemcensura.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmsemcensura.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Especificações técnicas

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
AutenticaçãoAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.llmsemcensura.com/v1
ID do modelouncensored
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Saída máximaaté 16.000 tokens por requisição (padrão 2.048)
Modo JSONresponse_format: {"type": "json_object"}
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Janela de contexto64.000 tokens (entrada + saída)
Limite de taxa300 requisições por minuto por chave
Tamanhoaté 8 MB por requisição
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrência8 requisições ao mesmo tempo por chave
Validadecrédito pago não expira, sem assinatura
Bônus+5% a partir de $50, +10% a partir de $100
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Teste grátis$0,50 por 7 dias, sem cartão
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas frequentes

Qual é a diferença entre este modelo e o GPT ou Claude?

Nosso modelo é aberto, rodado em hardware próprio e não utiliza seus prompts para treinar outros modelos. Ele é configurado especificamente para não recusar conteúdo adulto legal, diferentemente dos modelos padrão da OpenAI ou Anthropic. Não é uma versão do GPT ou Claude.

O que acontece se eu exceder o limite de taxa?

Se você ultrapassar 300 requisições por minuto, receberá um erro HTTP 429 (Too Many Requests). O corpo da resposta indicará o limite excedido. Reduza a frequência das chamadas ou aguarde o reset do window de 60 segundos.

Como funciona o bloqueio de conteúdo?

O modelo é 'sem censura' para conteúdo adulto, político e controverso, mas mantém um limite rígido: conteúdo sexual envolvendo menores é sempre bloqueado. Não incentivamos uso ilegal, mas não aplicamos filtros morais padrão para usuários adultos.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave e altere a URL base. É toda a configuração.

Obter chave da APIhttps://api.llmsemcensura.com/v1