Pontos principais
- A API usa um endpoint padrão compatível com OpenAI, exigindo apenas a alteração da URL base para clientes existentes.
- Ela serve um único modelo sem censura com uma janela de contexto de 100k, focando na geração de texto bruto sem recursos extras.
- O preço é pré-pago e transparente: $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída.
- Recargas via cripto com USDT ou USDC são o único método de pagamento, sem bloqueios de assinatura ou taxas mensais.
O que é a API sem censura?
A API sem censura é um serviço hospedado que expõe um único modelo de linguagem grande através de uma interface padrão de chat-completions. Diferente de plataformas que agregam vários modelos ou oferecem interfaces de chat na web, este serviço foca em fornecer um único modelo sem censura de alto desempenho para desenvolvedores que precisam de geração de texto bruto e sem filtros. O modelo é ajustado para responder sem recusas de conteúdo para uso adulto legal, sendo ideal para roleplay, escrita criativa ou aplicativos onde os filtros padrão podem interferir na saída.
Não é um wrapper em torno do GPT, Claude ou Gemini; é um modelo de pesos abertos independente executado em servidores dedicados. Essa distinção é importante porque você está obtendo um perfil de comportamento consistente, em vez de uma camada de roteamento que pode alternar modelos de forma imprevisível. A API lida com texto de entrada e texto de saída, suportando streaming, chamada de funções e modo JSON, mas não oferece embeddings, geração de imagens ou processamento de áudio.
Por que escolher um LLM sem censura?
LLMs padrão são treinados com aprendizado por reforço a partir de feedback humano (RLHF) que frequentemente resulta em recusas excessivas. Eles podem recusar prompts benignos relacionados a violência, sexualidade ou tópicos controversos simplesmente porque detectam um padrão que aciona um filtro de segurança. Um LLM sem censura remove essas restrições artificiais, permitindo que o modelo gere conteúdo com base em seus dados de treinamento sem guardrails arbitrários. Isso é particularmente valioso para aplicativos NSFW, onde o produto principal é conteúdo adulto, e para escrita criativa onde o usuário quer que o modelo siga a lógica da história em vez de uma política de segurança corporativa.
- Consistência: O modelo não recusa prompts aleatoriamente com base em políticas de conteúdo subjetivas.
- Saída bruta: Você obtém toda a gama de vocabulário e estilo do modelo sem sanitização.
- Controle do desenvolvedor: Você gerencia a moderação você mesmo se necessário, em vez de depender dos filtros de caixa preta do provedor.
Explicação da compatibilidade com OpenAI
A API sem censura adere à especificação OpenAI Chat Completions. Isso significa que você pode usar os SDKs oficiais da OpenAI para Python, Node.js ou outras linguagens, e simplesmente alterar a URL base para https://api.uncensoredaichat.cc/v1. A estrutura da requisição permanece idêntica: você envia uma lista de mensagens com papéis como user e assistant, e a API retorna uma conclusão. Essa compatibilidade reduz o atrito da integração, pois você não precisa escrever um cliente HTTP personalizado ou analisar um formato JSON exclusivo.
O ID do modelo é simplesmente uncensored. Você também pode listar modelos disponíveis via GET /v1/models. Como segue o esquema padrão, recursos como streaming via Server-Sent Events (SSE), chamada de funções (ferramentas) e modo JSON (response_format: {"type": "json_object"}) funcionam imediatamente. Isso o torna uma substituição pronta para usar para muitos aplicativos baseados em OpenAI, desde que não dependam de peculiaridades específicas do modelo únicas do GPT-4 ou similares.
Etapas de integração
Integrar a API sem censura é direto se você já está familiarizado com clientes compatíveis com OpenAI. Primeiro, faça login em uma conta usando Google ou um endereço de e-mail. Você receberá uma chave de API imediatamente, que fica ativa assim que criada. Não há necessidade de verificação por telefone ou entrada de cartão de crédito para o teste, embora o uso pago exija recargas de cripto.
Em seguida, configure seu cliente. Defina a URL base para https://api.uncensoredaichat.cc/v1 e defina sua chave de API no cabeçalho de autorização. Em seguida, faça uma requisição POST para /v1/chat/completions com seu prompt de sistema e mensagens de usuário. A API suporta parâmetros padrão como temperature, top_p e sequências stop.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Finalmente, processe a resposta. A API retorna um objeto JSON padrão com o texto gerado em choices[0].message.content. Para tarefas de longa duração, use streaming para receber tokens conforme são gerados. Lembre-se de que a API tem um limite de requisições de 300 requisições por minuto por chave, então implemente estratégias de backoff se estiver processando dados em massa.
Streaming e desempenho
O streaming é suportado via Server-Sent Events (SSE). Quando você define stream: true na sua requisição, a API retorna uma série de chunks. Cada chunk contém uma resposta parcial, e o chunk final inclui as estatísticas de uso de tokens. Isso é crucial para aplicativos em tempo real como chatbots, onde você deseja exibir texto conforme é gerado em vez de esperar pela conclusão completa.
O desempenho é otimizado para baixa latência. O modelo é hospedado em servidores dedicados, garantindo tempos de resposta consistentes. No entanto, tenha em mente que a API sem censura é um serviço apenas de texto. Ela não suporta geração de imagens ou áudio, então se o seu aplicativo requer saídas multimodais, você precisará lidar com isso separadamente. O endpoint de streaming é eficiente e não consome tokens extras além do que é usado para a geração de texto real.
Gerenciamento de janelas de contexto
A API sem censura suporta uma janela de contexto de 100.000 tokens, o que inclui tanto o prompt quanto a conclusão. Isso é significativamente maior que as janelas padrão de 8k ou 32k encontradas em muitos outros modelos, permitindo que você envie conversas ou documentos mais longos sem truncamento. No entanto, a saída máxima por requisição é de 32.000 tokens, ou 2.048 tokens se você não especificar max_tokens.
Para gerenciar contextos longos de forma eficaz, você deve implementar uma estratégia de janela deslizante ou sumarização na lógica do seu aplicativo. Envie as mensagens mais recentes para manter o contexto e arquivar partes mais antigas se necessário. A API não gerencia o contexto automaticamente para você; cabe ao desenvolvedor estruturar corretamente o array messages. Isso lhe dá controle total sobre as informações que o modelo vê, o que é importante para manter a consistência em roleplay de longo prazo ou análise de documentos.
Preços e créditos
A API sem censura usa um sistema de crédito pré-pago. Não há assinaturas mensais ou taxas ocultas. Você recarrega sua conta com cripto, e os créditos são cobrados com base no uso real de tokens. O preço é transparente: $0,25 por 1 milhão de tokens de entrada e $1,00 por 1 milhão de tokens de saída. Erros e recusas são gratuitos, então você não paga por requisições falhas.
- Pagamentos com cripto: Recargas são aceitas via USDT (TRC20) ou USDC (Base). Recarga mínima é $10, máxima é $500.
- Bônus: Recarregue $50 ou mais para um bônus de 5%, ou $100 ou mais para um bônus de 10%.
- Sem expiração: Créditos nunca expiram, então você pode usá-los quando precisar.
Você pode começar com um teste grátis de $0,50 válido por 7 dias, sem necessidade de cartão. Isso permite que você teste a API antes de se comprometer com uma recarga de cripto.
Casos de uso comuns
A API sem censura é ideal para aplicativos que requerem geração de texto bruto e sem filtros. Casos de uso comuns incluem:
- Roleplay NSFW: Gere conteúdo adulto sem que o modelo recuse com base em políticas de conteúdo.
- Escrita criativa: Permita que o modelo explore temas mais sombrios ou complexos sem restrições artificiais.
- Geração de conteúdo: Produza artigos, histórias ou roteiros que podem ser sinalizados por LLMs padrão.
- Aumento de dados: Gere amostras de texto diversificadas para treinar ou testar outros modelos.
Como a API é apenas de texto, não é adequada para aplicativos que requerem geração de imagens ou áudio. Também não é projetada para tarefas de alta frequência e baixa latência que requerem tempos de resposta subsegundos, pois o modelo é otimizado para qualidade e comprimento de contexto em vez de velocidade. Para a maioria dos aplicativos de desenvolvimento, no entanto, a API sem censura fornece uma base confiável e flexível.