ES ▾
Obtener clave de API

Cómo usar la API sin censura para integrar LLM NSFW

La API sin censura ofrece un endpoint compatible con OpenAI, sencillo y pensado para desarrolladores que necesitan un LLM que responda sin filtros de contenido. Sirve un único modelo sin censura mediante chat-completions estándar, lo que facilita su integración en código existente para aplicaciones NSFW o de roleplay.

Actualizado

Puntos clave

  • La API utiliza un endpoint compatible con OpenAI, lo que solo requiere cambiar la URL base para los clientes existentes.
  • Sirve un único modelo sin censura con una ventana de contexto de 100k, centrado en la generación de texto sin características adicionales.
  • La facturación es prepago y transparente a $0.25/1M tokens de entrada y $1.00/1M tokens de salida.
  • Las recargas con cripto mediante USDT o USDC son el único método de pago, sin suscripciones ni cuotas mensuales.

¿Qué es la API sin censura?

La API sin censura es un servicio alojado que expone un único modelo de lenguaje grande a través de una interfaz estándar de chat-completions. A diferencia de plataformas que agregan varios modelos o ofrecen interfaces de chat web, este servicio se centra en proporcionar un único modelo sin censura de alto rendimiento para desarrolladores que necesitan generación de texto sin filtros. El modelo está ajustado para responder sin rechazos de contenido para uso adulto legal, lo que lo hace ideal para roleplay, escritura creativa o aplicaciones donde los filtros estándar podrían interferir con la salida.

No es un wrapper alrededor de GPT, Claude o Gemini; es un modelo de pesos abiertos independiente que se ejecuta en servidores dedicados. Esta distinción es importante porque obtienes un perfil de comportamiento consistente en lugar de una capa de enrutamiento que podría cambiar de modelo de forma impredecible. La API maneja texto de entrada y texto de salida, admitiendo streaming, llamadas a funciones y modo JSON, pero no ofrece embeddings, generación de imágenes ni procesamiento de audio.

¿Por qué elegir un LLM sin censura?

Los LLM estándar se entrenan con aprendizaje por refuerzo a partir de comentarios humanos (RLHF) que a menudo resulta en un rechazo excesivo. Pueden rechazar prompts benignos relacionados con violencia, sexualidad o temas controvertidos simplemente porque detectan un patrón que activa un filtro de seguridad. Un LLM sin censura elimina estas restricciones artificiales, permitiendo que el modelo genere contenido basándose en sus datos de entrenamiento sin barreras arbitrarias. Esto es especialmente valioso para aplicaciones NSFW, donde el producto principal es contenido para adultos, y para la escritura creativa donde el usuario quiere que el modelo siga la lógica de la historia en lugar de una política de seguridad corporativa.

  • Consistencia: El modelo no rechaza prompts aleatoriamente basándose en políticas de contenido subjetivas.
  • Salida sin procesar: Obtienes todo el rango de vocabulario y estilo del modelo sin sanitización.
  • Control del desarrollador: Tú gestionas la moderación si es necesario, en lugar de depender de los filtros de caja negra del proveedor.

Compatibilidad con OpenAI explicada

La API sin censura se adhiere a la especificación de Chat Completions de OpenAI. Esto significa que puedes usar los SDK oficiales de OpenAI para Python, Node.js u otros lenguajes, y simplemente cambiar la URL base a https://api.uncensoredaichat.cc/v1. La estructura de la petición permanece idéntica: envías una lista de mensajes con roles como user y assistant, y la API devuelve una completación. Esta compatibilidad reduce la fricción de la integración, ya que no necesitas escribir un cliente HTTP personalizado ni analizar un formato JSON único.

El ID del modelo es simplemente uncensored. También puedes listar los modelos disponibles mediante GET /v1/models. Debido a que sigue el esquema estándar, características como streaming mediante Server-Sent Events (SSE), llamadas a funciones (tools) y modo JSON (response_format: {"type": "json_object"}) funcionan de forma nativa. Esto lo convierte en un reemplazo listo para usar para muchas aplicaciones basadas en OpenAI, siempre que no dependan de peculiaridades específicas del modelo únicas de GPT-4 o similares.

Pasos de integración

Integrar la API sin censura es sencillo si ya estás familiarizado con clientes compatibles con OpenAI. Primero, regístrate para obtener una cuenta usando Google o una dirección de correo electrónico. Recibirás una clave de API inmediatamente, que estará activa al crearse. No es necesario verificar el teléfono ni ingresar una tarjeta de crédito para la prueba, aunque el uso pago requiere recargas con cripto.

A continuación, configura tu cliente. Establece la URL base en https://api.uncensoredaichat.cc/v1 y establece tu clave de API en el encabezado de autorización. Luego, realiza una petición POST a /v1/chat/completions con tu prompt de sistema y mensajes de usuario. La API admite parámetros estándar como temperature, top_p y secuencias stop.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Finalmente, maneja la respuesta. La API devuelve un objeto JSON estándar con el texto generado en choices[0].message.content. Para tareas de larga duración, utiliza streaming para recibir tokens a medida que se generan. Recuerda que la API tiene un límite de peticiones de 300 peticiones por minuto por clave, así que implementa estrategias de retroceso si estás procesando datos masivos.

Streaming y rendimiento

El streaming se admite mediante Server-Sent Events (SSE). Cuando estableces stream: true en tu petición, la API devuelve una serie de fragmentos. Cada fragmento contiene una respuesta parcial, y el fragmento final incluye las estadísticas de uso de tokens. Esto es crucial para aplicaciones en tiempo real como chatbots, donde deseas mostrar el texto a medida que se genera en lugar de esperar la completación completa.

El rendimiento está optimizado para baja latencia. El modelo se aloja en servidores dedicados, lo que garantiza tiempos de respuesta constantes. Sin embargo, ten en cuenta que la API sin censura es un servicio solo de texto. No admite generación de imágenes ni de audio, así que si tu aplicación requiere salidas multimodales, necesitarás gestionarlas por separado. El endpoint de streaming es eficiente y no consume tokens adicionales más allá de los utilizados para la generación de texto real.

Gestión de ventanas de contexto

La API sin censura admite una ventana de contexto de 100.000 tokens, lo que incluye tanto el prompt como la completación. Esto es significativamente mayor que las ventanas estándar de 8k o 32k que se encuentran en muchos otros modelos, lo que te permite pasar conversaciones o documentos más largos sin truncamiento. Sin embargo, la salida máxima por petición es de 32.000 tokens, o 2.048 tokens si no especificas max_tokens.

Para gestionar contextos largos de manera efectiva, debes implementar una estrategia de ventana deslizante o resumen en la lógica de tu aplicación. Envía los mensajes más recientes para mantener el contexto y archiva las partes antiguas si es necesario. La API no gestiona automáticamente el contexto por ti; depende del desarrollador estructurar correctamente la matriz messages. Esto te da control total sobre la información que ve el modelo, lo cual es importante para mantener la consistencia en roleplay de formato largo o análisis de documentos.

Precios y créditos

La API sin censura utiliza un sistema de créditos prepago. No hay suscripciones mensuales ni tarifas ocultas. Recargas tu cuenta con cripto y los créditos se cargan según el uso real de tokens. La facturación es transparente: $0,25 por 1 millón de tokens de entrada y $1,00 por 1 millón de tokens de salida. Los errores y rechazos son gratuitos, así que no pagas por peticiones fallidas.

  • Pagos con cripto: Se aceptan recargas mediante USDT (TRC20) o USDC (Base). La recarga mínima es de $10 y la máxima de $500.
  • Bonificaciones: Recarga $50 o más para un bono del 5%, o $100 o más para un bono del 10%.
  • Sin expiración: Los créditos no caducan, así que puedes usarlos cuando los necesites.

Puedes comenzar con una prueba gratuita de $0,50 válida por 7 días, sin necesidad de tarjeta. Esto te permite probar la API antes de comprometerte con una recarga con cripto.

Casos de uso comunes

La API sin censura es ideal para aplicaciones que requieren generación de texto sin procesar y sin filtros. Los casos de uso comunes incluyen:

  • Roleplay NSFW: Genera contenido para adultos sin que el modelo rechace basándose en políticas de contenido.
  • Escritura creativa: Permite al modelo explorar temas más oscuros o complejos sin restricciones artificiales.
  • Generación de contenido: Produce artículos, historias o guiones que podrían ser marcados por LLM estándar.
  • Aumento de datos: Genera muestras de texto diversas para entrenar o probar otros modelos.

Dado que la API es solo de texto, no es adecuada para aplicaciones que requieren generación de imágenes o audio. Tampoco está diseñada para tareas de alta frecuencia y baja latencia que requieran tiempos de respuesta inferiores a un segundo, ya que el modelo está optimizado para la calidad y la longitud del contexto en lugar de la velocidad. Sin embargo, para la mayoría de las aplicaciones de desarrollo, la API sin censura proporciona una base fiable y flexible.

Preguntas y respuestas

¿La API sin censura admite varios modelos?

No, la API sin censura ofrece un único modelo sin censura. Esto garantiza un comportamiento y un rendimiento coherentes, en lugar de enrutar las peticiones a distintos modelos con capacidades variables. Está pensada para desarrolladores que necesitan un estilo de salida específico y sin filtros.

¿Cómo recargo mi cuenta?

Puedes recargar tu cuenta con criptomonedas. Aceptamos USDT en la red TRC20 o USDC en la red Base. Las recargas oscilan entre $10 y $500, y puedes recibir bonificaciones por importes mayores. No admitimos tarjetas de crédito ni PayPal.

¿La ventana de contexto es realmente de 100k tokens?

Sí, la ventana de contexto total es de 100,000 tokens, incluyendo tanto el prompt como el completado. Sin embargo, la salida máxima por petición es de 32,000 tokens, o 2,048 tokens si no especificas un límite. Esto permite conversaciones largas o procesamiento de documentos.

¿Qué ocurre si me equivoco al recargar?

Los créditos no caducan, así que puedes usarlos cuando los necesites. Si cometes un error, como un cargo doble, puedes contactar con soporte a través de la página de Soporte para resolver el problema. El crédito en sí no se reembolsa, pero el error puede corregirse.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave y cambia la URL base. Eso es todo el proceso de configuración.