IT ▾
Ottieni la chiave API

Come usare l'API senza censura per l'integrazione di LLM NSFW

L'API senza censura offre un endpoint semplice e compatibile con OpenAI per gli sviluppatori che necessitano di un LLM che risponda senza filtri sui contenuti. Offre un unico modello senza censura tramite chat-completions standard, rendendo facile l'integrazione in codebase esistenti per applicazioni NSFW o di roleplay.

Aggiornato

Punti chiave

  • L'API utilizza un endpoint standard compatibile con OpenAI, richiedendo solo un cambio dell'URL di base per i client esistenti.
  • Offre un unico modello senza censura con una finestra di contesto di 100k, focalizzato sulla generazione di testo grezzo senza funzionalità extra.
  • I prezzi sono prepagati e trasparenti: $0,25 per 1M di token in input e $1,00 per 1M di token in output.
  • Le ricariche in cripto tramite USDT o USDC sono l'unico metodo di pagamento, senza abbonamenti o canoni mensili.

Cos'è l'API senza censura?

L'API senza censura è un servizio ospitato che espone un unico modello linguistico di grandi dimensioni tramite un'interfaccia standard di chat-completions. A differenza delle piattaforme che aggregano più modelli o offrono interfacce chat web, questo servizio si concentra sul fornire un unico modello senza censura ad alte prestazioni per gli sviluppatori che necessitano di generazione di testo grezzo e non filtrato. Il modello è ottimizzato per rispondere senza rifiuti di contenuto per uso adulto legale, rendendolo ideale per il roleplay, la scrittura creativa o le applicazioni dove i filtri standard potrebbero interferire con l'output.

Non è un wrapper intorno a GPT, Claude o Gemini; è un modello open-weight indipendente in esecuzione su server dedicati. Questa distinzione è importante perché ottieni un profilo di comportamento coerente piuttosto che uno strato di instradamento che potrebbe cambiare modello in modo imprevedibile. L'API gestisce testo in input e testo in output, supportando streaming, chiamata di funzioni e modalità JSON, ma non offre embedding, generazione di immagini o elaborazione audio.

Perché scegliere un LLM senza censura?

I LLM standard sono addestrati con reinforcement learning from human feedback (RLHF) che spesso porta a un eccessivo rifiuto. Possono rifiutare prompt innocui relativi a violenza, sessualità o argomenti controversi semplicemente perché rilevano un pattern che attiva un filtro di sicurezza. Un LLM senza censura rimuove questi vincoli artificiali, permettendo al modello di generare contenuti basandosi sui suoi dati di addestramento senza guardrail arbitrari. Questo è particolarmente prezioso per le applicazioni NSFW, dove il prodotto principale è contenuto per adulti, e per la scrittura creativa dove l'utente vuole che il modello segua la logica della storia piuttosto che una policy di sicurezza aziendale.

  • Coerenza: Il modello non rifiuta casualmente i prompt in base a policy di contenuto soggettive.
  • Output grezzo: Ottieni l'intera gamma di vocabolario e stile del modello senza sanitizzazione.
  • Controllo dello sviluppatore: Gestisci tu la moderazione se necessario, invece di affidarti ai filtri black-box del provider.

Compatibilità con OpenAI spiegata

L'API senza censura aderisce alla specifica OpenAI Chat Completions. Questo significa che puoi utilizzare gli SDK ufficiali OpenAI per Python, Node.js o altre lingue, e semplicemente cambiare l'URL di base in https://api.uncensoredaichat.cc/v1. La struttura della richiesta rimane identica: invii una lista di messaggi con ruoli come user e assistant, e l'API restituisce un completamento. Questa compatibilità riduce l'attrito dell'integrazione, poiché non devi scrivere un client HTTP personalizzato o analizzare un formato JSON unico.

L'ID del modello è semplicemente uncensored. Puoi anche elencare i modelli disponibili tramite GET /v1/models. Poiché segue lo schema standard, funzionalità come lo streaming tramite Server-Sent Events (SSE), la chiamata di funzioni (tools) e la modalità JSON (response_format: {"type": "json_object"}) funzionano out of the box. Questo la rende un drop-in replacement per molte applicazioni basate su OpenAI, purché non si affidino a peculiarità specifiche del modello uniche per GPT-4 o simili.

Fasi di integrazione

Integrare l'API senza censura è semplice se sei già familiare con i client compatibili con OpenAI. Innanzitutto, registrati per un account utilizzando Google o un indirizzo email. Riceverai immediatamente una chiave API, attiva alla creazione. Non è necessaria la verifica del telefono o l'inserimento della carta di credito per la prova, anche se l'uso a pagamento richiede ricariche in cripto.

Successivamente, configura il tuo client. Imposta l'URL di base su https://api.uncensoredaichat.cc/v1 e imposta la tua chiave API nell'intestazione di autorizzazione. Poi, effettua una richiesta POST a /v1/chat/completions con il tuo system prompt e i messaggi utente. L'API supporta parametri standard come temperature, top_p e sequenze stop.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Infine, gestisci la risposta. L'API restituisce un oggetto JSON standard con il testo generato in choices[0].message.content. Per attività di lunga durata, usa lo streaming per ricevere i token man mano che vengono generati. Ricorda che l'API ha un limite di richieste di 300 richieste al minuto per chiave, quindi implementa strategie di backoff se stai elaborando dati in batch.

Streaming e prestazioni

Lo streaming è supportato tramite Server-Sent Events (SSE). Quando imposti stream: true nella tua richiesta, l'API restituisce una serie di chunk. Ogni chunk contiene una risposta parziale e l'ultimo chunk include le statistiche di utilizzo dei token. Questo è cruciale per le applicazioni in tempo reale come i chatbot, dove vuoi visualizzare il testo man mano che viene generato invece di attendere il completamento completo.

Le prestazioni sono ottimizzate per la bassa latenza. Il modello è ospitato su server dedicati, garantendo tempi di risposta coerenti. Tieni presente tuttavia che l'API senza censura è un servizio solo testo. Non supporta la generazione di immagini o audio, quindi se la tua applicazione richiede output multimodali, dovrai gestirli separatamente. L'endpoint di streaming è efficiente e non consuma token extra oltre a quelli utilizzati per la generazione effettiva del testo.

Gestione delle finestre di contesto

L'API senza censura supporta una finestra di contesto di 100.000 token, che include sia il prompt che il completamento. Questo è significativamente più grande delle finestre standard da 8k o 32k trovate in molti altri modelli, permettendoti di passare conversazioni più lunghe o documenti senza troncamento. Tuttavia, il massimo output per richiesta è di 32.000 token, o 2.048 token se non specifichi max_tokens.

Per gestire contesti lunghi in modo efficace, dovresti implementare una strategia a finestra scorrevole o di summarizzazione nella logica della tua applicazione. Invia i messaggi più recenti per mantenere il contesto e archivia le parti più vecchie se necessario. L'API non gestisce automaticamente il contesto per te; spetta allo sviluppatore strutturare correttamente l'array messages. Questo ti dà il controllo completo su quali informazioni vede il modello, il che è importante per mantenere la coerenza nel roleplay a lungo termine o nell'analisi di documenti.

Prezzi e crediti

L'API senza censura utilizza un sistema di crediti prepagati. Non ci sono abbonamenti mensili o costi nascosti. Ricarichi il tuo account con cripto e i crediti vengono addebitati in base all'utilizzo reale dei token. I prezzi sono trasparenti: $0,25 per 1 milione di token in input e $1,00 per 1 milione di token in output. Errori e rifiuti sono gratuiti, quindi non paghi per le richieste fallite.

  • Pagamenti in cripto: Le ricariche sono accettate tramite USDT (TRC20) o USDC (Base). Ricarica minima $10, massima $500.
  • Bonus: Ricarica $50 o più per un bonus del 5%, o $100 o più per un bonus del 10%.
  • Nessuna scadenza: I crediti non scadono mai, quindi puoi usarli quando vuoi.

Puoi iniziare con una prova gratuita di $0,50 valida per 7 giorni, senza carta di credito. Questo ti permette di testare l'API prima di impegnarti con una ricarica in cripto.

Casi d'uso comuni

L'API senza censura è ideale per applicazioni che richiedono generazione di testo grezzo e non filtrato. I casi d'uso comuni includono:

  • Roleplay NSFW: Genera contenuti per adulti senza che il modello rifiuti in base alle policy sui contenuti.
  • Scrittura creativa: Permetti al modello di esplorare temi più oscuri o complessi senza vincoli artificiali.
  • Generazione di contenuti: Produci articoli, storie o script che potrebbero essere segnalati dai LLM standard.
  • Data augmentation: Genera campioni di testo diversificati per l'addestramento o il test di altri modelli.

Poiché l'API è solo testo, non è adatta per applicazioni che richiedono generazione di immagini o audio. Non è inoltre progettata per attività ad alta frequenza e bassa latenza che richiedono tempi di risposta inferiori al secondo, poiché il modello è ottimizzato per la qualità e la lunghezza del contesto piuttosto che per la velocità. Per la maggior parte delle applicazioni degli sviluppatori, tuttavia, l'API senza censura fornisce una base affidabile e flessibile.

Domande e risposte

L'API senza censura supporta più modelli?

No, l'API senza censura serve un singolo modello senza censura. Questo garantisce un comportamento e prestazioni coerenti, invece di instradare le richieste a modelli diversi con capacità variabili. È pensata per gli sviluppatori che necessitano di uno stile di output specifico e senza filtri.

Come ricarico il mio account?

Puoi ricaricare il tuo account utilizzando criptovalute. Accettiamo USDT sulla rete TRC20 o USDC sulla rete Base. I ricaricamenti vanno da $10 a $500 e puoi ricevere bonus per importi superiori. Le carte di credito e PayPal non sono supportati.

La finestra di contesto è davvero di 100k token?

Sì, la finestra di contesto totale è di 100.000 token, inclusi sia il prompt che il completamento. Tuttavia, l'output massimo per richiesta è di 32.000 token, o 2.048 token se non specifichi un limite. Questo permette conversazioni lunghe o l'elaborazione di documenti.

Cosa succede se commetto un errore con la ricarica?

I crediti non scadono mai, quindi puoi utilizzarli quando ne hai bisogno. Se commetti un errore, come un doppio addebito, puoi contattare il supporto tramite la pagina Supporto per risolvere il problema. Il credito non viene rimborsato, ma l'errore può essere corretto.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.