FR ▾
Obtenir une clé API

Comment utiliser l'API sans censure pour l'intégration de LLM NSFW

L'API sans censure propose un endpoint standard compatible OpenAI pour les développeurs qui ont besoin d'un LLM qui répond sans filtres de contenu. Il sert un seul modèle sans censure via chat-completions standard, ce qui facilite l'intégration dans les bases de code existantes pour des applications NSFW ou de jeu de rôle.

Mis à jour le

Points clés

  • L'API utilise un endpoint standard compatible OpenAI, nécessitant uniquement un changement d'URL de base pour les clients existants.
  • Il propose un seul modèle sans censure avec une fenêtre de contexte de 100 000 tokens, axé sur la génération de texte brut sans fonctionnalités supplémentaires.
  • La tarification est prépayée et transparente à 0,25 $/1M tokens d'entrée et 1,00 $/1M tokens de sortie.
  • Les recharges crypto via USDT ou USDC sont le seul moyen de paiement, sans abonnements ni frais mensuels.

Qu'est-ce que l'API sans censure ?

L'API sans censure est un service hébergé qui expose un seul modèle de langage via une interface chat-completions standard. Contrairement aux plateformes qui agrègent plusieurs modèles ou proposent des interfaces de chat web, ce service se concentre sur la fourniture d'un seul modèle sans censure haute performance pour les développeurs qui ont besoin de génération de texte brut non filtré. Le modèle est ajusté pour répondre sans refus de contenu pour un usage adulte légal, ce qui le rend idéal pour le jeu de rôle, l'écriture créative ou les applications où les filtres standards pourraient interférer avec la sortie.

Il ne s'agit pas d'un wrapper autour de GPT, Claude ou Gemini ; c'est un modèle à poids ouverts indépendant fonctionnant sur des serveurs dédiés. Cette distinction est importante car vous bénéficiez d'un profil de comportement cohérent plutôt que d'une couche de routage qui pourrait changer de modèle de manière imprévisible. L'API gère le texte entrant et sortant, prenant en charge le streaming, l'appel de fonctions et le mode JSON, mais elle ne propose pas d'embeddings, de génération d'images ni de traitement audio.

Pourquoi choisir un LLM sans censure ?

Les LLM standards sont entraînés avec un apprentissage par renforcement à partir de retours humains (RLHF) qui entraîne souvent un refus excessif. Ils peuvent refuser des prompts bénins liés à la violence, à la sexualité ou à des sujets controversés simplement parce qu'ils détectent un motif déclenchant un filtre de sécurité. Un LLM sans censure supprime ces contraintes artificielles, permettant au modèle de générer du contenu basé sur ses données d'entraînement sans garde-fous arbitraires. Cela est particulièrement précieux pour les applications NSFW, où le produit principal est du contenu pour adultes, et pour l'écriture créative où l'utilisateur veut que le modèle suive la logique de l'histoire plutôt qu'une politique de sécurité corporative.

  • Cohérence : Le modèle ne refuse pas aléatoirement les prompts en fonction de politiques de contenu subjectives.
  • Sortie brute : Vous obtenez l'intégralité du vocabulaire et du style du modèle sans sanitization.
  • Contrôle développeur : Vous gérez vous-même la modération si nécessaire, plutôt que de dépendre des filtres black-box du fournisseur.

Compatibilité OpenAI expliquée

L'API sans censure adhère à la spécification OpenAI Chat Completions. Cela signifie que vous pouvez utiliser les SDK officiels OpenAI pour Python, Node.js ou d'autres langages, et simplement modifier l'URL de base vers https://api.uncensoredaichat.cc/v1. La structure de la requête reste identique : vous envoyez une liste de messages avec des rôles comme user et assistant, et l'API renvoie une complétion. Cette compatibilité réduit la friction d'intégration, car vous n'avez pas besoin d'écrire un client HTTP personnalisé ou d'analyser un format JSON unique.

L'ID du modèle est simplement uncensored. Vous pouvez également lister les modèles disponibles via GET /v1/models. Comme il suit le schéma standard, des fonctionnalités comme le streaming via Server-Sent Events (SSE), l'appel de fonctions (tools) et le mode JSON (response_format: {"type": "json_object"}) fonctionnent out of the box. Cela en fait un remplacement prêt à l'emploi pour de nombreuses applications basées sur OpenAI, à condition qu'elles ne dépendent pas de particularités spécifiques du modèle propres à GPT-4 ou similaire.

Étapes d'intégration

L'intégration de l'API sans censure est simple si vous êtes déjà familier avec les clients compatibles OpenAI. Tout d'abord, inscrivez-vous à un compte en utilisant Google ou une adresse e-mail. Vous recevrez une clé API immédiatement, qui est active dès sa création. Aucune vérification par téléphone ni saisie de carte de crédit n'est nécessaire pour l'essai, bien que l'utilisation payante nécessite des recharges crypto.

Ensuite, configurez votre client. Définissez l'URL de base sur https://api.uncensoredaichat.cc/v1 et définissez votre clé API dans l'en-tête d'autorisation. Ensuite, effectuez une requête POST vers /v1/chat/completions avec votre prompt système et vos messages utilisateur. L'API prend en charge les paramètres standards comme temperature, top_p et les séquences stop.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Enfin, gérez la réponse. L'API retourne un objet JSON standard avec le texte généré dans choices[0].message.content. Pour les tâches de longue durée, utilisez le streaming pour recevoir les tokens au fur et à mesure de leur génération. N'oubliez pas que l'API a une limite de débit de 300 requêtes par minute par clé, donc mettez en œuvre des stratégies de backoff si vous traitez des données en vrac.

Streaming et performances

Le streaming est pris en charge via Server-Sent Events (SSE). Lorsque vous définissez stream: true dans votre requête, l'API renvoie une série de chunks. Chaque chunk contient une réponse partielle, et le dernier chunk inclut les statistiques d'utilisation des tokens. Ceci est crucial pour les applications en temps réel comme les chatbots, où vous souhaitez afficher le texte au fur et à mesure de sa génération plutôt que d'attendre la complétion complète.

Les performances sont optimisées pour une faible latence. Le modèle est hébergé sur des serveurs dédiés, garantissant des temps de réponse cohérents. Cependant, gardez à l'esprit que l'API sans censure est un service texte uniquement. Elle ne prend pas en charge la génération d'images ou d'audio, donc si votre application nécessite des sorties multimodales, vous devrez les gérer séparément. L'endpoint de streaming est efficace et ne consomme pas de tokens supplémentaires au-delà de ce qui est utilisé pour la génération de texte réelle.

Gestion des fenêtres de contexte

L'API sans censure prend en charge une fenêtre de contexte de 100 000 tokens, qui inclut à la fois le prompt et la complétion. C'est significativement plus grand que les fenêtres standard de 8k ou 32k trouvées dans de nombreux autres modèles, vous permettant de passer de longues conversations ou des documents sans troncature. Cependant, la sortie maximale par requête est de 32 000 tokens, ou 2 048 tokens si vous ne spécifiez pas max_tokens.

Pour gérer efficacement les contextes longs, vous devriez implémenter une stratégie de fenêtre glissante ou de résumé dans la logique de votre application. Envoyez les messages les plus récents pour maintenir le contexte, et archivez les parties plus anciennes si nécessaire. L'API ne gère pas automatiquement le contexte pour vous ; il incombe au développeur de structurer correctement le tableau messages. Cela vous donne un contrôle total sur les informations que le modèle voit, ce qui est important pour maintenir la cohérence dans le jeu de rôle long format ou l'analyse de documents.

Tarification et crédits

L'API sans censure utilise un système de crédit prépayé. Il n'y a pas d'abonnements mensuels ni de frais cachés. Vous rechargez votre compte avec de la crypto, et les crédits sont débités en fonction de l'utilisation réelle des tokens. La tarification est transparente : 0,25 $ par 1 million de tokens d'entrée et 1,00 $ par 1 million de tokens de sortie. Les erreurs et les refus sont gratuits, donc vous ne payez pas pour les requêtes échouées.

  • Paiements crypto : Les recharges sont acceptées via USDT (TRC20) ou USDC (Base). La recharge minimum est de 10 $, le maximum est de 500 $.
  • Bonus : Rechargez 50 $ ou plus pour un bonus de 5 %, ou 100 $ ou plus pour un bonus de 10 %.
  • Pas d'expiration : Les crédits n'expirent jamais, vous pouvez donc les utiliser whenever vous en avez besoin.

Vous pouvez commencer avec un crédit d'essai gratuit de 0,50 $ valable 7 jours, sans carte requise. Cela vous permet de tester l'API avant de vous engager dans une recharge crypto.

Cas d'utilisation courants

L'API sans censure est idéale pour les applications qui nécessitent une génération de texte brut non filtré. Les cas d'utilisation courants incluent :

  • Jeu de rôle NSFW : Générez du contenu pour adultes sans que le modèle ne refuse en fonction des politiques de contenu.
  • Écriture créative : Permettez au modèle d'explorer des thèmes plus sombres ou plus complexes sans contraintes artificielles.
  • Génération de contenu : Produisez des articles, des histoires ou des scripts qui pourraient être signalés par les LLM standards.
  • Augmentation de données : Générez des échantillons de texte diversifiés pour l'entraînement ou le test d'autres modèles.

Puisque l'API est texte uniquement, elle ne convient pas aux applications nécessitant la génération d'images ou d'audio. Elle n'est pas non plus conçue pour les tâches à haute fréquence et faible latence nécessitant des temps de réponse inférieurs à une seconde, car le modèle est optimisé pour la qualité et la longueur du contexte plutôt que pour la vitesse. Pour la plupart des applications développeur, cependant, l'API sans censure fournit une base fiable et flexible.

Questions et réponses

L'API sans censure prend-elle en charge plusieurs modèles ?

Non, l'API sans censure sert un seul modèle sans censure. Cela garantit un comportement et des performances cohérents, plutôt que de router les requêtes vers différents modèles aux capacités variables. Il est conçu pour les développeurs qui ont besoin d'un style de sortie spécifique, sans filtre.

Comment recharger mon compte ?

Vous pouvez recharger votre compte à l'aide de cryptomonnaies. Nous acceptons USDT sur le réseau TRC20 ou USDC sur le réseau Base. Les recharges vont de 10 $ à 500 $, et vous pouvez recevoir des bonus pour les montants plus élevés. Les cartes de crédit et PayPal ne sont pas pris en charge.

La fenêtre de contexte fait-elle vraiment 100 000 tokens ?

Oui, la fenêtre de contexte totale est de 100 000 tokens, incluant à la fois le prompt et la complétion. Cependant, la sortie maximale par requête est de 32 000 tokens, ou 2 048 tokens si vous ne spécifiez pas de limite. Cela permet des conversations longues ou le traitement de documents.

Que se passe-t-il si je fais une erreur avec ma recharge ?

Les crédits n'expirent jamais, vous pouvez donc les utiliser lorsque vous en avez besoin. Si vous faites une erreur, comme un double débit, vous pouvez contacter le support via la page Support pour résoudre le problème. Le crédit lui-même n'est pas remboursé, mais l'erreur peut être corrigée.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.