DE ▾
API-Schlüssel erhalten

Dokumentation der Unzensierten KI-Chat-API

Die Unzensierte KI-Chat-API bietet ein einzelnes, hochleistungsfähiges unzensiertes Modell über eine standardmäßige OpenAI-kompatible Schnittstelle und ermöglicht es Entwicklern, NSFW-tolerante Textgenerierung ohne Inhaltsfilter in ihre Anwendungen zu integrieren.

Basis-URL und Authentifizierung

Verbinde dich mit der unzensierten KI-API über die standardmäßige OpenAI-kompatible Basis-URL. Du benötigst einen API-Schlüssel, um deine Anfragen zu authentifizieren. Registriere dich über Google oder E-Mail auf der Schlüssel-Seite, um dein Token sofort zu erhalten. Die Basis-URL lautet https://api.uncensoredaichat.cc/v1.

Setze den Authorization-Header auf Bearer YOUR_API_KEY. Dies funktioniert mit jedem OpenAI-SDK oder kompatiblen Client. Der Endpunkt für verfügbare Modelle ist GET /v1/models, der die Modell-ID uncensored zurückgibt. Verwende diese ID in deinen Vervollständigungsanfragen. Fehler wie 401 deuten auf einen ungültigen oder fehlenden Schlüssel hin.

Erste Anfrage

Sende eine Chat-Vervollständigungsanfrage an POST /v1/chat/completions. Die Modell-ID ist uncensored. Die API akzeptiert Standard-Nachrichtenstrukturen. Du kannst Prompts senden und Textantworten erhalten. Dies ist eine Text-only-API; sie unterstützt keine Bilder, Audio oder Embeddings.

Das unzensierte KI-Chat-Modell führt Open-Weight-Inferenz auf unseren Servern durch. Es ist darauf abgestimmt, ohne Ablehnungen auf legale erwachsene Inhalte zu antworten. Stelle sicher, dass deine Payload die Felder model, messages und max_tokens enthält. Passe max_tokens an, um die Ausgabelänge zu steuern, mit einem Standardwert von 2.048, wenn es weggelassen wird.

Python SDK-Integration

Verwende die offizielle OpenAI Python-Bibliothek, um mit der NSFW-LLM-API zu interagieren. Konfiguriere den Client mit der Basis-URL und deinem API-Schlüssel. Dieser Ansatz hält deinen Code sauber und nutzt bestehende SDK-Muster.

Setze das Modell in deiner Client-Konfiguration auf uncensored. Das SDK übernimmt die Serialisierung und Formatierung der Anfrage automatisch. Du kannst Parameter wie temperature und top_p übergeben, um das Generierungsverhalten zu steuern. Diese Methode ist ideal für Backend-Dienste oder Skripte, die zuverlässige Textgenerierung benötigen.

Node SDK-Integration

Integriere die unzensierte API in deine Node.js-Anwendungen über das OpenAI Node SDK. Initialisiere den Client mit der benutzerdefinierten Basis-URL und deinem API-Schlüssel. Diese Einrichtung ermöglicht es dir, vertraute Methoden wie chat.completions.create zu verwenden.

Übergebe die Modell-ID uncensored, um das unzensierte Modell anzugeben. Du kannst System-Prompts, Benutzer-Nachrichten und Assistenten-Antworten definieren. Das SDK verwaltet die HTTP-Anfragen effizient. Dies eignet sich für Webserver oder Edge-Funktionen, die bedarfsgerechte Textgenerierung ohne externe Abhängigkeiten neben dem Standard-SDK benötigen.

Streaming-Antworten

Aktiviere Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt Server-Sent Events (SSE) für die Echtzeit-Übertragung von Token zurück. Dies reduziert die wahrgenommene Latenz für Endbenutzer. Jeder Chunk enthält teilweise Textaktualisierungen.

Der letzte Chunk enthält Token-Nutzungsstatistiken. Dies ermöglicht es dir, die Kosten genau zu verfolgen, ohne die gesamte Antwort speichern zu müssen. Streaming wird sowohl für Python als auch für Node SDKs unterstützt. Es ist optimal für Chat-Schnittstellen, bei denen sofortiges Feedback erforderlich ist. Das unzensierte KI-Chat-Modell unterstützt dies für hochleistungsfähige Interaktionen.

Grenzwerte, Fehler und Kontext

Das Kontextfenster umfasst insgesamt 100.000 Token (Prompt + Vervollständigung). Die maximale Ausgabe pro Anfrage beträgt 32.000 Token. Fehler und Ablehnungen verbrauchen kein Guthaben. Ein 401-Fehler bedeutet, dass dein Schlüssel ungültig ist. Ein 429-Fehler zeigt an, dass du 300 Anfragen pro Minute oder 8 gleichzeitige Anfragen überschritten hast. Ratenlimits gelten pro Schlüssel. Anforderungstextkörper müssen unter 8 MB liegen. Guthaben wird nur für erfolgreiche Token-Nutzung berechnet. Prepaid-Guthaben verfällt nie.

cURL

curl https://api.uncensoredaichat.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredaichat.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

API-Spezifikation

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
Base-URLhttps://api.uncensoredaichat.cc/v1
AuthentifizierungAuthorization: Bearer YOUR_KEY
EndpunktePOST /v1/chat/completions · GET /v1/models
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
JSON-Modusresponse_format: {"type": "json_object"}
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Anfragegrößebis 8 MB
Ratenlimit300 Anfragen pro Minute und Schlüssel
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Unterstützt die unzensierte KI-Chat-API die Bild- oder Audioerstellung?

Nein, die API ist textbasiert. Sie bietet ein einzelnes Large Language Model für Chat-Vervollständigungen. Sie unterstützt keine Embeddings, Bild-, Audio- oder Videoerstellung. Nutze diese API für textbasierte Interaktionen und Roleplay.

Wie wird Guthaben berechnet und wann sind Fehler kostenlos?

Guthaben wird basierend auf der tatsächlichen Token-Nutzung für erfolgreiche Vervollständigungen berechnet. Fehler wie 401 ungültiger Schlüssel oder 429 Ratenlimit verbrauchen kein Guthaben. Ablehnungen von Inhalten berechnen ebenfalls keine Token. Prepaid-Guthaben verfällt nie.

Wie groß ist das maximale Kontextfenster und die Ausgabelänge?

Das gesamte Kontextfenster umfasst 100.000 Token, sowohl den Prompt als auch die Vervollständigung. Die maximale Ausgabelänge pro Anfrage beträgt 32.000 Token. Wenn max_tokens nicht festgelegt ist, beträgt die Standardausgabe 2.048 Token.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.