Dokumentation der Unzensierten KI-Chat-API
Die Unzensierte KI-Chat-API bietet ein einzelnes, hochleistungsfähiges unzensiertes Modell über eine standardmäßige OpenAI-kompatible Schnittstelle und ermöglicht es Entwicklern, NSFW-tolerante Textgenerierung ohne Inhaltsfilter in ihre Anwendungen zu integrieren.
Basis-URL und Authentifizierung
Verbinde dich mit der unzensierten KI-API über die standardmäßige OpenAI-kompatible Basis-URL. Du benötigst einen API-Schlüssel, um deine Anfragen zu authentifizieren. Registriere dich über Google oder E-Mail auf der Schlüssel-Seite, um dein Token sofort zu erhalten. Die Basis-URL lautet https://api.uncensoredaichat.cc/v1.
Setze den Authorization-Header auf Bearer YOUR_API_KEY. Dies funktioniert mit jedem OpenAI-SDK oder kompatiblen Client. Der Endpunkt für verfügbare Modelle ist GET /v1/models, der die Modell-ID uncensored zurückgibt. Verwende diese ID in deinen Vervollständigungsanfragen. Fehler wie 401 deuten auf einen ungültigen oder fehlenden Schlüssel hin.
Erste Anfrage
Sende eine Chat-Vervollständigungsanfrage an POST /v1/chat/completions. Die Modell-ID ist uncensored. Die API akzeptiert Standard-Nachrichtenstrukturen. Du kannst Prompts senden und Textantworten erhalten. Dies ist eine Text-only-API; sie unterstützt keine Bilder, Audio oder Embeddings.
Das unzensierte KI-Chat-Modell führt Open-Weight-Inferenz auf unseren Servern durch. Es ist darauf abgestimmt, ohne Ablehnungen auf legale erwachsene Inhalte zu antworten. Stelle sicher, dass deine Payload die Felder model, messages und max_tokens enthält. Passe max_tokens an, um die Ausgabelänge zu steuern, mit einem Standardwert von 2.048, wenn es weggelassen wird.
Python SDK-Integration
Verwende die offizielle OpenAI Python-Bibliothek, um mit der NSFW-LLM-API zu interagieren. Konfiguriere den Client mit der Basis-URL und deinem API-Schlüssel. Dieser Ansatz hält deinen Code sauber und nutzt bestehende SDK-Muster.
Setze das Modell in deiner Client-Konfiguration auf uncensored. Das SDK übernimmt die Serialisierung und Formatierung der Anfrage automatisch. Du kannst Parameter wie temperature und top_p übergeben, um das Generierungsverhalten zu steuern. Diese Methode ist ideal für Backend-Dienste oder Skripte, die zuverlässige Textgenerierung benötigen.
Node SDK-Integration
Integriere die unzensierte API in deine Node.js-Anwendungen über das OpenAI Node SDK. Initialisiere den Client mit der benutzerdefinierten Basis-URL und deinem API-Schlüssel. Diese Einrichtung ermöglicht es dir, vertraute Methoden wie chat.completions.create zu verwenden.
Übergebe die Modell-ID uncensored, um das unzensierte Modell anzugeben. Du kannst System-Prompts, Benutzer-Nachrichten und Assistenten-Antworten definieren. Das SDK verwaltet die HTTP-Anfragen effizient. Dies eignet sich für Webserver oder Edge-Funktionen, die bedarfsgerechte Textgenerierung ohne externe Abhängigkeiten neben dem Standard-SDK benötigen.
Streaming-Antworten
Aktiviere Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt Server-Sent Events (SSE) für die Echtzeit-Übertragung von Token zurück. Dies reduziert die wahrgenommene Latenz für Endbenutzer. Jeder Chunk enthält teilweise Textaktualisierungen.
Der letzte Chunk enthält Token-Nutzungsstatistiken. Dies ermöglicht es dir, die Kosten genau zu verfolgen, ohne die gesamte Antwort speichern zu müssen. Streaming wird sowohl für Python als auch für Node SDKs unterstützt. Es ist optimal für Chat-Schnittstellen, bei denen sofortiges Feedback erforderlich ist. Das unzensierte KI-Chat-Modell unterstützt dies für hochleistungsfähige Interaktionen.
Grenzwerte, Fehler und Kontext
Das Kontextfenster umfasst insgesamt 100.000 Token (Prompt + Vervollständigung). Die maximale Ausgabe pro Anfrage beträgt 32.000 Token. Fehler und Ablehnungen verbrauchen kein Guthaben. Ein 401-Fehler bedeutet, dass dein Schlüssel ungültig ist. Ein 429-Fehler zeigt an, dass du 300 Anfragen pro Minute oder 8 gleichzeitige Anfragen überschritten hast. Ratenlimits gelten pro Schlüssel. Anforderungstextkörper müssen unter 8 MB liegen. Guthaben wird nur für erfolgreiche Token-Nutzung berechnet. Prepaid-Guthaben verfällt nie.
cURL
curl https://api.uncensoredaichat.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredaichat.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)API-Spezifikation
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Base-URL | https://api.uncensoredaichat.cc/v1 |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Unterstützt die unzensierte KI-Chat-API die Bild- oder Audioerstellung?
Nein, die API ist textbasiert. Sie bietet ein einzelnes Large Language Model für Chat-Vervollständigungen. Sie unterstützt keine Embeddings, Bild-, Audio- oder Videoerstellung. Nutze diese API für textbasierte Interaktionen und Roleplay.
Wie wird Guthaben berechnet und wann sind Fehler kostenlos?
Guthaben wird basierend auf der tatsächlichen Token-Nutzung für erfolgreiche Vervollständigungen berechnet. Fehler wie 401 ungültiger Schlüssel oder 429 Ratenlimit verbrauchen kein Guthaben. Ablehnungen von Inhalten berechnen ebenfalls keine Token. Prepaid-Guthaben verfällt nie.
Wie groß ist das maximale Kontextfenster und die Ausgabelänge?
Das gesamte Kontextfenster umfasst 100.000 Token, sowohl den Prompt als auch die Vervollständigung. Die maximale Ausgabelänge pro Anfrage beträgt 32.000 Token. Wenn max_tokens nicht festgelegt ist, beträgt die Standardausgabe 2.048 Token.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.