PL ▾
Pobierz klucz API

Dokumentacja API czatu AI bez cenzury

API czatu AI bez cenzury dostarcza pojedynczy, wydajny model bez cenzury poprzez standardowy interfejs kompatybilny z OpenAI, umożliwiając programistom integrację generowania tekstu tolerującego NSFW w swoich aplikacjach bez filtrów treści.

Adres bazowy i uwierzytelnianie

Połącz się z API AI bez cenzury, używając standardowego adresu bazowego kompatybilnego z OpenAI. Potrzebujesz klucza API do uwierzytelnienia swoich zapytań. Zarejestruj się przez Google lub e-mail na stronie klucza, aby natychmiast otrzymać token. Adres bazowy to https://api.uncensoredaichat.cc/v1.

Ustaw nagłówek Authorization na Bearer YOUR_API_KEY. Działa to z dowolnym SDK OpenAI lub kompatybilnym klientem. Endpoint dla dostępnych modeli to GET /v1/models, który zwraca identyfikator modelu uncensored. Użyj tego ID w swoich zapytaniach uzupełniających. Błędy takie jak 401 oznaczają nieprawidłowy lub brakujący klucz.

Pierwsze zapytanie

Wyślij zapytanie o uzupełnienie czatu pod POST /v1/chat/completions. ID modelu to uncensored. API akceptuje standardowe struktury wiadomości. Możesz wysyłać prompty i otrzymywać odpowiedzi tekstowe. To API jest tylko tekstowe; nie obsługuje obrazów, audio ani embeddingów.

Model czatu AI bez cenzury obsługuje wnioskowanie na modelach o otwartych wagach na naszych serwerach. Jest dostrojony do odpowiadania bez odmów dla treści dla dorosłych. Upewnij się, że Twoja ładunek zawiera pola model, messages oraz max_tokens. Dostosuj max_tokens, aby kontrolować długość wyjścia, z wartością domyślną 2,048, jeśli zostanie pominięte.

Integracja z Python SDK

Użyj oficjalnej biblioteki Python OpenAI do interakcji z API LLM NSFW. Skonfiguruj klienta z adresem bazowym i swoim kluczem API. To podejście utrzymuje czystość kodu i wykorzystuje istniejące wzorce SDK.

Ustaw model na uncensored w konfiguracji klienta. SDK obsługuje serializację i formatowanie zapytań automatycznie. Możesz przekazywać parametry takie jak temperature i top_p, aby kontrolować zachowanie generowania. Ta metoda jest idealna dla usług backendowych lub skryptów, które wymagają niezawodnego generowania tekstu.

Integracja z Node SDK

Zintegruj API bez cenzury w swoich aplikacjach Node.js, używając Node SDK OpenAI. Zainicjuj klienta niestandardowym adresem bazowym i swoim kluczem API. Ta konfiguracja pozwala używać znanych metod takich jak chat.completions.create.

Przekaż ID modelu uncensored, aby określić model bez cenzury. Możesz zdefiniować prompty systemowe, wiadomości użytkownika i odpowiedzi asystenta. SDK zarządza żądaniami HTTP wydajnie. Jest to odpowiednie dla serwerów sieciowych lub funkcji brzegowych, które wymagają generowania tekstu na żądanie bez zewnętrznych zależności poza standardowym SDK.

Odpowiedzi strumieniowe

Włącz strumieniowanie, ustawiając stream: true w swoim zapytaniu. API zwraca zdarzenia wysyłane przez serwer (SSE) dla dostarczania tokenów w czasie rzeczywistym. Zmniejsza to postrzeganą opóźnienie dla użytkowników końcowych. Każdy fragment zawiera częściowe aktualizacje tekstu.

Ostatni fragment zawiera statystyki użycia tokenów. Pozwala to na dokładne śledzenie kosztów bez przechowywania całej odpowiedzi. Strumieniowanie jest obsługiwane zarówno dla Pythona, jak i Node SDK. Jest optymalne dla interfejsów czatu, gdzie wymagana jest natychmiastowa informacja zwrotna. Model czatu AI bez cenzury obsługuje to dla interakcji o wysokiej wydajności.

Limity, błędy i kontekst

Okno kontekstu wynosi łącznie 100 000 tokenów (prompt + uzupełnienie). Maksymalne wyjście na zapytanie to 32 000 tokenów. Błędy i odmowy nie zużywają kredytu. Błąd 401 oznacza, że Twój klucz jest nieprawidłowy. Błąd 429 oznacza, że przekroczyłeś 300 zapytań na minutę lub 8 zapytań równoległych. Limity zapytań są przypisane do klucza. Ciała zapytań muszą być mniejsze niż 8 MB. Kredyt jest naliczany tylko za pomyślne użycie tokenów. Przedpłacony kredyt nigdy nie wygasa.

cURL

curl https://api.uncensoredaichat.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredaichat.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Strumieniowanie

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
ID modeluuncensored
Base URLhttps://api.uncensoredaichat.cc/v1
UwierzytelnianieAuthorization: Bearer YOUR_KEY
EndpointyPOST /v1/chat/completions · GET /v1/models
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Tryb JSONresponse_format: {"type": "json_object"}
Równoległe zapytaniado 8 jednocześnie na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozmiar zapytaniado 8 MB
Limit zapytań300 zapytań na minutę na klucz
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Bonus+5% od $50, +10% od $100
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
LogowanieGoogle albo e-mail i hasło
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Czy API czatu AI bez cenzury obsługuje generowanie obrazów lub audio?

Nie, API jest tylko tekstowe. Obsługuje jeden duży model językowy do uzupełniania czatu. Nie obsługuje embeddingów, generowania obrazów, audio ani wideo. Użyj tego API do interakcji tekstowych i roleplay.

Jak naliczany jest kredyt i kiedy błędy są darmowe?

Kredyt jest naliczany na podstawie rzeczywistego zużycia tokenów za pomyślne uzupełnienia. Błędy takie jak 401 nieprawidłowy klucz lub 429 limit zapytań nie zużywają kredytu. Odmowy treści również nie obciążają tokenami. Przedpłacony kredyt nigdy nie wygasa.

Jaka jest maksymalna wielkość okna kontekstu i długość wyjścia?

Całkowite okno kontekstu wynosi 100 000 tokenów, w tym zarówno prompt, jak i uzupełnienie. Maksymalna długość wyjścia na zapytanie to 32 000 tokenów. Jeśli max_tokens nie jest ustawione, domyślne wyjście to 2 048 tokenów.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień adres bazowy. To cała konfiguracja.