PL ▾
Pobierz klucz API

Jak korzystać z API bez cenzury do integracji NSFW LLM

API bez cenzury zapewnia prosty, kompatybilny z OpenAI endpoint dla programistów potrzebujących LLM odpowiadającego bez filtrów treści. Obsługuje jeden model bez cenzury poprzez standardowe chat-completions, co ułatwia wdrożenie w istniejących bazach kodu dla aplikacji NSFW lub do odgrywania ról.

Zaktualizowano

Kluczowe punkty

  • API korzysta ze standardowego endpointu kompatybilnego z OpenAI, wymagając jedynie zmiany adresu URL bazowego dla istniejących klientów.
  • Obsługuje jeden model bez cenzury z oknem kontekstu 100k, skupiając się na generowaniu surowego tekstu bez dodatkowych funkcji.
  • Cennik opiera się na przedpłaconym kredycie i jest przejrzysty: $0,25 za 1 mln tokenów wejściowych i $1,00 za 1 mln tokenów wyjściowych.
  • Doładowania kryptowalutami (USDT lub USDC) to jedyna metoda płatności, bez blokad subskrypcyjnych ani miesięcznych opłat.

Czym jest API bez cenzury?

API bez cenzury to usługa hostowana, która udostępnia jeden duży model językowy poprzez standardowy interfejs chat-completions. W przeciwieństwie do platform agregujących wiele modeli lub oferujących interfejsy czatu webowego, usługa ta koncentruje się na dostarczaniu jednego wysokowydajnego modelu bez cenzury dla programistów potrzebujących surowego generowania tekstu bez filtrów. Model jest dostrojony do odpowiadania bez odmów treści dla legalnego użytku dorosłego, co czyni go idealnym do odgrywania ról, twórczego pisania lub aplikacji, w których standardowe filtry mogłyby zakłócać wynik.

Nie jest to opakowanie wokół GPT, Claude lub Gemini; to niezależny model o otwartych wagach działający na dedykowanych serwerach. Ta różnica ma znaczenie, ponieważ otrzymujesz spójny profil zachowań, a nie warstwę routingu, która może nieprzewidywalnie przełączać modele. API obsługuje dane wejściowe i wyjściowe, wspierając strumieniowanie, wywoływanie funkcji i tryb JSON, ale nie oferuje embeddings, generowania obrazów ani przetwarzania audio.

Dlaczego wybrać LLM bez cenzury?

Standardowe LLM są trenowane z wykorzystaniem uczenia wzmacnianego z opiniami ludzi (RLHF), co często prowadzi do nadmiernej odmowy. Mogą odrzucać niewinne prompty dotyczące przemocy, seksualności lub kontrowersyjnych tematów po prostu dlatego, że wykrywają wzorzec wyzwalający filtr bezpieczeństwa. LLM bez cenzury usuwa te sztuczne ograniczenia, pozwalając modelowi generować treści na podstawie danych treningowych bez arbitralnych barier. Jest to szczególnie cenne dla aplikacji NSFW, gdzie głównym produktem jest treść dla dorosłych, oraz dla twórczego pisania, gdzie użytkownik chce, aby model podążał za logiką historii, a nie polityką bezpieczeństwa korporacji.

  • Spójność: Model nie odrzuca losowo promptów na podstawie subiektywnych polityk treści.
  • Surowe wyjście: Otrzymujesz pełen zakres słownictwa i stylu modelu bez sanitizacji.
  • Kontrola programisty: Sam zarządzasz moderacją, jeśli jest to konieczne, zamiast polegać na filtrach dostawcy w czarnych skrzynkach.

Wyjaśnienie kompatybilności z OpenAI

API bez cenzury jest zgodne ze specyfikacją OpenAI Chat Completions. Oznacza to, że możesz użyć oficjalnych SDK OpenAI dla Pythona, Node.js lub innych języków i po prostu zmienić bazowy URL na https://api.uncensoredaichat.cc/v1. Struktura zapytania pozostaje identyczna: wysyłasz listę wiadomości z rolami takimi jak user i assistant, a API zwraca completion. Ta kompatybilność zmniejsza tarcie podczas integracji, ponieważ nie musisz pisać własnego klienta HTTP ani parsować unikalnego formatu JSON.

ID modelu to po prostu uncensored. Możesz również wyświetlić dostępne modele poprzez GET /v1/models. Ponieważ przestrzega standardowego schematu, takie funkcje jak strumieniowanie za pomocą Server-Sent Events (SSE), wywoływanie funkcji (narzędzia) i tryb JSON (response_format: {"type": "json_object"}) działają od razu. Umożliwia to zastąpienie wielu aplikacji opartych na OpenAI, pod warunkiem, że nie polegają na specyficznych dziwactwach modeli unikalnych dla GPT-4 lub podobnych.

Kroki integracji

Integracja API bez cenzury jest prosta, jeśli znasz już klientów kompatybilnych z OpenAI. Po pierwsze, zarejestruj konto za pomocą Google lub adresu e-mail. Otrzymasz klucz API natychmiast, który jest aktywny od momentu utworzenia. Nie ma potrzeby weryfikacji telefonu ani wprowadzania karty kredytowej dla wersji próbnej, choć płatne użycie wymaga doładowania kryptowalutą.

Następnie skonfiguruj klienta. Ustaw adres URL bazowy na https://api.uncensoredaichat.cc/v1 i ustaw swój klucz API w nagłówku autoryzacji. Następnie wyślij żądanie POST do /v1/chat/completions ze swoim promptem systemowym i wiadomościami użytkownika. API obsługuje standardowe parametry takie jak temperature, top_p i sekwencje stop.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Na koniec obsłuż odpowiedź. API zwraca standardowy obiekt JSON z wygenerowanym tekstem w choices[0].message.content. Dla zadań długotrwałych użyj strumieniowania, aby otrzymywać tokeny w miarę ich generowania. Pamiętaj, że API ma limit zapytań wynoszący 300 zapytań na minutę na klucz, więc wdróż strategie backoff, jeśli przetwarzasz dane wsadowe.

Strumieniowanie i wydajność

Strumieniowanie jest obsługiwane za pomocą Server-Sent Events (SSE). Gdy ustawisz stream: true w swoim żądaniu, API zwraca serię fragmentów. Każdy fragment zawiera częściową odpowiedź, a ostatni fragment zawiera statystyki użycia tokenów. Jest to kluczowe dla aplikacji w czasie rzeczywistym, takich jak boty czatowe, gdzie chcesz wyświetlać tekst w miarę jego generowania, a nie czekać na pełne uzupełnienie.

Wydajność jest zoptymalizowana pod kątem niskiego opóźnienia. Model jest hostowany na dedykowanych serwerach, zapewniając spójny czas odpowiedzi. Pamiętaj jednak, że API bez cenzury jest usługą tekstową. Nie obsługuje generowania obrazów ani audio, więc jeśli Twoja aplikacja wymaga wyjść multimodalnych, musisz obsłużyć je osobno. Endpoint strumieniowania jest wydajny i nie zużywa dodatkowych tokenów poza tymi użytymi do faktycznego generowania tekstu.

Obsługa okien kontekstu

API bez cenzury obsługuje okno kontekstu 100 000 tokenów, które obejmuje zarówno prompt, jak i uzupełnienie. Jest to znacznie więcej niż standardowe okna 8k lub 32k spotykane w wielu innych modelach, pozwalając na przesyłanie dłuższych rozmów lub dokumentów bez obcinania. Maksymalna ilość wyjściowa na zapytanie to jednak 32 000 tokenów, lub 2048 tokenów, jeśli nie określisz max_tokens.

Aby skutecznie zarządzać długimi kontekstami, powinieneś wdrożyć strategię przesuwającego się okna lub sumaryzację w logice swojej aplikacji. Wysyłaj najnowsze wiadomości, aby utrzymać kontekst, i archiwizuj starsze części, jeśli jest to konieczne. API nie zarządza automatycznie kontekstem dla Ciebie; to programista musi poprawnie zbudować tablicę messages. Daje to pełną kontrolę nad tym, jakie informacje widzi model, co jest ważne dla utrzymania spójności w długich formach odgrywania ról lub analizie dokumentów.

Cennik i kredyty

API bez cenzury korzysta z systemu przedpłaconego kredytu. Nie ma miesięcznych subskrypcji ani ukrytych opłat. Doładowujesz konto kryptowalutą, a kredyty są naliczane na podstawie rzeczywistego użycia tokenów. Cennik jest przejrzysty: $0,25 za 1 milion tokenów wejściowych i $1,00 za 1 milion tokenów wyjściowych. Błędy i odmowy są darmowe, więc nie płacisz za nieudane zapytania.

  • Płatności kryptowalutami: Doładowania akceptowane są za pomocą USDT (TRC20) lub USDC (Base). Minimalne doładowanie to $10, maksymalne to $500.
  • Bonusy: Doładuj $50 lub więcej, aby uzyskać 5% bonusu, lub $100 lub więcej, aby uzyskać 10% bonusu.
  • Brak wygaśnięcia: Kredyty nigdy nie wygasają, więc możesz ich użyć, gdy tylko będą potrzebne.

Możesz zacząć od darmowej wersji próbnej za $0,50 ważnej przez 7 dni, bez karty kredytowej. Pozwala to przetestować API przed zobowiązaniem się do doładowania kryptowalutą.

Typowe przypadki użycia

API bez cenzury jest idealne dla aplikacji wymagających surowej, niefiltrowanej generacji tekstu. Typowe przypadki użycia to:

  • NSFW Roleplay: Generuj treści dla dorosłych bez odmowy modelu na podstawie polityk treści.
  • Twórcze pisanie: Pozwól modelowi eksplorować ciemniejsze lub bardziej złożone tematy bez sztucznych ograniczeń.
  • Generowanie treści: Twórz artykuły, historie lub scenariusze, które mogą być oznaczone przez standardowe LLM.
  • Augmentacja danych: Generuj zróżnicowane próbki tekstu do trenowania lub testowania innych modeli.

Ponieważ API jest tekstowe, nie nadaje się do aplikacji wymagających generowania obrazów lub audio. Nie jest również przeznaczony do zadań o wysokiej częstotliwości i niskim opóźnieniu wymagających odpowiedzi w czasie krótszym niż sekunda, ponieważ model jest zoptymalizowany pod kątem jakości i długości kontekstu, a nie prędkości. Dla większości aplikacji programistycznych API bez cenzury zapewnia jednak niezawodną i elastyczną podstawę.

Pytania i odpowiedzi

Czy API bez cenzury obsługuje wiele modeli?

Nie, API bez cenzury obsługuje jeden model bez cenzury. Zapewnia to spójne zachowanie i wydajność, zamiast kierowania zapytań do różnych modeli o zróżnicowanych możliwościach. Zostało zaprojektowane dla programistów potrzebujących konkretnego stylu wyjściowego bez filtrów.

Jak doładować swoje konto?

Możesz doładować swoje konto za pomocą kryptowalut. Akceptujemy USDT w sieci TRC20 lub USDC w sieci Base. Doładowania wynoszą od 10 $ do 500 $, a za większe kwoty możesz otrzymać bonusy. Karty kredytowe i PayPal nie są obsługiwane.

Czy okno kontekstu ma naprawdę 100k tokenów?

Tak, całkowite okno kontekstu wynosi 100 000 tokenów, w tym zarówno prompt, jak i generowanie odpowiedzi. Maksymalna długość odpowiedzi na zapytanie to jednak 32 000 tokenów, lub 2 048 tokenów, jeśli nie określisz limitu. Pozwala to na długie rozmowy lub przetwarzanie dokumentów.

Co się stanie, jeśli popełnię błąd przy doładowaniu?

Kredyty nie wygasają, więc możesz korzystać z nich, gdy tylko potrzebujesz. Jeśli popełnisz błąd, np. podwójne obciążenie, skontaktuj się z pomocą techniczną przez stronę Wsparcie, aby rozwiązać problem. Kredyt nie zostanie zwrócony, ale błąd można skorygować.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.