주요 특징
- API는 표준 OpenAI 호환 엔드포인트를 사용하며, 기존 클라이언트는 베이스 URL만 변경하면 됩니다.
- 100k 컨텍스트 창을 가진 단일 무검열 모델을 제공하며, 추가 기능 없이 원시 텍스트 생성에 중점을 둡니다.
- 가격은 선불 크레딧 방식이며 투명합니다. 입력 토큰 1M당 $0.25, 출력 토큰 1M당 $1.00입니다.
- USDT 또는 USDC를 통한 암호화폐 충전이 유일한 결제 방법이며, 구독 잠금이나 월 요금이 없습니다.
무검열 API란 무엇인가요?
무검열 API는 표준 채팅 완료 인터페이스를 통해 단일 대규모 언어 모델을 노출하는 호스팅 서비스입니다. 여러 모델을 집계하거나 웹 기반 채팅 인터페이스를 제공하는 플랫폼과 달리 이 서비스는 원시적이고 필터 없는 텍스트 생성이 필요한 개발자를 위해 하나의 고성능 무검열 모델 제공에 중점을 둡니다. 이 모델은 합법적인 성인 사용에 대한 콘텐츠 거부 없이 답변하도록 조정되어 역할극, 창작 글쓰기 또는 표준 필터가 출력에 간섭할 수 있는 애플리케이션에 이상적입니다.
이것은 GPT, Claude 또는 Gemini의 래퍼가 아니며 전용 서버에서 실행되는 독립적인 오픈 웨이트 모델입니다. 이 구분이 중요한 이유는 예측 불가능하게 모델을 전환할 수 있는 라우팅 레이어이 아니라 일관된 동작 프로필을 얻기 때문입니다. API는 텍스트 입력과 출력을 처리하며 스트리밍, 함수 호출 및 JSON 모드를 지원하지만 임베딩, 이미지 생성 또는 오디오 처리는 제공하지 않습니다.
무검열 LLM을 선택해야 하는 이유
표준 LLM은 종종 과도한 거부를 초래하는 인간 피드백 강화 학습(RLHF)으로 학습됩니다. 안전 필터를 트리거하는 패턴을 감지하기 때문에 폭력, 성관계 또는 논쟁적인 주제와 관련된 양호한 프롬프트도 거부할 수 있습니다. 무검열 LLM은 이러한 인위적인 제약을 제거하여 모델이 임의의 가드레일 없이 학습 데이터에 기반하여 콘텐츠를 생성할 수 있도록 합니다. 이는 핵심 제품이 성인 콘텐츠인 NSFW 애플리케이션과 사용자가 기업 안전 정책보다 스토리의 논리를 따르기를 원하는 창작 글쓰기에 특히 가치 있습니다.
- 일관성: 모델은 주관적인 콘텐츠 정책에 따라 프롬프트를 무작위로 거부하지 않습니다.
- 원본 출력: 정제 없이 모델의 어휘와 스타일을 모두 사용할 수 있습니다.
- 개발자 제어: 필요시 제공업체의 블랙박스 필터에 의존하기보다 직접 중재를 처리합니다.
OpenAI 호환성 설명
무검열 API는 OpenAI Chat Completions 사양을 따릅니다. 즉, Python, Node.js 또는 기타 언어용 공식 OpenAI SDK를 사용할 수 있으며, 베이스 URL만 https://api.uncensoredaichat.cc/v1로 변경하면 됩니다. 요청 구조는 동일하게 유지됩니다: user 및 assistant와 같은 역할을 가진 메시지 목록을 보내면 API는 생성 결과를 반환합니다. 이 호환성으로 인해 커스텀 HTTP 클라이언트를 작성하거나 고유한 JSON 형식을 파싱할 필요가 없으므로 통합의 마찰이 줄어듭니다.
모델 ID는 단순히 uncensored입니다. GET /v1/models를 통해 사용 가능한 모델을 나열할 수도 있습니다. 표준 스키마를 따르기 때문에 Server-Sent Events(SSE)를 통한 스트리밍, 함수 호출(도구), JSON 모드(response_format: {"type": "json_object"})와 같은 기능은 별도 설정 없이 작동합니다. 이는 GPT-4 또는 유사 모델에 고유한 특정 모델의 특이점에 의존하지 않는 한, 많은 OpenAI 기반 애플리케이션에 대체재로 사용할 수 있음을 의미합니다.
통합 단계
이미 OpenAI 호환 클라이언트에 익숙하다면 무검열 API를 통합하는 것은 간단합니다. 먼저 Google 또는 이메일 주소를 사용하여 계정을 생성하세요. 생성 즉시 활성화되는 API 키가 즉시 제공됩니다. 무료 체험 기간에는 전화번호 확인이나 신용카드 입력이 필요하지 않지만, 유료 사용에는 암호화폐 충전이 필요합니다.
다음으로 클라이언트를 구성합니다. 기본 URL을 https://api.uncensoredaichat.cc/v1로 설정하고 인증 헤더에 API 키를 설정합니다. 그런 다음 시스템 프롬프트와 사용자 메시지가 포함된 /v1/chat/completions에 POST 요청을 만듭니다. API는 temperature, top_p 및 stop 시퀀스와 같은 표준 매개변수를 지원합니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)마지막으로 응답을 처리합니다. API는 생성된 텍스트가 choices[0].message.content에 포함된 표준 JSON 객체를 반환합니다. 긴 작업의 경우 스트리밍을 사용하여 생성되는 토큰을 받으세요. 키당 분당 300회의 속도 제한이 있으므로 대량 데이터를 처리할 때는 지연 재시도 전략을 구현해야 합니다.
스트리밍 및 성능
Server-Sent Events(SSE)를 통해 스트리밍이 지원됩니다. 요청에 stream: true를 설정하면 API는 청크 시리즈를 반환합니다. 각 청크에는 부분 응답이 포함되며, 마지막 청크에는 토큰 사용 통계가 포함됩니다. 이는 텍스트가 생성되는 대로 표시하려는 채팅봇과 같은 실시간 애플리케이션에 중요합니다. 전체 응답을 기다릴 필요가 없습니다.
성능은 낮은 지연 시간으로 최적화되었습니다. 모델은 전용 서버에 호스팅되어 일관된 응답 시간을 보장합니다. 그러나 무검열 API는 텍스트 전용 서비스라는 점을 명심하십시오. 이미지 또는 오디오 생성을 지원하지 않으므로 멀티모달 출력이 필요한 애플리케이션의 경우 별도로 처리해야 합니다. 스트리밍 엔드포인트는 효율적이며 실제 텍스트 생성에 사용되는 토큰 외에 추가 토큰을 소비하지 않습니다.
컨텍스트 창 처리
무검열 API는 프롬프트와 생성을 모두 포함하는 100,000 토큰의 컨텍스트 창을 지원합니다. 이는 많은 다른 모델에서 찾을 수 있는 표준 8k 또는 32k 창보다 훨씬 크므로 잘림 없이 더 긴 대화나 문서를 전달할 수 있습니다. 그러나 요청당 최대 출력은 32,000 토큰이며, max_tokens을 지정하지 않으면 2,048 토큰입니다.
긴 컨텍스트를 효과적으로 관리하려면 애플리케이션 로직에 슬라이딩 윈도우 또는 요약 전략을 구현해야 합니다. 컨텍스트를 유지하기 위해 가장 최근의 메시지를 보내고 필요시 이전 부분을 아카이브하십시오. API는 컨텍스트를 자동으로 관리하지 않습니다. 개발자가 messages 배열을 올바르게 구조화해야 합니다. 이는 모델이 볼 수 있는 정보에 대한 완전한 제어를 제공하며 긴 형식의 역할극이나 문서 분석에서 일관성을 유지하는 데 중요합니다.
가격 및 크레딧
무검열 API는 선불 크레딧 시스템을 사용합니다. 월 구독이나 숨겨진 요금이 없습니다. 암호화폐로 계정을 충전하고 크레딧은 실제 토큰 사용량에 따라 청구됩니다. 가격은 투명합니다: 입력 토큰 1M당 $0.25, 출력 토큰 1M당 $1.00. 오류와 거부는 무료이므로 실패한 요청에 대해 지불하지 않습니다.
- 암호화폐 결제: USDT(TRC20) 또는 USDC(Base)를 통해 충전이 허용됩니다. 최소 충전 금액은 $10, 최대는 $500입니다.
- 보너스: $50 이상 충전 시 5% 보너스, $100 이상 충전 시 10% 보너스를 받습니다.
- 만료 없음: 크레딧에는 만료 기간이 없으므로 필요할 때 언제든지 사용할 수 있습니다.
$0.50의 무료 체험을 7일 동안 사용할 수 있으며 카드는 필요하지 않습니다. 이를 통해 암호화폐 충전 전에 API를 테스트할 수 있습니다.
일반적인 사용 사례
무검열 API는 원시적이고 필터 없는 텍스트 생성이 필요한 애플리케이션에 이상적입니다. 일반적인 사용 사례는 다음과 같습니다:
- NSFW 역할극: 콘텐츠 정책에 따라 모델이 거부하지 않도록 성인 콘텐츠를 생성합니다.
- 창작 글쓰기: 인위적인 제약 없이 모델이 더 어둡거나 복잡한 주제를 탐색하도록 허용합니다.
- 콘텐츠 생성: 표준 LLM에서 플래그될 수 있는 기사, 이야기 또는 스크립트를 생성합니다.
- 데이터 증강: 다른 모델 학습 또는 테스트를 위한 다양한 텍스트 샘플을 생성합니다.
API는 텍스트 전용이므로 이미지 또는 오디오 생성이 필요한 애플리케이션에는 적합하지 않습니다. 또한 모델은 속도보다 품질과 컨텍스트 길이에 최적화되어 있으므로 1초 미만의 응답 시간이 필요한 고빈도 저지연 작업에는 설계되지 않았습니다. 그러나 대부분의 개발자 애플리케이션에 대해 무검열 API는 신뢰할 수 있고 유연한 기반을 제공합니다.