要点
- API 使用标准的 OpenAI 兼容接口,现有客户端只需更改基础 URL 即可。
- 它提供单一无审查模型,拥有 100k 上下文窗口,专注于无额外功能的原始文本生成。
- 定价为预付模式,透明且清晰:输入 token 为 $0.25/1M,输出 token 为 $1.00/1M。
- 仅支持通过 USDT 或 USDC 进行加密货币充值,无订阅锁定或月费。
什么是无审查 API?
无审查 API 是一项托管服务,通过标准的 chat-completions 接口暴露单一大型语言模型。与聚合多个模型或提供基于 Web 聊天界面的平台不同,该服务专注于为需要原始、无过滤文本生成的开发者提供一个高性能的无审查模型。该模型经过调整,可在合法成人用途中无内容拒绝地回答问题,非常适合角色扮演、创意写作或标准过滤器可能干扰输出的应用。
它不是 GPT、Claude 或 Gemini 的包装器;它是一个在专用服务器上运行的独立开放权重模型。这一区别很重要,因为您获得的是一致行为配置文件,而非可能不可预测地切换模型的路由层。API 处理文本输入和输出,支持流式输出、函数调用和 JSON 模式,但不提供嵌入、图像生成或音频处理。
为什么选择无审查 LLM?
标准 LLM 经过基于人类反馈的强化学习 (RLHF) 训练,往往导致过度拒绝。它们可能会拒绝与暴力、性或争议性主题相关的良性提示词,仅仅因为检测到触发安全过滤器的模式。无审查 LLM 移除了这些人为约束,允许模型基于其训练数据生成内容,而无需任意护栏。这对于 NSFW 应用(核心产品为成人内容)以及用户希望模型遵循故事逻辑而非企业安全政策的创意写作特别有价值。
- 一致性: 模型不会基于主观内容策略随机拒绝提示词。
- 原始输出: 您获得模型完整的词汇和风格范围,无需消毒。
- 开发者控制: 如果需要,您可以自行处理审核,而不是依赖提供方的黑盒过滤器。
OpenAI 兼容性说明
无审查 API 遵循 OpenAI Chat Completions 规范。这意味着您可以使用官方的 Python、Node.js 或其他语言的 OpenAI SDK,只需将基础 URL 更改为 https://api.uncensoredaichat.cc/v1。请求结构保持不变:您发送带有 user 和 assistant 等角色的消息列表,API 返回补全内容。这种兼容性降低了集成摩擦,因为您无需编写自定义 HTTP 客户端或解析独特的 JSON 格式。
模型 ID 仅为 uncensored。您也可以通过 GET /v1/models 列出可用模型。由于遵循标准架构,通过服务器发送事件 (SSE) 的流式输出、函数调用 (tools) 和 JSON 模式 (response_format: {"type": "json_object"}) 功能开箱即用。这使得它成为许多基于 OpenAI 应用的即插即用替代品,前提是不依赖 GPT-4 或类似模型特有的特定模型怪癖。
集成步骤
如果您已经熟悉 OpenAI 兼容客户端,集成无审查 API 非常简单。首先,使用 Google 或电子邮件地址注册账户。您将立即收到 API 密钥,创建后即生效。试用无需电话验证或输入信用卡,尽管付费使用需要加密货币充值。
接下来,配置您的客户端。将基础 URL 设置为 https://api.uncensoredaichat.cc/v1,并在授权头中设置 API 密钥。然后,向 /v1/chat/completions 发送 POST 请求,包含系统提示词和用户消息。API 支持标准参数,如 temperature、top_p 和 stop 序列。
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredaichat.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)最后,处理响应。API 返回标准 JSON 对象,生成的文本位于 choices[0].message.content。对于长时间运行的任务,请使用流式输出以接收生成的 token。请记住,API 的速率限制为每个密钥每分钟 300 次请求,因此在处理批量数据时请实施退避策略。
流式输出与性能
支持通过服务器发送事件 (SSE) 进行流式输出。当在请求中设置 stream: true 时,API 返回一系列数据块。每个数据块包含部分响应,最后一个数据块包含 token 使用统计信息。这对于聊天机器人等实时应用至关重要,因为您希望在生成文本时显示文本,而不是等待完整的补全内容。
性能针对低延迟进行了优化。模型托管在专用服务器上,确保响应时间一致。但是,请注意无审查 API 是纯文本服务。它不支持图像或音频生成,因此如果您的应用需要多模态输出,您需要单独处理这些内容。流式输出端点高效,不会消耗超出实际文本生成使用的额外 token。
处理上下文窗口
无审查 API 支持 100,000 token 的上下文窗口,包括提示词和补全内容。这比许多其他模型中常见的 8k 或 32k 窗口大得多,允许您传递更长的对话或文档而无需截断。但是,每次请求的最大输出为 32,000 token,如果不指定 max_tokens 则为 2,048 token。
为了有效管理长上下文,您应在应用逻辑中实现滑动窗口或摘要策略。发送最新消息以保持上下文,并在需要时归档旧部分。API 不会自动为您管理上下文;由开发者正确构造 messages 数组。这使您对模型可见的信息拥有完全控制权,这对于保持长篇角色扮演或文档分析的一致性非常重要。
定价与额度
无审查 API 使用预付额度系统。没有月度订阅或隐藏费用。您使用加密货币为账户充值,额度根据实际 token 使用情况扣除。定价透明:每 100 万输入 token $0.25,每 100 万输出 token $1.00。错误和拒绝是免费的,因此您无需为失败的请求付费。
- 加密货币支付: 接受 USDT (TRC20) 或 USDC (Base) 充值。最低充值 $10,最高 $500。
- 奖励: 充值 $50 或以上可获得 5% 奖励,充值 $100 或以上可获得 10% 奖励。
- 永不过期: 额度永不过期,您可以随时使用。
您可以从 $0.50 的免费试用开始,有效期 7 天,无需信用卡。这允许您在承诺加密货币充值之前测试 API。
常见用例
无审查 API 非常适合需要原始、无过滤文本生成的应用。常见用例包括:
- NSFW 角色扮演: 生成成人内容,模型不会基于内容策略拒绝。
- 创意写作: 允许模型探索更黑暗或更复杂的主题,无需人为约束。
- 内容生成: 生成可能被标准 LLM 标记的文章、故事或剧本。
- 数据增强: 生成多样化的文本样本,用于训练或测试其他模型。
由于 API 是纯文本的,因此不适合需要图像或音频生成的应用。它也不适用于需要亚秒级响应时间的高频低延迟任务,因为模型针对质量和上下文长度而非速度进行了优化。然而,对于大多数开发者应用而言,无审查 API 提供了可靠且灵活的基础。