中文 ▾
获取 API 密钥

如何选择用于无限制 AI 项目的私有 LLM API

私有 LLM API 提供专用的无审查文本接口,消除第三方内容过滤器和订阅锁定,让开发者完全控制模型行为和数据隐私。本指南解释了如何评估用于 NSFW 和无限制 AI 项目的无审查 LLM API,重点关注隐私政策、OpenAI 兼容性和透明的按需付费定价。

更新于

要点

  • 私有 LLM API 确保你的提示词不用于训练其他模型,从而保护敏感 NSFW 或商业应用的数据机密性。
  • 无审查模型消除了对合法成人内容、争议性话题和创意写作的任意拒绝,无需复杂的变通方法。
  • 按需付费定价配合预付额度消除了月度订阅费和未使用容量的成本,为可变使用量提供可预测的成本。
  • OpenAI 兼容接口允许你以最小的代码更改从商业提供商切换到无审查模型,支持流式输出和工具调用。

什么是私有 LLM API?

私有 LLM API 是一项托管服务,通过标准接口暴露大型语言模型,通常与 OpenAI 的结构兼容。与共享的公共实例或本地运行器不同,私有 API 为你的请求提供专用的计算资源。这种隔离确保了一致的性能和延迟,这对于需要可靠响应时间的应用程序至关重要。

此处的“私有”主要指数据处理和访问控制。当你使用私有 LLM API 时,你的 API 密钥用于验证请求,服务提供商承诺不将你的输入数据用于训练其通用模型。这与免费或共享层不同,在免费或共享层中,你的提示词可能会影响基础模型的权重。

对于构建 NSFW 或无限制 AI 应用的开发者来说,私有 API 消除了与内容过滤器斗争的摩擦。你不会收到针对合法成人内容的“403 Forbidden”响应,而是获得一致的文本输出。API 充当纯通道:输入文本,输出文本。这种简化降低了调试复杂性,因为你无需管理本地 GPU 驱动程序或模型版本控制。你只需将客户端指向 API URL 并发送请求即可。

为什么“无审查”对 NSFW 项目很重要

大多数商业 LLM 经过人类反馈强化学习 (RLHF) 调整,以变得“有用、无害且诚实”。这通常导致内容过滤器过于敏感,拒绝生成色情小说、讨论政治争议或分析安全漏洞。无审查 LLM API 消除了这些人为限制。该模型经过调整,可在合法成人用途中无内容拒绝地回答,允许你构建能够处理任何主题而不会出现意外阻止的应用程序。

需要注意的是,“无审查”并不意味着“无限制”。大多数提供商(包括本服务)都保持严格的内容限制:涉及未成年人的性内容将被阻止。这是标准的法律保障措施。除此之外,模型将生成可能被标准分类器标记的内容,包括详细描述、争议性观点或创意 NSFW 叙事。

对于创作者来说,这意味着你可以构建一个按用户预期行为运行的聊天机器人或故事生成器,而不会出现模型突然判定描述浪漫场景“不合适”的情况。无审查模型支持更广泛的创意和成人导向用例,使其成为 NSFW 聊天机器人 API、成人游戏 NPC 和无限制内容生成工具的理想选择。

隐私:数据使用与训练政策

当你向 LLM 发送数据时,会发生两件事:模型生成响应,并且数据被存储或使用。在公共 API 中,你的提示词可能会短期存储用于调试,或用于训练未来的模型版本。在私有 LLM API 中,隐私政策通常更加明确。我们的服务确保提示词不用于训练。你的数据归你所有。

账户创建仅需电子邮件和密码。试用层级不需要电话号码或信用卡。这减少了你向提供商共享的个人身份信息 (PII) 数量。API 密钥是你使用的唯一标识符。你可以随时重新生成它,这将立即撤销旧密钥,提供一个简单的安全模型,无需复杂的权限范围。

对于 NSFW 项目,隐私通常是一个主要关注点。用户可能会分享敏感的个人故事或偏好。知道你的 API 提供商不对你的数据进行训练,意味着你的用户交互保持机密。这是与大型科技公司利用用户数据改进其核心模型的关键区别。使用私有 API,你保留对数据谱系的完全控制。

OpenAI 兼容性与专有 SDK

OpenAI 兼容性意味着 API 遵循 OpenAI Chat Completions 接口使用的标准 JSON 架构。这允许你使用官方 OpenAI SDK 或任何支持 OpenAI 格式的客户端。你只需在配置中更改基础 URL 和 API 密钥。这显著减少了集成工作量。如果你有为 GPT-4 构建的现有代码,你可以以最小的更改切换到无审查模型。

专有 SDK(如 Anthropic 或 Google 的 SDK)通常需要特定的库,并以独特的方式处理流式输出或工具调用。使用 OpenAI 兼容 API 时,你可以为多个模型使用单个代码库。这对于希望根据成本或性能交换模型而无需重写整个应用层的开发者至关重要。

我们的 API 支持通过服务器发送事件 (SSE) 进行流式输出和工具/函数调用。这些是 OpenAI 架构中的标准功能。流式输出允许你在生成 token 时将其发送给用户,从而改善感知延迟。工具调用使模型能够执行函数,这对于构建 AI 代理至关重要。这两个功能都在标准兼容层内工作,确保你切换到无审查提供商时不会丢失功能。

理解上下文窗口与 Token 成本

上下文窗口决定了模型在单次对话中能记住多少文本。100,000 token 的上下文窗口允许大量的历史记录,从而实现复杂的多轮对话或处理大型文档。这显著大于旧模型的 8,000 token 限制,允许更连贯的长篇幅交互。

Token 成本按每百万 token 计算。输入 token 是你发送的文本(提示词),输出 token 是模型生成的文本(补全)。在我们的定价模型中,输入 token 的成本为每 1M token 0.25 美元,输出 token 的成本为每 1M token 1.00 美元。这意味着生成文本的成本是读取文本的四倍,这对于基于 Transformer 的模型来说是典型的。

在估算成本时,请考虑具有大上下文窗口的长对话将迅速消耗输入 token。如果你构建保留完整历史记录的聊天机器人,你的输入成本将会上升。然而,按需付费意味着你只为使用的部分付费。没有预留容量的月度费用。你可以随时停止使用 API 且无需支付任何费用。

按需付费与订阅模式

订阅模式为一定数量的请求或 token 收取固定的月度费用。如果你未使用配额,你将损失价值。如果你超出配额,你将支付超额费用。按需付费 (PAYG) 仅按实际使用情况收费。我们的 API 使用预付额度系统。你添加资金,余额会随着你发出请求而减少。预付额度永不过期。

对于可变使用模式,PAYG 更高效。如果你的项目有流量高峰,你无需立即升级到更高级别。你只需确保预付余额充足即可。如果使用量下降,你无需为空闲容量付费。这对于在承诺更大基础设施之前测试模型的独立开发者、初创公司或创作者来说非常理想。

我们还为大额充值提供额外额度。添加 50 美元可获得 +5% 的额外额度,添加 100 美元可获得 +10% 的额外额度。这降低了每个 token 的有效成本。没有隐藏费用或超额政策。只要你的信用余额足以覆盖 token 成本,你的请求就会得到处理。这种透明度使预算编制变得简单明了。

技术要求:流式输出与工具调用

流式输出对于良好的用户体验至关重要。API 在生成文本块时发送它们,而不是等待整个响应生成。这降低了感知延迟,允许用户立即开始阅读。我们的 API 支持通过服务器发送事件 (SSE) 进行流式输出,这是 OpenAI 兼容客户端的标准。

工具调用(或函数调用)允许模型输出你的应用程序可以执行的结构化数据。例如,模型可以决定调用“get_weather”函数。API 返回一个包含函数名称和参数的 JSON 对象。你的代码执行该函数并将结果发送回模型以获取最终答案。这对于构建能够与外部系统交互的 AI 代理至关重要。

这两个功能都通过标准 POST /v1/chat/completions 接口提供。你不需要标准 OpenAI 架构之外的特殊标头或参数。这确保你的集成保持可移植性。如果你将来需要更换提供商,代码结构保持不变。

如何将 API 集成到你的技术栈中

如果你的应用程序使用 OpenAI 兼容客户端,集成非常简单。你需要两个信息:基础 URL 和你的 API 密钥。我们 API 的基础 URL 是 https://api.anonymousllmapi.com/v1。模型 ID 是 uncensored。

对于 Python 用户,你可以安装 openai 库并配置客户端。下面的代码示例展示了如何设置基础 URL 并发起请求。

from openai import OpenAI

client = OpenAI(base_url="https://api.anonymousllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

对于 Node.js 用户,过程类似。你在配置中设置 baseURL。下面的代码示例演示了这一点。

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.anonymousllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

对于快速测试,你可以使用 curl 直接向接口发送请求。这对于调试或验证连接非常有用。

curl https://api.anonymousllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

这些示例假设你正在使用官方库。如果你使用其他客户端,请确保它支持自定义基 URL。API 密钥在注册后立即提供。试用无需信用卡,包含 7 天内有效的 $0.50 额度。

选择无审查 API 的最终检查清单

在确定使用 API 之前,请验证以下标准,以确保其满足项目需求:

  • 隐私政策: 确认提示词不用于训练。我们的服务不使用你的数据进行训练。
  • 内容过滤器: 确保模型允许合法成人内容。我们的模型经过调整,可提供无审查的回复。
  • 定价模式: 对于可变使用量,优先选择按量付费而非订阅。我们的预付额度永不过期。
  • 兼容性: 验证 OpenAI 兼容性以实现轻松集成。我们的 API 支持标准接口。
  • 速率限制: 检查每分钟请求数限制。每个密钥的限制为每分钟 300 个请求。
  • 上下文窗口: 确保上下文窗口足以满足你的用例。我们的模型支持 100,000 token。

通过遵循此检查清单,你可以避免常见陷阱,并选择一个在技术上稳健且符合你隐私和内容要求的 API。

问答

无审查模型与 GPT-4 或 Claude 相同吗?

不。该模型是一个开放权重模型,托管在我们自己的 GPU 服务器上。它不是 GPT、Claude、Gemini、Grok 或任何其他供应商的模型。它经过调整,可在合法成人用途中无内容拒绝地回答问题。

如何开始使用 API?

在“获取 API 密钥”页面使用电子邮件和密码注册。你将立即获得 API 密钥。你可以从 7 天内有效的 $0.50 试用额度开始,无需信用卡。对于持续使用,请使用加密货币(USDT 或 USDC)充值。

速率限制是多少?

限制为每个密钥每分钟 300 个请求。请求体大小限制为 8 MB。您可以随时重新生成密钥,这将使旧密钥失效。

API 支持流式输出和工具调用吗?

是的。API 支持通过服务器发送事件 (SSE) 进行流式输出,并通过标准 <code>POST /v1/chat/completions</code> 接口支持工具/函数调用。这与官方 OpenAI SDK 兼容。

只差一张表单,即可获得密钥

创建账户,复制密钥,更改基础 URL。这就是全部设置。