完整指南:在你的应用中集成无限制 AI
无审查 AI 移除限制创造力与回答深度的安全壁垒,使 LLM 模型能够生成成人内容、探索争议性细微差别,并在执行复杂角色扮演时不会过早拒绝。本技术指南说明如何集成提供该一致行为的 OpenAI 兼容 API,重点在于实际实现与技术限制管理。
更新于
要点
- “无审查”模型是开放的,运行在自有服务器上,并忽略对合法成人内容的拒绝,除非涉及未成年人。
- API 遵循 OpenAI 标准,只需更改 base_url 和身份验证 token 即可立即集成。
- 100,000 token 的上下文窗口支持长对话,但需要主动管理以避免截断或产生过高费用。
- 价格透明(输入 token 为 $0.25/1M,输出为 $1.00/1M),预付额度永不失效。
为什么要使用无限制 AI?
许多标准语言模型经过“安全”偏见训练,即使话题完全适合预期用途,也会拒绝成人、性或政治敏感话题。无限制 AI消除了这种任意过滤,使模型基于开放权重训练进行响应,专注于忠实于用户提示词,而非专有审核层。
这对于沉浸式角色扮演应用至关重要,其中角色可能具有更大胆的性格特征,或者用于文本生成,其中模型不应跳过叙事步骤以“清理”回复。与应用激进过滤器的通用平台不同,我们的模型经过专门调整,以响应所有合法内容,保持上下文连贯性,而不会频繁出现“内容不当”的中断。
兼容 OpenAI API 的优势
使用遵循 OpenAI 标准的 API 的最大技术优势是可移植性。你无需学习新的请求语法或编写自定义客户端。只需将 base_url 指向 https://api.apiiasemcensura.com/v1 并替换你的 API 密钥。这允许使用 Python、Node.js 和其他语言的官方 SDK。
- 即时集成: 使用
openai的现有代码只需进行最小配置调整即可运行。 - 标准化: 接口
/v1/chat/completions是行业标准,确保与接受 OpenAI 兼容 API 的第三方工具兼容。 - 简单性: 无需在多个模型之间进行复杂路由。你可以直接访问托管在我们专用 GPU 服务器上的“无审查”模型。
API 密钥初始设置
初始设置旨在快速且无摩擦。你只需提供电子邮件和密码即可创建账户。获取试用额度无需插入信用卡,注册后 API 密钥会立即显示。
要开始,你需要在账户创建页面获取密钥。请记住,每个账户只有一个活动密钥。如有必要,你可以随时重新生成它,这将立即使旧密钥失效。此密钥必须随所有请求一起发送,置于 Authorization: Bearer YOUR_API_KEY 标头中。
Chat Completions 接口实现
我们 API 的核心是 POST /v1/chat/completions 接口。它接受消息列表(system、user、assistant)并返回完整的文本回复。要使用无审查模型,你必须将 model 指定为 uncensored。
from openai import OpenAI
client = OpenAI(base_url="https://api.apiiasemcensura.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
启用流式输出以实现快速响应
对于需要低感知延迟的应用(如实时聊天机器人),通过服务器发送事件 (SSE) 启用流式输出至关重要。设置 stream: true 后,服务器会在生成 token 时发送 token 块,允许客户端立即显示它们,而无需等待完整计算结束。
这显著改善了用户体验,特别是对于长回复。无审查模型通过相同的 chat completions 接口原生支持此功能。
使用函数调用实现高级功能
除了文本生成外,API 还支持 函数调用。这允许模型执行外部操作,如获取数据或执行计算,通过在请求的 tools 字段中定义函数模式来实现。
模型将识别何时应使用工具,并返回 tool_calls 类型的回复,而不是纯文本。然后你在后端执行函数,并将结果发送回 API,以便模型根据结果生成最终回复。这对于创建在封闭模型典型工具限制之外运行的自主代理非常强大。
管理 100k token 上下文
我们的 API 支持 100,000 token 的上下文窗口,结合提示词和回复。这允许加载大量对话历史或参考文档。然而,上下文是有限的。
你必须主动管理对话大小。如果历史记录超出限制,API 可能会截断较早的消息,或者如果正文超过 8 MB 则拒绝请求。API 没有定义在开头或结尾截断的固定规则;管理上下文窗口(例如,删除旧消息或总结之前的对话)的责任在于开发者。
使用监控和限制
为确保服务稳定性,有明确的使用限制。每个 API 密钥限制为每分钟 300 个请求。请求正文不能超过 8 MB。
如果你超出速率限制,将收到 HTTP 429 错误(请求过多)。重要的是在你的代码中实现指数退避重试。由于没有月费,消耗按处理的 token 计算。你可以在账户页面监控你的信用额度,预付额度永不失效。
结论和后续步骤
通过标准 OpenAI API 集成无审查 AI,在完全控制生成内容与易于技术实现之间提供了理想平衡。使用“uncensored”模型可确保您的角色扮演、成人文本或研究应用不会因人工过滤而中断。
要开始,请访问我们的平台,创建账户并获取 API 密钥。使用你的 $0.50 试用额度测试模型,并在需要时添加额度以继续使用服务。凭借清晰的技术文档和透明的价格,集成直接且高效。
常见问题
该模型中的“无审查”具体指什么?
这意味着模型没有激进的过滤层,不会在话题合法时阻止成人、性或争议性内容。它根据用户提示词响应,不基于“敏感性”进行拒绝,从而提供更大的创作自由并忠实于上下文。唯一严格且普遍的硬性限制是涉及未成年人的性内容,这始终会被阻止。
价格是多少?支付方式如何运作?
输入 token 的价格为每 100 万 token $0,25,输出 token 的价格为每 100 万 token $1,00。没有月订阅费,也没有使用费。你通过预付额度进行支付,额度永不过期。最低充值金额为 $10,充值金额越高获得的额度奖励越多(充值 $50 起赠送 5%,充值 $100 起赠送 10%)。
我可以使用此模型生成图像或音频吗?
不可以。该 API 仅提供用于文本的大语言模型 (LLM)。不支持嵌入 (embeddings)、图像生成、音频或视频。主要接口为 /v1/chat/completions,专注于纯文本交互。
我的提示词数据会用于训练模型吗?
不会。隐私得到保障:你的提示词和回复不会被用于训练模型。该模型为开放权重模型,运行在我们的服务器上,仅用于响应你的特定请求。
您的密钥只需一个表单
创建账户,复制密钥,并更改基础 URL。这就是全部配置。