中文 ▾
获取 API 密钥

首页指南

无审查 AI:生产环境技术清单

在生产环境中部署无审查 AI API 需要验证原生兼容性、管理长上下文并确保数据隐私。此技术清单指导开发者集成无过滤 LLM 模型,侧重于简化流程和完全控制环境。

更新于

关键点

  1. “无审查”模型原生兼容 OpenAI API 格式,便于无需复杂适配器即可立即集成。
  2. 100k token 的上下文窗口允许处理长文档,但需要策略性管理以优化成本。
  3. API 密钥轮换是手动的,会立即重新生成凭证,无需额外配置即可使旧凭证失效。
  4. 涉及未成年人的性内容受到严格且持续的屏蔽,而其他成人主题仍然可用。

基础模型评估:真的没有过滤吗?

在集成无审查LLM模型之前,必须确认无限制是模型本身的特性,而非仅由平台配置决定。我们的模型被标识为'无审查',专为在成人内容、安全研究或争议性话题中避免典型的拒绝响应而设计。

  • 行为验证: 使用通常在标准模型中触发便利过滤器的提示词进行测试。
  • 明确的限制: 与基于概率的过滤器不同,这里的屏蔽是严格的:任何情况下都不允许涉及未成年人的性内容。
  • 独立性: 它不是 GPT、Claude 或 Gemini 的修改版;它是一个专为此目的优化的开放权重模型。

验证这一点时,请确保 API 没有应用会删除有效响应的后处理审核。模型行为的透明度对于 NSFW 内容应用或自由叙事至关重要。

SDK 兼容性与响应格式

我们无审查ai api的主要优势是与OpenAI生态系统的原生兼容性。这意味着你可以使用相同的官方SDK(Python、Node.js等),只需更改base URL和API密钥。

  • 标准接口: 我们使用 POST /v1/chat/completions,确保输入和输出格式与行业标准完全相同。
  • 工具(函数调用): 支持函数和工具调用,允许你在应用中编排操作,无需手动解析文本。
  • 官方 SDK: 你不需要第三方库或自定义适配器。

这大大减少了集成时间。使用标准格式,你的代码保持简洁且可维护,利用现有 SDK 处理 JSON 序列化和响应的稳健性。

100k Token 上下文管理

拥有 100,000 token 的上下文窗口,你可以在单次请求中发送长文档并接收长响应。这对于大文件分析或在不丢失上下文的情况下生成连续内容非常理想。

  • Token 成本: 请记住,输入 token(提示词)和输出 token(补全)都会收费。输入每百万 token $0.25,输出每百万 token $1.00,长上下文会直接影响账单。
  • 截断策略: 如果超出限制,API 将返回错误。在发送请求之前,在应用中实现逻辑以截断聊天历史或输入文档。
  • 监控: 检查已使用 token 的指标,以优化对话长度并避免不必要的成本。

100k token 的能力提供了灵活性,但需要仔细管理预算,以保持高容量应用的效率。

错误处理与速率限制

为了实现稳健的集成,你必须考虑速率限制和常见错误。我们的 API 允许每个 API 密钥每分钟最多 300 次请求,请求体限制为 8 MB。

  • 速度限制: 如果超过每分钟 300 次请求,你将收到指示你已超过限制的响应。在代码中实现指数退避以重试失败的请求。
  • Payload 大小: 确保你的请求不超过 8 MB,这在上下文非常大时虽然罕见但可能发生。
  • 重试: 优雅地处理速率限制错误,以免中断最终用户体验。

这些限制的可预测性有助于正确调整基础设施规模,并避免生产环境中的意外中断。

高容量成本优化

按使用量付费且无月度订阅的模式允许精确的财务控制。使用永不过期的预付额度,你可以规划长期支出,无需担心自动续订。

  • 奖励阶梯: 充值 $50 可获得 5% 的额外信用额度;充值 $100 可获得 10% 的额外额度。这降低了高容量下的每个 token 有效成本。
  • 透明度: 没有隐藏费用或额外的基础设施成本。你只为消耗的 token 付费。
  • 监控: 使用处理的 token 指标来预测未来成本,并根据工作流程调整充值频率。

透明的价格和批量奖励使该 API 在持续生成大量文本的应用中具有竞争力。

数据隐私与训练使用

隐私是许多企业和内容应用的关键因素。我们的政策很明确:你发送到 API 的请求不用于训练模型。

  • 数据使用:你的提示词和补全内容会关联到你的账户以保留历史记录,但不会添加到基础模型的训练数据集中。
  • 最小注册: 你只需要电子邮件和密码即可创建账户,无需提供其他敏感信息。
  • 法律中立: 模型在内容方面是中立的,但你的输入数据隐私得到保证。

这使得你可以将API用于敏感项目,无需担心你的定制数据会被用于提升竞争对手的能力或在未来的模型中泄露。这是相对于使用API数据来改进其专有模型的供应商的竞争优势。

实时流式集成

流式输出通过逐个 token 显示响应而不是等待整个文本生成来改善用户体验。我们的 API 原生支持服务器发送事件 (SSE) 流式输出。

  • 实现: 发送 POST 请求时,包含参数 stream: true。SDK 将自动处理流式连接。
  • 感知延迟: 用户立即看到响应,这对于聊天机器人或交互式应用至关重要。
  • 服务器资源: 流式输出保持连接打开直到结束,如果有很多活跃用户,可能会在你的服务器上消耗更多的并发资源。

确保正确管理流式连接的打开和关闭,以避免客户端应用程序中的资源泄漏。

API 密钥的安全性与轮换

API 访问安全至关重要。每个账户仅有一把 API 密钥,注册后立即显示。该密钥是你发起请求的身份凭证。

  • 手动轮换: 你可以随时在控制面板中重新生成 API 密钥。生成新密钥后,旧密钥将立即失效。
  • 单一密钥: 每个账户不允许多个密钥,从而简化访问管理。如果丢失密钥,只需重新生成即可。
  • 保护: 将密钥存储在安全的环境变量中,不要将其暴露在客户端源代码中。

手动轮换让你完全掌控访问何时过期,无需依赖基于时间的自动过期机制。这适用于安全审计或团队变更。

常见问题

该 API 使用什么具体模型?

我们使用一个被标识为“无审查”的开放权重模型,专门针对成人内容和各类主题的去审查进行了优化。它不是 GPT、Claude 或其他专有模型的复制品。

API 密钥如何轮换?

轮换是手动的。你可以随时在账户中重新生成 API 密钥。执行此操作后,旧密钥将立即被撤销,新密钥成为发起请求的唯一有效密钥。

该 API 可以生成图像吗?

不可以。该 API 专用于文本。不提供图像、音频、视频或嵌入生成。仅通过 chat-completions 接口处理输入文本和输出文本。

哪些类型的内容会被屏蔽?

唯一始终严格屏蔽的是涉及未成年人的性内容。其他所有成人内容、虚构作品、安全研究或有争议的主题均允许。

你的密钥触手可及

创建账户,复制密钥,更改基础 URL。就是这么简单。

获取 API 密钥