中文 ▾
获取 API 密钥

无审查 OpenRouter:模型与成本对比

OpenRouter 聚合了多个 LLM 提供商,但要为 NSFW 或无限制角色扮演找到可靠的无审查选项,需要导航其特定的模型路由和定价层级。我们将平台上的可用无审查模型与我们的直接 API 进行对比,以帮助你决定哪种架构适合你的吞吐量和延迟需求。

更新于

要点

  1. OpenRouter 通过单一路由层提供访问 Llama 和 Mistral 等各种无审查模型。
  2. 我们的 API 提供单一、专用的无审查模型,具有透明的预付 token 定价,无订阅锁定。
  3. 与连接到专用服务器相比,路由会增加延迟和抽象开销。
  4. 我们平台上的预付额度永不过期,而 OpenRouter 余额可能有不同的管理规则。

什么是无审查 OpenRouter?

OpenRouter 充当各种大型语言模型的统一网关,允许开发人员在提供商之间切换,而无需更改集成代码。当寻找无审查体验时,用户通常会搜索经过微调或调整以移除标准安全拒绝的模型。该平台聚合了这些模型,无论底层提供商如何,都提供一致的接口。

对于构建 NSFW 应用程序或角色扮演机器人的开发人员来说,OpenRouter 简化了发现过程。你只需管理一个 API 密钥,而不是管理十个不同提供商的密钥。然而,这种便利性伴随着抽象。你依赖他们的路由层来连接到你实际的模型服务器。如果该层出现问题,你的应用程序会受到影响。相比之下,我们的服务是连接到单一、专为无审查目的构建的模型的直接线路,消除了中间商开销。

OpenRouter 无审查模型概览

OpenRouter 托管了几个以其无审查功能而闻名的模型。这些通常包括 Llama、Mistral 和 Mixtral 的开放权重变体,这些变体经过微调以自由回答。常见选择包括 meta-llama/llama-3-70b-instruct 变体或针对创意写作和角色扮演进行微调的特定 mistral 模型。

这些模型通常很强大,能够处理复杂的上下文。然而,由于 OpenRouter 跨不同的硬件和提供商路由请求,服务于你请求的具体实例可能会发生变化。这种变异性有时会导致峰值期间性能或可用性的不一致。我们的 API 在自有服务器上提供单一、专用的无审查模型,确保每个请求的一致行为和性能特征。

直接 API 与 OpenRouter 路由

主要区别在于连接路径。OpenRouter 位于你和模型之间。你的请求发送到 OpenRouter,然后转发给提供商。这会增加少量但可测量的延迟。对于高容量应用程序,这种开销会累积。

直接 API(如我们的)直接连接到推理服务器。这减少了往返时间,并为你提供更可预测的吞吐量。此外,路由引入了单点故障。如果 OpenRouter 出现故障,你集成的所有模型都会宕机。使用直接提供商,你只面临特定模型可用性的风险。对于每一毫秒都很重要的应用程序,直接连接通常更优越。

成本对比:按 token 计费

OpenRouter 的定价因模型和提供商而异。你按 token 付费,但费率差异很大。一些无审查模型可能更便宜,而其他则是高端的。你还需要考虑路由可能会增加少量利润,或者不同提供商有不同的基础费率。

我们的定价非常透明:输入 token 每 1M 个 $0.25,输出 token 每 1M 个 $1.00。没有路由隐藏费用。我们使用永不过期的预付额度系统。如果你充值,你只为使用的部分付费。错误和拒绝不消耗 token,因此你只为成功的完成付费。与在路由平台上导航多个按模型费率相比,这种模式对于高容量使用通常更经济。

延迟与吞吐量

延迟是第一个 token 到达所需的时间。吞吐量是你每秒可以生成的 token 数量。OpenRouter 的路由层引入了额外的网络跳数,这可能会增加延迟。虽然对于休闲使用通常可以忽略不计,但在实时聊天应用程序中会变得明显。

我们的 API 针对高吞吐量进行了优化。我们每个密钥每分钟处理 300 个请求,并允许 8 个并发请求。这确保你的应用程序可以保持稳定的响应流,而不会遇到任意路由限制。专用基础设施意味着我们可以针对此单一模型专门调整硬件,最大化效率。

功能对等:工具与 JSON

OpenRouter 和我们的 API 都支持标准的 OpenAI 兼容功能。你可以使用函数调用、JSON 模式和流式输出。我们的 API 支持 response_format 用于严格的 JSON 输出,这对于需要结构化数据的应用程序至关重要。我们还支持 temperature、top_p 和 seed 参数来控制随机性。

OpenRouter 在其模型系列中提供类似的功能。然而,功能支持可能因底层提供商而异。例如,一些路由模型可能不支持高级工具使用,或者上下文窗口有限。我们的 API 保证完全支持这些功能,因为我们控制从模型到 API 网关的整个堆栈。

内容过滤差异

无审查模型旨在最大限度地减少拒绝。在 OpenRouter 上,根据具体的模型变体和其微调情况,你可能仍然会遇到偶尔的拒绝。有些模型比其他模型更严格。我们的模型专门针对成人法律和争议性话题进行了调整,确保 NSFW 内容生成的高可靠性。

我们只有一个硬性限制:涉及未成年人的性内容始终会被拒绝。这是标准的安全基线。除此之外,从露骨小说到政治评论,我们的模型都能回答。OpenRouter 的无审查模型在拒绝率上可能有所不同,因此你可能需要测试多个模型,以找到符合你特定内容需求的那个。

决策表:如何选择

功能OpenRouter直接 API
路由开销是(更高延迟)否(直接连接)
定价模式按模型(因情况而异)固定费率($0.25/$1.00)
额度过期因提供商而异永不过期
模型选择多个选项单一优化模型
并发请求因情况而异每个 API 密钥 8 个并发

问答

OpenRouter 支持无审查模型的流式输出吗?

是的,OpenRouter 支持大多数模型的流式输出,包括无审查变体。你可以使用 Server-Sent Events (SSE) 接收生成的 token。我们的 API 也支持通过 SSE 进行流式输出,提供类似的体验,但由于直接连接,延迟更低。

我可以在 OpenRouter 上使用现有的 OpenAI SDK 吗?

是的,OpenRouter 旨在与 OpenAI SDK 兼容。你只需更改 base URL 和 API 密钥即可。我们的 API 也遵循 OpenAI chat completions 格式,因此你可以使用相同的 SDK,只需进行少量配置更改。

如果在 OpenRouter 上 token 使用过量会怎样?

当余额耗尽时,OpenRouter 通常会暂停你的请求或返回错误。你可以随时充值余额。在我们的平台上,预付额度永不失效,因此你可以随时充值而不会损失资金。

OpenRouter 上的无审查模型和这里的模型一样吗?

不一样。OpenRouter 托管来自不同提供商(如 Llama 和 Mistral)的各种无审查模型。我们的 API 提供单一的、专为无限制内容优化的无审查模型。如果你需要特定的模型变体,OpenRouter 可能会提供更多选择,但我们提供一致性和直接的性能。

只差一张表单,即可获得密钥

创建账户,复制密钥,更改 base URL。这就是全部设置。