無審查 OpenRouter:比較模型與成本
OpenRouter 彙整多個 LLM 供應商,但若要為 NSFW 或無限制角色扮演尋找可靠的無審查選項,需要瀏覽其特定的模型路由和定價層級。我們將平台上的可用無審查模型與我們的直接 API 進行比較,以協助你決定哪種架構適合你的用量和延遲需求。
更新於
重點
- OpenRouter 透過單一路由層提供存取各種無審查模型(如 Llama 和 Mistral)。
- 我們的 API 提供單一專屬的無審查模型,具有透明的預付 token 定價,且無訂閱綁定。
- 與直接連線至專屬伺服器相比,路由會增加延遲和抽象化開銷。
- 我們平台上的預付額度永不過期,而 OpenRouter 的餘額可能有不同的管理規則。
什麼是無審查 OpenRouter?
OpenRouter 作為各種大型語言模型的統一閘道,讓開發者可以在不變更整合程式碼的情況下切換供應商。當尋找無審查體驗時,使用者通常會搜尋經過微調或對齊以移除標準安全拒絕的模型。此平台彙整這些模型,提供一致的介面,無論底層供應商為何。
對於開發 NSFW 應用程式或角色扮演機器人來說,OpenRouter 簡化了發現過程。你只需管理一個 API 金鑰,而非管理十個不同供應商的 API 金鑰。然而,這種便利性伴隨著抽象化。你依賴其路由層來連線至實際的模型伺服器。如果該層出現問題,你的應用程式就會感受到影響。相比之下,我們的服務是直接連線至單一專門設計的無審查模型,消除了中間人的開銷。
OpenRouter 無審查模型概覽
OpenRouter 託管多個以無審查能力聞知的模型。這些通常包括經過微調以自由回答的 Llama、Mistral 和 Mixtral 開放權重模型變體。常見選擇包括 meta-llama/llama-3-70b-instruct 變體或針對創意寫作和角色扮演進行微調的特定 mistral 模型。
這些模型通常具有強大的能力,能夠處理複雜的上下文。然而,由於 OpenRouter 跨不同硬體和供應商路由請求,提供請求的具體實例可能會有所不同。這種變異性有時會導致高峰時段的效能或可用性不一致。我們的 API 在我們自己的伺服器上託管單一專屬的無審查模型,確保每個請求具有一致的行為和效能特徵。
直接 API 與 OpenRouter 路由
主要差異在於連線路徑。OpenRouter 位於你與模型之間。你的請求會傳送至 OpenRouter,然後由其轉發至供應商。這會增加少量但可測量的延遲。對於高用量應用程式,這種開銷可能會累積。
直接 API(如我們的)直接連線至推論伺服器。這減少了往返時間,並提供更可預測的吞吐量。此外,路由引入了單一故障點。如果 OpenRouter 發生停擺,所有整合的模型都會中斷。使用直接供應商時,你只會面臨特定模型可用性的風險。對於每一毫秒都很重要的應用程式,直接連線通常更優越。
成本比較:每 token
OpenRouter 的定價因模型和供應商而异。你按 token 付費,但費率差異很大。某些無審查模型可能較便宜,而其他則是高價。你還需要考慮路由可能會增加少量利潤,或不同供應商有不同的基本費率。
我們的定價完全透明:每 1M 輸入 token 為 $0.25,每 1M 輸出 token 為 $1.00。沒有路由的隱藏費用。我們使用永不過期的預付額度系統。如果你儲值,你只需為實際使用的部分付費。錯誤和拒絕不會消耗 token,因此你只需為成功的完成付費。這種模式在與路由平台上的多個每模型費率相比時,通常更具經濟效益。
延遲與吞吐量
延遲是第一個 token 到達所需的時間。吞吐量是你每秒可以生成的 token 數量。OpenRouter 的路由層引入了額外的網路跳躍,這可能會增加延遲。雖然對於一般使用通常可以忽略不計,但在即時聊天應用程式中會變得明顯。
我們的 API 針對高吞吐量進行了最佳化。我們每個金鑰處理每分鐘 300 個請求,並允許 8 個並行請求。這確保你的應用程式可以維持穩定的回應串流,而不會觸及任意路由限制。專用基礎設施意味著我們可以針對此單一模型調整硬體,以最大化效率。
功能對等:工具與 JSON
OpenRouter 和我們的 API 都支援標準的 OpenAI 相容功能。你可以使用函式呼叫、JSON 模式和串流輸出。我們的 API 支援 response_format 以進行嚴格 JSON 輸出,這對於需要結構化資料的應用程式至關重要。我們也支援 temperature、top_p 和 seed 參數以控制隨機性。
OpenRouter 在其模型系列中提供類似的功能。然而,功能支援可能因底層供應商而异。例如,某些路由模型可能不支援進階工具使用,或者具有有限的上下文視窗。我們的 API 保證完全支援這些功能,因為我們控制從模型到 API 閘道的整個堆疊。
內容過濾差異
無審查模型旨在最小化拒絕。在 OpenRouter 上,根據特定的模型變體及其微調情況,你仍可能會遇到偶爾的拒絕。某些模型比其他模型更嚴格。我們的模型專門針對成人法律和爭議性主題進行調整,確保 NSFW 內容生成的高可靠性。
我們確實有一個硬性限制:涉及未成年人的性內容一律拒絕。這是標準的安全基線。至於其他所有內容,從露骨的虛構作品到政治評論,我們的模型都設計為予以回應。OpenRouter 的無審查模型在拒絕率上可能各異,因此你可能需要測試多個模型,才能找到符合你特定內容需求的模型。
決策表:選擇哪一個
| 功能 | OpenRouter | 直接 API |
|---|---|---|
| 路由開銷 | 是(較高延遲) | 否(直接連線) |
| 定價模式 | 依模型而定(視模型而異) | 固定費率 ($0.25/$1.00) |
| 額度過期 | 依供應商而异 | 永不過期 |
| 模型選擇 | 多種選項 | 單一最佳化模型 |
| 並行處理能力 | 視情況而定 | 每個金鑰限 8 個並行請求 |
問答
OpenRouter 支援無審查模型的串流輸出嗎?
是的,OpenRouter 支援其大多數模型的串流輸出,包括無審查變體。您可以使用 Server-Sent Events (SSE) 接收生成的 token。我們的 API 也支援透過 SSE 進行串流輸出,提供類似的體驗,但由於直接連線,延遲更低。
我可以在 OpenRouter 上使用現有的 OpenAI SDK 嗎?
是的,OpenRouter 設計為與 OpenAI SDK 相容。你只需變更基礎 URL 和 API 金鑰即可。我們的 API 也遵循 OpenAI 聊天完成格式,因此你可以使用相同的 SDK,僅需進行少量設定變更。
如果在 OpenRouter 上過度使用 token 會發生什麼事?
當您的餘額耗盡時,OpenRouter 通常會暫停您的請求或回傳錯誤。您可以隨時儲值。在我們的平台上,預付額度永不過期,因此您可以隨時儲值而不會損失資金。
OpenRouter 上的無審查模型與這裡的相同嗎?
不相同。OpenRouter 託管來自不同提供者(如 Llama 和 Mistral)的各種無審查模型。我們的 API 提供單一專屬的無審查模型,針對無限制內容進行最佳化。如果您需要特定的模型變體,OpenRouter 可能會提供更多選擇,但我們提供一致性和直接效能。
只差一張表單,即可取得金鑰
建立帳戶、複製金鑰、變更基礎 URL。這就是完整的設定流程。