團隊在做 Agent、Copilot 替代方案或自建 LLM 網關时,OpenRouter 几乎是繞不開的名字:一個 API Key、改一個 model 參數就能切 Claude、GPT、Gemini 等三百多个模型。但帳單到底怎么算?和直連 Anthropic / OpenAI / Google 差多少?本文按 2026 年 7 月 公開報價,把計費公式、隱藏費用和三大家旗艦模型的真實單次調用成本算清楚。
OpenRouter 計費公式:一分鐘搞懂
OpenRouter 采用預充值、按 token 扣费,沒有月費套餐。每次 API 調用的 inference 費用核心是:
單次調用 inference 費用
費用 =(輸入 token ÷ 1,000,000 × 輸入單價)+(輸出 token ÷ 1,000,000 × 輸出單價)
單價以美元「每百萬 token」標示,在 OpenRouter 模型目錄 與各模型詳情页可查。輸入與輸出分開計價,且輸出單價通常高於輸入。
什么算輸入 token? 你的 prompt、系統提示、歷史對話、工具(function)返回寫入上下文的内容、以及部分模型的「思考 / reasoning」token(若计入輸入侧)。什么算輸出 token? 模型生成并返回给你的文本(以及部分 API 模式下單独計費的 reasoning 輸出)。
舉例:某模型輸入 $3/百萬、輸出 $15/百萬,一次請求 10,000 輸入 + 2,000 輸出 token:
- 輸入:10,000 ÷ 1,000,000 × $3 = $0.03
- 輸出:2,000 ÷ 1,000,000 × $15 = $0.03
- 合計 inference:$0.06(尚未含充值手續費)
OpenRouter 介面與 OpenAI Chat Completions 相容,回應里通常带有 usage.prompt_tokens 與 usage.completion_tokens,便於你在應用内即時估算成本。
別忽略的隱藏成本
模型目錄上的 token 單價只是「地板價」。根据 OpenRouter 官方定價說明,實際總成本還要疊以下几層:
| 費用層 | 比例 / 規則 | 觸發條件 |
|---|---|---|
| Inference(token) | 廠商公開价透傳 | 每次 API 調用 |
| 信用卡充值平台費 | 5.5%(有最低手續費) | 每次用卡購買 credits |
| 加密貨幣充值 | 約 5% | 加密支付 top-up |
| BYOK 超額费 | 等價 OpenRouter 价的 5% | 自帶 Key 且月請求超免費額度(標準約 100 萬次/月) |
| 大客戶折扣 | 月消費達標后最高約 7% off | Gold / Platinum 等級(月消費門檻約 $1K / $5K) |
因此:小團隊預算应在上表 inference 之外再加 5–7% overhead。例如充 $100,實際可用於 inference 的 credits 大約 $94.5 左右(扣除 5.5% 平台費),再按模型單價扣 token。
另有一點:OpenRouter 对主流模型不在 token 單價上二次加價(與廠商官網一致),这点與部分聚合平台不同;「贵」主要體現在充值 friction 和多模型便利性的 trade-off,而非每張 token 偷偷加價。
2026 單價表:Claude vs GPT-5 vs Gemini
下表为 2026 年 7 月 在 OpenRouter 上可查的代表性模型報價(美元 / 百萬 token)。具體數字会随廠商調價變動,下單前請以 模型頁即時價格 為準。
Anthropic Claude 系列
| 模型(OpenRouter ID 示例) | 輸入 / 百萬 | 輸出 / 百萬 | 定位 |
|---|---|---|---|
Claude Opus 5 anthropic/claude-opus-5 |
$5.00 | $25.00 | 旗艦推理、複雜 Agent、長程編碼 |
Claude Sonnet 4.6 anthropic/claude-sonnet-4.6 |
$3.00 | $15.00 | 日常編碼與產品主力,性價比常見首選 |
Claude Haiku 4.5 anthropic/claude-haiku-4.5 |
$1.00 | $5.00 | 分類、路由、輕量補全 |
Claude 在 OpenRouter 上支援 Prompt Caching:重複發送的大段上下文(系統提示、長文檔)命中緩存后,有效輸入單價可顯著下降;OpenRouter 模型頁展示的「Effective Pricing」滾動均值,对部分用戶比標價低 60–80%。
OpenAI GPT-5 系列
| 模型(OpenRouter ID 示例) | 輸入 / 百萬 | 輸出 / 百萬 | 定位 |
|---|---|---|---|
GPT-5.5 openai/gpt-5.5 |
$5.00 | $30.00 | 旗艦多模態與複雜任務 |
GPT-5.4 openai/gpt-5.4 |
$2.50 | 約 $10–15 | 平衡性能與成本的主力檔 |
GPT-5.4 Mini openai/gpt-5.4-mini |
約 $0.15–0.40 | 約 $0.60–1.60 | 高並發、簡單任務 |
GPT-5 系列在 OpenRouter 上的輸出單價普遍高於同檔 Claude(例如 GPT-5.5 輸出 $30 vs Opus 5 輸出 $25)。若你的應用輸出很長(長文生成、大量代碼補全),總帳上 OpenAI 旗艦可能更貴。
Google Gemini 系列
| 模型(OpenRouter ID 示例) | 輸入 / 百萬 | 輸出 / 百萬 | 定位 |
|---|---|---|---|
Gemini 3.1 Pro google/gemini-3.1-pro-preview |
$2.00 | $12.00 | 長上下文、多模態 Pro 檔 |
Gemini 3.5 Flash google/gemini-3.5-flash |
約 $0.10–0.35 | 約 $0.40–1.40 | 低延迟、大批量 |
Gemini 3 Flash google/gemini-3-flash-preview |
約 $0.10–0.25 | 約 $0.40–1.00 | 輕量對話與工具調用 |
在同为「旗艦 Pro」檔位时,Gemini 3.1 Pro 的輸入价約為 Claude Opus 5 的 40%、輸出約為 48%,紙面單價最具競爭力。是否「夠用」取決於任務質量要求,而非只看價格。
四個真實場景算筆帳
下面用統一公式估算單次 inference(不含 5.5% 充值费)。为便於對比,選取三檔代表模型:Claude Sonnet 4.6、GPT-5.4、Gemini 3.1 Pro。
場景 A:短對話(客服 / 問答)
約 2,000 輸入 + 500 輸出 token。
| 模型 | 輸入成本 | 輸出成本 | 單次合計 |
|---|---|---|---|
| Sonnet 4.6($3 / $15) | $0.006 | $0.0075 | $0.0135 |
| GPT-5.4($2.5 / $12) | $0.005 | $0.006 | $0.011 |
| Gemini 3.1 Pro($2 / $12) | $0.004 | $0.006 | $0.010 |
短對話差異很小;日均上萬次时,Gemini 與 GPT-5.4 略省,但絕對值仍低。
場景 B:代碼審查(中等上下文)
約 50,000 輸入(含 diff + 相關檔案)+ 2,000 輸出(審查意見)。
| 模型 | 單次合計 |
|---|---|
| Sonnet 4.6 | $0.18($0.15 + $0.03) |
| GPT-5.4 | $0.149 |
| Gemini 3.1 Pro | $0.124 |
場景 C:終端 Agent 單會話(重度讀倉庫)
約 200,000 輸入 + 10,000 輸出——接近 Claude Code / Cursor Agent 一輪深度任務的上限量級。
| 模型 | 單次合計 |
|---|---|
| Sonnet 4.6 | $0.75 |
| GPT-5.4 | $0.62 |
| Gemini 3.1 Pro | $0.52 |
| Claude Opus 5($5 / $25) | $1.25 |
| GPT-5.5($5 / $30) | $1.30 |
Agent 場景下輸入 token 主導帳單。若每天 20 輪此類会话,僅 Sonnet 4.6 的 inference 約 $15/天 ≈ $450/月——這就是為什麼很多人選訂閱(如 Claude Code Max)而非純 API,直到用量突破訂閱天花板。
場景 D:批量摘要(100 篇 × 8K 輸入 + 300 輸出)
總輸入 800,000 + 輸出 30,000 token。
- Sonnet 4.6:約 $2.85
- GPT-5.4:約 $2.36
- Gemini 3.1 Pro:約 $1.96
- 若改用 Gemini 3.5 Flash:常可再降一個數量級,適合質量要求不高的流水線
按月用量:誰最便宜?
假設團隊月消耗 50M 輸入 + 5M 輸出 token(中型 Agent 產品常見區間),三檔模型 inference 對比:
| 模型 | 月 inference 估算 |
|---|---|
| Claude Opus 5 | $50×5 + $25×5 = $375 |
| Claude Sonnet 4.6 | $3×50 + $15×5 = $225 |
| GPT-5.5 | $5×50 + $30×5 = $400 |
| GPT-5.4 | $2.5×50 + $12×5 = $185 |
| Gemini 3.1 Pro | $2×50 + $12×5 = $160 |
加上 5.5% 充值费,Gemini 3.1 Pro 約 $169/月、Sonnet 4.6 約 $237/月、GPT-5.5 約 $422/月。紙面最便宜往往是 Gemini Pro 或 Flash;編碼 Agent 場景里 Sonnet 仍是很多團隊的質量锚点。
和訂閱產品對照
個人開發者 Claude Pro(約 $20/月)或 Max 5x($100/月)包含 Claude Code 與網頁用量池,不等於 API 按 token 計費。當你的月 API 帳單穩定超過 $100–200 且不需要 Claude Code 整合,純 OpenRouter + 自選模型往往更靈活;反之,重度終端 Agent 用戶可能訂閱更划算。
OpenRouter vs 直連 API
| 維度 | OpenRouter | 直連 Anthropic / OpenAI / Google |
|---|---|---|
| Token 單價(主流模型) | 通常與廠商一致 | 廠商標價;企业合同可能有折扣 |
| 額外平台費 | 充值 5.5% 等 | 无(或走发票账期) |
| 多模型切換 | 改 model 參數即可 | 多套 SDK / 密鑰 / 計費帳戶 |
| Failover / 路由 | 內建多提供商路由 | 需自建 |
| 合規與數據駐留 | 經 OpenRouter 中轉,需評估 DPA | 可直接選區域與合規套餐 |
建議: 單一模型、月消費 > $5K 且能談企業價 → 優先直連。原型期、多模型 A/B、小團隊統一網關 → OpenRouter 的時間價值常超過 5% 手續費。
降本技巧:緩存、Batch 與模型路由
- Prompt Caching:Claude 长系統提示、固定文檔重複發送时,OpenRouter 透傳緩存折扣,有效輸入价可大幅下降。
- 模型路由:用 Haiku / Flash 做意圖分類與草稿,僅複雜步驟升 Sonnet / Pro——可把平均單價拉低 50% 以上。
- 壓縮上下文:Agent 場景限制每次讀入檔案數、摘要歷史對話,比換旗艦模型更有效。
- Batch API:非即時任務走廠商 Batch(部分模型在 OpenRouter 有對應路由),通常有顯著折扣。
- 監控 usage:在應用層記錄每次
prompt_tokens/completion_tokens,按 feature 分攤,避免「不知道谁燒錢」。
若 Agent 還要在 Mac 上跑 xcodebuild、簽名與 TestFlight,模型帳單之外還有執行環境成本。可參考 雲端 Mac 與 iOS 工具鏈 把構建環境與 API 費用分開規劃。
常見問題
OpenRouter 免費模型能用嗎?
OpenRouter 提供部分免費模型與免費額度,但有速率限制(如每分鐘請求數、每日上限,與帳戶 credits 餘額相關)。適合試用與低頻工具,生產環境應選付費模型并預算 credits。
為什麼同一次調用帳單和計算器不一致?
常見原因:未計入 reasoning token、工具返回被寫入上下文、圖片/音訊按特殊單價計費、或命中/未命中 Prompt Cache。以 API 返回的 usage 為準。
BYOK(自帶 API Key)更省錢吗?
每月前約 100 萬次 BYOK 請求免費;超額后 OpenRouter 收等價平台价的 5%。若你已有廠商大額折扣合同,BYOK 可避免重複充值 OpenRouter credits,但仍付路由費。
2026 年該選 Claude、GPT-5 还是 Gemini?
沒有唯一答案:編碼與 Agent 質量 → 多數團隊仍以 Sonnet / Opus 或 GPT-5.4 為基準;長上下文 + 成本敏感 → Gemini 3.1 Pro;超高並發輕量任務 → Flash / Mini 檔。用 OpenRouter 做兩週並行 A/B,比只看標價表可靠。
快速結論
- 計費核心:輸入 + 輸出 token 分開算,Agent 場景輸入往往是大頭
- 平台費:充值約 +5.5%,預算勿只按模型標價
- 單價:旗艦檔 Gemini 3.1 Pro 通常最低,GPT-5.5 輸出最贵
- 選型:多模型 / 快速迭代 → OpenRouter;單一高用量 → 直連 + 企业折扣
API 管模型,雲端 Mac 管構建
OpenRouter 解决「调哪个 LLM」;iOS / macOS 流水線仍需要可運行的 Xcode 環境。Zilmac 雲端 Mac 適合與 Agent 工作流搭配,處理簽名、公證與 TestFlight。
無需實體 Mac,即可在穩定環境中運行 Apple 工具鏈。 — 查看云 Mac 方案