Zilmac 博客
← 返回技術實踐

OpenRouter API 價格怎麼算?Claude、GPT-5、Gemini 調用成本真實對比(2026)

API 與 Agent ·約 12 分鐘閱讀

多模型 API 網關與雲端 token 計費儀表板,示意 OpenRouter 統一調用 Claude GPT Gemini

團隊在做 Agent、Copilot 替代方案或自建 LLM 網關时,OpenRouter 几乎是繞不開的名字:一個 API Key、改一個 model 參數就能切 Claude、GPT、Gemini 等三百多个模型。但帳單到底怎么算?和直連 Anthropic / OpenAI / Google 差多少?本文按 2026 年 7 月 公開報價,把計費公式、隱藏費用和三大家旗艦模型的真實單次調用成本算清楚。

5.5%
信用卡充值平台費(另有最低額)
300+
可通過同一端點調用的模型數
輸入 ≠ 輸出
兩類 token 分開計價

OpenRouter 計費公式:一分鐘搞懂

OpenRouter 采用預充值、按 token 扣费,沒有月費套餐。每次 API 調用的 inference 費用核心是:

單次調用 inference 費用

費用 =(輸入 token ÷ 1,000,000 × 輸入單價)+(輸出 token ÷ 1,000,000 × 輸出單價)

單價以美元「每百萬 token」標示,在 OpenRouter 模型目錄 與各模型詳情页可查。輸入與輸出分開計價,且輸出單價通常高於輸入。

什么算輸入 token? 你的 prompt、系統提示、歷史對話、工具(function)返回寫入上下文的内容、以及部分模型的「思考 / reasoning」token(若计入輸入侧)。什么算輸出 token? 模型生成并返回给你的文本(以及部分 API 模式下單独計費的 reasoning 輸出)。

舉例:某模型輸入 $3/百萬、輸出 $15/百萬,一次請求 10,000 輸入 + 2,000 輸出 token:

  • 輸入:10,000 ÷ 1,000,000 × $3 = $0.03
  • 輸出:2,000 ÷ 1,000,000 × $15 = $0.03
  • 合計 inference:$0.06(尚未含充值手續費)

OpenRouter 介面與 OpenAI Chat Completions 相容,回應里通常带有 usage.prompt_tokensusage.completion_tokens,便於你在應用内即時估算成本。

別忽略的隱藏成本

模型目錄上的 token 單價只是「地板價」。根据 OpenRouter 官方定價說明,實際總成本還要疊以下几層:

費用層 比例 / 規則 觸發條件
Inference(token) 廠商公開价透傳 每次 API 調用
信用卡充值平台費 5.5%(有最低手續費) 每次用卡購買 credits
加密貨幣充值 約 5% 加密支付 top-up
BYOK 超額费 等價 OpenRouter 价的 5% 自帶 Key 且月請求超免費額度(標準約 100 萬次/月)
大客戶折扣 月消費達標后最高約 7% off Gold / Platinum 等級(月消費門檻約 $1K / $5K)

因此:小團隊預算应在上表 inference 之外再加 5–7% overhead。例如充 $100,實際可用於 inference 的 credits 大約 $94.5 左右(扣除 5.5% 平台費),再按模型單價扣 token。

另有一點:OpenRouter 对主流模型不在 token 單價上二次加價(與廠商官網一致),这点與部分聚合平台不同;「贵」主要體現在充值 friction 和多模型便利性的 trade-off,而非每張 token 偷偷加價。

2026 單價表:Claude vs GPT-5 vs Gemini

下表为 2026 年 7 月 在 OpenRouter 上可查的代表性模型報價(美元 / 百萬 token)。具體數字会随廠商調價變動,下單前請以 模型頁即時價格 為準。

Anthropic Claude 系列

模型(OpenRouter ID 示例) 輸入 / 百萬 輸出 / 百萬 定位
Claude Opus 5 anthropic/claude-opus-5 $5.00 $25.00 旗艦推理、複雜 Agent、長程編碼
Claude Sonnet 4.6 anthropic/claude-sonnet-4.6 $3.00 $15.00 日常編碼與產品主力,性價比常見首選
Claude Haiku 4.5 anthropic/claude-haiku-4.5 $1.00 $5.00 分類、路由、輕量補全

Claude 在 OpenRouter 上支援 Prompt Caching:重複發送的大段上下文(系統提示、長文檔)命中緩存后,有效輸入單價可顯著下降;OpenRouter 模型頁展示的「Effective Pricing」滾動均值,对部分用戶比標價低 60–80%

OpenAI GPT-5 系列

模型(OpenRouter ID 示例) 輸入 / 百萬 輸出 / 百萬 定位
GPT-5.5 openai/gpt-5.5 $5.00 $30.00 旗艦多模態與複雜任務
GPT-5.4 openai/gpt-5.4 $2.50 約 $10–15 平衡性能與成本的主力檔
GPT-5.4 Mini openai/gpt-5.4-mini 約 $0.15–0.40 約 $0.60–1.60 高並發、簡單任務

GPT-5 系列在 OpenRouter 上的輸出單價普遍高於同檔 Claude(例如 GPT-5.5 輸出 $30 vs Opus 5 輸出 $25)。若你的應用輸出很長(長文生成、大量代碼補全),總帳上 OpenAI 旗艦可能更貴。

Google Gemini 系列

模型(OpenRouter ID 示例) 輸入 / 百萬 輸出 / 百萬 定位
Gemini 3.1 Pro google/gemini-3.1-pro-preview $2.00 $12.00 長上下文、多模態 Pro 檔
Gemini 3.5 Flash google/gemini-3.5-flash 約 $0.10–0.35 約 $0.40–1.40 低延迟、大批量
Gemini 3 Flash google/gemini-3-flash-preview 約 $0.10–0.25 約 $0.40–1.00 輕量對話與工具調用

在同为「旗艦 Pro」檔位时,Gemini 3.1 Pro 的輸入价約為 Claude Opus 5 的 40%、輸出約為 48%,紙面單價最具競爭力。是否「夠用」取決於任務質量要求,而非只看價格。

開發者對比 Claude GPT Gemini API 帳單與 token 用量圖表
Agent 場景下輸入 token 往往佔大頭;對比模型成本时務必按輸入/輸出比例估算,而非只看百萬 token 標價。

四個真實場景算筆帳

下面用統一公式估算單次 inference(不含 5.5% 充值费)。为便於對比,選取三檔代表模型:Claude Sonnet 4.6GPT-5.4Gemini 3.1 Pro

場景 A:短對話(客服 / 問答)

約 2,000 輸入 + 500 輸出 token。

模型 輸入成本 輸出成本 單次合計
Sonnet 4.6($3 / $15) $0.006 $0.0075 $0.0135
GPT-5.4($2.5 / $12) $0.005 $0.006 $0.011
Gemini 3.1 Pro($2 / $12) $0.004 $0.006 $0.010

短對話差異很小;日均上萬次时,Gemini 與 GPT-5.4 略省,但絕對值仍低。

場景 B:代碼審查(中等上下文)

約 50,000 輸入(含 diff + 相關檔案)+ 2,000 輸出(審查意見)。

模型 單次合計
Sonnet 4.6 $0.18($0.15 + $0.03)
GPT-5.4 $0.149
Gemini 3.1 Pro $0.124

場景 C:終端 Agent 單會話(重度讀倉庫)

約 200,000 輸入 + 10,000 輸出——接近 Claude Code / Cursor Agent 一輪深度任務的上限量級。

模型 單次合計
Sonnet 4.6 $0.75
GPT-5.4 $0.62
Gemini 3.1 Pro $0.52
Claude Opus 5($5 / $25) $1.25
GPT-5.5($5 / $30) $1.30

Agent 場景下輸入 token 主導帳單。若每天 20 輪此類会话,僅 Sonnet 4.6 的 inference 約 $15/天 ≈ $450/月——這就是為什麼很多人選訂閱(如 Claude Code Max)而非純 API,直到用量突破訂閱天花板。

場景 D:批量摘要(100 篇 × 8K 輸入 + 300 輸出)

總輸入 800,000 + 輸出 30,000 token。

  • Sonnet 4.6:約 $2.85
  • GPT-5.4:約 $2.36
  • Gemini 3.1 Pro:約 $1.96
  • 若改用 Gemini 3.5 Flash:常可再降一個數量級,適合質量要求不高的流水線

按月用量:誰最便宜?

假設團隊月消耗 50M 輸入 + 5M 輸出 token(中型 Agent 產品常見區間),三檔模型 inference 對比:

模型 月 inference 估算
Claude Opus 5 $50×5 + $25×5 = $375
Claude Sonnet 4.6 $3×50 + $15×5 = $225
GPT-5.5 $5×50 + $30×5 = $400
GPT-5.4 $2.5×50 + $12×5 = $185
Gemini 3.1 Pro $2×50 + $12×5 = $160

加上 5.5% 充值费,Gemini 3.1 Pro 約 $169/月、Sonnet 4.6 約 $237/月、GPT-5.5 約 $422/月紙面最便宜往往是 Gemini Pro 或 Flash;編碼 Agent 場景里 Sonnet 仍是很多團隊的質量锚点。

和訂閱產品對照

個人開發者 Claude Pro(約 $20/月)或 Max 5x($100/月)包含 Claude Code 與網頁用量池,不等於 API 按 token 計費。當你的月 API 帳單穩定超過 $100–200 且不需要 Claude Code 整合,純 OpenRouter + 自選模型往往更靈活;反之,重度終端 Agent 用戶可能訂閱更划算。

OpenRouter vs 直連 API

維度 OpenRouter 直連 Anthropic / OpenAI / Google
Token 單價(主流模型) 通常與廠商一致 廠商標價;企业合同可能有折扣
額外平台費 充值 5.5% 等 无(或走发票账期)
多模型切換 改 model 參數即可 多套 SDK / 密鑰 / 計費帳戶
Failover / 路由 內建多提供商路由 需自建
合規與數據駐留 經 OpenRouter 中轉,需評估 DPA 可直接選區域與合規套餐

建議: 單一模型、月消費 > $5K 且能談企業價 → 優先直連。原型期、多模型 A/B、小團隊統一網關 → OpenRouter 的時間價值常超過 5% 手續費。

降本技巧:緩存、Batch 與模型路由

  1. Prompt Caching:Claude 长系統提示、固定文檔重複發送时,OpenRouter 透傳緩存折扣,有效輸入价可大幅下降。
  2. 模型路由:用 Haiku / Flash 做意圖分類與草稿,僅複雜步驟升 Sonnet / Pro——可把平均單價拉低 50% 以上。
  3. 壓縮上下文:Agent 場景限制每次讀入檔案數、摘要歷史對話,比換旗艦模型更有效。
  4. Batch API:非即時任務走廠商 Batch(部分模型在 OpenRouter 有對應路由),通常有顯著折扣。
  5. 監控 usage:在應用層記錄每次 prompt_tokens / completion_tokens,按 feature 分攤,避免「不知道谁燒錢」。

若 Agent 還要在 Mac 上跑 xcodebuild、簽名與 TestFlight,模型帳單之外還有執行環境成本。可參考 雲端 Mac 與 iOS 工具鏈 把構建環境與 API 費用分開規劃。

常見問題

OpenRouter 免費模型能用嗎?

OpenRouter 提供部分免費模型與免費額度,但有速率限制(如每分鐘請求數、每日上限,與帳戶 credits 餘額相關)。適合試用與低頻工具,生產環境應選付費模型并預算 credits。

為什麼同一次調用帳單和計算器不一致?

常見原因:未計入 reasoning token、工具返回被寫入上下文、圖片/音訊按特殊單價計費、或命中/未命中 Prompt Cache。以 API 返回的 usage 為準。

BYOK(自帶 API Key)更省錢吗?

每月前約 100 萬次 BYOK 請求免費;超額后 OpenRouter 收等價平台价的 5%。若你已有廠商大額折扣合同,BYOK 可避免重複充值 OpenRouter credits,但仍付路由費。

2026 年該選 Claude、GPT-5 还是 Gemini?

沒有唯一答案:編碼與 Agent 質量 → 多數團隊仍以 Sonnet / Opus 或 GPT-5.4 為基準;長上下文 + 成本敏感 → Gemini 3.1 Pro;超高並發輕量任務 → Flash / Mini 檔。用 OpenRouter 做兩週並行 A/B,比只看標價表可靠。

快速結論

  • 計費核心:輸入 + 輸出 token 分開算,Agent 場景輸入往往是大頭
  • 平台費:充值約 +5.5%,預算勿只按模型標價
  • 單價:旗艦檔 Gemini 3.1 Pro 通常最低,GPT-5.5 輸出最贵
  • 選型:多模型 / 快速迭代 → OpenRouter;單一高用量 → 直連 + 企业折扣

API 管模型,雲端 Mac 管構建

OpenRouter 解决「调哪个 LLM」;iOS / macOS 流水線仍需要可運行的 Xcode 環境。Zilmac 雲端 Mac 適合與 Agent 工作流搭配,處理簽名、公證與 TestFlight。

無需實體 Mac,即可在穩定環境中運行 Apple 工具鏈。 — 查看云 Mac 方案

限時特惠

Zilmac

雲端 Mac、遠端開發與 Mac VPS,為 iOS 與跨平台團隊補齊 Apple 工具鏈。

返回首頁
限時優惠 點擊查看套餐