Zilmac 博客
← 返回技术实践

OpenRouter API 价格怎么算?Claude、GPT-5、Gemini 调用成本真实对比(2026)

API 与 Agent ·约 12 分钟阅读

多模型 API 网关与云端 token 计费仪表盘,示意 OpenRouter 统一调用 Claude GPT Gemini

团队在做 Agent、Copilot 替代方案或自建 LLM 网关时,OpenRouter 几乎是绕不开的名字:一个 API Key、改一个 model 参数就能切 Claude、GPT、Gemini 等三百多个模型。但账单到底怎么算?和直连 Anthropic / OpenAI / Google 差多少?本文按 2026 年 7 月 公开报价,把计费公式、隐藏费用和三大家旗舰模型的真实单次调用成本算清楚。

5.5%
信用卡充值平台费(另有最低额)
300+
可通过同一端点调用的模型数
输入 ≠ 输出
两类 token 分开计价

OpenRouter 计费公式:一分钟搞懂

OpenRouter 采用预充值、按 token 扣费,没有月费套餐。每次 API 调用的 inference 费用核心是:

单次调用 inference 费用

费用 =(输入 token ÷ 1,000,000 × 输入单价)+(输出 token ÷ 1,000,000 × 输出单价)

单价以美元「每百万 token」标示,在 OpenRouter 模型目录 与各模型详情页可查。输入与输出分开计价,且输出单价通常高于输入。

什么算输入 token? 你的 prompt、系统提示、历史对话、工具(function)返回写入上下文的内容、以及部分模型的「思考 / reasoning」token(若计入输入侧)。什么算输出 token? 模型生成并返回给你的文本(以及部分 API 模式下单独计费的 reasoning 输出)。

举例:某模型输入 $3/百万、输出 $15/百万,一次请求 10,000 输入 + 2,000 输出 token:

  • 输入:10,000 ÷ 1,000,000 × $3 = $0.03
  • 输出:2,000 ÷ 1,000,000 × $15 = $0.03
  • 合计 inference:$0.06(尚未含充值手续费)

OpenRouter 接口与 OpenAI Chat Completions 兼容,响应里通常带有 usage.prompt_tokensusage.completion_tokens,便于你在应用内实时估算成本。

别忽略的隐藏成本

模型目录上的 token 单价只是「地板价」。根据 OpenRouter 官方定价说明,实际总成本还要叠以下几层:

费用层 比例 / 规则 触发条件
Inference(token) 厂商公开价透传 每次 API 调用
信用卡充值平台费 5.5%(有最低手续费) 每次用卡购买 credits
加密货币充值 约 5% 加密支付 top-up
BYOK 超额费 等价 OpenRouter 价的 5% 自带 Key 且月请求超免费额度(标准约 100 万次/月)
大客户折扣 月消费达标后最高约 7% off Gold / Platinum 等级(月消费门槛约 $1K / $5K)

因此:小团队预算应在上表 inference 之外再加 5–7% overhead。例如充 $100,实际可用于 inference 的 credits 大约 $94.5 左右(扣除 5.5% 平台费),再按模型单价扣 token。

另有一点:OpenRouter 对主流模型不在 token 单价上二次加价(与厂商官网一致),这点与部分聚合平台不同;「贵」主要体现在充值 friction 和多模型便利性的 trade-off,而非每张 token 偷偷加价。

2026 单价表:Claude vs GPT-5 vs Gemini

下表为 2026 年 7 月 在 OpenRouter 上可查的代表性模型报价(美元 / 百万 token)。具体数字会随厂商调价变动,下单前请以 模型页实时价格 为准。

Anthropic Claude 系列

模型(OpenRouter ID 示例) 输入 / 百万 输出 / 百万 定位
Claude Opus 5 anthropic/claude-opus-5 $5.00 $25.00 旗舰推理、复杂 Agent、长程编码
Claude Sonnet 4.6 anthropic/claude-sonnet-4.6 $3.00 $15.00 日常编码与产品主力,性价比常见首选
Claude Haiku 4.5 anthropic/claude-haiku-4.5 $1.00 $5.00 分类、路由、轻量补全

Claude 在 OpenRouter 上支持 Prompt Caching:重复发送的大段上下文(系统提示、长文档)命中缓存后,有效输入单价可显著下降;OpenRouter 模型页展示的「Effective Pricing」滚动均值,对部分用户比标价低 60–80%

OpenAI GPT-5 系列

模型(OpenRouter ID 示例) 输入 / 百万 输出 / 百万 定位
GPT-5.5 openai/gpt-5.5 $5.00 $30.00 旗舰多模态与复杂任务
GPT-5.4 openai/gpt-5.4 $2.50 约 $10–15 平衡性能与成本的主力档
GPT-5.4 Mini openai/gpt-5.4-mini 约 $0.15–0.40 约 $0.60–1.60 高并发、简单任务

GPT-5 系列在 OpenRouter 上的输出单价普遍高于同档 Claude(例如 GPT-5.5 输出 $30 vs Opus 5 输出 $25)。若你的应用输出很长(长文生成、大量代码补全),总账上 OpenAI 旗舰可能更贵。

Google Gemini 系列

模型(OpenRouter ID 示例) 输入 / 百万 输出 / 百万 定位
Gemini 3.1 Pro google/gemini-3.1-pro-preview $2.00 $12.00 长上下文、多模态 Pro 档
Gemini 3.5 Flash google/gemini-3.5-flash 约 $0.10–0.35 约 $0.40–1.40 低延迟、大批量
Gemini 3 Flash google/gemini-3-flash-preview 约 $0.10–0.25 约 $0.40–1.00 轻量对话与工具调用

在同为「旗舰 Pro」档位时,Gemini 3.1 Pro 的输入价约为 Claude Opus 5 的 40%、输出约为 48%,纸面单价最具竞争力。是否「够用」取决于任务质量要求,而非只看价格。

开发者对比 Claude GPT Gemini API 账单与 token 用量图表
Agent 场景下输入 token 往往占大头;对比模型成本时务必按输入/输出比例估算,而非只看百万 token 标价。

四个真实场景算笔账

下面用统一公式估算单次 inference(不含 5.5% 充值费)。为便于对比,选取三档代表模型:Claude Sonnet 4.6GPT-5.4Gemini 3.1 Pro

场景 A:短对话(客服 / 问答)

约 2,000 输入 + 500 输出 token。

模型 输入成本 输出成本 单次合计
Sonnet 4.6($3 / $15) $0.006 $0.0075 $0.0135
GPT-5.4($2.5 / $12) $0.005 $0.006 $0.011
Gemini 3.1 Pro($2 / $12) $0.004 $0.006 $0.010

短对话差异很小;日均上万次时,Gemini 与 GPT-5.4 略省,但绝对值仍低。

场景 B:代码审查(中等上下文)

约 50,000 输入(含 diff + 相关文件)+ 2,000 输出(审查意见)。

模型 单次合计
Sonnet 4.6 $0.18($0.15 + $0.03)
GPT-5.4 $0.149
Gemini 3.1 Pro $0.124

场景 C:终端 Agent 单会话(重度读仓库)

约 200,000 输入 + 10,000 输出——接近 Claude Code / Cursor Agent 一轮深度任务的上限量级。

模型 单次合计
Sonnet 4.6 $0.75
GPT-5.4 $0.62
Gemini 3.1 Pro $0.52
Claude Opus 5($5 / $25) $1.25
GPT-5.5($5 / $30) $1.30

Agent 场景下输入 token 主导账单。若每天 20 轮此类会话,仅 Sonnet 4.6 的 inference 约 $15/天 ≈ $450/月——这就是为什么很多人选订阅(如 Claude Code Max)而非纯 API,直到用量突破订阅天花板。

场景 D:批量摘要(100 篇 × 8K 输入 + 300 输出)

总输入 800,000 + 输出 30,000 token。

  • Sonnet 4.6:约 $2.85
  • GPT-5.4:约 $2.36
  • Gemini 3.1 Pro:约 $1.96
  • 若改用 Gemini 3.5 Flash:常可再降一个数量级,适合质量要求不高的流水线

按月用量:谁最便宜?

假设团队月消耗 50M 输入 + 5M 输出 token(中型 Agent 产品常见区间),三档模型 inference 对比:

模型 月 inference 估算
Claude Opus 5 $50×5 + $25×5 = $375
Claude Sonnet 4.6 $3×50 + $15×5 = $225
GPT-5.5 $5×50 + $30×5 = $400
GPT-5.4 $2.5×50 + $12×5 = $185
Gemini 3.1 Pro $2×50 + $12×5 = $160

加上 5.5% 充值费,Gemini 3.1 Pro 约 $169/月、Sonnet 4.6 约 $237/月、GPT-5.5 约 $422/月纸面最便宜往往是 Gemini Pro 或 Flash;编码 Agent 场景里 Sonnet 仍是很多团队的质量锚点。

和订阅产品对照

个人开发者 Claude Pro(约 $20/月)或 Max 5x($100/月)包含 Claude Code 与网页用量池,不等于 API 按 token 计费。当你的月 API 账单稳定超过 $100–200 且不需要 Claude Code 集成,纯 OpenRouter + 自选模型往往更灵活;反之,重度终端 Agent 用户可能订阅更划算。

OpenRouter vs 直连 API

维度 OpenRouter 直连 Anthropic / OpenAI / Google
Token 单价(主流模型) 通常与厂商一致 厂商标价;企业合同可能有折扣
额外平台费 充值 5.5% 等 无(或走发票账期)
多模型切换 改 model 参数即可 多套 SDK / 密钥 / 计费账户
Failover / 路由 内置多提供商路由 需自建
合规与数据驻留 经 OpenRouter 中转,需评估 DPA 可直接选区域与合规套餐

建议: 单一模型、月消费 > $5K 且能谈企业价 → 优先直连。原型期、多模型 A/B、小团队统一网关 → OpenRouter 的时间价值常超过 5% 手续费。

降本技巧:缓存、Batch 与模型路由

  1. Prompt Caching:Claude 长系统提示、固定文档重复发送时,OpenRouter 透传缓存折扣,有效输入价可大幅下降。
  2. 模型路由:用 Haiku / Flash 做意图分类与草稿,仅复杂步骤升 Sonnet / Pro——可把平均单价拉低 50% 以上。
  3. 压缩上下文:Agent 场景限制每次读入文件数、摘要历史对话,比换旗舰模型更有效。
  4. Batch API:非实时任务走厂商 Batch(部分模型在 OpenRouter 有对应路由),通常有显著折扣。
  5. 监控 usage:在应用层记录每次 prompt_tokens / completion_tokens,按 feature 分摊,避免「不知道谁烧钱」。

若 Agent 还要在 Mac 上跑 xcodebuild、签名与 TestFlight,模型账单之外还有执行环境成本。可参考 云端 Mac 与 iOS 工具链 把构建环境与 API 费用分开规划。

常见问题

OpenRouter 免费模型能用吗?

OpenRouter 提供部分免费模型与免费额度,但有速率限制(如每分钟请求数、每日上限,与账户 credits 余额相关)。适合试用与低频工具,生产环境应选付费模型并预算 credits。

为什么同一次调用账单和计算器不一致?

常见原因:未计入 reasoning token、工具返回被写入上下文、图片/音频按特殊单价计费、或命中/未命中 Prompt Cache。以 API 返回的 usage 为准。

BYOK(自带 API Key)更省钱吗?

每月前约 100 万次 BYOK 请求免费;超额后 OpenRouter 收等价平台价的 5%。若你已有厂商大额折扣合同,BYOK 可避免重复充值 OpenRouter credits,但仍付路由费。

2026 年该选 Claude、GPT-5 还是 Gemini?

没有唯一答案:编码与 Agent 质量 → 多数团队仍以 Sonnet / Opus 或 GPT-5.4 为基准;长上下文 + 成本敏感 → Gemini 3.1 Pro;超高并发轻量任务 → Flash / Mini 档。用 OpenRouter 做两周并行 A/B,比只看标价表可靠。

快速结论

  • 计费核心:输入 + 输出 token 分开算,Agent 场景输入往往是大头
  • 平台费:充值约 +5.5%,预算勿只按模型标价
  • 单价:旗舰档 Gemini 3.1 Pro 通常最低,GPT-5.5 输出最贵
  • 选型:多模型 / 快速迭代 → OpenRouter;单一高用量 → 直连 + 企业折扣

API 管模型,云端 Mac 管构建

OpenRouter 解决「调哪个 LLM」;iOS / macOS 流水线仍需要可运行的 Xcode 环境。Zilmac 云端 Mac 适合与 Agent 工作流搭配,处理签名、公证与 TestFlight。

无需实体 Mac,即可在稳定环境中运行 Apple 工具链。 — 查看云 Mac 方案

限时优惠

Zilmac

云端 Mac、远程开发与 Mac VPS,为 iOS 与跨平台团队补齐 Apple 工具链。

返回首页
限时优惠 点击查看套餐