团队在做 Agent、Copilot 替代方案或自建 LLM 网关时,OpenRouter 几乎是绕不开的名字:一个 API Key、改一个 model 参数就能切 Claude、GPT、Gemini 等三百多个模型。但账单到底怎么算?和直连 Anthropic / OpenAI / Google 差多少?本文按 2026 年 7 月 公开报价,把计费公式、隐藏费用和三大家旗舰模型的真实单次调用成本算清楚。
OpenRouter 计费公式:一分钟搞懂
OpenRouter 采用预充值、按 token 扣费,没有月费套餐。每次 API 调用的 inference 费用核心是:
单次调用 inference 费用
费用 =(输入 token ÷ 1,000,000 × 输入单价)+(输出 token ÷ 1,000,000 × 输出单价)
单价以美元「每百万 token」标示,在 OpenRouter 模型目录 与各模型详情页可查。输入与输出分开计价,且输出单价通常高于输入。
什么算输入 token? 你的 prompt、系统提示、历史对话、工具(function)返回写入上下文的内容、以及部分模型的「思考 / reasoning」token(若计入输入侧)。什么算输出 token? 模型生成并返回给你的文本(以及部分 API 模式下单独计费的 reasoning 输出)。
举例:某模型输入 $3/百万、输出 $15/百万,一次请求 10,000 输入 + 2,000 输出 token:
- 输入:10,000 ÷ 1,000,000 × $3 = $0.03
- 输出:2,000 ÷ 1,000,000 × $15 = $0.03
- 合计 inference:$0.06(尚未含充值手续费)
OpenRouter 接口与 OpenAI Chat Completions 兼容,响应里通常带有 usage.prompt_tokens 与 usage.completion_tokens,便于你在应用内实时估算成本。
别忽略的隐藏成本
模型目录上的 token 单价只是「地板价」。根据 OpenRouter 官方定价说明,实际总成本还要叠以下几层:
| 费用层 | 比例 / 规则 | 触发条件 |
|---|---|---|
| Inference(token) | 厂商公开价透传 | 每次 API 调用 |
| 信用卡充值平台费 | 5.5%(有最低手续费) | 每次用卡购买 credits |
| 加密货币充值 | 约 5% | 加密支付 top-up |
| BYOK 超额费 | 等价 OpenRouter 价的 5% | 自带 Key 且月请求超免费额度(标准约 100 万次/月) |
| 大客户折扣 | 月消费达标后最高约 7% off | Gold / Platinum 等级(月消费门槛约 $1K / $5K) |
因此:小团队预算应在上表 inference 之外再加 5–7% overhead。例如充 $100,实际可用于 inference 的 credits 大约 $94.5 左右(扣除 5.5% 平台费),再按模型单价扣 token。
另有一点:OpenRouter 对主流模型不在 token 单价上二次加价(与厂商官网一致),这点与部分聚合平台不同;「贵」主要体现在充值 friction 和多模型便利性的 trade-off,而非每张 token 偷偷加价。
2026 单价表:Claude vs GPT-5 vs Gemini
下表为 2026 年 7 月 在 OpenRouter 上可查的代表性模型报价(美元 / 百万 token)。具体数字会随厂商调价变动,下单前请以 模型页实时价格 为准。
Anthropic Claude 系列
| 模型(OpenRouter ID 示例) | 输入 / 百万 | 输出 / 百万 | 定位 |
|---|---|---|---|
Claude Opus 5 anthropic/claude-opus-5 |
$5.00 | $25.00 | 旗舰推理、复杂 Agent、长程编码 |
Claude Sonnet 4.6 anthropic/claude-sonnet-4.6 |
$3.00 | $15.00 | 日常编码与产品主力,性价比常见首选 |
Claude Haiku 4.5 anthropic/claude-haiku-4.5 |
$1.00 | $5.00 | 分类、路由、轻量补全 |
Claude 在 OpenRouter 上支持 Prompt Caching:重复发送的大段上下文(系统提示、长文档)命中缓存后,有效输入单价可显著下降;OpenRouter 模型页展示的「Effective Pricing」滚动均值,对部分用户比标价低 60–80%。
OpenAI GPT-5 系列
| 模型(OpenRouter ID 示例) | 输入 / 百万 | 输出 / 百万 | 定位 |
|---|---|---|---|
GPT-5.5 openai/gpt-5.5 |
$5.00 | $30.00 | 旗舰多模态与复杂任务 |
GPT-5.4 openai/gpt-5.4 |
$2.50 | 约 $10–15 | 平衡性能与成本的主力档 |
GPT-5.4 Mini openai/gpt-5.4-mini |
约 $0.15–0.40 | 约 $0.60–1.60 | 高并发、简单任务 |
GPT-5 系列在 OpenRouter 上的输出单价普遍高于同档 Claude(例如 GPT-5.5 输出 $30 vs Opus 5 输出 $25)。若你的应用输出很长(长文生成、大量代码补全),总账上 OpenAI 旗舰可能更贵。
Google Gemini 系列
| 模型(OpenRouter ID 示例) | 输入 / 百万 | 输出 / 百万 | 定位 |
|---|---|---|---|
Gemini 3.1 Pro google/gemini-3.1-pro-preview |
$2.00 | $12.00 | 长上下文、多模态 Pro 档 |
Gemini 3.5 Flash google/gemini-3.5-flash |
约 $0.10–0.35 | 约 $0.40–1.40 | 低延迟、大批量 |
Gemini 3 Flash google/gemini-3-flash-preview |
约 $0.10–0.25 | 约 $0.40–1.00 | 轻量对话与工具调用 |
在同为「旗舰 Pro」档位时,Gemini 3.1 Pro 的输入价约为 Claude Opus 5 的 40%、输出约为 48%,纸面单价最具竞争力。是否「够用」取决于任务质量要求,而非只看价格。
四个真实场景算笔账
下面用统一公式估算单次 inference(不含 5.5% 充值费)。为便于对比,选取三档代表模型:Claude Sonnet 4.6、GPT-5.4、Gemini 3.1 Pro。
场景 A:短对话(客服 / 问答)
约 2,000 输入 + 500 输出 token。
| 模型 | 输入成本 | 输出成本 | 单次合计 |
|---|---|---|---|
| Sonnet 4.6($3 / $15) | $0.006 | $0.0075 | $0.0135 |
| GPT-5.4($2.5 / $12) | $0.005 | $0.006 | $0.011 |
| Gemini 3.1 Pro($2 / $12) | $0.004 | $0.006 | $0.010 |
短对话差异很小;日均上万次时,Gemini 与 GPT-5.4 略省,但绝对值仍低。
场景 B:代码审查(中等上下文)
约 50,000 输入(含 diff + 相关文件)+ 2,000 输出(审查意见)。
| 模型 | 单次合计 |
|---|---|
| Sonnet 4.6 | $0.18($0.15 + $0.03) |
| GPT-5.4 | $0.149 |
| Gemini 3.1 Pro | $0.124 |
场景 C:终端 Agent 单会话(重度读仓库)
约 200,000 输入 + 10,000 输出——接近 Claude Code / Cursor Agent 一轮深度任务的上限量级。
| 模型 | 单次合计 |
|---|---|
| Sonnet 4.6 | $0.75 |
| GPT-5.4 | $0.62 |
| Gemini 3.1 Pro | $0.52 |
| Claude Opus 5($5 / $25) | $1.25 |
| GPT-5.5($5 / $30) | $1.30 |
Agent 场景下输入 token 主导账单。若每天 20 轮此类会话,仅 Sonnet 4.6 的 inference 约 $15/天 ≈ $450/月——这就是为什么很多人选订阅(如 Claude Code Max)而非纯 API,直到用量突破订阅天花板。
场景 D:批量摘要(100 篇 × 8K 输入 + 300 输出)
总输入 800,000 + 输出 30,000 token。
- Sonnet 4.6:约 $2.85
- GPT-5.4:约 $2.36
- Gemini 3.1 Pro:约 $1.96
- 若改用 Gemini 3.5 Flash:常可再降一个数量级,适合质量要求不高的流水线
按月用量:谁最便宜?
假设团队月消耗 50M 输入 + 5M 输出 token(中型 Agent 产品常见区间),三档模型 inference 对比:
| 模型 | 月 inference 估算 |
|---|---|
| Claude Opus 5 | $50×5 + $25×5 = $375 |
| Claude Sonnet 4.6 | $3×50 + $15×5 = $225 |
| GPT-5.5 | $5×50 + $30×5 = $400 |
| GPT-5.4 | $2.5×50 + $12×5 = $185 |
| Gemini 3.1 Pro | $2×50 + $12×5 = $160 |
加上 5.5% 充值费,Gemini 3.1 Pro 约 $169/月、Sonnet 4.6 约 $237/月、GPT-5.5 约 $422/月。纸面最便宜往往是 Gemini Pro 或 Flash;编码 Agent 场景里 Sonnet 仍是很多团队的质量锚点。
和订阅产品对照
个人开发者 Claude Pro(约 $20/月)或 Max 5x($100/月)包含 Claude Code 与网页用量池,不等于 API 按 token 计费。当你的月 API 账单稳定超过 $100–200 且不需要 Claude Code 集成,纯 OpenRouter + 自选模型往往更灵活;反之,重度终端 Agent 用户可能订阅更划算。
OpenRouter vs 直连 API
| 维度 | OpenRouter | 直连 Anthropic / OpenAI / Google |
|---|---|---|
| Token 单价(主流模型) | 通常与厂商一致 | 厂商标价;企业合同可能有折扣 |
| 额外平台费 | 充值 5.5% 等 | 无(或走发票账期) |
| 多模型切换 | 改 model 参数即可 | 多套 SDK / 密钥 / 计费账户 |
| Failover / 路由 | 内置多提供商路由 | 需自建 |
| 合规与数据驻留 | 经 OpenRouter 中转,需评估 DPA | 可直接选区域与合规套餐 |
建议: 单一模型、月消费 > $5K 且能谈企业价 → 优先直连。原型期、多模型 A/B、小团队统一网关 → OpenRouter 的时间价值常超过 5% 手续费。
降本技巧:缓存、Batch 与模型路由
- Prompt Caching:Claude 长系统提示、固定文档重复发送时,OpenRouter 透传缓存折扣,有效输入价可大幅下降。
- 模型路由:用 Haiku / Flash 做意图分类与草稿,仅复杂步骤升 Sonnet / Pro——可把平均单价拉低 50% 以上。
- 压缩上下文:Agent 场景限制每次读入文件数、摘要历史对话,比换旗舰模型更有效。
- Batch API:非实时任务走厂商 Batch(部分模型在 OpenRouter 有对应路由),通常有显著折扣。
- 监控 usage:在应用层记录每次
prompt_tokens/completion_tokens,按 feature 分摊,避免「不知道谁烧钱」。
若 Agent 还要在 Mac 上跑 xcodebuild、签名与 TestFlight,模型账单之外还有执行环境成本。可参考 云端 Mac 与 iOS 工具链 把构建环境与 API 费用分开规划。
常见问题
OpenRouter 免费模型能用吗?
OpenRouter 提供部分免费模型与免费额度,但有速率限制(如每分钟请求数、每日上限,与账户 credits 余额相关)。适合试用与低频工具,生产环境应选付费模型并预算 credits。
为什么同一次调用账单和计算器不一致?
常见原因:未计入 reasoning token、工具返回被写入上下文、图片/音频按特殊单价计费、或命中/未命中 Prompt Cache。以 API 返回的 usage 为准。
BYOK(自带 API Key)更省钱吗?
每月前约 100 万次 BYOK 请求免费;超额后 OpenRouter 收等价平台价的 5%。若你已有厂商大额折扣合同,BYOK 可避免重复充值 OpenRouter credits,但仍付路由费。
2026 年该选 Claude、GPT-5 还是 Gemini?
没有唯一答案:编码与 Agent 质量 → 多数团队仍以 Sonnet / Opus 或 GPT-5.4 为基准;长上下文 + 成本敏感 → Gemini 3.1 Pro;超高并发轻量任务 → Flash / Mini 档。用 OpenRouter 做两周并行 A/B,比只看标价表可靠。
快速结论
- 计费核心:输入 + 输出 token 分开算,Agent 场景输入往往是大头
- 平台费:充值约 +5.5%,预算勿只按模型标价
- 单价:旗舰档 Gemini 3.1 Pro 通常最低,GPT-5.5 输出最贵
- 选型:多模型 / 快速迭代 → OpenRouter;单一高用量 → 直连 + 企业折扣
API 管模型,云端 Mac 管构建
OpenRouter 解决「调哪个 LLM」;iOS / macOS 流水线仍需要可运行的 Xcode 环境。Zilmac 云端 Mac 适合与 Agent 工作流搭配,处理签名、公证与 TestFlight。
无需实体 Mac,即可在稳定环境中运行 Apple 工具链。 — 查看云 Mac 方案