Команды, которые строят агентов, альтернативы Copilot или собственный LLM-шлюз, почти неизбежно сталкиваются с OpenRouter: один API-ключ, один параметр model — и вы переключаетесь между Claude, GPT, Gemini и более чем 300 моделями. Но как считается счёт? И насколько он отличается от прямых вызовов Anthropic, OpenAI или Google? По публичным тарифам июля 2026 разбираем формулу биллинга, скрытые расходы и реальную стоимость одного API-вызова у трёх крупнейших вендоров.
Биллинг OpenRouter: формула за минуту
OpenRouter работает по схеме предоплаты и списания за токены — без месячного пакета. Ядро стоимости inference на один API-вызов:
Стоимость inference за вызов
Стоимость = (входные токены ÷ 1 000 000 × цена входа) + (выходные токены ÷ 1 000 000 × цена выхода)
Цены в USD за миллион токенов — в каталоге OpenRouter и на страницах моделей. Вход и выход считаются отдельно; выход обычно дороже.
Что считается входным токеном? Ваш prompt, system prompt, история диалога, ответы инструментов (function calling), попадающие в контекст, а у части моделей — reasoning-токены на стороне входа.
Что считается выходным токеном? Текст, сгенерированный моделью (и при необходимости отдельно тарифицируемый reasoning на выходе).
Пример: модель $3/M вход, $15/M выход, запрос 10 000 вход + 2 000 выход токенов:
- Вход: 10 000 ÷ 1 000 000 × $3 = $0.03
- Выход: 2 000 ÷ 1 000 000 × $15 = $0.03
- Inference всего: $0.06 (без комиссии пополнения)
API OpenRouter совместим с OpenAI Chat Completions; в ответе обычно есть usage.prompt_tokens и usage.completion_tokens — удобно для оценки затрат в приложении.
Скрытые расходы, которые легко пропустить
Цена токена в каталоге — только база. По тарифам OpenRouter добавляются ещё слои:
| Слой затрат | Ставка / правило | Когда применяется |
|---|---|---|
| Inference (токены) | Цена вендора без наценки | Каждый API-вызов |
| Комиссия при пополнении картой | 5.5% (минимум) | Каждая покупка credits картой |
| Пополнение криптой | ~5% | Крипто-платёж |
| Превышение BYOK | 5% от эквивалента OpenRouter | Свой ключ, запросы > бесплатного месячного лимита (стандарт ~1 M/мес) |
| Скидка по объёму | до ~7% off | Gold / Platinum (пороги ~$1K / $5K/мес) |
Небольшим командам стоит закладывать 5–7% overhead поверх inference. Пример: пополнили $100 → на inference остаётся около $94.50 (после 5.5%), далее списание по тарифу модели.
Важно: OpenRouter не накручивает цену токена у mainstream-моделей (как у вендора). Переплата — в основном friction пополнения и удобство multi-model, а не скрытая наценка на каждый токен.
Таблица цен 2026: Claude vs GPT-5 vs Gemini
Ориентиры на OpenRouter, июль 2026 (USD / M токенов). Цены меняются — перед продом смотрите актуальные тарифы.
Anthropic Claude
| Модель (ID OpenRouter) | Вход / M | Выход / M | Назначение |
|---|---|---|---|
Claude Opus 5 anthropic/claude-opus-5 |
$5.00 | $25.00 | Флагманский reasoning, сложные агенты, длинный coding |
Claude Sonnet 4.6 anthropic/claude-sonnet-4.6 |
$3.00 | $15.00 | Ежедневный coding и основная рабочая модель |
Claude Haiku 4.5 anthropic/claude-haiku-4.5 |
$1.00 | $5.00 | Классификация, маршрутизация, лёгкие completions |
Claude на OpenRouter поддерживает Prompt Caching: повторяющийся большой контекст (system prompt, длинные документы) сильно снижает эффективную цену входа; «Effective Pricing» на странице модели у части пользователей на 60–80% ниже списка.
OpenAI GPT-5
| Модель (ID OpenRouter) | Вход / M | Выход / M | Назначение |
|---|---|---|---|
GPT-5.5 openai/gpt-5.5 |
$5.00 | $30.00 | Флагман multimodal и тяжёлые задачи |
GPT-5.4 openai/gpt-5.4 |
$2.50 | ~$10–15 | Баланс производительности и стоимости |
GPT-5.4 Mini openai/gpt-5.4-mini |
~$0.15–0.40 | ~$0.60–1.60 | Высокая параллельность, простые задачи |
У GPT-5 на OpenRouter цена выхода часто выше, чем у сопоставимого Claude (напр. GPT-5.5 выход $30 vs Opus 5 выход $25). При длинном выходе (длинные тексты, много кода) флагман OpenAI может обойтись дороже.
Google Gemini
| Модель (ID OpenRouter) | Вход / M | Выход / M | Назначение |
|---|---|---|---|
Gemini 3.1 Pro google/gemini-3.1-pro-preview |
$2.00 | $12.00 | Длинный контекст, multimodal Pro |
Gemini 3.5 Flash google/gemini-3.5-flash |
~$0.10–0.35 | ~$0.40–1.40 | Низкая задержка, большие объёмы |
Gemini 3 Flash google/gemini-3-flash-preview |
~$0.10–0.25 | ~$0.40–1.00 | Лёгкие диалоги и tool calls |
В сегменте «flagship Pro» Gemini 3.1 Pro — около 40% цены входа и 48% цены выхода Claude Opus 5 — на бумаге самый выгодный. Хватит ли качества — зависит от задачи, а не только от цены.
Четыре реальных сценария с цифрами
Оценка на один inference-вызов (без 5.5% пополнения). Эталонные модели: Claude Sonnet 4.6, GPT-5.4, Gemini 3.1 Pro.
Сценарий A: короткий диалог (поддержка / Q&A)
~2 000 вход + 500 выход токенов.
| Модель | Вход | Выход | Итого |
|---|---|---|---|
| Sonnet 4.6 ($3 / $15) | $0.006 | $0.0075 | $0.0135 |
| GPT-5.4 ($2.5 / $12) | $0.005 | $0.006 | $0.011 |
| Gemini 3.1 Pro ($2 / $12) | $0.004 | $0.006 | $0.010 |
На коротких диалогах разница мала; даже при 10 000 вызовах в день суммы остаются небольшими.
Сценарий B: code review (средний контекст)
~50 000 вход (diff + файлы) + 2 000 выход (комментарии ревью).
| Модель | Итого |
|---|---|
| Sonnet 4.6 | $0.18 ($0.15 + $0.03) |
| GPT-5.4 | $0.149 |
| Gemini 3.1 Pro | $0.124 |
Сценарий C: терминальный агент, одна сессия (интенсивное чтение репо)
~200 000 вход + 10 000 выход — близко к глубокой сессии Claude Code / Cursor Agent.
| Модель | Итого |
|---|---|
| Sonnet 4.6 | $0.75 |
| GPT-5.4 | $0.62 |
| Gemini 3.1 Pro | $0.52 |
| Claude Opus 5 ($5 / $25) | $1.25 |
| GPT-5.5 ($5 / $30) | $1.30 |
В агентных сценариях счёт ведут входные токены. 20 таких сессий в день на Sonnet 4.6 ≈ $15/день ≈ $450/мес только inference — отсюда интерес к подписке (напр. Claude Code Max), пока API не станет выгоднее.
Сценарий D: пакетное суммирование (100 × 8K вход + 300 выход)
Всего 800 000 вход + 30 000 выход токенов.
- Sonnet 4.6: ~$2.85
- GPT-5.4: ~$2.36
- Gemini 3.1 Pro: ~$1.96
- С Gemini 3.5 Flash: часто на порядок дешевле — для pipeline с умеренными требованиями к качеству
Месячный объём: кто дешевле?
Допустим 50M вход + 5M выход токенов/мес (типично для среднего agent-продукта):
| Модель | Месячный inference (оценка) |
|---|---|
| Claude Opus 5 | $50×5 + $25×5 = $375 |
| Claude Sonnet 4.6 | $3×50 + $15×5 = $225 |
| GPT-5.5 | $5×50 + $30×5 = $400 |
| GPT-5.4 | $2.5×50 + $12×5 = $185 |
| Gemini 3.1 Pro | $2×50 + $12×5 = $160 |
С учётом 5.5% пополнения: Gemini 3.1 Pro ~$169/мес, Sonnet 4.6 ~$237/мес, GPT-5.5 ~$422/мес. На бумаге чаще выигрывают Gemini Pro или Flash; для coding-агентов Sonnet остаётся якорем качества у многих команд.
Сравнение с подписками
Claude Pro (~$20/мес) или Max 5x ($100/мес) включают Claude Code и веб-пул — это не API-биллинг по токенам. Если API-счёт стабильно выше $100–200 и Claude Code не нужен, OpenRouter + свободный выбор моделей часто гибче; тяжёлые пользователи терминальных агентов могут выгоднее взять подписку.
OpenRouter vs прямой API
| Измерение | OpenRouter | Прямо Anthropic / OpenAI / Google |
|---|---|---|
| Цена токена (mainstream) | Обычно как у вендора | Тариф списка; enterprise-скидки возможны |
| Доп. комиссия платформы | 5.5% пополнение и др. | Нет (или счета по договору) |
| Смена модели | Меняете model |
Несколько SDK, ключей, billing-аккаунтов |
| Failover / маршрутизация | Встроена | Строите сами |
| Compliance и резидентность данных | Трафик через OpenRouter — проверьте DPA | Регион и compliance-пакеты на выбор |
Рекомендация: одна модель, > $5K/мес, enterprise-скидка — прямой API. Прототип, multi-model A/B, маленькая команда с одним шлюзом — экономия времени OpenRouter часто перевешивает ~5% комиссии.
Как снизить расходы: кэш, Batch и маршрутизация
- Prompt Caching: повторяющиеся длинные system prompt у Claude — OpenRouter передаёт скидки кэша.
- Маршрутизация моделей: Haiku / Flash для intent и черновиков, Sonnet / Pro для тяжёлых шагов — средняя цена часто >50% ниже.
- Сжимать контекст: меньше файлов за раунд агента, суммировать историю — часто эффективнее смены flagship.
- Batch API: не realtime через Batch вендора (часть моделей на OpenRouter) — заметные скидки.
- Мониторить usage: логировать
prompt_tokens/completion_tokensпо фичам — без «никто не знает, кто жжёт бюджет».
Если агент ещё гоняет xcodebuild, подпись и TestFlight на Mac, добавляется стоимость среды выполнения. См. облачный Mac и iOS toolchain — отдельно планируйте сборку и API.
FAQ
Можно ли использовать бесплатные модели OpenRouter в проде?
Есть бесплатные модели и квоты с rate limits (RPM, дневные лимиты, зависимость от баланса). Подходит для тестов; прод требует платных моделей и бюджета credits.
Почему счёт не совпадает с калькулятором?
Частые причины: не учтены reasoning-токены, ответы инструментов в контексте, особые тарифы image/audio, cache hit/miss. Ориентир — usage в ответе API.
BYOK (свой API-ключ) дешевле?
~1 M BYOK-запросов/мес бесплатно; сверх — 5% эквивалента OpenRouter. При enterprise-скидке у вендора не дублируете пополнение OpenRouter — но платите за маршрутизацию.
Claude, GPT-5 или Gemini в 2026?
Универсального ответа нет: качество кода и агентов → Sonnet / Opus или GPT-5.4 как эталон; длинный контекст + бюджет → Gemini 3.1 Pro; высокая параллельность, лёгкие задачи → Flash / Mini. Две недели параллельного A/B на OpenRouter надёжнее любой таблицы цен.
Кратко
- Биллинг: вход и выход отдельно; в агентах часто доминирует вход
- Платформа: пополнение ~+5.5% — бюджет не только по цене модели
- Flagship: Gemini 3.1 Pro обычно дешевле по списку; выход GPT-5.5 самый дорогой
- Выбор: multi-model / быстрые итерации → OpenRouter; одна модель, большой объём → прямой API + enterprise
API для моделей, облачный Mac для сборок
OpenRouter отвечает на «какой LLM»; iOS/macOS pipeline всё равно нужен Xcode. Облачный Mac Zilmac подходит к agent-workflow — подпись, нотаризация, TestFlight.
Стабильная Apple toolchain без физического Mac. — Смотреть предложения Cloud Mac