Zilmac Блог
← Назад к технической практике

Цены OpenRouter API: реальное сравнение Claude, GPT-5 и Gemini (2026)

API и Agents ·~12 мин чтения

Мульти-модельный API-шлюз и облачная панель тарификации токенов—OpenRouter для Claude GPT Gemini

Команды, которые строят агентов, альтернативы Copilot или собственный LLM-шлюз, почти неизбежно сталкиваются с OpenRouter: один API-ключ, один параметр model — и вы переключаетесь между Claude, GPT, Gemini и более чем 300 моделями. Но как считается счёт? И насколько он отличается от прямых вызовов Anthropic, OpenAI или Google? По публичным тарифам июля 2026 разбираем формулу биллинга, скрытые расходы и реальную стоимость одного API-вызова у трёх крупнейших вендоров.

5.5%
Комиссия платформы при пополнении картой (есть минимум)
300+
Моделей через один endpoint
Вход ≠ Выход
Два типа токенов, разные тарифы

Биллинг OpenRouter: формула за минуту

OpenRouter работает по схеме предоплаты и списания за токены — без месячного пакета. Ядро стоимости inference на один API-вызов:

Стоимость inference за вызов

Стоимость = (входные токены ÷ 1 000 000 × цена входа) + (выходные токены ÷ 1 000 000 × цена выхода)

Цены в USD за миллион токенов — в каталоге OpenRouter и на страницах моделей. Вход и выход считаются отдельно; выход обычно дороже.

Что считается входным токеном? Ваш prompt, system prompt, история диалога, ответы инструментов (function calling), попадающие в контекст, а у части моделей — reasoning-токены на стороне входа.
Что считается выходным токеном? Текст, сгенерированный моделью (и при необходимости отдельно тарифицируемый reasoning на выходе).

Пример: модель $3/M вход, $15/M выход, запрос 10 000 вход + 2 000 выход токенов:

  • Вход: 10 000 ÷ 1 000 000 × $3 = $0.03
  • Выход: 2 000 ÷ 1 000 000 × $15 = $0.03
  • Inference всего: $0.06 (без комиссии пополнения)

API OpenRouter совместим с OpenAI Chat Completions; в ответе обычно есть usage.prompt_tokens и usage.completion_tokens — удобно для оценки затрат в приложении.

Скрытые расходы, которые легко пропустить

Цена токена в каталоге — только база. По тарифам OpenRouter добавляются ещё слои:

Слой затрат Ставка / правило Когда применяется
Inference (токены) Цена вендора без наценки Каждый API-вызов
Комиссия при пополнении картой 5.5% (минимум) Каждая покупка credits картой
Пополнение криптой ~5% Крипто-платёж
Превышение BYOK 5% от эквивалента OpenRouter Свой ключ, запросы > бесплатного месячного лимита (стандарт ~1 M/мес)
Скидка по объёму до ~7% off Gold / Platinum (пороги ~$1K / $5K/мес)

Небольшим командам стоит закладывать 5–7% overhead поверх inference. Пример: пополнили $100 → на inference остаётся около $94.50 (после 5.5%), далее списание по тарифу модели.

Важно: OpenRouter не накручивает цену токена у mainstream-моделей (как у вендора). Переплата — в основном friction пополнения и удобство multi-model, а не скрытая наценка на каждый токен.

Таблица цен 2026: Claude vs GPT-5 vs Gemini

Ориентиры на OpenRouter, июль 2026 (USD / M токенов). Цены меняются — перед продом смотрите актуальные тарифы.

Anthropic Claude

Модель (ID OpenRouter) Вход / M Выход / M Назначение
Claude Opus 5 anthropic/claude-opus-5 $5.00 $25.00 Флагманский reasoning, сложные агенты, длинный coding
Claude Sonnet 4.6 anthropic/claude-sonnet-4.6 $3.00 $15.00 Ежедневный coding и основная рабочая модель
Claude Haiku 4.5 anthropic/claude-haiku-4.5 $1.00 $5.00 Классификация, маршрутизация, лёгкие completions

Claude на OpenRouter поддерживает Prompt Caching: повторяющийся большой контекст (system prompt, длинные документы) сильно снижает эффективную цену входа; «Effective Pricing» на странице модели у части пользователей на 60–80% ниже списка.

OpenAI GPT-5

Модель (ID OpenRouter) Вход / M Выход / M Назначение
GPT-5.5 openai/gpt-5.5 $5.00 $30.00 Флагман multimodal и тяжёлые задачи
GPT-5.4 openai/gpt-5.4 $2.50 ~$10–15 Баланс производительности и стоимости
GPT-5.4 Mini openai/gpt-5.4-mini ~$0.15–0.40 ~$0.60–1.60 Высокая параллельность, простые задачи

У GPT-5 на OpenRouter цена выхода часто выше, чем у сопоставимого Claude (напр. GPT-5.5 выход $30 vs Opus 5 выход $25). При длинном выходе (длинные тексты, много кода) флагман OpenAI может обойтись дороже.

Google Gemini

Модель (ID OpenRouter) Вход / M Выход / M Назначение
Gemini 3.1 Pro google/gemini-3.1-pro-preview $2.00 $12.00 Длинный контекст, multimodal Pro
Gemini 3.5 Flash google/gemini-3.5-flash ~$0.10–0.35 ~$0.40–1.40 Низкая задержка, большие объёмы
Gemini 3 Flash google/gemini-3-flash-preview ~$0.10–0.25 ~$0.40–1.00 Лёгкие диалоги и tool calls

В сегменте «flagship Pro» Gemini 3.1 Pro — около 40% цены входа и 48% цены выхода Claude Opus 5 — на бумаге самый выгодный. Хватит ли качества — зависит от задачи, а не только от цены.

Разработчик сравнивает счета API Claude GPT Gemini и потребление токенов
В сценариях с агентами входные токены часто доминируют. Считайте затраты с учётом соотношения вход/выход — не только цену за миллион.

Четыре реальных сценария с цифрами

Оценка на один inference-вызов (без 5.5% пополнения). Эталонные модели: Claude Sonnet 4.6, GPT-5.4, Gemini 3.1 Pro.

Сценарий A: короткий диалог (поддержка / Q&A)

~2 000 вход + 500 выход токенов.

Модель Вход Выход Итого
Sonnet 4.6 ($3 / $15) $0.006 $0.0075 $0.0135
GPT-5.4 ($2.5 / $12) $0.005 $0.006 $0.011
Gemini 3.1 Pro ($2 / $12) $0.004 $0.006 $0.010

На коротких диалогах разница мала; даже при 10 000 вызовах в день суммы остаются небольшими.

Сценарий B: code review (средний контекст)

~50 000 вход (diff + файлы) + 2 000 выход (комментарии ревью).

Модель Итого
Sonnet 4.6 $0.18 ($0.15 + $0.03)
GPT-5.4 $0.149
Gemini 3.1 Pro $0.124

Сценарий C: терминальный агент, одна сессия (интенсивное чтение репо)

~200 000 вход + 10 000 выход — близко к глубокой сессии Claude Code / Cursor Agent.

Модель Итого
Sonnet 4.6 $0.75
GPT-5.4 $0.62
Gemini 3.1 Pro $0.52
Claude Opus 5 ($5 / $25) $1.25
GPT-5.5 ($5 / $30) $1.30

В агентных сценариях счёт ведут входные токены. 20 таких сессий в день на Sonnet 4.6 ≈ $15/день ≈ $450/мес только inference — отсюда интерес к подписке (напр. Claude Code Max), пока API не станет выгоднее.

Сценарий D: пакетное суммирование (100 × 8K вход + 300 выход)

Всего 800 000 вход + 30 000 выход токенов.

  • Sonnet 4.6: ~$2.85
  • GPT-5.4: ~$2.36
  • Gemini 3.1 Pro: ~$1.96
  • С Gemini 3.5 Flash: часто на порядок дешевле — для pipeline с умеренными требованиями к качеству

Месячный объём: кто дешевле?

Допустим 50M вход + 5M выход токенов/мес (типично для среднего agent-продукта):

Модель Месячный inference (оценка)
Claude Opus 5 $50×5 + $25×5 = $375
Claude Sonnet 4.6 $3×50 + $15×5 = $225
GPT-5.5 $5×50 + $30×5 = $400
GPT-5.4 $2.5×50 + $12×5 = $185
Gemini 3.1 Pro $2×50 + $12×5 = $160

С учётом 5.5% пополнения: Gemini 3.1 Pro ~$169/мес, Sonnet 4.6 ~$237/мес, GPT-5.5 ~$422/мес. На бумаге чаще выигрывают Gemini Pro или Flash; для coding-агентов Sonnet остаётся якорем качества у многих команд.

Сравнение с подписками

Claude Pro (~$20/мес) или Max 5x ($100/мес) включают Claude Code и веб-пул — это не API-биллинг по токенам. Если API-счёт стабильно выше $100–200 и Claude Code не нужен, OpenRouter + свободный выбор моделей часто гибче; тяжёлые пользователи терминальных агентов могут выгоднее взять подписку.

OpenRouter vs прямой API

Измерение OpenRouter Прямо Anthropic / OpenAI / Google
Цена токена (mainstream) Обычно как у вендора Тариф списка; enterprise-скидки возможны
Доп. комиссия платформы 5.5% пополнение и др. Нет (или счета по договору)
Смена модели Меняете model Несколько SDK, ключей, billing-аккаунтов
Failover / маршрутизация Встроена Строите сами
Compliance и резидентность данных Трафик через OpenRouter — проверьте DPA Регион и compliance-пакеты на выбор

Рекомендация: одна модель, > $5K/мес, enterprise-скидка — прямой API. Прототип, multi-model A/B, маленькая команда с одним шлюзом — экономия времени OpenRouter часто перевешивает ~5% комиссии.

Как снизить расходы: кэш, Batch и маршрутизация

  1. Prompt Caching: повторяющиеся длинные system prompt у Claude — OpenRouter передаёт скидки кэша.
  2. Маршрутизация моделей: Haiku / Flash для intent и черновиков, Sonnet / Pro для тяжёлых шагов — средняя цена часто >50% ниже.
  3. Сжимать контекст: меньше файлов за раунд агента, суммировать историю — часто эффективнее смены flagship.
  4. Batch API: не realtime через Batch вендора (часть моделей на OpenRouter) — заметные скидки.
  5. Мониторить usage: логировать prompt_tokens / completion_tokens по фичам — без «никто не знает, кто жжёт бюджет».

Если агент ещё гоняет xcodebuild, подпись и TestFlight на Mac, добавляется стоимость среды выполнения. См. облачный Mac и iOS toolchain — отдельно планируйте сборку и API.

FAQ

Можно ли использовать бесплатные модели OpenRouter в проде?

Есть бесплатные модели и квоты с rate limits (RPM, дневные лимиты, зависимость от баланса). Подходит для тестов; прод требует платных моделей и бюджета credits.

Почему счёт не совпадает с калькулятором?

Частые причины: не учтены reasoning-токены, ответы инструментов в контексте, особые тарифы image/audio, cache hit/miss. Ориентир — usage в ответе API.

BYOK (свой API-ключ) дешевле?

~1 M BYOK-запросов/мес бесплатно; сверх — 5% эквивалента OpenRouter. При enterprise-скидке у вендора не дублируете пополнение OpenRouter — но платите за маршрутизацию.

Claude, GPT-5 или Gemini в 2026?

Универсального ответа нет: качество кода и агентов → Sonnet / Opus или GPT-5.4 как эталон; длинный контекст + бюджет → Gemini 3.1 Pro; высокая параллельность, лёгкие задачи → Flash / Mini. Две недели параллельного A/B на OpenRouter надёжнее любой таблицы цен.

Кратко

  • Биллинг: вход и выход отдельно; в агентах часто доминирует вход
  • Платформа: пополнение ~+5.5% — бюджет не только по цене модели
  • Flagship: Gemini 3.1 Pro обычно дешевле по списку; выход GPT-5.5 самый дорогой
  • Выбор: multi-model / быстрые итерации → OpenRouter; одна модель, большой объём → прямой API + enterprise

API для моделей, облачный Mac для сборок

OpenRouter отвечает на «какой LLM»; iOS/macOS pipeline всё равно нужен Xcode. Облачный Mac Zilmac подходит к agent-workflow — подпись, нотаризация, TestFlight.

Стабильная Apple toolchain без физического Mac. — Смотреть предложения Cloud Mac

Лимитированное предложение

Zilmac

Облачный Mac, удалённая разработка и Mac VPS—Apple toolchain для iOS и кроссплатформенных команд.

На главную
Лимитированное предложение Смотреть планы