Строка «столько-то рублей за миллион токенов ввода и вывода» плохо предсказывает счёт, если через API работает агент. Автор материала на Habr взял свою реальную нагрузку в Claude Code и посчитал расходы на токены модели за один условный час работы — у пяти API-шлюзов с оплатой из России, по четырём категориям токенов сразу, включая чтение и запись кэша.
Материал вышел после появления Claude Opus 5.5 и GPT-6 Sol. Имени автор в заголовке не раскрывает; между статьями он ведёт телеграм-канал Agent Field Notes. Это первая часть задуманной серии: здесь — только расчёт по опубликованным ставкам, а замеры задержки, доли ошибок и фактических списаний он отложил на следующую часть.
Ниже — содержание разбора: откуда взялся профиль нагрузки, почему у этого профиля половина денег уходит на запись кэша, как выстроились два рейтинга (по Opus и по GPT) и где автор сам обозначил границы своих чисел. Оговорок в исходнике много, и они не декоративные — без них таблицы читаются неправильно.
Откуда взялся профиль нагрузки на час
Автор выгрузил логи 49 своих рабочих сессий Claude Code за два месяца, исключил паузы длиннее получаса и получил 138 часов активной работы. Это исторический профиль его собственного использования, а не тест только что вышедших моделей на специально подобранных задачах — он это оговаривает отдельно.
Средний час в этих логах выглядит так:
| Категория | Токенов за час | В миллионах |
|---|---|---|
| Чтение кэша | 15 300 000 | 15,3 |
| Запись в кэш | 860 000 | 0,86 |
| Вывод | 51 000 | 0,051 |
| Обычный, некэшированный ввод | 560 | 0,00056 |
Чтений кэша примерно в 18 раз больше, чем записей, и в 300 раз больше, чем вывода. Автор предупреждает о частой путанице: это не объём уникального текста, а суммарное использование — один и тот же контекст засчитывается при чтении кэша в каждом запросе, где он участвует.
Категории в расчёте не пересекаются: обычный ввод не включает токены, уже отнесённые к чтению или записи кэша, поэтому в формуле ничего не оплачивается дважды. Полной выгрузки логов в статье нет — приведены агрегированные цифры. По ним можно повторить сам расчёт расходов, но нельзя независимо проверить статистику нагрузки.
Почему расходы на токены модели не сводятся к цене ввода и вывода
Главное наблюдение разбора: при таком профиле основные деньги уходят не туда, куда смотрят в прайсе. Автор раскладывает официальную строку Anthropic для Claude Opus 5.5 — около 708 ₽ за условный час — на составляющие: примерно 363 ₽ приходится на запись кэша, 259 ₽ на чтение, 86 ₽ на вывод и меньше рубля на обычный ввод.
Записи составляют около 5,3% от суммы входных категорий, но при выбранном тарифе запись примерно в 25 раз дороже чтения. Отсюда и вывод: сравнивать шлюзы по цене ввода и вывода для такой нагрузки бессмысленно — половина счёта сидит в строке, которую на страницах цен часто приходится искать отдельно.
Формула, по которой считаются расходы у шлюзов с раздельными тарифами, простая:
C = 15,3 × Pчтение + 0,86 × Pзапись + 0,051 × Pвывод + 0,00056 × Pввод
Здесь C — рубли за условный час, P — ставка за миллион токенов соответствующей категории. Для официальной строки Opus это 15,3 × 16,9 + 0,86 × 422 + 0,051 × 1687 + 0,00056 × 337 = 707,72 ₽, после округления — 708 ₽.
Отдельная оговорка про TTL. Для строк с раздельными тарифами взята запись с временем жизни кэша 5 минут, тогда как в сессиях автора использовался часовой кэш, который у Anthropic дороже: $8 против $5 за миллион. Объёмы чтения и записи он оставил из логов и поменял только ставку — это не симуляция перехода на пятиминутный кэш, потому что при другом TTL часть повторных обращений потребовала бы новой записи.
Рейтинг по Claude Opus 5.5: пять шлюзов и официальный ориентир
В сравнении участвуют TeamoRouter, LiteAI, RouterAI, Polza AI и ProxyAPI. Дата ценового сравнения — 28 сентября 2026 года, долларовые ставки переведены по курсу 84,34 ₽ за доллар (округлённое значение курса Банка России на 26 сентября). Промокоды и договорные скидки не учитываются.
Ставки в рублях за миллион токенов:
| Платформа | Ввод | Вывод | Чтение кэша | Запись кэша |
|---|---|---|---|---|
| TeamoRouter | 86 | 432 | 4,3 | 108 |
| LiteAI — пересчёт пакета | 20 | 20 | 20 | 20 |
| RouterAI | 439 | 2 193 | 21,9 | 548 |
| Polza AI | 472 | 2 361 | 23,6 | 590 |
| ProxyAPI | 840 | 4 200 | 42 | 1 050 |
| Официально — Anthropic, ориентир | 337 | 1 687 | 16,9 | 422 |
Итоговый рейтинг — строго по расчётной сумме за одинаковый объём токенов:
| Место | Шлюз | Расчётные расходы, ₽/ч | К Anthropic |
|---|---|---|---|
| 1 | TeamoRouter | 181 | 0,26× |
| 2 | LiteAI — оценка по пакету | ≈324 | ≈0,46× |
| 3 | RouterAI | 918 | 1,30× |
| 4 | Polza AI | 989 | 1,40× |
| 5 | ProxyAPI | 1 760 | 2,49× |
Прямой API Anthropic в рейтинг посредников не входит и стоит рядом как ориентир: около 708 ₽/ч. Разрыв между первым и последним местом — примерно 9,7 раза, и автор сразу подчёркивает, что это разрыв в указанных ставках, а не доказательство одинаковой производительности или одинакового числа запросов после смены base_url.
Низкую цену TeamoRouter он отдельно комментирует: на сайте сервиса описаны динамические скидки, зависящие от стоимости апстрима, а среди причин названы оптовые условия и временные субсидии. Это объяснение самого сервиса, а не независимая проверка. Точный маршрут, режим обслуживания, ставку записи кэша и условия скидки автор на момент сравнения подтвердить в полном объёме не смог, поэтому считать эту цену постоянным базовым тарифом не предлагает.
LiteAI считается иначе
У LiteAI токены продаются пакетами, поэтому четырёх отдельных ставок у него нет. Автор берёт пакет на 100 млн токенов за 2 000 ₽ — 20 ₽ за миллион — и применяет эту цену ко всем четырём категориям: (15,3 + 0,86 + 0,051 + 0,00056) × 20 = 324,23 ₽, то есть около 324 ₽/ч. В таблице это помечено как оценка, а не как расчёт по опубликованным раздельным тарифам.
Допущение здесь одно и важное: предполагается, что чтения и записи кэша списываются из пакета один к одному. По фактическому биллингу это ещё не проверено. И 324 ₽ — стоимость условно израсходованных токенов, а не минимальное пополнение.
Другие пакеты дают другую оценку:
| Пакет | Предоплата | ₽ за 1 млн токенов | Opus, условные ₽/ч |
|---|---|---|---|
| 1 млн токенов | 30 ₽ | 30 | 486 |
| 10 млн токенов | 300 ₽ | 30 | 486 |
| 100 млн токенов — в рейтинге | 2 000 ₽ | 20 | ≈324 |
| 1 млрд токенов | 15 000 ₽ | 15 | 243 |
Самая низкая оценка в 243 ₽/ч требует предоплаты 15 000 ₽, а пакета на 1 млн токенов не хватит даже на один такой час. Неизрасходованный остаток большого пакета автоматически экономией не становится.
Рейтинг по GPT-6 Sol и режим Flex
Второй рейтинг построен на том же наборе объёмов, но по ставкам GPT-6 Sol для запросов до 272 тыс. входных токенов. Профиль из Claude Code здесь используется только как одинаковая нагрузка для сравнения — это не прогноз реального часа в Codex.
| Место | Шлюз | Расчётные расходы, ₽/ч | К OpenAI Standard |
|---|---|---|---|
| 1 | TeamoRouter | 83 | 0,17× |
| 2 | Polza AI | 338 | 0,70× |
| 3 | RouterAI | 627 | 1,30× |
| 4 | ProxyAPI | 1 201 | 2,49× |
| — | LiteAI: модель не найдена, место не присваивается | — | — |
Официальные ориентиры вне рейтинга: OpenAI Standard — около 483 ₽/ч, OpenAI Flex — около 241 ₽/ч. GPT-6 Sol в доступном перечне моделей LiteAI автор не нашёл, и оговаривает, что это ограничение опубликованного каталога, а не результат проверки доступности через API.
Отдельный сюжет — Polza AI. Её 338 ₽/ч выглядят как 70% от стандартного тарифа OpenAI, но если цена относится к маршруту openai/flex, то это уже около 140% от официального Flex. Связь ещё требует подтверждения, и автор не переводит её в вывод: Flex — другой режим обслуживания, дешевле в обмен на более медленные ответы и возможную нехватку ресурсов, а не ещё один шлюз. Порядок мест он оставляет как есть, но условия сравнения предлагает не считать одинаковыми.
Где расчёт заканчивается
Оговорок в материале едва ли не больше, чем цифр, и они формируют половину его ценности.
Это расчёт по опубликованным ставкам, а не замер фактических списаний. Не все ставки, маршруты и сроки действия цен автору удалось подтвердить; на некоторых открытых страницах встречаются значения, отличающиеся от табличных. Режим обслуживания, если он не подтверждён, автоматически не считается стандартным.
Пересчёт долларового прайса по курсу ЦБ — только способ привести всё к одной валюте. Он не означает, что пополнение пройдёт по этому курсу. Реальная рублёвая стоимость долларового баланса считается как «сколько рублей списано на сколько зачисленных долларов», с учётом комиссии. Платёжные комиссии, фактический курс зачисления и налоговый состав в таблицах не нормализованы — по каждому шлюзу автор перечисляет способы пополнения и честно помечает, что условия платежа подтверждены не полностью.
Профиль нагрузки принадлежит одному человеку. При коротких сессиях, другой истории диалога или другом TTL доля чтений и записей меняется, и объёмы надо подставлять в формулу заново; обещаний, что разрыв между шлюзами при этом вырастет, автор не даёт. Для GPT взят короткий ценовой диапазон — запросы за его пределами считаются отдельно. Самостоятельных расходов на инструменты и подписки, а также трат на ретраи и переключение маршрутов в расчёте нет.
Коротко
- Автор посчитал стоимость одного условного часа работы в Claude Code по четырём категориям токенов сразу: чтение кэша 15,3 млн, запись 0,86 млн, вывод 0,051 млн, обычный ввод 0,00056 млн. Профиль собран из 49 сессий и 138 часов активной работы.
- При такой нагрузке цена ввода почти ничего не решает: у официальной строки Anthropic из 708 ₽/ч около 363 ₽ приходится на запись кэша и 259 ₽ на чтение, а на обычный ввод — меньше рубля.
- Рейтинг по Claude Opus 5.5: TeamoRouter 181 ₽/ч, LiteAI ≈324 ₽/ч (оценка по пакету), RouterAI 918 ₽/ч, Polza AI 989 ₽/ч, ProxyAPI 1 760 ₽/ч. Разброс — почти десятикратный.
- Рейтинг по GPT-6 Sol на том же объёме: TeamoRouter 83 ₽/ч, Polza AI 338 ₽/ч, RouterAI 627 ₽/ч, ProxyAPI 1 201 ₽/ч; LiteAI без места, модель в каталоге не нашлась.
- Это сравнение опубликованных ставок на 28 сентября 2026 года, а не измеренные списания и не оценка качества. Задержку, долю ошибок и фактический биллинг автор обещает в следующей части.
Что из этого следует
Главное, что стоит забрать из материала независимо от рейтинга шлюзов: структура расходов зависит от того, как работает ваш клиент, а не от того, какие две цифры крупнее набраны на странице тарифов. У агентских сценариев с длинным контекстом счёт формируют кэш и его перезапись, у разовой генерации коротких текстов — вывод. Это разные профили, и оптимальный поставщик у них может быть разным.
Проверяемый шаг простой и повторяемый: выгрузить свои логи за пару недель, посчитать четыре категории токенов на типовой час или типовую задачу и подставить их в формулу автора вместо его чисел. Сравнение станет вашим, а не чужим, и сразу покажет, на какую строчку прайса вообще смотреть.
Третье — отношение к цене, которая выглядит слишком хорошо. Автор сам не выдаёт лидерство TeamoRouter за проверенный факт: динамические скидки, оптовые условия и временные субсидии — это объяснение сервиса, а маршрут и режим обслуживания он не подтвердил. Для регулярной работы такую ставку разумно считать временной и держать в голове стоимость переезда.
И последнее: расчётная стоимость токенов — не полная стоимость владения. Комиссия при пополнении, курс зачисления, ретраи, переключение маршрутов и минимальный размер пакета добавляются сверху. Обещанная вторая часть с замерами задержки и фактических списаний как раз про это, и без неё рейтинг остаётся ценовой таблицей, а не ответом на вопрос, где дешевле выполнить конкретную задачу.
Источник: Сколько стоит час работы кодинг-агента: рейтинг пяти API-шлюзов по расходам
