Перейти к содержимому
Content 365
Назад

Агенты для кодинга: сколько стоит час работы у пяти API-шлюзов

Обложка статьи «Агенты для кодинга: сколько стоит час работы у пяти API-шлюзов»

Строка «столько-то рублей за миллион токенов ввода и вывода» плохо предсказывает счёт, если через API работает агент. Автор материала на Habr взял свою реальную нагрузку в Claude Code и посчитал расходы на токены модели за один условный час работы — у пяти API-шлюзов с оплатой из России, по четырём категориям токенов сразу, включая чтение и запись кэша.

Материал вышел после появления Claude Opus 5.5 и GPT-6 Sol. Имени автор в заголовке не раскрывает; между статьями он ведёт телеграм-канал Agent Field Notes. Это первая часть задуманной серии: здесь — только расчёт по опубликованным ставкам, а замеры задержки, доли ошибок и фактических списаний он отложил на следующую часть.

Ниже — содержание разбора: откуда взялся профиль нагрузки, почему у этого профиля половина денег уходит на запись кэша, как выстроились два рейтинга (по Opus и по GPT) и где автор сам обозначил границы своих чисел. Оговорок в исходнике много, и они не декоративные — без них таблицы читаются неправильно.

Откуда взялся профиль нагрузки на час

Автор выгрузил логи 49 своих рабочих сессий Claude Code за два месяца, исключил паузы длиннее получаса и получил 138 часов активной работы. Это исторический профиль его собственного использования, а не тест только что вышедших моделей на специально подобранных задачах — он это оговаривает отдельно.

Средний час в этих логах выглядит так:

КатегорияТокенов за часВ миллионах
Чтение кэша15 300 00015,3
Запись в кэш860 0000,86
Вывод51 0000,051
Обычный, некэшированный ввод5600,00056

Чтений кэша примерно в 18 раз больше, чем записей, и в 300 раз больше, чем вывода. Автор предупреждает о частой путанице: это не объём уникального текста, а суммарное использование — один и тот же контекст засчитывается при чтении кэша в каждом запросе, где он участвует.

Категории в расчёте не пересекаются: обычный ввод не включает токены, уже отнесённые к чтению или записи кэша, поэтому в формуле ничего не оплачивается дважды. Полной выгрузки логов в статье нет — приведены агрегированные цифры. По ним можно повторить сам расчёт расходов, но нельзя независимо проверить статистику нагрузки.

Почему расходы на токены модели не сводятся к цене ввода и вывода

Главное наблюдение разбора: при таком профиле основные деньги уходят не туда, куда смотрят в прайсе. Автор раскладывает официальную строку Anthropic для Claude Opus 5.5 — около 708 ₽ за условный час — на составляющие: примерно 363 ₽ приходится на запись кэша, 259 ₽ на чтение, 86 ₽ на вывод и меньше рубля на обычный ввод.

Записи составляют около 5,3% от суммы входных категорий, но при выбранном тарифе запись примерно в 25 раз дороже чтения. Отсюда и вывод: сравнивать шлюзы по цене ввода и вывода для такой нагрузки бессмысленно — половина счёта сидит в строке, которую на страницах цен часто приходится искать отдельно.

Формула, по которой считаются расходы у шлюзов с раздельными тарифами, простая:

C = 15,3 × Pчтение + 0,86 × Pзапись + 0,051 × Pвывод + 0,00056 × Pввод

Здесь C — рубли за условный час, P — ставка за миллион токенов соответствующей категории. Для официальной строки Opus это 15,3 × 16,9 + 0,86 × 422 + 0,051 × 1687 + 0,00056 × 337 = 707,72 ₽, после округления — 708 ₽.

Отдельная оговорка про TTL. Для строк с раздельными тарифами взята запись с временем жизни кэша 5 минут, тогда как в сессиях автора использовался часовой кэш, который у Anthropic дороже: $8 против $5 за миллион. Объёмы чтения и записи он оставил из логов и поменял только ставку — это не симуляция перехода на пятиминутный кэш, потому что при другом TTL часть повторных обращений потребовала бы новой записи.

Рейтинг по Claude Opus 5.5: пять шлюзов и официальный ориентир

В сравнении участвуют TeamoRouter, LiteAI, RouterAI, Polza AI и ProxyAPI. Дата ценового сравнения — 28 сентября 2026 года, долларовые ставки переведены по курсу 84,34 ₽ за доллар (округлённое значение курса Банка России на 26 сентября). Промокоды и договорные скидки не учитываются.

Ставки в рублях за миллион токенов:

ПлатформаВводВыводЧтение кэшаЗапись кэша
TeamoRouter864324,3108
LiteAI — пересчёт пакета20202020
RouterAI4392 19321,9548
Polza AI4722 36123,6590
ProxyAPI8404 200421 050
Официально — Anthropic, ориентир3371 68716,9422

Итоговый рейтинг — строго по расчётной сумме за одинаковый объём токенов:

МестоШлюзРасчётные расходы, ₽/чК Anthropic
1TeamoRouter1810,26×
2LiteAI — оценка по пакету≈324≈0,46×
3RouterAI9181,30×
4Polza AI9891,40×
5ProxyAPI1 7602,49×

Прямой API Anthropic в рейтинг посредников не входит и стоит рядом как ориентир: около 708 ₽/ч. Разрыв между первым и последним местом — примерно 9,7 раза, и автор сразу подчёркивает, что это разрыв в указанных ставках, а не доказательство одинаковой производительности или одинакового числа запросов после смены base_url.

Низкую цену TeamoRouter он отдельно комментирует: на сайте сервиса описаны динамические скидки, зависящие от стоимости апстрима, а среди причин названы оптовые условия и временные субсидии. Это объяснение самого сервиса, а не независимая проверка. Точный маршрут, режим обслуживания, ставку записи кэша и условия скидки автор на момент сравнения подтвердить в полном объёме не смог, поэтому считать эту цену постоянным базовым тарифом не предлагает.

LiteAI считается иначе

У LiteAI токены продаются пакетами, поэтому четырёх отдельных ставок у него нет. Автор берёт пакет на 100 млн токенов за 2 000 ₽ — 20 ₽ за миллион — и применяет эту цену ко всем четырём категориям: (15,3 + 0,86 + 0,051 + 0,00056) × 20 = 324,23 ₽, то есть около 324 ₽/ч. В таблице это помечено как оценка, а не как расчёт по опубликованным раздельным тарифам.

Допущение здесь одно и важное: предполагается, что чтения и записи кэша списываются из пакета один к одному. По фактическому биллингу это ещё не проверено. И 324 ₽ — стоимость условно израсходованных токенов, а не минимальное пополнение.

Другие пакеты дают другую оценку:

ПакетПредоплата₽ за 1 млн токеновOpus, условные ₽/ч
1 млн токенов30 ₽30486
10 млн токенов300 ₽30486
100 млн токенов — в рейтинге2 000 ₽20≈324
1 млрд токенов15 000 ₽15243

Самая низкая оценка в 243 ₽/ч требует предоплаты 15 000 ₽, а пакета на 1 млн токенов не хватит даже на один такой час. Неизрасходованный остаток большого пакета автоматически экономией не становится.

Рейтинг по GPT-6 Sol и режим Flex

Второй рейтинг построен на том же наборе объёмов, но по ставкам GPT-6 Sol для запросов до 272 тыс. входных токенов. Профиль из Claude Code здесь используется только как одинаковая нагрузка для сравнения — это не прогноз реального часа в Codex.

МестоШлюзРасчётные расходы, ₽/чК OpenAI Standard
1TeamoRouter830,17×
2Polza AI3380,70×
3RouterAI6271,30×
4ProxyAPI1 2012,49×
—LiteAI: модель не найдена, место не присваивается——

Официальные ориентиры вне рейтинга: OpenAI Standard — около 483 ₽/ч, OpenAI Flex — около 241 ₽/ч. GPT-6 Sol в доступном перечне моделей LiteAI автор не нашёл, и оговаривает, что это ограничение опубликованного каталога, а не результат проверки доступности через API.

Отдельный сюжет — Polza AI. Её 338 ₽/ч выглядят как 70% от стандартного тарифа OpenAI, но если цена относится к маршруту openai/flex, то это уже около 140% от официального Flex. Связь ещё требует подтверждения, и автор не переводит её в вывод: Flex — другой режим обслуживания, дешевле в обмен на более медленные ответы и возможную нехватку ресурсов, а не ещё один шлюз. Порядок мест он оставляет как есть, но условия сравнения предлагает не считать одинаковыми.

Где расчёт заканчивается

Оговорок в материале едва ли не больше, чем цифр, и они формируют половину его ценности.

Это расчёт по опубликованным ставкам, а не замер фактических списаний. Не все ставки, маршруты и сроки действия цен автору удалось подтвердить; на некоторых открытых страницах встречаются значения, отличающиеся от табличных. Режим обслуживания, если он не подтверждён, автоматически не считается стандартным.

Пересчёт долларового прайса по курсу ЦБ — только способ привести всё к одной валюте. Он не означает, что пополнение пройдёт по этому курсу. Реальная рублёвая стоимость долларового баланса считается как «сколько рублей списано на сколько зачисленных долларов», с учётом комиссии. Платёжные комиссии, фактический курс зачисления и налоговый состав в таблицах не нормализованы — по каждому шлюзу автор перечисляет способы пополнения и честно помечает, что условия платежа подтверждены не полностью.

Профиль нагрузки принадлежит одному человеку. При коротких сессиях, другой истории диалога или другом TTL доля чтений и записей меняется, и объёмы надо подставлять в формулу заново; обещаний, что разрыв между шлюзами при этом вырастет, автор не даёт. Для GPT взят короткий ценовой диапазон — запросы за его пределами считаются отдельно. Самостоятельных расходов на инструменты и подписки, а также трат на ретраи и переключение маршрутов в расчёте нет.

Коротко

Что из этого следует

Главное, что стоит забрать из материала независимо от рейтинга шлюзов: структура расходов зависит от того, как работает ваш клиент, а не от того, какие две цифры крупнее набраны на странице тарифов. У агентских сценариев с длинным контекстом счёт формируют кэш и его перезапись, у разовой генерации коротких текстов — вывод. Это разные профили, и оптимальный поставщик у них может быть разным.

Проверяемый шаг простой и повторяемый: выгрузить свои логи за пару недель, посчитать четыре категории токенов на типовой час или типовую задачу и подставить их в формулу автора вместо его чисел. Сравнение станет вашим, а не чужим, и сразу покажет, на какую строчку прайса вообще смотреть.

Третье — отношение к цене, которая выглядит слишком хорошо. Автор сам не выдаёт лидерство TeamoRouter за проверенный факт: динамические скидки, оптовые условия и временные субсидии — это объяснение сервиса, а маршрут и режим обслуживания он не подтвердил. Для регулярной работы такую ставку разумно считать временной и держать в голове стоимость переезда.

И последнее: расчётная стоимость токенов — не полная стоимость владения. Комиссия при пополнении, курс зачисления, ретраи, переключение маршрутов и минимальный размер пакета добавляются сверху. Обещанная вторая часть с замерами задержки и фактических списаний как раз про это, и без неё рейтинг остаётся ценовой таблицей, а не ответом на вопрос, где дешевле выполнить конкретную задачу.


Источник: Сколько стоит час работы кодинг-агента: рейтинг пяти API-шлюзов по расходам


Поделиться статьёй:

Предыдущая статья
LLM модель в воркфлоу: где она помогает, а где стоит дорого