Сколько стоит час работы кодинг-агента: рейтинг пяти API-шлюзов по расходам
После выхода Claude Opus 5.5 и GPT-6 Sol я пошёл сравнивать цены API-шлюзов с оплатой из России. И быстро упёрся в то, что строчка «ввод / вывод за миллион токенов» плохо объясняет будущий счёт. В моих сессиях Claude Code основная нагрузка приходится на кэш, а цены его чтения и записи приходится искать отдельно.
Поэтому я посчитал по-другому: сколько стоил бы один и тот же объём токенов у разных шлюзов. За основу взял среднюю нагрузку за час активной работы в Claude Code по своим логам.
Критерий рейтинга один: сколько денег уйдёт на одинаковый объём токенов за условный час. Чем меньше сумма, тем выше место. Для каждой модели — свой порядок: не по цене ввода и не по общему баллу за разные модели. LiteAI тоже участвует в сравнении, но его пакетную цену пересчитываю отдельно и отмечаю как оценку.
Это расчёт по указанным ниже ставкам, а не замер фактических списаний через каждый шлюз и не рейтинг качества. Стабильность, время до первого токена и реальные расходы на одинаковые задачи оставляю для следующих частей.
Откуда профиль нагрузки
Я выгрузил логи своих 49 рабочих сессий Claude Code за два месяца. Паузы длиннее получаса исключил, получилось 138 часов активной работы. Это исторический профиль моего использования, а не двухмесячный тест только что вышедших моделей.
В расчёте на один такой час:
Категория | Токенов за час | В миллионах |
|---|---|---|
Чтение кэша | 15 300 000 | 15,3 |
Запись в кэш | 860 000 | 0,86 |
Вывод | 51 000 | 0,051 |
Обычный, некэшированный ввод | 560 | 0,00056 |
Чтений примерно в 18 раз больше, чем записей, и в 300 раз больше, чем вывода. Здесь важно не перепутать объём уникального текста с суммарным использованием: один и тот же контекст может учитываться при чтении кэша во многих запросах.
Категории в расчёте считаются отдельно: обычный ввод не включает токены, уже отнесённые к чтению или записи кэша. Поэтому одна и та же категория не оплачивается в формуле дважды. Здесь приведены агрегированные данные без полной выгрузки логов. По ним можно повторить расчёт расходов, но нельзя независимо проверить саму статистику нагрузки.
Кого сравниваю
В сравнении пять шлюзов: TeamoRouter, LiteAI, RouterAI, Polza AI и ProxyAPI. Для четырёх из них, кроме LiteAI, считаю расходы по отдельным ставкам четырёх категорий токенов для каждой модели. Это не полный обзор рынка и не утверждение, что все маршруты внутри каждого шлюза стоят одинаково.
LiteAI участвует в рейтинге с оценкой по пакету. У него пакетная покупка токенов, поэтому способ расчёта отличается: у остальных шлюзов умножаю объём каждой из четырёх категорий на её ставку и складываю результаты, а у LiteAI оцениваю весь объём по цене выбранного пакета. Для рейтинга беру пакет 100 млн токенов за 2 000 ₽ — это 20 ₽ за миллион. Это не безусловная базовая ставка и не самая низкая пакетная цена на странице. Другие пакеты посчитаны ниже.
В рейтинге Opus — все пять шлюзов. В рейтинге GPT — четыре шлюза с расчётной стоимостью и строка LiteAI без места. GPT-6 Sol в доступном перечне моделей LiteAI я не нашёл, поэтому расходы для него не рассчитываю. Это ограничение опубликованного каталога, а не результат проверки доступности через API.
Какие цены использую
Все ставки ниже — рубли за миллион токенов. Дата ценового сравнения — 28 сентября 2026 года. Долларовые цены переведены по курсу 84,34 ₽ за $1: это округлённое значение курса Банка России на 26 сентября — 84,3414 ₽.
Для воспроизводимости дальше считаю именно по числам, показанным в таблицах. Итог за час округляю один раз, до целого рубля. Это немного менее точно, чем расчёт по неокруглённым долларовым ставкам, зато читатель может повторить его без скрытых исходных данных.
Промокоды и индивидуальные договорные скидки не учитываю. Пакеты LiteAI и динамические скидки TeamoRouter отмечаю отдельно — их нельзя выдавать за одинаковый бессрочный базовый тариф.
Порядок шлюзов в таблицах ставок такой же, как в рейтингах ниже: от меньшей расчётной суммы за час к большей, а не по цене ввода. Официальные ставки стоят отдельно в конце таблиц как ориентир и не получают места среди шлюзов.
Claude Opus 5.5
Платформа | Ввод | Вывод | Чтение кэша | Запись кэша |
|---|---|---|---|---|
TeamoRouter | 86 | 432 | 4,3 | 108 |
LiteAI — пересчёт пакета | 20 | 20 | 20 | 20 |
RouterAI | 439 | 2 193 | 21,9 | 548 |
Polza AI | 472 | 2 361 | 23,6 | 590 |
ProxyAPI | 840 | 4 200 | 42 | 1 050 |
Официально — Anthropic, ориентир | 337 | 1 687 | 16,9 | 422 |
Строка LiteAI — не четыре отдельно опубликованных тарифа. Для оценки применяю пакетную цену 20 ₽ за миллион ко всем четырём категориям. В частности, списание чтений и записей кэша из пакета один к одному ещё нужно подтвердить по фактическому биллингу.
Для строк Opus с раздельными тарифами выбран тариф записи с TTL 5 минут; пересчёт единого пакета LiteAI не означает, что у него отдельно подтверждена такая ставка записи. У Anthropic запись с TTL 1 час стоит дороже: $8 вместо $5 за миллион токенов. В моих сессиях использовался именно часовой кэш.
Я сохраняю объёмы чтения и записи из логов и меняю только ставку. Это не симуляция перехода на пятиминутный кэш: при другом TTL часть повторных обращений может потребовать новой записи. Поэтому табличный результат нельзя считать обещанием фактического счёта после смены настроек. Применимость пятиминутной ставки у каждого шлюза тоже требует подтверждения.
GPT-6 Sol — запросы до 272 тыс. входных токенов
Платформа | Ввод | Вывод | Чтение кэша | Запись кэша |
|---|---|---|---|---|
TeamoRouter | 29 | 145 | 2,9 | 36 |
Polza AI | 118 | 590 | 11,8 | 148 |
RouterAI | 219 | 1 096 | 21,9 | 274 |
ProxyAPI | 420 | 2 100 | 42 | 525 |
LiteAI: модель не найдена, расчёта нет | — | — | — | — |
Официально — OpenAI Standard, ориентир | 169 | 843 | 16,9 | 211 |
Официально — OpenAI Flex, справочно | 84,34 | 421,70 | 8,43 | 105,43 |
У GPT использую его собственные категории тарификации. Правило «пятиминутная запись» от Anthropic сюда не переношу. Профиль из Claude Code здесь нужен только как одинаковый набор объёмов: это не прогноз реального часа в Codex и не сравнение стоимости выполнения одной задачи разными моделями.
Не все ставки, маршруты и сроки действия цен удалось подтвердить в полном объёме. На некоторых открытых страницах указаны значения, отличающиеся от табличных. Поэтому результат относится именно к приведённым ставкам, а не гарантирует, что после пополнения будет действовать та же цена. Если режим обслуживания не подтверждён, не считаю его автоматически Standard.
Рейтинг по расходам: от меньшей суммы за час к большей
Место определяется только расчётной суммой: кто дешевле при одинаковом объёме токенов, тот выше. У Opus и GPT отдельные таблицы, потому что порядок шлюзов у них разный. Прямой официальный API — ценовой ориентир, а не участник рейтинга посредников.
Для шлюзов с раздельными тарифами формула такая:
C = 15,3 × Pчтение + 0,86 × Pзапись + 0,051 × Pвывод + 0,00056 × Pввод
Где C — рубли за условный час, а P — соответствующая ставка за миллион токенов. Например, для официальной строки Opus:
15,3 × 16,9 + 0,86 × 422 + 0,051 × 1687 + 0,00056 × 337 = 707,71572 ₽
После округления — 708 ₽. Для LiteAI вместо четырёх независимых ставок использую пересчёт пакета, пояснение — сразу под рейтингом.
Claude Opus 5.5: рейтинг расходов для пяти шлюзов
Место по расходам | Шлюз | Расчётные расходы, ₽/ч | К Anthropic |
|---|---|---|---|
1 | TeamoRouter | 181 | 0,26× |
2 | LiteAI — оценка по пакету | ≈324 | ≈0,46× |
3 | RouterAI | 918 | 1,30× |
4 | Polza AI | 989 | 1,40× |
5 | ProxyAPI | 1 760 | 2,49× |
Официальный ориентир, вне рейтинга: Anthropic — около 708 ₽/ч (1,00×).
У LiteAI другой способ расчёта: здесь приведена оценка по пакету. В рейтинге использован пакет 100 млн токенов за 2 000 ₽, то есть 20 ₽ за миллион. Складываю все четыре категории — получается 16,21156 млн токенов за час — и умножаю на единую пакетную цену:
C_LiteAI = (15,3 + 0,86 + 0,051 + 0,00056) × 20 = 324,2312 ₽ ≈ 324 ₽/ч
Предполагается, что чтения и записи кэша расходуют пакет один к одному; по фактическому биллингу это ещё не проверено. 324 ₽ — стоимость условно израсходованных токенов, а не минимальное пополнение и не обещание фактического списания. Другой пакет даст другую оценку; варианты приведены ниже.
GPT-6 Sol: рейтинг расходов при том же объёме токенов
Место по расходам | Шлюз | Расчётные расходы, ₽/ч | К OpenAI Standard |
|---|---|---|---|
1 | TeamoRouter | 83 | 0,17× |
2 | Polza AI | 338 | 0,70× |
3 | RouterAI | 627 | 1,30× |
4 | ProxyAPI | 1 201 | 2,49× |
— | LiteAI: модель не найдена, место не присваивается | — | — |
Официальные ориентиры, вне рейтинга: OpenAI Standard — около 483 ₽/ч (1,00×), OpenAI Flex — около 241 ₽/ч (0,50×). Flex — другой режим обслуживания, а не ещё один шлюз. Связь цены Polza с маршрутом openai/flex ещё требует подтверждения; считать условия всех строк одинаковыми нельзя.
Множители рассчитаны по неокруглённым итогам формулы, а не по округлённым рублям за час. Обе таблицы ранжируют только ожидаемые расходы при указанных ценах и фиксированном потреблении. Они не содержат оценки качества и не показывают уже измеренные фактические списания.
Как пакет LiteAI меняет оценку расходов
Для основного рейтинга выбран сценарий 20 ₽ за миллион с явной пометкой «оценка по пакету». На странице покупки есть и другие цены, в том числе 15 ₽ за миллион. Поэтому 324 ₽ — не универсальная стоимость и не минимальная оценка среди всех пакетов. Ниже — остальные варианты, чтобы можно было учесть свой объём покупки.
Пакет | Предоплата | ₽ за 1 млн токенов | Opus, условные ₽/ч |
|---|---|---|---|
1 млн токенов | 30 ₽ | 30 | 486 |
10 млн токенов | 300 ₽ | 30 | 486 |
100 млн токенов — в рейтинге | 2 000 ₽ | 20 | ≈324 |
1 млрд токенов | 15 000 ₽ | 15 | 243 |
Здесь сумма четырёх категорий составляет 16,21156 млн токенов за условный час. Умножаю её на пакетную ставку. Расчёт предполагает, что и чтения, и записи кэша списываются из пакета один к одному, как следует из заявленного единого тарифа. Это ещё нужно проверить по фактическому биллингу; пока результат условный.
Столбец «за час» — нормализованная стоимость расхода, а не минимальная сумма платежа. Например, одного пакета на 1 млн токенов для такого часа недостаточно. Неизрасходованный остаток большого пакета тоже не превращается автоматически в экономию.
Что получается из этих цифр
При этой нагрузке разброс ставок даёт почти десятикратную разницу. По ставкам из таблицы расчёт Opus составляет 181 ₽ у TeamoRouter и 1 760 ₽ у ProxyAPI — примерно 9,7 раза. Это условный результат для конкретных строк, а не доказательство одинаковой производительности или одинакового числа запросов при смене base_url.
У официальной строки Opus около половины суммы приходится на запись кэша. Из 708 ₽ это примерно 363 ₽; чтение — 259 ₽, вывод — 86 ₽, обычный ввод — меньше рубля. Записей около 5,3% от суммы входных категорий, но при выбранном тарифе запись примерно в 25 раз дороже чтения. Для моего профиля сравнивать только ввод и вывод действительно недостаточно.
Самая низкая цена ввода не даёт первого места по расходам. Для LiteAI при пакетной ставке 20 ₽ за миллион получается около 324 ₽/ч — второе место в рейтинге Opus, хотя ввод дешевле. Другие пакетные ставки дают около 486 ₽/ч и 243 ₽/ч; последняя оценка требует предоплаты 15 000 ₽. Место определяется расходами на весь набор токенов, но размер пакета и порог покупки тоже нужно учитывать.
Polza нужно сравнивать с подходящим официальным режимом. Принадлежность этой цены GPT-6 Sol к маршруту openai/flex ещё требует подтверждения. Если цена относится именно к нему, то 338 ₽ — около 70% от OpenAI Standard, но примерно 140% от стоимости официального Flex. Режим OpenAI Flex дешевле стандартного в обмен на более медленные ответы и возможную нехватку ресурсов. Измерять задержку буду отдельно; здесь важно не скрывать разницу условий.
Низкая цена TeamoRouter тоже требует пояснения. На сайте описаны динамические скидки, зависящие от стоимости апстрима, а среди причин низкой цены названы оптовые условия и временные субсидии. Это объяснение самого сервиса, а не независимое подтверждение одинаковых условий с прямым API. Точный маршрут, режим обслуживания, ставку записи кэша и условия скидки на момент сравнения я пока не подтвердил в полном объёме. Эту цену нельзя считать постоянным базовым тарифом.
Как пополнить баланс и что это меняет в цене
Шлюз | Способы пополнения | Что важно для сравнения |
|---|---|---|
TeamoRouter | СБП, Т-Банк, Visa / Mastercard / «Мир», ЮMoney, SberPay | Баланс в USD; способы оплаты, курс рублёвого платежа, комиссия и минимум пока не подтверждены по каждому варианту |
LiteAI | Карта, СБП | Цена токена зависит от размера пакета |
RouterAI | Карты российских банков, СБП, счёт для юрлиц и ИП | Способы оплаты и применимость цены к выбранному маршруту пока не подтверждены полностью |
Polza AI | Карта, СБП, расчётный счёт | Итоговые условия платежа и выбранный маршрут пока не подтверждены полностью |
ProxyAPI | Карта, СБП, счёт для юрлиц | Способы оплаты, итоговая сумма и состав налогов пока не подтверждены полностью |
Пересчёт долларового прайса по курсу ЦБ — только способ привести ставки к одной валюте. Он не означает, что пользователь пополнит баланс по тому же курсу. Фактическая рублёвая стоимость долларового баланса считается как «сколько рублей списано / сколько долларов зачислено», с учётом комиссии.
Таблицы выше — сравнение указанных ставок, а не проверенный расчёт полной суммы оплаты. Платёжные комиссии, фактический курс зачисления и налоговый состав отдельно не нормализованы. Рекламную скидку на токены, стоимость пополнения и цену запроса нельзя смешивать в одну цифру без этих условий.
Где заканчивается этот расчёт
Профиль нагрузки мой, а не универсальный. При коротких сессиях, другой истории диалога или другом TTL доля чтений и записей может измениться. Тогда нужно заново подставить объёмы в формулу; обещать, что разрыв обязательно вырастет, оснований нет.
Для GPT выбран короткий ценовой диапазон. Если реальные запросы выходят за его пределы, их нужно считать отдельно, а не применять базовую ставку ко всем токенам. В расчёте нет самостоятельных расходов на инструменты и подписки, а также дополнительных расходов, которые могут появиться при ретраях или переключении маршрута.
Главный вывод этой части простой: ранжирую по ожидаемым расходам на одинаковый набор токенов — чем меньше сумма, тем выше место. LiteAI участвует с явно обозначенной оценкой по пакету, остальные шлюзы — с суммой расходов по отдельным категориям. Для моей нагрузки это полезнее сравнения одной цены ввода, но низкая расчётная стоимость ещё не означает минимальные реальные расходы на выполненную задачу.
Что дальше
В следующей части прогоню одинаковые задачи через выбранные шлюзы: сравню время до первого токена, долю ошибок при пяти параллельных запросах и фактические списания. Условия запуска и повторы опишу отдельно.
Счётчики токенов тоже сопоставлю с официальным API, но только как проверку учёта и поиск аномалий. Совпадение или расхождение счётчиков само по себе не доказывает, какая модель отвечала.
Кого добавить в следующую часть? Пишите в комментариях.
Короткие заметки и замеры между статьями — в канале Agent Field Notes.
Только зарегистрированные пользователи могут участвовать в опросе. Войдите, пожалуйста.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.