ESPN'This one hurts': How are Cowboys reacting to third straight 1-2 start?PunchAtiku faults FG over fresh $1.5bn World Bank loanThe Jerusalem PostLikud election candidate Bonzel says he wishes former hostage were 'returned to Hamas,' apologizesInquirerCamarines Sur placed under state of calamity over dengueESPN DeportesSemana 3 NFL: De la A a la Z, según el Gurú de las DiagonalesRadio TimesTop 10 Picks of the Day – Friday 2 OctoberScreen RantGod of War Laufey - Release Date, Preorders, Price, & PlatformsLa PresseAllégations de racisme au SPVM | Le dossier transmis au DPCPIl Sole 24 OreUstica, la Francia pronta a collaborare, pm verso ritiro archiviazioneسكاي نيوز عربيةمسؤول: محادثات أميركية إيرانية مرتقبة بوساطة قطريةFotogramas'Monstruo' recupera el vuelo en Netflix con una temporada 4 cautivadora, pero sigue lejos de la brillantez de 'Dahmer'SportstarVozinha, FIFA World Cup hero of Cape Verde, opens up consequences of fame after FWC 2026
The Daily Newsstand · Free, Always
Monday, September 28, 2026

Сколько стоит час работы кодинг-агента: рейтинг пяти API-шлюзов по расходам

Translate

После выхода Claude Opus 5.5 и GPT-6 Sol я пошёл сравнивать цены API-шлюзов с оплатой из России. И быстро упёрся в то, что строчка «ввод / вывод за миллион токенов» плохо объясняет будущий счёт. В моих сессиях Claude Code основная нагрузка приходится на кэш, а цены его чтения и записи приходится искать отдельно.

Поэтому я посчитал по-другому: сколько стоил бы один и тот же объём токенов у разных шлюзов. За основу взял среднюю нагрузку за час активной работы в Claude Code по своим логам.

Критерий рейтинга один: сколько денег уйдёт на одинаковый объём токенов за условный час. Чем меньше сумма, тем выше место. Для каждой модели — свой порядок: не по цене ввода и не по общему баллу за разные модели. LiteAI тоже участвует в сравнении, но его пакетную цену пересчитываю отдельно и отмечаю как оценку.

Это расчёт по указанным ниже ставкам, а не замер фактических списаний через каждый шлюз и не рейтинг качества. Стабильность, время до первого токена и реальные расходы на одинаковые задачи оставляю для следующих частей.

Откуда профиль нагрузки

Я выгрузил логи своих 49 рабочих сессий Claude Code за два месяца. Паузы длиннее получаса исключил, получилось 138 часов активной работы. Это исторический профиль моего использования, а не двухмесячный тест только что вышедших моделей.

В расчёте на один такой час:

Категория

Токенов за час

В миллионах

Чтение кэша

15 300 000

15,3

Запись в кэш

860 000

0,86

Вывод

51 000

0,051

Обычный, некэшированный ввод

560

0,00056

Чтений примерно в 18 раз больше, чем записей, и в 300 раз больше, чем вывода. Здесь важно не перепутать объём уникального текста с суммарным использованием: один и тот же контекст может учитываться при чтении кэша во многих запросах.

Категории в расчёте считаются отдельно: обычный ввод не включает токены, уже отнесённые к чтению или записи кэша. Поэтому одна и та же категория не оплачивается в формуле дважды. Здесь приведены агрегированные данные без полной выгрузки логов. По ним можно повторить расчёт расходов, но нельзя независимо проверить саму статистику нагрузки.

Кого сравниваю

В сравнении пять шлюзов: TeamoRouter, LiteAI, RouterAI, Polza AI и ProxyAPI. Для четырёх из них, кроме LiteAI, считаю расходы по отдельным ставкам четырёх категорий токенов для каждой модели. Это не полный обзор рынка и не утверждение, что все маршруты внутри каждого шлюза стоят одинаково.

LiteAI участвует в рейтинге с оценкой по пакету. У него пакетная покупка токенов, поэтому способ расчёта отличается: у остальных шлюзов умножаю объём каждой из четырёх категорий на её ставку и складываю результаты, а у LiteAI оцениваю весь объём по цене выбранного пакета. Для рейтинга беру пакет 100 млн токенов за 2 000 ₽ — это 20 ₽ за миллион. Это не безусловная базовая ставка и не самая низкая пакетная цена на странице. Другие пакеты посчитаны ниже.

В рейтинге Opus — все пять шлюзов. В рейтинге GPT — четыре шлюза с расчётной стоимостью и строка LiteAI без места. GPT-6 Sol в доступном перечне моделей LiteAI я не нашёл, поэтому расходы для него не рассчитываю. Это ограничение опубликованного каталога, а не результат проверки доступности через API.

Какие цены использую

Все ставки ниже — рубли за миллион токенов. Дата ценового сравнения — 28 сентября 2026 года. Долларовые цены переведены по курсу 84,34 ₽ за $1: это округлённое значение курса Банка России на 26 сентября — 84,3414 ₽.

Для воспроизводимости дальше считаю именно по числам, показанным в таблицах. Итог за час округляю один раз, до целого рубля. Это немного менее точно, чем расчёт по неокруглённым долларовым ставкам, зато читатель может повторить его без скрытых исходных данных.

Промокоды и индивидуальные договорные скидки не учитываю. Пакеты LiteAI и динамические скидки TeamoRouter отмечаю отдельно — их нельзя выдавать за одинаковый бессрочный базовый тариф.

Порядок шлюзов в таблицах ставок такой же, как в рейтингах ниже: от меньшей расчётной суммы за час к большей, а не по цене ввода. Официальные ставки стоят отдельно в конце таблиц как ориентир и не получают места среди шлюзов.

Claude Opus 5.5

Платформа

Ввод

Вывод

Чтение кэша

Запись кэша

TeamoRouter

86

432

4,3

108

LiteAI — пересчёт пакета

20

20

20

20

RouterAI

439

2 193

21,9

548

Polza AI

472

2 361

23,6

590

ProxyAPI

840

4 200

42

1 050

Официально — Anthropic, ориентир

337

1 687

16,9

422

Строка LiteAI — не четыре отдельно опубликованных тарифа. Для оценки применяю пакетную цену 20 ₽ за миллион ко всем четырём категориям. В частности, списание чтений и записей кэша из пакета один к одному ещё нужно подтвердить по фактическому биллингу.

Для строк Opus с раздельными тарифами выбран тариф записи с TTL 5 минут; пересчёт единого пакета LiteAI не означает, что у него отдельно подтверждена такая ставка записи. У Anthropic запись с TTL 1 час стоит дороже: $8 вместо $5 за миллион токенов. В моих сессиях использовался именно часовой кэш.

Я сохраняю объёмы чтения и записи из логов и меняю только ставку. Это не симуляция перехода на пятиминутный кэш: при другом TTL часть повторных обращений может потребовать новой записи. Поэтому табличный результат нельзя считать обещанием фактического счёта после смены настроек. Применимость пятиминутной ставки у каждого шлюза тоже требует подтверждения.

GPT-6 Sol — запросы до 272 тыс. входных токенов

Платформа

Ввод

Вывод

Чтение кэша

Запись кэша

TeamoRouter

29

145

2,9

36

Polza AI

118

590

11,8

148

RouterAI

219

1 096

21,9

274

ProxyAPI

420

2 100

42

525

LiteAI: модель не найдена, расчёта нет

—

—

—

—

Официально — OpenAI Standard, ориентир

169

843

16,9

211

Официально — OpenAI Flex, справочно

84,34

421,70

8,43

105,43

У GPT использую его собственные категории тарификации. Правило «пятиминутная запись» от Anthropic сюда не переношу. Профиль из Claude Code здесь нужен только как одинаковый набор объёмов: это не прогноз реального часа в Codex и не сравнение стоимости выполнения одной задачи разными моделями.

Не все ставки, маршруты и сроки действия цен удалось подтвердить в полном объёме. На некоторых открытых страницах указаны значения, отличающиеся от табличных. Поэтому результат относится именно к приведённым ставкам, а не гарантирует, что после пополнения будет действовать та же цена. Если режим обслуживания не подтверждён, не считаю его автоматически Standard.

Рейтинг по расходам: от меньшей суммы за час к большей

Место определяется только расчётной суммой: кто дешевле при одинаковом объёме токенов, тот выше. У Opus и GPT отдельные таблицы, потому что порядок шлюзов у них разный. Прямой официальный API — ценовой ориентир, а не участник рейтинга посредников.

Для шлюзов с раздельными тарифами формула такая:

C = 15,3 × Pчтение + 0,86 × Pзапись + 0,051 × Pвывод + 0,00056 × Pввод

Где C — рубли за условный час, а P — соответствующая ставка за миллион токенов. Например, для официальной строки Opus:

15,3 × 16,9 + 0,86 × 422 + 0,051 × 1687 + 0,00056 × 337 = 707,71572 ₽

После округления — 708 ₽. Для LiteAI вместо четырёх независимых ставок использую пересчёт пакета, пояснение — сразу под рейтингом.

Claude Opus 5.5: рейтинг расходов для пяти шлюзов

Место по расходам

Шлюз

Расчётные расходы, ₽/ч

К Anthropic

1

TeamoRouter

181

0,26×

2

LiteAI — оценка по пакету

≈324

≈0,46×

3

RouterAI

918

1,30×

4

Polza AI

989

1,40×

5

ProxyAPI

1 760

2,49×

Официальный ориентир, вне рейтинга: Anthropic — около 708 ₽/ч (1,00×).

У LiteAI другой способ расчёта: здесь приведена оценка по пакету. В рейтинге использован пакет 100 млн токенов за 2 000 ₽, то есть 20 ₽ за миллион. Складываю все четыре категории — получается 16,21156 млн токенов за час — и умножаю на единую пакетную цену:

C_LiteAI = (15,3 + 0,86 + 0,051 + 0,00056) × 20 = 324,2312 ₽ ≈ 324 ₽/ч

Предполагается, что чтения и записи кэша расходуют пакет один к одному; по фактическому биллингу это ещё не проверено. 324 ₽ — стоимость условно израсходованных токенов, а не минимальное пополнение и не обещание фактического списания. Другой пакет даст другую оценку; варианты приведены ниже.

GPT-6 Sol: рейтинг расходов при том же объёме токенов

Место по расходам

Шлюз

Расчётные расходы, ₽/ч

К OpenAI Standard

1

TeamoRouter

83

0,17×

2

Polza AI

338

0,70×

3

RouterAI

627

1,30×

4

ProxyAPI

1 201

2,49×

—

LiteAI: модель не найдена, место не присваивается

—

—

Официальные ориентиры, вне рейтинга: OpenAI Standard — около 483 ₽/ч (1,00×), OpenAI Flex — около 241 ₽/ч (0,50×). Flex — другой режим обслуживания, а не ещё один шлюз. Связь цены Polza с маршрутом openai/flex ещё требует подтверждения; считать условия всех строк одинаковыми нельзя.

Множители рассчитаны по неокруглённым итогам формулы, а не по округлённым рублям за час. Обе таблицы ранжируют только ожидаемые расходы при указанных ценах и фиксированном потреблении. Они не содержат оценки качества и не показывают уже измеренные фактические списания.

Как пакет LiteAI меняет оценку расходов

Для основного рейтинга выбран сценарий 20 ₽ за миллион с явной пометкой «оценка по пакету». На странице покупки есть и другие цены, в том числе 15 ₽ за миллион. Поэтому 324 ₽ — не универсальная стоимость и не минимальная оценка среди всех пакетов. Ниже — остальные варианты, чтобы можно было учесть свой объём покупки.

Пакет

Предоплата

₽ за 1 млн токенов

Opus, условные ₽/ч

1 млн токенов

30 ₽

30

486

10 млн токенов

300 ₽

30

486

100 млн токенов — в рейтинге

2 000 ₽

20

≈324

1 млрд токенов

15 000 ₽

15

243

Здесь сумма четырёх категорий составляет 16,21156 млн токенов за условный час. Умножаю её на пакетную ставку. Расчёт предполагает, что и чтения, и записи кэша списываются из пакета один к одному, как следует из заявленного единого тарифа. Это ещё нужно проверить по фактическому биллингу; пока результат условный.

Столбец «за час» — нормализованная стоимость расхода, а не минимальная сумма платежа. Например, одного пакета на 1 млн токенов для такого часа недостаточно. Неизрасходованный остаток большого пакета тоже не превращается автоматически в экономию.

Что получается из этих цифр

При этой нагрузке разброс ставок даёт почти десятикратную разницу. По ставкам из таблицы расчёт Opus составляет 181 ₽ у TeamoRouter и 1 760 ₽ у ProxyAPI — примерно 9,7 раза. Это условный результат для конкретных строк, а не доказательство одинаковой производительности или одинакового числа запросов при смене base_url.

У официальной строки Opus около половины суммы приходится на запись кэша. Из 708 ₽ это примерно 363 ₽; чтение — 259 ₽, вывод — 86 ₽, обычный ввод — меньше рубля. Записей около 5,3% от суммы входных категорий, но при выбранном тарифе запись примерно в 25 раз дороже чтения. Для моего профиля сравнивать только ввод и вывод действительно недостаточно.

Самая низкая цена ввода не даёт первого места по расходам. Для LiteAI при пакетной ставке 20 ₽ за миллион получается около 324 ₽/ч — второе место в рейтинге Opus, хотя ввод дешевле. Другие пакетные ставки дают около 486 ₽/ч и 243 ₽/ч; последняя оценка требует предоплаты 15 000 ₽. Место определяется расходами на весь набор токенов, но размер пакета и порог покупки тоже нужно учитывать.

Polza нужно сравнивать с подходящим официальным режимом. Принадлежность этой цены GPT-6 Sol к маршруту openai/flex ещё требует подтверждения. Если цена относится именно к нему, то 338 ₽ — около 70% от OpenAI Standard, но примерно 140% от стоимости официального Flex. Режим OpenAI Flex дешевле стандартного в обмен на более медленные ответы и возможную нехватку ресурсов. Измерять задержку буду отдельно; здесь важно не скрывать разницу условий.

Низкая цена TeamoRouter тоже требует пояснения. На сайте описаны динамические скидки, зависящие от стоимости апстрима, а среди причин низкой цены названы оптовые условия и временные субсидии. Это объяснение самого сервиса, а не независимое подтверждение одинаковых условий с прямым API. Точный маршрут, режим обслуживания, ставку записи кэша и условия скидки на момент сравнения я пока не подтвердил в полном объёме. Эту цену нельзя считать постоянным базовым тарифом.

Как пополнить баланс и что это меняет в цене

Шлюз

Способы пополнения

Что важно для сравнения

TeamoRouter

СБП, Т-Банк, Visa / Mastercard / «Мир», ЮMoney, SberPay

Баланс в USD; способы оплаты, курс рублёвого платежа, комиссия и минимум пока не подтверждены по каждому варианту

LiteAI

Карта, СБП

Цена токена зависит от размера пакета

RouterAI

Карты российских банков, СБП, счёт для юрлиц и ИП

Способы оплаты и применимость цены к выбранному маршруту пока не подтверждены полностью

Polza AI

Карта, СБП, расчётный счёт

Итоговые условия платежа и выбранный маршрут пока не подтверждены полностью

ProxyAPI

Карта, СБП, счёт для юрлиц

Способы оплаты, итоговая сумма и состав налогов пока не подтверждены полностью

Пересчёт долларового прайса по курсу ЦБ — только способ привести ставки к одной валюте. Он не означает, что пользователь пополнит баланс по тому же курсу. Фактическая рублёвая стоимость долларового баланса считается как «сколько рублей списано / сколько долларов зачислено», с учётом комиссии.

Таблицы выше — сравнение указанных ставок, а не проверенный расчёт полной суммы оплаты. Платёжные комиссии, фактический курс зачисления и налоговый состав отдельно не нормализованы. Рекламную скидку на токены, стоимость пополнения и цену запроса нельзя смешивать в одну цифру без этих условий.

Где заканчивается этот расчёт

Профиль нагрузки мой, а не универсальный. При коротких сессиях, другой истории диалога или другом TTL доля чтений и записей может измениться. Тогда нужно заново подставить объёмы в формулу; обещать, что разрыв обязательно вырастет, оснований нет.

Для GPT выбран короткий ценовой диапазон. Если реальные запросы выходят за его пределы, их нужно считать отдельно, а не применять базовую ставку ко всем токенам. В расчёте нет самостоятельных расходов на инструменты и подписки, а также дополнительных расходов, которые могут появиться при ретраях или переключении маршрута.

Главный вывод этой части простой: ранжирую по ожидаемым расходам на одинаковый набор токенов — чем меньше сумма, тем выше место. LiteAI участвует с явно обозначенной оценкой по пакету, остальные шлюзы — с суммой расходов по отдельным категориям. Для моей нагрузки это полезнее сравнения одной цены ввода, но низкая расчётная стоимость ещё не означает минимальные реальные расходы на выполненную задачу.

Что дальше

В следующей части прогоню одинаковые задачи через выбранные шлюзы: сравню время до первого токена, долю ошибок при пяти параллельных запросах и фактические списания. Условия запуска и повторы опишу отдельно.

Счётчики токенов тоже сопоставлю с официальным API, но только как проверку учёта и поиск аномалий. Совпадение или расхождение счётчиков само по себе не доказывает, какая модель отвечала.

Кого добавить в следующую часть? Пишите в комментариях.

Короткие заметки и замеры между статьями — в канале Agent Field Notes.

Только зарегистрированные пользователи могут участвовать в опросе. Войдите, пожалуйста.

View the original on Хабр →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.