Мой блог
Когда отменят ИИ-подписки? Считаем реальную стоимость токенов за $20
На первый взгляд тарифная сетка большинства ИИ-сервисов кажется предельно понятной и унифицированной. ChatGPT Plus, Claude Pro и Google AI Pro обходятся ровно в $20 за месяц, а более продвинутые тарифы линейно возрастают до $100 и $200. Казалось бы, пользователю достаточно найти в настройках точную цифру выделенных токенов и выбрать наиболее выгодную нейросеть. Однако попытка выяснить конкретный объем токенов внутри подписки быстро заходит в тупик.
Вместо четких лимитов провайдеры предлагают гибкие пятичасовые окна, динамические недельные потолки и абстрактные множители уровня 5x или 20x. Возникает закономерный вопрос: 5x от какого именно базового значения? В профильных сообществах обсуждают выкачку сотни миллионов токенов, а эксперты заявляют, что AI-гиганты работают себе в убыток, отдавая за $20 токенов на сотни долларов по прайсу API. При этом разработчики вводят жесткие ограничения: к примеру, Anthropic прямо запрещает использовать персональную подписку Claude Pro для сторонних коммерческих сервисов.



Чтобы выяснить, насколько щедры современные ИИ-подписки, сколько токенов мы получаем на самом деле и как долго сохранится эта экономическая аномалия, я детально изучил официальную документацию, сторонние исследования и провел собственные замеры на реальных задачах.
Что формально входит в тарифные планы за $20, $100 и $200
Для начала сравним официально декларируемые условия тарифных планов при помесячной оплате без учета скидок и налогов. В случае OpenAI рассматриваются лимиты Work/Codex, у Anthropic — тарифные планы Pro и Max, у Google — линейка Gemini Apps.

| Подписка | Цена в месяц | Объем включенных токенов | Ограничения по времени |
|---|---|---|---|
| ChatGPT Plus | $20 | Базовый лимит Work/Codex, меняется от модели | 5-часовое окно; недельный лимит |
| ChatGPT Pro 5x | $100 | 5x от объема Plus | 5-часовое окно; недельный лимит |
| ChatGPT Pro 20x | $200 | 20x от объема Plus | 5-часовое окно; недельный лимит |
| Claude Pro | $20 | Динамический лимит сессий | 5-часовое окно и недельный лимит |
| Claude Max 5x | $100 | 5x от объема Pro на сессию | 5-часовое окно и недельный лимит |
| Claude Max 20x | $200 | 20x от объема Pro на сессию | 5-часовое окно и недельный лимит |
| Google AI Pro | $19,99 | 4x от базовых лимитов Gemini | 5 часов до недельного лимита |
| Google AI Ultra 5x | $100 | 5x от объема AI Pro | 5 часов до недельного лимита |
| Google AI Ultra 20x | $200 | 20x от объема AI Pro | 5 часов до недельного лимита |
Ни один из поставщиков не называет точную месячную цифру токенов. Все операторы используют систему относительных коэффициентов. Определенным ориентиром служат лишь косвенные данные OpenAI по количеству сообщений Work/Codex за 5-часовой интервал: для модели GPT-6 Astra на подписке Plus доступно от 5 до 45 запросов, на Pro 5x — от 25 до 225, а на Pro 20x — от 100 до 900. Разброс внутри одного тарифа достигает почти порядка в зависимости от сложности задачи.
В экосистеме Claude условия еще сложнее. Использование передовых моделей Fable 5 и 5.1 на тарифе Pro расходует отдельный баланс кредитов с первого же запроса. В подписке Max они включены в пакет, но могут отнять не более 50% от суммарного недельного лимита, после чего система потребует доплату либо переключит на более простую модель.
Сколько токенов мы получаем на самом деле: реальные замеры
Публичные пользовательские тесты дают гораздо больше практической информации. При подробном аудите работы в Codex один развернутый запрос трансформировался в 11 внутренних вызовов нейросети общей емкостью 447 699 токенов. За сутки работы автор расходовал 118,16 млн токенов, истощив 71% недельной квоты ChatGPT Plus. Важная деталь: 97,3% входивших токенов были прочитаны из кэша, то есть речь идет о повторном считывании контекста, а не о генерации нового текста.

При пересчете измеренных недельных объемов в эквивалентную стоимость прямых вызовов через API получаются следующие данные:
| Тариф и модель | Месячный объем обработанных токенов | Стоимость по API-прайсу | Выгода подписки к API |
|---|---|---|---|
| Codex / ChatGPT Plus (GPT-5.5) | ~250M токенов | $536 | В 26,8 раза дешевле API |
| Claude Pro (Opus 4.7) | ~26,9M токенов | $152 | В 7,6 раза дешевле API |
Оба тарифных плана стоят ровно по $20 в месяц, однако подписка ChatGPT Plus перекрывает затраты на API почти в 27 раз, тогда как Claude Pro — примерно в 8 раз. Исследование Best Value AI подтверждает эту тенденцию: подписка Plus на GPT-5.4 дает порядка 190 млн токенов в неделю (~760 млн в месяц), а Claude Pro на Opus 4.7 — лишь 15,6 млн токенов в неделю (~62,4 млн в месяц). При полном выедании лимитов 1 миллион токенов обходится в 2,6 цента у OpenAI против 32 центов у Anthropic. Разница в наполнении за одни и те же деньги оказывается двенадцатикратной.
Electricity Bench: сравниваем подписки по реальным задачам
Оценивать подписки исключительно по объему токенов некорректно, ведь главный показатель для пользователя — решенные задачи. Наиболее полезным инструментом для сравнения я считаю бенчмарк Electricity Bench. В нем на модель натравливают автономных агентов для решения реальных задач разработки и замеряют количество успехов, затраченное время и расход лимита подписки.

Рассмотрим результаты тестирования на сете задач real-world issues v3 (15 комплексных программистских тасков):
| Модель и инструментарий | Тариф подписки | Успешно решено задач | Медианное время на задачу | Расход недельного лимита |
|---|---|---|---|---|
| GPT-6 Astra (Codex CLI) | Pro 5x ($100) | 10 из 15 | 2 мин 18 сек | 4,0% |
| Claude Fable 5.1 (Claude Code) | Max 20x ($200) | 13 из 15 | 2 мин 02 сек | 4,0% |
| Gemini 3.8 Flash (Antigravity CLI) | AI Pro ($19,99) | 13 из 15 | 5 мин 42 сек | 21,6% |
Показательный момент: Gemini на базовом тарифе за $20 решил столько же практических задач, сколько Fable на топовой подписке за $200, хотя затратил на выполнение почти в три раза больше времени. Модель Astra оказалась быстрой, но уступила по точности решения багов.
Как кэширование контекста экономит лимиты и деньги
При регулярном взаимодействии с нейросетью ключевую роль начинает играть кэширование контекста (Prompt Caching). Если вы загрузили большой справочный документ и задаете по нему вопросы, сам документ фиксируется в кэше и не оплачивается как новый ввод.
Аналогично при работе агента в репозитории кода: системные инструкции и ранее прочитанный код сохраняются в KV-кэше на сервере. Сравним стоимость API-запроса при объеме 100 000 входных токенов и 1 000 выходных токенов без кэша и с его использованием:
| Модель | Первичный запрос (100K input + 1K output) | Повторный запрос из кэша (100K cached + 1K output) |
|---|---|---|
| GPT-6 Astra | $1,05 | $0,15 |
| Claude Fable 5.1 | $1,05 | $0,075 |
| Gemini 3.8 Flash | ~$0,079 | ~$0,011 |
У Fable 5.1 повторное чтение из кэша обходится вдвое дешевле, чем у Astra ($0,25 против $1,00 за миллион токенов), хотя базовый ввод и генерация стоят одинаково. Gemini демонстрирует самые низкие расценки во всех режимах.
Время жизни кэша существенно разнится по провайдерам:

- Astra: кэш сохраняет актуальность минимум 30 минут с момента создания или последнего обращения. Это удобно при работе с паузами.
- Claude: стандартный кэш хранится всего 5 минут. Для работы часового кэша требуется специальный режим с повышенной стоимостью записи.
- Gemini: автоматический кэш включен по умолчанию, а чтение повторных данных стоит минимальных денег.
Как показали исследования Microsoft на базе Copilot, попадание в KV-кэш внутри непрерывной сессии агента составляет около 90%, но при паузах и переключениях контекста между шагами снижается до 55%. Чем больше пауз делает пользователь, тем быстрее расходуется лимит подписки.
Получается, ИИ-компании работают себе в минус?
На наиболее активных пользователях ИИ-сервисы действительно теряют маржу. По данным финансовых отчетов за 2025 год, на один доллар полученной выручки OpenAI расходовала порядка $2,60, а Anthropic — $2,16. Впрочем, Anthropic уже заявляет о скором выходе на операционную прибыльность.
Причина такой щедрости проста: IT-гиганты субсидируют подписки ради агрессивного захвата рынка, приучая пользователей и разработчиков к своим экосистемам и агентам. Когда привычка сформирована, а процессы встроены в нейросеть, вендоры начнут планомерно повышать тарифы или закручивать лимиты.
Когда отменят выгодные подписки?
Разработчики нейросетей уже ищут баланс между подписками и API. Anthropic проводила эксперименты по отключению Claude Code в базовых тарифных планах Pro для части новых регистраций. Для ресурсоемких моделей вводятся отдельные лимиты кредитов, а OpenAI и Google активно внедряют системы докупки AI Credits.
В ближайшем будущем базовые тарифные планы за $20 сохранятся для обычных текстовых диалогов и повседневной рутины. Однако специализированные тарифы 5x и 20x для кодинга и работы автономных агентов либо ощутимо подорожают, либо будут полностью переведены на покейсовую оплату за фактически израсходованные токены.
Практическая проверка расходов: утилита ccusage
Чтобы не гадать о затратах, я рекомендую использовать консольную утилиту ccusage. Она анализирует локальные логи сессий ИИ-агентов и вычисляет точный расход токенов с их стоимостью по текущему API-прайсу. Для запуска достаточно выполнить команду:
npx ccusage@latest codex session
Я проверил три задачи разного масштаба на подписке ChatGPT Pro 20x:
| Задача | Модель / reasoning | Время агента | API-эквивалент | Доступно запусков в неделю (оценка) | Результат |
|---|---|---|---|---|---|
| Масштабирование voice assistant | Astra / medium → high | >12 часов | ~$365 | 1–2 запуска | Модель не справилась |
| Оцифровка шахматного репертуара (40+ фото) | Sol / xhigh | ~11 часов | ~$170 | ~8 запусков | Репертуар оцифрован |
| План миграции промптов и Python-скрипт | Sol / high | ~19 минут | ~$4,48 | ~300 запусков | Скрипт готов, тесты прошли |
Замеры наглядно показывают реальность: одна сложная задача на Astra high способна выесть почти весь недельный лимит тарифа 20x за $200. В то же время небольшие, хорошо спроектированные сценарии миграции или генерации скриптов расходуют копейки и могут выполняться сотнями за ту же стоимость.
Выводы и рекомендации
Сейчас наступил наиболее выгодный период для тестирования персональных ИИ-подписок за $20. Я советую активно проверять различные сервисы на своих реальных рабочих задачах, отслеживать фактический расход токенов через ccusage и выбирать оптимальный инструмент, пока вендоры продолжают субсидировать тарифные планы.
Источник: habr.com
