Загрузка 0
ПОДЕЛИТЬСЯ

Мой блог

Листай вниз

Когда отменят ИИ-подписки? Считаем реальную стоимость токенов за $20

Когда отменят ИИ-подписки? Считаем реальную стоимость токенов за $20

На первый взгляд тарифная сетка большинства ИИ-сервисов кажется предельно понятной и унифицированной. ChatGPT Plus, Claude Pro и Google AI Pro обходятся ровно в $20 за месяц, а более продвинутые тарифы линейно возрастают до $100 и $200. Казалось бы, пользователю достаточно найти в настройках точную цифру выделенных токенов и выбрать наиболее выгодную нейросеть. Однако попытка выяснить конкретный объем токенов внутри подписки быстро заходит в тупик.

Вместо четких лимитов провайдеры предлагают гибкие пятичасовые окна, динамические недельные потолки и абстрактные множители уровня 5x или 20x. Возникает закономерный вопрос: 5x от какого именно базового значения? В профильных сообществах обсуждают выкачку сотни миллионов токенов, а эксперты заявляют, что AI-гиганты работают себе в убыток, отдавая за $20 токенов на сотни долларов по прайсу API. При этом разработчики вводят жесткие ограничения: к примеру, Anthropic прямо запрещает использовать персональную подписку Claude Pro для сторонних коммерческих сервисов.

Интерфейс утилиты ccusage в консоли разработчика
Вывод статистики израсходованных токенов и их API-стоимости в утилите ccusage.
Схема сохранения KV-кэша контекста при запросах к ИИ
Иллюстрация повторного использования токенов из кэша в диалогах с нейросетью.
Процесс решения задач программирования ИИ-агентом
Автономное исправление багов и выполнение коммитов ИИ-агентом в репозитории.
Сравнительная диаграмма расходов подписки и API
Соотношение затрат при покупке фиксированной подписки за $20 и прямой оплате API.

Чтобы выяснить, насколько щедры современные ИИ-подписки, сколько токенов мы получаем на самом деле и как долго сохранится эта экономическая аномалия, я детально изучил официальную документацию, сторонние исследования и провел собственные замеры на реальных задачах.

Реклама

Что формально входит в тарифные планы за $20, $100 и $200

Для начала сравним официально декларируемые условия тарифных планов при помесячной оплате без учета скидок и налогов. В случае OpenAI рассматриваются лимиты Work/Codex, у Anthropic — тарифные планы Pro и Max, у Google — линейка Gemini Apps.

Таблица тарифных планов OpenAI, Anthropic и Google AI
Сводная таблица формальных лимитов и временных окон в тарифных планах за $20, $100 и $200.
Подписка Цена в месяц Объем включенных токенов Ограничения по времени
ChatGPT Plus $20 Базовый лимит Work/Codex, меняется от модели 5-часовое окно; недельный лимит
ChatGPT Pro 5x $100 5x от объема Plus 5-часовое окно; недельный лимит
ChatGPT Pro 20x $200 20x от объема Plus 5-часовое окно; недельный лимит
Claude Pro $20 Динамический лимит сессий 5-часовое окно и недельный лимит
Claude Max 5x $100 5x от объема Pro на сессию 5-часовое окно и недельный лимит
Claude Max 20x $200 20x от объема Pro на сессию 5-часовое окно и недельный лимит
Google AI Pro $19,99 4x от базовых лимитов Gemini 5 часов до недельного лимита
Google AI Ultra 5x $100 5x от объема AI Pro 5 часов до недельного лимита
Google AI Ultra 20x $200 20x от объема AI Pro 5 часов до недельного лимита

Ни один из поставщиков не называет точную месячную цифру токенов. Все операторы используют систему относительных коэффициентов. Определенным ориентиром служат лишь косвенные данные OpenAI по количеству сообщений Work/Codex за 5-часовой интервал: для модели GPT-6 Astra на подписке Plus доступно от 5 до 45 запросов, на Pro 5x — от 25 до 225, а на Pro 20x — от 100 до 900. Разброс внутри одного тарифа достигает почти порядка в зависимости от сложности задачи.

В экосистеме Claude условия еще сложнее. Использование передовых моделей Fable 5 и 5.1 на тарифе Pro расходует отдельный баланс кредитов с первого же запроса. В подписке Max они включены в пакет, но могут отнять не более 50% от суммарного недельного лимита, после чего система потребует доплату либо переключит на более простую модель.

Сколько токенов мы получаем на самом деле: реальные замеры

Публичные пользовательские тесты дают гораздо больше практической информации. При подробном аудите работы в Codex один развернутый запрос трансформировался в 11 внутренних вызовов нейросети общей емкостью 447 699 токенов. За сутки работы автор расходовал 118,16 млн токенов, истощив 71% недельной квоты ChatGPT Plus. Важная деталь: 97,3% входивших токенов были прочитаны из кэша, то есть речь идет о повторном считывании контекста, а не о генерации нового текста.

Реклама
Карточка результатов модели GPT-6 Astra в Electricity Bench
Показатели точности решения задач и расхода недельного лимита моделью GPT-6 Astra.

При пересчете измеренных недельных объемов в эквивалентную стоимость прямых вызовов через API получаются следующие данные:

Тариф и модель Месячный объем обработанных токенов Стоимость по API-прайсу Выгода подписки к API
Codex / ChatGPT Plus (GPT-5.5) ~250M токенов $536 В 26,8 раза дешевле API
Claude Pro (Opus 4.7) ~26,9M токенов $152 В 7,6 раза дешевле API

Оба тарифных плана стоят ровно по $20 в месяц, однако подписка ChatGPT Plus перекрывает затраты на API почти в 27 раз, тогда как Claude Pro — примерно в 8 раз. Исследование Best Value AI подтверждает эту тенденцию: подписка Plus на GPT-5.4 дает порядка 190 млн токенов в неделю (~760 млн в месяц), а Claude Pro на Opus 4.7 — лишь 15,6 млн токенов в неделю (~62,4 млн в месяц). При полном выедании лимитов 1 миллион токенов обходится в 2,6 цента у OpenAI против 32 центов у Anthropic. Разница в наполнении за одни и те же деньги оказывается двенадцатикратной.

Electricity Bench: сравниваем подписки по реальным задачам

Оценивать подписки исключительно по объему токенов некорректно, ведь главный показатель для пользователя — решенные задачи. Наиболее полезным инструментом для сравнения я считаю бенчмарк Electricity Bench. В нем на модель натравливают автономных агентов для решения реальных задач разработки и замеряют количество успехов, затраченное время и расход лимита подписки.

График финансовой отчетности OpenAI по выручке и расходам
Динамика соотношения доходов и затрат OpenAI на обработку запросов пользователей.

Рассмотрим результаты тестирования на сете задач real-world issues v3 (15 комплексных программистских тасков):

Модель и инструментарий Тариф подписки Успешно решено задач Медианное время на задачу Расход недельного лимита
GPT-6 Astra (Codex CLI) Pro 5x ($100) 10 из 15 2 мин 18 сек 4,0%
Claude Fable 5.1 (Claude Code) Max 20x ($200) 13 из 15 2 мин 02 сек 4,0%
Gemini 3.8 Flash (Antigravity CLI) AI Pro ($19,99) 13 из 15 5 мин 42 сек 21,6%

Показательный момент: Gemini на базовом тарифе за $20 решил столько же практических задач, сколько Fable на топовой подписке за $200, хотя затратил на выполнение почти в три раза больше времени. Модель Astra оказалась быстрой, но уступила по точности решения багов.

Как кэширование контекста экономит лимиты и деньги

При регулярном взаимодействии с нейросетью ключевую роль начинает играть кэширование контекста (Prompt Caching). Если вы загрузили большой справочный документ и задаете по нему вопросы, сам документ фиксируется в кэше и не оплачивается как новый ввод.

Аналогично при работе агента в репозитории кода: системные инструкции и ранее прочитанный код сохраняются в KV-кэше на сервере. Сравним стоимость API-запроса при объеме 100 000 входных токенов и 1 000 выходных токенов без кэша и с его использованием:

Реклама
Модель Первичный запрос (100K input + 1K output) Повторный запрос из кэша (100K cached + 1K output)
GPT-6 Astra $1,05 $0,15
Claude Fable 5.1 $1,05 $0,075
Gemini 3.8 Flash ~$0,079 ~$0,011

У Fable 5.1 повторное чтение из кэша обходится вдвое дешевле, чем у Astra ($0,25 против $1,00 за миллион токенов), хотя базовый ввод и генерация стоят одинаково. Gemini демонстрирует самые низкие расценки во всех режимах.

Время жизни кэша существенно разнится по провайдерам:

Тетрадь с рукописным шахматным репертуаром для оцифровки
Страница рукописного репертуара, используемая в качестве сложного визуального теста для ИИ-агента.
  • Astra: кэш сохраняет актуальность минимум 30 минут с момента создания или последнего обращения. Это удобно при работе с паузами.
  • Claude: стандартный кэш хранится всего 5 минут. Для работы часового кэша требуется специальный режим с повышенной стоимостью записи.
  • Gemini: автоматический кэш включен по умолчанию, а чтение повторных данных стоит минимальных денег.

Как показали исследования Microsoft на базе Copilot, попадание в KV-кэш внутри непрерывной сессии агента составляет около 90%, но при паузах и переключениях контекста между шагами снижается до 55%. Чем больше пауз делает пользователь, тем быстрее расходуется лимит подписки.

Получается, ИИ-компании работают себе в минус?

На наиболее активных пользователях ИИ-сервисы действительно теряют маржу. По данным финансовых отчетов за 2025 год, на один доллар полученной выручки OpenAI расходовала порядка $2,60, а Anthropic — $2,16. Впрочем, Anthropic уже заявляет о скором выходе на операционную прибыльность.

Причина такой щедрости проста: IT-гиганты субсидируют подписки ради агрессивного захвата рынка, приучая пользователей и разработчиков к своим экосистемам и агентам. Когда привычка сформирована, а процессы встроены в нейросеть, вендоры начнут планомерно повышать тарифы или закручивать лимиты.

Когда отменят выгодные подписки?

Разработчики нейросетей уже ищут баланс между подписками и API. Anthropic проводила эксперименты по отключению Claude Code в базовых тарифных планах Pro для части новых регистраций. Для ресурсоемких моделей вводятся отдельные лимиты кредитов, а OpenAI и Google активно внедряют системы докупки AI Credits.

В ближайшем будущем базовые тарифные планы за $20 сохранятся для обычных текстовых диалогов и повседневной рутины. Однако специализированные тарифы 5x и 20x для кодинга и работы автономных агентов либо ощутимо подорожают, либо будут полностью переведены на покейсовую оплату за фактически израсходованные токены.

Практическая проверка расходов: утилита ccusage

Чтобы не гадать о затратах, я рекомендую использовать консольную утилиту ccusage. Она анализирует локальные логи сессий ИИ-агентов и вычисляет точный расход токенов с их стоимостью по текущему API-прайсу. Для запуска достаточно выполнить команду:

npx ccusage@latest codex session

Я проверил три задачи разного масштаба на подписке ChatGPT Pro 20x:

Задача Модель / reasoning Время агента API-эквивалент Доступно запусков в неделю (оценка) Результат
Масштабирование voice assistant Astra / medium → high >12 часов ~$365 1–2 запуска Модель не справилась
Оцифровка шахматного репертуара (40+ фото) Sol / xhigh ~11 часов ~$170 ~8 запусков Репертуар оцифрован
План миграции промптов и Python-скрипт Sol / high ~19 минут ~$4,48 ~300 запусков Скрипт готов, тесты прошли

Замеры наглядно показывают реальность: одна сложная задача на Astra high способна выесть почти весь недельный лимит тарифа 20x за $200. В то же время небольшие, хорошо спроектированные сценарии миграции или генерации скриптов расходуют копейки и могут выполняться сотнями за ту же стоимость.

Выводы и рекомендации

Сейчас наступил наиболее выгодный период для тестирования персональных ИИ-подписок за $20. Я советую активно проверять различные сервисы на своих реальных рабочих задачах, отслеживать фактический расход токенов через ccusage и выбирать оптимальный инструмент, пока вендоры продолжают субсидировать тарифные планы.

Источник: habr.com

01.