Загрузка 0
ПОДЕЛИТЬСЯ

Мой блог

Листай вниз

ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic

ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic

Сентябрь ознаменовался масштабной гонкой цен на рынке искусственного интеллекта, когда ведущие разработчики начали снижать расценки на фоне растущих затрат на физическое железо. Индустрия ИИ переживает период парадоксальных перемен: пока розничная оперативная память и аренда графических ускорителей продолжают расти в цене, стоимость обработки запросов через API стремительно падает за счет инженерных оптимизаций и финансовых стратегий разработчиков.

Анализ рыночных тенденций показывает, что снижение цен обеспечивается не альтруизмом технологических гигантов, а внедрением новых механизмов кэширования, сжатия KV-кэша и агрессивной борьбой за долю рынка перед грядущими выходами на биржу.

Пример обнаружения тандемного повтора в последовательности ДНК ИИ-агентом
Работа ИИ-агента с сырыми данными ДНК в биологическом эксперименте.
ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic
ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic
ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic
ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic
ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic
ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic
ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic
ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic
ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic

Anthropic и OpenAI снизили цены с разницей в полуторачасовом окне

Индустрия зафиксировала синхронное падение тарифов, когда ключевые игроки рынка представили обновленные линейки решений. Первой обновила прайсы компания Anthropic со своими флагманскими продуктами, а спустя непродолжительное время ответные релизы показали разработчики из OpenAI, пересмотрев стоимость использования языковых моделей в сторону уменьшения.

Реклама
График точности Terminal-Bench 4.0 и стоимости попытки для Opus 5.5 и конкурентов
Соотношение точности в Terminal-Bench 4.0 и стоимости одной попытки для различных моделей.

Claude Opus 5.5 — удешевление на 20% и неизменяемый режим рассуждений

В модели Claude Opus 5.5 стоимость миллиона входных токенов составила 4 доллара, а выходных — 20 долларов, что ниже показателей предшествующего поколения. Более существенно сократилась стоимость чтения из кэша, составив 0,20 доллара за миллион токенов. При этом разработчики отмечают важную особенность миграции: режим внутреннего мышления (thinking) в новой версии отключить нельзя, а глубина рассуждений регулируется исключительно параметром effort, что требует адаптации существующих кодовых баз и агентских интеграций.

GPT-6 Sol и Luna — двукратное сокращение прайса

Компания OpenAI ответила выпуском моделей GPT-6 Sol и Luna с ценниками в 2 и 10 долларов за миллион токенов соответственно. Главным технологическим нововведением стал запуск глубокого кэширования со скидками до 90–95% на входные кэшированные данные. Данный инструмент позволяет существенно оптимизировать затраты при работе с длинными контекстами, сохраняя при этом гибкость настройки параметров генерации на лету.

Дашборд кэширования GPT-6 с показателями hit rate и динамикой входных токенов
Метрики кэширования GPT-6: показатели hit rate и состав входных токенов.

Sonnet 5.5 — превосходство младшей линейки над флагманами

Выпущенная в конце сентября модель Sonnet 5.5 пополнила продуктовую линейку Anthropic, продемонстрировав более высокую точность на профильных бенчмарках по сравнению с ранее вышедшей Opus 5.5 при аналогичной стоимости за миллион токенов. Подобные релизы показывают, что эффективность современных архитектур растет быстрее номинального падения прайсов.

Реклама

Ключевые выводы по экономике моделей

Эксперты рынка подчеркивают, что прямая оценка стоимости по прайсу за миллион токенов теряет актуальность. Реальные затраты на решение прикладных задач снижаются значительно сильнее за счет эффективного кэширования и сокращения общего объема генерируемого текста. При этом разнообразие методологий тестирования в различных бенчмарках усложняет прямое сопоставление производительности разных версий ПО.

ИИ дешевеет, а ваш компьютер дорожает: гонка цен OpenAI и Anthropic
Прогноз S&P Global: скорректированный долг шести крупнейших гиперскейлеров с учетом аренды и долгосрочных контрактов на электроэнергию. Источник .

Кто оплачивает удешевление: инвестиции и финансовые обязательства

Снижение стоимости API на фоне дорожающего оборудования требует серьезных финансовых вливаний и приводит к накоплению рекордных долговых обязательств у инфраструктурных провайдеров и разработчиков моделей.

Финансовая модель и обязательства Anthropic

Опубликованные данные из проспекта Anthropic к планируемому первичному размещению акций раскрывают масштаб затрат компании. При стремительном росте выручки операционные убытки и обязательства перед поставщиками облачных вычислений исчисляются сотнями миллиардов долларов. Агрессивная ценовая политика на данном этапе направлена на захват рынка, в то время как покрытие расходов отложено на будущие периоды.

Прогноз скорректированного долга гиперскейлеров по версии S&P Global
Финансовый прогноз S&P Global: оценка обязательств крупнейших гиперскейлеров.

Масштабные раунды финансирования OpenAI

Конкуренты из OpenAI также ведут переговоры о привлечении рекордного капитала при оценках бизнеса, превышающих триллион долларов. Финансовая поддержка инвесторов позволяет удерживать демпинговые цены на инфраструктуру и сервисы, поддерживая темпы экспансии.

Нагрузка на поставщиков оборудования и кредиторов

Аналитические отчеты финансовых агентств указывают на растущую нагрузку на дата-центры и гиперскейлеров, которые вкладывают триллионы долларов в строительство инфраструктуры под искусственный интеллект. Подобные темпы капитальных затрат делают текущие тарифы на API временным явлением периода рыночной борьбы.

Реклама
Результаты тестов Gray Swan на устойчивость к промпт-инъекциям
Вероятность успешной косвенной промпт-инъекции по результатам тестов Gray Swan.

GPT-6 Astra и жесткий контроль доступа

Новейшие флагманские разработки компании OpenAI распространяются по принципу контролируемого допуска. Модель Astra получила высший уровень классификации кибербезопасности Critical, из-за чего ее возможности по генерации критического кода и потенциальных эксплойтов жестко ограничены на уровне публичных интерфейсов в целях предотвращения рисков.

Открытые веса: прорыв DeepSeek и стратегии Xiaomi

Сегмент открытых моделей продолжает развиваться за счет глубокой оптимизации архитектур и систем хранения контекста. Выход моделей с инновационными методами компрессии KV-кэша позволяет существенно снизить требования к видеопамяти графических ускорителей.

Размер KV-кэша на токен у разных поколений моделей DeepSeek
Сравнение объема KV-кэша на один токен в поколениях моделей DeepSeek.

DeepSeek V4.1-Flash и оптимизация памяти

Модель DeepSeek V4.1-Flash применила хранение KV-кэша в формате FP4, сократив требования к аппаратным ресурсам. Подобные технические решения вызвали заметные колебания на фондовых рынках производителей памяти, поскольку инвесторы переоценивают будущий спрос на чипы HBM со стороны разработчиков ПО.

Семейство Xiaomi MiMo-V2.6

Компания Xiaomi представила семейство мультимодальных моделей под открытой лицензией, заняв свободные ценовые ниши и продемонстрировав высокие показатели в независимых аналитических рейтингах.

Индекс Artificial Analysis для открытых моделей с MiMo-V2.6-Pro на первом месте
Позиции открытых моделей в актуальном индексе Artificial Analysis.

Инфраструктурные изменения и обновление софта

Плотный график релизов инфраструктурных инструментов в сентябре принес множество критических изменений для разработчиков, обновляющих стеки машинного обучения.

Обновления библиотек PyTorch и vLLM

Выход новых версий PyTorch и движка vLLM добавил оптимизированные ядра под актуальные архитектуры графических ускорителей, одновременно удалив устаревшие программные интерфейсы и потребовав от инженерных команд адаптации кода.

Сравнение архитектур Vera Rubin NVL72 и GB300 на бенчмарке AgentX
Тестирование производительности стоек Vera Rubin NVL72 и GB300.

Эффективность фреймворка SGLang

Особое внимание разработчиков привлек релиз SGLang версии 0.5.20, который за счет улучшенного кэширования точек ветвления в radix-кэше демонстрирует значительный рост процента попаданий в кэш и снижение времени генерации первого токена при работе с открытыми моделями.

Автономные агенты в научных исследованиях

Практическое применение дешевеющих вычислительных мощностей демонстрируют многочасовые прогоны агентских систем. Масштабные эксперименты позволяют ИИ-агентам анализировать сырые массивы данных и находить ранее не описанные биологические структуры, хотя верификация полученных гипотез по-прежнему требует участия профильных специалистов-людей.

Индекс розничных цен на оперативную память стандарта DDR5
Динамика розничных цен на модули оперативной памяти.

Регуляторные инициативы и суверенные модели

Изменения затронули и юридическую плоскость: вступление в силу новых законов об искусственном интеллекте в ряде регионов стимулирует переход корпоративного сектора и государственных структур на использование суверенных фундаментальных моделей, соответствующих локальным требованиям безопасности.

Заключение

Текущая ситуация на рынке демонстрирует разрыв между реальной стоимостью оборудования и ценой программных токенов для конечного пользователя. Инженерные оптимизации кэширования и временные инвестиционные стратегии создают выгодные условия для разработки приложений, однако долгосрочная экономика проектов требует точного расчета стоимости решения конкретных задач, а не слепого доверия к базовым тарифам за миллион токенов.

01.