Загрузка 0
ПОДЕЛИТЬСЯ

Мой блог

Листай вниз

Anthropic выпустила Claude Haiku 5.5: компактная модель с окном в 1 миллион токенов

Anthropic выпустила Claude Haiku 5.5: компактная модель с окном в 1 миллион токенов

Компания Anthropic официально представила Claude Haiku 5.5 — свою самую быструю и экономичную компактную модель на текущий момент. Релиз ориентирован на массовые рутинные задачи, такие как автоматическое составление резюме, сжатие текстов, классификация данных и выполнение вспомогательных подзадач, требующих высокой производительности.

Новинка сохраняет впечатляющее окно контекста размером в 1 миллион токенов и способна выдавать до 128 тысяч выходных токенов за раз. Базовая стоимость использования модели составляет всего $0.10 за миллион входящих токенов и $0.50 за миллион исходящих, что делает её доступным инструментом для масштабируемых проектов в различных сферах разработки и анализа данных, включая ценовую гонку ведущих разработчиков ИИ.

Что вошло в релиз Claude Haiku 5.5

Модель Haiku 5.5 стала первой в линейке Haiku, получившей настраиваемый параметр интенсивности работы. Функция адаптивного мышления здесь активирована по умолчанию, а значение параметра effort установлено на среднем уровне. Архитектура поддерживает обработку текста и изображений с выдачей текстового ответа, а актуальная база знаний ограничена июнем 2026 года. Для пакетных заданий в бета-режиме предусмотрена поддержка генерации до 300 тысяч выходных токенов.

Реклама

При интеграции необходимо учитывать важные технические особенности. Установка нестандартных значений параметров temperature, top_p или top_k приводит к ошибке 400. Кроме того, новый токенизатор учитывает аналогичный объем текста примерно на 30% дороже по сравнению с предыдущей версией Haiku 4.5. Подробные инструкции по переходу описаны в официальном руководстве.

Двухуровневая структура ценообразования

Тарифная сетка модели разделена на две категории по границе в 100 тысяч токенов промпта. Для запросов до 100K стоимость ввода составляет $0.10, а вывода — $0.50 за миллион токенов. Чтение из кэша оценивается в $0.01, а пятиминутная запись в кэш — в $0.125. При превышении порога в 100 тысяч токенов расценки возрастают до $0.50 за ввод и $2.50 за вывод.

Для сравнения, предыдущее поколение Haiku 4.5 обходилось в $1 за ввод и $5 за вывод. Согласно расчетам компании, около 90% запросов к Haiku 4.5 укладывались в лимит 100K токенов. С учетом особенностей нового токенизатора разработчики оценивают общее снижение затрат на Haiku 5.5 примерно в 75%, а запуск пакетной обработки сокращает расходы еще вдвое.

Сравнительные бенчмарки и производительность

По данным официальной системной карты, предоставленным разработчиками, модель демонстрирует следующие результаты в тестовых средах:

  • OSWorld 2.1 (офлайн-подмножество): 72.4% (для сравнения, у GPT-6 Luna показатель составляет 48.9%, а у Haiku 4.5 — 15.7%).
  • Terminal-Bench 4.0: 39.2% (против 16.4% у Luna и 0.0% у прошлой версии).
  • FrontierCode 1.1 (основной): 46.4% против 42.4% у конкурента.
  • Humanity’s Last Exam: 45.9% без использования инструментов и 57.4% с ними.
  • GDPval-AA v2.1: 1620 баллов против 1437 у Luna и 735 у Haiku 4.5.

При этом старшая модель Sonnet 5.5 удерживает лидерство по всем направлениям, включая 70.6% в тесте Terminal-Bench 4.0, поэтому для сложных задач агентского программирования создатели по-прежнему рекомендуют использовать Sonnet 5.5 и Opus 5.5.

Основные сценарии применения

Эксперты выделяют три ключевых направления, в которых новая модель проявляет себя наиболее эффективно:

  • Вспомогательные подзадачи (subagents) под управлением флагманских решений Opus 5.5 или Sonnet 5.5. Например, в финансовых сервисах вроде Rogo компактная модель извлекает конкретные финансовые показатели, пока более крупная система формирует презентацию.
  • Массовый анализ документов и генерация кратких выдержек в системах с огромным ежедневным потоком запросов.
  • Задачи, чувствительные к скорости отклика, включая интерактивную поддержку клиентов и автоматизацию действий в браузере.

Сравнение с ближайшими конкурентами

На рынке аналогичных решений Haiku 5.5 сопоставима с моделью GPT-6 Luna по базовой стоимости коротких контекстов. Стоимость кэш-чтения у них одинакова и составляет $0.01 за миллион токенов, а максимальный объем контекстного окна достигает одного миллиона токенов с поддержкой выдачи до 128 тысяч выходных токенов. Доступность модели обеспечена на ведущих облачных платформах, включая Amazon Bedrock, Google Cloud, Microsoft Foundry и AWS.

01.