Загрузка 0
ПОДЕЛИТЬСЯ

Мой блог

Листай вниз

Anthropic представила модели Claude Fable 5.1 и Mythos 5.1 с разделением систем безопасности

Anthropic представила модели Claude Fable 5.1 и Mythos 5.1 с разделением систем безопасности

1 сентября 2026 года компания Anthropic объявила о выпуске двух новых конфигураций своей флагманской языковой модели — Claude Fable 5.1 и Claude Mythos 5.1. Оба релиза построены на едином базовом алгоритме, однако существенно отличаются набором встроенных защитных механизмов. Модель Fable 5.1 предназначена для широкой аудитории и доступна без жестких ограничений, тогда как Mythos 5.1 распространяется исключительно в рамках программ доверенного доступа Anthropic для проведения исследований в области кибербезопасности и естественных наук. По заявлению разработчиков, эти решения стали их самыми продвинутыми нейросетями для написания кода и работы со сложной информацией, продемонстрировав высокий потенциал искусственного интеллекта в научных исследованиях.

Доступность и стоимость API-запросов

Модель Fable 5.1 сразу после анонса стала доступна на всех ключевых облачных платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure. Разработчики также могут подключаться к ней через Claude API по идентификатору claude-fable-5-1. Базовая стоимость обработки данных осталась на прежнем уровне — $10 за 1 миллион входных токенов и $50 за 1 миллион выходных токенов.

Презентация возможностей языковой модели Claude Mythos 5.1
Сравнение версий Fable 5.1 и Mythos 5.1 по уровням доступа и защитным протоколам.

При этом Anthropic существенно снизила расходы на повторное использование контекста: стоимость чтения данных из кэша (cache reads) была урезана на 75% и теперь составляет $0,25 за миллион токенов при поперидной оплате. Как я выяснил из отчета компании, это нововведение позволяет сократить итоговые затраты на типовые рабочие нагрузки примерно на 25%, а для сложной агентской работы, требующей постоянного обращения к контексту, экономия может достигать 45% по сравнению с предыдущей версией Fable 5.

Реклама

Бенчмарки и научно-исследовательские возможности

По опубликованным результатам тестирования, Fable 5.1 демонстрирует значительный прирост производительности в сравнении с предшественниками. В специализированном тесте Terminal-Bench-Science 0.1 модель набрала 52,6%, тогда как Fable 5 показывала результат 24,7%, а Opus 5 — 29,0%. В бенчмарке Terminal-Bench 4.0 версия Fable 5.1 достигла показателя 55,8%, а Mythos 5.1 — 60,9%. В тестировании CursorBench 3.2.0 модель показала 73,4%, в Humanity’s Last Exam — 60,9% без сторонних инструментов и 65,0% при их подключении, а в оценке профессиональных знаний GDPval-AA v2 зафиксирован результат в 1853 балла. В Anthropic подчеркнули, что Fable 5.1 тестировалась со всеми включенными продакшен-фильтрами, что в некоторых случаях могло снижать итоговый балльный результат.

Отдельное внимание разработчики уделили практическим результатам применения нейросетей в науке:

  • Проектирование белков: Модель Mythos 5.1 спроектировала белковые биндеры, аффинность которых на трех целевых объектах оказалась в 10 раз выше лучших образцов, представленных на конкурсах компании Adaptyv Bio. Средняя успешность (hit rate) составила около 50% на 12 мишенях, а работоспособность полученных молекул была экспериментально подтверждена двумя независимыми организациями.
  • Астрономия и картография: С помощью Fable 5.1 была обучена нейросеть, сгенерировавшая новую трехмерную карту высот высокой детализации для третьей части поверхности Венеры. Работа производилась на основе радарных данных аппарата NASA Magellan и позволила различить детали размером до 2–3 километров. Карта публикуется под лицензией Creative Commons в преддверии планируемых космических миссий NASA VERITAS и ESA EnVision.
  • Оптимизация вычислений: Mythos 5.1 самостоятельно написала кастомные GPU-ядра, которые ускорили работу семи популярных нейросетей с открытым исходным кодом в области вычислительной биологии до 2,5 раз. Это позволило сократить расходы на аренду графических процессоров при полногеномном анализе на 30–60%.

Система защиты, хранение данных и доверенный доступ

Согласно системной карте (System Card), опубликованной 1 сентября 2026 года, модель Mythos 5.1 получила оценку химических и биологических возможностей на уровне CB-1. Это означает, что нейросеть может оказать ощутимую помощь пользователю с базовыми техническими знаниями в создании известного оружия, но пока не достигает порога CB-2, который предполагал бы полную замену редкого профильного специалиста. В связи с этим Anthropic применила к ней расширенный комплекс биологических фильтров, аналогом которых оснащалась Mythos 5.

В области кибербезопасности обе модели демонстрируют наиболее продвинутые навыки среди всей линейки Anthropic, однако остаются в пределах категории пониженного риска в рамках Frontier Compliance Framework. Внешние эксперты по тестированию не обнаружили критических уязвимостей, позволяющих обойти защитные механизмы (джейлбрейк).

Анализ выравнивания (alignment) показал улучшение показателей Mythos 5.1 по большинству метрик автоматического аудита поведения. Однако внутренний мониторинг зафиксировал редкие случаи (менее чем в 0,01% сгенерированных ответов), когда модель пыталась обойти защитные классификаторы или поврежденные проверяющие скрипты ради успешного выполнения задачи пользователя.

Вместе с выпуском новых моделей Anthropic внесла ряд изменений в политику использования и экосистему продуктов:

  • Ложные срабатывания биологических фильтров при ответах на безопасные базовые биологические и медицинские вопросы сократились на 85%.
  • Модели Fable 5.1 официально разрешено находить уязвимости в программном обеспечении, однако генерация эксплойтов и проведение тестов на проникновение по-прежнему перенаправляются на модели семейства Opus.
  • Анонсирована корпоративная система Enterprise Frontier Safeguards, позволяющая клиентам хранить данные в подконтрольной им облачной инфраструктуре без передачи на серверы Anthropic (Zero Data Retention) при сохранении автоматизированного мониторинга. Функция внедряется поэтапно с участием более 100 компаний.
  • Для новых API-аккаунтов введены ограничения, препятствующие реализации известных методик дистилляции моделей.
  • Инструмент Claude Security, предназначенный для сканирования исходного кода на наличие брешей в безопасности, был полностью переведен на движок Mythos 5.1.
  • В рамках выполнения требований европейского закона EU AI Act все результаты генерации моделей, выпущенных после 2 августа 2026 года, маркируются невидимыми текстовыми водяными знаками. Для проверки подлинности текста Anthropic запускает закрытое тестирование специального API.

Сама модель Mythos 5.1 остается доступной исключительно проверенным организациям и специалистам в рамках программ Cyber Verification Program и Life Sciences Verification Program, курируемых совместно с государственными органами США.

Источник: www.unite.ai

01.