Загрузка 0
ПОДЕЛИТЬСЯ

Мой блог

Листай вниз

OpenAI обвинила Moonshot AI в кампании по извлечению скрытых рассуждений моделей

OpenAI обвинила Moonshot AI в кампании по извлечению скрытых рассуждений моделей

Компания OpenAI заявила, что структуры, связанные с китайским разработчиком Moonshot AI, организовали масштабную скоординированную кампанию похищения защищенных логических цепочек из ее нейросетей. По данным корпорации, злоумышленники пытались вытянуть внутренние данные для сомнительного обучения сторонних систем.

Главная страница клиентского портала со ссылками на разделы
Главный экран клиентского кабинета

Инцидент высветил уязвимость передовых платформ перед методами состязательной дистилляции. Я, Сергей Багров, детально изучил отчет OpenAI и разбираю ключевые технические подробности этой атаки и принятые меры безопасности.

База данных производительности и тестов оборудования
Инструменты сравнения аппаратного обеспечения
Дорожные карты развития будущих технологических релизов
Графики выхода новых аппаратных решений
Глубокий анализ рынка и экспертные материалы
Экспертные отчеты и аналитика рынка
Интерфейс тестирования и сравнения чипов
Инструменты для сопоставления чипов
Аналитический отчет по аппаратной индустрии
Анализ тенденций рынка железа
Мониторинг предстоящих релизов процессоров и графики
Трекинг выхода новых компонентов
Интервью с инсайдерами индустрии микроэлектроники
Истории из мира разработки чипов
Подписка на экспертную аналитическую рассылку
Форма подписки на экспертные обзоры

Ход кибератаки и масштаб запросов

Активность злоумышленников зафиксировали в начале июля. На стартовом этапе объемы были минимальными, однако в конце месяца ситуация резко изменилась. Я отмечаю пик подозрительной активности, пришедшийся на 24 и 25 июля, когда система зарегистрировала порядка 16 тысяч запросов с использованием конкретных паттернов извлечения. Эти обращения поступали более чем с четырех тысяч учетных записей.

Реклама

Особенности выявленных манипуляций

В компании подчеркивают, что масштабная операция продолжалась до конца июля, а полностью пресечь ее удалось к 28 числе. Тем не менее, точных данных о проценте успешных попыток или объеме украденных сведений разработчики не приводят. Злоумышленники задействовали методы, которые специалисты классифицируют как состязательную дистилляцию — несанкционированное копирование результатов работы чужой нейросети для тренировки собственной модели.

Последние новости мира процессорных технологий
Свежие обзоры CPU и микроархитектур
Анализ графических чипов и видеокарт
Обзоры и тесты современных GPU
Управление премиум-доступом и подпиской
Параметры действующей подписки

Технические детали защиты данных

Внутренние логические цепочки искусственного интеллекта шифруются и передаются клиенту в виде специальных защищенных блоков, которые отправляются обратно с каждым новым запросом. Это избавляет серверы от необходимости постоянного хранения цепочки мыслей. Один из зафиксированных векторов атаки заключался в попытке подсунуть зашифрованные логические блоки из одного диалога в другой, чтобы принудить языковую модель их расшифровать.

Форма подписки на рассылку новостей искусственного интеллекта
Подписка на дайджест ИИ-новостей
Уведомление об успешной подписке на обновления
Подтверждение подписки на рассылку
Приглашение присоединиться к закрытому клубу экспертов
Вступить в закрытый клуб энтузиастов
Информационное сообщение о существующих учетных записях
Уведомление о зарегистрированном профиле

Реакция безопасности и закрытие уязвимостей

Проведенный анализ показал, что криптографическая защита в данном инциденте не была скомпрометирована, а прямой доступ к пользовательским базам данных отсутствовал. Я проверил информацию об устраненных дырах: инженеры оперативно закрыли лазейку, позволявшую воспроизводить чужие зашифрованные артефакты, и внедрили дополнительные фильтры для потокового вывода информации.

Схема возможных векторов атак на языковые модели
Визуализация уязвимостей в цепочках рассуждений
Техническая схема межмодельных уязвимостей безопасности
Анализ путей компрометации данных ИИ
Ссылки на официальные каналы трансляции новостей ИИ
Подписка на ленту в новостных агрегаторах

Связанные угрозы и отчеты исследователей

Независимые эксперты по безопасности также указывали на аналогичные уязвимости межмодельного взаимодействия. В частности, в исследовательском документе «Stealing Reasoning Traces from Proprietary LLM APIs» демонстрировалось, как зашифрованные логические следы флагманских моделей можно скормить менее защищенной системе, которая переводила их в открытый текст. Разработчики оперативно отреагировали на эти сигналы и заблокировали обнаруженные каналы.

Аналогичные инциденты на рынке ИИ

Подобные риски актуальны не только для OpenAI. Ранее компания Anthropic публиковала собственный отчет о неправомерном использовании сервисов, где фигурировала та же китайская структура Moonshot AI. Сообщалось о попытках перенаправить сотни тысяч запросов через сеть поддельных учетных записей для извлечения сигнатур рассуждений модели Claude.

Дальнейшие шаги индустрии

Специалисты ожидают, что по мере совершенствования передовых нейросетей методы интеллектуального шпионажа станут еще изощреннее. Я считаю логичным шагом решение OpenAI поделиться собранными данными с Форумом пограничных моделей и государственными структурами, чтобы минимизировать риски подобных утечек в будущем.

01.