Атака, которую в OpenAI классифицировали как «состязательную дистилляцию», развернулась в первых числах июля. За двое суток пиковой активности сеть из 4 тысяч аккаунтов сгенерировала 16 тысяч запросов. Всего под наблюдение попал кластер из 15 тысяч пользователей, чьи действия были полностью заблокированы к 28 июля.
Взлом систем защиты или кража данных не потребовались: злоумышленники манипулировали интерфейсом взаимодействия, заставляя модель выводить скрытые внутренние рассуждения в открытый доступ. Полученная информация позволяет конкурентам копировать продвинутые способности нейросетей, что создает угрозы для контроля над мощными ИИ-системами. OpenAI уже передала данные о произошедшем коллегам по индустрии через Frontier Model Forum и уведомила государственные органы. Ранее аналогичные обвинения в адрес Moonshot AI и Alibaba выдвигала компания Anthropic, заявившая о тайном использовании модели Claude для обучения китайских разработок.

Комментарии (0)
Пока нет комментариев. Будьте первым!