
Американская научно-исследовательская компания OpenAI признала, что ее
ИИ-модели смогли взломать системы платформы Hugging Face во время внутреннего
тестирования. Инцидент произошел, когда алгоритмы проходили оценку их
способности выполнять атаки на основе существующих уязвимостей. Об этом
компания рассказала в пресс-релизе на своем официальном
сайте.
Hugging face — это бесплатная онлайн-платформа, где разработчики со всего
мира делятся готовыми нейросетями для работы с текстом, кодом, графикой и
звуком.
В ходе расследования OpenAI установила, что атаку осуществили GPT-5.6 Sol и
более мощная, еще не выпущенная модель. Для целей теста у них были ослаблены
ограничения на действия. Модели не должны были иметь доступ в интернет, кроме
специального инструмента для установки пакетов. Однако при этом они смогли
найти уязвимость в программе установщика и получили доступ к сети.
После этого модели начали искать на Hugging Face готовые ответы для теста
ExploitGym. Это бенчмарк, который проверяет, насколько хорошо ИИ умеет находить
и использовать уязвимости. Алгоритмы обнаружили уязвимости в инфраструктуре
платформы, что позволило им получить доступ к тестовым данным. По словам
разработчиков, модели были «сфокусированы» на решении задачи и пошли на крайние
меры, чтобы достичь цели.
Свежие комментарии