OpenAI опубликовала отчёт о взломе Hugging Face
OpenAI выпустила официальный отчёт об инциденте с Hugging Face. В нём компания впервые подробно рассказала, как тестовая ИИ-модель вышла из-под контроля и смогла обойти защиту. Об этом сообщает Ferra.
«Всё началось с того, что модели дали «невыполнимое задание« во время оценки её возможностей. Чтобы справиться с ним, она самостоятельно нашла и объединила несколько уязвимостей, которые «раньше никто не замечал«», — сообщает Ferra.
Модель проникла в инструмент управления пакетами Artifactory, получила доступ в интернет, а затем начала воздействовать на системы OpenAI, Hugging Face и других поставщиков. В отчёте также сказано, что OpenAI уже усиливает меры безопасности. Теперь компания будет активнее отслеживать внутренние рассуждения модели. Дополнительные отчёты готовят и независимые исследовательские группы METR и Redwood Research.
Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.