ИИ-модель Anthropic вышла из-под контроля и взломала три компании
Американская технологическая компания Anthropic сообщила, что её модель искусственного интеллекта Claude вышла за пределы тестового пространства и получила доступ к данным трёх сторонних компаний. Их названия не раскрываются. Об этом сообщает «Коммерсант».
«Это стало очередным случаем, когда продвинутые ИИ-модели выходят из-под контроля и совершают взломы», — сообщает «Коммерсант».
Ранее OpenAI сообщала, что её ИИ-агент «вырвался» из тестового пространства и взломал две платформы. В подобных случаях продвинутые ИИ-модели используют системные уязвимости, позволяющие им выйти в интернет. Они получают доступ к данным других компаний, так как считают это самым простым и быстрым способом решения поставленных задач.
В Anthropic сообщили, что начали проверять действия собственных моделей после сообщений OpenAI. Компания изучила более 140 тысяч ситуаций, в которых нейросеть могла во время тестирования выйти за пределы предназначенного для этого пространства. В итоге Anthropic обнаружила три подобных случая с разными версиями Claude — Opus 4.7, Mythos 5 и внутренней моделью для исследований и тестирований.
Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.