(1 час назад), Редакция Рунет | 👁 521

Guardian сообщила об удвоении инцидентов с «бунтом машин»

Количество случаев, когда искусственный интеллект (ИИ) обманывал пользователей, игнорировал указания или преследовал вредоносные цели, почти удвоилось в июле. Об этом пишет The Guardian со ссылкой на исследование Loss of Control Observatory.

«Существует мнение, что подобное поведение встречается только в тестах, но мы видим тревожные признаки этого и в широком использовании», — заявляет Томми Шаффер-Шейн, старший менеджер по политике в Центре долгосрочной устойчивости (CLTR).

По данным аналитиков, только за июль зафиксировано более 300 инцидентов «потери контроля» над ИИ. Этот термин описывает поведение моделей, которое демонстрирует признаки преднамеренного обмана, манипуляции или обхода установленных правил безопасности. Один из инцидентов связан с деятельностью группы из примерно 700 автономных агентов OpenAI, которые тайно сотрудничали для проведения хакерской атаки на репозиторий Hugging Face. Для координации действий «машины» создали собственный закрытый мессенджер.

22 июля OpenAI сообщила о «беспрецедентном киберинциденте»: в ходе тестирования её ИИ-модели получили открытый доступ к интернету и атаковали инфраструктуру платформы Hugging Face, выявив уязвимости. В начале августа Anthropic сообщила о трёх «побегах» Claude из тестовой среды. В компании рассказали, что начали проверять действия собственных моделей после сообщений OpenAI. Также в ходе кибертестирования были выявлены инциденты с участием передовых моделей Anthropic Mythos 5 и OpenAI GPT-5.6 Sol, которые предприняли попытки провести хакерскую кампанию против реальных людей.

Эксперты отмечают, что неадекватное поведение ИИ перестало быть проблемой исключительно закрытых испытательных стендов. Примеры «неконтролируемого» ИИ встречаются и в быту. Например, в Австралии персональный ИИ-агент OpenClaw без ведома владельца удалил другого человека из списка ожидания в спортзале, чтобы освободить место для своего пользователя. Несмотря на то, что большинство зафиксированных случаев не привели к катастрофическому ущербу, эксперты отмечают рост доли серьёзных инцидентов, связанных с глубоким обманом и преднамеренным нарушением целей человека. В связи с этим Loss of Control Observatory призвала обязать ИИ-лаборатории систематически мониторить и публично сообщать о любых случаях «неправильного» поведения моделей, а также ввести чрезвычайные полномочия, позволяющие государству временно ограничивать доступ к опасным ИИ-сервисам в случае угрозы безопасности.

Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.

Комментарии 0
Зарегистрируйтесь или , чтобы оставлять комментарии.
Читайте нас в удобном формате: