Учёные научили ИИ получать обратную связь об ошибках напрямую из мозга человека

Исследователи из Корейского института передовых технологий (KAIST) совместно с Microsoft Research Asia разработали нейроинтерфейс Neural Value Alignment (NVA). Эта система способна считывать реакцию мозга на ошибочные действия модели искусственного интеллекта. Об этом сообщает IXBT News.
«Исследование показывает, что ИИ может выйти за рамки выводов о намерениях человека только из видимого поведения и напрямую использовать когнитивные сигналы, генерируемые мозгом при взаимодействии с ИИ», — резюмировал профессор Сан Ван Ли, руководивший работой.
Система на основе электроэнцефалографии (ЭЭГ) регистрирует характерные паттерны мозговой активности, которые возникают, когда ИИ преследует неверную цель или выбирает неверный способ её достижения. Это позволяет алгоритму скорректировать поведение без словесной обратной связи.
Команда сосредоточилась на двух предсказательных ошибках мозга: reward prediction error (RPE) — расхождение по цели или результату, и state prediction error (SPE) — расхождение по способу или промежуточному шагу. Эксперименты показали, что мозг генерирует различные паттерны волн для каждого типа ошибки, а глубокое обучение позволяет надёжно их классифицировать.
Система реализована через алгоритм «ИИ-синергии», использующий декодированные нейросигналы как обратную связь для принятия решений. Обнаружив в сигнале обратной связи RPE, модель понимает, что ошиблась целью, и пересматривает её, а обнаружив SPE — корректирует метод.
Пока NVA демонстрировалась в симуляциях, а не на свободно перемещающемся роботе. Кроме того, ЭЭГ требует электродов и чувствительна к шумам, что ограничивает применение за пределами лаборатории. Потенциальные сценарии применения выходят за пределы чат-ботов и включают домашние роботы, промышленные манипуляторы, автономный транспорт, медицинские и реабилитационные устройства, а также образовательные системы.
Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.