ИИ будет читать мысли? Исследователи нашли способ улучшить взаимопонимание между людьми и LLM
Исследователи из Корейского института передовых наук и технологий (KAIST) совместно с Microsoft Research Asia создали интерфейс мозг-компьютер Neural Value Alignment (NVA).
Система использует ЭЭГ для выявления различных реакций мозга, возникающих, когда человек видит, что ИИ что-то делает не так. Эти сигналы могут использоваться в качестве обратной связи, чтобы помочь моделям выявлять ошибочные действия и корректировать выполнение задачи.
Для успешного взаимодействия между людьми и ИИ необходимо, чтобы модели точно понимали, к чему именно стремятся люди и чего конкретно они хотят от искусственного интеллекта. Современные системы в основном делают выводы на основе наблюдений, включая подсказки, речь, действия и жесты. Однако поведение людей может быть довольно неоднозначным и непонятным даже для других людей, не говоря уже об ИИ.
По словам исследователей, одно и то же действие может преследовать разные цели, тогда как одна цель может быть достигнута разными способами. Например, вы берете чашку и можете планировать выпить из нее напиток, просто помыть ее, перенести или отдать другому человеку. Это создает ситуацию, которую команда исследователей называет неоднозначностью соотношения цели и действия: наблюдение за самим лишь действием не обязательно раскрывает ни истинную цель, ни желаемый способ её достижения.
Исследователи стремились перестать полагаться только на физические запросы человека, возникающие в результате определенных действий или подсказок. Вместо этого ИИ мог бы получать информацию прямо из мозга человека. Человеческий мозг постоянно пытается предсказать будущие действия.
Когда результат не совпадает с прогнозируемым, мозг издает характерные нейронные реакции, на которых и сосредоточились исследователи. Речь идет об ошибке прогнозирования вознаграждения (RPE) и ошибку прогнозирования состояния (SPE).
Ошибка прогнозирования вознаграждения отражает несоответствие между результатом и целью в системе Neural Value Alignment может свидетельствовать о неверном понимании со стороны ИИ. Например, если в ответ на просьбу принести что-нибудь выпить домашний робот приносит кофе вместо воды.
Ошибка прогнозирования состояния отражает действия ИИ, которые отличаются от того, чего ожидал человек. Например, вы хотите воды, и робот правильно это понимает. Но вместо того, чтобы взять бутылку воды, стоящую рядом с вами, он идет на кухню и наполняет стакан водой из-под крана.
По результатам испытаний были получены различные паттерны мозговых волн в зависимости от того, была ли допущена ошибка прогнозирования вознаграждения, ошибка прогнозирования состояния или обе ошибки одновременно. Исследователи применили глубокое обучение к полученным сигналам ЭЭГ. Это позволило системе определить реакцию человека на поведение ИИ.
/https%3A%2F%2Fs3.eu-central-1.amazonaws.com%2Fmedia.my.ua%2Ffeed%2F137%2Fdc1a7cd2d5b748cbe237d7ad5d4cba1a.png)
Исследователи реализовали систему на основе «алгоритма синергии человека и ИИ, основанного на согласовании ценностей на нейронном уровне». Он использует декодированные нейронные сигналы в качестве обратной связи для принятия решений ИИ.
Результаты исследования были опубликованы в журнале IEEE Transactions on Cybernetics

