ИИ будет читать мысли? Исследователи нашли способ улучшить взаимопонимание между людьми и LLM

ШІ читатиме думки? Дослідники знайшли спосіб покращити розуміння між людьми та LLM

Исследователи из Корейского института передовых наук и технологий (KAIST) совместно с Microsoft Research Asia создали интерфейс мозг-компьютер Neural Value Alignment (NVA). 

Система использует ЭЭГ для выявления различных реакций мозга, возникающих, когда человек видит, что ИИ что-то делает не так. Эти сигналы могут использоваться в качестве обратной связи, чтобы помочь моделям выявлять ошибочные действия и корректировать выполнение задачи.

Для успешного взаимодействия между людьми и ИИ необходимо, чтобы модели точно понимали, к чему именно стремятся люди и чего конкретно они хотят от искусственного интеллекта. Современные системы в основном делают выводы на основе наблюдений, включая подсказки, речь, действия и жесты. Однако поведение людей может быть довольно неоднозначным и непонятным даже для других людей, не говоря уже об ИИ.

По словам исследователей, одно и то же действие может преследовать разные цели, тогда как одна цель может быть достигнута разными способами. Например, вы берете чашку и можете планировать выпить из нее напиток, просто помыть ее, перенести или отдать другому человеку. Это создает ситуацию, которую команда исследователей называет неоднозначностью соотношения цели и действия: наблюдение за самим лишь действием не обязательно раскрывает ни истинную цель, ни желаемый способ её достижения.

Исследователи стремились перестать полагаться только на физические запросы человека, возникающие в результате определенных действий или подсказок. Вместо этого ИИ мог бы получать информацию прямо из мозга человека. Человеческий мозг постоянно пытается предсказать будущие действия.

Когда результат не совпадает с прогнозируемым, мозг издает характерные нейронные реакции, на которых и сосредоточились исследователи. Речь идет об ошибке прогнозирования вознаграждения (RPE) и ошибку прогнозирования состояния (SPE).

Ошибка прогнозирования вознаграждения отражает несоответствие между результатом и целью в системе Neural Value Alignment может свидетельствовать о неверном понимании со стороны ИИ. Например, если в ответ на просьбу принести что-нибудь выпить домашний робот приносит кофе вместо воды.

Ошибка прогнозирования состояния отражает действия ИИ, которые отличаются от того, чего ожидал человек. Например, вы хотите воды, и робот правильно это понимает. Но вместо того, чтобы взять бутылку воды, стоящую рядом с вами, он идет на кухню и наполняет стакан водой из-под крана.

По результатам испытаний были получены различные паттерны мозговых волн в зависимости от того, была ли допущена ошибка прогнозирования вознаграждения, ошибка прогнозирования состояния или обе ошибки одновременно. Исследователи применили глубокое обучение к полученным сигналам ЭЭГ. Это позволило системе определить реакцию человека на поведение ИИ.

ШІ читатиме думки? Дослідники знайшли спосіб покращити розуміння між людьми та LLM
IEEE Transactions on Cybernetics

Исследователи реализовали систему на основе «алгоритма синергии человека и ИИ, основанного на согласовании ценностей на нейронном уровне». Он использует декодированные нейронные сигналы в качестве обратной связи для принятия решений ИИ.

Результаты исследования были опубликованы в журнале IEEE Transactions on Cybernetics

Источник: KAIST; New Atlas

Источник материала
loader
loader