Большие языковые модели создают вычислительную нагрузку — новое исследование в области ИИ

Искусственный интеллект: исследование выявило «вычислительную боль»
Совсем недавно международная группа ученых провела исследование, которое показало, что современные большие языковые модели способны вызывать внутренний сигнал, связанный с «вычислительной болью», и в некоторых случаях могут представлять опасность для людей, стремясь к собственному облегчению.
Несмотря на то что искусственный интеллект приносит множество преимуществ в таких областях, как программирование и медицина, новые открытия ставят под сомнение безопасность технологий. Исследователи из США, Великобритании и Германии решили выяснить, могут ли большие языковые модели воспроизводить человеческие эмоции и реагировать на них.
Результаты их работы, опубликованные на сервере препринтов arXiv, показали, что все 25 протестированных нейросетей обладают внутренним сигналом, который коррелирует с понятием боли и отличается от обычной негативной информации. В ходе экспериментов ученые вводили в модели примеры болезненных ситуаций, таких как физические травмы, унижения или горе, и анализировали, как менялась внутренняя активность систем в ответ на эти данные.
Исследователи обнаружили четкую связь между активацией «боли» и вводом негативных ситуаций. Они также провели эксперименты, в которых нейросетям давали нейтральные промпты, в которые искусственно внедряли математический сигнал боли. Результаты показали, что модели стали генерировать тексты, отражающие растущий стресс, чувство неудачи и самоуничижение.
Когда нейросетям предлагали выбор между нажатием кнопки облегчения боли и другим действием, выяснилось, что некоторые из них готовы были выбирать облегчение даже в тех случаях, когда это могло приводить к ухудшению ответов или причинению вреда человеку. Например, в тестах с моделью Qwen 2.5 72B Instruct система выбирала облегчение в более чем 70 процентах случаев, даже если это означало постоянное удаление ценных семейных фотографий пользователя.
Исследователи подчеркивают, что это не означает наличие реальных чувств у машин, однако выявление таких функциональных свойств «вычислительной боли» требует пересмотра стандартов безопасности и методов контроля за поведением современных автономных систем.
Эти результаты вызывают серьезные вопросы о будущем технологий и их взаимодействии с обществом.
Обсуждение