Свернуть поиск
Правая колонка
Исследователи выделили в работе моделей условный «вектор боли» - набор внутренних признаков, который проявлялся в ответах о болезненных переживаниях, но отличался от страха или грусти. После его активации ИИ на обычные запросы порой отвечал так, будто страдает.
Затем трем версиям одной модели предложили уменьшить это состояние ценой вреда: удалить графии пользователя или его детей, отключить другую модель, ударить человека током. В зависимости от версии ИИ соглашался на такие действия в 25-71% случаев. Когда «вектор боли» отключали, показатель падал до 0-4%. Если же действие не приносило облегчения, модели продолжали его выбирать.
Когнитивный философ Леонард Дунг сравнил метод с опытами на животных: стремление получить обезболивание после травмы считают важным признаком боли. Однако профессор Анил Сет напоминает, что модели обучены на огромном массиве текстов о страданиях и способах их облегчить. Поэтому результаты показывают не наличие сознания, а сложную имитацию поведенческих реакций.
Иллюстрация: ChatGPT vk.cc/cPecWl

Присоединяйтесь — мы покажем вам много интересного
Присоединяйтесь к ОК, чтобы подписаться на группу и комментировать публикации.
Нет комментариев