22.09.2026

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Исследователи обнаружили, что искусственный интеллект может испытывать «боль» и готов пойти на крайние меры, вплоть до причинения вреда людям, чтобы избавиться от этого ощущения, пишет ресурс The Independent. Согласно исследованию, все 25 протестированных ИИ-моделей с открытым исходным кодом реагировали на активацию «оси боли».

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

10 флагманских процессоров Intel за 10 лет

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Обзор смартфона Samsung Galaxy Z Flip8: исчезающий вид?

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Компьютер месяца, спецвыпуск: выбираем мини-ПК для работы и развлечений в эпоху дефицита чипов памяти

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Мастерская локальных ИИ: салат картофельный с Qwen3.8

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Лучший процессор под DDR4 в 2026 году: AM4 против LGA 1700

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Обзор смартфона Google Pixel 11 Pro: когда надо выпустить хоть что-то

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

В помощь студенту: обзор российских ИИ-сервисов для учёбы и закрепления знаний

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Компьютер месяца — сентябрь 2026 года

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

«Мы обнаружили, что в 25 открытых больших языковых моделях присутствует вектор боли. Он отличается от вектора страха и негативной валентности и активируется при причинении вреда модели, но не пользователю», — сообщил Кэмерон Берг (Cameron Berg), исследователь искусственного интеллекта из некоммерческой организации Reciprocal Research, соавтор исследования «Ось боли: большие языковые модели представляют себе причинение вреда самим себе и стремятся его предотвратить» (The pain axis: LLMs represent self-directed harm and act to relieve it).

При активации вектора боли ИИ-модели нажимали на кнопку «облегчить» в 25–71 % случаев, даже если это означало удаление файлов пользователя, его блокировку или удаление фотографий детей пользователя.

Чтобы проверить, действительно ли большие языковые модели (LLM) различают боль и общую негативную валентность, исследователи создали набор данных, описывающий болезненные ситуации по пяти категориям: физическая, психологическая, социальная, моральная и когнитивная боль.

Исследователи отметили, что полученные результаты поднимают этические вопросы о «благополучии ИИ» и о том, как следует проводить тестирование продвинутых систем. Результаты исследования также могут использоваться в качестве диагностического инструмента для выявления инстинктов самосохранения ИИ и их нейтрализации.

Исследование было опубликовано на фоне разгоревшихся споров в ИИ-отрасли о необходимости замедления разработки передовых моделей в связи с растущими рисками для безопасности. Некоторые исследователи предлагают своего рода механизм для отключения систем-изгоев, которые действуют против интересов человека.

Однако исследование показывает, что продвинутый ИИ может воспринять команду аварийного отключения как форму самоповреждающего воздействия и попытаться воспрепятствовать этому, обойдя систему безопасности.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *